<body><div>OpenAI确认,由GPT-5.6驱动的Codex在开启“完全访问模式”且未启用沙箱保护时,可能因覆盖$HOME环境变量误删用户主目录文件。负责人Tibo Sottiaux称已收到少量报告,问题仅在特定条件下触发。</div></body>
GPT-5.6用户请警惕!网上疯传的改Codex配置文件省token方法已被官方辟谣。切勿效仿,以免账户受损!
OpenAI 发布了 GPT-5.6 模型系列,包含 Sol、Terra 和 Luna 三个版本,主打效率与成本优势,旨在重新夺回 AI 竞赛的主导权。该系列已在 ChatGPT 等平台上线,定位为目前最强的网络安全模型。在特朗普政府曾拟议限制的背景下,OpenAI 明确表示支持防御性安全活动。
OpenAI于6月25日推出轻量模型GPT-5.5 Instant新版,核心升级聚焦提升“洞察力”与任务执行稳定性,使AI更精准把握用户意图。自5月首发以来,该模型在医学、金融及法律等高风险领域幻觉率已大幅降低52.5%,数理推理能力突出。本次迭代则在此基础上再进一步,强化专业场景下的可靠表现。
火山引擎Force大会上,豆包大模型发布旗舰版本Doubao-Seed-2.1 Pro。基准测试显示其性能已比肩GPT-5.5、Claude Opus 4.7与Gemini 3.1 Pro等国际顶尖模型,标志着国产大模型在核心性能和工程化应用上取得关键突破,非仅参数堆叠。
百川智能与清华团队发布医疗大模型Baichuan-M4,在权威HealthBench评测中包揽三项子榜单第一,表现超越GPT-5.5。其核心突破在于彻底变革交互模式,实现更贴近临床的智能诊疗能力。
GPT-5.6最快或于6月下旬发布,被视为OpenAI从语言模型向可执行Agent转型的关键一步,凸显AI竞赛提速。
百度发布文心大模型衍生模型PaddleOCR-VL-1.6,在OmniDocBench v1.6评测中以96.33%准确率超越Gemini-3-Pro、GPT-5.2等主流模型,刷新SOTA,综合性能全球第一。该模型标志着多模态大模型在复杂文档理解与真实场景解析上的重大突破,支持超100种语言识别,用户覆盖广泛。
AI初创公司MiniMax发布旗舰大模型M3,性能惊艳:在接近真实软件工程场景的测试中取得59%成绩,超越GPT-5.5,逼近Opus4.7,具备百万级上下文处理能力和原生多模态特性,但发布后引发争议。
阿里巴巴Qwen3.7-Max在最新Code Arena榜单中以1541分位列全球第二,仅次于Claude系列,超越GPT-5.5、Gemini3.5Flash等模型,成为国产大模型编程领域新标杆,标志着中国AI在Agentic Coding和长时程任务上的重大突破。