DeepSeek V4正式版测试视频曝光,或于下周一发布,承接Kimi K3热度。实测性能对标Claude Opus4.8,核心指标惊艳,引发行业关注。
阿里巴巴发布内部通知,要求员工在7月10日前停止使用Anthropic Claude全系产品,包括Sonnet、Opus、Fable等模型以及Claude Code等智能体工具。这一举措与此前公司年初开放AI使用、提供内部模型免费额度并报销外部模型费用的政策形成对比,预示着其在AI工具策略上的收紧与转向。
Anthropic发布新中高阶模型Claude Sonnet 5,主打性价比,性能大幅逼近旗舰Opus系列。该模型具备迄今最强代理能力,可自主规划复杂任务、自查输出,并灵活调用浏览器与终端等外部工具,在推理、编程和知识任务上表现突出。
马斯克宣布Grok4.5模型在SpaceX与特斯拉内部启动Beta测试,基于1.5万亿参数V9模型,训练中融入Cursor编程数据,性能已接近或超越Claude Opus,强化学习仍在优化中。
火山引擎Force大会上,豆包大模型发布旗舰版本Doubao-Seed-2.1 Pro。基准测试显示其性能已比肩GPT-5.5、Claude Opus 4.7与Gemini 3.1 Pro等国际顶尖模型,标志着国产大模型在核心性能和工程化应用上取得关键突破,非仅参数堆叠。
Anthropic发布Claude5系列,含面向大众的Fable5与侧重安全的Mythos5。Fable5是公开市场最强模型,在软件开发、科研分析、视觉识别等领域表现优异,相比前代Opus在长周期任务中处理能力显著提升,同时体现了企业在模型应用边界与安全架构上的深思熟虑。
美国大模型公司Anthropic发布Claude Opus 4.8,虽在多项榜单表现优异,但被曝出认知混乱问题。网友通过API测试发现,该模型在询问身份时,会错误自称是阿里巴巴的“千问(Qwen)”或“DeepSeek”等中国开源大模型,引发关注。