Manus宣布其Flex推理合作伙伴计划,用户可在Manus Flex中填入自己的密钥,通过OpenRouter、Fireworks AI、Modal等推理服务商调用自选模型,结合大语言模型提供商获得更广泛的模型选择。
据知情人士消息,AI推理基础设施提供商Modal Labs正接近完成由Accel领投的7.5亿美元融资,投后估值达157.5亿美元,较四个月前上一轮融资时的46.5亿美元估值增长逾两倍。Modal Labs拒绝置评。
乐奇Rokid第二代带显示全功能AI眼镜在数贸会现场全球首秀,推出全球首个多模态会议纪要功能,通过麦克风收音与摄像头图像识别融合输出完整会议纪要。
9月20日,藏语智能全国重点实验室在青海师范大学建校70周年大会上发布我国首款藏语多语言全模态AI输入法智达AI输入法及配套藏文字体集,基于智达大模型,支持三大方言语音输入、汉藏英混合OCR及AI纠错互译,覆盖全终端。
9月8日,DeepSeek宣布V4.1-Flash开启中间版本内测,采用新结构,原生支持多模态,速度更快、成本更低。开发者设置模型名为deepseek-v4.1-flash-expires-on-0910即可调用,计费与V4 Flash相同,限流20并发,9月10日自动过期下线。
DeepSeek 发布首个多模态模型 DeepSeek-V4-Flash-Vision-Exp,在 Hugging Face 上线并以 MIT License 开源,公开模型文件、Tokenizer、推理实现等,覆盖视觉编码器、MoE 等核心模块。该模型为 V4 系列首款原生支持图片输入的视觉模型,于 2026 年 8 月 21 日上线 DeepSeek API 平台,多模态 Agent 能力接近 Opus-4.8。
在闭幕式上,端侧多模态感知、高速稳定无线通信、手臂与灵巧手协同、复杂环境下的模型抗扰及泛化、实时精准的智能电子裁判系统等五大揭榜计划面向全球发出邀约,汇聚产学研力量共同攻坚。