返回新闻列表
2026-08-21 19:29
AI123

DeepSeek上线实验性多模态视觉模型DeepSeek-V4-Flash-Vision-Exp

公司DeepSeekGLM模型

8月21日,DeepSeek在官方API平台正式上线了全新的多模态视觉理解模型——DeepSeek-V4-Flash-Vision-Exp。该模型为实验性质,用户可通过设置参数model='deepseek-v4-flash-vision-exp'进行访问。

在纯文本能力方面,包括Agent、推理、世界知识等维度,DeepSeek-V4-Flash-Vision-Exp与DeepSeek-V4-Flash正式版保持持平。而在需要视觉理解的Agent Benchmark上,该模型相比DeepSeek-V4-Flash实现了大幅跃升,多模态Agent能力已接近Opus-4.8的水平,展现了在视觉与语言融合理解上的显著进步。

来源
  1. 2026-08-24 10:57 | 新浪财经:机构:物理AI的大脑,正处于性能快速跃迁期
    阅读原文

    (来源:财闻) 我们认为,世界模型/机器人(14.270, -0.61, -4.10%)模型作为物理AI的大脑,正处于性能快速跃迁期,而真机实采/仿真/合成数据对于世界模型/机器人模型训练至关重要,成为物理AI当前的瓶颈,需求缺口大。 8月24日,开源证券报告指出,积极关注物理AI、多模态AI、AI剧及AI游戏进展。8月17日,智象未来HiDream.ai发布全球首款原生全模态交互式世界模型HiDream-O1-World,其基于自研原生全模态UiT架构,支持文本、图像、交互等多模态输入,可生成具备长时空一致性和物理一致性的动态世界,用户既能以第...

  2. 2026-08-22 01:53 | 新浪财经:DeepSeek发布实验性视觉理解模型 挑战Anthropic的Opus 4.8
    阅读原文

    DeepSeek推出一款能够理解视觉提示的实验性人工智能(AI)模型,表示该工具的性能逼近美国竞争对手Anthropic PBC的一款高阶模型。这家总部位于杭州的公司8月21日表示,新发布的是DeepSeek旗舰纯文本模型V4 Flash的实验版本,新增了多模态能力,这意味着它还可以分析图像和屏幕截图等视觉提示并采取行动。“这款实验性多模态模型在文本能力方面与DeepSeek-V4-Flash相当 —— 包括智能体、推理和世界知识,”该公司在X上写道。DeepSeek表示,在多模态智能体能力测试中,该模型的表现“接近”Anthropic的高阶模型Opus 4.8。多模态智能体能力是指模型无需持...

  3. 2026-08-22 01:03 | 界面新闻:AI早报 | 马斯克否认SpaceX拟收购价值60亿美元频谱资源;阿里财报会披露Accio已超5万付费商家
    阅读原文

    阿里财报会披露Accio已超5万付费商家 8月20日,阿里发布2027财年第一季度财报。分析师会议上披露,面向跨境电商商家推出的AI智能体Accio Work上线后,已有超过5万付费商家在使用。 博通据悉寻求在最新一轮AI债务融资中筹集逾600亿美元 当地时间8月20日,据报道,知情人士透露,博通公司正与一组贷款机构洽谈,计划通过债务融资筹集超过600亿美元,用于一项AI芯片融资交易,该交易将使Anthropic等公司受益。部分知情人士表示,该笔融资方案仍在敲定中,可能还包括约300亿美元的次级债务部分。 Anthropic据悉拟将花旗集团纳入大型IPO承销银行名单 当地时间8月20...

  4. 2026-08-22 01:01 | 爱范儿:早报|摄像头AirPods或配备拍摄指示灯/问界儿童车售价1.58万元/LV否认「起诉国家知识产权局遭驳回」
    阅读原文

    🎨 GPT Image 2 API 开始预览透明背景生成 🤖 DeepSeek 上线 V4-Flash-Vision-Exp 多模态视觉理解模型 ⚠️ 9 家车企因应急机械拉手隐患召回约 427.6 万辆汽车 ☁️ 阿里二季度重组电商与 AI 业务架构 💻 腾讯芯片负责人高剑林被曝离职创业,瞄准 RISC-V AI CPU 📋 旺旺被曝启动裁员,并要求员工提交自评报告 🛍️ LV 否认「起诉国家知识产权局遭驳回」 💰 泡泡玛特拟在半年内回购股份 🚀 奇瑞旗下 AiMOGA 筹备 IPO,明年目标交付 1 万台机器人 💻 AMD x86 客户端...

  5. 2026-08-21 20:58 | user.guancha.cn:1分钱9张图!DeepSeek视觉模型连夜实测
    阅读原文

    Jay 发自 凹非寺  量子位 | 公众号 QbitAI  家人们,鲸鱼开眼了!  等了四个月,DeepSeek的多模态模型:deepseek-v4-flash-vision-exp,终于发布。  我也是第一时间赶到现场,连夜开始实测。  相比V4 Flash最大的不同,就是支持原生支持图片输入了,但图片生成当然还是没有的。  基础识图能力实测下来,和一直在内测的网页版差不多,感觉就是同一个模型。  但在Agent任务上,「眼睛」确实可谓是超强的装备了。  先看,纯文本能力(Agent、推理、世界知识等),DeepSeek-V4-Flash-Vision-Exp与DeepSeek-V4-Fla...

  6. 2026-08-21 12:42 | 澎湃新闻:DeepSeek继续上新!多模态模型发布,能力已接近Opus 4.8
    阅读原文

    国产大模型厂商DeepSeek推出了一款面向Agent(智能体)时代的多模态模型。8月21日,DeepSeek宣布全新的多模态视觉理解模型V4-Flash-Vision-Exp上线DeepSeek API平台,开启多模态API服务。据介绍,V4-Flash-Vision-Exp是一个实验性质的模型,在纯文本能力(Agent、推理、世界知识等)方面,DeepSeek-V4-Flash-Vision-Exp 与 DeepSeek-V4-Flash正式版持平;在需要视觉理解的Agent Benchmark上,DeepSeek-V4-Flash-Vision-Exp相比 DeepSeek-V4-Fla...

  7. 2026-08-21 10:25 | 爱范儿:突发| DeepSeek 多模态模型上新,鲸鱼终于开「天眼」了
    阅读原文

    DeepSeek 终于「开眼」了。 就在刚刚,DeepSeek 推出了一款面向 Agent 时代的多模态模型:deepseek-v4-flash-vision-exp。 目前,该模型已经上线 DeepSeek API 平台上,用户可以通过设置 model=’deepseek-v4-flash-vision-exp’ 访问该模型。 官方介绍,这是一个实验性质的模型。该模型在保持 DeepSeek-V4-Flash 文本能力的基础上,新增视觉理解能力,可以处理图片输入,并进一步提升多模态 Agent 任务表现。 与此同时,DeepSeek Harness 0.1.1 版本也加入了对该模型的原生支...

  8. 2026-08-21 09:32 | 界面新闻:DeepSeek-V4-Flash-Vision-Exp上线,开启多模态API服务
    阅读原文

    8月21日,全新的多模态视觉理解模型DeepSeek-V4-Flash-Vision-Exp上线DeepSeek API平台,这是一个实验性质的模型,用户可以通过设置model='deepseek-v4-flash-vision-exp'访问该模型。在纯文本能力(Agent、推理、世界知识等)方面,DeepSeek-V4-Flash-Vision-Exp与DeepSeek-V4-Flash正式版持平;在需要视觉理解的AgentBenchmark上,DeepSeek-V4-Flash-Vision-Exp相比DeepSeek-V4-Flash实现了大幅跃升,多模态Agent能力已接近Opus-4...

  9. 2026-08-21 09:28 | 华尔街见闻:DeepSeek新一代多模态模型上线,性能接近Opus-4.8
    阅读原文

    李佳 08-21 17:28 更多消息,持续更新中 DeepSeek-V4-Flash-Vision-Exp 在 DeepSeek API 平台上正式上线。该模型在文本能力上与 DeepSeek-V4-Flash 持平,涵盖agent、推理和世界知识等领域。在多模态智能体基准测试中,V4-Flash-Vision-Exp 相较 V4-Flash 实现了重大跃升,使多模态智能体性能接近 Opus-4.8。 风险提示及免责条款 市场有风险,投资需谨慎。本文不构成个人投资建议,也未考虑到个别用户特殊的投资目标、财务状况或需要。用户应考虑本文中的任何意见、...

  10. 2026-08-21 09:21 | IT之家:DeepSeek V4-Flash-Vision-Exp 上线:开启多模态 API 服务,Agent 能力接近 Opus-4.8
    阅读原文

    IT之家 8 月 21 日消息,深度求索官方刚刚宣布全新的多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp 上线 DeepSeek API 平台。该模型支持在文本之外输入图片,可以让模型描述图片、识别截图中的文字、分析图表等。支持的图片格式包括 JPEG、PNG、GIF、WebP。深度求索官方表示,V4-Flash-Vision-Exp 在各类 Agent 框架内展现出了较好的多模态适配能力,能够有效支持大家借助多样化的 Agent 工具解锁更多实用的工作场景。IT之家提醒:这是一个实验性质的模型,用户可以通过设置 model='deepseek-v4-flash-...

  11. 2026-08-20 22:24 | 36氪:刚刚,多模态版DeepSeek“长眼”了,1000张图只要1块钱
    阅读原文

    刚刚,DeepSeek首个多模态API模型正式上线! 名字叫DeepSeek-V4-Flash-Vision-Exp,API现在就能调。 更狠的是,一张图片最多占384个token,计费价格与V4-Flash完全一致。 在别家要单独算钱的多模态能力,在DeepSeek这里直接变成了赠品。 而且,还是满配版的。 V4-Flash,现在有眼睛了! 纯文本方面,加了视觉的V4-Flash-Vision-Exp反而更强了。 在七项Agent评测里,有六项都超过了V4-Flash-0731。 多模态方面,更是一度干掉了硅谷顶流模型。 有了如此强大的能力,对开发者...

  12. 2026-08-20 21:51 | 36氪:DeepSeek终于长出“眼睛”,V4 Flash视觉模型上线
    阅读原文

    8月21日下午,DeepSeek官方API文档的“模型细节”页面出现一个新的模型:deepseek-v4-flash-vision-exp,模型版本标注为 DeepSeek-V4-Flash-Vision-Exp。 从官方页面披露的信息看,这是DeepSeek V4系列首个直接支持图片输入的视觉模型。它拥有1M上下文,最大输出长度384K,支持JSON Output、Tool Calls、Responses API、Anthropic API以及对话前缀续写,图片将按照尺寸折算成Token,与文本Token一同计费。 V4 Flash Vision Exp目前显示的API价格与Flas...

其他新闻

查看全部