火山引擎发布豆包音频生成模型1.0,支持文本或音频输入,端到端生成完整音频作品。核心突破是单条Prompt即可同步生成对白、音效和背景音乐,无需传统多轨剪辑。该技术大幅简化音频制作流程,让用户像“音频导演”一样高效产出成片级音频,彻底告别手动对齐混音的复杂后期工作。
火山引擎Force大会上,豆包大模型发布旗舰版本Doubao-Seed-2.1 Pro。基准测试显示其性能已比肩GPT-5.5、Claude Opus 4.7与Gemini 3.1 Pro等国际顶尖模型,标志着国产大模型在核心性能和工程化应用上取得关键突破,非仅参数堆叠。
2026年6月23日,火山引擎在夏季FORCE原动力大会上发布豆包视频生成模型Seedance2.5,计划7月上线。该模型实现30秒单段原生视频直出、50个全模态素材联合生成及保持画面一致性的局部编辑三大突破。总裁谭待表示,视频生成是通往世界模型的关键。
针对“豆包AI误判蘑菇致用户中毒”事件,火山引擎团队已联系用户并完成技术核实。结果显示,豆包虽将野生蘑菇识别为“鸡腿菇”,但同时在对话框中明确输出多条高风险预警,指出该品相“极易与剧毒大青褶伞混淆,误食会引发严重后果”。关键点在于系统已履行风险提示义务。
法国戛纳电影节上,字节跳动旗下火山引擎发布视频生成模型Seedance2.0,并展示其在影视制作中的商业化应用。基于该模型制作的8部AI影片亮相,包括美国平台Higgsfield打造的全球首部95分钟AI长片《HELL GRIND》首映,标志生成式AI加速进入主流影视工业。
字节跳动火山引擎4月2日开放Seedance2.0多模态视频生成模型的普通API申请,标志着该模型从限量测试走向广泛开放。该模型支持文字、图片、音频、视频四种输入,能实现角色一致性、导演级镜头控制和物理模拟。