谷歌发布全新多模态模型Gemma4 12B,颠覆传统架构,取消独立编码器组件,实现消费级硬件上的高效本地部署与推理。这一突破显著降低多模态模型的计算复杂度,提升运行速度,标志着开源大模型生态进入新阶段。
**Gemma4重磅发布:开源模型迎来代际跨越** **开源诚意升级:协议全面拥抱Apache 2.0** 谷歌DeepMind正式发布新一代开源模型系列Gemma4。此次更新最大亮点在于开源协议的彻底开放,将许可证更换为全球通用的Apache 2.0,极大降低了开发者的商用与二次开发门槛。 **规格全覆盖:推出适配全场景的“四剑客”** Gemma4系列包含四款不同规格模型,实现从端侧到服务器的全面覆盖: - **31B Dense(旗舰版)**:310亿全激活参数,支持256K上下文,在Arena AI开源榜位列第三。 - **26B A4B MoE(性价比之王)**:采用混合专家架构,以高效推理性能位列排行榜第六。 - **E4B & E2B(端侧精英)**:专为移动与嵌入式设备深度优化,E2B版本内存占用可低于1.5GB。 **性能狂飙:核心能力实现代际飞跃** 相比前代,Gemma4在多项关键指标上取得突破性进展: - 数学能力(AIME2026测试)从20.8%提升至89.2%。 - 编程能力(Codeforces ELO评分)从110跃升至2150,成为当前最可用的开源编程辅助模型之一。 - 综合推理(GPQA Diamond)得分从42.4%大幅增长至84.3%。 - 原生支持超140种语言,MMMLU评分达88.4%。 **核心特性:集成先进交互与多模态能力** 模型不仅提升参数规模,更引入了旗舰级交互功能: - 内置可开关的“思考模式”,通过内部推理提升复杂任务准确性。 - 原生支持函数调用与结构化JSON输出,并配套开源Agent开发工具包(ADK)。 - 全系列支持图像与视频输入,部分小模型额外集成音频编码器,支持语音识别与翻译。 **行业影响:以极致工程化重塑开源格局** 面对国内开源模型的快速迭代,Gemma4通过极致的端侧工程化与更彻底的开源协议,标志着谷歌正强势回归开源主战场。其旗舰模型在消费级硬件上的流畅运行,有望显著拓宽全球AI开发者的创作边界。