谷歌推出全新 macOS 应用 AI Edge Foresight,向苹果用户展示 EmbeddingGemma 2 端侧多模态模型的能力。该应用可调用 Mac 麦克风与系统音频,结合用户笔记自动整理线上、线下会议纪要,支持完全离线运行与实时问答,兼容 Apple 芯片 Mac,用户可免费下载。
SiFive与AMD在AI Infra Summit上联合展示了RISC-V处理器与AMD Radeon AI PRO R9700显卡系统利用ROCm 10.0运行Google Gemma4-E2B模型的能力,旨在融合开源软件与RISC-V开放标准架构,赋能下一代数据中心AI计算。双方将继续评估基于RISC-V架构服务器的ROCm优化方案,以提升处理速度并支持更大规模模型。
谷歌于2026年6月发布开源语言模型DiffusionGemma,首次将图像AI扩散机制引入文本生成,打破传统逐字自回归范式。该模型从随机噪声迭代优化,并行输出256个词块。经英伟达优化,在单GPU单用户模式下,运行速度比同类传统模型快近四倍,如H100显卡处理单请求时表现显著提升。
谷歌于6月10日发布开源实验模型DiffusionGemma,采用文本扩散架构,在专用GPU上文本生成速度较传统自回归模型最高提升4倍,旨在提升AI生成效率,但官方对此保持谨慎态度。
谷歌发布全新多模态模型Gemma4 12B,颠覆传统架构,取消独立编码器组件,实现消费级硬件上的高效本地部署与推理。这一突破显著降低多模态模型的计算复杂度,提升运行速度,标志着开源大模型生态进入新阶段。
**Gemma4重磅发布:开源模型迎来代际跨越** **开源诚意升级:协议全面拥抱Apache 2.0** 谷歌DeepMind正式发布新一代开源模型系列Gemma4。此次更新最大亮点在于开源协议的彻底开放,将许可证更换为全球通用的Apache 2.0,极大降低了开发者的商用与二次开发门槛。 **规格全覆盖:推出适配全场景的“四剑客”** Gemma4系列包含四款不同规格模型,实现从端侧到服务器的全面覆盖: - **31B Dense(旗舰版)**:310亿全激活参数,支持256K上下文,在Arena AI开源榜位列第三。 - **26B A4B MoE(性价比之王)**:采用混合专家架构,以高效推理性能位列排行榜第六。 - **E4B & E2B(端侧精英)**:专为移动与嵌入式设备深度优化,E2B版本内存占用可低于1.5GB。 **性能狂飙:核心能力实现代际飞跃** 相比前代,Gemma4在多项关键指标上取得突破性进展: - 数学能力(AIME2026测试)从20.8%提升至89.2%。 - 编程能力(Codeforces ELO评分)从110跃升至2150,成为当前最可用的开源编程辅助模型之一。 - 综合推理(GPQA Diamond)得分从42.4%大幅增长至84.3%。 - 原生支持超140种语言,MMMLU评分达88.4%。 **核心特性:集成先进交互与多模态能力** 模型不仅提升参数规模,更引入了旗舰级交互功能: - 内置可开关的“思考模式”,通过内部推理提升复杂任务准确性。 - 原生支持函数调用与结构化JSON输出,并配套开源Agent开发工具包(ADK)。 - 全系列支持图像与视频输入,部分小模型额外集成音频编码器,支持语音识别与翻译。 **行业影响:以极致工程化重塑开源格局** 面对国内开源模型的快速迭代,Gemma4通过极致的端侧工程化与更彻底的开源协议,标志着谷歌正强势回归开源主战场。其旗舰模型在消费级硬件上的流畅运行,有望显著拓宽全球AI开发者的创作边界。
谷歌DeepMind暗示将发布新一代开源大模型Gemma 4,规格大幅升级至120B参数,挑战本地运行极限,试图在全球开源大模型市场夺回话语权。