2026-05-20 10:06
谷歌I/O大会宣布Gemini接入沃尔沃新车EX60摄像头,解锁多模态视觉感知
文本核心速览
- Gemini接入EX60摄像头—谷歌I/O大会上宣布,AI助手Gemini将接入沃尔沃纯电SUV EX60的外部摄像头,加速获取视觉与移动感知能力,实现AI大模型与智能汽车硬件的深度融合。
- 原生车载系统是基础—技术实现得益于沃尔沃EX60原生搭载谷歌嵌入式车载系统Android Automotive OS,Gemini可直接调用摄像头数据流,实时感知车辆周边物理环境。
- 首个应用:停车指示牌解读—首个落地场景聚焦泊车痛点,Gemini将为车主精准翻译并解读复杂停车指示牌,包括允许停放时长、许可证准入要求等限制条件。
- 未来多模态车载AI蓝图—谷歌规划未来Gemini可主动识别道路标线、解析交通路牌,并对周边地标或餐厅进行交互式问答,将传统语音助手升级为具备空间感知能力的AI随车管家。
沃尔沃EX60的摄像头,居然成了Gemini的“眼睛”
谷歌在I/O大会上直接扔出一个合作:Gemini将接入沃尔沃即将上市的纯电SUV——EX60的外部摄像头硬件,实时读取停车指示牌。 这意味着Gemini正在加速获取视觉与移动感知能力——AI大模型和智能汽车硬件的融合,终于不再只是PPT上的概念。
技术来自底层系统打通
这次升级能落地,全靠沃尔沃选了谷歌自家的车载系统:Android Automotive OS。 通过打通系统底层权限,Gemini可以直接调用车身外部摄像头的数据流,实时感知车辆周围环境并做出协同。 有开发者试了说,这相当于给了AI一双随时在线的眼睛,不用再通过手机或云端间接传图。
第一个场景:看不懂的停车牌
根据谷歌内部流传的说法,首个落地应用瞄准的是高频泊车痛点:由Gemini帮车主翻译并解读那些复杂的停车指示牌。 什么时间能停、停多久、需要什么许可证——直接看牌就行,不用再猜。 现场有开发者透露,谷歌Android汽车部门副总裁帕特里克·布雷迪(Patrick Brady)在会上表示,Gemini通过深化对驾驶环境的理解,能大幅提升行车便利性。
蓝图:从认牌到认路、认店
在此基础上,谷歌勾勒了更具想象力的车载AI蓝图:
- 未来,具备视觉感知能力的Gemini还能主动识别道路标线、解析交通路牌
- 针对车辆周边地标或餐厅,司机可以直接进行交互式问答
- 系统还会结合上下文,主动告诉你特定区域的允许停放时长、许可证准入要求等限制条件
行业视角:从“副驾助手”到“AI随车管家”
从行业视角看,大模型结合车载摄像头,正在把传统靠图文或语音交互的“副驾助手”,升级成具备空间感知能力的“AI随车管家”。 这也给智能座舱的演进提供了全新的多模态范式——不再只是对话,而是真正看懂你周围的世界。
接下来盯着看的是,Gemini能否真的读懂那些画着箭头和数字的奇葩停车牌,以及这事儿会让传统车载导航和语音助手厂商有多难受。
来源: aibase阅读原文