2026-06-26 09:24
AI 框选即问!谷歌 Chrome 149 携手 Gemini 3.5 Flash 升级截屏交互
文本核心速览
- Chrome 149 集成 Gemini 3.5 Flash—谷歌在 Chrome 149 中原生集成 Gemini 3.5 Flash 模型,推出“从屏幕选择”功能,用户可框选网页局部内容与 AI 即时对话。
- 告别全局上传,精准框选—用户用光标精准勾勒提问区域,选中的图片或文本自动作为附件融入提示词,无需全局上传或切换工具,大幅提升交互效率。
- 覆盖购物、图表、设计三大场景—用户可框选商品分析风格、选取图表获取解释、或选中设计元素进行创意重塑,实现针对性 AI 解答。
- 整合原生计算机操作工具—Gemini 3.5 Flash 模型整合原生计算机操作工具,支持 AI 智能体执行访问网站、填写表单、点击按钮等跨平台复杂任务。
Chrome 149框选屏幕就能让AI分析鞋子风格——不用再切页面了
谷歌在Chrome 149里直接把Gemini 3.5 Flash模型塞进浏览器底层,顺便扔了个叫“从屏幕选择”(Select from screen)的新交互。开发者试了说,现在用户能框选屏幕上的任何局部内容,然后跟AI直接对话——不用再在模型之间来回切,也不用开什么复杂工具。
告别全局上传,精准锁定网页局部
群里在传,Chrome 149的Gemini用光标精准画个框,被圈起来的图片或文字片段会自动变成附件,实时塞进你打的提示词里。这个操作逻辑跟Google Lens很像,但区别是它不会跳转到传统网页搜索结果页,而是直接把选中的局部内容丢进对话式AI架构里,让智能体针对细节给出更精准的答案。
三大场景实测:购物、图表、设计
有开发者试了三个典型场景:
- 购物:在鞋类电商网页上框选几双鞋子的图片,AI直接分析哪双更适合你的运动风格。
- 图表解释:框选一个复杂数据图,AI会一步步解释图上每条线代表什么。
- 设计重塑:选中网页某个设计元素,让AI给出创意修改方案。
同时,Gemini 3.5 Flash模型还整合了原生计算机操作工具,AI智能体能在不同环境里流畅地访问网站、填写长表单、点击按钮、收集数据——这些都是跨平台的复杂任务。
剩下要盯的事
这个功能首先会让截图类插件和传统OCR工具很难受——用户直接在浏览器里框选就能调用AI分析,谁还装第三方截图插件?受益最大的是电商比价网站和设计社区,用户框选商品或设计稿就能得到定制化建议,流量会往这跑。另外,Edge和Arc浏览器也要开始慌了——Chrome这一招直接嵌进系统层,别人要追只能跟OpenAI或Claude再谈原生集成。接下来看谷歌会不会把“从屏幕选择”开放给第三方扩展,如果开放,又是一波插件洗牌。
来源: aibase阅读原文