2026-05-21 10:50
苹果发布 AI 辅助功能升级:Apple Intelligence 赋能无障碍生态,Vision Pro 实现眼控轮椅
文本核心速览
- 苹果发布AI辅助功能升级—5月19日,苹果推出由Apple Intelligence驱动的全新AI辅助功能,并借助Vision Pro实现眼控轮椅,标志着无障碍技术的重大突破,深度融合端侧AI技术保护隐私。
- “旁白”图像浏览器AI增强—“旁白”依托AI对账单、照片等视觉内容进行更细腻描述,用户可通过“操作”按钮对相机取景器进行多轮自然语言提问,同时“放大器”也支持语音控制与快速问答。
- 语音控制引入自然语言识别—全新“语音控制”摆脱记忆精确指令的束缚,用户能以口语化描述自然操控屏幕控件,显著提升交互便捷性与直观性。
- 辅助功能阅读器与自动字幕—更智能的“辅助功能阅读器”可解析多栏、表格等复杂文献,提供按需摘要与内置翻译;基于端侧语音识别的“自动生成字幕”实现全平台实时私密转录。
- Vision Pro实现眼控轮椅—Apple Vision Pro联合Tolt和LUCI替代驱动系统,凭借高精度眼动追踪,在美国率先推出无需频繁校准的电动轮椅眼控功能。
Apple Vision Pro 眼控轮椅直接上市,免校准就能用
5月19日,苹果把 Apple Intelligence 驱动的整套AI辅助功能塞进了全系统,结果连电动轮椅都能用眼睛控制了——Tolt 和 LUCI 两家替代驱动系统直接接入,在美国率先上线,群里在传“轮椅用户再也不用频繁校准眼球追踪”。
眼控轮椅怎么来的
- Apple Vision Pro 的高精度眼动追踪系统 + Tolt/LUCI 的驱动硬件,做到了 无需频繁校准 的实时控制。
- 开发者试着用了一下说:“视线扫到哪,轮椅就转到哪,反应比想象中快”。
旁白和放大器的新玩法
- “旁白”图像浏览器现在靠AI能描述 账单、照片 这类复杂视觉内容,还能通过“操作”按钮对相机取景器里的东西 连续发问(比如“这张收据的总金额是多少?”)。
- “放大器”同步支持 语音控制 和 快速问答,有用户说“对着它喊一句‘放大左边那行字’就能识别出来”。
语音控制不用背指令了
- 以前的语音控制必须记精准指令(比如“点击右上角返回按钮”),现在引入 自然语言识别,直接说“帮我关掉这个弹窗”就能看懂上下文。
- 群里在传:“这玩意儿终于不用背快捷指令了,说人话就行”。
阅读器和字幕自己干活
- “辅助功能阅读器”能高效解析 多栏、表格 这些复杂科学文献,还加了两项实打实的功能:
- 按需摘要是 自动总结关键段落。
- 内置翻译可以直接把文献变成你熟悉的语言。
- “自动生成字幕”基于 端侧语音识别,能实时转录 没有加字幕的视频,而且不走云端,群里说“隐私保住了,延迟也低”。
接下来盯着看什么
- WWDC26 肯定会放出更多AI战略布局的细节——苹果这次把AI从聊天机器人拐到了系统级无障碍生态,让 Meta、Google 和所有轮椅驱动硬件厂商都开始紧张。谁会受益?天天要用辅助功能的用户;谁会难受?那些还在卖离线校准套件的传统公司。
来源: aibase阅读原文