2026-07-22 09:00
宇树科技发布UnifoLM-OminiA-0.3,实现人形机器人多任务自主执行
文本核心速览
- 发布全模态智能模型—宇树科技发布人形机器人通用智能模型UnifoLM-OminiA-0.3,支持全模态交互与环境感知,实现从任务理解到自主执行的完整闭环。
- 多场景任务演示—搭载该模型的G1机器人成功完成搬抱枕、识别物品颜色与数量、精准抓取药盒、整理衣物、收纳餐盘及调节病床高度等家居康养任务。
- 强交互与指令响应—模型具备视觉识别与语言理解能力,可根据用户指令规划复杂任务,如识别三盒不同颜色药品并按要求取出,且能实时响应“停”等语音指令。
- AGI与物理AI融合—该模型是宇树科技在G1平台上融合AGI与物理AI技术的重要进展,显著提升了机器人在真实环境中的适应性与任务执行能力。
宇树科技G1人形机器人新模型能识别三盒药颜色,还能喊停即停
宇树科技给G1人形机器人换上了新模型 UnifoLM-OminiA-0.3(版本号0.3,第三个迭代了,还不是最终版),演示视频里它干了不少活:能抱起地上的抱枕扔沙发上、识别物品颜色和数量、精准抓指定药盒(就三盒药不算多,但能区分颜色)、叠衣服、把盘子放洗碗机里、还能调病床高度。 这模型支持全模态交互理解,从环境感知到任务理解再到动手执行,走完一个闭环。
有开发者看了演示视频后说,搭载这模型的G1完成的任务包括:地面抱枕搬放至沙发、识别物品颜色与数量、精准抓取指定药盒、整理衣物、将餐盘放入洗碗机、调节病床高度等操作。 在交互这块,UnifoLM-OminiA-0.3有视觉识别和语言理解能力,能根据用户指令做复杂任务规划。比如,机器人可以识别三盒不同颜色药品(就三盒,不同颜色),并按要求取出指定位置的药盒。 还有一个关键点:在设备控制过程中,用户说“停”这个指令(就一个词),机器人能立即停止动作。
这个模型是宇树科技在G1平台上把AGI(通用人工智能)和物理AI技术揉到一起的进展。以前机器人只能干固定活,现在它能在真实环境里适应任务了。 现在具身智能产业卷得厉害,机器人竞争从单纯拼硬件转向“模型+感知+行动”的综合能力。 这模型放出来,意味着国产人形机器人正在加速往多场景自主应用方向跑。
接下来盯着看这模型能不能在G1上批量跑起来,或者它会让特斯拉Optimus这类对手难受。
来源: aibase阅读原文