aiminute. ← 全部AI新闻
新模型 AI Minute Newsroom 2026-08-21

给机器人演示一次——三到十二秒——它就能在完全不训练的情况下把活儿做对 59 次

给机器人演示一次——三到十二秒——它就能在完全不训练的情况下把活儿做对 59 次

Generalist AI 于 8 月 19 日发布了 GEN-1.5。演示在这里不是训练数据,而是提示词本身。一段三到十二秒的操作视频——由手持夹爪的人录制,或由机器人自己录制——被载入模型三十秒的上下文窗口,随后机器人便在没有任何梯度更新、没有任何微调的情况下尝试这项任务。在开罐子、拉开笔袋拉链、从钱包里取钱等十项不同任务中,这种单次示范方式的平均成功率为 59%,波动约十个百分点。用五分钟数据做十步梯度更新后,成功率升至 83%。该模型同时接收视频与传感器、语言、肢体位置数据,并以每秒一百次的频率输出动作指令。公司称,它展示的这些能力——从仿真迁移到现实、使用陌生工具、绕开障碍、双臂协同——从未被专门训练过,而是从八个月不间断的物理交互预训练中自行涌现的。公司未宣布开放权重,也未宣布产品。

为什么重要?实用机器人之所以仍然稀少,不是因为它们无法被编程,而是因为每一项新任务传统上都意味着重新采集数据、重新训练,这让除大批量工厂作业之外的一切都变得不划算。用给人做示范所需的时间,从一次演示中学会——这是一台必须为某项工作专门设计的机器,与一台可以被直接吩咐的机器之间的分野。这个数字旁边应当附上两点提醒:59% 距离可靠还很远,而且这是公司在自选任务上对自家模型的自我评测。但三周前我们报道过中国一款开源的单次示范机器人学习模型,第二支团队从不同路径抵达同一构想,正是一项研究成果开始变成趋势的方式。
#机器人

✓ 已核实 · 3个来源

▶ 相关视频: Introducing GEN-1.5, a one-shot learner
WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

微软的新模型在你说完之前就开始写字了。
2026-10-05
一家美国实验室即将免费放出对标中国的开源模型。
2026-10-05
一家视频网站免费放出了评分最高的开源翻译模型
2026-10-05
短暂视频通话里,一半人以为对面的AI是真人
2026-10-04
英伟达悄悄上传了一个新的多模态模型,没有告诉任何人。
2026-10-04