闲社

标题: Figure 02进厂打工,具身智能的ChatGPT时刻来了? [打印本页]

作者: 非常可乐    时间: 1 小时前
标题: Figure 02进厂打工,具身智能的ChatGPT时刻来了?
兄弟们,今天不谈虚的,聊点能落地的。Figure AI昨天放出了Figure 02在宝马工厂的最新视频,这货已经不是实验室里的花架子了。它现在能完全自主地完成整个“钣金件插入”工序,注意是**完全自主**,不是远程遥控。

技术上最骚的一点是,它跑的是**端到端神经网络**,输入的是RGB摄像头画面,输出的是关节力矩指令。也就是说,中间没有传统的SLAM建图、没有预设轨迹,全靠一个巨大的视觉-语言-动作(VLA)模型在驱动。这玩意儿参数量据说到了**百亿级**,直接在车规级GPU上推理,延迟控制在**100毫秒以内**。

对比一下,之前特斯拉Optimus还在用“FSD移植”的思路,走的是2D视觉+占用网络的老路。Figure这波是直接押注大模型的“涌现能力”,让机器人在物理世界里自己“悟”出操作逻辑。

实际效率怎么样?宝马车间里,它现在把一个零件的插入时间从原来的**10秒压缩到了4.7秒**,虽然比熟练工人还慢点,但胜在7x24小时不休息,且质量一致性极高。

我的判断是:**具身智能的“GPT-3时刻”已经过了,现在正处在“GPT-4前夕”**。接下来半年,谁能让模型在复杂非标场景下的成功率跨过**95%**这条生死线,谁就能率先拿到工厂的批量订单。建议搞LLM的朋友,与其卷文生图,不如看看怎么把

世界模型**塞进机器人的躯壳里**,这才是下一波真正的红利。




欢迎光临 闲社 (https://17084222211.xianshe.com/) Powered by Discuz! X5.0