OpenAI + Figure 最新成果
机器人在端到端神经网络上与人类对话:
→ OpenAI 提供视觉推理和语言理解
→ Figure 的神经网络提供快速、低等级、灵巧的机器人动作
视频无遥控操作,1 倍速。
Figure 的摄像头被喂入 OpenAI 大型视觉语言模型 (VLM)。
Figure 的神经网络还通过机器人上的摄像头以 10hz 的频率拍摄图像。
然后神经网络以 200hz 输出 24 个自由度的动作。
Domo 中展示的人工智能工作是由 Corey Lynch(刚加入)和 Toki Migimatsu 领导的。