-
日期: 2024-03-13 | 来源: 量子位 | 有0人参与评论 | 字体: 小 中 大
OpenAI大模型加持的机器人,深夜来袭!
名曰Figure 01,它能听会说,动作灵活。
能和人类描述眼前看到的一切:
我在桌子上看到了一个红色的苹果,沥水架上面还有几个盘子和一个杯子;然后你站在附近,手放在桌子上。
听到人类说“想吃东西”,就马上递过去苹果。
而且对于自己做的事有清楚认知,给苹果是因为这是桌上唯一能吃的东西。
还顺便把东西整理,能同时搞定两种任务。
最关键的是,这些展示都没有加速,机器人本来的动作就这么迅速。
(也没人在后面操纵)
这下网友坐不住了,立马@波士顿动力:
老伙计们,这家伙是真来劲儿了。咱得回实验室,让以前的机器人(波士顿动力)多跳点舞了。
也有网友看在OpenAI卷完大语言模型、文生视频之后,又狙击机器人后感慨道:
这是一场激烈的竞争;与OpenAl合作,苹果可能会超越特斯拉。
但硬件方面,擎天柱看起来更美观,Figure 01仍然需要一些“整容手术”。(doge)
接下来,我们继续来看下Figure 01的细节。
OpenAI视觉语言大模型加持
根据创始人的介绍,Figure 01通过端到端神经网络,可以和人类自如对话。
基于OpenAI提供的视觉理解和语言理解能力,它能完成快速、简单、灵巧的动作。
模型只说是一个视觉语言大模型,是否为GPT-4V不得而知。
- 新闻来源于其它媒体,内容不代表本站立场!
-
原文链接
原文链接:
目前还没有人发表评论, 大家都在期待您的高见