给波士顿动力机器狗装上 ChatGPT 后,会发生什么?-世界快消息
波士顿动力的「大黄狗」Spot 可以说是网红机器人的典范。
【资料图】
会巡逻、会搬砖、会跳舞 Spot 自诞生以来就吸引了全世界机器人爱好者的目光,谁能拒绝像这样一条动作灵活、姿态憨厚,还会卖萌的机器狗呢。
经过多年的发展,卖萌已经不再是 Spot 的「主业」,根据波士顿动力的介绍,Spot 现在能帮助人类完成一些特定场景下的工作,例如在跨洋轮船上检测仪表、参与地势复杂的勘测或救援工作等等。
如果给 Spot 这么灵活的身躯,装上一个像 ChatGPT 这么聪明的大脑,会发生什么?
人工智能专家 Santiago Valdarrama 还真做出来了这么一条拥有「最强大脑」的 Spot。
用 ChatGPT 大幅简化人机交互
Santiago 在 Twitter 上分享了他与改造版 Spot 互动的视频,这可能是史上第一条会讲话、会聊天的机器狗。
在演示视频中可以看到,Spot 并不仅仅是装了个「Siri」那么简单,当它在回答人类问题时,它的身体也会随着语句的内容和语调一起摆动,看上去就像是科幻片中的 Wall-E 走进了现实。
当你问到一些「Yes Or No」的简单问题时,它还会用「点头」「摇头」等身体语言代替语音来回答你,由此可见 Spot 远不是内置了一个智能音箱那么简单。
接入 ChatGPT 后,Spot 最大的变化就是听得懂人话,并且能够和使用者用自然语言交流。
Santiago 演示了一个场景,他跟 Spot 说因为它太碍事导致房间太拥挤了,让它往后稍稍,话音刚落 Spot 就理解了 Santiago 的意思,往后退了几步。
怎么样,是不是已经有科幻电影中呼唤机器人工作那味了。
过去操作 Spot 需要用类似无人机的大型遥控器或者用电脑输入复杂的指令,而现在 ChatGPT 的加入赋予了 Spot 强大的自然语言理解能力,动动嘴就能与机器人交互。
在这个过程中,ChatGPT 担任了人类与机器人之间的翻译,把人类输入的「人话」变成机器能看懂的指令,再把机器人的反馈用实际行为或者「人话」表达出来。
Santiago 介绍,他们把 Spot 的文件输进了 ChatGPT,并向其解释了文件的结构以及如何读取这个文件,从而实现了与 Spot 语音对话和操作。
操作员与 Spot 之间的交互被大幅简化,人们可以直接问它:「你的电量还有多少?」,然后 Spot 就会用语音的方式回答,这其中用到了 Google 文字转语音的技术,再把 ChatGPT 的答复经 Spot 的「口」讲出来。
Spot(或者说内置的 ChatGPT)会根据实际情况来回答问题,例如当你问它接下来要完成什么任务时,它会根据设定好的任务列表来作答,这在很大程度上避免了 ChatGPT 编造事实的情况。
当操作者给 Spot 下达像转向 90 度、前进 1 米这样的命令时,Spot 会联动内部的传感器和定位系统,精准地响应这些命令,不会说因为「大脑过于发达」而失去控制。
有趣的是,当你问它「你是谁?」的问题时,它会回答「我是 OpenAI。」,而不是机器狗 Spot。
Santiago 所在的公司 Levatas 是一家与波士顿动力合作的 AI 公司,专门帮助企业探索如何利用机器人解决实际问题的解决方案。
Santiago 认为,给 Spot 装上 ChatGPT 最大的实际意义,是把原本只有技术人员才能处理的复杂数据变成了任何人都能看得懂、听得懂的自然语言。
机器人每次在执行任务前,都要输入冗长的指令集;在结束工作后,还会产生大量的数据,只有最专业的技术人员才能从这些数据中分析出问题。
但现在通过 ChatGPT,简单的两句话就能搞定。
当机器人的操作门槛变低之后,机器人的使用场景就会随之变得丰富起来。
AI 大模型的潜力不容小觑
「最强大脑」版 Spot 并不是一蹴而就的,在一个月前,Santiago 曾发布一个视频介绍了一条能「听懂人话」的 Spot,其用到的是 OpenAI 另一个重要 AI 模型 Whisper。
在这个「初版」智能 Spot 中,Santiago 更详细地介绍了其中的原理:
Whisper 可以高效地把语音实时转换成文字,转换的正确率和速度都非常可观。通过把 Whisper 与 Spot 的 SDK 结合在一起,它可以从人类说的话中提取关键文字,然后通过 SDK 向 Spot 发送命令。
只需要向它说句话,就可以让 Spot 离开充电坞,起身去检查仪表是否出现问题,大大降低了人类的操作成本。
Santiago 的实践从一个很好的角度回答了一个被广泛讨论的问题:ChatGPT 一类的大语言模型到底有什么意义?
一开始,人们认为 ChatGPT 就是一个单纯文本生成式 AI,它有着比较强的自然语言理解能力,可以写文章、写报表,虽然不那么靠谱,但也算惊艳。
后来人们发现只要给 ChatGPT 恰当的指令,它可以代替人类自动得完成编程或者文字处理等工作,犹如一台基于自然语言运转的计算机。
OpenAI 发布了插件集功能后,ChatGPT 可以与许多互联网的应用结合在一起,把很多跨平台的操作用对话整合在了一起,变成了互联网的新入口。
微软发布的 Copilot 则启发了人们对下一阶段人机交互的想象:图形操作界面并不一定是永远合理的范式,许多我们习以为常的操作都可以被对话代替。
再回到 Spot 上时,我们就能比较清晰地看出大语言模型的意义:简化人机交互,赋予机器人更高级的智能。
无论是把 ChatGPT 当作新的互联网入口,还是当作控制具备学习能力、问题分析能力和执行高精度操作能力的工业机器人的遥控器,本质上都是把复杂的指令集变成自然语言,降低操作成本。
这种赋能将使未来的工业机器人不仅仅成为指令执行的工具,更能具备与人类大脑相当的智能水平。
就像图形界面把复杂的命令行变成了一个个直观的图标,现在点按不同图标的复杂操作又变成了一句简单的话,人类正在从图形用户界面走向一个新的阶段:自然语言用户界面。
在这个阶段,大语言模型将成为工业机器人的关键技术,它将简化人机交互,提高生产效率,进一步推动人类社会的科技发展。
并且在某些情况下,语言模型在理解语言时甚至会比人类表现得更好。普林斯顿大学的教授 Arvind Narayanan 在他一篇博客中提到了他的一个亲身案例。
Arvind Narayanan 为 ChatGPT 接上了语音交互,给自己快要四岁的女儿使用。就和所有孩子一样,他的女儿也充满好奇心,经常问 ChatGPT 各种问题。
让他感到意外的是,当他告知 ChatGPT 它在和一位小朋友说话时,ChatGPT 变得很善于表达同理心。
女儿:「关灯后会发生什么事?」
ChatGPT:「关了灯之后,会变得很黑,也可能会有点让人害怕。但不用担心!有很多东西能帮助你在黑暗中感到安全和舒适。」
《彭博社》专栏作家 Parmy Olson 指出,微软和 Google 都忙着把大模型用在搜索引擎上,但却没看到,和作为一个事实提供者相比,ChatGPT 更合适做情感陪伴者。
Olson 还让 ChatGPT 去做了情商测试,结果居然比她自己和同事都好。正因为 ChatGPT 是用网络上文字素材训练的,数据中会有大量错误信息,但这也让它更善于模仿共情。
这些案例都充分说明了,大语言模型对自然语言的理解能力其实有着很大的应用潜力。
借助如此强大的理解能力,我们可以利用大语言模型真正实现又一次的人机交互革新,同时大语言模型的出现为机器人的发展带来了新的可能性。
大语言模型可以让机器人可以更好地理解和处理指令,更快地学习和适应新的任务和环境。
《纽约客》在封面文章《黑暗工厂》(Dark Factory)中提到,目前工业机器人一个共同的难点,就是设计一个像人手一样的「末端执行器(end effector)」,让机器人能以不同的力度抓取大小形状各异的物体。
如果这个技术难题得到解决,机器人能完成更多精细的工作,很多领域自动化的程度也会大大提高。比如各种水果的采摘可以实现自动化,富士康的流水线也不再需要这么多工人了。
未来的工业机器人不仅仅应该是指令执行的工具,更应具备与人类大脑相当的智能水平,具备学习能力、问题分析能力和执行高精度操作的能力。
在工业生产线上,「肌肉发达」的工业机器人更加灵活高效,能够更好地应对各种生产问题,提高生产效率和质量。例如,在汽车制造领域,大语言模型可以为机器人赋予更强的智能和认知能力,使其能够更好地完成多样化的任务。
在医疗机器人领域,机器人可以通过自然语言处理技术与医生和病人进行交流,提供更好的医疗服务。
大语言模型为机器人行业带来了一颗强大的大脑,为机器人创造了出更泛化的应用场景,这很有可能会成为第四次工业革命的技术核心。而「语音版」Spot,便是这场技术变革迸发出的第一缕火花。
标签:
精彩推送
风暴眼|蔚来员工爆料:半年加班500小时,遭遇职场PUA,一度想要自杀
陈芳向凤凰网《风暴眼》透露,在自己的事情被媒体报道并登上热搜后,蔚来方面一改往日强硬蛮横的态度,开始
tomato的复数形式为什么加es_tomato的复数形式
1、1 以o结尾的表示“有生命”的事物加es如:tomato、potato、mangoes、hero后加-es2
1158万人!今年高校毕业生数量再创历史新高!找工作更难了...
点击下方卡片,关注“CVer”公众号AI CV重磅干货,第一时间送达今天Amusi看到这么一则新闻: 今年高校毕业
海天味业2022年营收256亿 正布局新赛道打造第二增长曲线 环球热消息
4月25日晚间,海天味业(603288 SH)发布了2022年业绩报告,2022年全年,海天味业实现营业收入256 10亿元,
ST海润2022年亏损775.44万同比亏损增加 电影票房分账收入较上年同期减少
挖贝网4月25日,ST海润(836583)近日发布2022年年度报告,报告期内公司实现营业收入4,622,098 42元,同比
环球最新:“家中扫帚4不放,人旺财也旺”,这4处是指哪里?万不可乱放!
“家中扫帚4不放,人旺财也旺”,这4处是指哪里?万不可乱放!大家好,我是傻姐美食,家中扫帚是我们日...
新闻快讯
X 关闭
X 关闭
新闻快讯
- 给波士顿动力机器狗装上 ChatGPT 后,会发生什么?-世界快消息
- 焦点热门:全国象棋快棋锦标赛收官 超快棋组王天一、梁妍婷夺冠
- 西藏消费者换新家电家居记得先来京东领券 戴森V15到手只需4599元 全球头条
- 精彩看点:一季度北京新设市场主体6.8万户 同比增长超两成
- 当前讯息:华严小学开展“五一”劳动节前安全隐患排查工作
- 天天快看:信用卡可以用完所有额度吗 情况是这样的
- 东营港经济开发区两家企业获“平安东营建设示范单位”称号 全球新资讯
- LOL:外媒评选2023MSI各位置选手TOP 7,Bin力压Zeus、369排名第一-全球新消息
- 今日要闻!杭州解百(600814)4月28日主力资金净买入476.74万元
- 告别暴力破解,AI成黑客“新玩具”
- 欧洲豪门困局:切尔西热刺惨不忍睹 拜仁内乱巴黎将失梅西
- 恒逸石化董秘回复:公司第四期员工持股计划成交均价为12.25元
- 社会出现一个非常“古怪”的问题,明明消费萎缩,物价却在上涨
- 04月28日福建皮棉为15910元 播报
- 快播:多地合胞病毒感染者增多 呼吸道合胞病毒感染的有效预防措施还是保护易感人群
- 世界观焦点:百万女网红“脸被偷”,不雅视频遭贩卖
- 购销合同未履行怎么处理_环球百事通
- 华安证券给予舍得酒业买入评级 业绩符合预期 预收款表现亮眼_世界要闻
- 环球新消息丨天津各主要医院“五一”假期有调整 看好应诊时间 合理安排就医
- 年轻时无数男人被她迷倒,40岁不结婚不生子,风韵犹存生活随性
- 总投资60亿元 中国联通中南研究院项目建设加速推进 热讯
- 报道:数字阅读为文化消费提供新选择
- 你在巴黎某个角落和某人在看日落文案_你在巴黎某个角落和某人在看日落-环球即时看
- 国家能源局:初步统计,目前全国煤矿智能化建设总投资近2000亿元
- 社保基金长期持仓标的近3年逾六成收涨
- 焦点信息:蕾冠王_关于蕾冠王介绍
- 马桶坑距尺寸标准尺寸图片大全_如何量马桶坑距
- 选择费德勒!回应网坛第一人争议,西西帕斯:不应该仅看大满贯|热点评
- 天天百事通!浪漫夕阳歌曲原唱_浪漫夕阳
- 当前视点!知命不惧日日自新是出自哪里的_知命不惧 日日自新是什么意思
- 焦点消息!大牙根管治疗多少钱一次啊_大牙根管治疗多少钱
- 世界头条:电脑面前放一颗仙人掌能防辐射吗_电脑前放一盆仙人掌能防辐射吗
- 高清图:江西国际医疗器械展开展 全球信息
- 当虹科技披露分配预案:拟10转增4股|全球简讯
- 引入私域元素,构建零售6.0新模式
- 今日讯!男子出售与女网友线下见面机会警方介入,爆料者最新发声:男子疑似诈骗
- 要闻:解锁五一新玩法——第四站:山西·大同 大不同
- 天天快播:消费者情绪好转 欧元区4月经济景气指数升至99.3
- 依法打击“黄牛”炒票、严禁假唱……文旅部进一步加强演出市场管理
- 秦皇岛城投2022年营业收入11.61亿元 净利润为4823.28万元 热讯
- 世界速讯:2023五一天津光合谷活动持续多久?
- 暗战1粤语在线观看_暗战1
- 赣州白癜风医院哪治疗好 如何使用药物对白斑治疗更有用?
- 全国首个劳模工匠主题邮局在陕西西安开业_天天快播
- 部分地区大雨、暴雨!“五一”假期天气发布
- 除螨仪真的能除螨吗视频_除螨仪真的能除螨吗|天天头条
- 今头条!摩通:中国海外第一季业绩踏上正轨实现全年指引
- 环球滚动:带着3比1的领先优势湖人来到灰熊的主场
- 秘鲁宣布边境地区进入紧急状态 快资讯
- 撞人致死逃逸怎么办-全球短讯