魔方|偏离AGI目标?OpenAI解散机器人团队!曾研发解魔方机械手

智东西(公众号:zhidxcom)
作者 | 杨畅
编辑 | Panken
智东西7月19日消息,据外媒VentureBeat报道,当地时间6月3号,全球顶尖人工智能研究机构OpenAI联合创始人Wojciech Zaremba透露,OpenAI已经解散了其机器人团队,将注意力转移到其他更容易获取数据的领域。有公司发言人称机器人团队解散时间是去年10月。
根据Zaremba的说法,OpenAI最初开展机器人研究是为了帮助他们公司通用人工智能方面发展,推进强化学习技术水平,OpenAI选择解散机器人团队对公司更有利,他们发现有其他研究方法可以使强化学习研究取得更快的进展。
魔方|偏离AGI目标?OpenAI解散机器人团队!曾研发解魔方机械手
文章插图
▲屏幕右侧为OpenAI联合创始人Wojciech Zaremba,他说OpenAI解散了其机器人团队
访谈视频地址:
https://www.youtube.com/watch?v=429QC4Yl-mA&t;=1153s
一、曾研发能解魔方的机械手
公司联合创始人Zaremba是在由美国初创公司Weights &Bias;主持的播客上,透露其机器人团队解散这个消息。
Zaremba说:“事实证明,当我们利用数据时,我们能够取得巨大的进步,然后机器学习、无监督学习和强化学习工作得更好了。很多领域都需要极其丰富的数据,这最终阻碍了机器人技术方面的发展。‘解散机器人团队’的决定对于我自己来说是相当艰难的,但我前一段时间意识到,实际上,从公司角度来看这样做是最好的。”
在一份声明中,OpenAI的一位发言人告诉VentureBeat:“在公司通过魔方项目和其他项目推进强化学习技术水平一段时间之后,去年10月份我们决定不再继续更多的机器人研究,转而将团队的重点移到其他项目上。因为人工智能及其能力的快速发展,我们发现了其他方法,例如基于人类反馈的强化学习,将加快我们强化学习的研究进展。”
在OpenAI解散机器人团队之前,他们已经进行了好几年的机器人研究。
早在2017年,OpenAI发布过一个机器人仿真控制开源软件Roboschool。同年,它开发出了一个机器人系统,在模拟环境中彻底地训练这个系统,并将其部署到一个实体机器人身上。这个机器人看一遍这个新任务怎么做,就能学会它。
OpenAI在2018年研究出了可用的模拟机器人环境和能从失败中学习的强化学习算法HER(Hindsight Experience Replay)。
2019年10月,OpenAI首次大范围的展示了它在机器人方面的工作情况,在一项研究中,详细介绍其设计五指机械手,其中内置人工智能模型来引导机械手运动。
当时,表现最好的系统模型解开魔方的成功率约为20%到60%,似乎不是特别令人瞩目。但值得注意的,研究人员增加难度,如绑住机械手手指或者给机械手戴上皮手套时,机械手仍能解开魔方。
魔方|偏离AGI目标?OpenAI解散机器人团队!曾研发解魔方机械手
文章插图
▲机器手在戴上皮手套并用绑带绑住的情况下解魔方
二、解散团队或因偏离AGI目标
如果OpenAI是一家机器人公司,那么它的公司使命会与现在不同,在这样的假设下,Zaremba认为公司会继续大力发展机器人业务。
“但从我们公司想要实现的目标——通用人工智能(AGI)角度来看,有一些业务部分要失去。”他谈道。
OpenAI长期以来一直宣称,庞大的算力是迈向AGI的必要一步,或者人工智能可学习人类能够完成的任务。当初进行机器人研究也是为了促进AGI方面的发展。
当加拿大蒙特利尔学习算法研究所(Montreal Institute of Learning Algorithms,Mila)创始人Yoshua Bengio和Facebook副总裁兼首席人工智能科学家Yann LeCun等名人认为AGI不存在时,OpenAI的联合创始人和赞助人,包括Greg Brockman、首席科学家Ilya Sutskever、Elon Musk、Reid Hoffman和美国Y Combinator前总裁Sam Altman等,都相信强大的计算机结合强化学习、预训练和其他技术可以实现颠覆范式的人工智能的进步。