跳到正文
北京时间
原文
OpenAI:官网动态·· 2019-10-15精选AI 评分61

OpenAI 用机器手训练神经网络还原魔方

Solving Rubik’s Cube with a robot hand

AI 导读

OpenAI 训练了一对神经网络,用类人机器手还原魔方。神经网络完全在仿真环境中训练,使用与 OpenAI Five 相同的强化学习代码,并配合一种名为 Automatic Domain Randomization(ADR)的新技术。系统能应对训练中从未见过的情况,例如被长颈鹿玩偶戳碰,说明强化学习不只能用于虚拟任务,也能解决需要极高灵巧度的现实世界问题。

推荐理由

原文说明了 ADR 方法与全仿真训练思路,可帮助读者理解强化学习从虚拟任务走向真实机械手操作的技术路径。

来源:OpenAI:官网动态 · openai.com