OpenAIが、人間の手を模したロボットハンドでルービックキューブを解く研究成果を発表した。ニューラルネットワークはシミュレーション内のみで訓練され、OpenAI Fiveと同じ強化学習コードと新手法ADR(自動ドメインランダム化)を用いて、訓練で見たことのない外乱にも対応した。強化学習が高度な器用さを要する物理世界のタスクにも適用できることを示した。
OpenAIが、人間の手を模したロボットハンドでルービックキューブを解く研究成果を発表した。ニューラルネットワークはシミュレーション内のみで訓練され、OpenAI Fiveと同じ強化学習コードと新手法ADR(自動ドメインランダム化)を用いて、訓練で見たことのない外乱にも対応した。強化学習が高度な器用さを要する物理世界のタスクにも適用できることを示した。