多くの人々は、ロボットの訓練とはAIがすべてを自力で学ぶことだと考えています。 しかし、学習はそういったものではありません。 Axis Roboticsでは、人間がシミュレーションされたロボットを操作し、タスクを実行することで、ポリシーが学習できる軌道を作成できます。 訓練後でも、ロボットがミスをした場合、人間が操作を引き継ぎ、動きを修正して再び制御をロボットに渡すことができます。 この修正は貴重なデータです。 それは、前のポリシーができなかったことを次のポリシーに教えるのです。 これにより、強力なループが生まれます: 人間の操作 → ロボットが学習 → ロボットが行動 → 人間が修正 → より良いポリシー → より良いロボット 目的は、人間をループから排除することではありません。 人間の操作を、ロボットをより良くするための学習信号に変えることです。 これが、ロボットを制御するための新しい考え方です。 @axisrobotics


