ロボット企業であるUnitree(宇樹科技)は先日、ロボットのトレーニング用ソースコードを全面的にオープンソース化すると発表し、業界で大きな注目を集めています。今回オープンソース化されるのは、強化学習(RL)のトレーニングコードと、シミュレーションからシミュレーション(Sim-to-Sim)、シミュレーションから現実(Sim-to-Real)までの完全なコードです。
Unitree、ロボットトレーニング用コードを全面オープンソース化:業界のイノベーションを加速


ロボット企業であるUnitree(宇樹科技)は先日、ロボットのトレーニング用ソースコードを全面的にオープンソース化すると発表し、業界で大きな注目を集めています。今回オープンソース化されるのは、強化学習(RL)のトレーニングコードと、シミュレーションからシミュレーション(Sim-to-Sim)、シミュレーションから現実(Sim-to-Real)までの完全なコードです。
9月17日、小米MiMoチーム責任者の羅福莉氏がMiMo-V2.6の強化学習訓練の進展を初公開し、RL段階をリアルタイムページで全程ライブ配信した。これは物理世界と汎用知能の探索が突破期に入ったことを示す。技術詳細は今後数週間でオープンソース化予定。同モデルは大規模マルチタスクエージェント訓練を実施中。....
マスクはXプラットフォームで明らかにした。Grok 4.8のパラメーター数は2.5兆に達し、新たなC++ソフトウェアスタックでトレーニングされ、今週中にトレーニングを終えた後、強化学習を開始する予定である。前回のGrok 4.7は9月12日に発表する予定だったが、後に数日間待つ必要があると改訂された。延期の理由は強化学習に起因している。
財躍星辰と上海交通大安泰チームが金融推論モデルAlpha-R1を共同オープンソース化。8B基盤、独自の意味ゲート推論と2段階強化学習を採用。金融推論のサンプル外評価で汎用モデル・従来手法を大幅に上回り、資産配分など金融投研向け。....
Hugging Face傘下のPollen Roboticsが小型二足歩行ロボット「Microduck」をオープンソース化。身長25cm・重さ約800g、RK3566搭載、50Hzで15サーボ制御。強化学習・Sim2Real・リアルタイム制御を融合した具現AI向けミニ開発基盤で、多数の実用技能を習得済み。....
バレット・ゾフがGoogleに研究担当副社長として復帰し、Geminiチームに参加。強化学習とポストトレーニングに注力。2016年にGoogle Brain、2022年にOpenAIへ移りChatGPT開発に従事。今年、Thinking Machines Lab CEOミラ・ムラティとの意見相違で退職しOpenAIに移ったが、再びOpenAIを離れGoogleへ。AI人材流動の一例。....