UTORoboは最近、人形ロボットのための汎用知能モデル「UnifoLM-OminiA-0.3」を発表しました。このモデルはすべてのモダリティでの相互理解をサポートしており、家事や介護などの多様なシナリオにおけるタスクを統合的に処理し、ロボットが環境認識からタスク理解、そして自主的な実行に至るまでの完全なループを実現します。
UTORoboが公開したデモ動画によると、このモデルを搭載した人形ロボットG1は、床にあるクッションをソファに移動させたり、物の色と数を識別したり、指定された薬箱を正確に取り出したり、服を整えたり、食器を洗浄機に入れる、病床の高さを調整するなど、さまざまな実際のタスクを実行できます。

インタラクティブな能力において、UnifoLM-OminiA-0.3は視覚認識と言語理解をサポートしており、ユーザーの指示に基づいて複雑なタスク計画を実行できます。例えば、ロボットは3つの異なる色の薬品を識別し、要求された位置の薬箱を取り出すことができます。また、装置制御中にユーザーが「止めて」という指示を出すと、ロボットは即座に動作を停止できます。
このモデルは、UTORoboが人形ロボットG1プラットフォーム上でAGI(汎用人工知能)と物理AI技術を統合する重要な進展であり、リアルな環境でのロボットの適応力とタスク実行力をさらに向上させています。
身体的知能業界の急速な発展に伴い、ロボットの競争は単なるハードウェア性能から「モデル+センシング+行動」の総合的な能力へと移りつつあります。UnifoLM-OminiA-0.3の発表は、中国製の人形ロボットが多様なシナリオでの自律的な応用段階に向かって加速していることを示しています。
