最近、SuperCLUEが最新のOnDeviceモバイル端末側の大規模モデル評価ランキングを公開しました。スマートフォンのローカル動作能力に焦点を当てたこのコンペティションで、vivoのBlueLM3.5Nano3Bモデルは印象的なパフォーマンスを発揮し、89.86点を獲得して総合順位の1位を獲得しました。
具体的な評価結果を見てみると、この3Bパラメータの小さなモデルはエッジ側分野でリストトップを記録し、グーグルのGemini3.6Flash、ドウバオシード2.1pro、Qwen3.8Maxなどの主要なクラウドベースの大規模モデルとほぼ同等のスコアを達成しています。エッジ側リストの以降の順位では、Qwen3.59BとQwen3.54Bはそれぞれ87.82点と85.16点を獲得し、2位と3位を記録しました。他の参加者はGLM4.6V Flash、Gemma4E4B it、Gemma4E2B itです。

エッジ側AIの急速な普及とともに、ローカル動作モードの利点が徐々に明らかになっています。エッジ側大規模モデルのコア価値は、常時インターネット接続を必要とせずに、スマートフォン上で画像やテキストの推論を行う能力にあります。すべてのユーザー入力コンテンツはデバイス内に残り、よりセキュアでプライベートな体験を提供します。
スマートフォンハードウェアの物理的制限により、エッジ側モデルのパラメータサイズはクラウドベースモデルのように無限に拡張することはできません。超複雑なタスク処理においてもまだ限界があります。しかし、vivoが3Bパラメータモデルで優れたスコアを獲得したことは、小容量のエッジ側モデルでも高い技術的な到達点に達成可能であることを示しています。これは、今後のスマートフォンAI体験がネットワークに過度に依存しなくなることを示しており、オフライン環境でもスムーズに動作することが可能です。もちろん、ベンチマーキングスコアはあくまで実験室での性能を反映しており、実際の日常使用効果は主要スマートフォンメーカーによる深いシステム最適化に依存します。
VIP会員