大規模モデル業界における「価格戦争」と「能力の限界」は、最近新たな突破を遂げた。以前からオープンソースコミュニティで注目を集めていた、通称「ニューロ(NiuLai)」と呼ばれる謎のモデルOx-Alphaがついに姿を現し、それが智譜AIが最新にリリースしたGLM-5.3-Flashであることが明らかとなった。GLM-5シリーズの初のネイティブなマルチモーダルモデルとして、そのパフォーマンスは世界トップクラスのエンドユーザーと直接対決し、破壊的な価格と国内製の計算力基盤により、業界の競争ルールを再定義した。
コア性能と価格定位において、GLM-5.3-Flashは飛躍的なコストパフォーマンスを示している。Artificial Analysis Intelligenceスコアは57点に達し、前世代のエントリーモデルGLM-5.2を上回り、DeepSeek V4 Pro正式版の53点よりも高く、類似モデルの中央値である18ポイントを大幅に超えている。価格面では、従来の大規模モデルで「パラメータが多いほど高くなる」という法則を打ち破り、100万トークンの入力は0.8元、出力は2.8元、キャッシュヒットは0.23元であり、Claude Opus 4.8の約40分の1のコストとなる。これにより、先端の知能は「使い続けるのが難しい」という窮地から脱することができた。
マルチモーダル視覚能力の完全なネイティブ統合は、このモデルの最大の技術的特徴である。従来のプログラミング大規模モデルは「人間が審判になる」という単一のプロセスに依存していたが、GLM-5.3-Flashは視覚エンコード機能をコーディングループに組み込んでいる。コードの作成、ゲームの設計、3Dシーンの構築時に、モデルはレンダリング結果やインタラクティブなフィードバックを主に「観察」し、「生成-観察-修正」のサイクルを形成する。公式テストによると、このモデルはBlenderで16時間連続して動作し、400平方メートルの専門的なシェフ住宅とテストキッチンをゼロから構築することができ、強力な自律的な視覚判断と改善能力を示している。
さらに重要なのは、この先進的大規模モデルの背後にある計算力はすべて中国製チップへと転換されていることである。OpenCodeやOpenRouterなどのプラットフォーム上で、クラスタによって運用される世界的な実際のオンライントラフィックはすべて中国製チップによって計算力が提供され、専用のSGLang推論エンジン、ReplaySSM、混合キャッシュ量化、EPD分離型アーキテクチャなどの革新的な最適化技術を活用して、メモリと帯域幅のボトルネックを克服した。この突破は、中国製チップが先進的大規模モデルを完璧にサポートできることだけでなく、大規模な実際のトラフィック下でも安定性と経済性を保つことができる事を証明している。
現在、GLM-5.3-Flashのモデル重みはMITライセンスでHugging Faceなどのプラットフォームでオープンソース化されており、APIも同時に世界中の開発者に公開された。これは、大規模モデルが高性能、低コスト、および国内適合性の融合の道を歴史的な一歩で進んだことを意味している。
VIP会員