最近、智譜はGLM-5シリーズの最初のネイティブマルチモーダルモデルであるGLM-5.3-Flash(320B-A18B)を正式にリリースし、オープンソース化しました。前線の人工知能技術をより広く利用可能にするために、優れた性能と極めて低コストな価格を提供しています。
このモデルは世界の先端レベルに位置付けられており、Artificial Analysis Intelligence Indexの評価で57点を獲得し、Claude Opus4.8と同等のスコアを記録しました。プログラミング能力も同様であり、パラメータ数が大きいGLM-5.2よりも全体的な性能が優れています。正式リリース前に、「Ox-Alpha」という匿名の名前で公開テストが行われ、OpenCodeやOpenRouterプラットフォームの呼び出しランキングでトップとなりました。

コストの面での優位性が最大の特徴です。GLM-5.3-Flashの価格は、同じシリーズのGLM-5.3の十分の一に過ぎず、限定価格ではさらに二十分の一にまで下がり、Opus4.8の四十分の一という価格になります。これにより、最先端モデルの利用障壁は大幅に低下しています。
構造面では、このモデルは疎な注目と線形な注目の混合構造を使用しており、初めてこの設計を実装したオープンソースの最先端モデルです。それに加えて、マニフォールド制約スーパーコネクション技術が導入されています。前バージョンと比較して、注目計算量は3.01倍減少し、KVキャッシュは4.44倍削減され、長文の文脈処理と推論コストの両方を維持しています。また、視覚機能をネイティブに統合しており、視覚フィードバックを利用してフロントエンド開発、3Dモデリング、ドキュメント作成などのタスクを自立して行うことができます。金融レポートや法務文書などの専門的な場面でも突出した性能を発揮します。

注目に値する点として、このモデルの全流量は中国製のチップクラスターによって担われています。チームは独自の推論エンジンを開発し、EPD分離構造および複数のメモリ最適化戦略を基盤にして、エンドツーエンドの推論性能を3倍向上させ、ハードウェアの使用効率はNVIDIAの主要GPUと同等になりました。これにより、中国製の算力が大規模な最先端モデルの推論を支えることが証明されました。
現在、GLM-5.3-Flashは全面的にオープンソース化されており、APIインターフェースやオンライン体験の手段が開放され、ZCodeやAutoClawなどのスマートエージェントプラットフォームにも登場しています。また、毎日1万枚の体験カードを提供し、世界中の開発者に無料で利用可能です。
オンライン体験
Z.ai:https://chat.z.ai
智譜清言アプリ:https://chatglm.cn
VIP会員