知譜AIのBigModelプラットフォームは、GLM-5.3-FlashXという大規模モデルを正式にリリースしました。APIも同時に公開され、モデル識別子は「GLM-5.3-FlashX」です。新しいバージョンでは最大200トークン/秒の出力速度を実現し、「スマートさ、価格、スピード」の三位一体の競争力を強調しています。企業および開発者向けに、高スループットで低遅延な推論サービスを提供します。

このモデルの前身であるGLM-5.3-Flashは、「Ox Alpha」として海外で匿名で登場し、同じサイズの中で最も高い知能水準と非常に高いコストパフォーマンスにより迅速に評判を獲得し、使用量が継続的に増加しました。需要の増加に対応するため、知譜は国内チップの10万枚の計算能力ベースを基盤として、推論最適化への投資を強化し、最終的に高速版のFlashXをリリースしました。
FlashXは、従来の知能レベルと手頃な価格を維持しながら、生成速度を最大化し、さらに高同時接続シーンにおける商業的な優位性を強化しました。開発者は公式APIドキュメントを通じて接続でき、非技術ユーザーは体験センターで直接試用できます。今回のアップグレードは、国内の大規模モデルが推論効率と普及化においてさらに一歩進んだことを示しています。
VIP会員