8月13日、OpenAIが新しく「Ultrafast(超高速)」モードを発表し、最新の旗艦大規模モデルであるGPT-5.6Solの処理効率を大幅に向上させました。公式データによると、モデルの従来の高い知能と出力品質を維持しつつ、Ultrafastモードは標準処理よりも最大で14倍速く動作し、1秒間に最大750の出力トークン(Tokens)を生成できます。

OpenAI

この機能は、OpenAIとチップメーカーのCerebrasが共同で開発したものです。現在はプレビュー段階であり、一部の企業顧客に優先的に提供されています。今後、計算能力の拡充に伴って範囲を広げていく予定です。

従来の大規模モデルの応用では、「モデルの能力」と「応答速度」のトレードオフに苦しんできました。リアルタイムシーンでは、しばしばパラメータ数が少ないモデルを選択せざるを得ませんでした。Ultrafastモードの実装により、この課題が打ち破られ、GPT-5.6Solはイベント対応、カスタマーサービス、金融市場分析、およびECなど、遅延に敏感な複雑なワークフローにシームレスに導入できるようになりました。

競合するAnthropicのClaudeの高速モードと比較して、OpenAIは出力スループットと実行効率においてより優れた強みを示しています。この技術的突破は、最先端の大規模モデルが「高遅延のオフライン推論」から「高スループットのリアルタイムインタラクション」へと加速していることを示しており、今後、企業向けAIの実装形態や生産性の基準を再構築することになるでしょう。