OpenAIの音声製品担当者アティ・エレティ氏は、この度公式にChatGPTボイス機能が重要なアップデートを実施したことを発表しました。今回のアップデートでは、ユーザーが音声インタラクションを行う際に、必要なモデルや推論深度を自由に選ぶことができるようになりました。プロサブスクリプションをご利用のお客様は、最上位のGPT-5.6SolまたはGPT-6Astraモデルを直接呼び出すことができます。ユーザーが会話中にネットワーク検索や複雑な論理演算をトリガーする場合、音声システムは自動的に指定された強力なモデルに切り替えて関連するタスクを処理します。

ユーザーが動作メカニズムをよりよく理解できるようにするために、公式は説明しています。音声モードでユーザーの音声会話を下位のテキストモデルに渡すたびに、そのプロセスは該当モデルに独立したメッセージを送信したものと見なされます。下位の大規模モデルが完全に接続されると、音声コミュニケーションはさらにスマートになりますが、全体の使用枠の分配にも新しい要件が求められるようになります。

image.png

このモデルの能力向上に伴い、OpenAIはGPT-Liveの毎日の使用制限ルールも全面的に簡略化および最適化しました。具体的な調整内容は4つのグレードに分かれています:GoサブスクリプションはGPT-Live-1miniの最大3時間の使用時間を提供し、ベース版のGPT-Live-1へのアクセス権は提供されません。PlusサブスクリプションはGPT-Live-1の最大3時間の使用時間を提供します。Proサブスクリプションは月額100ドルのプランでGPT-Live-1の最大15時間の使用時間を提供し、月額200ドルのプレミアムProサブスクリプションはGPT-Live-1の無制限な使用を可能にします。

注目すべき点として、プラットフォームは権利保護の面でも人間的な調整を行いました。PlusおよびProユーザーが音声枠を使い切った場合、システムは軽量版のGPT-Live miniに自動的にローディングしないことになりました。また、今回の新制度が本格的に導入されることにより、従来の「Instant、Medium、High」の3段階の独立した音声インテリジェンスレベルは正式に廃止され、大規模モデルと推論深度を選択可能な新たなインタラクティブな時代へと全面的に移行しました。