OpenAI は、これまでで最も進化したAI画像生成モデル「ChatGPT Images2.5」を正式にリリースしました。4月にリリースされたImages2と比較して、新バージョンは画像の細部の鮮明さや自然な照明、テクスチャの豊かさを大幅に向上させつつ、画像生成の遅延を最大50%短縮し、制作プロセスをより効率的でスムーズにしています。
機能の革新において、Images2.5は実用的なシナリオ向けの重要なアップグレードを複数導入しています。その中でも注目すべきは、新たに追加された「Sketch(スケッチ)」機能です。ユーザーは「@Sketch」というコマンドを入力することで呼び出すことができ、チャットの中で直接スケッチを描き、テキストの説明を補足するだけで、モデルがそれを完全な詳細な画像に変換します。また、システム内にはポスター、商品など一般的なフォーマットのテンプレートが内蔵されており、作成のハードルを大幅に下げています。ユーザーは画像を共有する際、ワンクリックで元のプロンプトを添付することも可能です。

専門的なデザインや詳細な修正のニーズに対応するために、新バージョンでは画像内のコメントとマーク機能を導入しました。ユーザーは画像の特定の場所にコメントを追加し、「この領域を削除してください」や「この部分を青に変えてください」といった指示を発出することができます。この過程で、モデルは指定された領域のみを正確に修正し、他の部分は変更されません。また、複数回の編集においても画像の一貫性と品質を効果的に維持し、従来の複数回編集でよく起こる細部の劣化の問題を回避します。
API呼び出しにおいて、OpenAIは開発者に選択可能な2つの異なる定位のモデルを提供しています。そのうち、GPT-Image-2.5Flareはほとんどの一般的なAPI画像生成アプリケーションに適しており、クリエイターのコンテンツ、ソーシャルメディア、製品体験、ビジュアル検索、素早く原型を作成する用途、大量生産などに適しています。一方、GPT-Image-2.5Sunburstは編集の制御が必要な複雑なワークフローに特化しており、完成度の高いマーケティング素材や精修された製品画像に最適ですが、生成に時間がかかる傾向があります。APIはさまざまな解像度をサポートしており、片辺の長さは3840ピクセル以下、総ピクセル数は655,360から8,294,400の間です。
セキュリティと合規性の面では、Images2.5は既存のセキュリティメカニズムを引き続き採用しており、プロンプトと生成された画像を継続的にチェックし、有害な出力を防ぎます。さらに、すべての出力内容にはC2PAメタデータと非表示の透かしが埋め込まれており、外部の人々がOpenAIツールによって生成された画像を識別できるようにし、無許可での再利用やディープフェイクを効果的に防止します。
VIP会員