人工知能による画像生成分野において、また一つ重要なアップグレードが行われました。AI絵画の巨頭Midjourneyはこのほど、広範なユーザー向けに初のV8.2画像編集モデルのテストを公開しました。今回のアップデートの核となるのは、これまで単一のテキストで画像を生成するだけだった従来の方法を完全に打ち破り、コマンド微調整、複数画像参照、局所的な再描画などの最先端機能を深く統合し、クリエイターにさらに正確で制御可能なプロフェッショナルなビジュアル創作体験をもたらすことです。

image.png

V8.2画像編集モデルの主な機能には4つの技術特性があります。第一に、強力なコマンド編集能力があり、既存の画像をテキストコマンドで直接編集できます。第二に、新たな複数画像参照生成メカニズムがあり、以前のオムニ・リファレンス(全景参照)を完全に置き換えることができ、一度に最大4枚の画像を参照として統合することが可能です。第三に、特定の領域に対する局所的な再描画(inpainting)とキャンバス拡張(outpainting)機能があり、画面の詳細な調整やサイズの拡張が簡単にできます。第四に、パーソナライズ設定、感情ボード、スタイル参照(srefs)との全面的な互換性がありますが、公式側はこのバージョンでは感情ボードやスタイル参照を使用する際、追加のヒントワードを適切に組み合わせることでより良いアート効果を得られる可能性があると注意しています。

image.png

ユーザーがさまざまなワークフローでスムーズに体験できるように、Midjourneyはこのモデルにいくつかの使い勝手の良い使用方法を調整しました。ユーザーは画像を直接プロンプト入力ボックスにドラッグして「プロンプトに追加」機能を選択することもでき、プレビューの右下隅にある「編集」ボタンをクリックすることもできます。また、左側のナビゲーションバーの「編集」タブから画像をアップロードすることも可能であり、Discordチャンネルで直接コマンドを入力して呼び出すこともサポートされています。

製品エコシステムおよびインターフェースの改善において、公式側はMidjourney公式サイトとalpha.midjourney.comテストサイトも同時に更新しました。現在は機能テストの初期段階であるため、テスト版のインターフェースは頻繁な実験的最適化により迅速に進化していきます。公式側は新モデルが複雑なエッジケースに対してまだ予期せぬ課題に直面する可能性があることを認めています。そのため、コミュニティユーザーからの協力とフィードバックが非常に重要です。ユーザーが創作中に期待通りではない状況に遭遇した場合、ランプボックス右側の絵文字またはタスクIDを提供することで開発チームにフィードバックすることができ、また公式交流チャネルのクリエイティブと機能提案エリアで考えを共有することもできます。

詳細:https://updates.midjourney.com/edit-model-for-v8/