ネットイース互娱 AI Labの学術論文「General Image-to-Image Translation with One-Shot Image Guidance」が、国際的なコンピュータビジョン分野のトップ会議であるICCV2023に採択されました。
本論文では、VCTと呼ばれる画像編集手法を提案しています。
マイクロソフト、自社開発の高精度画像AI「MAI-Image-2.5-Pro」を発表。GPUコスト最大84%削減。並列音声処理特化の「MAI-Voice-2-Flash」も公開。データはクリーンでトレーサブル、第三者モデルの蒸留に依存せず、製品ユーザー向けに設計。....
阿里がQwen-Image-3.0を発表。最大4.5Kトークンのテキスト入力で、数式・幾何図形・論理展開・多層UI等を一括生成。12言語・20以上のフォントに対応し、テキスト長は前世代比4.5倍。映像絵コンテや知識図解の制作力が大幅向上。....
グーグルが新AIモデル「Nano Banana2Lite」を発表。激しい競争の中、単一画像生成時間を4秒未満に短縮し、低遅延とコスト効率で優位性を示す。....
xAIが「Grok Imagine API」の「品質モード」を開発者・企業向けに発表。視覚的リアリズム、文字レンダリング、クリエイティブ制御の3次元で革新を達成し、細部まで自然でリアルな画像生成を実現、描写力と表現力を大幅に向上。....
アリババがWan2.7-Imageモデルを発表。肖像画のカスタマイズ、カラーコントロール、長文レンダリングにおいて突破を遂げ、AIで生成される画像が一様になる問題を解決するためのものである。このモデルはすでにアリババクラウドの百煉プラットフォームのAPIに登場し、体験が公開されている。主なアップグレードには「仮想の顔の整形」と「正確なカラーパレット」機能があり、創作の自由度を大幅に向上させている。