AI音楽生成プラットフォームのSunoが、新たなモデルシリーズ「Suno v6」を正式リリースしました。これはSuno史上最大のアップデートであり、Warner Music Group(ワーナー・ミュージック・グループ)、BMG、Believeなどの音楽業界パートナーと共同で開発した最初のモデルシリーズです。公式によると、v6モデルはより高速で表現力が豊かで、音質も向上し、クリエイターにこれまでになかった正確なコントロール力を提供します。これまでの旧バージョンモデルは順次廃止されます。

image.png

3つのモデルアーキテクチャで、さまざまな創作ニーズに対応

Suno v6は単一のモデルではなく、3つのバージョンから構成されています:

  • v6: エンタメモデルとして、ProおよびPremierサブスクリプションユーザー向けです。安定性があり、精度が高く、あらゆるスタイルやジャンルで高品質でプロフェッショナルな音楽作品を継続的に生成できます。明確な目標を持つクリエイターに適しています。
  • v6-wild: 同様に有料ユーザー向けですが、探求を目的としています。出力がよりランダムで多様で、予期せぬ、質感があり大胆な結果をもたらすことがあり、インスピレーションを得たり、通常とは異なるものを追求するクリエイターに適しています。
  • v6-mini: すべてのユーザー(無料ユーザーを含む)向けの効率的なバージョンです。生成が早く、リソース消費が少なく、公式には現在の他の無料音楽生成モデルよりも優れたパフォーマンスを示しており、アイデアを迅速に完全な曲に変えることが簡単になります。

核心的な新機能: マルチモーダル入力 + 精密な局所編集

v6の最大の特徴の一つは、マルチモーダル創作をサポートすることです。ユーザーは文字のヒントだけでなく、画像、動画、または音声メモ(voice memo)を直接アップロードすることで、システムがそれらを音楽に変換します。例えば、画像の雰囲気、動画の感情、または音声メモ内の歌い方や説明に基づいて、対応するスタイルの曲を生成できます。

また、作成された曲に対して精密な局所的修正を行うことができます。全体を再生成しなくてもよいです:

  • 自然言語の指示で特定のセクションを変更(例:「サビを福音合唱団のものに変えてください」)し、他の部分は変更しない。
  • 特定の文や1つの歌詞だけを変更し、その他の内容を保持する。
  • 複数の既存の作品から要素を抽出してミックス(例:A曲のボーカル、B曲のドラムを抽出し、新しい歌詞を追加して1980年代のシンセ波風に指定)。
  • 特定の時間点のriffやギターなど楽器をサンプリングし、それを基に新しいビートを作成する。

さらに、モデルは音楽言語の理解が大幅に向上し、ボーカル、楽器、構造、感情、参照スタイル、全体的な雰囲気などをよりよく把握できるようになり、複雑な創造がより実現しやすくなりました。

産業協力と今後の方向性

Sunoは、v6がゼロから訓練された新一代のモデルであり、パートナーからのライセンスデータとユーザーのデータを使用し、チームが以前に蓄積した技術と好み学習の成果を組み込んでいると強調しています。プラットフォームでは、特定の有名アーティストや曲の模倣を直接提示して生成することは禁止されています。公式には、今後アーティストが自発的に参加するAIミキシングなどの新体験を探索し、権利者に新たな収益機会を創出する予定であることも明らかにしました。