人工智能視頻生成領域迎來了一項重要的技術突破。阿里雲近日正式對外展示了全新升級的 Wan3.0視頻大模型,實現了從早期只能生成數秒短片段到如今直接輸出單條30秒長鏡頭的跨越,並重磅推出了支持導演級控制和最多引用五條視頻的 omni-reference 核心能力。
回顧視頻生成技術的發展歷程,行業在過去很長一段時間裏主要圍繞5秒左右的短片段進行打磨,隨後逐步延伸至15秒。而 Wan3.0的推出則標誌着該技術開始真正適配影視行業的真實生產流程。在實際應用場景中,製作團隊無需再像過去那樣費力拼接成百上千個零散的短片段,而是可以直接通過模型生成連貫的長鏡頭,再根據劇本與故事走向進行後期剪輯,從而大幅提升了創作效率。

在覈心功能方面,Wan3.0帶來了兩項顯著的技術亮點:一是突破性的單條30秒視頻直出能力,能夠保持畫面長時間的高質量與連貫性;二是強大的全能多視頻參考(omni-reference)機制,支持同時引入多達五條視頻作爲參考素材,而不僅僅侷限於以往的靜態圖片參考。這種導演級別的精細控制能力,讓 AI 視頻生成在複雜敘事和風格統一上達到了全新的高度。
目前,阿里雲 Wan3.0的相關能力已經通過官方渠道面向開發者和企業用戶開放。開發者和製作團隊可以通過 Model Studio 以及 Qwen Cloud 訪問其 API 接口,將這一前沿的視頻生成能力接入到實際的影視製作工作流中。
更多 API 訪問權限:
Model Studio: https://click.alibabacloud.com/m/20000002017/
Qwen Cloud: https://click.qwencloud.com/m/20000002025/
VIP會員