阿里巴巴近日推出了一款名爲QVQ-72B的全新多模態推理模型,該模型基於Qwen2-VL-72B構建,融合了強大的語言和視覺能力,能夠處理更爲複雜的推理和分析任務,標誌着阿里巴巴在多模態AI領域取得了新的突破。



阿里巴巴近日推出了一款名爲QVQ-72B的全新多模態推理模型,該模型基於Qwen2-VL-72B構建,融合了強大的語言和視覺能力,能夠處理更爲複雜的推理和分析任務,標誌着阿里巴巴在多模態AI領域取得了新的突破。


GitMind推出多模態AI升級,聯合StackCommerce以49.99美元提供終身訂閱(原價169美元)。該工具聚焦解決手動繪製思維導圖的痛點,整合多模態AI解析能力,可直接處理PDF、YouTube視頻、截圖等多種內容,實現智能知識整理。
華中科技大學學生團隊藉助自研AI平臺“愛烏”,僅用48小時完成10分鐘長視頻《新江漢攬勝圖》初剪版,展現高效創作能力。該視頻濃縮江城千年歷史,引發廣泛關注。AI視頻生成行業雖快速增長,但仍面臨挑戰。
商湯科技發佈並開源日日新SenseNova U1系列模型,基於自研NEO-unify架構,實現多模態理解、推理與生成的深度統一,標誌着從“集成式”向“原生統一”的跨越。該架構摒棄拼接式設計,去除視覺編碼器和變分自編碼器,提升了模型效率與性能。
OpenAI計劃將視頻生成器Sora整合進ChatGPT,以拓展多模態AI佈局,強化視頻創作能力,推動用戶增長。目前ChatGPT周活約9.2億,距10億目標尚有差距。Sora的接入有望吸引短視頻和視覺創作用戶,應對谷歌Veo和Meta的競爭。
中國AI產業崛起,全球調用量首超美國。OpenRouter數據顯示,2026年2月中國AI大模型周調用量超越美國,標誌應用落地取得突破。