相關推薦
騰訊發佈GeometryCrafter:用AI解鎖開放世界視頻的幾何一致性之美
近日,騰訊在人工智能領域再下一城,其研發團隊通過Hugging Face平臺正式發佈了全新AI模型GeometryCrafter。這一模型以其在開放世界視頻中實現一致性幾何估計的卓越能力,迅速成爲科技圈的焦點。藉助擴散先驗技術(Diffusion Priors),GeometryCrafter不僅爲視頻內容的深度理解和處理帶來了新的可能性,也爲創作者和研究者提供了一把探索三維世界的“鑰匙”。GeometryCrafter的核心亮點在於其能夠從動態、複雜的開放世界視頻中提取並生成一致的幾何信息。所謂“開放世界視頻”,指的是那些內容
MiniMax Audio推Speech- 02語音模型,一次性可以輸入20萬字符
備受關注的音頻技術創新者MiniMax Audio正式發佈了其全新的Speech-02系列語音模型,支持30多種語音,一次性可以輸入20萬字符。爲用戶帶來更真實、更流暢、更便捷的音頻體驗。全新的Speech-02系列是本次更新的核心亮點。據官方介紹,該系列在多語言覆蓋能力上實現了顯著提升,能夠更準確、更地道地呈現多種語言的發音。更令人驚喜的是,Speech-02的人聲相似度高達99%,這意味着合成的語音聽起來更加自然、貼近真人. 此外,該模型還實現了零節奏故障,徹底解決了音頻播放過程中可能出現的
Krea整合Gemini文字生圖與圖像編輯功能:Chat界面迎來實用性飛躍
近日,人工智能創意平臺Krea宣佈成功接入Google Gemini的文字生成圖像(Text-to-Image)及圖像編輯功能,進一步提升了其平臺的生成能力和用戶交互體驗。據悉,這一更新顯著增強了Krea Chat界面的實用性,使其從單一的對話工具轉變爲一個集圖像生成與編輯於一體的綜合性創作平臺。這一進展被視爲Krea在AI驅動的創意設計領域邁出的重要一步,引發了業界和用戶的廣泛關注。Krea此前以其實時圖像生成和直觀操作界面受到創意工作者的青睞,而此次與Gemini的深度整合則爲其注入了更強大的技術支
Vibe Draw:將孩子的隨手塗鴉一鍵轉3D世界
近日,一款名爲Vibe Draw的人工智能工具在社交媒體上引發熱議,因其能夠將簡單的草圖轉化爲可交互的3D模型,尤其被認爲在兒童教育領域具有廣闊的應用前景。這款工具以其直觀的操作和強大的生成能力,讓孩子們隨手繪製的圖畫瞬間變成栩栩如生的3D世界,爲教育工作者和家長提供了一種創新的教學與互動方式。Vibe Draw的核心功能在於其“從草圖到3D”的快速轉換能力。孩子們只需在工具的自由畫布上勾勒出簡單的輪廓,例如一座城堡的形狀,AI便能迅速生成對應的3D模型。更令人驚歎的
Arm 放棄收購 Alphawave,探索新戰略以搶佔 AI 芯片市場份額
軟銀旗下的 Arm Holdings近期考慮收購英國半導體 IP 供應商 Alphawave,以提升其在人工智能(AI)處理器領域的競爭力。Arm 特別看中了 Alphawave 的 SerDes 技術,這一技術對於需要在芯片之間進行快速數據傳輸的 AI 應用至關重要,尤其在 ChatGPT 等系統中扮演關鍵角色。然而,儘管進行了初步談判,Arm 最終決定不再繼續推進收購計劃。圖源備註:圖片由AI生成,圖片授權服務商Midjourney這一消息一經披露,Alphawave 的股價迅速上漲。該公司股價飆升21%,最終以上漲15.08% 收盤,市值達到約8.19億英鎊(約合
VIP會員