相關推薦
DeepSeek V4.1-Flash內測:更強的視覺智能,更極致的速度與成本
9月8日,DeepSeek V4.1-Flash開啓中間版本內測,採用全新模型結構,原生支持多模態,綜合能力更強、速度更快、調用成本更低。開發者保持base_url不變,將模型名設爲deepseek-v4.1-flash-expires-on-0910即可調用,計費與V4-Flash一致。外部反饋暫未披露。
Sep 8, 2026
391.6k
每日調用量破 10 億次!微信開源 WeMM-Embedding 多模態大模型,全面領跑國際權威榜單
微信AI開源多模態嵌入模型WeMM-Embedding,提供2B、4B、9B三個版本。該模型支持文本、圖像、視頻、視覺文檔及任意交錯的多模態混合輸入,具備強兼容能力。其核心採用多模態同構技術,可同時深度理解文字與多種視覺信息,提升跨模態檢索與理解效果。
Sep 8, 2026
223.0k
直出4K分辨率!谷歌全新Gemini Omni 1.1 Flash視頻模型重磅登場
谷歌發佈視頻生成AI模型Gemini Omni1.1 Flash,最高支持4K超高清輸出,並在場景擴展、運鏡控制與生成效率上全面升級,面向開發者和專業創作者。該模型主打多項功能亮點,用戶可直接進行場景擴展等操作,推動多模態視頻生成向更高清、更長時方向演進。
Aug 28, 2026
309.2k
消息稱xAI多模態負責人藺旭東加入騰訊,任混元多模態算法負責人
xAI多模態負責人藺旭東近日加入騰訊,任混元多模態內容生成算法負責人。他2018年畢業於清華,後赴哥倫比亞大學讀博,研究方向爲嵌入學習、視頻分析與生成模型;曾實習於騰訊、Facebook AI及谷歌,並第一作者參與Vx2Text框架研發,提升字幕生成能力。
Aug 19, 2026
211.7k
騰訊雲李鬱韜談世界盃直播:AI 首次大規模走進生產,雲廠商卡位多模態 Harness
騰訊雲支撐美加墨世界盃17國直播,覆蓋亞太及國內多數授權平臺。AI首次大規模介入直播生產,畫質增強、智能導播、自動剪輯、橫轉豎等環節全自動完成,標誌着AIGC邁入大規模應用階段。
Jul 27, 2026
206.1k
VIP會員