近日,騰訊微信視覺團隊正式宣佈開源通用多模態嵌入模型 WeMM-Embedding。該模型全面支持文本、圖像等多模態輸入,旨在通過先進的技術架構與訓練策略,爲廣大 AI 應用開發者提供堅實的技術支撐,進一步推動人工智能技術在更多垂直領域的創新應用。
在版本佈局與技術架構上,WeMM-Embedding 推出了 2B、4B 和 9B 三個不同體量的版本,以適應多樣化的部署需求。該模型採用了統一架構設計,並結合了兩階段訓練及知識蒸餾等核心技術,在大幅提升多模態理解能力的同時,有效兼顧了實際落地中的部署效率。
作爲一項已經在實際業務中經歷過嚴苛檢驗的技術成果,該模型目前已大規模部署在微信的推薦與搜索系統中,線上日調用量高達十億量級。此次全面開源,不僅標誌着微信在多模態AI技術生態建設上的進一步開放,也將爲行業內的AI應用開發帶來強有力的技術賦能。
VIP會員