百度近日發佈並開源了3B參數規模的端到端OCR模型——
技術上,
在OmniDocBench v1.6基準測試中,該模型以93.92%的成績刷新紀錄。真實場景下,其推理速度較DeepSeek OCR提升約12.7%,在6000Tokens輸出長度下速度優勢擴大至35%,爲海量文檔數字化和大模型長程記憶管理提供了全新路徑。

百度近日發佈並開源了3B參數規模的端到端OCR模型——
技術上,
在OmniDocBench v1.6基準測試中,該模型以93.92%的成績刷新紀錄。真實場景下,其推理速度較DeepSeek OCR提升約12.7%,在6000Tokens輸出長度下速度優勢擴大至35%,爲海量文檔數字化和大模型長程記憶管理提供了全新路徑。
騰訊公益智能助手“公益Buddy”9月2日上線,系騰訊SSV基於WorkBuddy打造的首個公益行業AI基礎設施。它整合11個場景膠囊、42條場景能力,由15個智能體協同,覆蓋資助申請、票據處理、盡職調查等重複性事務,機構用戶可通過“發現應用”入口體驗。
資本市場對中國新一代人工智能熱情空前,本土大模型企業Minimax成最受內地投資者青睞的港股標的。8月內地投資者通過港股通買入其股票達106億港元,吸金規模居同類創新企業前列,甚至超越阿里巴巴等巨頭。
馬斯克在X平臺預告,未來10天內將推出Grok4.7模型,預計2026年9月12日上線。該模型參數規模達2.1萬億,較前代Grok4.6的1.5萬億增長40%,顯示xAI在參數規模與性能迭代上加速衝刺。推文還提及服務速度等細節,但相關信息未完整披露。
谷歌發佈博文宣佈,AI圖像設計與編輯工具Google Pics正式上線,用戶可通過pics.new網頁版或在Docs、Slides中直接調用。它支持上傳素材繼續修改,無需從空白畫布開始,適合製作邀請函、海報等視覺內容。該工具由Nano Banana圖像生成模型驅動,曾在今年5月I/O開發者大會亮相。
谷歌宣佈進軍創意設計領域,推出AI圖像創作與編輯工具Google Pics,將深度整合至Google Workspace企業及高級用戶生態,面向日常辦公與生活設計場景。其核心搭載Nano Banana圖像生成模型,與傳統設計平臺不同,主打通過提示詞直接生成和編輯圖像。