相关推荐
Qwen4已投入训练,阿里公布10万亿参数模型演进路线
9月22日云栖大会杭州开幕,阿里公布大模型进展:Qwen4已投入训练,后续参数规模计划扩至5万亿至10万亿;递归自我改进进入训练、推理及芯片协同;多模态矩阵升级,11月发布新一代视频生成模型。刘大一恒称Scaling是迈向ASI的重要路径。
2026年9月22号 14:03
238.9k
千问上线 Qwen3.8-Omni-Flash:1M 上下文,30项评测平均提升超26%
千问18日上线新一代原生全模态模型Qwen3.8-Omni-Flash,支持文本、图像、音频、视频输入及1M长上下文,已在千问AI平台开放体验。该模型在编程、文本知识、GUI操作等通用Agentic能力上,重点拓展音视频Agentic应用,覆盖视频剪辑、MV创作、影视制作解说、音视频转图文摘要与对话等,并已完成累计30项评测。
2026年9月18号 11:25
344.8k
微信 WeMM-Embedding 已被大规模使用:朋友圈搜索、视频号推荐都在跑,日调用 10 亿次
微信AI于9月4日开源多模态嵌入模型WeMM-Embedding,含2B、4B、9B三个版本,支持文本、图像、视频、视觉文档等交错输入,可在统一语义空间比较检索,已在朋友圈搜索、视频号推荐等场景落地。
2026年9月8号 10:04
238.9k
DeepSeek首个视觉实验模型正式开源,3050亿参数对标顶尖水平
DeepSeek开源V4系列首个实验性多模态模型V4-Flash-Vision-Exp。该模型基于V4-Flash架构融合视觉模块,在原有文本能力上新增深度图像理解与分析能力,总参数量达3050亿,视觉与文本架构有机结合,可精准解读图像并实现多模态融合。
2026年9月1号 9:02
223.0k
价格砍至四十分之一!智谱开源原生多模态大模型GLM-5.3-Flash
智谱开源原生多模态模型GLM-5.3-Flash(320B-A18B),以领先性能和极致定价推动AI普惠。该模型测评获57分,与Claude Opus4.8持平,编程能力相当,综合性能超越GLM-5.2。发布前以匿名“Ox-Alpha”公开测试,登顶OpenCode、OpenRouter平台调用。
2026年8月27号 10:00
294.2k
VIP会员