8月25日,阿里云推出大规模视觉语言模型Qwen-VL,支持中英文多语种,具备文本和图像的联合理解能力。Qwen-VL基于阿里云此前开源的通用语言模型Qwen-7B,相较其他视觉语言模型,Qwen-VL新增了视觉定位、图像中文字理解等能力。Qwen-VL已在GitHub获得3400多星,下载量超过40万。视觉语言模型被视为通用AI的重要演进方向。业界认为,支持多模态输入的模型能提升对世界的理解能力,拓展使用场景。阿里云通过Qwen-VL的开源,进一步推动通用AI技术的进步。
相关推荐
国产大模型迎里程碑突破!灵骏真武M890超节点正式上线,国内首个跑通超2万亿参数大模型
阿里云灵骏真武M890超节点实例全面上线,首个在乌兰察布开售,标志着国内超大规模模型训推关键突破。该实例成功运行超2万亿参数大模型,已支持Kimi K3及2.4万亿参数的Qwen3.8 Max等旗舰模型对外服务。
2026年8月12号 14:43
157.4k
消息称阿里内测 AI 办公平台"万有无界":多个数字员工组队干活
阿里云正内测B端人机协作平台“万有无界”,核心玩法是组建多名数字员工构成的协作小组,像真实团队一样围绕复杂项目分工推进、联合交付。与此前侧重日常办公流程的“千问办公”不同,该平台聚焦多智能体协同,进一步完善了阿里云在复杂项目交付领域的布局。
2026年8月3号 10:48
188.3k
OpenAI人才流动:前研究员田永龙入职腾讯,深耕视觉语言模型研发
OpenAI前研究员田永龙加盟腾讯大语言模型部,专注视觉语言模型研发。此举被视为腾讯强化多模态大模型布局的关键引援,凸显前沿人才争夺激烈。
2026年7月9号 10:16
239.7k
OpenAI 前研究员田永龙被曝加入腾讯混元多模态团队
OpenAI前研究员田永龙已加入腾讯,或将担任混元多模态模型负责人,主导视觉语言模型(VLM)研发。消息尚未官宣但备受业界关注,继姚顺雨之后,他成为混元团队引进的又一核心人才,显示腾讯正加速强化多模态大模型领域的人才与技术布局。
2026年7月8号 11:10
267.1k
阿里云QoderWork推出“峰谷Token”:错峰调用Qwen3.7-Max低至2折
阿里云旗下QoderWork推出“峰谷Token”计费,引导用户错峰利用夜间(22:00至次日8:00)闲置算力,任务自动享低至2折优惠,主力模型Qwen3.7-Max等受益。该模式精细化配置AI资源,为企业和开发者大幅降低大模型应用成本。
2026年6月24号 13:51
213.5k
