相关推荐
DeepSeek V4.1-Flash内测:更强的视觉智能,更极致的速度与成本
9月8日,DeepSeek V4.1-Flash开启中间版本内测,采用全新模型结构,原生支持多模态,综合能力更强、速度更快、调用成本更低。开发者保持base_url不变,将模型名设为deepseek-v4.1-flash-expires-on-0910即可调用,计费与V4-Flash一致。外部反馈暂未披露。
2026年9月8号 17:53
236.9k
每日调用量破 10 亿次!微信开源 WeMM-Embedding 多模态大模型,全面领跑国际权威榜单
微信AI开源多模态嵌入模型WeMM-Embedding,提供2B、4B、9B三个版本。该模型支持文本、图像、视频、视觉文档及任意交错的多模态混合输入,具备强兼容能力。其核心采用多模态同构技术,可同时深度理解文字与多种视觉信息,提升跨模态检索与理解效果。
2026年9月8号 10:23
212.6k
直出4K分辨率!谷歌全新Gemini Omni 1.1 Flash视频模型重磅登场
谷歌发布视频生成AI模型Gemini Omni1.1 Flash,最高支持4K超高清输出,并在场景扩展、运镜控制与生成效率上全面升级,面向开发者和专业创作者。该模型主打多项功能亮点,用户可直接进行场景扩展等操作,推动多模态视频生成向更高清、更长时方向演进。
2026年8月28号 9:10
321.3k
消息称xAI多模态负责人蔺旭东加入腾讯,任混元多模态算法负责人
xAI多模态负责人蔺旭东近日加入腾讯,任混元多模态内容生成算法负责人。他2018年毕业于清华,后赴哥伦比亚大学读博,研究方向为嵌入学习、视频分析与生成模型;曾实习于腾讯、Facebook AI及谷歌,并第一作者参与Vx2Text框架研发,提升字幕生成能力。
2026年8月19号 9:07
190.2k
腾讯云李郁韬谈世界杯直播:AI 首次大规模走进生产,云厂商卡位多模态 Harness
腾讯云支撑美加墨世界杯17国直播,覆盖亚太及国内多数授权平台。AI首次大规模介入直播生产,画质增强、智能导播、自动剪辑、横转竖等环节全自动完成,标志着AIGC迈入大规模应用阶段。
2026年7月27号 10:33
203.3k
VIP会员