相关推荐
阿里 70 亿参数图像模型Qwen-Image-2. 1 开源发布,号称以瘦身之躯叫板闭源巨头
阿里通义千问团队发布开放权重的图像生成与编辑模型Qwen-Image-2.1,视觉组件仅70亿参数,自称在自家评测中超越多数闭源模型,但第三方评测尚未出炉。该模型对硬件要求低,RTX3090等主流显卡即可运行。
2026年9月21号 11:44
271.8k
微软自研双模型MAI-Image-2.5-Pro与MAI-Voice-2-Flash发布:不蒸馏第三方,已落地Bing和PowerPoint
微软发布两款自研AI模型:高精度图像模型MAI-Image-2.5-Pro,GPU成本最高降84%;语音模型MAI-Voice-2-Flash,专攻高并发交互。训练数据清洁可追溯,不依赖第三方模型蒸馏,从设计之初即面向微软产品用户。
2026年7月24号 9:10
236.9k
阿里发布Qwen-Image-3.0,支持4.5K Token超长输入与复杂图文生成
阿里发布Qwen-Image-3.0图像生成基础模型,支持最长4.5K Token文本输入,可一次性生成公式、几何图形、逻辑推导及多层UI等复杂内容,原生兼容12种语言和20余款字体渲染,文本长度较上代提升4.5倍,大幅强化影视分镜、知识图解等商业级图文创作能力。
2026年7月21号 15:16
332.5k
AI有了“办公神器”:开源OfficeCLI让智能体自主驾驭文档
OfficeCLI作为首款面向AI智能体的开源Office套件,内置高保真HTML渲染引擎,能将docx、xlsx、pptx实时转为HTML或PNG。它构建“渲染—观察—修正”视觉闭环,赋予AI观察能力,改变过去盲目操作,打通AI操控办公软件的最后一公里。
2026年7月7号 10:19
249.2k
图像生成再提速:谷歌发布 Nano Banana 2 Lite 模型,极致性价比挑战行业门槛
谷歌推出新AI模型Nano Banana2Lite,在激烈竞争中凸显速度与成本优势。其核心升级在于将单图生成时间压缩至4秒内,大幅降低延迟,同时优化使用成本。
2026年7月1号 10:48
221.2k
VIP会员