语音识别大模型迎来重要技术升级。9月23日,科大讯飞官方正式发布了全新一代语音识别大模型 Spark-ASR-2.0,标志着其在语音交互与智能硬件落地方面迈出了关键一步。
在具体的上线与落地节奏方面,该模型将于次日(9月24日)起在讯飞输入法中逐步上线,同时通过讯飞开放平台面向开发者与企业客户全面提供 API 服务。此外,Spark-ASR-2.0还将陆续在讯飞 AI 眼镜、讯飞智能办公本、讯飞听见等一系列核心软硬件产品业务中深度落地,持续拓展声学大模型在多元场景中的应用边界。

语音识别大模型迎来重要技术升级。9月23日,科大讯飞官方正式发布了全新一代语音识别大模型 Spark-ASR-2.0,标志着其在语音交互与智能硬件落地方面迈出了关键一步。
在具体的上线与落地节奏方面,该模型将于次日(9月24日)起在讯飞输入法中逐步上线,同时通过讯飞开放平台面向开发者与企业客户全面提供 API 服务。此外,Spark-ASR-2.0还将陆续在讯飞 AI 眼镜、讯飞智能办公本、讯飞听见等一系列核心软硬件产品业务中深度落地,持续拓展声学大模型在多元场景中的应用边界。
科大讯飞上线语音基座大模型Spark-Audio-1.0-Preview,基于全国产化算力训练。传统音频处理多采用级联方案,先转文字再理解,存在信息丢失(忽略语气、情绪、背景环境音)和链路割裂(语音转写、声纹识别等环节分离)两大短板,影响场景判断完整性。
科大讯飞发布星火X2.5大模型,采用MoE架构,参数规模293B-A30B,重点提升代码与智能体能力,并增强数学、理解等通用能力。该模型基于全国产算力完成训练推理,优化国产超长序列训推难题,已上线讯飞开放平台。端侧4B和1.7B模型已先行开源,支持最长100万Token上下文。
近日,中科院大连化物所联合科大讯飞、阿里云发布智能化工大模型3.0 Pro。作为我国化工行业首个大模型的最新迭代版,其发布标志着行业大模型正告别单一知识问答,向更深层次工业落地迈进;技术上从过去聚焦信息检索与内容生成,跨越到全新阶段。
科大讯飞9月1日将开源星火X2.5-4B和1.7B两款端侧通用大模型,原生支持1M token长上下文,重点提升智能体交互、数学计算与通用理解能力,面向车载、智能硬件及万物互联等端侧场景。9月7日还将发布更大规模模型。
科大讯飞在2026年半年度业绩说明会上透露,将于今年1024开发者节正式推出基于全国产算力的全新主力通用大模型;8月底率先发布阶段性版本,供市场和开发者提前体验,技术落地节奏已明确。