寒武纪今日宣布,已基于 vLLM 推理框架完成对深度求索(DeepSeek)最新开源模型
针对
硬件层面,寒武纪深度挖掘了 MLU 的访存与排序加速特性,有效应对
行业分析指出,DeepSeek-V4凭借百万字(1M)超长上下文及顶尖的逻辑推理性能,对底层算力架构提出了严苛要求。寒武纪在模型发布首日的敏捷适配,不仅展示了国产算力平台对超大规模、复杂结构模型的承载能力,也预示着国产 AI 产业链在软硬协同层面已进入成熟期,为大模型应用普惠提供了高效的算力底座支持。

寒武纪今日宣布,已基于 vLLM 推理框架完成对深度求索(DeepSeek)最新开源模型
针对
硬件层面,寒武纪深度挖掘了 MLU 的访存与排序加速特性,有效应对
行业分析指出,DeepSeek-V4凭借百万字(1M)超长上下文及顶尖的逻辑推理性能,对底层算力架构提出了严苛要求。寒武纪在模型发布首日的敏捷适配,不仅展示了国产算力平台对超大规模、复杂结构模型的承载能力,也预示着国产 AI 产业链在软硬协同层面已进入成熟期,为大模型应用普惠提供了高效的算力底座支持。
Deep Code开源终端编程助手因深度适配DeepSeek-V4系列模型受关注,主打高质量推理与代码生成。历经迭代至v0.1.31版,功能趋于成熟,支持VS Code插件模式,为开发者提供新的辅助选择。
AI推理芯片初创公司Etched近日完成融资,估值达50亿美元,年销售额突破10亿美元。该公司专注为特定任务设计的ASIC推理芯片,其成功有力验证了推理芯片的市场潜力和强劲需求,为全球及国内芯片设计行业注入强心针。
腾讯云宣布自2026年6月3日起大幅下调DeepSeek-V4系列模型调用价格,全面与官方售价持平。其中,DeepSeek-V4-Pro缓存命中价格降幅最高达97.5%,推理输入和输出价格均下调75%;DeepSeek-V4-Flash缓存命中价格也下调90%。
DeepSeek在发布V4版五天后,灰度测试多模态识图功能,新增“识图模式”入口,支持图片理解。实测显示,其在基础视觉理解、复杂人物和环境识别上表现优异,标志着从文本向视觉交互的跨越。
DeepSeek-V4发布仅10小时,北京大学DCAI团队便通过最新开源的One-Eval评测框架,快速生成全量自动化评测报告。传统大模型评测流程繁琐,需耗费大量精力在搭建测试管道上,而One-Eval显著提升了效率,标志着行业进入新阶段。