智能手机厂商和芯片制造商在AI大模型领域展开暗战,挑战超过10亿参数的端侧技术已成为关键。联发科和高通成为手机芯片的焦点,突破摩尔定律的瓶颈成为创新挑战。用户对智能手机更智能、个性化的期望推动了大模型集成的需求。
相关推荐
微软云端隐忧:千亿营收背后的增速换挡与杠杆风险
云服务巨头军备竞赛白热化。微软云年营收首破千亿美元,增速43%;但谷歌云以82%增速反超。谷歌凭借自研模型与芯片的完整生态,将运营利润率从20.7%大幅推高,凸显技术路径决定商业回报的差异。
2026年7月31号 17:59
2,101.4k
DeepSeek V4 正式版疑定档 8 月 3 日:硅基流动涨价露马脚,API 已能答对新题
DeepSeek V4正式版自7月中旬灰度测试后一度跳票,官方至今未公布发布时间。但硅基流动平台通知自8月3日起,将DeepSeek V4 Pro的缓存命中价格从每百万Token 0.1元大幅上调至1.0元。这一突兀涨价被外界视为DeepSeek V4正式版即将上线的重要信号,8月3日或成为发布节点。
2026年7月31号 15:57
692.6k
DeepSeek-V4-Flash正式版上线,130亿激活参数撬动Agent战场
7月31日,DeepSeek-V4-Flash正式版API上线。该模型Agent性能逆袭Pro版,打破以往强弱分层逻辑。总参数2840亿,在Terminal Bench2.1等基准测试中斩获高分。此举标志国产大模型在Agent赛道迈出关键一步。
2026年7月31号 15:23
242.7k
腾讯开源 AngelSpec 框架:破解大模型真实推理效率难题
腾讯开源统训框架AngelSpec,通过多方案协同与工作负载异构适配,降低大模型自回归解码成本,提升推理吞吐量。针对不同场景文本特征采取差异化训练策略,如高熵多轮对话采用轻量稳定方案,实现真实场景下的高效推理。
2026年7月30号 10:39
236.1k
TaiXu-Admin V0.1.2 发布:把 LLM、RAG 与 Agent 收进同一套管理后台
TaiXu-Admin V0.1.2 将大模型对话、检索增强生成(RAG)与智能体协同整合至同一后台。更新重点:新增 LLM Wiki 解析与搜索,强化文档处理;引入热编译替换机制,代码改动无需重启即可生效。该项目正试图理顺分散的大模型能力,构建统一的应用管理框架。
2026年7月28号 11:15
361.6k
