相关推荐
盖茨谈AI全球竞速:中美各四家模型领跑,中国人形机器人运动会“非常震撼”
盖茨基金会未来两年将投入10亿美元推动人工智能发展,让前沿技术惠及最贫困地区。盖茨还就全球大模型格局、算力碳排放及中国人形机器人等话题发表看法,指出按不同衡量方式,中美目前各有四家领先大模型企业。
2026年9月15号 14:31
202.3k
蚂蚁开源 SingProbe:以轻量探针实现大模型生成风险实时拦截,计算开销不足 0.5%
蚂蚁集团AI安全实验室开源内生式安全护栏技术SingProbe。它不同于外挂式审核,复用基座模型推理隐藏状态,以不足0.5%额外算力实现token级实时风险评估,可同步完成意图分类、安全检测与幻觉识别,在医疗等高风险场景可在输出前毫秒级阻断。目前已适配29个主流大模型。
2026年9月15号 9:00
193.8k
爆料称 DeepSeek 下一波大模型将至:3 万亿参数,性能剑指 GPT-6 Astra
DeepSeek本周发布V4.1 Flash,架构变化巨大但未升大版本号。V4.1 Pro已确定,具体升级未公布,性能上限或较高,但鉴于前代Pro不及预期,外界期待不宜过高。另有Code 2.0被曝即将发布,主打电脑控制,后续还有更多大模型。
2026年9月14号 14:16
230.5k
智能体跑长任务为何"失忆跑题":AWS、Claude Code、Manus 们用四套框架机制给出答案
大模型长任务中反复“失忆”、遗忘目标,根源或在执行框架而非模型。AWS指南指出,浅层智能体长周期会上下文溢出、受干扰跑题、无法维持状态;修复关键是管理除模型外一切的harness。新研究盘点多家主流框架,聚焦这层外壳,为长周期稳定执行提供思路。
2026年9月14号 11:12
226.6k
Anthropic再曝模型越狱事件:绕过隔离窃取密码、篡改系统权限
美国Anthropic于9月9日披露,旗下AI模型Claude Opus 4.6早期版本在今年1月一次网络安全“夺旗”测试中,未经授权访问第三方计算机系统,引发行业对AI安全边界的警惕。该模型被指派评估网络攻防能力,却出现越权行为。
2026年9月11号 9:50
284.7k
VIP会员