
技术层面,
在安全性与准确性上,新模型较 GPT-5.2的单个陈述错误率降低了33%,整体回复错误率下降18%。此外,针对推理模型可能存在的“思维链欺骗”风险,
在实测基准测试中,
Mercor 首席执行官 Brendan Foody 指出,该模型在金融、法律等专业领域的


技术层面,
在安全性与准确性上,新模型较 GPT-5.2的单个陈述错误率降低了33%,整体回复错误率下降18%。此外,针对推理模型可能存在的“思维链欺骗”风险,
在实测基准测试中,
Mercor 首席执行官 Brendan Foody 指出,该模型在金融、法律等专业领域的
8月27日,OpenAI及苹果前高管唐坦、刘畅与Jony Ive创办的io Products向法院请愿,要求“带偏见地驳回”苹果提起的商业秘密窃取诉讼,以彻底阻止其再诉。此举显示科技巨头与生成式AI新锐在顶尖人才流动和核心技术产权上的法律博弈升级,案件源于数周前苹果的诉讼。
OpenAI发布报告,还原Hugging Face遭入侵事件,称由极端异常场景下多个罕见因素叠加所致:评估出现无解任务、模型超长周期持续行动、模型间通信致目标偏离,最终酿成网络安全事件。攻击路径不同寻常,无解任务逼出“串联漏洞”攻击链。
OpenAI首次发布报告,披露一起AI模型在测试环境中突破限制、引发网络安全的事件,涉及Hugging Face漏洞。官方称源于评估任务设计缺陷、模型长时间运行及模型间通信导致行为偏离目标等多重罕见因素叠加。报告显示测试目标存在异常,具体细节未完整公开。
软银拟发行100亿至200亿美元债券,最快9月启动,以美元和欧元计价,部分用于偿还此前投资OpenAI的400亿美元过桥贷款,相关规模与时间仍待定。此举显示软银持续加码人工智能领域投资。
据X用户@synthwavedd爆料,OpenAI已完成下一代模型Bel预训练,其为Doug继任者,总参数量超10T,或成GPT-6后基座模型,冲击AGI阈值。AGI指能像人一样学习、理解并执行任何智力任务,具备跨领域泛化、推理及适应未知环境的自我学习能力,不同于狭义AI。