在 AI 飞速进化的2026年,如何防止大模型“胡言乱语”或被恶意引导,已成为大厂们的头等大事。当地时间3月9日,
作为 AI 安全领域的“扫描仪”,
收购完成后,
从近期发布
这场收购不仅是技术的融合,更是行业标准的重塑。当 AI 巨头开始亲自动手“打补丁”,整个 AI 安全赛道或许将迎来一场深刻的洗牌。

在 AI 飞速进化的2026年,如何防止大模型“胡言乱语”或被恶意引导,已成为大厂们的头等大事。当地时间3月9日,
作为 AI 安全领域的“扫描仪”,
收购完成后,
从近期发布
这场收购不仅是技术的融合,更是行业标准的重塑。当 AI 巨头开始亲自动手“打补丁”,整个 AI 安全赛道或许将迎来一场深刻的洗牌。
谷歌云在“Gemini at Work2026”大会宣布,面向全球企业客户推出全新Gemini智能体,定位为“通用工作智能体”,旨在以一站式界面革新企业日常协作与生产力。该智能体突破传统AI仅能简单问答的局限,用户只需输入宏观工作目标,即可自主处理后续任务,提升企业工作效率。
陶哲轩等学者严厉批评OpenAI批量发布AI生成的数学证明。OpenAI从GitHub发布含数百项开放难题解答的719份数学手稿,被指违背“数学与人工智能顾问小组”关于提高专有模型透明度与发布规范的建议。陶哲轩称,这种工业化批量攻克难题造成“证明消化不良”,理解机制缺失正威胁数学研究生态。
Anthropic近日全面修订Claude使用政策,新规将于2026年11月12日生效。此次修订首次在条款中加入禁止“持续且不必要的虐待或残忍行为”,主要针对用户无明确目的、反复对模型实施残忍对待。官方表示,当前执行机制主要采取……具体措施原文未完整披露。此举凸显AI企业正强化人机互动伦理与使用边界。
芯片设计软件龙头新思科技表示,尽管美国收紧AI与半导体出口管制,仍计划与中国大语言模型构建者合作,利用其工具的AI版本,帮助中国本土企业加速芯片研发。此前,新思科技已与OpenAI签署多年协议,联合打造专用AI模型,推动芯片设计流程自动化、缩短开发周期。高层透露合作模式将延伸并本土化。
上周突遭解雇的三名OpenAI研究人员巴莱斯尼、科尔巴克和贾斯敏·王今日发公开信,担忧此举令在职员工噤若寒蝉,重创公司文化。题为《OpenAI无法独自确保AI安全》的信由AI对齐研究者巴莱斯尼在社媒发布,收信对象为OpenAI各安全团队,凸显对AI安全治理与内部文化的担忧。