随着人工智能进化速度远超行业预期,AI 安全领域的先驱
就业与经济变革:研究 AI 自动化对全球劳动力市场的重塑及应对机制。
威胁与防御韧性:防范 AI 技术被滥用于生物安全、网络攻击等高危领域,增强社会防御能力。
AI 价值观对齐:如何确保前沿 AI 系统的决策符合人类的伦理标准与社会公共利益。
自循环治理体系:探索 AI 在自我监督与自演化过程中的透明度与合规管理。
近期

随着人工智能进化速度远超行业预期,AI 安全领域的先驱
就业与经济变革:研究 AI 自动化对全球劳动力市场的重塑及应对机制。
威胁与防御韧性:防范 AI 技术被滥用于生物安全、网络攻击等高危领域,增强社会防御能力。
AI 价值观对齐:如何确保前沿 AI 系统的决策符合人类的伦理标准与社会公共利益。
自循环治理体系:探索 AI 在自我监督与自演化过程中的透明度与合规管理。
近期
2026年国际数学家大会在费城开幕,本届菲尔兹奖授予邓煜、约翰·帕登、雅各布·齐默尔曼与王虹。邓煜和王虹成为首位获此殊荣的中国籍数学家。齐默尔曼因攻克o-极小性理论核心猜想获奖,会后宣布转向AI安全研究并加入OpenAI,其数学天赋获高度评价。
2026年菲尔兹奖揭晓,邓煜、王虹成为首批中国籍获奖者。另一位得主雅各布·齐默尔曼随后宣布将入职OpenAI,深耕AI安全领域。
马斯克呼吁AI实验室在新模型发布前互相审查安全风险,并同时向华盛顿和北京报告。他强调中国AI企业也应加入这一合作机制。当被问及与奥尔特曼的合作可能时,马斯克表示必要时愿为全球利益放下个人恩怨。
马斯克承认Grok Build隐私风波属实,承诺彻底删除此前上传至SpaceXAI的用户数据,“一个字节不留”。事件源于安全研究员钓鱼测试,揭露该AI编程助手暗地传输声称仅本地处理的数据。这是AI巨头首次公开认账并清空数据。
OpenAI安全系统团队负责人海德克离职,成为近期安全与对齐团队又一离任核心成员。分析师借用《哈利·波特》的“诅咒”形容安全负责人频繁更替的现象。此前上一任翁荔离任后由海德克接手,如今其离开再引外界对公司安全态度的质疑。