蚂蚁集团 AI 安全实验室近日正式开源大模型内生式安全护栏技术 SingProbe。该技术区别于主流的外挂式安全审核模式,通过复用基座模型推理过程中的隐藏状态,以不足0.5% 的额外计算开销,实现 token 级实时风险评估,可同步完成意图分类、安全检测和幻觉识别任务,在医疗等高风险场景优势突出,能在内容输出前实施毫秒级阻断。
目前 SingProbe 已适配29个主流大模型,是首个由大型科技企业开源的完整内生式安全技术解决方案,其开源代码和预训练模型已同步发布。

蚂蚁集团 AI 安全实验室近日正式开源大模型内生式安全护栏技术 SingProbe。该技术区别于主流的外挂式安全审核模式,通过复用基座模型推理过程中的隐藏状态,以不足0.5% 的额外计算开销,实现 token 级实时风险评估,可同步完成意图分类、安全检测和幻觉识别任务,在医疗等高风险场景优势突出,能在内容输出前实施毫秒级阻断。
目前 SingProbe 已适配29个主流大模型,是首个由大型科技企业开源的完整内生式安全技术解决方案,其开源代码和预训练模型已同步发布。
9月16日,阿里千问Qwen3.8-27B在Hugging Face最受欢迎开源大模型榜单登顶,超越FLUX.1、DeepSeek-R1、Kimi-K3、Meta-Llama-3等。该榜以开发者点赞为评选口径,反映真实偏好,而非跑分或参数规模,成社区史上最受欢迎开源模型。
谷歌发布全球语言智能新成果:AI支持超300种语言,覆盖71亿人口、86%比例。谷歌称语言大模型不应只做文本翻译,还需理解语气、情感与文化细微差别;同时指出传统语音识别多步刚性管线存在局限。
Anthropic于2026年9月15日升级中小企业版Claude,新增43项高效工作流及27个主流商业软件深度集成,推动AI从后台辅助转为核心业务驱动力。今年5月曾首推智能连接器与预置工作流,此次升级进一步扩展生态,助力中小企业增长。
尽管两大AI巨头掌门人刚呼吁为技术狂飙“踩刹车”,OpenAI与Anthropic本周却悄然灰度测试下一代旗舰模型,被指“光速打脸”。OpenAI测试GPT-6Sol,Anthropic跳过5.1直接推新,行业竞争未减速。
近日,字节系企业生产力产品密集更新:火山引擎将豆包大模型Doubao-Seed-2.1-pro升级至0915版,API全量上线火山方舟,并同步在豆包工作可用;飞书发布8.0,推出团队智能体“豆包工作伙伴”,将AI从个人助手拓展至群聊、文档、会议及业务流程。新模型聚焦“生产级交付”,强化Agent任务证据溯源等能力。