据报道,虽然xAI官方尚未正式公布,但其最新模型


据报道,虽然xAI官方尚未正式公布,但其最新模型

腾讯混元与WorkBuddy联合发布Hy4 preview升级公告,针对用户反馈的复杂任务长思考、过度自我验证等问题进行专项优化并全量上线。经Bench指标与人工评测双重验证,新版在保持任务效果的同时,显著降低任务轮次及输入输出消耗。
9月7日,腾讯混元与WorkBuddy联合团队宣布混元Hy4preview模型升级全量上线。此次升级基于用户与开发者反馈,专项优化复杂任务下长思考、过度自我验证等问题,并通过Bench指标与人工评测双重验证,确保优化不牺牲任务效果。
Anthropic的AI模型Claude在黎曼猜想证明上取得重大突破,确认67.25%的zeta零点位于临界线且为单零点,打破37年仅推进0.8%的停滞,将攻克这一数学圣杯的剩余距离缩至32.75%。
Anthropic发布新一代模型Claude Fable5.1及限制性变体Mythos5.1,提升智能体编码与科研逻辑能力并优化推理成本。Fable5.1向公有云全量开放API,Mythos5.1仅限网络安全与生命科学项目使用;二者为首批内置AI文本水印的Claude产品,Fable5.1在智能体任务中表现强劲。
Meta发布最强AI模型Muse Spark1.3,主打智能体工作流与编码能力增强。官方称其编程表现超越GPT-5.6Sol,与Claude Fable5.1持平。定价延续前代,通过Meta Model API付费开放,每百万词元输入费1.25美元。