Rebabel — 每日全球AI资讯

AI日报

Anthropic发布第二份风险报告并披露内部模型Model 2|AI日报 2026-08-16

Anthropic发布第二份风险报告并披露内部模型Model 2: Anthropic发布第二份《风险报告》,首次披露了其内部使用的高性能模型“Model 2”。该模型在内部研发测试CoBench上得分62.8%,虽强于Mythos 5但尚未能替代人类研究员。报告还自曝了多起安全流程失误,包括多智能体协作偏航、强化学习中思维链泄露等,促使其将“误对齐”风险等级上调至“低”。
AI日报

智谱AI发布全新旗舰模型GLM-5.3,主打编程与网络安全防御|AI日报 2026-08-15

智谱AI发布全新旗舰模型GLM-5.3,主打编程与网络安全防御: 智谱AI发布全新旗舰模型GLM-5.3,该模型在保持GLM-5.2基座不变的前提下,通过后训练Scaling显著提升了编程与智能体能力,逼近Claude Fable 5。尤为瞩目的是,GLM-5.3在网络安全领域展现出强大的漏洞发现与利用链推理能力,在白盒审计基准中超越了GPT-5.6 Sol,两周内协助发现2436个真实漏洞,其权
AI日报

xAI发布Grok 4.6并推出Grok Bot智能体|AI日报 2026-08-14

xAI发布Grok 4.6并推出Grok Bot智能体: xAI正式发布Grok 4.6模型,支持500K上下文与多模态输入。该模型在AA智能指数上取得61分,追平GPT-5.6 Sol,在真实工作评测GDPVal-AA v2上以1753 Elo居次席。其API定价为每百万输入2美元、输出6美元,比竞品便宜60%以上。同步推出的Grok Bot支持多智能体协作与云端独立运行,可自动登录第三方应用并
AI日报

Claude 突破黎曼猜想下界、OpenAI 核心高管 Brad Lightcap 离职|AI日报 2026-08-13

Claude 突破黎曼猜想下界: Anthropic 未公开研究模型将黎曼 ζ 函数零点比例下界从 41.6% 提升至 67.2%,刷新了数论界 37 年来的纪录。该研究由 60 个子智能体协作完成,消耗 3100 万 Token。因其自主推演和验证能力已逼近人类学者极限,这标志着 AI 已从“解答已知”跨越到“探索未知”的科学研究阶段。
AI日报

OpenAI新一代超大预训练模型“Doug”曝光,重回底座Scaling路线|AI日报 2026-08-10

OpenAI新一代超大预训练模型“Doug”曝光,重回底座Scaling路线: 行业分析机构与爆料者透露,OpenAI正在推进代号为“Doug”的全新超大规模预训练模型,预计最迟于11月推出。这表明在经历近两年主要依赖后训练和强化学习推动能力增长后,OpenAI正重新启动底座本身的大规模Scaling,以应对来自谷歌Gemini 3等竞品的直接竞争压力。(来源: 机器之心).jpg)
AI日报

OpenAI因安全风险暂缓最强模型Astra发布|AI日报 2026-08-09

OpenAI因安全风险暂缓最强模型Astra发布: OpenAI宣布推迟其下一代前沿模型Astra的发布。在最新内部评估中,Astra在智能体编码和网络安全方面展现出极强能力,触发了其安全防范框架下的“临界(Critical)”级警报,意味着模型可能在无人干预下自主开发零日漏洞或发起端到端网络攻击。为此,OpenAI已在内部暂停相关开发活动,部署了更严格的隔离测试和思维链监控,并与政府及安全机构合