编译新闻 2026.08.15 · 北京

人工智能

Anthropic 8 月风险报告:自动 AI 研发可能变成主要风险

灾难性风险仍评低,但部分评测已经饱和,信心在下降。Claude 已写掉 Anthropic 大部分合并进生产的代码。

编译 Newsdesk 2026.08.15 来源 Moneycontrol

Moneycontrol 8 月 15 日报道了 Anthropic 的《Risk Report: August 2026》。报告看错位、自动研发、化学生物武器和更广义的加速。公司仍把整体灾难性风险评为低,但对自动研发这一项的把握不如以前:一些任务评测已经饱和,测不出能力还在往上走。

Claude Mythos 5 和 Model 2 已经大量用于公司内部的研究和工程,包括持续运行的 agent。Anthropic 说,Claude 现在写掉了合并进生产代码库的大部分代码。即便如此,模型还不能完全替代研究科学家和工程师:有明显加速,但进度没有因为 AI 帮忙而翻倍。

内部评测 CoBench 上,Model 2 拿到 62.8%,Claude Mythos 5 是 50.3%。公司估计,要完全顶替技术员工,至少得打到 85%。

领先指标显示,「有意义的加速」从 2025 年早中期开始,但不到 2 倍。公司认为最初那波加速很多不是 AI 造成的,不过模型已经成为把更快趋势维持下去的关键因素。当前节奏仍低于 Responsible Scaling Policy 的门槛:AI 研发自动化有没有让进步速度相对「AI 辅助之前」翻倍。公司也提醒,测量可能落后于最近的变化。

Anthropic 还访谈了 31 位来自机器人、能源、生物、半导体、武器、神经技术和纳米领域的人。结论是 AI 在写代码、分析和研究杂务上提高了效率,但还没到能迅速改写地缘政治的自动化程度。

报告本身是 8 月 14 日发布的。这篇是 15 日 10:02 IST(北京时间 12:32)的报道。

出处 · 可点开原文

  1. Moneycontrol
编译新闻 · news.coderluny.com