Anthropic 披露,其 AI 模型 Claude 目前已经达到"主导"下一代继任模型研发(R&D)工作 26% 的阶段。此次披露是该公司量化 AI 在多大程度上推动自身未来发展的举措之一,同时公司还公布了一套用于衡量这一开发速度的新指标体系。

Claude 已主导四分之一的研发工作

Anthropic 引入了一套六级框架(AL0 至 AL5),用于对内部研发任务中 AI 的参与程度进行分类。完全由人类完成的工作被归为 AL0,AI 在人类密切指导下完成大量工作的阶段被称为"协作(collaborates)",而 AI 仅凭高层级指令就能端到端完成大部分任务的阶段则被称为"主导(leads)"。最高级别 AL5,即完全自主,公司内部尚未达到。

根据这一框架,截至 2026 年 8 月,Claude 在 Anthropic 研发工作中"主导"的比例达到 26%,而 2026 年 2 月时这一比例还不到 1%。更广泛来看,公司整体研发工作中超过 90% 已经达到"协作"及以上水平。Anthropic 强调,无论在哪个衡量类别中,Claude 都尚未实现完全自主运行,全程仍有人类监督。

约 3 万个智能体处于持续监控之下

截至 2026 年 8 月,Anthropic 同时有约 3 万个 AI 智能体在开展研究与工程工作。该公司表示,其对这些智能体活动的 100% 都同时采用"在线"监控(实时审查智能体行为)和"离线"监控(事后审查记录)。在线监控审查的超过 10 亿次判断中,仅有 0.002% 被拦截;离线监控则从每千条记录中标记出约一到两条供进一步审查,每周约有 50 条记录被上报给人工审核人员。

同时公布安全领域的算力投入

Anthropic 还公布了投入安全研究的算力比例数据。在 2026 年 7 月 13 日至 20 日这一周内,整体 AI 研发所用算力中约 6% 被用于安全相关工作,而在 AI 主导自身研发的工作中,这一比例上升到约 12%。该公司将"安全相关"定义为主要目的是让 AI 系统更安全、更易理解或更稳健的项目。

回应业界对透明度的普遍关切

此次披露正值业界日益担忧:随着 AI 越来越多地参与加速自身的开发,人类可能愈发难以理解或控制这些系统。Anthropic 表示,希望通过持续公布此类测量数据,让公众更容易了解前沿实验室内部 AI 开发的真实进展,而不是仅依赖零散或不完整的信息。该公司表示未来将持续定期更新这些数据。

总结

Anthropic 披露,Claude 目前已"主导"其下一代模型研发工作的 26%,同时公布了约 3 万个智能体的监控体系细节,以及投入安全研究的算力比例数据。在 AI 开发透明度的讨论持续进行之际,这类量化报告能在多大程度上被业界广泛采纳,值得持续关注。