跳转到主要内容

Anthropic的Claude现在处理其26%的研发工作

Anthropic的Claude现在处理其26%的研发工作

Anthropic悄然发布了内部数据,揭示了其自家AI已多么深入地渗透到公司的研发中。截至8月,Claude主导了26%的AI研发任务——相比六个月前的不到1%,这是一个惊人的飞跃。

六个自动化级别,但无完全自主

该公司使用六级框架来追踪AI的参与程度。第四级AL4被定义为“AI主导”:人类设定高层目标,Claude完成大部分繁重工作,由人监督和审查。如今,超过90%的研发工作达到人机协作级别或更高。然而,没有任何任务达到AL5——完全自主。AI始终处于人类监视之下。

在幕后,大约30,000个由Claude驱动的AI代理并行工作。它们相互分配任务、交叉纠正错误,仅在8月份就产生了超过10亿次决策

80%的代码来自Claude

为了控制风险,每个AI操作在执行前都会进行在线安全检查。异常决策会被直接拦截。后台还会定期抽样对话日志,高风险案例会提交给人工审查。

在代码层面,这种转变更加明显:合并到代码库中的超过80%的代码现在由Claude生成。工程师们表示他们的生产力成倍增长。这些AI代理处理大量底层工作——模型实验、代码编写、数据分析和结果验证。它们甚至参与迭代下一代Claude模型,这一过程被业界称为递归自我改进

关键要点

  • Claude在Anthropic研发任务中的份额从2月的<1%跃升至8月的26%。
  • 超过90%的研发工作达到人机协作,但没有任务是完全自主的。
  • 约30,000个由Claude驱动的AI代理仅在8月就产生了10亿次决策。
  • 合并到代码库中的超过80%的代码现在由Claude编写。
  • AI代理参与构建下一个Claude模型——这是一种递归自我改进的形式。