Claude Code大重构!内部3万Agent管理技术免费开放
Jay 发自 凹非寺
多人云端Coding的时代,来了。
刚刚,Claude Code的项目功能迎来全面重构,原生支持多Agent玩法。
用户下达目标,Claude在云端派生多条Git分支并行干活,写完直接提PR。
此外,A社还新增了共享记忆,保证Agent之间的上下文对齐。
可以说是彻底超进化了,Project不再只是个放提示词和文档的文件夹。

同一时间,在Anthropic披露的最新报告中,也已看到这项能力的上限:
他们内部研发平台,每天同时跑着3万个AI Agent,在云端疯狂写代码、调模型、跑测试。
是的,3万个。。。
结果就是,自家核心的AI研发工作,现在已经有整整26%由Claude主导,来到L4级别。
半年前,这个数字还不到1%。

一个人带一个Agent军团,Claude Code大重构
最新亮相的Claude Code Projects重构版,彻底终结了把Projects当「静态资料夹」的时代。

以前的Projects功能,本质上就是个存放提示词和参考文档的文件夹,聊上几轮上下文就乱成一团。
这次重构直接把形态变成了「以对话为驱动的协作中心」,架构核心是一个名为Coordinator(协调器)的大脑。
开发者不需要再手把手教AI每一步怎么走,只要在主对话框下达一个高阶目标,比如「把整个鉴权模块重构为OAuth 2.0并补齐自动化测试」。
主协调器接收到指令后,会自动把复杂的工程任务拆解为多个子任务,并调度分配给并行的工作线程。
而每一个工作线程,都是一个运行在云端独立环境里的Claude Code实例。
它们拥有完全隔离的代码副本,各自拉出独立的Git分支,在后台同时推进不同模块的代码编写与单测。
活干完了,工作线程会自动在后台提交代码并生成PR。
协调器还会贴心地跟踪各个子任务的上下文依赖,提醒开发者先合并哪个分支、后测试哪个模块。
神了,Vibe Coding几个月,好不容易学会Git。
你现在告诉我,连Git也白学了???

说回新版Project。
道理大家都懂,以前也不是没人干,但问题在于——
多个Agent各写各的,其实际体验是不太好的,各个会话需要互相传递上下文,中间会出现相当多信息损失。
结果就是,Token消耗巨大,速度也没快哪去。。。
但这次,A社给出了新的的解决方案:共享记忆。
所有分支线程在执行过程中沉淀的技术规范、架构决策与团队偏好,都会实时同步回共享记忆。
这样,Claude就可以记住系统将发布时间改到了周五,为什么导出功能被取消了,以及在访问账单服务之前需要联系谁。
泪目,终于不需要在每个子任务里重复粘贴配置了o(╥﹏╥)o。

更关键的是,整个过程支持完全异步。
开发者下完指令合上电脑就能去喝咖啡,甚至可以通过移动端随时查看各线程进度,并微调指令。
但A社也承认,多Agent嘛,肯定是不便宜的,建议大家随时注意自己的usage,别一不小心就干崩了。

对了,先别兴奋地太早。
Projects现在是beta,而且挑人。
第一批是部分Claude Pro和Max订阅用户,还得是用云会话项目的人。
接下来一周会慢慢放量,Team、Enterprise,Cowork……都得再等等。
26%的研发交给AI,半年飙升26倍
可以先看看A社内部是咋用的。
太有毅力了嗷。
「安全叙事」暴雷后,A社依旧乐此不疲地沉浸在自己的核弹艺术里。
Anthropic在最新发布的《衡量AI研发节奏》报告里,首次公开了自家内部的AI自主研发基准数据。
先对齐一下定义。这套自动化分级标准由前沿机构Epoch AI制定,从AL0一路排到AL5。
AL0是纯人类操作,AL3是深度人机协作,AL4代表AI能凭一个高阶指令端到端完成任务,AL5才是完全脱离人类干预的自主闭环。
在这套坐标系下,A社内部目前的自动化评级是,AL4级研发任务占比26%。
看着不是很多,但你要知道,今年2月这个数字还不足1%。
半年,26倍。
把标准调低点的话,Anthropic内部超过90%的研发流程,已经处在AL3级别。
当然,这么庞大的自主研发也不是白来的,A社选择了最烧Token的打法:
截至今年8月,A社的内部研发平台上,常态化并发运行着多达30000个AI Agent,在云端没日没夜地写代码、跑实验、改架构,单月触发的决策量就超过了10亿次。
纯纯的赛博黑工啊。。。

不过,几万个Agent在底层狂飙,失控了怎么办?
这当然是不用你担心的,A社向来在这方面遥遥领先,早已想好了PR话术(bushi)。
公司表示,他们专门配备了全天候实时监控系统(Agent Oversight),对所有AI操作进行动态审查。
在8月份超10亿次模型决策中,系统精准拦截了大约0.002%的高风险或异常行为。
是挺厉害的。
不过吧,你的A社前几天刚被曝出花钱操控舆论、散布安全焦虑,现在这套说辞还有多少人信,就不好说了。
Dario当然也想到了这点,为了防止大家质疑自己对安全的真心,A社这次竟然给「发票」搬了出来——
Dario显然也想到了这点。
为了证明自己对安全的真心,A社这次干脆把「发票」掏了出来:
7月13日至20日,公司约6%的AI研发算力花在安全与对齐研究上。
同一周,AI驱动型研发的算力里,约12%投向安全相关任务。
外界质疑王婆卖瓜?
A社表示,欢迎第三方评估团队,给予内部风险团队同等级别的数据访问权限,对自动化数据进行审计。
Coding新赛季
从内部26%的自主研发率,到外部重构的多线程Projects,本以为折腾得差不多了的Coding,如今似乎又往前推了一步。
写代码的动作正在迅速贬值,工程拆解与任务调度的能力成了核心。
以往一个中级工程师在终端里一次只能死磕一个特性,现在你一个人就是一个技术小组,底下带着一群Claude Code同时开工。
人在这个链条里的角色,从逐行敲代码的执行者,变成了拍板架构方向、审核PR和处理异常边界的技术负责人。
当然,多Agent并行并不是万能灵药,多分支重叠修改依然会不可避免地撞上Git合并冲突。
遇到这种代码冲突,协调器会把依赖关系理清楚,最终还是需要人类工程师介入把关。
但不可否认的是,AI写代码早已跨过了简单的单行补全阶段。
一边是内部30000个Agent单月触发10亿次决策,一边是外部产品直接支持多分支并发提交PR。
而这也不只是A社一家的判断。
9月10日,Cursor发布Projects beta,主打的同样是Coordinator Agent,一个不写代码的协调者,向下派发数千个子Agent,项目上下文云端共享,合上笔记本也照跑。
这也是Coding的下一步吧。
单点提效的时代结束了,开发效率的下一个瓶颈,在团队协作。
“特别声明:以上作品内容(包括在内的视频、图片或音频)为凤凰网旗下自媒体平台“大风号”用户上传并发布,本平台仅提供信息存储空间服务。
Notice: The content above (including the videos, pictures and audios if any) is uploaded and posted by the user of Dafeng Hao, which is a social media platform and merely provides information storage space services.”




