Claude Code 现在可并行启动数十到数百个子代理,它们以对抗方式互相验证。实战考验:11 天内把 Bun 运行时约 75 万行代码从 Zig 移植到 Rust。
回想一下上一次你面对一项又大又枯燥的任务:重命名几百个文件、把整个项目翻一遍找 bug、迁移旧代码。你是一个人一点点手动搞定的,一边干一边小声骂娘,对吧?我们都经历过。而如今 coding agents 的飞跃已经不再是「帮我写这个函数」,而是「指挥一支大军替我干重活」。Anthropic 让 Claude Code 的 Dynamic Workflows 正式全面上线(GA),而他们抛出的数字着实让人肃然起敬:在单次会话内,数十到数百个子代理并行工作。这已经不是一个助手了,而是一整支听你号令的队伍。
一个会给自己使绊子的代理
真正精妙的地方在这里,而且比表面看上去更有门道。一旦触发,Claude 会根据你的需求进行规划,把工作拆成子任务,再分派给同时运行的多个代理。但真正的魔法在于对抗式验证:一部分代理从各自独立的角度攻克问题,另一部分则主动去反驳前者得出的结论,如此反复迭代,直到所有代理收敛到同一个答案。这就像拥有一支团队,里面总有人扮演唱反调的角色,好让任何错误都无所遁形。而且更妙的是,进度会自动保存:如果中途被打断,它会从原本的地方继续,而不是从头再来——这正是我们所有人最怕的噩梦。
一个把一切说清楚的案例
实验室里的数字固然漂亮,但没什么比一个猛料案例更有说服力。压轴演示是对 Bun 的重写,一个完整的运行时:约 75 万行 Rust 代码从 Zig 移植而来,从第一次 commit 到最终 merge 只用了十一天。停下来想一秒——这样一个原本会让人类团队耗上数月的项目,被一支代理大军在不到两周内解决了。Anthropic 摆出了那些显而易见的应用场景:代码审计、bug 猎捕、安全审查,以及成千上万个文件的迁移。恰恰是那些我们最讨厌手动去做的活儿,而人工智能碰巧做起来毫无怨言。
对 NeuralOS 来说这有双重意义
在这里我们就不装谦虚了,因为这件事对我们而言是双重的正中要害。一方面,我们在自己的构建与审计流程中用的正是这类多代理编排——事实上,你在 NeuralOS 里看到的很大一部分东西,就是这样构建和审查出来的:一支支代理大军互相验证。另一方面,它是最有力的证明,说明「一个构建者 + 众多并行代理」已经不再是一个好看的 demo,而是变成了一种真正可用于生产的工作方式。而这正是我们想交到你手中的力量:不是让你一个人构建得更快,而是让你指挥一支代理团队,在你思考下一个想法的同时替你干活。