Google 为 Gemini API 的 Managed Agents 新增四项能力:远程 MCP(mcp_server)、后台执行、可切换到 requires_action 的 function calling,以及通过 environment_id 刷新凭证而不丢失环境状态;其中最不起眼的一项——不重启就刷新令牌——才是让长时任务智能体真正可行的关键。
有些公告要看它说了什么,另一些则要看它透露了什么。7 月 7 日的这条属于后者。Google——由 Google DeepMind 的 Philipp Schmid 和 Mariano Cocirio执笔——为 Gemini API 的 Managed Agents 发布了四项新能力,其中之一是对远程 MCP 服务器的支持。这不是又一个营销上的勾选项:这是一个管道层面的决定。当一个 frontier lab 决定让自己的智能体通过 Model Context Protocol 与外部工具对话时,它就是在为这一代软件的默认线路选边站队。而管道层面的决定,恰恰因为看不见,才最能左右你能在其上构建什么。
Google 究竟宣布了什么
四块拼图,值得逐一审视,因为它们合在一起讲了一个故事。第一块是后台执行:你传入 `background: true`,服务器会以异步方式运行这次交互,并立即返回一个 ID 供你轮询状态。第二块是通过 `mcp_server` 工具与远程 MCP 服务器的集成,让智能体无需定制中间件即可触达私有数据库和内部 API。第三块是自定义的 function calling:内置工具在服务器上独立运行,而你自己的函数会让交互进入 `requires_action`,交由你的客户端执行本地业务逻辑。第四块——也是最安静的一块——是凭证刷新:你用现有的 `environment_id` 搭配一份新的网络配置来续期令牌,既不丢失文件系统状态,也不丢失已经装好的软件包。
为什么最不起眼的细节才最要命
四项之中,能让工程师松一口气的是最后一项,也是最不显眼的一项。任何搭建过长时任务智能体的人都懂那种窘境:访问令牌在一个二十分钟任务进行到一半时过期,天真的应对是把整个环境重启、重装依赖,把智能体已经做好的一切统统扔进垃圾桶。在保留状态的前提下刷新凭证,正是一个每小时崩一次的智能体和一个能真正连干数小时的智能体之间的分水岭。这就像不关手电筒就换电池:毫无光彩,后果却巨大。把它放在后台执行的旁边,意图就清楚了:让智能体独立运行、跑很长时间、触碰真实系统。
MCP 是线路,不是锁
这里值得把事实和解读分开。事实是,Google 把远程 MCP 接入了它的智能体 API。更广的解读是,MCP——这个由 Anthropic 开源、并在整个生态中逐步被采纳的开放协议——正在成为其余一切之上的标准底层,就像当年的 HTTP 或 USB。当心别把层次搞混:MCP 不是决定谁能进入你数据的那把锁——那仍由 OAuth 和 API-Keys 负责——而是智能体与工具之间那场对话得以流动的标准化管道。一个 frontier lab 把它当作理所当然,并不能证明整个行业已经宣告收敛,但这确实是一个强烈的信号:管道一旦开始标准化,就往往会变得既看不见又无处不在。
对用 AI 做产品的人意味着什么
给用智能体打造产品的人的教训很直接:永远分清锁和线路,别把你的架构绑死在本季度流行的那把锁上,因为真正持久的是管道。正是同样的推理——把 MCP 理解为传输标准,而非授权机制——指引着我们在 NeuralOS 中的自身判断,而 Google 这样的公告,恰好为这一假设提供了外部验证。还有一处诚实的呼应:不重启环境就刷新凭证的这套模式,正是一个按账户加密的密钥 vault 存在的意义所在——在不打断智能体正在进行的工作的前提下续期令牌。当一个大实验室最终造出了一件你早已认定必要的部件,这不是说你来晚了:而是说你一直走在正确的车道上。而对于构建者,那正是最好的落脚之处。