今天我想聊一个看起来偏开发者、但其实很值得所有做 AI 产品的人关注的更新:Google 在 7 月 28 日把 Gemini API 的 Managed Agents 又往前推了一步。它不只是把默认模型换成 Gemini 3.6 Flash,更关键的是加入了环境 hooks、预算控制、定时触发和免费层访问。我的判断是:AI Agent 的竞争,正在从“模型会不会回答”进入“代理能不能被安全、稳定、可控地放进真实工作流”。
这次更新到底是什么
根据 Google 官方博客,Managed Agents 是 Gemini API 里托管式的代理运行环境:一次 API 调用,可以在隔离云沙箱里协调推理、代码执行、包安装、文件管理和网页检索。新的默认模型是 Gemini 3.6 Flash,定位是兼顾推理、编码和工具调用;开发者也可以显式选择 Gemini 3.5 Flash 或更低成本的 Flash-Lite。
真正值得看的是 hooks。简单说,开发者可以在代理每次调用工具之前或之后,运行自己的脚本。比如在写文件或执行代码前先做安全检查;在工具调用后自动 lint、审计日志、验证输出质量。Unite.AI 的解读也强调了这一点:Google 给托管代理加了一层“控制层”,让开发者不仅能看见代理在做什么,还能在必要时拦住它。
为什么这件事重要
过去一年,大家谈 Agent 很容易停留在演示:让它写代码、查资料、跑任务。但真到企业环境,问题马上变得具体:它会不会乱花 token?会不会改错文件?出错后能不能暂停?能不能定时执行但不要失控?这次 Google 补的,正是这些工程化细节。
- 预算控制:可以设置 max_total_tokens,避免复杂多轮任务无限消耗。
- 定时触发:把代理、环境、提示词和 cron 计划绑定成持久资源,让它按计划自动运行。
- 沙箱复用:每次运行可以复用同一环境,文件状态得以保留,更像真实工作目录。
- 免费层访问:没有开启计费的项目也能实验,降低了开发者试错门槛。
Xing 的判断
我不认为这只是 Google 又发了一个 API 功能。它说明头部 AI 公司已经意识到:Agent 要从玩具变成生产力,不能只靠更强模型,还要靠“护栏、预算、审计、调度”这些不性感但关键的东西。
对创业者和产品负责人来说,这里有一个很实用的启发:未来的 AI 产品差异化,不一定只在模型参数上,而在谁能把 AI 放进更可靠的业务流程里。谁能解释清楚代理做了什么,谁能限制它不该做什么,谁能让它低成本地每天稳定跑,谁就更接近真正的商业价值。
如果你正在做 AI 应用,我建议把关注点从“能不能生成答案”再往后推一步:你的 Agent 有没有权限边界?有没有预算上限?有没有失败后的暂停机制?有没有可审计的日志?这些问题,可能比一次炫酷 demo 更能决定产品能否卖给真实客户。
消息来源
- Google Blog:Gemini API Managed Agents: 3.6 Flash, hooks, and more — https://blog.google/innovation-and-ai/technology/developers-tools/expanding-managed-agents-gemini-api-3-6-flash-hooks/
- Unite.AI:Google Lets Developers Block Gemini Agents’ Tool Calls — https://www.unite.ai/google-lets-developers-block-gemini-agents-tool-calls/
- Google News RSS:Managed Agents / Gemini API 近 48 小时新闻检索 — https://news.google.com/rss/search?q=%22Managed+Agents%22+%22Gemini+API%22+when:2d
- Google Blog AI RSS:AI 栏目 7 月 28 日更新列表 — https://blog.google/innovation-and-ai/technology/ai/rss/