模型 / 官方
3.6 Flash 默认模型、环境钩子与免费层全面开放
Google DeepMind 近日宣布对 Gemini API 托管智能体(Managed Agents)进行全面升级。最新版本将 Gemini 3.6 Flash 设为默认模型,开发者无需修改任何代码即可自动享受更强的推理与编码能力。与此同时,全新的环境钩子(Environment Hooks)机制允许开发者在沙箱内每次工具调用前后插入自定义脚本,实现安全拦截、代码格式化或合规审计等操作。在成本管控方面,新增的预算上限参数可防止复杂任务无限消耗 Token,任务暂停后环境状态得以保留,支持续跑。定时触发器则让智能体能够按 Cron 计划自动执行重复性任务,沙箱文件在多次运行间持久保存。此外,托管智能体现已向免费层项目开放,开发者无需绑定计费账户即可通过 API Key 体验完整的智能体工作流。
Gemini API 托管智能体的核心升级之一是将 Gemini 3.6 Flash 设为 antigravity-preview-05-2026 智能体的默认模型。该模型在推理、编码与工具调用方面取得了更好的平衡,开发者的现有代码无需任何改动,下一次交互即自动切换。若有特殊需求,也可通过 agent_config.model 参数显式指定模型,例如选择延迟更低、成本更低的 Gemini 3.5 Flash-Lite,或锁定特定版本以保证行为一致性。
环境钩子是本次更新中最具生产价值的新特性。开发者只需在环境中添加 .agents/hooks.json 配置文件,即可在智能体每次调用工具前后触发自定义脚本。钩子支持正则表达式匹配,可精准针对特定工具(如 code_execution 或 write_file),也可用通配符覆盖所有工具。若前置钩子脚本返回拒绝决策,工具调用将被跳过,拒绝原因会直接传入模型上下文,形成完整的安全闭环。
AI 原生投资银行 OffDeal 已将环境钩子应用于生产场景。其 AI 分析师产品 Archie 在生成投资材料时需要处理大量公司 Logo,每个 Logo 都必须满足尺寸、透明背景、对比度等严格要求。借助 post_tool_execution 钩子,Archie 在写入公司列表的瞬间即触发完整的图像验证流水线,包括候选图片抓取、像素级质量检查以及 Gemini Vision 核验,最终生成一份经过审批的文件清单,确保只有合规图片进入最终文稿。
在成本管控方面,开发者可在 agent_config 中传入 max_total_tokens 参数,为单次交互设置 Token 消耗上限(涵盖输入、输出与思考 Token)。当智能体触达上限时,执行会安全暂停并返回 incomplete 状态,同时保留当前环境状态。开发者可通过传入 previous_interaction_id 并附带新的预算,从断点处无缝续跑,避免重复执行已完成的步骤。
定时触发器(Scheduled Triggers)让托管智能体具备了自动化调度能力。开发者可将智能体、环境、提示词与 Cron 表达式绑定为一个持久化资源,无需外部编排系统即可按计划自动执行重复任务。每次运行复用同一沙箱,文件在多次执行间持久保存,非常适合代码库定期审计、依赖更新检查等场景。配套推出的 Environments API 还支持以编程方式列出、查询和删除沙箱会话,方便在流水线结束后及时清理资源。
此次更新还将托管智能体的访问门槛大幅降低——免费层项目现已可以使用该功能,开发者仅凭 API Key 即可在无需绑定计费账户的情况下体验完整的智能体工作流。综合来看,本次升级将托管智能体从实验性工具升级为具备成本控制、定时调度与安全审计能力的生产级自主工作者,为企业级 AI 应用落地提供了更坚实的基础设施支撑。
要点
- Gemini 3.6 Flash 已成为托管智能体默认模型,无需修改代码即可自动生效,同时支持通过参数显式指定其他模型版本。
- 环境钩子支持在工具调用前后插入自定义脚本,可实现安全拦截、代码格式化和合规审计,已有企业将其用于生产级图像验证流水线。
- 预算上限参数可防止复杂任务无限消耗 Token,任务暂停后环境状态保留,支持从断点续跑,有效控制运行成本。
- 定时触发器允许按 Cron 计划自动执行重复性智能体任务,沙箱文件跨次运行持久保存,无需外部编排系统。
- 托管智能体现已向免费层项目开放,大幅降低开发者的入门门槛。
原始标题:Gemini API Managed Agents: 3.6 Flash, hooks, and more
本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。