首页/新闻资讯/正文详情

AI Agent成本失控?Google Antigravity SDK预算限制与Token用量监控完全指南

发布时间:2026/9/27 18:34:27 来源:云帆数科 栏目:资讯中心
AI Agent成本失控?Google Antigravity SDK预算限制与Token用量监控完全指南
AI Agent成本失控Google Antigravity SDK预算限制与Token用量监控完全指南【免费下载链接】antigravity-sdk-pythonA Python library for building AI agents that leverage the full power of Google Antigravity.项目地址: https://gitcode.com/gh_mirrors/an/antigravity-sdk-pythonAI Agent 成本失控是部署智能体时最头疼的问题模型反复调用、工具死循环、超长上下文……账单瞬间飙升。Google Antigravity SDK 是 Google 推出的 Python AI Agent 开发框架内置了会话级**预算限制Budget Limits**和Token 用量监控机制通过一套BudgetConfig配置即可为模型调用次数、工具调用次数和各类 Token 用量设置硬性上限让每一分 API 花费都可控。为什么 AI Agent 成本必须被管控Agent 与传统一问一答的模型调用不同——它在会话中会自主进行多轮推理、反复调用工具一次用户请求背后可能隐藏着几十次模型调用推理级联复杂任务触发多轮思考Token 消耗指数增长️工具死循环Agent 反复重试失败的工具调用如查天气查了 50 次上下文膨胀历史对话累积每次请求的输入 Token 越滚越大Google Antigravity SDK 的应对思路很直接在会话级别设置 5 个预算旋钮超限即停并返回明确的停止原因而不是事后才发现账单爆炸。5 个预算旋钮用 BudgetConfig 一键设定成本上限在 google/antigravity/types.py 中BudgetConfig提供了 5 个可独立开启的限额覆盖次数和Token两个维度预算旋钮限制对象适用场景max_model_calls会话内模型调用总次数防止推理级联、控制整体成本max_tool_calls会话内工具执行总次数防止工具死循环、保护本地资源max_input_tokens净未缓存输入 Tokenprompt − cached防止超长上下文/大文件灌入max_output_tokens累计输出 Token含思考 Token限制生成内容的总长度max_total_tokens净输入 输出的总 Token最粗粒度的总闸门配置只需一行把它挂到LocalAgentConfig即可config LocalAgentConfig( budget_configtypes.BudgetConfig( max_model_calls10, # 最多 10 次模型调用 max_tool_calls25, # 最多 25 次工具执行 max_input_tokens100_000, # 输入 Token 上限 max_output_tokens20_000, # 输出 Token 上限 max_total_tokens120_000, # 总 Token 上限 ) ) 细节亮点max_input_tokens计算的是净未缓存Token提示词 Token 减去缓存命中 Token开启 Prompt Caching 后预算能花得更久这是控制成本的另一条隐性路径。官方完整示例见 budget_limits.py它逐个演示了 5 个旋钮被触发时的行为配套讲解文档在 budget_limits.md。预算耗尽时会发生什么用 StopReason 精确归因Agent 不会在超预算时悄悄继续跑。每次对话结束后ChatResponse.stop_reason会明确告诉你这轮为什么停止。StopReason枚举定义于 types.py与 5 个预算旋钮一一对应MAX_MODEL_CALLS_EXCEEDED→ 模型调用次数用尽MAX_TOOL_CALLS_EXCEEDED→ 工具执行次数用尽MAX_INPUT_TOKENS_EXCEEDED→ 输入 Token 在发送前被主动拦截省钱的关键不产生无效推理MAX_OUTPUT_TOKENS_EXCEEDED→ 累计输出超限MAX_TOTAL_TOKENS_EXCEEDED→ 总 Token 预算耗尽QUOTA_EXHAUSTED→ 后端 API 配额用尽非你设置的预算UNSPECIFIED→ 正常完成生产环境建议对停止原因做分支处理例如触发预算停止后通知用户本次额度已用完或自动开启新会话res await agent.chat(分析我们的季度财务数据) print(await res.text()) if res.stop_reason types.StopReason.MAX_MODEL_CALLS_EXCEEDED: print(会话模型调用预算已用尽请开启新会话。) elif res.stop_reason types.StopReason.MAX_INPUT_TOKENS_EXCEEDED: print(输入内容过长请在发送前被预算拦截节省了 Token。)这种主动拦截机制意味着预算不仅事后止损还能在推理发生前省钱——尤其是max_input_tokens会在 dispatch 前评估。Token 用量监控UsageMetadata 让你看清每个 Token 花在哪光有限额还不够你还得知道钱花在了哪里。SDK 提供结构化的UsageMetadatatypes.py精确拆解每次模型调用的 Token 构成字段含义prompt_token_count输入提示词 Tokencached_content_token_count其中命中缓存的部分计费更低candidates_token_count生成的回复 Tokenthoughts_token_count思考/推理消耗的 Token容易被忽略的成本total_token_count以上合计service_tier实际服务等级standard / priority三个层级的观测入口满足不同监控粒度单步级每个Step.usage_metadata记录该步骤的模型调用用量单轮级response.usage_metadata汇总当前一轮的全部调用会话级agent.conversation.total_usage累加整个会话的历史总量实现见 conversation.py官方可观测性示例 observability.py 展示了如何打印完整账单usage agent.conversation.total_usage print(f输入 Token: {usage.prompt_token_count}) print(f输出 Token: {usage.candidates_token_count}) print(f思考 Token: {usage.thoughts_token_count}) print(f总 Token: {usage.total_token_count})⚠️ 新手易踩的坑thoughts_token_count是思考模型脑内活动的消耗在深度推理场景下可能占比很高把它纳入成本看板才算完整监控。进阶玩法监控服务等级降级与成本波动使用 Gemini 优先级推理Priority Inference时请求可能在高峰期被自动降级到 Standard 等级。好消息是降级请求按低价计费监控手段也很简单——检查usage_metadata.service_tier是否等于STANDARD。示例 prioritized_inference.py 展示了如何程序化监控服务端降级结合service_tier字段即可在监控面板中区分高价快队列与平价标准队列的实际占比进一步优化成本结构。实用建议新手预算配置清单 场景推荐配置个人开发调试max_model_calls20, max_total_tokens50_000客服/轻量问答max_model_calls10, max_output_tokens4_000代码生成/长任务max_tool_calls50, max_total_tokens200_000高并发生产环境全 5 项开启并对StopReason做告警 自动新会话最后三条黄金法则✅总闸门兜底无论单项怎么配务必设置max_total_tokens作为最终防线✅停止即归因永远检查stop_reason区分正常结束和预算拦截✅看板常态化把total_usage按天聚合成本异常一目了然相关资源速查预算限制完整示例examples/getting_started/budget_limits.pyToken 用量监控示例examples/getting_started/observability.py服务等级降级监控examples/getting_started/prioritized_inference.py预算配置源码定义google/antigravity/types.py官方技能文档skills/google-antigravity-sdk/examples/getting_started/budget_limits.md项目总览与安装说明README.md【免费下载链接】antigravity-sdk-pythonA Python library for building AI agents that leverage the full power of Google Antigravity.项目地址: https://gitcode.com/gh_mirrors/an/antigravity-sdk-python创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关推荐

openClaw 配置飞书:用 TaoToken 统一 Key 打通 WebSocket 长连接
openClaw 配置飞书:用 TaoToken 统一 Key 打通 WebSocket 长连接

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views … · 2026/9/27 18:34:21

3个旅游网站建设策划书案例拆解避坑最佳实践
3个旅游网站建设策划书案例拆解避坑最佳实践

3个旅游网站建设策划书案例拆解避坑最佳实践 找建站公司最怕什么?不是怕技术不行,而是怕被“高价低配”收割。很多老板拿着几十万的预算,最后建出来的网站连搜索引擎都搜不到,钱花了,流量为零。别急,今天不聊虚的,直接上干货。我整理了三个不同规模、… · 2026/9/27 18:34:21

CSS3 cursor 取值鼠标形状大全:TaoToken 配置 settings.json 骨架与验证动作
CSS3 cursor 取值鼠标形状大全:TaoToken 配置 settings.json 骨架与验证动作

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views … · 2026/9/27 18:34:21

3套免费网站推广策划书模板,搞定域名服务器难题
3套免费网站推广策划书模板,搞定域名服务器难题

3套免费网站推广策划书模板,搞定域名服务器难题 很多刚起步的老板最头疼的就是域名服务器搞不懂,看着后台那些配置项就头大,根本不知道从哪下手。别急,我手里有几套直接能用的免费工具,能帮你把技术门槛降下来,让推广落地不再卡在技术细节上。… · 2026/9/27 19:43:13

Claude Code怎么用?TaoToken统一Key接入与settings.json配置教程
Claude Code怎么用?TaoToken统一Key接入与settings.json配置教程

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views … · 2026/9/27 19:43:07

learn claude code S02 工具使用详解笔记:从 dispatch map 到路径沙箱的配置骨架
learn claude code S02 工具使用详解笔记:从 dispatch map 到路径沙箱的配置骨架

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views … · 2026/9/27 19:43:07

新手入门:企业大学网站建设计划避坑指南
新手入门:企业大学网站建设计划避坑指南

新手入门:企业大学网站建设计划避坑指南 备案流程一头雾水,是无数独立站长和新手入门者遇到的第一道坎。很多人对着工信部网站发呆,不知道域名解析怎么填,ICP备案材料怎么准备,甚至分不清浙江本地服务商和全国通用的区别。… · 2026/9/27 19:42:54

网站开发最好用什么软件及源码下载避坑指南
网站开发最好用什么软件及源码下载避坑指南

网站开发最好用什么软件及源码下载避坑指南 备案流程一头雾水,很多刚入行的前端小白或准备做独立站的站长,往往卡在第一步。明明代码写好了,服务器也租了,结果提交备案时被驳回,理由五花八门,有人甚至因为“网站性质不明确”被反复退回三次。这时候你才… · 2026/9/27 19:42:54

搞定域名服务器难题 10年老兵揭秘关于网站建设的标语对比评测
搞定域名服务器难题 10年老兵揭秘关于网站建设的标语对比评测

搞定域名服务器难题 10年老兵揭秘关于网站建设的标语对比评测 域名选错,服务器配错,网站上线第一天就卡死? 这种“域名服务器搞不懂”的崩溃感,我见过太多新手栽跟头。 今天不整虚的,直接上干货,聊聊 关于网站建设的标语… · 2026/9/27 19:42:54

MATLAB雷达信号脉冲压缩仿真:LFM线性调频、匹配滤波与距离分辨率实现
MATLAB雷达信号脉冲压缩仿真:LFM线性调频、匹配滤波与距离分辨率实现

简介:这套Matlab仿真工具完整呈现雷达信号脉冲压缩过程,从线性调频(LFM)信号生成、目标回波仿真到匹配滤波压缩处理均有可运行代码支撑,面向电子信息工程、计算机、数学等专业学生,适用于课程设计、期末大作… · 2026/9/27 0:00:01

汕头网站建设制作厂家避坑指南:5大注意事项救急
汕头网站建设制作厂家避坑指南:5大注意事项救急

汕头网站建设制作厂家避坑指南:5大注意事项救急 改个需求建站公司拖一周,这种憋屈事我见得太多了。 很多汕头老板找本地建站团队,签合同前看着方案挺美,一上线就变脸。 今天不聊虚的,直接拆解找 汕头网站建设制作厂家 时的5个核心 注意事项… · 2026/9/27 0:00:01

多模态虚假新闻检测实战:BERT+ResNet双塔与对比学习
多模态虚假新闻检测实战:BERT+ResNet双塔与对比学习

简介:基于PyTorch的多模态虚假新闻检测项目完整代码包,面向自然语言处理与计算机视觉交叉方向的开发者、科研人员及毕业设计选题者,解决社交媒体中文本与图像联合识别虚假新闻的问题。系统以BERT预训练模型提取文本语义特征,以Res… · 2026/9/27 0:00:01

MATLAB雷达信号脉冲压缩仿真:LFM线性调频、匹配滤波与距离分辨率实现
MATLAB雷达信号脉冲压缩仿真:LFM线性调频、匹配滤波与距离分辨率实现

简介:这套Matlab仿真工具完整呈现雷达信号脉冲压缩过程,从线性调频(LFM)信号生成、目标回波仿真到匹配滤波压缩处理均有可运行代码支撑,面向电子信息工程、计算机、数学等专业学生,适用于课程设计、期末大作… · 2026/9/27 0:00:01

汕头网站建设制作厂家避坑指南:5大注意事项救急
汕头网站建设制作厂家避坑指南:5大注意事项救急

汕头网站建设制作厂家避坑指南:5大注意事项救急 改个需求建站公司拖一周,这种憋屈事我见得太多了。 很多汕头老板找本地建站团队,签合同前看着方案挺美,一上线就变脸。 今天不聊虚的,直接拆解找 汕头网站建设制作厂家 时的5个核心 注意事项… · 2026/9/27 0:00:01

多模态虚假新闻检测实战:BERT+ResNet双塔与对比学习
多模态虚假新闻检测实战:BERT+ResNet双塔与对比学习

简介:基于PyTorch的多模态虚假新闻检测项目完整代码包,面向自然语言处理与计算机视觉交叉方向的开发者、科研人员及毕业设计选题者,解决社交媒体中文本与图像联合识别虚假新闻的问题。系统以BERT预训练模型提取文本语义特征,以Res… · 2026/9/27 0:00:01

了解更多?预约专属演示

我们的顾问将为您一对一讲解产品与方案

企业微信二维码