Bedrock 使用量
此页面可从调用次数、令牌、延迟、费用、缓存节省等角度监控 AWS Bedrock 模型使用量。
主要功能
时间范围选择
- 在顶部分段控件中选择 1h / 6h / 24h / 7d / 30d 之一(默认值 24h)。
- 所选时间范围将同时应用于 KPI 卡片、图表和模型表格。
- 所有指标均从 CloudWatch 的 AWS/Bedrock 指标中汇总。
KPI 卡片
| 卡片 | 含义 |
|---|---|
| 总费用 | 所选时间范围内的预估费用合计(USD) |
| 调用次数 | 模型调用(invocation)总数 |
| 输入令牌 | 输入令牌总数(compact 表示法) |
| 输出令牌 | 输出令牌总数(compact 表示法) |
| 缓存节省 | 通过 cache read 折扣节省的预估费用 |
图表
- 令牌趋势(输入+输出):以面积图显示时间范围内的令牌使用量。
- 各模型调用次数:以柱状图比较各模型的调用量。
- 各模型费用:以环形图和图例展示各模型的费用占比。
模型详情表格
每个模型提供以下列:模型、调用、输入令牌、输出令牌、平均延迟(ms)、错误、费用。表格默认按费用从高到低排序。
使用方法
- 在侧边栏点击 Bedrock。
- 在顶部分段控件中选择想查看的时间范围。
- 通过 KPI 卡片一目了然地确认总费用、调用次数、令牌和缓存节省。
- 在令牌趋势图中观察使用量的变化模式。
- 通过各模型调用次数和各模型费用图表比较哪个模型使用最多、占据最多费用。
- 在模型详情表格中一并检查各模型的延迟和错误。
- 通过右上角的刷新按钮重新加载最新数据。按钮旁会显示上次获取数据的时刻(KST)。
使用技巧
费用为估算值
显示的费用是将令牌使用量乘以每 100 万令牌单价表计算出的估算值,可能与实际 AWS 账单金额不同。准确的账单金额请在 Cost Explorer 中确认。
善用缓存节省
缓存节省卡片显示因提示词缓存(cache read)而节省的费用。数值越大,说明缓存利用得越好。
数据为空时
如果所选时间范围内没有模型调用,将显示空状态消息。若加载失败,请检查 CloudWatch 权限或会话是否过期。
AI 分析技巧
通过浮动按钮(或 AI 助手页面)可以提出如下问题。
- "过去 7 天费用最高的 Bedrock 模型是哪个?"
- "要进一步增加缓存节省应该怎么做?"
- "请比较最近 24 小时各模型的平均延迟。"
相关页面
- Cost Explorer - 按服务和时间范围分析 AWS 费用
- AI 助手 - 就使用量和费用提问并获得分析