线上出问题,是等用户来投诉,还是让指标主动找你?CloudBase CLI ≥ v3.5.8 把监控与告警搬进了终端——一条命令看 12 类资源健康度,一行配置让异常自动播报。本文带你从排障到自动巡检跑通这条链路。
为什么值得用
- ⚡ 快:一行命令拉取云函数 / 数据库 / 云托管等 12 类资源的实时指标,告别控制台层层点选。
- 🤖 可编排:命令可直接写进脚本、定时巡检、CI 流水线,异常自动播报。
- 🛡️ 有兜底:指标越界自动告警,质量风险主动触达,不再被动等用户投诉。
1. 监控查询(tcb monitor)—— 一眼看清资源健康度
统一入口覆盖云函数 / 数据库 / MySQL / 云托管 / 静态托管 / 认证 / 大模型 / 知识库 / 网关 / 登录 / DB Connector / 环境 QPS 共 12 类资源。
典型场景
- 🔍 排障:函数报错、耗时突增?一键拉出错误数与时延曲线。
- 📊 巡检 / 周报:
--json输出直接喂给脚本,自动生成资源水位报表。 - ⏱️ 时间自由:
--last 7d/--last 24h任意回看,指标名精准指定。
# 查看某函数最近 7 天的错误数
tcb monitor function --name helloWorld --metric-name FunctionError --last 7d
# 查看最近 24 小时耗时,结构化输出给脚本消费
tcb monitor function --name helloWorld --metric-name FunctionDuration --last 24h --json
常用参数:
- 相对时间窗口:
--last 7d/--last 24h - 精准指标:
--metric-name FunctionError - 结构化输出:
--json(便于脚本消费) - 指标清单:
tcb monitor schema <资源类型>
2. 告警配置(tcb api monitor)—— 让风险主动找你
场景:函数报错即告警。 当任意云函数版本出现错误,立即推送通知到企微 / 邮件 / 短信,线上质量有兜底。
tcb api monitor CreateAlarmPolicy --api-version 2018-07-24 --body '{
"Module": "monitor",
"PolicyName": "云函数版本错误数告警",
"MonitorType": "MT_QCE",
"Namespace": "SCF",
"ProjectId": 0,
"Enable": 1,
"Condition": {
"IsUnionRule": 1,
"Rules": [
{ "MetricName": "Error", "Period": 60, "Operator": "gt",
"Value": "0", "ContinuePeriod": 1, "NoticeFrequency": 3600, "IsPowerNotice": 0 }
]
},
"NoticeIds": ["notice-xxxxxxxx"]
}'
要点:
- 创建即覆盖该命名空间下所有函数版本,无需逐个绑定。
- 返回
PolicyId,可用于后续删除或精确绑定到指定实例。 NoticeIds为通知模板 ID,不需要可删除该行。
3. 升级到支持版本
npm i -g @cloudbase/cli@latest
tcb -v # 确认 ≥ 3.5.8

