| 项目/异常 | 环境 | 次数 | 状态 | 最近 |
|---|
把下面的 job 追加进 prometheus.yml 并热加载。之后应用只要接入 starter 并开启心跳,就会自动进入抓取列表 —— 不用再改 Prometheus 配置。凭据用与上报相同的 API Key(标准 Bearer 方式)。
| 应用 | 环境 | 内网 IP | 公网 IP | 端口 | starter 版本 | 最近心跳 | 状态 | 抓取 | 操作 |
|---|
每个应用、每个环境签发一把独立密钥。密钥绑定到 应用 + 环境,只能写它自己的事件与心跳,不能读、不能管理。管理员密钥(OPC_API_KEY)仍是全权限,此处不受影响。
| 前缀 | 应用 | 环境 | 备注 | 状态 | 创建时间 | 启用 | 操作 |
|---|
接入后自动获得:异常捕获与聚合上报、飞书/企微告警、/actuator/prometheus 的 JVM/GC 指标。下面的配置由服务端按当前环境自动生成,直接复制即可。
在 Prometheus 的 opc-app job 下追加,然后热加载。
上面是「接一个应用」;这里是「接一台机器」,让新服务器的 CPU/内存/磁盘出现在资源看板,并可按 IP 筛选。两者独立,按需做。
在新服务器上执行。绑 127.0.0.1 时需让 Prometheus 所在机可达,跨机请绑内网地址并用安全组限制来源。
关键:instance 必须填该机真实 IP —— 资源看板的「服务器 IP」下拉、主机清单表、按 IP 筛选全靠它。填错就分不清是哪台机器。
全部由服务端 /api/config 下发,页面不含硬编码地址;改环境只需改服务端配置或环境变量,无需改前端。
接收服务开启鉴权时,控制台需带 X-Opc-Key。密钥保存在浏览器本地,不会上传。
CONSOLE_TITLE 控制台标题
GRAFANA_URL Grafana 地址(为空则隐藏「趋势」页)
GRAFANA_ERROR_DASHBOARD 错误看板 uid
GRAFANA_RESOURCE_DASHBOARD 资源看板 uid
REPORT_ENDPOINT 「接入指引」展示的上报地址
OPC_API_KEY 鉴权密钥(为空 = 不鉴权)
OPC_RATE_LIMIT 每 IP 每分钟请求上限
ALERT_FEISHU_WEBHOOK 飞书机器人
ALERT_WECHAT_WEBHOOK 企微机器人(可与飞书同时配置)
FORGE_DIR colt-forge 目录(为空则不启用提单)
FORGE_AUTO 是否按阈值自动提单
STORE_TYPE 存储适配器 mysql | postgres
# 数据保留期(默认关闭;开启前请确认保留期能接受,删掉的数据不可恢复)
RETENTION_ENABLED true 才启用定期清理,默认 false
RETENTION_DAYS 保留期(天),默认 180。语义 = last_seen 超过 N 天
没再更新的错误连同其样本一起删;还在复发的不会被删
RETENTION_CRON 清理时间,默认 0 30 3 * * *(凌晨 3:30)
RETENTION_BATCH_SIZE 每批指纹数,默认 200(决定单条 DELETE 的锁范围)
RETENTION_MAX_BATCHES 单轮批数上限,默认 50(单轮最多清 200*50 行)
RETENTION_PAUSE_MS 批间停顿毫秒,默认 200(把连接让回给摄入)