Opc Monitor · 控制台

加载中…

错误列表

项目/异常环境次数状态最近

详情

← 选择一条错误查看根因、完整堆栈与样本
Prometheus 一次性配置(点开查看,配一次即可)

把下面的 job 追加进 prometheus.yml 并热加载。之后应用只要接入 starter 并开启心跳,就会自动进入抓取列表 —— 不用再改 Prometheus 配置。凭据用与上报相同的 API Key(标准 Bearer 方式)。


    

应用实例

应用环境内网 IP公网 IP端口starter 版本最近心跳状态抓取操作

签发新应用密钥

每个应用、每个环境签发一把独立密钥。密钥绑定到 应用 + 环境,只能写它自己的事件与心跳,不能读、不能管理。管理员密钥(OPC_API_KEY)仍是全权限,此处不受影响。

已签发密钥

前缀应用环境备注状态创建时间启用操作

新服务接入 · 两步

接入后自动获得:异常捕获与聚合上报、飞书/企微告警、/actuator/prometheus 的 JVM/GC 指标。下面的配置由服务端按当前环境自动生成,直接复制即可。

① Maven 依赖


  

② application.yml


  

③ 纳入指标抓取(运维侧,可选)

在 Prometheus 的 opc-app job 下追加,然后热加载。


  

新增服务器(主机监控)

上面是「接一个应用」;这里是「接一台机器」,让新服务器的 CPU/内存/磁盘出现在资源看板,并可按 IP 筛选。两者独立,按需做。

④ 目标机装 node_exporter

新服务器上执行。绑 127.0.0.1 时需让 Prometheus 所在机可达,跨机请绑内网地址并用安全组限制来源。


  

⑤ 加入抓取 + 打好 IP 标签

关键instance 必须填该机真实 IP —— 资源看板的「服务器 IP」下拉、主机清单表、按 IP 筛选全靠它。填错就分不清是哪台机器。


  

当前生效配置

全部由服务端 /api/config 下发,页面不含硬编码地址;改环境只需改服务端配置或环境变量,无需改前端。

控制台访问凭据

接收服务开启鉴权时,控制台需带 X-Opc-Key。密钥保存在浏览器本地,不会上传。

可配项说明

CONSOLE_TITLE                 控制台标题
GRAFANA_URL                   Grafana 地址(为空则隐藏「趋势」页)
GRAFANA_ERROR_DASHBOARD       错误看板 uid
GRAFANA_RESOURCE_DASHBOARD    资源看板 uid
REPORT_ENDPOINT               「接入指引」展示的上报地址
OPC_API_KEY                鉴权密钥(为空 = 不鉴权)
OPC_RATE_LIMIT             每 IP 每分钟请求上限
ALERT_FEISHU_WEBHOOK          飞书机器人
ALERT_WECHAT_WEBHOOK          企微机器人(可与飞书同时配置)
FORGE_DIR                     colt-forge 目录(为空则不启用提单)
FORGE_AUTO                    是否按阈值自动提单
STORE_TYPE                    存储适配器 mysql | postgres

# 数据保留期(默认关闭;开启前请确认保留期能接受,删掉的数据不可恢复)
RETENTION_ENABLED             true 才启用定期清理,默认 false
RETENTION_DAYS                保留期(天),默认 180。语义 = last_seen 超过 N 天
                              没再更新的错误连同其样本一起删;还在复发的不会被删
RETENTION_CRON                清理时间,默认 0 30 3 * * *(凌晨 3:30)
RETENTION_BATCH_SIZE          每批指纹数,默认 200(决定单条 DELETE 的锁范围)
RETENTION_MAX_BATCHES         单轮批数上限,默认 50(单轮最多清 200*50 行)
RETENTION_PAUSE_MS            批间停顿毫秒,默认 200(把连接让回给摄入)