已支付订单
订单查询
暂无成功查询结果;本页不展示模拟成功数据。
决赛演示 · PostgreSQL 连接池耗尽
一个 PostgreSQL 应用连接池耗尽案例,串联真实业务查询、监控告警、多智能体诊断、受控预演、人工审批、修复执行与独立验证。页面静态骨架始终可用,数据库卡片真实降级。
环境状态
待初始化
incident 待创建
请求先进入 Manager 创建事故,再由 Manager 调用受控 fixture;页面不持有数据库或 fixture 凭据。
三张卡片独立轮询,共用同一个被施加压力的应用连接池。
每 3 秒轮询 · 2 秒客户端超时
已支付订单
暂无成功查询结果;本页不展示模拟成功数据。
最近仓库
暂无成功查询结果;本页不展示模拟成功数据。
审计事件
暂无成功查询结果;本页不展示模拟成功数据。
正常卡片
0/3
降级卡片
3/3
上次成功平均延迟
待测
Manager 权威状态驱动;预演通过仅获得审批资格,不代替人工批准。
场景启动
starting
等待告警
awaiting_alert
告警关联
alert_correlated
诊断派发
diagnosis_dispatched
预演就绪
preview_ready
等待审批
awaiting_approval
修复派发
repair_dispatched
独立验证
verifying
恢复确认
recovered
档案关闭
closed
启动失败
start_failed
只展示进入人工审批前的紧凑证据;完整对比表在事故关闭后由档案页回看。
受控负载边界:preview-pg 只重放固定负载,不复制原实例活动会话。
未获得人工审批资格
预演拒绝 · 不进入人工审批
监控看板
主看板:确认连接池 4/4、等待队列与查询错误率
https://teams.yueming.xin/grafana/d/opskeeper-pgpool-live/?orgId=1&from=now-15m&to=now&refresh=5s
Manager 状态
次看板:查看 Manager 健康、HTTP 延迟与内部资源
https://teams.yueming.xin/grafana/d/opskeeper-manager-internals/opskeeper-manager-internals?orgId=1&from=now-1h&to=now&refresh=30s
Element 房间
观察 Manager 主持诊断、预演与修复协同
https://rooms.yueming.xin/#/room/#benyue-lumos-ops:matrix-local.agentteams.io:18080
AgentTeams Dashboard
查看任务看板与 OpsKeeper Runtime
https://teams.yueming.xin/#plugin-route:opskeeper-teamharness/home
OpsKeeper 后台
切换为演示普通用户,查看事故、审批、审计与只读配置
https://opskeeper.yueming.xin/login?account=switch
事故档案
关闭后回看完整证据链与 A/B 对比表
https://teams.yueming.xin/#plugin-route:opskeeper-teamharness/archive
预演报告
打开 preview-pg 深链核对完整指标
https://opskeeper.yueming.xin/preview/
以下仅保留真正需要人工介入的两个节点;故障注入、诊断、预演和验证由 Manager 与 Worker 协同推进。
请人工审批 incident <incident_id> 的 Candidate A 修复方案。请逐项核对 candidate_id、execution_id、目标指纹、影响范围、参数与有效期;预演 PASS 只代表具备审批资格,不等于人工批准。请对 incident <incident_id> 执行档案关闭:确认业务查询、连接池指标和独立验证结果,然后归档完整证据链与 A/B 预演对比表。