diff --git a/docs/ops/go-vehicle-ingest-memory.md b/docs/ops/go-vehicle-ingest-memory.md index 5b9f18f5..ef57f18b 100644 --- a/docs/ops/go-vehicle-ingest-memory.md +++ b/docs/ops/go-vehicle-ingest-memory.md @@ -385,6 +385,27 @@ net.ipv4.tcp_tw_reuse = 1 10W 总连接阶段使用双端口 loopback:JT808 `50000` + GB32960 `50000`,均 `-send=false`。峰值约 `100238` active connections,gateway FD 约 `100252`,available memory 约 `4511 MB`。NATS ack pending 中间短时到 `10`,`18:23:02 CST` 回到 `0`;history/stat/realtime Kafka lag 总和均为 `0`。压测后 JT808 回落到约 `236`,GB32960 回落到约 `2`,readyz 全部 OK。 +### Gateway async publish 指标 + +2026-07-03 已部署 gateway async sink 指标到 ECS 当前 release: + +```text +vehicle_async_sink_enqueue_total{sink,kind,status} +vehicle_async_sink_publish_total{sink,kind,status} +vehicle_async_sink_publish_duration_ms{sink,kind,status} +vehicle_async_sink_queue_depth{sink} +``` + +部署后验证: + +- `vehicle_async_sink_queue_depth{sink="nats"} 0` +- `vehicle_async_sink_enqueue_total{kind="raw",sink="nats",status="queued"}` 持续增长 +- `vehicle_async_sink_publish_total{kind="raw",sink="nats",status="ok"}` 持续增长 +- NATS bridge ack pending 为 `0` +- Gateway 启动后窗口无 `error|failed|panic|fatal` 日志 + +这些指标是进入带帧率压测前的关键保护栏:如果 `queue_depth` 持续增长或 `enqueue_total{status="timeout"}` 增长,说明入口 publish 队列已成为瓶颈。 + ## 下次恢复上下文时先做 1. 读本文件。