如何将腾讯云 ES 与 OpenAI 可观测数据无缝对接,打造个性化仪表盘?
- 内容介绍
- 文章标签
- 相关推荐
先搞清楚数据是怎么流的:
# 1️⃣ 在一台能访问公网的机器上拉取镜像
docker pull package-registry/distribution:9.1.3
# 2️⃣ 保存镜像为 tar 文件
docker save -o package-registry.tar package-registry/distribution:9.1.3
# 3️⃣ 把 tar 文件传到 VPC 内的 CVM 上, 加载镜像
docker load -i package-registry.tar
# 4️⃣ 启动本地 EPR
docker run -d -p 8080:8080 package-registry/distribution:9.1.3
腾讯云 ES 与 Elastic Cloud 最较大的差别在于:腾讯云的 Kibana 与 ES 节点跑在 VPC 内网里默认无法直接访问 Elastic Package Registry。而 Fleet 安装 Integration 时需要从 EPR 下载集成包,这一步常常卡住。

🛠️ 一键打开网络通道:工单 VS 自建代理
Q:Fleet 页面加载很缓慢,Integration 列表为空?
这一步没法自己改,腾讯云托管的 Kibana 配置文件只能通过工单修改。提交工单时请说明:,提到这个...
- 需要开放
8080端口到内网 EPR 镜像所在机器。 - 允许 Fleet Server 从该地址拉取包。
一般一个工作岗位日内即可生效。如果你不想等工单, 也能够在 VPC 内部署一个 nginx 正向代理,把外网申请转发进去——但记住把证书链配置完整,否则会出现 --insecure 警告。
🔑 准备 OpenAI Admin Key 并验证可达性
OpenAI Integration 采用的是Admin Key它拥有读取组织全部用量数据的权限。普通业务 Key 是没有当前这个能力的,我跟你交个底...。
# 手动测试 Usage API
curl -H "Authorization: Bearer sk-admin-xxx" \
"/v1/organization/usage/completions?start_time=$"
抓到重点了。 If response returns JSON with "input_tokens"/"output_tokens", 那么网络已经通畅,后续 Agent 就能够顺利抓取数据。
📦 在 Fleet 中添加 OpenAI Integration
- 登录 Kibana → Integrations → 搜索 “OpenAI”。如果列表为空,请确认上面的网络工单已经生效。
- 点击 “Add integration”,弹出配置页。
- 填写以下必填项:
- OpenAI Admin Key:
sk-admin-... - Initial Interval:默认
24h - 采集间隔:
5m
- OpenAI Admin Key:
- 类别,减较低 API 调用次数。
- 点击 Save and continue.
Kibana 仪表盘:从“黑箱”到“可视化” 🚀
The OpenAI Integration comes with 拉倒吧... a pre‑built Dashboard that展示以下维度:
- Total tokens consumed
- # of requests per model
- User / Project 分布图表
- Date histogram
You can clone default dashboard 这玩意儿... , rename it为「团队 AI 消耗洞察」,然后自行添加:
- SLO 曲线:"每月 token 消耗 ≤ 500k"
- A/B 对比:"功能上线前后 GPT‑4o 调用量改变"
- Anomaly Detection:"突发 token 爆增告警"
💡 较小技巧:Bucket Width 的选取原则
- Poor man’s实时监控:
* Interval = 5m & Bucket Width = 5m - Aggressive 历史持续发展回溯:
* 初始回溯 = 180d & Bucket Width = 1d - If you set too fine grain for a long interval , Agent will flood OpenAI Usage API and hit rate limits.
Pain Point 排查清单 📋
#1 Elastic Agent 与 ES 通信技术失利?
# 常见错误码
curl -k -u elastic:@es-internal:9200/_cluster/health
# 若返回 SSL handshake error,加 --insecure 参数或正确配置 CA
elastic-agent install \
--fleet-server-es=https://es-internal:9200 \
--fleet-server-service-token=YOUR_TOKEN \
--fleet-server-policy=fleet-server-policy \
--fleet-server-port=8220 \
--insecure
#2 数据延迟或缺失?
- The OpenAI Usage API 本身有几分钟到几十分钟延迟, 再加上 Agent 默认采集间隔,整体延迟约10–30 分钟。
- If you see “Healthy” but Discover 没有数据,请检查:
- EPR 有没有正常运行;
访问
/registry/v1/packages/openai/usage/latest/manifest.json - Kibana 日志里有没有报错 “401 Unauthorized”。若是请沉重崭新生成 Admin Key 并更崭新 Integration 配置。
- EPR 有没有正常运行;
访问
#3 为哪些百度不收录? 🤔
A: 搜索引擎对页面内容进行爬取时 会依据 robots.txt、meta robots、以及页面有没有被防火墙拦截来判断有没有允许收录。如果你的网站采用了腾讯云 CDN 的防盗链功能、 或者在页面头部加入了 ``,搜索引擎就会主动跳过该页面。除此之外如果页面加载速度缓慢、资源条件被跨域阻止,也会引起百度抓取不到内容,从而“不收录”。解决办法是检查服务器响应头、 确保 robots.txt 中没有阻止爬虫,并把关键资源条件放到对外公开可访问的域名下,我始终觉得...。
🎉 打造属于自己的 AI 用量仪表盘——完整流程回顾
- CVM 准备:Linux CVM 必须要拥有公网出入口;安装 Docker 与 Elastic Agent。
- EPR 本地化:采用上述 Docker 命令把 Elastic Package Registry 拉进 VPC,实现较高速离线下载。
-
本文约
先搞清楚数据是怎么流的:
# 1️⃣ 在一台能访问公网的机器上拉取镜像
docker pull package-registry/distribution:9.1.3
# 2️⃣ 保存镜像为 tar 文件
docker save -o package-registry.tar package-registry/distribution:9.1.3
# 3️⃣ 把 tar 文件传到 VPC 内的 CVM 上, 加载镜像
docker load -i package-registry.tar
# 4️⃣ 启动本地 EPR
docker run -d -p 8080:8080 package-registry/distribution:9.1.3
腾讯云 ES 与 Elastic Cloud 最较大的差别在于:腾讯云的 Kibana 与 ES 节点跑在 VPC 内网里默认无法直接访问 Elastic Package Registry。而 Fleet 安装 Integration 时需要从 EPR 下载集成包,这一步常常卡住。

🛠️ 一键打开网络通道:工单 VS 自建代理
Q:Fleet 页面加载很缓慢,Integration 列表为空?
这一步没法自己改,腾讯云托管的 Kibana 配置文件只能通过工单修改。提交工单时请说明:,提到这个...
- 需要开放
8080端口到内网 EPR 镜像所在机器。 - 允许 Fleet Server 从该地址拉取包。
一般一个工作岗位日内即可生效。如果你不想等工单, 也能够在 VPC 内部署一个 nginx 正向代理,把外网申请转发进去——但记住把证书链配置完整,否则会出现 --insecure 警告。
🔑 准备 OpenAI Admin Key 并验证可达性
OpenAI Integration 采用的是Admin Key它拥有读取组织全部用量数据的权限。普通业务 Key 是没有当前这个能力的,我跟你交个底...。
# 手动测试 Usage API
curl -H "Authorization: Bearer sk-admin-xxx" \
"/v1/organization/usage/completions?start_time=$"
抓到重点了。 If response returns JSON with "input_tokens"/"output_tokens", 那么网络已经通畅,后续 Agent 就能够顺利抓取数据。
📦 在 Fleet 中添加 OpenAI Integration
- 登录 Kibana → Integrations → 搜索 “OpenAI”。如果列表为空,请确认上面的网络工单已经生效。
- 点击 “Add integration”,弹出配置页。
- 填写以下必填项:
- OpenAI Admin Key:
sk-admin-... - Initial Interval:默认
24h - 采集间隔:
5m
- OpenAI Admin Key:
- 类别,减较低 API 调用次数。
- 点击 Save and continue.
Kibana 仪表盘:从“黑箱”到“可视化” 🚀
The OpenAI Integration comes with 拉倒吧... a pre‑built Dashboard that展示以下维度:
- Total tokens consumed
- # of requests per model
- User / Project 分布图表
- Date histogram
You can clone default dashboard 这玩意儿... , rename it为「团队 AI 消耗洞察」,然后自行添加:
- SLO 曲线:"每月 token 消耗 ≤ 500k"
- A/B 对比:"功能上线前后 GPT‑4o 调用量改变"
- Anomaly Detection:"突发 token 爆增告警"
💡 较小技巧:Bucket Width 的选取原则
- Poor man’s实时监控:
* Interval = 5m & Bucket Width = 5m - Aggressive 历史持续发展回溯:
* 初始回溯 = 180d & Bucket Width = 1d - If you set too fine grain for a long interval , Agent will flood OpenAI Usage API and hit rate limits.
Pain Point 排查清单 📋
#1 Elastic Agent 与 ES 通信技术失利?
# 常见错误码
curl -k -u elastic:@es-internal:9200/_cluster/health
# 若返回 SSL handshake error,加 --insecure 参数或正确配置 CA
elastic-agent install \
--fleet-server-es=https://es-internal:9200 \
--fleet-server-service-token=YOUR_TOKEN \
--fleet-server-policy=fleet-server-policy \
--fleet-server-port=8220 \
--insecure
#2 数据延迟或缺失?
- The OpenAI Usage API 本身有几分钟到几十分钟延迟, 再加上 Agent 默认采集间隔,整体延迟约10–30 分钟。
- If you see “Healthy” but Discover 没有数据,请检查:
- EPR 有没有正常运行;
访问
/registry/v1/packages/openai/usage/latest/manifest.json - Kibana 日志里有没有报错 “401 Unauthorized”。若是请沉重崭新生成 Admin Key 并更崭新 Integration 配置。
- EPR 有没有正常运行;
访问
#3 为哪些百度不收录? 🤔
A: 搜索引擎对页面内容进行爬取时 会依据 robots.txt、meta robots、以及页面有没有被防火墙拦截来判断有没有允许收录。如果你的网站采用了腾讯云 CDN 的防盗链功能、 或者在页面头部加入了 ``,搜索引擎就会主动跳过该页面。除此之外如果页面加载速度缓慢、资源条件被跨域阻止,也会引起百度抓取不到内容,从而“不收录”。解决办法是检查服务器响应头、 确保 robots.txt 中没有阻止爬虫,并把关键资源条件放到对外公开可访问的域名下,我始终觉得...。
🎉 打造属于自己的 AI 用量仪表盘——完整流程回顾
- CVM 准备:Linux CVM 必须要拥有公网出入口;安装 Docker 与 Elastic Agent。
- EPR 本地化:采用上述 Docker 命令把 Elastic Package Registry 拉进 VPC,实现较高速离线下载。
-
本文约

