Skip to content

get_crawl_health

检查后台采集引擎的运行状态,包括采集次数、各站点采集情况、过期监控检测。

Insight

描述

检查后台采集引擎的运行状态,包括采集次数、各站点采集情况、过期监控检测。

用户可能的问法:

  • "采集系统运行正常吗"
  • "今天采集了多少次"
  • "各站点的采集情况怎样"
  • "有没有监控很久没更新了"

无需参数,直接返回采集系统健康报告。数据范围为当前用户自己的监控商品。

参数

无参数。

返回值

返回采集系统健康报告,包含采集统计、监控状态、预警统计、各站点采集情况及过期监控检测。

采集系统健康报告:

📊 采集统计(近 7 天):
  - 今日采集: 28 次
  - 近 7 天采集: 156 次

📦 监控状态:
  - 总监控: 12(活跃 10)

🔔 预警统计:
  - 今日预警: 2 条

🌏 各站点采集情况(近 7 天):
  - MY: 74 次采集,3 个监控
  - SG: 82 次采集,5 个监控,1 个无数据
  - TH: 0 次采集,1 个监控,1 个无数据
  - VN: 0 次采集,1 个监控,1 个无数据

⚠️ 近 7 天无采集数据的监控(3 个):
  - Samsung S24 Ultra (SG)
  - Xiaomi Redmi Note 13 (TH)
  - Realme C55 (VN)

⚠️ 今日暂无采集记录,采集引擎可能未运行,请检查 Crawler 扩展。

数据隔离说明

本工具返回的所有数据均按用户隔离,只包含当前用户自己监控商品的采集统计,不会显示其他用户的数据。

对话示例

  • "采集系统运行正常吗"
  • "今天采集了多少次"
  • "各站点的采集情况怎样"
  • "有没有监控很久没更新了"

API 端点

  • GET /user/dashboard — 获取今日/7天采集次数、预警数、监控总数(按 user_id 隔离)
  • GET /price/summary?days=7 — 获取各监控的采集次数,按站点聚合统计(按 user_id 隔离)

为什么不再使用 telemetry 端点?

之前的实现使用 /telemetry/summary/telemetry/site-stats,但采集事件由 Crawler 扩展以上报者身份记录,导致卖家通过 MCP 查询时看不到自己商品的采集数据。改为从 PriceHistory 表统计,数据严格按 user_id 隔离,确保卖家看到的是自己监控商品的采集情况。

Released under the MIT License.