get_crawl_health
检查后台采集引擎的运行状态,包括采集次数、各站点采集情况、过期监控检测。
Insight
描述
检查后台采集引擎的运行状态,包括采集次数、各站点采集情况、过期监控检测。
用户可能的问法:
- "采集系统运行正常吗"
- "今天采集了多少次"
- "各站点的采集情况怎样"
- "有没有监控很久没更新了"
无需参数,直接返回采集系统健康报告。数据范围为当前用户自己的监控商品。
参数
无参数。
返回值
返回采集系统健康报告,包含采集统计、监控状态、预警统计、各站点采集情况及过期监控检测。
采集系统健康报告:
📊 采集统计(近 7 天):
- 今日采集: 28 次
- 近 7 天采集: 156 次
📦 监控状态:
- 总监控: 12(活跃 10)
🔔 预警统计:
- 今日预警: 2 条
🌏 各站点采集情况(近 7 天):
- MY: 74 次采集,3 个监控
- SG: 82 次采集,5 个监控,1 个无数据
- TH: 0 次采集,1 个监控,1 个无数据
- VN: 0 次采集,1 个监控,1 个无数据
⚠️ 近 7 天无采集数据的监控(3 个):
- Samsung S24 Ultra (SG)
- Xiaomi Redmi Note 13 (TH)
- Realme C55 (VN)
⚠️ 今日暂无采集记录,采集引擎可能未运行,请检查 Crawler 扩展。数据隔离说明
本工具返回的所有数据均按用户隔离,只包含当前用户自己监控商品的采集统计,不会显示其他用户的数据。
对话示例
- "采集系统运行正常吗"
- "今天采集了多少次"
- "各站点的采集情况怎样"
- "有没有监控很久没更新了"
API 端点
GET /user/dashboard— 获取今日/7天采集次数、预警数、监控总数(按 user_id 隔离)GET /price/summary?days=7— 获取各监控的采集次数,按站点聚合统计(按 user_id 隔离)
为什么不再使用 telemetry 端点?
之前的实现使用 /telemetry/summary 和 /telemetry/site-stats,但采集事件由 Crawler 扩展以上报者身份记录,导致卖家通过 MCP 查询时看不到自己商品的采集数据。改为从 PriceHistory 表统计,数据严格按 user_id 隔离,确保卖家看到的是自己监控商品的采集情况。