生产力工具 #6 GitHub Stars 219,439 原文已核对

data-scraper-agent

面向公开来源的自动数据采集代理,支持定时抓取、LLM 丰富和多种存储落地。

适合自动收集和跟踪公开网页数据。

安装这个 Skill

原文暂未提供标准安装命令。

为什么值得装

推荐它,是因为它在「生产力工具」分类里热度靠前(GitHub Stars 219,439),同时原始文档信息密度足够高。原文列出的执行要点包括:User wants to scrape or monitor any public website or API;User says "build a bot that checks...", "monitor X for me", "collect data from..."。对经常重复的任务来说,这类 Skill 能把经验沉淀到工作流前端,减少临场猜测。

原文里最有价值的点

  • 适合招聘、价格、新闻、赛事等公开页面的持续采集。
  • 可将抓取结果写入 Notion、Sheets、Supabase,便于后续分析。
  • 依赖公开来源与自动化运行,需关注目标站点稳定性。

适合用在

  • 建立测试闭环、回归验证、安全检查和发布前质量门