乔木阅读研究 #4 GitHub Stars 107 原文已核对

defuddle

从网页或本地 HTML 中提取干净正文,去掉噪音后用于阅读、总结或再加工。

抓取网页、论文、电子书、Newsletter 或知识库资料

安装这个 Skill

npx skills add https://github.com/joeseesun/defuddle-skill --skill defuddle

为什么值得装

推荐它,是因为这是 joeseesun 仓库中可直接追溯到原始 SKILL.md 的条目,文档路径为「skills/defuddle/SKILL.md」。相比只看仓库名,原文给出了触发场景、执行边界或操作步骤,适合在需要这类能力时直接安装或作为模板改造。

原文里最有价值的点

  • Extract clean 文章 内容 来自 web pages or local HTML files。
  • Title: 来自 JSON title field。
  • Author: 来自 JSON author field。
  • 文档重点章节:Prerequisites、Default Workflow、Step 1: Extract content as Markdown +。

适合用在

  • 把多源内容转成 Markdown、NotebookLM、PPT 或长文素材
  • 需要先读原文再进行结构化总结和二次创作的任务