defuddle
从网页或本地 HTML 中提取干净正文,去掉噪音后用于阅读、总结或再加工。
抓取网页、论文、电子书、Newsletter 或知识库资料
安装这个 Skill
npx skills add https://github.com/joeseesun/defuddle-skill --skill defuddle
为什么值得装
推荐它,是因为这是 joeseesun 仓库中可直接追溯到原始 SKILL.md 的条目,文档路径为「skills/defuddle/SKILL.md」。相比只看仓库名,原文给出了触发场景、执行边界或操作步骤,适合在需要这类能力时直接安装或作为模板改造。
原文里最有价值的点
- Extract clean 文章 内容 来自 web pages or local HTML files。
- Title: 来自 JSON title field。
- Author: 来自 JSON author field。
- 文档重点章节:Prerequisites、Default Workflow、Step 1: Extract content as Markdown +。
适合用在
- 把多源内容转成 Markdown、NotebookLM、PPT 或长文素材
- 需要先读原文再进行结构化总结和二次创作的任务