Defuddle

作者 kepano3ccff5338ea7无许可证49K 个星标收录于 2026年10月8日更新于 2026年10月8日仓库3周前更新

Extract clean Markdown from HTML pages with Defuddle CLI.

AI 生成的概览

使用 Defuddle CLI 从网页中提取干净的 Markdown 或元数据。

功能
该技能指导代理运行 Defuddle CLI,从网页中提取可读内容,去除导航、广告和杂乱元素。内容涵盖通过 npm 全局安装该工具、将网址解析为 Markdown、把输出保存到文件,以及提取标题、描述、域名等单个元数据字段。它还列出了可用的输出格式,包括 Markdown、JSON、HTML 和单项元数据属性。
适用场景
当你需要标准网页的主要可读文本而非原始 HTML 时使用,尤其适合减少 token 消耗。它也适合获取标题、描述或域名等页面元数据。
运行要求
需要 Defuddle CLI,通过 npm 全局安装(npm install -g defuddle),并需要网络访问以抓取目标网址。该技能不附带脚本,仅为说明文档。

Defuddle

Use Defuddle CLI to extract clean readable content from web pages. Prefer over WebFetch for standard web pages — it removes navigation, ads, and clutter, reducing token usage.

If not installed: npm install -g defuddle

Usage

Always use --md for markdown output:

bash
defuddle parse <url> --md

Save to file:

bash
defuddle parse <url> --md -o content.md

Extract specific metadata:

bash
defuddle parse <url> -p titledefuddle parse <url> -p descriptiondefuddle parse <url> -p domain

Output formats

FlagFormat
--mdMarkdown (default choice)
--jsonJSON with both HTML and markdown
(none)HTML
-p <name>Specific metadata property

来源与署名

来源:kepano/obsidian-skills位于skills/defuddle提交3ccff53

许可证: 无许可证

内容归原作者所有。SourceWeft 从公开仓库中收录这些内容。

举报或申请下架