Defuddle

作者 kepano3ccff5338ea7無授權條款49K 個星標收錄於 2026年10月8日更新於 2026年10月8日儲存庫3 週前更新

Extract clean Markdown from HTML pages with Defuddle CLI.

AI 產生的概覽

使用 Defuddle CLI 從網頁擷取乾淨的 Markdown 或中繼資料。

功能
此技能指示代理執行 Defuddle CLI,從網頁中擷取可讀內容,移除導覽、廣告與雜亂元素。內容涵蓋透過 npm 全域安裝此工具、將網址解析為 Markdown、把輸出儲存到檔案,以及擷取標題、描述、網域等個別中繼資料欄位。它也列出可用的輸出格式,包括 Markdown、JSON、HTML 與單一中繼資料屬性。
適用情境
當你需要標準網頁的主要可讀文字而非原始 HTML 時使用,特別適合減少 token 用量。它也適合取得標題、描述或網域等頁面中繼資料。
執行需求
需要 Defuddle CLI,透過 npm 全域安裝(npm install -g defuddle),並需要網路存取以抓取目標網址。此技能未附帶指令碼,僅為說明文件。

Defuddle

Use Defuddle CLI to extract clean readable content from web pages. Prefer over WebFetch for standard web pages — it removes navigation, ads, and clutter, reducing token usage.

If not installed: npm install -g defuddle

Usage

Always use --md for markdown output:

bash
defuddle parse <url> --md

Save to file:

bash
defuddle parse <url> --md -o content.md

Extract specific metadata:

bash
defuddle parse <url> -p titledefuddle parse <url> -p descriptiondefuddle parse <url> -p domain

Output formats

FlagFormat
--mdMarkdown (default choice)
--jsonJSON with both HTML and markdown
(none)HTML
-p <name>Specific metadata property

來源與署名

來源:kepano/obsidian-skills位於skills/defuddle提交3ccff53

授權條款: 無授權條款

內容歸原作者所有。SourceWeft 從公開儲存庫中收錄這些內容。

檢舉或申請下架