Mozilla可读性解析器MCP服务器
特性
- 删除广告、导航、页脚和其他非必要内容
- 将干净的HTML转换为格式良好的Markdown(也使用Turndown)
- 返回文章元数据(标题、摘录、署名、网站名称)
- 优雅地处理错误
为什么不直接取?
与简单的获取请求不同,此服务器:
- 使用Mozilla的可读性算法仅提取相关内容
- 消除广告、弹出窗口和导航菜单等噪音
- 通过删除不必要的HTML/CSS减少令牌使用
- 提供一致的Markdown格式,以实现更好的LLM处理
- 包括有关内容的有用元数据
安装
通过Smithery安装
通过以下方式自动安装Mozilla Readability Parser for Claude Desktop 史密瑟里:
npx -y @smithery/cli install server-moz-readability --client claude手动安装
npm install server-moz-readability工具参考
parse
提取网页内容并将其转换为干净的Markdown。
论据:
{
"url": {
"type": "string",
"description": "The website URL to parse",
"required": true
}
}退货:
{
"title": "Article title",
"content": "Markdown content...",
"metadata": {
"excerpt": "Brief summary",
"byline": "Author information",
"siteName": "Source website name"
}
}使用Claude Desktop
添加到您的 claude_desktop_config.json:
{
"mcpServers": {
"readability": {
"command": "npx",
"args": ["-y", "server-moz-readability"]
}
}
}依赖项
- @mozilla/可读性-内容提取
- turndown-HTML到Markdown的转换
- jsdom-DOM解析
- axios-HTTP请求
许可证
麻省理工学院
