Zyte MCP服务器
用于从网页中提取结构化数据和HTML的MCP服务器 Zyte API.
特性
- 产品数据提取(电子商务网站)
- 文章内容提取(新闻、博客)
- 文章列表提取
- 职位发布提取
- 通用页面内容提取
- 静态/动态HTML检索
环境变量
| 变量 | 必填 | 描述 |
|---|---|---|
ZYTE_API_KEY | 是 | Zyte API密钥。从以下地址获取 Zyte仪表板 |
ZYTE_TIMEOUT | 否 | 请求超时(秒)(默认值:60) |
设置
使用uvx(推荐)
不需要安装依赖项。直接用 uvx 命令。
本地开发
pip install -r requirements.txt
# or
pip install -e .使用克劳德代码/克劳德桌面
克劳德代码
添加以下内容 ~/.claude/settings.json:
{
"mcpServers": {
"zyte": {
"command": "uvx",
"args": [
"--from",
"git+https://github.com/jacopen/zyte-mcp",
"zyte-mcp-server"
],
"env": {
"ZYTE_API_KEY": "YOUR_API_KEY"
}
}
}
}克劳德桌面版
添加以下内容 ~/Library/Application Support/Claude/claude_desktop_config.json (macOS)或 %APPDATA%\Claude\claude_desktop_config.json (Windows):
{
"mcpServers": {
"zyte": {
"command": "uvx",
"args": [
"--from",
"git+https://github.com/jacopen/zyte-mcp",
"zyte-mcp-server"
],
"env": {
"ZYTE_API_KEY": "YOUR_API_KEY"
}
}
}
}使用本地路径
{
"mcpServers": {
"zyte": {
"command": "uvx",
"args": [
"--from",
"/path/to/zyte-mcp",
"zyte-mcp-server"
],
"env": {
"ZYTE_API_KEY": "YOUR_API_KEY"
}
}
}
}可用工具
| 工具 | 说明 |
|---|---|
extract_product | 从产品页面提取结构化产品数据(名称、价格、SKU、可用性等) |
extract_article | 从新闻/博客页面中提取结构化文章数据(标题、正文、作者、日期等) |
extract_article_list | 从索引页面(新闻索引、博客列表等)中提取文章列表 |
extract_job_posting | 提取结构化的职位发布数据(职位、描述、工资、地点等) |
extract_page_content | 从任何页面提取干净的文本内容(删除广告和导航) |
extract_html | 检索静态HTML(快速且低成本) |
extract_html_with_browser | 执行JavaScript后检索HTML(适用于动态网站) |
提取选项
AI提取工具(extract_product, extract_article, extract_article_list, extract_job_posting, extract_page_content)支持 extract_from 用于指定提取源的参数:
| 选项 | 描述 |
|---|---|
httpResponseBody | 使用原始HTTP响应。快速且低成本 |
browserHtmlOnly | 使用浏览器渲染。对于JavaScript繁重的页面 |
browserHtml | 使用带有视觉功能的浏览器渲染(默认) |
链接
- Zyte -Zyte官方网站
- Zyte API文件 -API文件
- Zyte仪表板 -获取和管理API密钥
- MCP(模型上下文协议) -MCP规范
许可证
麻省理工学院
