Token导航 LogoToken导航TokenDH.com
zyte MCP logo
浏览器工具stdio官方级别未说明来源级核验

zyte MCP

MCP Server

Zyte MCP Server是一个用于从网页中提取结构化数据和HTML的服务,适用于电子商务、新闻博客、招聘信息等多种场景。

工具数

7

提示词数

0

GitHub Stars

1

资源数

0
数据提取电子商务PythonClaude浏览器自动化Claude

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

jacopen

提供方

jacopen

最后核验

2026/5/17 20:23

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

命令预览

pip install -r requirements.txt

详细介绍

Zyte MCP服务器

用于从网页中提取结构化数据和HTML的MCP服务器 Zyte API.

特性

  • 产品数据提取(电子商务网站)
  • 文章内容提取(新闻、博客)
  • 文章列表提取
  • 职位发布提取
  • 通用页面内容提取
  • 静态/动态HTML检索

环境变量

变量必填描述
ZYTE_API_KEYZyte API密钥。从以下地址获取 Zyte仪表板
ZYTE_TIMEOUT请求超时(秒)(默认值:60)

设置

使用uvx(推荐)

不需要安装依赖项。直接用 uvx 命令。

本地开发

pip install -r requirements.txt
# or
pip install -e .

使用克劳德代码/克劳德桌面

克劳德代码

添加以下内容 ~/.claude/settings.json:

{
  "mcpServers": {
    "zyte": {
      "command": "uvx",
      "args": [
        "--from",
        "git+https://github.com/jacopen/zyte-mcp",
        "zyte-mcp-server"
      ],
      "env": {
        "ZYTE_API_KEY": "YOUR_API_KEY"
      }
    }
  }
}

克劳德桌面版

添加以下内容 ~/Library/Application Support/Claude/claude_desktop_config.json (macOS)或 %APPDATA%\Claude\claude_desktop_config.json (Windows):

{
  "mcpServers": {
    "zyte": {
      "command": "uvx",
      "args": [
        "--from",
        "git+https://github.com/jacopen/zyte-mcp",
        "zyte-mcp-server"
      ],
      "env": {
        "ZYTE_API_KEY": "YOUR_API_KEY"
      }
    }
  }
}

使用本地路径

{
  "mcpServers": {
    "zyte": {
      "command": "uvx",
      "args": [
        "--from",
        "/path/to/zyte-mcp",
        "zyte-mcp-server"
      ],
      "env": {
        "ZYTE_API_KEY": "YOUR_API_KEY"
      }
    }
  }
}

可用工具

工具说明
extract_product从产品页面提取结构化产品数据(名称、价格、SKU、可用性等)
extract_article从新闻/博客页面中提取结构化文章数据(标题、正文、作者、日期等)
extract_article_list从索引页面(新闻索引、博客列表等)中提取文章列表
extract_job_posting提取结构化的职位发布数据(职位、描述、工资、地点等)
extract_page_content从任何页面提取干净的文本内容(删除广告和导航)
extract_html检索静态HTML(快速且低成本)
extract_html_with_browser执行JavaScript后检索HTML(适用于动态网站)

提取选项

AI提取工具(extract_product, extract_article, extract_article_list, extract_job_posting, extract_page_content)支持 extract_from 用于指定提取源的参数:

选项描述
httpResponseBody使用原始HTTP响应。快速且低成本
browserHtmlOnly使用浏览器渲染。对于JavaScript繁重的页面
browserHtml使用带有视觉功能的浏览器渲染(默认)

链接

许可证

麻省理工学院

目录标签

目录标签

数据提取电子商务PythonClaude浏览器自动化本地部署网页抓取新闻博客招聘信息

支持客户端

Claude

接入字段

传输方式(transport,传输协议)

stdio

鉴权方式(authType,认证方式)

none

工具数量(toolCount,工具数)

7

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

stdionone部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

来源信息

继续浏览同类 MCP