Token导航 LogoToken导航TokenDH.com
开发操作浏览器clawhub未标认证来源可访问clear审计提醒

web-reader网络阅读器

Agent Skill

web-reader 用于补充开发相关能力,适合在 OpenClaw 中需要让 Agent 承接开发相关任务时使用。可结合来源仓库、安装命令和原始 README 继续核验具体用法。安装前建议确认权限范围、维护状态,以及是否会触发联网、命令执行或文件读写。

总安装

15,359

周安装

653

GitHub Stars

公开资料未说明

下载量

5,381
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:web-reader(网络阅读器)
来源仓库:https://github.com/alexxxiong/web-reader
安装命令:
openclaw skills install web-reader
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install web-reader

简介

用于补充开发相关能力,适合处理网页内容抓取和视频下载任务。

  • 支持文章摘要、关键词提取及微信/飞书文档归档。
  • 适用于知识管理、内容聚合或离线阅读场景。
  • 安装命令:openclaw skills install web-reader,来自指定仓库。
  • 使用前需确认目标网站版权政策及是否允许批量下载。

SKILL.md

name
web-reader
description
智能网页阅读器 - 抓取文章/下载视频并归档,支持分析、摘要、衍生。Triggers: '下载这篇文章', '抓取文章', '保存文章', 'fetch URL', '分析这篇文章', '摘要', '总结文章', '下载视频', '抓取微信文章', '抓取飞书文档', '把这个链接保存下来', '下载B站视频', 'download article', 'analyze article', 'summarize'.
version
0.2.0
license
MIT

Web Reader

智能网页阅读器:抓取文章(图文)→ 归档到指定目录 → 分析/摘要/衍生。

工作流程

Phase 1: 下载原文(优先执行)

当用户提供 URL 并要求下载/保存/抓取/分析时,先下载原文

Step 1: 确定归档路径

检查用户是否配置了归档目录。读取 ~/.claude/web-reader.json

{
  "archive_dir": "/Volumes/Keybase (m4)/private/biggerbear/文档/微信摘录",
  "categories": ["AI漫剧短剧", "AI工具与技术", "OpenClaw", "开发技术", "商业与产品", "飞书文档"]
}

如果配置文件不存在,使用 ~/Documents/docs/ 作为默认归档目录。

Step 2: 抓取文章

python3 {SKILL_DIR}/fetcher.py "URL" -o "ARCHIVE_DIR" --category "CATEGORY"

对于需要 JavaScript 渲染的页面(返回 "JavaScript enabled" 错误),升级为浏览器模式:

# 先尝试 scrapling fetch(浏览器)
scrapling extract fetch "URL" /tmp/article.md --network-idle

# 如果仍失败,用 camoufox
python3 {SKILL_DIR}/fetcher.py "URL" -o "ARCHIVE_DIR" --method camoufox --category "CATEGORY"

Step 3: 处理微信图片

对于微信公众号文章(mp.weixin.qq.com),fetcher.py 自动处理 data-src 图片。 如果自动处理失败(图片为空 ![]() 占位符),手动处理:

  1. 用 scrapling 获取 HTML:scrapling extract get "URL" /tmp/wx.html -s "#js_content"
  2. 从 HTML 中提取 data-src="https://mmbiz.qpic.cn..." URL
  3. 下载图片到 ARCHIVE_DIR/CATEGORY/SLUG/ 目录
  4. 替换 markdown 中的空占位符为本地路径

Step 4: 自动分类

根据文章内容判断分类。参考分类关键词:

  • AI漫剧短剧: 漫剧, 短剧, 动漫, seedance, AI视频创作
  • AI工具与技术: AI工具, 大模型, scrapling, agent, API, 技术方案
  • OpenClaw: openclaw, claude code, agent team
  • 开发技术: flutter, 编程, 开发, 逆向, IDE, 部署
  • 商业与产品: 产品分析, 商业模式, 市场, 付费, 创业
  • 飞书文档: feishu.cn 域名

如果不确定分类,询问用户选择或创建新分类。

Step 5: 确认结果

输出归档信息:

  • 文章标题
  • 保存路径
  • 图片数量
  • 分类

Phase 2: 后续探索(用户触发)

文章下载完成后,等待用户指令:

指令动作
分析阅读文章全文,提取核心观点、论据、方法论,给出结构化分析
摘要生成 3-5 句话的精炼摘要,保留关键数据和结论
总结按章节列出要点,适合快速回顾
衍生基于文章内容,提出可以进一步探索的方向、相关话题、实践建议
提炼提取可直接复用的方法、工具、配置、代码片段
对比与之前下载的其他文章进行对比分析(需指定对比目标)
洗稿基于原文重写,保留核心信息但完全改写表述(配合 /wxpub 使用)

执行分析时,直接读取归档的 markdown 文件,不需要重新抓取。

智能路由

平台方法说明
mp.weixin.qq.comscrapling提取 data-src 图片,处理 SVG 占位符
*.feishu.cn虚拟滚动滚动整理内容块,浏览器内下载图片
zhuanlan.zhihu.comscrapling.Post-RichText 选择器
www.zhihu.comscrapling.RichContent 选择器
www.toutiao.comscrapling处理 toutiaoimg base64 占位符
www.xiaohongshu.comcamoufox反爬需要隐身浏览器
www.weibo.comcamoufox反爬需要隐身浏览器
bilibili.com / b23.tvyt-dlp视频下载
youtube.com / youtu.beyt-dlp视频下载
douyin.comyt-dlp视频下载
其他 URLscrapling通用抓取,三级降级策略

安装依赖

按需安装:

依赖用途安装
scrapling文章抓取pip install scrapling
yt-dlp视频下载pip install yt-dlp
camoufox反检测浏览器pip install camoufox && python3 -m camoufox fetch
html2textHTML 转 Markdownpip install html2text

CLI 参考

python3 {SKILL_DIR}/fetcher.py [URL] [OPTIONS]

参数:
  url                    要抓取的 URL

选项:
  -o, --output DIR       输出目录(默认: 当前目录)
  -q, --quality N        视频质量(默认: 1080)
  --method METHOD        强制方法: scrapling, camoufox, ytdlp, feishu
  --selector CSS         强制 CSS 选择器
  --urls-file FILE       URL 列表文件(每行一个,# 注释)
  --audio-only           仅提取音频
  --no-images            跳过图片下载
  --cookies-browser NAME 浏览器 cookies(如 chrome, firefox)
  --category NAME        归档子目录名
  --json-output          JSON 格式输出(程序化调用)

配置

创建 ~/.claude/web-reader.json 配置归档目录:

{
  "archive_dir": "~/Documents/docs/articles",
  "categories": ["技术", "产品", "行业"]
}

平台特殊处理

微信公众号

  • 图片使用 data-src 属性 + mmbiz.qpic.cn
  • 可见 <img> 是 SVG 懒加载占位符
  • 图片下载需要 Referer: https://mp.weixin.qq.com/ 请求头

飞书文档

  • 虚拟滚动:滚过的内容会从 DOM 移除
  • 注入 JS 整理器在滚动过程中捕获 [data-block-id] 内容块
  • 图片 401:必须在浏览器上下文内用 fetch(url, {credentials: 'include'}) 下载

Bilibili

  • 短链 (b23.tv) 自动解析
  • 大会员内容用 --cookies-browser chrome

故障排除

问题解决方案
页面需要 JavaScript--method camoufox 或先 scrapling extract fetch
微信图片为空手动从 HTML 提取 data-src URL
飞书返回登录页文档可能需要认证
B站 403--cookies-browser chrome
内容太短尝试 --method camoufox

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

76.93%
按下载量换算4,140

安全审计

VirusTotal

通过

ClawScan

通过

Static analysis

可疑

权限和风险

操作浏览器

该 Skill 可能涉及浏览器控制能力,使用时可能读取或操作网页内容,需要在受控环境中确认权限边界。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills