Token导航 LogoToken导航TokenDH.com
Browser History logo
浏览器工具stdio官方级别未说明来源级核验

Browser History

MCP Server

本地CLI和MCP服务器工具,用于导入和分析Safari/Chrome/Firefox/Edge/Brave浏览历史,自动标记访问记录,并通过自然语言查询快速获取信息(如“列出我访问过的所有GitHub项目”或“最近访问了哪些AI网站”),无需发送数据到外部服务器。

工具数

5

提示词数

0

GitHub Stars

3

资源数

0
Python命令行工具浏览器自动化

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

keithah

提供方

keithah

最后核验

2026/5/17 20:19

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

命令预览

pip install -e .

详细介绍

浏览器历史查询

本地CLI+MCP服务器,用于摄取Safari/Chrome/Firefox/Edge/Brave历史记录、自动标记访问并回答快速问题(例如,“列出我访问过的所有GitHub项目”,“我最近访问过哪些AI网站”),而无需向任何地方发送数据。

![CI](https://github.com/keithah/browser-history/actions/workflows/ci.yml)

特性

  • 复制浏览器历史数据库(Safari、Chrome、Firefox、Edge、Brave),转换时间戳并存储为 data/history_store.db.
  • 重复数据消除:默认情况下,摄入重复数据消除在 url+timestamp (使用唯一索引强制执行),并跟踪每个源的事件;您可以通过以下方式切换到每个源的重复数据消除 --dedupe-scope source.
  • 自动标签启发式: github_project, ai, personal_site, docs, news, social, shopping, video, other.
  • 从标题/路径导出的摘要(例如,GitHub仓库成为 owner/repo),可选的页面元数据获取以改进标题/描述,以及对URL/标题/摘要/域/路径/标签的全文搜索。
  • 自然语言ish ask 命令将问题路由到过滤器; reclassify 允许您在调整启发式后刷新标签。
  • MCP服务器公开工具/资源,以便代理可以调用相同的摄取/查询/询问逻辑。

设置

python3.11 -m venv .venv
. .venv/bin/activate
pip install -e .
# for tests/dev extras
pip install -e .[dev]

命令行界面

  • 新访问次数(重复): browser-history ingest --browser safari|chrome|firefox|edge|brave|all (自动检测Chrome/Edge/BBrave配置文件和Firefox release/beta/dev/ESR配置文件;添加 --limit 200 取样;添加 --fetch-metadata 通过网络提取页面标题/描述;使用 --metadata-max 为了限制每次运行获取的页面数量,默认值为500; --progress-every 记录进度; --state-interval 更频繁地冲洗入口; --dedupe-scope global|source 选择全局重复数据消除(默认)或按浏览器/配置文件; --analyze 摄取后运行SQLite ANALYZE; --vacuum 用于离线真空)。如果找不到请求的浏览器数据库,则会打印警告。
  • 按筛选器查询: browser-history query --category ai --since 30d --limit 20 [--source safari|chrome:Profile|firefox:Profile]
  • 全文搜索: --search foo 在URL/标题/摘要/域/路径/标签上使用SQLite FTS5(如果FTS5不可用,则回退到LIKE)。
  • 用简单的文字提问: browser-history ask "list all the github projects"
  • 在存储行上重新运行分类器(在启发式更改后): browser-history reclassify
  • 将旧行回填到 visit_occurrences: browser-history backfill-occurrences [--source foo] [--limit 1000]
  • 运行维护: browser-history maintain (默认为分析+真空;传递 --analyze--vacuum 限制)
  • 统计数据: browser-history stats [--since 30d] [--source ...] 显示覆盖率、按类别计数、按来源计数和每个来源的ingest_state(包括配置文件名称)。
  • 守护进程: browser-history daemon --browser all --fetch-metadata --metadata-max 200 --interval 1800 --progress-every 1000 在计时器上运行连续摄取;按Ctrl+C停止。
  • 共同 --since 格式: 7d, 12h, 2024-12-01.

数据存在于 data/history_store.db;浏览器DB的快照保存在 data/*_snapshot.db 为了确保摄入安全。

MCP服务器

  • 运行: browser-history-mcp (stdio传输)。需要 mcp Python包(通过安装 pip install -e .).
  • 工具: ingest_history(browser?, limit?, fetch_metadata=false, metadata_max=500?, dedupe_scope=global|source) (浏览器包括safari/chrome/firefox/edge/barve/all), query_history(category?, search?, domain?, source?, since?, limit), ask_history(question, limit), stats_history(since?, source?), backfill_occurrences(source?, limit?).
  • 资源模板: resource://browser/history/recent/{limit} 以JSON格式返回最近的访问。
  • 任何支持MCP的客户端都可以通过stdio连接;除了将客户端指向 browser-history-mcp 命令。

备注

  • 分类只是启发式的(没有网络/LLM调用)。在中添加更多图案 browser_history/classifier.py 如果你想要更好的水桶。
  • 要重新开始,请删除 data/history_store.db 并重新运行 ingest.
  • 摄入状态(进度、上次看到的时间戳、元数据计数)存储在 ingest_state 里面 data/history_store.db; browser-history stats 按来源打印,以便您可以恢复/监视长时间运行。每次访问还存储事件(源+原始时间戳),这样您就可以在使用全局重复数据消除时看到所有访问同一页面的浏览器/配置文件。
  • 发布/发布:标签 v* 触发构建;集 PYPI_API_TOKEN 通过提供的GitHub Actions工作流发布仓库机密。CI在Python 3.9–3.12中对推送/PR进行测试。

目录标签

目录标签

Python命令行工具浏览器自动化浏览器历史分析本地部署本地数据处理自然语言查询自动分类CLI工具

接入字段

传输方式(transport,传输协议)

stdio

鉴权方式(authType,认证方式)

none

工具数量(toolCount,工具数)

5

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

stdionone部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

来源信息

继续浏览同类 MCP