Token导航 LogoToken导航TokenDH.com

干掉NotebookLM!这个开源项目+Obsidian,补齐了本地AI知识库的最后一块拼图

更新时间 2026-06-16来源 Simonlin的精神世界正文 5157字阅读约 17分钟21 张图片

Hello啊朋友们,我是Simonlin,用通俗易懂的语言,手把手带你玩转AI,提高10倍效率!

有一次,我问了我好几个朋友,同一个问题。

"你每天在群里看到的那些干货,后来都去哪了?"

答案很统一:进收藏夹吃灰了。

然后呢?

没了。

说实话,我也一样。

公众号里标了两百多篇星标,X上存了一堆书签,群聊里截了一屏幕的图,隔两天想找个东西,翻了十分钟,放弃。

更让我难受的是,我明明看过那些东西...但当我想写文章的时候,脑子一片空白。

那个观点是谁说的来着?那篇文章里有个特别好的案例,到底在哪?群里上个月聊过一个工具,叫什么来着?

直到我昨天装了一个东西。

叫 Trove AI。

不过,不是你随便搜到的那个版本。这篇文章要讲的,就是怎么用这个开源工具,加上 Obsidian,把你的本地 AI 知识库彻底补齐。

一、这个版本跟原版有什么区别

图片

Trove AI 是一个开源项目,原版是 https://github.com/weaiw/trove-ai。一个"稍后阅读 + AI 知识库"的开源工具,跑在你自己电脑上。

但我装完之后发现,它有一个明显的问题:B站视频内容抓不了。

靠之,好多好东西,都在B站里,包括一些课程啥的,还有某个视频里看到的一些能引起思考的观点...

如果后续不将它们整合在一起,变成自己的固定资产,就等于没看过一样...好可惜啊!

所以我一开始用Trove,就发现这个问题:

B站视频贴进去,只能抓到标题和简介。字幕?没有。视频里说了什么?不知道。

这对一个"知识库"来说,差得太远了。

因此我花了一点点时间,给它加了四个关键能力:

  1. 1. B站视频 ASR 语音转录 — 没字幕的视频,后台自动下载音频、Whisper 转录成文字,几分钟出结果
  2. 2. YouTube 视频解析 + 转录 — 贴链接秒抓标题/字幕,没字幕一样走后台 ASR
  3. 3. 深度求索 DeepSeek v4-pro 驱动 — 摘要更准、标签更聪明
  4. 4. UI 配置化 — 代理、ASR、YouTube 开关全在设置页直接改,不用改代码

加上这些能力后,我发现它真的好用到爆!

我把这个版本叫 Trove v1.1,代码已经推到我的 GitHub:

👉 https://github.com/simonlin000/trove-ai


二、三步走,本地部署

只要你电脑上有 Docker(没有的话装个 Docker Desktop,免费的),三步搞定:

  
# 1. 克隆代码
git clone https://github.com/simonlin000/trove-ai.git
cd trove-ai

# 2. 配好环境变量
cp .env.example .env
# 编辑 .env,至少填上 DEEPSEEK_API_KEY 和 SECRET_KEY

# 3. 启动
docker compose up -d

等大概两分钟,浏览器打开 http://localhost:80,注册账号,登录。

然后去 设置 → AI 对话模型,把 DeepSeek 的 API Key 填进去,点测试连接,保存。

为啥用DeepSeek?肯定是因为它好用+便宜啊!

图片

绝对没有收钱,主要是我跑了好几个任务,居然才花了3毛钱...这谁不心动啊。

图片

对了,如果是国内网络,再去 设置 → 插件设置,在代理地址里填上你的代理(比如http://host.docker.internal:7897),YouTube 解析才能用。

就这么简单。五个容器跑在你电脑上,占大概 4G 内存,数据全部在你本地 PostgreSQL 数据库里,不上传到任何人的服务器。

图片

装一个cloudflared,然后开个临时隧道,让你本地Agent助理把链接发你。

这样的话,手机和 iPad,即使不跟电脑连同一个局域网,也能访问。

macOS,有homebrew的话,在命令行输入:brew install cloudflared

windows,命令行输入:winget install Cloudflare.cloudflared

安装好之后,把这条指令再复制粘贴一下:

cloudflared tunnel --url http://localhost:80

然后它会给你一个临时的域名,用完直接关就行。

这下真就是“随时随地,想存就存”了!

三、v1.1 到底多了什么


1、B站视频 → 文字

原版 Trove 贴一个B站链接,它只能抓到视频标题、UP主、简介。没了。

图片

v1.1 做了三层处理:

第一层:抓字幕。 如果 UP 主上传了外挂字幕,直接扒下来。很多知识类视频都有字幕,这层覆盖大部分场景。

第二层:ASR 语音转录。 没有字幕?没关系。它会在后台自动下载视频的音频轨道,然后用 Whisper 模型做语音转文字。整个过程全自动,你贴完链接关掉页面就行,30秒内后台扫到标记,几分钟后刷新,字幕已经在文章底部了。

第三层:限制保护。 超过 30 分钟的视频不会自动转录(防止内存爆掉),会显示"视频 XX 分钟,超出自动转录上限"。你可以在设置里调这个上限。

图片

这个功能对知识库来说太重要了。

B站上大量优质的知识视频没有字幕——访谈、演讲、长教程...以前你只能听完自己记笔记,现在贴链接就行。

2、YouTube 视频 → 文章

原版 Trove 根本不知道怎么处理 YouTube 链接。贴进去走通用网页解析器,什么都拿不到。

图片

v1.1 接入了 yt-dlp,一个开源的视频下载工具:

  • 自动获取视频标题、频道、简介、封面
  • 优先抓中文字幕,其次英文
  • 字幕转成干净的文字附在文章底部
  • 没字幕且不超过上限的视频,同样走后台 ASR 转录

唯一需要你做的,就是在设置里配好代理地址,因为yt-dlp 在国内直连 YouTube 很慢甚至连不上,走代理就秒出。

3、UI 配置化

原来改代理、开关 ASR、调转录上限,你得修改代码、重新 build Docker 镜像。现在全部在设置页搞定:

图片

设置 → 插件设置,四个配置项:

  • YouTube 解析:开关,不想用 yt-dlp 就关掉
  • 代理地址:yt-dlp 走这个代理访问 YouTube
  • 语音转录 (ASR):开关,关掉就完全不转录
  • 转录上限:最多转录多少秒的视频,默认 1800(30分钟)

改了立刻生效,不用重启容器。

4、DeepSeek v4-pro

原版默认用硅基流动的模型做摘要。

我换成了 DeepSeek 的 V4-Pro,1.6 万亿参数,中文理解和生成质量明显更高。

摘要不再是"本文介绍了XXX"那种废话。它会真正提取文章的核心命题。

我举个例子。我丢了一篇歸藏写的关于 Skills 的万字长文进去,v1.1 给我的摘要:

图片

你感受一下。

它不是总结文章标题,是在提炼核心命题。

四、回到正题:Trove 到底能干什么

好,说完了 v1.1 的新东西,我们回到 Trove 本身。

你可以把它理解成你自己的 AI 图书馆。

先说清楚一件事:Trove AI 不是那种云端的、按月收费的、数据存在别人服务器上的 SaaS 产品。

它是开源的,跑在你本地。

1、贴链接自动抓取

图片

公众号、知乎、B站、YouTube、小红书、掘金、X上的推文,把链接贴进去就行。

它会自动把正文抠出来,排版干净。

原因在于,它用的是 Playwright 去真正渲染页面。

所以微信公众号的页面,它也能处理。

B站带时间戳的字幕,它能抓。

YouTube 视频,配置好yt-dlp,转写的内容直接到手。

你丢进去的每一篇,它会自动用 AI 读,然后做三件事:

生成摘要、打标签、建立知识图谱关联。

2、RAG 问答

图片

你可以直接在 Trove 里问问题。

图片
图片

支持“本文”和“全库”两个搜索模式。

  • “本文”:在文章范围内通过语义搜索,命中你需要的结果,返回。

  • “全库”:在整个知识库范围内搜索。

比如,在“全库搜索”模式下,提问:"我收藏的文章里,关于 Agent 架构都说了什么?"

内置的AI会把收藏过的相关内容全部挑出来,总结给你看。

关于它内置的AI助手,也有四种模式:

图片
  1. 1. 自动识别:根据你的问题,决定要采用什么模式来进行处理。
  2. 2. 深度研究:/r 强制把你的问题拆成4个阶段进行研究,保证输出的结构性,有条不紊。
  3. 3. 工具Agent : /a 根据你的问题,自动调用工具完成任务,后端执行,返回结果给LLM。
  4. 4. 灵感创作:/c 你给主题,它写文章,而且是一篇完整的文章。
图片

不过,前提是需要配置一个embedding模型,可以用硅基流动的,或者是OpenAI/MiniMax的,也可以自己用本地部署的模型。

这个模型很重要,它涉及到你向AI提问时,它能不能精准地找到你想要的答案。

我只能说,这个Trove AI,是真的强大!从基础功能实现来看,跟Notebooklm没什么区别了。

这个跟问 ChatGPT 的区别在哪?

ChatGPT 给你的是互联网随机搜来的内容,Trove 给你的是你自己筛选过的、觉得值得收藏的内容。

跟Notebooklm区别又在哪?

Notebooklm虽然好用,但是对免费用户来说,是有限制的,而且东西都存放在云端,指不定哪天你存的好东西,都变成人家训练的数据...

用Trove这种本地配置的,免费,而且安全。

3、知识图谱

图片

“仓鼠党”们有一个问题,就是存了东西,但是看着好像是杂乱无章,不成体系。

Trove 能自动把你放进去的所有资料,建立联系,形成知识图谱。

因为它自动把每一个材料都做好了向量化,打上了标签,所以这样一来,就很方便进行检索和处理。

A材料跟B材料是否有关联,能不能学,关系是怎么样的,一目了然。

4、跨平台阅读

Trove 是网页界面。电脑、iPad、手机都能访问。开个 cloudflared 隧道,出门也能用。

5、连接微信

图片

在“个人设置”里,Trove做了一个很有意思的操作:

直接连接微信通道,让它变成你的私人知识库管家。

看到什么好东西,想存,直接丢进微信聊天框,它就能存到你的知识库里,非常方便。

但是要注意的是,目前微信bot只能连接一个AI 工具,也就是有上限。

你连了这个,就要考虑你的本地Agent放哪里了。

6、AI学习路线生成

 该图片疑似使用了AI生成技术,请谨慎甄别图片

我认为最顶的功能来了!!!

很多朋友在学习AI的过程中,会有这样的一个问题....

收藏从未停止,学习从未开始。

存了那么多好东西,其实还是啥都不会。

Trove AI有一个“学习路线”的模块,就是让AI根据你收藏的这些资料,将它们做一个系统性的整理,编排成学习路线图。

图片

点进去一看,是真的很详细啊,就是从你知识库里收藏的材料中,最基础的出发,然后一步步给你提高难度。

跟爬山一样,贼有意思。

五、跟 Obsidian 打通

图片

收藏不是目的,用起来才是。

打通 Obsidian 三步:

  1. 1. Trove 设置里生成 Sync Token(有效期一年)
  2. 3. 填服务器地址 + Token,在Obsidian里面,点 Sync Now
图片

全部文章、AI 摘要、标签、知识图谱关系,一键同步到 Obsidian。

Markdown 格式,可以直接编辑。知识图谱的关联会变成 Obsidian 的双链 [[wikilink]]。

同步是单向的,你在 Obsidian 里修改不会被覆盖。

六、我的日常用法

自从用了Trove AI之后,我搜集信息的流程完全变了。

基本上可以看成一个完整的闭环:

  • 第一环:刷信息流的时候,链接丢进 Trove。公众号、B站、X、群聊里的干货,一分钟能丢十几篇。不用纠结分类和标签。

  • 第二环:过段时间打开 Trove,扫一眼 AI 摘要。重点的点进去看原文,不重要的扫一眼就够了。

  • 第三环:点 Sync,所有内容出现在 Obsidian 里。

  • 第四环:在 Obsidian 写文章时,直接搜素材。之前收藏的所有相关内容全跳出来。从已有的高质量内容里提炼,而不是从零构思。

从"看到了→存了→忘了→想写文章时一片空白"。。。

变成了"看到了→存了→AI 处理了→想写文章时素材已经等在那里了"


结语

Trove AI 不是来替代 Obsidian 的。

Obsidian 是你的写作台,你在上面思考、写作、建立自己的想法。

Trove 是你的 AI 图书馆,它负责帮你把散落在各处的信息收进来、整理好、建关联,让你想用的时候随时能调出来。

图书馆只能作为收藏,但是不会替你写作,但没有图书馆,你只能凭记忆写作。

Trove 补齐的,正是本地 AI 知识库一直缺的那块——一个能把散落信息自动收进来、处理好的入口。

Obsidian 是你的写作台,Trove 是你的素材库,再加上DeepSeek做你的 AI 助手。这三样东西凑在一起,才是本地知识库的完整体。

我这个版本比原版多了视频理解能力,装了就能用,全在 UI 里配。

欢迎来 GitHub star 和提 issue:

👉 https://github.com/simonlin000/trove-ai

我是Simonlin,下次见。

感谢你看到这里。

我建了一个 AI 交流群,群的信息密度很高,也有很多AI行业的从业者。

如果你是以下选手:

  • 一线 AI 从业者——工程师、产品经理、创业者、投资人

  • 正在把 AI 融入自己的业务或工作流

  • 对 AI 工具、Agent、大模型落地有真实的经验和困惑

  • 不只是想"学 AI",而是想和同行交流、找资源、找合作

我是 Simonlin,下次见。

文章标签模型发布开源AI产品
资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多