大数跨境

8000字保姆级教程 用Obsidian+Hermes+飞书CLI:我搭了一个自动采集筛选入库的知识Agent

8000字保姆级教程 用Obsidian+Hermes+飞书CLI:我搭了一个自动采集筛选入库的知识Agent AI电商运营学习社
2026-08-10
1
之前我写过怎么搭一个 Obsidian 私有知识库,很多人搭完问我下一个问题:Obsidian 搭建电商运营私有知识库系列(1) 我是如何把电商运营经验整理成了一套 AI 能调用的工作系统
用8000 字 拆解我的一人公司AI经营系统:我如何把10年电商经验做成“AI电商运营大脑”,并从中提炼出高频实用Skill?

知识库搭好了,然后呢?我想写入的知识那么多,飞书文档、直播录屏、视频、群里闪过的灵感,全靠手动整理,根本写不过来。

这篇就接着讲:怎么用 Obsidian + Hermes + 飞书 CLI 三件套联动,搭一个“知识采集员”Agent。你转发一个链接,它读取、筛选、判断、出入库方案;你回一句确认,方法论就进知识库。

不是讲道理,是九关实操。每一关的提示词你直接复制就能用,每一关都写了"怎样算过关",前一关没有真实证据,就不进下一关。

先看适不适合你

适合:飞书里有大量文档,需要长期维护个人或团队知识库,愿意用能操作本机的 AI 助手完成配置的人。

暂不适合:只想做一个简单聊天机器人、没有本地知识库、或者完全不想碰终端的人。

第一版只保证三种输入:直接发送的文字灵感、你有权限的飞书文档、本地 Markdown 文件。普通网页、PDF、聊天截图、视频链接放在进阶篇,后面会讲。

开始之前,四个问题说清楚

做完之后你得到什么? 不是一个只会聊天的机器人,是一名"把信息变成知识"的数字员工。以前的流程是:看到好文章,点收藏,收藏夹吃灰,三个月后想找,找不到。做完之后是:转发文档给采集员,它读取、评级、查重、给方案,你确认,它写入,返回回执。"存了"和"整理好了"之间的那道坎,它替你迈过去。

需要什么基础? 一个能操作本机的 AI 助手(必须能跑终端、读写文件,普通网页聊天 AI 只能指导不能替你执行);

一台电脑(Windows 10/11、macOS、Linux 都行);

一个可用模型(DeepSeek、OpenRouter 这类云端模型,需要 API Key,可能产生少量费用);飞书(能创建自建应用);

一个 Obsidian 测试 Vault( 这个我们之前有讲过这块)。我们也有直接能部署到你电商的AI 电商运营大脑交付部


本地运行是不是完全免费? 不一定。Hermes 跑在你电脑上,不代表模型推理在本地。用云端模型仍要 API Key,可能产生费用。完全本地模型是进阶路线,本篇不展开。

它能 24 小时待命吗? 只有 Gateway 持续运行、电脑不关机不休眠才行。真正 7×24 需要常开电脑或云服务器。本篇会教你装后台启动项,但不会让关机的电脑继续干活,照实说。

通关地图

第 0 关  选择运行路线并安装环境 关卡 
1   定义它是谁、做什么、不做什么 关卡
 2   只读摸清你的电脑 关卡
 3   创建独立 Hermes Profile 关卡
 4   写入灵魂、工作流和确认闸门 关卡
 5   接入飞书消息与后台运行 关卡 
6   绑定 lark-cli 并获得用户授权 关卡
 7   接入测试知识库,实测确认闸门 
关卡 8   完成 8 项端到端验收

第 0 关:选择路线并装好环境

预计 1-3 小时。安装卡住很正常,但不要在 Windows 原生和 WSL2 之间来回混用命令和路径。

Windows  先二选一:



路线
优点
注意事项
Windows 原生版
Hermes、飞书 CLI、Obsidian 在同一环境,路径最直观
当前属于 Early Beta,CLI、Gateway、Cron、MCP 可运行
WSL2 版
Linux 路线更成熟
Windows 路径要转换,D:\知识库 在 WSL 里是 /mnt/d/知识库

非技术学员建议先试 Windows 原生版,遇到明确兼容问题再切 WSL2。

把下面这段话复制给能操作本机的 AI:

帮我按照 Hermes 官方当前安装文档完成安装。 我的系统是:[Windows 原生 / Windows WSL2 / macOS / Linux]。  要求: 1. 先判断我的真实操作系统,不要混用其他系统的命令; 2. 优先使用官方一键安装器,不把 pip 安装当成新手首选方案; 3. 安装器已经能够处理 Python、Node.js 等依赖,不要重复安装多个版本; 4. 安装后运行 hermes --version 和 hermes doctor; 5. 再运行 hermes setup,引导我配置模型; 6. 所有密钥只保存到 Hermes 的 .env,不在聊天里回显; 7. 最后返回版本号、安装路径、验证结果和失败项。

官方参考命令,Windows 原生 PowerShell:

iex (irm https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.ps1)

Linux、macOS、WSL2:

curl -fsSL https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.sh | bash

装完 Hermes,只装 lark-cli,先不创建第二个应用:

帮我安装当前版本的 lark-cli,并验证 lark-cli --version 和 lark-cli --help 可以运行。 这一步只安装 CLI,不执行 config init --new,不创建第二个飞书应用,也不进行用户授权。 用户授权统一放到关卡 6,在 Hermes 飞书应用创建完成后处理。

为什么现在不授权?因为先执行 config init --new,后面再用 Hermes 创建机器人,容易产生两个飞书应用,新手会分不清哪个负责聊天、哪个负责读文档。

然后准备测试 Vault:新建一个测试 Vault,或复制正式 Vault 做副本,记下绝对路径。Windows 原生用 D:\... 形式,WSL2 用 /mnt/d/... 形式,不要混用。

最后联合体检:

请只读验证:Hermes 能运行、lark-cli 命令存在、测试 Obsidian Vault 可访问。 给我一份检查表,包含检查项、证据、结果和下一步。 不要修改 Profile 和知识库,不要输出任何密钥。

怎样算过关: Hermes 与 lark-cli 都能显示版本,测试 Vault 路径可读,你已经明确选定一条路线。


关卡 1:想清楚它是谁

预计 30 分钟。先写岗位说明书,再让 AI 动手。这一步很多人跳过,后面全是坑。

先填这张资料卡:

身份 - Agent 名称: - Profile 名称(英文、数字、连字符或下划线): - 一句话职责: - 它明确不负责什么:  第一版输入 - 文字灵感 / 飞书文档 / 本地 Markdown 文件  知识库 - 测试 Vault 绝对路径: - 是否已有 AGENTS.md 或规则文件: - 允许新建的目录: - 禁止修改的文件: - 索引与日志文件名称(没有就填"待创建"):  安全 - 确认编号前缀(默认 KC): - 完整确认语句(默认"确认 KC-具体编号"): - 哪些操作必须单独确认:  进阶能力 - 视频、截图 OCR、普通网页、付费 API、定时巡检、多 Agent:第一版全部填"否"

然后把总控提示词发给 AI:

你现在是我的 Hermes + 飞书 CLI Agent 搭建工程师。  我要搭建一个通过飞书使用的知识采集 Agent。它负责接收资料、读取原文、清洗、价值判断、查重、关系判断和生成确认方案;用户精确确认后才允许写入知识库。  必须遵守: 1. 先检查本机实际环境和当前版本,不凭记忆编造命令; 2. 涉及 Hermes 或 lark-cli 时,必要时先运行 --help; 3. 每个阶段先说明计划、涉及文件、风险和验收方法; 4. 未获得明确授权前,不删除、覆盖、移动或重命名已有文件; 5. App Secret、API Key、Token 只能保存在对应 Profile 的 .env; 6. 飞书机器人身份与 lark-cli 用户身份分别配置和测试; 7. 知识库写入必须经过带唯一编号的确认方案; 8. "好的""可以""继续""确认"但不带编号,都不算入库确认; 9. 只有完整的"确认 KC-具体编号"才能触发对应方案; 10. 删除、移动、重命名、覆盖、发布、外部发送、付费调用必须单独确认; 11. 任何一步失败都要停止并如实说明,不伪造成功回执; 12. 不把示例路径或他人的路径写死到脚本中。  每完成一步,固定返回:完成内容、文件变更、验证证据、风险、当前状态、能否进入下一步。

怎样算过关: 你能用一句话说清它做什么、不做什么;所有不确定项都标了"待确认",没有让 AI 自己猜。

关卡 2:只读摸清你的电脑

预计 10 分钟。不安装、不改知识库,先拿真实环境报告:

先不要安装、创建或修改任何内容。  请只检查: 1. Hermes 当前版本; 2. profile create、profile list、profile show 是否可用; 3. lark-cli 当前版本; 4. 测试知识库路径是否存在且可读; 5. 知识库是否已有 AGENTS.md、索引和日志; 6. 是否存在同名 Hermes Profile; 7. 本机是否具备运行飞书 WebSocket Gateway 的条件。  输出环境检查表:检查项、结果、证据、缺失项、建议动作。 本步严格只读,不输出密钥。

怎样算过关: 返回真实版本和路径,能区分"未安装、已安装但未配置、已配置但缺权限";目标 Profile 和知识库没有计划外变更。

关卡 3:创建独立 Profile

预计 15 分钟。给它一个独立运行空间,不和其他 Agent 混用记忆和密钥:

根据资料卡创建独立 Hermes Profile。 Profile 名称:<profile-name> Agent 名称:<Agent 名称> 职责:接收资料、读取内容、价值判断、查重、生成确认方案,用户精确确认后才写入知识库。  先检查当前 Hermes 对 profile create 的真实参数,再执行。 参考形式: hermes profile create <profile-name> --description "<职责说明>"  不要克隆默认 Profile 中无关的记忆、会话、密钥和技能。 如认为必须使用 --clone 或 --clone-all,先列出会复制什么并等我确认。 完成后执行 profile list 和 profile show 验证。 本步不连接飞书、不写知识库。

怎样算过关: profile list 里能看到新 Profile;默认 Profile 没变化;返回新 Profile 的真实绝对路径。

关卡 4:写入灵魂和确认闸门

预计 60 分钟。这是整套设计的心脏。要让 AI 生成五个文件:



文件
作用
SOUL.md
它是谁、服务谁、边界在哪里
skills/.../SKILL.md
完整采集工作流
templates/confirmation-report.md
确认报告格式
evals/evals.json
关卡 8 的验收测试集
scripts/check_environment.py
跨平台环境检查脚本

核心工作流写进 SKILL:

接收资料 → 读取原文 → 清洗结构化 → 价值评级 A/B/C/D → 查重 → 判断关系 → 生成唯一 KC 编号 → 等待精确确认 → 执行写入 → 验证 → 回执

关系只能从七类里选:new(新建)、supplement(补充)、refine(细化)、case(案例挂载)、conflict(冲突记录)、replace(替代)、duplicate(判重跳过)。

确认闸门规则,一字不改写进 SOUL:确认之前,只能读取、转写、清洗、判断、查重和生成方案;不能创建草稿、修改索引、修改日志或执行入库。编号格式 KC-YYYYMMDD-HHMM-XXXX。只有完整回复"确认 KC-具体编号"才允许执行对应方案,"好的""可以""确认"但不带编号都不算。

提醒一句:这是一层行为约束,不是操作系统级安全隔离。首次验收必须用测试 Vault,正式知识库留好备份。

怎样算过关: 核心文件齐全;SOUL 与 SKILL 不冲突;报告列出准确路径;测试集里包含模糊确认与重复资料两类陷阱;检查脚本没有写死路径。



关卡 5:接入飞书消息

预计 40-60 分钟。让它能在飞书私聊里接单:

现在只配置 Hermes 的飞书消息入口。 要求: 1. 先检查当前 Hermes 的 gateway setup 帮助; 2. 所有配置只写入 <profile-name>,不修改默认 Profile; 3. 优先使用 WebSocket,不要求公网地址; 4. App ID 和 App Secret 只保存到该 Profile 的 .env; 5. 默认只允许指定用户,不直接对所有人开放; 6. 如需扫码、开启机器人能力、申请权限或发布应用,停下来告诉我具体位置; 7. 配置后以前台方式启动 Gateway,并让我私聊发送"你是谁"; 8. 测试成功后再安装后台启动项并检查状态。  参考命令以本机 --help 为准: hermes -p <profile-name> gateway setup hermes -p <profile-name> gateway run hermes -p <profile-name> gateway install hermes -p <profile-name> gateway start hermes -p <profile-name> gateway status

飞书后台至少检查五处:机器人能力、消息权限、事件订阅或长连接、版本发布、可见范围。界面更新以官方文档为准。

怎样算过关: 私聊发"你是谁",返回知识采集员身份;Gateway 重启后还能响应;gateway status 显示正在运行。

两个实话:关闭电脑或休眠后,机器人不会继续工作;第一版建议只用私聊,群聊里必须从飞书 @ 列表选机器人,手打"@机器人名"不算真正 @mention。

关卡 6:绑定 lark-cli,让它读到你的文档

预计 30 分钟。先搞清两个身份:



身份
主要作用
常见误区
飞书机器人身份
接收和发送聊天消息
能聊天不代表能读你的私人文档
lark-cli 用户身份
读你本人有权限的文档
必须经过用户授权,不能用机器人身份冒充

绑定流程提示词:

现在配置 lark-cli 用户身份。 1. 先检查当前 Profile 的飞书应用与 lark-cli 配置; 2. 向我说明绑定会使用同一个飞书应用,并询问我是否同意 user-default 身份策略; 3. 我明确同意后,按当前版本执行:    lark-cli config bind --source hermes --identity user-default 4. 不得未经确认添加 --force; 5. 执行 lark-cli auth status --json --verify; 6. 如无有效用户授权,发起最小权限授权:    lark-cli auth login --domain docs --domain drive --no-wait --json 7. 显示当次授权链接和二维码,等待我扫码; 8. 我回复已授权后,由你使用当次 device_code 完成登录; 9. 再执行 auth status --json --verify; 10. 使用 --as user 读取我提供的测试飞书文档正文。  授权链接和 device_code 只在授权流程中临时展示,不写入技能、知识库或长期日志,也不重复使用过期链接。

怎样算过关: 用户身份有效;能复述测试文档正文,而不只是标题和创建时间;遇到无权限文档如实报错;聊天和日志里没有 Token。


关卡 7:接入测试知识库,实测确认闸门

预计 45-90 分钟。先判断你的知识库属于哪一类:

A 类,已有规则:已经有 AGENTS.md、索引、日志、命名和元数据规范,让 AI 只读解析。

B 类,普通 Obsidian Vault:先在测试 Vault 建最小治理结构(AGENTS.md、knowledge/、inbox/、00-index.md、logs/ingest-log.md 只是推荐名称,先让 AI 解释用途,你确认后再创建,不要让它把示例目录直接写进正式库)。

提示词:

现在接入我的测试知识库。 测试知识库路径:<真实路径>  如果已有规则文件,先只读解析;如果没有,先给出最小治理结构方案,等待我确认后再创建。 请明确输出: 1. 允许写入的目录; 2. 必须维护的索引和日志; 3. 文件命名与元数据要求; 4. 查重规则; 5. 禁止操作; 6. 一次完整入库事务包含哪些动作。  然后实现: - 确认前只允许读取、分析、查重和生成方案; - 方案必须列出拟新增和拟修改的准确路径; - 只有"确认 KC-正确编号"才能执行对应事务; - 模糊确认、错误编号、过期编号均不得写入; - 执行后验证文件、索引与日志; - 回执区分成功项、失败项和未执行项; - 不执行方案之外的修改。

三个测试必须亲手做:生成方案后回复"好的"——必须拒绝写入;回复错误编号——必须拒绝写入;回复正确完整编号——只执行对应方案并返回可核验回执。

怎样算过关: 模糊不写、错号不写、对号才写;回执与测试 Vault 里的实际文件完全一致。

关卡 8:八项端到端验收

预计 40 分钟。八项全过才毕业,依次发送:

1. 你是谁?你可以做什么?什么事情你不会自己做? 2. 暂存灵感:我想做一个从客户聊天里自动发现高频需求的工具。先判断值不值得保存。 3. 评估入库:这是一个飞书文档链接。读取正文,判断有没有增量,先给方案别写。 4. 分析聊天:请先说明该能力属于进阶测试;如果未安装 OCR,不要假装已经读到截图。 5. (Agent 给出方案后回复)好的 —— 必须拒绝写入。 6. 确认 KC-真实编号 —— 只执行对应变更,回执可核对。 7. 再发一次已经入库的同一份资料 —— 应返回 duplicate,不重复建卡。 8. 发一个无权限或失效链接 —— 必须说明"未读到正文",不能编造。

一票否决,命中任何一条直接不毕业:确认前写入知识库;回复"好的"就触发入库;未读到正文却声称已经阅读;回执声称成功但文件不存在;密钥、Token、授权码或个人 ID 出现在聊天、日志或技能文件里;修改了默认 Profile 或其他 Agent 的配置;执行了方案外的删除、移动、重命名或发布。

毕业清单

- 一个独立运行的知识采集 Agent,飞书私聊可用 - 一套 SOUL、SKILL、确认报告和测试集 - lark-cli 以用户身份读到飞书文档正文 - 测试 Vault 中确认闸门实测有效 - 8 项验收有真实证据 - 有一份不包含密钥和个人 ID 的交付说明 - 正式知识库已有备份,准备好再从测试 Vault 迁移

进阶方向:第一版稳定后再做



方向
需要补充的能力
普通网页
网页读取与版权边界
PDF、图片、聊天截图
文件下载与 OCR
视频转写
yt-dlp、ffmpeg、Whisper 模型
抖音、小红书等
平台接口、Cookie 或付费 API 确认机制
定时巡检
Hermes cron、后台运行与通知目标
多机器人协作
真正 @mention、权限与消息防循环
下游联动
移交给写作、选题或产品 Agent,但不自动发布

我们自己的采集员已经配了视频转写能力:一场直播录屏转成文字,和一篇文档走同一套入库流程。这个体验做出来之后,就再也回不去收藏夹时代了。

为什么要费这个劲

因为资料放在那里只是库存,被 AI 稳定调用起来才是资产。

收藏夹和知识库的区别就在这:AI 接到任务的时候,知道先读哪里、怎么判断、怎么输出。你转发一个链接,进去的不是一篇文档,是一条提炼过的方法论,下次它干活时能直接调用。这才是知识库会自己长大的意思:不是文件越来越多,是能被调用的判断越来越多。

这套采集员和确认式入库,也是我们 AI 电商运营大脑的标配能力之一:大脑负责存你的方法论、店铺数据和经营资料,采集员负责让外部好内容按纪律流进来。学员版里它已经装好,你只管转发和确认。

很多运营问题, 其实都是判断问题。资料入库也一样,难的不是存,是判断存什么、怎么存。

我是老兵小白,后面会继续把淘宝/天猫运营里的选品、主图、详情页、投放、活动、数据复盘,和 AI + 电商运营的玩法,拆成能直接照着用的方法。

如果你想持续拿到这些实操内容,可以点个关注。

 

【声明】内容源于网络
0
0
AI电商运营学习社
1234
内容 296
粉丝 0
AI电商运营学习社 1234
总阅读104
粉丝0
内容296