大数跨境

Muse AI-Skills 深度解析:工业级个人 Agent 的技能体系与 Hatch 运行时

Muse AI-Skills 深度解析:工业级个人 Agent 的技能体系与 Hatch 运行时 苏哲管理咨询
2026-09-26
11
导读:Q&A(10 个关键问题)Q:这个仓库是 muse.ai 开源代码吗? A:不是,是第三方抓取存档快照。

Q&A(10 个关键问题)

  1. Q:这个仓库是 muse.ai 开源代码吗? A:不是,是第三方抓取存档快照。没有发布完整源码,核心逻辑编译成 Linux ELF 二进制。
  2. Q:能不能 clone 下来直接跑 Muse Agent? A:不行。缺少 rootfs、数据库、控制面依赖,只能阅读文档;二进制只能在 x86_64 Linux,且缺少依赖。
  3. Q:SKILL.md 是什么? A:技能的业务契约文档,定义什么时候触发、任务流程、失败处理、交付物验收标准,是这套系统的核心设计资产。
  4. Q:manifest.yaml 作用? A:机器可读的权限声明,定义 OAuth scope、接口方法、权限边界,实现细粒度授权。
  5. Q:skill-creator 技能是什么? A:元技能,允许 Agent 按模板创建新技能,实现能力自扩展。
  6. Q:wide-research 亮点? A:协调者 + worker 多子 Agent 并行调研;统一输出 schema,收集失败项、覆盖率,解决复杂研究任务。
  7. Q:Magic Moment 技能是做什么? A:将 Agent 工作成果 + 旁白,自动生成竖版短视频,包含剧本、时间线、渲染评审流水线。
  8. Q:runtime-cell 的隔离原理? A:systemd-nspawn 容器沙箱,独立网络、挂载,限制技能与工具逃逸;区分宿主环境与 Agent 客体环境。
  9. Q:forget 技能为什么重要? A:处理隐私删除,扫描跨系统的记忆副本、衍生产物,后台任务回写清理,满足遗忘权。
  10. Q:这套设计可以迁移到自研 Agent 吗? A:可以借鉴契约式技能、产物验收、细粒度权限、子 worker 编排思想,但连接器 OAuth、容器脚本需要重写,不能直接复制。
附录  MuseAI-Skills 仓库完整解读

仓库地址:https://github.com/win4r/MuseAI-Skills 一句话定位:muse.ai 的 Hatch Agent 运行环境快照存档,不是开源源码,不可一键部署;核心价值是 68 份技能定义文档,用于研究个人 Agent 的技能体系、工具契约、权限模型与任务编排。

一、项目本质

  1. 主体
    Muse = muse.ai,Hatch 是它底层 Agent 运行时;Jarvis 是文档内别名。
  2. 仓库性质
    第三方静态存档快照,非官方发布,没有完整源代码。
    • 核心执行程序:Linux x86-64 ELF 二进制(LFS 存储),没有源码
    • 快照包含:技能定义、权限清单、环境脚本、产品文档、数据库 Schema、评测场景
    • 缺失:rootfs、完整构建脚本、数据库迁移、部分 SDK、私有密钥、完整控制面
  3. 规模
    68 个独立SKILL.md技能(4 个符号链接别名,合计 72 个入口);配套 40 份manifest.yaml权限声明、12 份 eval 评测场景。

二、架构总览(Hatch Agent 分层)

用户输入 ↔ 个人上下文层(Goals目标 / Memory记忆 / Feed / Ideas)
    ↓
Agent执行层(Hatch Daemon + hatch-execd执行服务)
    ↓
技能契约层(SKILL.md 任务定义 + manifest.yaml OAuth/方法级权限)
    ↓
工具连接器层(各类CLI、MCP、浏览器broker、第三方API)
    ↓
持久化层(PostgreSQL,17个命名空间、195张表)
    ↓
隔离运行时(systemd-nspawn runtime-cell容器,宿主/客体隔离)

核心设计思想:技能 = 结构化任务契约,不是单纯 Prompt。每个技能由三部分组成:

  1. SKILL.md
    触发条件、业务流程、失败处理、交付验收标准
  2. manifest.yaml
    机器可读权限、OAuth Scope、工具方法映射
  3. eval/scenarios.yaml
    评测场景,定义预期行为

三、68 项技能分类清单(核心能力集)

1. Agent 工作流与记忆(6 个)

  • wide-research:并行多源深度调研,统一输出契约,失败覆盖率上报(最值得研究的子 worker 并行框架)
  • goals:目标管理,区分新建目标 / 持续跟进,避免重复收集用户信息
  • skill-creator:元技能——Agent 可以创建新技能;定义技能模板、触发规则、按需加载参考资料
  • self-awareness:Agent 自检,回答自身能力、记忆、已完成任务
  • forget:记忆删除,处理多副本、衍生数据、后台任务回写的清理流程(记忆安全关键设计)
  • muse_db:只读数据库查询,追踪执行记录、诊断 Agent 交付历史

2. 文档产物验收 Artifacts(6 个)

统一思想:区分 “生成成功” 和 “产物可用”,交付物必须校验

  • document:Word/OOXML 文档编辑、修订
  • markdown:Markdown、纪要、README 生成与自检
  • pdf:PDF 编排、表单填写、几何校验
  • presentation:PPTX/HTML 幻灯片组装
  • spreadsheet:表格、公式、工作簿验证
  • testing:产物验收框架,占位符扫描、重渲染校验、目视检查

3. 旅行预订(7 个)

重要设计:调研路由 和 交易路由分离,先可行性研究,再下单入口

  • travel-planning:行程规划、签证、转机、交通可行性
  • booking:航班酒店门票可订选项
  • places-search:本地餐厅景点搜索比价
  • duffel:航班搜索、订票、订单管理、票价监控
  • flightaware:航班实时状态、延误取消查询
  • opentable:餐厅订位
  • ticketmaster:活动票务搜索(只给链接,不直接支付)

4. 办公邮箱 & 知识工具(16 个,连接器最多)

Google 全家桶 + Outlook + Notion + Calendly + 会议转录 gmail/google-calendar/google-contacts/google-docs/google-drive/google-forms/google-sheets/google-slides/google-tasks outlook-calendar/outlook-contacts/outlook-mail notion、granola 会议转录、muse-mail、calendly 预约

5. 社交消息(6 个)

Facebook/Instagram/Threads 内容发布、私信、Marketplace 刊登

6. 购物金融(3 个)

shopping 商品搜素比价;printify 定制电商;plaid 银行账户、交易、资产读取

7. 健康数据(6 个)

Apple HealthKit、Google Health Connect、Function-health 化验、Healthex、Peloton 健身、Withings 设备数据读取

8. 图像音视频工作流(8 个)

image-search、媒体图库、Spotify 音乐播客、generate_podcast 播客生成、TTS 语音、voice-design 语音定制magic-moment:标志性技能,把 Agent 工作成果 + 真人旁白,自动编排成竖屏短视频,包含剧本、时间线、渲染评审流水线

9. 设备、网络、智能家居(6 个)

设备数据、穿戴设备、穿戴短信通话、飞利浦 Hue 灯光、Tesla 车辆控制、Tailscale 私有网络接入

10. Muse 产品自身操作(4 个)

抢先体验申请、反馈提交、分享 Idea、订阅用量状态查询

四、文件结构拆解

.
├── README.md / PROJECT_ANALYSIS.md   # 总介绍 + 架构分析报告
├── SHA256SUMS                       # 文件校验哈希
├── home/hatch/                       # Agent用户侧配置、产品文档
│    ├── config/home.yaml / skills.yaml  # Agent推理配置、技能可用状态
│    ├── docs/                       # 26份产品顶层设计文档(goals.md、artifacts.md、connectors.md等)
│    └── workspace/
└── opt/hatch/
     ├── bin/                        # 77个核心二进制:hatch主daemon、spawnd容器管理、hatch-execd命令执行器、各类connector CLI
     ├── runtime-cell/               # systemd-nspawn容器生命周期脚本(启动/停止/网络/挂载/信任存储)
     └── skills/                     # 全部68个技能目录(SKILL.md + manifest + eval)
opt/hatch-image/bin/                 # 镜像侧工具:bun、npm、codex、rtc音视频组件

五、运行隔离 Runtime-Cell(Hatch 安全模型重点)

采用 systemd-nspawn 轻容器作为沙箱运行单元:

  1. pre-start:清理旧状态、准备挂载
  2. ensure-rootfs:准备 rootfs 镜像
  3. launch-daemon.sh:启动 nspawn 容器,overlay 技能与二进制
  4. post-start:配置 veth 虚拟网卡、网络过滤
  5. stop/post-stop:优雅关闭、清理网络与挂载
  • skill-scopes.conf / bin-scopes.conf:渠道可见性控制(不等于权限授权)
  • guest.env:容器环境变量、代理、CA 证书

安全设计:可见性、授权、凭据三层分离。manifest 定义权限范围;Vault 保存密钥;容器隔离执行。

六、阅读路线

  1. PROJECT_ANALYSIS.md
    全局架构、边界、缺项一览
  2. home/hatch/docs/muse.md
    Muse 产品整体概览
  3. home/hatch/docs/connectors.md
    连接器、OAuth、权限模型总规则
  4. 优先技能文档(最有参考价值)
    • wide-research:子 Agent 并行任务
    • skill-creator:元技能自构建
    • artifacts/testing:交付物验收体系
    • forget:记忆删除 / 数据遗忘
    • magic-moment:多媒体产物流水线
    • gmail:标准连接器完整样例(SKILL+manifest+eval 全套)
  5. opt/hatch/runtime-cell/
    容器脚本,理解隔离执行模型
  6. muse_db/references/schema.md
    数据库模型

七、关键限制与风险

  1. 不能直接部署运行
    缺少 rootfs、数据库、完整核心源码;二进制只能在 Linux x86_64 运行。
  2. 快照是存档,不是官方开源项目,无统一开源协议;版权归属原始厂商。
  3. skills.yaml
    只是声明 “可用”,不等于账号授权;manifest 只是权限定义,不等于已经授予 OAuth。
  4. eval 评测场景文件仅描述预期行为,不代表已经全部测试通过。
  5. 仓库只保存静态文档,无法验证原系统真实线上行为。

八、对 Agent 工程的启示

这套文档代表一套工业级个人 Agent 设计范式,区别于简单提示词 Agent:

  1. 技能作为一等公民,标准化契约:触发条件、输入输出、失败策略、验收标准
  2. 权限精细化:方法级权限,不是粗粒度全 API 访问
  3. 任务拆分:协调者 + Worker 子 Agent(wide-research)
  4. 产物闭环:生成→校验→验收(artifacts)
  5. 记忆治理:不仅能写记忆,还有 forget 遗忘流程,处理隐私删除
  6. 运行隔离:容器沙箱,防止工具调用逃逸
  7. 可评测:每个连接器配套场景化测试用例
  8. 元能力:Agent 拥有创建新技能的能力(skill-creator)

【声明】内容源于网络
0
0
苏哲管理咨询
为企业及组织提供AI+战略、数智化转型咨询及观点、建议等
内容 2245
粉丝 0
苏哲管理咨询 为企业及组织提供AI+战略、数智化转型咨询及观点、建议等
总阅读50.3k
粉丝0
内容2.2k