大数跨境

智能体骨架就五样:原子、编排、能力路由、门控和事件账本,CodeAgent新版本V0.6.1开源

智能体骨架就五样:原子、编排、能力路由、门控和事件账本,CodeAgent新版本V0.6.1开源 AI驱动数字化转型
2026-09-24
7
导读:CodeAgent 的 0.6.1 今天发布,仓库是 codeagent-minimal,它是我手里那套代码智
CodeAgent 的 0.6.1 今天发布,仓库是 codeagent-minimal,它是我手里那套代码智能体唯一对外开源的一份。这一轮改了两层,外面那层是让人怎么上手,底下那层是那些原子怎么摆,才配给别的智能体当底稿。
PART 01
一个前端,两个入口

上一版这个库里还留着两个前端。一个是我自己调试用的运行页,一个是给外人看的演示页。两个都在的时候,第一次打开的人不知道该点哪个,我讲起来也要先解释两句。这轮我把它们合成一个,只留 Lab。
打开之后只有两条路。想省事的点「用预设·点一下就跑」,选一件今天要做的事;想自己搭的点「自己组装·拖拽搭流程」,从原子列表里往画布上拖。剩下那些零碎工具我收进「更多工具」,不占视线。
顶上先让工程师选目标。他填一个仓库目录,或者挑一个文件,按「切换目标」,这套东西就认这棵树;急着看结果的时候,他直接按「一键审查」,不用先想编排。
工程师按一下「快速体检」,画面立刻开始走,四个检查并行铺开,谁先回来看谁。
十六张预设卡,每一张背后都是一整套编排,不是一次调用。
从全量代码审查、快速体检、修 bug、写新功能,到测试补强、影响面分析、重构精简、质量闸门、交付验收,再到上手新项目、长任务续跑、外部工具与模型分工,都在里面。
工程师点哪一张,画布上就摆出那一条编排。先并行铺开几路检查,再把结果交给门控判定,该循环的回到上游重试,最后交一份交付报告。他不用在几个工具之间来回搬结果,只看最后那份报告。
卡上印的步骤,是我从真实编排图里取出来的,不是另写一份说明书给自己看。
画布也不再是摆设。顶上有个下拉,十六套编排加一个空白自搭都在里面,他选中哪一套,画布立刻换成那一套。主干从左到右横着排,能同时跑的原子竖着叠在同一列,循环用一条橙色虚线绕回上游,他一眼看得见它回到哪里。他扫一遍画布,就知道哪一步会并行,哪一步会回头。运行名跟着编排走,换了编排,它自己改成那一套的名字。
PART 02
点下去要有回应

上一版有个毛病,切换编排的时候画布不动,什么也不说。我查了半天,才发现是构图函数里漏了一行取节点的语句,异常被事件系统吞掉了,界面看起来就像没反应。
这轮我把它补上,还立了一条规矩:载入失败必须在画布顶上写出真实原因,画布保持原样,不许装作没事发生。
页面上多了一枚版本号,就在标题右边,写着 0.6.1。我让它只认仓库根目录那个 version.py,后端读它,前端显示它。以后改版本只改一处,不会出现界面写着旧版、代码已经跑成新版这种事。工程师扫一眼标题右边,就知道自己跑的是哪一版。

PART 03
工厂里真正用得上的是什么

我做这套东西,最先想到的落点是工厂里的代码辅助。车间里的设备和工艺代码,很多是十几年前写的,工程师想改一处,要先弄清它牵动哪几处。图纸、PLC 程序、MES 接口,这些都不方便往外传。
这个库整个跑在本机,纯 Python 标准库,不装第三方依赖,也不调用外部服务,代码不出厂这句话是能兑现的。
一条常见的活是修一个老 bug。工程师点开「修 bug / 修回归」,编排自己往下走。先深挖根因,同时并行算影响面和依赖,再定方案、改代码、跑测试。测试不过,回到改代码那一步重试;过了以后并行过一遍审查和安全扫描,门控判定放行,最后交一份交付报告。整个过程他盯着结果就行,不用在几个工具之间来回搬数据。
门控这一步值得多说一句。它按上游给出的证据判定放行还是打回,哪一路检查没过,报告里写清楚。真机上我跑过一条五节点的编排,代码审查、安全扫描、死代码、门控、交付报告,五步全绿。工程师看到放行两个字,才放心把改动交出去。
报告是给工程师看的,不是给日志看的。

PART 04
长任务、凭据和跨会话

这一版我补进来三个核心原子,是给长活准备的。
event-log 把每一步追加写进事件流,能打检查点,也能按事件回放。出了事,工程师打开事件流,顺着时间线往回查,哪一步改动引出了哪一步结果,对得上。secret-vault 管凭据的加密、存取和掩码,密钥不进代码,也不进日志。session 记会话的步进和恢复,他关掉窗口,第二天打开还能接着跑。
工厂里的活很少几分钟能干完。跑一次全量审查、训一轮模型、批处理几百个文件,中间关一次机是常事。以前这些事情断了只能从头再来,现在它们有地方记,也有地方接。工人拿手机看一眼今天的结果,不必守在电脑前面。
PART 05
它也想当别的智能体的底稿

这个库从一开始就不只干代码审查这一件事。我把它拆成原子,每个原子只做一件说得清的事。能力放进注册表做路由,谁要什么本事就调哪个原子,不用管它在哪一层。原子之间靠编排连起来,编排能并行、能循环、能加门控。每一步的结果进事件账本,交付物按统一的信封返回。
原子、编排、能力路由、门控、事件账本,这五样摆在一起,就是一个智能体的骨架。
换一个领域,动的不是骨架,是原子和本体。工厂设备问答那套东西,就是把设备、工艺、故障这些概念做成本体,再把查询、统计、判定做成原子,用同一套编排把它们串起来。培训系统也是这样,文档进本体,能力点从本体里取出来,出题、自适应、考评各是一个原子。团队接过去,照着摆自己的原子就行,骨架不用换。
我把这套原子代码智能体框架开源,也是想让它能被人拿去当底稿,而不是只当一个能跑的工具。

PART 06
这一版的口径和验证

现在这个库里是 39 个核心原子、161 项能力,Lab 启动时加载 41 个,也就是 39 个核心加 2 个扩展。这三个数字,我在本地母库、这个开源库和远端仓库上核过,是同一个口径,之前对不上的地方这轮都收齐了。
交付原子这里我修了一个会误导人的边界问题。上游没有接输入的时候,它原来会直接判整条编排失败,界面上看着像出错了,其实只是「上游没给东西」这一种情况。现在如实写成没有输入,编排继续往下走。
安全边界也加固了一处。路径里的穿越写法、绝对路径,包括 Windows 的盘符写法,不论在哪个系统上都拒绝。这个改动是被持续集成逼出来的。它在 Linux 上跑,我才发现旧代码只认反斜杠或者只认斜杠,换一个系统就漏过去。
验证是这样做的。全量测试 195 项通过,持续集成在远端跑绿,真机端到端跑过一次完整编排。前端我拿浏览器打开真实页面点过,不是只看接口返回。
PART 07
怎么开始用

仓库地址是 https://github.com/zhengjinjun1975/codeagent-minimal ,克隆下来就能跑,不需要装依赖。
三条命令够用了。起服务是 python lab/lab_app.py --port 8098,看一眼原子和版本是 python codeagent.py status --json,做一次完整审查就在页面上点「全量代码审查」那张卡。
现在的版本号是 0.6.1,仓库里的 tag 从 v0.5.0、v0.6.0 一路到 v0.6.1,都能对上。
第一次上手,我建议工程师先按那张「快速体检」。它并行跑四项检查,再过门控,最后交一份报告,几十秒到几分钟就有结果。
这套东西把几路检查收成一份结论的过程,他不用参与,只要在最后一步看谁没过、为什么没过。看清这一步,他再去点那几张长编排,心里就有底了。
这一版的改动都写进了 CHANGELOG 的 0.6.1 一节,从与母库对齐口径、前端显示版本号、交付原子边界修复到安全边界加固,都在里面,远端也打了 v0.6.1 的标签。
工具好不好用,多半不在功能多,而在客户按下去之后它有没有回应,出问题的时候有没有说实话。

【声明】内容源于网络
0
0
AI驱动数字化转型
专注AI,促进智造行业数据衍生,服务智能制造企业的数字化、智能化,聚焦大模型私域部署、大模型微调、数据清洗、AI模型训练、私域知识库及agent技术延展等。行业智能,落地为先。
内容 1092
粉丝 1
AI驱动数字化转型 专注AI,促进智造行业数据衍生,服务智能制造企业的数字化、智能化,聚焦大模型私域部署、大模型微调、数据清洗、AI模型训练、私域知识库及agent技术延展等。行业智能,落地为先。
总阅读11.8k
粉丝1
内容1.1k