大数跨境

Grok Bot刚上线两周就被网友“还原”了:Claude、Codex全接上,本地Docker也能跑,这下Agent的底牌看清了

Grok Bot刚上线两周就被网友“还原”了:Claude、Codex全接上,本地Docker也能跑,这下Agent的底牌看清了 我的Ai笔记
2026-08-31
2
导读:Grok Bot被社区重构后,Agent的模型路由、本地执行与真实架构彻底摆上台面。
点击蓝字,关注我们


这是我的第489篇Ai笔记,本篇2965、累计笔记8470170

彩蛋:结尾扫描二维码,领取《Grok Bot Agent 架构拆解手册》

引言

刚上线没多久的 Grok Bot,这两天出了件很有意思的事。

xAI 刚刚推出 Grok Bot,定位非常直接:给你一群可以长期在线工作的 AI 队友。它们拥有自己的云端电脑,可以打开网页、操作文件、调用工具,你把任务交出去以后,甚至可以直接合上电脑,让它继续在后台干活。官方目前已经把它开放给 SuperGrok、Cursor Pro 以及 Cursor Teams 等多个订阅计划。

结果产品上线还不到两周,开发者 Bennett 发现,Grok Bot 0.18.0 发布包里竟然带着运行时的 Source Maps(源码映射文件)。

简单理解,正常的软件发布以后,代码早就经过压缩和打包,外面的人看到的是一坨处理过的 JavaScript;Source Maps 就像一张“代码地图”,可以帮助开发者把处理后的代码重新对应回更容易阅读的源码结构。

原稿里也记录了 Bennett 发现这一问题,并据此开始重构 Grok Bot 的过程。

但好家伙,真正有意思的事情才刚刚开始。

Bennett 不但做出了一套可以运行的 Grok Bot 0.18.0 重构版本,还顺手给它加了一个模型 Router(路由器):Cursor、Claude Code、Codex、OpenRouter,都可以接进同一套 Grok Bot 里;原本依赖远程云端电脑的执行环境,也增加了可选的本地 Docker 沙箱。

看到这里,我第一反应其实不是“Cursor 怎么连 Source Maps 都忘了关”。

我觉得真正值得看的,是另外一件事:

一个售价不低、被包装成“下一代 AI 数字员工”的商业 Agent,终于被扒开给我们看了一眼。

它到底是怎么工作的?

思考

过去半年,我们聊 Agent,经常会把注意力放在模型身上。

Claude 强不强,Codex 会不会写代码,Grok 推理怎么样,Gemini 能不能操作电脑……

但把这次 Grok Bot 的公开重构项目翻一遍,你会发现,一个真正能替你干活的 Agent,模型只是里面的一层。

它下面还有 Electron 客户端、Host(任务执行主机)、Coordinator(协调器)、工具系统、MCP、认证、会话、远程执行环境,以及负责选择不同模型的 inference router(推理路由器)。公开项目给出的架构图非常直白:上面是 Grok Bot 的界面,中间负责调度和执行,下面才是 Cursor、Claude、Codex、OpenRouter 这些模型入口。

这就有意思了。

因为它说明 Agent 接下来很可能会越来越像今天的电脑。

模型是 CPU,Claude、Codex、Grok 都可以换;Docker 或云端电脑是执行环境;浏览器、文件、MCP 是外设;真正把这些东西组织起来,让任务能持续跑下去的,是中间那一整套 Harness(运行时总控)。

所以我反而不太认同原稿里一个比较激进的说法:商业 Agent 只是“简单的流程拼接”。

拼起来确实没什么神秘的,能把它稳定地跑起来,才是真本事。

模型掉线怎么办?任务执行一半崩了怎么恢复?工具权限怎么管?密码什么时候能让 AI 用?不同模型什么时候切换?执行结果怎么留下记录?哪些动作必须让人确认?

这些东西听起来没有“大模型突破”那么性感,却决定了一个 Agent 到底能不能真的替你上班。

而 Grok Bot 这次被重构,反而把这层东西暴露得更清楚了。

AI+

那这个社区版本到底加了什么?

我挑三个最值得看的。

01|同一个 Agent,Claude、Codex、Cursor 随便换

原版 Grok Bot 的模型和执行环境,本身是一套比较封闭的产品组合。

Bennett 在重构版本里加了一个 Router。

现在新任务可以选择 Cursor、Claude Code、Codex 或 OpenRouter。Claude Code 使用已有登录状态,Codex 可以使用本地 ChatGPT/Codex 登录,OpenRouter 则直接使用 API Key。

这个功能看起来只是多了一个下拉框,我觉得它的意义却挺大。

以前买 Agent,模型、客户端、云端电脑、工具基本是一整套卖给你;现在模型开始变成可以替换的零件。

写代码的时候丢给 Codex,需要另一套能力时切 Claude,简单任务走便宜模型。

Agent 和模型开始解绑了。

以后我们挑 Agent,很可能不会再只问一句“它用的是什么模型”,还得继续问:

我能不能自己换模型?

02|云端电脑,也可以换成本地 Docker

Grok Bot 官方最大的卖点之一,就是每个 Bot 都有自己的电脑。

官方描述的是一台持续存在的云端电脑,里面有浏览器、文件系统和终端。Agent 可以在你离开以后继续跑任务,这也是它和普通聊天机器人的核心区别之一。

而重构项目又往前走了一步。

它保留远程模式,同时增加了可选的本地 Docker Sandbox(Docker 沙箱),让部分执行任务可以直接发生在自己的机器上。

这个功能对个人开发者可能只是方便。

放到企业里,意义就不一样了。

代码、内部文件、业务数据,到底需不需要全部送进厂商的云端电脑?能不能在自己的机器或者服务器里执行?

过去大家选 Agent,主要看它聪不聪明。

以后我觉得还会多一个越来越重要的问题:

它到底在哪里干活?

03|真正值得抄的,是它的分层方式

如果你只是想围观“源码泄露”,看到这里其实已经可以走了。

但如果你自己在做 Agent,这个项目真正值钱的是架构。

它把桌面客户端、认证和插件生命周期、远程/本地执行环境、任务协调、模型路由、MCP 工具,以及最终的 UI 分开处理。

换句话说:

前面的聊天窗口只是入口。

真正复杂的东西都藏在后面。

这也是为什么最近 Codex、Claude Code,包括越来越多新的 Agent 产品,都开始把工作重点放到模型外围:工具、沙箱、权限、上下文、任务状态、并行执行、恢复机制。

模型越来越强以后,大家真正开始狠狠干“怎么让模型可靠干活”这件事了。

这可能才是 Grok Bot 这次意外被扒开以后,最值得看的地方。

三句话

最后,老规矩,用三句话总结这件事。

1. Grok Bot 这次被重构,真正暴露出来的不是一个“AI 套壳秘密”,而是一套越来越清晰的 Agent 技术结构:模型、工具、执行环境、任务协调和客户端正在逐渐分开。

2. Claude、Codex、Cursor 可以接进同一个 Agent,本地 Docker 也可以替换部分云端执行,但目前它依然是一个非官方、实验性的重构项目,距离普通人无脑使用还差得远。

3. 接下来选 Agent,我建议少问一句“它用什么模型”,多问四句:模型能不能换、数据在哪里跑、权限怎么管、任务失败以后怎么恢复——这些东西会越来越值钱。

🎁彩蛋福利🎁

这次 Grok Bot 的公开仓库其实非常适合拿来学习 Agent,只不过源码和文档比较散,直接啃还是挺费时间。

所以我另外整理了一份 《Grok Bot Agent 架构拆解手册》,把它的 客户端、Coordinator、Host、模型 Router、MCP、本地 Docker 沙箱 几个关键模块画成了中文架构图,同时整理了 Claude、Codex、OpenRouter 的接入关系。

不需要你去啃几万行代码,照着图就能看懂一个商业 Agent 到底是怎么跑起来的。

扫码回复关键词【GROK】即可领取。

【声明】内容源于网络
0
0
我的Ai笔记
很干货、有深度、真免费,关注“我的Ai笔记”,每天学Ai技巧! 赋能客户、助力普通人在Ai时代抢占先机。
内容 444
粉丝 1
我的Ai笔记 很干货、有深度、真免费,关注“我的Ai笔记”,每天学Ai技巧! 赋能客户、助力普通人在Ai时代抢占先机。
总阅读24.3k
粉丝1
内容444