三天,从零到上线 · 全程直播
三名成员、一间工作室:72 小时,从空仓库到上线。
整理自三场直播实录 · 附《Grok Bot Guide》中文指南
Grok Bot 团队的三名成员——Matt Palmer、Roshan 和 Lauren(“Potato”)——坐在旧金山的一间工作室里,面前是一个空的 GitHub 组织、一个空的 Slack、一个空的 Notion,且毫无头绪。七十二小时后,他们推出了一款面向数千用户的在线产品。本文中的所有经验均来自这三场直播。
- 第一天 · 构思
一家餐厅快闪店变成了快闪平台,变成了一场艺术展,又变成了周边商品快闪店。一天内四次转型。瓶颈从来不是软件;是“到底要做什么”的共识。
- 第二天 · 搭建
转向游戏工作室方向。用 HTML 做了一个自动对战游戏的临时原型,代号 Cupcake,边搭边玩——包括数值 bug、作弊演示等一切问题全部现场暴露。
- 第三天 · 发布
Bot 工厂一夜之间提交了 170 个 PR。上午 10 点,《Thursday Arena》正式上线。
截止收工:433 个 PR 合并、约 3 万次页面浏览量、约 6,000 场比赛、收入为 $0。
433
pull requests · 三天内合并完成
~2,000
注册玩家数(发布当天)
~30k
已上线游戏的页面浏览量
$0
收入
产品文档描述的是“功能做了什么”。而三天未经剪辑的实时搭建过程,向你展示的是人们在时间压力下实际怎么做——哪些模式经受住了考验,哪些代价过高,哪些悄无声息地出了问题。这里几乎每一项都是有人亲自在实操的行为,而非某个人的功能描述。
01
PART
先换心智:是AI同事,不是技能
产品创作者 Roman 把核心论点说得很直白:他们想让 Grok Bot 非常像你在和同事一起工作。
三条假设撑起后面所有操作:
队友范式,不是任务范式
这是与现在通用 Agent WorkBuddy、ChatGPT Work 等最大的区别,机器人是有名字、会持续积累知识的同事,不是用完就扔的会话线程。
每个机器人有自己的电脑
带浏览器的 Linux 环境,能碰遗留软件、政府门户、没有 API 的站点。
云端跑
合上电脑,活还在干。
于是日常动作变了:你是在写「职位描述」,不是填设置页;纠正是投资,不是打扰;中途打断重定向,是正常管理,不是失败。
Roshan 还划清了一层边界:大模型是大脑,轻量框架负责编排和判断,真正的重度编码再委派给云端编码代理。原型可以快,交付要进正规流水线。
02
PART
一条被反复强调的铁律:一个机器人,一项工作
三天里,几乎每个人都独立讲到同一句:不要一个万能助手,要一张狭窄专精的角色表。
为什么?
-
每个机器人有自己的上下文上限。通用助手同时扛四件无关事,会先忘事。 -
人脑记不住小说,但记得住该找谁——角色名就是索引。 -
工作够窄,反馈才有意义,模型才学得进。 -
五个专家并行,再回来汇总,就是人类开会的分头讨论再综合。
好角色描述至少写清五件事:单一负责领域、可用工具与数据源、怎么干活、什么事必须先问你、有没有周期任务。
命名也不是装饰。有名字的机器人会收到委派;比如竞品监测、产品开发。
同时警惕机器人泛滥:新建很便宜、很好玩,所以才危险。直播里跑最大角色表的人反而喊得最响——先问要不要给现有专家加一项技能,再问要不要新招。
03
PART
验证没建好,就别谈放手
如果你只带走一条建设指令,带走这个:验证就是一切。
Lauren 说得很硬:机器人要真去跑代码、截图;你才会相信它理解了问题。
他们的三条铁律可直接挪到出海运营:
复现才能修
写改动前先启动应用、找到确切行为。
证据进交付物
UI 变更附截图或视频,后端附指标——别让你自己点点看成为默认收尾。
把验证做成可点名的技能
比如固定叫 /verify …,自动驾驶流程里不可省略。
没有验证回路的失败模式很眼熟:机器人说「好了,你来跑一下告诉我有没有问题」。来回折腾,时间就在这里烧掉。
Eric 的启发式也实用:先找工作流里可验证的循环,再在那种循环里放开手脚。没有机器可读信号的环节,先别给自主权。
04
PART
钱是怎么漏的:四个真实漏洞
计费按消耗:你跟机器人说话要钱,机器人自己点电脑也要钱。直播里报过的量级包括:做完整销售案例研究幻灯片大约 $20–30 美元(约等于四到五小时体力活);中等复杂度客服工单端到端大约 $1–2。
四个泄露点,按杀伤力排序:
流程太勤
三条每十五分钟跑一次的流程,一天就是几百条消息。
有 API 却硬用浏览器自动化
更慢、更贵。能接连接器就用连接器。
群聊当日常工位
机器人互相插话,账单飙升。日常一对一,群聊留给决策。
机器人过多
多一个就多重建上下文、多流程、多重叠。
可调杠杆包括:让机器人少啰嗦、忘掉不再需要的上下文、甚至养一个专门审计其他机器人流程的成本 Bot。
05
PART
72 小时案例里,人还在做什么
游戏《Thursday Arena》第三天上午十点上线。过夜期间落了约 170 个 PR;收工时约 6,000 场公开比赛、约 2,000 用户量级。
但回顾时,团队最清醒的几句反而泼冷水:
-
分发渠道决定成败。流量几乎来自直播本身,产品好不好看不是主因。 -
共识比建东西更难。第一天四次转型、零产品。 -
克制是新技能。你现在完全可以构建任何东西,所以究竟哪些产品是值得被开发的? -
发现仍要真人。先有机地发现问题,再固化成机器人与流程。
直播结尾时的话很扎心:
「做任何事最难的部分——即使有无限制的 AI 能力——是让人真的关心 people care。」
AI 真正擅长的:补知识盲区、扛重复验证、在短项目里持有超脑容量的上下文、把口述立刻落成可排序事项。
仍由人类拍板的:值不值得做、对功能说不;察觉还不够有趣、信任与模糊判断等。
06
PART
出海团队可抄的「第一周」清单
-
先连每日技术栈,再招第一个机器人。 -
录 10–15 分钟每日工作的语音备忘录,让机器人反向提取系统架构。 -
挑一天中最烦人的部分当第一单。 -
定义清晰的狭窄专家 + 只读起步,审批规则提前写好。 -
跟人一起手动做一次,再沉淀成技能。 -
第二个机器人之前,先搭验证回路。
不该做:别因为好玩就建机器人。
写在最后
如果你正在带一支出海小队,同时又对 Grok Bot 保持好奇:
今晚列出「最烦人、最可验证」的三件事,各自对应一个很精确的角色名,和我们招一位职责明确且细分的人类员工一样——而不是再开一个全能助理。
下面附赠直播指南全文(见附件完整稿文末)。
P.S. 用了两天用量消耗完之后,发现Grok Bot居然能用支付宝支付,这对于最近被Claud/ChatGPT封号和充值困扰的AI难民来说简直是最大红利。
如果你觉得今天这篇有收获,欢迎点赞、在看、转发三连,我们下篇见
THANKS FOR READING

