本文作者:meng shao(@shao__meng)。版权归作者所有,未经授权禁止转载。
How we built Grok Bot in a month
Lenny's Podcast × Roman Ugarte「我们如何在一个月内造出 Grok Bot」,一份「AI 时代高速产品方法论」的完整复盘:一支从大公司里隔离出来的小团队,用 4 周写出原型、3 周内测、再 3 周后面向全球发布,产品上线不到一个月已有数百万个 Bot 在为用户干活。Lenny 与 Roman Ugarte(Grok Bot 产品负责人、Cursor 前 15 号员工)在 80 多分钟深度访谈中,讲清了这套打法背后的每一个关键决策。
背景速览
- 发布者:Lenny Rachitsky,硅谷最有影响力的产品类播客主持人,“每天用 100 次 Grok Bot”、把原本在 OpenAI Codex/Cowork 上的工作流全部迁移了过来
- 受访者:Roman Ugarte — Cursor 第 15 号员工,做 Growth 两年,亲历 Cursor 从 15 人扩张到 1000+ 人直到被 SpaceX 收购,随后内部孵化 Grok Bot 并负责产品
- 产品:Grok Bot,SpaceXAI 旗下的“知识工作 Agent”——你创建一组有名字、有持久记忆、各自拥有云端电脑的 AI 同事,向它们派活并等它交付
时间线(极限产品研发效率)
| 阶段 | 耗时 | | 第一行代码 → 可用的内部原型 | 约 4 周 | | 内部全公司推广 → 公开发布 | 约 3 周 | | 发布至录制本期节目 | 约 3 周 |
起点是“完全的白纸”:几个人搬进办公室一个隔开的角落、开私有 Slack 频道、“进洞闭关”一个月,唯一目标是为非工程师做出知识工作 Agent。Roman 事后总结:这在小团队+完全隔离的条件下才可能实现——每天要做大量不明显的微观决策,如果团队更大、规划周期是 6-12 个月,他们永远到不了最终的形态。
五个核心话题的实质内容
1. 为什么从零开始,而不是放进 Cursor?
这个决定当时丝毫不明确、内部争论很大。放进 Cursor 的路径存在三个问题:
- 纸割伤(paper cuts):编程工具做非编程任务总是别扭,界面对非技术用户有威慑力,品牌联想也错位
- 反面教材:竞品把所有形态塞进同一个界面、加几个标签页——用户能感觉到那是“三套愿景共享一块屏幕”,本质是在“发布自己的组织架构图”
- 干净的白纸:从零构建意味着可以控制体验的每一个像素,为知识工作这个新受众做对每一个决策
Roman 的补充判断很清醒:这些想法并非天才独创(OpenClaw 等已验证了产品市场契合),真正的难点在于——身处旧范式、背负沉没成本的公司,很难痛苦地另起炉灶。
2. 两个“当时不觉得显然”的关键赌注
赌注一:一切皆云端。 用户永远不该思考“这跑在本地还是云上、我的电脑得开着吗、手机发起的任务要不要连接到家里的机器”。Bot 是独立实体,随时随地可发起、可调用。
赌注二:每个 Bot 有自己的一台电脑。 人类并不是通过 MCP 和 API 干活的——我们用电脑、点像素、填输入框。很多真实工具(销售用的部分系统)没有好用的 API,只有给它电脑才能跑通。Roman 的类比极精彩:“如果新同事入职第一天,你说‘你没有自己的笔记本,永远坐我旁边跟我共用一台、互相挡道、共享彼此的密码’——这不是正常人接纳同事的方式。可我们现在就是这样对待 AI 的。”
3. 手动 Onboarding 前两三百名用户(约两周)
核心团队亲自上 20 分钟一通的 onboarding 电话,包括 Roman 本人。这样做的价值:
- 痛感即优先级:电脑转不起来、用户一脸困惑的每一分钟,都直接变成“这件事明天必须修好,因为明天我还要 onboard 下一个人”
- 刻意不引导:内部流行“把表现最好的助理 Bot 晋升为幕僚长(chief of staff)、由它调度其他 Bot”的玩法,但团队在 onboarding 时故意不教,想验证外部用户会不会自己长出这个模式——结果很多人真的长出来了,才敢在产品里顺势强化
- 跳出硅谷泡沫:早期用户里有一位咖啡店老板,成了最活跃的 power user 和最丰富的反馈来源(Shopify 集成、商品文案等),验证了“这个产品最强的地方可能在非开发者身上”
4. 发布前的几周在干嘛?——Unshipping(下架功能)
这是全场最反直觉的一段:发布前他们做的事是大量删掉已经做出来的功能——把暴露模型内部思考、记忆内容等调试用的可见性工具全部砍掉。
背后的两条原则:
- “Grok Bot 现在可以……”(can now),不是“Grok Bot 现在有了……”(now has):前者的答案是能力,后者的答案是按钮、下拉框、集成入口。很多功能其实是“不需要像素的能力”,应该让 Bot 在幕后替你操作
- 具体案例:竞品的自动化流程是“侧栏 → 加号 → 选触发器 → 选动作”;Grok Bot 里 99% 的自动化是直接对 Bot 说“每天早上 8 点提醒我”,然后它就照做——你永远看不到那个配置界面
- Lenny 的点评很专业:AI 很擅长告诉你加什么,很不擅长告诉你减什么——判断“不做什么/砍什么”是人类持续重要的空间
5. 「Colleague-pilled」产品哲学
产品争论陷入僵局时的万能解法:跳出来问“一个人类同事在这种情况下会怎么做?” 答案往往立刻清晰且全票一致。这条线索贯穿全场:
- 不展示工具调用和思维链,就像你不会要求同事汇报每一秒点了哪些按钮
- 长期记忆 + 按工作泳道设“角色”,而不是每个任务开一个新聊天框
- 100% vs 90%:一个只做到 90% 的 AI 意味着你还在脑子里挂着这件事、随时准备介入——那是“你仍然在做这件事”;只有 100% 的交付才是真正的“不看人传球”(no look pass),才是质变
- 下一步方向:Bot 应该比你更主动——监控你的 Slack/邮件/X 全量信息流、每日简报、真有急事时甚至会打电话寻呼你
用户最实用的一条:第一个 Prompt 该试什么
Roman 拒绝给“hack 技巧”(“那些东西本不该存在”)。新用户的正确打开方式:
接入 Slack 和邮箱等工具后,直接说:“翻一遍我的 Slack 和邮箱,建议五件你能从我盘子里拿走的事,以及你需要什么才能做到。” 然后把其中靠谱的两件各交给一个新 Bot。
这正是 Roman 自己的“wow 时刻”——它不是“帮我草拟一封邮件”,而是一次交付一整块工作。进阶用法:让多个 Bot 的产出写入一个统一、人类可读的存储,每天读它的摘要。
给创始人和产品人的深层启示
- 护城河是发现的,不是规划的:Cursor 活在世上最惨烈的赛道(正面硬刚 OpenAI/Anthropic),当年的十几个竞品如今掉队,不是因为决策错误或资源不足,而是文化上无法快速转身。“每 6 个月彻底自我重塑一次,做不到就输”
- 两条公司价值观:"deleting the product"(因为模型变强,为弥补模型不足而搭的脚手架功能就该被删掉)和 "just do the thing"(不请示文化——看到该做的事就直接去做、自己拉资源)
- GTM 判断:复制编程工具的扩散路径——先行者在个人场景体验到“回不去了”的加速感,然后回到工作中倒逼公司采用;当前重点是让 Bot 进入团队、进入企业复杂系统
- SpaceXAI 三大支柱:编程(Cursor/Grok Build)、通用知识工作(Grok Bot)、模型研发——且明确表态目标是“有用的 AI”而非追逐某种模糊的超智能叙事