众力资讯网

别再让你的 AI 和你抢鼠标了。Cursor 第 15 号员工、Grokbot

别再让你的 AI 和你抢鼠标了。

Cursor 第 15 号员工、Grokbot 产品负责人 Roman Ugarte,最近在访谈里说了一句很扎的话:「你不该让这些聪明的新同事永远和你共用同一台电脑。」

我第一次听到这句话,愣了几秒。因为我们所有人的用法,还真是这样:你在电脑前干活,旁边开一个聊天窗口,AI 等你提问,等你贴上下文,等你点确认。它不是同事,它是一个一直探头看你屏幕、随时打断你的实习生。

Roman 的团队只用一个月,就从第一行代码做出了 Grokbot 的内部原型。公开测试三周后,Lenny Rachitsky 在节目里说,他已经建了十五个 bot,每天调用上百次,把不少原来交给其他 AI 工具的任务都迁了过来。

但真正值得拆的,不是「一个月」这个速度。

是他们换掉了一个基本单位。

一、别把旧产品加个标签页

Cursor 本来就有很强的编码 Agent。最省事的做法,是在原产品里加个标签页:代码在这边,知识工作在那边。

他们没这么干。另起炉灶,每个像素重新决定。

为什么?Roman 说,非技术用户面对编码工具会感到压迫,品牌认知也会限制使用场景。更关键的是,多个形态挤在同一块屏幕上,用户看到的往往不是一致的工作方式,而是一张被硬塞过来的组织架构图。

旧产品的单位是一次对话、一次任务。Grokbot 的单位,是一个有名字、有职责、会持续记住上下文的 bot。

单位不变,加再多 Agent 入口,得到的只是更复杂的旧产品。

二、给每个 bot 一台电脑

第二个决策更狠:每个 bot 拥有自己的电脑,跑在云上。

不是一组 API,不是几个插件连接,是一台真的电脑。原因很朴素:大量真实工作没有好用的 API。人会打开网页、点按钮、在输入框里打字,Agent 也需要这套最基础的能力。

你在手机上发起任务,bot 在云上自己跑。你第二天从任何设备回来看结果。它不依赖你家里那台电脑开没开机。

Roman 还讲了一个 QA bot 的例子:把 Grokbot 装进 Grokbot 自己的电脑里,让它反复跑十个固定测试流程,把结果写进 Notion,和历史版本对比。套娃听着像玩笑,但边界已经变了,测试和监控,成了它自己的长期工作。

三、人不想看 AI 的每一次点击

原型上线前,团队陪两三百位早期用户上手。有人等二十分钟云端电脑没启动,有人卡在引导页不知道下一步。团队坐在通话里看完,要求第二天不能重复同样的错。

换来了几条判断,我每一条都认同。

第一,用户会自然给 bot 分工。内部用户常常建五到十个 bot,每个管一条工作泳道。两周后,有人把表现最好的 bot「晋升」为总管,只跟它说话,让它分发任务给其他 bot。团队没教,外部用户也长出了一样的用法。

第二,没人想读 Agent 滚动的推理文本。Grokbot 藏掉了工具调用和每一次点击,只显示它在工作,按需给进度。有人想看待办清单,几乎没人想看思考过程。

第三,也是我在节目里印象最深的一句,Roman 自己说的:「Agent 做完百分之百,和做到百分之九十,是两种产品。」

百分之九十的活,最后百分之十会全部推回你手里:检查、修补、重新解释。那不叫委派,叫换了个方式自己干。

落到我身上,这几条我都在踩。

做 Token.Step 的时候,我抱着电脑盯了三天,手动一轮一轮跑,累得要死。后来切成 Goal 模式,晚上睡觉前让它开始运行,早上起来验收就行了。那一刻我突然意识到,这不是提示词问题,是管理问题。提示词是教它一句话,管理是给它一个位置、一个目标、一套验收标准。

前段时间招人,卡了半年。我一度以为缺的是能帮我做内容的人,后来想明白了,我缺的是能让我安心做内容的人。所以现在我手边也是一小队 bot,筛选、写稿、生图、分发,各管一条泳道。先给每个座位独立的位置,再谈分工。

你明天能做什么?三条。

一,给一个 Agent 独立座位。别让它跟你挤在同一块桌面,找个能自己跑的环境,把一个完整任务整个丢给它。

二,只看进度和结果。别盯它的每一步点击,那是旧工具的用法。你要的是结果能直接用,不是过程好看。

三,活必须交到能直接用。做不到百分之百,就回来改边界和验收标准,而不是你自己上手补完。记住,AI 替代的是手,不是脑子。

Roman 的团队还有一句话我很喜欢:先把手里的模型当同事,再问一个同事在此刻应该怎样工作。

产品是这样,用人是这样,你自己用 AI,也是这样。

别让聪明同事永远坐在你旁边抢鼠标。给它一台电脑,给它一个目标,然后你去睡觉,早上去验收。

这不是提示词问题,是管理问题。从来都不是。