最近,身边不少学文科的朋友也在尝试用Grok Bot 做自己的自动化。 以前打开AI聊天,问一个问题,出一个 答案,整个过程就跑完了。现在的Agent已经能够在我们的驯化下成为赛博牛马,帮我们干累活。 我这次把 Grok Bot 的官方总览、入门页和安全说明逐页对了一遍,又拿两份新手材料交叉检查。最先让我停下来的地方很普通。很多介绍把 Grok Bot 和 Grok、X 上的 @grok、Grok Build 混在一起,后面的教程自然越看越乱。

先把名字认准。

Grok Bot 是一个有名字、能长期保留工作上下文的 Agent。它在账户对应的云电脑里使用浏览器、文件和终端,也能通过 connector 或 MCP 接上其他服务。你给它工作、资料和边界,它会继续往下做,生成文件或操作软件,碰到需要你决定的动作再回来询问。

普通聊天助手更多时候交回一段文字。Grok Bot 面向的是一段能够验收的工作。这个区别会影响你怎样下任务,也会影响你该开放多少权限。

几个相近产品可以这样分:

Grok:

日常对话、问答和内容生成

X 上的

@grok:

X 平台内的 Grok 机器人

Grok Build:

面向终端和代码工作的开源 Agent

Grok Bot:

带持久云电脑、角色和工作流程的 AI 同事产品

图 1 任务经云电脑处理并返回可检查结果

本文只讲 Grok Bot。五步走完以后,你会有一个职责清楚的 Bot,一次可以回到原文检查的任务结果,还会留下一份能够继续修改的工作说明。

下面的账号、系统与界面信息,按 2026 年 9 月 6 日可访问的官方页面整理。产品还在更新,实际安装时请再看一遍 Grok Bot 官方入门页

第一步 确认账号和设备

目前官方入门页列出的可用方案包括 SuperGrok Plus、SuperGrok Heavy、Cursor Pro+、Cursor Ultra,以及 Cursor Teams Standard 或 Premium。Grok Bot 使用 Cursor 账号登录,并要求开启云端数据存储。Legacy Privacy Mode 暂不支持这个产品。

桌面端覆盖 macOS、Windows 和 Linux。Windows 安装包分 x64 和 Arm64,Linux 提供 deb、rpm 和 AppImage。官方 FAQ 还列出了 iOS 18 及以上版本和 Android 9 及以上版本,iPad 在初始发布阶段没有适配。

先去 官方下载页 选对安装包。装好后点 Get started,浏览器会打开 Cursor 登录页面。首次启动时,应用会在后台准备云电脑,并询问你常用哪些工具。这一步只用来给出初始建议,不会直接替你连接账号。

做到这里先停一下。你应该已经能进入应用,看到创建 Bot 的入口,云电脑也准备好了。邮箱、公司系统和付款账户先别接,第一轮练习用不到它们。

第二步 给第一个 Bot 一份窄工作

创建 Bot 时要填短名字、主职和工作方式。这三项写得越具体,后面越容易判断它该看什么,做到哪里应该停。

“万能助手”很难用。它今天整理文档,明天发邮件,后天还要改生产数据,保存下来的上下文会越来越杂,权限也很难照看。

第一个 Bot 适合做重复、容易检查、出错以后方便恢复的工作。整理一份文档就很好。材料在手边,输出能逐条回查,也不需要登录外部网站。

图 2 用职责和边界限定第一个 Bot

下面这份说明可以直接改:

名称 = 资料整理员 职责 = 阅读我提供的文档,提取日期、决定和待办事项 工作方式 = 每项结论保留来源位置,无法确认的内容单独列出 交付 = 一页摘要和一张待办表 边界 = 不修改原文件,不发送消息,不删除内容

这五行已经把责任、资料、交付物和禁区放在一起。官方文档允许一个账号创建多个 Bot,新手没必要一上来凑队伍。先让一个 Bot 把一份文档整理明白。以后出现稳定的新职责,再单独创建第二个。

第三步 写一条能验收的任务

Bot 的个人说明保存长期规则,当前消息安排眼前这件事。官方入门页给任务列出五个组成部分,分别是结果、来源、限制、交付物和检查点。

缺少来源,Bot 可能把旧记忆混进来。没有检查点,它也不知道何时该停。交付格式含糊时,你常常会拿到一段看着顺、却没法直接使用的回答。

图 3 首条任务的五个组成部分

第一条任务可以完全避开网站登录。拖进一份普通文档,再把下面这段发出去:

请阅读我上传的文档。 结果 用五条要点说明文档讲了什么。 来源 只使用这份文档,每条结论标明页码或小节。 限制 不要修改源文件,不补写文档里没有的信息。 交付 先给五条摘要,再列出所有日期、决定和未解决问题。 检查点 发现内容冲突或文件缺页时停下来问我。完成以上内容后停止。

这项练习花不了多久,验收却很扎实。把摘要逐条放回原文,看日期有没有抄错,结论能不能找到对应位置,推测有没有混进事实。

第一轮只让 Bot 读取和整理。第二轮可以让它准备草稿。发送、发布、删除和付款留在人工审批后面,等你摸清它处理例外的方式,再考虑开放可逆的执行动作。

第四步 只接当前任务需要的工具

Grok Bot 能操作网页,也能使用 connector 或 MCP。连接一个工具以前,先看当前任务是否真的需要它。

整理上传的文档,文件本身已经够用。做公开资料研究,浏览器通常可以完成。邮箱预审需要邮箱连接,安排会议才用得到日历。工具少一点,你要管理的登录状态和数据范围也会少一点。

网站需要登录时,打开 Agent Computer 并接管控制权。密码、双重验证码和 CAPTCHA 由你自己输入,完成后再把电脑交还给 Bot。一次性验证码不要发进普通聊天。

Bot 的描述里还要写审批边界。对外发信、公开发布、购买、删除、改权限和改生产系统,都适合在执行前停下来。官方的 Auto Review 可以保存 Require Approval 或 Always Allow 规则,范围要落到具体动作和目标,别写成“浏览器全部放行”。

图 4 多个 Bot 共用云电脑并保留审批门

还有一条安全信息很容易被忽略。同一账号下的所有 Bot 共用一台云电脑,文件、浏览器会话和登录状态彼此可见。Bot 名字分开了,电脑并没有随之分开。某项服务不再使用时,应当退出登录,或者回到原服务撤销授权。

第五步 复盘一轮再安排自动运行

第一轮结束以后,先别急着创建 Routine。打开源文件检查事实,再打开 Bot 生成的文件看格式。它是否选中了当前版本,重要结论有没有来源,碰到高影响动作时有没有停下来,这些都能从结果里查。

可以用这张表做第一次复盘。

修改以后再跑一次。别只补一句“下次认真点”。Bot 总把旧数据写进日报,就把数据窗口和权威来源写明。它总在结尾补无依据的建议,就让它把事实、推测和待确认事项分开。

任务手动跑稳以后,可以把做法保存为 Skill。Skill 记录怎样完成一类工作,Routine 交代由哪个 Bot 在什么时间运行。官方建议的顺序很清楚,先完成一次真实任务,随后保存 Skill,最后再设置 Routine。

创建 Routine 时补齐时区、输入窗口和失败处理。然后点 Test run。测试会真实读取文件、打开网站或调用连接的工具,写操作仍要留在审批之后。检查通过,定时运行才算准备好。

四个常见失误

其中最危险的往往是最后一项。Grok Bot 可以生成文件、访问网页和执行动作,一份顺畅的回答只能说明文字通顺,不能证明工作已经完成。

十分钟上手速查

今天做到第三步已经够了。选一份没有敏感信息的文档,创建“资料整理员”,跑完上面的任务,再亲手核对五条摘要。等它能稳定交出一份可靠结果,再去连接更多工具。