从创建首个持久化智能体到构建可复用工作流系统,系统介绍Grok Bot的任务委托模式。
AI translation, not an official translation. Refer to the original for technical details.
Adapted from @Mikadzyki_NFT# 如何用17步精通Grok Bot 2026年8月11日,埃隆·马斯克旗下的xAI以早期测试版形式推出了Grok Bot。 短短几周内,它便吸引了大量关注。这不仅仅是因为Grok这个名字或其与xAI的关联——整体理念与我们通常使用AI的方式截然不同。 传统方式是每次打开新对话,从头解释任务;而Grok Bot允许你逐步将重复性工作交给持久化智能体来处理。 不只是提问。 而是委托。 正因如此,Grok Bot给人的感觉与其说是又一个AI界面,不如说是一次改变我们在日常工作中使用人工智能方式的尝试。 下面,我们将分18个步骤全面介绍Grok Bot——从创建你的第一个智能体并授予其访问权限,到传授可重复执行的流程,最终将其打造成一套运转有效的系统。 ## 1. 委托而非提示词 使用传统AI时,核心问题往往是: 如何写出完美的提示词? 使用Grok Bot时,问题变成了: 我究竟想委托什么、智能体需要哪些信息、它的权限边界在哪里? 这与向员工分配工作更为接近,而不是在写提示词。 一个好的任务描述应当回答以下几个问题: - 需要交付什么结果 - 机器人应从哪里获取信息 - 哪些事情不能自行决定 - 结果应采用什么格式 - 何时应停下来请求审批 例如,不要这样写: 检查我们的数据分析。 而应这样写: 将本周新用户激活情况与前四周进行对比。找出最大变化,附上相关图表链接,并准备一份简短的调查计划。不要对仪表板做任何修改。 差别看似不大,但现在机器人既明白要做什么,也明白"完成"究竟意味着什么。 ## 2. 机器人作为持久化角色 当每个机器人负责一个特定职责领域时,Grok Bot的效果最佳。 xAI官方文档给出的示例包括:人才挖掘助手(Talent Scout)、费用管理助手(Expense Manager)和缺陷复现助手(Bug Reproduction)。通用型"万能助手"往往用处不大,因为它没有明确的职责,积累的上下文也难以复用。 当某项工作具备以下特征时,设立独立机器人才有意义: - 有独立的目标 - 有独立的信息来源和工具 - 有不同的工作风格 - 有独立的审批边界 - 有重复性任务 例如,收件箱管理机器人可以专注于处理收到的消息:阅读、分类、摘要,以及准备回复草稿。 研究机器人可以专注于查找和核实信息。 角色描述最适合用于设定永久规则: 未经审批,不得向客户发送任何消息。 对话本身则应包含当前任务: 今天为这12位客户准备回复草稿。 区别很简单:配置文件存储永久规则,消息包含当前工作内容。 ## 3. 设置与创建第一个机器人 Grok Bot支持macOS、Windows和iPhone。目前不支持Linux桌面端、Android和iPad。 访问权限扩大后,Grok Bot可通过以下渠道使用: - SuperGrok - SuperGrok Plus - SuperGrok Heavy - Cursor Pro - Cursor Pro+ - Cursor Ultra - Cursor Teams Standard - Cursor Teams Premium 安装应用后,使用你的Cursor账号登录。 你可以通过以下方式创建第一个机器人: New -> Create new agent 或: Cmd/Ctrl+N 然后为其命名,设定主要职责,并描述它应当如何工作。 不要从银行账户或复杂的自动化流程开始。 你的第一个任务应该尽可能安全。例如,附上一份文档,让机器人: - 创建简短摘要 - 提取所有重要日期 - 列出已做出的决策 - 识别未解决的问题 - 为重要结论提供来源 这样可以让你在连接真实服务之前,先测试机器人执行指令的效果。 ## 4. 持久化云端计算机 Grok Bot 最重要的功能之一是其持久化云端计算机。 它拥有浏览器、文件系统、终端以及已连接的应用程序。这意味着机器人不仅能解释你应该做什么——它还能直接打开网站、查找信息、下载文件,或在某个服务内部直接执行操作。 但有一个重要细节。 你所有的机器人共用同一台计算机。 它们可能拥有不同的角色、对话和积累的上下文,但工作环境是共享的。 这包括: - 文件 - 浏览器会话 - 网站登录状态 - 已连接的工具 如果一个机器人通过浏览器登录了某项服务,同一台计算机上的另一个机器人就有可能使用同一个会话。 因此,独立的机器人不应被视为独立的安全容器。 一个账户最多可以拥有 50 个机器人和群聊的组合。 对于需要在代理之间传递的文件,共享工作区尤为实用。研究机器人可以保存其发现,写作机器人可以立即从相同的材料继续工作,无需手动复制粘贴。 ## 5. 教授任务——演示一次流程 Grok Bot 最有趣的功能之一是"教授任务"。 你无需编写详细描述每一次点击的冗长指令,只需亲自执行一次流程并将其展示给代理即可。 当该功能可用时: 1. 打开与机器人的直接对话 1. 打开其计算机 1. 选择"教授任务" 1. 说明你即将演示的结果 1. 亲自执行该流程 1. 停止录制 1. 审查机器人创建的技能 可见的计算机交互操作最多可录制 10 分钟。麦克风不会被录制。 例如,你可以演示以下工作流程: 打开仪表板 -> 查找指标 -> 与上周对比 -> 将结果保存到文档 -> 准备一条 Slack 消息 演示完成后,机器人会将该流程转换为可复用技能草稿。 "草稿"是这里的关键词。 一次成功的演示并不能教会代理:当网站加载失败、数据缺失或界面发生变化时应该怎么做。 你还应该定义以下情况的处理方式: - 来源不可用 - 所需数据缺失 - 两个来源相互矛盾 - 界面发生变化 - 操作需要人工审批 "教授任务"功能正在逐步推出。如果你尚未获得该功能,仍可以通过书面指令和已完成的任务来创建技能。 ## 6. 技能 技能是一种保存下来的完成任务的方式。 例如,"每周账户健康检查"可以定义数据来源、需要检查哪些指标、最终报告应呈现的格式,以及机器人必须在哪些环节停下来等待审批。 一个良好的技能应该说明: 1. 何时使用它 1. 需要哪些数据和访问权限 1. 步骤顺序 1. 如何验证结果 1. 返回的格式 1. 哪些操作需要审批 这与普通提示词有一个重要区别。 提示词描述的是当下的一个任务。 技能将一个成功的流程转化为可重复使用的程序。 已保存的技能可通过 / 调用,而 @ 可用于附加机器人、群组、例行程序和可用连接器。 ## 7. 无需共享密码即可访问 机器人迟早会访问到需要身份验证的页面。 你无需在普通消息中发送密码。 当 Grok Bot 到达敏感步骤时,你可以打开 Agent Computer,亲自接管并完成所需操作: - 输入密码 - 使用通行密钥 - 完成双重身份验证 - 解决 CAPTCHA - 确认付款或其他仅限人工操作的行为 之后控制权返回机器人,它从同一页面继续执行。 浏览器会话保留在共享计算机上,因此下次运行时可能无需再次登录。 但请记住:该会话属于共享账户环境,而非某个特定机器人。 对于拥有现成集成的服务,你可以使用插件和连接器,而无需通过浏览器控制网站。 连接方式如下: 设置 -> 插件 ## 8. 权限边界 赋予机器人的工具越多,定义其可独立执行哪些操作就越重要。 一种实用的思考方式是将操作分为三类。 绿色 - 可独立完成: - 搜索 - 阅读 - 分析 - 比较 - 计算 - 研究 - 整理信息 - 准备草稿 黄色 - 仅可在预定义范围内完成: - 编辑内部文件 - 创建工件 - 更新已审批的内部数据 - 运行已测试的流程 红色 - 通常需要人工审批: - 发送外部消息 - 公开发布 - 购买或转账 - 删除重要数据 - 更改权限 - 修改生产系统 - 接受法律条款 绿色、黄色和红色并非 Grok Bot 的官方模式,它们只是定义边界的一种实用方式。 Grok Bot 本身支持审批机制。 "需要审批"会强制代理在匹配操作前停止。 "始终允许"则让匹配操作自动运行,除非有其他原因要求机器人停止。 如果规则发生冲突,"需要审批"优先。 逻辑很简单: 一个操作越难撤销,就越没有理由让机器人在没有人工介入的情况下执行它。 IMAGE 3 ## 9. 例行程序——机器人开始自主工作的时候 技能回答的是: 这项任务应该如何完成? 例行程序回答的是: 它应该在什么时候完成? 例如: - 每天早上 8:00 创建工作简报 - 每周五检查客户列表 - 每周准备一份报告 - 在受支持的事件触发后启动流程 对于某些集成,例行程序不仅可以由时间触发,还可以由事件触发,例如收到新消息或通知。 这正是 Grok Bot 开始让人感觉与普通 AI 聊天截然不同的地方。 你不再需要打开对话并重复输入同样的命令,机器人会在正确的时机启动并执行已配置的工作。 例行程序应定义: - 哪个机器人负责该程序 - 计划时间与时区 - 数据来源 - 预期结果 - 审批边界 - 数据源不可用时的处理方式 后台例行程序即使在笔记本电脑关闭时也可继续运行。 一个机器人最多可拥有 50 个例行程序。 每个例行程序,系统会保留最近 20 次运行记录,包括成功和失败的记录。 在启用自动化之前,请务必先测试,尤其是当机器人涉及写入、发送或更改某些内容时。 ## 10. 机器人团队与参谋长 当你拥有不止一个机器人时,最有趣的阶段便开始了。 Grok Bot 允许智能体之间相互传递上下文与任务。你不再需要手动将研究机器人的输出复制到写作机器人,再将完成的草稿移交给审阅机器人。 一个简单的结构可能如下所示: 参谋长 接收总体目标,将其拆解为若干部分,分配工作,并汇总最终结果。 研究 查找信息,核实事实,保存来源。 策略 将研究成果转化为决策或计划。 执行 创建最终交付物:文档、分析报告、文章、表格或其他成果。 审阅者 在成果到达用户之前进行最终检查。 不要在第一天就创建十个智能体。 从最精简的实用团队开始,只有在出现真正需要专属负责人的重复性工作时,才添加专职成员。 群聊 一个群聊最多可容纳 2 至 6 个机器人。 你可以为它们设定一个共同目标,让它们自行分配工作。 也可以使用 @ 来指定某个特定智能体。 机器人之间的高质量交接大致如下: 这是结果。这是来源。这是无法确认的内容。这是下一步的具体行动。 这样,下一个智能体接收到的不仅是一个文件,还有继续工作所需的上下文。 复制机器人 已配置好的机器人可以被复制。 副本保留: - 个人资料 - 设置 - 已启用的技能 - 例程 - 头像 不保留: - 对话历史 - 累积记忆 - 聊天附件 当同一角色需要跨多个项目或工作流使用时,此功能非常实用。 图片 4 ## 11. 说清楚"完成"意味着什么 复杂任务失败,往往不是因为机器人不够智能。 而是因为没有人解释清楚一个完成的结果应该是什么样子。 不好的示例: 每周调研竞争对手。 这留下了太多问题。调研几家竞争对手?什么算重要?机器人应该返回什么? 更好的示例: 每周五,整理竞争对手在产品、定价和市场定位方面最重要的五项变化。每项变化附上来源,说明可能的影响,并给出后续行动建议。不得对外发布任何内容。 对于复杂任务,请明确定义: - 结果 - 来源 - 格式 - 频率 - 完成标准 - 约束条件 - 审批节点 诸如"好"、"高质量"或"专业"之类的词几乎毫无用处。 用可验证的条件来替代它们: - 每条事实都有来源 - 包含发布日期 - 已去除重复内容 - 未经核实的信息有明确标注 - 最终结果符合长度限制 - 对外行动仅在获得批准后执行 如果终点无法被核查,机器人就无法可靠地判断工作何时真正完成。 ## 12. 不要在第一次成功后就自动化 最常见的错误之一,是某次获得了不错的结果,就立刻将该流程变成每日自动化任务。 更稳妥的路径是: 1. 给机器人布置一个真实任务 1. 审查结果 1. 修正流程 1. 将其保存为技能 1. 在不同数据上测试该技能 1. 定义失败情形与重试机制 1. 然后再创建例程 一个糟糕的流程经过自动化之后不会变好。 它只会开始自动产出糟糕的结果。 在自动化之前,请检查: - 如果数据来源不可用,会发生什么 - 如果信息缺失会发生什么 - 工作是否会重复执行 - 审批是否正确触发 - 任务在失败后是否可以安全地重新运行 ## 13. 审查你的自动化流程 一个自动化流程可能完美运行一个月,然后在某一天突然中断。 网站更改了界面。 连接器更改了数据格式。 文档新增了必填字段。 而之前返回完美结果的机器人,突然开始产出不完整的工作。 这就是为什么例程会保留运行历史记录,让你可以检查成功和失败的执行记录、测试流程并修改指令。 每当网站、连接器或数据源格式发生变化后,请重新测试自动化流程。 定期提出以下四个问题是有益的: - 例程是否运行了 - 结果是否正确 - 是否出现了新错误 - 这个自动化流程是否仍然有用 持续的自动化并不意味着无需人工监督的自动化。 ## 14. 实用的 Grok Bot 工作流程 晨间工作简报 参谋长可以检查已批准的信息来源,并返回一份简短报告: - 发生了什么变化 - 哪些事项需要关注 - 哪些决策需要做出 - 哪些任务可以进一步委派 无需在早晨打开多个应用,你只需打开一个对话。 电子邮件 机器人可以读取可访问的邮件,对其进行分类、摘要,并准备草拟回复。 发送操作可以保留在审批环节之后。 调研 调研机器人可以从多个来源收集信息、保存链接,并将已确认的事实与假设区分开来。 销售外联 机器人可以调研客户、找到相关联系人,并准备个性化的外联草稿。 实际发送可以保留给人工完成。 浏览器操作 如果某项服务没有便捷的 API 或连接器,Grok Bot 可以通过其自带的云端浏览器进行操作。 一个反复出现的流程之后可以成为一项技能,再进而成为一个例程。 内容团队 一个简单的结构: 调研 -> 撰写 -> 审核 第一个智能体收集信息和来源。 第二个创建草稿。 第三个检查事实、格式和要求。 重要的不是机器人的数量,而是清晰的职责归属。 IMAGE 5 ## 15. 你应该首先创建哪些角色? 不要从二十个智能体的庞大阵容开始。 选择一个真实存在的、反复占用你时间的问题。 角色示例: - 参谋长 - 人才挖掘专员 - 费用管理员 - 缺陷复现专员 - 销售外联专员 - 客户健康管理员 - 内容编辑 - 数据分析审核员 一个好的问题是: 这项工作是否应该有一个固定的负责人? 如果任务只发生过一次,它可能不需要专属机器人。 如果它每周都会出现,并且使用大致相同的数据来源,那么设立一个专属角色就开始有意义了。 ## 16. Grok Bot 的局限性 现成的基础设施使 Grok Bot 易于上手,但它也带来了一些局限性。 模型选择可能并不总是可用 在大多数工作流程中,Grok Bot 会自动管理模型选择和路由。 根据产品版本和功能可用性,可能会出现默认模型设置,因此不应将缺乏手动模型选择视为所有账户和所有界面版本的绝对限制。 机器人之间并非相互隔离 同一用户的所有机器人运行在同一台共享云端计算机上。 独立的机器人并不是独立的安全容器。 工作在云端环境中进行 浏览器会话、工作文件和已连接的服务都存在于账户的云计算机中。 **"教导任务"功能正在逐步推出** 部分用户可能比其他人晚些收到该功能。 **浏览器工作流可能中断** 如果某个网站更改了其界面,计算机使用工作流可能需要重新测试。 在可用的情况下,优先选择稳定的连接器。 **存在使用限制** Grok Bot 有其自身的使用限制,可用额度取决于订阅方案。 因此,您可以持续委托的工作量,既取决于您的套餐,也取决于您所执行的任务类型。 ## 17. 放手让它运行前的检查清单 在让 Grok Bot 独立工作之前,请确认: - 机器人拥有一个明确的角色 - 任务具有可衡量的结果 - 信息来源已明确定义 - 机器人不得更改的内容已清晰说明 - 外部消息需要审批 - 购买和付款需要审批 - 危险的删除操作需要审批 - 密码和双重验证码不通过普通聊天发送 - 仅连接必要的访问权限 - 您记得该计算机由您的所有机器人共享 - 成功的流程已保存为技能 - 该技能已在其他输入上经过测试 - 已定义失败时的处理方式 - 在自动执行之前已对该流程进行测试 - 在网站或连接器发生更改后,流程已重新测试 一个实用的起步方式是: 读取 → 分析 → 准备 → 审批 → 行动 首先让代理进行读取、分析和准备。 只有在质量变得可预期之后,才应逐步允许其执行会改变外部世界的操作。 ## **官方资源** Grok Bot 仍在快速演进,因此功能、支持的平台、套餐和限制可能随时发生变化。 如需获取最新信息,请查阅 xAI 官方文档。 审批、安全与隐私 https://docs.x.ai/grok-bot/approvals-security-and-privacy 聊天与协作 https://docs.x.ai/grok-bot/chat-and-collaboration 创建和管理机器人 https://docs.x.ai/grok-bot/bots 常见问题解答 https://docs.x.ai/grok-bot/faq 快速入门 https://docs.x.ai/grok-bot/get-started Grok Bot https://docs.x.ai/grok-bot/overview Grok Bot 介绍 https://x.ai/news/introducing-grok-bot 技能与例行任务 https://docs.x.ai/grok-bot/skills-routines-and-automations 使用案例 https://docs.x.ai/grok-bot/use-cases Grok Bot 背后的核心理念,并不是再给你一个与 AI 对话的窗口。 首先,您创建一个持久角色。然后为其配备真实工具。成功的流程成为一项技能。重复性工作成为一项例行任务。随着工作量的增长,专业化的机器人开始相互传递工作。 取代数十个一次性提示的,是您逐渐获得的一支数字团队——拥有持久角色、工作上下文、工具、日程安排和清晰的权限边界。 正是在这里,Grok Bot 开始让人感觉,与其说是另一个聊天机器人,不如说是一种将工作委托给 AI 的全新方式。 如果您希望看到更多关于 AI、智能代理和新技术的文章,请关注 @Mikadzyki_NFT