发布日期:2026-08-14 | 数据来源:xAI 官网、xAI Grok 4.5 发布公告| 话题:Grok Bots · xAI · AI Agent · 云电脑

Grok Bots 是 xAI 于 2026 年 8 月 11 日正式推出的 AI Agent 产品(早期测试版),由 xAI 与 Cursor 联合构建,定位为"全天候在线的 AI 队友"——每个 Bot 拥有一台独占的持久化云端 Linux 虚拟机(含浏览器、文件系统、终端),能直接登录并操作用户的邮箱、CRM、SaaS 工具,无论是否有开放 API,均以计算机操作方式完成;Bot 7×24 小时运行,合上笔记本后任务照跑,只在需要人工审批的节点才返回通知;多个 Bot 可协同工作,首席 Bot 统筹、专项 Bot 并行,互发消息和传递任务所有权;底层模型为 Grok 4.5(SWE Marathon 29.0% 全球第一、Token 效率是主要竞品的 4 倍以上);访问入口为 SuperGrok Heavy(约 $300/月)、Cursor Ultra 或 Cursor Teams Premium($120/席位/月)订阅,企业版开放候补名单;这是 xAI 以 600 亿美元收购 Cursor 母公司 Anysphere 后推出的首款联合产品,发布帖 24 小时获得 900 万次浏览。


Grok Bots 是什么:不是聊天机器人,是干活的虚拟同事

Grok Bots 的核心区别在于它拥有自己的电脑。

常规 AI 助手(包括 ChatGPT、Claude)的工作方式是:你提问 → 它回答 → 你来执行。Grok Bots 的工作方式是:你分配任务 → Bot 登录你的工具 → Bot 把做完的结果交还给你。

每个 Bot 的"配置清单":

  • 一台 7×24 小时在线的 Linux 虚拟机(独占,不与他人共享)

  • VM 内含完整浏览器、文件系统、终端

  • 跨任务持久记忆(浏览器会话、文件、操作偏好)

  • 能直接操作任何网站或应用,无论对方是否提供 API

官方 tagline 是:"They have their own computer, use it like you do, and never log off."(它们有自己的电脑,像你一样使用,永不下线。)


核心能力:无 API 操作 + 异步汇报 + 工作流学习

无 API 直接操作

Grok Bots 通过 Computer Use 方式操作界面——就像真人用鼠标键盘操作一样。这意味着不开放 API 的平台(老旧内网系统、某些 SaaS 后台)也可以被 Bot 操作,无需等待对方提供 API 接入。

异步任务,仅审批时回头

Bot 启动后在后台独立运行。用户可以关电脑、睡觉,Bot 继续执行。只有在遇到"需要人工决策"的节点(如批准付款、确认发送重要邮件)时,Bot 才推送通知请求审批。

工作流学习与复用

演示一次操作流程,Bot 记录并保存为可重复执行的"例程"——下次相同任务直接调用,不需要重新描述步骤。

典型场景举例

场景

Bot 的做法

邮件处理

登录收件箱,按规则分类、回复标准问题、标记待办

销售跟进

查找线索 → 更新 CRM → 准备拜访资料

报销流程

下载发票 → 填写报销表 → 提交审批入口

Bug 修复

读取报错日志 → 定位代码 → 提交修复 PR

实测用户 Bennett(销售团队)反馈:"效率提升了 2 到 3 倍,因为它不需要我反复确认和审查。"


多 Bot 协作:AI 微型组织

Grok Bots 不只是一个 Agent,而是一支可以自行分工协作的团队。

架构模式:

  • 首席 Bot(Orchestrator):接收用户任务,分解步骤,分派给专项 Bot

  • 专项 Bot:并行执行各自负责的子任务(信息收集、数据分析、输出整合)

  • Bot 间通信:互发消息、共享上下文、传递任务所有权,无需用户中转

这种架构的实际意义在于:并行——当一个 Bot 在爬竞品数据时,另一个 Bot 可以同步整理上周会议纪要,两件事同时推进。

Grok 4.5 底层本身内置 4-Agent 系统(研究/逻辑/创意/协调),多步骤任务中交叉验证、相互制衡。


底层模型:Grok 4.5

Grok Bots 由 Grok 4.5(2026 年 7 月 16 日发布)驱动,xAI 与 Cursor 联合训练,侧重多步骤软件工程和 Agent 任务。

基准测试数据:

测试集

Grok 4.5

Fable (max)

GPT-5.5 (xhigh)

Claude Opus 4.8 (max)

SWE Marathon(pass@1)

29.0%

24.0%

26.0%

SWE Bench Pro

64.7%

80.4%

58.6%

69.2%

DeepSWE 1.0

62.0%

66.1%

64.3%

55.75%

Terminal Bench 2.1

83.3%

84.3%

83.4%

78.9%

Token 效率(SWE Bench Pro 平均输出 token):

模型

平均输出 tokens

Grok 4.5

15,954

Claude Opus 4.8

67,020

完成相同任务,Grok 4.5 输出约为 Opus 4.8 的 1/4,xAI 称"单位时间和成本下的最高智能密度"。

API 定价(开发者直接调用):

  • 输入:$2 / 百万 tokens(约 ¥14.4/M)

  • 输出:$6 / 百万 tokens(约 ¥43/M)


怎么访问 Grok Bots

当前处于早期测试阶段,访问入口绑定订阅计划:

订阅方案

月费参考

备注

SuperGrok Heavy

约 $300/月

包含 Grok 4 Heavy 访问权限

Cursor Ultra

参考 Cursor 官网

含 Grok Build 全部功能

Cursor Teams Premium

$120 / 席位 / 月

团队协作场景

企业版

候补名单

联系 xAI 商务

平台支持:Mac、iOS、Windows、Linux 已上线;Android 即将推出。

访问入口:x(grok.com 亦有跳转)m 亦有跳转)


与同类产品的差异

Grok Bots 上线后,市场最常见的问题是:"和 Claude Code / Manus / Computer Use 有什么不一样?"

维度

Grok Bots

Claude Code

Manus / 同类

虚拟机架构

每个 Bot 独占 VM

CLI,本地执行

共享实例为主

持久运行

7×24,离线照跑

会话内持续

会话结束即停

无 API 操作

✅(Computer Use)

❌(需工具接入)

部分支持

多 Agent 协同

✅(首席 + 专项 Bot)

单 Agent 主导

部分支持

编程专精

✅(Cursor 训练数据)

✅(代码编辑为主)

通用

定价模式

包月订阅

按 token 计费

混合

独占 VM 的代价:算力空转(Bot 不执行任务时 VM 仍在运行),这是包月模式的根本原因——xAI 把算力计价从"token 脉冲"改成了"VM 月租"。用户为"确定性"付费——VM 状态完整保留,不受他人负载波动影响。


常见问题

Q:Grok Bots 和 Grok(聊天版)是什么关系?

两者使用同一套底层模型(Grok 4.5),但产品形态完全不同。Grok 聊天版是对话界面,每次会话独立;Grok Bots 是持久化 Agent,有自己的 VM 和跨任务记忆,定位是自主完成工作而非对话交流。

Q:Bot 能访问我的账号,安全吗?

xAI 提供权限策略配置,Bot 只在用户授权的范围内操作,不授权的操作会在执行前向用户请求审批。当前测试阶段建议先在非关键账号和工作区测试,验证 Bot 行为符合预期后再扩展授权范围。

Q:Bot 不执行任务时一直开着虚拟机,费用怎么算?

Grok Bots 采用包月订阅制,虚拟机费用已包含在订阅内,不按实际运行时长或 token 用量单独计费。这也是 xAI 将定价从 token 切换到月租模式的核心逻辑。

Q:我已经在用 Cursor,要升级哪个方案才能用 Grok Bots?

Cursor Ultra 或 Cursor Teams Premium($120/席位/月)均可访问 Grok Bots 测试版。普通 Cursor Pro 方案当前未包含 Grok Bots 访问权限,需升级到 Ultra 或 Teams Premium 档。

Q:Grok Bots 支持哪些 SaaS 工具?

官方列举了 Gmail、Salesforce、Slack 等主流工具,理论上任何 Bot 能通过浏览器操作的界面都支持(无需 API),但各工具的实际操作效果在测试阶段仍在完善中。管理多款大模型 API(如同时评估 Grok 与国产模型)的开发者,可以通过多模型聚合 MaaS 平台(如七牛云 Token Plan,qiniu.com/ai/plan)统一管理不同模型的 API 调用,降低多 Key 管理复杂度。

Q:早期测试版有哪些已知问题?

现阶段部分 SuperGrok Heavy 用户反映账户识别问题(系统无法确认订阅状态,需联系支持),以及 Bot 偶发空循环卡死需手动中断的情况。xAI 预告 Grok 4.6 发布后将扩大测试规模并推进修复。


小结

Grok Bots 的核心赌注是:把 AI Agent 的运行载体从"对话会话"变成"独占虚拟机"——Bot 有自己的电脑、自己的记忆、自己的任务时间表,像真实同事一样异步工作。底层 Grok 4.5 在 SWE Marathon 上以 29.0% 领先,Token 效率约为主要竞品的 4 倍,是这套架构的模型基础。当前处于早期测试,稳定性仍有待完善,但"持久化 VM + 无 API 操作 + 多 Bot 协同"的架构组合,在现有主流 AI Agent 产品中目前是相对独特的组合。

本文信息截至 2026 年 8 月 14 日,以 xAI 官方公告为准,早期测试版功能和定价可能随版本更新变化。


延伸阅读

  • Grok Bots 官方页面:https://x.ai/bot

  • Grok Bots 官方文档:https://docs.x.ai/grok-bot/overview

  • Grok 4.5 发布公告:https://x.ai/news/grok-4-5

  • 七牛云 Token Plan(多模型 API 统一接入):https://qiniu.com/ai/plan