在远程开发环境里,代码仓库旁边住进了一个不睡觉的同事——你睡觉前丢给它一个任务,醒来它已经把活干完了。这是 xAI 在 Grok 4.6 之后推出的 Grok Bot 想实现的体验:一个可以长期驻留在云端环境中的 AI 助手,在用户的远程开发环境中持续运行,主动完成任务,而不是等用户一条条地下指令。

它和聊天机器人的区别:住下来,而不是随叫随到
Grok Bot 和普通聊天机器人最大的区别是”驻留”两个字:它住在你的云端工作环境里,有持久的上下文记忆,用户不干预也能自己推进任务。给它一个目标,它会自行规划步骤、调用工具、执行操作。
适合它的活儿,是那些需要多步骤、跨时间段的复杂任务——持续监控数据流、定期生成报告、维护代码库的自动化流程。这类任务以前需要人盯着调度系统,现在可以整个托管给一个住在云端的 Agent。
这个方向不止 xAI 在做:Claude Code 有后台任务,OpenAI 的 Codex 有 Cloud 模式,Cursor 也一直在往 Agent 化走。各家都在赌同一个判断——AI 的下一个形态不是”你问我答”,而是”我替你守着”。Grok Bot 的差异点在于底座的上下文能力:以 Grok 4.6 为底座,继承了 500K 上下文窗口和长时程 Agent 优化能力,长时间运行还能保持对任务背景的理解,不会因为上下文溢出丢掉关键信息。
能力底气:61 分,跟 GPT-5.6 Sol 持平
Grok 4.6 在 Artificial Analysis 智能指数中得分 61,与 GPT-5.6 Sol 持平。有这个能力水平打底,Grok Bot 在执行复杂推理和编码任务时才靠得住——常驻式 Agent 最怕的就是”跑得久但质量飘”,底座能力是它敢长期干活的底气。
想用上它,先看清这三个现实
不过目前离”随手可用”还有距离。一是平台范围:目前仅支持 Cursor、Grok Build 等部分平台,不是所有开发环境都能住进去;二是运行时长:虽然支持长时程运行,但具体最长连续运行时间还没公布,能跑多久、跑久了会不会掉链子,都是未知数;三是定价:与 Grok 4.6 API 定价一致,输入 $2/百万 token,输出 $6/百万 token——按量计费意味着”长期驻留”的账单会随运行时间累积,把任务交给它之前,最好先算清楚这笔账。
从 Grok Bot 能看出 xAI 的动向:不满足于只做模型供应商,开始往 AI 应用平台走。把模型能力封装成可以持续运行的 Bot,模型就不只是被调用,而是开始主动干活——这是 Agent 赛道一个明显的方向,也是接下来各家都要抢的位置。对用户来说,常驻式 Agent 的性价比账怎么算、任务边界怎么划,恐怕比”哪个模型更强”更值得先想清楚。