Grok 4.6 正式发布:强化长程 Agent 与编程能力,全面冲刺 AI 第一梯队
xAI 正式推出了全新的 Grok 4.6 模型。相比于 Grok 4.5,本次更新并非简单的常规迭代,而是将重心转向复杂的长程 Agent 任务、软件工程(Coding)以及深度知识工作(Knowledge Work)。
根据 Artificial Analysis Intelligence Index 的测试数据,Grok 4.6 的综合得分已追平 GPT-5.6 Sol,正式跨入顶级 AI 模型梯队。
核心升级亮点
- 强化长程 Agent 能力:引入大量的 Agentic RL(强化学习)任务训练,覆盖知识工作、通用编程、内核优化、Web 开发等专业场景。模型能够独立拆解复杂目标,执行多步骤的长流程交互。
- 软件工程与 Terminal 表现出色:
- 在 DeepSWE v1.1 软件工程测试中,Grok 4.6 在 High Thinking Effort 下取得 65.9% 的成绩,在 XHigh 状态下达到 67.0%。
- 在 Terminal-Bench 3.0 真实终端环境测试中,任务成功率升至 26.0%。
- 知识工作(Knowledge Work)评估提升:
- GDPVal-AA 测试得分达到 1753 Elo。
- AA-Briefcase 长周期专业知识工作测试得分达到 1577 Elo。
- 支持 500K 超长上下文:提供最高 500K Token 的上下文窗口,大幅提升多文件分析、运行日志排查及跨代码库调优时的信息留存能力。
体验与安装指南
xAI 官方已开放命令行 CLI 工具供免费体验,不同操作系统的快速安装指令如下:
Windows PowerShell
1 | irm https://x.ai/cli/install.ps1 | iex |
Linux / macOS / WSL
1 | curl -fsSL https://x.ai/cli/install.sh | bash |
生态对接与集成
目前 Grok 4.6 已接入多个主流开发平台与云服务:
- 开发工具集成:已上线 Grok Build 和 Cursor(提供首周额外额度),并同步登录 GitHub Copilot,支持在 VS Code、Copilot CLI 及云端 Agent 环境中使用。
- API 与云端部署:官方 API 已提供
grok-4.6模型接口,同时该模型也已同步登陆 Amazon Bedrock,支持 500K 上下文及自定义 reasoning effort 配置。
本博客所有文章除特别声明外,均采用 CC BY-NC-SA 4.0 许可协议。转载请注明来源 极客的赛博空间 | 专注 AI 与技术分享!
评论








