
8 月 12 日,xAI 发布 Grok 4.6。按官方公告的说法,这一版在 Grok 4.5 的基础上把重点放在两处:一是长时运行的智能体——在跨越很多步骤的任务里保持工作连贯,并在更长的任务中做更多自我测试与验证;二是视觉与交互类项目,首轮产出的完成度更高。
公告列出的几项成绩包括:AA Intelligence Index 61 分,CursorBench v3.2 69.9%,DeepSWE v1.1 65.9%,FrontierCode v1.1 61.3%,APEX-Agents 57.5%,Terminal-Bench v3.0 26%。
价格没有变化:API 输入 2 美元、输出 6 美元/百万 Tokens,Fast 版本为两倍价格。Cursor 与 Grok Build 即日可用,API 通过 console.x.ai 提供,OpenRouter、Vercel 与 Cloudflare 同步接入。8 月 10 日以来 Meta、英伟达接连发布开源模型,「长时运行智能体」是这一批发布共同强调的方向。



