产品Cursor Blog·原文 2026年8月12日本站收录 2026年9月5日

Cursor与SpaceXAI发布Grok 4.6,主打长时程代理任务,性能对标GPT-5.6 Sol

Grok 4.6在Cursor和Grok Build中上线,首周双倍用量,API定价每百万输入token 2美元、输出6美元。

AI解读:Grok 4.6是SpaceXAI与Cursor合作发布的模型,核心变化是面向长时间运行、多步骤的代理任务做了专门训练,比如跨代码库工作、把想法做成可运行的初版应用。它并不是简单的参数升级,而是用了更长的补充训练和更多代理强化学习数据,官方称其在九个基准的合成指数上追平了GPT-5.6 Sol。普通用户最直接的感知是:在Cursor或Grok Build里,本周内可用量翻倍;而开发者若通过API调用,输入每百万token收费2美元、输出6美元,快速版本贵一倍。这条新闻对两类人有意义:一是重度使用AI编程或代理工具的工程师,可以试试它能否在长任务中减少人工干预;二是正在选型的团队,现在多了一个与GPT-5.6同档的备选,但定价并不算便宜。需要说明的是,官方提到的基准表现和自测结果只是厂商单方面说法,实际能力边界还得看社区复现,别急着迁移关键工作流。

Cursor与SpaceXAI于今日发布Grok 4.6,模型定位是长时程代理和更复杂的交互式、可视化工作,官方称其在多个代理编码与知识工作基准上达到前沿水平,并在Artificial Analysis Intelligence Index上追平GPT-5.6 Sol。

发布范围与定价

Grok 4.6即日起在Cursor和Grok Build中可用,同时通过SpaceXAI API以及OpenRouter、Vercel、Cloudflare等合作伙伴提供。定价为每百万输入token 2美元、每百万输出token 6美元,快速版本价格为两倍。官方表示在Cursor和Grok Build中,首周提供2倍包含用量。

训练方法与能力侧重

Cursor的博客文章说明,Grok 4.6比Grok 4.5进行了更长的补充训练,使用经过筛选的模型生成数据用于推理和高级技术概念、高质量的工程数据,并改进了优化器和训练方法。随后的SFT和RL阶段中,团队用Grok 4.5重新生成SFT轨迹,覆盖推理、代理框架、STEM、软件工程和知识工作等领域,并用基于模型的检查过滤有问题的样本。

模型在广泛的代理RL任务上训练,包括知识工作、通用编码,以及内核优化、Web开发、计算机辅助设计等专用环境。官方称,在长轨迹任务上,模型开始出现更多的自我测试和验证行为;相比Grok 4.5,Grok 4.6在视觉和交互项目上能生成更强的首版结果,适合先产出实质性初稿再在循环中迭代的工作流。

安全评估与限制

官方称防护措施已根据模型能力校准,并进行了涵盖能力和安全校准的、迄今为止最广泛的一套部署前测试,以及部署后的第三方测试。但关于第三方的具体身份和测试结果,博客未提供细节。

信息来源

Cursor Blog原始来源