众力资讯网

【SpaceXAI 推出 Grok 4.6,声称其智能水平达到 GPT-5.6

【SpaceXAI 推出 Grok 4.6,声称其智能水平达到 GPT-5.6 Sol 和 Claude Fable 5 Max】

从最近收购 Cursor 到发布 Grok Bot Agent,SpaceXAI 正越来越重视其模型。今日发布的 Grok 4.6 版本在此基础上更进一步,SpaceXAI 声称其智能水平可与 OpenAI 的 GPT-5.6 Sol 和 Anthropic 的 Claude Fable 5 相媲美。

根据 SpaceXAI 的新闻稿,Grok 4.6 在 Grok 4.5 的基础上进行了改进,特别注重长期运行的代理、编码、知识工作以及更具雄心的交互式和视觉化工作。它能够处理多步骤的复杂任务,无论是研究主题、分析信息、跨代码库工作,还是将想法转化为完善的 App 或作品。

在 AI 分析智能指数中,Grok 4.6 的得分为 61 分。这与 GPT-5.6 Sol 的最高推理水平相当,仅比 Fable 5 Max 低 1 分。

在所有的评估中,包括 CursorBench、FrontierCode、APEX-Agents 和 Terminal-Bench,SpaceXAI 都比 Grok 4.5 显著提升。

SpaceXAI 表示,与 Grok 4.5 相比,Grok 4.6 进行了更长时间的补充训练,使用了经过筛选的模型生成数据(用于推理和高级技术概念)、更高质量的工程数据,以及改进的优化器和训练方案。这为后续的 SFT 和 RL 阶段奠定了更坚实的基础。

然后,SpaceXAI 使用 Grok 4.5 重新生成了 SFT 在推理过程、Agent 框架以及 STEM、软件工程和知识工作等领域中的轨迹,并通过基于模型的检查过滤掉了问题轨迹。最终得到的 SFT 检查点展现出优异的性能和改进的行为。

Grok 4.6 经过广泛的智能强化学习任务训练,包括知识工作、通用编码以及核优化、Web 开发、计算机辅助设计等领域的特定环境。

Grok 4.6 现已在 Cursor 和 Grok Build 中推出。它已在 API 和其他合作伙伴(如 OpenRouter、Vercel 和 Cloudflare)中推出。

定价从每百万个输入 token 2 美元起,每百万个输出 token 6 美元起。此外,还有另外一种快速版本,价格是普通版本的两倍。

SpaceXAI 将在第一周内提供 Grok Build 和 Cursor 内 2 倍的使用次数,以便用户可以立即开始试用 4.6 版本。