AB
AiBoss站
project

Grok 4.6 - SpaceXAI 推出的最新一代旗舰大模型

Grok 4.6 是 SpaceXAI 推出的最新一代旗舰大模型,1.5T 参数,50 万 token 上下文。模型性能在编码、Agent 等基准测试中逼近 Claude Fable 5 与 GPT-5.6 Sol ...

Grok 4.6是什么

Grok 4.6 是 SpaceXAI 推出的最新一代旗舰大模型,1.5T 参数,50 万 token 上下文。模型性能在编码、Agent 等基准测试中逼近 Claude Fable 5 与 GPT-5.6 Sol Max,响应速度极快。模型 API 定价为百万输入 $2、输出 $6,远低于同类旗舰。Grok 4.6 支持文本与图像输入,擅长复杂软件开发及多步骤任务,已上线 Grok Build、Cursor 及 xAI API 等平台。

Grok 4.6的主要功能

  • 复杂任务处理:支持多步骤研究、分析与跨代码库工作,能快速将宽泛产品构想转化为可运行原型,并在长轨迹中自我验证。
  • 编码工程:在 CursorBench、DeepSWE 等基准中接近 Fable 5 水平,支持漏洞修补、工程设计及代码执行。
  • 多模态推理:支持文本+图像输入,文本输出无长度限制,提供 Low/Medium/High/XHigh 四级推理档位,上下文窗口达 50 万 token。
  • 工具与安全:支持 Function Calling、Web/X Search 及代码执行,安全堆栈针对漏洞修补与 AI 研究场景重新校准。

Grok 4.6的技术原理

  • 训练架构:基于 Grok 4.5 进行更长时间的补充训练,采用 1.5T 总参数规模的 MoE 架构,配合改进的优化器与训练方案,为后续 SFT 和 RL 阶段奠定更坚实的基础。
  • 数据与 SFT:用 Grok 4.5 重新生成并过滤推理、Agent 框架、STEM、软件工程等领域的 SFT 轨迹,同时引入高质量工程数据与筛选后的模型生成数据,确保训练质量。
  • 强化学习:通过广泛的智能体 RL 训练覆盖知识工作、通用编码及核优化、Web 开发等特定环境,强化模型从宽泛构想到可运行原型的持续改进与自我验证能力。
  • 推理优化:在同等价格下相比 Grok 4.5 实现显著性能提升,通过推理基础设施的深度优化,在保持旗舰级智能的同时实现极快的响应速度。

如何使用Grok 4.6

  • Grok Build 网页/应用:访问 Grok Build 网页端或应用,在模型选择中切换至 Grok 4.6,可直接对话并体验首周双倍用量。
  • Cursor 编辑器:在 Cursor 的 AI 助手设置中将模型切换为 cursor-grok-4.6,可在代码编辑与生成过程中调用其编码与推理能力,首周同样享受双倍用量。
  • xAI API:通过 xAI 官方 API(模型标识 grok-4.6)调用 Responses API 或 Chat Completions 接口,将模型集成至自有产品或自动化工作流。

Grok 4.6的核心优势

  • 旗舰性能:在 AA Intelligence Index、DeepSWE、CursorBench 等基准测试中全面逼近 Claude Fable 5 与 GPT-5.6 Sol Max,具备复杂任务处理、跨代码库工作及快速原型构建能力。
  • 极速响应:Grok 4.6 在保持顶级智能的同时实现极快反馈,彻底解决旗舰模型的速度焦虑。
  • 极致性价比:API 定价仅为 Fable 5 的约 1/5~1/8,SuperGrok Heavy 订阅附赠 Cursor Ultra 会员,是当前唯一在性能、价格、速度三角中同时拉满的旗舰模型。

Grok 4.6的同类竞品对比

对比维度 Grok 4.6 Claude Fable 5
发布方 SpaceXAI (xAI) Anthropic
参数规模 1.5T (MoE) 未公开
上下文窗口 500K tokens 200K tokens
多模态 文本+图像输入 文本+图像+PDF 全多模态
输出限制 无限制 有长度限制
知识截止 2026年2月1日 较早
响应速度 ⭐⭐⭐⭐⭐ 极快(秒级) ⭐⭐⭐ 较慢(十几分钟至半小时)
工程稳定性 良好,超长期略逊 ⭐⭐⭐⭐⭐ 业界最强
AA Intelligence Index 61 62
DeepSWE v1.1 65.9% 70%
CursorBench v3.2 69.9% 70.5%
Terminal-Bench v3.0 26% 34.1%
Code Arena WebDev 1618(第7) 1627(第5)
API 输入/1M $2.00 ~$10.00(贵5倍)
API 输出/1M $6.00 ~$50.00(贵8.3倍)
订阅方案 SuperGrok Heavy $300/月(赠Cursor Ultra $200) Pro $200/月 + API另付
最佳场景 日常Vibe Coding、快速原型、长文档分析 超大型关键项目、金融级代码、终端自动化
核心优势 速度+性价比 稳定性+工程可靠性
一句话定位 最快的准Fable级工程师 最稳的顶级工程师

Grok 4.6的应用场景

  • 高频 Vibe Coding:适合需要快速迭代、即时反馈的日常编程与原型开发,配合 Grok Build 或 Cursor 体验最佳。
  • 复杂软件工程:可处理跨代码库工作、多步骤系统架构设计,但超大型关键项目建议与 Claude Fable 5 搭配使用。
  • 产品原型构建:能将宽泛的产品构想一次性转化为具备结构和视觉语言的可运行初始版本,适合初创团队快速验证想法。
  • 漏洞修补与安全研究:安全堆栈专门针对漏洞修补、AI 研究等场景校准,适合安全工程师与研究人员。
  • 实时交互开发:在需要人机紧密协作、快速试错的设计与开发流程中,其极速响应可显著缩短反馈循环。