SpaceXAI推出Grok 4.6系列模型 专注于长时程任务和处理交互式可视化工作
微资讯
#人工智能 SpaceXAI 推出 Grok 4.6 模型,专注于长时程任务和可视化交互式复杂任务。该模型在 4.5 基础上进行更长时间的补充训练,覆盖软件工程、知识工作、通用编程、内核优化、网页开发和计算机辅助设计任务等。价格方面输入输出缓存分别为 2/6/0.5 美元,超过 200K 部分翻倍收费。提供快速模式,快速模式定价是标准定价的两倍,超出 200K 部分则是四倍。查看全文:https://ourl.co/114307
SpaceXAI 日前宣布推出 Grok 4.6 系列模型,该系列模型重点提升模型处理长时程任务、代码开发以及交互式视觉项目的能力。SpaceXAI 称模型可以在多个步骤中持续推进工作,适合执行资料研究、信息分析、跨文件代码修改以及从产品创意开发可运行的应用原型等。
训练重点转向复杂任务处理:
SpaceXAI 称,Grok 4.6 在此前模型基础上进行更长时间的补充训练,训练数据包括模型生成的推理数据、软件工程数据以及高质量技术资料等。同时开发团队还改进优化器和整体训练方案,使用 Grok 4.5 重新生成不同的推理强度和不同智能体工具环境下的训练轨迹。
这些训练覆盖软件工程、知识工作、通用编程、内核优化、网页开发以及计算机辅助设计等任务。新模型也加强了在长时程任务中的自我测试和结果验证能力,减少智能体执行到中途后出现偏离目标、无法收尾或交付结果质量不稳定等问题。
对于交互式和视觉项目,Grok 4.6 更容易在首次尝试中建立清晰的应用结构和视觉风格,不过这些能力主要体现在 Grok Build 等应用开发场景中,实际效果仍然取决于任务复杂度、工具调用环境以及模型是否能够正确理解用户需求。
基准测试表现仍然不是强项:
Grok 4.6 在多种模型基准测试中的表现要比此前版本更好,不过整体来说没有特别领先的地方,即要么与 GPT-5.6 SOL 持平,要么低于 Claude Fable 5 等模型。所以在多种测试中,Grok 4.6 处在头部地位但并没有领先,而且部分竞争模型的成绩来自公开系统卡或排行榜,相关数据并非全部由独立机构重新测试。
SpaceXAI 也强调 Grok 4.6 所说的达到前沿水平主要指的是在多个智能体和知识工作测试中具备竞争力,所以实际能力如何还需要开发者日常使用来感受。
Grok 4.6 目前已经在 Cursor 和 Grok Build 中提供,发布首周以上工具的订阅用户可以获得两倍额度。开发者也可以通过 API 调用该模型,除了 SpaceXAI 官方 API 外,其他模型平台也会陆续提供 Grok 4.6 的调用。
模型信息卡:
- 模型名称:grok-4.6
- 模型窗口:500K
- 知识库时间:2026 年 2 月 1 日
- 模态支持:文本和图像输入、文本输出
- 百万输入:2 美元
- 百万输出:6 美元
- 百万缓存:0.5 美元
- 额外定价:超过 200K 部分,百万输入 4 美元、百万输出 12 美元、百万缓存 1 美元
- 快速模式:为标准定价的两倍,快速模式下的超出 200K 部分也翻倍,也就是标准定价普通模式的四倍
- 努力程度:低、中、高、超高,默认为高
- API 接口支持: Responses API,Chat Completions
消息源:发布新闻稿、Grok 4.6 定价