SpaceXAI发布Grok 4.6,性能对标GPT-5.6 Sol,API价格仅为一半

新闻摘要
SpaceXAI,这家隶属于埃隆·马斯克SpaceX旗下、前身为xAI的人工智能集团,于2026年8月12日星期三(美国东部时间)正式发布其最新大型语言模型Grok 4.6。此次发布通过公司官网的官方博客文章宣布,并得到多家科技媒体的确认,将Grok 4.6定位为前沿级模型,特别强调其在长时间运行的自主智能体、软件编程和复杂知识工作方面的能力。
发布内容
Grok 4.6在发布时即通过多个渠道提供使用,包括Grok Build、专注于编程的Grok Bot智能体系统、第三方开发者工具Cursor以及xAI API。公司还通过OpenRouter、Vercel和Cloudflare等基础设施合作伙伴提供该模型的访问,拓宽了开发者将其集成到现有产品中的方式。根据官方公告,Grok 4.6旨在支持长时间会话中的复杂多步骤任务,无论是跨多个来源研究主题、分析大量信息、浏览完整软件代码库,还是将粗略想法转化为完整的应用程序或文档。
模型能力与规格
Grok 4.6支持50万token的上下文窗口,并接受文本和图像输入,但目前仅返回文本输出。该模型对单次响应的输出长度没有固定限制,公司表示这是为了支持长篇技术写作和扩展的智能体工作流而不被截断。与前代Grok 4.5相比,新版本反映了更新的监督微调和基于人类反馈的强化学习,公司称这些变化在编程、终端命令执行和通用知识工作基准测试中带来了可衡量的提升。
独立基准测试结果
第三方评测机构Artificial Analysis在智能指数上测得Grok 4.6(高)得分为61,该指数涵盖推理、数学、科学知识和编程能力等九项独立测试。这一得分使Grok 4.6与GPT-5.6 Sol几乎持平,略低于Claude Opus 5的63分和Claude Fable 5的62分,领先于Kimi K3。在智能体编程任务上,Artificial Analysis发现Grok 4.6平均约用53轮对话解决评估任务,消耗约5亿输入token,这比Claude Opus 5在类似任务上记录的约103轮和20亿输入token要高效得多。
定价与可用性
SpaceXAI通过其API提供Grok 4.6访问,起始价格为每百万输入token 2美元,每百万输出token 6美元,公司和外部报道称这一价格约为竞争对手前沿模型成本的一半。埃隆·马斯克在其社交媒体平台上公开评论了此次发布,引用了该模型内部1753的Elo评分,并对发布表示积极态度。报道此次发布的分析师指出,接近前沿的基准性能与更低的每token定价相结合,可能会迫使竞争对手调整自己的定价结构。
公司路线图
发布后的报道显示,SpaceXAI已经在准备一个更大的继任模型,暂定名为Grok 4.7,预计规模将扩大到约2.1万亿参数,并将在Grok 4.6发布后数周内推出。报道还指出,公司内部目标是在2026年底前发布下一代Grok 5模型,这表明公司打算在今年剩余时间内保持快速的发布节奏。
更广泛的产品背景
除了核心模型发布外,SpaceXAI还推出了Grok Bot,这是一个面向企业的系统,旨在协调销售、财务和工程等部门的多个AI智能体。该工具旨在让智能体共享上下文并相互交接任务,其设计目标是自动化多步骤业务流程,而不是处理单一的孤立请求。行业观察人士将Grok Bot视为SpaceXAI对其他主要AI实验室正在开发的类似企业智能体产品的回应,反映了整个行业向能够在更长、更复杂的工作流中半自主运行的AI系统转变的趋势。