据MarkTechPost报道,SpaceXAI发布旗舰模型Grok 4.7,面向编程、智能体任务和知识工作。该模型采用更大的基座模型和更长的强化学习训练,但维持与Grok 4.6相同的价格与速度,每百万输入token收费2美元、每百万输出token收费6美元。Grok 4.7以托管模型形式提供,目前可通过xAI API、Cursor、Grok Build、OpenRouter、Vercel和Cloudflare调用。

SpaceXAI列出Grok 4.7相较Grok 4.6的四项底层变化。新模型没有复用Grok 4.6基座,而是采用更大的基座模型;强化学习运行时间更长,任务组合偏向需要数小时才能完成的问题;自我验证和长上下文处理得到加强,公司称模型会更仔细检查自身工作;模型原生支持Grok Bot harness,训练中理解该工具链以服务对话和知识工作。官方文档列出的API规格为:模型名grok-4.7,上下文窗口50万token,知识截止日期2026年5月,支持文本和图像输入、文本输出,推理强度分为low、medium、high(默认)和xhigh,提供Responses API和Chat Completions,支持函数调用、网页搜索、X搜索和代码执行。

发布对比表将Grok 4.7的xHigh档与Grok 4.6的High档、GPT-5.6 Sol Max和Fable 5.1 Max并列。Grok 4.7的DeepSWE成绩在high effort下运行,所有分数均为厂商提供。SpaceXAI称,Grok 4.7在表中每一行都优于Grok 4.6,其中Terminal-Bench 4.0从20.3%升至38.0%,EEBench上升11个百分点至64.0%,为表中最高分;在Harvey法律智能体基准上,Grok 4.7得19.6%,Fable 5.1 Max得6.7%。Grok 4.7并非全面领先。Fable 5.1 Max在7项基准中领先4项,包括Terminal-Bench 4.0的57.9%;GPT-5.6 Sol Max保持DeepSWE v1.1最高分72.7%。价格方面,Fable 5.1 Max的输入价格是Grok 4.7的5倍,输出价格约为8.3倍;GPT-5.6 Sol Max的输入价格是2倍,输出价格约为3.3倍。在CursorBench 4.0每任务成本图中,SpaceXAI将Grok 4.7置于价格性能前沿。在测试专业知识工作的GDPval上,Grok 4.7 xhigh得1695 Elo,高于Grok 4.6 high的1605;Fable 5.1 max以1735领先,GPT-6 Astra max得1542。SpaceXAI还称Grok 4.7更擅长生成文档和演示文稿。

安全方面,Grok 4.7搭载一套全新防护栈。SpaceXAI称其是自己测试过的在拒绝和抗越狱方面最强的模型。该模型在LatchBio生物安全基准上以62.4%居首。在SpaceXAI自有的风险与恶意网络任务基准HackerBench v0.3上,模型放行了3.3%的风险性双用途提示。公司称它很少阻止合法的安全工作。部分网络安全合作伙伴现在获得邀请制访问权限,可将其红队能力用于防御研究。

Grok 4.7每百万输入token收费2美元,每百万输出token收费6美元。它在Cursor所有套餐中可用,是Grok Build的默认模型,也通过Grok API、OpenRouter、Vercel和Cloudflare提供。Grok 4.7 Fast是同一模型运行在更快基础设施上,输出速度翻倍,价格也翻倍。文档称其仅在Cursor和Grok Build中运行,不在公共xAI API上提供,也不包含在Grok Build免费层中。位于https://us.api.x.ai/v1的美国区域端点可将推理保留在美国境内,溢价10%。SpaceXAI建议设置prompt_cache_key以获得可靠缓存命中。