Grok 4.7 在 Harvey 的法律代理测试中,以 Fable 五分之一的投入价格,击败了 Fable 5.1 和 GPT-5.6 Sol。

- Grok 4.7 在 Harvey Legal Agent Benchmark 测试中得分 19.6%,领先于 Fable 5.1 的 6.7% 和 GPT-5.6 Sol 的 2.5%。.
- xAI 将 Grok 4.7 定价为每百万个输入代币 2 美元,是 Fable 5.1 定价 10 美元的五分之一。.
- 在 Terminal-Bench 4.0 测试中,Fable 5.1 仍然以 57.9% 对 38.0% 的优势击败了 Grok 4.7。.
xAI 于周一发布了 Grok 4.7。 在法律代理基准测试中,它击败了 Anthropic 的 Fable 5.1 和 OpenAI 的 GPT-5.6 Sol,而每个输入代币的价格仅为 Fable 的五分之一。
Anthropic 的 Output 价格为每百万个代币 6 美元,而 Anthropic 的价格为 50 美元。
xAI发布的数据显示,Grok 4.7在Harvey Legal Agent基准测试中得分19.6%,Fable 5.1在同一测试中获得6.7%,而GPT-5.6 Sol仅获得2.5%。.
这使得 Grok 4.7 的得分约为 Anthropic 的三倍,接近 Sol 的八倍。Cryptopolitan Cryptopolitan 报道称 ,Grok 4.6 的得分已经达到 15.8%,领先于这两款加密货币。
在法律领域,Grok 4.7 的表现远超其他竞争对手,这在少数几个领域中实属罕见。它在 EEBench 电气工程测试中也轻松通过了 Fable 5.1 的测试,并在 DeepSWE 编码测试中略胜一筹。.
Grok 4.7 的定价为每百万个输入代币 2 美元,每百万个输出代币 6 美元,与 Grok 4.6 相同。该输入价格是 GPT-5.6 Sol 的 4 美元的一半,是 Fable 5.1 的 10 美元的五分之一。.
输出价格为 6 美元,而 Sol 为 20 美元,Fable 为 50 美元,约为 Anthropic 的八分之一。.
xAI 将 CursorBench 4.0 得分与完成任务的平均成本绘制成图表,并声称该模型处于性价比的前沿。Grok 4.7 在该图表中得分约为 46%,每项任务成本约为 6 美元,而 Claude Opus 5 要达到类似的结果,成本几乎是其两倍。.
Fable 5.1 在高预算下表现更佳,在每项任务约 17 美元的情况下,效率最高可达 51.8%。马斯克在 X 大会上表示,此次发布是“智能、速度和低成本的tron结合”。.

Terminal-Bench 4.0 显示 Anthropic 以 57.9% 比 38.0% 的优势领先。
在 GDPval 和 AA Briefcase 办公任务测试中,Grok 4.7 均位列 Fable 5.1 之后,排名第二。Anthropic 的模型在更长时间的编码和终端基准测试中保持着明显的领先优势。.
差距最大的是 Terminal-Bench 4.0,Fable 5.1 的得分为 57.9%,而 Grok 4.7 的得分为 38.0%,相差约 20 分。.
Fable 在 CursorBench 和 HealthBench Professional 临床推理测试中也领先,GPT-5.6 Sol 也击败了 Grok。.
Grok 4.7 在 GDPval 上的 Elo 得分为 1,695,该评分系统对模型在律师、护士和金融分析师完成的任务上的表现进行评分,高于 Grok 4.6 的 1,605。这低于 Fable 5.1 的 1,735 分,但高于 OpenAI 最新推出的 GPT-6 Astra 在同一图表上的 1,542 分。.
Grok 4.7 在七项基准测试中的五项都优于 GPT-5.6 Sol,仅在 DeepSWE 和临床测试中落后。.
Grok 4.7 运行在 2.1 万亿个参数上,比 Grok 4.6 的 1.5 万亿个参数多了 40%。xAI 还加入了 SpaceX 的补充训练数据,包括 Starlink 卫星遥测数据和制造记录。.
该公司表示,与 Grok 4.6 相比,该模型更有可能花更多时间解决棘手的问题,并仔细检查自己的答案。.
该 模型 已在 Grok 应用、Cursor、Grok Build 和 xAI API 上发布,无需等待。
本文所有数据均来自xAI自身的测试。xAI主要使用的测试工具CursorBench由Cursor公司开发,SpaceX已于上月完成对Cursor的收购。.
xAI 与 GPT-5.6 Sol 进行了基准测试,而 OpenAI 的较新 GPT-6 Astra 仅出现在 GDPval、AA Briefcase 和 EEBench 图表中。.
最顶尖的加密货币专家都在阅读我们的简报。想 加入他们?
常见问题解答
与 Fable 5.1 和 GPT-5.6 Sol 相比,Grok 4.7 的价格是多少?
Grok 4.7 每百万个输入代币收费 2 美元,每百万个输出代币收费 6 美元,而 Fable 5.1 的收费分别为 10 美元和 50 美元。.
Grok 4.7 在哪些基准测试中胜出,哪些又落败?
Grok 4.7 在 Harvey 法律基准测试中以 19.6% 的成绩胜出,而 Fable 5.1 在 CursorBench、Terminal-Bench 和 HealthBench Professional 测试中领先。.
Grok 4.7 的大小是多少?它是用什么数据训练的?
Grok 4.7 使用 2.1 万亿个参数运行,并包含 SpaceX 的补充训练数据,例如 Starlink 卫星遥测数据。.
免责声明:本页面提供的信息并非交易建议。Cryptopolitan.com对任何基于本页面信息进行的投资概不负责。我们tron您在做出任何投资决定前进行独立dent /或咨询合格的专业人士。Cryptopolitan研究

兰达·摩西
Randa Moses是 Cryptopolitan 的编辑和记者,主要报道科技、人工智能、机器人、加密货币、诈骗和黑客攻击等领域。她自2017年起便投身于加密货币领域,曾就职于Forward Protocol、AmaZix和Cryptosomniac等公司。Randa拥有布拉德福德大学电气与tron工程学位。.
















