最新新闻
为您推荐

在马斯克发表评论后,Grok 4.5与Anthropic的Claude相比如何?

作者Hannah CollymoreHannah Collymore 2 分钟阅读
在马斯克发表评论后,Grok 4.5 与 Anthropic 的 Claude 相比如何?
  • SpaceXAI 推出了 Grok 4.5,输入和输出令牌每百万分别定价为 2 美元和 6 美元。 
  • 该模型的使用成本低于 Claude Opus 4.8,其定价为每百万输入和输出令牌分别为 5 美元和 25 美元。
  • 独立测试将其排在 Artificial Analysis 智能排名的第四位,位于 Fable 5、GPT-5.5 和 Opus 4.8 之后。

 

SpaceXAI最近发布了其AI聊天机器人的新版本,名为Grok 4.5。这是一个专注于编码的模型,Elon Musk将其定位为Anthropic的Claude的“Opus级”竞争对手,但成本仅为其中的一小部分。 

考虑到AI使用成本的上升,工程团队现在优先考虑每完成一项任务的价格,而不是峰值智能。 

Grok的新模型是否优于Claude Opus 4.8?

Elon Musk在X上发布的一篇帖子中描述了 新推出的Grok 4.5 为“Opus级模型”,速度更快且更具成本效益。该模型专为编码和其他复杂任务而设计。 

Musk在发布后发表了第二篇帖子, 写道,“看起来Grok 4.5至少在几个基准测试中排名第一。比预期的要好。”

SpaceXAI(NASDAQ: SPCX)将Grok 4.5的定价定为每百万输入令牌2美元,每百万输出令牌6美元,这远低于使用Anthropic模型的成本,后者Claude Opus 4.8的定价为5美元和25美元,或者OpenAI的GPT-5.6 Luna,其定价为1美元和6美元。 

新模型是首个与Cursor(一家AI编码初创公司)联合开发的模型,SpaceXAI最近同意以全股票交易方式以600亿美元收购该公司。该交易预计将于2026年第三季度完成。 

Cursor表示,它与SpaceXAI在训练方面进行了合作,提供了关于工程师如何编写、审查和调试代码的真实信号。训练在数万个Nvidia GB300 GPU上运行,SpaceXAI表示该模型每秒运行约80个令牌,令牌效率约为可比竞争对手的两倍。

Grok在竞争对手中究竟排名如何? 

独立基准测试网站 Artificial Analysis,将其Grok 4.5在智能指数中评分为54,排名第四,落后于Anthropic的Fable 5、OpenAI的GPT-5.5和Claude Opus 4.8。 

在编码测试中,Artificial Analysis在Grok Build中对Grok 4.5的评分为76,在其 编码代理指数中。这与Codex中的GPT-5.5处于同一水平,略低于Claude Code中的Fable 5。 

该网站测量Grok 4.5每编码任务成本为2.49美元,而Claude Code中的Fable 5为11.80美元。Grok 4.5每个任务消耗了约190万个令牌,而Fable 5使用了720万个。

在某个特定基准测试中,Grok 4.5 完胜Claude。 Snorkel AI 在其GDPval+数据集中选取了约2000个专业工作任务样本,将该模型与GPT 5.5和Opus 4.8进行了对比运行。 

Grok 4.5通过了29%的任务,领先于GPT 5.5的22%和Opus 4.8的21%。最大的优势体现在法律、教育和医疗任务中。应公司要求,Grok 4.5在该测试中与SpaceXAI自己的Grok Build代理配对。

Cryptopolitan 在 6 月报道 本周早些时候指出,Elon Musk关于该模型“接近甚至可能超越Opus”的声明源于公司评估者的印象,而非发布的基准测试。Grok所对比的具体Opus版本是Claude Opus 4.8。 

Musk本人后来承认,该模型是与前一代Claude竞争,而非当前一代。

Grok 4.5现已通过SpaceXAI控制台、Grok Build代理以及Cursor的所有计划提供,预计欧盟用户将在7月中旬获得访问权限。 

不要只是阅读加密货币新闻,要真正理解它。订阅我们的通讯。 免费。

常见问题

Grok 4.5 比 Claude Opus 4.8 便宜多少?

Grok 4.5 的定价为每百万输入令牌 2 美元,每百万输出令牌 6 美元,而 Claude Opus 4.8 的定价分别为 5 美元和 25 美元。

Grok 4.5 真的在基准测试中胜过 Claude 吗?

结果喜忧参半:Artificial Analysis 将 Grok 4.5 在其智能指数中排名第四,位于 Claude Fable 5 和 Opus 4.8 之后;但 Snorkel AI 发现,Grok 4.5 通过了 29% 的专业工作任务,而 Opus 4.8 为 21%。

Cursor 在 Grok 4.5中扮演什么角色?

Grok 4.5 是首个与 Cursor 联合开发的模型,Cursor 是一家 SpaceX 正在以 600 亿美元全股票交易收购的代码初创公司,预计该交易将于 2026 年第三季度完成,且 Cursor 的交互数据被用于该模型的训练。

分享本文
Hannah Collymore

Hannah Collymore

汉娜是一位作家兼编辑,在加密货币领域拥有近十年的博客写作和活动报道经验。在Cryptopolitan,汉娜负责新闻板块,报道和分析DeFi、RWA、加密货币监管、AI和前沿科技行业的最新发展。她毕业于阿卡迪亚大学,获得工商管理学位。

更多新闻…