最新新闻
为您推荐

阿里巴巴的 Qwen3 取代 DeepSeek 的 R1,现居开源 AI 模型之首

作者Florence MuchaiFlorence Muchai 3 分钟阅读
  • 阿里巴巴的Qwen3系列AI模型在语言指令、数学、编程和数据分析等领域已超越DeepSeek的R1,成为全球最佳开源模型。 
  • Qwen3使用成本低廉,每运行100万token仅需0.55美元。
  • 美国芯片制造商英伟达(Nvidia)和英特尔(Intel)已开始支持Qwen3。

阿里巴巴的新 Qwen3 AI 模型系列已超越 DeepSeek 的 R1,成为世界上最好的开源模型。据报道,Qwen3 在衡量开源 AI 模型在语言指令、数学、编码和数据分析等领域能力的测试中表现优于 R1。 

Qwen3 系列上周由阿里巴巴的云计算部门推出。它拥有八个改进后的模型,参数量在 6 亿到 2350 亿之间。在机器学习中,参数是 AI 系统在训练过程中的变量。

根据 LiveBench 平台是一个独立平台,用于测试大型语言模型。在这些新测试之前,DeepSeek 的 R1 自 1 月发布以来一直是世界上最好的开源 AI 模型。但情况已不再如此。

中美公司竞相采用 Qwen 3

Qwen3 在 LiveBench 排名中的崛起显示了中国 AI 发展的速度。得益于开源工具,中国科技产业取得了巨大增长。阿里巴巴的开源方法代码允许其他第三方软件开发者共享设计、修复断链或使程序更强大。 

然而,整体 LiveBench 结果显示,Qwen3 不如 OpenAI 的 o3、Google 的 Gemini Pro 2.5 和 Anthropic 的 Claude 3.7,这些是世界上最好的闭源 AI 模型。LiveBench 表示,o3-mini 高配版,即 OpenAI 最受欢迎的 AI 模型,是全球整体最好的。微软支持 OpenAI。

每运行 100 万 token,o3 需要 10 美元。另一方面,Qwen3 使用成本更低,每运行 100 万 token 仅需 0.55 美元。由于 Qwen3 更便宜且效果更好,许多企业表示一旦推出就会支持阿里巴巴最新的 AI 模型。

华为技术、摩尔线程、寒武纪科技和海光信息都是芯片公司,它们都表示将支持 Qwen3。

寒武纪上周二表示,已成功优化 Qwen3 以在其图形处理单元上快速运行。这是出于菲律宾的 AI 开发者希望使用中国制造的芯片。

Qwen3 也用于 Hyperbolic 和 Fireworks.ai 两家 AI 基础设施公司的云计算服务。美国芯片制造商英伟达和英特尔已开始支持 Qwen3。

中国许多大型数据中心,如北京、上海、杭州以及湖北、吉林和陕北等省份的数据中心,也表示将使用阿里巴巴的第三代 Qwen AI 模型。中国超算网络也采用了 Qwen3。该网络连接了 14 个省份 20 个城镇的 20 多个数据中心。

Anthropic CEO 表示 DeepSeek “有些夸大其词”

在一次商业活动上,Claude AI 模型制造商 Anthropic 的联合创始人表示,DeepSeek 仍然“落后于美国前沿公司六到八个月”。他还表示,围绕这家中国初创公司的近期热潮“可能有些夸大其词”。

DeepSeek DeepSeek 在 2024 年 12 月底和 2025 年 1 月初通过分享两个先进的开源 AI 模型 V3 和 R1 引起了全球关注。这些模型的开发成本极低,所需的计算能力也远低于大型科技公司进行 LLM 项目通常需要的水平。

DeepSeek 何时发布其下一代模型尚不清楚。这家位于杭州的公司于 late 4月悄然发布了其 6710 亿参数的 Prover-V2。这是对其专门处理数学证明模型的更新。然而,它尚未对其备受期待的 R2 推理模型的进展发表任何声明。

如果您正在阅读这篇文章,说明您已经领先一步。请继续通过我们的通讯保持关注。

免责声明。 本文提供的信息不构成交易建议。 Cryptopolitan.com 对于基于本页信息进行的任何投资,我们不承担任何责任。我们强烈建议在进行任何投资决策之前,进行独立研究或咨询合格的专业人士。

Florence Muchai

Florence Muchai

Florence 过去 6 年一直报道加密货币、游戏、科技和人工智能新闻。她在梅鲁科技大学修读计算机研究,并在马林加莫伊科学与技术大学学习灾害管理与国际外交,这些经历充分赋予她语言、观察和技术技能。Florence 曾在 VAP Group 工作,并担任多家加密货币媒体的编辑。

更多新闻…