DeepSeek以透明AI突破挑战OpenAI,在3个参数上击败OpenAI

- DeepSeek-R1-Lite-Preview 在数学推理方面表现出色,优于竞争对手。
- 该 AI 系统强调透明度,为用户提供实时推理能力。
- DeepSeek 计划发布开源工具,推动生成式 AI 市场的竞争。
DeepSeek,一家位于中国的AI公司,推出了DeepSeek-R1-Lite-Preview,以提供更好的推理和问题解决能力。该系统在X上的一篇帖子中宣布,定位为与OpenAI等行业领导者竞争的产品。
评论家认为,DeepSeek的透明度具有讽刺意味,因为 西方公司 尚未解决这些差距。
DeepSeek AI的新发布表现更佳 数学
DeepSeek,一家位于中国的AI公司,推出了其AI系统的新版本,名为DeepSeek-R1-Lite-Preview。在X上的一篇帖子中,它表示新AI系统提高了推理和问题解决能力。
根据 DeepSeek,预览版在AIME(美国数学邀请赛)和MATH等基准测试中表现良好,这些测试衡量问题解决和推理能力。由于AI似乎擅长处理复杂的数学和逻辑问题,它可能已经准备好与OpenAI的ChatGPT以及特别是OpenAI o1竞争。
本周,Mistral AI的Le Chat也宣布更新以允许免费访问新功能。这些发布似乎正在创造生成式AI市场的激烈竞争,克服了其他方面的不足。
DeepSeek思考时 大声说出来,不像ChatGPT
DeepSeek表示 确认 AI可以展示逐步的实时推理,使其思维过程更加透明。同时,该AI公司还表示 他们 将在未来几天发布开源模型和API开发者工具。
根据一份比较图表 引用 由AI和技术评论家Andrew Curran制作,DeepSeek-R1-Lite-Preview在AIME(52.5)和Codeforces(1450)等参数上取得了最高分,优于OpenAI o1-preview和Claude 3.5 Sonnet等竞争对手。
它在MATH-500(91.6)方面也领先,表明在高级问题解决任务中表现优异。然而,与OpenAI o1-preview(分别为73.3和71.4)等模型相比,它在GPQA Diamond(58.5)和Zebra Logic(56.6)方面落后。这些数字 意味着 在一般知识和逻辑推理领域仍有改进空间。
在o1-preview发布两个月后,其思维链推理已被复制。Whale现在具备推理能力。DeepSeek表示,DeepSeek-R1的官方版本将完全开源。 https://t.co/Ya9mVyLvDP pic.twitter.com/6wZ8xoAyyz
— Andrew Curran (@AndrewCurran_) 11月 20, 2024
Cryptopolitan尝试了发布的功能以进行无偏见的评论。首先,DeepSeek的聊天需要用户登录。‘Deep Think’功能下的聊天将对话限制为每天最多50条消息。 我们可以说DeepSeek在思考时大声说出来,同时估算其 响应 时间。 它还以逻辑顺序解决了我们提出的数学问题。相比之下,ChatGPT 4o花费的时间更少 峰会 得出解决方案,但没有展示逐步推理 对于同样的.


网红Bilawal Sidhu对o1进行了讽刺,并表示:“讽刺的是 OpenAI的o1模型隐藏了其思维链推理,而中国的DeepSeek-R1则对用户透明。难道不应该反过来吗?”
话虽如此,中国拥有全面的 框架 关于AI的监管。2023年7月13日,包括中国国家互联网信息办公室(CAC)和教育部在内的多个中国当局引入了生成式AI技术的新法规。这些被称为《生成式AI条例》的规则,正式 于 去年8月 15生效。
据报道,该法规的范围涵盖算法、深度合成技术的使用、 使用 所有生成式AI技术以及几种其他科技活动。 此外 凭借其透明的推理方法、在竞争性基准测试中的强劲表现以及发布开源工具的计划,DeepSeek正在推动中国及其全球竞争对手中生成式AI的边界。
不要只是阅读加密货币新闻,要真正理解它。订阅我们的通讯。 免费。
免责声明。 本文提供的信息不构成交易建议。 Cryptopolitan.com 对于基于本页信息进行的任何投资,我们不承担任何责任。我们强烈建议在进行任何投资决策之前,进行独立研究或咨询合格的专业人士。
Shraddha Sharma
Sharma拥有约五年的财经记者经验,教育背景为投资银行与金融。她于印度起步,担任商业新闻实习生和视频制作人。在此期间她接触到了加密货币,但疫情导致的封锁让她有时间放慢脚步,更深入地理解这一资产类别。Sharma一直热衷于了解新兴技术如何影响更广泛的市场。















