알리바바의 Qwen3이 DeepSeek의 R1을 제치고 오픈소스 AI 모델 선두

- Alibaba의 Qwen3 AI 모델 시리즈는 언어 지시, 수학, 코딩, 데이터 분석 분야에서 DeepSeek의 R1을 제치고 세계 최고의 오픈소스 모델로 자리 잡았습니다.
- Qwen3은 100만 토큰당 0.55달러의 비용으로 실행되므로 사용 비용이 매우 저렴합니다.
- 미국의 반도체 기업인 엔비디아와 인텔이 Qwen3 지원을 시작했습니다.
알리바바의 새로운 Qwen3 AI 모델 가군은 DeepSeek의 R1을 넘어 세계 최고의 오픈소스 모델이 되었습니다. 보고서에 따르면, Qwen3은 언어 지시, 수학, 코딩 및 데이터 분석 분야에서 오픈소스 AI 모델의 능력을 측정하는 테스트에서 R1보다 더 나은 성과를 보였습니다.
Qwen3 가군은 알리바바의 클라우드 컴퓨팅 유닛에 의해 지난 주에 출시되었습니다. 6억에서 2350억 개의 파라미터를 가진 8개의 개선된 모델이 있습니다. 머신러닝에서 파라미터는 AI 시스템이 훈련되는 동안의 변수입니다.
에 따르면 LiveBench 플랫폼은 대규모 언어 모델을 테스트하는 독립적인 플랫폼이며, 이 새로운 테스트 전에 DeepSeek의 R1은 1월에 출시된 이후 세계 최고의 오픈소스 AI 모델이었습니다. 하지만 더 이상 아닙니다.
미국과 중국 기업 모두 Qwen 3 채택을 서두름
LiveBench 순위에서 Qwen3의 부상은 중국에서 AI가 얼마나 빠르게 발전하고 있는지를 보여줍니다. 중국 기술 산업은 오픈소스 도구 덕분에 크게 성장했습니다. 알리바바의 오픈소스 방법론 코드는 다른 서드파티 소프트웨어 개발자가 설계를 공유하고, 깨진 링크를 수정하거나, 프로그램을 더 강력하게 만들 수 있게 했습니다.
그러나 전체 LiveBench 결과는 Qwen3이 OpenAI의 o3, Google의 Gemini Pro 2.5 및 Anthropic의 Claude 3.7보다 좋지 않았음을 보여주었습니다. 이들은 세계 최고의 폐쇄형 AI 모델입니다. LiveBench는 o3-mini, OpenAI의 가장 인기 있는 AI 모델이 전체적으로 세계 최고라고 말합니다. 마이크로소프트는 OpenAI를 지원합니다.
매 100만 토큰마다 o3를 실행하는 데 $10이 필요합니다. 반면에 Qwen3은 실행하는 데 매 100만 토큰당 $0.55만 필요하므로 사용이 더 저렴합니다. Qwen3이 더 저렴하고 더 잘 작동하기 때문에 많은 기업들이 출시되자마자 알리바바의 최신 AI 모델을 지지하겠다고 말했습니다.
화웨이 테크놀로지스, 무어 스레드스, 캄브리콘 테크놀로지스, 하이곤 인포메이션 테크놀로지는 모두 Qwen3을 지원하겠다고 발표한 칩 회사들입니다.
캄브리콘은 지난 화요일에 필리핀의 AI 개발자들이 중국산 칩을 원했기 때문에 Qwen3을 그래픽 처리 장치(GPU)에서 빠르게 실행하도록 성공적으로 최적화했다고 밝혔습니다.
Qwen3은 또한 하이퍼볼릭과 파이어워크스.ai라는 두 AI 인프라 회사의 클라우드 컴퓨팅 서비스에서 사용되고 있습니다. 미국의 칩 제조사 엔비디아와 인텔은 Qwen3 지원을 시작했습니다.
베이징, 상하이, 항저우, 후베이, 지린, 서북 산시 성의 중국 내 많은 대형 데이터 센터들도 알리바바의 3세대 Qwen AI 모델을 사용할 것이라고 밝혔습니다. 중국의 슈퍼컴퓨팅 네트워크도 Qwen3을 채택했습니다. 이 네트워크는 14개 성의 20개 도시에 있는 20개 이상의 데이터 센터를 연결합니다.
Anthropic CEO, DeepSeek를 "약간 과장되었다"고 말함
비즈니스 행사에서 Claude AI 모델을 만든 회사인 Anthropic의 공동 창립자는 DeepSeek가 여전히 "미국 프론티어 기업들이 있는 곳보다 6~8개월 뒤처져 있다"고 말했습니다. 그는 또한 중국 스타트업에 대한 최근의 관심은 "아마도 약간 과장되었다"고 말했습니다.
딥시크(DeepSeek) 2024년 12월 말과 2025년 1월 초에 V3 및 R1이라는 두 가지 고급 오픈소스 AI 모델을 공유하며 전 세계의 주목을 받았습니다. 이러한 모델은 대형 기술 회사가 LLM 프로젝트에 일반적으로 필요로 하는 비용과 컴퓨팅 파워의 작은 분수로 만들어졌습니다.
DeepSeek가 모델의 다음 세대를 언제 출시할지는 불명확합니다. 항저우 기반 회사는 6710억 파라미터를 가진 Prover-V2를 12월 말에 조용히 출시했습니다. 4 월. 이는 수학 증명을 처리하기 위한 전용 모델의 업데이트였습니다. 그러나 그는 오랫동안 기다려온 R2 추론 모델의 진전에 대해서는 아무것도 말하지 않았습니다.
암호화폐 뉴스를 단순히 읽는 것을 넘어, 이해하세요. 뉴스레터에 구독하세요. 무료입니다.
면책 조항. 제공된 정보는 투자 조언이 아닙니다. Cryptopolitan.com 본 페이지에 제공된 정보를 바탕으로 이루어진 투자에 대해 어떠한 책임도 지지 않습니다. 투자 결정을 내리기 전에 반드시 독립적인 조사나 자격을 갖춘 전문가의 상담을 강력히 권장합니다.

플로렌스 무차이
플로렌스는 지난 6년 동안 암호화폐, 게임, 기술 및 AI 뉴스를 다루어 왔습니다. 메루 과학기술대학교에서 컴퓨터학을, MMUST에서 재난 관리 및 국제 외교를 전공하며 언어, 관찰력 및 기술적 역량을 충분히 갖추었습니다. 플로렌스는 VAP 그룹에서 근무했으며 여러 암호화폐 미디어 하우스의 편집자로 활동했습니다.
















