최신 뉴스
당신을 위한 선택

OpenAI GPT-5, 첫날 mixed reviews

작성자Nellius IreneNellius Irene 3분 읽기
  • OpenAI는 수개월간의 기대감 고조 끝에 GPT-5를 출시했으며, 추론, 코딩, 속도 측면에서 주요 도약이 있을 것이라고 약속했습니다.
  • 초기 평가는 엇갈리는데, 일부는 그 능력을 칭찬하는 반면 다른 이들은 수학, 철자, 추론 오류를 지적합니다.
  • 사용자들은 투명성 감소와 GPT-4o 같은 이전 모델의 단종에 반발했습니다.

OpenAI의 최고경영자(CEO) 샘 알트먼은 수개월 동안 GPT-5를 teasers했습니다. 그는 이것이 더 똑똑하고 빠르며 '박사 수준'으로 사고할 수 있는 고급 모델이라고 주장했습니다. 회사는 이 출시를 코딩, 추론, 정확성 측면에서 지능 향상을 이끌 ChatGPT의 주요 한 걸음으로 포지셔닝했습니다. 

하지만 초기 반응은 더 흐릿한 그림을그려냅니다. 개발자들은 복잡한 프롬프트를 이해하고 잘 구조화된 코드를 출력하는 모델에 찬사를 보냈습니다. 초기 테스터인 사이먼 윌리슨은 GPT-5를 '유능하다'고 평가하며 '때때로 인상적'이지만 GPT-4에서 큰 도약은 아니라고 말했습니다. 다른 이들은 덜 감명받았습니다.

소셜 미디어의 여러 게시물은 빠르게 수많은 사실 오류, 약한 수학 능력, 그리고 몇몇 경우에는 기본적인 철자 오류에 대한 불만으로 바뀌었습니다. 벤틀리 대학교의 수학 교수 노아 지안시라쿠사는 이 출시를 '실망스럽다'고 평가하며, 해당 업데이트들이 '기대했던 것보다 더 미미해 보인다'고 언급했습니다.

혼란의 일부는 모델의 아키텍처 때문이었습니다. GPT-5는 작업에 따라 다양한 모델 크기에 대한 '자동 전환기'를 포함할 것입니다. 이는 처리를 절약하며 항상 전체 GPT-5를 사용하는 것은 아니라는 것을 의미합니다. 이는 많은 사람들에게 백도어를 제공했습니다. 시스템이 질문에 잘못 답변했을 때, 작업 중인 에이전트는 '블루베리에 b가 몇 개 있는지'에 대해 '더 열심히 생각하라'고 지시했습니다. 그 피드백 후, 쿼리 시 정답을 얻었습니다.

사용자들의 반발—and OpenAI의 대응

이러한 불만은 금요일까지 레딧과 X로 퍼질 수 있습니다. 일부 사용자는 텍스트가 누구로부터, 심지어 어떤 모델에서 왔는지 알 수 없다는 사실에 불만을 품었지만, 많은 사람들은 이것이 단지 추론일 뿐이며 GPT-5가 자신이 신뢰하던 이전의 즐겨찾기를 대체했다고 느꼈습니다. 몇몇은 품질이 저하되었다고 작성하며, 글쓰기가 GPT-4.5, 당신이 동의했듯이, 그리고 일부 창의적이고 기술적인 것들이 더 나빠진 것 같다고 썼습니다.

이 대화는 OpenAI의 CEO가 반발을 해소하기 위해 레딧의 '나에게 질문하기(Ask Me Anything)' 세션에 참여하도록 이끌었습니다. 그는 오토스위치어(autoswitcher)의 버그로 인해 GPT-5가 첫날부터 잠재력을 충분히 발휘하지 못했다고 밝혔습니다. 그는 향후 모델 전환 시 더 투명하게 대응하겠다고 약속하며, "오늘부터 GPT-5는 점점 더 똑똑해 보일 것이다"라고 말했습니다. OpenAI는 선호도를 표시한 사용자를 위해 GPT-4o 등 이전 모델을 다시 배포하겠다고 약속했으며, 이는 가장 강력한 비판자들을 설득하기 위한 노력으로 해석됩니다.

이렇게 신속하게 대응해야 했던 이유는 그만큼 높은 스테이크가 걸려 있었음을 보여줍니다. 현재 OpenAI는 Anthropic, Google DeepMind, 심지어 일론 머스크의 xAI와 같은 경쟁사와 치열한 경쟁을 벌이고 있습니다. 이러한 경쟁 구도 속에서 작은 실수 하나도 곧 경쟁사가 한 발 앞서 나가는 결과를 초래할 수 있습니다.

AI 경쟁의 격화

이러한 차이점에도 불구하고 GPT-5에 대한 반응은 미온적이었지만, 이는 LMArena라는 사용자 주도형 모델 학습 리더보드에서 최상위 자리로 올라가는 것을 막지는 못했습니다. 오늘날 우리가 프로그래밍 가능하다고 부르는 기능은 부족했지만, 속도와 표현력이 뛰어나 대규모의 복잡한 쿼리를 지원했습니다. 그러나 다른 벤치마크 결과는 더 복잡하고 도전적인 문제 환경을 보여주었습니다. Grok 4는 머스크의 xAI를 위해 ARC-AGI-2(고급 추론을 위한 테스트 세트)에서 매우 높은 점수를 기록하며 OpenAI의 독보적 지위에 상당한 도전을 제기했습니다.

일부 업계 분석가들은 GPT-5의 영향이 완전히 파악되기까지 최소 하루가 걸릴 것으로 추산합니다. 이는 GPT-3와 같은 이전의 획기적인 돌파구와 유사한 패턴입니다. GPT-5와 GPT-4는 업데이트와 다른 사용 사례를 통해 개선되기 전까지 상당한 반발을 겪었습니다. 이 모델의 성공 여부는 일상적인 워크플로우에서 얼마나 유용하느냐에 달려 있으며, 전 세계에는 약 7억 명의 주간 ChatGPT 사용자가 있습니다.

워튼 스쿨의 이단 몰릭(Ethan Mollick) 교수는 "GPT-5는 때로는 놀라운 일을, 때로는 의아한 일을 스스로 해냅니다. 이것이 바로 그 매력을 더하는 요소입니다. 이는 여전히 기술 관료주의적이며, 약간은 불쾌한 접근 방식입니다. 이런 것을 공중보건 영역의 일부로 '흥미롭다'고 부르는 것은

가장 똑똑한 암호화폐 전문가들이 이미 우리 뉴스레터를 구독하고 있습니다. 참여하고 싶으신가요? 함께하세요.

이 기사 공유하기
Nellius Irene

Nellius Irene

Nellius는 비즈니스 관리 및 IT 학사 학위를 소지하고 있으며, 암호화폐 산업에서 5 년간의 경력을 쌓았습니다. 또한 비트코인 다다 (Bitcoin Dada) 를 졸업했습니다. Nellius 는 BanklessTimes, Cryptobasic, Riseup Media 등 주요 미디어 매체에 기고한 바 있습니다.

더 많은 뉴스 …