OpenAI GPT-5 riceve recensioni contrastanti nel primo giorno

- OpenAI ha lanciato GPT-5 dopo mesi di hype, promettendo grandi salti nel ragionamento, nella codifica e nella velocità.
- Le prime recensioni sono contrastanti: alcuni ne lodano le capacità, altri segnalano errori di matematica, ortografia e ragionamento.
- Gli utenti hanno espresso perplessità per la ridotta trasparenza e la perdita di modelli precedenti come GPT-4o.
Il CEO di OpenAI Sam Altman aveva anticipato GPT-5 per mesi. Ha affermato che era un modello avanzato, più intelligente, più veloce e capace di pensare a un "livello di dottorato". L'azienda ha posizionato quel lancio come un grande passo avanti per ChatGPT, destinato a portare a miglioramenti dell'intelligenza nella codifica, nel ragionamento e nell'accuratezza.
Ma le prime reazioni dipingono un quadro più confuso. Gli sviluppatori hanno elogiato il modello per la comprensione di prompt complessi e l'output di codice ben strutturato. Il primo tester Simon Willison ha descritto GPT-5 come "competente" e "occasionariamente impressionante", ma non un grande salto rispetto a GPT-4. Altri erano meno impressionati.
Diversi post sui social media si sono rapidamente trasformati in lamentele su numerosi errori fattuali, deboli abilità matematiche e, in alcuni casi, persino errori di ortografia di base. Noah Giansiracusa, professore di matematica alla Bentley University, ha definito il rilascio "deludente", notando che gli aggiornamenti in questione sembravano "più marginali di quanto avrei sperato."
Parte della confusione era dovuta all'architettura del modello. GPT-5 includerebbe un 'autoswitcher' per i varie dimensioni del modello, a seconda del suo compito. Questo risparmia elaborazione e significa che non si tocca sempre il GPT-5 completo, il che ha creato problemi a molte persone. Dopo aver risposto erroneamente a una domanda con il sistema, l'agente con cui stava lavorando le ha istruito a "pensare più a fondo" su quante lettere "b" ci sono in blueberry. Dopo quel feedback, ha risposto correttamente quando interrogato.
Gli utenti si ribellano e OpenAI risponde
La frustrazione potrebbe riversarsi su Reddit e X venerdì. E sebbene alcuni utenti odiano il fatto che non saprebbero chi o persino quale modello abbia generato il testo, molti sentivano che l'inferenza era tutto e che GPT5 ha sostituito i vecchi preferiti di cui si fidavano. Alcuni hanno detto che la qualità è stata influenzata, la scrittura non è buona come GPT-4.5, che hai concordato dovrebbe essere, e alcune cose creative e tecniche sono peggiorate.
Questa chat ha portato il CEO di OpenAI a partecipare a un "Ask Me Anything" su Reddit per affrontare le critiche. Ha affermato che un bug nell'autoswitcher significava che GPT-5 funzionava al di sotto del suo pieno potenziale nel primo giorno. Ha promesso di essere più trasparente nelle future transizioni dei modelli: "da oggi in poi, GPT-5 dovrebbe apparire sempre più intelligente. OpenAI ha anche promesso di ridistribuire modelli precedenti come GPT-4o per coloro che hanno espresso una preferenza, uno sforzo per placare i critici più rumorosi.
Il fatto che abbia dovuto agire così rapidamente evidenzia quanto fossero grandi in gioco. Oggi, OpenAI è in una gara sfrenata con concorrenti come Anthropic, Google DeepMind e persino xAI di Elon Musk. Con tutta questa concorrenza, un piccolo errore e presto il tuo concorrente fa un passo avanti.
La competizione si intensifica nella corsa all'IA
Anche con tali differenze, l'accoglienza di GPT-5 è stata tiepida, ma ciò non ha impedito che venisse posizionata al primo posto su LMArena, una classifica guidata dagli utenti per i modelli di addestramento. Sebbene non fosse quello che considereremmo oggi programmabile, era estremamente veloce ed espressivo, supportando query grandi e complesse. Tuttavia, altri benchmark hanno mostrato un panorama di problemi diverso e più sfidante. Grok 4 di xAI di Musk ha ottenuto un punteggio così alto su ARC-AGI-2 (un insieme di test per il ragionamento avanzato) da presentare una sfida significativa alla supremazia di OpenAI.
Alcuni analisti del settore ipotizzano che ci vorrà almeno un giorno prima che gli effetti di GPT-5 siano pienamente compresi, simile ai precedenti breakthrough della società, come GPT-3. GPT-5 e GPT-4 hanno ricevuto un forte backlash prima di vedere miglioramenti negli aggiornamenti e in altri casi d'uso. Il modello ha il potenziale per avere successo (o fallire) a seconda di quanto sia utile per il flusso di lavoro quotidiano delle persone, e ci sono quasi 700 milioni di utenti settimanali di ChatGPT in tutto il mondo.
Nelle parole del professore di Wharton Ethan Mollick: "GPT-5 fa semplicemente cose, a volte cose incredibili, a volte cose puzzolenti, interamente da solo. È questo a renderlo così intrigante. È ancora un approccio tecnocratico, leggermente inquietante, definire cose come questa parte della sfera della salute pubblica 'interessante'"
Non limitarti a leggere le notizie sulle criptovalute. Comprendile. Iscriviti alla nostra newsletter. È gratuita.

Nellius Irene
Nellius è una laureata in Gestione Aziendale e Informatica con cinque anni di esperienza nel settore delle criptovalute. È anche diplomata presso Bitcoin Dada. Nellius ha contribuito a principali testate giornalistiche, tra cui BanklessTimes, Cryptobasic e Riseup Media.
















