Ho testato ChatGPT Images 2.5: i pattern di rumore sono pessimi e il pubblico di Reddit mi ha creduto.
Reddit aveva ragione? Ho testato ChatGPT Images 2.5 e ho confermato che i pattern di rumore sono davvero pessimi. Scoprite la mia esperienza completa e perché la qualità è così deludente.
Le cose più importanti che devi sapere
- ChatGPT Images 2.5 soffre di un persistente "rumore" o "granulosità" nelle immagini, che le fa apparire ruvide e sabbiose, contraddicendo le promesse di OpenAI di "dettagli più nitidi e texture più ricche".
- I test dell'autore, in linea con le lamentele degli utenti di Reddit, hanno mostrato una persistente texture granulosa nel cielo, negli sfondi in studio e nella pelle, anche quando venivano richieste sfumature di colore delicate.
- Nonostante la velocità e l'efficienza di Images 2.5, la sua predilezione per le texture granulose indebolisce il realismo promesso e spinge alcuni risultati nella "valle del bizzarro", rendendolo quasi inutilizzabile per la produzione per alcuni utenti.
OpenAI ha lanciato questa settimana ChatGPT Images 2.5 , vantando notevoli miglioramenti al suo generatore di immagini basato sull'intelligenza artificiale . L'azienda afferma che il suo ultimo modello offre dettagli più nitidi, un'illuminazione più naturale e composizioni più ricche, migliorando al contempo la conservazione di persone e oggetti rispetto alle immagini di riferimento. Dovrebbe inoltre generare immagini fino al 50% più velocemente e seguire istruzioni visive complesse con maggiore affidabilità.

Sono presenti anche diverse aggiunte davvero utili. Images 2.5 offre una funzione Sketch per convertire schizzi grezzi in immagini finite, modelli per elementi come poster e fotografie di prodotti, e la possibilità di lasciare commenti direttamente sull'immagine quando viene richiesta la modifica. OpenAI lo descrive come il suo modello di immagine più recente, uno standard piuttosto elevato per qualcosa che inevitabilmente richiede di disegnare draghi prima di colazione.
Ma la reazione iniziale non è stata così positiva come previsto. Un utente di Reddit ha offerto forse la recensione più memorabile finora: "I pattern di rumore sono orribili". Un altro ha guardato un'immagine generata dall'IA e ha concluso: "Questa... sembra terribile". La critica è facile da capire: riguarda tutta la questione del rumore.
Tutto si intensificò, problema compreso.
Il rumore è una critica piuttosto vaga quando si parla di immagini generate dall'IA . In fotografia, di solito si riferisce alle macchie o alla grana che compaiono in un'immagine a causa di una discrepanza tra illuminazione e tecnica fotografica. Ma le immagini generate dall'IA possono produrre qualcosa di simile senza mai passare attraverso una fotocamera. Tutto appare ruvido e sabbioso e, per qualche ragione, nulla sembra pulito.
Il rumore è particolarmente dannoso perché può mascherarsi da dettaglio. I modelli generativi hanno imparato che le fotografie contengono grana, texture, sottili variazioni di colore e occasionali imperfezioni. Images 2.5 sembra insolitamente desideroso di riprodurre questi segnali, proiettandoli talvolta sul cielo, sulla pelle, sulle piume e sugli sfondi dello studio.
Ciò contraddice i "dettagli più nitidi" e le "texture più ricche" promesse da OpenAI. Nonostante l'enfasi su un'illuminazione e texture più naturali, alcuni utenti ritengono che ChatGPT Images 2.5 non abbia raggiunto gli obiettivi prefissati.
Una persona ha scritto: "Devono eliminare queste distorsioni dovute al rumore. Rendono il modello praticamente inutilizzabile in produzione". Ci sono elogi mescolati a critiche, ma siamo ben lontani dal plauso universale che OpenAI probabilmente desidererebbe.
Volevo verificare se il problema si estendesse oltre gli screenshot che circolavano su Reddit, quindi ho testato alcune immagini con dettagli fini e aree che dovrebbero rimanere visivamente uniformi, per vedere se si insinuava della grana. Mi sono anche assicurato che le mie istruzioni specificassero gradazioni tonali uniformi e la rimozione di qualsiasi rumore visivo.

Ho iniziato con l'immagine di una tazza in uno studio fotografico. A prima vista, i dettagli del pavone, dei fiori, della frutta e del paesaggio che si intrecciano sulla ceramica virtuale sono sbalorditivi. Ma a un'osservazione più attenta, lo sfondo grigio dello studio rivela una trama granulosa continua, mentre alcuni dei motivi più piccoli iniziano a svanire in un caos disordinato. Il modello ha prodotto una grande quantità di informazioni visive senza definire sempre chiaramente quali parti meritano attenzione.
Un problema simile si è presentato quando ho richiesto l'immagine di un barbagianni al crepuscolo. Le piume offrono un'opportunità ideale per mostrare la complessità, e Images 2.5 ha gestito bene la situazione. Le singole strutture rimangono visibili sulle ali e sul viso, gli artigli appaiono realistici e l'animale evita quell'effetto "plastico" che spesso caratterizzava le immagini di animali selvatici generate dall'IA in passato.
Dietro il gufo, appare un cielo che dovrebbe essere l'equivalente visivo di un foglio di carta bianco immacolato. Invece, la tenue area blu presenta una sottile e distinta grana. Questo non rovina completamente l'immagine, ma una volta che l'ho notato, non ho potuto fare a meno di notarlo.

Leggendaria confusione granulare
Ho pensato che una scena fantasy potesse essere migliore, una che non si basasse su fotografie reali di un cavallo alato o di un drago. Ma sebbene questi elementi coesistano con un arcobaleno su un lago di montagna in una composizione sorprendentemente coerente, il problema è immediatamente evidente. L'eccessiva nitidezza conferisce all'immagine l'aspetto di una schermata di caricamento di un videogioco.
Il cielo azzurro pallido appare con una texture tenue anziché con la gradazione tonale perfettamente pulita che mi aspetterei da un'immagine resa in modo impeccabile. Allo stesso tempo, i dettagli delle montagne, degli alberi e delle creature appaiono sgranati e sovraesposti a un'osservazione ravvicinata. Non è un disastro, ma l'immagine dà l'impressione di una fotografia pesantemente ritoccata.
Sono rimasto molto soddisfatto del risultato ottenuto dalla mia richiesta di ritrarre due amici su un tetto al tramonto. L'immagine si è avvicinata molto al realismo promesso, con espressioni convincenti e un effetto di gravità che sembrava autentico sui loro abiti. Tuttavia, osservandola attentamente per più di un minuto, si nota chiaramente la grana che pervade il cielo crepuscolare, i capelli e la pelle. Questo è particolarmente evidente perché non c'era una scarsa illuminazione né un sensore difettoso della fotocamera. Se il cielo crepuscolare appare granuloso, questa grana è una scelta creativa o un difetto del modello, non il risultato delle inevitabili leggi della fisica quando si scatta una foto in condizioni di scarsa illuminazione.

Osservando nello specifico queste quattro immagini in termini di nitidezza, devo unirmi alle lamentele su Reddit. È presente una texture fine e persistente nel cielo, negli sfondi in studio e nelle aree in penombra. La nitidezza è una caratteristica facile da sfruttare a fini di marketing perché fa un'ottima figura nella galleria di lancio, ma forse si è esagerato, portando alcuni risultati di ChatGPT Images 2.5 nella cosiddetta "valle perturbante".
Images 2.5 è veloce, adattabile e spesso efficiente, ma la sua propensione per le texture granulose compromette il realismo che dovrebbe catturare. Forse il prossimo aggiornamento si renderà conto che la cosa più impressionante che un generatore di immagini basato sull'IA può inserire in una porzione di immagine è essenzialmente il nulla.
Cosa ne pensi? Partecipa al sondaggio qui sopra per esprimere la tua opinione.
I commenti sono chiusi.