OpenAI ha accelerato significativamente le proprie capacità di generazione d'immagini con il rilascio di ChatGPT Images 2.5, un modello progettato per abbattere la latenza fino al 50% rispetto alla versione precedente. Oltre alla pura velocità, questo aggiornamento introduce un cambio strategico nel modo in cui OpenAI espone la sua tecnologia agli sviluppatori: per la prima volta, l'API è divisa in due livelli distinti—GPT-Image-2.5 Flare e GPT-Image-2.5 Sunburst—permettendo agli utenti di scegliere tra generazione rapida e controllo creativo ad alta precisione.
Velocità vs Precisione: la nuova stratificazione dell'API
L'introduzione di Flare e Sunburst rispecchia la logica a livelli che OpenAI aveva precedentemente applicato ai suoi modelli linguistici. Questa stratificazione permette agli sviluppatori di ottimizzare le risorse in base a specifiche esigenze aziendali, evitando di pagare la "tassa temporale" dei modelli ad alta precisione quando non sono necessari.
- GPT-Image-2.5 Flare: Posizionato come modello predefinito per la maggior parte delle applicazioni, Flare si concentra sulla velocità e sulla generazione batch. È ideale per contenuti social, prototipazione rapida e generazione di immagini ad alta frequenza. I primi test suggeriscono che Flare possa essere da 2 a 4 volte più veloce di GPT-Image-2, con miglioramenti notevoli nella generazione di sfondi trasparenti—una funzionalità che evolve il supporto nativo per i PNG introdotto in GPT-Image-2.
- GPT-Image-2.5 Sunburst: Questo modello privilegia il controllo dell'editing e l'estremo dettaglio rispetto alla velocità. È mirato specificamente ad asset di livello professionale, immagini di prodotto e flussi di lavoro creativi complessi in cui il tempo di generazione è secondario rispetto alla qualità finale.
L'API supporta diverse risoluzioni, con un lato massimo di 3840 pixel e un numero totale di pixel compreso tra 655.360 e 8.294.400.
Strumenti di design iterativo: Sketch e Template
All'interno dell'interfaccia di ChatGPT, Images 2.5 introduce una suite di strumenti progettati per trasformare la generazione di immagini da un'esperienza a "tentativi" verso un flusso di lavoro professionale e iterativo.
Il nuovo strumento Sketch permette agli utenti di fornire input disegnati a mano come riferimento, offrendo all'AI una guida strutturale per la composizione. A questo si affianca la funzione Template, che offre punti di partenza per formati specifici come volantini o display di prodotti. Inoltre, gli utenti possono ora lasciare commenti direttamente sulle immagini per identificare con precisione le aree che necessitano di modifiche, migliorando drasticamente l'accuratezza degli editing multi-turno.
Coerenza ed espansione dell'ecosistema
Un miglioramento tecnico critico della versione 2.5 è la capacità di preservare i soggetti delle foto di riferimento in modo più coerente. Questo risolve un problema storico della generazione AI: mantenere l'identità di persone o oggetti quando vengono inseriti in nuove scene o renderizzati in stili diversi.
La tecnologia si sta inoltre espandendo oltre l'ecosistema OpenAI. I modelli Flare e Sunburst sono ora disponibili all'interno di Adobe Firefly, integrando queste velocità di generazione superiori e i controlli di editing più stringenti direttamente nella suite creativa di Adobe.
Per garantire trasparenza e sicurezza, i nuovi modelli includono i watermark C2PA e SynthID, fornendo un livello di provenienza per i contenuti generati dall'AI. L'aggiornamento è attualmente in fase di rilascio su desktop, mobile e web per gli utenti di ChatGPT, ChatGPT Work e Codex in tutti i livelli di accesso.

Ancora nessun commento. Puoi essere il primo!