Puntata 065
Puntata 65 — Prima immagine generata
Livello: 🧓 Babbano Boomer · Capitolo 6 · Foto e immagini
Hai sempre voluto vedere “un gatto vestito da astronauta su Marte mentre suona la fisarmonica”. Adesso si può. In 10 secondi. E va bene.
Il salto dalla foto al disegno
Finora abbiamo usato l’AI per capire le foto. Ora le chiediamo di fare le foto — anzi, di inventarle. Le AI che lo fanno si chiamano modelli di generazione di immagini: Dall-E (di OpenAI, dentro ChatGPT), Imagen (Google, dentro Gemini), Midjourney, Stable Diffusion, Flux, Adobe Firefly.
Per noi Babbani, la cosa più semplice è usarli dentro ChatGPT, Gemini o Copilot: scrivi “creami un’immagine di…” e in 10 secondi te la mostra. Niente da scaricare, niente da imparare.
Il primo prompt: il famoso gatto astronauta
Apri ChatGPT (o Gemini, o Copilot). Scrivi esattamente:
“Creami un’immagine: un gatto rosso vestito da astronauta, mentre cammina sulla Luna tenendo una bandiera italiana. Stile fotografico realistico.”
Aspetta 10-20 secondi. Boom: vedi l’immagine.
Congratulazioni. Hai appena creato un’opera che 5 anni fa avrebbe richiesto un grafico, 3 giorni e 800€. Adesso costa zero (se sei nel piano free) o pochi centesimi (se sei nel piano a pagamento).
Anatomia di un buon prompt-immagine
Più sei preciso, meglio l’AI capisce. Le 4 cose da specificare:
1. SOGGETTO (cosa)
Un gatto rosso / una donna anziana / una pizza margherita / il Duomo di Milano
2. AZIONE / CONTESTO (cosa fa, dove)
che cammina sulla Luna / mentre legge un libro su una panchina / fotografata dall’alto / illuminato dal tramonto
3. STILE (come deve essere disegnata)
Stile fotografico realistico / cartone animato in stile Disney / dipinto a olio classico / acquerello / fumetto manga / disegno a matita
4. DETTAGLI (per renderla unica)
tenendo una bandiera italiana / con un piccolo cappello rosso / sfondo sfocato / luce calda / colori pastello
10 prompt-esempio per cominciare
Copia, modifica, divertiti:
- “Un golden retriever con gli occhiali da vista che legge il giornale al bar, stile fotorealistico.”
- “Un piatto di spaghetti al pomodoro fotografato dall’alto, luce calda, stile rivista di cucina.”
- “Il Colosseo al tramonto con un drago che ci vola sopra, stile cinematografico.”
- “Un bambino di 5 anni che dipinge un quadro, stile cartone Pixar.”
- “Cartolina vintage di Roma anni ‘60, con la Vespa e la Fontana di Trevi.”
- “Un cestino di pane appena sfornato in una panetteria toscana, fotografia gourmet.”
- “Un robot simpatico che impasta la pizza, stile illustrazione per libri per bambini.”
- “Un paesaggio invernale delle Alpi italiane all’alba, stile pittura ad olio.”
- “Logo per la mia pizzeria di quartiere ‘Da Mario’, stile retrò anni ‘50, colori rosso bianco e verde.”
- “Un gattino tigrato che dorme su una pila di libri in una libreria antica, luce dorata.”
Cosa NON funziona (ancora)
⚠️ Volti specifici di persone reali: chiedere “crea una foto di Vasco Rossi” → la maggior parte degli LLM rifiuta (privacy/diritti). Per personaggi famosi storici (Leonardo, Garibaldi) a volte funziona.
⚠️ Riprodurre fedelmente loghi noti o personaggi protetti (Topolino, Hello Kitty, Pokémon, Coca-Cola): l’AI farà qualcosa di “simile” ma con varianti, per evitare violazioni di copyright.
⚠️ Mani con 5 dita esatte: vedi puntata 69. È il classico errore.
⚠️ Testo scritto dentro l’immagine: spesso esce con errori di ortografia (es. “PIZZERIA” diventa “PIZERRIA”). I modelli più recenti sono migliorati molto ma non sono perfetti.
⚠️ Realismo perfetto: a volte i dettagli (peli del gatto, gioielli, occhi) sono quasi realistici ma con qualcosa di “strano” che il cervello umano riconosce subito (la uncanny valley).
Costi reali (2026)
- ChatGPT free: qualche immagine al giorno, gratis.
- ChatGPT Plus / Gemini Advanced / Copilot Pro (20-22€/mese): immagini quasi illimitate, qualità migliore.
- Midjourney / Adobe Firefly / Flux Pro: piani da 10-30€/mese per uso intensivo (più qualità, più controllo, ideale per chi disegna sul serio).
Per un Babbano: inizia col piano gratuito di ChatGPT o Gemini. Se ti appassiona, valuta il piano a pagamento.
La regola “tira e affina”
La prima immagine raramente è perfetta. Procedi così:
- Scrivi il prompt.
- Guardi il risultato.
- Non riformulare da zero. Dì all’AI cosa cambiare:
- “Bello, ma fammelo con la coda più lunga e lo sfondo più scuro.”
- “Quasi, ma cambia il colore del cappello in rosso.”
- “Tienilo quasi uguale, ma mettilo in inverno con neve.”
L’AI ricorda l’immagine precedente e la modifica. È come un grafico paziente che ascolta i tuoi feedback.
Cosa farne (idee pratiche)
- Auguri di compleanno personalizzati (vedi puntata 67)
- Avatar per WhatsApp/Facebook (puntata 68)
- Sfondo del telefono unico
- Cartoline per i nipoti
- Logo per la tua piccola attività
- Illustrazioni per la storia che vuoi scrivere a tuo nipote
- Foto di “famiglia immaginaria” dove tu, tua moglie e il cane siete supereroi (sì, esiste già una community di Babbani che lo fa)
TEST lampo
Vuoi creare un’immagine come regalo di compleanno per tua nipote di 7 anni, che ama i cavalli, il rosa e Frozen. Cosa scrivi?
👀 Spoiler: clicca per il prompt-tipo
“Crea un’immagine come biglietto di compleanno: un cavallo magico bianco con la criniera arcobaleno, sopra una collina innevata, sotto un cielo rosa al tramonto. Stile cartone animato per bambini, ispirato a Frozen (colori freddi azzurro/lilla + tocchi rosa). In alto, scritta in italiano ‘BUON COMPLEANNO GIULIA’ a caratteri morbidi e dorati. Inquadratura quadrata, adatta a stampa per biglietto.”
Tre cose ben fatte:
- Soggetto + stile preciso (cavallo + Frozen).
- Specifiche utili (scritta personalizzata, formato quadrato per stampa).
- Tieni il diritto di re-iterare: se la prima esce strana, “ottima, ma fai la criniera più lunga e aggiungi un piccolo glitter sulle ali”.
Stampi → cornice da 5€ → regalo unico al mondo. Costo: 0,30 di stampa.
Glossario lampo
- Modello di generazione immagini = un’AI specifica (Dall-E, Imagen, Midjourney, Flux) addestrata a creare immagini da testo. Spesso integrata dentro le AI di chat.
- Uncanny valley = quella sensazione di “qualcosa non va” davanti a un’immagine quasi perfetta ma con un dettaglio strano (sguardo vuoto, mano deformata).
Take-away
Hai appena fatto qualcosa che era impossibile fino al 2022: descrivere un’immagine e vederla nascere. Non sei un grafico. Sei un Babbano. Va benissimo così.
➡️ Prossima puntata: Stili — cartone, foto, dipinto.