Annual billing keeps the same monthly credits for around 30% less.

See Plans

Testo in immagine o immagine in immagine: da dove partire

Testo in immagine o immagine in immagine: da dove partire

Ogni lavoro comincia dallo stesso bivio, e la gran parte dei crediti sprecati nasce dall'imboccare il ramo sbagliato. Descrivere un'immagine dal nulla e modificare un'immagine che hai già sono strumenti diversi, e il secondo è sottoutilizzato.

La regola

Se una qualsiasi parte dell'immagine finale esiste già — un prodotto, un logo, una stanza, un volto, uno schizzo, perfino un brutto render di ieri — parti da immagine in immagine. Se non esiste ancora nulla, parti da testo in immagine.

Scritto così sembra ovvio. Nella pratica c'è chi descrive a parole il proprio prodotto a un modello che non l'ha mai visto, e poi brucia quindici render nel tentativo di convincerlo della forma giusta.

Che cosa controlla davvero ciascuna modalità

Testo in immagineImmagine in immagine
Tu fornisciUna descrizioneUna o più immagini, più una descrizione
Tu controlliSoggetto, stile, inquadraturaTutto questo, più la cosa in sé
Tentativi per centrarlaDiversi, se il soggetto è specificoDi solito uno o due
Slot di riferimentoNessunoDa 1 a 16, secondo il modello
Ideale perConcept, scene, atmosfere, sfondiProdotti, persone, asset di marca, revisioni

Sullo stesso modello costano uguale per render. La differenza non è il prezzo di un tentativo, ma quanti tentativi servono.

Le immagini di riferimento sono il punto

Quante referenze accetta un modello è una vera differenza di capacità, non una riga di scheda tecnica. Alcuni ne accettano esattamente una. GPT Image 2 e GPT Image 2.5 ne accettano fino a sedici. Nano Banana 2 ne accetta quattordici, Nano Banana Pro e Seedream da otto a dieci.

Una referenza risponde a «fallo somigliare a questo». Otto referenze rispondono a «questo è il prodotto, da queste angolazioni, con questa finitura, e questa è la luce che voglio». La seconda è la domanda che la fotografia di prodotto pone davvero.

Cosa mettere negli slot

Un set utile è: due o tre angolazioni del soggetto, un'immagine per luce o atmosfera e una per la superficie o l'ambiente. Aggiungere otto varianti della stessa angolazione non serve. Il modello non sta facendo una media: gli si sta mostrando che cosa conta.

I casi che quasi tutti sbagliano

Loghi e packaging. Un modello a cui chiedi di disegnare il tuo logo da una descrizione produrrà qualcosa a forma di logo, e sbagliato. Fornisciglielo come riferimento e lo stesso modello lo colloca correttamente.

Lo stesso prodotto, dodici volte. Le schede prodotto hanno bisogno di coerenza più che di genialità. Testo in immagine dà dodici bottiglie plausibili; immagine in immagine con un set fisso di riferimenti dà una bottiglia fotografata in dodici modi.

«Quasi giusto, una modifica». È la voce più pesante. Quando un render è al 90%, si riscrive il prompt e si rilancia, il che rimescola tutto, comprese le parti che funzionavano. Rimettere il render buono come riferimento e descrivere solo la modifica conserva ciò che ti piaceva.

Gli sfondi. Scontornare un soggetto e metterlo altrove non è un problema di generazione. Gli strumenti rimozione sfondo, sfondo trasparente e colore dello sfondo lo fanno senza toccare il soggetto.

Quando testo in immagine è davvero la scelta giusta

Sfondi e ambienti che comporrai in seguito. Lavoro di concept in cui il punto è vedere opzioni. Illustrazione e arte stilizzata senza referente reale. Tutto ciò in cui «sorprendimi» è un pregio e non un rischio.

È anche il posto più economico per esplorare. I modelli da 2 crediti esistono esattamente per questo: lancia sei inquadrature di un'idea, scegline una, e solo allora porta i riferimenti e un modello migliore per eseguirla.

Un flusso ibrido che funziona

La maggior parte delle immagini finite su questa piattaforma nasce da un ciclo, non da un singolo prompt. Abbozza la composizione con testo in immagine su un modello economico. Scegli l'inquadratura migliore. Passa a immagine in immagine, rimetti quell'inquadratura come riferimento insieme al prodotto reale e descrivi solo ciò che deve cambiare. Fai il finale sul modello adatto alla destinazione.

Due o tre passaggi così battono dodici rilanci, e costano meno. Risultati ripetibili copre il lato parametri dello stesso ciclo: seed, guidance e cosa conviene fissare fra un'esecuzione e l'altra.

Cambiare a metà lavoro senza ricominciare

Nello spazio di lavoro il campo del prompt è identico nelle due modalità; aggiungere un'immagine di riferimento è ciò che ti sposta dall'una all'altra. Nulla del tuo prompt va riscritto e l'elenco dei modelli resta lo stesso, quindi un confronto che hai già fatto vale ancora.

Diciannove modelli supportano entrambe le modalità, con limiti di riferimento diversi. Il catalogo li elenca, e il prezzo è per render a prescindere dalla modalità usata: l'unica cosa che la scelta cambia è quanti render ti servono. Che di solito è l'intero budget.

Lo stesso lavoro, fatto in due modi

Un confronto concreto. Hai la foto di una bottiglia in ceramica e ti servono tre immagini: uno scatto da scheda su fondo bianco, una scena in cucina e un banner largo.

ApproccioPassiRisultato
Solo testo in immagineDescrivere la bottiglia ogni volta; rilanciare finché la forma si avvicinaTre bottiglie diverse, nessuna è la tua
Immagine in immagineDare la foto come riferimento; descrivere solo ambiente e inquadraturaUna bottiglia, tre ambienti, coerenti

La seconda strada finisce anche prima, perché ogni immagine va a segno in uno o due tentativi invece di cinque. Il costo in crediti per render è identico; il totale non ci si avvicina nemmeno.

Modalità di fallimento da riconoscere

Il soggetto che deriva. Il tuo prodotto cambia forma fra un render e l'altro. O sei in testo in immagine quando non dovresti, oppure la strength è alta al punto da lasciare che il modello reinterpreti il riferimento.

Il collage. Troppi riferimenti scollegati producono un'immagine che ne fa la media. Cinque riferimenti scelti per compiti diversi — angolazione, angolazione, luce, superficie, atmosfera — funzionano; dodici simili no.

La vittoria sovrascritta. Un render è quasi perfetto, riscrivi il prompt e la versione buona sparisce. Rimetti il render buono come riferimento e descrivi solo la modifica.

Il prompt che doveva essere uno strumento. Chiedere «la stessa immagine ma con sfondo bianco» costa un render intero, mentre uno strumento lo fa senza toccare il soggetto.

Quali modelli si adattano a quale modalità

Per testo in immagine contano soprattutto i motori economici e veloci, perché è nell'esplorazione che i tentativi si accumulano. Per immagine in immagine è il limite di riferimenti a decidere cosa è possibile: uno slot basta per un trasferimento di stile, ma il lavoro di prodotto con più angolazioni ne richiede otto o più.

Le pagine dei modelli riportano entrambi i numeri, e il catalogo li mostra affiancati. Nient'altro del tuo flusso deve cambiare fra le due modalità: stesso prompt, stesse impostazioni di proporzione, stesso equilibrio.