Annual billing keeps the same monthly credits for around 30% less.

See Plans

Gentagelige resultater: referencer, seeds og de indstillinger der betyder noget

Gentagelige resultater: referencer, seeds og de indstillinger der betyder noget

At få ét godt billede er at administrere held. At få tolv, der ligner de kommer fra samme fotografering, er en proces. Forskellen er, om du kaster prompts om igen eller styrer de ting, der faktisk gør output gentageligt.

Hvorfor den samme prompt giver forskellige billeder

Billedmodeller starter fra tilfældig støj og former den efter din prompt. Ændrer du startstøjen, får du et andet billede ud af de samme ord. Den tilfældighed er grunden til, at det er let at udforske og svært at være konsekvent.

Alt herunder er en måde at fjerne tilfældighed fra én del af processen, så modellen kun improviserer, hvor du vil have det.

Referencer er den stærkeste kontrol

Ord beskriver; referencer viser. Findes motivet, fjerner det at levere det via billede til billede modellens frihed til at genopfinde det. Det er langt mere pålideligt end nok så mange stablede tillægsord.

Hvor mange referencer en model tager imod, svinger meget. GPT Image 2 og GPT Image 2.5 tager op til seksten. Nano Banana 2 tager fjorten, Seedream 5 Pro ti, Nano Banana Pro og flere andre otte. Nogle få modeller tager præcis én.

Hvad der hører til i hver plads

Et sæt der virker: to eller tre vinkler af motivet, ét billede der bærer det lys, du vil have, og ét der bærer omgivelserne eller overfladen. Fem referencer valgt af forskellige grunde slår tolv næsten ens, som mest lærer modellen at lave gennemsnit.

Behold det samme referencesæt gennem en serie. At skifte ét billede ud mellem renderinger er den mest almindelige årsag til en serie, der næsten passer sammen.

Seeds: gentagelsesknappen

Et seed låser startstøjen. Samme seed, samme prompt, samme indstillinger, samme model giver dig det samme billede igen. Skift ét ord, og du får en kontrolleret variation frem for et nyt terningkast.

Ikke alle modeller viser det. Blandt dem der gør, lader Qwen, Midjourney Diffusion, Ideogram og Wan-modellerne dig sætte det direkte. Når det er tilgængeligt, er arbejdsgangen: udforsk uden seed, til noget er tæt på, notér seedet for den rendering, og itererér så med det låst, mens du justerer formuleringen.

Fejlen er at låse et seed for tidligt. Et seed fastlåser en komposition, du endnu ikke har valgt.

Guidance og trin, i almindeligt sprog

IndstillingHvad den ændrerFornuftigt interval
Guidance-skalaHvor bogstaveligt modellen følger promptenMidt i intervallet; høje værdier virker stive
Inference-trinHvor længe den forfiner, før den stopperStandard, medmindre resultatet ser ufærdigt ud
Strength (billede til billede)Hvor langt den må afvige fra din referenceLav for at beholde motivet, høj for at omstile
Negativ promptHvad der skal undgåsKort og konkret, ikke en ønskeliste

Guidance er den, folk skruer for meget på. Skruet højt op tvinger den bogstavelig lydighed igennem og koster som regel naturlighed — hårde kanter, stive positurer, overmættet lys. Ignorerer modellen noget vigtigt, er løsningen næsten altid en klarere prompt eller et referencebillede, ikke et højere tal.

Strength er den, folk bruger for lidt. I billede til billede er den knappen mellem "pift det her op" og "fortolk det her på ny". Hvis dit produkt bliver ved med at skifte form, er strength for høj.

At skrive en prompt, der overlever en ny kørsel

En gentagelig prompt nævner fire ting: motivet, lyset, beskæringen og hvad der ikke må være der. Alt vagere bliver udfyldt forskelligt hver gang.

Sammenlign "et flot produktfoto af en flaske, professionelt" med "en mat keramikflaske på mørk skifer, ét blødt hovedlys fra venstre, lav dybdeskarphed, ingen tekst, ingen refleksioner på etiketten". Den anden er kedelig at læse og kommer ensartet tilbage.

Hold strukturen fast gennem en serie, og ændr kun den variable del. Skifter motivet, mens lys og beskæring skal blive, er det kun de ord, der må flytte sig.

Ensartethed på tværs af en serie

Til en serie der skal hænge sammen: lås modellen, lås billedformatet, lås referencesættet, lås lyssætningen, og varier kun motivet eller vinklen. Kør dem i én arbejdsgang i stedet for over dage, for din egen formulering driver mere end modellen gør.

Opløsningen bør også være konstant inden for et sæt. At blande et 4K-hovedbillede med 1K-støttebilleder er fint; at blande 1K og 2K i billeder, der vises ved siden af hinanden, kan ses i detaljen. Hvilket niveau til hvilken plads dækker vores guide til ramme og opløsning.

Når resultatet stadig ikke falder til ro

Bliver et motiv ved med at mutere trods referencer, er modellen måske bare ikke den rigtige — referencegrænser og evnen til at følge anvisninger varierer skarpt i kataloget. Ser detaljer udtværede ud, er opløsningen mere sandsynlig årsag end prompten. Kommer tekst i billedet ud som volapyk, er det et modelvalg: Ideogram er bygget til typografi, og ingen prompt retter det andre steder.

Og er billedet rigtigt bortset fra ét element, så stop med at generere. Fjern elementet med objektfjernelse, eller ret baggrunden med baggrundsværktøjerne. Den grænse behandlede vi i at rydde op i billeder.

En løkke der konvergerer

Udforsk billigt på en model til 2 kreditter uden seed, indtil kompositionen er rigtig. Notér seedet, hvis modellen tilbyder et. Gå videre til tekst til billede eller billede til billede på den model, der passer til destinationen, med den samme formulering. Tilføj referencer for alt, der skal forblive nøjagtigt. Ændr én variabel pr. kørsel, aldrig tre.

De fleste opgaver lander sådan efter tre-fire renderinger. Arbejdsrummet holder prompt, referencer og indstillinger ét sted, mens du skifter motor, og abonnementerne viser, hvad hver af de kørsler trækker fra din saldo. Er du stadig ved at vælge motor, er denne sammenligning genvejen.

En promptskabelon værd at genbruge

Hold skelettet fast, og skift kun den variable del ud. Noget i retning af: motiv og materiale, så overflade eller omgivelser, så lysretning og -kvalitet, så dybdeskarphed, så undtagelserne.

Skrevet ud: "en mat keramikflaske på mørk skifer, ét blødt hovedlys fra venstre, lav dybdeskarphed, ingen tekst, ingen hårde refleksioner". Skal et andet produkt i samme sæt fotograferes, er det kun den første del, der ændres. Alt det, modellen bruger til at bygge looket, forbliver ord for ord identisk, og det er hele pointen.

Undtagelser hører til sidst og skal være konkrete. "Ingen tekst" virker. "Intet grimt" beskriver ikke noget, en model kan handle på.

Fejlfinding efter symptom

SymptomSandsynlig årsagLøsning
Motivet skifter mellem kørslerIngen reference, eller strength for højTilføj referencer; sænk strength
Resultatet virker stift eller overbelystGuidance skruet for højt opTilbage til midten af intervallet
Detalje udtværet i fuld størrelseOpløsning for lav til brugenKør igen i 2K eller 4K
Tekst i billedet er volapykForkert model til typografiBrug Ideogram
Serien passer ikke sammenPrompt eller referencer er drevetLås formuleringen og referencesættet; kør dem igen samlet
Ét element ødelægger et godt billedeForsøg på at løse det ved at regenerereFjern det i stedet

Ændr én ting ad gangen

Den disciplin, der får alt ovenstående til at virke, er kedelig: én variabel pr. kørsel. Ændr seedet eller formuleringen eller modellen, aldrig to på én gang, ellers ved du ikke, hvilken ændring der gav forbedringen.

Det føles langsommere og bliver færdigt tidligere. Tre bevidste kørsler slår som regel et dusin håbefulde, og på de billige motorer koster de tre kørsler seks kreditter.