Annual billing keeps the same monthly credits for around 30% less.

See Plans

텍스트로 시작할까, 이미지로 시작할까: 작업의 출발점

텍스트로 시작할까, 이미지로 시작할까: 작업의 출발점

모든 작업은 같은 갈림길에서 시작하고, 낭비되는 크레딧의 대부분은 엉뚱한 갈래로 들어선 데서 나옵니다. 아무것도 없는 상태에서 그림을 말로 설명하는 일과, 이미 가진 그림을 고치는 일은 서로 다른 도구이며, 두 번째 도구는 지나치게 덜 쓰입니다.

규칙

최종 이미지의 어느 한 부분이라도 이미 존재한다면—제품, 로고, 공간, 얼굴, 스케치, 심지어 어제 나온 실패작이라도—이미지로 이미지 만들기에서 시작하세요. 아직 아무것도 없다면 텍스트로 이미지 만들기에서 시작합니다.

적어 놓고 보면 당연해 보입니다. 그런데 실제로는, 자기 제품을 한 번도 본 적 없는 모델에게 말로 설명한 뒤 올바른 형태로 유도하려고 렌더를 열다섯 번 돌립니다.

각 모드가 실제로 통제하는 것

텍스트로 이미지이미지로 이미지
당신이 주는 것설명한 장 이상의 사진 + 설명
당신이 통제하는 것피사체, 스타일, 프레이밍그 전부 + 대상 자체
맞히기까지의 시도피사체가 구체적이면 여러 번보통 한두 번
참조 슬롯없음모델에 따라 1~16개
적합한 용도콘셉트, 장면, 분위기, 배경제품, 인물, 브랜드 자산, 수정

같은 모델이라면 렌더 한 장 값은 동일합니다. 차이는 한 번의 가격이 아니라, 몇 번이 필요하냐입니다.

참조 이미지가 핵심입니다

모델이 받는 참조 장수는 사양표의 사소한 항목이 아니라 실제 역량 차이입니다. 어떤 모델은 딱 한 장만 받습니다. GPT Image 2와 GPT Image 2.5는 최대 열여섯 장. Nano Banana 2는 열네 장, Nano Banana Pro와 Seedream은 여덟에서 열 장입니다.

참조 한 장은 "이렇게 보이게 해줘"에 답합니다. 여덟 장은 "이게 그 제품이고, 이 각도들에서, 이 마감이며, 조명은 이렇게 원한다"에 답합니다. 제품 사진이 실제로 던지는 질문은 두 번째 쪽입니다.

슬롯에 무엇을 넣을까

쓸 만한 구성은 이렇습니다. 피사체의 각도 두세 장, 조명이나 분위기용 한 장, 바닥면이나 배경용 한 장. 같은 각도의 변주를 여덟 장 넣는 건 도움이 되지 않습니다. 모델은 평균을 내는 것이 아니라, 무엇이 중요한지 보여지고 있는 것입니다.

사람들이 자주 틀리는 경우

로고와 패키지. 설명만으로 당신의 로고를 그리게 하면 "로고처럼 생긴 무언가"가 나오고, 그건 틀린 것입니다. 참조로 넣어 주면 같은 모델이 제자리에 정확히 배치합니다.

같은 제품, 열두 번. 상세페이지에 필요한 건 비범함보다 일관성입니다. 텍스트로 만들면 그럴듯한 병이 열두 개 나오고, 참조 세트를 고정한 이미지 모드는 같은 병을 열두 가지로 찍어 줍니다.

"거의 맞는데 한 군데만". 가장 큰 함정입니다. 렌더가 90% 왔을 때 사람들은 프롬프트를 다시 써서 주사위를 다시 굴리고, 잘 나온 부분까지 포함해 전부를 다시 무작위로 만듭니다. 좋은 렌더를 참조로 되먹이고 바뀔 부분만 묘사하면 마음에 든 것이 남습니다.

배경. 피사체를 오려서 다른 곳에 두는 일은 생성 문제가 아닙니다. 배경 제거, 투명 배경, 배경색 도구가 피사체를 전혀 건드리지 않고 해냅니다.

텍스트로 이미지가 정말 맞는 경우

나중에 합성할 배경과 환경. 선택지를 보는 것 자체가 목적인 콘셉트 작업. 현실의 대상이 없는 일러스트와 양식화된 그림. "놀라게 해 줘"가 위험이 아니라 장점인 모든 경우.

탐색을 하기에도 더 싼 자리입니다. 2크레딧 모델은 바로 이걸 위해 있습니다. 한 아이디어를 여섯 가지 프레이밍으로 돌리고, 하나 고른 뒤에야 참조와 더 나은 모델을 데려와 완성합니다.

실제로 통하는 혼합 작업 흐름

이 플랫폼에서 완성되는 이미지 대부분은 단일 프롬프트가 아니라 하나의 루프에서 나옵니다. 값싼 모델의 텍스트 모드로 구도를 잡습니다. 가장 좋은 컷을 고릅니다. 이미지 모드로 옮겨 그 컷과 실제 제품을 함께 참조로 되먹이고, 바뀌어야 할 것만 묘사합니다. 마지막은 놓일 자리에 맞는 모델로 돌립니다.

이렇게 두세 번 도는 편이 열두 번 다시 굴리는 것보다 낫고 더 쌉니다. 같은 루프의 파라미터 쪽—시드, 가이던스, 실행 사이에 고정할 가치가 있는 것—은 재현 가능한 결과에서 다뤘습니다.

작업 도중에 바꿔도 처음부터 다시가 아닙니다

워크스페이스에서 프롬프트 입력창은 두 모드에서 동일합니다. 참조 이미지를 더하는 행위가 곧 한쪽에서 다른 쪽으로 옮겨 가는 동작입니다. 프롬프트를 다시 쓸 필요가 없고 모델 목록도 그대로이므로, 이미 해 둔 비교가 그대로 유효합니다.

열아홉 개 모델이 두 모드를 모두 지원하며 참조 한도만 다릅니다. 목록은 카탈로그에 있고, 가격은 어떤 모드를 썼든 렌더 단위입니다. 그러니 이 선택이 바꾸는 것은 렌더가 몇 번 필요하냐뿐이고, 보통 그게 예산의 전부입니다.

같은 작업, 두 가지 방식으로

구체적인 비교입니다. 도자기 병 사진이 있고 이미지 세 장이 필요합니다. 흰 배경 상세 컷, 주방 장면, 그리고 와이드 배너.

접근단계결과
텍스트로만매번 병을 설명하고, 형태가 비슷해질 때까지 다시 굴림서로 다른 병 세 개, 어느 것도 당신 것이 아님
이미지로사진을 참조로 넣고, 배경과 프레임만 묘사병 하나, 배경 셋, 일관됨

두 번째 경로가 더 빨리 끝나기도 합니다. 각 이미지가 다섯 번이 아니라 한두 번에 끝나기 때문입니다. 렌더당 크레딧은 같지만, 합계는 비교가 되지 않습니다.

알아둘 만한 실패 양상

흔들리는 피사체. 렌더마다 제품의 형태가 달라집니다. 텍스트 모드에 있어선 안 될 때 거기 있거나, strength가 높아 모델이 참조를 다시 해석할 여지를 준 것입니다.

콜라주화. 서로 무관한 참조가 너무 많으면 그것들을 평균 낸 이미지가 나옵니다. 역할을 나눠 고른 다섯 장—각도, 각도, 조명, 바닥면, 분위기—은 작동하고, 비슷한 열두 장은 작동하지 않습니다.

덮어써 버린 성공. 거의 완벽한 렌더가 있었는데 프롬프트를 다시 쓰자 좋은 버전이 사라집니다. 좋은 렌더를 참조로 되먹이고 바뀔 부분만 묘사하세요.

도구로 해결했어야 할 프롬프트. "같은 이미지인데 배경만 흰색으로"는 렌더 한 장 값이지만, 도구 하나면 피사체를 건드리지 않고 끝납니다.

어떤 모델이 어떤 모드에 맞나

텍스트 모드에서는 값싸고 빠른 엔진이 가장 중요합니다. 시도 횟수가 쌓이는 곳이 탐색 단계이기 때문입니다. 이미지 모드에서는 참조 한도가 가능한 일을 결정합니다. 스타일 전이에는 슬롯 하나로 충분하지만, 여러 각도를 다루는 제품 작업에는 여덟 개 이상이 필요합니다.

모델 페이지에 두 수치가 모두 적혀 있고, 카탈로그에서 나란히 볼 수 있습니다. 모드를 바꿔도 작업 흐름의 나머지는 하나도 바꿀 필요가 없습니다. 같은 프롬프트, 같은 화면비 설정, 같은 감각입니다.