비 오는 광장에 거대한 노란 우산이 서 있는 장면을 요청했다고 해 봅시다. 우산이 화면을 가득 채워도 가까이 찍은 평범한 우산처럼 보일 수 있습니다. 주변 사람과의 크기 차이는 충분한데, 바닥에서 떠 있는 듯 어색할 수도 있습니다. 이런 결과를 고칠 때는 '더 크게'라는 말을 덧붙이기 전에 무엇과 비교되는지부터 살펴봅니다.
크기는 단어 하나로 전달되지 않습니다. 사람의 눈은 물건이 얼마나 큰지가 아니라 다른 것과 비교해 얼마나 큰지를 읽습니다. 그래서 프롬프트에도 크기 대신 관계를 적어야 합니다. 이 글은 기준물과 바닥, 겹침, 그림자, 시점을 문장으로 지정하는 방법을 다룹니다. 특별한 명령어는 필요 없고, 평소 쓰는 말이면 됩니다.
이 글에서 다루는 범위
Instagram 작가 Jessica(@aistudio.jessica)가 2026년 9월 22일 올린 릴스의 공개 댓글에는 거대한 대상과 작은 대상을 한 화면에 두는 구도의 약칭이 올라와 있었습니다. 이 글은 그 목록을 옮기지 않습니다. 아래 구성 틀과 장면별 문장은 이 아이디어를 바탕으로 DMS.Labs에서 새로 작성했습니다.
OpenAI의 이미지 프롬프트 가이드는 피사체의 상대적인 크기, 프레이밍, 상호작용을 구체적으로 적으라고 안내합니다. 수정할 때는 바꿀 것과 지킬 것을 나누고 한 번에 한 요소씩 고치라는 설명도 있습니다. 특별한 문법에 기대지 않아도 된다는 점, 카메라 사양을 정밀한 물리 시뮬레이션의 보장으로 받아들이지 말라는 설명도 같은 문서에 있습니다. 이 글의 방법은 그 안내를 거대 사물 구도에 적용한 것입니다.
크기를 숫자로 적어도 되는가
"우산의 높이는 10미터"처럼 숫자를 쓰고 싶어질 수 있습니다. 숫자는 구성 요청으로는 쓸 수 있습니다. 하지만 모델이 그 숫자를 계산해서 그린다고 믿으면 안 됩니다. "열 배", "세 배" 같은 표현을 쓰더라도 장면을 구성해 달라는 요청으로 받아들여야 합니다. 결과 이미지에서 실제 배율을 재어 확인한 것이 아니며, 그렇게 읽으셔도 안 됩니다. 숫자가 쓸모 있는 지점은 정확도가 아니라 방향입니다. "사람보다 훨씬 크다"보다 "사람 키의 열 배쯤"이라고 쓰면 대략의 단계가 전달됩니다.
공간의 관계를 문장으로 묶습니다
프롬프트를 쓰기 전에 아래 항목을 먼저 정해 둡니다.
- 기준물: 크기를 비교할 평범한 물건입니다. 어른 한 명, 자전거, 가로등처럼 누구나 크기를 아는 것을 고릅니다.
- 같은 바닥: 거대한 사물과 기준물이 같은 지면 위에 서 있다고 말합니다.
- 겹침: 둘 중 하나가 다른 쪽을 일부 가리게 합니다. 겹쳐야 앞뒤 거리가 읽힙니다.
- 접점 그림자: 사물이 땅에 닿는 곳에 빛에 맞는 그림자를 둡니다.
- 시점: 카메라의 높이와 보는 방향을 정하고 수정할 때 유지합니다.
기준물은 평범해야 합니다
기준물이 낯설면 비교가 성립하지 않습니다. 보통 키의 성인, 보통 크기의 자전거처럼 크기가 널리 알려진 대상을 쓰세요. 사람을 넣을 때는 익명의 성인이라고 적고, 얼굴이 중요하지 않다면 뒷모습이나 먼 거리로 두는 편이 안전합니다. 그리고 기준물을 거대한 사물의 바로 옆에 둡니다. 멀리 떨어져 있으면 눈이 둘을 같은 공간으로 읽지 않습니다.
같은 바닥에 세웁니다
확인할 오류 중 하나는 거대한 사물이 공중에 뜬 것처럼 보이는 현상입니다. 이를 막으려면 "같은 포장 바닥 위에 서 있다", "같은 지평선을 공유한다"처럼 지면과 시점이 같다고 직접 말합니다. 바닥의 재질을 구체적으로 적으면 더 좋습니다. 젖은 돌 포장, 회색 보도블록, 벽돌 마당처럼 질감이 있는 바닥은 사물이 놓일 자리를 만들어 줍니다.
겹침으로 거리를 만듭니다
거대한 사물이 배경의 일부를 가리게 하거나, 기준물이 사물의 앞쪽 가장자리를 가리게 하면 앞뒤 관계가 생깁니다. "거대한 우산의 지붕이 뒤쪽 가로등을 일부 가린다", "사람이 찻주전자의 가장자리 앞에 서서 일부를 가린다"처럼 적습니다. 어느 쪽이 앞인지를 문장으로 정해 두는 것이 요점입니다.
접점 그림자가 무게를 만듭니다
사물이 바닥에 닿는 부분에 작고 짙은 그림자가 있으면 그 물건이 실제로 놓여 있다는 인상이 생깁니다. 햇빛이 있는 장면이라면 사람의 그림자와 같은 방향으로 그림자가 떨어지게 합니다. 비 오는 날이라면 접점 주변의 젖은 바닥과 작은 물웅덩이를 적어 줄 수 있습니다. 접점이 어색하다면 바닥을 더 복잡하게 만들기 전에 이 부분부터 확인합니다.
시점은 한 번만 정하고 유지합니다
눈높이 시점인지 약간 올려다보는지 먼저 정하고, 수정할 때도 "카메라 각도는 그대로"라고 반복해 적습니다. 크기를 고치다가 카메라가 함께 움직이면 앞서 맞춘 관계가 무너집니다.
복사해서 쓰는 프롬프트 틀
아래 틀은 장면만 바꿔 쓸 수 있도록 괄호로 비워 두었습니다. 괄호 안을 채워 영어로 입력하시면 됩니다.
Create a photorealistic photograph of [place, time and weather]. Horizontal 3:2 composition, [eye-level] camera. One giant [object], about [N] times the height of a normal adult, stands on the [ground material] in the middle distance. Next to it stands a normal adult [holding / beside an ordinary reference object], so the viewer has a familiar scale. The object and the person share the same ground plane and the same [light]. The object [overlaps / is overlapped by] [a background element]. Place a soft contact shadow where the object touches the ground, pointing the same way as the person's shadow. Keep [background elements] and the camera angle unchanged. No text, no logo, no duplicated objects, no collage.
한국어로 입력하고 싶다면 같은 순서로 문장을 이어 가면 됩니다. 이 틀의 한국어 번역은 별도로 시험하지 않았습니다.
직접 생성한 세 장면과 사용한 프롬프트
첫 번째는 비 오는 광장의 거대한 노란 우산입니다. 아래는 이 이미지를 만들 때 실제 입력한 문장입니다. 보통 크기의 우산을 든 보행자들이 비교 기준이 됩니다. 출력에서는 기둥 아래에 돌 받침이 생겨, 손에 드는 우산보다 광장의 설치물처럼 보입니다.
Create a photorealistic surreal editorial photograph for a tutorial about believable relative scale. Horizontal 3:2 composition, eye-level camera, one consistent perspective and a single shared ground plane in a normal real-world environment (not a miniature diorama, no tiny city). A gigantic open yellow umbrella stands upright in a rainy stone plaza. The canopy dominates the upper frame; the shaft and round base have believable contact with the wet paving, with reflections and a soft contact shadow. Several anonymous normal-sized adult pedestrians walk in the plaza as size references, some partly overlapping the umbrella's base. Overcast rainy light. Restrained natural film-photographic colour, soft realistic lighting. No text, no lettering, no logo, no watermark, no collage, no duplicated objects. Fictional staged visual, not an actual field photograph.
표지 장면입니다. 비 오는 광장에 선 거대한 노란 우산과 기준이 되는 성인을 한 바닥에 놓은 구성입니다.원본 전체 보기
두 번째는 햇빛이 드는 마당의 커다란 크림색 찻주전자입니다. 성인과 자전거가 같은 포장 바닥에 놓여 있어 크기 차이를 읽을 수 있습니다. 사람 키의 정확히 몇 배인지 측정하지는 않았습니다.
Create a photorealistic surreal editorial photograph for a tutorial about believable relative scale. Horizontal 3:2 composition, eye-level camera, one consistent perspective and a single shared ground plane in a normal real-world environment (not a miniature diorama, no tiny city). A giant cream ceramic teapot sits in a sunlit courtyard beside a normal parked bicycle and a normal adult standing next to it. All objects stand on the same ground plane with a clear contact shadow under each, and each is visible enough for size comparison. The teapot is several times taller than the adult, with plain unbranded glaze. Restrained natural film-photographic colour, soft realistic lighting. No text, no lettering, no logo, no watermark, no collage, no duplicated objects. Fictional staged visual, not an actual field photograph.
찻주전자 예시입니다. 성인과 자전거를 기준물로 두고 주전자 바닥에 접점 그림자를 지정한 구성입니다.원본 전체 보기
세 번째는 녹색 실이 감긴 큰 실패입니다. 의자에 앉은 사람이 앞쪽 가장자리를 가리며 앞뒤 관계를 보여줍니다. 면사를 요청했지만 출력의 실결은 굵은 털실처럼 보이는 부분도 있습니다.
Create a photorealistic surreal editorial photograph for a tutorial about believable relative scale. Horizontal 3:2 composition, eye-level camera, one consistent perspective and a single shared ground plane in a normal real-world environment (not a miniature diorama, no tiny city). A huge spool of green cotton thread stands on its flat end in a daylight work courtyard. One normal adult sits on a normal chair in front of it, partly overlapping the spool, with natural contact shadows on the ground for both. The thread wraps show believable cotton texture, and the spool has no printed labels. Restrained natural film-photographic colour, soft realistic lighting. No text, no lettering, no logo, no watermark, no collage, no duplicated objects. Fictional staged visual, not an actual field photograph.
녹색 실패 앞에 앉은 성인이 가장자리를 일부 가리고 있습니다.원본 전체 보기
위 세 문장은 각 이미지 생성에 실제 사용한 영어 프롬프트입니다. 상대 크기와 기준물, 같은 바닥과 빛을 반복해서 지정하되 장면에 따라 필요한 겹침과 접점을 달리 적었습니다. 세 출력은 작성 예시이지 특정 문장의 효과를 분리한 통제 실험은 아닙니다. 같은 문장으로 다시 생성해도 구도와 인물, 세부 형태가 달라질 수 있습니다.
단계별로 만들어 보는 순서
처음부터 완성도를 노리기보다 아래 순서로 한 단계씩 확인하는 편이 빠릅니다.
- 장면을 정합니다. 장소, 시간, 날씨와 바닥 재질을 한 줄로 적습니다.
- 거대한 사물과 기준물을 정합니다. 기준물은 평범한 크기의 대상 하나면 충분합니다.
- 대략의 배율을 적습니다. 정확한 값이 아니라 단계를 알려 주는 용도입니다.
- 같은 바닥과 같은 빛을 한 문장으로 적습니다.
- 겹침 하나와 접점 그림자 한 줄을 넣습니다.
- 유지할 배경과 카메라 각도를 적고, 글자와 로고 금지를 붙입니다.
생성한 뒤에는 순서대로 확인합니다. 사물이 바닥에 놓였는지, 기준물과 같은 지면인지, 앞뒤 겹침이 맞는지, 그림자 방향이 일치하는지 봅니다. 하나라도 어긋나면 그 항목만 고칩니다.
잘 안 될 때 쓰는 수정 문장
처음부터 다시 쓰기보다 어긋난 한 가지만 지적하는 편이 안정적입니다.
- 사물이 떠 보일 때: "장면, 카메라 각도, 조명은 그대로 두세요. 거대한 사물의 바닥이 같은 포장 바닥에 닿게 하고 접점에 선명하고 부드러운 그림자를 넣어 주세요. 다른 것은 바꾸지 마세요."
- 크기 차이가 약할 때: "같은 구도에서 거대한 사물만 한 단계 더 크게 해 주세요. 사람과 배경은 그대로 둡니다."
- 사람이 사물과 비슷한 크기로 변했을 때: "사람은 평범한 성인 키로 유지해 주세요. 거대한 사물은 사람보다 분명히 커야 합니다."
- 그림자 방향이 다를 때: "거대한 사물의 그림자를 사람의 그림자와 같은 방향으로 맞춰 주세요."
- 사물이 둘로 늘어났을 때: "거대한 사물은 하나입니다. 중복된 사물을 지워 주세요."
- 앞뒤가 뒤섞였을 때: "사람이 사물 앞에 서서 사물의 가장자리를 일부 가리게 해 주세요."
수정 문장에는 늘 지킬 것을 함께 적으세요. "나머지는 바꾸지 마세요"라는 한 줄이 없으면 고치는 김에 다른 부분이 달라질 수 있습니다.
한계도 알고 쓰세요
이 방법이 거대 사물의 자연스러운 배치를 보장하지는 않습니다. 같은 프롬프트로도 결과가 달라지고, 사람의 손과 자전거처럼 구조가 복잡한 부분은 거대한 사물과 함께 그려질 때 형태가 틀어지기 쉽습니다. 이 방식만으로 사물의 크기를 숫자에 정확히 맞췄다고 보장할 수는 없습니다. 치수가 중요한 설계도나 제품 검증에는 쓰지 않고, 시각적 콘셉트를 만드는 용도로 사용합니다.
현실 사진처럼 보이는 결과물을 공개할 때는 연출된 이미지임을 분명히 하세요. 거대한 우산이 실제로 있는 것처럼 오해될 일은 드물지만, 사람이 함께 나오는 장면은 특히 조심하는 편이 좋습니다. 서비스가 업데이트되면 같은 문장도 다르게 작동할 수 있다는 점도 기억해 두세요.
출력 크기에 맞춰 다시 봅니다
생성 화면에서 그럴듯했던 장면도 작은 카드로 줄이면 기준물이 보이지 않을 수 있습니다. 거대한 물건을 강조하려고 사람과 자전거를 너무 작게 배치했다면, 휴대전화 화면에서 비교할 단서가 사라지는지 확인합니다. 물건 하나만 꽉 차게 자르는 대신 기준물과 바닥이 함께 남도록 구도를 잡는 편이 낫습니다.
가로 이미지를 세로 카드에 넣을 때는 양옆이 잘리는 것도 확인합니다. 손잡이, 주둥이, 바닥 접점이 프레임 밖으로 나가면 무엇이 얼마나 큰지 읽기 어려워집니다. 이때는 원본 전체를 좁은 영역에 억지로 채우기보다 여백을 두고 보여주거나 세로 구도로 다시 요청합니다. 특히 기준물이 화면 가장자리에 있다면 이미지 자체가 좋아도 카드에는 맞지 않을 수 있습니다.
마지막으로 새 이미지를 처음 보는 사람의 눈으로 확인합니다. 사물이 크다고 알기 위해 설명문을 먼저 읽어야 한다면 기준물을 더 분명히 드러낼 여지가 있습니다. 이것은 정확한 물리 측정이 아니라 전달력을 확인하는 점검입니다. 크기의 의도가 읽힌 뒤에 색과 질감을 다듬으면, 분위기는 좋은데 무엇을 보여주려는지 모호한 결과를 줄이는 데 도움이 됩니다.
오늘 해볼 한 장
물건 하나를 고르세요. 우산, 찻주전자, 실패처럼 생활에서 흔한 물건이면 됩니다. 그 옆에 평범한 기준물을 하나 두고, 같은 바닥과 같은 빛, 겹침 하나, 접점 그림자 한 줄을 적습니다. 결과가 나오면 바닥, 겹침, 그림자 순서로 하나씩 확인하세요. 크기를 키우고 싶을 때는 문장을 늘리지 말고, 기준물과 사물의 관계를 다시 읽어 보시기 바랍니다.

