DAY 03작업 3일째

콘티를 읽는 단계와 외형을 채우는 단계를 나눴다

대충 그린 콘티가 선을 색칠한 그림으로 나오던 문제를, 의도 해석의 틀을 넓히고 미정 외형만 따로 채우는 단계를 더해 풀었다.

콘티를 넣고 생성하면 결과가 두 갈래로 실패했다. 콘티를 강하게 따르면 대충 그린 선을 그대로 색칠한 그림이 나왔고, 약하게 따르면 글만 보고 구도와 상관없는 그림이 나왔다. 사용자가 원하는 건 그 사이다. 선이 무엇을 뜻하는지 읽고, 그 뜻대로 완성된 그림이다.

처음의 해석 규칙은 특정 사례에 맞춰져 있었다

처음에는 이미지 이해 모델(Qwen3-VL)이 콘티를 여섯 항목으로 읽게 했다. 대상의 종류와 개수, 주 대상의 꼭대기와 중심, 위쪽 여백, 그리고 선의 끝점이 연결점보다 높으면 팔을 든 동작으로 보라는 지침까지 있었다. 생성 단계에는 원본 대신 콘티를 흑백으로 바꿔 흐리게 만든 배치 지도를 넘겼고, 픽셀로 잰 빈 공간을 최종 여백으로 강제했다.

모두 한두 개의 실패 사례를 고치려다 생긴 규칙이었다. 화면 전체에 퍼진 효과나 중심이 없는 풍경에도 셀 수 있는 주 대상을 찾게 만들었고, 흐린 지도는 색과 가는 선의 방향을 지웠다. 바꾸기 전에 그 상태를 복구 태그로 남겨 두고 해석 규칙을 다시 짰다.

바꾸기 전바꾼 뒤
대상 종류 · 개수 · 중심 · 여백을 반드시 답한다의도한 완성 그림, 중요한 시각 관계, 보완할 수 있는 부분, 불확실한 부분 네 가지만. 해당 없으면 비운다
끝점 높이로 동작을 정한다지침에서 뺐다
생성에는 흐린 흑백 배치 지도해석과 생성 모두 같은 원본을 그대로 쓴다
잰 여백을 최종 구도로 강제강제하지 않는다

졸라맨이나 단순한 선 그림도 그게 의도라면 유효한 완성 그림으로 본다. 코드가 대상 이름을 바꿔 넣거나 특정 형태를 금지하지 않는다.

그래도 빈 도형을 칠한 그림이 나왔다

해석이 좋아져도 인물 콘티는 여전히 빈 윤곽을 색칠한 모습으로 나왔다. 원인을 나누려고 같은 입력과 시드에 외형 설명을 손으로 써 넣어 봤다. 그러자 얼굴과 머리카락, 옷이 있는 인물로 발전했다. 병목은 해석이 아니라, 생성 모델에게 넘기는 지시에 완성 외형이 비어 있다는 점이었다.

외형을 채우는 방법을 두 가지 시험했다. 해석 전체를 넘겨 장면을 다시 쓰게 하면, 콘티에서 세부가 생략됐다는 관찰까지 그대로 옮겨 최종 그림에서도 세부를 빼라는 지시가 됐다. 의미만 요약해 넘기면 외형은 채웠지만 새 동작과 전신, 좁은 여백까지 지어냈다. 둘 다 버렸다.

채택한 방식은 범위를 좁히는 것이다. 별도 작성 단계는 해석에서 정해지지 않은 외형만 채우고, 그 결과를 기존 의도에 별도 섹션으로 덧붙인다. 장면 전체를 다시 쓰지 않는다. 배치와 동작은 계속 원본 콘티가 맡는다.

콘티 + 장면 설명 + 그림체
  → 해석: 의도 · 시각 관계 · 보완 가능 · 불확실
  → 외형 작성: 정해지지 않은 생김새만 채운다
  → 생성: 의도 + 외형 + 원본 콘티
인물 콘티의 전후
왼쪽 콘티, 가운데는 외형 단계 전, 오른쪽은 후. 같은 해석과 시드로 프롬프트 조립만 바꿨다
강아지 콘티의 전후
선과 타원으로 그린 개가 털과 눈이 있는 강아지로 완성된다. 다른 대상으로 바꾸지 않는다

비교는 저장해 둔 해석을 그대로 다시 쓰고 원본, 설명, 그림체, 시드, 모델, 해상도를 모두 고정해서 했다. 생성 그래프에서 달라진 건 프롬프트를 조립하는 노드뿐이다. 얼굴과 의상이 없는 단순한 흑백 선화를 요청한 경우에는 외형을 억지로 넣지 않고 단순한 모습을 지켰다.

감수한 것

외형만 쓰라고 해도 작성 모델이 동작을 덧붙이는 경우가 있다. 위 인물도 손을 모으는 자세가 새로 생겼고 머리 위치와 비율이 달라졌다. 구도를 정확히 지키는 문제는 아직 풀지 못했다. 해석과 외형 작성으로 텍스트 생성이 두 번 늘어 기다리는 시간도 길어졌다. 그래서 선을 그대로 따르는 「선과 구도를 강하게 반영하기」는 이 단계 없이 남겨 두었다.

기록 #02 · 2026.09.26