AI 영상으로 제작하기 쉬운 대본은 무엇일까: 생성과 촬영의 제약부터 고려해 쓰기
AI 영상이나 저예산 실사 촬영 모두 어떤 대본이든 적은 비용으로 안정적인 완성작으로 만들 수는 없다. 더 신뢰할 수 있는 방법은 집필 단계에서 동시에 화면에 등장하는 인물 수, 긴 동작의 연속성, 장면 전환, 소품과의 상호작용, 숏 길이를 조절하고, 안정적으로 제작하기 어려운 내용을 소리, 인터페이스, 텍스트 노드 또는 재사용 가능한 리액션 숏으로 바꾸는 것이다.

들어가며
AI 영상이나 저예산 실사 촬영 모두 어떤 대본이든 적은 비용으로 안정적인 완성작으로 만들 수는 없다. 더 신뢰할 수 있는 방법은 집필 단계에서 동시에 화면에 등장하는 인물 수, 긴 동작의 연속성, 장면 전환, 소품과의 상호작용, 숏 길이를 조절하고, 안정적으로 제작하기 어려운 내용을 소리, 인터페이스, 텍스트 노드 또는 재사용 가능한 리액션 숏으로 바꾸는 것이다.
이 글은 제작에 맞게 대본을 조정하는 방법을 다루며, 특정 모델의 최신 성능을 평가하지 않는다. 도구 버전은 빠르게 바뀌므로 본격적인 제작에 앞서 실제로 사용할 숏으로 테스트 영상을 만들고, 모델, 매개변수, 소재 출처와 수작업 수정 사항을 기록해야 한다.
먼저 위험도가 높은 다섯 가지 장면을 파악하기
여러 사람이 오랫동안 한 화면에 등장하면 인물의 정체성, 시선과 동작의 연속성을 유지하기 어려워진다. 복잡한 손동작, 정확한 소품 전달과 격투 역시 숏 사이의 일관성을 유지해야 한다. 거울, 화면 속 문자, 제복 표식 같은 세부 요소는 쉽게 달라질 수 있다. 연속적인 동선과 롱테이크는 여러 오류를 하나의 영상 소재에 누적시킨다. 잦은 장소 변경은 인물과 조명을 다시 구현하는 비용을 늘린다.
이런 장면을 절대로 만들 수 없다는 뜻은 아니다. 다만 프로젝트 기획 단계에서 테스트, 재작업과 수작업 후반 작업을 반영해야 하며, “한 번 생성해서 성공한다”는 전제로 비용을 추산해서는 안 된다.
정보 전달 동작과 물리적 동작을 분리하기
인터랙티브 영상 게임의 긴장감은 정보의 변화에서 나오는 경우가 많으며, 반드시 비용이 많이 드는 액션에 의존하지는 않는다. 인물이 서버를 해킹하는 장면은 화면 기록, 소리, 짧은 리액션 숏과 결과 화면으로 표현할 수 있다. 키보드를 조작하는 모든 과정을 빠짐없이 보여줄 필요는 없다.
《零点回拨》에서는 린즈샤가 이어폰으로 서버실의 이상한 소리를 듣고, 동시에 인터페이스에 출입 통제 상태의 변화가 표시된 뒤 그녀의 반응으로 전환할 수 있다. 안정적인 짧은 숏 세 개는 이동, 문 열기, 장비 조작과 여러 사람의 대화가 담긴 긴 숏 하나보다 재사용하고 선택에 연결하기 쉽다.
하지만 모든 동작을 텍스트 설명으로 바꾸지는 말아야 한다. 핵심 감정과 되돌릴 수 없는 행동에는 여전히 명확한 시각적 증거가 있어야 한다. 그렇지 않으면 플레이어는 결과가 작품 바깥에서 일어난다고 느끼게 된다.
분기에 “공통 진입점”과 “공통 종료점” 설계하기
모든 영상 구간은 시작과 끝에서 다음 구간과의 연결을 고려해야 한다. 공통 진입점은 여러 이전 노드에서 같은 구간으로 들어올 수 있게 하고, 공통 종료점은 서로 다른 선택 이후에도 자연스럽게 합류할 수 있게 한다.
예를 들어 선택지가 나타나기 전에 인물이 안정적인 구도 안에서 중립적인 동작으로 멈춘다. 각 분기에서는 서로 다른 짧은 반응을 재생하고, 이후 같은 위치로 돌아와 공통 숏을 이어서 사용한다. 분기마다 인물이 다른 장소로 이동하고 다른 소품을 들고 있다면 이후 재사용이 어려워진다.
공통 종료점이 결과를 지워서는 안 된다. 조건부 대사, 인터페이스 상태, 소품 변화 또는 다음 노드의 진입점을 통해 차이를 유지할 수 있다.
숏의 제작 가능성 등급 정하기
| 등급 | 특징 | 권장 용도 |
|---|---|---|
| A | 한 사람, 미디엄 클로즈업, 짧은 동작, 안정적인 배경 | 주요 대사와 반응 |
| B | 두 사람의 대화, 제한적인 동선, 명확한 소품 | 핵심 관계 장면, 먼저 테스트 영상 제작 |
| C | 여러 사람, 복잡한 동작, 정밀한 연속성 | 수량을 줄이거나 실사 합성 활용 |
| D | 긴 격투, 혼잡한 장면, 복잡한 문자와 거울 | 다시 쓰기, 숏 분할 또는 다른 매체 사용 |
대본의 장면 분할표에서 각 숏에 등급을 매긴다. C, D 등급이 몰려 있다면 제작 실패 후에 처리하려 하지 말고 대본 회의에서 수정해야 한다.
혼합 매체로 비용 관리하기
텍스트 노드는 내면의 생각, 기록과 저비용 분기에 적합하다. 정적인 인터페이스는 증거 비교에, 소리는 전화, 방송과 화면 밖 사건에 적합하며, 짧은 영상은 연기와 핵심 행동을 담당한다. 서로 다른 매체는 노드와 상태를 공유해야 하며, 각각 별개의 이야기를 만들어서는 안 된다.
혼합 매체 역시 플레이어에게 한 약속을 지켜야 한다. 영화 같은 경험을 내세우는 작품이라면 핵심 갈등을 모두 채팅 기록으로 축소해서는 안 된다. 조사가 핵심이라면 인터페이스 정보는 저렴한 대체재가 아니라 주요 게임플레이다.
AI 소재를 감사 가능한 자산으로 다루기
각 소재마다 생성 도구와 버전, 입력 소재의 출처, 프롬프트와 참고 자료, 생성 날짜, 수작업 수정 사항, 인물과 장면 버전, 사용 노드와 라이선스 제한을 기록한다. Steam의 콘텐츠 설문조사는 개발 단계에서 생성되어 게임과 함께 배포되는 콘텐츠와 실행 중 생성되는 콘텐츠를 구분한다. 정식 출시 시에는 당시의 규정에 따라 다시 확인하고 사실대로 공개해야 한다.
“생성되었다”는 것을 “사용할 수 있다”는 뜻으로 받아들이지 말아야 한다. 인물의 일관성, 연기의 의도, 민감한 콘텐츠, 제삼자의 권리와 홍보상의 약속도 확인해야 한다.
촬영이나 일괄 생성 전에 세 종류의 테스트 영상 만들기
첫 번째는 가장 흔한 숏으로 안정적인 제작 역량을 검증한다. 두 번째는 가장 어려운 숏으로 최대 위험을 검증한다. 세 번째는 분기 연결로 구간 사이에 자연스러운 전환이 가능한지 검증한다. 세 종류가 모두 통과해야 일괄 제작에 적합하다.
테스트 영상의 검수 항목에는 인물의 정체성, 의상과 소품, 조명, 시선, 입 모양이나 소리, 시작과 끝의 자세, 자막 공간, 인코딩과 연동이 포함된다. 집필 팀은 실패 원인에 따라 장면을 수정해야 하며, 모든 수정 부담을 후반 작업에 넘겨서는 안 된다.
일괄 제작 후에는 반려 기준도 마련해야 한다. 인물의 얼굴이나 의상에 연속성이 없거나, 핵심 소품의 형태가 바뀌거나, 화면 속 문자를 읽을 수 없거나, 동작의 인과관계가 불분명하거나, 시작과 끝 프레임을 연결할 수 없다면 재작업하거나 다른 매체로 바꿔야 한다. 개별 구간이 “멋져 보인다”는 이유만으로 정식 경로에 포함해서는 안 된다.
제작 가능성을 고려한 대본 수정이 끝나면 다음 모듈에서는 선택을 본격적으로 검토한다. 선택이 단지 버튼 두 개를 제공하는 데 그치지 않고 결과를 바꾸는지, 대가를 요구하는지, 정보를 활용하는지, 인물을 표현하는지 살펴본다.


