269 읽음
힉스필드, AI와 3D 결합 하이브리드 애니 공개
위키트리
0
탑승 시간이 코앞이다. 공항에 도착한 여자는 그제야 여권을 집에 두고 왔다는 사실을 깨닫는다. 붙잡아 탄 택시의 기사는 온화한 얼굴에 콧수염을 기른 중년 남성이다. 차가 출발하는 순간 평화는 끝난다. 택시는 트럭 두 대 사이를 두 바퀴로 비집고 들어가고 도로 위로는 통나무가 쏟아진다. 마지막엔 버섯구름 같은 폭발까지 터진다.
인공지능(AI) 영상 플랫폼 힉스필드(Higgsfield)가 유튜브에 공개한 단편 애니메이션 ‘패스포트 러시'의 한 장면.

인공지능(AI) 영상 플랫폼 힉스필드(Higgsfield)가 유튜브에 공개한 단편 애니메이션 ‘패스포트 러시(Passport Rush)’의 줄거리다. 약 5분 길이의 액션 코미디다. 힉스필드는 이 작품을 블렌더와 힉스필드를 결합한 제작 방식으로 만든 첫 하이브리드 AI 애니메이션이라고 소개했다. 블렌더(Blender)는 무료로 쓸 수 있는 오픈소스 3D 제작 프로그램이다.
인공지능(AI) 영상 플랫폼 힉스필드(Higgsfield)가 유튜브에 공개한 단편 애니메이션 ‘패스포트 러시'의 한 장면.

영상을 본 시청자들 사이에서 놀랍다는 반응이 쏟아진다. 지금까지 본 AI 영상 중 단연 최고라는 반응이 가장 많다. 5분 동안 긴장과 설렘 등 온갖 감정을 다 느꼈다는 시청자도 있었다. AI로 만든 사실을 잊고 봤다는 반응도 나왔다.

AI 영상의 고질병은 장면이 바뀔 때마다 인물의 얼굴이나 옷이 조금씩 달라지는 것이다. 카메라가 빠르게 움직이는 액션 장면에서는 사람과 사물의 형태가 무너지기 일쑤다. '패스포트 러시'는 이런 약점을 상당 부분 극복했다는 평가를 받는다. 카메라가 격하게 움직이는 추격 장면에서도 주인공의 생김새와 차량의 형태가 비교적 안정적으로 유지된다.

비결은 작품과 함께 공개된 제작 과정 영상에 담겼다. 힉스필드 애니메이션 채널에 올라온 이 영상에서 제작진은 택시 추격 장면을 어떻게 만들었는지 약 28분에 걸쳐 설명했다.

해설을 맡은 애니메이터 아미나는 "우리 팀은 전통 애니메이션 출신이고 힉스필드에 합류하기 전까지 AI를 써본 적이 없다"며 "지금도 이 도구들이 우리가 원하는 작업 방식에 어떻게 맞는지 알아가는 중"이라고 말했다.

제작진은 AI에 모든 걸 맡기지 않았다. 스토리보드를 먼저 그리고 복잡한 장면은 블렌더로 카메라 각도와 움직임, 타이밍을 미리 잡았다. 색과 질감 없이 회색 입체와 움직임, 카메라만 담은 이 사전 시각화 영상을 AI에 참고 자료로 넣었다. 말로 설명하기 어려운 동작은 직접 움직여 보여주는 편이 빠르다는 판단에서다. 간단한 장면은 곧바로 텍스트 명령어로 영상을 만들었다.
인공지능(AI) 영상 플랫폼 힉스필드(Higgsfield)가 유튜브에 공개한 단편 애니메이션 ‘패스포트 러시'의 한 장면.

힉스필드는 공식 X 계정에서 이번 작업의 가장 큰 교훈으로 "AI에게 모든 걸 시키지 말라"는 점을 꼽았다. 통제가 필요한 부분은 블렌더로 잡고 AI는 효율을 높일 수 있는 곳에 쓰라는 것이다.

제작진이 가장 공을 들인 건 AI에 입력할 참고 이미지였다. 캐릭터 설정화와 소품, 배경이 여기에 해당한다. 제작진은 이를 '에셋 우선 원칙'이라고 불렀다. 아미나는 "입력 이미지가 불분명하거나 엉성하면 영화 전체가 엉성해진다"고 말했다.

그림체는 입체감 있는 3D 캐릭터와 수채화풍 배경을 섞었다. 주인공 디자인은 힉스필드 자체 이미지 모델 '소울(Soul) 2.0'으로 여러 시안을 뽑은 뒤 골랐다. 생강색 머리에 파란 후드티와 운동화, 치마를 입은 모습이다. 아미나는 "나는 보통 공항에 운동복 바지처럼 가장 편한 옷을 입고 간다"며 주인공 옷차림을 정한 이유를 설명했다. 이후 포토샵으로 색을 더 밝게 다듬고 윤곽선 주변에 붓 터치를 손으로 그려 넣었다.

택시 기사는 둥글고 순한 얼굴에 모자를 쓰고 큰 콧수염을 달았다. 겉보기엔 한없이 느긋하지만 운전은 난폭하다. 아미나는 기사 캐릭터를 두고 "그의 차라면 한 번은 타겠다. 아마 딱 한 번만"이라고 농담했다.

시행착오도 많았다. 순수 수채화 배경은 테스트 영상에서 지저분하고 생기 없어 보였다. 수채화풍을 아예 포기하자는 얘기까지 나왔다. 해법은 조명이었다. 한낮이던 배경 시간을 늦은 오후로 바꾸고 따뜻한 햇빛과 긴 그림자를 명령어에 넣자 화면에 깊이가 생겼다. 이 방식은 작품 전체의 시각 공식이 됐다.

택시도 처음엔 수채화 질감을 입혔다. 막상 움직이자 평면 이미지를 3D 모형에 억지로 씌운 것처럼 어색해 보였다. 제작진은 수채화 배경 위에 수채화 소품까지 올리면 AI가 감당할 정보가 두 배로 늘어난다고 판단했다. 결국 택시는 깔끔한 3D로 바꾸고 수채화 질감은 배경에만 남겼다.

폭발 장면에서는 웃지 못할 일도 있었다. 명령어에 '버섯 모양 폭발'이라고 쓰자 AI가 진짜 버섯 모양의 폭발을 만들어냈다. 제작진은 표현을 '핵폭발'로 바꾸고 손으로 질감을 덧그려 장면을 완성했다.

명령어는 영상 4초짜리 장면 하나에도 긴 글 수준으로 썼다. 아미나는 "우리가 적지 않은 세부 사항은 모델이 알아서 정한다"며 "모델은 형편없는 추측꾼"이라고 말했다. 명령어 앞부분 20%가 특히 중요하다는 설명도 덧붙였다. 모델이 사람처럼 위에서 아래로 읽고 뒤로 갈수록 덜 엄격하게 따른다는 이유에서다. 명령어 초안 작성에는 앤트로픽의 AI 챗봇 클로드를 썼다. 명령어 구조를 한 번 정리해 두면 이후 모든 장면에 같은 틀을 적용하는 방식이다.

제작진은 추격 장면 18개를 사흘 만에 작업했다. 그래도 끝내 풀지 못한 장면이 있었다. 택시 안에서 주인공이 손잡이를 잡자 뜯겨나가고 다급히 반대쪽 손잡이를 잡았는데 그것마저 떨어지는 장면이다. 손잡이가 부러진 걸 깨닫는 짧은 멈춤이 웃음의 핵심인데 AI로는 이 미묘한 연기를 구현하지 못했다. 제작진은 이를 '연기 격차'라고 불렀다. 아미나는 "화려한 액션 장면이 더 어려울 줄 알았는데 AI는 오히려 섬세한 캐릭터 연기에 애를 먹었다"고 말했다.

네티즌들이 박수만 친 건 아니다. 일부 장면은 손그림 2D 같고 일부는 3D 애니메이션 같아 미술 방향이 조금 일관되지 않다는 지적이 나왔다. 대사가 나오는 순간 AI라는 게 드러난다거나 목소리가 기계 같으니 실제 성우를 쓰면 더 좋겠다는 반응도 있었다. 캐릭터들이 눈을 한 번도 깜빡이지 않는다고 꼬집은 댓글도 눈에 띄었다.

제작 방식을 두고도 의견이 갈렸다. 한 시청자는 AI를 어도비 프로그램의 플러그인이나 효과처럼 도구로 쓴 만큼 'AI 보조 제작'과 'AI 생성 콘텐츠'는 따로 논의해야 한다는 의견을 남겼다. 창의성은 그대로이고 매체만 바뀌었을 뿐이라는 댓글도 있었다. 반면 3D 아티스트라고 밝힌 시청자는 이제 블렌더를 잘 다루지 않아도 누구나 할 수 있게 됐다며 자신들의 설 자리를 걱정했다.

작품 속 숨은 장치를 찾아낸 시청자들도 있었다. 탑승권에 적힌 공항 코드와 택시 기사의 번호판 숫자를 근거로 제작진이 카자흐스탄 출신이라며 응원하는 댓글이 여러 개 달렸다.

작품에 쓴 명령어와 에셋을 이미 공개한 힉스필드는 총 생성 횟수와 제작비, 전체 제작 기간 등을 담은 상세 분석 영상도 내놓겠다고 밝혔다.
0 / 300