최종 MP4 합성 + 출력 검증
6개 클립을 0.45초 xfade/acrossfade로 합성. 최종 58초·1280×704·H.264 NVENC·AAC 생성, ffprobe 및 faststart/yuv420p 검증, 공개 게시
GPT Image 2 캐릭터 기준 시트와 LTX 2.5 native audio I2V를 결합해 같은 인물이 서울에서 이세계의 마법사로 이어지는 60초 프롤로그 숏 무비를 만드는 실험
단계별 결과를 쌓아가는 실험입니다.
GPT Image 2 기준 시트를 모든 장면에 참조해도 개별 프레임의 해부학적 품질과 장면 간 얼굴 identity는 별개였고, 최종 영상에서 다른 얼굴로 변하는 현상을 확인했습니다.
Evidence
Scope
GPT Image 2와 LTX 2.5로 만든 60초 프롤로그의 장면·프레임 비교
Confidence · confirmed
6개 클립을 0.45초 xfade/acrossfade로 합성. 최종 58초·1280×704·H.264 NVENC·AAC 생성, ffprobe 및 faststart/yuv420p 검증, 공개 게시
2026.08.20 · 최종 MP4 합성 + 출력 검증
2026.08.20
6개 클립을 0.45초 xfade/acrossfade로 합성. 최종 58초·1280×704·H.264 NVENC·AAC 생성, ffprobe 및 faststart/yuv420p 검증, 공개 게시
2026.08.20
개별 프레임은 해부학적으로 사용 가능했지만, 기준 시트와 cross-scene 비교에서 다른 얼굴로 변하는 현상 확인
2026.08.20
채택 클립 생성 1125.513초, 6개 모두 10.041667초·1280×704·24fps·AAC native audio
6개 클립을 0.45초 xfade/acrossfade로 합성. 최종 58초·1280×704·H.264 NVENC·AAC 생성, ffprobe 및 faststart/yuv420p 검증, 공개 게시
개별 프레임은 해부학적으로 사용 가능했지만, 기준 시트와 cross-scene 비교에서 다른 얼굴로 변하는 현상 확인
채택 클립 생성 1125.513초, 6개 모두 10.041667초·1280×704·24fps·AAC native audio
동일 기준 시트 참조, 장면별 시각 검수 및 Scene 4 손 crop 재생성
정면·3/4·전신·측면 2×2 시트 생성, identity anchor 확정