LTX-2.5는 생성 구조와 실행 경로를 넓혔고, Wan Animate 2는 참조 인물의 동작과 시점을 다루며, Seedance 2.5는 긴 장면과 다중 참조 활용을 설명했습니다. 세 공식 발표가 제작 과정에서 맡는 역할을 기능별로 구분해 살펴봅니다.
LTX-2.5 생성 구조와 실행 방식
ComfyUI는 LTX-2.5를 발표 당일부터 지원한다고 밝혔습니다. 사용자가 직접 실행하는 공개 가중치와 호스팅된 모델을 함께 제시해, 로컬 환경과 제공형 경로 가운데 작업 여건에 맞는 쪽을 고를 수 있게 했습니다.
공식 발표 내용
이번 발표는 한 단계만 바꾼 갱신이 아니라 생성 전반을 다룬다고 설명합니다. 새 렌더링 방식과 영상 복호기, 맞춤형 문장 부호화기, 증류형 모델, 지시문 보강기, 추가 학습에 쓸 기본 체크포인트가 한 묶음으로 소개됐습니다.
직접 실행하는 구성에는 주 모델과 더 작고 빠른 증류형이 마련됐습니다. 공식 설명은 증류 방식을 다시 구성해 화질과 지시문 반영, 움직임을 더 담았다고 밝히며, 전체 모델의 비용이 맞지 않는 배치 환경도 적용 대상으로 제시합니다.
길이 설정을 덜어 주는 실험 기능도 포함됐습니다. 작은 길이 예측 모델이 지시문에 적힌 행동을 읽고 확산을 시작하기 전에 알맞은 영상 길이를 정하며, 지시문 보강기와 함께 쓰면 제작 도구에서 따로 조정할 항목을 줄일 수 있다는 설명입니다.
기존 세대에서 이어진 출력 범위로는 4케이 해상도와 음성·영상 동기화, 초당 최대 50프레임이 제시됐습니다. 새로 바뀐 생성 구조와 별개로 유지되는 항목이어서, 고해상도 영상과 소리를 함께 만드는 조건도 이번 지원 범위에 남습니다.
호스팅된 패스트 구성은 2초에서 20초, 720피부터 4케이까지를 다루며 24·25·48·50프레임률을 제공합니다. 10초를 넘으면 720피 또는 1080피와 24·25프레임으로 제한되고, 프로 구성은 2초에서 10초와 720피·1080피를 지원합니다.
관련 기능 또는 적용 범위
새 렌더링은 장면마다 계산량을 똑같이 배분하지 않습니다. 움직임과 구도, 화면 틀을 시간축으로 여덟 배 압축한 잠재 공간에서 먼저 만들고, 복잡도에 따라 핵심 프레임 수를 달리한 뒤 픽셀 확산 단계에서 세부 질감을 최종 영상에 입힙니다.
전용 영상 복호기는 기존 방식 대신 최종 복원을 맡아 얼굴과 글자를 더 또렷하게 하고 빠른 움직임에서 번짐을 줄이는 용도입니다. 여러 장면 생성은 한 번의 실행에서 연결된 숏을 만들며, 장면 전환 사이에 인물과 환경, 조명, 목소리, 양식을 이어 가도록 설계됐습니다.
맞춤형 문장 부호화기는 긴 지시문에 여러 대상과 행동, 조명, 카메라 방향이 함께 들어가도 세부 조건을 유지하는 역할을 맡습니다. 별도 보강기는 짧은 지시문을 촬영 지시가 담긴 자세한 문장으로 확장하며, 공식 설명은 추가 계산량이 거의 들지 않는다고 적었습니다.
사용 절차는 최신 ComfyUI로 갱신한 뒤 가중치를 모델 폴더에 두고, 템플릿 패널에서 목적에 맞는 흐름을 불러오는 순서입니다. 텍스트로 영상을 만드는 흐름과 이미지 기반 흐름, 첫 프레임과 마지막 프레임을 잇는 흐름이 각각 제공됩니다.
원문
출처명: ComfyUI Official News
공식 원문 URL: https://blog.comfy.org/p/ltx-25-day-0-support-in-comfyui
공식 게시일: 2026-08-12
Wan Animate 2 인물 동작 제어
ComfyUI는 Wan Animate 2를 기본 지원 목록에 추가했습니다. 참조 인물과 구동 영상을 받아 동작을 옮기는 과정에서 중간 동작 추출기를 없애고, 변환기가 구동 영상을 직접 읽도록 한 점이 발표의 중심입니다.
공식 발표 내용
새 종단 간 인물 애니메이션 구조는 구동 영상을 다시 설계한 확산 변환기에 곧바로 넣습니다. 중간 동작 추출기를 두지 않고 원본 영상의 정보를 변환기까지 직접 전달하도록 입력 경로를 바꾼 구성입니다.
지원과 함께 두 개의 새 노드도 제공됩니다. 하나는 참조 인물과 구동 영상을 받아 조건을 구성하고, 다른 하나는 자세 처리 분기의 결과를 저장해 표본 추출 단계마다 같은 계산을 반복하지 않게 합니다. 기본 흐름과 계산 절약 흐름을 나눠 조립할 수 있는 구성입니다.
경량형은 연속 인물 애니메이션을 겨냥해 실시간 지연 범위로 추론 시간을 낮춘 형태로 소개됐습니다. 한꺼번에 영상을 만든 뒤 기다리는 방식뿐 아니라 입력에 이어 결과를 내보내는 작업도 후보가 되며, 기본형과 다른 운용 범위를 담당합니다.
구동 영상을 직접 읽는 구조의 결과는 움직임과 인물 외형으로 나뉘어 설명됩니다. 공식 발표는 이전판과 비교한 움직임 변화의 근거로 직접 입력 방식을 들었고, 같은 구조가 한 장면 동안 참조 인물의 모습을 더 일관되게 유지한다고 밝혔습니다.
관련 기능 또는 적용 범위
중간 추출기가 사라진 이유는 원본 동작의 작은 차이를 보존하기 위해서입니다. 이전 단계가 미세한 표정이나 손가락 위치를 표현하지 못하면 생성 전에 그 정보가 사라질 수 있었지만, 구동 영상을 직접 읽는 구조는 이 손실 구간을 없앱니다.
시점은 구동 영상과 결과 영상을 분리해 다룹니다. 구동 영상은 인물의 연기를 제공하고, 지시문은 결과 화면의 카메라 위치를 따로 정할 수 있습니다. 같은 움직임을 쓰면서도 결과 장면의 관찰 방향을 바꿀 수 있다는 것이 공식 발표가 제시한 제어 범위입니다.
한 장면의 길이를 넘겨 생성을 이어 가는 기능도 들어갔습니다. 공식 설명은 이음새를 건너 동작을 이어 갈 수 있다고 밝히며, 긴 시퀀스는 구간 창으로 나눠 만들 수 있고 자세 처리 결과를 저장하는 기능과 함께 쓸 수 있다고 안내합니다.
자세 처리 결과 저장은 선택 사항입니다. 표본 추출의 각 단계에서 자세 분기 계산을 재사용해 생성 시간을 대략 절반으로 줄이는 대신 시스템 메모리를 더 쓰는 방식입니다. 작업자는 처리 시간과 메모리 여유를 비교해 이 노드를 켤지 정할 수 있습니다.
실행 절차는 ComfyUI를 최신 상태로 갱신하거나 클라우드 환경을 연 뒤 템플릿을 불러오는 방식입니다. 참조 인물과 구동 영상을 연결하고 출력 해상도와 길이를 정해 실행하며, 계산 시간을 줄여야 할 때는 자세 처리 결과 저장 노드를 선택해 더할 수 있습니다.
원문
출처명: ComfyUI Official News
공식 원문 URL: https://blog.comfy.org/p/wan-animate-2-is-now-available-in
공식 게시일: 2026-08-08
Seedance 2.5 긴 장면과 참조 구성
Seedance 2.5는 ComfyUI의 파트너 노드를 통해 제공됩니다. 한 번에 30초짜리 연속 장면을 만들고 최대 50개 참조 자료를 받는 구성이며, 기존 영상을 편집하거나 뒤를 이어 만드는 기능도 함께 소개됐습니다.
공식 발표 내용
한 번의 생성에는 이미지 30개와 영상 10개, 음원 10개까지 넣을 수 있습니다. 공식 설명은 이 묶음으로 인물과 환경, 움직임, 소리를 한 지시문 안에 함께 고정해 여러 단계로 참조 자료를 나눠 넣는 과정을 줄일 수 있다고 밝힙니다.
각 참조 자료는 지시문 안에서 바로 가리킬 수 있습니다. 특정 이미지에는 인물 외형을, 특정 영상에는 움직임을, 특정 음원에는 소리 조건을 연결하는 식으로 자료별 요청을 나눌 수 있어, 최대 50개 입력을 하나의 모호한 묶음으로만 다루지 않습니다.
30초 장면은 짧은 조각을 이어 붙이는 방식이 아니라 한 번의 실행으로 연속 생성됩니다. 공식 설명은 전체 구간에서 구도와 조명, 피사체의 연속성을 유지한다고 밝힙니다. 긴 결과를 만들 때 조각 사이의 경계를 맞추는 별도 작업을 줄이는 방향입니다.
제어 범위에는 지시문 반영과 기존 영상의 편집·연장이 포함됩니다. 발표는 이전 버전보다 요청을 더 안정적으로 따르며, 이미 있는 영상을 바꾸거나 끝 지점 뒤를 생성할 수 있다고 설명합니다. 열 가지가 넘는 언어로 음성 내용을 직접 만드는 기능도 제시됐습니다.
관련 기능 또는 적용 범위
장면 지시는 시간표처럼 작성할 수 있습니다. 각 시간 구간에 일어날 행동과 화면 크기, 카메라 종류, 전환 방식을 적으면 모델이 그 순서를 따르며, 박자에 맞춘 즉시 전환도 지정할 수 있습니다. 긴 장면 안에서 숏의 배열을 미리 정하는 방식입니다.
편집은 기존 영상을 넣고 바꿀 내용을 자연어로 설명하는 흐름입니다. 화면에서 주인공만 남기라는 요청을 주면 다른 인물을 없애고 그 자리를 배경으로 복원하면서 나머지 장면을 유지하는 사례가 제시됐습니다. 같은 경로로 원본 끝 뒤의 장면도 이어 만듭니다.
다국어 기능은 대사와 발성을 영상 안에서 직접 생성하는 방식입니다. 열 가지가 넘는 언어를 다루며 입술 모양과 턱 움직임을 말소리에 맞춘다고 설명합니다. 한 장면 안에서 여러 언어가 차례로 바뀌는 경우에도 이 맞춤을 유지하는 범위가 포함됩니다.
실행할 때는 ComfyUI를 최신 상태로 바꾸거나 클라우드 환경을 연 뒤 템플릿을 불러옵니다. 참조 자료를 붙이고 지시문을 적어 시작하는 구조이며, 참조 영상 기반 흐름과 텍스트 기반 흐름이 따로 제공돼 입력 자료의 종류에 맞춰 출발점을 고를 수 있습니다.
원문
출처명: ComfyUI Official News
공식 원문 URL: https://blog.comfy.org/p/seedance-25-is-now-available-via
공식 게시일: 2026-08-08