Guides

ComfyUI 의 MiniMax H3: 버전, 파일, OOM 막는 플래그

네이티브 노드는 0.30.0, 메모리 부족을 막는 수정은 0.32.0 입니다. 가이드 대부분이 0.30.0 에서 멈춰 있습니다. PR 번호까지 적었습니다.

9분 읽기편집팀편집팀
ComfyUI 의 MiniMax H3: 버전, 파일, OOM 막는 플래그

ComfyUI 에서 MiniMax H3 를 돌리시려면 ComfyUI 0.32.0 이상과, 합쳐서 42.47 GB 인 모델 파일 넷이 필요하고, 커스텀 노드는 필요 없습니다. 네이티브 지원은 0.30.0 에 들어왔지만, 오디오가 일그러지는 문제를 고친 샘플러 수정은 0.31.0 에, 최대 메모리 수정은 0.32.0 에 들어왔습니다. 24 GB 카드에서는 끝까지 가는지 아닌지를 호스트 RAM 이 정합니다.

여기 적힌 것은 전부 날짜가 붙은 이야기입니다. 0.30.0 이후에 H3 관련 수정이 아홉 개 나왔으니, 첫 주에 쓰인 가이드는 다른 프로그램을 설명하고 있는 셈입니다. 아래의 사실에는 각각 풀 리퀘스트 번호와 릴리스가 붙어 있습니다.

무엇을 내려받으시기 전에 이것부터 확인하세요. MiniMax H3 Community Licence 는 가중치를 로컬에서 돌리는 허락에서 미국 · EU · 영국 · 대한민국을 제외하고, §V.4 가 그 제한을 결과물까지 넓힙니다. 호스팅 API 는 이 지역 조항의 대상이 아닙니다. 이는 요약이며 법률 자문이 아닙니다. 라이선스 전문 정리에 조항이 있습니다.

0.30.0 이 주는 것과 주지 않는 것

0.30.0 은 노드와 로컬용 예제 템플릿 셋이 등장한 버전입니다. 그게 전부입니다.

8월 8일 0.31.0 에 수정 여섯 개가 더 들어왔고, 그 앞에 kijai 의 #15243, Fix sampler issues for audio with minimax 가 있습니다. 8월 11일 0.32.0 에 셋이 들어왔는데, 그중 comfyanonymous 의 #15486, Fix peak memory issue with H3 가 예전에는 죽던 24 GB 카드가 이제 끝까지 가는 이유입니다.

릴리스PR무엇을 고치나심각도
0.31.0#15243샘플러가 오디오 스케줄을 넘겨 밟음. 4 스텝에서는 잡음이 됨치명
0.31.0#15390EasyCache 가 사운드트랙을 망가뜨림
0.31.0#15377오디오 VAE 를 전부 오프로드하면 실패함
0.31.0#15334int8_convrot VAE 가 올라오지 않음
0.31.0#15322마스크 샘플링이 틀림작음
0.31.0#15268VAE 디코드 중 장치 불일치 오류작음
0.32.0#15486OOM 그것. 손으로 무엇을 고치시기 전에 먼저 올리세요치명
0.32.0#15477NestedTensor 잠재 표현에서 타일 VAE 디코드가 죽음
0.32.0#15446이것이 없으면 디코드가 느리고 무거움작음

8월 13일 0.33.1 이 MiniMax ContextIR 과 Regenerate-2K API 노드를 더했습니다(#15471). 호스팅 2K 단계를 로컬 그래프에 이어 붙일 수 있게 된 것입니다. 그 단계의 가중치는 호스팅 쪽에 그대로 있어서, 이 경로에는 로컬 확인이 아니라 API 키가 필요합니다.

cd /path/to/ComfyUI
git pull
python -m pip install -r requirements.txt
python main.py --version        # expect 0.32.0 or later

Windows 포터블판은 함께 들어 있는 업데이트 스크립트나 앱 안의 업데이터를 쓰세요.

어떤 모델 파일을 받고 어디에 두는가

저장소를 통째로 클론하지 마세요. 모든 정밀도 변형이 다 들어 있어서 약 475 GB 입니다. 텍스트로 만드는 그래프나 사진으로 만드는 그래프가 올리는 것은 정확히 파일 넷이고, 8월 14일에 Hugging Face 와 바이트 단위로 대조했습니다.

파일크기들어갈 곳
minimax_h3_fl2va_pruned_int8_convrot.safetensors20.97 GBmodels/diffusion_models/
qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors15.69 GBmodels/text_encoders/
minimax_h3_video_vae_fp16.safetensors5.21 GBmodels/vae/
minimax_h3_audio_vae_fp32.safetensors0.61 GBmodels/vae/
합계42.47 GB = 39.55 GiB
hf download Comfy-Org/MiniMax-H3 \
  diffusion_models/minimax_h3_fl2va_pruned_int8_convrot.safetensors \
  text_encoders/qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors \
  vae/minimax_h3_video_vae_fp16.safetensors \
  vae/minimax_h3_audio_vae_fp32.safetensors \
  --local-dir ComfyUI/models

레퍼런스로 만드는 작업에는 다섯째 파일, 즉 별도의 Ref2VA 체크포인트가 붙어서 63.44 GB 가 됩니다. R2V 그래프에 FL2VA 파일을 올리는 것이 첫 실행에서 가장 흔한 실패입니다.

널리 복사된 파일 표 두 개가 이 수치를 기비바이트로 적어 놓고 라벨은 GB 로 달아 두었습니다. 디스크를 39.6 GB 비우셨다면, ComfyUI 가 무엇을 쓰기도 전에 2.9 GB 가 모자랍니다.

정밀도 이야기. bf16 은 확산 모델만으로 66.28 GB 입니다. 왜 그것이어야 하는지 아실 때만 고르세요. fp8_scaled 는 20.96 GB 로 int8_convrot 과 크기가 거의 같습니다. 여러분 환경에서 int8_convrot 이 빌드되지 않을 때만 고르세요.

그다음은 Workflow → Browse Templates → Video → MiniMax H3. 로컬 템플릿 셋과 API 를 호출하는 템플릿 셋이 있습니다.

여러분의 GPU 로 돌아갈까요

공식 최소 사양은 없고, 찾으실 수 있는 하드웨어 표는 서로 다 다릅니다. 서로 다른 것을 쟀기 때문입니다.

실행을 죽이는 것은 VRAM 이 아니라 호스트 RAM 입니다

가지치기된 INT8 구성을 4090 에서 돌리면 샘플링 동안 VRAM 에 앉아 있는 것은 6.6 GB 정도뿐입니다. 가중치는 호스트 메모리에 살면서 필요할 때 넘어옵니다. 그러니 실패는 호스트 메모리 실패입니다. 기록으로 남은 3090 실행 하나는 31,997 MB 중 29,866 MB 까지 갔다가 커널에 죽었고, --disable-pinned-memory 를 준 같은 작업은 7,508 MB 에서 정점을 찍고 23분 17초 만에 끝났습니다. 고정된 메모리는 페이지 아웃이 되지 않으니, 스왑만 늘려서는 아무것도 달라지지 않습니다.

0.30~0.31 을 쓰시는데 올릴 수 없는 상황이라면, 재현 가능한 처방들이 바꾸는 것은 상수 하나입니다. comfy/supported_models.pyMiniMaxH3.memory_usage_factor0.114 에서 1.0 으로요. 0.32.0 이상이시라면 먼저 올리시고, 그래도 OOM 이 날 때만 손대세요.

실측된 실행과 그 뒤의 하드웨어

출처를 붙일 수 있을 만큼 자세한 실행이 열네 건 공개됐습니다. 어느 것도 벤치마크가 아닙니다. 변수를 고정한 사람이 아무도 없습니다. 존재 증명으로 읽어 주세요. 이 구성이 이만큼 걸려 끝났다, 라는 뜻입니다.

GPUVRAM호스트 RAM화면 크기길이시간
RTX 306012 GB16 GB0.2 MP5초51분 07초
RTX 306012 GB32 GB864×4805.17초, 20 스텝9분 미만
RTX 30708 GB32 GB0.4 MP5초약 9~10분
RTX 4090 Laptop + SageAttention16 GB32 GB960×5405초, 20 스텝182초
RTX 5070 Ti16 GB64 GB0.4 MP5 / 10 / 15초약 2 / 4.5 / 7분
RTX 508016 GB1.0 MP10초13분 36초
RTX 409024 GB832×48015초, 8 스텝약 25~30분
RTX 309024 GB31 GB15초23분 17초
RTX 5090 2장 (SGLang, ComfyUI 아님)각 32 GB377 GiB1344×768124 프레임, 50 스텝559.67초

마지막 줄은 호스트 RAM 377 GiB 를 가진 기계에서 카드 두 장으로 돌린 다른 런타임입니다. 규모를 보여 드리려고 넣었지 비교하시라고 넣은 것이 아닙니다. 이것으로 카드 한 장짜리 ComfyUI 속도를 예측하시면 틀립니다. 4090 한 장에서는 같은 처방이 가능 여부의 경계를 보여 줍니다. 832×480 은 124 프레임과 362 프레임 모두 끝나고, 1088×640 은 124 프레임에서 끝나며, 1088×640 의 192 프레임과 1344×768 의 362 프레임은 둘 다 OOM 입니다.

카드가 값을 하는지는 별개의 계산입니다.

해상도, 프레임, 그리고 17n+5 격자

Resolution Selector 의 설정 셋이 너비와 높이를 만듭니다. Multiple 은 32 로 두세요. 그것이 H3 의 격자입니다. 네이티브 화면은 짧은 변 768 픽셀이고 768×1344 에서 막힙니다. 16:9 에서 메가픽셀 0.98 이 정확히 1344×768 을 주고, 1.0 프리셋은 1376×768 을 주는데 그것은 문서에 적힌 화면 밖입니다. 템플릿은 0.4 MP 로 나옵니다. 거기에서 시작하세요. 바닥은 384p 이고 256p 는 아예 실패합니다.

프레임 수는 24 fps 에서 17n+5 로 스냅되니 대부분의 요청이 올림됩니다. 175 프레임은 7.29초이고, 7.00 은 없습니다. 4~15초 구간 전체에서 정수 초에 떨어지는 값은 정확히 하나, 192 프레임, 8.000초 입니다. 검증된 천장은 362 프레임, 15.08초입니다.

소리가 없거나, 소리가 일그러지거나

원인이 다른 두 가지 실패입니다.

무음은 배선 문제입니다. VAE 둘 다 올라와 있어야 하고 VAEDecodeAudio 출력이 저장 노드까지 닿아야 합니다. 플레이어 말고 파일을 확인하세요. 24 fps H.264 와 32 kHz AAC 스테레오가 보여야 합니다. 두 번째 스트림이 없다면 모델이 아니라 그래프가 틀린 것입니다.

ffprobe -hide_banner out.mp4

일그러짐은 샘플러 문제입니다. H3 는 화면과 소리를 서로 다른 플로 스케줄 둘, shift 12 와 shift 3 으로 돌리는데, 시계가 하나뿐인 샘플러는 그중 하나를 넘겨 밟습니다. 20 스텝에서는 이 오차가 보이지 않고, Turbo LoRA 가 쓰는 4 스텝에서는 클리핑과 잡음이 됩니다. ComfyUI 0.31.0 은 ModelSamplingAV 로 두 스케줄을 네이티브로 다룹니다. 그 아래 버전에서는 larryvrh 의 이중 시계 샘플러가 필요합니다.

오류와, 각각의 한 줄짜리 해결

무엇을 바꾸시기 전에 규칙 둘. 한 번에 변수 하나만 바꾸고 같은 프롬프트와 같은 시드로 다시 돌리세요. --lowvram--reserve-vram, --cache-none, 양자화 체크포인트를 한꺼번에 쌓으면 무엇이 도움이 됐는지 알 길이 없어집니다. 그리고 SageAttention 이나 TeaCache, EasyCache, GGUF 로더를 붙이시기 전에, 아무것도 손대지 않은 공식 템플릿 하나가 끝까지 가는 것을 먼저 보세요.

콘솔에 보이는 증상원인해결
샘플링 중 CUDA out of memory화면 크기 × 프레임이 계획을 넘음메가픽셀을 먼저 낮추고 프레임을 그다음에. 0.30~0.31 이면 0.32.0 으로 올리기(#15486)
프로세스가 죽고 기계가 멈추는데 CUDA 오류는 없음호스트 RAM. 고정된 메모리는 페이지 아웃이 안 됨--disable-pinned-memory --disable-async-offload
VAE 디코드 때만 OOM디코드 할당이 프레임 수에 따라 커짐프레임을 줄이거나 화면을 작게. 0.32.0 으로 올리기(#15477, #15446)
MiniMaxH3… 노드나 템플릿이 없음코어가 0.30.0 보다 오래됨python main.py --version, 업데이트, 재시작
「텍스트로 영상」 노드가 어디에도 없음오해T2V 템플릿은 아무것도 연결하지 않은 MiniMaxH3ImageToVideo 입니다. 서드파티 대체 노드를 설치하지 마세요
R2V 그래프에서 로더 오류Ref2VA 대신 FL2VA 체크포인트를 고름minimax_h3_ref2va_pruned_int8_convrot.safetensors 를 고르세요
결과물에 오디오 스트림이 없음오디오 VAE 가 안 올라왔거나 VAEDecodeAudio 가 저장 노드까지 못 닿음둘 다 확인하고 ffprobe 로 검증
소리가 튀거나 웅웅거리거나 잡음이 됨플로 스케줄 둘을 시계 하나로 밟음0.31.0 으로 올리거나(#15243) larryvrh 의 Turbo Sampler 사용
256p 에서 생성 실패H3 의 바닥인 384p 아래템플릿 프리셋을 쓰세요

빨라지게 하는 방법, 효과 순서대로

이 순서인 이유는 앞의 둘이 공짜이고 마지막 하나는 품질을 대가로 받기 때문입니다.

  1. 업데이트. 0.32.0 의 VAE 최적화와 메모리 수정이 어떤 플래그보다 값어치가 큽니다.
  2. 길이보다 화면을 먼저 줄이세요. 24 GB 카드에서 1 MP 가 자주 못 가는 자리를 0.4 MP 는 갑니다.
  3. SageAttention. --use-sage-attention 으로 띄우시거나 KJNodes 로 끼워 넣으세요. ComfyUI 는 대략 두 배로 추정하는데, 오프로드에 묶인 기계는 그보다 덜 봅니다. dtype 폴백 경고는 원래 나옵니다.
  4. Turbo LoRA. larryvrh 의 v4 가 샘플링을 약 20 스텝에서 48 스텝으로 줄입니다. 68 을 쓰세요. 4 는 빠른 움직임을 뭉개고, 8 을 넘기면 더 도움이 되지 않습니다.

--lowvram--disable-pinned-memory 와 함께 넣지 마세요. 서로 충돌합니다.

ComfyUI 에서 돌리지 말아야 할 때

로컬이 틀린 답인 경우가 셋, 분명히 맞는 답인 경우가 하나 있습니다.

미국 · EU · 영국 · 대한민국에 계시면서 가중치를 직접 올려 돌리시는 경우, 로컬은 틀립니다. 라이선스가 그것을 허락하지 않습니다. 오픈 웨이트로 2K 가 필요하신 경우에도 틀립니다. Regenerate-2K 는 끝내 공개되지 않았기 때문입니다. 그리고 시스템 RAM 16 GB 에 8 GB 카드인 경우에도 틀립니다. 거기에서는 5초짜리 한 편이 51분 걸렸다는 보고가 있습니다.

VRAM 24 GB 에 호스트 RAM 32 GB, 그리고 허용된 지역이시라면 로컬이 맞습니다. 그때 ComfyUI 는 배치 처리와 LoRA, 노드 단위 제어를 줍니다. 저희를 포함한 어떤 호스팅 인터페이스도 따라갈 수 없는 것들입니다. 여기에 파일 이름과 플래그를 하나하나 적어 둔 이유가 그것입니다.

첫 실행이 실패한 뒤에 나오는 질문

커스텀 노드가 필요한가요? 아닙니다. 0.30.0 부터 네이티브이고, 템플릿은 코어 노드만 씁니다.

왜 텍스트로 만드는 노드가 없나요? T2V 템플릿은 아무것도 연결하지 않은 MiniMaxH3ImageToVideo 입니다. 의도된 설계입니다.

실제로 어느 버전을 써야 하나요? 0.32.0 이상입니다. 0.30.0 도 돌기는 하지만 H3 관련 수정 아홉 개를 놓칩니다.

결과물이 왜 무음인가요? VAE 둘 다 올라와야 하고 VAEDecodeAudio 가 저장 노드까지 닿아야 합니다. ffprobe 로 확인하세요.

4 스텝에서 소리가 왜 깨지나요? 시계가 하나뿐인 샘플링이 오디오 스케줄을 넘겨 밟습니다. 0.31.0 에서 고쳐졌습니다.

디스크가 얼마나 필요한가요? T2V 와 I2V 에는 42.47 GB, Ref2VA 까지면 63.44 GB, 거기에 캐시를 더하세요.

12 GB 카드로 되나요? 됩니다. 오프로드를 많이 걸면요. 864×480, 124 프레임, 20 스텝을 9분 안에 끝냈다는 메인테이너 보고가 있습니다.

7초짜리를 만들었는데 왜 더 길게 나오나요? 프레임이 17n+5 로 스냅됩니다. 175 프레임이 7.29초입니다.

GGUF 빌드를 써야 하나요? 공식 빌드는 없습니다. 공식 구성이 돌아간 다음에만 시도하세요.

로컬에서 2K 가 되나요? 오픈 웨이트로는 안 됩니다. 0.33.1 부터 호스팅 Regenerate-2K 노드를 이어 붙이실 수는 있습니다.


바뀔 수 있는 것. 이 영역은 주 단위로 움직입니다. 0.33.1 보다 새로운 H3 항목이 있는지 ComfyUI 릴리스를 확인하세요. 362 프레임 천장은 서드파티 문서이지 공식 상한이 아닙니다. 그리고 memory_usage_factor 패치는 0.32.0 이상에서는 이미 필요 없을 수도 있습니다. 최종 확인 2026-08-14.

편집팀

쓴 사람

편집팀

minimax-h3ai.video

글 전체