본문 바로가기

comfyui32

XFORMERS, ComfyUI에서 아직 설치해야 할까? PyTorch Attention 비교 ComfyUI 설치법을 찾다 보면 여전히 xFormers를 설치하면 VRAM이 줄고 속도가 빨라진다는 설명을 쉽게 볼 수 있다. 과거에는 꽤 중요한 팁이었지만, 최신 PyTorch와 ComfyUI에서는 상황이 달라졌다.결론부터 말하면 현재 ComfyUI에서 xFormers는 필수 패키지가 아니다. PyTorch 자체에 최적화된 Scaled Dot Product Attention, 즉 SDPA가 들어가면서 xFormers를 설치하지 않아도 효율적인 Attention 연산을 사용할 수 있기 때문이다. 다만 특정 GPU나 기존 환경에서는 여전히 비교해 볼 가치가 있다.XFORMERS에서 가장 먼저 볼 변화xFormers가 원래 해결하던 문제이미지 생성 모델의 Attention 연산은 해상도와 토큰 수가 증가할.. 2026. 8. 21.
ComfyUI CFG 값은 무엇을 바꾸나? KSampler 설정 기준 ComfyUI의 KSampler를 처음 만지면 steps, cfg, sampler_name, scheduler가 한꺼번에 보인다. 이 가운데 CFG는 숫자 하나만 바꿔도 이미지의 색감과 프롬프트 반영 정도가 크게 달라져 특히 헷갈리는 값이다.CFG는 단순한 ‘이미지 품질’ 옵션이 아니다. 핵심은 모델이 프롬프트 조건을 얼마나 강하게 따라가도록 밀어붙일 것인가다. 따라서 CFG를 무작정 높이는 것보다 현재 사용하는 모델과 프롬프트에서 필요한 수준을 찾는 것이 중요하다.CFG에서 가장 먼저 볼 변화CFG는 프롬프트를 따르는 힘을 조절한다CFG는 Classifier-Free Guidance의 약자다. 생성 과정에서 프롬프트가 적용된 예측과 그렇지 않은 쪽의 예측 차이를 이용해, 결과를 조건 방향으로 더 강하게.. 2026. 8. 21.
Fish Audio S2 Pro 로컬 TTS, ComfyUI에서 쓸 때 확인할 점 이미지 생성 모델을 ComfyUI에서 다루던 사용자라면 이제 음성도 같은 워크플로우 안에 넣고 싶어질 수 있다. 2026년 공개된 Fish Audio S2 Pro는 이런 용도에서 주목할 만한 오픈소스 계열 TTS 모델이다.다만 모델을 다운로드한 뒤 일반 Checkpoint처럼 ComfyUI에 넣으면 바로 동작하는 구조는 아니다. 실제로 확인해야 할 부분은 음질 자체보다 VRAM, 별도 추론 환경, 음성 제어 방식, 그리고 ComfyUI 커스텀 노드의 구현 상태다.오디오 모델에서 가장 먼저 볼 변화Fish Audio S2 Pro에서 가장 달라진 부분Fish Audio S2 Pro는 단순히 텍스트를 읽는 TTS보다 표현 제어에 초점을 맞춘 모델이다. 공식 모델은 1000만 시간 이상 규모의 오디오 데이터를 .. 2026. 8. 19.
LTX-2.5 ComfyUI VAE가 사라졌나? Diffusion Video Decoder 변화 LTX-2.5에서 눈여겨볼 변화 중 하나는 생성 모델 자체보다 마지막 영상을 복원하는 방식이다. 기존 LTX 계열에서 익숙했던 VAE 디코딩 단계에 Diffusion Video Decoder가 들어오면서, 얼굴이나 작은 텍스트, 빠르게 움직이는 장면을 복원하는 방식이 달라졌다.여기서 바로 생기는 질문이 있다. "그러면 LTX-2.5에서는 VAE가 사라진 것인가?" 결론부터 말하면 아니다. VAE의 역할이 없어졌다기보다 최종 복원 단계가 확장된 것으로 이해하는 편이 정확하다.vae관련 혹은 인코더 관련에서 가장 먼저 볼 변화LTX-2.5는 왜 일반 VAE Decode를 바꿨나일반적인 latent 기반 생성 모델에서는 픽셀 상태의 이미지나 영상을 작은 latent 표현으로 압축한 뒤, 모델이 이 공간에서 생.. 2026. 8. 18.