분류 전체보기131 XFORMERS, ComfyUI에서 아직 설치해야 할까? PyTorch Attention 비교 ComfyUI 설치법을 찾다 보면 여전히 xFormers를 설치하면 VRAM이 줄고 속도가 빨라진다는 설명을 쉽게 볼 수 있다. 과거에는 꽤 중요한 팁이었지만, 최신 PyTorch와 ComfyUI에서는 상황이 달라졌다.결론부터 말하면 현재 ComfyUI에서 xFormers는 필수 패키지가 아니다. PyTorch 자체에 최적화된 Scaled Dot Product Attention, 즉 SDPA가 들어가면서 xFormers를 설치하지 않아도 효율적인 Attention 연산을 사용할 수 있기 때문이다. 다만 특정 GPU나 기존 환경에서는 여전히 비교해 볼 가치가 있다.XFORMERS에서 가장 먼저 볼 변화xFormers가 원래 해결하던 문제이미지 생성 모델의 Attention 연산은 해상도와 토큰 수가 증가할.. 2026. 8. 21. ComfyUI CFG 값은 무엇을 바꾸나? KSampler 설정 기준 ComfyUI의 KSampler를 처음 만지면 steps, cfg, sampler_name, scheduler가 한꺼번에 보인다. 이 가운데 CFG는 숫자 하나만 바꿔도 이미지의 색감과 프롬프트 반영 정도가 크게 달라져 특히 헷갈리는 값이다.CFG는 단순한 ‘이미지 품질’ 옵션이 아니다. 핵심은 모델이 프롬프트 조건을 얼마나 강하게 따라가도록 밀어붙일 것인가다. 따라서 CFG를 무작정 높이는 것보다 현재 사용하는 모델과 프롬프트에서 필요한 수준을 찾는 것이 중요하다.CFG에서 가장 먼저 볼 변화CFG는 프롬프트를 따르는 힘을 조절한다CFG는 Classifier-Free Guidance의 약자다. 생성 과정에서 프롬프트가 적용된 예측과 그렇지 않은 쪽의 예측 차이를 이용해, 결과를 조건 방향으로 더 강하게.. 2026. 8. 21. Fish Audio S2 Pro 로컬 TTS, ComfyUI에서 쓸 때 확인할 점 이미지 생성 모델을 ComfyUI에서 다루던 사용자라면 이제 음성도 같은 워크플로우 안에 넣고 싶어질 수 있다. 2026년 공개된 Fish Audio S2 Pro는 이런 용도에서 주목할 만한 오픈소스 계열 TTS 모델이다.다만 모델을 다운로드한 뒤 일반 Checkpoint처럼 ComfyUI에 넣으면 바로 동작하는 구조는 아니다. 실제로 확인해야 할 부분은 음질 자체보다 VRAM, 별도 추론 환경, 음성 제어 방식, 그리고 ComfyUI 커스텀 노드의 구현 상태다.오디오 모델에서 가장 먼저 볼 변화Fish Audio S2 Pro에서 가장 달라진 부분Fish Audio S2 Pro는 단순히 텍스트를 읽는 TTS보다 표현 제어에 초점을 맞춘 모델이다. 공식 모델은 1000만 시간 이상 규모의 오디오 데이터를 .. 2026. 8. 19. MiniMax H3 특이성, 영상 생성에서 오디오까지 한 모델이 처리한다 MiniMax H3를 단순히 새로운 Text-to-Video 모델로 보면 가장 중요한 특징을 놓치게 된다. H3의 핵심은 영상 해상도나 생성 길이보다 텍스트·이미지·영상·오디오를 하나의 문맥으로 받아들이고, 영상과 소리를 함께 생성하도록 설계된 omni-modal 구조에 있다. MiniMax는 2026년 7월 H3를 공개하며 최대 2K 해상도, 최대 15초 영상과 네이티브 스테레오 오디오 생성을 주요 기능으로 제시했다.따라서 기존 I2V 워크플로우에서 영상 생성 후 별도의 TTS, 효과음, 음악 생성 단계를 이어 붙이던 사용자라면 H3를 볼 때 벤치마크 점수보다 먼저 확인할 부분이 있다. 영상과 오디오가 처음부터 같은 생성 문맥 안에서 만들어진다는 점이 실제 제작 파이프라인에 어떤 차이를 만드는가다.미니.. 2026. 8. 19. 이전 1 ··· 18 19 20 21 22 23 24 ··· 33 다음