VoiceCloning1 Fish Audio S2 Pro 로컬 TTS, ComfyUI에서 쓸 때 확인할 점 이미지 생성 모델을 ComfyUI에서 다루던 사용자라면 이제 음성도 같은 워크플로우 안에 넣고 싶어질 수 있다. 2026년 공개된 Fish Audio S2 Pro는 이런 용도에서 주목할 만한 오픈소스 계열 TTS 모델이다.다만 모델을 다운로드한 뒤 일반 Checkpoint처럼 ComfyUI에 넣으면 바로 동작하는 구조는 아니다. 실제로 확인해야 할 부분은 음질 자체보다 VRAM, 별도 추론 환경, 음성 제어 방식, 그리고 ComfyUI 커스텀 노드의 구현 상태다.오디오 모델에서 가장 먼저 볼 변화Fish Audio S2 Pro에서 가장 달라진 부분Fish Audio S2 Pro는 단순히 텍스트를 읽는 TTS보다 표현 제어에 초점을 맞춘 모델이다. 공식 모델은 1000만 시간 이상 규모의 오디오 데이터를 .. 2026. 8. 19. 이전 1 다음