3 Commits

Author SHA1 Message Date
claude
1aa0bbf3e6 feat: OuteTTS 엔진 추가(개인용/비상업 CC-BY-NC, 한국어)
- Qwen2 500M + WavTokenizer, torch cu128 GPU, 전용 venv 워커(8003)
- 한국어 프리셋 4종(male/female), 속도·피치 librosa 후처리
- transformers 4.49로 torchvision 강제 import 회피, soundfile 저장
- scenema-audio는 VRAM 24GB+/Gemma12B 게이트로 8GB GPU에선 불가 → 미포함
2026-08-25 10:02:24 +09:00
claude
ed09c6a08f feat: Supertonic 엔진 추가(자연스러운 한국어, MIT, ONNX)
- 전용 venv 워커(8002)로 격리, MeloTTS(8788)와 병행
- 남녀 10종 음성, 한국어/자동감지(다국어), 속도·피치
- 모델 ~260MB 베이킹, torch/GPU 불필요
- entrypoint로 워커+메인앱 동시 기동
2026-08-24 21:00:45 +09:00
claude
9c1009d16d feat: CosyVoice 한국어 엔진 통합 (Apache-2.0, GPU)
- vendor/CosyVoice: 패치된 CosyVoice 코드 + Matcha-TTS 벤더링
- cosyvoice_worker: 전용 venv에서 상주하는 합성 워커(FastAPI, 모델 1회 로드)
- app/engines/cosyvoice_engine: HTTP 프록시 엔진(속도/피치)
- Dockerfile: 전용 venv(torch cu128) + 모델 베이킹 + 빌드 워밍업
- entrypoint.sh: 워커(8001) + 메인앱(8788) 동시 기동
2026-08-23 23:16:24 +09:00