이름을 Hearo → LiveSub 로 변경. 말장난보다 하는 일이 바로 보이는 쪽이 낫다. 자막 on/off - 전역 단축키 Ctrl+Alt+S (자막) / Ctrl+Alt+D (번역) — Windows RegisterHotKey + 네이티브 이벤트 필터라 게임 창이 떠 있어도 동작. 다른 OS 에서는 no-op - 단축키·체크박스·우클릭 메뉴가 모두 같은 경로를 타도록 통합 모니터 선택 + 디스코드식 배치 - placement.py: Qt 비의존 배치 계산 (모니터 목록 → 9분할 좌표) - AnchorGrid 위젯으로 3x3 위치 선택, 드래그하면 자유 배치로 전환 - 모니터 구성이 바뀌어도 자막이 화면 밖으로 사라지지 않도록 클램프 GPU 저부하 모드 (기본 켜짐) - 연산 정밀도 int8 강등, VRAM 상한 35%, 추론 후 60ms 양보, 300초 무음 시 모델 언로드, 중간 결과 비활성 - 기본 티어를 균형(6GB) → 신속(4GB) 으로 하향 - 8GB GPU 기준 자막 2.8GB / 게임 5.2GB 게임 용어집 번들 (304개) - 롤 74 · 발로란트 59 · 오버워치2 49 · FPS공통 46 · 마크 38 · 방송 38 - 체크박스로 켜고 끄며, 사용자가 직접 등록한 항목이 항상 우선 검증: pytest 91개 통과 (배치 14 + 팩 12 + UI 6 신규), ruff clean Co-Authored-By: Claude Opus 4.7 <noreply@anthropic.com>
67 lines
2.1 KiB
Python
67 lines
2.1 KiB
Python
"""파일/합성 오디오 캡처 백엔드.
|
|
|
|
실제 오디오 장치 없이 파이프라인 전체를 돌려볼 수 있게 해준다.
|
|
개발·테스트·데모용이며 어느 OS에서나 동작한다.
|
|
"""
|
|
|
|
from __future__ import annotations
|
|
|
|
import time
|
|
import wave
|
|
from pathlib import Path
|
|
|
|
import numpy as np
|
|
|
|
from ..constants import FRAME_SAMPLES, SAMPLE_RATE
|
|
from .base import AudioSource, CaptureBackend, CaptureError, to_mono_16k
|
|
|
|
|
|
class FileCapture(CaptureBackend):
|
|
"""WAV 파일을 실시간 속도로 재생하듯 흘려보낸다."""
|
|
|
|
name = "file"
|
|
per_process = False
|
|
|
|
def __init__(self, path: str | Path, loop: bool = False, realtime: bool = True) -> None:
|
|
super().__init__()
|
|
self.path = Path(path)
|
|
self.loop = loop
|
|
self.realtime = realtime
|
|
|
|
@staticmethod
|
|
def available() -> bool:
|
|
return True
|
|
|
|
@staticmethod
|
|
def list_sources() -> list[AudioSource]:
|
|
return []
|
|
|
|
def _read_wav(self) -> np.ndarray:
|
|
if not self.path.is_file():
|
|
raise CaptureError(f"오디오 파일을 찾을 수 없습니다: {self.path}")
|
|
with wave.open(str(self.path), "rb") as wf:
|
|
channels = wf.getnchannels()
|
|
rate = wf.getframerate()
|
|
width = wf.getsampwidth()
|
|
raw = wf.readframes(wf.getnframes())
|
|
if width == 2:
|
|
data = np.frombuffer(raw, dtype=np.int16).astype(np.float32) / 32768.0
|
|
elif width == 4:
|
|
data = np.frombuffer(raw, dtype=np.float32)
|
|
else:
|
|
raise CaptureError(f"지원하지 않는 샘플 폭입니다: {width * 8}bit")
|
|
return to_mono_16k(data, channels, rate)
|
|
|
|
def _run(self) -> None:
|
|
audio = self._read_wav()
|
|
chunk = FRAME_SAMPLES * 5 # 100ms
|
|
while not self._stop.is_set():
|
|
for start in range(0, audio.size, chunk):
|
|
if self._stop.is_set():
|
|
return
|
|
self._emit(audio[start : start + chunk].copy())
|
|
if self.realtime:
|
|
time.sleep(chunk / SAMPLE_RATE)
|
|
if not self.loop:
|
|
return
|