feat: LiveSub 2차 — 자막 on/off, 모니터·위치 선택, GPU 저부하, 게임 용어집
이름을 Hearo → LiveSub 로 변경. 말장난보다 하는 일이 바로 보이는 쪽이 낫다. 자막 on/off - 전역 단축키 Ctrl+Alt+S (자막) / Ctrl+Alt+D (번역) — Windows RegisterHotKey + 네이티브 이벤트 필터라 게임 창이 떠 있어도 동작. 다른 OS 에서는 no-op - 단축키·체크박스·우클릭 메뉴가 모두 같은 경로를 타도록 통합 모니터 선택 + 디스코드식 배치 - placement.py: Qt 비의존 배치 계산 (모니터 목록 → 9분할 좌표) - AnchorGrid 위젯으로 3x3 위치 선택, 드래그하면 자유 배치로 전환 - 모니터 구성이 바뀌어도 자막이 화면 밖으로 사라지지 않도록 클램프 GPU 저부하 모드 (기본 켜짐) - 연산 정밀도 int8 강등, VRAM 상한 35%, 추론 후 60ms 양보, 300초 무음 시 모델 언로드, 중간 결과 비활성 - 기본 티어를 균형(6GB) → 신속(4GB) 으로 하향 - 8GB GPU 기준 자막 2.8GB / 게임 5.2GB 게임 용어집 번들 (304개) - 롤 74 · 발로란트 59 · 오버워치2 49 · FPS공통 46 · 마크 38 · 방송 38 - 체크박스로 켜고 끄며, 사용자가 직접 등록한 항목이 항상 우선 검증: pytest 91개 통과 (배치 14 + 팩 12 + UI 6 신규), ruff clean Co-Authored-By: Claude Opus 4.7 <noreply@anthropic.com>
This commit is contained in:
66
src/livesub/audio/file_source.py
Normal file
66
src/livesub/audio/file_source.py
Normal file
@@ -0,0 +1,66 @@
|
||||
"""파일/합성 오디오 캡처 백엔드.
|
||||
|
||||
실제 오디오 장치 없이 파이프라인 전체를 돌려볼 수 있게 해준다.
|
||||
개발·테스트·데모용이며 어느 OS에서나 동작한다.
|
||||
"""
|
||||
|
||||
from __future__ import annotations
|
||||
|
||||
import time
|
||||
import wave
|
||||
from pathlib import Path
|
||||
|
||||
import numpy as np
|
||||
|
||||
from ..constants import FRAME_SAMPLES, SAMPLE_RATE
|
||||
from .base import AudioSource, CaptureBackend, CaptureError, to_mono_16k
|
||||
|
||||
|
||||
class FileCapture(CaptureBackend):
|
||||
"""WAV 파일을 실시간 속도로 재생하듯 흘려보낸다."""
|
||||
|
||||
name = "file"
|
||||
per_process = False
|
||||
|
||||
def __init__(self, path: str | Path, loop: bool = False, realtime: bool = True) -> None:
|
||||
super().__init__()
|
||||
self.path = Path(path)
|
||||
self.loop = loop
|
||||
self.realtime = realtime
|
||||
|
||||
@staticmethod
|
||||
def available() -> bool:
|
||||
return True
|
||||
|
||||
@staticmethod
|
||||
def list_sources() -> list[AudioSource]:
|
||||
return []
|
||||
|
||||
def _read_wav(self) -> np.ndarray:
|
||||
if not self.path.is_file():
|
||||
raise CaptureError(f"오디오 파일을 찾을 수 없습니다: {self.path}")
|
||||
with wave.open(str(self.path), "rb") as wf:
|
||||
channels = wf.getnchannels()
|
||||
rate = wf.getframerate()
|
||||
width = wf.getsampwidth()
|
||||
raw = wf.readframes(wf.getnframes())
|
||||
if width == 2:
|
||||
data = np.frombuffer(raw, dtype=np.int16).astype(np.float32) / 32768.0
|
||||
elif width == 4:
|
||||
data = np.frombuffer(raw, dtype=np.float32)
|
||||
else:
|
||||
raise CaptureError(f"지원하지 않는 샘플 폭입니다: {width * 8}bit")
|
||||
return to_mono_16k(data, channels, rate)
|
||||
|
||||
def _run(self) -> None:
|
||||
audio = self._read_wav()
|
||||
chunk = FRAME_SAMPLES * 5 # 100ms
|
||||
while not self._stop.is_set():
|
||||
for start in range(0, audio.size, chunk):
|
||||
if self._stop.is_set():
|
||||
return
|
||||
self._emit(audio[start : start + chunk].copy())
|
||||
if self.realtime:
|
||||
time.sleep(chunk / SAMPLE_RATE)
|
||||
if not self.loop:
|
||||
return
|
||||
Reference in New Issue
Block a user