Files
live-app-translator/src/livesub/audio/file_source.py
EJClaw 8b36b244ff feat: LiveSub 2차 — 자막 on/off, 모니터·위치 선택, GPU 저부하, 게임 용어집
이름을 Hearo → LiveSub 로 변경. 말장난보다 하는 일이 바로 보이는 쪽이 낫다.

자막 on/off
- 전역 단축키 Ctrl+Alt+S (자막) / Ctrl+Alt+D (번역) — Windows RegisterHotKey +
  네이티브 이벤트 필터라 게임 창이 떠 있어도 동작. 다른 OS 에서는 no-op
- 단축키·체크박스·우클릭 메뉴가 모두 같은 경로를 타도록 통합

모니터 선택 + 디스코드식 배치
- placement.py: Qt 비의존 배치 계산 (모니터 목록 → 9분할 좌표)
- AnchorGrid 위젯으로 3x3 위치 선택, 드래그하면 자유 배치로 전환
- 모니터 구성이 바뀌어도 자막이 화면 밖으로 사라지지 않도록 클램프

GPU 저부하 모드 (기본 켜짐)
- 연산 정밀도 int8 강등, VRAM 상한 35%, 추론 후 60ms 양보,
  300초 무음 시 모델 언로드, 중간 결과 비활성
- 기본 티어를 균형(6GB) → 신속(4GB) 으로 하향
- 8GB GPU 기준 자막 2.8GB / 게임 5.2GB

게임 용어집 번들 (304개)
- 롤 74 · 발로란트 59 · 오버워치2 49 · FPS공통 46 · 마크 38 · 방송 38
- 체크박스로 켜고 끄며, 사용자가 직접 등록한 항목이 항상 우선

검증: pytest 91개 통과 (배치 14 + 팩 12 + UI 6 신규), ruff clean

Co-Authored-By: Claude Opus 4.7 <noreply@anthropic.com>
2026-09-21 17:49:26 +09:00

67 lines
2.1 KiB
Python

"""파일/합성 오디오 캡처 백엔드.
실제 오디오 장치 없이 파이프라인 전체를 돌려볼 수 있게 해준다.
개발·테스트·데모용이며 어느 OS에서나 동작한다.
"""
from __future__ import annotations
import time
import wave
from pathlib import Path
import numpy as np
from ..constants import FRAME_SAMPLES, SAMPLE_RATE
from .base import AudioSource, CaptureBackend, CaptureError, to_mono_16k
class FileCapture(CaptureBackend):
"""WAV 파일을 실시간 속도로 재생하듯 흘려보낸다."""
name = "file"
per_process = False
def __init__(self, path: str | Path, loop: bool = False, realtime: bool = True) -> None:
super().__init__()
self.path = Path(path)
self.loop = loop
self.realtime = realtime
@staticmethod
def available() -> bool:
return True
@staticmethod
def list_sources() -> list[AudioSource]:
return []
def _read_wav(self) -> np.ndarray:
if not self.path.is_file():
raise CaptureError(f"오디오 파일을 찾을 수 없습니다: {self.path}")
with wave.open(str(self.path), "rb") as wf:
channels = wf.getnchannels()
rate = wf.getframerate()
width = wf.getsampwidth()
raw = wf.readframes(wf.getnframes())
if width == 2:
data = np.frombuffer(raw, dtype=np.int16).astype(np.float32) / 32768.0
elif width == 4:
data = np.frombuffer(raw, dtype=np.float32)
else:
raise CaptureError(f"지원하지 않는 샘플 폭입니다: {width * 8}bit")
return to_mono_16k(data, channels, rate)
def _run(self) -> None:
audio = self._read_wav()
chunk = FRAME_SAMPLES * 5 # 100ms
while not self._stop.is_set():
for start in range(0, audio.size, chunk):
if self._stop.is_set():
return
self._emit(audio[start : start + chunk].copy())
if self.realtime:
time.sleep(chunk / SAMPLE_RATE)
if not self.loop:
return