Files
live-app-translator/tests/test_segmenter.py
EJClaw 8b36b244ff feat: LiveSub 2차 — 자막 on/off, 모니터·위치 선택, GPU 저부하, 게임 용어집
이름을 Hearo → LiveSub 로 변경. 말장난보다 하는 일이 바로 보이는 쪽이 낫다.

자막 on/off
- 전역 단축키 Ctrl+Alt+S (자막) / Ctrl+Alt+D (번역) — Windows RegisterHotKey +
  네이티브 이벤트 필터라 게임 창이 떠 있어도 동작. 다른 OS 에서는 no-op
- 단축키·체크박스·우클릭 메뉴가 모두 같은 경로를 타도록 통합

모니터 선택 + 디스코드식 배치
- placement.py: Qt 비의존 배치 계산 (모니터 목록 → 9분할 좌표)
- AnchorGrid 위젯으로 3x3 위치 선택, 드래그하면 자유 배치로 전환
- 모니터 구성이 바뀌어도 자막이 화면 밖으로 사라지지 않도록 클램프

GPU 저부하 모드 (기본 켜짐)
- 연산 정밀도 int8 강등, VRAM 상한 35%, 추론 후 60ms 양보,
  300초 무음 시 모델 언로드, 중간 결과 비활성
- 기본 티어를 균형(6GB) → 신속(4GB) 으로 하향
- 8GB GPU 기준 자막 2.8GB / 게임 5.2GB

게임 용어집 번들 (304개)
- 롤 74 · 발로란트 59 · 오버워치2 49 · FPS공통 46 · 마크 38 · 방송 38
- 체크박스로 켜고 끄며, 사용자가 직접 등록한 항목이 항상 우선

검증: pytest 91개 통과 (배치 14 + 팩 12 + UI 6 신규), ruff clean

Co-Authored-By: Claude Opus 4.7 <noreply@anthropic.com>
2026-09-21 17:49:26 +09:00

79 lines
2.4 KiB
Python

import numpy as np
from livesub.audio.segmenter import Segmenter, SegmenterConfig
from livesub.constants import SAMPLE_RATE
def tone(ms: int, amplitude: float = 0.3) -> np.ndarray:
n = SAMPLE_RATE * ms // 1000
t = np.arange(n, dtype=np.float32) / SAMPLE_RATE
return (np.sin(2 * np.pi * 220 * t) * amplitude).astype(np.float32)
def silence(ms: int) -> np.ndarray:
return np.zeros(SAMPLE_RATE * ms // 1000, dtype=np.float32)
def config(**kw) -> SegmenterConfig:
base = dict(silence_ms=300, min_segment_ms=200, max_segment_ms=5000,
partial_interval_ms=0)
base.update(kw)
return SegmenterConfig(**base)
def test_speech_then_silence_emits_one_final_segment():
seg = Segmenter(config())
out = seg.push(silence(200))
assert out == []
out += seg.push(tone(800))
out += seg.push(silence(600))
finals = [s for s in out if s.is_final]
assert len(finals) == 1
assert 0.7 <= finals[0].duration_s <= 1.8
def test_short_blip_is_discarded():
seg = Segmenter(config(min_segment_ms=500))
out = seg.push(tone(60)) + seg.push(silence(600))
assert out == []
def test_max_length_forces_a_cut():
seg = Segmenter(config(max_segment_ms=1000))
out = seg.push(tone(3000))
assert len([s for s in out if s.is_final]) >= 2
def test_partial_results_are_emitted_while_speaking():
seg = Segmenter(config(partial_interval_ms=300))
out = seg.push(tone(1500))
partials = [s for s in out if not s.is_final]
assert len(partials) >= 2
# 중간 결과는 누적된다
assert partials[-1].duration_s > partials[0].duration_s
def test_flush_returns_pending_speech():
seg = Segmenter(config())
assert seg.push(tone(700)) == [] # 아직 침묵이 안 왔으니 확정 없음
leftover = seg.flush()
assert leftover is not None and leftover.is_final
assert seg.flush() is None
def test_continuous_silence_never_emits():
seg = Segmenter(config())
for _ in range(10):
assert seg.push(silence(200)) == []
def test_lead_in_is_prepended():
"""발화 직전 오디오가 붙어 첫 음절이 잘리지 않아야 한다."""
seg = Segmenter(config(lead_in_ms=200))
seg.push(silence(400))
out = seg.push(tone(600)) + seg.push(silence(600))
finals = [s for s in out if s.is_final]
assert len(finals) == 1
# 0.6초 발화 + 최대 0.2초 리드인
assert finals[0].duration_s > 0.6