이름을 Hearo → LiveSub 로 변경. 말장난보다 하는 일이 바로 보이는 쪽이 낫다. 자막 on/off - 전역 단축키 Ctrl+Alt+S (자막) / Ctrl+Alt+D (번역) — Windows RegisterHotKey + 네이티브 이벤트 필터라 게임 창이 떠 있어도 동작. 다른 OS 에서는 no-op - 단축키·체크박스·우클릭 메뉴가 모두 같은 경로를 타도록 통합 모니터 선택 + 디스코드식 배치 - placement.py: Qt 비의존 배치 계산 (모니터 목록 → 9분할 좌표) - AnchorGrid 위젯으로 3x3 위치 선택, 드래그하면 자유 배치로 전환 - 모니터 구성이 바뀌어도 자막이 화면 밖으로 사라지지 않도록 클램프 GPU 저부하 모드 (기본 켜짐) - 연산 정밀도 int8 강등, VRAM 상한 35%, 추론 후 60ms 양보, 300초 무음 시 모델 언로드, 중간 결과 비활성 - 기본 티어를 균형(6GB) → 신속(4GB) 으로 하향 - 8GB GPU 기준 자막 2.8GB / 게임 5.2GB 게임 용어집 번들 (304개) - 롤 74 · 발로란트 59 · 오버워치2 49 · FPS공통 46 · 마크 38 · 방송 38 - 체크박스로 켜고 끄며, 사용자가 직접 등록한 항목이 항상 우선 검증: pytest 91개 통과 (배치 14 + 팩 12 + UI 6 신규), ruff clean Co-Authored-By: Claude Opus 4.7 <noreply@anthropic.com>
79 lines
2.4 KiB
Python
79 lines
2.4 KiB
Python
import numpy as np
|
|
|
|
from livesub.audio.segmenter import Segmenter, SegmenterConfig
|
|
from livesub.constants import SAMPLE_RATE
|
|
|
|
|
|
def tone(ms: int, amplitude: float = 0.3) -> np.ndarray:
|
|
n = SAMPLE_RATE * ms // 1000
|
|
t = np.arange(n, dtype=np.float32) / SAMPLE_RATE
|
|
return (np.sin(2 * np.pi * 220 * t) * amplitude).astype(np.float32)
|
|
|
|
|
|
def silence(ms: int) -> np.ndarray:
|
|
return np.zeros(SAMPLE_RATE * ms // 1000, dtype=np.float32)
|
|
|
|
|
|
def config(**kw) -> SegmenterConfig:
|
|
base = dict(silence_ms=300, min_segment_ms=200, max_segment_ms=5000,
|
|
partial_interval_ms=0)
|
|
base.update(kw)
|
|
return SegmenterConfig(**base)
|
|
|
|
|
|
def test_speech_then_silence_emits_one_final_segment():
|
|
seg = Segmenter(config())
|
|
out = seg.push(silence(200))
|
|
assert out == []
|
|
out += seg.push(tone(800))
|
|
out += seg.push(silence(600))
|
|
finals = [s for s in out if s.is_final]
|
|
assert len(finals) == 1
|
|
assert 0.7 <= finals[0].duration_s <= 1.8
|
|
|
|
|
|
def test_short_blip_is_discarded():
|
|
seg = Segmenter(config(min_segment_ms=500))
|
|
out = seg.push(tone(60)) + seg.push(silence(600))
|
|
assert out == []
|
|
|
|
|
|
def test_max_length_forces_a_cut():
|
|
seg = Segmenter(config(max_segment_ms=1000))
|
|
out = seg.push(tone(3000))
|
|
assert len([s for s in out if s.is_final]) >= 2
|
|
|
|
|
|
def test_partial_results_are_emitted_while_speaking():
|
|
seg = Segmenter(config(partial_interval_ms=300))
|
|
out = seg.push(tone(1500))
|
|
partials = [s for s in out if not s.is_final]
|
|
assert len(partials) >= 2
|
|
# 중간 결과는 누적된다
|
|
assert partials[-1].duration_s > partials[0].duration_s
|
|
|
|
|
|
def test_flush_returns_pending_speech():
|
|
seg = Segmenter(config())
|
|
assert seg.push(tone(700)) == [] # 아직 침묵이 안 왔으니 확정 없음
|
|
leftover = seg.flush()
|
|
assert leftover is not None and leftover.is_final
|
|
assert seg.flush() is None
|
|
|
|
|
|
def test_continuous_silence_never_emits():
|
|
seg = Segmenter(config())
|
|
for _ in range(10):
|
|
assert seg.push(silence(200)) == []
|
|
|
|
|
|
def test_lead_in_is_prepended():
|
|
"""발화 직전 오디오가 붙어 첫 음절이 잘리지 않아야 한다."""
|
|
seg = Segmenter(config(lead_in_ms=200))
|
|
seg.push(silence(400))
|
|
out = seg.push(tone(600)) + seg.push(silence(600))
|
|
finals = [s for s in out if s.is_final]
|
|
assert len(finals) == 1
|
|
# 0.6초 발화 + 최대 0.2초 리드인
|
|
assert finals[0].duration_s > 0.6
|