feat(voice): run pipeline eyes-free (STT -> Brain -> TTS), defer screen share
Make source/vision optional so the conversation loop runs with no screen capture. Add Settings.voice() preset and `python -m wsai --voice` demo. Co-Authored-By: Claude Opus 4.7 <noreply@anthropic.com>
This commit is contained in:
6
PLAN.md
6
PLAN.md
@@ -2,6 +2,12 @@
|
||||
|
||||
디스코드 화면공유를 실시간으로 함께 보며 **음성으로** 대화하는 AI.
|
||||
|
||||
## 방향 전환 (2026-08-11)
|
||||
|
||||
- **화면공유(눈) 부분은 일단 보류**하고, 먼저 **음성 대화 루프 STT → 두뇌 → TTS**를 완성한다.
|
||||
- 파이프라인은 이제 눈 없이(source/vision = None) 돌아간다: `python -m wsai --voice`.
|
||||
- 화면공유 관문 1(DAVE) 성과는 아래에 보존. 나중에 눈을 다시 붙일 때 재사용한다.
|
||||
|
||||
## 확정된 결정 (2026-08-09)
|
||||
|
||||
1. **캡처 방식 (눈)** — 사용자 요구: 스크린샷/브라우저 캡처 ❌,
|
||||
|
||||
Reference in New Issue
Block a user