From 82e0fa7ca2cda66dc90df86d1fe4e6e46754f193 Mon Sep 17 00:00:00 2001 From: workD12 Date: Fri, 11 Sep 2026 19:49:21 +0300 Subject: [PATCH] =?UTF-8?q?Handoff:=20=D0=BF=D0=BE=D0=BB=D0=BD=D1=8B=D0=B9?= =?UTF-8?q?=20=D0=BD=D0=B0=D0=B1=D0=BE=D1=80=20=D0=B7=D0=B0=D0=B2=D0=B8?= =?UTF-8?q?=D1=81=D0=B8=D0=BC=D0=BE=D1=81=D1=82=D0=B5=D0=B9=20=D0=B4=D0=BB?= =?UTF-8?q?=D1=8F=20=D0=BD=D0=BE=D0=B2=D0=BE=D0=B3=D0=BE=20=D0=9F=D0=9A=20?= =?UTF-8?q?(torch=20CPU,=20silero-vad,=20readchar)=20+=20=D0=B8=D0=BD?= =?UTF-8?q?=D1=81=D1=82=D1=80=D1=83=D0=BA=D1=86=D0=B8=D1=8F=20=D1=83=D1=81?= =?UTF-8?q?=D1=82=D0=B0=D0=BD=D0=BE=D0=B2=D0=BA=D0=B8?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit --- docs/HANDOFF.md | 36 +++++++++++++++++++++++++++++++++--- requirements.txt | 12 +++++++++--- 2 files changed, 42 insertions(+), 6 deletions(-) diff --git a/docs/HANDOFF.md b/docs/HANDOFF.md index c41706c..3938b8a 100644 --- a/docs/HANDOFF.md +++ b/docs/HANDOFF.md @@ -67,12 +67,42 @@ HOTKEY_DIALOG=space, HOTKEY_TALK=num 0, HOTKEY_STOP=esc, HOTKEY_REPEAT=enter. ## Окружение (на этой машине) - .venv на python3.13 (Debian: venv без pip — ставить `python3 -m pip --python .venv install ...`). -- torch 2.14.0+cpu, torchaudio 2.11.0+cpu (CPU-варианты!), silero-vad 6.2.1, faster-whisper 1.2.1, - edge-tts 7.2.8, piper-tts 1.8.0, sounddevice 0.5.6 (Linux: нужен apt-пакет libportaudio2), - keyboard 0.13.5, readchar 4.2.2, openai 3.13.0. - Модели: ~/.cache/huggingface (whisper small), models/piper/ (121 МБ). - Первый старт whisper качает модель ~460 МБ (если HF недоступен: HF_ENDPOINT=https://hf-mirror.com). +## Установка на новом компьютере (полный набор, проверенный) + +```bash +# 1. Клонировать и окружение +git clone <репозиторий> && cd Blind +python3 -m venv .venv && source .venv/bin/activate +cp .env.example .env # и вписать реальный OPENROUTER_API_KEY (и WAKE_WORD при желании) + +# 2. Основные зависимости +pip install -r requirements.txt + +# 3. Linux: системный PortAudio (звук) +sudo apt install -y libportaudio2 + +# 4. torch/клиент для Silero-VAD — СТРОГО CPU (GPU-пакеты 2.5 ГБ не нужны): +pip install --index-url https://download.pytorch.org/whl/cpu torch +pip install --index-url https://download.pytorch.org/whl/cpu torchaudio --force-reinstall --no-deps + +# 5. Whisper-модель скачается при первом запуске (~460 МБ, кэш ~/.cache/huggingface) +# 6. Голос Piper (если TTS_PROVIDER=piper): +python -m piper.download_voices ru_RU-dmitri-medium --download-dir models/piper + +# 7. Куи-файлы уже в git (assets/earcons/*.wav); перегенерация после смены голоса: +python assets/earcons/generate_cues.py --force + +# 8. Проверка: +python modules/assistant/test_free.py # «Марта» → диалог → «До свидания» +``` + +Прокси (OPENROUTER_PROXY=http://192.168.0.246:8887) работает только в LAN юзера — +вне его сети понадобится VPN/другой egress, иначе openai/* и часть источников недоступны +(gemma-3-27b и glm работают из РФ напрямую, проверено). + ## Как запускать (проверенные команды) ```bash diff --git a/requirements.txt b/requirements.txt index 83fed57..e755470 100644 --- a/requirements.txt +++ b/requirements.txt @@ -10,12 +10,18 @@ numpy>=1.26 # Модуль 1: STT (речь → текст) faster-whisper==1.2.1 +# Модуль 5: клавиши и свободный режим +keyboard==0.13.5 # глобальные клавиши (Windows; на Linux требует root) +readchar==4.2.2 # одиночные клавиши в консоли без root (пробел без Enter) + +# Silero-VAD требует torch. СТАВИТЬ ТОЛЬКО CPU-ВАРИАНТ (GPU-пакеты 2.5 ГБ не нужны!): +# pip install --index-url https://download.pytorch.org/whl/cpu torch +# pip install --index-url https://download.pytorch.org/whl/cpu torchaudio --force-reinstall --no-deps +silero-vad==6.2.1 # после torch (см. команды выше) + # Модуль 4: brain (LLM через OpenRouter) openai>=3.13 httpx>=0.27 # http_client с прокси для OpenAI-клиента -# Модуль 5: глобальные клавиши (Windows; на Linux требует root — тест через console-бэкенд) -keyboard==0.13.5 - # Дальше зависимости добавляются по мере готовности следующих модулей: # aiogram>=3 # Модуль 6 (Telegram) \ No newline at end of file