transcriber: enabled: true provider: "faster_whisper_cpu" model: small language: ru options: # Путь — КОНТРАКТ с backend/services/ai_tiers.py (WHISPER_MODELS_ROOT, # ADR-004): модель уровня `` хранится в подкаталоге # /models/whisper/, а не в плоском корне тома — иначе предзагрузка # (deploy/whisper/download-model.py) и детект доступности уровня AI # (services/ai_levels.py) не найдут скачанную модель. download_root: /models/whisper/small summarizer: enabled: true provider: "null" model: null chunk_minutes: 20 # Пример конфигурации уровня `min` (сервер llama.cpp с Qwen3.5-4B, ADR-004 # docs/architecture/adr/004-ai-tier-matrix.md — единственный источник имён # моделей/квантов; `medium`/`max` собираются автоматически из TIERS в # services/ai_tiers.py при выборе уровня в админке, руками их прописывать # сюда не нужно): # provider: qwen_local # model: qwen3.5-4b-instruct-q4_k_m # chunk_minutes: 20 # options: # base_url: http://llm:8080/v1 # tokenizer_path: /models/qwen/qwen3.5-4b-instruct.tokenizer.json # temperature: 0.2 # max_tokens_map: 1024 # max_tokens_reduce: 1536 chat: enabled: true