perf(backend): явный пул соединений БД и несколько воркеров uvicorn
Пул создавался с дефолтом SQLAlchemy (5 + 10) и под нагрузкой выгребался за секунды. Теперь параметры заданы явно и вынесены в настройки: DB_POOL_SIZE=10, DB_MAX_OVERFLOW=10, DB_POOL_TIMEOUT=10. Таймаут снижен с дефолтных 30 секунд намеренно — пусть запрос падает быстро и показывает проблему, а не висит полминуты. Backend запускался одним процессом uvicorn: любой блокирующий вызов останавливал и параллельные запросы, и WS-чат всех участников. Добавлен UVICORN_WORKERS с дефолтом 2 — не по числу ядер, потому что на четырёхъядерном сервере ядра делятся с LiveKit, а медиа важнее API. Бюджет соединений считается на весь инстанс: каждый воркер держит свой пул, поэтому UVICORN_WORKERS × (DB_POOL_SIZE + DB_MAX_OVERFLOW) должно оставаться заметно ниже max_connections у Postgres. Многопроцессность безопасна: бутстрап настроек в lifespan идемпотентен (INSERT ... ON CONFLICT DO NOTHING), а WS-чат разносит сообщения через Redis pub/sub и состояния в памяти процесса не держит.
This commit is contained in:
@@ -20,6 +20,24 @@ class Settings(BaseSettings):
|
||||
redis_url: str = "redis://localhost:6379/0"
|
||||
plugins_config_path: str = "../config/plugins.yaml"
|
||||
|
||||
# --- Пул соединений с БД ---
|
||||
# Дефолт SQLAlchemy (5 + 10) на нагрузочном тесте 28.07.2026 выгребался
|
||||
# за секунды: 226 ошибок `QueuePool limit of size 5 overflow 10 reached`
|
||||
# и 37 ответов 500 на путях входа в конференцию.
|
||||
#
|
||||
# ⚠️ Бюджет соединений считается на ВЕСЬ инстанс, а не на процесс: каждый
|
||||
# воркер uvicorn (`UVICORN_WORKERS`) держит собственный пул, плюс
|
||||
# соединения нужны Celery-воркерам и alembic при миграциях. При
|
||||
# `max_connections=100` у Postgres и двух воркерах 2 × (10 + 10) = 40
|
||||
# оставляет запас. Поднимая значения на более крупном сервере, поднимайте
|
||||
# и `max_connections` — иначе вместо понятной ошибки приложения получите
|
||||
# отказ Postgres, который диагностируется куда хуже.
|
||||
db_pool_size: int = 10
|
||||
db_max_overflow: int = 10
|
||||
# 10 секунд вместо дефолтных 30 — сознательно: пусть запрос падает быстро
|
||||
# и показывает проблему, а не висит полминуты, делая вид, что всё живо.
|
||||
db_pool_timeout: int = 10
|
||||
|
||||
# --- Версия инстанса (релиз v0.0.1) ---
|
||||
# install.sh копирует значение из файла `VERSION` (корень репозитория) в
|
||||
# `.env` при каждой установке/обновлении — здесь только чтение готового
|
||||
@@ -59,6 +77,13 @@ class Settings(BaseSettings):
|
||||
# (см. `deploy/docker-compose.yml`); в тестах переопределяется на `tmp_path`.
|
||||
recordings_dir: str = "/recordings"
|
||||
|
||||
# Таймаут запуска Track Egress. Когда egress-сервиса в деплое нет (профиль
|
||||
# `transcribe` не поднят), LiveKit ждёт ответа воркера через Redis до
|
||||
# собственного таймаута psrpc — на тесте 28.07.2026 это давало по 20–25
|
||||
# секунд на каждый вызов. Ждать столько бессмысленно: если egress жив, он
|
||||
# отвечает за доли секунды.
|
||||
egress_start_timeout_s: float = 3.0
|
||||
|
||||
# --- Email (SMTP-бэкенд) ---
|
||||
# `console` — дефолт для dev (письмо только логируется); `smtp` — реальная
|
||||
# отправка через aiosmtplib. Секреты SMTP — только в `.env` (инвариант №6),
|
||||
|
||||
Reference in New Issue
Block a user