monitoring: decouple default profile from optional llm/llm-gpu
Целевой набор профилей compose по умолчанию (media,monitoring) не включает llm/llm-gpu — job `llm` в prometheus.yml и алерт LlmDown в alerts.yml закомментированы, иначе Prometheus постоянно логировал бы неудачный скрейп несуществующего таргета, а LlmDown вечно оставался бы firing. Раскомментировать оба вместе — на инсталляциях с профилем llm/llm-gpu (пресеты 3-5 install.sh). Дашборд «Пайплайны пост-обработки» и docs/deploy/monitoring.md обновлены с пояснением, что большинство панелей показывают «No data» без transcribe/llm — это ожидаемо, не баг.
This commit is contained in:
@@ -40,6 +40,14 @@ scrape_configs:
|
||||
# которого в сети compose есть сетевой алиас `llm`, см. его определение в
|
||||
# deploy/docker-compose.yml) — эти профили взаимоисключающи, поэтому один
|
||||
# job без дублирования и без вечно недоступного второго таргета.
|
||||
- job_name: llm
|
||||
static_configs:
|
||||
- targets: ["llm:8080"]
|
||||
#
|
||||
# Закомментировано по умолчанию: целевой набор профилей compose —
|
||||
# `media,monitoring` (см. .env.example, COMPOSE_PROFILES), БЕЗ `llm`/
|
||||
# `llm-gpu` — таргет `llm:8080` в этом случае не резолвится вовсе, и
|
||||
# Prometheus писал бы в лог постоянные ошибки скрейпа, а алерт `LlmDown`
|
||||
# (deploy/monitoring/alerts.yml, тоже закомментирован) вечно оставался бы
|
||||
# firing. Раскомментируйте оба вместе на инсталляциях с профилем
|
||||
# `llm`/`llm-gpu` (пресеты 3–5 install.sh).
|
||||
# - job_name: llm
|
||||
# static_configs:
|
||||
# - targets: ["llm:8080"]
|
||||
|
||||
Reference in New Issue
Block a user