9 / 10
Как действовать при инциденте в LLM-системе: деградация модели или провайдера, всплеск выдумок, запасной вариант и готовый план действий?
Отказ провайдера / ошибки 5xx / 429 → следим за страницами статуса OpenAI и Anthropic и автоматически переключаемся на запасного провайдера. Всплеск задержки (P95 выше цели 5 минут) → зовём дежурного. Всплеск выдумок (просела верность источникам в онлайн-оценке) → проверяем недавние выкатки промпта, смену модели, изменения в поиске. Скачок расходов в 10 раз → шторм повторов или зациклившийся агент. Готовые планы действий, Sentry и разбор инцидента обязательны.