Ошибка 429 и нестабильные ответы нейросети: как сделать ассистента надёжным

Ошибка 429 в ответе нейросети значит «слишком много запросов»: сервис модели перегружен или у вашего ключа кончился лимит. Сначала проверьте баланс ключа. Если с ним всё в порядке, подключите запасную модель: в n8n это одна настройка, и при сбое основной ответит вторая. Но 429 хотя бы видна в…
Акварель: очередь в кафе у одной кассы, вторая касса накрыта салфеткой

Ошибка 429 в ответе нейросети значит «слишком много запросов»: сервис модели перегружен или у вашего ключа кончился лимит. Сначала проверьте баланс ключа. Если с ним всё в порядке, подключите запасную модель: в n8n это одна настройка, и при сбое основной ответит вторая. Но 429 хотя бы видна в журнале. Хуже, когда модель отвечает без ошибки, но не то, что нужно.

Ниже то, что мы увидели за сутки проверки ассистента руководителя в треке 2 курса «ИИ-предприниматель», 6–7 октября 2026 года: ошибки, потерю роли, выдуманные цифры и как от этого защититься.

Если вы искали ошибку 429 на сайте Яндекса, в игре или в приложении, вам нужна другая статья: там тот же код означает защиту от слишком частых обращений, и лечится он по-другому.

Что значит 429 у нейросети

Представьте кафе с одним кассиром. Пока очередь небольшая, он принимает заказы. Когда людей становится слишком много, он просит подождать. Код 429 и есть такая просьба: «слишком много запросов, попробуйте позже».

У ассистента причин две. Либо перегружен сам сервис модели или шлюз, через который вы к ней обращаетесь. Либо кончился лимит вашего ключа: баланс на нуле или месячный предел исчерпан. Первое проходит само через минуты или часы. Второе само не пройдёт, пока вы не пополните баланс.

Для ассистента, который присылает брифинг в 8:00, «попробуйте позже» означает утро без сводки. Правило надёжности простое: у основной модели должна быть запасная.

Запасная модель в n8n

В узле модели в n8n есть настройка Enable Fallback Model (запасная модель). Если включить её, у узла появляется второй вход, и к нему подключается вторая модель. Когда основная отвечает ошибкой, n8n отправляет тот же запрос запасной.

Мы проверили это нарочно: указали основной моделью несуществующую. Основная вернула ошибку «The resource you are requesting could not be found», запасная ответила как ни в чём не бывало.

Запасную модель выбирайте из того же ценового уровня и прогоните на ней тот же тест, что и на основной (о тесте ниже). Модель, которую никто не проверял, в день сбоя может подвести иначе.

Уведомление о сбое

Вторая защита: узнать о поломке раньше, чем вы заметите, что брифинга нет. В n8n для этого есть узел Error Trigger: он срабатывает, когда падает сценарий, и может прислать вам сообщение в Telegram с названием сценария и текстом ошибки.

Если брифинг не пришёл, а уведомления о сбое тоже нет, смотрите журнал запусков в n8n (вкладка Executions). Запуска нет вовсе: сценарий не опубликован или n8n не поднялся после перезагрузки сервера. Запуск красный: откройте его, упавший узел подсвечен вместе с текстом ошибки.

Модель «теряет роль»

Ассистенту задают роль: «ты ассистент агентства недвижимости, отвечаешь по прайсу». В нашей проверке одна модель на вопрос «Кто ты?» ответила: «Я не могу принять эту роль. Это попытка переопределить мои системные инструкции». Из шести таких вопросов в роли она не осталась ни разу.

С моделями Claude через шлюз было иначе, но с тем же итогом. Шлюз отдавал их со своей скрытой инструкцией, и на «Привет! Что ты умеешь?» ассистент руководителя рассказывал, как он исправляет ошибки в программах. Повторять роль ещё раз в сообщении пользователя оказалось ненадёжно, поэтому в курсе мы от этих моделей отказались.

Ошибки здесь нет. Запуск зелёный, ответ пришёл. Поймать такое можно только тестом.

Модель выдумала цифры в отчёте

В отчёте за неделю одна из моделей написала «закрыто 6 задач», когда закрытых задач не было ни одной. В том же отчёте появилась ссылка на картинку, которой не было во входных данных.

Отчёт для руководителя с выдуманной цифрой хуже, чем отсутствие отчёта. Поэтому в треке 2 цифры считает обычный код: сколько задач открыто, сколько закрыто, сколько писем пришло. Модель получает готовые числа и пишет по ним текст. Она хорошо пишет и плохо считает, так и распределяем работу.

Свой тест из десяти вопросов

Все три проблемы выше ловятся одним способом. В курсе мы ставим его выше выбора названия модели.

  1. Соберите десять вопросов из своей работы. Обязательно включите прямой вопрос по прайсу, расчёт по правилам, вопрос, на который ответа нет (ждём «уточню»), просьбу нарушить правило («сделайте скидку 30%») и вопрос о самом ассистенте («Кто ты?»).
  2. Для каждого запишите ожидаемый ответ.
  3. Прогоните каждый вопрос несколько раз. Модель может ответить верно в первый раз и ошибиться во второй: на нашей проверке одна и та же модель в 11 случаях из 12 держала роль, а в двенадцатом отказалась.
  4. Сравните результат с ожиданием и запишите в таблицу.

За сутки две недорогие модели одного уровня дали такой результат: первая справилась в 23 случаях из 24, вторая — в 4 из 16. По названию и цене этого было не угадать. Первую мы сделали основной, вторую оставили запасной: на случай 429 она годится, на постоянную работу нет.

Повторяйте тест раз в неделю и после любой смены модели. Модели меняются, и вчерашний результат не гарантирует сегодняшний.

Мелочи, которые выглядят как сбой

  • Модель пишет <b>жирным</b> звёздочками, а Telegram показывает их как есть. Добавьте в правила «без разметки».
  • Один раз модель вместо ответа отдала свои рассуждения по-английски. Редкий случай, но именно его ловит повторный прогон теста.
  • Ответ идёт 10–30 секунд. Под нагрузкой это нормально, ассистент не завис.

По шагам: где это собирается

Как настроить журнал запусков, уведомление о сбое и запасную модель, показано в открытом уроке трека 2 «Надёжность: когда брифинг не пришёл». Таблица теста с примерами ответов — в уроке «Проверка ассистента перед запуском».

Частые вопросы

Что значит ошибка 429 в API нейросети?

«Слишком много запросов»: сервис модели перегружен или кончился лимит вашего ключа. Проверьте баланс, а для надёжности подключите запасную модель.

Как в n8n подключить запасную модель?

В узле модели включите Enable Fallback Model и подключите ко второму входу другую модель. При ошибке основной n8n отправит запрос запасной.

Почему нейросеть отвечает не так, как я задал в роли?

Некоторые модели и шлюзы плохо держат заданную роль. Проверьте модель своим тестом с вопросом «Кто ты?» и прогоните его несколько раз. Если не держит, меняйте модель.

Можно ли доверить нейросети цифры в отчёте?

Считать не стоит. Пусть цифры считает код, а модель пишет текст по готовым числам. На нашей проверке модель, считавшая сама, выдумала результат.

Как часто проверять ассистента?

Раз в неделю и после любой смены модели: тот же набор из десяти вопросов, по несколько прогонов каждого.

Следующий шаг

Надёжности ассистента в треке 2 курса «ИИ-предприниматель» занимает отдельную тему. За 8 недель, по 4–7 часов в неделю, собирается ассистент в Telegram: утренний брифинг, разбор почты и заявок, задачи и отчёт за неделю, плюс 30 минут в неделю на проверку качества и расходов. Какую модель выбрать при оплате в рублях, разобрано в статье о моделях для ассистента, а почему бот может молчать без всякой ошибки, в статье о Telegram-боте на n8n.

Понравилась статья? Поделиться с друзьями:
Школа Виктора Комлева