Ошибка 429 в ответе нейросети значит «слишком много запросов»: сервис модели перегружен или у вашего ключа кончился лимит. Сначала проверьте баланс ключа. Если с ним всё в порядке, подключите запасную модель: в n8n это одна настройка, и при сбое основной ответит вторая. Но 429 хотя бы видна в журнале. Хуже, когда модель отвечает без ошибки, но не то, что нужно.
Ниже то, что мы увидели за сутки проверки ассистента руководителя в треке 2 курса «ИИ-предприниматель», 6–7 октября 2026 года: ошибки, потерю роли, выдуманные цифры и как от этого защититься.
Если вы искали ошибку 429 на сайте Яндекса, в игре или в приложении, вам нужна другая статья: там тот же код означает защиту от слишком частых обращений, и лечится он по-другому.
Что значит 429 у нейросети
Представьте кафе с одним кассиром. Пока очередь небольшая, он принимает заказы. Когда людей становится слишком много, он просит подождать. Код 429 и есть такая просьба: «слишком много запросов, попробуйте позже».
У ассистента причин две. Либо перегружен сам сервис модели или шлюз, через который вы к ней обращаетесь. Либо кончился лимит вашего ключа: баланс на нуле или месячный предел исчерпан. Первое проходит само через минуты или часы. Второе само не пройдёт, пока вы не пополните баланс.
Для ассистента, который присылает брифинг в 8:00, «попробуйте позже» означает утро без сводки. Правило надёжности простое: у основной модели должна быть запасная.
Запасная модель в n8n
В узле модели в n8n есть настройка Enable Fallback Model (запасная модель). Если включить её, у узла появляется второй вход, и к нему подключается вторая модель. Когда основная отвечает ошибкой, n8n отправляет тот же запрос запасной.
Мы проверили это нарочно: указали основной моделью несуществующую. Основная вернула ошибку «The resource you are requesting could not be found», запасная ответила как ни в чём не бывало.
Запасную модель выбирайте из того же ценового уровня и прогоните на ней тот же тест, что и на основной (о тесте ниже). Модель, которую никто не проверял, в день сбоя может подвести иначе.
Уведомление о сбое
Вторая защита: узнать о поломке раньше, чем вы заметите, что брифинга нет. В n8n для этого есть узел Error Trigger: он срабатывает, когда падает сценарий, и может прислать вам сообщение в Telegram с названием сценария и текстом ошибки.
Если брифинг не пришёл, а уведомления о сбое тоже нет, смотрите журнал запусков в n8n (вкладка Executions). Запуска нет вовсе: сценарий не опубликован или n8n не поднялся после перезагрузки сервера. Запуск красный: откройте его, упавший узел подсвечен вместе с текстом ошибки.
Модель «теряет роль»
Ассистенту задают роль: «ты ассистент агентства недвижимости, отвечаешь по прайсу». В нашей проверке одна модель на вопрос «Кто ты?» ответила: «Я не могу принять эту роль. Это попытка переопределить мои системные инструкции». Из шести таких вопросов в роли она не осталась ни разу.
С моделями Claude через шлюз было иначе, но с тем же итогом. Шлюз отдавал их со своей скрытой инструкцией, и на «Привет! Что ты умеешь?» ассистент руководителя рассказывал, как он исправляет ошибки в программах. Повторять роль ещё раз в сообщении пользователя оказалось ненадёжно, поэтому в курсе мы от этих моделей отказались.
Ошибки здесь нет. Запуск зелёный, ответ пришёл. Поймать такое можно только тестом.
Модель выдумала цифры в отчёте
В отчёте за неделю одна из моделей написала «закрыто 6 задач», когда закрытых задач не было ни одной. В том же отчёте появилась ссылка на картинку, которой не было во входных данных.
Отчёт для руководителя с выдуманной цифрой хуже, чем отсутствие отчёта. Поэтому в треке 2 цифры считает обычный код: сколько задач открыто, сколько закрыто, сколько писем пришло. Модель получает готовые числа и пишет по ним текст. Она хорошо пишет и плохо считает, так и распределяем работу.
Свой тест из десяти вопросов
Все три проблемы выше ловятся одним способом. В курсе мы ставим его выше выбора названия модели.
- Соберите десять вопросов из своей работы. Обязательно включите прямой вопрос по прайсу, расчёт по правилам, вопрос, на который ответа нет (ждём «уточню»), просьбу нарушить правило («сделайте скидку 30%») и вопрос о самом ассистенте («Кто ты?»).
- Для каждого запишите ожидаемый ответ.
- Прогоните каждый вопрос несколько раз. Модель может ответить верно в первый раз и ошибиться во второй: на нашей проверке одна и та же модель в 11 случаях из 12 держала роль, а в двенадцатом отказалась.
- Сравните результат с ожиданием и запишите в таблицу.
За сутки две недорогие модели одного уровня дали такой результат: первая справилась в 23 случаях из 24, вторая — в 4 из 16. По названию и цене этого было не угадать. Первую мы сделали основной, вторую оставили запасной: на случай 429 она годится, на постоянную работу нет.
Повторяйте тест раз в неделю и после любой смены модели. Модели меняются, и вчерашний результат не гарантирует сегодняшний.
Мелочи, которые выглядят как сбой
- Модель пишет
<b>жирным</b>звёздочками, а Telegram показывает их как есть. Добавьте в правила «без разметки». - Один раз модель вместо ответа отдала свои рассуждения по-английски. Редкий случай, но именно его ловит повторный прогон теста.
- Ответ идёт 10–30 секунд. Под нагрузкой это нормально, ассистент не завис.
По шагам: где это собирается
Как настроить журнал запусков, уведомление о сбое и запасную модель, показано в открытом уроке трека 2 «Надёжность: когда брифинг не пришёл». Таблица теста с примерами ответов — в уроке «Проверка ассистента перед запуском».
Частые вопросы
Что значит ошибка 429 в API нейросети?
«Слишком много запросов»: сервис модели перегружен или кончился лимит вашего ключа. Проверьте баланс, а для надёжности подключите запасную модель.
Как в n8n подключить запасную модель?
В узле модели включите Enable Fallback Model и подключите ко второму входу другую модель. При ошибке основной n8n отправит запрос запасной.
Почему нейросеть отвечает не так, как я задал в роли?
Некоторые модели и шлюзы плохо держат заданную роль. Проверьте модель своим тестом с вопросом «Кто ты?» и прогоните его несколько раз. Если не держит, меняйте модель.
Можно ли доверить нейросети цифры в отчёте?
Считать не стоит. Пусть цифры считает код, а модель пишет текст по готовым числам. На нашей проверке модель, считавшая сама, выдумала результат.
Как часто проверять ассистента?
Раз в неделю и после любой смены модели: тот же набор из десяти вопросов, по несколько прогонов каждого.
Следующий шаг
Надёжности ассистента в треке 2 курса «ИИ-предприниматель» занимает отдельную тему. За 8 недель, по 4–7 часов в неделю, собирается ассистент в Telegram: утренний брифинг, разбор почты и заявок, задачи и отчёт за неделю, плюс 30 минут в неделю на проверку качества и расходов. Какую модель выбрать при оплате в рублях, разобрано в статье о моделях для ассистента, а почему бот может молчать без всякой ошибки, в статье о Telegram-боте на n8n.
