Расходы и кэширование: как не сжечь бюджет

API — это реальные деньги за каждый запрос. Хорошая новость: расходы маркетолога обычно измеряются несколькими долларами в месяц, если не делать типичных ошибок. Разберём, где утекает бюджет и как его беречь.

🎯 После урока сможешь: настроить кэширование и удержать расходы на API в пределах пары долларов в месяц.

Где деньги «утекают»

  Ошибка                                     Лишний расход
  ──────────────────────────────────────────────────────
  Opus для классификации                     × 60
  Каждый раз шлём весь брендбук в промпт      × 5–10
  Не поставили лимит max_tokens              × 2–3
  Большие пачки без пакетной обработки        × 2

Контроль расходов

  • В Anthropic Console: Settings → Limits → задать месячный лимит (например, $50) и уведомления на 50% / 80%.
  • В запросе всегда ставить max_tokens — жёсткий потолок длины ответа.
  • Логировать стоимость каждого запроса (по полю usage в ответе) в Google Sheets.

Кэширование: экономия до 90%

Проблема: системный промпт с брендбуком (~1 500 токенов) отправляется при каждом запросе. На 100 постах это 150 000 лишних токенов. Решение: кэширование — Anthropic запоминает большой статичный блок и при повторных запросах берёт его из кэша по цене 10% от обычной.

  Когда применять кэширование:
  • большой системный промпт (≥ 1 024 токена)
  • один и тот же контекст для серии запросов
  • повторы в течение 5 минут (время жизни кэша)

  Эффект на постоянном брендбуке:
  10 постов  → экономия ~60%
  100 постов → экономия ~88%
  1000 постов → экономия ~90%
response = client.messages.create(
    model="claude-sonnet-5",
    max_tokens=500,
    system=[{
        "type": "text",
        "text": "<брендбук компании ~1500 токенов>",
        "cache_control": {"type": "ephemeral"}   # включаем кэш
    }],
    messages=[{"role": "user", "content": "Пост про запуск весенней коллекции"}]
)
Первый запрос платный, следующие 99 — по 10% цены системного блока.

В no-code (n8n / Make) кэш включается так же — добавляете cache_control в JSON системного промпта через нод HTTP Request.

Кэширование — главный приём экономии для маркетолога. Применяйте всегда, когда есть постоянный системный промпт (а брендбук постоянный). Бюджет с оптимизацией: 100 постов + 30 рассылок + отчёты + анализ отзывов ≈ $3.5–6/мес вместо $15–30.

Контрольный вопрос. Что делает кэширование системного промпта?

АПовторно использует большой статичный блок по цене 10% — экономит до 90%
БУскоряет интернет
ВУдаляет старые запросы

Подсказка: Кэш = 10% от обычной цены на повторах.

Онлайн-проверка ответа появится позже

Контрольный вопрос. Когда кэширование даёт наибольший эффект?

АБольшой постоянный системный промпт + серия запросов подряд
БОдин разовый короткий запрос
ВКогда каждый промпт полностью разный

Подсказка: Постоянный контекст + много запросов.

Онлайн-проверка ответа появится позже

Контрольный вопрос. Зачем ставить месячный лимит в Anthropic Console?

АЧтобы не потратить лишнего из-за ошибки в пайплайне
БЧтобы ускорить ответы
ВЭто обязательно по закону

Подсказка: Страховка от «сжёг бюджет за ночь».

Онлайн-проверка ответа появится позже

Что дальше

Фундамент готов: ключ, модели, расходы под контролем. В Модуле 3 соберём первую команду агентов-копирайтеров. Сначала закрепим модуль на практике.

Назад  ·  ↑ В начало урока  ·  ⌂ В начало курса  ·  Вперёд →

Школа Виктора Комлева