Обновлено 03.08.2026

Стоимость API-токенов: input, output и cache read

Как корректно сравнивать цены ИИ-API и почему одной ставки «за миллион токенов» недостаточно.

Три разных вида расхода

  • Input — системный промпт, история, файлы, инструкции инструментов и новый запрос.
  • Output — сгенерированный ответ и учитываемые моделью reasoning-токены.
  • Cache read — повторно использованный upstream-кэш, если модель и маршрут подтвердили его в usage.

Формула PAYG

В PAYG стоимость считается по фактическому usage каждой категории и ставкам выбранной модели. У модели могут заметно отличаться цены входа и выхода, поэтому оценивайте реальный профиль нагрузки.

Для оценки бюджета возьмите реальные запросы приложения за несколько дней и отдельно посчитайте доли input, output и cache read.

Как считаются пакеты

Пакет — не запас только выходных токенов. Из него списывается учитываемый объём запроса с коэффициентом модели. Чем мощнее и дороже модель, тем быстрее расходуется одинаковый номинальный пакет.

Перед покупкой сравните срок действия, коэффициент нужной модели и свой месячный расход.

Практическая проверка

  • Выполните один и тот же сценарий несколько раз.
  • Запишите input/output/cache read и стоимость каждого вызова.
  • Отдельно оцените обычный чат и агентную IDE-задачу.
  • Не экстраполируйте бюджет по одному короткому запросу.
  • Учитывайте, что длинная история повторно входит в следующие запросы.

Готовы попробовать?

Создайте ключ в личном кабинете и отправьте первый запрос.

Создать аккаунт