Обновлено 03.08.2026
Стоимость API-токенов: input, output и cache read
Как корректно сравнивать цены ИИ-API и почему одной ставки «за миллион токенов» недостаточно.
Три разных вида расхода
- Input — системный промпт, история, файлы, инструкции инструментов и новый запрос.
- Output — сгенерированный ответ и учитываемые моделью reasoning-токены.
- Cache read — повторно использованный upstream-кэш, если модель и маршрут подтвердили его в usage.
Формула PAYG
В PAYG стоимость считается по фактическому usage каждой категории и ставкам выбранной модели. У модели могут заметно отличаться цены входа и выхода, поэтому оценивайте реальный профиль нагрузки.
Для оценки бюджета возьмите реальные запросы приложения за несколько дней и отдельно посчитайте доли input, output и cache read.
Как считаются пакеты
Пакет — не запас только выходных токенов. Из него списывается учитываемый объём запроса с коэффициентом модели. Чем мощнее и дороже модель, тем быстрее расходуется одинаковый номинальный пакет.
Перед покупкой сравните срок действия, коэффициент нужной модели и свой месячный расход.
Практическая проверка
- Выполните один и тот же сценарий несколько раз.
- Запишите input/output/cache read и стоимость каждого вызова.
- Отдельно оцените обычный чат и агентную IDE-задачу.
- Не экстраполируйте бюджет по одному короткому запросу.
- Учитывайте, что длинная история повторно входит в следующие запросы.