CostPerPrompt посчитает реальную стоимость запросов к 232+ ИИ-моделям
На Hacker News в разделе Show HN представили CostPerPrompt, сайт с живыми, автоматически обновляемыми ценами API для более чем 232 ИИ-моделей и калькуляторами, которые переводят стоимость токенов в реальные деньги: сколько будет стоить в месяц чат-бот, агент или конкретная API-нагрузка.
Сайт объясняет базовую механику ценообразования: почти все крупные провайдеры ИИ берут плату за токен (примерно ¾ слова), причём отдельно за входные токены (то, что отправляет пользователь) и выходные (то, что генерирует модель), выходные обычно в 3, 5 раз дороже входных. Например, модель с тарифом $5 / $25 за миллион токенов означает $5 за каждый миллион отправленных токенов и $25 за каждый миллион сгенерированных.
Отдельно выделены две скидки, которые сильно меняют итоговую стоимость и которые, по утверждению авторов сайта, большинство статей о стоимости ИИ не учитывает: кеширование промптов (prompt caching) снижает стоимость повторяющегося входного текста до 90%, это особенно важно для чат-ботов, заново отправляющих при каждом запросе всю историю переписки, а пакетная обработка (batch processing) даёт скидку около 50% для задач, где можно подождать результат. Калькуляторы CostPerPrompt учитывают оба варианта скидок, тогда как большинство публикаций о стоимости ИИ, по словам авторов, игнорирует их, из-за чего такие оценки расходятся с реальностью в 2, 3 раза, как в большую, так и в меньшую сторону. Таблица цен на флагманские модели на сайте помечена датой обновления 2 августа 2026 года.
Ключевые факты
- CostPerPrompt агрегирует живые цены API 232+ ИИ-моделей и обновляет их автоматически.
- Калькуляторы переводят цену за токен в реальную стоимость чат-бота, агента или API-нагрузки в месяц.
- Выходные токены обычно в 3, 5 раз дороже входных; пример из текста, тариф $5/$25 за миллион токенов.
- Кеширование промптов снижает стоимость повторного входного текста до 90%, пакетная обработка, около 50%.
- Авторы сайта утверждают: без учёта этих скидок другие оценки стоимости ИИ расходятся с реальностью в 2, 3 раза.
Почему это важно
Стоимость использования ИИ-моделей через API, частый источник путаницы: провайдеры меняют цены, вводят разные тарифы на входные и выходные токены, добавляют скидки за кеширование и пакетную обработку. Без инструмента, сводящего всё это воедино, разработчику приходится вручную сверяться с документацией каждого провайдера или доверять устаревшим статьям. CostPerPrompt закрывает этот разрыв: живой список цен по 232+ моделям и калькулятор, который сразу переводит тарифы в понятную сумму за месяц для конкретного сценария использования.
Кому это важно
Разработчикам и командам, которые строят продукты поверх ИИ-API, чат-ботов, агентов, интеграций, и должны заранее прикинуть бюджет на инференс; техническим менеджерам и стартапам, сравнивающим провайдеров по цене; авторам технических статей и обзоров, которым нужны актуальные цифры вместо устаревших таблиц.
Как это применить
Калькуляторы сайта на основе ожидаемого объёма запросов, чат-бот, агент или произвольная API-нагрузка, и выбранной модели считают стоимость в месяц, автоматически применяя скидки за кеширование повторяющегося контекста (до 90%) и за пакетную обработку (около 50%), если сценарий их предполагает. Это позволяет сравнивать не список цен за токен, а итоговый счёт для конкретной задачи.
Можно ли доверять
Источник, собственное описание сайта в посте Show HN на Hacker News, без независимой проверки. В тексте не указаны ни авторы, ни компания за проектом, ни механизм, которым цены «232+ моделей» обновляются автоматически (нет упоминания API провайдеров, скрапинга или ручной модерации). Утверждение о том, что другие статьи ошибаются в оценках стоимости в 2, 3 раза, тоже заявление самого сайта, без ссылки на конкретные примеры или методику подсчёта.
Риски и подводные камни
Главный риск, актуальность и точность данных: цены API у провайдеров меняются часто, и при непрозрачном механизме обновления устаревшая или неточная цифра может привести к ошибке в бюджете продукта. Кроме того, не все провайдеры и модели предлагают кеширование промптов или пакетную обработку на одинаковых условиях, калькулятор упрощает картину до общей ставки скидки (90% и 50%), тогда как реальные условия конкретного провайдера могут отличаться.