OpenAI снизила цены GPT-5.6 Luna на 80% и Terra на 20%

31 июля 2026 года OpenAI опубликовала пост «Building abundant intelligence» за авторством Сары Фрайр. В посте компания описывает стратегию, которая объединяет четыре слоя, инфраструктуру, модели, платформу и продукты, с целью сделать продвинутый ИИ дешевле, мощнее и доступнее для большего числа людей и бизнесов. Логика такая: более совершенные системы привлекают больше пользователей, а растущая выручка от их использования финансирует дальнейшие исследования и инфраструктуру, цикл, который, по словам компании, и лежит в основе стратегии.

В качестве непосредственного примера в тот же день OpenAI снизила цены на модели семейства GPT-5.6. Цена GPT-5.6 Luna упала на 80%, до $0,20 за миллион входных токенов и $1,20 за миллион выходных. GPT-5.6 Terra подешевела на 20%, до $2 и $12 за миллион токенов соответственно. Отдельно упомянут «быстрый режим» (Fast mode) для GPT-5.6 Sol: он обрабатывает запросы в 2,5 раза быстрее обычного, но стоит вдвое дороже стандартного режима, источник не уточняет, относится ли эта наценка к входным токенам, выходным или к обоим.

OpenAI приводит несколько технических показателей эффективности, которые, по её словам, и позволили снизить цены. Оптимизация серверного программного обеспечения сократила сквозные издержки на обслуживание запросов на 20%. Спекулятивное декодирование повысило скорость генерации токенов более чем на 15%. Улучшенное управление контекстом подняло результат моделей на бенчмарке ARC-AGI-3 с 13,3% до 38,3% при этом расходуя в шесть раз меньше выходных токенов на задачу.

По данным компании, её сервисами пользуются более 1 млрд активных пользователей и свыше 2 млн компаний. OpenAI отмечает, что спустя полгода после регистрации пользователи в среднем отправляют примерно на 50% больше сообщений в день, чем в начале, и применяют ChatGPT примерно для вдвое большего числа типов задач, базовые цифры для этого сравнения в посте не приводятся.

Отдельно в посте говорится об инвестициях в инфраструктуру: OpenAI заявляет, что принимает решения о наращивании мощностей исходя из реальных сигналов спроса, роста числа пользователей, спроса корпоративных клиентов, использования API, выручки, возможностей моделей и достигнутой эффективности, а не строит мощности «про запас» в отрыве от нужд клиентов. Пост упоминает долгосрочные партнёрства как часть этого подхода к инфраструктуре, но не называет ни конкретных партнёров, ни сумм, ни сроков.

Ключевые факты

  • 31 июля 2026 года OpenAI опубликовала пост «Building abundant intelligence» за авторством Сары Фрайр, о стратегии удешевления и масштабирования ИИ сразу по четырём слоям: инфраструктура, модели, платформа, продукты.
  • В тот же день компания снизила цену GPT-5.6 Luna на 80% (до $0,20 за млн входных и $1,20 за млн выходных токенов) и GPT-5.6 Terra на 20% (до $2 и $12 соответственно); «быстрый режим» GPT-5.6 Sol обрабатывает запросы в 2,5 раза быстрее, но стоит вдвое дороже.
  • Технические улучшения: оптимизация серверного ПО снизила издержки на обслуживание запросов на 20%, спекулятивное декодирование ускорило генерацию токенов более чем на 15%, а улучшенное управление контекстом подняло результат на бенчмарке ARC-AGI-3 с 13,3% до 38,3% при вшестеро меньшем числе выходных токенов.
  • По данным OpenAI, у неё более 1 млрд активных пользователей и свыше 2 млн бизнес-клиентов; спустя полгода после регистрации пользователи в среднем отправляют примерно на 50% больше сообщений в день и применяют ChatGPT примерно для вдвое большего числа типов задач.
  • Инвестиции в инфраструктуру компания обещает соотносить с реальным спросом, а не наращивать мощности заранее; долгосрочные партнёрства упомянуты без конкретных сумм, сроков или названий партнёров.

Почему это важно

OpenAI впервые формализовала связку четырёх слоёв, инфраструктуры, моделей, платформы и продуктов, в единую стратегию удешевления ИИ и подкрепила её конкретным действием: одновременным снижением цен на две модели семейства GPT-5.6. Компания явно позиционирует эффективность (меньше токенов и вычислений на ту же задачу) как источник ценовых снижений, а не как разовую акцию, и приводит измеримые технические показатели в подтверждение.

Кому это важно

Бизнесам и разработчикам, которые уже используют GPT-5.6 через API, цены на Luna и Terra падают с того же дня публикации поста. Тем, кто следит за капитальной дисциплиной OpenAI на фоне огромных вложений в инфраструктуру ИИ, компания явно заявляет, что расходы привязаны к спросу, а не к спекулятивному наращиванию мощностей. Конкурентам и аналитикам рынка, сравнивающим стоимость токенов у крупных провайдеров моделей.

Как это применить

Компании с высоконагруженными, но не критичными по качеству задачами могут перейти на подешевевшую GPT-5.6 Luna и получить экономию до 80% на инференсе. Для сбалансированной продакшен-нагрузки подойдёт GPT-5.6 Terra, подешевевшая на 20%. Для задач, критичных к задержке ответа, доступен «быстрый режим» GPT-5.6 Sol, в 2,5 раза быстрее стандартного, но и вдвое дороже; выбор режима стоит соотносить с тем, действительно ли скорость важнее цены для конкретного сценария.

Можно ли доверять

Источник, официальный пост самой OpenAI, то есть все цифры (снижение цен, показатели эффективности, число пользователей и бизнес-клиентов, рост вовлечённости), это собственные, самостоятельно раскрытые данные компании, а не результат независимого аудита. Ценовые изменения проверяемы напрямую по прайс-листу API; показатели эффективности и вовлечённости пользователей проверить со стороны сложнее.

Риски и подводные камни

Формулировки о росте вовлечённости («примерно на 50% больше сообщений», «вдвое больше типов задач») даны без базовых значений для сравнения, оценить реальный масштаб роста по ним нельзя. Наценка «быстрого режима» Sol не детализирована по типу токенов. Заявления про долгосрочные партнёрства и инвестиции в инфраструктуру звучат без конкретных сумм, сроков и названий партнёров, что затрудняет оценку реальных обязательств компании.

«Клиентов в конечном счёте волнует выполнение задач, а не число потраченных ИИ-токенов.»

— Сара Фрайр, из поста OpenAI «Building abundant intelligence»