OpenAI выпустила GPT-6 Astra, флагманскую модель для бизнеса и работы за компьютером

OpenAI выпустила GPT-6 Astra, флагманскую модель для бизнеса и работы за компьютером

OpenAI на прошлой неделе представила GPT-6 Astra, новую флагманскую модель, которую компания называет самой умной и «согласованной» (наиболее точно следующей намерениям и правам доступа пользователя) моделью в мире. Astra уже доступна в корпоративной версии ChatGPT, ChatGPT Work, в Codex и через API. По словам OpenAI, это передовая модель для работы с компьютером (computer use), просмотра веб-страниц, профессиональных задач, разработки ПО, кибербезопасности и науки.

Большинству ИИ-систем перед реальной работой нужна подготовка: бизнесу приходится готовить данные, перестраивать рабочие процессы и писать интеграции. По словам OpenAI, Astra эту проблему снимает, в ChatGPT Work и Codex модель пишет код и работает прямо в тех приложениях, которыми люди пользуются каждый день, даже если у приложения нет API. Это значит, что компании могут встраивать ИИ в уже существующие процессы с первого дня, без долгой подготовки и инженерной работы. Уже в первые дни после запуска, утверждает OpenAI, клиенты начали применять Astra для оптимизации работы GPU, поиска расхождений в финансовой отчётности и подготовки презентаций в фирменном стиле компании, Astra в целом лучше следует голосу бренда, шаблонам и стандартам оформления, так что первый результат чаще оказывается пригоден к использованию сразу.

Внутри самой OpenAI Astra тестировали за несколько недель до публичного запуска, и компания успела ощутить эффект на себе. Команды разработки и маркетинга с помощью Astra и Codex смонтировали из трёх часов отснятого с нескольких камер материала ролик «GPT-6 Astra Developer First Impressions», он набрал больше 550 тысяч просмотров всего за 4 дня. Инженерная команда с помощью Astra нашла и устранила узкое место в распределении памяти, из-за которого сессии Codex в тестовой среде работали медленно: после смены аллокатора памяти задержка отклика на одно обращение (turn) сократилась в 25 раз, а пиковое потребление памяти выросло примерно на 30%.

Astra продолжает линию OpenAI на модели, которые дают больше полезной работы на доллар: её обучили решать задачи за меньшее число токенов и с меньшим числом повторных попыток, а значит, с меньшей переделкой и более низкой стоимостью задачи. Цена в API, от $10 за миллион входных токенов и $50 за миллион выходных. По утверждению OpenAI, с выходом Astra компания занимает большую часть границы эффективности «цена/качество» на тестах профессиональной работы и кода, включая Terminal Bench 4.0 и Artificial Analysis Intelligence Index, конкретных баллов или мест в этих рейтингах в анонсе не приведено.

Отдельный акцент OpenAI сделала на безопасности: Astra называют самой «согласованной» моделью компании на сегодня, с более строгим следованием намерениям человека и правам доступа. На внутреннем тесте безопасности работы с компьютером, где проверяются сценарии вроде раскрытия конфиденциальной информации, слишком широкого доступа к дашборду или удаления данных, Astra допускала нежелательные результаты на 89% реже, чем предыдущая модель OpenAI GPT-5.6 Sol, и на 74,7% реже, чем модель Anthropic Claude Fable 5.1. Дополнительная проверка и автоматическое ревью, по данным OpenAI, ещё улучшили показатели и GPT-6 Astra, и GPT-5.6 Sol. Детали методики, размер выборки, число сценариев сверх трёх названных типов, в анонсе не раскрыты.

Для бизнеса OpenAI добавила административные инструменты: организации могут ограничивать доступ Astra к одобренным сайтам и десктопным приложениям, управлять загрузкой и выгрузкой файлов и контролировать историю браузера. В ChatGPT Work и Codex появились политики подтверждения, они могут требовать одобрения перед значимыми действиями, и автоматическая проверка потенциально небезопасных или неавторизованных вызовов инструментов; это позволяет компаниям начинать с ограниченной конфигурации и постепенно расширять доступ. Одновременно в ChatGPT Desktop запускаются новые корпоративные плагины на основе возможностей работы в браузере (browser use), от Oracle Analytics, Power BI (сервис Microsoft Fabric), Navan и Avalara, они упрощают доступ к привычным бизнес-приложениям.

Astra стала первой моделью OpenAI, достигшей порога Critical («критический») по кибербезопасности в собственной программе компании по оценке рисков, Preparedness Framework. В ответ на возросшие возможности OpenAI усилила защиту: обучила Astra соблюдать границы безопасности, повысила устойчивость модели к попыткам обойти защитные механизмы и добавила автоматические проверки, блокирующие потенциально вредоносные ответы. Для части клиентов API на поддерживаемых эндпоинтах и по отдельному одобрению доступен режим нулевого хранения данных (Zero Data Retention). Доступ к Astra для корпоративных клиентов по умолчанию выключен при запуске, администраторы включают его сами, по действующему у их организации тарифу и договору.

Ключевые факты

  • OpenAI выпустила GPT-6 Astra, новую флагманскую модель, доступную в ChatGPT Work, Codex и через API; главная особенность, computer use: модель работает прямо в обычных приложениях, даже без их API.
  • Цена в API, от $10 за миллион входных токенов и $50 за миллион выходных.
  • На внутреннем тесте безопасности Astra допускала нежелательные действия на 89% реже, чем GPT-5.6 Sol, и на 74,7% реже, чем Claude Fable 5.1 (модель Anthropic).
  • Astra, первая модель OpenAI, достигшая порога Critical по кибербезопасности в Preparedness Framework; в ответ компания усилила защитные меры.
  • В ChatGPT Desktop запускаются новые корпоративные плагины, Oracle Analytics, Power BI, Navan и Avalara; доступ для организаций по умолчанию выключен и включается администраторами.

Почему это важно

Astra, не рядовое обновление, а новая флагманская модель OpenAI, которую компания продвигает как решение именно для бизнеса, а не для массового потребителя: она выходит сразу в корпоративной версии ChatGPT Work, в Codex и через API. Главное отличие от предыдущих моделей, computer use: Astra умеет работать прямо в обычных приложениях, которыми пользуются сотрудники, даже если у приложения нет API. До сих пор для внедрения ИИ в рабочие процессы компаниям обычно приходилось готовить данные и писать интеграции, Astra, по заявлению OpenAI, снимает этот барьер и позволяет подключить модель к уже существующим процессам с первого дня. Второй акцент, безопасность: OpenAI называет Astra своей самой «согласованной» моделью и приводит цифры о резком снижении числа нежелательных действий при работе с компьютером по сравнению с прошлыми моделями.

Кому это важно

В первую очередь, бизнесу и ИТ-отделам, которые рассматривают ИИ-агентов для реальных рабочих процессов: финансовой отчётности, работы с внутренними дашбордами, подготовки презентаций, использования корпоративных приложений вроде Oracle Analytics, Power BI, Navan или Avalara. Разработчикам, через Codex. Отдельно это важно администраторам и специалистам по безопасности, которым OpenAI отдаёт настройку доступа: что модели разрешено открывать, куда загружать и выгружать файлы, какие действия требуют подтверждения человека. И конкурентам: OpenAI напрямую сравнивает свою модель с Claude Fable 5.1 от Anthropic, по показателям безопасности при работе с компьютером Astra, по данным OpenAI, ошибается на 74,7% реже.

Как это применить

Astra уже доступна сегодня, в ChatGPT Work, в Codex или через API; встроить её в собственные продукты и процессы можно через тот же API. Цена, от $10 за миллион входных токенов и $50 за миллион выходных. Для организаций доступ по умолчанию выключен: включить Astra администратор должен сам, по действующему у компании тарифу и договору, и может сделать это постепенно, начать с ограниченной конфигурации (ограничить список сайтов и приложений, контролировать загрузку и выгрузку файлов и историю браузера, включить политики подтверждения перед значимыми действиями) и расширять доступ по мере доверия к модели. Часть клиентов API на поддерживаемых эндпоинтах может подключить режим нулевого хранения данных (Zero Data Retention), по отдельному одобрению. Одновременно в ChatGPT Desktop появились готовые корпоративные плагины, Oracle Analytics, Power BI (сервис Microsoft Fabric), Navan и Avalara, они упрощают доступ к привычным бизнес-приложениям.

Можно ли доверять

Все цифры в анонсе, собственные данные OpenAI: сравнение по безопасности проведено на «внутреннем тесте безопасности работы с компьютером» самой компании, без независимой проверки. Сколько сценариев тестировалось и какой была выборка помимо трёх названных примеров (утечка данных, широкий доступ к дашборду, удаление данных), не раскрыто. Заявление о том, что Astra занимает «большую часть границы эффективности» на Terminal Bench 4.0 и Artificial Analysis Intelligence Index, не подкреплено ни конкретным баллом, ни местом в рейтинге, сравнить с другими моделями по этим тестам самостоятельно по тексту анонса нельзя. Результат «в 25 раз меньше задержка, на 30% больше памяти» получен OpenAI в собственной тестовой среде, без абсолютных цифр латентности и без названия использованных аллокаторов памяти. Иными словами, это релизный пост производителя: сам факт выхода модели и её возможности не вызывают сомнений, а количественные сравнения стоит воспринимать как заявленные OpenAI, а не подтверждённые независимо.

Риски и подводные камни

Astra получает реальный доступ к бизнес-системам, браузеру, десктопным приложениям, загрузке и выгрузке файлов, и собственный тест безопасности OpenAI прямо называет, что при этом может пойти не так: модель способна раскрыть конфиденциальную информацию, открыть слишком широкий доступ к дашборду или удалить данные. Это не гипотетические риски, а сценарии, которые компания сама заложила в тестирование. «На 89% реже» и «на 74,7% реже», это снижение частоты нежелательных исходов, а не их исключение: часть таких случаев, по собственным данным OpenAI, всё ещё происходит. Отдельный сигнал, то, что Astra стала первой моделью OpenAI, достигшей порога Critical по кибербезопасности в её программе оценки рисков Preparedness Framework: это означает более высокий потенциал использования модели во вред, и именно поэтому OpenAI понадобилось отдельно усиливать защиту от обхода ограничений и от несанкционированных действий модели. Насколько надёжны эти защитные меры на практике, а не в описании релиза, покажет только время и независимая проверка. Наконец, реальная безопасность внедрения зависит от того, насколько тщательно администратор настроит ограничения доступа, сама Astra их не включает по умолчанию.