Исследователь уволился из Anthropic, назвав гонку компании к сверхразуму безответственной
Автор X-аккаунта @hilbertspaess, называющий себя Джейкобом Коксоном, опубликовал 9 сентября 2026 года цепочку из семи твитов об увольнении из Anthropic. По его словам, он в сумме три года занимался исследованиями предобучения моделей в OpenAI и Anthropic и пришёл к выводу, что ни одна из двух компаний не действует ответственно: обе гонятся напрямую к самосовершенствующемуся сверхразуму, ставя на кон человеческие жизни.
Автор предупреждает, что не стоит недооценивать силу этой технологии: скоро появятся сверхчеловеческие системы, способные взломать что угодно, произвести революцию в любой отрасли за одну ночь и получить реальную власть и ресурсы, а прогресс в этих направлениях не замедляется. По его утверждению, люди, создающие ИИ, искренне верят, что он может убить всех к концу этого десятилетия, и это не маркетинговый трюк: многие руководители и старшие исследователи смягчают формулировки для прессы, но приватно выражают тот же страх.
На вопрос «если они действительно так думают, зачем продолжают это строить», автор отвечает по-разному для двух компаний. В OpenAI, по его словам, многие не осознали в полной мере цивилизационные ставки. В Anthropic ставки понимают хорошо, но компания заперта в гонке за то, чтобы прийти первой: там считают, что никто другой не будет действовать ответственно, поэтому должны сделать это сами, несмотря на риск. Принять такую гонку и войти в «эндшпиль», это, по его оценке, самонадеянная авантюра, которую не должны запускать из корпоративного Slack; попытка «спидрана» согласования (alignment) требует чрезвычайной уверенности в отсутствии лучших путей.
Автор пишет, что сохраняет оптимизм насчёт координации: такие предупредительные сигналы, как атака на Hugging Face, сделали соглашения о темпе разработки между американскими лабораториями более реалистичными. При этом он не уверен, что глобальную гонку удастся предотвратить, и допускает, что для этого могут понадобиться дорогостоящие меры вплоть до временного запрета на наращивание возможностей моделей. Завершает тред призывом к исследователям лабораторий задуматься, каково им будет в ближайшие годы: стоит ли запускать сверхразумный цикл обучения с подкреплением без строгого понимания того, что получится, или продолжать работать, потому что «это всё равно происходит», или использовать момент, чтобы потребовать других условий.
Ключевые факты
- Автор X-аккаунта @hilbertspaess, представившийся Джейкобом Коксоном, объявил об увольнении из Anthropic после в сумме трёх лет исследований предобучения в OpenAI и Anthropic
- Заявляет, что ни OpenAI, ни Anthropic не действуют ответственно и обе гонятся напрямую к самосовершенствующемуся сверхразуму, рискуя жизнями людей
- По его словам, многие руководители и старшие исследователи в лабораториях приватно выражают страх, хотя публично смягчают формулировки
- В Anthropic, по его утверждению, риски осознают, но остаются в гонке за первенство, считая, что иначе никто не будет действовать ответственно
- Называет атаку на Hugging Face предупредительным сигналом, повысившим реалистичность соглашений о темпе разработки между лабораториями, и допускает необходимость временного запрета на наращивание возможностей моделей
Почему это важно
Публичный уход из ведущей ИИ-лаборатории с прямым обвинением компании и её главного конкурента в безответственной гонке к сверхразуму, редкое инсайдерское заявление такого рода, даже если личность автора не подтверждена независимо. Оно попадает в текущую дискуссию о темпах разработки ИИ и о том, насколько сами разработчики верят собственным публичным заявлениям об осторожности.
Кому это важно
Тем, кто следит за темой безопасности ИИ и политикой регулирования лабораторий; сотрудникам и кандидатам самих лабораторий, оценивающим внутренние настроения; исследователям и журналистам, работающим с темой согласования (alignment) и гонки за сверхразумом.
Как это применить
Прямого продукта или инструмента здесь нет, это личное заявление, а не релиз. Для тех, кто отслеживает публичный дискурс об ИИ-safety, пост можно использовать как ещё один сигнал того, что тема соглашений о темпе разработки между лабораториями и рисков гонки к сверхразуму остаётся активной; для проверки достоверности стоит искать независимое подтверждение личности и трудоустройства автора, прежде чем ссылаться на его слова как на факт.
Можно ли доверять
Источник, цепочка твитов от аккаунта, не связанного публично ни с OpenAI, ни с Anthropic; в источнике нет никаких проверяемых данных о должности, команде или дате увольнения, кроме слова «сегодня». Под тредом есть комментарий, ставящий под сомнение сам факт работы автора в этих компаниях и указывающий, что аккаунт создан в 2026 году, независимого подтверждения его трудоустройства нет. Содержание стоит рассматривать как личное заявление одного человека, а не как подтверждённый факт о позиции OpenAI или Anthropic.
Риски и подводные камни
Автор не называет ни одного конкретного руководителя или сотрудника, не раскрывает деталей атаки на Hugging Face и не описывает, что именно должно входить в «соглашения о темпе разработки» между лабораториями, все формулировки остаются на уровне общих утверждений без верифицируемых подробностей. Это делает пост скорее личным манифестом, чем источником новых фактов о внутренней политике компаний.
«Люди, создающие ИИ, искренне верят, что он может убить всех нас к концу этого десятилетия. Это не маркетинговый трюк.»
— Джейкоб Коксон (@hilbertspaess), самопровозглашённый бывший исследователь предобучения в OpenAI и Anthropic