OpenAI заявила о решении уравнения Навье, Стокса, и попала в спор о приоритете с Anthropic

OpenAI заявила о решении уравнения Навье, Стокса, и попала в спор о приоритете с Anthropic

OpenAI сообщила, что её ИИ-система нашла решение уравнения Навье, Стокса, 200-летнего уравнения, описывающего поведение жидкостей и газов и входящего в список задач тысячелетия Института Клэя (каждая оценена в $1 млн). По словам математика и ИИ-исследователя OpenAI Себастьена Бубека, компания начала обучение новой модели с продвинутыми математическими способностями 28 августа; узнав слухи о том, что Anthropic продвигается в решении смежной задачи, компания направила на неё более 1000 ИИ-агентов, которые работали свыше 50 часов, а затем довела их число до 10 000, прежде чем получить решение. «Я думал, что где-то должна быть ошибка. А в воскресенье утром у нас было готовое решение, полностью формализованное в Lean», сказал Бубек (Lean, язык программирования для формализации математических доказательств). Расходы на вычисления составили «миллионы долларов», сообщил руководитель исследований OpenAI Марк Чен.

В понедельник математик Нью-Йоркского университета Трайстан Бакмастер и исследователь Anthropic Левент Альпёге опубликовали собственные материалы о продвижении в смежной задаче, уравнении Эйлера без вынуждающей силы (unforced Euler); для работы они использовали несколько ИИ-моделей, включая Claude и Codex. Бакмастер заявил, что на прошлой неделе узнал, что OpenAI стало известно об их с Альпёге работе и компания начала направлять на задачу значительные ресурсы. По его словам, он спросил руководство OpenAI, обращалась ли компания к логам их использования Codex, и получил ответ, что модель «не просматривала данные пользователей», но вопросы про обучение остались без ответа. Бакмастер утверждает, что OpenAI предложила ему несколько вариантов, включая публикацию, в которой решение задачи приписывалось бы внутренней модели OpenAI без упоминания имени Альпёге.

Бубек в соцсетях отверг версию о том, что компания предлагала убрать имя Альпёге; гендиректор OpenAI Сэм Альтман также публично вступился за команду. При этом в блоге, посвящённом работе, OpenAI написала: «хотя это маловероятно, мы не можем исключить, что деидентифицированные данные, полученные из использования [Бакмастером и Альпёге] наших продуктов, помогли улучшить наши модели». Бубек подчеркнул: «Я хочу предельно ясно сказать, что мы признаём приоритет Левента Альпёге и Трайстана Бакмастера в работе над unforced Euler и можем только поздравить их с этим огромным достижением. Хочу уточнить: мы не использовали их подсказки (промпты) или доказательство, чтобы направлять наши модели или агентов». Математик OpenAI Вен Чандрасекаран отдельно заявил, что решение компании существенно отличается по своей природе от решения пары исследователей. Бакмастер, Альпёге и Anthropic не ответили на запрос Wired оперативно. Издание отмечает, что спор о том, кому достаётся заслуга за решение крупных математических задач, может повторяться и впредь по мере того, как ИИ берёт на себя всё больше работы по поиску доказательств.

Ключевые факты

  • OpenAI объявила о решении уравнения Навье, Стокса, 200-летней задачи тысячелетия Института Клэя (приз $1 млн); на задачу направили сначала более 1000, затем до 10 000 ИИ-агентов, а вычисления обошлись в «миллионы долларов».
  • По словам математика OpenAI Себастьена Бубека, финальное, формализованное в Lean решение было получено в воскресенье утром, после начала обучения новой математической модели 28 августа.
  • Математик Нью-Йоркского университета Трайстан Бакмастер и исследователь Anthropic Левент Альпёге в понедельник опубликовали материалы о продвижении в смежной задаче unforced Euler, используя, среди прочего, Claude и Codex.
  • Бакмастер утверждает: узнав об их работе, OpenAI ускорила собственные усилия и предлагала варианты публикации, из которых убиралось имя Альпёге; OpenAI это отрицает, а Сэм Альтман публично поддержал команду.
  • OpenAI признала в блоге, что не может исключить, что деидентифицированные данные из использования её продуктов Бакмастером и Альпёге «помогли улучшить» модели компании, хотя считает это маловероятным.

Почему это важно

OpenAI заявляет, что её ИИ-система впервые получила решение уравнения Навье, Стокса, одной из задач тысячелетия Института Клэя (приз $1 млн за каждую), которая 200 лет не поддавалась математикам. Компания начала обучение новой математической модели 28 августа, а узнав слухи о продвижении Anthropic в смежной задаче, бросила на неё более 1000, а затем до 10 000 ИИ-агентов; расходы на вычисления составили «миллионы долларов». Если результат выдержит проверку, это станет заметной вехой применения ИИ к нерешённым математическим проблемам, но именно проверка и стала предметом спора.

Кому это важно

Математикам и исследователям, работающим над задачами тысячелетия и формальной верификацией доказательств (язык Lean); ИИ-лабораториям, прежде всего OpenAI и Anthropic, для которых громкие научные результаты становятся аргументом в конкуренции; шире, сообществу, которое теперь вынуждено решать, как приписывать авторство, когда несколько групп независимо используют похожие ИИ-инструменты (в этом случае, Claude и Codex) для смежных задач.

Как это применить

Само доказательство, не публичный продукт: ни инструмента, ни API по нему не описано. Практический вывод скорее для исследователей, ведущих конкурентную работу через ИИ-ассистентов: стоит заранее фиксировать процесс и обсуждать с провайдером модели, как логи использования могут быть прочитаны или использованы третьей стороной, именно это стало ядром претензий Бакмастера к OpenAI.

Можно ли доверять

Заявление независимо не подтверждено: решение представлено самой OpenAI на пресс-брифинге, компания говорит, что оно формализовано в Lean, но о стороннем рецензировании в материале речи нет. Параллельно Трайстан Бакмастер обвиняет OpenAI в том, что компания узнала о его и Левента Альпёге смежной работе и ускорила свою, а также предлагала публикацию без имени Альпёге. OpenAI это отрицает: Бубек публично отверг версию про удаление имени Альпёге, а в блоге компания признала, что «хотя это маловероятно», не может исключить, что деидентифицированные данные из использования продуктов Бакмастером и Альпёге помогли улучшить её модели. Математик OpenAI Вен Чандрасекаран утверждает, что решения компании и пары исследователей существенно различаются по природе. Ни Бакмастер, ни Альпёге, ни Anthropic оперативно не ответили Wired.

Риски и подводные камни

История обнажает новый тип риска в ИИ-исследованиях: когда несколько лабораторий используют модели друг друга (здесь, Claude и Codex от Anthropic и OpenAI соответственно) для работы над смежными задачами, логи использования продукта превращаются в спорный источник данных о происхождении идей, а компания-разработчик модели одновременно оказывается наблюдателем и участником гонки за результат. Статья отмечает, что подобные конфликты за приоритет, вероятно, будут повторяться по мере того, как ИИ берёт на себя всё больше работы по поиску математических доказательств.

«Я думал, что где-то должна быть ошибка. А в воскресенье утром у нас было готовое решение, полностью формализованное в Lean.»

— Себастьен Бубек, математик и ИИ-исследователь OpenAI