Biohub Цукерберга координирует $1,8 млрд на ИИ-модели клеток

Biohub Цукерберга координирует $1,8 млрд на ИИ-модели клеток

Biohub, некоммерческая организация, которую поддерживают Марк Цукерберг и Присцилла Чан, координирует усилия на $1,8 млрд. По сообщению Reuters, которое пересказывает The Decoder, они охватывают данные, лабораторное оборудование и вычислительные мощности. Цель, научить ИИ-модели предсказывать поведение клеток, что может ускорить разработку лекарств.

Biohub уже обещала $500 млн в апреле на пятилетнюю «Виртуальную биологическую инициативу» (Virtual Biology Initiative); год в источнике не указан. Meta, Google DeepMind и Isomorphic Labs вносят в проект в сумме $300 млн, отдельные суммы по компаниям не названы. Министерство энергетики США (DOE) вкладывает свыше $500 млн в лабораторные измерения и вычисления в течение пяти лет. Национальные институты здравоохранения США (NIH) координируют наборы данных, созданные на более чем $500 млн прежнего федерального финансирования; Biohub приведёт их к единому стандарту для обучения ИИ. Входят ли эти $500 млн прежнего финансирования в итоговые $1,8 млрд, источник не уточняет.

Условия доступа к данным такие: коммерческие спонсоры получают год эксклюзивного доступа к данным, за которые заплатили, после чего данные становятся общедоступными, об этом сообщил руководитель исследований Biohub Алекс Райвз (Alex Rives). Работы на государственные деньги будут доступны без этих ограничений. Первый набор данных должен быть готов примерно через год.

В конце материала The Decoder отмечает, что биологией занимаются и другие ИИ-компании: Anthropic построила собственную биологическую лабораторию для разработки лекарств с помощью ИИ, а OpenAI Foundation направляет более $125 млн на биологические и медицинские наборы данных. Технических деталей о самих моделях, архитектурах и типах клеток в тексте нет.

Ключевые факты

  • Biohub, организация при поддержке Марка Цукерберга и Присциллы Чан, координирует усилия на $1,8 млрд: данные, лабораторное оборудование и вычисления для ИИ-моделей, предсказывающих поведение клеток (по данным Reuters).
  • Meta, Google DeepMind и Isomorphic Labs вносят вместе $300 млн; Министерство энергетики США, свыше $500 млн за пять лет на лабораторные измерения и вычисления.
  • NIH координирует наборы данных, созданные на более чем $500 млн прежнего федерального финансирования; Biohub стандартизирует их для обучения ИИ.
  • Коммерческие спонсоры получают год эксклюзивного доступа к оплаченным данным, затем данные становятся публичными; работы на госсредства доступны без ограничений.
  • Первый набор данных должен быть готов примерно через год.

Почему это важно

Проект собирает под одной координацией частные деньги крупных ИИ-компаний и государственные средства: данные, лабораторные измерения и вычисления. Задача, модели, которые предсказывают поведение клеток, а это, по оценке The Decoder, может ускорить разработку лекарств. Одновременно материал показывает общий тренд: Anthropic построила собственную биологическую лабораторию, а OpenAI Foundation направляет более $125 млн на биомедицинские наборы данных.

Кому это важно

Исследователям в биологии и медицине, которые работают с клеточными данными и обучением моделей. Компаниям, занятым ИИ для разработки лекарств, прежде всего тем, кто рассматривает участие в качестве коммерческого спонсора. Тем, кто следит за тем, как ИИ-компании и государство вкладываются в научные данные.

Как это применить

Напрямую применять пока нечего: первый набор данных должен быть готов примерно через год. Практически важны условия доступа: коммерческие спонсоры получают год эксклюзивного доступа к данным, за которые заплатили, после чего данные публикуются; работы на государственные средства доступны без этих ограничений. Остальным стоит дождаться публикации данных.

Можно ли доверять

Это краткий пересказ сообщения Reuters, сделанный The Decoder; первоисточник мы не видели. Условия доступа к данным приписаны Алексу Райвзу, руководителю исследований Biohub. Прямых цитат Цукерберга, Чан или других лиц в тексте нет. Сроки подаются осторожно: первый набор данных «должен быть» готов через год, а не «будет».

Риски и подводные камни

Из текста неясно, входят ли более $500 млн прежнего федерального финансирования под наборы данных NIH в итоговые $1,8 млрд, поэтому сумму не стоит раскладывать по слагаемым. Пятилетний срок указан для Виртуальной биологической инициативы и вклада Министерства энергетики, а не для всей суммы. Отдельных сумм по Meta, Google DeepMind и Isomorphic Labs нет, только общие $300 млн. Технических деталей о моделях и типах клеток нет, так что оценить научную реалистичность цели по этому тексту нельзя. Год эксклюзивного доступа для коммерческих спонсоров означает, что часть данных будет открыта с задержкой.

Компания Meta Platforms признана экстремистской организацией, её деятельность на территории РФ запрещена.