GCC запретил ИИ-код в значимых вкладах в проект

Руководящий комитет компилятора GCC утвердил политику использования ИИ в разработке, подготовленную рабочей группой проекта по этому вопросу. Правило гласит: проект отклоняет «юридически значимые вклады, которые включают сгенерированный LLM контент или производны от сгенерированного LLM контента». Порог «юридической значимости» взят из рекомендаций сопровождающих проекта GNU, это примерно 15 строк кода и/или текста: вклад такого объёма и больше уже подпадает под ограничение по авторскому праву. Из этого правила есть исключение: сопровождающие GCC вправе по своему усмотрению принимать юридически значимые тестовые примеры (test cases), даже если они сгенерированы ИИ. Сам запрет касается только готовых вкладов в кодовую базу, политика прямо разрешает использовать LLM для исследований, анализа, поиска и описания багов, ревью патчей и подобных вспомогательных задач, пока результат такой работы не попадает в сам вклад. Комитет отметил, что считает политику развивающейся и планирует пересматривать её периодически, то есть нынешняя формулировка не финальная.

Ключевые факты

  • Комитет GCC принял политику по вкладам, созданным при участии ИИ, рекомендованную рабочей группой проекта
  • Запрещены «юридически значимые» вклады, включающие или производные от контента LLM
  • Порог значимости, около 15 строк кода или текста, определение взято из рекомендаций сопровождающих GNU
  • Исключение: сопровождающие вправе принять тестовые примеры, сгенерированные ИИ
  • LLM разрешены для исследований, анализа, поиска багов и ревью патчей, если их вывод не входит во вклад напрямую

Почему это важно

GCC, один из ключевых компиляторов открытого ПО, лежащий в основе множества дистрибутивов Linux и инструментов сборки. Формальная политика по ИИ-коду от такого проекта, сигнал, что вопрос авторских прав на сгенерированный ИИ контент из области теории перешёл в область практических правил для крупных open-source-проектов. Причина запрета не техническая, а юридическая: неясен статус авторского права на код, порождённый LLM, и проект предпочёл исключить риск, а не разбираться с ним постфактум.

Кому это важно

Разработчикам, которые участвуют в GCC или похожих open-source-проектах и используют ИИ-ассистентов в работе; сопровождающим других проектов, которым предстоит формулировать похожие правила; юристам и организациям, которые опираются на GCC и следят за чистотой цепочки авторских прав в опенсорсе.

Как это применить

Если вклад в GCC (патч, значительный фрагмент кода или текста, примерно от 15 строк) создан LLM или производен от его вывода, его не примут. При этом использовать ИИ для поиска багов, анализа кода, ревью патчей или как черновой инструмент для собственного анализа никто не запрещает, ограничение касается только того, что попадает в итоговый вклад. Тестовые примеры, сгенерированные ИИ, сопровождающие могут принять на своё усмотрение, это отдельное исключение из общего правила.

Можно ли доверять

Материал опубликован LWN.net, специализированным изданием о разработке ядра Linux и открытого ПО с давней репутацией точного технического освещения; речь идёт о прямом изложении официального решения руководящего комитета GCC, а не о слухах или интерпретации.

Риски и подводные камни

Формулировка «юридически значимый» и порог «около 15 строк» оставляют пространство для спорных пограничных случаев, где заканчивается небольшая правка и начинается значимый вклад, решают сопровождающие в каждом конкретном случае. Комитет сам называет политику развивающейся и обещает её пересматривать, то есть нынешние правила могут измениться, а механизм проверки происхождения кода (как отличить ИИ-вклад от человеческого на практике) в тексте не описан.

«Проект отклоняет юридически значимые вклады, которые включают сгенерированный LLM контент или производны от сгенерированного LLM контента»

— политика руководящего комитета GCC