Руководящий комитет GCC официально утвердил новую политику, касающуюся использования искусственного интеллекта и больших языковых моделей в правках для коллекции компиляторов GNU.

Согласно новым правилам, GCC пока будет отклонять любые правки, содержащие защищённый авторским правом материал, созданный языковой моделью, либо основанный на выводах такой системы.

Это касается не только кода, напрямую скопированного из инструментов вроде ChatGPT, Gemini или GitHub Copilot, но и любых вариантов кода, которые впоследствии редактировались или переписывались человеком, если итоговая правка по-прежнему основана на материале, созданном такой системой.

Суть не в том, пользовался ли разработчик ИИ-инструментом на каком-то этапе работы. Участники могут использовать LLM для обсуждения идей, понимания существующего кода, изучения незнакомой предметной области или общих исследований. Ограничение действует на включение в код, отправляемый в GCC, значимых с точки зрения авторского права фрагментов, созданных такими системами.

Политика также предусматривает несколько ограниченных исключений. Сопровождающие GCC могут принимать незначительные с юридической точки зрения или тривиальные изменения, сгенерированные языковой моделью, при условии, что они соответствуют обычным требованиям проекта к правкам, а факт использования LLM явно указан.

Допускается также приём значимых с точки зрения авторского права тестовых примеров, созданных ИИ. Поскольку тесты, как правило, представляют собой небольшие программы для воспроизведения ошибок компилятора или проверки поведения, политика рассматривает их отдельно от кода, входящего в состав GCC.

Это не означает, что просмотр или правка сгенерированного кода делают его допустимым. По правилам, участник не может взять существенную реализацию, созданную LLM, доработать её вручную и затем выдать получившийся патч за свой оригинальный код.

Если правка была получена на основе сгенерированного материала, она по-прежнему подпадает под действие политики. Дополнительные подробности смотрите здесь.