Червона лінія для AI-агентів: що ухвалив Steering Committee
GCC Steering Committee офіційно прийняв рекомендації спеціальної робочої групи GCC AI Policy Working Group. Згідно з ухваленим рішенням, проєкт GNU Compiler Collection запровадив повну відмову від прийняття юридично значущих внесків коду, створених або похідних від нейромережевих мовних моделей.
Причиною такого кроку стали невизначений правовий статус авторів AI-коду та ризики порушення ліцензії GNU GPL. Редагування документації проєкту та відповідний комміт уже зафіксовані в репозиторії gcc-wwwdocs. Керівництво компілятора прагне захистити кодову базу від потенційних судових позовів щодо copyright-інфрінджменту, пов'язаного з навчальними датасетами LLM.
Винятки з правил та юридична неістотність
Розробники залишили невеликий простір для маневру при повсякденному рефакторингу та виправленні дрібних огріхів. Згідно з правилами, мейнтейнери мають право приймати такі типи внесків від LLM:
- Юридично незначні зміни — виправлення одруків, підсказування форматування або дрібні правки синтаксису за умови обов'язкового явного маркування джерела;
- Модульні та регресійні тестові сценарії — як виняток, мейнтейнерам дозволено приймати юридично значущі тестові набори, згенеровані штучним інтелектом повністю або частково;
- Код від авторів, які володіють повним авторським правом і самостійно верифікували відсутність згенерованих фрагментів у критичних алгоритмах.
Чому компіляторники бояться LLM і що буде у 2027 році
Специфіка компіляторобудування вимагає абсолютної математичної точності та прозорої атрибуції ліцензій. Поява у важких оптимізаційних пасах GCC галюцинованого або запозиченого з закритих проєктів коду загрожує не лише стабільності бінарників, а й легітимності всього дистрибутива GNU/Linux.
Рада директорів GCC планує переглянути цю заборону на початку 2027 року. До того часу будь-який пул-реквест чи патч у список розсилки gcc-patches із прямою участю Copilot, Claude або ChatGPT відхилятиметься на етапі первинного рев'ю.