Код Читати оригінал на Phoronix 1 хв читання 1

Ніякого AI у ядрі компілятора: чому GCC встановив жорсткий бан на LLM

На тлі масового впровадження AI-асистентів у розробку керівний комітет проєкту GNU Compiler Collection вирішив провести чітку межу між кодом людини та алгоритмів. За даними видання Phoronix, GCC офіційно затвердив нову політику щодо згенерованих мовними моделями внесків, встановивши суворі обмеження для розробників. Рішення ставить під загрозу звичні workflow з автодоповненням коду для одного з найважливіших компіляторів у світі системного програмування.

#GCC #компілятори #штучний інтелект #Open Source #LLM
Офіційний логотип C++ та GNU компіляції на тлі вихідного коду GCC
Офіційний логотип C++ та GNU компіляції на тлі вихідного коду GCC · Джерело зображення: Phoronix

Червона лінія для AI-агентів: що ухвалив Steering Committee

GCC Steering Committee офіційно прийняв рекомендації спеціальної робочої групи GCC AI Policy Working Group. Згідно з ухваленим рішенням, проєкт GNU Compiler Collection запровадив повну відмову від прийняття юридично значущих внесків коду, створених або похідних від нейромережевих мовних моделей.

Причиною такого кроку стали невизначений правовий статус авторів AI-коду та ризики порушення ліцензії GNU GPL. Редагування документації проєкту та відповідний комміт уже зафіксовані в репозиторії gcc-wwwdocs. Керівництво компілятора прагне захистити кодову базу від потенційних судових позовів щодо copyright-інфрінджменту, пов'язаного з навчальними датасетами LLM.

Винятки з правил та юридична неістотність

Розробники залишили невеликий простір для маневру при повсякденному рефакторингу та виправленні дрібних огріхів. Згідно з правилами, мейнтейнери мають право приймати такі типи внесків від LLM:

  • Юридично незначні зміни — виправлення одруків, підсказування форматування або дрібні правки синтаксису за умови обов'язкового явного маркування джерела;
  • Модульні та регресійні тестові сценарії — як виняток, мейнтейнерам дозволено приймати юридично значущі тестові набори, згенеровані штучним інтелектом повністю або частково;
  • Код від авторів, які володіють повним авторським правом і самостійно верифікували відсутність згенерованих фрагментів у критичних алгоритмах.

Чому компіляторники бояться LLM і що буде у 2027 році

Специфіка компіляторобудування вимагає абсолютної математичної точності та прозорої атрибуції ліцензій. Поява у важких оптимізаційних пасах GCC галюцинованого або запозиченого з закритих проєктів коду загрожує не лише стабільності бінарників, а й легітимності всього дистрибутива GNU/Linux.

Рада директорів GCC планує переглянути цю заборону на початку 2027 року. До того часу будь-який пул-реквест чи патч у список розсилки gcc-patches із прямою участю Copilot, Claude або ChatGPT відхилятиметься на етапі первинного рев'ю.

Контекст для України

Заборона використання штучного інтелекту в кодовій базі GCC безпосередньо впливає на українську спільноту системних розробників та інженерів embedded-проєктів. Українські IT-компанії, зокрема SoftServe, EPAM та GlobalLogic, мають потужні центри експертизи C++ та Linux-систем, чиї фахівці беруть участь у відкритих Open Source ініціативах. Тепер українським кодерам доведеться чітко розділяти локальне використання Copilot для генерації юніт-тестів і пряме написання внутрішніх пасів компілятора. Це унеможливлює автогенерацію складних оптимізацій для оборонних та промислових розробок на базі архітектури RISC-V та ARM в Україні. Нові вимоги змусять українські команди переглянути внутрішні CI/CD пайплайни та правила статичного аналізу коду.

Часті запитання

Чи можна використовувати GitHub Copilot для написання коду компілятора GCC?
Використання мовних моделей для генерації юридично значущого сирцевого коду компілятора GCC повністю заборонено. Steering Committee відхилятиме такі патчі через ризики ліцензійних порушень GPL, за винятком випадків написання тестових наборів або виправлення дрібних одруків у документації.
Які саме винятки з заборони на використання AI діють у проєкті GCC?
Мейнтейнерам дозволено приймати згенеровані штучним інтелектом юридично незначні правки синтаксису та дрібні виправлення. Крім того, зроблено офіційний виняток для написання регресійних і модульних тестів за умови обов'язкового явного позначення використання LLM у комміті.
Telegram

Свіжі новини у нашому Telegram

Отримуйте миттєві сповіщення про нові публікації в рубриці «Код»

@procodeandevenmore