A GCC Steering Committee hivatalosan elfogadott egy új irányelvet, amely az MI és a nagy nyelvi modellek használatát szabályozza a GNU Compiler Collectionhöz érkező hozzájárulásokban.
Az új szabályok szerint a GCC egyelőre elutasít minden olyan hozzájárulást, amely szerzői jog által védett, LLM által előállított anyagot tartalmaz, vagy ilyen rendszer kimenetére épül.
Nemcsak a ChatGPT, a Gemini vagy a GitHub Copilot által generált kód közvetlen bemásolásáról van szó, hanem minden olyan kódról is, amelyet később ember szerkesztett vagy írt át, feltéve, hogy a végső hozzájárulás továbbra is a rendszer által generált anyagra épül.
A lényeg tehát nem az, hogy a fejlesztő használt-e valamilyen MI-eszközt a munkája során. A közreműködők használhatnak LLM-eket ötletelésre, a meglévő kód megértésére, egy számukra ismeretlen terület megismerésére vagy általános kutatásra. A korlát ott van, hogy a GCC-nek beküldött kód nem tartalmazhat ilyen eszközök által generált, szerzői jog szempontjából jelentős anyagot.
Az irányelv néhány szűk kivételt is megenged. A GCC karbantartók elfogadhatnak jogilag jelentéktelen vagy triviális, LLM által generált módosításokat, ha azok megfelelnek a projekt szokásos hozzájárulási követelményeinek, és az LLM használatát egyértelműen feltüntetik.
Szerzői jog szempontjából jelentős, MI által generált teszteseteket is elfogadhatnak. A tesztesetek általában kis programok, amelyek célja fordítóhibák reprodukálása vagy bizonyos viselkedés ellenőrzése, ezért az irányelv ezeket külön kezeli a GCC-be ténylegesen bekerülő kódtól.
Nem elég tehát ránézni a generált kódra vagy kicsit átszerkeszteni ahhoz, hogy az elfogadható legyen. A most elfogadott szabályok szerint a közreműködő nem vehet át egy LLM által létrehozott, érdemi megvalósítást, nem tisztogathatja meg kézzel, majd nem kezelheti a létrejött javítócsomagot úgy, mintha azt eredetileg ő írta volna.
Ha egy hozzájárulás generált tartalomból származik, továbbra is az irányelv hatálya alá tartozik. További részletekért itt olvashat.

