Kitiltja az Oracle az OpenJDK-ből a generatív MI tartalmakat

enlightened Ez az oldal a közösségért készül. heart Kövess minket máshol is:  Linux Mint Magyar Közösség a Mastodon-on  Telegram csatorna – csak hírek  Beszélgessünk a Telegram – Linux csevegő csoport  Hírek olvasása RSS segítségével  Linux Mint Hivatalos Magyar Közösség a Facebook-on      Linux Mint Baráti Kör a Facebook-on
wink Ha hasznosnak találod, és szeretnéd, hogy folytatódjon, támogasd a munkát Ko-fi vagy Paypal segítségével. laugh

kami911 képe

A generatív MI területe gyorsan fejlődik. Komoly lehetőséget kínál a fejlesztők hatékonyságának növelésére, ugyanakkor kockázatokat is hordoz: növeli a kódellenőrzők terheit, veszélyeztetheti a biztonságot és a szellemi tulajdont.

Az Oracle, az OpenJDK Community vállalati támogatójaként, egy átfogó irányelvet dolgoz ki a generatív MI-eszközök OpenJDK-hoz készült hozzájárulásokban történő használatáról. Az Oracle ezt az irányelvet később az OpenJDK Governing Board elé terjeszti. Amíg ez az irányelv nem lép életbe, a Governing Board jóváhagyta az alábbi átmeneti irányelvet:

Az OpenJDK Community hozzájárulásai nem tartalmazhatnak részben vagy egészben nagy nyelvi modellek, diffúziós modellek vagy hasonló deep learning rendszerek által generált tartalmat. A tartalom ebben az összefüggésben többek között – de nem kizárólag – a forráskódot, szövegeket és képeket jelenti az OpenJDK Git tárolókban, GitHub pull requestekben, e-mail üzenetekben, wikioldalakon és JBS problémákban.

Az OpenJDK Community közreműködői magáncélra használhatnak generatív MI-eszközöket az OpenJDK kódjának és más tartalmainak megértéséhez, hibakereséséhez, ellenőrzéséhez, illetve OpenJDK projektekhez kapcsolódó kutatáshoz, amennyiben az ilyen eszközök által generált tartalmat nem nyújtják be hozzájárulásként.

Ez az átmeneti irányelv arra ösztönöz, hogy a generatív MI-eszközöket úgy használják, hogy közben a kockázatok korlátozottak maradjanak, miközben további tapasztalatok gyűlnek, amelyek segítenek a végleges irányelv kialakításában.

Gyakran ismételt kérdések

  • Milyen kockázatot jelent a generatív MI-eszközök használata a kódellenőrzők terhelésére?
  • A generatív MI-eszközök természetüknél fogva megkönnyítik nagy mennyiségű, első ránézésre hihető kód és teszt létrehozását, amely azonban hibás lehet, vagy ha helyes is, rosszul megtervezett, ezért nehezen karbantartható. Az ilyen kódok ellenőrzése könnyen felemésztheti az amúgy is szűkös emberi erőforrásokat. Emiatt néhány nyílt forráskódú közösség korlátozta, sőt akár tiltotta is a generatív MI-eszközökkel létrehozott kód beküldését.
  • Milyen kockázatot jelent a generatív MI-eszközök használata a biztonságra és a megbízhatóságra?
  • Az OpenJDK Community által fejlesztett és karbantartott JDK a Java platform elsődleges megvalósítása. Vállalatok, kormányzati szervek és más szervezetek üzletileg kritikus rendszereinek alapját adja világszerte. A biztonság és a megbízhatóság kiemelten fontos. A látszólag meggyőző, de hibás kód ezeket az alapvető tulajdonságokat veszélyeztetné.
  • Milyen szellemi tulajdoni kockázatai vannak a generatív MI-eszközök használatának?
  • Az Oracle Contributor Agreement (OCA) előírja, hogy a közreműködő rendelkezzen minden egyes hozzájárulás szellemi tulajdonjogaival, és ezeket a jogokat korlátozás nélkül átruházhassa az Oracle-re. A legtöbb generatív MI-eszközt azonban szerzői joggal védett és licencelt tartalmakon tanították, a kimenetük pedig tartalmazhat olyan elemeket, amelyek sértik ezeket a jogokat és licenceket, így az ilyen tartalom beküldése megsértené az OCA-t. Jelenleg is folyamatban vannak perek arról, hogy a generatív MI-eszközök felhasználóit milyen szellemi tulajdonjogok illetik meg az eszközök által létrehozott tartalom felett.
  • A kockázatok ellenére a generatív MI-eszközök komoly értéket képviselhetnek. Teljesen tilos az OpenJDK közreműködőinek ilyen eszközöket használniuk?
  • Nem. Az irányelv szerint nyugodtan használhatsz ilyen eszközöket az OpenJDK kódjának és más tartalmainak megértésére, hibakeresésére és átnézésére. Más közösségek tapasztalatai alapján úgy tűnik, hogy a generatív MI-eszközök elsősorban a meglévő kód elemzésében erősek, nem pedig új kód írásában, különösen a nagy kódbázissal rendelkező, kiforrott projektek esetében. Eddigi tapasztalataink is ezt támasztják alá.
  • Mit jelent az, hogy a generatív MI-eszközöket „magánjelleggel” használjuk?
  • Ezzel azt szeretnénk hangsúlyozni, hogy saját magad használhatod ezeket az eszközöket, anélkül hogy beküldenéd az általuk előállított tartalmat. Nem arról van szó, hogy például ne oszthatnád meg és vitathatnád meg egy kollégáddal az ilyen eszközök kimenetét. Ilyen tartalom megosztásakor érdemes jól látható megjegyzést fűzni hozzá, amely egyértelműen jelzi, hogy MI által generált szövegről van szó.
  • Továbbra is használhatom a helyesírás-ellenőrző, nyelvhelyesség-ellenőrző, automatikus kiegészítő és refaktoráló funkciókat a szerkesztőmben vagy IDE-mben?
  • Igen, amíg ezek nem nagy nyelvi modelleken vagy hasonló deep learning rendszereken alapulnak.
  • Használhatok generatív MI-eszközt JEP-tervezetek, JavaDoc vagy más dokumentumok átnézésére, ha a teljes szöveget én írom?
  • Igen. Ez egyértelműen a tartalom átnézésére használt generatív MI-eszköz esete, ami rendben van.
  • Ha generatív MI-eszközzel íratok 100 sor kódot, majd ebből tíz sort én magam szerkesztek át, beküldhetem a végeredményt?
  • Nem. A hozzájárulásod így is részben MI által generált kódot tartalmazna.
  • Fejleszthetünk-e az eszköztárunkon, hogy segítsünk a közreműködőknek betartani ezt az irányelvet?
  • Igen. Hamarosan úgy állítjuk be a Skarát, hogy a GitHub minden egyes pull requestjének törzsébe bekerüljön egy jelölőnégyzet. Pull request létrehozásakor kötelező lesz bejelölni, hogy a hozzájárulásod megfelel az irányelvnek. További részletek, köztük az is, hogyan lehet a jelölőnégyzetet hozzáadni egy már létező pull request törzséhez, a wikin olvashatók.
  • Egy OpenJDK projekten belül rendben van-e olyan funkciót hozzáadni, amely egy külső MI-szolgáltatást hív meg?
  • Ez a szolgáltatás felhasználási feltételeitől függ, vagyis jogi kérdés. Sok ilyen feltétel szigorúan korlátozza, hogyan használhatod a szolgáltatást. Kérd ki a saját ügyvéded vagy a munkaadód ügyvédjének tanácsát, és gondoskodj róla, hogy a Projektedben érdekelt mindenki egyeztessen a megfelelő jogi szakértőkkel.
  • OpenJDK projektben bírálóként felelősséget vállalok azért, hogy észrevegyem, ha egy közreműködő generatív MI-eszközzel készített kódot vagy más tartalmat küld be?
  • Ebben a szerepben már most is elvárják tőled, hogy a legjobb tudásod szerint ügyelj rá: a beérkező hozzájárulások feleljenek meg az OpenJDK közösség irányelveinek és szokásainak. Általánosságban lehetetlen megbízhatóan megkülönböztetni az ember által írt tartalmat az MI által generálttól. Ha viszont bizonyítékot látsz arra, hogy egy hozzájárulásban lévő tartalmat generatív MI-eszközzel hozták létre, akkor kötelességed erről értesíteni a közreműködőt. Ha a közreműködő nem reagál együttműködően, és nem távolítja el a tartalmat, jelezd az ügyet az illetékes projektvezetőnek.
  • Milyen árulkodó jelei vannak a generatív MI-eszközökkel készült tartalomnak?
  • Néha teljesen egyértelmű, például ha a közreműködő saját forkjában lévő commit üzenet, ahonnan a pull requestet indítja, tartalmaz egy Co-Authored-By záró sort, amely egy konkrét generatív MI-eszközt tüntet fel társszerzőként. Máskor sokkal finomabb a jel, például ha a közreműködő megjegyzései egy pull request beszélgetésben vagy egy e-mailben csevegősek, terjengősek, és nem illenek a korábbi írásai stílusához. További jel lehet a túlságosan tagolt, több alcímmel ellátott megjegyzés, a felesleges kommentek a kódban, az indokolatlanul „defenzív” programozás, illetve az emoji karakterek használata.
  • A generatív MI-eszközök gyorsan fejlődnek, ezért ami ma jó jelző, holnap már lehet, hogy nem az. Általánosságban, ha egy pull requestben valami feltűnően derűlátó vagy szokatlanul aprólékos, akkor könnyen lehet, hogy MI által generált tartalommal van dolgod.