Vége a láthatatlan trükközésnek az európai felhasználók számára: hamarosan gépi úton is egyértelműen visszakereshetővé válik, ha egy esszét, programkódot vagy hivatalos levelet a mesterséges intelligencia fogalmazott meg – írja a szeretlekmagyarorszag.hu.
Az OpenAI bejelentette, hogy a következő hetek során beépít egy láthatatlan, digitális vízjelet a ChatGPT és a programozást segítő Codex által generált összes szövegbe az Európai Unióban.
A cég szerint ez válasz az EU mesterségesintelligencia-törvényének megjelölési előírásaira, azaz hogy a generált szövegekbe kerüljön egy géppel azonosítható jelölés. A fejlesztők az API-ban keddtől kezdve világszerte választhatóvá tették a vízjelezést, ám az alapértelmezés szerint kikapcsolt marad.
Az eljárás a textGrain nevű megoldáson alapszik, ez emberi szemmel nem olvasható, azonosítható.
A módszer a szavak statisztikai kiválasztási mintázatát módosítja finoman a szövegalkotás során, így a kimenetben egy rejtett mintázat jön létre.
A technológia azonban még nem tökéletes, a rendszer érzékeny az utólagos módosításokra. Az OpenAI szerint egy 400 tokenes szöveg esetében a felismerési pontosság mintegy 92 százalékos, ám ha a szavak mindössze 10 százalékát szinonimákra cserélik, a hatékonyság 66 százalékra csökken. Ha pedig a felhasználó a szavak negyedét átírja, a detektálás pontossága már csak 17 százalék lesz, tehát a vízjel lényegében eltűnik.
Az átírás tehát gyengítheti a felismerést, a fordítás hatását pedig még vizsgálja az OpenAI.
A kifejezetten rövid vagy kötött formátumú válaszoknál – például matematikai képleteknél – eleve jóval bizonytalanabb az azonosítás. Belső méréseik szerint a kimutatás 200 tokennél körülbelül 80, míg 400 tokennél 95 százalék körül alakul ideális feltételek mellett.
Komoly korlátot jelent az is, hogy az OpenAI első körben nem teszi hozzáférhetővé a a vízjeleket leolvasó ellenőrző eszközt. A detektorhoz a rajtnál kizárólag előzetesen jóváhagyott kutatók és kijelölt szakmai szervezetek férhetnek hozzá, így
az átlagos felhasználók vagy a tanárok egyelőre nem tudják önállóan tesztelni a gyanús szövegeket.
A cég hangsúlyozta, hogy a láthatatlan vízjel nem tartalmaz semmilyen személyes adatot, tehát nem azonosítható vele a konkrét felhasználó. Emellett azt is leszögezték, hogy a vízjel hiánya önmagában még nem bizonyítja egy írásos munka emberi szerzőségét.




