Az OpenAI új technológiával jelölné meg a ChatGPT és a Codex által generált szövegeket az Európai Unióban. A vízjel szabad szemmel nem lesz látható, mégis felismerhető mintázatot hagyhat az AI által írt tartalomban. A módszer azonban messze nem tévedhetetlen: már kisebb átfogalmazás is jelentősen ronthatja a felismerést.
Hetediknap a Google Keresőben
Kérjük állítsa be, hogy a hetediknap.hu mindenképpen megjelenjen a találatai közt!
Fontos változás jöhet a ChatGPT európai használatában. Az OpenAI a következő hetekben egy olyan technológia bevezetését tervezi az Európai Unióban, amely segítségével később megállapítható lehet, hogy egy szöveget mesterséges intelligencia generált-e.
A Bleeping Computer beszámolója szerint a rendszer nem hagy hagyományos, szemmel látható vízjelet a szövegben. Másoláskor vagy beillesztéskor sem jelenik meg külön jelölés.
Az OpenAI ehelyett egy textGrain nevű technológiát alkalmaz. Ennek lényege, hogy a modell bizonyos helyzetekben úgy választ a hasonló jelentésű szavak és kifejezések közül, hogy a kész szövegben egy később statisztikailag felismerhető mintázat alakuljon ki.
Vagyis az olvasó számára a szöveg teljesen hétköznapinak tűnhet, egy megfelelő detektor azonban jelezheti, hogy AI készítette.
Nem lehet vele mindenkit „lebuktatni”
A módszernek azonban komoly korlátai vannak.
Az OpenAI saját tesztje szerint egy nagyjából 400 token hosszúságú szöveg esetében eredetileg 92 százalék körüli volt a felismerési arány. Ha azonban a szavak mindössze 10 százalékát szinonimákra cserélték, ez már körülbelül 66 százalékra esett.
A szöveg negyedének módosításakor az észlelési arány mindössze 17 százalékra zuhant.
Ez azt jelenti, hogy egy viszonylag egyszerű emberi átfogalmazás, szerkesztés vagy utómunka jelentősen megnehezítheti a vízjel felismerését.
A technológia ráadásul nem minden típusú tartalomnál működik ugyanolyan jól. Matematikai szövegeknél például kevesebb lehetősége van a modellnek különböző megfogalmazások közül választani, ezért gyengébb lehet a módszer hatékonysága. Az OpenAI közlése szerint a rendszer egyes újabb modelljein sem alkalmazható jelenlegi formájában.
Nem derül ki, ki írta
Fontos különbség, hogy a vízjel nem a felhasználót azonosítja.
Nem tartalmazza a ChatGPT-fiók adatait, nem mutatja meg az eredeti promptot, és azt sem képes megállapítani, hogy egy végleges szöveg mekkora részét írta ember, illetve mennyit készített vagy szerkesztett a mesterséges intelligencia.
A technológia célja kizárólag annak valószínűsítése, hogy a szöveg AI-generált eredetű-e.
Az OpenAI kezdetben nem mindenki számára teszi hozzáférhetővé a felismerőeszközt. A hozzáférést először jóváhagyott kutatók és kiválasztott szakmai szervezetek kaphatják meg.





