A ChatGPT és a Codex generálta szövegekben elhelyezett láthatatlan vízjelek megmutatják, mesterséges intelligencia készítette-e az írást, vagy sem. Az úgynevezett textgrain azonban még messze nem tökéletes.

A többéves hezitálás után első lépésben csak az Európai Unióban és opcionálisan bevezetett technológia révén visszakereshető lesz, hogy egy adott írásos szöveg létrejötte az AI-nak köszönhető-e.

Ennek lényege, hogy a ChatGPT és a Codex generálta szövegekhez láthatatlan vízjelet rendelnek, aminek segítségével visszakereshető lesz azok eredete.

Átlagember számára nem látható

A textGrain nevű újítás a modell szóhasználatának alig észrevehető megváltoztatásával éri el, hogy egy később detektálható statisztikai mintázat jöjjön létre – áll a Bleeping Computer cikkében.

A vízjel ugyanakkor sem a szöveg olvasása, sem a másolása során nem lesz látható, és egyelőre az alapértelmezett beállításokban sem jelenik meg, csak a fejlesztők kapcsolhatják be a támogatott modellek esetében. Az OpenAI ugyan párhuzamosan megnyitotta a pályázati lehetőséget a vízjelfelismerőjéhez, de

a hozzáférés egyelőre kizárólag az általuk jóváhagyott kutatók és szakmai szervezetek számára lehetséges.

A vízjel hiánya nem bizonyíték az emberi szerzőségre

A vállalat azt sem tagadta, hogy a szöveges vízjelek messze nem tökéletesek; a saját tesztjeik szerint már egy viszonylag hétköznapi szerkesztési metódus is jelentősen csökkentheti a rendszer képességét az AI-generált szövegek felismerésére.

400 tokenből álló szövegrészek értékelése alapján a szavak mindössze tíz százalékának szinonimákkal való felcserélése a felismerési arányt 92 százalékról 66 százalékra csökkenti, 25 százaléknyi csere esetében pedig az utóbbi érték mindössze 17 százalék

– ismerték el az OpenAI fejlesztői.

Az eredmények ráadásul még rosszabbak lettek például a matematikai tárgyak esetében, ahol a modellnek kevesebb a szabadsága a különböző szavak közötti válogatásban.

Vagyis – hívták fel rá a figyelmet – az, hogy nem sikerült a vízjelet észlelni, még korántsem egyértelmű bizonyítéka az emberi szerzőségnek:

Az OpenAI-eszközökkel generált szövegek túl rövidek, szerkesztettek vagy lefordítottak lehetnek ahhoz, hogy a felismerés megbízhatóan működjön.

A textgrain nem rontja az OpenAI által generált szöveg minőségét

Azt is kiemelték, hogy az észlelt vízjel nem árulja el, ki generálta a szöveget, milyen fiókot, promptot vagy beszélgetést használt, ahogyan arra sem képes, hogy egyértelműen megmondja, a végső szöveg mekkora részét írta vagy szerkesztette ember.

Az OpenAI állítása szerint a vízjelezés érdemben nem befolyásolja a csúcskategóriás modell, a GPT-6 Astra teljesítményét: az ezt mérő benchmarktesztek eredményei nagyjából változatlanok maradnak, amikor a vízjelezést vizsgáló textgrain funkció be van kapcsolva.

Az OpenAI más területeken is úttörő szerepre pályázik: a vállalat első jelentős fogyasztói hardvereszköze egy kijelző nélküli, hordozható AI-eszköz lesz, amelyet Jony Ive, az Apple egykori vezető formatervezője és LoveFrom nevű stúdiója közreműködésével fejlesztenek.