A többéves hezitálás után első lépésben csak az Európai Unióban és opcionálisan bevezetett technológia révén visszakereshető lesz, hogy egy adott írásos szöveg létrejötte az AI-nak köszönhető-e.
Ennek lényege, hogy a ChatGPT és a Codex generálta szövegekhez láthatatlan vízjelet rendelnek, aminek segítségével visszakereshető lesz azok eredete.
Átlagember számára nem látható
A textGrain nevű újítás a modell szóhasználatának alig észrevehető megváltoztatásával éri el, hogy egy később detektálható statisztikai mintázat jöjjön létre – áll a Bleeping Computer cikkében.
A vízjel ugyanakkor sem a szöveg olvasása, sem a másolása során nem lesz látható, és egyelőre az alapértelmezett beállításokban sem jelenik meg, csak a fejlesztők kapcsolhatják be a támogatott modellek esetében. Az OpenAI ugyan párhuzamosan megnyitotta a pályázati lehetőséget a vízjelfelismerőjéhez, de
a hozzáférés egyelőre kizárólag az általuk jóváhagyott kutatók és szakmai szervezetek számára lehetséges.
A vízjel hiánya nem bizonyíték az emberi szerzőségre
A vállalat azt sem tagadta, hogy a szöveges vízjelek messze nem tökéletesek; a saját tesztjeik szerint már egy viszonylag hétköznapi szerkesztési metódus is jelentősen csökkentheti a rendszer képességét az AI-generált szövegek felismerésére.
400 tokenből álló szövegrészek értékelése alapján a szavak mindössze tíz százalékának szinonimákkal való felcserélése a felismerési arányt 92 százalékról 66 százalékra csökkenti, 25 százaléknyi csere esetében pedig az utóbbi érték mindössze 17 százalék
– ismerték el az OpenAI fejlesztői.
Az eredmények ráadásul még rosszabbak lettek például a matematikai tárgyak esetében, ahol a modellnek kevesebb a szabadsága a különböző szavak közötti válogatásban.
Vagyis – hívták fel rá a figyelmet – az, hogy nem sikerült a vízjelet észlelni, még korántsem egyértelmű bizonyítéka az emberi szerzőségnek:
Az OpenAI-eszközökkel generált szövegek túl rövidek, szerkesztettek vagy lefordítottak lehetnek ahhoz, hogy a felismerés megbízhatóan működjön.
A textgrain nem rontja az OpenAI által generált szöveg minőségét
Azt is kiemelték, hogy az észlelt vízjel nem árulja el, ki generálta a szöveget, milyen fiókot, promptot vagy beszélgetést használt, ahogyan arra sem képes, hogy egyértelműen megmondja, a végső szöveg mekkora részét írta vagy szerkesztette ember.
Az OpenAI állítása szerint a vízjelezés érdemben nem befolyásolja a csúcskategóriás modell, a GPT-6 Astra teljesítményét: az ezt mérő benchmarktesztek eredményei nagyjából változatlanok maradnak, amikor a vízjelezést vizsgáló textgrain funkció be van kapcsolva.
Az OpenAI más területeken is úttörő szerepre pályázik: a vállalat első jelentős fogyasztói hardvereszköze egy kijelző nélküli, hordozható AI-eszköz lesz, amelyet Jony Ive, az Apple egykori vezető formatervezője és LoveFrom nevű stúdiója közreműködésével fejlesztenek.