SG.hu·

Vízjelezni kezdi az MI által írt szövegeket a Claude

Vízjelezni kezdi az MI által írt szövegeket a Claude
Az Anthropic megváltoztatja a chatbot működését a kisebb, véletlenszerű döntések szintjén, hogy megfeleljen az uniós szabályozásnak.

A világ mostanra már jól ismeri a gép által generált szövegek tipikus fordulatait: egyes szavak túlzott használatát, a gondolatjelek túlburjánzását, valamint a gondosan pontokba szedett tartalmakat. De vajon hamarosan még rosszabb lesz a helyzet? Az Anthropic egy olyan frissítést tett közzé, amely megváltoztatja, hogyan állít elő prózai szöveget a Claude MI-modellje. Erre azért van szükség, hogy megfeleljen egy uniós szabályozásnak, amely decembertől előírja minden MI által generált szöveg vízjelezését. A minden, az Európai Unióban működő MI-vállalatra vonatkozó szabályozás azt jelenti, hogy a vállalatoknak néhány hónapon belül be kell vezetniük ezeket a vízjeleket. Ez megnehezítheti, hogy diákok, ügyvédek és egyetemi oktatók sajátjukként tüntessenek fel chatbot által írt tartalmakat. Az Anthropic közölte, hogy a változtatásokat azon a finom, véletlenszerű szinten hajtják végre, amelyen a modelljeik a szöveget generálják, és az átlagos olvasó számára nem lesznek észlelhetők.

Legalább egy szakértő azonban másképp gondolja. "Ez az egész projekt perverz meghamisítása annak, amit az írás jelent" - írta John Gruber veterán technológiai blogger. Érvelése szerint a vízjel korlátozni fogja a Claude működését, és arra kényszeríti majd, hogy összességében rosszabb, kevésbé pontos szóválasztásokat alkalmazzon. Bár szerinte ettől a modell által írt szöveg nem feltétlenül lesz kevésbé pontos, úgy vélte, hogy ezek a korlátozások mégis rontanak majd rajta.

Van egy véletlenszerű, sztochasztikus elem azokban az apró döntésekben, amelyeket egy MI-modell egy mondat megfogalmazásakor hoz: például hogy egy napot "szürkének" vagy "borúsnak" nevez, illetve hogy a folyó vizére "patak" vagy "csermely" kifejezéssel utal. Az Anthropic új vízjele ezeket a véletlenszerű döntéseket fogja módosítani - közölte a vállalat -, és ennek eredményeként olyan mintázat jön létre, amelyet maga az Anthropic, illetve azok is felismerhetnek, akik rendelkeznek a dekódoláshoz szükséges kulccsal. Steven Murdoch, a University College London számítástechnikai professzora szerint a változtatás "valószínűleg semmilyen észrevehető hatással nem jár majd".

Úgy tűnik, Gruber kifogása elsősorban arra irányul, hogy a vízjelezés kevésbé szabaddá teszi a nagy nyelvi modell számára annak eldöntését, hogy melyik szó következzen egy mondatban, ezért előfordulhat, hogy nem a lehető legjobb választást teszi. Az LLM-ek azonban már most sem feltétlenül a legjobb döntéseket hozzák. "Ezekben a nagy nyelvi modellekben már eleve jelen van a véletlenszerűség" - mondta Murdoch. "Ez meglehetősen alapvető része annak, ahogyan működnek. Ha nem lenne ez a véletlenszerűség, akkor beragadnának bizonyos ciklusokba, és újra meg újra ugyanazt kezdenék ismételni."

Más szóval egy chatbot nem feltétlenül azért dönt úgy, hogy a folyó vizét "pataknak" nevezi a "csermely" helyett, mert az utóbbi régiesebb hangulatú kifejezés lenne. A modell nem mérlegeli ezeket a lehetőségeket: véletlenszerűen választ közülük. Erre nemrég konkrét bizonyíték is született, amikor egy vezető kémiai folyóiratban megjelent tanulmányt vissza kellett vonni, mert úgy tűnt, hogy a szerzők egy MI-eszközt használtak a publikáció egy részének megírásához. Az eszköz a "végső megoldás" kifejezés alternatívájaként a "egy etnikai csoport tömeges meggyilkolása" fordulatot használta, miközben a szóban forgó bekezdés látszólag egy cinkből készült nanogélről szólt.

A frissítéssel kapcsolatban Murdoch azt mondta: "Nem lesz észrevehető különbség. Ugyanazok a véletlenszám-generátorok maradnak - korábban teljesen véletlenszerűek voltak, most pedig statisztikailag kiszámíthatóvá válnak, de továbbra is véletlenszerűek maradnak." Van azonban egy másik oka is az MI által létrehozott tartalmak vízjelezésének - mondta Murdoch: már most is annyi ilyen tartalom található az interneten, hogy az akár maguknak a modelleknek is árthat. Ha az MI-t MI által írt tartalmakkal tanítják, az úgynevezett "modellösszeomláshoz" vezethet, amelynek során a modellek összekeverik a fogalmakat. Más szóval a vízjelezés nem csupán egy csendben rendkívül hatékony eszköz a dezinformáció elleni küzdelemben - hanem egy mélyrehatóan átalakító rendszer annak biztosítására is, hogy a chatbotok ne őrüljenek meg.

Kapcsolódó cikkek és linkek

Hozzászólások

Jelentkezz be a hozzászóláshoz.

Nem érkezett még hozzászólás. Legyél Te az első!