Leülsz a reggeli kávéddal, megnyitod a ChatGPT-t, és beírod: „írj egy rövid születésnapi üzenetet a kertészkedő nagynénémnek". Pár másodperc múlva megjelenik egy kedves bekezdés. Majdnem emberi. A motorháztető alatt viszont ami történt, sokkal egyszerűbb — és sokkal furább —, mint a legtöbben gondolnák.
Az üzenetedet feldarabolja tokenekre
Először is: a ChatGPT nem úgy olvassa a mondatodat, ahogy te. A szöveget kis darabokra, úgynevezett tokenekre bontja — általában darabonként nagyjából négy karakter hosszúak. Egy rövid szó egy token, egy hosszabb kettő vagy három. A „születésnapi" egy token. A „kertészkedő" lehet, hogy kettő. A modell mindig csak számokat lát, amelyek ezeket a darabokat jelölik; a valódi betűk sosem jutnak el hozzá. Ezt a lépést tokenizálásnak hívják, és így kezd minden modern AI-csevegőrobot.
Az agy egy „nagy nyelvi modell"
A ChatGPT belsejében egy nagy nyelvi modell (LLM) dolgozik. A nagy név ellenére nem úgy gondolkodik, ahogy te. Ez egy hatalmas matematikai függvény — képzelj el egy receptet milliárdnyi állítható beállítással, ezeket hívjuk paramétereknek. Egy hosszú tanítási folyamat során a modell hatalmas mennyiségű szöveget olvasott — könyveket, cikkeket, weboldalakat, kódtárakat —, és fokozatosan hangolta a paramétereit, amíg nagyon jó nem lett egyetlenegy dologban: bármilyen mondatban kitalálni a legvalószínűbb következő szót.
Ennyi. Ez a lényegi trükk.
A válasz szóról szóra épül fel
Amikor megnyomod az entert, a modell nem „keresi ki" a választ úgy, mint egy kereső. Minden token után kiszámítja, melyik szó jöhet a legnagyobb valószínűséggel következőnek, kiválaszt egyet, majd az egész számítást újraindítja az addig leírtak alapján. Ismételd meg ezt ezerszer, és kész a teljes bekezdés.
Ezért ad a ChatGPT ugyanarra a kérdésre minden alkalommal kissé más választ. És ezért tud magabiztosan félre dolgokat kitalálni — a szakértők ezt hallucinációnak hívják (az AI kitalál egy hihető hangzású, de hamis választ). Nem tényeket ellenőriz; azt jósolja meg, ami jól hangzik.
A mai ChatGPT-re extra eszközöket is ráépítettek
Az eredeti ChatGPT lényegében csak egy csevegőablak volt. A mai váltora több réteget is ráhúztak erre a kitalálós motorra. Tud a weben friss információt keresni, feltöltött fájlokat olvasni, képeket generálni, kódot írni és futtatni, valamint több lépésből álló feladatokat is elvégezni ügynökökön keresztül — olyan AI-kon, amelyek más appokat is tudnak használni helyetted. Egyik sem váltja fel az alap szókitaláló trükköt; ezek plusz szoftveres képességek, amelyeket a csevegőrobot akkor indít el, ha a kérdésedhez szükség van rájuk.
Mit jelent ez számodra?
- Ha hétköznapi feladatokra használod a ChatGPT-t: A leghasznosabb, amit megjegyezhetsz, hogy szavakat jósol, nem tényeket ellenőriz. Egy születésnapi üzenethez ez tökéletes. Orvosi vagy jogi kérdésnél, vagy bárminél, amire tényleg rábízod magad, ellenőrizd a választ egy megbízható forrásból.
- Ha diák vagy író vagy: Ezért zseniális a ChatGPT vázlatokhoz és piszkozatokhoz, de megbízhatatlan a dátumok, nevek vagy idézetek terén. Használd az induláshoz, de beküldés előtt ellenőriz.
- Ha a munkád miatt aggódsz: Az AI jelenleg az ismétlődő szöveg- és összefoglaló feladatokat kezeli a legjobban sok munkában — nem az ítélethozatalt. Ha érted, hogyan működik valójában az eszköz, könnyebb meglátni, hol segít és hol nem.
Összefoglaló
A ChatGPT nem egy személy bújik meg a képernyő mögött. Egy hatalmas szókitaláló gép, barátságos csevegőablakba csomagolva, néhány extra eszközzel megspékelve. Ha így tekintesz rá, az erősségei — a gyorsaság, a folyékonyság, a piszkozatok, az összefoglalók — érthetővé válnak, és a gyengeségei — a kitalált tények, a bizonytalan következtetések, a valódi megértés hiánya — szintén.
Próbáld ki ma: kérd meg a ChatGPT-t, hogy magyarázzon el valamit, amit már jól ismersz, aztán hasonlítsd össze a válaszát a saját tudásoddal. Azok a hézagok, amelyeket felfedezel, többet tanítanak a működéséről, mint bármilyen magyarázat.
