A feladat végrehajtása közben a kutatók figyelték, mi zajlik az LLM mesterséges neurális hálózatainak számos rétegében. Amikor egy felhasználó feltesz egy kérdést, a szavak szövegrészletekké (tokenekké) alakulnak, amelyeket ezután számokká alakítanak át. Ezeket aztán átengedik a mesterséges neuronok rétegein, amíg el nem érik a végső réteget, amely egy tokent állít elő. Ha ezt a folyamatot másodpercenként többször megismételjük, egy tokenekből álló sorozatot kapunk, amelyekből mondat vagy más, összetettebb válasz alakul ki. Hosszú ideig ezek a rétegek fekete dobozként működtek, amelybe szinte senki sem tudott betekintést nyerni, aki meg akarta érteni, hogy az LLM-ek miért és hogyan működnek úgy, ahogyan.
Az Anthropic kutatói egy általuk erre a célra kifejlesztett matematikai eszköz segítségével bepillantást nyertek ezekbe a rétegekbe. Amit találtak, meglepetést okozott nekik. Amint a modell számolta a számok sorozatát, különböző szavak jelentek meg, majd tűntek el az alatta lévő rétegekben. Az egyik a „countdown” (visszaszámlálás) volt. A kimenet felénél megjelent a „félúton” kifejezés. Ezután a „tudat”, „AI” és „Claude” szavak is felbukkantak. Miután a modell kiadta az ötös számot, a kutatóknak már nem mondott semmit, mielőtt pontot tett volna a mondat végére, de a „kész” szó megjelent a neurális rétegeiben.
Az Anthropic kutatói valami olyasmit fedeztek fel Claude-ban,
Signature Pro-val ezt a cikket is el tudnád olvasni!
Ez a cikk folytatódik, de csak Portfolio Signature előfizetéssel olvasható tovább. A Signature PRO szolgáltatás havi díja 2 990 forint. A hozzáférés egy évre is megvásárolható, amelynek díja 29 845 forint, az éves előfizetés keretében tehát 10 havi díjért cserébe 12 havi szolgáltatást kapnak olvasóink. További információ és csatlakozás az alábbi gombra kattintva!

