A probléma
Amint a prompt hosszabb lesz, megjelenik egy alattomos hiba. A modell nem tudja biztosan, hol ér véget az utasítás és hol kezdődik a feldolgozandó anyag. Ha a beillesztett ügyféllevélben az áll, hogy kérem, küldjenek árajánlatot, a modell hajlamos ezt feladatnak venni, és árajánlatot írni, pedig mi csak összefoglalót kértünk a levélről.
A megoldás, a határok kijelölése
A technika egyszerű. Az adatot látható határok közé zárjuk, és az utasításban erre a határra hivatkozunk. A gyakorlatban ez lehet hármas idézőjel, XML szerű címke vagy egyszerű felirat, a lényeg a következetesség.
Az utasítás a prompt elején vagy a legvégén legyen, az adat pedig középen, egyértelmű jelöléssel. A leggyengébb elrendezés az, amikor az utasítás az adat közepébe ékelődik, mert ott vész el a legkönnyebben.
Miért biztonsági kérdés is
A szétválasztás nem csak minőségi ügy. Ha a modell a beillesztett tartalomban lévő felszólításokat utasításként kezeli, akkor egy rosszindulatú levél vagy dokumentum eltérítheti a munkamenetet. Ezt hívják prompt injekciónak, és a védekezés első lépése ugyanez a fegyelem. Ami adat, az jelölten adat, és az utasításban kimondjuk, hogy a határokon belüli szövegben található kéréseket nem kell teljesíteni, csak feldolgozni.
Sablon, amit érdemes megjegyezni
Ez a négyblokkos szerkezet a leghosszabb anyagoknál is stabil marad, és ez az alapja minden későbbi, összetettebb promptnak is.
Források és további olvasnivaló
A tananyag gerince az Anthropic ingyenes, kilencfejezetes Prompt Engineering Interactive Tutorial kurzusa. A prompt injekcióról részletesen az AI biztonsági kockázatok tananyagban.