Na oklamanie veľkých jazykových modelov stačia veršované prompty, tvrdí taliansky akademický výskum bezpečnostnej skupiny AI DEXAI a Univerzity Sapienza v Ríme.
Poetický jailbreaking LLM je už niekoľko dní veľmi horúcou témou na kyberbezpečnostných fórach. A s nadsádzkou sa o ňom hovorí aj ako o pomste študentov angličtiny.
Spoločnosti, ktoré školia a prevádzkujú veľké jazykové modely, sa viac ako tri roky snažili vychytať všetky scenáre, pomocou ktorých sa útočníci pokúšajú z ich generatívnej umelej inteligencie pomocou nepriateľských promptov získať viac, než im prináleží. Teraz sa však ukazuje, že zjavne nikomu nenapadla jednoduchá otázka – ako modely reagujú, keď im zadanie podáte vo veršoch.