A bejegyzés szerint a Claude nyelvi modellnél a több rétegű védelem — modellképzés, bemeneti próbaküldés és a szándékot ellenőrző osztályozó — az ismeretlen támadásoknál az indirekt prompt-injekciót körülbelül 0-ra csökkenti; az automatikus mód a Claude kódjában jövő héttől alapértelmezett lesz.
Mesterséges intelligenciával generált szöveg
Többrétegű védelemmel gyakorlatilag nullára csökkenthető az indirekt prompt-injekció a Claude-nál
A bejegyzés szerint a Claude nyelvi modellnél a több rétegű védelem — modellképzés, bemeneti próbaküldés és a szándékot ellenőrző osztályozó — az ismeretlen támadásoknál az indirekt prompt-injekciót…



