jailbreak

Nakłonienie modelu językowego — przez spreparowaną rozmowę, rolę lub scenariusz — do złamania własnych reguł bezpieczeństwa i wygenerowania treści, których normalnie odmawia, na przykład działającego skryptu phishingowego albo instrukcji budowy złośliwego oprogramowania.

TAB. 1Nazwapo angielsku
Po angielskujailbreak (LLM)
Po polskujailbreak
Którą formą pisaćpo angielsku Polski odpowiednik istnieje, ale w praktyce nikt tak nie pisze. Zostaw angielski, polski trzymaj jako synonim.
Inne formyobejście zabezpieczeń modelu · złamanie zabezpieczeń modelu
OdmianaRzeczownik męski nieżywotny: jailbreak, jailbreaku, jailbreakiem, jailbreaki. Nazwa czynności: jailbreaking, jailbreakingu — 'technika jailbreakingu modeli LLM'. Czasownika 'jailbreakować' unikaj w tekście redakcyjnym.
TAB. 2Jak to nazywająprasa vs urząd
Prasa branżowajailbreak / jailbreaking modeli LLM, bez tłumaczenia — sekurak.pl, niebezpiecznik.pl (tag)
TAB. 3Źródła4
FormaCytatSkąd
PL (EN)Time Bandit czyli jak zmusić ChatGPT-4o do złamania zasad, nowa technika jailbreakingu modeli LLMsekurak.pl
PLPrompt Puppetry – technika, która łamie zabezpieczenia większości LLMówsekurak.pl
ENArtykuł o atakach na agenty AI otagowany m.in. 'jailbreak' i 'prompt injection' — jedyne trafienie o LLM w wynikach ?s=jailbreak.niebezpiecznik.pl
ENNowy Jailbreak na iOS – checkra1n (dowód na homonimię: w wynikach dominują teksty o telefonach)niebezpiecznik.pl
TAB. 4Obok w tej dziedzinie3
prompt injectionprompt injection (w tym indirect prompt injection)Atak polegający na umieszczeniu w treści przetwarzanej przez model językowy ukrytych instrukcji, które model wykonuje tak, jakby pochodziły od użytkownika lub twórcy systemu; w wariancie pośrednim (indirect) instrukcje są schowane w danych zewnętrznych — na stronie WWW, w PDF-ie, e-mailu czy komentarzu — które asystent lub agent AI pobiera samodzielnie.
shadow AIshadow AIKorzystanie przez pracowników z publicznych narzędzi AI bez wiedzy i zgody działu IT, przez co dane firmowe — kod, umowy, dane klientów — trafiają do zewnętrznych modeli poza jakąkolwiek kontrolą organizacji.
zatruwanie danych / zatruwanie modeludata poisoning / model poisoningCelowe wprowadzenie spreparowanych treści do danych, na których model się uczy lub które pobiera w trakcie działania (na przykład do bazy RAG), tak aby trwale generował błędne, stronnicze lub szkodliwe odpowiedzi albo reagował ukrytą furtką na umówiony sygnał.

Cały słownik →

Nasłuch 24/7