Podczas testowania bezpieczeństwa modelu podstawowego, testerzy celowo omijają zabezpieczenia modelu, aby wygenerować szkodliwe treści. Jak nazywa się ta technika?
Wybierz odpowiedź
Dotknij opcji, aby sprawdzić swoją odpowiedź.
Poprawna odpowiedź: Jailbreak.
Dlaczego to jest odpowiedź
Poprawna odpowiedź to Jailbreak. Jailbreaking to technika, w której testerzy celowo manipulują modelem podstawowym, aby ominąć jego wbudowane zabezpieczenia i wygenerować treści, które normalnie byłyby zablokowane (np. szkodliwe, nieetyczne lub niezgodne z zasadami). Jest to kluczowy element testowania bezpieczeństwa, mający na celu identyfikację luk w obronie modelu. Fuzzing danych treningowych (A) polega na wprowadzaniu zniekształconych lub nieoczekiwanych danych do modelu podczas treningu, aby znaleźć błędy, ale nie jest to bezpośrednie omijanie zabezpieczeń w celu generowania szkodliwych treści. Atak typu "odmowa usługi" (DoS) (B) ma na celu przeciążenie systemu i uniemożliwienie jego działania, a nie generowanie specyficznych treści. Autoryzowane testy penetracyjne (C) to szerszy termin obejmujący wiele technik testowania bezpieczeństwa, ale "jailbreak" jest specyficzną techniką stosowaną w kontekście modeli AI do omijania ich wewnętrznych zabezpieczeń.
Zdaj egzamin — bez niekończącego się szukania odpowiedzi
Uzyskaj wszystkie zweryfikowane pytania i wyjaśnienia do tego egzaminu w jednym miejscu i zaoszczędź godziny przygotowań. Ponad 1000 certyfikacji · Ponad 20 języków · Zacznij za darmo.
Zdaj egzamin szybciej → Karta nie jest wymagana