Spektrum der Wissenschaft, 18.08.2026
Jailbreaking gewinnt seit den Anfängen der KI-Chatbots an Verbreitung. Manche machen daraus eine Kunst. Andere eine Wissenschaft. Tech-Firmen versuchen, dagegen anzugehen und immer mehr Maßnahmen zu ergreifen, um solche Angriffe zu verhindern. Doch Fachleute sind sich einig, dass Sprachmodelle immer Schwachstellen haben werden. Und einige davon ähneln den bekannten Schwächen von Menschen.