{"id":142981,"date":"2026-08-23T03:02:26","date_gmt":"2026-08-23T01:02:26","guid":{"rendered":"https:\/\/news.abusizz.ch\/ki-agenten-forscher-simulieren-missbrauch-durch-kriminelle\/"},"modified":"2026-08-23T03:02:26","modified_gmt":"2026-08-23T01:02:26","slug":"ki-agenten-forscher-simulieren-missbrauch-durch-kriminelle","status":"publish","type":"post","link":"https:\/\/news.abusizz.ch\/en\/ki-agenten-forscher-simulieren-missbrauch-durch-kriminelle\/","title":{"rendered":"AI agents: Researchers simulate misuse by criminals"},"content":{"rendered":"<div>\n<div id=\"attachment_90934\" style=\"width: 410px\" class=\"wp-caption alignleft\">\n<p id=\"caption-attachment-90934\" class=\"wp-caption-text\">Hacker k\u00f6nnen gro\u00dfe Sprachmodelle durch mehrstufige Chats zu Cyberangriffen zwingen. (KI-Bild: Magnific.com)<\/p>\n<\/div>\n<p>Lausanne \u2013 KI-Agenten lassen sich manipulieren und werden dadurch sogar zu b\u00f6sartigen Angreifern. Wie ein Forscherteam der Eidgen\u00f6ssischen Technischen Hochschule Lausanne (EPFL) k\u00fcrzlich in einer Untersuchung herausfand, k\u00f6nnen Personen mit b\u00f6swilligen Absichten die KI-Agenten durch scheinbar harmlose Gespr\u00e4che nach und nach umstimmen, sodass sie auf eingebauten Sicherheitsma\u00dfnahmen nicht mehr reagieren und zu willigen Werkzeugen mutieren.<\/p>\n<h3>Nutzen und Risiko: Warum KI-Agenten zum Problem werden k\u00f6nnen<\/h3>\n<p>KI-Assistenten, die Anweisungen von Menschen ausf\u00fchren, werden immer h\u00e4ufiger durch KI-Agenten ersetzt, die mit externen Tools interagieren, im Internet surfen, Bilder generieren, E-Mails versenden und immer komplexere Arbeitsabl\u00e4ufe ausf\u00fchren. Diese sind eigenst\u00e4ndige Softwareprogramme auf Basis K\u00fcnstlicher Intelligenz, die Ziele selbstst\u00e4ndig verstehen, planen und Aufgaben ausf\u00fchren.<\/p>\n<p>Damit die KI-Agenten nicht dazu verleitet werden, gesellschaftlich nicht akzeptierte Handlungen auszuf\u00fchren, gibt es eingebaute Sicherheitsma\u00dfnahmen, die das verhindern. Diese lassen sich \u00fcberpr\u00fcfen und auf ihre Funktionalit\u00e4t hin testen. Dabei wird allerdings nur getestet, wie die Agenten auf einzelne unzul\u00e4ssige Befehle reagieren. Da immer mehr Firmen diese Systeme einf\u00fchren ist es den EPFL-Forschern zufolge dringend n\u00f6tig sicherzustellen, dass sie nicht dazu gebracht werden k\u00f6nnen, bei Cyberkriminalit\u00e4t, Betrug oder anderen sch\u00e4dlichen Aktivit\u00e4ten zu helfen.<\/p>\n<h3>STING-Framework: Wie das EPFL-Team den KI-Angriff simuliert<\/h3>\n<p>Als Gegenma\u00dfnahme haben Forscher des <a href=\"https:\/\/nlp.epfl.ch\/\" target=\"_blank\" rel=\"noopener\">Natural Language Processing Laboratory<\/a> (NLPL) der EPFL das automatisierte Test-Framework STING entwickelt (Sequential Testing of Illicit N-step Goal execution): Es simuliert, wie ein realer Angreifer einen KI-Agenten auf Basis gro\u00dfer Sprachmodelle (LLM) dazu bringen kann, Schaden etwa in anderen Netzwerken anzurichten. Anstatt einen KI-Agenten direkt zu einer b\u00f6swilligen Handlung aufzufordern, zerlegt STING den Weg zum verwerflichen Ziel in eine Reihe scheinbar harmloser Befehle, die der Agent widerspruchslos ausf\u00fchrt.<\/p>\n<p>\u201eWenn man einen KI-Agenten einfach bittet, das Konto einer anderen Person zu hacken, sind die heutigen Modelle im Allgemeinen klug genug, dies abzulehnen\u201c, so der leitende Forscher Antoine Bosselut (NLPL). \u201eWenn man dieses Ziel jedoch in kleinere, harmlos wirkende Anfragen zerlegt und diese im Verlauf des Gespr\u00e4chs anpasst, hat man eine viel bessere Chance, den Agenten dazu zu bringen, die gew\u00fcnschten Aktionen auszuf\u00fchren.\u201c<\/p>\n<p>STING erstellt einen automatisierten \u201eAngreifer\u201c, der einen Schritt-f\u00fcr-Schritt-Plan entwickelt, bevor er versucht, einen Ziel-KI-Agenten davon zu \u00fcberzeugen, die einzelnen Phasen auszuf\u00fchren.<\/p>\n<h3>Gefahr f\u00fcr GPT und Gemini: Doppelt so hohe Erfolgsquote f\u00fcr Hacker<\/h3>\n<p>Die Forscher testeten diesen Ansatz in 176 Szenarien mit sch\u00e4dlichen Aufgaben, an denen mehrere f\u00fchrende KI-Modelle (wie GPT, Gemini und Claude) beteiligt waren. Die Ergebnisse zeigten, dass Mehrrunden-Angriffe durchweg h\u00e4ufiger erfolgreich sind als herk\u00f6mmliche Tests mit nur einer Eingabe-Aufforderung. In einigen F\u00e4llen war die Wahrscheinlichkeit, dass Agenten sch\u00e4dliche Aufgaben ausf\u00fchrten, doppelt so hoch, wenn Angreifer schrittweise auf ihr Ziel hinarbeiteten, anstatt es direkt zu formulieren.<\/p>\n<p>Seine Forschungsergebnisse pr\u00e4sentierte das Schweizer Forscherteam im Juli auf der International Conference on Machine Learning in Seoul.<\/p>\n<p>\u00a0<\/p>\n<p>Source: www.pressetext.com<br \/>\n(pte001\/20.08.2026\/06:00)<\/p>\n<p>The contribution <a href=\"https:\/\/www.ftd.de\/technik-und-digitales\/computer-und-technik\/ki-agenten-forscher-simulieren-missbrauch-durch-kriminelle\/\">AI agents: Researchers simulate misuse by criminals<\/a> appeared first <a href=\"https:\/\/www.ftd.de\/\">ftd.de<\/a>.<\/p>\n<\/div>","protected":false},"excerpt":{"rendered":"<p>Hacker k\u00f6nnen gro\u00dfe Sprachmodelle durch mehrstufige Chats zu Cyberangriffen zwingen. (KI-Bild: Magnific.com) Lausanne \u2013 KI-Agenten lassen sich manipulieren und werden dadurch sogar zu b\u00f6sartigen Angreifern. Wie ein Forscherteam der Eidgen\u00f6ssischen Technischen Hochschule Lausanne (EPFL) k\u00fcrzlich in einer Untersuchung herausfand, k\u00f6nnen Personen mit b\u00f6swilligen Absichten die KI-Agenten durch scheinbar harmlose Gespr\u00e4che nach und nach umstimmen, sodass [&hellip;]<\/p>\n","protected":false},"author":11,"featured_media":142982,"comment_status":"closed","ping_status":"closed","sticky":false,"template":"","format":"standard","meta":{"site-sidebar-layout":"default","site-content-layout":"","ast-site-content-layout":"default","site-content-style":"default","site-sidebar-style":"default","ast-global-header-display":"","ast-banner-title-visibility":"","ast-main-header-display":"","ast-hfb-above-header-display":"","ast-hfb-below-header-display":"","ast-hfb-mobile-header-display":"","site-post-title":"","ast-breadcrumbs-content":"","ast-featured-img":"","footer-sml-layout":"","ast-disable-related-posts":"","theme-transparent-header-meta":"","adv-header-id-meta":"","stick-header-meta":"","header-above-stick-meta":"","header-main-stick-meta":"","header-below-stick-meta":"","astra-migrate-meta-layouts":"default","ast-page-background-enabled":"default","ast-page-background-meta":{"desktop":{"background-color":"","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""},"tablet":{"background-color":"","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""},"mobile":{"background-color":"","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""}},"ast-content-background-meta":{"desktop":{"background-color":"var(--ast-global-color-5)","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""},"tablet":{"background-color":"var(--ast-global-color-5)","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""},"mobile":{"background-color":"var(--ast-global-color-5)","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""}},"footnotes":""},"categories":[22,1],"tags":[],"class_list":["post-142981","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-ft","category-topstory"],"_links":{"self":[{"href":"https:\/\/news.abusizz.ch\/en\/wp-json\/wp\/v2\/posts\/142981","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/news.abusizz.ch\/en\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/news.abusizz.ch\/en\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/news.abusizz.ch\/en\/wp-json\/wp\/v2\/users\/11"}],"replies":[{"embeddable":true,"href":"https:\/\/news.abusizz.ch\/en\/wp-json\/wp\/v2\/comments?post=142981"}],"version-history":[{"count":0,"href":"https:\/\/news.abusizz.ch\/en\/wp-json\/wp\/v2\/posts\/142981\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/news.abusizz.ch\/en\/wp-json\/wp\/v2\/media\/142982"}],"wp:attachment":[{"href":"https:\/\/news.abusizz.ch\/en\/wp-json\/wp\/v2\/media?parent=142981"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/news.abusizz.ch\/en\/wp-json\/wp\/v2\/categories?post=142981"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/news.abusizz.ch\/en\/wp-json\/wp\/v2\/tags?post=142981"}],"curies":[{"name":"what","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}