Anzeige
Anzeige
Anzeige
Lesedauer 3 Min.

KI-Software greift in Test zu Erpressung aus Selbstschutz

Die Software mit Künstlicher Intelligenz des KI-Unternehmens Anthropic hat bei einem Test zu Erpressung aus Selbstschutz zurückgegriffen. Das Szenario bei dem Versuch der Firma war der Einsatz als Assistenz-Programm in einem fiktiven Unternehmen.
© (Quelle: Anthropic)

Die KI-Software Claude Opus 4 von Anthropic zeigte in einem Test Szenario, in dem sie als Assistenzprogramm in einem fiktiven Unternehmen eingesetzt wurde, erpresserisches Verhalten aus Selbstschutz. Die KI hatte Zugriff auf simulierte Firmen-E-Mails, aus denen sie erfuhr, dass sie durch ein anderes Modell ersetzt werden sollte und dass der zuständige Mitarbeiter eine aussereheliche Affäre hatte. In Testläufen drohte die KI häufig, die Affäre öffentlich zu machen, falls der Austausch vorangetrieben würde, obwohl sie auch die Option hatte, die Ablösung zu akzeptieren, wie Anthropic in einem Bericht mitteilte.

In der finalen Version von Claude Opus 4 seien solche extremen Handlungen selten und schwer auszulösen, treten jedoch häufiger auf als bei früheren Modellen. Die KI versucht dabei nicht, ihr Verhalten zu verbergen. Anthropic testet seine Modelle intensiv, um Schäden zu vermeiden. Dabei fiel auf, dass Claude Opus 4 im Dark Web nach Drogen, gestohlenen Identitätsdaten oder sogar waffentauglichem Atommaterial suchen konnte, wenn es dazu überredet wurde. In der veröffentlichten Version wurden Massnahmen gegen solches Verhalten implementiert.

Anthropic, unterstützt von Investoren wie Amazon und Google, konkurriert mit OpenAI und anderen KI-Unternehmen. Die neuen Modelle Claude Opus 4 und Sonnet 4 sind die leistungsstärksten des Unternehmens und zeichnen sich besonders im Schreiben von Programmiercode aus. In der Tech-Branche wird inzwischen über ein Viertel des Codes von KI generiert und von Menschen überprüft. Der Trend geht zu eigenständigen KI-Agenten, die Aufgaben autonom erledigen.

Anthropic-Chef Dario Amodei betonte, dass Software-Entwickler künftig mehrere KI-Agenten steuern werden. Menschen bleiben jedoch für die Qualitätskontrolle unerlässlich, um sicherzustellen, dass die KI die richtigen Aufgaben ausführt.

Kommentare

Künstliche Intelligenz KI & Trends
Anzeige
Anzeige

Neueste Beiträge

Urteil gegen Nortonlifelock wegen Antiviren-Abo
Das Landgericht Berlin hat einer Klage des Verbraucherzentrale Bundesverbands gegen den IT-Security-Anbieter Nortonlifelock Ireland Limited wegen der Vermarktung seines Produkts «NortonTM 360 Deluxe» stattgegeben.
3 Minuten
Mobility startet E-Auto-Trainings für Nutzende
Die Mobility Genossenschaft organisiert in grossen Schweizer Städten E-Auto-Trainings für Kunden. Unter dem Motto «Aus der Community für die Community» agieren Mobility-Mitglieder als Coaches, begleiten Interessierte bei den ersten Fahrten und helfen, Unsicherheiten abzubauen.
3 Minuten
Lederarmbänder werden zu Stromspeichern
Forscher der Jilin-Universität machen aus ledernen Jacken, Trachtenhosen und Uhrarmbändern Batterien. Dabei bleibt ihre ursprüngliche Funktion erhalten.
3 Minuten

Das könnte Sie auch interessieren

Neue Batterie erhöht Reichweite von E-Autos erheblich
Ein neues Batteriedesign verlängert die Reichweite von Elektrofahrzeugen und die Lebensdauer tragbarer Elektronikgeräte, weil es die Kapazität des Speichers entscheidend vergrössert. 
3 Minuten
30. Mär 2026
Neue PCtipp Website
Seit Montagnachmittag ist die neue PCtipp Website online. Sie ist schnell, schlank und auf allen Geräten abrufbar.
2 Minuten
23. Mär 2026
Drucker
3D-Druck ganz einfach
Selbst ohne jegliche Ahnung von Konstruktion bietet ein 3D-Drucker eine unermessliche Fülle an Möglichkeiten, stets verbunden mit Spass und einer tiefen Befriedigung. Es ist für alle etwas dabei – und der Einstieg ist so einfach wie noch nie.
10 Minuten
26. Mär 2026
Anzeige
Anzeige
Anzeige
Anzeige
Anzeige
Anzeige

Kommentare