Claude, Opus

Claude Opus 5: Anthropic senkt Prompt-Injection-Erfolgsrate auf 0,2%

Veröffentlicht am: 11.08.2026 um 09:51 Uhr | Redaktion boerse-global.de

Anthropic veröffentlicht neue Echtzeit-Schutzmechanismen für Claude Opus und Sonnet. Die Modelle zeigen deutlich verbesserte Abwehrraten gegen Prompt-Injection-Angriffe.

Anthropic rüstet Claude-Modelle mit neuen Echtzeit-Sicherheitsfunktionen aus
Ein Cybersecurity-Experte arbeitet an einem modernen Arbeitsplatz in einem Serverraum, umgeben von blau leuchtender Hardware. Illustration mit AI erstellt übermittelt durch boerse-global.de

Das KI-Unternehmen Anthropic hat neue Echtzeit-Schutzvorkehrungen für seine Sprachmodelle Claude Opus und Claude Sonnet bereitgestellt. Ziel dieser Maßnahmen ist es, die Sicherheit gegenüber sich stetig weiterentwickelnden digitalen Bedrohungen zu erhöhen. Details zu den neuen Sicherheitsarchitekturen wurden im Claude Help Center veröffentlicht.

Signifikante Fortschritte bei der Abwehr von Prompt-Injections

Ein zentraler Aspekt der neuen Schutzmaßnahmen betrifft die Widerstandsfähigkeit gegen indirekte Prompt-Injection-Angriffe. Aktuellen Testergebnissen des Gray-Swan-IPI-Benchmarks aus dem ersten Quartal 2026 zufolge weist das Modell Claude Opus 5 eine Resistenz von 98 % gegen derartige Manipulationsversuche auf.

Die Erfolgswahrscheinlichkeit für Angreifer sank bei Claude Opus 5 nach 15 Versuchen auf 2,0 %. Im Vergleich dazu lag dieser Wert beim Vorgängermodell Opus 4.8 noch bei 5,5 %. Besonders deutlich wird die Steigerung bei der Erfolgsquote für einen einzelnen Angriffsversuch: Diese wurde von 0,5 % bei Opus 4.8 auf 0,2 % bei Opus 5 reduziert. Branchenanalysten ziehen hierbei Vergleiche zu Wettbewerbern; so verzeichne das leistungsstärkste Modell außerhalb der Claude-Familie, Muse Spark, in diesem Szenario eine Erfolgsrate von 16,5 %.

Spezialisierte Sicherheitsmetriken für Coding und Browser-Nutzung

Die Wirksamkeit der neuen Schutzmaßnahmen variiert je nach Einsatzgebiet des Modells. In einer kontrollierten Coding-Umgebung erzielte Claude Opus 5 unter Verwendung der Funktion „Extended Thinking“ eine Erfolgsrate für Angriffe von lediglich 0,56 %. Ohne diese Funktion lag der Wert bei 0,41 %. Beide Werte markieren eine deutliche Verbesserung gegenüber Opus 4.8, das in diesen Kategorien Erfolgsraten von 7,03 % beziehungsweise 17,44 % aufwies.

Anzeige

Während technologische Fortschritte die Sicherheit von KI-Systemen erhöhen, müssen Unternehmen auch die rechtlichen Rahmenbedingungen im Blick behalten. Dieser kostenlose Umsetzungsleitfaden bietet einen kompakten Überblick über alle Anforderungen, Pflichten und Fristen der EU-KI-Verordnung. EU AI Act in 5 Schritten verstehen: Fristen, Pflichten und Risikoklassen kompakt erklärt

Weitere Ergebnisse der Sicherheitsprüfung für Claude Opus 5 zeigen:
* Im Bereich „Computer-Use“ sank die Erfolgsrate von 7,14 % (Opus 4.8) auf 0,54 %.
* Bei der Verwendung von Sonden (Probes) wurde eine Rate von 0,18 % gemessen.
* In Szenarien der Browser-Nutzung konnten für Claude Opus 5 keinerlei erfolgreiche Angriffe registriert werden.

Anzeige

Wer sich mit der Implementierung moderner KI-Systeme befasst, steht oft vor der Frage, welche Anwendungen rechtlich als Hochrisiko eingestuft werden. Ein kostenloser Report klärt über die neuen Regeln der EU-KI-Verordnung auf und zeigt, was Verantwortliche jetzt konkret tun müssen. Kostenlosen Leitfaden zur KI-Verordnung jetzt herunterladen

Verifizierungsprogramm und Preisstruktur

Zusätzlich zu den technischen Updates bietet das Unternehmen das sogenannte Anthropic Cyber Verification Program an. Dieses Programm ist kostenlos zugänglich, wobei eine Entscheidung über die Aufnahme von Bewerbern innerhalb von zwei Geschäftstagen getroffen wird. Teilnehmer des Programms erhalten angepasste Richtlinien für das Blockieren von Dual-Use-Anwendungen bei Claude Opus 5.

Die Kosten für die Nutzung von Claude Opus 5 belaufen sich auf 5 US-Dollar beziehungsweise 25 US-Dollar pro eine Million Tokens. Durch die Integration der neuen Echtzeit-Schutzmaßnahmen reagiert Anthropic auf die steigenden Anforderungen an die IT-Sicherheit im Bereich der generativen Künstlichen Intelligenz.

Disclaimer...

de | wissenschaft | 69936270 |