KI: Anthropic überarbeitet im März 2026 seine Sicherheitszusagen vor dem Hintergrund von Kontroversen has
Der am 6. April 2026 veröffentlichte Pressespiegel von LinuxFr.org blickt auf die Entwicklungen rund um KI im März zurück: den Rechtsstreit zwischen Anthropic und der US-Regierung, die Überarbeitung der Sicherheitszusagen des Unternehmens und die Leistungsfähigkeit neuer Modelle. Er beleuchtet außerdem die Grenzen von Bewertungen und die Risiken beim Einsatz im juristischen, militärischen und IT-Bereich.
Anthropic überarbeitet seine Sicherheitszusagen
Im März stufte das US-Verteidigungsministerium Anthropic offiziell als „Risiko für die Lieferkette“ ein. Das Unternehmen focht diese Entscheidung an und erwirkte eine einstweilige Verfügung, die ihre Anwendung bis zu einer Entscheidung in der Hauptsache aussetzt. Der Pressespiegel von LinuxFr.org merkt an, dass die offizielle Mitteilung weniger restriktiv war als frühere öffentliche Erklärungen: Insbesondere untersagte sie Subunternehmern des Ministeriums nicht, mit Anthropic zusammenzuarbeiten.
Ein weiteres wichtiges Thema betrifft die Richtlinie des Unternehmens zur verantwortungsvollen Entwicklung (RSP). In ihren früheren Fassungen sah sie vor, die Entwicklung und Bereitstellung von Modellen zu verlangsamen oder auszusetzen, wenn die Sicherheitsvorkehrungen mit deren Fortschritt nicht Schritt hielten. Der Pressespiegel betont, dass die Bewertungen von Opus 4.6 es nicht mehr erlaubten, das Erreichen der Risikostufe ASL-4 auszuschließen, obwohl die entsprechenden Verfahren noch nicht festgelegt waren.
Die neue Fassung der Richtlinie schränkt die Reichweite mehrerer einseitiger Zusagen ein. Anthropic erklärt, dass bestimmte fortgeschrittene Sicherheitsanforderungen im Alleingang schwer zu erfüllen seien, und will nach eigenen Angaben an als umsetzbar betrachteten Zusagen festhalten. Zugleich erfasst das Unternehmen Risiken, die seiner Ansicht nach eine gemeinsame Antwort der Branche erfordern. Der Pressespiegel stellt diese Änderung als Rückschritt gegenüber früheren Versprechen dar, vor dem Hintergrund, dass ihm eine von einem einzelnen Unternehmen beschlossene Pause kaum vorstellbar erscheint.
Angekündigte Fortschritte, differenziert zu betrachtende Bewertungen
Google DeepMind stellte Gemini 3.1 Pro vor, OpenAI GPT 5.4. Dem Pressespiegel zufolge gehört Gemini nach den veröffentlichten Ergebnissen zu den führenden Modellen, doch die erwähnten Rückmeldungen aus der Praxis fallen zurückhaltender aus. Auch das Sicherheitsdatenblatt von DeepMind wird als wenig detailliert beurteilt: Es besagt, dass das Modell keine zusätzlichen Maßnahmen rechtfertige, ohne diese Schlussfolgerung näher zu erläutern.
Bei FrontierMath sollen drei Modelle – GPT 5.4, Opus 4.6 und Gemini 3.1 Pro – das erste offene Problem des Tests gelöst haben, das sich mit Ramsey-Hypergraphen befasst. Opus 4.6 lieferte außerdem eine Teillösung für ein mathematisches Problem, an dem Donald Knuth arbeitete. Diese Ergebnisse veranschaulichen Fortschritte, doch andere Bewertungen erinnern daran, dass die angekündigten Leistungen nicht alles aussagen.
Der Test BrokenArXiv misst insbesondere, ob ein Modell Theoreme erkennen kann, die absichtlich so verändert wurden, dass sie falsch sind. GPT 5.4 erzielt dabei mit einer Erfolgsquote von unter 40 % das beste Ergebnis. METR wiederum schätzt, dass die Hälfte der von der automatischen Bewertung von SWE-bench als korrekt eingestuften Lösungen nach einer menschlichen Prüfung abgelehnt werden müsste. Der Pressespiegel stellt allerdings klar, dass diese manuelle Überprüfung strengere Kriterien anwendet.
Cybersicherheit, Recht und sensible Einsatzbereiche
Mehrere Ankündigungen betreffen die IT-Sicherheit. Anthropic gibt an, dass Opus 4.6 in Firefox 22 Sicherheitslücken entdeckt habe. OpenAI stellte Codex Security vor, während Shannon, ein autonomer Agent für Penetrationstests, veröffentlicht wurde. Parallel dazu zielt ein Werkzeug namens Obliteratus darauf ab, Schutzmechanismen von Modellen zu entfernen, deren Gewichte zugänglich sind. Der Pressespiegel verweist zudem auf Arbeiten zu möglichen offensiven Verhaltensweisen von Programmieragenten und berichtet, dass ein beliebtes OpenClaw-Modul Schadsoftware war.
Auch der Einsatz im juristischen Bereich gibt Anlass zur Sorge. Ein manueller Test juristischer Fähigkeiten platziert die Modelle von Anthropic laut dem Pressespiegel hinter Grok und einigen chinesischen Modellen mit offen zugänglichen Gewichten. In einem gesonderten, von Reuters gemeldeten Fall wurde OpenAI verklagt, nachdem ein von ChatGPT beratener Nutzer angeblich Klagen eingereicht hatte, die auf nicht existierenden Entscheidungen und Vorschriften beruhten und Gerichtskosten verursachten. Es handelt sich um ein Gerichtsverfahren und nicht um eine abschließende Feststellung zur Haftung des Unternehmens.
Schließlich greift der Pressespiegel Artikel auf, denen zufolge Claude im Konflikt gegen den Iran eingesetzt worden sein soll, insbesondere zur Identifizierung und Priorisierung von Bombardierungszielen. Über diesen Einsatz berichten Medien; er wird im Text nicht als offiziell bestätigt dargestellt. Insgesamt reichen die im März erfassten Themen von den Risiken der Deanonymisierung im Internet über Fehler bei der Gesichtserkennung und die Auswirkungen von Rechenzentren bis hin zu Debatten über den Stellenwert generativer Werkzeuge in der Arbeitswelt und bei freier Software.
Quelle: LinuxFr.org: die mit „nouvelles_sur_l_ia“ gekennzeichneten Inhalte (linuxfr.org)
Originalartikel: Originalquelle aufrufen
Autor: Moonz
