Keine große KI-Firma hat ihre eigene KI wirklich unter Kontrolle

4 days ago 10

Kein KI-Anbieter setzt grundlegende Kontrollmechanismen für seine eigenen internen KI-Systeme vollständig um, so zumindest das Fazit der ersten Bewertung der Non-Profit-Organisation Guidelight. Geprüft wurden Anthropic, OpenAI, Google, xAI und Meta, allein auf Basis öffentlicher Angaben wie System Cards, Sicherheitsberichten und Blogposts.

Guidelight sah sich sechs Basispraktiken an, etwa das Protokollieren interner KI-Aktivität, das Freigeben riskanter Aktionen durch einen Prüfmechanismus, Notabschaltungen ("Circuit Breaking") und Pläne zum Eindämmen fehlgeleiteter Modelle. Anthropic und OpenAI führen mit der Note C+, Google folgt mit D+ und einer detaillierten Roadmap, xAI (D−) und Meta (F) schneiden am schwächsten ab.

 GuidelightKein Unternehmen erreicht die vorgeschlagenen Sicherheit-Standards von Guidelight. | Bild: Guidelight

Am besten läuft das Erkennen von Fehlverhalten, am schlechtesten Vorbeugung und Eindämmung. Guidelight ist eine unabhängige Non-Profit-Organisation, gegründet von den früheren OpenAI-Sicherheitsverantwortlichen Page Hedley und Steven Adler.

KI-News ohne Hype – von Menschen kuratiert

Mit dem THE‑DECODER‑Abo liest du werbefrei und wirst Teil unserer Community: Diskutiere im Kommentarsystem, erhalte unseren wöchentlichen KI‑Newsletter, 6× im Jahr den "KI Radar"‑Frontier‑Newsletter mit den neuesten Entwicklungen aus der Spitze der KI‑Forschung, bis zu 25 % Rabatt auf KI Pro‑Events und Zugriff auf das komplette Archiv der letzten zehn Jahre.

Jetzt abonnieren

Read Entire Article