KI-Sicherheit

Nadella: Jedes KI-Modell gilt als kompromittiert

Microsoft CEO Satya Nadella. © World Economic Forum
Microsoft CEO Satya Nadella. © World Economic Forum

Trending Topics auf Google als bevorzugte Nachrichtenquelle festlegen.

Vertrauen ist gut, Misstrauen ist besser: Microsoft-CEO Satya Nadella fordert, dass Unternehmen jedes leistungsstarke KI-Modell so behandeln, als wäre es bereits kompromittiert. „Wir müssen davon ausgehen, dass ein Modell kompromittiert ist, und es von Anfang an eindämmen“, schreibt Nadella in einem ausführlichen Beitrag auf X. Dazu gehöre eine Notbremse, mit der eine autorisierte Person ein Modell jederzeit mitten in einer Aufgabe pausieren oder abschalten kann.

KI-Modelle als Insider-Risiko

Nadella vergleicht KI-Modelle mit Mitarbeiter:innen oder Auftragnehmer:innen, die Zugang zu kritischen Systemen haben. Böswilligkeit unterstellt er den Modellen dabei ausdrücklich nicht: Jeder fähige Akteur mit solchen Zugriffsrechten könne Fehler machen oder kompromittiert werden. Bei KI kommt ein grundsätzliches Problem hinzu: Anders als bei klassischer Software lässt sich das Verhalten eines Modells nicht auf bestimmte Trainingsdaten oder Gewichte zurückführen. Superintelligenz dürfe deshalb nicht als „Reihe verschachtelter Black Boxes“ behandelt werden, deren Empfehlungen und Handlungen man einfach annimmt oder ablehnt.

Sein Kernprinzip: Die Bereitstellung von Intelligenz müsse von der Befugnis darüber getrennt werden. Kontrollen darüber, was ein Modell sehen und tun darf, sollen außerhalb des Modells liegen, getrennt von der Software, die seine Arbeit steuert. Jede relevante Aktion eines Modells soll in manipulationssicheren, für Menschen lesbaren Protokollen festgehalten werden. Kein einzelnes Modell soll zugleich ein System steuern und die Belege kontrollieren, mit denen es bewertet wird, und kein Modell soll seine eigene Arbeit prüfen. Ausfälle sollen Unternehmen zudem rasch offenlegen und mit der Branche teilen.

Verantwortung bleibt bei den Anwender:innen

Bemerkenswert ist, wen Nadella in die Pflicht nimmt. Die Zusicherungen eines Modellanbieters entbinden Unternehmen laut Nadella nicht von ihrer Verantwortung für das, was KI in ihrem Auftrag tut. Je fähiger die Modelle werden, desto bessere Eindämmungstechnik brauche es, und dafür solle sich die Branche auf gemeinsame Standards einigen. Sein Fazit: Das vertrauenswürdigste System sei jenes, das es erlaubt, dem Modell am wenigsten zu vertrauen.

Nadellas Vorstoß folgt auf eine Reihe von Vorfällen. Erst kürzlich hat Anthropic offengelegt, dass seine KI-Agenten bei internen Tests eigenmächtig Behörden-Websites bedient und etwa einen falschen Hinweis auf einen ungeklärten Mordfall an die Polizei von Philadelphia geschickt haben. Zuvor hatte ein KI-Agent von OpenAI in Australien unbefugt auf das Medicare-Portal zugegriffen. Box-CEO Aaron Levie sprach angesichts solcher Fälle bereits von einer Zero-Trust-Ära für KI.

Alignment und Selbstverpflichtung als Gegenmodell

Nadellas Ansatz unterscheidet sich deutlich von dem der großen KI-Labore. Anthropic und OpenAI investieren massiv in Alignment-Forschung, also in den Versuch, Modelle selbst so zu trainieren, dass sie sich verlässlich an menschliche Vorgaben halten. Nadella klammert dieses „harte Problem des Alignments“ bewusst aus und setzt auf deterministische Systemarchitektur, menschliche Kontrolle und Betriebsabläufe rund um das Modell. Auch politisch gibt es Gegenwind für verbindliche Regeln: Die US-Regierung von Donald Trump setzt bei KI auf freiwillige Selbstkontrolle der Branche statt auf Gesetze.

Microsoft selbst ist in der Debatte nicht neutral. Der Konzern ist an OpenAI und Anthropic beteiligt, verkauft mit Copilot eigene KI-Agenten an Unternehmen und bietet auf seiner Cloud Azure Modelle zahlreicher Anbieter an. Nadellas Forderung, kein Unternehmen solle sich für wichtige Aufgaben von einem einzigen Modell abhängig machen, passt zu diesem Geschäftsmodell.

Rank My Startup: Erobere die Liga der Top Founder!
Werbung
Werbung

Specials unserer Partner

Die besten Artikel in unserem Netzwerk

Deep Dives

Wasner + Steinschaden | Der KI Podcast

News, Modelle, Strategien
#glaubandich CHALLENGE: SVAN triumphiert in Klagenfurt

#glaubandich CHALLENGE 2027

Österreichs größter Startup-Wettbewerb - Top-Investoren mit an Bord
© Wiener Börse

IPO Spotlight

powered by Wiener Börse

RankMyStartup.com

Steig' in die Liga der Top Founder auf!

2 Minuten 2 Millionen | Staffel 13

Alle Startups | Alle Deals | Alle Hintergründe

Future{hacks}

Zwischen Hype und Realität

Trending Topics Tech Talk

Der Podcast mit smarten Köpfen für smarte Köpfe

Weiterlesen

Newsletter

Founders Dispatch

Zwei Mal pro Woche kostenlos in die Inbox: die wichtigsten Startups, Deals und Tech-Entwicklungen aus Europa, handgeschrieben von der Redaktion.

Jederzeit abbestellbar. Mehr über den Newsletter