Windows bekommt Open-Weight-KI wie Chinas DeepSeek und Nvidias Nemotron
Trending Topics auf Google als bevorzugte Nachrichtenquelle festlegen.
Neuer Anlauf nach dem KI-Kater: Nachdem Microsoft mit Recall, Copilot-Knöpfen in jeder App und der Marke „Copilot+ PC“ bei vielen Nutzer:innen abgeblitzt ist, erklärt der Konzern Windows nun zur Plattform für „hybride Intelligenz“. KI-Agenten sollen je nach Aufgabe lokal am PC oder in der Cloud laufen, abgesichert durch eingebaute Sicherheitsfunktionen. Dazu kommt mit dem Surface Laptop Ultra ein Notebook mit Nvidias neuem Chip RTX Spark, das ab sofort vorbestellt werden kann.
Agenten in der Sandbox
Kern der Ankündigung ist die Idee, dass Windows die sicherste Umgebung für KI-Agenten sein soll. Agenten laufen rund um die Uhr, nutzen Werkzeuge, schreiben Code und greifen auf Dateien zu, oft ohne dass jemand jeden Schritt überwacht, argumentiert Windows-Chef Pavan Davuluri in der Ankündigung von Microsoft. Dafür sind die Microsoft Execution Containers (MXC) auf Windows 11 ab sofort allgemein verfügbar. Das sind ins Betriebssystem integrierte Sandboxes, mit denen Unternehmen festlegen, auf welche Dateien und Netzwerke ein Agent zugreifen darf. Jeder Agent muss sich ausweisen, damit IT-Abteilungen seine Aktionen von jenen der Nutzer:innen unterscheiden können. Über Intune und Agent 365 lassen sich Regeln für die ganze Firma ausrollen, wobei Microsoft im Kleingedruckten einräumt, dass die Verwaltung im großen Stil zusätzliche Dienste erfordern kann.
Unterstützt wird MXC bereits von Codex von OpenAI, GitHub Copilot, OpenClaw, Replit, LM Studio, OpenShell von Nvidia und Unsloth. Folgen sollen unter anderem Claude Code von Anthropic, Perplexity, Manus, Box und Raycast. Auch Metas Agent Muse kommt als eigene Windows-App mit MXC-Anbindung. Für Mini-PCs, die viele inzwischen als dauerhaft laufende Agenten-Rechner nutzen, verspricht Microsoft eine Einrichtung mit wenigen Klicks statt mühsamer Konfiguration im Terminal, zum Start für OpenClaw.
Große Modelle direkt am Laptop
Die „hybride Intelligenz“ soll Rechenarbeit dorthin verteilen, wo sie am sinnvollsten ist, und so Token und damit Cloud-Kosten sparen. Dafür bringt Microsoft große Modelle stark komprimiert auf den PC:
- MAI Code 1.1 Flash: Das hauseigene Coding-Modell mit 137 Milliarden Parametern (davon 6,8 Milliarden aktiv) läuft in 3-Bit-Präzision lokal, ist damit fast 80 Prozent kleiner und unterstützt ein Kontextfenster von 256.000 Token.
- Nemotron von Nvidia: Ein kommendes Modell mit mehr als 70 Milliarden Parametern soll in 2-Bit-Präzision mit gut 20 GB Arbeitsspeicher auskommen.
- DeepSeek V4 Flash: Auch das chinesische Modell mit 284 Milliarden Parametern soll lokal auf RTX-Spark-Geräten laufen.
Dazu kommt HydraFusion von GitHub, das jede Aufgabe automatisch an das passende Modell weiterleitet und künftig auch lokale Modelle einbezieht. Verfügbar ist das allerdings vorerst nur als experimentelle Vorschau in der GitHub-Copilot-App, im GitHub Copilot CLI und in Visual Studio Code, und zwar noch im Laufe des Oktobers. Entwickler:innen können zudem über llama.cpp in Windows ML leichter Open-Source-Modelle einbinden.
Auffällig ist, welches Modell in der Aufzählung fehlt: GPT von OpenAI. Damit schreitet Microsofts Loslösung vom langjährigen Partner weiter voran. Seit der Neuordnung der Partnerschaft mit OpenAI baut Microsoft mit der MAI-Reihe eigene Modelle, setzt in Microsoft 365 Copilot auch auf Modelle von Anthropic und holt nun mit DeepSeek und Nemotron weitere Alternativen auf den PC. Für Windows heißt das: Welches Modell eine Aufgabe erledigt, entscheidet künftig das Routing, und OpenAI ist nur noch einer von vielen Anbietern.
Copilot greift auf lokale Dateien zu
Copilot selbst bekommt mehr Befugnisse, und zwar in allen drei Bereichen Home, Code und Autopilot. Mit Erlaubnis der Nutzer:innen soll der Assistent auf lokale Dateien und die jüngsten Aktivitäten zugreifen, Aufgaben in Windows erledigen, etwa Dateien ordnen oder Probleme beheben, und dafür auch Modelle am Gerät nutzen. In einer Demo suchte Copilot laut Tom’s Hardware Steuerunterlagen zusammen, benannte sie um, packte sie in ein ZIP-Archiv und entwarf eine E-Mail an die Steuerberatung, die vor dem Versand bestätigt werden muss.
Die Einschränkungen: Die Funktionen kommen nur auf Copilot+ PCs und sollen erst in den kommenden Monaten ausgerollt werden. Wann welche Funktion in welchem Land auf welchem Gerät landet, lässt Microsoft offen. Neu ist auch die Windows-Suche in der Taskleiste: Befehle wie „Dunkelmodus einschalten“, „Bildschirm dimmen“ oder „alle Fenster minimieren“ werden direkt ausgeführt. Die Aktionen starten ab sofort für Windows Insider im experimentellen Kanal, eine optionale Copilot-Anbindung der Suche folgt später im Jahr zunächst in ausgewählten Märkten.
Surface Laptop Ultra und neue Geräte
Auf der Hardware-Seite setzt Microsoft auf Nvidia. Der Surface Laptop Ultra mit dem Chip RTX Spark, laut Microsoft das leistungsstärkste Surface bisher, bietet bis zu 128 GB gemeinsamen Arbeitsspeicher, einen 15-Zoll-Touchscreen und soll KI-Modelle mit mehr als 120 Milliarden Parametern lokal ausführen können. Die wichtigsten Eckdaten im Überblick:
- Surface Laptop Ultra: ab 2.599 US-Dollar (rund 2.310 Euro) laut Tom’s Hardware, Auslieferung ab Freitag nächster Woche.
- Surface RTX Spark Dev Box: ab 5.999 US-Dollar (rund 5.330 Euro), Auslieferung im November und vorerst nur in den USA.
- Geräte von Partnern: Asus ProArt P16 und P14, Dell XPS 16 Creator Edition, HP OmniBook Ultra 16, Lenovo Yoga 9n und MSI Prestige N16 Flip AI+ sind ebenfalls vorbestellbar und werden ebenfalls ab Freitag nächster Woche ausgeliefert. Mini-PCs und weitere Dev Boxes mit RTX Spark folgen später im Jahr.
- DGX Station für Windows: Nvidias Desktop-Supercomputer mit dem Chip GB300, bis zu 748 GB Speicher und 20 Petaflops KI-Rechenleistung soll noch heuer auch mit Windows kommen, etwa von Dell und HP. Darauf sollen Modelle mit bis zu einer Billion Parametern laufen und mehr als 32 Agenten parallel ein ganzes Team bedienen. Preise nennt Microsoft dafür nicht.
Gegenüber einem MacBook Pro 16 mit M5 Pro verspricht Microsoft bei RTX-Spark-Geräten bis zu 2,1-mal schnellere erste Antworten von Sprachmodellen, 4,3-mal schnellere Bildgenerierung und 6,2-mal schnellere Videogenerierung. Die Werte stammen allerdings aus Tests, die Microsoft und Nvidia selbst in Auftrag gegeben bzw. durchgeführt haben, und zwar mit Vorserien-Geräten. Für Gamer:innen kündigte Microsoft an, dass Call of Duty 2027 auf RTX Spark kommt. „Wir haben den Personal Computer komplett neu erfunden“, sagte Nvidia-Chef Jensen Huang bei der Präsentation.
Die Rückschläge der vergangenen Jahre
Der große Auftritt soll auch vergessen machen, wie holprig Microsofts bisherige KI-Offensive auf dem PC verlaufen ist. Die Erinnerungsfunktion Recall musste nach heftiger Kritik an Datenschutz und Sicherheit um ein Jahr verschoben werden und gilt intern laut Windows Central in ihrer bisherigen Form als gescheitert. Als Davuluri vergangenen Herbst ankündigte, Windows werde zum „agentischen Betriebssystem“, hagelte es Tausende überwiegend negative Reaktionen. Im Laufe des Jahres kündigte Microsoft dann an, Copilot-Funktionen in Apps wie Notepad und Paint zurückzufahren. Und erst kürzlich ließen Microsoft und Qualcomm die Marke „Copilot+ PC“ auf neuen Geräten stillschweigend fallen, weil kaum jemand einen „KI-PC“ haben wollte.
In der Ankündigung verteidigt Microsoft die Gerätekategorie dennoch: Auf allen Copilot+ PCs würden pro Monat mehr als zwei Billionen KI-Berechnungen lokal ausgeführt, und mehr als 40 Prozent der Business-Laptops seien heute Copilot+ PCs. Die neue Strategie wirkt trotzdem wie eine Lehre aus den Pannen: weniger KI-Knöpfe im Alltag, mehr Kontrolle und Sicherheit für Unternehmen und Agenten, die erst nach Bestätigung handeln. Ob das die Skepsis auflöst, hängt davon ab, ob Nutzer:innen den Agenten Zugriff auf ihre Dateien geben wollen.
Apple und Google ziehen nach
Microsoft ist mit der Idee nicht allein. Apple setzt mit Apple Intelligence ebenfalls auf eine Mischung aus Modellen am Gerät und einer eigenen Cloud. Seit einem mehrjährigen Deal mit Google zu Jahresbeginn greift Apple dafür allerdings auf lizenzierte Gemini-Modelle zurück und darf diese zu kleineren Destillaten eindampfen, die direkt auf Mac und iPhone laufen. Die MacBooks mit M5-Chips gelten als starke Plattform für lokale KI, weshalb Microsoft seine Benchmarks auch genau gegen das MacBook Pro richtet. Google wiederum baut Gemini tief in Chrome, Android und ChromeOS ein und arbeitet ebenfalls an Agenten, die im Browser Aufgaben erledigen.

