Agentic Windows Desktop: Microsoft gibt MXC frei
Auf dem Event vom 7. Oktober 2026 erhalten KI-Agenten eigene Sandbox-Konten, und quantisierte Modelle laufen mit 20 bis 60 GByte RAM lokal.
Kurz gesagt
Microsoft hat am 7. Oktober 2026 die Microsoft Execution Containers für Windows 11 allgemein verfügbar gemacht, sodass KI-Agenten in einer Sandbox mit eigenem Benutzerkonto laufen, und zeigte dazu quantisierte Modelle, die lokal mit 20 bis 60 GByte RAM auf Notebooks arbeiten.
Auf einen Blick
- MXC (Microsoft Execution Containers) sind aus der Vorschau in die allgemeine Verfügbarkeit unter Windows 11 gewechselt.
- KI-Agenten laufen als eigene Benutzer mit getrennten Zugriffsrechten; die Anbindung an Microsoft Entra ist angekündigt, nicht fertig.
- MAI Code 1.1 Flash: 3-Bit-Quantisierung, rund 80 Prozent kleiner, 53 GByte, Kontext bis 256.000 Token.
- Nvidia Nemotron läuft 2-Bit-quantisiert mit 20 GByte RAM, DeepSeek V4 Flash mit 1,6-Bit und 60 GByte RAM.
- Geräte für hybride Intelligenz kommen von Asus, Dell, HP, Lenovo und MSI; Preise nennt die Quelle nicht.
Microsoft hat am 7. Oktober 2026 auf der Veranstaltung „Windows and Surface October 2026 News" die Microsoft Execution Containers (MXC) aus der Vorschau in die allgemeine Verfügbarkeit unter Windows 11 gehoben. KI-Agenten laufen damit in einer Sandbox und als eigener Benutzer mit getrennten Rechten. Satya Nadella und Windows-Chef Pavan Davuluri zeigten dazu quantisierte Modelle, die lokal mit 20 bis 60 GByte RAM arbeiten.
Agenten bekommen eigene Konten statt geliehener Rechte
Der sicherheitsrelevante Teil der Ankündigung klingt unspektakulär und ist der wichtigste: Ein Agent erbt nicht mehr die Rechte der Person, die ihn startet, sondern erhält ein eigenes Benutzerkonto mit eigenen Zugriffsgrenzen. Die Anbindung an Microsoft Entra, über die Unternehmen solche Agentenkonten zentral verwalten könnten, ist laut Bericht für „in Kürze" angekündigt und damit noch nicht verfügbar. Für den organisationsweiten Blick auf Agentenaktionen nennt Microsoft Agent 365.
Hybride Intelligenz: über eine Million Token lokal
„Hybride Intelligenz" nennt Microsoft die Arbeitsteilung zwischen Modellen auf dem Gerät und Modellen in der Cloud, und das Argument dafür ist die Rechnung. In einer Entwicklerdemo fielen deutlich über eine Million Token auf dem lokalen Rechner an, während extern nur einige Tausend Token eingekauft wurden. Die Windows-ML-Runtime verteilt die Last über GPU, NPU und CPU und unterstützt jetzt llama.cpp, womit Entwickler mehr offene Modelle einbinden können.
Drei quantisierte Modelle und ihr Speicherbedarf
Die drei genannten Beispiele zeigen, wie stark Microsoft die Modelle eindampft. MAI Code 1.1 Flash kommt mit 3-Bit-Quantisierung auf 53 GByte, rund 80 Prozent weniger als zuvor, und verarbeitet bis zu 256.000 Token Kontext. Nvidia Nemotron läuft 2-Bit-quantisiert bereits mit 20 GByte RAM, DeepSeek V4 Flash mit 1,6-Bit-Quantisierung und 60 GByte RAM.
Praktisch heißt das: Wer Agenten dauerhaft lokal laufen lassen will, braucht ein Notebook mit reichlich Arbeitsspeicher, nicht nur eine schnelle NPU. Geräte für hybride Intelligenz kommen laut Microsoft von Asus, Dell, HP, Lenovo und MSI.
Copilot Home, Copilot Code und Autopilot
Die drei Ende September angekündigten Copilot-Funktionen haben auf dieser Bühne ihren Platz im System erhalten. Copilot Home greift auf den lokalen Kontext des PCs zu, etwa zum Sortieren von Dateien, Copilot Code baut mit hybrider Intelligenz native Windows-Anwendungen, und Autopilot übernimmt mehrstufige Aufgaben – im Beispiel das Zusammenstellen von Unterlagen für den Steuerberater. Als Zeitraum für Copilot+-PCs nennt Microsoft die kommenden Monate.
Was diese Quelle offen lässt
Zur Hardware bleibt der Bericht knapp: Microsoft zeigte Notebooks, Rechner und Server, die seit einiger Zeit bekannt sind, und erste Geräte lassen sich nun tatsächlich kaufen. Preise, Prozessoren, NPU-Leistung und Liefertermine stehen nicht in dieser Quelle, deshalb stehen sie auch nicht in diesem Text. Der englischsprachige Bericht von Ars Technica zum selben Event war bei der Erstellung nicht abrufbar, sodass alle Angaben hier auf heise online beruhen und nicht gegengeprüft sind.
Häufige Fragen
Was ist der Agentic Windows Desktop?
Microsofts Bezeichnung für ein Windows 11, in dem KI-Agenten als eigene Benutzer in einer Sandbox arbeiten, lokale und Cloud-Modelle kombinieren und über Agent 365 verwaltet werden.
Was sind Microsoft Execution Containers?
MXC sind die abgeschottete Laufzeitumgebung für KI-Agenten unter Windows 11. Sie sind seit dem 7. Oktober 2026 allgemein verfügbar; jeder Agent erhält ein eigenes Konto mit begrenzten Zugriffsrechten.
Wie viel RAM brauchen lokale KI-Modelle unter Windows 11?
Nach den gezeigten Beispielen 20 GByte für Nvidia Nemotron (2 Bit), 53 GByte für MAI Code 1.1 Flash (3 Bit) und 60 GByte für DeepSeek V4 Flash (1,6 Bit).