Ayman Nadeem hat mit Nuanced eine ganze Coding-App rund um den Plan-Modus gebaut und hält das Konzept inzwischen für überholt. Frühe Nutzer lasen die langen, von KI geschriebenen Spezifikationen der App kaum. Teams mit Claude Code oder Codex brauchen deshalb einen anderen Weg zum Überblick über ihren Code.
drweb.de als bevorzugte Quelle auf Google hinzufügenQualitätsgeprüfte Inhalte direkt in Google News & DiscoverJetzt hinzufügenDer Plan-Modus sollte KI-Coding-Agenten zähmen: erst planen, dann freigeben, dann bauen. Ayman Nadeem, früher Senior Software Engineer bei GitHub, hat genau darauf das Start-up Nuanced gegründet und erklärt den Plan-Modus in einem Essay vom 24. September nun für tot.[1] Die Begründung betrifft jedes Team, das mehrere Agenten parallel an einer Codebasis arbeiten lässt.
Das Wichtigste in Kürze
- Nuanced übersetzte Anforderungen in lange Spezifikationen, doch frühe Nutzer zeigten daran wenig Interesse.
- Laut Nadeem treffen bessere Modelle viele Entscheidungen selbst, die ein Plan früher festlegen musste.
- Ungelöst bleibt, wie Menschen den Überblick behalten, sobald Hunderte Agenten gleichzeitig Code ändern.
Warum scheiterte Nuanced mit dem Plan als Dokument?

Nuanced verwechselte laut Nadeem das Planen mit dem Plan. Die App erzeugte lange, von KI geschriebene Spezifikationen, die kaum jemand las, und trennte Planung und Umsetzung so strikt, dass die Rückkehr zur Planung wie ein Rückschritt wirkte.[1]
Die macOS-App fragt zu Beginn nach Zielen, Randbedingungen und Ausschlüssen und schreibt jede Antwort in eine lebende Spezifikation. Daraus leitet Nuanced Aufgaben ab, die Codex von OpenAI abarbeitet.[2] Das Problem lag im Umfang: Die Dokumente enthielten mehr Information, schufen aber keine Klarheit.[1]
Eine zusätzliche Spec Tour sollte Nutzer durch die wichtigsten Stellen führen. Nadeem wertet sie heute als weitere Textschicht: Braucht ein Dokument eine Kurzfassung, verliert die Langfassung ihren Zweck.[1]
Dazu kam ein starrer Ablauf in acht Schritten vom Chat bis zum Code-Review. Echtes Denken verläuft anders, weil jeder Versuch neue Fragen aufwirft.[1]
Was ersetzt den klassischen Plan-Modus?
Nadeem beschreibt eine Schleife aus Verstehen, Handeln, Prüfen, Klären und Nachsteuern. Geplant wird weiterhin, allerdings bei Bedarf im Chat und nicht als eigenes Dokument vor der ersten Codezeile.[1]
Die großen Werkzeuge setzen den Plan-Modus bisher als Schreibsperre um. Claude Code liest im Plan-Modus Dateien und schlägt einen Plan vor, ändert aber nichts vor der Freigabe.[3] Die Vorlage für den Plan-Modus von Codex verlangt einen „entscheidungsvollständigen“ Plan, der bei der Umsetzung keine offene Frage mehr lässt.[4]
Genau diese Vollständigkeit verliert laut Nadeem an Wert, weil die Modelle Codebasen inzwischen selbst erkunden und brauchbare Annahmen treffen. Bei getrennten Modi müssen Nutzer zudem vor jeder Aufgabe abwägen, ob sich ein Plan überhaupt lohnt.[1]
Der Befund läuft einem kräftigen Branchentrend zuwider. Mit GitHubs quelloffenem Spec Kit zerlegen Teams Anforderungen über Befehle wie /speckit-specify und /speckit-plan in Pläne und Aufgaben. Das Projekt kommt auf GitHub auf rund 139.000 Sterne.[5] In Kiro, der Entwicklungsumgebung von Amazon Web Services, entstehen zu jeder Spezifikation die Dateien requirements.md, design.md und tasks.md.[6]
So planen vier Werkzeuge vor dem ersten Code
Ein Plan, den niemand liest, dokumentiert gar nichts. Festhalten sollten Teams, warum eine Entscheidung fiel, und nicht jeden Schritt, den der Agent ohnehin selbst findet.
— Michael Dobler, Herausgeber Dr. Web
Wie behalten Teams den Überblick über KI-generierten Code?
Kurze Entscheidungsnotizen ersetzen lange Spezifikationen. Reviews prüfen gezielt die Stellen, an denen der Agent Annahmen getroffen hat. Eine fertige Lösung für das Verständnisproblem gibt es laut Nadeem noch nicht.[1]
Wie groß die Wahrnehmungslücke ausfallen kann, zeigt eine randomisierte Studie von METR aus dem Juli 2025: 16 erfahrene Open-Source-Entwickler arbeiteten mit KI-Werkzeugen 19 % langsamer, hielten sich danach aber für 20 % schneller.[7] Mit jedem zusätzlichen Agenten wächst der Anteil an Code, den im Team niemand ganz versteht. Die Folgen beschreiben die Beiträge über KI-Code mit teurem Unterhalt und über das Code-Review am Limit.
In Deutschland setzen laut Bitkom inzwischen 57 % der Unternehmen ab 20 Beschäftigten KI ein.[8] Für Teams, die Claude Code oder Codex produktiv nutzen, lohnen sich vier Schritte:
- Den Plan-Modus für Architektur, Datenmodelle und Schnittstellen reservieren und kleine Änderungen direkt im Chat klären.
- Entscheidungen in wenigen Sätzen im Repository festhalten, etwa in CLAUDE.md oder AGENTS.md, und veraltete Einträge regelmäßig ausmisten.
- Im Review nach den Annahmen des Agenten fragen: Welche Abstraktion hat das Modell gewählt, und welche Anforderung hat niemand vorgegeben?
- Die Zahl paralleler Agenten an der Prüfkapazität ausrichten, damit die Testpipeline nicht zum Flaschenhals wird.
Weitere Modelle und Agenten ordnet die KI-Rubrik von Dr. Web ein.
Quellen
[1] Ayman Nadeem: „Plan mode is dead“
[2] Nuanced: „The AI coding app for thinking“
[3] Anthropic, Claude-Code-Dokumentation: „Common workflows: Plan before editing“
[4] OpenAI Codex auf GitHub: Vorlage für den Plan-Modus (plan.md)
[5] GitHub: „Spec Kit“
[6] Kiro-Dokumentation: „Specs“
[7] METR: „Measuring the Impact of Early-2025 AI on Experienced Open-Source Developer Productivity“
[8] Bitkom: „Erstmals nutzt die Mehrheit der Unternehmen KI“
Mehr Newshunger?
- Konfigurationsdateien für KI-Agenten haben ein Verfallsdatum
- KI-Coding macht CI zum Flaschenhals: Linears Antwort auf die Testflut
- Code-Review am Limit: Wenn KI mehr Code liefert, als Menschen prüfen können
- Critical Design Engineering: Ein Manifest für den Umgang mit KI-Code
- KI macht das Bauen billig, das Besitzen teuer
- Schreibt KI guten Code? Bisher kaum.