KI Refactoring sollte Code schöner machen, ohne dass sich etwas ändert. Bei mir lief es anders: Claude Code hat beim Refactoring einfach meine Applikation zerstört. Genau davon handelt das Video. Und genau deshalb erzähle ich hier, warum das passiert und wie ihr euch davor schützt.
Refactoring mit Sicherheitsnetz
- Erst Quality Gates, dann aufräumen
- Statische Analyse, Unit Tests und Cypress E2E in der Pipeline
- KI als Werkzeug im Review, nicht als autonomer Umbauer
- Über 20 Jahre Erfahrung mit Testing und Legacy Code
- Kostenloses Kennenlernen, danach transparente Minuten Abrechnung
Refactoring heißt: Verhalten bleibt gleich
Die Definition ist alt und klar. Martin Fowler beschreibt Refactoring als Umbau der inneren Struktur, ohne das äußere Verhalten zu ändern. Wer refactored, darf also nichts kaputt machen. Das ist die ganze Idee.
Ein KI Agent sieht das anders. Er will den Code besser machen. Und besser heißt für ihn oft: kürzer, einfacher, eleganter. Dabei fallen Sonderfälle weg, die jemand vor Jahren aus gutem Grund eingebaut hat.
Warum KI Agenten beim Refactoring Verhalten ändern
Das Problem ist bekannt. In einem GitHub Issue zu Claude Code beschreiben Entwickler genau das: Beim Verschieben von Funktionen hat der Agent komplexe Logik durch eine vereinfachte Version ersetzt, obwohl das Verhalten erhalten bleiben sollte.
Die typischen Muster:
- Sonderfälle verschwinden: Ein Fallback wirkt überflüssig und fliegt raus
- Umbenennungen ohne Ende: Ein Name ändert sich, drei Aufrufer nicht
- Zu großer Diff: Hunderte Zeilen auf einmal, die niemand wirklich prüft
- Grüne Tests, falsche Tests: Der Agent passt Tests an den neuen Code an statt umgekehrt
Das Tückische: Der Code sieht danach besser aus. Er läuft nur nicht mehr so wie vorher.
Die richtige Reihenfolge: erst absichern, dann aufräumen
Bei NCA gilt eine feste Reihenfolge. Sie ist nicht neu, aber mit KI wichtiger denn je.
| Schritt | Was passiert | Warum |
|---|---|---|
| 1. Statische Analyse | PHPStan, Psalm oder Ruff und mypy laufen in der Pipeline | Fehler im Typsystem fallen sofort auf |
| 2. Unit Tests | Kritische Logik wird festgenagelt | Sonderfälle bekommen einen Wächter |
| 3. Funktionale Tests | Das Verhalten wird von außen geprüft | Auch Code ohne Tests wird absicherbar |
| 4. Cypress E2E | Die wichtigsten Wege durch die App laufen automatisch | Was der Nutzer sieht, bleibt gleich |
| 5. Aufräumen | Kleine Schritte, KI assistiert, Mensch entscheidet | Jeder Schritt ist prüfbar |
Für Code ohne Tests ist das Characterisation Testing mit Golden Master Tests der schnellste Einstieg. Was bei jedem Push passiert, zeigt der Beitrag zu Quality Gates in der Pipeline. Für E2E Tests setzen wir auf Cypress.
KI als Werkzeug, nicht als Umbauer
Das Refactoring selbst läuft bei uns stark manuell, mit KI als Assistenz. Der Agent schlägt vor, erklärt, findet Stellen. Er räumt aber nicht allein eine ganze Codebasis um. Das ist kein Misstrauen gegen die Technik, sondern Respekt vor dem Code, der Geld verdient.
- Kleine Schritte mit klarem Ziel statt ein großer Umbau
- Nach jedem Schritt laufen die Tests
- Jeder Commit ist einzeln rückgängig machbar
- Tests werden nie an den neuen Code angepasst, ohne dass ein Mensch zustimmt
Ein Plan vor dem ersten Edit hilft zusätzlich. Wie der Plan Modus dabei unterstützt, steht im Beitrag zum Claude Code Plan Mode. Wir selbst arbeiten heute mit OpenCode, das Prinzip ist aber bei jedem Agenten gleich.
Weiterlesen
- AI Code Refactoring: Legacy Code mit KI sicher modernisieren
- Der KI Refactoring Werkzeugkasten für JavaScript, PHP und Python
- PHP Refactoring ist mehr als Code aufräumen
- Codebase Audit für KI generierten Code
- AI Coding Refactoring: Disziplin im KI Workflow
Häufige Fragen zu KI Refactoring 2026
Kann KI Refactoring 2026 meine Applikation zerstören?
Ja. Agenten ändern beim Umbauen oft Verhalten, etwa indem sie Sonderfälle entfernen. Ohne Tests fällt das erst in Produktion auf. Mit Quality Gates in der Pipeline wird jeder Bruch sofort sichtbar.
Welche Tests brauche ich vor einem KI Refactoring 2026?
Mindestens statische Analyse und Tests für die kritischen Abläufe. Ideal sind Unit Tests, funktionale Tests und E2E Tests mit Cypress. Für alten Code ohne Tests helfen Golden Master Tests als schneller Einstieg.
Sollte ein Agent 2026 Legacy Code allein umbauen?
Nein. Das Refactoring läuft besser manuell mit KI Assistenz, in kleinen Schritten. Der Agent schlägt vor, der Mensch entscheidet. So bleibt jeder Schritt prüfbar und rückgängig machbar.
Was tun, wenn das Refactoring schon etwas kaputt gemacht hat?
Zurück auf den letzten funktionierenden Stand in der Versionskontrolle. Dann zuerst Tests für den betroffenen Bereich schreiben und das Refactoring in kleinen Schritten wiederholen.
Hilft der Plan Modus gegen kaputte Refactorings?
Er hilft, weil der Agent erst analysiert und einen Plan vorlegt, bevor er Dateien ändert. Er ersetzt aber keine Tests. Ein guter Plan ohne Sicherheitsnetz kann trotzdem Verhalten ändern.
Refactoring, das nichts kaputt macht
Wir setzen mit euch die Quality Gates auf, bevor aufgeräumt wird, und begleiten das Refactoring mit KI Assistenz Schritt für Schritt. Erstgespräch kostenlos, danach transparente Minuten Abrechnung.
