Werkzeuge & Agenten · KI für Developer mit Claude und Codex
Codex Tests erstellen: Änderungen gezielt absichern
Kurz gesagt
Lassen Sie Codex Tests nach dem gewünschten Verhalten schreiben, nicht nach dem vorhandenen Code: normale Fälle, Grenzwerte, Fehlerfälle. Prüfen Sie, ob jeder Test fehlschlägt, wenn Sie den Code absichtlich kaputtmachen. Tests, die immer bestehen oder nur die Implementierung spiegeln, schützen nichts.
Das Problem
Sie haben eine Änderung am Code vorgenommen oder von einem KI-Assistenten vornehmen lassen: eine neue Preisberechnung, eine geänderte Anmeldung. Ob sie richtig funktioniert und ob sie andere Teile kaputt macht, wissen Sie nicht sicher. Tests würden Gewissheit schaffen, aber sie zu schreiben ist mühsam, und oft fehlen sie ganz.
Codex kann Tests erzeugen, und das ist eine seiner nützlichen Aufgaben. Es gibt aber eine Falle: Wenn die KI Tests direkt aus dem vorhandenen Code ableitet, prüft sie, dass der Code tut, was er tut, nicht dass er tut, was er soll. Ist der Code falsch, ist der Test es auch, und beide bestehen. Solche Tests geben ein trügerisches Gefühl von Sicherheit.
Gute Tests beschreiben das gewünschte Verhalten, unabhängig von der Umsetzung. Mit einem klaren Auftrag und einer einfachen Gegenprobe lässt sich die Qualität prüfen. Stand: Oktober 2026; Funktionen von Codex ändern sich.
So lösen Sie es mit KI – Schritt für Schritt
- Verhalten in Worten beschreiben. Was soll die Änderung bewirken? Schreiben Sie es als Regeln auf: «Ab 100 Franken Bestellwert ist der Versand gratis.»
- Fälle sammeln. Normale Fälle, Grenzwerte (99.95, 100.00, 100.05), leere oder falsche Eingaben, Sonderfälle. Fragen Sie Codex nach weiteren Fällen, die Sie vergessen haben könnten.
- Vorhandene Tests ansehen. Wie sind sie aufgebaut, wie führt man sie aus? Neue Tests sollen dem Stil folgen.
- Tests nach Verhalten schreiben lassen. Geben Sie die Regeln und Fälle vor, nicht nur den Code. Codex soll erwartete Ergebnisse aus Ihrer Beschreibung ableiten.
- Tests ausführen. Alle neuen Tests sollten bei richtigem Code bestehen. Prüfen Sie auch die bestehenden.
- Gegenprobe machen. Machen Sie den Code absichtlich falsch, zum Beispiel ändern Sie eine Grenze, und prüfen Sie, ob ein Test fehlschlägt. Wenn nicht, ist der Test wertlos.
- Tests lesen und aufräumen. Sind die Namen verständlich? Prüft jeder Test eine Sache? Gibt es Duplikate oder feste Werte ohne Erklärung?
- Dokumentieren. Halten Sie fest, was die Tests absichern und was nicht, und führen Sie sie künftig regelmässig aus.
Vorlage zum Kopieren
Schreibe Tests für folgende Änderung. Ziel: Die Tests sollen das gewünschte Verhalten prüfen, nicht die Implementierung abbilden.
Verhalten in Regeln:
1. [Regel 1, zum Beispiel: Ab einem Bestellwert von 100.00 CHF ist der Versand gratis.]
2. [Regel 2]
Betroffener Code: [Dateien/Funktionen]
Testwerkzeug und Ausführung: [zum Beispiel Befehl zum Starten der Tests]
Berücksichtige:
- Normale Fälle
- Grenzwerte (knapp darunter, genau auf der Grenze, knapp darüber)
- Leere, ungültige und unerwartete Eingaben
- Fehlerfälle und deren Meldungen
Leite die erwarteten Ergebnisse aus meinen Regeln ab, nicht aus dem vorhandenen Code. Wenn der Code von den Regeln abweicht, melde das, statt den Test anzupassen.
Benenne jeden Test so, dass das Verhalten erkennbar ist. Ändere keinen Produktivcode. Führe die Tests aus und berichte, welche bestehen und welche fehlschlagen.Ersetzen Sie Regeln und Fälle. Der Satz zur Abweichung ist wichtig, weil er verhindert, dass Tests «passend» gemacht werden.
| Fallgruppe | Beispiel | Prüfen |
|---|---|---|
| Normal | Bestellwert 150.00 | Versand gratis |
| Grenzwert | 99.95 / 100.00 / 100.05 | Wechsel genau bei 100.00 |
| Ungültig | leer, negativ, Text | Fehlermeldung statt Absturz |
| Sonderfall | Rabatt und Gutschein | Reihenfolge der Berechnung |
Worauf Sie achten müssen
- Scheintests. Tests, die immer bestehen oder nur Code wiederholen, schützen nichts. Prüfen Sie mit der Gegenprobe.
- Angepasste Erwartungen. Wenn ein Test fehlschlägt, könnte die KI den Test ändern statt den Code. Achten Sie darauf, was sich ändert.
- Zufällige oder zeitabhängige Tests. Tests, die vom Datum, Zufall oder externen Diensten abhängen, werden unzuverlässig.
- Echte Daten. Verwenden Sie in Tests keine echten Kundendaten. Erfundene Daten genügen.
- Zu viele Tests. Eine hohe Zahl sagt wenig. Wichtig sind sinnvolle Fälle, nicht Abdeckung um jeden Preis.
- Verantwortung. Sie entscheiden, ob die Tests ausreichen. Bei sicherheits- oder abrechnungsrelevantem Code ziehen Sie eine zweite Person bei (Code-Review mit Codex).
Ein Beispiel aus der Praxis
Ein Beispiel: Ein Entwickler in einem Reisebüro in Lugano ändert die Berechnung der Stornogebühr: bis 30 Tage vor Abreise 10 Prozent, danach 50 Prozent, ab 7 Tagen 100 Prozent. Er lässt Codex Tests schreiben, aber nur aus den Regeln.
Codex erzeugt zwölf Tests, darunter die Grenzen bei 30 und 7 Tagen sowie eine Reise am Abreisetag. Beim Ausführen schlägt ein Test fehl: Bei genau 30 Tagen berechnet der Code 50 statt 10 Prozent. Der Entwickler korrigiert die Bedingung. Zur Gegenprobe ändert er testweise die Grenze auf 29 Tage und sieht, dass der Grenzwert-Test fehlschlägt.
Vorher hätte er die Berechnung von Hand mit zwei Beispielen geprüft, nachher schützen Tests alle Grenzen. Bei späteren Änderungen laufen sie automatisch mit.
So hilft Ihnen Alpasana
Wie man Tests als Teil der KI-gestützten Entwicklung nutzt und Ergebnisse verifiziert, lernen Sie im Kurs KI für Developer mit Claude und Codex von absofort. Beschrieben sind Codegenerierung, Debugging, Refactoring und Review, das Delegieren und Verifizieren sowie ein Entwickler-Playbook mit Prompts, Review-Regeln, Tests und Datenschutzgrenzen.
Der Kurs ist online mit Abschlussquiz, KI-geprüfter Praxisaufgabe und verifizierbarem Zertifikat.
Häufige Fragen
Muss ich alles testen?
Nein. Konzentrieren Sie sich auf Verhalten mit Folgen: Berechnungen, Zugriffsrechte, Datenänderungen. Triviales braucht wenig Tests.
Warum Tests aus Regeln statt aus dem Code?
Weil Tests aus dem Code dessen Fehler übernehmen. Regeln aus der Aufgabenstellung sind die unabhängige Messlatte.
Was bedeutet Gegenprobe?
Sie machen den Code absichtlich falsch und prüfen, ob ein Test fehlschlägt. So sehen Sie, ob der Test etwas schützt.
Kann Codex alle Tests selbst ausführen?
Je nach Umgebung. Führen Sie Tests zusätzlich selbst aus und prüfen Sie die Ausgabe, besonders bei wichtigen Änderungen.
Erstellt mit KI-Unterstützung, redaktionell verantwortet von der Alpasana GmbH · 10.10.2026. Fehler entdeckt? Melden Sie es uns.
Quellen
Weiterlesen in der Galaxie
- Fehler mit Codex finden und beheben lassenCodex Debugging: Beschreiben Sie Fehlermeldung und Schritte zum Nachstellen. Prüfen Sie Ursache und Änderung im Diff und sichern Sie sie mit einem Test ab.
- Codex Prompt Vorlage für klare ProgrammieraufträgeCodex Prompt Vorlage: Formulieren Sie Ziel, Kontext, betroffene Dateien und Abnahmekriterien so, dass Änderungen klein und überprüfbar bleiben.
- Codex-Code prüfen: Checkliste vor der ÜbernahmeCodex-Code prüfen: Checkliste für Fachpersonen und Verantwortliche, damit von KI vorgeschlagene Änderungen verstanden, getestet und erst dann übernommen werden.
- Codex vs Claude Code: Arbeitsabläufe vergleichenCodex vs Claude Code: Vergleichen Sie beide Coding-Agenten mit Ihren Entwicklungsaufgaben und halten Sie Beobachtungen für eine begründete Teamwahl fest.
- Codex für eine kleine Web-App: Vom Wunsch zum PrototypMit Codex eine kleine Web-App erstellen: Planen Sie Funktionen, bauen Sie einen Prototyp und prüfen Sie Tests, Sicherheit und Grenzen vor dem Einsatz.