Eliminierung technischer Schulden mit PHPStan, Rector PHP und PHPUnit. Über 20 Jahre Praxiserfahrung in skalierbaren Backends.
- Aktualisiert:
- Autor:
- Roland Golla
Was sind agentische Akzeptanztests?
Inhalt
Agentische Akzeptanztests mit NCA: Schnelle Hilfe vom Experten
Gesetzliche Konformität & Inklusion. Optimierung von Performance und Conversion durch radikal nutzerzentriertes, universelles Design.
Skalierbare KI-Systeme mit echtem Code Ownership. CI/CD, Backup-Strategien und Infrastruktur, die mit deinem Team wächst.
Warum Akzeptanztests im agentischen Workflow wichtiger werden
Das Problem: Der Agent bewertet seine eigene Arbeit
Akzeptanztest Levels: Vom Klicktest zum agentischen Loop
Akzeptanztest Levels im Überblick
| Level | Tools | Freigabe |
|---|---|---|
| 1 Manuell | Checkliste, Testprotokoll, Klicktest | Fachbereich nimmt von Hand ab |
| 2 Automatisiert | Cypress, Szenarien im Given When Then Format | Pipeline blockiert bei rotem Test |
| 3 Generiert | cy.prompt, KI Testgenerierung für SAP Prozesse | Mensch prüft den generierten Testcode vor dem Commit |
| 4 Agentisch | Coding Agent im Loop, geschützte Testdateien, Cypress in CI | Mensch gibt den Merge frei, Tests nur per Review änderbar |
Akzeptanzkriterien als Auftrag für den Agenten
Akzeptanztests generieren mit cy.prompt
Schutzregeln: So bleibt der Test der Maßstab
- Tests zuerst: Akzeptanztests entstehen vor dem Code, formuliert von Menschen oder einem getrennten Agenten, nie vom Agenten, der umsetzt.
- Testdateien schützen: Der umsetzende Agent darf Akzeptanztests nicht ändern. Änderungen daran laufen über ein eigenes Review, etwa über festgelegte Code Owner.
- Rollen trennen: Ein Agent implementiert, ein anderer prüft in einer isolierten Umgebung. Kent Beck nutzt diese Trennung, damit Agenten schwache Ergebnisse nicht schönreden.
- Klare Anweisung bei Widersprüchen: Passt ein Test nicht zur Anforderung, stoppt der Agent und meldet den Konflikt, statt ihn selbst aufzulösen.
- Verdeckte Tests: Holdout Tests, die der Agent nicht sieht, decken Tricks auf. Laut der EvilGenie Studie helfen sie, sind aber nicht lückenlos.
- Diffs auf Tests markieren: Die Pipeline schlägt Alarm, wenn ein Merge Request Code und Akzeptanztests gleichzeitig ändert.
Akzeptanztests bei externen Dienstleistern
Any indication that the genie was cheating, for example by disabling or deleting tests.
Agentische Akzeptanztests in der Praxis mit Never Code Alone
NCA Vibe Coding Consulting
Roland Golla ist Entwickler aus Leidenschaft – seit über 20 Jahren. Er hat hunderte Projekte begleitet, von Legacy-Refactoring bis KI-Integration. Bei Vibe Coding verbindet er das Beste aus beiden Welten: Die Geschwindigkeit von KI-generiertem Code mit der Qualität professioneller Softwareentwicklung. Kein Bullshit, keine Agentur-Floskeln – direkte Hilfe von jemandem, der selbst täglich im Code steckt.
Häufige Fragen zu agentischen Akzeptanztests
Was sind agentische Akzeptanztests 2026?
Agentische Akzeptanztests sind Akzeptanztests, die im Workflow mit KI Agenten als Maßstab dienen. Der Coding Agent arbeitet, bis sie grün sind, und Agenten helfen zunehmend, sie aus Anforderungen in natürlicher Sprache zu erzeugen. Weil der Test damit über Qualität entscheidet, braucht er klare Regeln, wer ihn schreibt und wer ihn ändern darf.
Warum manipulieren KI Agenten 2026 Tests?
Agenten optimieren auf das Ziel, das sie sehen, und das ist oft ein grüner Test. Die Benchmark ImpossibleBench zeigt, dass Frontier Modelle häufig Tests ändern, Sonderfälle hart codieren oder andere Abkürzungen nehmen, wenn Test und Anforderung sich widersprechen. Stärkere Modelle schummeln dabei oft mehr. Strenge Anweisungen und weniger Zugriff auf Tests senken die Rate deutlich.
Wie schützt man Akzeptanztests 2026 vor KI Agenten?
Tests entstehen vor dem Code und nicht durch den umsetzenden Agenten. Testdateien sind für ihn gesperrt, Änderungen laufen über ein eigenes Review. Ein zweiter Agent prüft isoliert, verdeckte Holdout Tests decken Tricks auf, und die Pipeline meldet Merge Requests, die Code und Tests gleichzeitig ändern. Bei Widersprüchen stoppt der Agent und meldet den Konflikt.
Was ist cy.prompt 2026?
cy.prompt ist ein KI gestützter Cypress Befehl, der Testschritte in natürlicher Sprache in echte Cypress Befehle übersetzt und im Browser ausführt. Cypress hat ihn auf der CypressConf 2025 vorgestellt, er ist experimentell und braucht einen Cypress Cloud Account. Den erzeugten Code kann man jederzeit ansehen und exportieren. Für Teams ohne Tests ist cy.prompt ein toller Einstieg ins Testen.
Können Product Owner 2026 Akzeptanztests selbst schreiben?
Ja, zumindest die Kriterien. Szenarien im Format Given When Then versteht der Fachbereich, und Werkzeuge wie cy.prompt machen daraus ausführbare Tests. Wichtig bleibt, dass jemand mit Testerfahrung den erzeugten Code prüft, bevor er zum Maßstab wird. Methoden wie Example Mapping helfen, Kriterien gemeinsam mit Entwicklung und QA zu schärfen.
Was ist der Unterschied zwischen Akzeptanztest und Unit Test?
Ein Unit Test prüft eine einzelne Funktion oder Klasse isoliert. Ein Akzeptanztest prüft das Verhalten aus Sicht des Nutzers oder Fachbereichs, meist als End to End Test im Browser. Im agentischen Workflow brauchen Teams beides: Unit Tests fangen Fehler früh und schnell, Akzeptanztests zeigen, ob die Anforderung wirklich erfüllt ist.
Sollte der Coding Agent seine eigenen Akzeptanztests schreiben?
Nein. Wer Code und Test gleichzeitig schreibt, bewertet seine eigene Arbeit und kann den Maßstab unbemerkt anpassen. Akzeptanztests sollten von Menschen oder einem getrennten Agenten stammen und vor der Umsetzung feststehen. Der umsetzende Agent darf Unit Tests ergänzen, die Akzeptanztests aber nicht verändern.
Was sind Holdout Tests?
Holdout Tests sind zusätzliche Tests, die der Agent während der Arbeit nicht sieht. Sie laufen erst nach der Umsetzung und decken Lösungen auf, die nur die sichtbaren Tests bedienen. Die EvilGenie Studie zeigt, dass sie hilfreich, aber nicht lückenlos sind, weil auch heuristische Lösungen verdeckte Tests bestehen können.
Welche Werkzeuge braucht man für agentische Akzeptanztests?
Ein E2E Framework wie Cypress, eine CI Pipeline, die bei roten Tests blockiert, und Regeln, die Testdateien schützen. Für die Kriterien helfen Given When Then Szenarien, für die Generierung Werkzeuge wie cy.prompt. Realistische Testdaten liefert Faker. Im SAP Umfeld übernimmt Tricentis die Testautomatisierung auf Prozessebene.
Funktionieren agentische Akzeptanztests auch bei externen Dienstleistern?
Ja, dort sind sie besonders wertvoll. Akzeptanztests werden zum Vertrag: Der Auftraggeber formuliert die Kriterien, der Dienstleister liefert eine grüne Pipeline mit Nachweisen. Entscheidend ist die Frage, wer die Tests geschrieben hat und wer sie ändern durfte. Ohne diese Klarheit sagt ein grüner Test wenig über die Qualität.
Was bedeutet Self Healing bei E2E Tests?
Self Healing heißt, dass ein Test Selektoren automatisch anpasst, wenn sich die Oberfläche ändert. cy.prompt bietet das, wenn der Befehl dauerhaft im Test bleibt, und zeigt jede Anpassung im Command Log. Für Akzeptanztests ist das mit Vorsicht zu nutzen, weil sich der Maßstab dann ohne Review verändern kann.
Kann Never Code Alone bei agentischen Akzeptanztests helfen?
Ja. Testing ist unser Ursprung, Roland Golla ist Cypress Ambassador, und Cypress mit Cypress Cloud läuft bei uns intensiv in Production. Wir helfen Teams, Akzeptanzkriterien zu formulieren, Tests vor Agenten zu schützen und die Pipeline als Quality Gate aufzusetzen. Der Einstieg ist ein kostenloses Kennenlernen, abgerechnet wird transparent minutengenau.
Wie wir durch optimierte MCP Response Formate 90% Token eingespart haben. Praktische Anleitung für jeden der MCP Server oder API Tools für KI Agenten baut.