KI-Agenten-Tests
Die Tests, die einen Menschen brauchten, laufen jetzt jede Nacht.
Keine Regel-Engine mit besserem Marketing. Agenten bedienen Ihre Website wie eine Testperson — und übergeben Ihnen das Protokoll, damit Sie den Test prüfen statt ihn zu wiederholen.
Die Flotte
Acht Agenten, ein Protokoll
-
Tastatur & Fokus
Tab-Reihenfolge, sichtbarer Fokus, Fokusfallen, Sprunglinks, Fokus nach Dialogen und Routenwechseln. Ergebnis: der Tastaturpfad mit Urteil je Schritt.
-
Screenreader
Die Seite gelesen mit NVDA-, JAWS- und VoiceOver-Semantik. Ergebnis: die aufgezeichnete Sprachausgabe gegen das, was hätte angesagt werden müssen.
-
Alt-Text-Relevanz
Ein Bildmodell fragt, ob der Text dieses Bild in diesem Kontext beschreibt — dekorativ, informativ oder funktional. Ergebnis: Bewertung je Bild und ein Textvorschlag.
-
Zoom, Reflow & Kontrast
400 % Zoom, 320 px Reflow, Textabstände, Kontrast im tatsächlich gerenderten Zustand inklusive Hover und Fokus.
-
Formulare & Fehler
Beschriftungen, Hinweise, Fehlererkennung, Korrekturvorschläge, Pflichtfelder — und ob Fehler die assistive Technologie erreichen.
-
Medien & Untertitel
Untertitel vorhanden und synchron, Audiodeskription, Autoplay, Steuerelemente per Tastatur erreichbar.
-
Zeigegeräte & Sprachsteuerung
Zielgröße, Alternativen zum Ziehen, Zeigerabbruch — und ob sichtbare Beschriftungen zum barrierefreien Namen passen.
-
Inhaltliche Prüfung
Linkzweck außerhalb des Kontexts, Überschriftenstruktur, rein sensorische Anweisungen, Sprache einzelner Passagen.
Nachweise
Jeder Befund zeigt seinen Rechenweg
Ein Score, den man nicht hinterfragen kann, ist ein Risiko. Öffnen Sie einen Befund und Sie sehen den Lauf dahinter: die Schritte, das Erwartete, das Eingetretene und das zugeordnete WCAG-Kriterium. Prüfer und Entwickler schauen auf dasselbe Artefakt.
| Agent | Gesicherter Nachweis | Was ein Mensch damit macht |
|---|---|---|
| Tastatur & Fokus | Tastaturpfad, fokussiertes Element je Schritt, Screenshot beim Fehler | In 20 Sekunden nachstellen oder bestätigen und weitergeben |
| Screenreader | Sprachausgabe gegen erwartete Ansage | Beurteilen, ob die Formulierung in Ihrer Domäne trägt |
| Alt-Text | Bild, aktueller Alt-Text, Bewertung, Vorschlag | Vorschlag freigeben, bearbeiten oder ablehnen |
| Formulare & Fehler | Prüfprotokoll je Feld, abgesendeter Zustand, Ansagen | Entscheiden, ob das Muster ein Redesign braucht |
Ehrliche Grenzen
Wo die Agenten aufhören
Manche Urteile stehen uns nicht zu. Sie bleiben bei Menschen — und das Produkt sagt das in der Oberfläche, statt still zu raten.
Wir veröffentlichen die Übereinstimmungsquote jedes Agenten mit unseren menschlichen Prüfern, sichtbar in Ihrem Dashboard. Liegt ein Agent falsch, markieren Sie den Befund als Falschmeldung — der Lauf wird daran nachjustiert.
- Qualität der Leichten Sprache und redaktionelle Absicht
- Qualität von Gebärdensprach-Verdolmetschung
- Rechtliche Freigabe der Erklärung zur Barrierefreiheit
- Abläufe mit echter Zahlung oder echten Ausweisdokumenten
- Alles unterhalb der Konfidenzschwelle — es geht in die Warteschlange „braucht einen Menschen“
Setzen Sie einen Agenten auf Ihre schwierigste Seite an
Checkout, Buchungsstrecke, Antragsformular — nehmen Sie die, vor deren Test Ihr Team sich drückt.