KI-Agenten-Tests

Die Tests, die einen Menschen brauchten, laufen jetzt jede Nacht.

Keine Regel-Engine mit besserem Marketing. Agenten bedienen Ihre Website wie eine Testperson — und übergeben Ihnen das Protokoll, damit Sie den Test prüfen statt ihn zu wiederholen.

Die Flotte

Acht Agenten, ein Protokoll

  • Tastatur & Fokus

    Tab-Reihenfolge, sichtbarer Fokus, Fokusfallen, Sprunglinks, Fokus nach Dialogen und Routenwechseln. Ergebnis: der Tastaturpfad mit Urteil je Schritt.

  • Screenreader

    Die Seite gelesen mit NVDA-, JAWS- und VoiceOver-Semantik. Ergebnis: die aufgezeichnete Sprachausgabe gegen das, was hätte angesagt werden müssen.

  • Alt-Text-Relevanz

    Ein Bildmodell fragt, ob der Text dieses Bild in diesem Kontext beschreibt — dekorativ, informativ oder funktional. Ergebnis: Bewertung je Bild und ein Textvorschlag.

  • Zoom, Reflow & Kontrast

    400 % Zoom, 320 px Reflow, Textabstände, Kontrast im tatsächlich gerenderten Zustand inklusive Hover und Fokus.

  • Formulare & Fehler

    Beschriftungen, Hinweise, Fehlererkennung, Korrekturvorschläge, Pflichtfelder — und ob Fehler die assistive Technologie erreichen.

  • Medien & Untertitel

    Untertitel vorhanden und synchron, Audiodeskription, Autoplay, Steuerelemente per Tastatur erreichbar.

  • Zeigegeräte & Sprachsteuerung

    Zielgröße, Alternativen zum Ziehen, Zeigerabbruch — und ob sichtbare Beschriftungen zum barrierefreien Namen passen.

  • Inhaltliche Prüfung

    Linkzweck außerhalb des Kontexts, Überschriftenstruktur, rein sensorische Anweisungen, Sprache einzelner Passagen.

Nachweise

Jeder Befund zeigt seinen Rechenweg

Ein Score, den man nicht hinterfragen kann, ist ein Risiko. Öffnen Sie einen Befund und Sie sehen den Lauf dahinter: die Schritte, das Erwartete, das Eingetretene und das zugeordnete WCAG-Kriterium. Prüfer und Entwickler schauen auf dasselbe Artefakt.

Was ein Agentenlauf aufbewahrt
AgentGesicherter NachweisWas ein Mensch damit macht
Tastatur & FokusTastaturpfad, fokussiertes Element je Schritt, Screenshot beim FehlerIn 20 Sekunden nachstellen oder bestätigen und weitergeben
ScreenreaderSprachausgabe gegen erwartete AnsageBeurteilen, ob die Formulierung in Ihrer Domäne trägt
Alt-TextBild, aktueller Alt-Text, Bewertung, VorschlagVorschlag freigeben, bearbeiten oder ablehnen
Formulare & FehlerPrüfprotokoll je Feld, abgesendeter Zustand, AnsagenEntscheiden, ob das Muster ein Redesign braucht

Ehrliche Grenzen

Wo die Agenten aufhören

Manche Urteile stehen uns nicht zu. Sie bleiben bei Menschen — und das Produkt sagt das in der Oberfläche, statt still zu raten.

Wir veröffentlichen die Übereinstimmungsquote jedes Agenten mit unseren menschlichen Prüfern, sichtbar in Ihrem Dashboard. Liegt ein Agent falsch, markieren Sie den Befund als Falschmeldung — der Lauf wird daran nachjustiert.

  • Qualität der Leichten Sprache und redaktionelle Absicht
  • Qualität von Gebärdensprach-Verdolmetschung
  • Rechtliche Freigabe der Erklärung zur Barrierefreiheit
  • Abläufe mit echter Zahlung oder echten Ausweisdokumenten
  • Alles unterhalb der Konfidenzschwelle — es geht in die Warteschlange „braucht einen Menschen“

Setzen Sie einen Agenten auf Ihre schwierigste Seite an

Checkout, Buchungsstrecke, Antragsformular — nehmen Sie die, vor deren Test Ihr Team sich drückt.