Methodik

ShopReadable prüft, ob Maschinen – Crawler, Feed-Verarbeiter und KI-Agenten – einen Online-Shop zuverlässig finden, verstehen und vergleichen können. Geprüft werden technische, von außen messbare Signale.

Was der Score ist – und was nicht

Einordnung in drei Bänder

Zur schnellen Orientierung ordnet die Ergebnisseite den Score in drei Bänder ein: 0–49 deutlicher technischer Handlungsbedarf, 50–79 teilweise maschinenlesbar, 80–100 technisch gut lesbar; ab 95 heißt es „hervorragend maschinenlesbar“. Die Grenzen sind eine Darstellungsentscheidung von ShopReadable, keine Vorgabe eines Anbieters, und ändern den berechneten Score nicht. Dieselbe Einordnung gilt je Kategorie; zusätzlich nennt die Seite die schwächste bewertete Kategorie als größten Hebel.

Welche Seiten geprüft werden

Der kostenlose Scan liest robots.txt und Sitemaps und prüft eine kleine, nach Seitentyp und Seitenmuster gestreute Stichprobe von höchstens 8 Seiten. Der bezahlte Deep Audit besteht aus zwei Teilen: der Tiefenprüfung von bis zu 50 gezielt ausgewählten Seiten aus allen Seitentypen – Produkte, Varianten, Sale, ausverkaufte Artikel, Versand und Rückgabe –, die mit allen Regeln, dem Commerce Truth Graph und im Browser ausgewertet werden, und dem Katalog-Check (bis zu 2.000 Produktseiten aus Sitemap und Links, in bis zu 60 Minuten Prüfzeit und im Tempo, das der Shop vorgibt (Crawl-delay) – bei langsamen Shops entsprechend weniger; das Ergebnis nennt genau, wie viele geprüft wurden). Er liest die Sitemaps selbst (auch verschachtelte, bis zu 50 Dateien), ruft jede gefundene Produktseite einzeln ab und prüft ohne Browser die Grundlagen: erreichbar, indexierbar, Produkt-Markup mit Preis, Währung, Verfügbarkeit und Kennungen. Wie viele Produktseiten gefunden und wie viele davon geprüft wurden, steht im Ergebnis – „alle“ nur, wenn es wirklich alle gefundenen waren.

Warenkorb, Kasse, Konto und Suche werden nie abgerufen. Zusätzlich ruft jeder Scan genau einmal /.well-known/ucp und /llms.txt ab und prüft mit einem einfachen Abruf, ob die im UCP-Profil angekündigten Endpunkte des Shops antworten – nur wenn robots.txt es erlaubt, mit Crawl-Pause und ohne eine Schnittstelle aufzurufen. Einzelne Produktseiten werden zusätzlich in einem Browser dargestellt, um Inhalte zu prüfen, die erst per JavaScript entstehen, und den Accessibility-Tree zu lesen, über den Agenten eine Seite bedienen. Innerhalb eines Scans ist die Auswahl deterministisch; ein neuer Scan kann andere Seiten ziehen. Wie viele Seiten gefunden und wie viele geprüft wurden, steht im Ergebnis.

Ergebnis je Regel

Jede Regel endet mit Bestanden, Warnung, Befund, Unbekannt oder Nicht anwendbar. Unbekannt und Nicht anwendbar mindern den Score nie: Hat ein Produkt keine Varianten, ist die Variantenregel nicht anwendbar; lässt sich etwas von außen nicht messen – etwa ob das Netz eines Anbieters den Shop erreicht –, bleibt es unbekannt.

Optionale Agenten-Standards

UCP-Profile, WebMCP-Werkzeuge und die Eignung öffentlicher Daten für einen OpenAI-Produktfeed prüfen wir im Bereich „Native Agent Commerce“. Seit Score-Modell SR-ACRS-2026.10 wird dieser Bereich separat ausgewiesen und zählt nicht zum Gesamtscore: Wer einen jungen Standard ausprobiert und dabei einen Fehler macht, soll nicht schlechter dastehen als ein Shop, der ihn gar nicht anbietet. Fehler in einem vorhandenen Profil erscheinen trotzdem als Befund.

Wie stark ein Befund wirkt

Befunde zählen nach Betroffenheit: Ist eine von fünfzig geprüften Seiten betroffen, kostet das nur einen kleinen Teil des Regelgewichts, sind alle betroffen, das ganze. Gezählt wird je Regel das, was sie prüft – Seiten, bei Crawler-Freigaben die Pfade der geprüften Seiten, bei Sitemaps die einzelnen Sitemap-Dateien. Befunde ohne einzelne betroffene Stellen, etwa fehlendes HTTPS oder eine unlesbare robots.txt, wirken als Ganzes. Jeder Befund nennt, wie viel der geprüften Menge betroffen ist.

Nachprüfungen und Methodikänderungen

Jeder Scan speichert Regelwerk und Score-Modell. Eine Nachprüfung rechnet mit dem Score-Modell ihres Audits, damit sich Vorher und Nachher nicht durch eine neuere Methodik verschieben. Die Regeln laufen im aktuellen Stand; hat sich die Version einer Regel seit dem Audit geändert, kennzeichnet der Vergleich das.

Commerce Truth

Für dasselbe Produkt werden die Aussagen aller Quellen nebeneinandergestellt: sichtbare Seite, strukturierte Daten, Meta-Tags. Weichen Preis, Währung oder Verfügbarkeit voneinander ab, zeigt der Befund alle beobachteten Werte mit Fundstelle. ShopReadable erklärt keine Quelle für die richtige.

Konfidenz

Die Konfidenz ist keine „KI-Sicherheit“, sondern beschreibt die Belastbarkeit der Auswahl geprüfter Seiten: Zahl der geprüften Produktseiten, Anteil erfolgreicher Abrufe, Anteil messbarer Regeln und Abdeckung der Seitentypen. Sie bleibt immer unter 95 %.

Reifegrad der Grundlagen

Jede Regel nennt ihre Quelle und deren Reifegrad – offizieller Standard, Vorgabe eines Anbieters, entstehender Standard, experimentell, Best Practice oder reine Information. Ob Trainings-Crawler zugelassen werden, ist eine Entscheidung des Händlers und fließt nie in den Score ein.

Grenzen