Methodik

Wie der Check rechnet 27 Prüfungen, 100 Punkte, zwei K.-o.-Regeln

Der Check vergibt insgesamt 100 Punkte in fünf Bereichen. Für jede Prüfung gibt es vier mögliche Ergebnisse: erfüllt, teilweise erfüllt, offen oder nicht anwendbar. Die Gewichtung der einzelnen Prüfungen ist redaktionell festgelegt und basiert nicht auf einer Messung.

Grundregeln

Wie werden aus den Ergebnissen Punkte?

Ist eine Prüfung erfüllt, gibt es die volle Punktzahl. Bei einer teilweise erfüllten Prüfung gibt es die Hälfte, bei einer offenen Prüfung keine Punkte.

Ist eine Prüfung nicht anwendbar, werden ihre Punkte auf die anderen Prüfungen des jeweiligen Bereichs verteilt. Das betrifft zum Beispiel die Prüfung nach Autor und Datum auf einer Website, die keine Artikel enthält.

Was wird einmal geprüft, was auf jeder Seite?

Einige Prüfungen beziehen sich auf die gesamte Website. Dazu gehören zum Beispiel robots.txt, Sitemap und das Organisations-Markup. Diese Prüfungen zählen einmal.

Andere Prüfungen werden für jede geprüfte Seite durchgeführt. Die Ergebnisse werden anschließend gewichtet: Die Startseite zählt zu 40 Prozent, die bis zu fünf Unterseiten zusammen zu 60 Prozent.

Welche Seiten werden geprüft?

Geprüft wird die eingegebene Adresse sowie bis zu fünf intern verlinkte Seiten. Dabei werden bevorzugt Seiten ausgewählt, die über die Hauptnavigation erreichbar sind und tatsächlich Inhalte enthalten.

Impressum und Datenschutz werden erkannt, aber nicht als Inhaltsseiten gezählt.

Der Check ruft die Seiten unter dieser Kennung ab:

User-Agent
neuesichtbarkeit.de/1.0 (+https://neuesichtbarkeit.de/methodik.html)

Warum wird die Punktzahl manchmal begrenzt?

Eine reine Addition der Punkte würde zu einem problematischen Ergebnis führen: Eine Website könnte zum Beispiel 70 Punkte bekommen, obwohl sie alle KI-Bots aussperrt. Das würde einen falschen Eindruck vermitteln.

Deshalb gibt es zwei K.-o.-Regeln:

  • Sind die Antwort-Bots gesperrt oder bekommt ein Bot eine andere Antwort als ein normaler Browser, kann die Gesamtpunktzahl höchstens 40 betragen.
  • Steht der eigentliche Inhalt nicht im ausgelieferten HTML, kann die Gesamtpunktzahl höchstens 50 betragen.

Auf solche Fälle weist der Bericht direkt am Anfang hin.

Stufen

Was bedeutet die Punktzahl?

  • 85 bis 100: gut aufgestellt. KI-Systeme können die Website abrufen, lesen und einordnen. Danach geht es vor allem um Details.
  • 65 bis 84: solide mit einigen Lücken. Die wichtigsten Grundlagen sind vorhanden, einzelne Punkte können die Sichtbarkeit aber noch einschränken.
  • 40 bis 64: es gibt deutlichen Handlungsbedarf. In mehreren Bereichen fehlen wichtige Grundlagen oder einzelne Punkte fallen stärker ins Gewicht.
  • unter 40: für KI-Systeme weitgehend unsichtbar. Häufig ist eine der K.-o.-Regeln dafür verantwortlich.

Wie werden die drei Maßnahmen ausgewählt?

Die vorgeschlagenen Maßnahmen richten sich danach, wie viele Punkte sich mit welchem Aufwand zurückgewinnen lassen. Dafür wird der Punktverlust durch den geschätzten Aufwand geteilt. S steht für einen kleinen Aufwand, M für einen mittleren und L für einen größeren Aufwand. Intern werden dafür S = 1, M = 2 und L = 4 verwendet.

K.-o.-Prüfungen stehen immer ganz oben.

Dadurch kann zum Beispiel „robots.txt anpassen“ mit acht möglichen Punkten und kleinem Aufwand vor „Inhalte umstrukturieren“ mit fünf Punkten und größerem Aufwand stehen. Der Bericht zeigt damit zuerst die Maßnahmen, bei denen sich vergleichsweise schnell etwas ändern lässt.

Alle Prüfungen

Die 27 Prüfungen und ihre Gewichte

Die folgende Tabelle beschreibt das Modell in Version 1.0. Jeder Bericht speichert die verwendete Modellversion. So bleiben ältere Berichte nachvollziehbar, auch wenn sich die Gewichtung später ändert.

Zugang · 25 Punkte

IDPrüfungPunkteErfüllt, wenn
A1robots.txt erreichbar und lesbar2Antwort 200, gültige Syntax
A2Antwort-Bots dürfen die Website abrufen8OAI-SearchBot, ChatGPT-User, PerplexityBot, Claude-SearchBot, Claude-User erlaubt; teilweise: mindestens die Hälfte
A3Keine Sperre durch Firewall oder CDN4Abruf mit Bot-Kennung liefert denselben Status wie mit Browser-Kennung
A4Sitemap vorhanden und in der robots.txt genannt4gültige XML-Sitemap, in der robots.txt referenziert; teilweise: vorhanden, aber nicht referenziert
A5HTTPS, saubere Statuscodes, höchstens eine Weiterleitung4Startseite per HTTPS mit Status 200, http leitet auf https um, höchstens ein Sprung
A6Antwortzeit des Servers3erstes Byte in unter 800 ms; teilweise: unter 1.800 ms

Lesbarkeit · 25 Punkte

IDPrüfungPunkteErfüllt, wenn
L1Inhalt steht im ausgelieferten HTML10mindestens 250 sichtbare Wörter im Quelltext, keine leere App-Hülle; teilweise: ab 100 Wörtern
L2Genau eine H1, Überschriften ohne Sprünge5eine H1 je Seite, keine Ebene übersprungen
L3Semantische Bereiche: main, nav, header, footer3main plus mindestens zwei weitere Landmarken
L4Titel, Beschreibung, Sprache3title, Meta-Description und lang-Attribut gesetzt
L5Alt-Texte an Inhaltsbildern2mindestens 80 % der Inhaltsbilder mit Alt-Text; nicht anwendbar ohne Inhaltsbilder
L6Text-zu-Code-Verhältnis, Inhalt früh im Quelltext2mindestens 8 % Text im Markup (ohne Inline-Styles und -Skripte), Hauptinhalt in den ersten 40 % des Dokuments

Verständlichkeit · 20 Punkte

IDPrüfungPunkteErfüllt, wenn
V1Strukturierte Daten (JSON-LD) vorhanden und lesbar4mindestens ein JSON-LD-Block auf der Startseite, alle Blöcke fehlerfrei
V2Organisation vollständig beschrieben6Organization oder LocalBusiness mit name, url, logo, Adresse, Kontakt; teilweise: ab drei Feldern
V3Verknüpfungen zu Profilen (sameAs)2mindestens zwei sameAs-Adressen am Organisations-Knoten
V4Seitentyp-Markup auf Unterseiten4Article, FAQPage, Service, Product, BreadcrumbList oder ähnlich auf mindestens der Hälfte der Unterseiten
V5Impressum, Kontakt und Über-uns verlinkt3alle drei von den geprüften Seiten aus verlinkt
V6Open-Graph-Angaben1og:title, og:description und og:image gesetzt

Zitierbarkeit · 20 Punkte

IDPrüfungPunkteErfüllt, wenn
Z1Antwort zuerst5erster Absatz nach H1/H2 mit 20 bis 80 Wörtern, ohne Floskel-Einleitung; nicht anwendbar ohne solche Absätze
Z2Überschriften in Frageform4im Schnitt mindestens eine Frage-Überschrift je Seite
Z3Listen oder Tabellen im Inhalt3mindestens eine Liste oder Tabelle je Seite
Z4Autor und Datum auf Artikelseiten4Autor und Datum auf Seiten mit Article-Markup oder Artikelstruktur; nicht anwendbar ohne Artikel
Z5Absatzlänge2Median der Absätze höchstens 80 Wörter; teilweise: bis 120; nicht anwendbar bei weniger als drei Absätzen
Z6FAQ-Bereich vorhanden2ein Fragen-und-Antworten-Bereich auf mindestens einer geprüften Seite

Aktualität und Konsistenz · 10 Punkte

IDPrüfungPunkteErfüllt, wenn
K1Änderungsdaten in der Sitemap plausibel3lastmod vorhanden, nicht überall identisch, nicht alle von heute
K2Aktuelles Datum auf mindestens einer Seite3dateModified, datePublished oder sichtbares Datum aus den letzten zwölf Monaten
K3Canonical-Adresse vorhanden und stimmig2link rel=canonical gesetzt und gleich der eigenen Adresse
K4Name, Adresse und Telefon stimmen überein2Angaben im Organisations-Knoten finden sich in Fußzeile bzw. Impressum wieder; nicht anwendbar ohne Organisations-Knoten

Nur zur Information, ohne Punkte

  • llms.txt: Wenn die Datei vorhanden ist, wird sie im Bericht angezeigt. Ob sie für KI-Systeme tatsächlich einen Nutzen hat, ist derzeit offen. Kein großes KI-System hat bestätigt, dass es die Datei auswertet. Deshalb gibt es dafür weder Punkte noch einen Abzug.
  • Trainings-Crawler: GPTBot, ClaudeBot, Google-Extended und CCBot sammeln Daten für das Training von Modellen. Sie zu sperren und gleichzeitig die Antwort-Bots zu erlauben, ist eine mögliche Entscheidung. Der Bericht zeigt sie an und erklärt die Auswirkungen, bewertet sie aber nicht.

Transparenz

Was passiert beim Prüfen?

Der Check ruft die Seiten unter der oben genannten Kennung ab. Eine Ausnahme gibt es bei der Startseite: Sie wird ein zweites Mal abgerufen, diesmal mit der Kennung eines KI-Bots.

So lässt sich feststellen, ob eine Firewall oder ein CDN einen Bot anders behandelt als einen normalen Browser.

Die Antwortzeit wird von einem Server in Deutschland gemessen. Sie zeigt eine Größenordnung, ersetzt aber kein vollständiges Messprotokoll.

Die Ergebnisse werden pro Website 24 Stunden zwischengespeichert. Wer in dieser Zeit etwas an der Website ändert und den Check erneut startet, bekommt deshalb zunächst noch den vorherigen Stand. Im Bericht ist das Datum der Prüfung angegeben.

Alle Regeln sind deterministisch. Wenn eine Website unverändert bleibt, liefert sie bei gleicher Prüfung dasselbe Ergebnis. Ein Sprachmodell ist an der Bewertung nicht beteiligt.

Stand des Modells: Version 1.0, .

Häufige Fragen

Zur Methodik

Warum bekommt eine Website ohne Blog keinen Abzug für fehlende Autorenangaben?

Weil die Prüfung dann nicht anwendbar ist. Ihre Punkte werden innerhalb des Bereichs Zitierbarkeit auf die übrigen Prüfungen verteilt. Eine Website wird nur für das bewertet, was sie hat.

Warum zählt die Startseite nur 40 Prozent?

Weil KI-Systeme selten die Startseite zitieren. Sie holen sich die Antwort von der Seite, auf der sie steht: Leistungsseite, Artikel, FAQ. Die Unterseiten zusammen sind deshalb wichtiger als die Startseite allein.

Was ist, wenn eine Seite während der Prüfung nicht antwortet?

Dann steht das im Bericht, und die betroffenen seitenbezogenen Prüfungen werden ohne diese Seite gemittelt. Der Zugangs-Bereich hält den Ausfall als Befund fest. Der Bericht gibt keine Entwarnung für etwas, das er nicht gesehen hat.

Ändern sich die Gewichte?

Ja, wenn sich das Verhalten der KI-Systeme ändert oder sich eine Prüfung als unbrauchbar erweist. Jede Änderung bekommt eine neue Modellversion. Alte Berichte behalten die Version, mit der sie erstellt wurden.