Crawler-Abdeckung
nicht ausweisbar
Für diesen Abruf wird bewusst keine Abdeckung ausgewiesen: Die gerenderte Ansicht lieferte zu wenig Haupttext, um als Nenner zu taugen.
https://example.com/
Beide Ansichten enthalten nach derselben Extraktion sehr wenig Text (unter 120 Wörtern). Häufige Ursachen sind Zustimmungsdialoge, Interstitials oder eine reine Weiterleitungsseite. Aus diesem Lauf lässt sich keine Aussage über die Crawler-Lesbarkeit ableiten.
Crawler-Abdeckung
nicht ausweisbar
Für diesen Abruf wird bewusst keine Abdeckung ausgewiesen: Die gerenderte Ansicht lieferte zu wenig Haupttext, um als Nenner zu taugen.
Inhaltsähnlichkeit
100%
Vergleicht beide Texte unabhängig von reiner Wortzahl und erkennt gleich lange, aber andere Inhalte.
Wortdifferenz
0 Wörter
0% gegenüber der gerenderten Ansicht. Minus heißt: dem Crawler fehlen Wörter.
Metoz-Score
–/100
Lesbarkeit
–
Zugang
100
Zitierfähigkeit
0
Für diesen Abruf wird kein Gesamtscore gebildet, weil zu wenig Haupttext für eine belastbare Lesbarkeitsaussage vorlag.
Report mitnehmen
Wir schicken dir die wichtigsten Befunde und den Link zu diesem vollständigen Report.
Einmaliger Versand über Epostix, kein Newsletter und kein Öffnungs- oder Klicktracking. metoz.de speichert die E-Mail-Adresse nicht in der eigenen Datenbank. Mehr im Datenschutz.
Was jetzt?
Befund: Für diesen Abruf lag zu wenig extrahierbarer Haupttext vor (Schwellwert: 120 Wörter).
Folge: Aus diesem Lauf lässt sich weder eine gute noch eine schlechte Crawler-Lesbarkeit ableiten. Es wird bewusst keine Abdeckungsquote und kein Gesamtscore ausgewiesen.
Empfehlung: Prüfen, ob die geprüfte URL auf einen Zustimmungsdialog, ein Interstitial oder eine Weiterleitung führt, und den Scan auf einer Inhaltsseite wiederholen.
Befund: Keiner der geprüften Such-Crawler wird für diese URL durch robots.txt blockiert.
Folge: Die robots.txt verhindert damit nicht, dass diese Dienste die Seite als Webquelle abrufen.
Empfehlung: Bot-Regeln bei Änderungen an der robots.txt erneut prüfen.
Metoz-Werkstatt
Die Downloads entstehen nur in deinem Browser. Sie enthalten die beobachteten Befunde, klare Leitplanken und eine Abnahme per erneutem Scan – keine Garantie für Indexierung, Zitat oder Ranking.
Technik und Umsetzung
Übersetzt Empfehlungen, Messwerte und Bot-Sperren in einen neutralen Markdown-Auftrag mit Abnahmekriterien.
6 Antwortlücken
Übernimmt nur vollständig belegte Antworten. Fehlende Angaben bleiben als fachlicher Klärungsauftrag markiert.
Block 3
Ein Modell hat ausschließlich den crawler-sichtbaren Text mit sechs immer gleichen Fragen geprüft. Das Ergebnis misst Beantwortbarkeit, nicht eine spätere Nennung in einem konkreten KI-Dienst.
Dieses Unternehmen oder diese Organisation macht Dokumentationsbeispiele zur Verfügung.
Das Angebot ist für Personen bestimmt, die Dokumentationsbeispiele benötigen.
Das Angebot ist kostenlos.
Die genaue Adresse des Unternehmens oder der Organisation ist nicht im Text angegeben.
Man kann Kontakt aufnehmen, indem man mehr über das Angebot erfahren möchte.
Dieses Angebot sollte gewählt werden, weil es kostenlos ist und für Dokumentationsbeispiele verwendet werden kann.
Modell: @cf/meta/llama-3.1-8b-instruct-fast · Kontext: 16 Token
Beide Ansichten werden getrennt abgerufen und anschließend mit derselben Haupttext-Extraktion ausgewertet. Kennzahlen und Grenzen erklärt.
Chromium mit JavaScript · 16 Wörter

This domain is for use in documentation examples without needing permission. Avoid use in operations.Learn more
Ohne JavaScript · 16 Wörter
This domain is for use in documentation examples without needing permission. Avoid use in operations.Learn more
robots.txt regelt den erlaubten Zugriff. Ein „erlaubt“ beweist noch nicht, dass ein Dienst die Seite indexiert oder zitiert.
Ohne Zugriff kann ChatGPT die Seite nicht als Quelle für die Websuche nennen.
Ohne Zugriff kann Claude die Seite nicht über diesen Such-Crawler als Quelle erfassen.
Ohne Zugriff kann die Seite in der Google-Suche fehlen; das ist keine reine KI-Einstellung.
Ohne Zugriff kann Perplexity die Seite nicht für seine Suchantworten indexieren.
Ohne Zugriff kann die Sichtbarkeit in Apple-Suchergebnissen eingeschränkt sein.
Ohne Zugriff können Metas Abrufdienste die Seite nicht in ihren Produkten aufbereiten.
Ohne Zugriff kann You.com die Seite nicht über diesen Such-Crawler erfassen.
Ohne Zugriff kann ChatGPT keine vom Nutzer ausgelösten Abrufe der Seite durchführen.
Ohne Zugriff sind von Claude-Nutzern ausgelöste Abrufe eingeschränkt.
Ohne Zugriff sind nutzergesteuerte Abrufe durch Perplexity eingeschränkt.
Ohne Zugriff sind externe, von Meta ausgelöste Abrufe eingeschränkt.
Ohne Zugriff fließt der Inhalt nicht in das Training von OpenAI-Modellen ein.
Ohne Zugriff kann Anthropic den Inhalt nicht mit diesem Crawler erfassen.
Ohne Zugriff darf Google den Inhalt nicht zur Verbesserung von Gemini und ähnlichen generativen APIs verwenden.
Ohne Zugriff kann Amazon den Inhalt nicht mit diesem KI-Crawler erfassen.
Ohne Zugriff kann Apple den Inhalt nicht für Apple-Intelligence-Dienste verwenden.
Ohne Zugriff erscheint der Inhalt nicht im Common-Crawl-Datensatz, den viele Modelle nutzen.
Ohne Zugriff kann Meta den Inhalt nicht über diesen externen Agenten abrufen.
Ohne Zugriff kann ByteDance den Inhalt nicht mit diesem Crawler erfassen.
Ohne Zugriff kann Cohere den Inhalt nicht mit diesem Crawler erfassen.
Ohne Zugriff kann Diffbot die Seite nicht für seine Wissensdaten erfassen.
robots.txt: nicht vorhanden – keine Regeln erkannt
Die gerenderte Ansicht läuft in Chromium mit JavaScript und einem normalen Browser-User-Agent. Die Crawler-Ansicht nutzt einen separaten Abruf mit MetozBot/1.0 und führt kein JavaScript aus. Beide HTML-Fassungen durchlaufen Mozilla Readability.
Gleiche Wortzahlen sind deshalb möglich und meist positiv. Aussagekräftiger sind Crawler-Abdeckung, Inhaltsähnlichkeit und die abweichenden Passagen. A/B-Tests, Consent-Banner und zeitabhängige Inhalte können zwei Abrufe trotzdem beeinflussen.