Crawler-Abdeckung
98%
Anteil der Wörter aus dem gerenderten Haupttext, die auch der Crawler erhält.
https://berliner-zeitung.de/
Die Seite liefert ohne JavaScript den Großteil des gerenderten Haupttexts. Die abweichenden Passagen sollten geprüft werden.
Crawler-Abdeckung
98%
Anteil der Wörter aus dem gerenderten Haupttext, die auch der Crawler erhält.
Inhaltsähnlichkeit
92%
Vergleicht beide Texte unabhängig von reiner Wortzahl und erkennt gleich lange, aber andere Inhalte.
Wortdifferenz
+19 Wörter
+14% gegenüber der gerenderten Ansicht. Minus heißt: dem Crawler fehlen Wörter.
Metoz-Score
71/100
Lesbarkeit
95
Zugang
100
Zitierfähigkeit
33
40 % Crawler-Lesbarkeit, 20 % Zugang der Such- und Agenten-Bots, 40 % Beantwortbarkeit der sechs Zitat-Fragen.
Report mitnehmen
Wir schicken dir die wichtigsten Befunde und den Link zu diesem vollständigen Report.
Einmaliger Versand über Epostix, kein Newsletter und kein Öffnungs- oder Klicktracking. metoz.de speichert die E-Mail-Adresse nicht in der eigenen Datenbank. Mehr im Datenschutz.
Was jetzt?
Befund: Die Crawler-Ansicht deckt 98% des gerenderten Haupttexts ab.
Folge: Fehlende Leistungen, Preise oder Kontaktdaten können von Such- und Antwortsystemen nicht zuverlässig verwendet werden.
Empfehlung: Die unten markierten Nur-Browser-Passagen in das initiale HTML aufnehmen und anschließend erneut scannen.
Befund: Keiner der geprüften Such-Crawler wird für diese URL durch robots.txt blockiert.
Folge: Die robots.txt verhindert damit nicht, dass diese Dienste die Seite als Webquelle abrufen.
Empfehlung: Bot-Regeln bei Änderungen an der robots.txt erneut prüfen.
Block 3
Ein Modell hat ausschließlich den crawler-sichtbaren Text mit sechs immer gleichen Fragen geprüft. Das Ergebnis misst Beantwortbarkeit, nicht eine spätere Nennung in einem konkreten KI-Dienst.
Es handelt sich um ein Nachrichten- und Nachrichtenportal.
Das Angebot ist für diejenigen bestimmt, die sich für Nachrichten und Politik interessieren.
Die Preise für das Angebot sind nicht explizit angegeben.
Die genaue Location des Unternehmens oder der Organisation ist nicht angegeben.
Man kann Kontakt aufnehmen, indem man sich für einen Newsletter anmeldet.
Die Webseite bietet eine unabhängige und vielfältige Berichterstattung, die sich von anderen Angeboten unterscheidet.
Modell: @cf/meta/llama-3.1-8b-instruct-fast · Kontext: 155 Token
Beide Ansichten werden getrennt abgerufen und anschließend mit derselben Haupttext-Extraktion ausgewertet. Kennzahlen und Grenzen erklärt.
Chromium mit JavaScript · 136 Wörter

17 Tage 3 Std. 53 Min. Heute Wetten auf die Wahl Wahlsieger bei den Parlamentswahlen in Sachsen-Anhalt Für die Hauptstadt, den Osten, die Welt und die Straße. Für die Mutigen. Meistgelesene Artikel Stil NEWSLETTER • FREITAGS UM 12:00 UHR Stil und Genuss Zwischen Ästhetik und Aperitif. Inspiration für Ihr Wochenende. Vielen Dank für Ihre Anmeldung. Sie erhalten eine Bestätigung per E-Mail. NEWSLETTER • TÄGLICH UM 6:00 UHR Guten Morgen, Berlin Die wichtigsten Themen für Ihren Start in den Tag. Vielen Dank für Ihre Anmeldung. Sie erhalten eine Bestätigung per E-Mail. NEWSLETTER • DONNERSTAGS UM 18:00 UHR Open Source Kontrovers, vielfältig und unabhängig. Vielen Dank für Ihre Anmeldung. Sie erhalten eine Bestätigung per E-Mail. Immer auf dem Laufenden. Erfahren Sie, was in Ihrem Bezirk passiert – von Pankow bis Spandau. Wortstoerung KW 30/31, 2026 Von Raban Ruddigkeit
Ohne JavaScript · 155 Wörter
– Tage – Std. – Min. Heute Wetten auf die Wahl Wahlsieger bei den Parlamentswahlen in Sachsen-Anhalt Wetten auf die Wahl Wahlsieger zum Abgeordnetenhaus von Berlin Wetten auf die Wahl Wahlsieger bei den Parlamentswahlen in Mecklenburg-Vorpommern Für die Hauptstadt, den Osten, die Welt und die Straße. Für die Mutigen. Meistgelesene Artikel Stil NEWSLETTER • FREITAGS UM 12:00 UHR Stil und Genuss Zwischen Ästhetik und Aperitif. Inspiration für Ihr Wochenende. Vielen Dank für Ihre Anmeldung. Sie erhalten eine Bestätigung per E-Mail. NEWSLETTER • TÄGLICH UM 6:00 UHR Guten Morgen, Berlin Die wichtigsten Themen für Ihren Start in den Tag. Vielen Dank für Ihre Anmeldung. Sie erhalten eine Bestätigung per E-Mail. NEWSLETTER • DONNERSTAGS UM 18:00 UHR Open Source Kontrovers, vielfältig und unabhängig. Vielen Dank für Ihre Anmeldung. Sie erhalten eine Bestätigung per E-Mail. Immer auf dem Laufenden. Erfahren Sie, was in Ihrem Bezirk passiert – von Pankow bis Spandau. Wortstoerung KW 30/31, 2026 Von Raban Ruddigkeit
robots.txt regelt den erlaubten Zugriff. Ein „erlaubt“ beweist noch nicht, dass ein Dienst die Seite indexiert oder zitiert.
Ohne Zugriff kann ChatGPT die Seite nicht als Quelle für die Websuche nennen.
Ohne Zugriff kann Claude die Seite nicht über diesen Such-Crawler als Quelle erfassen.
Ohne Zugriff kann die Seite in der Google-Suche fehlen; das ist keine reine KI-Einstellung.
Ohne Zugriff kann Perplexity die Seite nicht für seine Suchantworten indexieren.
Ohne Zugriff kann die Sichtbarkeit in Apple-Suchergebnissen eingeschränkt sein.
Ohne Zugriff können Metas Abrufdienste die Seite nicht in ihren Produkten aufbereiten.
Ohne Zugriff kann You.com die Seite nicht über diesen Such-Crawler erfassen.
Ohne Zugriff kann ChatGPT keine vom Nutzer ausgelösten Abrufe der Seite durchführen.
Ohne Zugriff sind von Claude-Nutzern ausgelöste Abrufe eingeschränkt.
Ohne Zugriff sind nutzergesteuerte Abrufe durch Perplexity eingeschränkt.
Ohne Zugriff sind externe, von Meta ausgelöste Abrufe eingeschränkt.
Ohne Zugriff fließt der Inhalt nicht in das Training von OpenAI-Modellen ein.
Ohne Zugriff kann Anthropic den Inhalt nicht mit diesem Crawler erfassen.
Ohne Zugriff darf Google den Inhalt nicht zur Verbesserung von Gemini und ähnlichen generativen APIs verwenden.
Ohne Zugriff kann Amazon den Inhalt nicht mit diesem KI-Crawler erfassen.
Ohne Zugriff kann Apple den Inhalt nicht für Apple-Intelligence-Dienste verwenden.
Ohne Zugriff erscheint der Inhalt nicht im Common-Crawl-Datensatz, den viele Modelle nutzen.
Ohne Zugriff kann Meta den Inhalt nicht über diesen externen Agenten abrufen.
Ohne Zugriff kann ByteDance den Inhalt nicht mit diesem Crawler erfassen.
Ohne Zugriff kann Cohere den Inhalt nicht mit diesem Crawler erfassen.
Ohne Zugriff kann Diffbot die Seite nicht für seine Wissensdaten erfassen.
robots.txt: gefunden und ausgewertet
Die gerenderte Ansicht läuft in Chromium mit JavaScript und einem normalen Browser-User-Agent. Die Crawler-Ansicht nutzt einen separaten Abruf mit MetozBot/1.0 und führt kein JavaScript aus. Beide HTML-Fassungen durchlaufen Mozilla Readability.
Gleiche Wortzahlen sind deshalb möglich und meist positiv. Aussagekräftiger sind Crawler-Abdeckung, Inhaltsähnlichkeit und die abweichenden Passagen. A/B-Tests, Consent-Banner und zeitabhängige Inhalte können zwei Abrufe trotzdem beeinflussen.