metoz.de/ Gespeicherter Scan
gut

https://pnp.de/

Der Haupttext ist ohne JavaScript nahezu vollständig lesbar

Der getrennt abgerufene Crawler-Text deckt den gerenderten Hauptinhalt nahezu vollständig ab.

Crawler-Abdeckung

100%

Anteil der Wörter aus dem gerenderten Haupttext, die auch der Crawler erhält.

Inhaltsähnlichkeit

96%

Vergleicht beide Texte unabhängig von reiner Wortzahl und erkennt gleich lange, aber andere Inhalte.

Wortdifferenz

+5 Wörter

+7% gegenüber der gerenderten Ansicht. Minus heißt: dem Crawler fehlen Wörter.

Metoz-Score

79/100

Lesbarkeit

98

Zugang

100

Zitierfähigkeit

50

40 % Crawler-Lesbarkeit, 20 % Zugang der Such- und Agenten-Bots, 40 % Beantwortbarkeit der sechs Zitat-Fragen.

Gespeicherten Scan öffnen

Report mitnehmen

Report per E-Mail erhalten

Wir schicken dir die wichtigsten Befunde und den Link zu diesem vollständigen Report.

Einmaliger Versand über Epostix, kein Newsletter und kein Öffnungs- oder Klicktracking. metoz.de speichert die E-Mail-Adresse nicht in der eigenen Datenbank. Mehr im Datenschutz.

Was jetzt?

Befunde und Empfehlungen

gut

Crawler-Lesbarkeit beibehalten

Befund: 100% des gerenderten Haupttexts sind in der Crawler-Ansicht wiederzufinden.

Folge: Wichtige Aussagen sind nicht von JavaScript abhängig.

Empfehlung: Nach größeren Änderungen an Rendering oder CMS erneut scannen.

gut

KI-Suchzugang ist offen

Befund: Keiner der geprüften Such-Crawler wird für diese URL durch robots.txt blockiert.

Folge: Die robots.txt verhindert damit nicht, dass diese Dienste die Seite als Webquelle abrufen.

Empfehlung: Bot-Regeln bei Änderungen an der robots.txt erneut prüfen.

Block 3

Zitat-Test

Ein Modell hat ausschließlich den crawler-sichtbaren Text mit sechs immer gleichen Fragen geprüft. Das Ergebnis misst Beantwortbarkeit, nicht eine spätere Nennung in einem konkreten KI-Dienst.

Was macht dieses Unternehmen oder diese Organisation?

beantwortbar

News-Portal

Für wen ist das Angebot bestimmt?

beantwortbar

Leser

Was kostet das Angebot?

nicht beantwortbar

not_answerable

Wo sitzt das Unternehmen oder die Organisation?

nicht beantwortbar

not_answerable

Wie kann man Kontakt aufnehmen?

beantwortbar

Telefon/Internet

Warum sollte man dieses Angebot statt einer Alternative wählen?

nicht beantwortbar

not_answerable

Modell: @cf/meta/llama-3.1-8b-instruct-fast · Kontext: 76 Token

Die Doppelansicht

Beide Ansichten werden getrennt abgerufen und anschließend mit derselben Haupttext-Extraktion ausgewertet. Kennzahlen und Grenzen erklärt.

Gerenderte Ansicht

Chromium mit JavaScript · 71 Wörter

Gerenderte Browseransicht von pnp.de
Wählen Sie Ihre Region: Top-Meldungen Echte Verbesserungen gefordert / Neuer Uniformtag: Rettungskräfte aus dem Landkreis Passau üben Kritik Echte Verbesserungen gefordert / Neuer Uniformtag: Rettungskräfte aus dem Landkreis Passau üben Kritik Video Meinung LeserbriefeHier haben unsere Leser das Wort KommentarZur geplanten Abschaffung des Altersteilzeit-Blockmodells: Wer zahlt, schafft an – oder? Christian Eckl StandpunktZum Anstieg der Baugenehmigungen: Politik mit Wirkung Thomas Vitzthum LeserbriefeHier haben unsere Leser das Wort Nachrichten aus Ihrer Region

MetozBot-Ansicht

Ohne JavaScript · 76 Wörter

Wählen Sie Ihre Region: Top-Meldungen Echte Verbesserungen gefordert / Neuer Uniformtag: Rettungskräfte aus dem Landkreis Passau üben Kritik Echte Verbesserungen gefordert / Neuer Uniformtag: Rettungskräfte aus dem Landkreis Passau üben Kritik Video Servus Niederbayern! Dein tägliches News-Update Meinung LeserbriefeHier haben unsere Leser das Wort StandpunktZum Anstieg der Baugenehmigungen: Politik mit Wirkung Thomas Vitzthum KommentarZur geplanten Abschaffung des Altersteilzeit-Blockmodells: Wer zahlt, schafft an – oder? Christian Eckl LeserbriefeHier haben unsere Leser das Wort Nachrichten aus Ihrer Region

Türsteher-Check

robots.txt regelt den erlaubten Zugriff. Ein „erlaubt“ beweist noch nicht, dass ein Dienst die Seite indexiert oder zitiert.

Suche und Quellenalle erlaubt
erlaubtOAI-SearchBotOpenAI

Ohne Zugriff kann ChatGPT die Seite nicht als Quelle für die Websuche nennen.

erlaubtClaude-SearchBotAnthropic

Ohne Zugriff kann Claude die Seite nicht über diesen Such-Crawler als Quelle erfassen.

erlaubtGooglebotGoogle

Ohne Zugriff kann die Seite in der Google-Suche fehlen; das ist keine reine KI-Einstellung.

erlaubtPerplexityBotPerplexity

Ohne Zugriff kann Perplexity die Seite nicht für seine Suchantworten indexieren.

erlaubtApplebotApple

Ohne Zugriff kann die Sichtbarkeit in Apple-Suchergebnissen eingeschränkt sein.

erlaubtFacebookBotMeta

Ohne Zugriff können Metas Abrufdienste die Seite nicht in ihren Produkten aufbereiten.

erlaubtYouBotYou.com

Ohne Zugriff kann You.com die Seite nicht über diesen Such-Crawler erfassen.

Nutzergesteuerte Abrufealle erlaubt
erlaubtChatGPT-UserOpenAI

Ohne Zugriff kann ChatGPT keine vom Nutzer ausgelösten Abrufe der Seite durchführen.

erlaubtClaude-UserAnthropic

Ohne Zugriff sind von Claude-Nutzern ausgelöste Abrufe eingeschränkt.

erlaubtPerplexity-UserPerplexity

Ohne Zugriff sind nutzergesteuerte Abrufe durch Perplexity eingeschränkt.

erlaubtMeta-ExternalFetcherMeta

Ohne Zugriff sind externe, von Meta ausgelöste Abrufe eingeschränkt.

Training und Datensätzealle erlaubt
erlaubtGPTBotOpenAI

Ohne Zugriff fließt der Inhalt nicht in das Training von OpenAI-Modellen ein.

erlaubtClaudeBotAnthropic

Ohne Zugriff kann Anthropic den Inhalt nicht mit diesem Crawler erfassen.

erlaubtGoogle-ExtendedGoogle

Ohne Zugriff darf Google den Inhalt nicht zur Verbesserung von Gemini und ähnlichen generativen APIs verwenden.

erlaubtAmazonbotAmazon

Ohne Zugriff kann Amazon den Inhalt nicht mit diesem KI-Crawler erfassen.

erlaubtApplebot-ExtendedApple

Ohne Zugriff kann Apple den Inhalt nicht für Apple-Intelligence-Dienste verwenden.

erlaubtCCBotCommon Crawl

Ohne Zugriff erscheint der Inhalt nicht im Common-Crawl-Datensatz, den viele Modelle nutzen.

erlaubtMeta-ExternalAgentMeta

Ohne Zugriff kann Meta den Inhalt nicht über diesen externen Agenten abrufen.

erlaubtBytespiderByteDance

Ohne Zugriff kann ByteDance den Inhalt nicht mit diesem Crawler erfassen.

erlaubtcohere-aiCohere

Ohne Zugriff kann Cohere den Inhalt nicht mit diesem Crawler erfassen.

erlaubtDiffbotDiffbot

Ohne Zugriff kann Diffbot die Seite nicht für seine Wissensdaten erfassen.

robots.txt: gefunden und ausgewertet

Messmethode und Grenzen

Die gerenderte Ansicht läuft in Chromium mit JavaScript und einem normalen Browser-User-Agent. Die Crawler-Ansicht nutzt einen separaten Abruf mit MetozBot/1.0 und führt kein JavaScript aus. Beide HTML-Fassungen durchlaufen Mozilla Readability.

Gleiche Wortzahlen sind deshalb möglich und meist positiv. Aussagekräftiger sind Crawler-Abdeckung, Inhaltsähnlichkeit und die abweichenden Passagen. A/B-Tests, Consent-Banner und zeitabhängige Inhalte können zwei Abrufe trotzdem beeinflussen.

Crawler-Abruf
19.08.2026, 18:10:48 · Hash 0a25485c395d
Browser-Abruf
19.08.2026, 18:11:12 · Hash 8cbe174b60a5
Crawler-Ziel
https://www.pnp.de/
Browser-Ziel
https://www.pnp.de/
KI-Crawler-Scan: pnp.de | metoz.de