metoz.de/ Gespeicherter Scan
kritisch

https://ard.de/

Ein wesentlicher Teil des gerenderten Haupttexts fehlt dem Crawler

Die Crawler-Ansicht enthält deutlich weniger oder anderen Hauptinhalt als die gerenderte Ansicht. JavaScript, Bot-Auslieferung oder das Seiten-Markup können die Ursache sein.

Crawler-Abdeckung

48%

Anteil der Wörter aus dem gerenderten Haupttext, die auch der Crawler erhält.

Inhaltsähnlichkeit

65%

Vergleicht beide Texte unabhängig von reiner Wortzahl und erkennt gleich lange, aber andere Inhalte.

Wortdifferenz

−117 Wörter

−58% gegenüber der gerenderten Ansicht. Minus heißt: dem Crawler fehlen Wörter.

Metoz-Score

56/100

Lesbarkeit

57

Zugang

100

Zitierfähigkeit

33

40 % Crawler-Lesbarkeit, 20 % Zugang der Such- und Agenten-Bots, 40 % Beantwortbarkeit der sechs Zitat-Fragen.

Gespeicherten Scan öffnen

Report mitnehmen

Report per E-Mail erhalten

Wir schicken dir die wichtigsten Befunde und den Link zu diesem vollständigen Report.

Einmaliger Versand über Epostix, kein Newsletter und kein Öffnungs- oder Klicktracking. metoz.de speichert die E-Mail-Adresse nicht in der eigenen Datenbank. Mehr im Datenschutz.

Was jetzt?

Befunde und Empfehlungen

kritisch

Fehlende Inhalte serverseitig ausliefern

Befund: Die Crawler-Ansicht deckt 48% des gerenderten Haupttexts ab.

Folge: Fehlende Leistungen, Preise oder Kontaktdaten können von Such- und Antwortsystemen nicht zuverlässig verwendet werden.

Empfehlung: Die unten markierten Nur-Browser-Passagen in das initiale HTML aufnehmen und anschließend erneut scannen.

gut

KI-Suchzugang ist offen

Befund: Keiner der geprüften Such-Crawler wird für diese URL durch robots.txt blockiert.

Folge: Die robots.txt verhindert damit nicht, dass diese Dienste die Seite als Webquelle abrufen.

Empfehlung: Bot-Regeln bei Änderungen an der robots.txt erneut prüfen.

Block 3

Zitat-Test

Ein Modell hat ausschließlich den crawler-sichtbaren Text mit sechs immer gleichen Fragen geprüft. Das Ergebnis misst Beantwortbarkeit, nicht eine spätere Nennung in einem konkreten KI-Dienst.

Was macht dieses Unternehmen oder diese Organisation?

teilweise

Das Unternehmen oder die Organisation ist die ARD, die eine Vielzahl von Angeboten anbietet.

Für wen ist das Angebot bestimmt?

teilweise

Das Angebot ist für alle bestimmt, die die Angebote der ARD nutzen möchten.

Was kostet das Angebot?

nicht beantwortbar

status: not_answerable

Wo sitzt das Unternehmen oder die Organisation?

teilweise

Die ARD hat ihren Hauptsitz in Deutschland.

Wie kann man Kontakt aufnehmen?

teilweise

Man kann Kontakt aufnehmen über die ARD-Hilfeseite (hilfe.ard.de) oder über die ARD-Pressemeldungen (ard.de/presse).

Warum sollte man dieses Angebot statt einer Alternative wählen?

nicht beantwortbar

status: not_answerable

Modell: @cf/meta/llama-3.1-8b-instruct-fast · Kontext: 86 Token

Die Doppelansicht

Beide Ansichten werden getrennt abgerufen und anschließend mit derselben Haupttext-Extraktion ausgewertet. Kennzahlen und Grenzen erklärt.

Gerenderte Ansicht

Chromium mit JavaScript · 203 Wörter

Gerenderte Browseransicht von ard.de
ARD Mediathek – Das Beste der ARD streamen, jederzeit und überallardmediathektagesschau – Die erste Adresse für Nachrichten und InformationtagesschauSportschau – aktuell und hintergründig, alles zum SportsportschauARD Sounds – Podcasts, Hörspiele und Live-RadioardsoundsKiKA – Das Beste für Kinderkika Ein ARD-Konto für alle Mit dem ARD-Konto können Sie unsere Angebote noch bequemer nutzen.ARD Mediathek, tagesschau, Sportschau und ARD Sounds: accounts.ard.de mehr Die ARD Hier finden Sie umfassende Informationen zu Organisation, Aufgaben und Kontaktmöglichkeiten der ARD sowie aktuelle ARD-Pressemeldungen: ard.de/die-ard mehr Das ist die ARDKarriere in der ARDAufgaben und Leistungen der ARDProgramm für allePublic Value: Unser Beitrag zum Gemeinwohl ARD-Pressemeldungen Nachfolgend finden Sie einige aktuelle ARD-Pressemeldungen. Eine umfassende Übersicht und die Kontaktdaten der ARD-Kommunikation finden Sie hier: ard.de/presse mehr PressemeldungARD Schlagerwelt: Neue digitale Heimat für Schlagerfans in ARD SoundsPressemeldungma 2026 Audio II: ARD punktet mit RegionalitätPressemeldungBremer Fernseh- und Digitalpreis 2026 ausgeschriebenPressemeldungSave The Date: Jugendmedientag von ARD, ZDF und Deutschlandfunk am 12. November 2026PressemeldungARD Radiofestival und 3satFestspielsommer starten in die Festivalsaison 2026PressemeldungKI und Diversität – ARD und ZDF diskutieren auf der re:publica 2026 über gerechte KI in einer vielfältigen DemokratiePresseservice der ARD-Kommunikation ARD-Hilfeseite Über unsere ARD-Hilfeseite können Sie direkt mit uns in Kontakt treten. Außerdem finden Sie hier Antworten auf häufige Fragen und technische Unterstützung: hilfe.ard.de mehr

MetozBot-Ansicht

Ohne JavaScript · 86 Wörter

Ein ARD-Konto für alle Mit dem ARD-Konto können Sie unsere Angebote noch bequemer nutzen.ARD Mediathek, tagesschau, Sportschau und ARD Sounds: accounts.ard.de mehr Die ARD Hier finden Sie umfassende Informationen zu Organisation, Aufgaben und Kontaktmöglichkeiten der ARD sowie aktuelle ARD-Pressemeldungen: ard.de/die-ard mehr ARD-Pressemeldungen Nachfolgend finden Sie einige aktuelle ARD-Pressemeldungen. Eine umfassende Übersicht und die Kontaktdaten der ARD-Kommunikation finden Sie hier: ard.de/presse mehr ARD-Hilfeseite Über unsere ARD-Hilfeseite können Sie direkt mit uns in Kontakt treten. Außerdem finden Sie hier Antworten auf häufige Fragen und technische Unterstützung: hilfe.ard.de mehr

Türsteher-Check

robots.txt regelt den erlaubten Zugriff. Ein „erlaubt“ beweist noch nicht, dass ein Dienst die Seite indexiert oder zitiert.

Suche und Quellenalle erlaubt
erlaubtOAI-SearchBotOpenAI

Ohne Zugriff kann ChatGPT die Seite nicht als Quelle für die Websuche nennen.

erlaubtClaude-SearchBotAnthropic

Ohne Zugriff kann Claude die Seite nicht über diesen Such-Crawler als Quelle erfassen.

erlaubtGooglebotGoogle

Ohne Zugriff kann die Seite in der Google-Suche fehlen; das ist keine reine KI-Einstellung.

erlaubtPerplexityBotPerplexity

Ohne Zugriff kann Perplexity die Seite nicht für seine Suchantworten indexieren.

erlaubtApplebotApple

Ohne Zugriff kann die Sichtbarkeit in Apple-Suchergebnissen eingeschränkt sein.

erlaubtFacebookBotMeta

Ohne Zugriff können Metas Abrufdienste die Seite nicht in ihren Produkten aufbereiten.

erlaubtYouBotYou.com

Ohne Zugriff kann You.com die Seite nicht über diesen Such-Crawler erfassen.

Nutzergesteuerte Abrufealle erlaubt
erlaubtChatGPT-UserOpenAI

Ohne Zugriff kann ChatGPT keine vom Nutzer ausgelösten Abrufe der Seite durchführen.

erlaubtClaude-UserAnthropic

Ohne Zugriff sind von Claude-Nutzern ausgelöste Abrufe eingeschränkt.

erlaubtPerplexity-UserPerplexity

Ohne Zugriff sind nutzergesteuerte Abrufe durch Perplexity eingeschränkt.

erlaubtMeta-ExternalFetcherMeta

Ohne Zugriff sind externe, von Meta ausgelöste Abrufe eingeschränkt.

Training und Datensätzealle erlaubt
erlaubtGPTBotOpenAI

Ohne Zugriff fließt der Inhalt nicht in das Training von OpenAI-Modellen ein.

erlaubtClaudeBotAnthropic

Ohne Zugriff kann Anthropic den Inhalt nicht mit diesem Crawler erfassen.

erlaubtGoogle-ExtendedGoogle

Ohne Zugriff darf Google den Inhalt nicht zur Verbesserung von Gemini und ähnlichen generativen APIs verwenden.

erlaubtAmazonbotAmazon

Ohne Zugriff kann Amazon den Inhalt nicht mit diesem KI-Crawler erfassen.

erlaubtApplebot-ExtendedApple

Ohne Zugriff kann Apple den Inhalt nicht für Apple-Intelligence-Dienste verwenden.

erlaubtCCBotCommon Crawl

Ohne Zugriff erscheint der Inhalt nicht im Common-Crawl-Datensatz, den viele Modelle nutzen.

erlaubtMeta-ExternalAgentMeta

Ohne Zugriff kann Meta den Inhalt nicht über diesen externen Agenten abrufen.

erlaubtBytespiderByteDance

Ohne Zugriff kann ByteDance den Inhalt nicht mit diesem Crawler erfassen.

erlaubtcohere-aiCohere

Ohne Zugriff kann Cohere den Inhalt nicht mit diesem Crawler erfassen.

erlaubtDiffbotDiffbot

Ohne Zugriff kann Diffbot die Seite nicht für seine Wissensdaten erfassen.

robots.txt: gefunden und ausgewertet

Messmethode und Grenzen

Die gerenderte Ansicht läuft in Chromium mit JavaScript und einem normalen Browser-User-Agent. Die Crawler-Ansicht nutzt einen separaten Abruf mit MetozBot/1.0 und führt kein JavaScript aus. Beide HTML-Fassungen durchlaufen Mozilla Readability.

Gleiche Wortzahlen sind deshalb möglich und meist positiv. Aussagekräftiger sind Crawler-Abdeckung, Inhaltsähnlichkeit und die abweichenden Passagen. A/B-Tests, Consent-Banner und zeitabhängige Inhalte können zwei Abrufe trotzdem beeinflussen.

Crawler-Abruf
19.08.2026, 17:58:56 · Hash 0e198eb87ebb
Browser-Abruf
19.08.2026, 17:59:02 · Hash 27373f60a9c4
Crawler-Ziel
https://www.ard.de/
Browser-Ziel
https://www.ard.de/
KI-Crawler-Scan: ard.de | metoz.de