metoz.de/ Gespeicherter Scan
kritisch

https://gmx.net/

Ein wesentlicher Teil des gerenderten Haupttexts fehlt dem Crawler

Die Crawler-Ansicht enthält deutlich weniger oder anderen Hauptinhalt als die gerenderte Ansicht. JavaScript, Bot-Auslieferung oder das Seiten-Markup können die Ursache sein.

Crawler-Abdeckung

0%

Anteil der Wörter aus dem gerenderten Haupttext, die auch der Crawler erhält.

Inhaltsähnlichkeit

0%

Vergleicht beide Texte unabhängig von reiner Wortzahl und erkennt gleich lange, aber andere Inhalte.

Wortdifferenz

−11 Wörter

−69% gegenüber der gerenderten Ansicht. Minus heißt: dem Crawler fehlen Wörter.

Metoz-Score

20/100

Lesbarkeit

0

Zugang

100

Zitierfähigkeit

0

40 % Crawler-Lesbarkeit, 20 % Zugang der Such- und Agenten-Bots, 40 % Beantwortbarkeit der sechs Zitat-Fragen.

Gespeicherten Scan öffnen

Report mitnehmen

Report per E-Mail erhalten

Wir schicken dir die wichtigsten Befunde und den Link zu diesem vollständigen Report.

Einmaliger Versand über Epostix, kein Newsletter und kein Öffnungs- oder Klicktracking. metoz.de speichert die E-Mail-Adresse nicht in der eigenen Datenbank. Mehr im Datenschutz.

Was jetzt?

Befunde und Empfehlungen

kritisch

Fehlende Inhalte serverseitig ausliefern

Befund: Die Crawler-Ansicht deckt 0% des gerenderten Haupttexts ab.

Folge: Fehlende Leistungen, Preise oder Kontaktdaten können von Such- und Antwortsystemen nicht zuverlässig verwendet werden.

Empfehlung: Die unten markierten Nur-Browser-Passagen in das initiale HTML aufnehmen und anschließend erneut scannen.

gut

KI-Suchzugang ist offen

Befund: Keiner der geprüften Such-Crawler wird für diese URL durch robots.txt blockiert.

Folge: Die robots.txt verhindert damit nicht, dass diese Dienste die Seite als Webquelle abrufen.

Empfehlung: Bot-Regeln bei Änderungen an der robots.txt erneut prüfen.

Block 3

Zitat-Test

Ein Modell hat ausschließlich den crawler-sichtbaren Text mit sechs immer gleichen Fragen geprüft. Das Ergebnis misst Beantwortbarkeit, nicht eine spätere Nennung in einem konkreten KI-Dienst.

Was macht dieses Unternehmen oder diese Organisation?

nicht beantwortbar

not_answerable

Für wen ist das Angebot bestimmt?

nicht beantwortbar

not_answerable

Was kostet das Angebot?

nicht beantwortbar

not_answerable

Wo sitzt das Unternehmen oder die Organisation?

nicht beantwortbar

not_answerable

Wie kann man Kontakt aufnehmen?

nicht beantwortbar

not_answerable

Warum sollte man dieses Angebot statt einer Alternative wählen?

nicht beantwortbar

not_answerable

Modell: @cf/meta/llama-3.1-8b-instruct-fast · Kontext: 5 Token

Wo sich die Inhalte unterscheiden

Beispielpassagen mit geringer Wortüberschneidung. Sie zeigen Prüfstellen, nicht automatisch einen Fehler.

Nur in der gerenderten Ansicht

  • Leider konnten wir die Einstellungen für Privatsphäre & Datenschutz nicht laden.

Nur in der Crawler-Ansicht

Keine deutliche Nur-Crawler-Passage gefunden.

Die Doppelansicht

Beide Ansichten werden getrennt abgerufen und anschließend mit derselben Haupttext-Extraktion ausgewertet. Kennzahlen und Grenzen erklärt.

Gerenderte Ansicht

Chromium mit JavaScript · 16 Wörter

Gerenderte Browseransicht von gmx.net
Es ist ein Fehler aufgetreten. Leider konnten wir die Einstellungen für Privatsphäre & Datenschutz nicht laden.

MetozBot-Ansicht

Ohne JavaScript · 5 Wörter

Das könnte Sie auch interessieren

Türsteher-Check

robots.txt regelt den erlaubten Zugriff. Ein „erlaubt“ beweist noch nicht, dass ein Dienst die Seite indexiert oder zitiert.

Suche und Quellenalle erlaubt
erlaubtOAI-SearchBotOpenAI

Ohne Zugriff kann ChatGPT die Seite nicht als Quelle für die Websuche nennen.

erlaubtClaude-SearchBotAnthropic

Ohne Zugriff kann Claude die Seite nicht über diesen Such-Crawler als Quelle erfassen.

erlaubtGooglebotGoogle

Ohne Zugriff kann die Seite in der Google-Suche fehlen; das ist keine reine KI-Einstellung.

erlaubtPerplexityBotPerplexity

Ohne Zugriff kann Perplexity die Seite nicht für seine Suchantworten indexieren.

erlaubtApplebotApple

Ohne Zugriff kann die Sichtbarkeit in Apple-Suchergebnissen eingeschränkt sein.

erlaubtFacebookBotMeta

Ohne Zugriff können Metas Abrufdienste die Seite nicht in ihren Produkten aufbereiten.

erlaubtYouBotYou.com

Ohne Zugriff kann You.com die Seite nicht über diesen Such-Crawler erfassen.

Nutzergesteuerte Abrufealle erlaubt
erlaubtChatGPT-UserOpenAI

Ohne Zugriff kann ChatGPT keine vom Nutzer ausgelösten Abrufe der Seite durchführen.

erlaubtClaude-UserAnthropic

Ohne Zugriff sind von Claude-Nutzern ausgelöste Abrufe eingeschränkt.

erlaubtPerplexity-UserPerplexity

Ohne Zugriff sind nutzergesteuerte Abrufe durch Perplexity eingeschränkt.

erlaubtMeta-ExternalFetcherMeta

Ohne Zugriff sind externe, von Meta ausgelöste Abrufe eingeschränkt.

Training und Datensätzealle erlaubt
erlaubtGPTBotOpenAI

Ohne Zugriff fließt der Inhalt nicht in das Training von OpenAI-Modellen ein.

erlaubtClaudeBotAnthropic

Ohne Zugriff kann Anthropic den Inhalt nicht mit diesem Crawler erfassen.

erlaubtGoogle-ExtendedGoogle

Ohne Zugriff darf Google den Inhalt nicht zur Verbesserung von Gemini und ähnlichen generativen APIs verwenden.

erlaubtAmazonbotAmazon

Ohne Zugriff kann Amazon den Inhalt nicht mit diesem KI-Crawler erfassen.

erlaubtApplebot-ExtendedApple

Ohne Zugriff kann Apple den Inhalt nicht für Apple-Intelligence-Dienste verwenden.

erlaubtCCBotCommon Crawl

Ohne Zugriff erscheint der Inhalt nicht im Common-Crawl-Datensatz, den viele Modelle nutzen.

erlaubtMeta-ExternalAgentMeta

Ohne Zugriff kann Meta den Inhalt nicht über diesen externen Agenten abrufen.

erlaubtBytespiderByteDance

Ohne Zugriff kann ByteDance den Inhalt nicht mit diesem Crawler erfassen.

erlaubtcohere-aiCohere

Ohne Zugriff kann Cohere den Inhalt nicht mit diesem Crawler erfassen.

erlaubtDiffbotDiffbot

Ohne Zugriff kann Diffbot die Seite nicht für seine Wissensdaten erfassen.

robots.txt: gefunden und ausgewertet

Messmethode und Grenzen

Die gerenderte Ansicht läuft in Chromium mit JavaScript und einem normalen Browser-User-Agent. Die Crawler-Ansicht nutzt einen separaten Abruf mit MetozBot/1.0 und führt kein JavaScript aus. Beide HTML-Fassungen durchlaufen Mozilla Readability.

Gleiche Wortzahlen sind deshalb möglich und meist positiv. Aussagekräftiger sind Crawler-Abdeckung, Inhaltsähnlichkeit und die abweichenden Passagen. A/B-Tests, Consent-Banner und zeitabhängige Inhalte können zwei Abrufe trotzdem beeinflussen.

Crawler-Abruf
19.08.2026, 18:03:22 · Hash bc02942bcec3
Browser-Abruf
19.08.2026, 18:03:29 · Hash c4e1da67ee74
Crawler-Ziel
https://www.gmx.net/
Browser-Ziel
https://www.gmx.net/
KI-Crawler-Scan: gmx.net | metoz.de