metoz.de/ Gespeicherter Scan
gut

https://gala.de/

Der Haupttext ist ohne JavaScript nahezu vollständig lesbar

Gleiche Wortzahlen sind hier ein gutes Ergebnis: Die Ansichten wurden getrennt abgerufen und enthalten nach derselben Extraktion praktisch denselben Inhalt.

Crawler-Abdeckung

100%

Anteil der Wörter aus dem gerenderten Haupttext, die auch der Crawler erhält.

Inhaltsähnlichkeit

100%

Vergleicht beide Texte unabhängig von reiner Wortzahl und erkennt gleich lange, aber andere Inhalte.

Wortdifferenz

0 Wörter

0% gegenüber der gerenderten Ansicht. Minus heißt: dem Crawler fehlen Wörter.

Metoz-Score

60/100

Lesbarkeit

100

Zugang

100

Zitierfähigkeit

0

40 % Crawler-Lesbarkeit, 20 % Zugang der Such- und Agenten-Bots, 40 % Beantwortbarkeit der sechs Zitat-Fragen.

Gespeicherten Scan öffnen

Report mitnehmen

Report per E-Mail erhalten

Wir schicken dir die wichtigsten Befunde und den Link zu diesem vollständigen Report.

Einmaliger Versand über Epostix, kein Newsletter und kein Öffnungs- oder Klicktracking. metoz.de speichert die E-Mail-Adresse nicht in der eigenen Datenbank. Mehr im Datenschutz.

Was jetzt?

Befunde und Empfehlungen

gut

Crawler-Lesbarkeit beibehalten

Befund: 100% des gerenderten Haupttexts sind in der Crawler-Ansicht wiederzufinden.

Folge: Wichtige Aussagen sind nicht von JavaScript abhängig.

Empfehlung: Nach größeren Änderungen an Rendering oder CMS erneut scannen.

gut

KI-Suchzugang ist offen

Befund: Keiner der geprüften Such-Crawler wird für diese URL durch robots.txt blockiert.

Folge: Die robots.txt verhindert damit nicht, dass diese Dienste die Seite als Webquelle abrufen.

Empfehlung: Bot-Regeln bei Änderungen an der robots.txt erneut prüfen.

Block 3

Zitat-Test

Ein Modell hat ausschließlich den crawler-sichtbaren Text mit sechs immer gleichen Fragen geprüft. Das Ergebnis misst Beantwortbarkeit, nicht eine spätere Nennung in einem konkreten KI-Dienst.

Was macht dieses Unternehmen oder diese Organisation?

nicht beantwortbar

not_answerable

Für wen ist das Angebot bestimmt?

nicht beantwortbar

not_answerable

Was kostet das Angebot?

nicht beantwortbar

not_answerable

Wo sitzt das Unternehmen oder die Organisation?

nicht beantwortbar

not_answerable

Wie kann man Kontakt aufnehmen?

nicht beantwortbar

not_answerable

Warum sollte man dieses Angebot statt einer Alternative wählen?

nicht beantwortbar

not_answerable

Modell: @cf/meta/llama-3.1-8b-instruct-fast · Kontext: 18 Token

Die Doppelansicht

Beide Ansichten werden getrennt abgerufen und anschließend mit derselben Haupttext-Extraktion ausgewertet. Kennzahlen und Grenzen erklärt.

Gerenderte Ansicht

Chromium mit JavaScript · 18 Wörter

Gerenderte Browseransicht von gala.de
Anzeige Anzeige Anzeige Anzeige Anzeige Anzeige Anzeige Anzeige Anzeige Anzeige Anzeige Anzeige Anzeige Anzeige Anzeige Inhalte im Überblick

MetozBot-Ansicht

Ohne JavaScript · 18 Wörter

Anzeige Anzeige Anzeige Anzeige Anzeige Anzeige Anzeige Anzeige Anzeige Anzeige Anzeige Anzeige Anzeige Anzeige Anzeige Inhalte im Überblick

Türsteher-Check

robots.txt regelt den erlaubten Zugriff. Ein „erlaubt“ beweist noch nicht, dass ein Dienst die Seite indexiert oder zitiert.

Suche und Quellenalle erlaubt
erlaubtOAI-SearchBotOpenAI

Ohne Zugriff kann ChatGPT die Seite nicht als Quelle für die Websuche nennen.

erlaubtClaude-SearchBotAnthropic

Ohne Zugriff kann Claude die Seite nicht über diesen Such-Crawler als Quelle erfassen.

erlaubtGooglebotGoogle

Ohne Zugriff kann die Seite in der Google-Suche fehlen; das ist keine reine KI-Einstellung.

erlaubtPerplexityBotPerplexity

Ohne Zugriff kann Perplexity die Seite nicht für seine Suchantworten indexieren.

erlaubtApplebotApple

Ohne Zugriff kann die Sichtbarkeit in Apple-Suchergebnissen eingeschränkt sein.

erlaubtFacebookBotMeta

Ohne Zugriff können Metas Abrufdienste die Seite nicht in ihren Produkten aufbereiten.

erlaubtYouBotYou.com

Ohne Zugriff kann You.com die Seite nicht über diesen Such-Crawler erfassen.

Nutzergesteuerte Abrufealle erlaubt
erlaubtChatGPT-UserOpenAI

Ohne Zugriff kann ChatGPT keine vom Nutzer ausgelösten Abrufe der Seite durchführen.

erlaubtClaude-UserAnthropic

Ohne Zugriff sind von Claude-Nutzern ausgelöste Abrufe eingeschränkt.

erlaubtPerplexity-UserPerplexity

Ohne Zugriff sind nutzergesteuerte Abrufe durch Perplexity eingeschränkt.

erlaubtMeta-ExternalFetcherMeta

Ohne Zugriff sind externe, von Meta ausgelöste Abrufe eingeschränkt.

Training und Datensätzealle erlaubt
erlaubtGPTBotOpenAI

Ohne Zugriff fließt der Inhalt nicht in das Training von OpenAI-Modellen ein.

erlaubtClaudeBotAnthropic

Ohne Zugriff kann Anthropic den Inhalt nicht mit diesem Crawler erfassen.

erlaubtGoogle-ExtendedGoogle

Ohne Zugriff darf Google den Inhalt nicht zur Verbesserung von Gemini und ähnlichen generativen APIs verwenden.

erlaubtAmazonbotAmazon

Ohne Zugriff kann Amazon den Inhalt nicht mit diesem KI-Crawler erfassen.

erlaubtApplebot-ExtendedApple

Ohne Zugriff kann Apple den Inhalt nicht für Apple-Intelligence-Dienste verwenden.

erlaubtCCBotCommon Crawl

Ohne Zugriff erscheint der Inhalt nicht im Common-Crawl-Datensatz, den viele Modelle nutzen.

erlaubtMeta-ExternalAgentMeta

Ohne Zugriff kann Meta den Inhalt nicht über diesen externen Agenten abrufen.

erlaubtBytespiderByteDance

Ohne Zugriff kann ByteDance den Inhalt nicht mit diesem Crawler erfassen.

erlaubtcohere-aiCohere

Ohne Zugriff kann Cohere den Inhalt nicht mit diesem Crawler erfassen.

erlaubtDiffbotDiffbot

Ohne Zugriff kann Diffbot die Seite nicht für seine Wissensdaten erfassen.

robots.txt: gefunden und ausgewertet

Messmethode und Grenzen

Die gerenderte Ansicht läuft in Chromium mit JavaScript und einem normalen Browser-User-Agent. Die Crawler-Ansicht nutzt einen separaten Abruf mit MetozBot/1.0 und führt kein JavaScript aus. Beide HTML-Fassungen durchlaufen Mozilla Readability.

Gleiche Wortzahlen sind deshalb möglich und meist positiv. Aussagekräftiger sind Crawler-Abdeckung, Inhaltsähnlichkeit und die abweichenden Passagen. A/B-Tests, Consent-Banner und zeitabhängige Inhalte können zwei Abrufe trotzdem beeinflussen.

Crawler-Abruf
19.08.2026, 17:54:59 · Hash ba8d676178ca
Browser-Abruf
19.08.2026, 17:55:04 · Hash ba8d676178ca
Crawler-Ziel
https://www.gala.de/
Browser-Ziel
https://www.gala.de/
KI-Crawler-Scan: gala.de | metoz.de