„5 Sterne sind absolut verdient!Von der ersten Idee bis zur fertigen Website hat alles gepasst. Das Team arbeitet kreativ, modern und mit einem richtig guten Gespür für Design und Markenauftritt. Unsere Website für Running Late ist jung, frisch und genau so geworden, wie wir sie uns vorgestellt haben.Besonders überzeugt hat uns die schnelle Kommunikation, die Zuverlässigkeit und die Fähigkeit, eigene Ideen einzubringen und gleichzeitig unsere Wünsche perfekt umzusetzen.Wer eine Webagentur sucht, die nicht nur schöne Webseiten gestaltet, sondern auch mitdenkt und individuelle Lösungen entwickelt, ist hier genau richtig. Vielen Dank für die tolle Zusammenarbeit. Wir freuen uns schon auf die nächsten gemeinsamen Projekte!“
Damit eine Seite bei Google erscheinen kann, muss sie zwei Schritte durchlaufen: erst gecrawlt, dann indexiert werden. Wer versteht, wie dieser Prozess funktioniert, kann gezielt eingreifen, und verhindern, dass wichtige Seiten unsichtbar bleiben.
Kostenloses Werkzeug
Mit dem KI-Sichtbarkeits-Check von onlinewachsen.de lässt sich kostenlos und ohne Anmeldung prüfen, ob ChatGPT, Gemini, Claude und Perplexity ein Unternehmen nennen und richtig beschreiben. Eine E-Mail wird nur verschickt, wenn man sie ausdrücklich anfordert.
Zum KI-Sichtbarkeits-CheckWie funktioniert der Prozess?
Crawling und Indexierung laufen in klar definierten Phasen ab. Schlägt eine Phase fehl, ist die Seite für Google unsichtbar, unabhängig davon, wie gut der Inhalt ist.
Googlebot findet neue URLs über Links von bereits bekannten Seiten, über Sitemaps oder über die Google Search Console. Seiten ohne eingehende Links werden oft gar nicht gefunden.
Der Googlebot ruft die Seite ab und liest HTML, Text, Bilder und Links ein. Dabei prüft er auch robots.txt und Meta-Robots-Tags, steht dort „Disallow" oder „noindex", bricht er ab.
Google analysiert den Inhalt, erkennt Struktur, Thema und Qualität der Seite. JavaScript-Inhalte werden verzögert gerendert. Das kann die Indexierung verlangsamen.
Wenn die Seite die Qualitätsanforderungen erfüllt, wird sie in den Google-Index aufgenommen. Erst ab diesem Punkt kann sie bei passenden Suchanfragen erscheinen.
Indexierte Seiten werden gegen tausende Rankingfaktoren bewertet und für relevante Suchanfragen positioniert. Crawling und Indexierung sind die Voraussetzung. Das Ranking ist das Ergebnis.
robots.txt und Meta-Robots
Mit zwei Mechanismen kann kontrolliert werden, was Google crawlen und indexieren darf. Das ist wichtig, um Crawl-Budget nicht auf unwichtige Seiten zu verschwenden.
# Alle Crawler erlaubt User-agent: * Allow: / # Bestimmte Verzeichnisse sperren Disallow: /wp-admin/ Disallow: /danke/ Disallow: /checkout/ # Sitemap angeben Sitemap: https://example.de/sitemap.xml
<!-- Seite indexieren, Links folgen (Standard) --> <meta name="robots" content="index, follow"> <!-- Seite NICHT indexieren --> <meta name="robots" content="noindex, nofollow">
Crawl-Budget: Was steckt dahinter?
Google crawlt nicht jede Seite täglich. Jede Website hat ein Crawl-Budget, die Anzahl der Seiten, die Googlebot in einem bestimmten Zeitraum besucht. Auf großen Websites kann ineffizienter Einsatz des Crawl-Budgets dazu führen, dass wichtige Seiten seltener aktualisiert oder neue Inhalte verzögert indexiert werden.
- Unendlich viele URL-Parameter (/shop?sort=preis&filter=rot)
- Doppelte Inhalte ohne Canonical-Tag
- Archivseiten, Tag-Seiten und Paginierung ohne Mehrwert
- Weiterleitungsketten (301 → 301 → 301)
- Kaputte interne Links (404-Seiten)
- Unwichtige Seiten per robots.txt sperren
- Canonical-Tags korrekt einsetzen
- XML-Sitemap aktuell halten
- Schnelle Ladezeiten (Googlebot wartet nicht lange)
- Klare interne Verlinkung zu wichtigen Seiten
Crawling überwachen und prüfen
Diese Tools helfen dabei zu verstehen, wie Google die eigene Website sieht, und wo Probleme beim Crawling oder der Indexierung entstehen:
So wird die eigene Website schneller indexiert
- Sitemap einreichen: In der Google Search Console eine XML-Sitemap hinterlegen und aktuell halten
- Interne Verlinkung stärken: Neue Seiten von bestehenden, gut verlinkten Seiten aus verlinken
- URL-Prüfung nutzen: In der Search Console neue URLs manuell zur Indexierung anfordern
- Ladezeiten optimieren: Schnelle Seiten werden öfter und tiefer gecrawlt
- noindex entfernen: Häufiger Fehler: Seite ist versehentlich auf noindex gesetzt
- Robots.txt prüfen: Wichtige Verzeichnisse nicht aus Versehen blockiert?
Häufige Fragen zu Crawling
Das variiert stark, von wenigen Stunden bis zu mehreren Wochen. Faktoren sind die Domain-Autorität, die Verlinkung der neuen Seite und ob eine Sitemap eingereicht wurde. Über die Search Console (URL-Prüfung → Indexierung beantragen) kann der Prozess beschleunigt werden.
Ja. Das passiert häufig. Gründe: ein noindex-Tag, dünner oder doppelter Inhalt, Qualitätsprobleme oder ein Canonical, der auf eine andere URL zeigt. Die Search Console zeigt unter „Seiten" genau an, warum eine Seite nicht indexiert wurde.
Googlebot crawlt die Seite nicht, kann sie aber trotzdem im Index behalten, wenn andere Seiten darauf verlinken. Um sicherzustellen, dass eine Seite weder gecrawlt noch indexiert wird, braucht man beides: robots.txt-Sperre UND noindex-Meta-Tag.
Bei kleinen Websites unter einigen hundert Seiten ist Crawl-Budget selten ein Problem: Google indexiert diese in der Regel vollständig. Relevant wird es ab einigen tausend Seiten, etwa bei Online-Shops mit vielen Filterkombinationen oder großen Nachrichtenportalen.
Verwandte Begriffe
- Crawling & IndexierungCrawling bezeichnet den Prozess, bei dem Googles automatisierte Programme (Crawler, auch „Googlebot" genannt) das Web nach Seiten…
- KeywordsEin Keyword ist ein Wort oder eine Wortgruppe, für die eine Seite in Suchmaschinen gefunden werden soll, etwa ein typischer Suchbegriff der…
- Structured DataStructured Data (strukturierte Daten) ist maschinenlesbarer Code, der im Quelltext einer Seite hinterlegt wird und Suchmaschinen erklärt…
- Robots.txtDie robots.txt ist eine einfache Textdatei, die im Wurzelverzeichnis einer Website liegt (erreichbar unter beispiel.de/robots.txt ).
Zuletzt fachlich geprüft am