Indexierung & Crawling

Crawling: wie Suchmaschinen Webseiten entdecken

Crawling ist der Prozess, bei dem Suchmaschinen-Bots URLs aufrufen, Links folgen und Inhalte erfassen. Ohne Crawling kann eine Seite nicht zuverlässig indexiert werden. Deshalb sind interne Verlinkung, Statuscodes, robots.txt, Sitemaps und Serverstabilität wichtige Bestandteile technischer SEO.

SEO WikiAktualisiert: 01.09.2026Lesedauer: ca. 7 Min.

Crawling beschreibt das Abrufen von URLs durch Suchmaschinen-Bots. Es ist die Grundlage für Indexierung und spätere Rankings.

Kurzfassung und SEO-Einordnung

1

Crawling ist nicht dasselbe wie Indexierung.

2

Bots brauchen erreichbare URLs, klare interne Links und konsistente technische Signale.

3

Große Websites sollten Crawling gezielt steuern, damit wichtige Seiten Priorität bekommen.

Wodurch wird Crawling beeinflusst?

  • interne Linkstruktur
  • XML-Sitemaps
  • robots.txt und noindex-Signale
  • Serverantwortzeiten und Fehlercodes
  • URL-Parameter, Filter und Duplikate

Crawling vs. Indexierung

  • Crawling bedeutet: eine URL wurde abgerufen.
  • Indexierung bedeutet: eine URL kann im Suchindex erscheinen.
  • Eine gecrawlte Seite kann trotzdem ausgeschlossen, kanonisiert oder als wenig relevant bewertet werden.

Audit-Fragen

  • Sind wichtige Seiten intern verlinkt?
  • Blockiert robots.txt versehentlich relevante Bereiche?
  • Gibt es viele 404-, 5xx- oder Redirect-Ketten?
  • Sind Sitemaps aktuell und sauber?
Auffindbarkeit

Crawling entscheidet, welche URLs Suchmaschinen überhaupt sehen

Beim Crawling folgen Suchmaschinen Links, Sitemaps und bekannten URLs, um Inhalte zu entdecken oder erneut zu prüfen. Eine Seite kann inhaltlich stark sein und trotzdem kaum Wirkung entfalten, wenn sie intern schlecht verlinkt ist, in endlosen Filterpfaden verschwindet oder durch Robots-Regeln und Statuscodes uneindeutige Signale sendet.

Besonders bei größeren Websites ist Crawling eine Priorisierungsfrage. Bots haben nicht unendlich viel Zeit für jede Domain. Wenn viele Parameterseiten, Kalenderpfade, interne Suchseiten oder Weiterleitungsketten erreichbar sind, kann Aufmerksamkeit von wichtigen Kategorien, Ratgebern oder Produktseiten abgezogen werden.

Was Crawling in der Praxis bremst

BremseWoran man sie erkenntSinnvolle Reaktion
Robots.txt blockiert wichtige BereicheCrawler dürfen zentrale Pfade nicht abrufenRegeln gegen Indexierungsziel und Sitemaps abgleichen
Redirect-KettenBots erreichen Zielseiten erst nach mehreren SprüngenWeiterleitungen direkt auf finale URLs führen
Orphan PagesURLs existieren, sind aber intern kaum verlinktkontextuelle Links aus Hubs, Kategorien oder Ratgebern einbauen
Parameter- und FilterflutCrawler finden viele ähnliche VariantenCrawlbare Muster begrenzen und Canonicals prüfen
JavaScript-Links ohne HTML-Fallbackwichtige Wege sind im Roh-HTML nicht sichtbarnavigationelle Links serverseitig oder im HTML verfügbar machen

Crawling-Audit für wichtige Seitentypen

1

Seed-Liste definieren

Startseite, Hubs, Kategorien, Produktseiten, Wiki, Tools und umsatznahe Seiten in eine Prüfliste aufnehmen.

2

Interne Pfade crawlen

Tiefe, Klickdistanz, Statuscodes, Canonicals, Noindex und interne Linkanzahl erfassen.

3

Sitemap vergleichen

Prüfen, ob Sitemaps nur finale, indexierbare und strategisch wichtige URLs enthalten.

4

Serverdaten einbeziehen

Wenn möglich Logfiles oder Bot-Zugriffe nutzen, um echte Crawl-Aktivität von theoretischen Pfaden zu trennen.

Woran gute Crawling-Steuerung erkennbar ist

  • Wichtige Seiten sind mit wenigen Klicks erreichbar und werden von mehreren relevanten Kontexten verlinkt.
  • Unwichtige Varianten, interne Suche und technische Duplikate verschwenden keine Crawl-Aufmerksamkeit.
  • Sitemaps, Canonicals, Statuscodes und interne Links zeigen auf dieselben finalen URLs.
  • Nach Relaunches werden alte URL-Muster aktiv überwacht, statt nur neue Seiten zu prüfen.

Verwandte Wiki-Begriffe

Direkt prüfen

Nutzen Sie die passenden Seitenreport-Tools, um das Thema nicht nur theoretisch zu verstehen, sondern an konkreten URLs zu überprüfen.

FAQ zu Crawling

Kann eine Seite ranken, wenn sie nicht gecrawlt wird?

Nein. Suchmaschinen müssen eine URL zunächst erreichen und verarbeiten können, bevor sie sinnvoll indexiert oder gerankt werden kann.

Hilft eine Sitemap beim Crawling?

Ja, sie hilft bei der Entdeckung wichtiger URLs, ersetzt aber keine saubere interne Verlinkung.

Von der Definition zur konkreten SEO-Maßnahme

Das Seitenreport Wiki erklärt den Begriff, die SEO-Tools prüfen konkrete URLs. So wird aus Wissen eine priorisierte Maßnahme für bessere Sichtbarkeit, sauberere Technik und bessere Nutzererfahrung.