1) Was ist Website-Indexierung bei Google und wie unterscheidet sie sich von Crawling und Indexierung?

Die Website-Indexierung ist der Prozess, durch den Google eine Seite in seine Datenbank aufnimmt, damit sie in den Suchergebnissen angezeigt werden kann. Der Googlebot erkennt zunächst die URL, durchsucht sie dann, rendert sie gegebenenfalls und entscheidet erst dann, ob sie indexiert wird.

Der Scanvorgang wird beeinflusst durch Budget für die Kriechkeller – eine relative Begrenzung der Aufmerksamkeit, die Google Ihrer Website widmet. Je mehr nutzlose URLs, Duplikate und Weiterleitungen vorhanden sind, desto weniger Ressourcen stehen für wichtige Seiten zur Verfügung.

2) Wie Googlebot und die mobile Indexierung die Seitensichtbarkeit beeinflussen

Mobile-First-Indexierung bedeutet, dass Google die mobile Version einer Seite bei der Bewertung und Indexierung priorisiert. Wenn Inhalte in der mobilen Version ausgeblendet sind oder die Auszeichnungssprache abweicht, ist das Risiko einer fehlerhaften Indexierung höher.

3) Prozessdiagramm: Wie eine Seite indexiert wird

Google kann Informationen über eine Seite aus internen Links, externen Links und Dateien gewinnen. Sitemap.xmlsowie die manuelle Einreichung über die Google Search Console. Eine aktuelle Sitemap trägt dazu bei, die Auffindbarkeit neuer und aktualisierter URLs zu beschleunigen.

4) Crawl-Budget: Wie das Crawl-Limit verteilt wird

Für die Suchmaschinenoptimierung von Unternehmen ist dies entscheidend: Wenn Sie einen großen Katalog oder Online-Shop Bei Zehntausenden von URLs führt eine schlechte Verteilung des Crawling-Budgets dazu, dass Googlebot Ressourcen für nutzlose Seiten verschwendet, während kommerziell wichtige Kategorien und Produktseiten nur langsam aktualisiert werden.

5) Indexierungsdiagnose über die Google Search Console

Im Bericht zur Seitenindizierung ist es wichtig, die Status „Gecrawlt – derzeit nicht indexiert“, „Gefunden – derzeit nicht indexiert“, „Duplikat ohne vom Benutzer ausgewählten kanonischen URL“, „Seite mit Weiterleitung“, „Soft 404“ und „Blockiert durch“ zu verfolgen. robots.txt.

6) URL-Prüftool: Eine bestimmte Seite überprüfen

Das URL-Prüftool hilft Ihnen zu verstehen, ob Googlebot eine Seite sieht, ob sie gecrawlt werden kann, welche Version als kanonisch gilt, wie das Crawling und Rendern verlaufen ist und warum die Seite indexiert wurde oder nicht.

7) HTTP-Statuscodes: Welche Codes verhindern die Indizierung?

Die HTTP-Statuscodes haben direkten Einfluss auf die Indexierung: 200 bedeutet, dass die Seite erfolgreich zurückgegeben wurde, 301 hilft bei der korrekten Übertragung der URL, 404/410 schließen fehlende Seiten aus und 5xx signalisiert Serverprobleme.

8) Robots.txt: So steuern Sie das Scannen

Die robots.txt-Datei regelt den Zugriff von Suchmaschinen-Bots auf bestimmte Bereiche einer Website, beeinflusst aber nicht direkt die Indexierung. Es ist wichtig, CSS und JavaScript nicht zu blockieren, da Googlebot diese für die korrekte Darstellung benötigt.

9) Meta-Roboter: noindex/nofollow

Noindex wird für Seiten verwendet, die nicht indexiert werden sollen: Warenkorb, persönliches Konto, interne Suche, technische Seiten und einige parametrische URLs.

10) X-Robots-Tag

Mit X-Robots-Tag können Sie die Indizierung auf HTTP-Header-Ebene steuern, auch für PDFs, Bilder und andere Nicht-HTML-Ressourcen.

11) Sitemap.xml: So beschleunigen Sie die URL-Auffindung

Die Sitemap.xml sollte ausschließlich kanonische, indexierbare URLs mit dem Statuscode 200 enthalten, ohne noindex, Weiterleitungen oder technischen Ballast.

12) Kanonische URL

Kanonische URLs helfen Google bei der Auswahl der primären Version einer Seite, wenn Duplikate vorhanden sind. Sie funktionieren jedoch am besten, wenn interne Links, Weiterleitungen und Sitemaps diesem Signal nicht widersprechen.

13) Doppelte Seiten

Doppelte Seiten verfälschen die Signale und verschwenden Crawling-Budget. Um sie zu vermeiden, verwenden Sie kanonische URLs, 301-Weiterleitungen, noindex und eine Normalisierung der URL-Struktur.

14) JavaScript SEO

Auf Single-Page-/Customer-Site-Request-Seiten (SPA/CSR) ist es wichtig, dass Googlebot wichtige Inhalte, Links und strukturierte Daten nach dem Rendern erkennen kann. Für Seiten mit hoher Priorität empfiehlt sich serverseitiges Rendering (SSR), hybrides Rendering oder Vorrendering.

15) Warum ist die Seite nicht indexiert?

Die Gründe können technischer Natur sein: Blockierung in Robots.txt, noindex, x-robots-tag, 4xx/5xx, Soft 404, Canonical-Konflikt, schwache interne Verlinkung, Duplikate oder Darstellungsprobleme.

16) Wie man die Website-Indexierung beschleunigt

Zuerst sollten Sie Prioritäts-URLs identifizieren, die interne Verlinkung stärken, Ihre Sitemap.xml aufräumen, die Gründe für den Ausschluss aus dem Index beseitigen, Ihr Crawl-Budget optimieren und erst dann das URL-Inspektionstool verwenden, um die Indexierung anzufordern.

17) Überwachung und Steuerung

Überwachen Sie regelmäßig den Bericht zur Seitenindizierung, die Dynamik der indizierten und ausgeschlossenen Seiten, das Wachstum von Duplikaten, Spitzenwerte bei durch robots.txt blockierten Seiten, Soft 404, 404/403/5xx und kanonischen Diskrepanzen.

18) Häufig gestellte Fragen

Die Indexierungsabfrage ist ein nachträglich hinzugefügter Beschleuniger, kein Ersatz. technische SEOWenn eine Website weiterhin Duplikate, Weiterleitungsketten, schwache interne Verlinkungen und technische Einschränkungen aufweist, liefert eine Anfrage über das URL-Inspektionstool keine konsistenten Ergebnisse.

19) Ergebnis

Eine konsistente Sichtbarkeit bei Google beginnt mit einer konsistenten Signalgebung: Der Googlebot muss die URL erkennen, die Seite erfolgreich crawlen und rendern, den kanonischen Tag verstehen, qualitativ hochwertige Inhalte erkennen und eine Bestätigung durch interne Links und eine saubere Sitemap erhalten.

Interessantes zum Thema