SEO
Verwaiste Seiten auf Ihrer Website finden – und warum ein Crawler nur „potenziell“ sagen kann
Seiten, auf die nichts verlinkt, sind für Besucher und Suchmaschinen schwer zu finden. Wie Sie sie aufspüren, warum ein Crawl nur „potenziell“ verwaiste Seiten melden kann und was Sie mit jeder einzelnen tun sollten.
Auf dieser Seite
Eine verwaiste Seite (Orphan Page) ist eine Seite Ihrer Website, auf die keine andere Seite verlinkt. Sie kann weiterhin existieren, in Ihrer Sitemap stehen und sogar für irgendetwas ranken. Besucher, die sich durch Ihre Website klicken, erreichen sie aber nicht, und Suchmaschinen erfahren nur über die Sitemap, dass es sie gibt. Zudem liefert Ihre eigene Verlinkung keinerlei Signal dafür, dass die Seite wichtig ist.
Verwaiste Seiten entstehen selten mit Absicht. Sie bleiben zurück, wenn bei einem Redesign ein Menüpunkt wegfällt, eine Kampagnen-Landingpage ihre Kampagne überdauert, eine Kategorie entfernt wird oder ein Blogbeitrag immer nur von einem Platz auf der Startseite aus verlinkt war, der längst anders belegt ist.
Warum verwaiste Seiten ein Problem sind
- Auffindbarkeit. Suchmaschinen finden die meisten Seiten, indem sie Links folgen. Eine Seite, die nur über die Sitemap erreichbar ist, wird weniger zuverlässig entdeckt und erneut gecrawlt.
- Bedeutung. Interne Links sind eines der Mittel, mit denen Suchmaschinen einschätzen, welche Seiten Sie für wichtig halten. Eine Seite ohne solche Links wirkt unwichtig.
- Besucher. Niemand kann sich zu ihr durchklicken, nützliche Inhalte bleiben also ungelesen.
- Pflege. Vergessene Seiten veralten: alte Preise, abgelaufene Angebote, überholte Ratschläge.
Wie verwaiste Seiten gefunden werden
Um eine Seite als verwaist einzustufen, brauchen Sie zwei Listen: alle Seiten, die existieren, und alle Seiten, auf die irgendetwas verlinkt. Die verwaisten Seiten stehen auf der ersten Liste und fehlen auf der zweiten. Schwierig ist die erste Liste, denn verwaiste Seiten lassen sich per Definition nicht finden, indem man Links folgt. Die üblichen Quellen sind:
- Ihre XML-Sitemap;
- ein Inhaltsexport aus Ihrem CMS;
- Seiten, die in Ihrer Webanalyse Besuche verzeichnen;
- Seiten, die Google kennt – zu sehen in den Search-Console-Berichten „Leistung“ und „Seitenindexierung“;
- URLs, die in Ihren Server-Logs auftauchen.
Die zweite Liste liefert ein Crawl: auf der Startseite beginnen, jedem internen Link folgen und festhalten, welche Seiten verlinkt waren.
Warum ein Crawler „potenziell verwaist“ sagt
Ein Crawler kennt nur die Links auf den Seiten, die er tatsächlich besucht hat. Endet ein Crawl nach 10 oder 100 Seiten oder bei einer bestimmten Klicktiefe, oder überspringt er Seiten, die per robots.txt gesperrt sind, dann kann eine scheinbar unverlinkte Sitemap-Seite durchaus von einer Seite aus verlinkt sein, die der Crawl nie erreicht hat. Deshalb spricht ein ehrliches Tool von potenziell verwaisten Seiten: „In diesem Crawl wurde kein interner Link auf diese Seite gefunden“ – und nicht „Nichts verlinkt auf diese Seite“.
Auch anderes kann einen vorhandenen Link vor einem Crawler verbergen: Links, die erst erscheinen, nachdem JavaScript ausgeführt wurde (wenn der Crawler nur das rohe HTML liest), Links in Formularen oder Suchergebnissen sowie Links von Subdomains oder anderen Hosts, die nicht als intern zählen.
Nach potenziell verwaisten Seiten suchen
Starten Sie ein Audit: Ein Website-Scan von Rudra vergleicht Ihre Sitemap mit den gefundenen internen Links und listet Seiten auf, auf die im Crawl nichts verlinkt hat.
Wie Rudra potenziell verwaiste Seiten findet
Ein Website-Scan von Rudra (kostenloses Konto; das kostenlose Website-Audit deckt eine einzelne Seite ab) liest während des Crawls Ihre XML-Sitemap. Nach dem Crawl listet er Sitemap-Seiten auf, die 200 geliefert haben und von keiner anderen gecrawlten Seite einen internen Link erhalten haben. Die Startseite ist ausgenommen, es zählen nur Links zwischen Seiten derselben Website, und URLs werden verglichen, nachdem abschließende Schrägstriche, Fragmente sowie die Varianten http/https und www vereinheitlicht wurden. Die Prüfung läuft nur, wenn eine Sitemap gefunden und mindestens zwei Seiten gecrawlt wurden. Der Befund nennt außerdem, wie viele Seiten der Crawl erfasst hat, damit Sie einschätzen können, wie vollständig er ist.
Derselbe Bericht führt Seiten mit wenigen internen Links – einem oder keinem von anderen gecrawlten Seiten – als gesonderten Hinweis mit niedriger Konfidenz auf, ebenso Seiten, die vier oder mehr Klicks von der Startseite entfernt sind. Beides sind keine Fehler, sondern Anlässe, Ihre Verlinkung zu überprüfen.
Prüfen, ob eine Seite wirklich verwaist ist
- Durchsuchen Sie Ihre eigene Website. Suchen Sie über die Suche Ihres CMS oder per Datenbankabfrage nach URL und Slug der Seite, und suchen Sie mit
site:yourdomain.com "page title"nach Erwähnungen. - Sehen Sie in der Search Console nach. Unter „Links“ → „Interne Links“ steht, wie viele interne Links auf eine URL Google gesehen hat.
- Prüfen Sie, wo der Crawl aufgehört hat. Hat Ihr Crawl sein Seitenlimit erreicht, findet ein größerer Crawl den Link vielleicht.
- Werfen Sie einen Blick in die Webanalyse. Eine Seite mit Besuchen, aber ohne interne Verweisquellen wird nur über die Suche, per E-Mail oder über Anzeigen erreicht.
Was Sie mit jeder verwaisten Seite tun sollten
Entscheiden Sie Seite für Seite, ob sie ihre Daseinsberechtigung noch hat:
- Nützlich und aktuell: Verlinken Sie sie von passenden Stellen aus – einer Kategorie- oder Übersichtsseite, verwandten Artikeln, der Navigation oder dem Footer, wenn sie wichtig ist, und über Breadcrumbs. Verwenden Sie aussagekräftigen Linktext statt „hier klicken“.
- Nützlich, aber veraltet: Aktualisieren Sie sie und verlinken Sie sie dann.
- Durch eine bessere Seite ersetzt: Leiten Sie sie per 301 auf die Nachfolgeseite weiter und entfernen Sie sie aus der Sitemap.
- Überholt und ohne Ersatz: Entfernen Sie sie (ein 404 oder 410 genügt) und nehmen Sie sie aus der Sitemap.
- Absichtlich unverlinkt (eine Kampagnen-Landingpage, eine Danke-Seite): Erwägen Sie
noindexund die Entfernung aus der Sitemap, damit sie nicht mit Ihren Hauptseiten konkurriert.
Prüfen Sie bei dieser Gelegenheit, ob die neu gesetzten Links auch funktionieren – darum geht es in unserem Leitfaden Defekte Links beheben – und halten Sie die Sitemap auf dem aktuellen Stand, wie unter Sitemap-Probleme diagnostizieren beschrieben.
Häufig gestellte Fragen
Sind verwaiste Seiten schlecht für das SEO?
Sie werden nicht abgestraft, sind für Suchmaschinen aber schwerer zu entdecken und wirken weniger wichtig, weil nichts auf Ihrer Website auf sie verlinkt. Wichtige Seiten sollten immer von anderen thematisch passenden Seiten aus verlinkt sein.
Kann eine Seite verwaist sein, obwohl sie in meiner Sitemap steht?
Ja. Die Sitemap teilt Suchmaschinen mit, dass die Seite existiert, ist aber kein Link. Verwaist ist eine Seite, auf die keine internen Links zeigen – ob die Sitemap sie aufführt oder nicht.
Warum hat der Scan eine Seite gemeldet, von der ich weiß, dass sie verlinkt ist?
Der Link steht vermutlich auf einer Seite, die der Crawl wegen seines Seiten- oder Tiefenlimits nicht erreicht hat, wird per JavaScript eingefügt oder liegt auf einem anderen Host. Deshalb spricht der Befund von einer „potenziell“ verwaisten Seite. Prüfen Sie das nach, bevor Sie handeln.
Soll ich einfach jede verwaiste Seite in die Navigation aufnehmen?
Nein. Verlinken Sie jede Seite von den Stellen aus, an denen sie wirklich passt. Die Navigation ist Ihren wichtigsten Seiten vorbehalten. Alles andere gehört in Übersichtsseiten, Kategorien und verwandte Inhalte.