Noindex-tag

Bijgewerkt: 2 min. leestijd SEOFuxx-redactie

Met de instructie noindex zeg je zoekmachines dat een pagina niet in de zoekindex moet worden opgenomen. Je zet haar als metatag in de kop van de pagina of als HTTP-header. Anders dan de robots.txt regelt noindex niet het crawlen, maar of een opgehaalde pagina in de resultaten verschijnt.

Zo zet je noindex

  • Metatag in de kop van de pagina: geldt voor alle zoekmachines die de instructie kennen.
  • Metatag alleen voor Google: googlebot in plaats van robots als naam.
  • HTTP-header X-Robots-Tag: de oplossing voor bestanden zonder HTML, zoals pdf's, afbeeldingen en video's.
<!-- voor alle zoekmachines -->
<meta name="robots" content="noindex">

<!-- alleen voor Google -->
<meta name="googlebot" content="noindex">

<!-- noindex combineren met andere instructies -->
<meta name="robots" content="noindex, nofollow">
# Apache: pdf-bestanden niet laten indexeren
<FilesMatch ".pdf$">
  Header set X-Robots-Tag "noindex"
</FilesMatch>

De pagina moet bereikbaar blijven

Google moet de pagina laden om de instructie te zien. Is de pagina in de robots.txt geblokkeerd, dan blijft noindex onzichtbaar en kan het adres toch in de resultaten verschijnen als andere pagina's ernaar linken. Blokkeer een pagina daarom niet in de robots.txt als ze uit de index moet verdwijnen.

Een noindex-regel in de robots.txt zelf gebruikt Google niet. Andere zoekmachines duiden haar misschien anders, en de pagina kan daar blijven verschijnen.

Hoe lang het duurt

Google hoort pas van de wijziging bij het volgende ophalen van de pagina. Bij minder belangrijke pagina's kan dat maanden duren. Met de URL-inspectie in Google Search Console kun je een nieuwe aanvraag aanzetten. Voor snelle verwijdering verwijst Google naar de verwijderingstool van Search Console, die een pagina tijdelijk verbergt.

Wanneer noindex past

  • Pagina's zonder eigen zoekwaarde: interne zoekresultaten, filtercombinaties, bevestigings- en bedankpagina's
  • Gebieden voor bezoekers die niet in de resultaten moeten verschijnen, zoals concepten of afdrukversies
  • Bestanden zoals pdf's die je niet in de zoekresultaten wilt

Wanneer niet

  • Dubbele pagina's: Hier is een canonical de betere keuze, omdat die de signalen bundelt (zie Duplicate content).
  • Vertrouwelijke inhoud: Noindex verbergt niets voor bezoekers. Beveilig zulke pagina's met een login.
  • Crawlsturing: Google haalt de pagina blijvend op om de noindex te controleren. Om crawltijd te besparen is het niet geschikt (zie Crawlbudget).

Veelgemaakte fouten

  • noindex en een blokkade in de robots.txt tegelijk: De instructie wordt nooit gelezen.
  • noindex in de template vergeten: Een instructie uit de testomgeving die bij de livegang meegaat, haalt de hele website uit de index.
  • Pagina in de sitemap en op noindex: Dat is tegenstrijdig. In de sitemap horen alleen pagina's die moeten verschijnen.
  • Verschillende instructies op mobiel en desktop: Google beoordeelt de mobiele versie (zie Mobile-first indexering).
  • Rekenen op de werking van de links: Of links op een noindex-pagina op den duur nog worden meegewogen, is niet gegarandeerd.

Verwante begrippen

Bronnen

Heb je iets aan deze inhoud?

·