Gebruiksnotities
Een <meta name="robots">-element kan de volgende aanvullende attributen hebben:
content | Het content-attribuut moet gedefinieerd zijn, en de waarde ervan stelt het indexerings- en crawlgedrag in voor coöperatieve zoekmachinerobots.
Accepteert een of meer van de volgende trefwoorden als een door komma's gescheiden lijst:
|
|---|
Beschrijving
Er zijn verschillende belangrijke overwegingen bij het instellen van een robots-metawaarde:
- Alleen coöperatieve robots volgen deze regels. Ze voorkomen niet dat kwaadwillende actoren, zoals e-mailharvesters, de instructies negeren.
- Als gedefinieerd in een
<meta>-tag, moeten robots de pagina nog steeds bezoeken om deze regels te lezen. Overweeg om bandbreedte te besparen een robots.txt-bestand te gebruiken in plaats daarvan. - De tag
<meta name="robots">enrobots.txtvervullen verschillende rollen:robots.txtregelt het crawlen, terwijl derobots-metatag de indexering en ander gedrag beïnvloedt. - Een pagina die geblokkeerd wordt door
robots.txtkan nog steeds geïndexeerd worden als er vanuit andere bronnen naar gelinkt wordt. - De
noindex-instructie wordt pas van kracht nadat de robot de pagina opnieuw bezoekt, dus zorg ervoor datrobots.txtdit niet verhindert. - Sommige waarden, zoals
indexversusnoindexoffollowversusnofollow, sluiten elkaar wederzijds uit. Het gedrag is niet gedefinieerd wanneer tegenstrijdige waarden gebruikt worden. - Robots zoals Google, Yahoo en Bing ondersteunen deze instructies ook in de HTTP-header
X-Robots-Tag, wat nuttig is voor niet-HTML-inhoud zoals PDF's of afbeeldingen.
Voorbeelden
Een robots-trefwoord gebruiken
Het volgende voorbeeld gebruikt nofollow om te verzoeken dat een crawler geen links op een pagina volgt, en noindex om te verzoeken dat de pagina wordt uitgesloten van indexering:
<meta name="robots" content="nofollow, noindex" />