Noindex ist ein Meta-Tag oder ein HTTP-Header-Befehl, der Suchmaschinen wie Google explizit anweist, eine bestimmte Webseite nicht in ihren Suchindex aufzunehmen. Obwohl die betroffene Seite für Nutzer, beispielsweise über direkte Links oder die interne Seitennavigation, weiterhin ganz normal erreichbar bleibt, wird sie durch diese Anweisung effektiv aus den öffentlichen Suchergebnissen ausgeschlossen. Es handelt sich hierbei um ein zentrales Steuerungselement der Suchmaschinenoptimierung.
Die klassische Einbindung erfolgt direkt im HTML-Quelltext einer Webseite, genauer gesagt im <head>-Bereich. Der entsprechende Code-Schnipsel sieht in der Praxis wie folgt aus:
<meta name="robots" content="noindex">
Alternativ kann die Anweisung auch spezifisch für einzelne Crawler formuliert werden (z. B. name="googlebot") oder über den sogenannten HTTP-Antwort-Header (X-Robots-Tag) mitgegeben werden. Letzteres ist besonders nützlich, um Nicht-HTML-Dateien wie PDFs oder Bilder von der Indexierung auszuschließen.
Es gibt zahlreiche Szenarien, in denen Webmaster verhindern möchten, dass Webseiten bei Google & Co. gelistet werden. Zu den wichtigsten Anwendungsfällen gehören: