Noindex ve WordPressu: jak omylem nezablokovat Google ani AI

TL;DR Noindex je direktiva pro indexaci, robots.txt řídí crawling. Když je URL zakázaná v robots.txt, Google noindex nikdy nepřečte. WordPress má vlastní přepínač viditelnosti a SEO pluginy, které se mohou hádat s jádrem. AI crawlery (GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot) se řídí hlavně robots.txt, ne meta noindex. Cloudflare multi-purpose pravidlo (od 15. 9. 2026) může omylem zablokovat i Googlebot. Ověření = Search Console + view-source + curl. Semly sleduje, jestli vás AI vůbec cituje.

Noindex ve WordPressu: co to je a co vlastně vypíná

Než začnete cokoli vypínat, potřebujete vědět, co který přepínač dělá. Jinak si snadno zablokujete web a budete se divit, proč nic nefunguje.

Noindex je direktiva pro indexaci. Říká vyhledávači: "Tuhle stránku neukazuj ve výsledcích." Neříká ale, jestli si ji robot může stáhnout. To je jiná věc.

Crawling má na starosti robots.txt. Ten říká robotům, kam vůbec smí vstoupit. A tady vzniká nejčastější past.

Když je URL zakázaná v robots.txt, Googlebot se na stránku vůbec nedostane. Noindex v meta tagu tedy nikdy nepřečte. Stránka se pak může dál objevovat ve výsledcích, protože na ni odkazují jiné weby. Vy si myslíte, že jste ji vypnuli, ale ona je pořád venku.

Pamatujte si jedno pravidlo: když se direktivy bijí, platí ta přísnější.

Direktiva Co řídí Kde se nastavuje Na co nestačí
meta robots indexaci stránky HTML v <head> ne-HTML soubory (PDF, obrázky)
X-Robots-Tag indexaci v HTTP hlavičce server (.htaccess, Nginx) obsah, který se nestahuje přes HTTP
robots.txt crawling soubor v rootu webu nezaručí vyřazení z indexu

Pozor: noindex + Disallow = noindex se nikdy nepřečte. Když stránku zakážete v robots.txt a zároveň jí dáte noindex, robot se na ni nedostane a vaše direktiva zůstane nepovšimnuta. Chcete-li stránku vyřadit z indexu, nechte ji crawlovatelnou a použijte jen noindex.

X-Robots-Tag použijete tam, kde meta tag nejde vložit. Typicky u PDF, obrázků nebo videa. Nastavíte ho na serveru a platí pro celý web nebo jen pro vybrané typy souborů.

Kde se ve WordPressu bere noindex (a kde ho nečekáte)

WordPress umí noindex zapnout na několika místech. A právě proto se často stane, že o něm ani nevíte.

Nejčastější zdroje:

  1. Nastavení → Čtení → "Search engine visibility". Podle dokumentace WordPress tento přepínač přidává noindex. Přímé ověření dokumentace se nám nepodařilo potvrdit, takže si stav vždy zkontrolujte přímo v kódu stránky.
  2. SEO pluginy (Yoast, Rank Math). Mají vlastní meta tagy a často přepisují to, co generuje jádro.
  3. Filtr wp_robots v jádru. WordPress přes něj skládá obsah meta robots.
  4. Šablony a child themes. Někdo tam meta tag napsal ručně a už na něj zapomněl.
  5. Staging pluginy (WP Staging) a multisite. Staging kopie mají noindex často zapnutý schválně.
  6. Cloudflare a CDN přepínače. Blokace botů na úrovni CDN se do meta tagu vůbec nepropíše.

Filtr wp_robots vypadá takto:

add_filter( 'wp_robots', function( $robots ) {
    $robots['noindex'] = true;
    unset( $robots['index'] );
    return $robots;
} );

Když tohle přidáte do šablony a zároveň máte aktivní SEO plugin, oba se mohou hádat. Jeden přidá index, druhý noindex. Výsledek je nepředvídatelný a mění se podle pořadí, v jakém se filtry spustí.

Nejlepší obrana je jednoduchá: jedno místo pro noindex. Buď plugin, nebo jádro, nikdy obojí.

Krok 1 — Zjistěte, jestli je noindex opravdu aktivní

Než cokoli změníte, zjistěte fakta. Diagnostika vám zabere pár minut a ušetří hodiny paniky.

Postupujte takto:

  1. View-source. Otevřete stránku, dejte zobrazit zdrojový kód a hledejte <meta name="robots".
  2. DevTools → Network → Response Headers. Zkontrolujte, jestli tam není X-Robots-Tag.
  3. curl -I https://vasedomena.cz. Rychlá kontrola hlaviček z terminálu.
  4. robots.txt. Otevřete ho v prohlížeči a hledejte Disallow.
  5. Search Console. URL Inspection vám ukáže "Crawl allowed?" a "Indexing allowed?". Page Indexing report pak stav "URL marked noindex".

Checklist "5 míst, kde noindex hledat":

  • meta robots v <head>
  • X-Robots-Tag v HTTP hlavičce
  • robots.txt
  • nastavení WordPressu a pluginů
  • pravidla na CDN (Cloudflare)

Důležité: robots.txt a meta tag kontrolujte odděleně. Jsou to dvě různé věci a jedna druhou nevypne.

Když v Search Console uvidíte "Indexing allowed: No", znamená to, že Google stránku neindexuje. Ještě to ale neříká proč. Může za tím být noindex, blokace v robots.txt nebo něco úplně jiného.

Krok 2 — Rozlište, co chcete vypnout: Google, nebo AI

Tohle je jádro celého rozhodování. Většina lidí si myslí, že noindex vypne všechno. Není to pravda.

Existují čtyři páky a každá dělá něco jiného:

Páka Co vypne Co zůstane
noindex vše včetně vyhledávání nic
nosnippet snippet i vstup do AI Overviews/AI Mode klasické vyhledávání
Google-Extended použití pro AI trénink a Gemini vyhledávání i AI zobrazení
opt-out z AI Overviews/AI Mode AI zobrazení snippet i vyhledávání

U Google-Extended buďte opatrní. Je to token pro řízení použití obsahu pro AI trénink a Gemini, ale přímé potvrzení oficiálním zdrojem v našem researchi chybí. Berte ho jako samostatnou páku, ne jako univerzální vypínač.

Opt-out z AI Overviews a AI Mode je novější možnost. Podle Google není ranking signál pro klasické vyhledávání. Vypne AI zobrazení, ale snippet i search zůstávají.

A teď to nejdůležitější: AI crawlery se řídí hlavně robots.txt, ne meta noindex.

Bot K čemu slouží Řídí se
Googlebot klasické vyhledávání robots.txt + meta direktivy
GPTBot trénink modelů OpenAI robots.txt
OAI-SearchBot zobrazování v ChatGPT search robots.txt
ChatGPT-User akce iniciované uživatelem robots.txt (omezeně)
ClaudeBot Anthropic robots.txt
PerplexityBot Perplexity robots.txt

Nastavení jsou nezávislá. Můžete povolit OAI-SearchBot a zároveň zakázat GPTBot. Změna robots.txt se v systémech OpenAI projeví zhruba do 24 hodin.

Noindex v meta tagu AI trénink neřeší. Když chcete ovlivnit, jestli váš obsah používají AI modely, musíte sáhnout po robots.txt. Meta noindex je páka pro vyhledávače.

Krok 3 — Bezpečně nasaďte nebo odstraňte noindex

Tady se láme úspěch celé operace. Postupujte pomalu a v tomto pořadí:

  1. Záloha + staging. Nikdy neměňte robots.txt ani meta tagy přímo na produkci bez zálohy.
  2. Úprava na stagingu. Vyzkoušejte změnu na kopii webu.
  3. U AI botů editovat robots.txt opatrně. Neodstraňujte existující pravidla bez analýzy. Můžete smazat něco, co potřebuje Google.
  4. Po nasazení ověřit live testem. Search Console → URL Inspection → Test live URL.
  5. Request indexing. Požádejte o opětovné prozkoumání.
  6. Sledovat Page Indexing report. Kontrolujte, jestli se stav mění.
  7. Noindexované stránky neodstraňovat ze sitemap příliš brzy. Oddálíte tím deindexaci.

Pozor: Cloudflare multi-purpose pravidlo (od 15. 9. 2026). Cloudflare hodnotí multi-purpose crawlery (Googlebot, Applebot, Bingbot) podle nejrestriktivnějšího chování. Kdo blokuje kategorii Training, může omylem zablokovat i Googlebot. Zkontrolujte si nastavení, i když jste si jisti, že jste nic neměnili.

Checklist "před spuštěním":

  • mám zálohu?
  • vím, kde všude je noindex zapnutý?
  • neblokuje robots.txt něco, co potřebuji?
  • mám nastavený staging?

Checklist "po migraci":

  • odstranil jsem noindex ze stagingu?
  • ověřil jsem live testem?
  • požádal jsem o indexaci?
  • sleduji Page Indexing report?
  • nechal jsem stránky v sitemapě?

Krok 4 — Ověřte, že vás vidí Google i AI

Změna je hotová. Teď potřebujete potvrdit, že to funguje. A to ve dvou světech.

Google strana. Search Console vám ukáže indexaci a návrat pozic. Podívejte se na Page Indexing report a URL Inspection. Počítejte s tím, že to chvíli trvá.

Dobrý příklad z praxe: SeatGeek omylem noindexoval 9 000 klíčových stránek. Návrat do indexu trval 1 až 2 dny, hlubší stránky až 5 dní. Provoz se vrátil na původní úroveň za 2 až 3 dny. Data pocházejí z případové studie Moz.

AI strana. Tady klasické SEO nástroje nestačí. Potřebujete vědět, jestli vás AI modely vůbec zmiňují a citují.

Semly sleduje zmínky a citace v ChatGPT, Gemini, Claude, Grok a Google AI Mode/Overviews. Ukazuje viditelnost, pozice, sentiment a zdroje odpovědí. Zároveň generuje doporučení k robots.txt, llms.txt a sitemapě. Blokaci AI botů označuje jako kritickou prioritu.

Rozlišujte dvě otázky:

  • "Jsem v Google?" → Search Console, indexace, pozice.
  • "Jsem citován v AI?" → monitoring AI viditelnosti.

A hlavně: AI viditelnost se měří v čase, ne podle jednoho dne. Jeden dotaz nic neznamená. Trend ano.

Nejčastější chyby a jak je napravit

Tady je rychlý přehled pastí, do kterých lidé padají nejčastěji.

  • robots.txt Disallow + noindex. Důsledek: noindex se nikdy nepřečte, stránka zůstane v indexu. Oprava: odstraňte Disallow, nechte stránku crawlovat a použijte jen noindex.
  • Zapomenutý noindex po migraci. Důsledek: celý web zmizí z Google. Oprava: zkontrolujte nastavení viditelnosti, pluginy i šablony, pak live test.
  • Konflikt jádro vs. plugin. Důsledek: nepředvídatelné meta tagy. Oprava: jedno místo pro noindex, nikdy obojí.
  • Blokace GPTBotu s očekáváním zmizení z ChatGPT. Důsledek: nic se nezmění. Oprava: ChatGPT search řeší OAI-SearchBot, ne GPTBot.
  • Cloudflare Training blokne Googlebot. Důsledek: vypadnete i z klasického vyhledávání. Oprava: zkontrolujte multi-purpose pravidla.
  • Odstranění robots.txt pravidel bez analýzy. Důsledek: můžete smazat pravidla potřebná pro Google. Oprava: nejdřív zjistěte, co které pravidlo dělá.
  • Smazání noindexovaných URL ze sitemap příliš brzy. Důsledek: oddálíte deindexaci. Oprava: nechte je v sitemapě, dokud se stav nezmění.

Nejčastější je kombinace prvních dvou. Vypadá to jako banální chyba, ale dokáže potrápit i zkušené správce.

Co dál

Ne vždy je noindex správná odpověď. Někdy stačí jiný nástroj.

Kdy stačí canonical místo noindex. U duplicit, kde chcete, aby se počítala jen jedna verze stránky. Canonical stránku nevyřadí, jen jí řekne, která verze je ta hlavní.

Kdy je noindex žádoucí:

  • administrace (/wp-admin/)
  • košík a checkout
  • děkovné stránky
  • interní vyhledávání (?s=)
  • tenké tag a archive stránky
  • staging

Kdy sáhnout po robots.txt místo meta tagu. U ne-HTML souborů (PDF, obrázky) a u AI botů. Ti se meta direktivami neřídí.

llms.txt berte jako experimentální doplněk. Je to kurátorská mapa klíčových zdrojů pro AI, ale není to oficiální standard. Žádný významný poskytovatel LLM oficiálně nepotvrdil, že tyto soubory čte. Nenahrazuje robots.txt ani sitemapu, jen je doplňuje.

Co kontrolovat pravidelně. Jednou měsíčně projděte robots.txt, nastavení viditelnosti, pravidla na CDN a stav indexace. U AI viditelnosti sledujte trend, ne jednotlivé dny.

A pokud chcete mít jistotu, že vás AI modely nejen vidí, ale i citují, napojte Semly. Platforma sleduje vaši viditelnost v ChatGPT, Gemini, Claude, Grok a Google AI Mode průběžně a upozorní vás, když nastavení blokuje AI botům přístup. Integrace s WordPressem a WooCommerce je otázka pár minut.

Zdroje

Zjistěte, zda vás vidí

Zadejte adresu svého webu a získejte bezplatný report o viditelnosti v AI