Jak přidat web do Google

Přidat web do Google znamená ověřit ho v Search Console a odeslat sitemapu. Google si ho ale najde i bez toho — a právě proto většina návodů řeší nesprávnou polovinu problému.

Zkontrolovat svůj web
  • Postup na 10 minut
  • Google i Seznam
  • Co dělat, když to nejde

Základ

Odpověď v jedné větě

Web přidáte do Google tak, že si ho zaregistrujete v Google Search Console, ověříte vlastnictví domény a odešlete soubor sitemap.xml se seznamem stránek.

Hned k tomu ale patří druhá věta, kterou návody vynechávají: registrace není podmínkou indexace. Google zaindexuje i web, o kterém jste mu nikdy neřekli — stačí, aby na něj odněkud vedl odkaz. Search Console není vstupenka do vyhledávače. Je to okno, kterým vidíte, co s vaším webem Google dělá.

Rozdíl je zásadní. Když web ve výsledcích není, chyba skoro nikdy není v tom, že jste ho „nepřidali". Bývá v něčem, co Googlu brání ho zaindexovat — a to bez Search Console nezjistíte. Proto je tenhle návod rozdělený na dvě části: jak web přidat (deset minut) a co dělat, když se stejně neobjeví (zbytek stránky).

Kontrola

Nejdřív zjistěte, jestli web v Googlu už není

Než začnete cokoli přidávat, ověřte si výchozí stav. Ušetří vám to práci — a hlavně vám to řekne, jestli řešíte problém s přidáním, nebo s indexací.

Nejrychlejší zkouška je vyhledat site:vasedomena.cz přímo v Googlu. Když se objeví seznam stránek, web v indexu je a přidávat ho nepotřebujete. Když nenajde nic, ještě to nic neznamená.

Past, do které tady spadne skoro každý: operátor site: není přesný odraz indexu. Neukazuje spolehlivě všechny zaindexované stránky a jejich počet kolísá mezi jednotlivými dotazy. Jako orientace stačí, jako důkaz ne.

Přesnou odpověď dá jen nástroj Kontrola URL v Search Console. Ten se ptá přímo indexu a odpoví jednoznačně: adresa v indexu je, nebo není, a pokud není, proč. K němu se dostanete v kroku 4 níž.

Bez přihlašování si můžete nechat web zkontrolovat tady — test se dívá na to, co indexaci nejčastěji brání: značku noindex, blokaci v robots.txt, chybějící sitemapu a kanonické adresy.

Postup

Přidání do Google Search Console krok za krokem

Celé to zabere zhruba deset minut, když máte po ruce přístup k DNS nebo k souborům webu.

  1. Otevřete Search Console a zvolte typ služby

    Na search.google.com/search-console se přihlaste běžným účtem Google a přidejte službu. Nabídnou se dva typy a volba není kosmetická: Doména pokryje web celý — http i https, s www i bez, všechny subdomény — ale ověřit ji jde jedině přes DNS. Předpona adresy URL pokrývá jen přesně tu variantu, kterou napíšete, zato nabízí víc způsobů ověření. Když si nejste jistí, volte Doménu: ušetří vám to pozdější zjištění, že měříte jen půlku webu.

  2. Ověřte, že je web váš

    U domény vložíte u svého registrátora TXT záznam, který vám Google vypíše. Propsání trvá od pár minut po několik hodin, takže když ověření napoprvé selže, zkuste ho za hodinu znovu. U předpony adresy URL si vyberete z několika cest: nahrát na web ověřovací HTML soubor, vložit meta tag do hlavičky úvodní stránky, nebo se svézt na už existujícím Google Analytics či Tag Manageru. Ověřovací soubor ani tag pak nikdy nemažte — Google ověření průběžně opakuje a po jeho zmizení o službu přijdete.

  3. Odešlete sitemapu

    Sitemapa je XML soubor se seznamem adres, které chcete mít v indexu. Bývá na vasedomena.cz/sitemap.xml; WordPress ji generuje sám, stejně tak Shoptet i většina redakčních systémů. V Search Console ji vložíte v sekci Sitemapy — stačí zadat cestu a odeslat. Jeden soubor pojme až 50 000 adres a 50 MB; větší web se rozdělí na několik sitemap a ty se propojí indexovou sitemapou. Adresu sitemapy je zvykem uvést i v souboru robots.txt, aby ji našly i ostatní vyhledávače.

  4. Nechte prohlédnout jednotlivou adresu

    Do horního pole Search Console vložte konkrétní URL a spusťte Kontrolu URL. Dozvíte se, jestli je adresa v indexu, kdy ji robot naposledy navštívil, kterou verzi považuje za kanonickou a jestli jí něco nebrání. Pokud v indexu není, klikněte na Požádat o indexování. Tím se adresa zařadí do fronty přednostního procházení.

  5. Počkejte a pak teprve zasahujte

    Google k době procházení říká, že „může trvat od několika dní po několik týdnů", a že požádání o procházení nezaručuje zařazení do výsledků okamžitě ani vůbec. Na odesílání jednotlivých adres navíc platí denní kvóta a opakované odeslání téže adresy procházení nezrychlí. Klikat na tlačítko každý den je tedy ztráta času. Když je web po dvou třech týdnech pořád mimo index, příčina je jinde — a ta se hledá v další části návodu.

Načasování

Jak dlouho trvá, než se web objeví ve vyhledávání

Poctivá odpověď zní: od několika dnů po několik týdnů, a záruka neexistuje. Přesně tak to formuluje i dokumentace Googlu — a kdo vám slíbí „do 24 hodin", si vymýšlí.

Rozptyl má svou logiku. Nová doména bez jediného odkazu zvenčí čeká déle, protože Google k ní nemá cestu ani důvod spěchat. Nová stránka na zavedeném webu, kam robot chodí denně, bývá v indexu do několika hodin. Rozhoduje tedy spíš to, jak dobře váš web robot zná, než to, jestli jste zmáčkli správné tlačítko.

Co dobu reálně zkrátí: odkaz z už zaindexovaného webu. Jeden odkaz z existující stránky, kterou Google pravidelně navštěvuje, udělá pro nový web víc než tři žádosti o indexaci. Odkaz je cesta, po které robot přijde sám.

Diagnostika

Co znamenají stavy v Search Console

Tohle je nejužitečnější část Search Console a zároveň nejhůř čitelná. Formulace jsou opatrné a laik z nich nepozná, co je problém a co ne. Tady je překlad.

Odesláno a indexováno

Nejlepší možný výsledek. Stránka je v indexu a může se zobrazovat ve výsledcích. Zobrazování ale není totéž co dobrá pozice — to už je práce pro obsah a odkazy.

Objeveno – momentálně neindexováno

Google adresu zná, ale ještě ji nenavštívil. Podle dokumentace k tomu dochází typicky tehdy, když Google adresu procházet chtěl, ale odložil to kvůli riziku přetížení serveru. Nejčastější příčina u nových a u pomalých webů. Zásah zpravidla není potřeba — pokud stav trvá týdny, podívejte se na odezvu hostingu.

Procházeno – momentálně neindexováno

Robot stránku stáhl, přečetl a do indexu ji nezařadil. Google k tomu říká, že v budoucnu indexována být může, ale nemusí, a že adresu není potřeba odesílat znovu. V praxi to bývá soud o kvalitě: obsah je tenký, hodně podobný jiné stránce, nebo nepřináší nic, co index už nemá. Řeší se přepsáním stránky, ne tlačítkem.

Alternativní stránka se správnou kanonickou značkou

Není to chyba. Google poznal, že stránka je variantou jiné adresy (třeba stránkování nebo verze s parametrem), a indexuje tu hlavní. Chybou se to stane jen tehdy, když si za kanonickou vybral jinou stránku, než jste zamýšleli.

Vyloučeno značkou noindex

Stránka nese pokyn, aby indexována nebyla. Když to tak chcete, je vše v pořádku. Když ne, jde o nejčastější příčinu zmizelého webu vůbec — a bývá to pozůstatek vývoje.

Blokováno souborem robots.txt

Robot k adrese vůbec nesmí. Pozor na past: blokace v robots.txt indexaci nezruší — jen Googlu zabrání stránku přečíst, takže případnou značku noindex na ní vůbec neuvidí. Stránka pak může zůstat ve výsledcích bez popisku.

Příčiny

Pět důvodů, proč se web nezaindexuje

Pořadí není náhodné — je seřazené podle toho, jak často na to v auditech narazíme.

Značka noindex zapomenutá z vývoje
Nejčastější příčina se vší parádou. Web se staví na testovací adrese se zákazem indexace, pak se spustí naostro a značka zůstane. U WordPressu k tomu stačí jedno zaškrtnutí v Nastavení → Zobrazování („Požádat vyhledávače, aby web neindexovaly"). Poznáte to podle značky <meta name="robots" content="noindex"> ve zdroji stránky nebo podle hlavičky X-Robots-Tag.
Robots.txt blokuje celý web
Řádek Disallow: / zavře robotovi dveře k celému webu. Typicky se tam dostane stejnou cestou jako noindex — z testovacího prostředí. Soubor najdete na vasedomena.cz/robots.txt a přečtete ho za deset vteřin.
Na stránku nevede jediný odkaz
Stránka, na kterou se nedá doklikat z žádné jiné, je pro robota v podstatě neviditelná — bývá jí říká osiřelá. Sitemapa to částečně nahradí, ale interní odkaz je silnější signál. Pomůže zkontrolovat strukturu a prolinkování webu.
Obsah je tenký nebo skoro totožný s jiným
Typický stav „Procházeno – momentálně neindexováno". Stránky s pár větami, kategorie bez textu nebo produkty s převzatým popisem od dodavatele Google klidně nechá mimo index. Řešením je obsah, ne technika.
Server je pomalý nebo nedostupný
Když robot naráží na chyby a dlouhé odezvy, procházení sám přibrzdí, aby web nepoložil. Odtud se rekrutuje většina dlouhodobých „Objeveno – neindexováno". Stojí za to změřit rychlost webu a podívat se na odezvu serveru.

Seznam.cz

Nezapomeňte na Seznam

Na českém trhu je Seznam pořád významný zdroj návštěvnosti a do jeho indexu se web přidává zvlášť. Google a Seznam si nic nepředávají.

Slouží k tomu Seznam Webmaster na adrese reporter.seznam.cz/wm/. Přihlásíte se účtem u Seznamu, přidáte doménu a ověříte ji jednou ze dvou cest: buď vložíte do hlavičky úvodní stránky meta tag <meta name="seznam-wmt" content="…">, nebo nahrajete do kořene webu ověřovací soubor seznam-wmt-….txt. Stejně jako u Googlu platí, že ověření se opakuje — tag ani soubor tedy nemažte.

Jednotlivou adresu jde Seznamu poslat i bez registrace přes formulář na search.seznam.cz/wt/pridej-stranku. Na jednorázové ohlášení nového webu to stačí, na správu ne — přehled o chybách a o tom, co robot na webu vidí, dá jen Webmaster.

Bing a AI

Bing, a proč na něm dnes záleží víc než dřív

Bing mívá u českých webů malý podíl a dlouho se vyplácelo ho ignorovat. To se změnilo: z jeho indexu čerpá řada asistentů s umělou inteligencí. Když chcete, aby vás citovaly, musí o vás Bing vědět.

Registrace probíhá v Bing Webmaster Tools a má příjemnou zkratku — službu lze naimportovat přímo z Google Search Console, takže ověřování absolvujete jen jednou. Sitemapa se odesílá stejně jako u Googlu.

Bing navíc podporuje protokol IndexNow, kterým web sám hlásí, že se něco změnilo, místo aby čekal na robota. U často aktualizovaných webů to má smysl; u pětistránkové prezentace je to zbytečná práce.

Řešení

Co dělat, když nic z toho nepomohlo

Web je ověřený, sitemapa odeslaná, uběhl měsíc a v indexu pořád nic. V tu chvíli přestaňte klikat na „Požádat o indexování" a projděte v tomhle pořadí:

1. Zdroj stránky. Otevřete si zdrojový kód a najděte slovo noindex. Když tam je, máte hotovo — víc hledat netřeba.

2. Robots.txt. Načtěte si vasedomena.cz/robots.txt a přečtěte, co zakazuje.

3. Kanonickou adresu. V Kontrole URL porovnejte „kanonická adresa určená uživatelem" a „kanonická adresa vybraná Googlem". Když se liší, Google indexuje jinou stránku, než chcete — typicky jinou variantu téhož obsahu.

4. Verze s www a bez www. Když obě odpovídají kódem 200 a nepřesměrovávají na sebe, máte web ve dvou kopiích a signály se dělí. Vyberte jednu variantu a druhou na ni trvale přesměrujte.

5. Obsah samotný. Když technika sedí a stav zůstává „Procházeno – momentálně neindexováno", nezbývá než přiznat, že stránka Google nepřesvědčila. Tady žádné tlačítko nepomůže — pomůže lepší text.

První čtyři body umí SEO test webu zkontrolovat za půl minuty a rovnou ukáže, který z nich máte rozbitý.

Zkontrolujte, co Googlu brání

Zadejte adresu a do 30 sekund uvidíte, jestli web blokuje noindex nebo robots.txt, jestli má sitemapu a jak je na tom s rychlostí. Zdarma, bez registrace.

Přidat web je snadné. Udržet ho v indexu je práce.

Registrace v Search Console je otázka deseti minut a zvládne ji každý. Zajímavé začne být až to, co uvidíte potom — které stránky Google prochází, které zahodil a proč.

Začněte měřením. Napoví, jestli řešíte technickou překážku, nebo obsah.

Změřit svůj web