- A feltérképezés, az indexelés és a rangsorolás három külön szakasz, és külön-külön tud elakadni.
- Megbízható választ csak a Search Console URL-ellenőrző eszköze ad, a site: operátor csak tájékoztató.
- A ki nem indexelt oldalak leggyakoribb oka technikai: noindex, robots.txt-tiltás, rossz kanonikus vagy hibás státuszkód.
- Az indexelés kérése kérés, nem utasítás: a bekerülés ideje órától hetekig terjedhet, és semmilyen beállítás nem hoz önmagában helyezést.
- Ha az oldal indexelve van, de az átlagpozíció 40 fölött áll, nem indexelési, hanem relevancia- és tartalommélység-kérdésről van szó.
Ha valaki beírja a keresőbe, hogy „google indexelés”, jellemzően nem lexikon-definícióra kíváncsi. Vagy elindított egy új oldalt, és sehogy nem találja meg magát a Google-ben, vagy a Search Console dobott ki egy figyelmeztetést, amit nem ért, vagy egy addig jól működő aloldal egyszer csak eltűnt a találatok közül. Ez a cikk erre a három helyzetre ad használható választ: mit jelent az indexelés, hogyan ellenőrzöd egy perc alatt, mik a leggyakoribb okok, ha nem működik, és mit tudsz konkrétan tenni, ha az oldal ugyan bent van az indexben, de forgalmat mégsem hoz.

Mit jelent pontosan, hogy a Google indexeli az oldaladat?
Az indexelés az a lépés, amikor a Google a már letöltött oldalt feldolgozza, értelmezi a tartalmát, és felveszi a saját adatbázisába, hogy későbbi keresésekre válaszként megjeleníthesse. Ha egy oldal nincs indexelve, semmilyen kifejezésre nem tud megjelenni a találatok között.
(Hivatalosan igazolt, Google Search Central dokumentáció.) A Google három, egymástól elkülönülő szakaszban dolgozik. Az első a feltérképezés: a Googlebot letölti az oldal HTML-jét, és követi a rajta talált linkeket. A második az indexelés: a rendszer értelmezi a szöveget, a képeket, a strukturált adatot, eldönti, hogy az oldal melyik URL-változat kanonikus formája, és eltárolja. A harmadik a megjelenítés, vagyis amikor egy konkrét keresésre a Google kiválasztja és rangsorolja az indexben lévő oldalakat.
A gyakorlati következmény az, hogy a három szakasz külön-külön tud elromlani. Attól, hogy a Googlebot járt az oldaladon, még nem biztos, hogy be is került az indexbe. Attól, hogy bekerült, még nem biztos, hogy bármilyen keresésre esélye van előre kerülni. A hibakeresés első lépése ezért mindig az, hogy eldöntöd, melyik szakaszban akadtál el.
Miben különbözik a feltérképezés és az indexelés?
A feltérképezés a letöltés, az indexelés a feldolgozás és a tárolás. A Google hivatalos állásfoglalása szerint egy feltérképezett oldalt nem köteles indexelni, és ez nem hiba, hanem minőségi és kapacitásbeli döntés.
Ez az a pont, ahol a legtöbb félreértés születik. Sok tulajdonos abból indul ki, hogy ha a szerver naplójában látja a Googlebot kéréseit, akkor „minden rendben”. A valóságban a Google mindennap sokkal több oldalt tölt le, mint amennyit tárolni érdemesnek tart. A döntés hátterében jellemzően három dolog áll: az oldal önálló értéke, a duplikáció (van-e már majdnem ugyanilyen tartalom az indexben), és az, hogy a webhely egészét mennyire tartja megbízhatónak a rendszer.
- Feltérképezhető, de nem indexelt: a tartalom megvan, de a Google nem látja benne a hozzáadott értéket, vagy egy másik URL-t választott kanonikusnak.
- Indexelt, de nem jelenik meg: bent van, csak semmilyen keresésre nem kerül elég előre.
- Nem is feltérképezett: technikai akadály van, tiltás, hibás státuszkód, vagy egyszerűen nincs rá mutató link.
Hogyan ellenőrzöd, hogy indexelve van-e egy adott oldalad?
A megbízható válasz a Google Search Console URL-ellenőrző eszközéből jön: beírod a teljes URL-t, és a rendszer megmondja, szerepel-e az indexben, mikor járt ott utoljára a Googlebot, és melyik URL-t tekinti kanonikusnak.
- Nyisd meg a Search Console-t arra a tulajdonra, amely a domainedet fedi.
- A felső keresősávba illeszd be a pontos, teljes URL-t (protokollal együtt, a végén ott a per jel, ha az oldalad úgy működik).
- Olvasd el a fejlécet: vagy azt írja, hogy az URL szerepel a Google-ben, vagy azt, hogy nem.
- Nyisd le a részleteket, és nézd meg a felfedezés módját (sitemap vagy hivatkozó oldal), a legutóbbi feltérképezés dátumát és a Google által választott kanonikus URL-t.
(Saját tapasztalat.) A site:domain.hu/oldal operátor gyors, de félrevezető tud lenni: a találatszám becslés, és a Google több esetben akkor sem mutatja a URL-t, ha az egyébként bent van. Első ránézésre jó, döntést viszont ne alapozz rá. Ha nincs Search Console-hozzáférésed, az operátor legfeljebb annyit mond meg, hogy „valószínűleg igen”, azt nem, hogy miért nem.
Mit jelentenek a leggyakoribb Search Console-státuszok?
Az Oldalak (Pages) jelentés minden ki nem indexelt URL-hez okot rendel, és ezek az okok nagyon eltérő súlyúak: van köztük teljesen normális működés és valódi hiba is.
- Felderítve, jelenleg nincs indexelve: a Google tud az URL-ről, de még le sem töltötte. Jellemzően kapacitás- vagy prioritás-kérdés.
- Feltérképezve, jelenleg nincs indexelve: letöltötte, de nem tárolta el. A legtöbbször tartalmi jelzés: kevés önálló érték, vékony vagy ismétlődő szöveg.
- Duplikált tartalom, a Google más kanonikus oldalt választott: a rendszer szerint egy másik URL képviseli jobban ugyanazt a tartalmat.
- Alternatív oldal megfelelő kanonikus címkével: ez rendben van, te magad jelölted ki a fő változatot.
- Kizárva a noindex címke miatt: szándékos tiltás. Ha nem te tetted oda, a sablonban vagy egy bővítményben keresd.
- Blokkolva a robots.txt által: a Google le sem tudta tölteni. Fontos: ez önmagában nem veszi ki az indexből, csak megakadályozza a feldolgozást.
- Soft 404: a szerver 200-as státuszt ad vissza, de az oldal üresnek vagy hibajelzésnek látszik.
Miért nem indexeli a Google az oldaladat?
A leggyakoribb okok technikaiak és néhány perc alatt ellenőrizhetők, utána jön a jóval nehezebb tartalmi kérdés. Menj végig rajtuk ebben a sorrendben:
- Van rajta noindex. Nézd meg a forráskódban:
<meta name="robots" content="noindex">, illetve a szerver válaszfejlécében azX-Robots-Tag: noindexsort. WordPressen a fejlesztés alatti állapot kapcsolója szokott bent maradni. - A robots.txt tiltja. Egyetlen félreírt sor, például
Disallow: /, az egész webhelyet kizárja a feldolgozásból. - Rossz kanonikus hivatkozás. Ha minden aloldalon a főoldalra mutat a
<link rel="canonical">, a Google következetesen a főoldalt fogja megtartani. - Hibás státuszkód. Ellenőrizd parancssorból:
curl -I https://domain.hu/oldal. Ha nem 200 jön vissza, ott a válasz. - Árva oldal. Ha egyetlen belső link sem mutat rá, és a sitemapban sincs benne, a Google nehezen talál rá és alacsony prioritást ad neki.
- Kizárólag JavaScriptből betöltött tartalom. A Google renderel, de késleltetve és korlátozottan. Ami a nyers HTML-ben is benne van, sokkal kiszámíthatóbban kerül be.
- Nincs benne önálló érték. Ha az oldal ugyanazt mondja, mint száz másik, csak más szavakkal, a rendszernek nincs oka eltárolni.
Hogyan kérheted egy új oldal indexelését, és mennyi idő alatt kerül be?
A Search Console URL-ellenőrző eszközében az „Indexelés kérése” gombbal soron kívül jelezheted az új vagy frissített oldalt, de ez kérés, nem utasítás: a Google dönti el, mikor és mit tárol el.
- Előbb javítsd a technikai akadályt (noindex, robots.txt, kanonikus, státuszkód). Enélkül az indexelés kérése értelmetlen.
- Tedd be az URL-t a sitemap.xml-be, és a sitemapot küldd be a Search Console-ban.
- Tegyél rá legalább egy-két belső linket a webhely már indexelt, látogatott oldalairól.
- Csak ezután futtasd le az URL-ellenőrzést és kérd az indexelést.
(Saját tapasztalat.) Egy régóta működő, rendszeresen frissülő webhelyen az új cikk gyakran néhány órán vagy egy-két napon belül bekerül. Egy friss domainen ugyanez hetekig is eltarthat, és nem ritka, hogy az első néhány oldal indexelése után a rendszer felgyorsul. (Szakmai feltételezés.) A tapasztalt különbség mögött vélhetően az áll, hogy a Google a webhely eddigi feltérképezési előzményei alapján osztja be a kapacitását, tehát a rendszeres, kiszámítható publikálás segítheti a gyorsabb bekerülést. Ezt a Google nem közli számszerűen.
Mit tegyél, ha sok oldalad van, és lassan halad az indexelés?
Nagyobb webhelyen az indexelés ritkán egyedi URL-ek kérdése: a szerkezetet, a szerver válaszidejét és a felesleges URL-ek számát érdemes rendezni.
- Csökkentsd a zajt. Szűrők, rendezési paraméterek, keresési találati oldalak, kosár- és nyomtatási változatok ezrével termelnek olyan URL-eket, amelyeknek semmi keresnivalójuk az indexben.
- Gyorsíts a szerveren. Ha a válaszidő magas, a Google visszaveszi a feltérképezés ütemét, hogy ne terhelje túl a webhelyet.
- Rendezd a belső linkelést. Ami három kattintásnál mélyebben van, jellemzően ritkábban kerül sorra.
- Tartsd karban a sitemapot. Csak indexelhető, 200-as státuszú, kanonikus URL-ek legyenek benne, valós
lastmodértékkel.
(Hivatalosan igazolt.) A Google Indexing API kizárólag két tartalomtípusra használható hivatalosan: álláshirdetésekre és élő közvetítés jellegű oldalakra. Általános tartalomhoz nem való. Az IndexNow protokollt a Bing és a Yandex használja, a Google nem jelentette be, hogy a saját indexeléséhez felhasználná, tehát önmagában a Google-megjelenésre nem megoldás. Ettől még hasznos lehet, ha más keresők felé is dolgozol.
Mit tegyél, ha az oldal indexelve van, de nincs rajta forgalom?
Az indexelés a belépő, nem a cél. Ha a Search Console szerint az oldal bent van, megjelenéseid is vannak, de az átlagpozíció 40 és 90 között mozog, akkor nem indexelési, hanem relevancia- és tartalommélység-problémád van.
(Saját tapasztalat.) Ez a helyzet elég jellegzetes: a Google már összekötötte a webhelyet a témával, hiszen enélkül megjelenésed sem lenne, de a rendelkezésre álló oldalaid egyike sem válaszolja meg pontosan azt, amit a kereső beírt. Ilyenkor nem új linkekre van szükség, hanem egy olyan oldalra, amely kifejezetten arra a kérdésre válaszol, teljes terjedelemben.
- A Search Console Teljesítmény jelentésében szűrj arra a keresésre, ahol megjelenésed van, de kattintásod alig.
- Nézd meg, melyik URL-t mutatja rá a Google. Gyakran egy oda nem illő aloldal.
- Írd meg vagy írd át azt az egy oldalt úgy, hogy a keresés mögötti kérdésre az első bekezdésben konkrét válasz legyen.
- Adj hozzá olyat, amit máshol nem talál meg: lépéssort, ellenőrzőlistát, valós mérési tapasztalatot, kódrészletet.
- Linkeld be a webhelyed erős, már jól teljesítő oldalairól.
Hogyan függ össze az indexelés az AI-válaszmotorokban való megjelenéssel?
A Google AI-összefoglalói a Google saját indexéből dolgoznak, tehát ami nincs indexelve, azt ott idézni sem tudják. A ChatGPT, a Perplexity és a többi asszisztens viszont saját robotokkal gyűjt, ezért ott külön hozzáférési kérdés is felmerül.
(Hivatalosan igazolt.) Az OpenAI és a Perplexity is közzéteszi a robotjainak azonosítóit (például GPTBot, OAI-SearchBot, PerplexityBot), és ezek a robots.txt-ben külön engedélyezhetők vagy tilthatók. Sok webhelyen egy évekkel korábban felrakott, túl szigorú tiltás vagy egy védelmi szolgáltatás szűrése zárja ki ezeket a robotokat anélkül, hogy a tulajdonos tudna róla. Az indexelési átvizsgálást ezért érdemes kiterjeszteni ezekre a robotokra is: nézd meg a szerver naplójában, hogy egyáltalán járnak-e nálad, és milyen státuszkódot kapnak.
(Szakmai feltételezés.) Ami a Google indexelését segíti (tiszta HTML, stabil URL-ek, egyértelmű kanonikus jelölés, gyors válaszidő), az jó eséllyel az AI-robotok dolgát is könnyíti, mert ugyanazokba a technikai falakba ütköznek. Ez logikus következtetés a robotok működéséből, nem publikált szabály, és nem is jelent automatikus idézettséget.
Milyen ellenőrzőlistával nézd át negyedévente az indexelést?
Ez a lista körülbelül fél óra alatt végigmegy egy közepes méretű webhelyen:
- A Search Console Oldalak jelentésében nőtt-e a nem indexelt URL-ek száma az előző időszakhoz képest.
- A „Feltérképezve, jelenleg nincs indexelve” listán van-e olyan oldal, amely fontos lenne az üzletnek.
- A robots.txt tartalma megegyezik-e azzal, amit szándékosan beállítottál.
- A legfontosabb tíz oldalad forráskódjában nincs-e véletlen noindex.
- A sitemap darabszáma nagyságrendileg stimmel-e az indexelt oldalak számával.
- A Teljesítmény jelentésben van-e olyan keresés, amelyre sok a megjelenés és gyenge a pozíció.
- A szerver átlagos válaszideje nem romlott-e a Feltérképezési statisztikák szerint.
- A naplóban megjelennek-e az AI-robotok, és 200-as választ kapnak-e.
Egyik pont sem hoz azonnali eredményt, és semmilyen technikai beállítás nem hoz magától helyezést. Az indexelés rendbetétele azt a feltételt teremti meg, amely nélkül a jó tartalom sem tud dolgozni.
Források és további olvasnivalók
- Google Search Central: Feltérképezés és indexelés dokumentáció
- Google Search Central: Search Essentials
- Google Search Console súgó: URL-ellenőrző eszköz és Oldalak jelentés
- RFC 9309: Robots Exclusion Protocol
- Google Indexing API dokumentáció
- IndexNow protokoll dokumentáció (Microsoft Bing)
- OpenAI dokumentáció: GPTBot és OAI-SearchBot
- Schema.org: strukturált adat szókészlet
- W3C: HTML és webes szabványok
Gyakori kérdések
Mennyi idő alatt indexeli a Google az új oldalamat?
Nincs rá fix határidő. Egy régóta működő, rendszeresen frissülő webhelyen gyakran néhány óra vagy egy-két nap, egy friss domainen viszont hetekig is eltarthat. Az indexelés kérése a Search Console-ban gyorsíthatja, de a döntést a Google hozza meg.
Hogyan nézem meg, hány oldalam van indexelve?
A Search Console Oldalak (Pages) jelentése mutatja az indexelt és a ki nem indexelt URL-ek számát, okokra bontva. A site:domain.hu operátor gyors becslést ad, de a találatszám pontatlan, döntést ne alapozz rá.
A robots.txt tiltás kiveszi az oldalt a Google indexéből?
Nem közvetlenül. A robots.txt csak a letöltést akadályozza meg, így a Google nem tudja feldolgozni a tartalmat, de a URL bizonyos esetekben megmaradhat az indexben. Ha biztosan ki akarsz venni egy oldalt, noindex címkét kell használnod, és ehhez a Googlebotnak el kell érnie az oldalt.
Mit jelent a Feltérképezve, jelenleg nincs indexelve üzenet?
Azt, hogy a Googlebot letöltötte az oldalt, de nem tartotta érdemesnek eltárolni. Jellemzően tartalmi jelzés: vékony, ismétlődő vagy más oldalakhoz nagyon hasonló szöveg. Technikai javítás helyett az oldal önálló értékén érdemes dolgozni.
Indexelve van az oldal, mégsem találom a Google-ben. Miért?
Az indexelés csak azt jelenti, hogy a Google eltárolta az oldalt, azt nem, hogy előre is sorolja. Nézd meg a Teljesítmény jelentésben, mely keresésekre van megjelenésed és milyen átlagpozícióval; ha a pozíció magas szám, a tartalom relevanciáján és mélységén múlik a továbblépés.
Számít az indexelés az AI-válaszmotoroknál is?
A Google AI-összefoglalói a Google indexéből dolgoznak, tehát ott az indexelés feltétel. A ChatGPT és a Perplexity saját robotokkal gyűjt, ezért náluk az a kérdés, engedi-e a robots.txt és a védelmi réteg a hozzáférést, és milyen státuszkódot kapnak ezek a robotok.
Források és további olvasnivalók
Ezen az oldalon a hivatalosan igazolt információt elsődleges forrásokból építjük fel; a saját tapasztalatot és a szakmai becslést mindig külön jelöljük a szövegben.