Miért nem jelenik meg a weboldalam a Google-ben?
Megtalálhatóság
- Publikálva
- Szerző
- PageIQ
Nincs indexelve az oldal, vagy csak nem jön ki a keresésekre? Két külön probléma. Így derül ki, melyik a tiéd, és mit tudsz vele kezdeni.
Rákeresel a saját cégedre, és az oldalad nincs a találatok között. Ilyenkor két, egymástól elég távoli dolog állhat a háttérben. Vagy egyáltalán nincs benne az oldal a Google indexében, vagy benne van, csak nem azokra a keresésekre hozza ki, amikre számítasz. A kettőt máshogy kell megoldani, ezért ezzel érdemes kezdeni.
Előbb derítsd ki, melyik esetről van szó
Keress rá a cég pontos nevére. Ha erre sem jön ki az oldalad, valószínűleg indexelési probléma van. Ha a cégnévre megtalálod, de a szolgáltatásodhoz kapcsolódó keresésekre nem, akkor az oldal benne van a Google-ben, és a kérdés már az, miért nem kerül elég előre.
Sokan a site:sajatdomain.hu kereséssel ellenőrzik ezt. Támpontnak jó,
hibakeresésre viszont nem alkalmas. A Google leírása szerint a site: keresés
nem feltétlenül adja vissza az összes indexelt URL-t, kulcsszó nélkül pedig a
sorrend is nagyjából véletlenszerű.
Pontos választ a Search Console URL-ellenőrző eszköze ad. Beírsz egy konkrét címet, és megmondja, szerepel-e a Google-ben, és ha nem, mi akadályozza. A Search Console ingyenes, de használatához igazolni kell, hogy tiéd a domain. Ha még nincs beállítva, ez az a pont, ahol érdemes megcsinálni, mert enélkül csak találgatni lehet.
Ha az oldal még új, lehet, hogy csak idő kell
A Google dokumentációja szerint a kereső magától keresi az új webhelyeket, tehát általában nem kell hozzá semmit csinálni azon kívül, hogy az oldal fent van a weben. Ugyanez a leírás azt is hozzáteszi, hogy néhány hétbe telhet, mire a Google észreveszi az új oldalt vagy a változásokat, és hogy a feldolgozott oldalak mennyisége miatt óhatatlanul kimaradnak webhelyek, jellemzően az újabbak és a kisebbek.
A felfedezést gyorsíthatja egy sitemap beküldése, és a Search Console-ból egy-egy címre indexelést is lehet kérni. A Google leírása szerint ilyenkor az indexelés jellemzően egy nap körül tart, de van, amikor sokkal tovább. Ugyanazt a címet viszont nem érdemes naponta újra beküldeni, mert az ismételt kérés nem gyorsítja a folyamatot, és napi korlát is van rá. Ha egyszerre sok oldalról van szó, a sitemap a megfelelő eszköz.
Azt viszont senki nem tudja garantálni, hogy egy oldal bekerül az indexbe. Nem óvatoskodásból írjuk így, a Google súgójában szerepel, hogy nem garantálja minden oldal indexelését.
Ami a leggyakrabban kizárja az oldalt
A noindex, ami a fejlesztés óta ott maradt
Fejlesztés közben normális, hogy az oldal ki van zárva a keresőkből. A gond
akkor van, ha ez élesítés után is így marad. Ilyenkor a Google letölti az
oldalt, látja rajta a noindex utasítást, és nem indexeli.
WordPressnél ennek van egy jól ismert forrása. A Beállítások, Olvasás
menüpontban van egy jelölőnégyzet, amivel meg lehet kérni a keresőket, hogy ne
indexeljék a webhelyet. Bekapcsolva a WordPress noindex, nofollow meta címkét
tesz az oldalak fejlécébe. Egy percbe telik kikapcsolni, viszont magától senki
nem veszi észre.
A robots.txt, ami kizárja a robotokat
A sajatdomain.hu/robots.txt címen te is meg tudod nézni, mi van benne. Egy
Disallow: / sor a teljes oldalt kizárja a letöltésből.
Van itt egy csapda, amibe sokan beleesnek. A robots.txt és a noindex nem
ugyanaz, és rosszul kombinálva pont az ellenkezőjét érik el annak, amit
szeretnél. Ha a robots.txt tiltja az oldal letöltését, a Google el sem jut odáig,
hogy meglássa a noindex utasítást, az oldal pedig más oldalak linkjei nyomán
így is megjelenhet a találatok között. Fordítva ugyanez: a robots.txt-beli
kizárás önmagában nem garantálja, hogy az oldal kimarad az indexből. Ha egy
oldalt biztosan ki akarsz hagyni, a noindex a megfelelő eszköz, és ehhez a
robotoknak le kell tudniuk tölteni az oldalt.
Jelszó, hibás válaszok, átirányítások
Ha az oldal jelszó mögött van, a Googlebot ugyanazt látja, mint bárki más, aki kívülről érkezik. A 401-es válasz azt jelenti, hogy a szerver azonosítást kér, a 403-as azt, hogy megtagadja a hozzáférést. A Googlebot soha nem ad meg jelszót, tehát egyiken sem jut túl.
Hasonló a helyzet a szerverhibákkal. Egy pillanatnyi kimaradás önmagában általában nem okoz bajt, a tartós 5xx hiba viszont igen, mert a Google nem tudja feldolgozni az oldalt. Előfordul az is, hogy egy átirányítás hibás, például túl hosszú a lánc, körbeér, vagy üres cím van benne. És van a soft 404, amikor az oldal szövegben azt írja, hogy a tartalom nem található, közben pedig sikeres választ küld a szerver. A Google az ilyen oldalakat nem indexeli.
Ugyanaz a tartalom több címen
A www és a www nélküli változat, a http és a https, néha az /index.php
végződés. Ezek külön URL-ek. Ha ugyanaz a tartalom több címen is elérhető, a
Google kiválaszt egyet kanonikusnak, és azt indexeli. Nem feltétlenül azt,
amelyiket te választanád.
Ez önmagában nem baj, és nem is mindig kell vele foglalkozni. Akkor számít, ha a Search Console-ban azt látod, hogy egy neked fontos oldal azért nincs indexelve, mert a Google másik címet választott helyette.
Letöltötte, mégsem indexelte
Két külön állapot, és könnyű összekeverni őket. A „Feltérképezve, jelenleg nincs indexelve” (Crawled – currently not indexed) azt jelenti, hogy a Google letöltötte az oldalt, de nem tette be az indexbe, és lehet, hogy később mégis megteszi. A „Felfedezve, jelenleg nincs indexelve” azt, hogy tud az oldal létezéséről, de még le sem töltötte, jellemzően azért, mert a letöltés túlterhelte volna a webhelyet.
Az elsőnél a Google azt írja, hogy nem kell újra beküldeni az URL-t, mert később még indexelheti. Ha viszont sok oldalad áll ebben az állapotban, azt érdemes végignézni, ad-e ezeken bármi olyat a tartalom, amiért egyáltalán érdemes lenne indexelni. A második gyakran szerver- vagy tárhelykérdés.
Melyik állapot mit jelent
| Amit a Search Console-ban látsz | Mit jelent | Mivel kezdd |
|---|---|---|
| Az URL nincs a Google-ben | Az oldal nem szerepel az indexben | Nézd meg az URL-ellenőrző eszköz indoklását |
| noindex címkével megjelölt URL | Az oldalon noindex utasítás van |
Fejlesztői beállítás vagy WordPress-jelölőnégyzet |
| A robots.txt letiltotta az URL-t | A robotok nem tölthetik le | Nyisd meg a robots.txt fájlt, keresd a Disallow sorokat |
| Szerverhiba (5xx) | Az oldal hibát adott a letöltéskor | Tárhely, szerver, a hiba időpontja |
| Soft 404 | Hibaüzenet sikeres válaszban | Az oldal adjon valódi 404-es státuszt |
| Duplikált tartalom, a Google más kanonikus oldalt választott | Több cím ugyanazzal a tartalommal | Átirányítások, www, https, canonical |
| Feltérképezve, jelenleg nincs indexelve | Letöltötte, nem indexelte | Ne küldd be újra, az oldal tartalmát nézd meg |
| Felfedezve, jelenleg nincs indexelve | Még le sem töltötte | Szerver terhelhetősége, belső linkek |
Ha benne van az indexben, mégsem találod
Ez a másik eset, és itt nincs mit megjavítani. Az, hogy egy oldal indexelve van, csak annyit jelent, hogy megjelenhet a találatok között. Azt nem, hogy meg is fog, és azt sem, hogy hányadikként.
Itt már nem hibakeresésről van szó. A kérdés az, hogy amit az oldal tartalmaz, mennyire válaszol arra, amire az emberek valójában rákeresnek, és mennyien kínálnak ugyanerre jobb választ. Helyi szolgáltatásnál a Google cégprofil adatai is számítanak. Erről és az AI-válaszokban való megjelenésről külön írtunk a Mit lehet tenni azért, hogy a céged megjelenjen az AI-válaszokban? cikkben.
Pozíciót senki nem tud ígérni, mi sem. Azt viszont meg lehet nézni, milyen keresésekre jelenik meg most az oldalad, és hol van a legnagyobb különbség aközött, amire keresnek, és amit az oldal ténylegesen tartalmaz.
Amit magad is meg tudsz nézni
- Keress rá a cég pontos nevére a Google-ben. Ha ez sem hozza ki az oldalt, indexelési gond van.
- Nyisd meg a
sajatdomain.hu/robots.txtcímet, és nézd meg, van-e benneDisallow: /sor. - Nézd meg az oldal forrását, és keress rá a
noindexszóra. WordPressnél ellenőrizd a Beállítások, Olvasás menüpontot is. - Írd be a nyitóoldalad címét a Search Console URL-ellenőrző eszközébe, és olvasd el, mit ír ki.
- Nézd meg az Oldalak indexelése jelentést, és nézd át, mi az a néhány indok, ami a legtöbb oldaladnál előfordul.
A legtöbb esetben ez a néhány lépés megmutatja, melyik irányba kell indulni.
Ha az indoklásból nem derül ki, mi a teendő, vagy a technikai rész rendben van, és inkább az a kérdés, miért nem jön forgalom, ez a SEO és AI-megtalálhatóság szolgáltatásunk része. Egy ilyen átnézéshez elég a domain és annyi, hogy mióta tart a probléma, ezt itt tudod elküldeni.
Források
- Get your website on Google – Google Search Central
- Page Indexing report – Search Console súgó
- URL Inspection Tool – Search Console súgó
- Block Search indexing with noindex – Google Search Central
- How to use the site search operator – Google Search Central
- Settings Reading screen – WordPress dokumentáció