Whiteseo

Səhifələrin indeksləşməsi hesabatı və URL yoxlaması

Səhifələrin indeksləşməsi hesabatı və URL yoxlaması

"Səhifəm Google-da görünmür" — SEO-da ən çox verilən sualdır və cavabı demək olar ki, həmişə Search Console-un Səhifələrin indeksləşməsi (Page indexing) hesabatındadır. Bu hesabat Google-un saytınızdan bildiyi hər URL-i iki qrupa bölür — indekslənənlər və indekslənməyənlər — və ikinci qrupu səbəb üzrə qruplaşdırır.

Səbəb sözü burada açardır. "İndekslənmir" tək bir problem deyil; onun arxasında bir-birindən tamamilə fərqli 15-ə yaxın hal var: texniki blok, dublikat, kanonik seçim, keyfiyyət qərarı, sadəcə növbə. Hər birinin həlli fərqlidir, ona görə əvvəlcə səbəbi oxumaq, sonra hərəkət etmək lazımdır.

Bu yazı hesabatın bütün statuslarını Google-un rəsmi izahları ilə açır və URL yoxlaması (URL Inspection) alətini diaqnostika üçün necə istifadə etməyi göstərir. Alətin ümumi mənzərəsi: Google Search Console nədir və necə işləyir.

Qısa cavabBir səhifənin Google-da görünməsi üçün üç şərt lazımdır: URL kəşf olunmalı, taranmalıindekslənməlidir. Hesabat hansı mərhələdə dayandığını göstərir. "Discovered — currently not indexed" tarama növbəsi/büdcə problemidir; "Crawled — currently not indexed" isə keyfiyyət qərarıdır və düymə ilə həll olunmur. İndeksləşdirməni istəmək növbəyə əlavə edir, zəmanət vermir.

Tarama və indeksləşmə fərqi

Bu iki söz çox vaxt qarışdırılır, halbuki fərqli proseslərdir:

Tarama (crawling) — Googlebot-un URL-i endirməsidir. Bu, sadəcə fayl əldə etməkdir.

İndeksləşdirmə (indexing) — Google-un həmin məzmunu emal edib indeksinə yazması və nəticələrdə göstərməyə namizəd etməsidir. Bu, qərardır — və Google bu qərarı verməyə bilər.

Aradakı fərq bütün diaqnostikanın əsasıdır: taranmış səhifə indekslənməyə bilər, hətta hər şeyi texniki cəhətdən düzgün etsəniz belə. Google indeksləşdirməni heç vaxt zəmanət etmir.

Saytınızdakı bütün URL-lərGoogle-un kəşf etdiyi URL-lərmənbə: sitemap, daxili linklər, xarici linklərTaranan URL-lərtarama büdcəsi, server cavabı, prioritetİndekslənən URL-lərkeyfiyyət, dublikat, kanonik qərarı
Sxem 1 — Hər mərhələdə URL sayı azalır. Hesabat sizə göstərir ki, itki hansı mərhələdə baş verib.

Hesabatın quruluşu

Hesabat üç blokdan ibarətdir:

İndekslənən səhifələr. Google-un indeksində olan URL-lər. Rəqəmin özü hədəf deyil — 500 səhifəlik saytda 500 indekslənmiş səhifə olması yaxşı əlamət deyil, əgər həmin səhifələrin yarısı filtr URL-ləri və ya boş kateqoriyalardırsa.

İndekslənməyən səhifələr. Səbəb üzrə qruplaşdırılmış siyahı. Diqqət: buradakı hər sətir problem deyil. Məsələn, "Alternate page with proper canonical tag" tamamilə normal və düzgün vəziyyətdir.

Xəbərdarlıqlar. İndekslənib, amma problemlə: məsələn, robots.txt ilə bloklanmasına baxmayaraq indekslənmiş səhifə.

Bu ayrımı başa düşmək vaxt qazandırır. Praktik qayda: "indekslənməyən" rəqəminin böyük olması özlüyündə pis deyil — vacib olan həmin URL-lərin hansı səbəbləsizin indeksdə görmək istədiyiniz səhifələr olub-olmadığıdır.

Bütün statuslar və əsl mənaları

Aşağıdakı cədvəldə Google-un rəsmi izahları və hər statusun praktik tərcüməsi var.

Status Google-un izahı Praktik məna
Server error (5xx) "Your server returned a 500-level error when the page was requested." Server problemi. Təcili — tarama sürəti də düşür
Redirect error Çox uzun zəncir, dövr, həddindən artıq uzun URL və ya sınıq yönləndirmə Yönləndirmə zəncirini qısaldın
URL blocked by robots.txt "This page was blocked by your site's robots.txt file." Google girə bilmir. Qəsdən deyilsə, qaydanı silin
URL marked 'noindex' "When Google tried to index the page it encountered a 'noindex' directive" Teq və ya başlıq göstəriş verir. Qəsdən deyilsə, silin
Soft 404 "It returns a user-friendly 'not found' message but not a 404 HTTP response code" Kod və məzmun ziddiyyətdədir
Blocked due to unauthorized request (401) "The page was blocked to Googlebot by a request for authorization." Şifrə arxasındadır
Blocked due to access forbidden (403) "The user agent provided credentials, but was not granted access." Server Googlebot-u rədd edir
Not found (404) "This page returned a 404 error when requested." Səhifə yoxdur. Köhnə URL-dirsə, 301 lazımdır
Page with redirect "This is a non-canonical URL that redirects to another page." Normaldır — hədəf səhifə indekslənir
Alternate page with proper canonical tag "This page is marked as an alternate of another page... correctly points to the canonical page." Problem deyil. Düzgün işləyən kanoniklik
Duplicate without user-selected canonical "This page is a duplicate of another page, although it doesn't indicate a preferred canonical page." Kanonik teq qoyun
Duplicate, Google chose different canonical than user "This page is marked as canonical... but Google thinks another URL makes a better canonical." Siqnallarınız ziddiyyətlidir
Crawled — currently not indexed "The page was crawled by Google but not indexed." Keyfiyyət/dəyər qərarı
Discovered — currently not indexed "The page was found by Google, but not crawled yet." Növbə və büdcə məsələsi
Indexed, though blocked by robots.txt "The page was indexed despite being blocked by your website's robots.txt file." Ziddiyyətli siqnal — noindex üçün robots.txt blokunu açmaq lazımdır
Page indexed without content "This page appears in the Google index, but for some reason Google could not read the content." Render və ya cloaking problemi

Bu statusları üç ailəyə bölmək işi asanlaşdırır:

1. Texniki bloklar (401, 403, 404, 5xx, robots.txt, noindex, redirect error) — həlli sizin əlinizdədir və dəqiqdir. Bunların əksəriyyəti server cavabı ilə bağlıdır: HTTP status kodları və SEO404, 410, soft 404.

2. Kanonik/dublikat qrupu — Google eyni məzmunu bir neçə URL-də görür və birini seçir. Həlli: kanonik teqləri, daxili linkləri və yönləndirmələri bir-birinə uyğunlaşdırmaq.

3. Keyfiyyət və növbə qrupu ("Crawled/Discovered — currently not indexed") — ən çətin ikisi. Növbəti bölmə bunlara həsr olunub.

İki ən çətin status

"Discovered — currently not indexed" — Google URL-i tanıyır, amma hələ taramayıb. Rəsmi izah: "The page was found by Google, but not crawled yet." Adətən səbəblər bunlardır:

  • Sayt yenidir və ya URL sayı sürətlə artıb — tarama büdcəsi çatmır.
  • Serverin cavabı yavaşdır, Googlebot tempi azaldıb.
  • URL-ə daxili link az gedir və ya heç getmir — Google onu prioritet saymır.
  • Sitemapda var, amma saytın strukturunda yoxdur ("orfan səhifə").

Nə etməli: daxili linkləmə strukturunu gücləndirin (bu, ən təsirli addımdır — bax topical authority və kontent klasteri), server cavab müddətini yaxşılaşdırın, sitemapı təmizləyin (404 və yönləndirilən URL-lər olmasın), lazımsız URL variantlarını (filtr, sıralama parametrləri) azaldın.

"Crawled — currently not indexed" — Google səhifəni görüb və indeksləməməyi seçib. Rəsmi izah: "The page was crawled by Google but not indexed." Bu, texniki xəta deyil, dəyər qərarıdır. Ən çox rast gəlinən səbəblər:

  • Məzmun nazikdir və ya digər səhifələrinizin təkrarıdır.
  • Səhifə mövcud nəticələrə əlavə dəyər vermir.
  • Şablon məzmun üstünlük təşkil edir (eyni mətn, dəyişən yalnız bir söz).
  • Səhifə avtomatik yaradılıb (filtr kombinasiyaları, boş kateqoriyalar).

Nə etməli: səhifəni gücləndirin (orijinal məlumat, dərinlik, sual-cavab), oxşar səhifələri birləşdirin, dəyər verməyən səhifələri noindex edin və ya silin. Mövzunun necə struktura salınacağı üçün: semantik SEO nədir.

Vacib qeyd"Crawled — currently not indexed" statusunda olan səhifəni dəfələrlə "indeksləşdirməyə göndərmək" işə yaramır. Google səhifəni artıq görüb; problem görməkdə deyil, məzmunun dəyərində və ya təkrarlığındadır. Səhifəni dəyişmədən nəticə də dəyişməyəcək.

URL yoxlaması aləti

URL yoxlaması (URL Inspection) tək bir URL üçün Google-un bildiyi hər şeyi göstərir. Google-un təsviri ilə, alət "provides information about Google's indexed version of a specific page, and also allows you to test whether a URL might be indexable".

Burada iki fərqli məlumat var və onları qarışdırmaq ən çox yayılan səhvdir:

İndeksdəki versiya Canlı test (Live test)
Nəyi göstərir Google-un ən son taradığı halı URL-in indiki halını
Nə vaxt istifadə olunur "Google nə bilir?" "Düzəlişim işlədimi?"
Google-un qeydi "the results shown are from most recently indexed version of a page, not the live version on the web" "fetches and examines the URL in real time"

Yəni düzəliş etdikdən dərhal sonra indeksdəki versiya hələ də köhnə problemi göstərəcək — bu normaldır. Düzəlişi yoxlamaq üçün Canlı test düyməsini basmaq lazımdır.

İndeksləşdirməni istəmək (Request indexing). Bu düymə URL-i prioritet tarama növbəsinə salır. Google açıq yazır: "submitting a request does not guarantee that the page will appear in the Google Index." Həmçinin gündəlik limit var — həm yoxlama sorğularına, həm də indeksləşdirmə tələblərinə. Yüzlərlə URL-i əl ilə göndərmək praktik yol deyil; kütləvi hallarda düzgün alət sitemapdır.

Gözləmə müddəti barədə Google-un ifadəsi: "Indexing typically takes only a day or so, but can take much longer in some cases" — bəzi hallarda bir-iki həftə gözləmək tövsiyə olunur. Yeni saytlarda bu müddət daha uzun ola bilər.

Alət həmçinin göstərir: səhifənin kanonik URL-i (sizin göstərdiyiniz və Google-un seçdiyi — ikisi fərqli ola bilər), mobil uyğunluq, struktur məlumat (schema) və hansı sitemapda tapıldığı. Kanonik uyğunsuzluğunu ən tez burada görürsünüz.

Diaqnostika ardıcıllığı

Səhifə Google-da yoxdur → URL yoxlaması alətinə salın və statusa baxınSTATUSTƏDBİRrobots.txt bloklayırvə ya 401 / 403 qaytarırQaydanı və ya server icazəsini açın,sonra canlı testlə yoxlayınnoindex teqi varmeta və ya X-Robots-TagTeqi silin. Diqqət: robots.txt bloku varsa,Google teqi görə bilmir — əvvəlcə bloku açınDublikat / kanonikGoogle başqa URL seçibKanonik teq, daxili link və sitemapıeyni URL-ə yönəldinDiscovered — not indexedtapılıb, taranmayıbDaxili link verin, sitemapı təmizləyin,server cavabını sürətləndirinCrawled — not indexedgörülüb, seçilməyibMəzmunu gücləndirin və ya birləşdirin —düymə basmaqla həll olunmur
Sxem 2 — Status nə deyirsə, tədbir də odur. Qırmızı çərçivəli iki hal texniki deyil, strategiya məsələsidir.

Ardıcıllığı belə saxlayın:

  1. URL yoxlaması ilə konkret səhifənin statusuna baxın.
  2. Status texniki blokdursa (robots.txt, noindex, 4xx, 5xx) — bloku aradan qaldırın və canlı test edin.
  3. Status kanonik/dublikatdırsa — kanonik teq, daxili linklər və sitemapın eyni URL-i göstərdiyinə əmin olun.
  4. Status "Discovered" və ya "Crawled — not indexed" isə — düyməyə basmaq yerinə struktur və məzmun üzərində işləyin.
  5. Düzəlişdən sonra bir dəfə indeksləşdirməni istəyin və 1-2 həftə gözləyin.
  6. Hesabatda "Doğrulamanı başlat" (Validate fix) düyməsi varsa, onu basın — Google kütləvi şəkildə yenidən yoxlayacaq.

Tez-tez edilən səhvlər

1. noindex teqini robots.txt bloku ilə birlikdə istifadə etmək. Səhifə robots.txt ilə bloklanıbsa, Google onun içindəki noindex teqini oxuya bilmir və URL indeksdə qala bilər. Düzgün ardıcıllıq: əvvəlcə robots.txt blokunu açın, noindex görünsün, sonra istəsəniz bloklayın.

2. "İndekslənməyən" rəqəmini sıfıra endirməyə çalışmaq. Bu rəqəmin içində normal hallar var (kanonik alternativlər, yönləndirmələr). Hədəf sıfır deyil, düzgün səbəb paylanmasıdır.

3. Eyni URL üçün dəfələrlə indeksləşdirmə tələb etmək. Növbəni sürətləndirmir, gündəlik limiti isə boş yerə xərcləyir.

4. Canlı testin nəticəsini indeks statusu sanmaq. Canlı test "indekslənə bilər" deyir, "indekslənib" demir.

5. Sitemapı təmizləməmək. İçində 404, yönləndirilən və ya noindex URL-lər olan sitemap Google-un saytınıza olan etimadını azaldır və büdcə xərcləyir.

6. Yeni sayta bir gündə nəticə gözləmək. Google indeksləşdirmənin adətən bir gün çəkdiyini, amma bəzi hallarda daha uzun sürdüyünü yazır — yeni domenlərdə həftələr normaldır.

Tez-tez verilən suallar

"Crawled — currently not indexed" nə deməkdir?

Google səhifəni taradı, amma indeksləməmək qərarına gəldi. Bu, texniki xəta deyil — məzmunun dəyəri, orijinallığı və ya təkrarlığı ilə bağlı qərardır. Həll yolu səhifəni gücləndirmək və ya oxşar səhifələrlə birləşdirməkdir.

"Discovered — currently not indexed" nə deməkdir?

Google URL-i tanıyır, amma hələ taramayıb. Adətən tarama büdcəsi, zəif daxili linkləmə və ya yavaş server ilə bağlıdır. Daxili link vermək ən təsirli addımdır.

İndeksləşdirməni istəmək sıralamama kömək edirmi?

Xeyr. Bu düymə yalnız tarama növbəsinə əlavə edir. Google açıq yazır ki, sorğu göndərmək səhifənin indeksdə görünəcəyinə zəmanət vermir; sıralamaya isə heç bir təsiri yoxdur.

Səhifəm indekslənib, amma axtarışda tapmıram. Niyə?

İndekslənmək və sıralanmaq fərqli şeylərdir. Səhifə indeksdə ola, amma rəqabətli sorğuda 50-ci mövqedə dayana bilər. Real vəziyyəti Effektivlik hesabatında göstərilmə və mövqe ilə yoxlayın.

İndeksləşmə nə qədər çəkir?

Google-un ifadəsi: "Indexing typically takes only a day or so, but can take much longer in some cases" — bəzən bir-iki həftə. Yeni saytlarda daha uzun sürə bilər.

Sitemap göndərmək indeksləşməyə zəmanət verirmi?

Xeyr. Sitemap kəşfetməyə kömək edir, indeksləşdirmə qərarını dəyişmir. Amma təmiz sitemap (yalnız kanonik, 200 qaytaran URL-lər) prosesi nəzərəçarpacaq dərəcədə sürətləndirir.

"Alternate page with proper canonical tag" problemdirmi?

Xeyr. Bu, kanonikliyin düzgün işlədiyini bildirir: səhifə başqa URL-in alternatividir və ona düzgün işarə edir. Toxunmaq lazım deyil.

Səhifəni indeksdən necə silim?

Daimi silinmə üçün səhifədə noindex qoyun (və robots.txt ilə bloklamayın) ya da 404/410 qaytarın. Search Console-un "Silinmələr" aləti isə yalnız müvəqqəti gizlətmə üçündür — bax 404, 410 və soft 404.

Bu klasterin davamıİndeksləşmə problemlərinin diaqnostikası və həlli texniki SEOSEO audit xidmətlərimizin əsas hissəsidir.
İstifadə olunan rəsmi mənbələr
  1. Page Indexing report — bütün statusların rəsmi izahı
  2. URL Inspection tool — indeksdəki versiya, canlı test, indeksləşdirmə tələbi
  3. Sitemaps report
  4. Search Console overview
  5. Large site owner's guide to managing crawl budget — tarama büdcəsi
Whiteseo SEO Komandası
SEO mütəxəssisləri · 8+ il təcrübə · Yoxlanılıb və redaktə olunub

Whiteseo komandası 2016-cı ildən bəri yerli və beynəlxalq brendlər üçün axtarış optimizasiyası ilə məşğul olur. Məqalələrimiz real layihə təcrübəsi əsasında hazırlanır.

WhatsApp Bloglar