TechnoRadical notları · Makale
Tarama bütçesi kaç sayfadan sonra gerçekten sorun olur
Tarama bütçesi kaç sayfadan sonra gerçekten sorun olur? Google'ın üç eşiğini (1.000, 10.000+, 100.000 URL) birleştirip kendi sitenizle karşılaştırın.
Tarama bütçesi (crawl budget), Google’ın bir sitedeki sayfaları taramaya ayırdığı isteği ve sunucunun buna verdiği yanıt kapasitesini tanımlayan bir kavramdır. Bunun ne zaman gerçek bir sorun haline geldiği sorusuna Google’ın kendi belgeleri tek bir sayı yerine üç ayrı eşikle cevap veriyor: Search Console’un Tarama İstatistikleri raporu 1.000 sayfadan az siteleri kapsam dışı sayıyor, tarama bütçesi rehberi eşiği 10.000 sayfaya (günlük değişim) ve 1 milyon sayfaya (haftalık değişim) kadar yükseltiyor, John Mueller ise 100.000 URL’lik bir sitenin genellikle bu bütçeyi hiç zorlamadığını söylüyor. Üç eşik aslında üç farklı soruyu cevaplıyor: rehberi baştan sona okumaya değer mi, Search Console’daki raporu açmaya değer mi ve ara büyüklükteki bir site gerçekten risk altında mı. TechnoRadical’ın kendi sitemap’i 49 URL taşıyor, yani en düşük eşiğin bile yirmide birinin altında kalıyor. Bu üç eşiği kendi sayfa sayınız ve içerik değişim sıklığınızla karşılaştıran bir karar çerçevesi, sorunun sizin için gerçek olup olmadığını netleştiriyor. Gerçekten eşiğin üzerindeyse öncelik URL envanterini sadeleştirmek ve yönlendirme zincirlerini kısaltmaktır; tarama bütçesini içerik veya backlink üreterek artırmak mümkün değildir.
Tarama bütçesi Google’ın kendi tanımıyla nedir
Tarama bütçesi, Google’ın bir sitede taramak “istediği” hacim (crawl demand) ile sunucunun kaldırabildiği hacmin (crawl capacity limit) kesiştiği noktadır. Google Search Central’ın tarama bütçesi rehberi bu iki bileşeni ayrı ayrı tanımlar.
Crawl demand üç faktörden oluşur. Algılanan envanter (perceived inventory), Googlebot’un sitede bildiği URL’lerin tamamını veya çoğunu taramaya çalışmasıdır; yönlendirme verilmezse Googlebot bilinen her adresi taramayı dener, envanter çoğaltılmış, kaldırılmış veya önemsiz URL’lerle şişerse tarama zamanı israf olur. Popülerlik, internette daha çok bilinen URL’lerin sistemde daha taze tutulmak için daha sık taranmasıdır. Tazelik ise Google’ın bir belgeyi değişiklikleri yakalayacak sıklıkta yeniden taramak istemesidir.
Crawl capacity limit ayrı bir mekanizmadır. Google sunucuyu yormadan taramak ister; bu sınır sabit değildir, sunucunun yanıt tutarlılığına göre otomatik yükselir veya alçalır. Site hızlı ve hatasız yanıt verdikçe sınır yükselir, sunucu yavaşladıkça veya hata döndürdükçe sınır düşer. Google’ın kendi tarama kaynağı kısıtları (web genelinde sonlu kapasitenin paylaşılması) da bu sınırı etkiler.
Gerçek tarama hacmi bu ikisinin kesişiminde ortaya çıkar. Demand yüksek ama capacity düşükse, örneğin yavaş yanıt veren bir sunucuda, tarama düşük kalır. Demand düşükse, örneğin küçük ve durağan bir sitede, capacity yüksek olsa bile fazladan tarama gerekmez.
Google’ın rehberine göre tarama bütçesi hangi büyüklükteki siteleri ilgilendiriyor
Google’ın tarama bütçesi rehberi önce kimin okumaması gerektiğini söyler. Rehberin açılış cümlesi şöyledir: hızlı değişen çok sayfası olmayan veya sayfaları yayınlandığı gün taranan siteler için gerekli değildir. Rehber yalnızca iki koşullu eşiğin üzerindeki siteleri hedefliyor: haftalık değişen içerikle 1.000.000 veya daha fazla sayfa, ya da günlük değişen içerikle 10.000 veya daha fazla sayfa.
Bu iki eşik birbirinden bağımsızdır ve tek bir sayıya indirgenmemelidir. 10.000 sayfaya sahip ama içeriği ayda bir değişen bir site rehberin ikinci koşulunu (günlük değişim) karşılamaz. Tersine, 200.000 sayfalık haftalık güncellenen bir site de 1.000.000 eşiğinin altında kalır. Rehber, 1.000.000 ile 10.000 arasında farklı değişim sıklıklarına sahip siteler için kesin bir sayı vermez; “duruma göre değişir” dışında bir yanıt yoktur.
Search Console’un kendi eşiği: 1.000 sayfadan az bir site Tarama İstatistikleri raporunu neden hiç açmamalı
Search Console’un Tarama İstatistikleri raporu (Crawl Stats report) farklı bir soruyu cevaplar: rehberi okumaya değer mi değil, bu raporu Search Console’da hiç açmaya değer mi. Google Search Console Yardım’ın rapor sayfası şunu yazar: bu rapor ileri kullanıcılar içindir, binden az sayfası olan bir site bu raporu kullanmaya veya bu düzeyde tarama detayını düşünmeye gerek duymaz. 1.000 sayfadan az, durağan içerikli bir sitenin bu raporu hiç açmasına gerek yoktur.
Rapor üç ana metrik gösterir: toplam tarama isteği sayısı, indirilen toplam bayt ve ortalama sunucu yanıt süresi. Ayrıca “host status” (barındırma durumu) başlığı altında üç ayrı mekanizmayı izler: robots.txt dosyasının getirilme başarısızlık oranı, DNS çözümleme hataları ve sunucunun yanıt vermediği bağlantı sorunları. Bu üç mekanizma son 90 günlük veriyi kapsar.
Bu eşik, tarama bütçesi rehberinin verdiği 10.000+ ve 1.000.000+ sayfalık eşiklerle karıştırılmamalıdır; ikisi farklı sorulara cevap verir. Biri rehberi okumaya değer mi sorusuna, diğeri bu raporu Search Console’da açmaya değer mi sorusuna cevap verir. Türkçe kaynaklarda bu ayrım nadiren yapılıyor: imza.com kaynak göstermeden “1.000 sayfadan az” eşiğini verirken, veritasdijital.com “10.000 sayfa veya daha az” olan sitelerin endişelenmemesi gerektiğini yazıyor; bu ikinci ifade rehberin risk grubu başlangıç eşiğini (günlük değişen içerikle 10.000+ sayfa) ters yönde kullanan bir hatadır ve kaynak göstermiyor.
100.000 URL’lik bir site bile genelde tarama bütçesini zorlamıyor: Mueller’ın hesabı
Google’ın Arama Savunucusu John Mueller, 21 Aralık 2021’de X/Twitter’da bir tarama bütçesi tartışmasına şöyle yanıt verdi: 100.000 URL genellikle tarama bütçesini etkilemeye yetmiyor, bu üç aylık dönemde dakikada birden az isteğe denk geliyor. Bu açıklama Search Engine Roundtable üzerinden aktarılıyor; resmî bir Google dokümantasyon sayfası değil, gayri resmi bir sosyal medya yanıtıdır, bu yüzden belirli bir site için garanti sayılmamalı ve “genellikle” ifadesiyle okunmalıdır.
Hesabı somutlaştırmak ayrımı netleştiriyor. Üç ay yaklaşık 90 gündür, bu da 129.600 dakikaya karşılık gelir. Dakikada birden az ek istek, üç aylık dönemde en fazla yaklaşık 129.600 ek isteğe denk gelir; bu, Googlebot’un günlük olağan tarama hacmi yanında ölçülemeyecek kadar küçük bir yüktür. Bu hesap Mueller’ın gözlemine dayanan bir yaklaşık büyüklük göstergesidir, Google’ın yayınladığı resmî bir formül değildir.
100.000 URL, Search Console’un 1.000 sayfa eşiği ile rehberin 10.000+/1.000.000+ eşiği arasında kalan somut bir ara nokta örneğidir. Üçü birlikte okunduğunda “kaç sayfadan sonra sorun olur” sorusunun cevabının tek bir sayı değil, sayfa sayısı, değişim sıklığı ve duplikasyon oranının birleşimi olduğu ortaya çıkıyor.
Kendi siteniz bu eşiklerin neresinde, nasıl kontrol edersiniz
Kendi sitenizin bu eşiklerin neresinde durduğunu görmek iki sayıya bakmayı gerektirir: toplam sayfa sayısı ve içeriğin değişim sıklığı.
- Toplam URL sayısını çıkarın. XML sitemap indeks dosyasını açıp alt sitemap’lerdeki URL sayılarını toplayın veya Search Console’un Site Haritaları raporundaki “Bulunan URL” sütununa bakın.
- İçerik değişim sıklığını sınıflandırın. İçerik yılda birkaç kez mi güncelleniyor (durağan), haftada bir mi değişiyor, yoksa günlük mü yeni sayfa veya güncelleme üretiyor.
Sayfa sayısı ile değişim sıklığının birleşimi şu kararı verir.
| Sayfa sayısı | Değişim sıklığı | Karar |
|---|---|---|
| 1.000’in altı | Herhangi | Tarama İstatistikleri raporunu hiç açmaya gerek yok |
| 1.000 - 10.000 | Durağan veya haftalık | Yalnızca indekslenmeme veya yavaş tarama gibi somut bir belirti varsa bakın |
| 10.000 ve üzeri | Günlük değişen | Tarama bütçesi rehberini okuyun, verimlilik adımlarını uygulayın |
| 1.000.000 ve üzeri | Haftalık değişen | Tarama bütçesi rehberini okuyun, verimlilik adımlarını uygulayın |
Çalışan bir örnek bu tabloyu somutlaştırıyor. Eylül 2026’da doğrudan taranan technoradical.com’un sitemap’i 49 URL taşıyor (33 blog yazısı, 6 araç sayfası ve kalan statik sayfalar); bu sayı 1.000 eşiğinin yirmide birinden azdır ve tabloya göre en alt satıra düşer. Bu sayım gerçek Googlebot tarama davranışını değil, sitemap’te bildirilen URL sayısını gösterir; sitenin gerçek tarama verisi Search Console’da henüz üç aylık geçmiş birikmediği için yoktur. Bu sayım aslında daha geniş bir denetimin tek bir parçasıdır: beş katmanlı teknik SEO denetiminin tarama/indeksleme katmanı robots.txt, site haritası ve yönlendirme zincirini aynı anda otomatik olarak tarar.
Tarama bütçesi gerçekten sorun olduğunda kaynağı genelde nedir
Gerçek sorunun kaynağı çoğunlukla sayfa sayısının kendisi değil, algılanan envanterin çoğaltılmış veya önemsiz URL’lerle şişmesidir. Bu şişme somut senaryolarda ortaya çıkar: filtre kombinasyonlarının her birinin ayrı bir URL ürettiği e-ticaret kategori sayfaları, oturum kimliği veya sıralama parametresi taşıyan adresler, sonu gelmeyen sayfalama zincirleri.
Bu tür parametre kaynaklı çoğalmayı yönetmenin eski yolu artık yok. Google, URL Parametreleri aracını 26 Nisan 2022’de tamamen kapattı; duyuru gerekçesini, aracın sunduğu yapılandırmaların yalnızca yaklaşık %1’inin tarama için gerçekten kullanışlı olduğunu söyleyerek açıklıyor. Parametre kaynaklı duplikasyon bugün Google’ın kendi seçim mekanizmasıyla, rel="canonical" etiketi ve gerektiğinde robots.txt ile yönetiliyor. Aynı içerik birden fazla URL’de göründüğünde bu şişme büyür; en sık ve en fark edilmez nedenlerden biri, kanonik etiketin sessizce yanlış kurulmasıdır. Google’ın kendi duplike URL birleştirme rehberi, hiçbir sinyalin (301, canonical, sitemap) zorunlu olmadığını, belirtilmezse Google’ın kendi objektif seçimini yaptığını açıkça yazıyor. Bu, sinyal vermemenin bir “ceza” anlamına gelmediği ama kontrolü tamamen Google’a bıraktığı anlamına gelir; kanonik etiket yanlış kurulduğunda bu kontrol, istenmeyen bir URL’nin taranmaya devam etmesi yönünde çalışabilir.
Tarama bütçesi gerçekten sorunsa hangi sekiz adım önceliklidir
Google’ın tarama bütçesi rehberi, tarama verimliliğini artırmak için sekiz somut öneri veriyor. Öncelik sırası önce envanter ve duplikasyonu sadeleştirmek, sonra sunucu tarafını hızlandırmaktır.
- URL envanterini yönetin. Google’a hangi sayfaların taranıp taranmayacağını uygun araçlarla (robots.txt, sitemap) bildirin.
- Yinelenen içeriği birleştirin. Tarama, çoğaltılmış URL yerine benzersiz içeriğe odaklansın.
- Önemsiz sayfaları robots.txt ile engelleyin.
- Kalıcı kaldırılan sayfalar için 404 veya 410 durum kodu döndürün.
- Soft 404 hatalarını giderin. Bu sayfalar tarama bütçesini israf etmeye devam eder.
- Site haritalarını güncel tutun. Güncellenen içerik için
<lastmod>etiketini kullanın. Etiketi yanlış kurmak ise hiç kullanmamaktan daha kötü bir sinyal sayılıyor; sitemap lastmod yanlış kurulunca ortaya çıkan dört bozulma kalıbı bu ayrımı ve kendi sitemizdeki düzeltmeyi gösteriyor. - Uzun yönlendirme zincirlerinden kaçının. Bunu elle sayfa sayfa kontrol etmek yerine, yönlendirme zincirlerini ve robots.txt/site haritası bildirimini otuz saniyede tarayan site denetimi aynı kontrolü otomatik yapar.
- Sayfaları hızlı yüklenir hale getirin. Sunucu yanıt sürelerini optimize edin, HTTP önbelleklemeyi ve 304 yanıtlarını destekleyin.
Kendi denetim aracımızın yönlendirme zinciri bulgusu, listedeki yedinci maddenin doğrudan otomatik karşılığıdır; sekiz maddenin hiçbiri için Google, kazandıracağı süreyi veya oranı sayısallaştırmıyor, hepsi niteliksel bir öncelik sırasıdır.
Tarama bütçesi optimizasyonuna ne zaman hiç girişilmemeli
1.000 sayfadan az, durağan içerikli bir site için Search Console’un kendi tavsiyesi bu raporu hiç açmamaktır; 10.000 sayfanın altında ve günlük değişmeyen bir site rehberin kapsamı dışında kalır; 100.000 URL’ye kadar bile Mueller’ın gözlemine göre genelde sorun çıkmaz. Üç eşik birlikte okunduğunda küçük ve orta ölçekli çoğu site için cevap nettir: bu konuyu düşünmeye gerek yok.
TechnoRadical’ın kendi sitesi bu üç eşiğin de fersah fersah altında kalıyor: 49 URL, 1.000 sayfalık en düşük eşiğin yirmide birinden azdır. Bu içeriği üreten otomasyon sistemi bile şu an bu sorunu düşünmesine gerek olmayan bir örnektir; bu bir performans iddiası değil, yalnızca bir sayım gözlemidir.
Tarama bütçesini artırmanın tek somut resmî koşulu sunucu kapasitesi darboğazıdır. Rehberin “How do I get more crawl budget?” bölümü tek koşulu şöyle veriyor: sunucu kapasitesi yüzünden site taranamıyorsa (URL İnceleme aracında “Hostload exceeded” hatası görülüyorsa), işe yarayacaksa daha fazla sunucu kaynağı eklenmesi öneriliyor. İçerik veya backlink üretmek, sektörde sık duyulan bir tavsiye olsa da, bu koşulun bir parçası değildir ve tarama bütçesini artıran evrensel bir yöntem yoktur.
Sunucu kapasitesi darboğazını Search Console’da nasıl fark edersiniz?
Tarama İstatistikleri raporundaki host status bölümünde robots.txt getirme hatalarının, DNS çözümleme sorunlarının veya sunucu bağlantı hatalarının artması, kapasite sınırının zorlanmaya başladığının ilk işaretidir. URL İnceleme aracında bir sayfa için “Hostload exceeded” mesajı görünüyorsa sorun artık içerik veya envanter tarafında değil, doğrudan sunucu kapasitesi tarafındadır ve çözüm sunucu kaynağı eklemektir.
Az sayfalı bir site için site haritası (sitemap) göndermek hâlâ gerekli mi?
Hayır, zorunlu değil ama faydalıdır. Google, sitemap kaydını URL keşfi için zayıf ama yararlı bir sinyal sayıyor; hiçbir yöntem (301 yönlendirme, canonical etiketi, sitemap) zorunlu değildir, belirtilmezse Google kendi seçimini yapar. Az sayfalı bir sitede sitemap göndermenin gerekçesi tarama bütçesi kaygısı değildir; yeni yayınlanan sayfaların daha hızlı keşfedilmesidir.
tarama bütçesi · crawl budget · teknik SEO · Search Console