TechnoRadical İletişime geçin

TechnoRadical notları · Makale

Log Analizi Küçük Sitede İşe Yarar mı?

Google'ın üç eşiğine göre çoğu küçük sitede log analizi gereksiz. Gerçek Googlebot'u doğrulama komutu ve dar istisna senaryoları burada.

Log analizi küçük bir sitede genellikle işe yaramaz. Google’ın Search Console yardım sayfası, tarama bütçesi rehberi ve John Mueller’ın 100 bin URL gözlemi aynı yöne işaret eder: binden az sayfası olan, içeriği durağan bir site için sunucu log dosyasına inmek zaman ve araç bütçesine değmez. Bu genellemenin üç dar istisnası vardır: parametre patlaması yaşayan bir e-ticaret sitesi, bir URL değişikliği (migration) sonrası şüpheli bir sayfa ve gerçek Googlebot’la sahte bir kazıyıcının karıştığı durumlar. Yazı bu üç eşiği tek bir çerçevede birleştirir, gerçek Googlebot’u sahte bir user-agent’tan host komutuyla nasıl ayıracağını gösterir ve ücretsiz bir log aracının gerçek maliyetini hesaplar.

Log analizi nedir, sunucu logu tam olarak ne kaydeder

Log analizi, sunucunun tuttuğu erişim kayıtlarını (access log) okuyup hangi isteğin insana hangisinin arama motoru botuna ait olduğunu, hangi sayfanın ne zaman ve hangi sonuçla taranıp yanıtlandığını çıkarma işidir. Bu işlem, ham metin dosyasını satır satır filtreleyip belirli bir soruya (örneğin “Googlebot son bir haftada hangi sayfaları taradı”) kanıtlı bir cevap aramaktan ibarettir.

Sunucu erişim logu her HTTP isteğini yedi temel alanla kaydeder. Bu alanlar istemci IP adresi, zaman damgası, istek metodu (GET veya POST), istenen URL, HTTP durum kodu, user-agent ve referrer’dır. Örnek bir log satırı şöyle görünür.

66.249.66.1 - - [27/Sep/2026:10:14:32 +0300] "GET /blog/ornek-yazi/ HTTP/1.1" 200 15234 "-" "Mozilla/5.0 (compatible; Googlebot/2.1; +http://www.google.com/bot.html)"

Bu satırdaki alanlar sırasıyla IP adresi, zaman damgası, istek satırı, durum kodu, yanıt boyutu (bayt), referrer ve user-agent’tır. Bu kayıtlar Apache ve NGINX sunucularında genelde access.log dosyasında saklanır; paylaşımlı hostinglerde kontrol panelinden indirilir, Cloudflare gibi bir CDN katmanı varsa ayrı bir log servisinden çekilir.

Log analizinin ilk mekanik adımı bot trafiğini insan trafiğinden ayrıştırmaktır ve bu ayrıştırma user-agent alanına göre yapılır. Ancak bu adımın kendisi bir sınır taşır: user-agent metni istemci tarafından bildirilir ve taklit edilebilir. “Googlebot” yazan bir satırın gerçek Googlebot’a ait olup olmadığını doğrulamak ayrı bir adımdır.

Log analizi küçük bir sitede genelde işe yaramaz

Hayır, içeriği durağan olan küçük veya orta ölçekli bir site için log analizi genelde zaman ve araç bütçesine değmez. Bu cevap tek bir görüşe değil, Google’ın kendi yayınladığı üç ayrı eşiğe dayanır.

Google Search Console’un Tarama İstatistikleri (Crawl Stats) raporu kendi yardım sayfasında şunu yazar: “This report is aimed at advanced users. If you have a site with fewer than a thousand pages, you should not need to use this report or worry about this level of crawling detail.” Yani binden az sayfası olan bir site için Google’ın kendi tanımına göre bu rapor da, log dosyasına inmek de gereksizdir. Rapor son 90 günü kapsar ve toplam tarama isteği, toplam indirilen bayt, ortalama yanıt süresi ile robots.txt getirme hatası, DNS çözümleme hatası ve sunucu yanıtsızlığı gibi host status kategorilerini gösterir; URL bazlı ayrıntı vermez.

Google’ın büyük site tarama bütçesi rehberi de kapsamını kendi girişinde daraltır: rehber yalnızca haftalık değişen 1 milyondan fazla sayfalı siteleri veya günlük değişen 10 binden fazla sayfalı siteleri hedefler. Search Console’un Crawl Stats raporunun kendi ifadesiyle 1000 sayfadan az olan bir sitenin bu ayrıntı seviyesiyle hiç ilgilenmesine gerek yoktur; bu eşik, tarama bütçesinin hangi sayfa sayısından sonra gerçekten sorun olduğunu gösteren daha geniş bir çerçevenin yalnızca bir parçasıdır. İki eşik ayrı sorulara cevap verir. Crawl Stats raporu, raporu açmaya değip değmediği sorusuna cevap verir; tarama bütçesi rehberi, rehberi okumaya değip değmediği sorusuna cevap verir. İkisi karıştırılmamalıdır.

Google’ın Arama Savunucusu John Mueller, 21 Aralık 2021’de X/Twitter’da 100 bin URL’lik bir sitenin genelde tarama bütçesini ölçülebilir şekilde etkilemediğini yazdı; bu ek yükün üç aylık dönemde dakikada birden az isteğe karşılık geldiğini belirtti. Bu açıklama Search Engine Roundtable üzerinden aktarılıyor; resmî bir dokümantasyon değil gayri resmî bir açıklamadır, dolayısıyla belirli bir site için garanti sayılmamalı, genellikle geçerli bir gözlem olarak okunmalıdır.

Kendi sitemizin (technoradical.com) sitemap’i 49 URL taşır (21 Eylül 2026 tarihli tarama). Bu sayı, Search Console’un adlandırdığı en düşük eşiğin (1000 sayfa) yirmide birinden azdır; bu ölçekte bir site için log dosyasına inmeden önce Search Console’un ücretsiz özet raporu yeterlidir. Bu bir performans iddiası değil, yalnızca bir URL sayımıdır; sitenin gerçek Googlebot tarama davranışını ölçmez.

Log analizi ne zaman gerçekten işe yarar

Log analizi dar birkaç senaryoda gerçekten gerekçelidir. Bu senaryoların ortak noktası sayfa sayısı değil, bir belirsizliğin URL bazlı kanıtla çözülmesi gerektiğidir.

Birinci senaryo filtre veya parametre kombinasyonu üreten küçük bir e-ticaret sitesidir. Örneğin renk, beden ve fiyat filtresi kombinasyonlu bir kategori sayfası, ürün sayısı düşük olsa bile yüzlerce parametreli URL üretebilir. Google’ın crawl demand tanımına göre tarama talebi algılanan URL envanterine, popülerliğe ve içerik tazeliğine dayanır; bu üç faktörden algılanan envanter, çoğaltılmış veya önemsiz parametreli URL’lerle şişince küçük bir site bile gerçek bir tarama deseni sorunu yaşayabilir.

İkinci senaryo bir URL değişikliğinden (migration) sonra önemli bir sayfanın hiç taranmadığından şüphelenilen durumdur. Search Console’un toplu raporu burada yetmez; hangi URL’nin ne zaman ve hangi durum koduyla yanıtlandığını gösteren URL bazlı bir kanıt gerekir. Bu şüphenin somut bir örneği, robots.txt kuralı ile noindex etiketinin sessizce birbirini geçersiz kılması durumudur; noindex etiketinin işlemesi için Googlebot’un sayfayı hiç engellenmeden taraması gerekir, sayfa robots.txt tarafından engellenmişse Googlebot etiketi hiç göremez ve sayfa beklenmedik biçimde indekste kalır veya kalkmaz. Bu çelişki Search Console raporunda görünmez ama log kaydında görünür: sayfa hiç taranmıyor gibi durur ve nedeni ancak istek geçmişinde çözülür.

Üçüncü senaryo, sitede beklenmedik bir trafik artışı görülüp bunun gerçek Googlebot mu yoksa Googlebot’u taklit eden bir kazıyıcı mı olduğundan şüphelenilmesidir. Bu şüphe de yalnızca ham log kaydına inerek ve IP doğrulaması yaparak çözülür.

Bu üç senaryo, küçük bir sitede log analizinin genelde gereksiz olduğu cevabını çürütmez; onu dar ve isimlendirilmiş vakalarla sınırlar.

Log dosyasında gerçek Googlebot’u nasıl doğrularsınız

Log satırındaki “Googlebot” ibaresine bakmak yeterli değildir; bu ibare istemci tarafından bildirilir ve sahte bir kazıyıcı aynı user-agent’ı taklit edebilir. Gerçek Googlebot’u doğrulamanın resmî yolu, erişen IP adresi üzerinde reverse DNS sorgusu çalıştırmaktır.

Google Search Central’ın Googlebot doğrulama sayfası (son güncelleme 2026-03-20) bu dört adımı tanımlar.

  1. Log dosyasını user-agent alanında “Googlebot” geçen satırlara göre filtreleyin ve benzersiz IP listesi çıkarın: grep "Googlebot" access.log | awk '{print $1}' | sort -u.
  2. Her benzersiz IP için host komutuyla reverse DNS sorgusu çalıştırın: host 66.249.66.1.
  3. Dönen alan adının googlebot.com, google.com veya googleusercontent.com ile bittiğini doğrulayın.
  4. Bulunan hostname üzerinde forward DNS sorgusu çalıştırıp IP’nin gerçekten eşleştiğini teyit edin: host crawl-66-249-66-1.googlebot.com.

Bir alternatif de vardır: Google’ın yayınladığı JSON IP aralığı listeleriyle (yaygın crawler’lar, özel durum crawler’ları ve kullanıcı tetiklemeli fetcher’lar için ayrı ayrı üç liste) otomatik eşleştirme yapmak. Bu yöntem çok sayıda IP’yi tek tek host komutuyla sorgulamak istemeyen siteler için daha pratiktir.

Bu doğrulama atlanırsa, sahte bir user-agent ile gelen bir kazıyıcı “Googlebot ziyaret sayısı” gibi görünüp log analizinden çıkan sonucu yanlış hale getirir.

Search Console’un Crawl Stats raporu log analizinin yerini ne kadar tutar

Search Console’un Crawl Stats raporu, dar istisna senaryoları dışında log analizinin yerini tutar. İkisi arasındaki fark ayrıntı seviyesi, maliyet ve kurulum zorluğudur.

Veri kaynağıAyrıntı seviyesiMaliyetKurulum zorluğuKüçük site için yeterlilik
Crawl Stats raporuToplam metrik, URL bazlı değilÜcretsizYok, Search Console’da hazır gelirGenelde yeterli
Ham log analiziURL bazlı ayrıntıAraç + zaman maliyetiSunucu log erişimi ve araç kurulumu gerekirYalnızca dar istisnalarda gerekli

Crawl Stats raporu toplam tarama isteği, toplam indirilen bayt ve ortalama yanıt süresini gösterir; hangi tekil URL’nin ne zaman tarandığını göstermez. Bu, robots.txt getirme hatası, DNS çözümleme hatası veya sunucu yanıtsızlığı gibi genel sunucu sağlığı sorunlarını yakalamak için yeterlidir ama tekil bir sayfanın tarama geçmişini kanıtlamaz. Küçük bir site için bu toplam görünüm, dar istisna senaryoları dışında genelde yeterlidir.

Log analiz araçlarının gerçek maliyeti

Ücretsiz bir log aracı bulmak, log analizini bedava yapmaz; en yaygın ücretsiz araçta bile küçük bir sitenin birkaç günde dolduracağı bir satır sınırı vardır.

Screaming Frog Log File Analyser’ın ücretsiz sürümü 1.000 log satırıyla sınırlıdır ve tek proje kaydına izin verir; sınırsız log olayı ve proje için 2026 fiyatlandırmasına göre yıllık 129 Euro ödenir. Araç Apache ve W3C Extended log biçimlerini (Apache, IIS, NGINX ve Amazon ELB dahil) destekler.

Günde ortalama 150 Googlebot isteği alan küçük bir site bu 1.000 satır sınırını yaklaşık bir haftada doldurur (1.000 / 150 ≈ 6,7 gün); günde 1.000’in üzerinde istek alan bir site aynı gün doldurur. Bu hesap, “ücretsiz araç var” iddiasının küçük bir site için de gerçek bir zaman ve bütçe kısıtı taşıdığını gösterir; ücretsiz sürüm sınırsız değildir, yalnızca ilk kullanımı ücretsizdir.

Büyük ölçekli alternatifler (ELK Stack, BigQuery, Semrush Log File Analyzer) küçük bir site için orantısız bir kurulum yüküdür; bu araçlar log toplama hattı, veri ambarı ve sorgu altyapısı gerektirir ve yüzlerce bin sayfalık siteler için tasarlanmıştır.

Türkçe kaynaklarda log analizi nasıl anlatılıyor, nerede kaynaksız kalıyor

Türkçe kaynaklarda log analizi konusu var ama küçük site sorusuna kaynaklı ve net bir cevap taranan örneklemde bulunamadı.

analyticahouse.com Splunk, Logz.io, Screaming Frog ve Semrush gibi araçları sıralıyor ve Google’ın Googlebot IP listesine bağlantı veriyor, ama bu bağlantı Kasım 2021 tarihli ve güncellenmemiş; küçük site sorusuna “daha küçük siteler bile israfı ortadan kaldırmaktan fayda sağlar” gibi belirsiz bir cümleyle geçiyor, net bir eşik veya komut örneği yok. stratejikseo.com adım adım bir süreç (indirme, temizleme, doğrulama, analiz) anlatıyor ama küçük site sorusuna hiç cevap vermiyor, enterprise ölçekli sitelere odaklanıyor ve kaynaksız sayısal örnekler (“binlerce URL”) kullanıyor. medyatics.com taranan üç kaynak arasında en dürüst istisnayı gösteriyor ve “bu konu çoğu küçük site için kritik olmayabilir” diyor; ama bu cümleyi Search Console’un kendi “1000 sayfadan az” ifadesine hiç bağlamıyor ve hangi büyüklükten sonra gerçekten gerekli olduğuna dair somut bir eşik vermiyor.

Üçünün ortak eksiği aynı: hiçbiri Google’ın resmî Googlebot doğrulama sayfasına atıf yapmıyor, hiçbiri bir komut satırı veya kod örneği veriyor. Taranan kaynaklardan ikisi log analizi için kaynaksız sayısal örnekler kullanıyor; bu, SEO sektöründe bir sayının nereden geldiği hiç sorgulanmadan tekrarlanmasının tipik bir örneğidir ve bir SEO iddiasının gerçek kaynağının geriye doğru nasıl izleneceğine dair ayrı bir yöntem gerektirir.

Bu gözlem 27 Eylül 2026’da doğrudan taranan üç TR kaynağa dayanır; bir ek kaynak (onuroztr.com) erişim engeli (403) nedeniyle doğrulanamadı. Örneklem küçüktür ve yalnızca ilk SERP sayfasını kapsar; bu bir genel TR SEO içerik yargısı değil, gözlemsel bir kesittir.

Karar: log analizine ne zaman başlamalısınız

Dört sorunun cevabı “evet, sorun yok” ise log analizine gerek yoktur, Crawl Stats raporu yeterlidir.

  1. Sayfa sayısı 1000’in altında mı?
  2. İçerik günlük değişmiyor mu?
  3. Search Console’da beklenmedik bir tarama veya indeksleme sorunu yok mu?
  4. Şüpheli bot trafiği yok mu?
DurumLog analizi gerekli mi
Sayfa sayısı 1000’in altında, içerik durağan, Search Console’da sorun yokHayır, Crawl Stats raporu yeterli
Filtre veya parametre patlaması olan küçük e-ticaret sitesiEvet, dar istisna
Migration sonrası şüpheli sayfa veya robots.txt/noindex çelişkisiEvet, dar istisna
Şüpheli bot trafiği (sahte Googlebot ihtimali)Evet, dar istisna

Dört sorunun en az birine “hayır” cevabı veriliyorsa ve bu durum yukarıdaki dar senaryolardan birine uyuyorsa log analizi gerekçelidir. Ama log dosyalarına inmeden önce daha basit ve ücretsiz teşhis adımlarının tüketilmesi gerekir: yönlendirme zinciri, kırık bağlantı ve temel tarama engeli kontrolü. Bu ilk elemeyi log erişimine hiç ihtiyaç duymadan, kendi ücretsiz denetim aracımızın çıkardığı bir teknik tarama sonucu yapar.

log analizi · tarama bütçesi · googlebot doğrulama · teknik seo

Bu yazıdakileri kendi sitenizde ölçmek ister misiniz?

Araçların hepsi ücretsiz ve kayıt istemiyor. Yazıda geçen ölçütlerin çoğunu doğrudan kendi adresinize uygulayabilirsiniz.

Ücretsiz denetim Diğer yazılar