TechnoRadical notları · Makale
GEO araçları ne ölçüyor, ne ölçmüyor
GEO araçları neyi ölçüyor, neyi ölçmüyor? Üç kategori var; Ahrefs ve Semrush sınırını açıklıyor, GeoSkoru açıklamıyor. Seçmeden önce sorulacak sorular.
GEO (Generative Engine Optimization, üretken arama motorlarında görünürlük çalışması) araçları, üretken yapay zeka arama motorlarındaki görünürlüğü ölçme iddiasıyla satılan yazılımlardır ve resmi metodoloji kaynağı bulunan üç ayrı kategoriye ayrılır: yapısal hazırlık skoru veren araçlar, saf AI görünürlük izleyen araçlar ve mevcut SEO paketine eklenmiş görünürlük modülleri. Bu üç kategorinin her biri farklı bir şeyi ölçer ve her birinin resmi kaynağında kendi yazdığı bir sınır vardır. Ahrefs Brand Radar kendini “kimin gördüğünü değil neyin göründüğünü gösteren bir medya-görünürlük denetimi” olarak tanımlar; Semrush AI Visibility Toolkit “hiçbir platformun kesin görünürlük sayısı veremeyeceğini” açıkça yazar; kendi GEO hazırlık aracımız “gerçek yapay zeka görünürlüğünü tahmin etmediğini” söyler. Buna karşılık GeoSkoru kendi tahmin doğasını hiç açıklamaz, Profound ise kurumsal ana sayfasında herhangi bir metodolojik sınır belirtmez. Türkiye pazarında bu farkın iki örneği yan yana durur: webtures’ın kaynaksız ve ürün ilişkisi açıklanmamış tanıtım yazıları ile GEONI’nin (Türkiye merkezli bir AI görünürlük karşılaştırma rehberi yayıncısı) kaynak gösteren ama yapısal hazırlık kategorisini hiç kapsamayan rehberi. Karşılaştırma, isimlendirilmiş araçların kendi resmi açıklamalarına dayanır; bağımsız bir laboratuvar testi değildir ve kendi otomasyon kurulumu dördüncü bir yol olarak var olsa da sourced karşılaştırmanın dışında tutulur.
GEO araçları kaç kategoriye ayrılır
Piyasadaki GEO araçları, resmi metodoloji kaynağı bulunan üç kategoriye ayrılır: yapısal hazırlık skoru veren araçlar, saf AI görünürlük izleyen araçlar ve mevcut SEO paketine eklenmiş görünürlük modülleri. Üç kategori farklı bir girdiyi işler ve farklı bir çıktı üretir; biri yalnızca sayfanın kendi metnini analiz eder, diğer ikisi gerçek yapay zeka platformlarına gerçek bir soru gönderir.
Birinci kategori yapısal hazırlık skorudur. Bu araçlar (GeoSkoru, kendi /geo-hazirlik/ aracımız) bir sayfanın başlık yapısını, cevap bloğunu, yapılandırılmış verisini ve E-E-A-T (deneyim, uzmanlık, otorite, güvenilirlik) sinyallerini tarar; sonucu bir puan olarak verir. İkinci kategori saf AI görünürlük izlemedir. Bu araçlar (GEONI, Profound, Peec AI, Otterly.ai) gerçek promptları gerçek AI platformlarına gönderir; markanın cevapta anılıp anılmadığını, atıf alıp almadığını kaydeder. Üçüncü kategori SEO paketine eklenmiş modüldür. Bu araçlar (Ahrefs Brand Radar, Semrush AI Visibility Toolkit) zaten var olan anahtar kelime veritabanını ve tıklama akışı verisini AI görünürlük ölçümüne genişletir.
Üç kategorinin girdi türü ve çıktısı şöyledir.
| Kategori | Neyi analiz eder | Çıktısı | Örnek araç |
|---|---|---|---|
| Yapısal hazırlık skoru | Sayfanın kendi metni | Puan/skor | GeoSkoru, /geo-hazirlik/ |
| Saf AI görünürlük izleme | Gerçek prompt, gerçek AI platform cevabı | Anılma, atıf, varlık | GEONI, Profound, Peec AI, Otterly.ai |
| SEO paketine eklenmiş modül | Anahtar kelime veritabanı + PAA/tıklama akışı verisi | Anılma/atıf oranı, yönelim sinyali | Ahrefs Brand Radar, Semrush AI Visibility Toolkit |
Bu üç kategorinin dışında dördüncü bir yol daha var: kendi otomasyon kurulumunuzla API üzerinden kendi prompt setinizi sorgulamak. Bu yöntem ayrı bir kurulum ve bakım kararı gerektirir; sourced üç kategori karşılaştırmasının dışında tutuluyor.
GEONI’nin kendi karşılaştırma rehberi de bu üçlü ayrımı dolaylı olarak doğruluyor: rehber yalnızca gerçek prompt sorgulayan ikinci ve üçüncü kategori araçları (Profound, Peec AI, Otterly.ai, GEONI, Ahrefs Brand Radar, Nightwatch, SEOYEN, Frase) karşılaştırıyor; yapısal hazırlık skoru veren birinci kategoriden hiç bahsetmiyor. Gerçek prompt sorgulayan bu iki kategoride ölçülen şey de birbirinin aynısı değildir. GEONI’nin kendi ayrımıyla, ölçülen şeyin konum değil varlık olduğu ayrım burada devreye giriyor: klasik SEO’daki gibi sabit bir sıralama pozisyonu değil, markanın AI cevabında var olup olmadığı kaydediliyor.
Yapısal hazırlık skoru veren araçlar ne ölçer, ne ölçmez
Bu kategori yalnızca sayfa özelliklerini ölçer; gerçek AI davranışını hiç sorgulamaz. GeoSkoru bunun somut bir örneği. Araç 11 kriterlik ağırlıklı bir puanlama sistemi kullanıyor: yedi “teknik” kriter (AI Bot Erişimi %15, Yapısal Veri %20, E-E-A-T Sinyalleri %20, Cevap Bloğu %15, İçerik Güncelliği %10, Çıkarılabilirlik %10, Konu Otoritesi %10) ve dört “yapay zeka analizi” kriteri (aiCitability, contentDepth, entityCoverage, citationQuality).
Bu dört “yapay zeka” kriteri bile ChatGPT veya Perplexity gibi bir platforma marka sorgusu göndermiyor. GeoSkoru’nun kendi tanımlarına göre aiCitability, yapay zekanın içeriği bir soruya yanıt olarak kaynak gösterme olasılığını değerlendiriyor; contentDepth, konunun yüzeysel mi yoksa derinlemesine mi işlendiğini inceliyor; entityCoverage, içeriğin temel kavramları, kişileri ve organizasyonları ne ölçüde kapsadığını ölçüyor; citationQuality, dış kaynaklara yapılan atıfların güvenilirliğini değerlendiriyor. Dördü de girdi olarak yalnızca sayfanın kendi metnini kullanıyor.
Buradan çıkan sonuç, GeoSkoru’nun kendi ifadesi değil. “Bu kategori gerçek model davranışını değil yapısal hazırlığı ölçer” sonucu, GeoSkoru’nun 11 kriterinin ve dört “AI” kriterinin gösterdiği kapsamdan türetilen bir editoryal çıkarımdır; GeoSkoru bu sınırı kendisi hiçbir yerde yazmıyor. Sayfa aracı “bir web sitesinin yapay zeka arama motorlarına ne kadar hazır olduğunu ölçen” bir sistem olarak tanımlıyor, yani kapsamının yapısal hazırlık olduğunu üstü kapalı biçimde kabul ediyor; ama skorun bir tahmin olduğunu, gerçek AI davranışını doğrudan ölçmediğini ayrı bir cümleyle hiçbir yerde açıklamıyor.
Bu sessizlik aynı kategorideki kendi GEO hazırlık aracımızla doğrudan tezat oluşturuyor. Kendi aracımızın sayfasında bu sınır açıkça yazılı: “Araç gerçek yapay zeka görünürlüğünü tahmin etmez.” GEO hazırlık aracımız yalnızca başlık yapısı, cevap paragrafı, tablo ve kaynak işareti gibi dışarıdan ölçülebilen yapısal unsurları kontrol ediyor; markanın gerçekten görünüp görünmediği ayrı sorgu ve yönlendirme verisiyle ölçülmesi gerektiğini kendisi belirtiyor. Düşük bir skor sayfanın otomatik olarak baştan yazılması gerektiği anlamına da gelmez; yapısal hazırlık, kalite öz-değerlendirmesi ve performans sinyali birlikte okunduğunda hangi aksiyonun gerektiği ayrı bir karar tablosuyla belirlenir.
GeoSkoru sayfasında en az bir maddi iddia da kaynaksız duruyor: “FAQPage, hem Featured Snippet hem AI Overviews için en yüksek etkiyi sağlar” cümlesinin hiçbir referansı yok. GeoSkoru’nun 11 kriterlik ağırlıklı puanlaması (%15, %20 gibi yüzdeler) kanıtlanmış bir GEO sıralama veya alıntılanma faktörü değildir; aracın kendi editoryal seçimidir.
Saf AI görünürlük izleme araçları ne ölçer, ne ölçmez
Bu kategori gerçek promptları gerçek AI platformlarına gönderir ve markanın cevapta anılıp anılmadığını, atıf alıp almadığını kaydeder; bir önceki kategoriden farkı budur. GEONI’nin kendi ayrımıyla ölçülen şey, markanın karşılaşabileceği tüm kullanıcıları veya olası tüm prompt varyasyonlarını temsil etmiyor; kaydedilen konum değil varlıktır.
GEONI’nin rehberi araçları yedi ölçütle karşılaştırıyor: motor sorgulaması derinliği, soru kişiselleştirmesi, kaynak gösterimi, rakip tanıması, ölçüm kaydı, dil/ülke ayrımı, fiyat modeli. Rehber kendi ürününü de aynı yedi ölçütle değerlendirmeye dahil ediyor; bu pazarda satıcı olan bir tarafın “en iyisi budur” demesinin reklamdan farksız olduğunu açıkça yazıyor ve “Kendi ürünümüz hakkında da aynı dürüstlükle” başlığı altında kendi sınırlarını listeliyor: AI özeti içinde sıra takibi ve günlük izleme sunmuyor, 15 günde bir tarıyor.
Kurumsal oyuncu Profound bu şeffaflığın tam tersini gösteriyor. Profound’un ana sayfası izlediği sekiz platformu (Perplexity, ChatGPT, Claude, Gemini, Grok, Microsoft Copilot, DeepSeek, Google AI Overviews) açıkça listeliyor ama Ahrefs ve Semrush’ın kendi belgelerinde yaptığı türden hiçbir metodolojik sınır, kişiselleştirme uyarısı veya “tahmin/yönelim sinyali” açıklaması taşımıyor; sayfa yalnızca ölçek ve kapsamı olumlu dille anlatıyor.
SEO paketine eklenmiş görünürlük modülleri ne ölçer, ne ölçmez
Bu kategori mevcut büyük SEO altyapısını AI görünürlük ölçümüne genişletir; dolayısıyla saf AI araçlarından farklı olarak dev ölçekli gerçek talep verisiyle çalışır. İki aracın kendi resmi metodoloji sayfasındaki sınır açıklaması, büyük ölçeğin bile kişiselleştirme ve kesinlik sorununu çözmediğini gösteriyor.
Ahrefs Brand Radar’ın kendi metodoloji sayfası yedi platformu izlediğini yazıyor: ChatGPT, Perplexity, Gemini, Microsoft Copilot, Google AI Overviews, Google AI Mode ve Grok. ChatGPT, Perplexity, Gemini ve Copilot verisi aylık yenileniyor ve 90 günlük bir raporlama penceresi kullanıyor; Google AI Overviews ve AI Mode ise anahtar kelime veritabanı döngüsüyle uyumlu, sürekli güncelleniyor. Prompt seti, Google’ın kullanıcıların gerçekten arattığı sorulardan oluşan “Diğer sorular” (People Also Ask) korpusundan ve Ahrefs’in 110 milyar anahtar kelimelik veritabanından toplanıyor; bu havuz anlamsal genişletme (fanout) yöntemiyle “mantıksal bütünlük” sağlanacak şekilde büyütülüyor.
Ahrefs kendi sınırını doğrudan yazıyor: “Chatbot usage is highly personalized, and the number of possible AI queries is effectively infinite” (sohbet robotu kullanımı son derece kişiselleştirilmiştir ve olası AI sorgusu sayısı pratikte sonsuzdur). Aynı sayfa, halüsinasyonlu veya bozuk linkleri filtrelemediğini de belirtiyor: “We do not filter out hallucinated or malformed links, as they reflect real model output.” Ahrefs’in ayrı bir ölçümünde bu davranışın somut bir sonucu görülüyor: ChatGPT’nin hangi sayfaları kaynak gösterdiği kaynak türüne göre büyük farklılık taşıyor; 1,4 milyon ChatGPT promptu üzerindeki analizde arama sonucu kökenli sayfalar %88,46 atıf alırken Reddit kökenli sayfalar yalnızca %1,93 atıf alıyor. Ahrefs Brand Radar ayrıca kendini şöyle tanımlıyor: “Think of it as a media-visibility audit, showing what appears in AI and search, not who saw it” (bunu bir medya-görünürlük denetimi olarak düşünün, AI ve aramada neyin göründüğünü gösterir, kimin gördüğünü değil).
Semrush AI Visibility Toolkit’in resmi yardım sayfası, prompt yanıtlarının gerçek isteklerden yakalandığını belirtiyor, herhangi bir LLM API’si üzerinden değil: “Prompt responses are captured from real requests and not via any APIs of LLMs.” Veri kaynağı, AI arama tıklama akışı verisi ve Google’ın AI Overviews için anahtar kelime veri setinden geliyor; araç ChatGPT, Google AI Overviews, Google AI Mode, Gemini ve Perplexity’yi 117 bölgesel veritabanı üzerinden kapsıyor. Semrush kendi sınırını da açıkça yazıyor: “AI search and LLM responses are fast-changing and highly personalized, which means no platform can provide exact numbers on visibility” (AI arama ve LLM yanıtları hızla değişir ve son derece kişiselleştirilmiştir, bu yüzden hiçbir platform kesin görünürlük sayısı veremez). Metrikler kesin ölçüm değil “güvenilir yönelim sinyalleri” sağlıyor; amaç trend tespiti, rakip kıyaslaması ve strateji rehberliği. Güncelleme sıklığı rapor türüne göre değişiyor: prompt veritabanı günlük döngüyle, marka performansı haftalık, prompt takibi günlük, site denetimi her taramada (Ağustos 2026 itibarıyla).
GEO araçlarının ortak ölçüm sınırları
Üç kategorinin ortak paydası iki yapısal sınırdır: kişiselleştirme ve AI arama sonuçlarının hızla değişmesi; hiçbir araç bu ikisini kesin bir sayıya çeviremez. Ahrefs’in kendi açıklaması bunu gösteriyor: kişiselleştirme yüzünden olası sorgu sayısı pratikte sonsuzdur, araç bir kullanıcının değil ortalama bir örneklemin gördüğünü yansıtır. Semrush’ın açıklaması aynı sonuca farklı bir cümleyle varıyor: hızla değişen ve kişiselleştirilmiş yanıtlar yüzünden hiçbir platform kesin sayı veremez.
Profound’un kurumsal ana sayfasında bu sınırın hiç yazılmaması, tam bu noktada dikkat çekici. Okurun bir aracın fiyatına değil, bu sınırı açıkça yazıp yazmadığına bakması gereken yer burası. Bu tespit, ölçüm yönteminin genel güvenilirliğini (örnekleme, platform farkı) tartışan ayrı bir konuyla karıştırılmamalı; buradaki odak yalnızca ticari araçların bu sınırı kendi ürün sayfalarında ne kadar açık yazdığı veya yazmadığıdır.
Türkiye’deki GEO araç içerikleri kaynak gösterme ve çıkar çatışması açıklamasında nasıl ayrışıyor
Türkiye’deki GEO araç içerikleri, kaynak gösterme ve çıkar çatışması açıklamasında iki farklı ciddiyet seviyesinde duruyor. webtures.com’un üç ayrı yazısı bunun bir ucunda. “Yapay Zekada Görünürlük Nasıl Ölçülür?” yazısı yalnızca “Brantial” adlı aracı öneriyor, hiçbir aracın sınırından bahsetmiyor ve tamamen kaynaksız. “GEO Analizi Nasıl Yapılır? Programları Nelerdir?” yazısı da Brantial’ı öneriyor ama Brantial ile Webtures arasındaki ilişkiyi (kendi ürünleri mi, bağımsız bir araç mı) hiçbir yerde açıklamıyor. “En İyi Ücretli ve Ücretsiz GEO Analiz Araçları” yazısı ise Gartner’a atfen “%25” ve kaynağı gösterilmeyen ayrı bir “%69” rakamını hiçbir bağlantı vermeden kullanıyor.
GEONI’nin rehberi bu ucun tam karşısında duruyor. Rehber kendi çıkar çatışmasını açıkça yazıyor ve “Kendi ürünümüz hakkında da aynı dürüstlükle” başlığı altında kendi ürününün “hâlâ yapmadığı şey”i listeliyor. Ama GEONI’nin şeffaflığı da eksiksiz değil: rehber yalnızca gerçek prompt sorgulayan “saf AI arama” araçlarını kapsıyor, yapısal hazırlık skoru veren kategoriden (GeoSkoru gibi) hiç bahsetmiyor.
Bu fark bir kopyalama zincirinin sonucu değil. Türkçe SEO içeriğinde aynı kaynaksız istatistiğin onlarca blogda dolaşması ayrı bir sorun; burada görülen, aynı pazarda iki farklı ciddiyet seviyesinin yan yana durmasıdır.
Bir GEO aracına güvenmeden önce hangi sorular sorulmalı
Bir GEO aracına güvenmeden önce sorulacak beş soru var; her biri somut bir kategori veya örnek farkına dayanıyor.
| # | Soru | Kanıt |
|---|---|---|
| 1 | Bu araç sayfa özelliklerine mi bakıyor, gerçek AI cevabını mı sorguluyor? | Yapısal hazırlık kategorisi yalnızca sayfa metnini analiz eder; saf AI izleme ve SEO modülü kategorileri gerçek promptu gerçek platforma gönderir |
| 2 | Aracın kendi metodoloji sayfası kişiselleştirme veya kesinlik sınırını yazıyor mu? | Ahrefs ve Semrush kendi sayfalarında evet yazıyor; Profound ana sayfasında hiç yazmıyor |
| 2a | Araç hangi AI platformlarını ve hangi bölge/dilleri kapsıyor? | Ahrefs Brand Radar yedi platformu listeliyor; Semrush AI Visibility Toolkit beş platformu 117 bölgesel veritabanı üzerinden kapsıyor; platform sayısının fazlalığı ölçüm doğruluğunun kanıtı değildir, yalnızca kapsam farkıdır |
| 2b | Veri ne sıklıkla yenileniyor? | Ahrefs 90 günlük raporlama penceresi ve aylık yenileme kullanıyor; Semrush rapor türüne göre günlük veya haftalık döngü kullanıyor |
| 3 | Prompt seti gerçek arama talebinden mi geliyor, yoksa aracın kendi tahmininden mi? | Ahrefs, PAA korpusunu ve 110 milyar anahtar kelimelik veritabanını fanout yöntemiyle genişletiyor; Semrush gerçek isteklerden yakalıyor, LLM API’si kullanmıyor |
| 4 | Aracı öneren içerik, ürünle ilişkisini açıklıyor mu? | webtures, Brantial ile ilişkisini hiçbir yazısında açıklamıyor; bu, ilişkinin gizlendiği anlamına gelmez, yalnızca hiç açıklanmadığı anlamına gelir |
| 5 | (yayın sonrası) Aracın sonucu birkaç manuel prompt testiyle çapraz kontrol edildi mi? | Bu adım aracın kesinliğini kanıtlamaz; yalnızca sonucun yönelimini sınar, tek bir aracın çıktısına körü körüne güvenmeyi önler |
Bu listenin dışında kalan ama ölçümün ön koşulu olan bir teknik nokta var. Google Search Central’ın kendi açıklamasına göre bir sayfanın AI Overviews veya AI Mode’da kaynak olabilmesi için tek teknik şart, sayfanın indekslenmiş olması ve Arama’da bir snippet ile gösterilmeye uygun olmasıdır: “There are no additional requirements to appear in AI Overviews or AI Mode, nor other special optimizations necessary.” Bu ön koşul yalnızca gerçek AI çıktısını ölçen kategoriler (saf AI görünürlük izleme, SEO paketine eklenmiş modül) için geçerlidir; yapısal hazırlık skoru veren kategori (GeoSkoru, kendi /geo-hazirlik/ aracımız) sayfanın kendi yapısını analiz ettiği için bu ön koşuldan bağımsız çalışır. Kendi site denetimi aracı, canonical etiket, noindex durumu, robots.txt ve site haritası bildirimi gibi bu ön koşulu gerçek taramayla kontrol ediyor; bu, bir GEO aracının çıktısını doğrulayan bir adım değil, yalnızca Google’ın AI deneyimlerinde kaynak olma ön koşulunu adlandıran ayrı bir kontrol.
Hangi durumda hangi araç kategorisi seçilir
Araç seçimi okurun kendi durumuna göre değişir; kategori tercihinin dört tipik senaryosu var.
| Durum | Önerilen adım | Kaynak |
|---|---|---|
| Site yapısal hazırlığı hiç test edilmedi | Önce yapısal hazırlık kategorisi denenir; GeoSkoru’nun temel analizi Ağustos 2026 itibarıyla ücretsiz sunuluyor ve yaklaşık 20-30 saniye sürüyor | GeoSkoru ana sayfası |
| Marka birden fazla platformda izlenmek isteniyor, kullanım arttıkça ödeme tercih ediliyor | Saf AI görünürlük izleme kategorisi; GEONI kendi rehberinde (Ağustos 2026 itibarıyla) “kullandıkça öde” modeliyle çalıştığını belirtiyor | GEONI karşılaştırma rehberi |
| Zaten Ahrefs veya Semrush aboneliği var | SEO paketine eklenmiş modül; Brand Radar ve AI Visibility Toolkit aynı sağlayıcının anahtar kelime veritabanı ve PAA/tıklama akışı verisini AI görünürlük ölçümüne genişletiyor | Ahrefs ve Semrush metodoloji sayfaları |
| Teknik ekip var, tam kontrol ve platform seçimi isteniyor | Kendi otomasyon kurulumu; sourced üç kategori karşılaştırmasının dışında kalan, ayrı bir maliyet ve bakım kararı gerektiren dördüncü yol | - |
Bu tablodaki hiçbir satır bir garanti taşımıyor. Ahrefs veya Semrush’a zaten abone olan bir marka için AI görünürlük modülünün mevcut abonelikte otomatik olarak açık olup olmadığı veya ek bir kurulum gerektirip gerektirmediği doğrulanmadı; satır yalnızca veri kaynağı ve çalışma biçimiyle sınırlı kalıyor. Aynı şekilde GEONI’nin karşılaştırdığı diğer araçlar (Profound dahil) için sayfasında fiyat bilgisi bulunmuyor; bu yüzden onlar hakkında bir maliyet karşılaştırması kurulmuyor.
GEO · AI görünürlük araçları · ölçüm metodolojisi · araç karşılaştırma