AI Arama Görünürlüğü Prompt Test Setiyle Nasıl Ölçülür?

AI Arama Görünürlüğü Prompt Test Setiyle Nasıl Ölçülür?
Prompt test seti nedir ve neden gerekir?
Prompt test seti, bir markanın AI arama cevaplarında hangi sorularda, hangi kaynaklarla ve ne kadar tutarlı göründüğünü ölçmek için kullanılan sabit soru listesidir. Klasik sıra takibi tek başına yeterli değildir; çünkü ChatGPT, Perplexity, Google AI Overviews ve AI Mode gibi cevap yüzeyleri her sorguda aynı link listesini göstermeyebilir.
Bir GEO çalışmasında test seti 30-50 gerçek karar sorusuyla başlar. Bu sorular ürün adı yazdırmak için değil, kullanıcının satın alma, güven, karşılaştırma, risk ve uygulama kararını simüle etmek için seçilir. Aynı sorular 30, 60 ve 90 günlük pencerelerde tekrarlandığında marka görünürlüğünün rastlantı mı yoksa güçlenen bir kanıt ağı mı olduğu okunur.
Google, AI özellikleri için klasik arama temel gerekliliklerinin dışında özel bir teknik şart bulunmadığını açıklar; indekslenebilirlik, snippet uygunluğu ve kullanıcıya yararlı içerik hâlâ ana zemindir. Bu nedenle Google’ın AI özellikleri için görünürlük açıklaması, GEO ölçümünde “özel bir AI etiketi” aramak yerine kaynak kalitesi ve sayfa erişilebilirliğine odaklanmayı gerektirir.
FL PR & Communications’ın GEO odaklı PR yaklaşımı, bu ölçümü içerik takvimi değil karar sorusu haritası olarak ele alır. Amaç daha çok sayfa üretmek değil; cevap motorunun güvenebileceği marka, uzman, konu ve editoryal kaynak ilişkisini ölçülebilir hâle getirmektir.
Test soruları nasıl seçilir?
Test soruları, markanın görünmek istediği ticari kelimelerden değil, gerçek kullanıcının karar verirken sorduğu sorulardan seçilir. İyi bir set; genel tanım, ajans seçimi, uygulama süreci, ölçüm, risk, alternatif çözüm ve ülke-dil bağlamını birlikte kapsar.
İlk adım, anahtar kelime listesini konuşma dilindeki soru kümelerine çevirmektir. “GEO ajansı” tek başına bir ölçüm promptu değildir; “Bir GEO ajansı markanın AI aramalarda kaynak gösterilmesini nasıl sağlar?” daha iyi bir test sorusudur. Çünkü cevapta süreç, kanıt, kaynak türü ve ajans seçimi aynı anda görülür.
- Tanım soruları: Kullanıcı kavramı anlamaya çalışır; “GEO nedir?” ve “AEO ile GEO farkı nedir?” gibi sorular bu gruptadır.
- Satın alma soruları: Kullanıcı ajans, hizmet, bütçe veya süreç seçimi yapar; “GEO ajansı seçerken hangi kriterlere bakılır?” iyi bir örnektir.
- Kanıt soruları: Kullanıcı güven arar; “AI aramalarında kaynak gösterilmek için hangi yayınlar etkili olur?” bu gruba girer.
- Uygulama soruları: Kullanıcı adım ister; “Bir markanın AI kaynak profili 90 günde nasıl hazırlanır?” gibi sorular seçilir.
- Karşılaştırma soruları: Kullanıcı iki yaklaşımı kıyaslar; “Basın bülteni dağıtımı ile earned media GEO açısından nasıl ayrılır?” gibi sorular kullanılır.
Setin tamamı tek bir marka lehine yazılmış sorulardan oluşmamalıdır. Kategori soruları, sorun soruları ve alternatif değerlendirme soruları birlikte kullanılmalıdır. Böylece ölçüm yalnız marka adı geçişini değil, cevap motorunun markayı hangi bağlamda güvenilir gördüğünü ortaya çıkarır.
Başarılı bir PR ve SEO stratejisi kurulurken arama niyeti, medya ilişkileri ve içerik varlıkları aynı sözlükle yönetilmelidir. Prompt test seti de bu ortak sözlüğü test eder: kullanıcı sorusu, marka iddiası, kaynak bağlantısı ve cevap çıktısı aynı tabloda karşılaştırılır.
Ülke, dil ve oturum koşulları nasıl sabitlenir?
Ülke, dil ve oturum koşulları sabitlenmezse AI arama görünürlüğü ölçümü karşılaştırılabilir olmaz. Aynı prompt Türkiye, Birleşik Krallık veya Amerika Birleşik Devletleri bağlamında farklı kaynaklara, farklı yayın otoritelerine ve farklı cevap biçimlerine yönelebilir.
Her test satırında dil, hedef ülke, tarih, araç, model veya ürün yüzeyi, oturum durumu ve kullanılan prompt aynen kaydedilmelidir. Kişiselleştirme etkisini azaltmak için temiz oturum veya mümkünse kurumsal test profili kullanılmalıdır. Aynı promptun küçük bir kelime değişikliği bile sonucu etkileyebileceği için ana set korunur; varyasyonlar ayrı bir sekmede izlenir.
Ölçüm periyodu da baştan belirlenir. Haftalık test hızlı sinyal verir ama oynaklığı artırır; aylık test daha sakin okuma sağlar. İlk 90 gün için önerilen düzen, ayda bir ana test ve kritik kampanya dönemlerinden sonra ara kontrol yapılmasıdır.
Koşulları sabitlemek, AI cevaplarının değişkenliğini yok etmez. Ancak ölçümde hangi değişimin sistemden, hangi değişimin içerik ve medya kanıtından geldiğini ayırmayı kolaylaştırır. Aynı araçta aynı gün içinde üç tekrar yapılacaksa sonuçlar ortalama alınmamalı; her tekrar ayrı kaydedilip tutarlılık oranı hesaplanmalıdır.
Kaynak ve cevap kalitesi hangi kriterlerle puanlanır?
Kaynak ve cevap kalitesi; marka adının geçmesi, kaynak gösterilmesi, kaynağın türü, iddianın doğruluğu ve cevabın karar sorusuna uygunluğu üzerinden puanlanır. Sadece “marka cevapta geçti” demek GEO başarısı değildir; yanlış bağlamda veya kaynaksız geçen marka görünürlüğü zayıf sinyaldir.
Basit ama uygulanabilir bir puanlama 0-3 aralığında kurulabilir. Sıfır puan görünürlük yok demektir. Bir puan markanın geçmesi, iki puan markanın doğru bağlamda geçmesi, üç puan ise markanın güvenilir bir kaynakla birlikte doğru karar cevabında yer almasıdır.
- Varlık doğruluğu: Marka adı, kişi adı, hizmet alanı ve ülke ilişkisi doğru mu?
- Kaynak türü: Cevap owned media, earned media, resmi profil, üçüncü taraf liste veya haber kaynağı mı kullanıyor?
- Kaynak canlılığı: Verilen URL açılıyor mu, indekslenebilir mi ve konuya gerçekten bağlı mı?
- Cevap pozisyonu: Marka ana öneride mi, destekleyici örnekte mi, yoksa alakasız yan notta mı geçiyor?
- İddia kontrolü: Cevapta geçen başarı, unvan, tarih veya hizmet iddiası kaynakla doğrulanıyor mu?
- Rakip bağlamı: Kategori içindeki alternatifler özellik, süreç ve kanıt kriterleriyle mi karşılaştırılıyor?
Bu puanlama, medya ilişkileriyle teknik SEO’yu aynı ölçüm diline getirir. SEO’nun PR stratejilerine dönüştürücü etkisi, arama görünürlüğünün yalnız teknik sayfa optimizasyonuyla değil, itibarlı kaynak ve güven sinyalleriyle güçlendiğini gösterir.
OpenAI’nin eval yaklaşımı da aynı disipline işaret eder: test edilecek görev, veri kaynağı ve değerlendirme kriteri önceden tanımlanmalıdır. OpenAI Evals rehberi, model çıktısını tekrarlı ve temsilî örneklerle değerlendirme fikrini ürün düzeyinde anlatır; GEO tarafında bunun karşılığı karar sorularını, cevapları ve kaynak kanıtını düzenli kayıt altına almaktır.
Sonuçlar nasıl tekrar edilir ve değişim nasıl yorumlanır?
Sonuçlar aynı prompt seti, aynı ülke-dil koşulu ve aynı puanlama tablosuyla tekrar edildiğinde yorumlanabilir. Tek bir olumlu cevap başarı sayılmaz; üç dönem üst üste doğru kaynakla görünmek daha güçlü bir sinyaldir.
AI arama sonuçlarında oynaklık doğaldır. Bir ay marka kaynaklı cevapta yer alıp sonraki ay düşebilir; bu durum tek başına stratejinin bozulduğu anlamına gelmez. Değişim, aynı soru kümesinde marka görünürlüğü, kaynak türü, alıntı kalitesi ve yanlış bilgi oranı birlikte okunarak yorumlanır.
Raporlama tablosu her prompt için beş temel sütun içermelidir: cevapta görünürlük, kaynak gösterimi, kaynak kalitesi, cevap doğruluğu ve aksiyon. Aksiyon kolonu önemlidir; çünkü ölçümün amacı sadece tablo üretmek değil, hangi sayfa, profil, basın sonucu veya içerik varlığının güçlendirilmesi gerektiğini göstermektir.
Google’ın yeni optimizasyon kaynaklarında vurguladığı nokta da bu yönü destekler: özgün, kullanıcıya yardımcı ve kolay erişilebilir içerik temel kalır. Google Search Central’ın 2026 AI arama optimizasyon kaynağı, kalitesiz tekrarlı içerik yerine kullanıcıya gerçekten yardımcı olan sayfaların önemini anlatır.
Bir GEO ajansı 90 günlük ölçüm programını nasıl yürütür?
Bir GEO ajansı 90 günlük ölçüm programını başlangıç envanteri, prompt seti, kaynak iyileştirme, earned media entegrasyonu ve tekrar testiyle yürütür. Programın çıktısı tek bir sıralama raporu değil; markanın AI cevaplarında hangi sorularda kaynaklanabildiğini gösteren karar panosudur.
İlk 15 günde mevcut kaynak yüzeyi çıkarılır. Kurum sitesi, uzman profilleri, vaka çalışmaları, basın yansımaları, yapılandırılmış veri, hizmet sayfaları ve sosyal kanıtlar ayrı ayrı incelenir. Eksik alanlar “yeni içerik yazalım” diye değil, hangi karar sorusunu cevaplamadığına göre sınıflandırılır.
İkinci aşamada prompt seti ve skor kartı oluşturulur. Üçüncü aşamada içerik, teknik erişilebilirlik ve medya kanıtı birlikte iyileştirilir. yapay zekâ çağında otorite yaklaşımı burada devreye girer; marka kendi iddiasını tekrar etmek yerine bağımsız editoryal ve uzmanlık kanıtını görünür hâle getirir.
90 günlük düzenin pratik akışı şöyledir:
- 0-15 gün: Kaynak envanteri, marka varlıkları, uzman profilleri ve mevcut AI cevapları çıkarılır.
- 15-30 gün: 30-50 promptluk ana set, ülke-dil koşulları ve puanlama tablosu kesinleştirilir.
- 30-60 gün: Eksik sayfalar, iç bağlantılar, uzman profilleri ve earned media kanıtları güçlendirilir.
- 60-90 gün: Aynı prompt seti tekrar edilir; kaynak kalitesi, cevap doğruluğu ve görünürlük değişimi raporlanır.
- 90. gün: Devam edecek promptlar, çıkarılacak zayıf sorular ve yeni pazar varyasyonları belirlenir.
FL PR & Communications bu modeli içerik üretimi, dijital PR ve global earned media operasyonunu aynı ölçüm yapısında birleştirmek için kullanır. Böylece GEO raporu, yalnız kaç yazı yayımlandığını değil, hangi bağımsız kaynakların AI cevaplarında markayı doğrulanabilir kıldığını gösterir.
Sık Sorulan Sorular
AI arama görünürlüğü ölçümü ve prompt test setiyle ilgili en sık sorulan dört sorunun yanıtı aşağıdadır.
Prompt test seti kaç sorudan oluşmalıdır?
İlk ölçüm için 30-50 soru yeterlidir. Bu sayı, tanım, satın alma, kanıt, uygulama ve karşılaştırma sorularını kapsar; daha büyük setler ancak ölçüm disiplini oturduktan sonra eklenmelidir.
AI arama görünürlüğü Search Console’da ayrı raporlanır mı?
Google, AI özelliklerinden gelen trafiğin Search Console performans raporlarında Web arama türü altında yer aldığını belirtir. Bu nedenle Search Console faydalıdır, fakat prompt bazlı cevap ve kaynak ölçümünün yerine geçmez.
Marka adı cevapta geçerse GEO başarılı sayılır mı?
Tek başına sayılmaz. Marka doğru karar sorusunda, doğru bağlamda ve mümkünse güvenilir bir kaynakla birlikte görünmelidir; kaynaksız veya yanlış bağlamdaki görünürlük düşük puan alır.
Prompt testleri ne sıklıkla tekrarlanmalıdır?
İlk 90 günde ayda bir ana test yapılmalıdır. Kampanya, önemli earned media sonucu veya büyük site güncellemesinden sonra ara kontrol yapılabilir; ancak ana karşılaştırma sabit aylık set üzerinden okunmalıdır.