GEO 25 Temmuz 2026

Teknik GEO Rehberi: AI Botları Web Sitelerini Nasıl Bulur?

Boosmart Agency

Üretken yapay zekâ sistemlerinin bir web sitesindeki bilgileri kullanabilmesi için öncelikle içeriği keşfetmesi, erişebilmesi ve doğru biçimde işlemesi gerekir. Bu nedenle GEO yalnızca içerik üretimi veya kaynak gösterilme çalışması değildir. Web sitesinin teknik altyapısı da AI görünürlüğünü destekleyen temel unsurlardan biridir.

AI botları, arama motoru crawler’ları, arama dizinleri ve retrieval sistemleri aynı yöntemlerle çalışmaz. Bir platformun içeriğe erişebilmesi, o içeriği mutlaka yanıtlarında kullanacağı anlamına da gelmez. Teknik GEO’nun amacı kaynak gösterimini garanti etmek değil; keşif, erişim, render ve anlamlandırma sürecindeki engelleri azaltmaktır.

Bu rehberde AI botlarının web sitelerini nasıl bulduğunu, crawler türlerini, robots.txt yönetimini, site mimarisini, JavaScript ve HTML erişilebilirliğini, sitemap ve canonical kullanımını, sunucu loglarını ve teknik GEO audit sürecini ele alacağız.

AI Botları Web Sitelerini Nasıl Keşfeder?

Yapay zekâ sistemleri web içeriklerine tek bir kanal üzerinden ulaşmaz. Kullanılan yöntem; platformun altyapısına, sorgunun niteliğine ve yanıtın güncel bilgi gerektirip gerektirmediğine göre değişebilir.

Bazı sistemler daha önce öğrendikleri bilgilerden yararlanırken bazıları sorgu sırasında güncel web kaynaklarına veya arama dizinlerine erişebilir. Platformlar kendi crawler’larını kullanabileceği gibi mevcut arama motoru altyapılarından da faydalanabilir.

Web içeriklerinin keşfedilmesinde şu kanallar rol oynayabilir:

  • Sayfalar arasındaki dahili bağlantılar
  • Diğer web sitelerinden gelen bağlantılar
  • XML sitemap dosyaları
  • Arama motoru dizinleri
  • Platformlara ait crawler’lar
  • Güncel web arama ve retrieval sistemleri
  • Haber, ürün veya merchant feed’leri
  • Daha önce keşfedilmiş URL kayıtları
  • Güvenilir üçüncü taraf kaynaklardaki marka referansları

Bir URL’nin keşfedilmesi yalnızca ilk adımdır. Botun sayfaya erişebilmesi, içeriği işleyebilmesi ve hangi URL’nin ana sürüm olduğunu anlayabilmesi de gerekir.

AI Keşif Süreci Hangi Aşamalardan Oluşur?

Teknik GEO açısından web içeriğinin yapay zekâ sistemleri tarafından kullanılmasına uzanan süreç beş aşamada değerlendirilebilir.

1. URL’nin Keşfedilmesi

Bot veya kullanılan arama altyapısı sayfanın URL’sini bir bağlantı, sitemap, feed ya da mevcut dizin kaydı üzerinden bulur. Dahili bağlantısı bulunmayan, sitemap’te yer almayan ve dış kaynaklardan bağlantı almayan yetim sayfaların keşfedilmesi daha zor olabilir.

2. Erişim İzinlerinin Kontrol Edilmesi

Bot, siteye erişmeden önce robots.txt kurallarını ve kendi user-agent tanımına uygulanan izinleri kontrol edebilir. Doğrudan erişimin kapatılması, güncel içeriğin keşfedilmesini ve işlenmesini sınırlayabilir. Ancak platformların arama dizinleri veya üçüncü taraf kaynaklar gibi başka bilgi kanallarından da yararlanabileceği unutulmamalıdır.

3. Sayfanın Getirilmesi ve Render Edilmesi

Bot HTML içeriğini talep eder. Sayfadaki ana bilgiler ilk HTML yanıtında yer almıyorsa JavaScript’in çalıştırılması gerekebilir. 

Her crawler’ın JavaScript render kapasitesi, bekleme süresi ve kaynak kullanımı aynı değildir. Bu nedenle yalnızca client-side render edilen önemli içerikler bazı sistemler tarafından eksik işlenebilir.

4. İçeriğin Anlamlandırılması

Sayfanın başlığı, ana içeriği, bağlantıları, yapılandırılmış verileri, canonical etiketi, dil sinyalleri ve diğer teknik öğeleri değerlendirilir.

Bu aşamada sistem şu sorulara yanıt arayabilir:

  • Sayfanın ana konusu nedir?
  • Hangi marka, kişi, ürün veya hizmetlerden söz ediliyor?
  • Tercih edilen URL hangisidir?
  • Sayfa başka bir içeriğin kopyası mı?
  • İçerik hangi dile ve bölgeye yöneliktir?
  • Bilgiler açık ve erişilebilir biçimde sunuluyor mu?

5. Dizine, Cache’e veya Retrieval Katmanına Alınması

İçerik, platformun kullandığı altyapıya bağlı olarak bir arama dizininde, geçici cache yapısında veya retrieval sisteminde değerlendirilebilir.

Yanıtta kaynak seçimi ise yalnızca teknik erişime bağlı değildir. Sorgu uyumu, güncellik, güvenilirlik, içerik kalitesi ve platformun kaynak politikaları da belirleyici olabilir.

AI Crawler Türleri Nelerdir?

Tüm AI botlarını aynı grupta değerlendirmek doğru değildir. Botların amaçları ve içeriklerle kurdukları ilişki farklı olabilir.

Model Geliştirme Botları

Bazı crawler’lar, modellerin geliştirilmesinde veya gelecekteki sistemlerin iyileştirilmesinde kullanılabilecek içerikleri toplamak amacıyla çalışabilir. Bu botlara erişim izni vermek, güncel AI arama yanıtlarında doğrudan görünürlük sağlandığı anlamına gelmez.

Arama ve Retrieval Botları

Bu botlar veya arama altyapıları, kullanıcının sorgusu sırasında güncel web kaynaklarını keşfetmek ve yanıtı destekleyecek bilgiler bulmak için kullanılabilir.

Arama erişimi ile model geliştirme erişimi aynı süreç değildir. Bu nedenle bot politikaları belirlenirken her user-agent’ın amacı ayrı değerlendirilmelidir.

Kullanıcı Tarafından Tetiklenen Botlar

Bazı sistemlerde erişim, kullanıcının belirli bir URL’yi açması, özetlemesi veya analiz ettirmesi sonucunda gerçekleşebilir. Bu tür talepler, düzenli tarama faaliyetlerinden farklı özellik gösterebilir.

Arama Motoru Crawler’ları

Üretken yapay zekâ platformları her zaman kendi botlarıyla doğrudan tarama yapmaz. Mevcut arama motoru dizinlerinden ve bunların crawler altyapılarından da yararlanabilir.

Bu nedenle klasik teknik SEO sorunları, AI görünürlüğünü dolaylı olarak etkileyebilir. Arama motorlarında keşfedilemeyen veya doğru indekslenmeyen sayfalar, bazı yapay zekâ deneyimlerinde de daha sınırlı görünürlük elde edebilir.

robots.txt ile AI Bot Erişimi Nasıl Yönetilir?

robots.txt, crawler’lara hangi URL yollarına erişip erişemeyeceklerini bildiren teknik bir yönerge dosyasıdır. AI bot yönetiminde de temel kontrol alanlarından biridir.

Bir bot için erişim politikası belirlenirken yalnızca “izin ver” veya “tamamen engelle” yaklaşımı kullanılmak zorunda değildir. Site bölümlerine göre farklı kurallar tanımlanabilir.

Örneğin markalar:

  • Herkese açık blog ve rehber içeriklerine erişim verebilir.
  • Üyelik gerektiren alanları engelleyebilir.
  • Filtre ve parametre URL’lerini taramaya kapatabilir.
  • Dahili arama sonuçlarını engelleyebilir.
  • Test ve staging ortamlarını erişime kapatabilir.
  • Belirli botlar için farklı politikalar uygulayabilir.

robots.txt kuralları hazırlanırken user-agent adlarının doğru yazılması gerekir. Yanlış veya geçersiz bot tanımları beklenen sonucu vermeyebilir.

Ayrıca robots.txt bir güvenlik mekanizması değildir. Gizli, kişisel veya ücretli içerikler yalnızca robots.txt ile korunmamalıdır. Bu alanlarda kimlik doğrulama, erişim kontrolü ve sunucu düzeyinde güvenlik önlemleri kullanılmalıdır.

AI Botlarını Engellemek GEO Görünürlüğünü Etkiler mi?

Bir AI crawler’ını engellemek, ilgili botun siteyi doğrudan taramasını sınırlayabilir. Ancak etkinin kapsamı platformun bilgiye nasıl ulaştığına bağlıdır.

Platform:

  • Başka bir arama motoru dizinini kullanabilir.
  • Daha önce edinilmiş bilgilerden yararlanabilir.
  • Üçüncü taraf sitelerdeki marka bilgilerini değerlendirebilir.
  • Kullanıcı tarafından sağlanan bir sayfayı farklı yöntemlerle işleyebilir.
  • Web sitesi yerine resmî veri feed’lerinden bilgi alabilir.

Bu nedenle bot erişimi ile AI görünürlüğü arasında her zaman bire bir ilişki kurulamaz.

Erişim politikası belirlenirken şu unsurlar birlikte değerlendirilmelidir:

  • İçeriğin ticari değeri
  • Fikrî mülkiyet yaklaşımı
  • Görünürlük hedefleri
  • Güncel kaynak olarak kullanılma ihtiyacı
  • İçerik lisanslama politikaları
  • Sunucu maliyetleri
  • Bot trafiğinin yoğunluğu
  • Kamuya açık ve özel içerik ayrımı

Karar yalnızca teknik ekip tarafından verilmemelidir. İçerik, hukuk, güvenlik ve pazarlama ekiplerinin de sürece katılması gerekir.

Site Mimarisi AI Keşfini Nasıl Etkiler?

İyi yapılandırılmış site mimarisi, botların önemli sayfaları keşfetmesini ve içerikler arasındaki ilişkileri anlamasını kolaylaştırır.

Ana kategori, pillar ve destekleyici cluster içerikleri arasında kurulan mantıklı bağlantılar; hem kullanıcı deneyimini geliştirir hem de hangi sayfaların hangi konu alanına ait olduğunu daha açık hâle getirir.

Teknik GEO açısından site mimarisinde şu noktalar kontrol edilmelidir:

  • Önemli sayfalar ana navigasyondan erişilebilir mi?
  • İçerikler ilgili kategori ve pillar sayfalara bağlı mı?
  • Yetim sayfalar bulunuyor mu?
  • Dahili bağlantılar açıklayıcı anchor metinlerle kullanılıyor mu?
  • Kritik içerikler gereğinden fazla tıklama derinliğinde mi?
  • Benzer URL’ler arasında tutarlı bir hiyerarşi var mı?
  • Sayfalama ve filtre URL’leri kontrol altında mı?
  • Eski ve yeni içerikler arasında doğru yönlendirmeler kurulmuş mu?

Yapay zekâ botları için özel olarak karmaşık bir site yapısı oluşturmak gerekmez. Kullanıcıların ve arama motorlarının anlayabildiği temiz bir bilgi mimarisi, teknik GEO için de güçlü bir temel sağlar.

JavaScript ve HTML Erişilebilirliği

JavaScript tabanlı sitelerde ana içeriğin ne zaman ve nasıl oluşturulduğu kritik önem taşır.

Client-side rendering kullanılan bir sayfada sunucudan gelen ilk HTML sınırlı olabilir. Başlıklar, ürün bilgileri veya ana metin ancak JavaScript çalıştıktan sonra görüntülenebilir. Bot JavaScript’i çalıştırmıyorsa veya render işlemini tamamlamadan sayfadan ayrılıyorsa içerik eksik işlenebilir.

Client-Side Rendering

İçerik büyük ölçüde kullanıcının tarayıcısında oluşturulur. Bu yapı, render kapasitesi sınırlı crawler’lar için risk yaratabilir.

Server-Side Rendering

Sayfanın ana HTML’i sunucuda hazırlanarak gönderilir. Böylece kritik içerik, JavaScript çalıştırılmadan da erişilebilir olur.

Static Site Generation

Sayfalar önceden oluşturulmuş HTML dosyaları olarak sunulur. İçerik ağırlıklı sitelerde yüksek erişilebilirlik ve performans sağlayabilir.

Hydration

Sunucudan gelen HTML daha sonra JavaScript ile etkileşimli hâle getirilir. Doğru uygulandığında hem erişilebilir içerik hem de dinamik kullanıcı deneyimi sunabilir.

JavaScript tabanlı sitelerde en azından şu bilgiler ilk veya render edilmiş HTML içinde bulunmalıdır:

  • Sayfa başlığı
  • Ana başlık
  • Temel içerik
  • Ürün veya hizmet açıklamaları
  • Canonical etiketi
  • Meta robots yönergeleri
  • Dahili bağlantılar
  • Yapılandırılmış veri
  • Dil ve hreflang sinyalleri

Bunun yanında HTML yapısının da anlamlı ve düzenli olması gerekir. Her sayfada açıklayıcı bir title etiketi, net bir H1, mantıklı H2-H3 hiyerarşisi ve gerçek bağlantı öğeleri kullanılmalıdır.

Kritik bilgiler yalnızca görsel, canvas, animasyon veya kullanıcı etkileşimi sonrasında görünür hâle gelmemelidir. Ana içerik mümkün olduğunca erişilebilir HTML metni olarak sunulmalıdır.

XML Sitemap AI İçin Önemli mi?

XML sitemap, önemli URL’lerin keşfedilmesini destekleyen bir dosyadır. Özellikle çok sayıda sayfası bulunan, yeni içerikleri sık yayımlayan veya bağlantı yapısı karmaşık olan sitelerde yararlıdır.

Sitemap dosyasında:

  • Yalnızca geçerli ve canonical URL’ler yer almalı
  • Yönlendirilmiş URL’ler bulunmamalı
  • 404 veya sunucu hatası veren sayfalar çıkarılmalı
  • noindex işaretli URL’ler eklenmemeli
  • Dil ve bölge varyasyonları tutarlı yönetilmeli
  • Son güncelleme bilgileri doğru kullanılmalı
  • Dosya büyüdüğünde sitemap index yapısı kurulmalı

Sitemap, bir sayfanın AI yanıtında kullanılmasını garanti etmez. Ancak önemli URL’lerin keşfedilmesini kolaylaştıran destekleyici bir sinyal sunar.

Canonical Etiketi Teknik GEO’yu Nasıl Etkiler?

Canonical etiketi, aynı veya çok benzer içeriğe sahip URL’ler arasında tercih edilen sürümü belirtir.

Yanlış canonical kullanımı şu sorunlara yol açabilir:

  • Önemli sayfanın başka bir URL’ye bağlanması
  • Yeni içeriğin eski sayfaya canonical verilmesi
  • Dil varyasyonlarının tek URL altında birleştirilmesi
  • Parametreli URL’lerin kontrolsüz çoğalması
  • Ürün ve kategori sayfalarının yanlış eşleştirilmesi
  • Canonical ile yönlendirme sinyallerinin çelişmesi

Teknik GEO açısından amaç, marka veya konu hakkındaki ana bilginin hangi URL’de bulunduğunu açık hâle getirmektir.

Canonical sinyali; dahili bağlantılar, sitemap, yönlendirmeler ve hreflang etiketleriyle tutarlı biçimde desteklenmelidir.

hreflang Çok Dilli Sitelerde Neden Gereklidir?

hreflang, farklı dil veya ülke hedeflerine sahip sayfaların birbirleriyle ilişkisini belirtir.

Çok dilli bir sitede hreflang yanlış uygulandığında sistemler:

  • Yanlış dil sürümünü seçebilir.
  • Farklı ülke sayfalarını karıştırabilir.
  • Kullanıcıya uygun olmayan fiyat veya hizmet bilgisini gösterebilir.
  • Marka hakkındaki bölgesel bilgileri yanlış eşleştirebilir.

Doğru hreflang uygulamasında:

  • Her sayfa kendisini de işaretlemeli
  • Karşılıklı referanslar bulunmalı
  • Dil ve ülke kodları doğru kullanılmalı
  • Canonical ve hreflang birbiriyle çelişmemeli
  • Yönlendirilmiş veya hatalı URL’lere işaret edilmemeli
  • x-default kullanımı gerektiğinde planlanmalı

Çok dilli GEO stratejisinde yalnızca çeviri yeterli değildir. Marka, ürün ve hizmet bilgilerinin her pazarda güncel ve tutarlı olması da gerekir.

Sunucu Logları AI Botları Hakkında Ne Gösterir?

Sunucu logları, hangi botların siteye ne zaman eriştiğini ve hangi URL’leri talep ettiğini gösteren en güvenilir teknik veri kaynaklarından biridir.

Log analiziyle şu sorular yanıtlanabilir:

  • Hangi AI botları siteye erişiyor?
  • En sık hangi sayfalar taranıyor?
  • Önemli sayfalara erişim gerçekleşiyor mu?
  • Botlar hangi durum kodlarıyla karşılaşıyor?
  • 404, 403 veya 5xx hataları bulunuyor mu?
  • Gereksiz parametre URL’leri taranıyor mu?
  • Bot trafiği sunucu yükünü etkiliyor mu?
  • robots.txt değişikliklerinden sonra davranış değişti mi?

User-agent bilgisi tek başına botun gerçek kimliğini doğrulamak için yeterli olmayabilir. Kötü niyetli sistemler başka botların user-agent bilgisini taklit edebilir. Gerekli durumlarda IP doğrulaması ve ters DNS kontrolleri gibi ek yöntemler kullanılmalıdır.

Log verileri yalnızca tarama davranışını gösterir; içeriğin nasıl işlendiğini veya hangi yanıtlarda kullanıldığını göstermez.

Cache ve İçerik Güncellemeleri Nasıl Yönetilmelidir?

Yapay zekâ platformlarında görülen bilgiler her zaman web sitesindeki en güncel sürümle aynı olmayabilir. Bunun nedeni arama dizini, cache, retrieval ve model bilgisinin farklı zamanlarda güncellenmesidir.

İçerik güncellenirken şu teknik adımlar uygulanabilir:

  • Eski bilgi mümkünse aynı URL üzerinde güncellenmeli
  • Gereksiz yere yeni URL oluşturulmamalı
  • URL değiştiyse 301 yönlendirmesi kullanılmalı
  • Sitemap güncellenmeli
  • Dahili bağlantılar yeni URL’ye çevrilmeli
  • Canonical sinyalleri kontrol edilmeli
  • Eski ürün ve hizmet bilgileri kaldırılmalı
  • Yapılandırılmış veriler içerikle birlikte güncellenmeli
  • Üçüncü taraf profillerdeki bilgiler kontrol edilmeli

Güncelleme tarihi eklemek tek başına yeterli değildir. Sayfanın gerçek içeriği güncellenmeli ve geçerliliğini kaybeden bilgiler temizlenmelidir.

Teknik GEO Audit Nasıl Yapılır?

Teknik GEO audit, web sitesinin yapay zekâ sistemleri ve bunların kullandığı arama altyapıları tarafından keşfedilmesini, taranmasını ve işlenmesini zorlaştırabilecek sorunları belirlemeyi amaçlar.

Bot Erişimi

  • robots.txt kurallarını inceleyin.
  • AI crawler user-agent’larını kontrol edin.
  • CDN ve güvenlik duvarı engellerini değerlendirin.
  • 403 ve 429 yanıtlarını analiz edin.
  • Kamuya açık ve özel içerik politikalarını ayırın.

Tarama ve URL Sinyalleri

  • Önemli sayfaların erişilebilirliğini doğrulayın.
  • noindex, canonical ve yönlendirme sinyallerini kontrol edin.
  • Yetim sayfaları belirleyin.
  • Hatalı durum kodlarını tespit edin.
  • XML sitemap yapısını inceleyin.

Render ve İçerik Erişimi

  • İlk HTML ile render edilmiş HTML’i karşılaştırın.
  • Ana içeriğin JavaScript olmadan erişilebilirliğini kontrol edin.
  • Başlık, canonical ve meta bilgilerin render sonrasında değişip değişmediğini inceleyin.
  • Lazy loading ve etkileşime bağlı içerikleri test edin.
  • Kritik bilgilerin HTML metni olarak sunulduğunu doğrulayın.

Site Mimarisi

  • Önemli sayfaların tıklama derinliğini ölçün.
  • Pillar ve cluster bağlantılarını kontrol edin.
  • Dahili bağlantısı bulunmayan sayfaları tespit edin.
  • Filtre, parametre ve sayfalama URL’lerini değerlendirin.
  • Eski içeriklerin yeni URL’lere doğru yönlendirildiğini doğrulayın.

Dil ve Bölge Yönetimi

  • Canonical etiketlerini kontrol edin.
  • hreflang eşleşmelerini test edin.
  • Dil sürümleri arasındaki içerik tutarlılığını inceleyin.
  • Bölgesel ürün, fiyat ve hizmet bilgilerinin karışmadığından emin olun.
  • HTTP ve HTTPS, www ve non-www sürümlerini tekilleştirin.

Sunucu Logları

  • AI bot ziyaretlerini belirleyin.
  • Tarama sıklığını ve URL dağılımını inceleyin.
  • Hata oranlarını kontrol edin.
  • Gereksiz tarama alanlarını tespit edin.
  • Teknik değişikliklerin bot davranışına etkisini takip edin.

Audit sonucunda bulunan sorunlar; görünürlük etkisi, uygulama zorluğu ve iş önceliğine göre sınıflandırılmalıdır.

Teknik GEO Çalışmalarında Sık Yapılan Hatalar

Teknik GEO çalışmaları bazen doğrulanmamış varsayımlar üzerinden yürütülebilir. En sık karşılaşılan hatalar şunlardır:

  • Tüm AI sistemlerinin aynı crawler’ı kullandığını düşünmek
  • Bot erişiminin doğrudan kaynak gösterimi sağladığını varsaymak
  • robots.txt dosyasını güvenlik aracı olarak kullanmak
  • llms.txt dosyasını zorunlu veya garantili bir görünürlük sinyali gibi değerlendirmek
  • JavaScript render sorunlarını göz ardı etmek
  • Sitemap’e tüm URL’leri kontrolsüz biçimde eklemek
  • Canonical ve hreflang sinyallerini çelişkili kullanmak
  • User-agent bilgisini doğrulamadan bot trafiği hakkında karar vermek
  • Arama motoru taranabilirliğini GEO’dan tamamen ayrı görmek
  • Teknik çalışma tamamlandıktan sonra log takibi yapmamak

Teknik optimizasyon, içerik kalitesi ve marka otoritesinin yerine geçmez. Bu alanların birlikte yönetilmesi gerekir.

Teknik GEO Tek Başına Yeterli mi?

Teknik GEO, içeriklerin keşfedilmesi ve işlenmesi için gerekli zemini oluşturur. Ancak bir sayfanın kaynak gösterilmesi veya marka önerilerinde yer alması daha geniş bir değerlendirme sürecine bağlıdır.

Teknik erişimin yanı sıra şu unsurlar da önem taşır:

  • Sorguyla güçlü konu uyumu
  • Açık ve doğrulanabilir bilgiler
  • Güncel içerik
  • Güvenilir kaynak kullanımı
  • Marka ve entity tutarlılığı
  • Özgün veri veya uzmanlık
  • Güçlü dahili içerik ağı
  • Güvenilir üçüncü taraf referansları
  • Kullanıcının ihtiyacına uygun içerik formatı

Teknik GEO bu unsurların önündeki erişim engellerini azaltır. Kaynak seçimi ve önerilme ise içerik, otorite ve marka görünürlüğünün birlikte yönetilmesini gerektirir.

Web Sitenizin Teknik GEO Altyapısını Güçlendirin

AI botlarının web sitenizi bulabilmesi yalnızca bir crawler’a izin vermekten ibaret değildir. robots.txt politikası, HTML erişilebilirliği, JavaScript render yapısı, site mimarisi, canonical ve hreflang sinyalleri, sitemap kalitesi ve sunucu yanıtları birlikte değerlendirilmelidir.

Boosmart olarak teknik GEO audit hizmetimiz kapsamında web sitenizin AI crawler erişimini, render koşullarını, önemli URL’lerin keşfedilebilirliğini ve teknik sinyaller arasındaki tutarlılığı analiz ediyoruz. Audit sonucunda görünürlüğü sınırlayabilecek teknik sorunları önceliklendirerek uygulanabilir bir iyileştirme yol haritasına dönüştürüyoruz.