KISA CEVAP

Instagram'ın robots dosyası GPTBot, ClaudeBot, Google-Extended, PerplexityBot, Applebot-Extended ve Amazonbot'u adıyla belirtiyor ve hepsini sitenin tamamından engelliyor. İşletmeniz yalnızca Instagram'da varsa, Meta her büyük yapay zeka modeline onu okumamasını söylemiş ve size hiç sorulmadı. Bir profili bir modelin yapacağı gibi getirmek yaklaşık 939 kilobayt ve yaklaşık 50 karakter okunabilir işletme bilgisi döndürüyor. Adres yok, fiyat yok, çalışma saati yok.


instagram.com/robots.txt dosyasını herhangi bir tarayıcıda açın. Herkese açık bir dosya ve on saniye sürer.

Üst kısımda, adlarıyla, OpenAI, Anthropic, Google, Perplexity, Apple ve Amazon'a ait tarayıcılar var. Her birinin ardından Disallow: / geliyor, yani sitenin tamamı, üzerindeki her profil, sizinki dahil.

Bu hesabınızda bir ayar değil. Meta'nın platformdaki her işletme adına aldığı bir karar ve profilinizin bunun uygulanmadığı bir versiyonu yok.

Instagram'ın kendi robots dosyası her büyük yapay zeka tarayıcısını adıyla engelliyor

İşte dosya, 6 Eylül 2026'da okundu. İlgili satırlar, birebir aynı şekilde şöyle:

User-agent: Amazonbot        Disallow: /
User-agent: Applebot-Extended Disallow: /
User-agent: ClaudeBot         Disallow: /
User-agent: Google-Extended   Disallow: /
User-agent: GPTBot            Disallow: /
User-agent: PerplexityBot     Disallow: /

Üstlerindeki başlık pozisyonu açıkça belirtiyor: Instagram'ın açık yazılı izni olmadan otomatik araçlarla Instagram üzerinde veri toplamak yasaktır.

Meta'nın bunu yapması savunulabilir bir şey. Verisi kendi varlığı. Buradaki tek nokta, kararın onlara ait olduğu ve sonucun size ait olduğu.

[ 01 / instagram.com/robots.txt ]

Adıyla belirtiliyor ve sitenin tamamından engelleniyor

6 Eylül 2026'da okundu. Herkese açık bir dosya ve kontrol etmek on saniye sürüyor.

Şu kuralla engelleniyor: Disallow: /

  • GPTBot · OpenAI, eğitim
  • ClaudeBot · Anthropic, eğitim
  • Google-Extended · Google, yapay zeka eğitimi
  • PerplexityBot · Perplexity, arama dizini
  • Applebot-Extended · Apple, yapay zeka eğitimi
  • Amazonbot · Amazon
  • Brightbot

Dosyada adı geçmeyenler

  • Birisi bir soru sorduğu anda sayfayı canlı olarak getiren ajanlar. Bunlar ayrı adları olan ayrı programlar ve Instagram bunları listelemiyor.
Şekil 1 · Meta'nın platformdaki her işletme adına aldığı bir karar

instagram.com/robots.txt, 6 Eylül 2026'da okundu. Dosyanın kendi başlığı, Instagram'ın açık yazılı izni olmadan otomatik veri toplamanın yasak olduğunu belirtiyor.

Meta bu kararı sizin yerinize verdi ve siz bunu geçersiz kılamazsınız

O dosyayı düzenleyemezsiniz. Kendi profilinizi bundan muaf tutamazsınız. Bir işletme hesabında "yapay zeka modellerinin çalışma saatlerimi okumasına izin ver" diyen bir anahtar yok.

Aynısı bir Facebook sayfası için de geçerli ve kontrol ettiğiniz bir alan adında değil de bir platformun içinde yaşayan herhangi bir varlık için de. Bir makinenin işletmenizi okuyup okuyamayacağını belirleyen kurallar, binanın sahibi olan şirket tarafından yazılıyor.

Bu, Instagram sizi hatırladıkları yerdir. Karar verdikleri yer değildir. yazısındaki sorundan farklı bir sorun. O yazı insanlarla ilgiliydi. Bu yazı ise insanların giderek daha sık ilk olarak başvurduğu makinelerle ilgili.

Bir profil 939 kilobayt ve yaklaşık elli karakterlik işletme bilgisi

Engelleme yalnızca görünen yarısı. Diğer yarısı, aslında okunacak ne olduğu.

Dört büyük herkese açık profili bir modelin canlı tarayıcısının yapacağı gibi getirip, betikleri ve stilleri çıkarıp kalan metni okumak şunu veriyor:

  • NASA: 939.018 bayt indirildi, 42 karakter çıkarılabilir metin
  • National Geographic: 939.316 bayt, 59 karakter
  • Starbucks: 939.481 bayt, 52 karakter
  • Four Seasons Hotels and Resorts: 939.831 bayt, 74 karakter

Her durumda çıkarılabilir metin sayfa başlığından ibaret, başka hiçbir şey yok. NASA profilinde, indirmenin 840.087 baytı JavaScript. Dördünden hiçbiri herhangi bir yapılandırılmış veri taşımıyor.

Bir makinenin başvuracağı açıklama etiketi, tam olarak şöyle okunuyor: 2M Followers, 333 Following, 62 Posts. Bu Four Seasons. Küresel bir otel grubu ve bir makinenin elde ettiği şey bir takipçi sayısı.

[ 02 / Bir modelin yapacağı gibi getirildi ]

Yaklaşık 939 kilobayt giriyor. 75 karakterin altında çıkıyor.

Platformdaki en büyük dört herkese açık profil, betikler ve stiller çıkarılıp kalan metin sayıldı.

@nasa · 939.018 bayttan

42

@natgeo · 939.316 bayttan

59

@starbucks · 939.481 bayttan

52

@fourseasons · 939.831 bayttan

74

yapılandırılmış veri kaydı, dördünde de

0

NASA sayfasının JavaScript olan kısmı

840 KB

Her durumda çıkarılabilen metin yalnızca sayfa başlığından ibaret. Bir makinenin başvurduğu açıklama, Four Seasons için tam olarak şöyle: 2M Followers, 333 Following, 62 Posts. Küresel bir otel grubu ve bir makinenin elde ettiği tek şey bir takipçi sayısı.

0oda, fiyat, adres, çalışma saati veya konuşulan dil bilgisi dört profilden çıkarılabildi. Platformdaki en büyük hesaplar bunu döndürüyorsa, Girne'deki bir otel de aynı şekli döndürür.
Şekil 2 · Kendi ölçümümüz ve herkes tekrarlayabilir

Her profil 6 Eylül 2026'da canlı bir ajan user string'iyle getirildi, betik ve stil blokları çıkarıldı, kalan metin sayıldı. Bayt sayıları, Meta'nın sürekli yeniden oluşturduğu bir sayfanın anlık görüntüsü. Bulgu olan kesin rakam değil, orandır.

Engelleme yalnızca yarısı. Canlı erişim de hiçbir şey elde etmiyor.

Burada çoğu haberin göz ardı ettiği bir ayrım var ve önemli çünkü çözümü değiştiriyor.

Instagram'ın adlandırdığı tarayıcılar, eğitim verisi toplayan ve arama dizinleri oluşturan tarayıcılar. Birisi bir soru sorduğu anda bir sayfayı canlı olarak getiren ajanlar farklı programlar, farklı adları var ve Instagram bunları listelemiyor.

Yani canlı erişim engellenmiyor. Yukarıdaki ölçümler böyle alındı. 939 kilobayt ve yaklaşık elli karakter döndürüyor.

İki yol da aynı yere çıkıyor. Biri politika tarafından kapatılmış, diğeri açık ama boş. Birbiriyle ilgisiz iki sebeple görünmez olan bir işletme daha az görünmez değil.

Bir model sizi bulsa bile, daha az kişi tıklıyor

Bu, her iki yönde de abartılan kısım, o yüzden burada gerçekten arkasında bir çalışma olan rakamlar var.

Pew Research Center, Mart 2025'e kadar 900 Amerika Birleşik Devletleri yetişkininin internetteki gezinme davranışını izledi, 68.879 benzersiz Google araması kapsayarak, bunların 12.593'ü bir yapay zeka özeti üretti. Bir özetin göründüğü ziyaretlerde, kullanıcılar geleneksel bir arama sonucuna ziyaretlerin %8'inde tıkladı. Özet görünmediğinde, %15. Özetin içindeki bir bağlantıya tıklamak, ziyaretlerin %1'inde gerçekleşti.

Bu, Amerika Birleşik Devletleri'ne ait ve yalnızca Google'a özgü bir veri; her model ve her pazar hakkında bir iddiaya dönüştürülmemeli. Ortaya koyduğu şey yön: cevap giderek ziyaret olmadan geliyor.

Cloudflare, Ağustos 2025'in ilk haftasında kendi ağını ölçerek, taranan sayfaların geri gönderilen yönlendirmelere oranını yayımladı: Anthropic için yaklaşık 50.000'e 1, OpenAI için 887'ye 1, Perplexity için 118'e 1. İçerik, geri dönen trafiğin hiç eşleşmediği bir ölçekte okunuyor.

Bir otel için bu bir felaket değil. Web sitesinin ne için olduğunda bir değişiklik ve her şeyle aynı yönü işaret ediyor: cevabın inşa edildiği kaynak olmak, on birinci mavi bağlantı olmaktan daha önemli hale geliyor.

Kimse işaretlemenin sizi önerilmeye götürdüğünü kanıtlayamıyor ve biz bunu iddia etmeyeceğiz

Çoğu makalenin bir şey satmaya başladığı nokta burası. Kanıtların dürüst durumu bunu desteklemiyor.

Google, OpenAI, Anthropic veya Schema.org'dan hiçbir açıklama, yapılandırılmış veri eklemenin bir yapay zeka modelinin sayfanızı alıntılama olasılığını ölçülebilir şekilde artırdığını iddia etmiyor. Google'ın kendi pozisyonu, Temmuz 2025'te kamuya açık olarak belirtildiği üzere, geçerli olanın olağan arama motoru optimizasyonu pratikleri olduğu yönünde. Ayrı bir kaldıraç yok.

2024'te önerilen ve o zamandan beri yoğun şekilde pazarlanan llms.txt dosyası, kanıtlanmamış olmaktan da beter. Ahrefs, Mayıs 2026'da 137.210 alan adını analiz etti ve yayımlanan llms.txt dosyalarının %97'sinin hiçbir yerden hiçbir istek almadığını buldu. Herhangi bir trafik alan küçük kısımda ise bu trafiğin çoğu yapay zeka sistemlerinden değil, SEO denetim araçlarından geliyordu. Google, dosyayı kullanmadığını ve kullanma planı olmadığını kamuya açık olarak söyledi.

Bu ikisi üzerine kurulu bir yapay zeka görünürlüğü paketi satan herkes, kimsenin kanıtlamadığı bir mekanizma satıyor.

Web siteleri profillerden daha iyi, ama umduğunuz kadar değil

Instagram kolay hedef. Adil soru, bir makinenin buradaki gerçek otel web sitelerinde ne bulduğu, o yüzden varsaymak yerine saymak daha iyi göründü.

Kuzey Kıbrıs'taki kırk dört otel web sitesi, 6 Eylül 2026'da, Cyprus Turkish Hotels Association üyeliğinden alınıp her biri tek tek kuzeyde faaliyette olduğu doğrulanarak kontrol edildi. Otuz üç ana sayfa getirilip okunabildi.

Bu otuz üçün on üçü herhangi bir yapılandırılmış veri taşıyor. Yalnızca biri kendini bir makineye otel olarak tanımlıyor. Mevcut yapılandırılmış verinin geri kalanı, bir içerik yönetim sisteminin kendiliğinden ürettiği türden: bir içerik haritası (breadcrumb), bir site adı, bir arama kutusu. Kullanışlı altyapı ve odalar, fiyatlar, konum veya sezon hakkında hiçbir şey söylemiyor.

Otuz üçün yirmisi bir meta tanımı taşıyor, başka hiçbir şey sunulmadığında bir makinenin başvurduğu tek satır. On üçü taşımıyor.

Sonra bu sitelerin nasıl inşa edildiği hakkında en çok şeyi söyleyen detay. Üçü sayfa kodunda açıkça yanlış dil beyan ediyor: ikisi kendini Endonezce, biri Vietnamca olarak tanıtıyor. Bunlar hiç değiştirilmemiş şablon varsayılanları ve her tarayıcı, çeviri aracı ve makine okuyucu bunları olduğu gibi kabul ediyor.

Kırk dördün otuzu herhangi bir robots dosyası yayımlıyor. Üçü, hangi yönde olursa olsun, içinde herhangi bir yapay zeka tarayıcısını adlandırıyor. Diğer yirmi yedisi bir karar vermemiş, ki bu yanlış bir karar vermekten farklı ve düzeltilmesi çok daha kolay.

Bunu daha önce kimse ölçmemişti, ne bu ada için ne de herhangi bir küçük turizm pazarı için. Yukarıdaki rakamlar bize ait.

[ 03 / Kuzeyde 44 otel web sitesi ]

Bir profilden daha iyi. Ama umduğunuz kadar değil.

6 Eylül 2026'da kontrol edildi. Kırk dördün otuz üçünün ana sayfası getirilip okunabildi ve okunabilirlik rakamları bu otuz üç üzerinden.

33 siteden, herhangi bir yapılandırılmış veri taşıyanlar

13

kendini bir otel olarak tanımlıyor

1

33 siteden, meta tanımı olanlar

20

tamamen yanlış bir dil beyan ediyor

3

44 siteden, robots.txt dosyası yayımlayanlar

30

içinde herhangi bir yapay zeka tarayıcısını adlandırıyor

3

Yapılandırılmış verinin gerçekte içerdiği şey

Bir içerik haritası (breadcrumb), bir site adı, bir arama kutusu. Bir içerik yönetim sisteminin kendiliğinden ürettiği şeyler. Odalar, fiyatlar, konum veya sezon hakkında hiçbir şey yok.

Üç yanlış dil beyanı

  • 2 kendini Endonezce olarak tanımlıyor
  • 1 kendini Vietnamca olarak tanımlıyor
  • Kimsenin değiştirmediği şablon varsayılanları. Her tarayıcı, çeviri aracı ve makine okuyucu bunları olduğu gibi kabul ediyor.

Otuz robots dosyasının yirmi yedisi hiçbir yapay zeka tarayıcısını adlandırmıyor. Bu yanlış bir karar değil, hiç karar verilmemiş demek ve alternatifinden çok daha kolay düzeltiliyor.

Şekil 3 · Burada veya herhangi bir küçük turizm pazarında ilk kez sayılıyor

Oteller Cyprus Turkish Hotels Association üyeliğinden alındı ve her biri tek tek kuzeyde faaliyette olduğu doğrulandı. Ana sayfalar 6 Eylül 2026'da getirilip ayrıştırıldı. İçeriği doğru olsun olmasın, herhangi bir yapılandırılmış veri varsa site bunu taşıyor sayılıyor, bu yüzden sayım cömert. Hiçbir otel adlandırılmadı.

Kurallarını kontrol ettiğiniz tek yüzey, sahip olduğunuz bir yüzey

Kanıtlanmamış her şeyi çıkarınca geriye kısa bir liste kalıyor, hepsi sıkıcı ve hepsi doğrulanabilir.

Bir makine metin okuyabilir. Menünüzün fotoğrafını okuyamaz ve elli karakter döndüren bir profili okuyamaz. Yalnızca bir robots.txt'nin izin verdiğini getirebilir ve yazmanıza izin verilen tek robots.txt kendi alan adınızdakidir.

Yani çözüm bir hile veya bir paket değil. İşletmeniz hakkındaki gerçeklerin, kontrol ettiğiniz sayfalarda, sabit kalan adreslerde, metin olarak var olması gerektiği: ne sattığınız, nerede olduğunuz, ne kadar tuttuğu, ne zaman açık olduğunuz, hangi dillerde, kimin için.

Bu bir yapay zeka stratejisi değil. Bunu okuyan bir makinenin ne yaptığınızı bilerek ayrılması için inşa edilmiş bir web sitesi.

Bu konuda gerçekten yapılması gereken şey

Önce ücretsiz versiyon, çünkü gerçek. Gidin ve kendi sitenizi bir makinenin yaptığı gibi okuyun. Tarayıcınızda görselleri kapatın ve geriye ne kaldığına bakın. Cevap bir logo ve üç fotoğrafsa, bir modelin elinde çalışacak bir şey yok ve yavaş bağlantısı olan bir müşterinin de yok.

Tavan, bunun yeterli olmaktan çıktığı yer. Sayfası olmayan, yalnızca kayan tek bir uzun görüntünün bölümlerinden ibaret bir siteyi yeniden yapılandıramazsınız. Odalarınızı ve fiyatlarınızı, bir PDF'nin veya bir fotoğrafın içinde yaşıyorlarsa metin haline getiremezsiniz. Size ait olmayan bir alan adında robots dosyasını kontrol edemezsiniz. Bunlar inşa sorunları ve hiçbir düzenleme miktarı bunları aşamaz.

Bu konuda yaptığımız şey gösterişsiz ve somut: sattığınız her şey için bir sayfa, gerçekleri metnin resmi olarak değil metin olarak, bir işletmeyi dürüstçe tanımlayan yapılandırılmış veri ve varsayılan olarak değil bilerek evet diyen bir robots dosyası.

Size bir cevapta anılacağınızı vaat etmeyeceğiz. Dürüst olan kimse bunu vaat edemez. Vaat edilebilecek şey, bir makine işletmenizi okumaya geldiğinde okunacak bir şey olacağı, ki bu bugün adanın çoğu için geçerli değil.

Bize Ulaşın