KORT ANTWOORD

Het robots-bestand van Instagram noemt GPTBot, ClaudeBot, Google-Extended, PerplexityBot, Applebot-Extended en Amazonbot bij naam, en sluit ze allemaal uit van de hele site. Als uw bedrijf alleen op Instagram bestaat, heeft Meta elk groot AI-model opgedragen het niet te lezen, en dat is u niet gevraagd. Het ophalen van een profiel zoals een model dat zou doen, levert ongeveer 939 kilobyte op en ruwweg vijftig tekens aan leesbare bedrijfsinformatie. Geen adres, geen prijzen, geen openingstijden.


Open instagram.com/robots.txt in een willekeurige browser. Het is een openbaar bestand en het kost tien seconden.

Bovenaan staan, bij naam genoemd, de crawlers van OpenAI, Anthropic, Google, Perplexity, Apple en Amazon. Elk daarvan wordt gevolgd door Disallow: /, wat de hele site betekent, elk profiel erop, ook het uwe.

Dat is geen instelling in uw account. Het is een beslissing die Meta heeft genomen namens elk bedrijf op het platform, en er bestaat geen versie van uw profiel waarop dit niet van toepassing is.

Instagrams eigen robots-bestand blokkeert elke grote AI-crawler bij naam

Hier is het bestand, gelezen op 6 september 2026. De relevante regels zijn deze, woordelijk:

User-agent: Amazonbot        Disallow: /
User-agent: Applebot-Extended Disallow: /
User-agent: ClaudeBot         Disallow: /
User-agent: Google-Extended   Disallow: /
User-agent: GPTBot            Disallow: /
User-agent: PerplexityBot     Disallow: /

De kop erboven verwoordt het standpunt onomwonden: het verzamelen van gegevens op Instagram via geautomatiseerde middelen is verboden zonder uitdrukkelijke schriftelijke toestemming van Instagram.

Dat is voor Meta een verdedigbare keuze. De gegevens zijn hun bezit. Het punt is alleen dat de beslissing van hen is en het gevolg van u.

[ 01 / instagram.com/robots.txt ]

Met naam genoemd, en geblokkeerd voor de hele site

Gelezen op 6 september 2026. Het is een openbaar bestand en het kost tien seconden om te checken.

Geblokkeerd met Disallow: /

  • GPTBot · OpenAI, training
  • ClaudeBot · Anthropic, training
  • Google-Extended · Google, AI-training
  • PerplexityBot · Perplexity, zoekindex
  • Applebot-Extended · Apple, AI-training
  • Amazonbot · Amazon
  • Brightbot

Niet genoemd in het bestand

  • De live agents die een pagina ophalen op het moment dat iemand een vraag stelt. Dat zijn aparte programma's met aparte namen, en Instagram vermeldt ze niet.
Figuur 1 · Een beslissing die Meta nam voor elk bedrijf op het platform

instagram.com/robots.txt, gelezen op 6 september 2026. De kop van het bestand zelf stelt dat geautomatiseerd verzamelen verboden is zonder uitdrukkelijke schriftelijke toestemming van Instagram.

Meta nam die beslissing voor u, en u kunt die niet terugdraaien

U kunt dat bestand niet bewerken. U kunt uw eigen profiel er niet van uitzonderen. Er is geen schakelaar in een zakelijk account met de tekst sta AI-modellen toe mijn openingstijden te lezen.

Hetzelfde geldt voor een Facebook-pagina, en voor elke aanwezigheid die binnen een platform leeft in plaats van op een domein dat u zelf beheert. De regels die bepalen of een machine uw bedrijf mag lezen, worden geschreven door het bedrijf dat het gebouw bezit.

Dat is een ander probleem dan het probleem in Instagram is waar ze u onthouden. Het is niet waar ze beslissen. Dat stuk ging over mensen. Dit stuk gaat over de machines die mensen steeds vaker eerst raadplegen.

Een profiel is 939 kilobyte en ongeveer vijftig tekens aan bedrijfsinformatie

De blokkade is slechts de zichtbare helft. De andere helft is wat er daadwerkelijk te lezen valt.

Het ophalen van vier grote openbare profielen zoals de live browser van een model dat zou doen, en vervolgens de scripts en stijlen verwijderen en lezen wat er aan tekst overblijft, levert dit op:

  • NASA: 939.018 bytes gedownload, 42 tekens aan uitleesbare tekst
  • National Geographic: 939.316 bytes, 59 tekens
  • Starbucks: 939.481 bytes, 52 tekens
  • Four Seasons Hotels and Resorts: 939.831 bytes, 74 tekens

In alle gevallen is de uitleesbare tekst de paginatitel en verder niets. Op het NASA-profiel bestaan 840.087 bytes van de download uit JavaScript. Geen van de vier bevat gestructureerde gegevens.

De metabeschrijving waarop een machine terugvalt, luidt in zijn geheel: 2M Followers, 333 Following, 62 Posts. Dat is Four Seasons. Een wereldwijde hotelgroep, en wat een machine krijgt, is een aantal volgers.

[ 02 / Opgehaald zoals een model dat zou doen ]

Ruwweg 939 kilobyte erin. Minder dan 75 tekens eruit.

Vier van de grootste openbare profielen op het platform, scripts en stijlen verwijderd, overblijvende tekst geteld.

@nasa · van 939.018 bytes

42

@natgeo · van 939.316 bytes

59

@starbucks · van 939.481 bytes

52

@fourseasons · van 939.831 bytes

74

gestructureerde gegevens, alle vier

0

van de NASA-pagina is JavaScript

840 KB

In alle gevallen is de uitleesbare tekst de paginatitel en verder niets. De metabeschrijving waarop een machine terugvalt, luidt bij Four Seasons in zijn geheel: 2M Followers, 333 Following, 62 Posts. Een wereldwijde hotelgroep, en wat een machine krijgt, is een aantal volgers.

0kamers, tarieven, adressen, openingstijden of gesproken talen waren uit welk van de vier profielen dan ook te halen. Als dit is wat de grootste accounts op het platform opleveren, ziet het resultaat voor een hotel in Girne er net zo uit.
Figuur 2 · Onze eigen meting, en iedereen kan haar herhalen

Elk profiel opgehaald op 6 september 2026 met een live-agent user string, script- en stijlblokken verwijderd, overblijvende tekst geteld. De bytetellingen zijn een momentopname van een pagina die Meta voortdurend herbouwt. De verhouding is de bevinding, niet het exacte getal.

Blokkeren is maar de helft van het verhaal. Ook de live ophaling levert niets op.

Er is hier een onderscheid dat de meeste berichtgeving wegpoetst, en het is van belang omdat het de oplossing verandert.

De crawlers die Instagram bij naam noemt, zijn de crawlers die trainingsdata verzamelen en zoekindexen opbouwen. De agents die een pagina live ophalen, op het moment dat iemand een vraag stelt, zijn andere programma's met andere namen, en Instagram noemt ze niet.

Een live ophaling wordt dus niet geblokkeerd. Zo zijn de metingen hierboven ook uitgevoerd. Die levert 939 kilobyte op en ongeveer vijftig tekens.

Beide wegen komen op hetzelfde punt uit. De ene is gesloten door beleid, de andere staat open en is leeg. Een bedrijf dat om twee losstaande redenen onzichtbaar is, is er niet minder onzichtbaar om.

Zelfs als een model u wél vindt, klikken er minder mensen

Dit is het deel dat in beide richtingen wordt overdreven, dus hier zijn de cijfers die daadwerkelijk op een onderzoek zijn gebaseerd.

Het Pew Research Center volgde het surfgedrag van 900 Amerikaanse volwassenen tot en met maart 2025, over 68.879 unieke Google-zoekopdrachten, waarvan 12.593 een AI-overzicht opleverden. Bij bezoeken waarbij een AI-overzicht verscheen, klikten gebruikers in 8% van de gevallen op een traditioneel zoekresultaat. Waar geen AI-overzicht verscheen, was dat 15%. Op een link binnen het overzicht zelf klikken gebeurde bij 1% van de bezoeken.

Dat zijn Amerikaanse gegevens over Google specifiek, en die mogen niet worden opgerekt tot een claim over elk model in elke markt. Wat ze wél vaststellen, is een richting: het antwoord komt steeds vaker aan zonder het bezoek.

Cloudflare, dat zijn eigen netwerk mat in de eerste week van augustus 2025, publiceerde de verhouding tussen gecrawlde pagina's en teruggestuurde verwijzingen: ruwweg 50.000 op 1 voor Anthropic, 887 op 1 voor OpenAI, 118 op 1 voor Perplexity. Content wordt gelezen op een schaal die nooit is geëvenaard door het teruggestuurde verkeer.

Voor een hotel is dit geen catastrofe. Het is een verschuiving in waar de website voor dient, en het wijst in dezelfde richting als al het andere: de bron zijn waarop het antwoord is gebouwd, telt zwaarder dan de elfde blauwe link zijn.

Niemand kan bewijzen dat markup u aanbevelingen oplevert, en dat beweren wij ook niet

Hier is het punt waarop de meeste artikelen over dit onderwerp iets beginnen te verkopen. De eerlijke stand van het bewijs ondersteunt dat niet.

Geen enkele verklaring van Google, OpenAI, Anthropic of Schema.org stelt dat het toevoegen van gestructureerde gegevens meetbaar de kans vergroot dat een AI-model uw pagina citeert. Googles eigen standpunt, publiekelijk uitgesproken in juli 2025, is dat gewone zoekpraktijk van toepassing is. Er bestaat geen aparte hendel.

Het bestand llms.txt, voorgesteld in 2024 en sindsdien hard verkocht, is erger dan onbewezen. Ahrefs analyseerde 137.210 domeinen in mei 2026 en ontdekte dat 97% van de gepubliceerde llms.txt-bestanden geen enkel verzoek ontving, van wat dan ook. Van het kleine restant dat wél verkeer zag, was het grootste deel afkomstig van SEO-audittools in plaats van AI-systemen. Google heeft publiekelijk gezegd het bestand niet te gebruiken en geen plannen te hebben dat te doen.

Iedereen die een AI-zichtbaarheidspakket verkoopt dat op die twee dingen is gebouwd, verkoopt een mechanisme dat niemand heeft aangetoond.

De websites zijn beter dan de profielen, maar niet zoveel beter als u zou hopen

Instagram is het gemakkelijke doelwit. De eerlijke vraag is wat een machine daadwerkelijk vindt op de hotelwebsites hier, dus leek het beter om te tellen dan om aan te nemen.

Vierenveertig hotelwebsites in Noord-Cyprus werden op 6 september 2026 gecontroleerd, gehaald uit het ledenbestand van de Cyprus Turkish Hotels Association en pand voor pand geverifieerd als noordelijk. Drieëndertig homepages konden worden opgehaald en gelezen.

Dertien van die drieëndertig bevatten enige gestructureerde gegevens. Eén omschrijft zichzelf tegenover een machine als hotel. De rest van de aanwezige gestructureerde gegevens is het soort dat een contentmanagementsysteem vanzelf genereert: een broodkruimelpad, een sitenaam, een zoekvak. Nuttige loodgieterij, en het zegt niets over kamers, tarieven, locatie of seizoen.

Twintig van de drieëndertig hebben een metabeschrijving, de ene regel waarop een machine terugvalt wanneer er verder niets wordt aangeboden. Dertien niet.

Dan het detail dat het meeste zegt over hoe deze sites zijn gebouwd. Drie ervan geven ronduit de verkeerde taal op in hun paginacode: twee presenteren zich als Indonesisch en één als Vietnamees. Dat zijn standaardinstellingen van een sjabloon die nooit zijn aangepast, en elke browser, vertaaltool en machine die leest, neemt dat voor waar aan.

Dertig van de vierenveertig publiceren überhaupt een robots-bestand. Drie noemen daarin een AI-crawler, in welke richting dan ook. De overige zevenentwintig hebben geen beslissing genomen, wat iets anders is dan de verkeerde beslissing hebben genomen, en veel makkelijker te verhelpen.

Niemand heeft dit eerder gemeten, niet voor dit eiland en niet voor enige kleine toeristische markt. De cijfers hierboven zijn van ons.

[ 03 / 44 hotelwebsites in het noorden ]

Beter dan een profiel. Niet zoveel beter als u zou hopen.

Gecontroleerd op 6 september 2026. Drieëndertig van de vierenveertig homepages konden worden opgehaald en gelezen, en de leesbaarheidscijfers zijn op basis van die drieëndertig.

van de 33 bevatten gestructureerde gegevens

13

omschrijft zichzelf als hotel

1

van de 33 hebben een metabeschrijving

20

geven volledig de verkeerde taal op

3

van de 44 publiceren een robots-bestand

30

noemen daarin een AI-crawler

3

Wat de gestructureerde gegevens daadwerkelijk bevatten

Een broodkruimelpad, een sitenaam, een zoekvak. Wat een contentmanagementsysteem vanzelf genereert. Niets over kamers, tarieven, locatie of seizoen.

De drie verkeerde taalopgaves

  • 2 presenteren zich als Indonesisch
  • 1 presenteert zich als Vietnamees
  • Standaardinstellingen van een sjabloon die niemand heeft aangepast. Elke browser, vertaaltool en machine die leest, neemt dat voor waar aan.

Zevenentwintig van de dertig robots-bestanden noemen helemaal geen AI-crawler. Dat is niet de verkeerde beslissing, het is geen beslissing, en dat is veel makkelijker te verhelpen dan het alternatief.

Figuur 3 · Voor het eerst geteld, hier of in enige kleine toeristische markt

Hotels gehaald uit het ledenbestand van de Cyprus Turkish Hotels Association en pand voor pand geverifieerd als noordelijk. Homepages opgehaald en geparst op 6 september 2026. Een site telt als drager van gestructureerde gegevens zodra er iets aanwezig is, ongeacht of de inhoud correct is, dus de telling is royaal. Er wordt geen hotel genoemd.

Het enige oppervlak waarvan u de regels beheert, is er een dat u zelf bezit

Haal alles weg wat onbewezen is, en er blijft een korte lijst over, allemaal saai en allemaal verifieerbaar.

Een machine kan tekst lezen. Ze kan geen foto van uw menukaart lezen, en ze kan geen profiel lezen dat vijftig tekens oplevert. Ze kan alleen ophalen wat een robots.txt toestaat, en het enige robots.txt-bestand dat u mag schrijven, is dat op uw eigen domein.

De oplossing is dus geen trucje en geen pakket. Het is dat de feiten over uw bedrijf als tekst moeten bestaan, op pagina's die u beheert, op adressen die blijven staan: wat u verkoopt, waar u zit, wat het kost, wanneer u open bent, in welke talen, voor wie.

Dat is geen AI-strategie. Het is een website, zo gebouwd dat een machine die haar leest, weet wat u doet.

Wat hier daadwerkelijk aan te doen valt

Eerst de gratis versie, want die is reëel. Lees uw eigen site zoals een machine dat doet. Zet afbeeldingen uit in uw browser en kijk wat er overblijft. Als het antwoord een logo is en drie foto's, heeft een model niets om mee te werken, en een klant met een trage verbinding evenmin.

Het plafond is waar dat ophoudt genoeg te zijn. U kunt geen site herstructureren die geen pagina's heeft, alleen secties van één lang doorlopend scrollbeeld. U kunt uw kamers en tarieven niet in tekst zetten als ze in een pdf of een foto zitten. U kunt geen robots-bestand beheren op een domein dat niet het uwe is. Dat zijn bouwproblemen, en geen enkele hoeveelheid opruimen komt daar voorbij.

Wat wij eraan doen is onopvallend en specifiek: een pagina per ding dat u verkoopt, de feiten als tekst in plaats van als foto's van tekst, de gestructureerde gegevens die een bedrijf beschrijven eerlijk ingevuld, en een robots-bestand dat bewust ja zegt in plaats van bij gebrek aan een keuze.

Wij beloven u geen vermelding in een antwoord. Niemand die eerlijk is, kan dat. Wat wel beloofd kan worden, is dat wanneer een machine uw bedrijf komt lezen, er iets te lezen zal zijn, wat vandaag voor het grootste deel van het eiland niet het geval is.

Neem Contact Op