Türkiye pazarındaki 216 güzellik ve kişisel bakım markasının web sitesini 5 Ağustos 2026'da taradık. Her markanın ana sayfasına, bir kategori sayfasına ve bir ürün sayfasına baktık; yapay zekâ tarayıcılarına ne dediklerini, hangi ölçüm etiketlerini çalıştırdıklarını ve yapılandırılmış verilerinin ne kadar eksiksiz olduğunu kaydettik.
Çalışmaya bir beklentiyle başladık: markalar, Cloudflare'in tek tıklık düğmesi yüzünden farkında olmadan yapay zekâ botlarını engelliyordur. Bu beklenti tamamen yanlış çıktı — erişebildiğimiz 189 markanın hiçbiri cevap motorlarını engellemiyor.
Verinin işaret ettiği şey daha rahatsız edici. Ölçtüğümüz her olumlu sinyal, markanın kullandığı platformun varsayılanı. Kurulum gerektiren tek bir şey yapılmamış. Aşağıda bunun kanıtını, yöntemi ve kendi listenizle aynı taramayı nasıl tekrar edeceğinizi bulacaksınız.
Yöntem ve sınırları
Marka başına ana sayfa, bir kategori sayfası ve bir ürün sayfası incelendi. Bir kısmı düz HTTP isteğiyle, bir kısmı gerçek bir tarayıcıda — çünkü Meta Pixel gibi etiketler artık HTML kaynağına yazılmıyor; Google Tag Manager bunları çalışma anında sayfaya ekliyor. Sayfayı çalıştırmadan görmeniz mümkün değil.
Aracın tamamı, marka listesi ve toplulaştırılmış sonuçlar açık kaynak: github.com/soleach/soleach-web-scraper. Kendi listenizle çalıştırıp kendi verinizi üretebilirsiniz.
Baştan söylenmesi gereken üç sınır
- 216 markanın 189'una erişebildik (%88). Kalan 27'nin 16'sı, kimliğini açıkça bildiren tarayıcımıza doğrudan 403 döndü. Bu bir hata değil, o sitelerin tercihi — ve kendisi de bir bulgu.
- Çerez banner'ına hiç dokunmadık; onay ziyaretçinin vereceği bir şey, bir botun değil. Dolayısıyla gördüğümüz her etiket, ziyaretçi hiçbir şeyi onaylamadan önce çalışmış demektir. Bunun bedeli şu: onayı doğru bekleyen bir sitenin pixel'ini hiç göremiyoruz, o siteleri pixel'i yok diye saymadık.
- Sitelerin %63'ü bir CDN arkasında ve robots.txt dosyasında yapay zekâ botlarına dair tek satır yok. Gerçek politika Cloudflare panelinde olabilir; oraya bakamıyoruz. Bu markaları izin veriyor diye değil, ölçülemedi diye işaretledik.
Bulgu 1: llms.txt oranı yüksek — ama markaların eseri değil
Erişilebilen 189 markanın 79'unda (%42) içi dolu bir llms.txt dosyası var. Bu dosya, yapay zekâ motorlarına siteyi ve markayı tanıtmak için önerilen bir standart (llmstxt.org) ve Türkiye için beklediğimizden çok yüksek bir oran.
Sonra sonuçları kullanılan e-ticaret platformuna göre ayırdık ve tablo tamamen değişti:
- Shopify kullanan 66 markanın 64'ünde llms.txt var — %97.
- Shopify dışındaki 123 markanın 15'inde var — %12.
Yani ortadaki %42, bir yapay zekâ görünürlüğü farkındalığı değil. Shopify bu dosyayı kiracılarına otomatik üretiyor. Shopify'da olmayan bir Türk güzellik markasının llms.txt sahibi olma ihtimali sekizde bir.
Bu ayrımı yapmasaydık yazının en büyük iddiası yanlış olacaktı: Türk güzellik markalarının GEO konusunda beklenenden iyi olduğunu yazacaktık.
Bulgu 2: Platformun vermediği hiçbir şey yapılmamış
İlk bulgu bir kalıba işaret ediyor, ikinci bulgu onu doğruluyor. Kurulum gerektiren iki şeye baktık; ikisi de neredeyse hiç yok.
FAQPage şeması: 189 markadan 1'inde var
Bu, yapay zekâ görünürlüğünün en ucuz kazancı: sayfanızdaki soru-cevapları makine okunur hâle getiren birkaç satırlık işaretleme (schema.org/FAQPage). Cevap motorları tam olarak bu biçimi arıyor. Türkiye'nin güzellik sektöründe tek bir marka yapıyor — 189'da 1, yani %0,5.
Ürün sayfasında ViewContent: 116 mağazanın 4'ünde
Bu daha da can yakıcı, çünkü doğrudan paraya bağlı. ViewContent, Meta'ya gönderilen bir ziyaretçi bu ürüne baktı sinyalidir (Meta Pixel standart olayları). Olmadan katalog kampanyası kuramaz, ürün bazlı retargeting yapamaz, algoritmaya hangi ürünün ilgi çektiğini söyleyemezsiniz. Kendi mağazası olan 116 markanın 4'ünde tetikleniyor — %3.
Ve bu bir platform kısıtı değil. Shopify'da 63 mağazanın 2'sinde, diğer platformlarda 53 mağazanın 2'sinde var. Yani Shopify size llms.txt'i bedava veriyor ama ViewContent'i kurmanız gerekiyor — ve kimse kurmuyor. Kalıp bu: platform ne verdiyse o var.

Bulgu 3: Pixel'i olanların üçte birinde dönüşümler çift sayılıyor
Tarayıcıda çalıştırabildiğimiz 175 sitenin 34'ünde (%19) Meta Pixel'in istek gönderdiğini gördük. Bu oran düşük görünüyor, ama hatırlayın: onayı doğru bekleyen siteler burada görünmüyor, dolayısıyla gerçek kurulum oranı daha yüksek.
Asıl bulgu içeride. Pixel'i çalışan 34 siteden 11'inde (%32) olay kimliği yok. Bu parametre, tarayıcıdan giden olayla Conversions API üzerinden sunucudan giden aynı olayı eşleştirip tekilleştirmeye yarar (Meta: Pixel ve sunucu olaylarını tekilleştirme). Yoksa Meta aynı satın almayı iki kez sayar; raporlanan ROAS gerçeğinden yüksek çıkar ve bütçe yanlış kanala kayar.
Beklenmedik bir ayrıntı: yerli markalarda pixel'i olan 15 markanın 13'ünde olay kimliği var; global markalarda 12'nin 7'sinde. Örneklem küçük, temkinli okumak gerekir — ama yerli markaların bu konuda geride olduğu varsayımını desteklemiyor.

Bulgu 4: Banner var, ama onay beklenmiyor
Çerez banner'ına hiç dokunmadığımızı hatırlayın. Buna göre tarayıcıda çalıştırabildiğimiz 175 site dörde ayrılıyor:
- Banner var, ama pazarlama etiketi zaten çalışmış: 60 site (%34).
- Onay arayüzü hiç yok, etiket çalışıyor: 51 site (%29).
- Etiket tutuluyor, onay bekleniyor — doğru davranış: 35 site (%20).
- Hiç etiket yok: 29 site (%17).
Yani banner gösteren sitelerin çoğunda banner dekoratif; ziyaretçi kabul et düğmesine basmadan önce pazarlama etiketleri çalışmaya başlamış oluyor.

Burada bir nüans var ve atlanması yanlış sonuç üretir: GA4 tarafında Google Consent Mode aktifse etiket çalışıp depolamayı reddedebilir — bu doğru davranıştır ve 175 sitenin 101'inde (%58) Consent Mode sinyali gördük (Google: Consent Mode). Meta Pixel'in ise böyle bir ara kademesi yok; ya çalışır ya çalışmaz.
Beklentimiz yanlış çıktı: kimse cevap motorlarını engellemiyor
Burada bir ayrım şart. Eğitim botları (GPTBot, ClaudeBot, CCBot) modelleri eğitmek için içerik toplar; bunları engellemek savunulabilir bir tercihtir ve 6 marka bunu yapıyor. Cevap motoru botları (OAI-SearchBot, ChatGPT-User, PerplexityBot) ise kullanıcının sorusunu cevaplarken sayfayı okumak için gelir; onları engellemek markayı yapay zekâ cevaplarından tamamen siler.
189 markanın hiçbiri ikinci grubu engellemiyor. Beklentimiz buydu ve yanlıştı.
Ama asıl sayı bu değil: 189 markanın 175'inin (%93) robots.txt dosyasında yapay zekâ botlarına dair tek bir kural yok. Ne izin ne yasak — konu hiç ele alınmamış. Üstüne %63'ü bir CDN arkasında, yani kararın nerede alındığını marka tarafının bildiğinden bile emin değiliz.
Yapılandırılmış veri tarafı da aynı kalıba uyuyor: ana sayfaların %60'ında Organization şeması var (çoğu tema varsayılanı), %12'sinde BreadcrumbList, ürün sayfalarının %70'inde Product şeması — ama aggregateRating yalnızca %29'unda. Platform ne koyduysa o duruyor.
Ne yapmalı
Verinin söylediği basit: platformunuz size bir taban veriyor ve kimse üstüne bir şey koymuyor. Koyan öne geçer. En ucuzdan başlayarak:
- ViewContent'i kurun. Kendi mağazanız varsa ve ürün sayfanızda bu olay tetiklenmiyorsa Meta'ya ürün sinyali göndermiyorsunuz demektir. Tek seferlik iş, doğrudan kampanya performansı.
- Olay kimliği (event_id) ekleyin. Pixel ve Conversions API'yi birlikte kullanıyorsanız tekilleştirme olmadan dönüşümleriniz şişik raporlanıyor.
- FAQPage işaretlemesi ekleyin. Birkaç satır; sektörde tek bir markanın yaptığı bir şey.
- robots.txt dosyanızda bilinçli bir pozisyon alın. En azından hangi bota ne dediğinizi bilin — kararın CDN panelinde alınmış olma ihtimali yüksek.
- llms.txt yazın. Shopify'da değilseniz muhtemelen yok.
Kendiniz tekrar edin
Araç, marka listesi ve toplulaştırılmış sonuçlar açık: github.com/soleach/soleach-web-scraper. Tarayıcı robots.txt kurallarına uyar, kimliğini bildirir ve başka bir botun kimliğine bürünmez.
Marka bazlı sonuçları bilerek yayımlamıyoruz. Denedik: veri setindeki her alan kamuya açık bir gözlem olduğu için satır düzeyinde anonimlik sağlanamıyor — isimler silinse bile 216 satırın 216'sı, tüm sütunlar birlikte kullanıldığında tekil kalıyor. Tek dürüst seçenek ya isim vermek ya da toplulaştırmaktı; ikincisini seçtik. Kendi listenizi tarayıp kendi marka bazlı verinizi üretebilirsiniz.
Tarama tarihi: 5 Ağustos 2026. Veriler o günkü durumu yansıtır. Siteler değişir; aynı taramayı bugün çalıştırırsanız farklı sayılar elde edersiniz, beklenen de budur.
Sık sorulan sorular
Türkiye'de kaç güzellik markasının llms.txt dosyası var?
5 Ağustos 2026'da taranan ve erişilebilen 189 markanın 79'unda (%42) içi dolu bir llms.txt dosyası bulundu. Ancak bu oran platforma göre çok keskin ayrışıyor: Shopify kullanan 66 markanın 64'ünde (%97) varken, Shopify dışındaki 123 markanın yalnızca 15'inde (%12) var. Yani genel oran markaların tercihini değil, Shopify'ın varsayılanını yansıtıyor.
Meta Pixel kuran markaların kaçı CAPI deduplication yapıyor?
Tarayıcıda ölçülebilen 175 sitenin 34'ünde Meta Pixel çalışıyordu; bunların 11'inde (%32) olay kimliği (event_id) yoktu. Olay kimliği olmadan tarayıcıdan ve sunucudan gönderilen aynı dönüşüm tekilleştirilemez, dolayısıyla iki kez sayılır ve raporlanan ROAS gerçeğinden yüksek çıkar.
Türk güzellik markaları yapay zekâ tarayıcılarını engelliyor mu?
Hayır. Erişilebilen 189 markanın hiçbiri robots.txt dosyasında cevap motoru botlarını (OAI-SearchBot, ChatGPT-User, PerplexityBot gibi) engellemiyor. Yalnızca 6 marka eğitim botlarını engelliyor. Asıl bulgu şu: 189 markanın 175'inin (%93) robots.txt dosyasında yapay zekâ botlarına dair hiçbir kural yok. Ayrıca sitelerin %63'ü bir CDN arkasında olduğu için güvenlik duvarı seviyesindeki engellemeler bu yöntemle görünmüyor.
Ürün sayfalarında ViewContent olayı ne kadar yaygın?
Kendi mağazası olan ve ürün sayfası ölçülebilen 116 markanın yalnızca 4'ünde (%3) ViewContent tetikleniyor. Bu oran Shopify'da (63 mağazanın 2'si) ve diğer platformlarda (53 mağazanın 2'si) neredeyse aynı; yani platform kısıtı değil, kurulum eksikliği.
Bu araştırmayı kendim tekrar edebilir miyim?
Evet. Araç, marka listesi ve toplulaştırılmış sonuçlar github.com/soleach/soleach-web-scraper adresinde açık kaynak olarak yayımlandı. Kendi marka listenizle çalıştırıp kendi verinizi üretebilirsiniz. Siteler zamanla değiştiği için birebir aynı sayıları elde etmezsiniz; değişmeyen şey ölçüm yöntemidir.
Marka bazlı sonuçlar neden yayımlanmıyor?
Satır düzeyinde anonimlik sağlanamadığı için. Veri setindeki her alan kamuya açık bir gözlem olduğundan, isimler silinse bile 216 satırın 216'sı tüm sütunlar birlikte kullanıldığında tekil kalıyor — birisi aynı aracı şüphelendiği markaya çalıştırıp parmak izini eşleştirebilir. Sahte anonimlik yerine toplulaştırılmış sonuç yayımlamayı tercih ettik.
Kaynaklar
- Soleach. beauty-web-audit — güzellik markası web sitesi tarama aracı ve veri seti. — Soleach
- Howard, J. llms.txt — a proposal to standardise information for LLMs. — llmstxt.org
- Meta. Deduplicate Pixel and Server Events. Meta for Developers. — Meta
- Meta. Reference — Meta Pixel Standard Events. Meta for Developers. — Meta
- Google. Consent Mode — Tag Platform Security Guides. — Google
- Schema.org. FAQPage type definition. — Schema.org
