Yapay zekâ tarayıcıları

27 yapay zekâ tarayıcısı, tek tek.

Denetimimizin ve ücretsiz kontrol aracımızın aradığı user-agent'lar bunlar. Her biri ya sizi alıntılayıp bağlantı verebilen bir cevap motorudur ya da modeller için metin toplayan ve karşılığında hiçbir şey göndermeyen, yalnız eğitim amaçlı bir tarayıcıdır. Neyi engelleyeceğinize karar verirken önemli olan bu farktır.

Cevap motorları: sizi alıntılayabilen 16 tarayıcı

Bunlardan birini engellemek, bir modelin sizi kaynak olarak anabileceği bir yüzeyden sizi siler.

User-agentİşletenNe yapar
oai-searchbotOpenAIPowers ChatGPT's search index
chatgpt-userOpenAIFetches a page when a user asks ChatGPT about it
claude-userAnthropicFetches a page when a user asks Claude about it
claude-searchbotAnthropicPowers Claude's search results
perplexitybotPerplexityBuilds the index Perplexity answers from
perplexity-userPerplexityFetches a page a user asked about
google-cloudvertexbotGoogleVertex AI grounding
bingbotMicrosoftCopilot answers are built on the Bing index
msnbot-mediaMicrosoftMedia crawling for Bing/Copilot
meta-externalagentMetaCrawls for Meta AI answers
meta-externalfetcherMetaFetches a page on user request
amazonbotAmazonFeeds Alexa and Rufus answers
youbotYou.comIndexes pages You.com can cite
cohere-aiCohereRetrieval for Cohere-powered assistants
diffbotDiffbotKnowledge-graph extraction used by several assistants
timpibotTimpiIndependent index used by AI search products

Açıklamalar, işletenlerin yayımladığı dil olan İngilizce tutulur.

Yalnız eğitim: karşılığında hiçbir şey vermeyen 11 tarayıcı

Bunlar model eğitimi için içerik toplar. Engellemek bir lisans kararıdır: görünürlüğünüzü azaltmaz.

User-agentİşletenNe yapar
gptbotOpenAICollects content that may be used to train OpenAI models; ChatGPT search uses OAI-SearchBot instead
claudebotAnthropicCollects content that may be used to train Anthropic models; Claude search uses Claude-SearchBot
google-extendedGoogleNot a crawler: a robots.txt token for Gemini training and grounding; Google says it does not affect Google Search
applebot-extendedAppleNot a crawler: a robots.txt token for training Apple models; Apple says it does not affect Apple search
claude-webAnthropicLegacy Anthropic agent no longer documented; current user fetches use Claude-User
ccbotCommon CrawlPublic dataset many models train on
bytespiderByteDanceTraining data collection
omgiliWebz.ioData resale and training corpora
anthropic-aiAnthropicLegacy training-data agent (no live citation)
facebookbotMetaTraining data collection
petalbotHuaweiPetal search and training corpora

Açıklamalar, işletenlerin yayımladığı dil olan İngilizce tutulur.

Tek bir tarayıcıyı yönetmek

robots.txt user-agent bazında çalışır. Bu grup tek bir tarayıcıyı engeller, geri kalan her şeyi olduğu gibi bırakır:

User-agent: CCBot
Disallow: /

Bir cevap motoru tarayıcısını engellemek sizi o motorun cevaplarından çıkarır. Yalnız eğitim amaçlı bir tarayıcıyı engellemek, kaynak gösterilip gösterilmediğinizi etkilemez.

Kendi robots.txt'nizi kontrol edin

Ücretsiz kontrol aracı robots.txt ve llms.txt dosyalarınızı okur ve bu 27 tarayıcıdan hangilerine izin verdiğinizi söyler.

Kontrol aracını aç

Bu sayfa ürünün kullandığı katalogdan üretilir; denetimin kontrol ettiği listeden hiçbir zaman ayrışmaz.