O nosso robô: SpyXBot
Viu SpyXBot nos registos do seu servidor? Eis quem é, o que faz e como bloqueá-lo, se assim o desejar. English version below.
Quem é o SpyXBot?
O SpyXBot é o robô da SpyX, uma ferramenta de auditoria SEO e de visibilidade nas IA. Só visita um site quando alguém pede a sua auditoria em spyx.fr — nunca de forma espontânea nem periódica. Apresenta-se com o seguinte cabeçalho:
Mozilla/5.0 (compatible; SpyXBot/1.0; +https://spyx.fr/robot)
O que faz
- Lê primeiro o seu robots.txt e respeita as suas regras: qualquer zona em
Disallow(paraSpyXBotou para*) não é visitada, nem testada, nem contada. - Explora no máximo 300 páginas HTML por auditoria, seguindo as ligações internas a partir da página inicial e, nos sites grandes, juntando uma amostra de URL do seu sitemap, com no máximo um pedido a cada 250 ms.
- Abranda por si próprio assim que o seu servidor responde 429 (demasiados pedidos), sem nunca contar essa resposta como um erro do seu site.
- Verifica a existência de robots.txt, sitemap.xml, llms.txt e de uma página 404, e o peso de uma amostra de imagens (pedidos HEAD, sem transferência).
- Não preenche formulários, não cria contas, não executa JavaScript e guarda apenas o necessário ao relatório pedido.
Como bloqueá-lo
Adicione estas duas linhas ao seu ficheiro robots.txt; o SpyXBot deixará de explorar o seu site a partir da auditoria seguinte:
User-agent: SpyXBot
Disallow: /
Para excluir apenas uma zona, indique o seu caminho em vez de / (por exemplo Disallow: /go/).
Alguma questão?
Escreva-nos: contact@auraleads.fr. A SpyX é editada pela Auraleads (França).
About SpyXBot (English)
SpyXBot is the crawler of SpyX, an SEO and AI-visibility audit tool. It only visits a website when someone requests an audit of that site on spyx.fr — never on its own schedule. It identifies itself as Mozilla/5.0 (compatible; SpyXBot/1.0; +https://spyx.fr/robot).
- It reads your robots.txt first and honours it: anything under
Disallow(forSpyXBotor*) is neither fetched, tested nor counted. - It crawls at most 300 HTML pages per audit, following internal links from the home page (plus a sample of sitemap URLs on large sites), with at least 250 ms between requests, and backs off as soon as your server answers 429.
- It checks robots.txt, sitemap.xml, llms.txt, the 404 page, and the size of a sample of images (HEAD requests only). It submits no forms, creates no accounts and runs no JavaScript.
To block it, add to your robots.txt:
User-agent: SpyXBot
Disallow: /
Questions: contact@auraleads.fr.