Skip to main content
Blog
Blog

Como bloquear e detetar agentes de IA no seu site: 4 métodos comparados

Compare 4 métodos para bloquear e detetar agentes de IA: robots.txt, controlos de servidor, deteção de bots tradicional e deteção especializada. Descubra quais realmente travam a fraude.

Feb 24, 2026 Atualizado Aug 11, 2026 22 min read
Como bloquear agentes de IA no seu site - cside
Índice

Resumo: robots.txt versus deteção especializada de agentes de IA

  • robots.txt é um pedido: Todos recorrem primeiro ao robots.txt. Um estudo da Duke University de 2025 concluiu que apenas cerca de 60% dos assistentes de IA cumprem, o Perplexity respeita o 'disallow' cerca de 20% das vezes, e os agentes com navegador headless cumprem cerca de 10% das vezes. É um pedido educado, não um controlo.
  • Como a cside deteta: Testes internos da cside contornaram a deteção de bots tradicional em 80 de 100 tentativas com esforço mínimo. O cside AI Agent Detection instala-se com um único snippet, combina sinais de rede, de aplicação e de interação, e apanha navegadores Playwright, Selenium, Manus e Comet alojados localmente que as ferramentas legadas não detetam.
  • A decisão: Se quer apenas abrandar grandes rastreadores como o GPTBot e o ClaudeBot, o robots.txt mais bloqueios no servidor bastam. Se enfrenta abuso de promoções, testes de cartões, pirataria ou fraude de chargeback por parte de agentes de IA, use deteção especializada com uma política de governança por sessão.

Sem tempo? Veja a deteção de agentes de IA da cside. Cobre tudo o que se segue numa única implementação.

4 Métodos para Bloquear Agentes de IA no Seu Site (comparação)

  <thead>
    <tr>
      <th>Método</th>
      <th>Como Funciona</th>
      <th>Eficaz contra:</th>
      <th>Profundidade de Segurança/Antifraude:</th>
      <th>Custo</th>
      <th>Dificuldade de Implementação</th>
    </tr>
  </thead>

  <tbody>

    <tr>
      <td><strong>robots.txt</strong></td>
      <td>
        Um ficheiro de texto que cria e carrega no seu site. Diz aos rastreadores a quais partes do seu site não devem aceder.
      </td>
      <td>
        • Rastreadores de IA de busca de grandes plataformas (Google, ChatGPT)<br>
        • Scrapers de IA que treinam modelos de LLM
      </td>
      <td>
        <strong>Fraco</strong><br>
        • A maioria dos agentes de IA não respeita o robots.txt<br>
        • A falsificação de user-agent é fácil<br>
        • Sem visibilidade sobre o comportamento<br>
        • Ineficaz contra agentes maliciosos ou alojados localmente
      </td>
      <td>Gratuito</td>
      <td>Fácil. Pode ser implementado por equipas não técnicas.</td>
    </tr>

    <tr>
      <td><strong>Controlos no servidor</strong></td>
      <td>
        Definir regras ao nível do servidor para bloquear agentes com base em IP ou diretivas de user-agent.
      </td>
      <td>
        • Rastreadores de IA de busca de grandes plataformas (Google, ChatGPT)<br>
        • Scrapers de IA que treinam modelos de LLM
      </td>
      <td>
        <strong>Fraco</strong><br>
        • O bloqueio por IP pode ser contornado com proxies residenciais<br>
        • Os cabeçalhos HTTP podem ser falsificados<br>
        • Requer configuração manual que pode facilmente ser mal configurada
      </td>
      <td>Baixo a moderado (requer tempo de pessoal)</td>
      <td>Médio. Requer apoio de um developer ou de DevOps.</td>
    </tr>

    <tr>
      <td><strong>Deteção tradicional de bots (como o Cloudflare)</strong></td>
      <td>
        Ferramenta de fornecedor com dashboards. Atribui pontuações de bot usando sinais da camada de rede, bases de dados de reputação e monitorização limitada do lado do cliente.
      </td>
      <td>
        • Rastreadores de IA de busca<br>
        • Scrapers de IA que treinam modelos de LLM<br>
        • Bots e scrapers básicos<br>
        • Ataques DDoS
      </td>
      <td>
        <strong>Médio</strong><br>
        • Tem dificuldade com agentes de navegador alojados localmente<br>
        • Visibilidade limitada ao nível da interação<br>
        • Lógica binária de permitir/negar<br>
        • Capacidades de governança fracas
      </td>
      <td>Baixo a moderado (depende do plano de preços)</td>
      <td>Fácil.</td>
    </tr>

    <tr>
      <td><strong>Deteção especializada de agentes de IA (como a cside)</strong></td>
      <td>
        Ferramenta de fornecedor com dashboards. Analisa a execução comportamental, monitorização profunda do lado do cliente e sinais únicos para identificar agentes de IA com maior precisão.
      </td>
      <td>
        • Rastreadores de IA de busca de grandes plataformas (Google, ChatGPT)<br>
        • Scrapers de IA que treinam modelos de LLM<br>
        • Bots e scrapers básicos<br>
        • Agentes de consumidores a correr em extensões de navegador<br>
        • Agentes de IA fraudulentos (ambientes alojados localmente, navegadores headless)
      </td>
      <td>
        <strong>Forte</strong><br>
        • Criado especificamente para defender contra agentes de IA<br>
        • Combina sinais de rede, de aplicação e ao nível da interação<br>
        * Deteção mais precisa contra agentes baseados em navegadores headless
      </td>
      <td>Baixo a moderado (depende do plano de preços)</td>
      <td>Fácil. Instale um snippet de código no seu site.</td>
    </tr>

  </tbody>
</table>
Tabela: comparação de métodos para bloquear rastreadores e agentes de IA.

1. Robots.txt

Como funciona: Cria um ficheiro "robots.txt" e carrega-o no seu site. Este ficheiro de texto contém uma lista de nomes de agentes de IA que são permitidos ou proibidos. Quando esses agentes visitam o seu site e leem que estão "proibidos", vão abster-se de aceder ao site. *

* Apenas os agentes que optarem por respeitar o seu robots.txt serão efetivamente bloqueados. Este ficheiro pode ser ignorado por agentes maliciosos ou mal configurados.

Exemplo Simplificado

# Allow OpenAI's crawler (ChatGPT / GPTBot)
User-agent: GPTBot
Allow: /
## Disallow DeepSeek's crawler
User-agent: DeepSeekBot
Disallow: /

Bloco de código: exemplo de uma diretiva robots.txt que permite o GPTBot e bloqueia o DeepSeekBot

A maioria dos ficheiros robots.txt contém dezenas de diretivas de user-agent.

Vantagens

  • Gratuito
  • Muitas ferramentas e modelos para começar rapidamente
  • Pode ser configurado num dia
  • Pode ser implementado por uma pessoa sem conhecimentos técnicos

Limitações

  • Os agentes não são obrigados a respeitar o seu ficheiro robots.txt. É mais um pedido educado. Os rastreadores dos principais fornecedores de IA (Meta, Anthropic, OpenAI) tendem a respeitar estas diretivas, mas estas empresas são apenas a ponta do icebergue do total de agentes de IA.
  • Os agentes de IA maliciosos vão ignorar o seu ficheiro robots.txt.
  • Manutenção manual para centenas de ferramentas populares de agentes de IA, cada uma com múltiplas identidades agênticas (rastreador, investigação, executor de ações).
  • Nem todos os agentes de IA têm uma "identidade" pública. Plataformas como o Selenium e o Playwright permitem que os utilizadores criem agentes que acedem ao seu site sem uma identidade clara.
  • Tem visibilidade zero sobre o comportamento. Este mecanismo serve apenas como uma lista de "bloquear ou não". Não vê quanto tráfego é agêntico nem o que os agentes estão a fazer.

Deve usar o robots.txt: Sim. É um ótimo ponto de partida para pequenas empresas e vai protegê-lo dos principais rastreadores publicamente conhecidos, como o da Meta, que de outro modo consumiriam recursos do servidor. No entanto, este mecanismo não o vai proteger contra fraude por agentes de IA.

2. Controlos no Servidor

Como funciona: Configura regras no seu servidor web (.htaccess), CDN ou firewall que efetivamente bloqueiam agentes de IA através de:

  • Bloqueio de endereços IP específicos ou intervalos de IPs de agentes conhecidos
  • Limitação de taxa para padrões de pedidos excessivos
  • Inspeção de cabeçalhos HTTP
  • Verificação de identidades de user-agent (semelhante ao robots.txt)

Ao contrário do robots.txt, os controlos no servidor têm poder de aplicação real. Estas regras vão bloquear os agentes ou devolver um código de erro para que não consigam aceder ao seu site.

Vantagens

  • Aplicação real contra tráfego de agentes
  • Mitiga agentes de scraping simples
  • Trava o abuso de pedidos em elevado volume
  • Funciona bem para bloquear rastreadores publicamente identificados (Meta, DeepSeek, Google)

Limitações

  • Requer configuração técnica e manutenção, muitas vezes por um developer web
  • Os agentes de IA maliciosos podem contornar estes controlos
  • O bloqueio baseado em IP pode ser contornado com proxies residenciais ou IPs rotativos
  • Os cabeçalhos HTTP podem ser facilmente falsificados
  • Sem visibilidade sobre o comportamento. Este mecanismo vai bloquear agentes, mas não lhe dá informação sobre o que estão a fazer.

Conclusão: Se tem pessoal técnico disponível, os controlos no servidor são uma forma sólida de aplicar bloqueios contra pedidos de rastreadores agênticos. Este método continua a ficar aquém no que toca a defender contra fraude de agentes de IA ou ataques a sites assistidos por IA, já que os agentes maliciosos conseguem criar identidades falsas e passar pelos controlos de verificação.

3. Ferramentas Tradicionais de Deteção de Bots (ex.: Cloudflare)


Muitos produtos legados de deteção de bots atualizaram a sua marca para "deteção de agentes de IA", mas não evoluíram o produto em si o suficiente e não conseguem detetar navegadores alojados localmente ou ambientes agênticos criados para escapar à deteção.


Como funciona: Ferramentas de fornecedores como a deteção de bots do Cloudflare atribuem a cada visitante uma "pontuação de bot" com base em análise comportamental, fingerprints, bases de dados de reputação de ameaças conhecidas e outros sinais.

Estas ferramentas de fornecedores operam sobretudo na camada de CDN ou de rede do seu site, com alguma injeção de JavaScript nas páginas para recolher sinais do navegador (monitorização do lado do cliente).

Vantagens

  • Relativamente fácil de instalar
  • Em comparação com listas de permitir/proibir, analisa sinais mais avançados do que apenas a identidade
  • Proteção comprovada contra ataques como DDoS e bots básicos de scraping
  • Mais automatizado do que os controlos manuais no servidor

Limitações

  • Pode ser contornado por agentes de IA fraudulentos que imitam o comportamento humano
  • Tem dificuldade em detetar agentes de navegador alojados localmente, cada vez mais adotados por consumidores e atacantes
  • Depende de sinais ao nível da aplicação, com sinais muito básicos ao nível da interação
  • Nenhuma capacidade de orientar os agentes de IA de consumo na jornada de compra
  • Visibilidade fraca sobre sinais do lado do cliente

As ferramentas legadas de deteção de bots não estão preparadas para agentes de IA: Estas soluções foram criadas para uma era em que os bots viviam em infraestrutura de nuvem, não conseguiam raciocinar e seguiam padrões previsíveis. Os agentes de IA modernos correm dentro de navegadores reais e misturam-se com o tráfego normal. O bloqueio indiscriminado vai travar os abusos óbvios, mas uma estratégia moderna de governança agêntica exige compreender a intenção e definir regras dinâmicas.

Os nossos testes internos na cside conseguiram contornar a deteção tradicional de bots em 80/100 tentativas com esforço mínimo.

4. Ferramentas Especializadas de Deteção de Agentes de IA (ex.: cside)

Exemplo de dashboard de uma ferramenta especializada em deteção de agentes de IA (cside)
Exemplo de dashboard de uma ferramenta especializada em deteção de agentes de IA (cside)

Leitura relacionada: o nosso guia completo sobre deteção de tráfego de agentes de IA no seu site · apanhar bots que não querem ser apanhados

Como funciona: É instalado um snippet de código no seu site, dando-lhe controlo sobre:

  • Deteção: observa dezenas de sinais para identificar agentes de IA, as suas ações e o risco de fraude.
  • Bloqueio: as pontuações de risco são criadas a partir de uma variedade de sinais: padrões de interação, fingerprints, contexto de execução de JavaScript, bases de dados de reputação, honeypots, entre outros. Pode rever o risco do agente e definir regras dinâmicas para bloqueá-lo completamente ou permitir acesso limitado.
  • Governança: um SDK é usado pelos developers para adicionar guardrails às sessões de agentes. Por exemplo, determinados passos podem exigir validação humana, ou certos agentes de confiança podem ser autorizados a efetuar compras enquanto outros ficam restritos ao modo apenas de leitura.

Vantagens

  • Fácil de implementar, com dashboards para equipas de fraude e SDKs para developers
  • Criado especificamente para agentes de IA. A cside é melhor a detetar agentes de IA de navegador alojados localmente (ex.: Playwright, Selenium)
  • Mais eficaz a detetar agentes que operam a partir de extensões de navegador (Manus AI, Comet)
  • Concebido para prevenir ataques e fraude baseados em agentes, e não apenas "bloquear rastreadores"
  • Capacidades de governança para melhorar experiências de comércio agêntico
  • Visibilidade sobre o tráfego agêntico. Um dashboard com os agentes presentes no seu site, as ações que estão a tomar, onde ficam bloqueados e o risco que representam.

As stacks modernas de segurança web precisam de uma ferramenta especializada de deteção de agentes de IA: bloquear "bots" e rastreadores já não é suficiente. Os agentes de IA exigem classificação comportamental e regras dinâmicas. Ferramentas como o cside AI Agent Detection dão às empresas essa visibilidade, para que a fraude possa ser bloqueada sem afetar os agentes de consumo genuínos.

Por Que Deve Bloquear (Alguns) Agentes de IA do Seu Site

Infográfico: ameaças de agentes de IA ao seu site
Infográfico: ameaças de agentes de IA ao seu site

Nem todos os agentes de IA são prejudiciais. Alguns ajudam consumidores. Alguns funcionam como ferramentas de investigação. Mas muitos agentes são fraudulentos. Um relatório de investigação da Ahrefs concluiu que 63% dos sites recebem tráfego agêntico. Isso foi no início de 2025. Atualmente, essa percentagem é provavelmente mais elevada.

Por que bloquear rastreadores e scrapers:

A conversa em torno do tráfego agêntico centra-se atualmente em rastreadores visíveis do ChatGPT, Gemini ou de outras plataformas de LLM que obtêm conteúdo para respostas ou para treinar modelos. A motivação para bloquear rastreadores e scrapers é válida, especialmente para empresas com conteúdo único, como editoras ou serviços de streaming de media, que enfrentam:

  • Scraping de conteúdo premium para pirataria
  • Recolha de conteúdo para treinar modelos de LLM sem autorização

Por que agentes de IA fraudulentos:

Os rastreadores de plataformas de LLM não são a única ameaça. Na verdade, estão do lado "mais seguro" do espectro de automação de bots. A ameaça mais preocupante é a forma como o abuso automatizado por parte de atacantes será amplificado por agentes de IA. Os agentes facilitam a evasão à deteção e a imitação do comportamento humano.

Um relatório sobre crime financeiro do Departamento do Tesouro dos EUA chama a atenção para o facto de os agentes de IA reduzirem a barreira de entrada a técnicas de ataque sofisticadas que antes exigiam muitos recursos, tornando a fraude automatizada acessível a atacantes com poucas competências.

Ameaças agênticas para equipas de segurança:

  • Tentativas automatizadas de tomada de contas
  • Descoberta de vulnerabilidades assistida por IA
  • Abuso de fluxos de utilizadores autenticados
  • Manipulação de checkout através de scripts

Ameaças agênticas para equipas de fraude:

  • Testar credenciais roubadas em grande escala
  • Abusar de códigos promocionais e cupões
  • Automatizar fluxos de fraude de devoluções
  • Perfis falsos criados com documentos de identificação e fotos gerados por LLMs

Ameaças agênticas para equipas de eCommerce:

  • Acumulação de stock por compradores automatizados
  • Scraping de preços por rastreadores de catálogo automatizados
  • Fraude em links de afiliados

O panorama de ameaças dos agentes de IA em 2026

Desde o início de 2025, vários desenvolvimentos expandiram a superfície de ataque dos agentes de IA e tornaram a deteção consideravelmente mais difícil.

Agentes com capacidades de utilização de computador

Plataformas como o OpenAI Operator e a utilização de computador do Claude da Anthropic podem navegar em sites, preencher formulários e concluir transações de forma autónoma. São as mesmas ações que um utilizador humano realizaria. Estes agentes operam dentro de navegadores reais, o que significa que os controlos de rede tradicionais os veem como tráfego web normal. O Google Gemini Live e produtos similares estendem estas capacidades a ambientes móveis.

Comunicação de agentes ao nível do protocolo

O Model Context Protocol (MCP), introduzido pela Anthropic, permite que os agentes de IA se conectem diretamente a serviços e fontes de dados. Os agentes que operam via MCP podem contornar fluxos de autenticação padrão ou desencadear chamadas de API de alta frequência que não se parecem com o tráfego de utilizadores baseado em navegador. O protocolo Agent-to-Agent (A2A) da Google permite a delegação de tarefas entre múltiplos agentes, criando cadeias de pedidos multi-salto difíceis de atribuir.

Abuso do comércio agêntico em escala

O que era teórico no início de 2025 é agora observado no comércio eletrónico e nos serviços financeiros: agentes de IA a concluir compras, resgatar cupões, criar contas e gerir perfis de forma autónoma. A reciclagem de códigos promocionais, a manipulação do fluxo de pagamento e a automatização da fraude em devoluções são agora vetores de ataque viáveis.

Implicação para a deteção: Todos estes tipos de agentes operam dentro de ambientes de navegador legítimos. A deteção requer sinais comportamentais capturados a partir do interior da sessão, não apenas reputação de IP ou inspeção de user-agent.

Como bloquear agentes de IA no seu site (passo a passo)

Passo 1: Identifique os agentes de IA no seu site (quem são eles)

Com uma ferramenta de deteção:

  • Para obter um dashboard instantâneo de agentes de IA fraudulentos e tráfego de rastreadores, pode usar o cside Agent Detection.
  • Se o seu site estiver ligado ao Cloudflare, pode consultar o dashboard de Bot Analytics para um detalhe do tráfego de rastreadores de IA.
  • Para visibilidade específica de SEO sobre o tráfego de rastreadores de IA, pode usar o analisador de logs do Screaming Frog. Esta ferramenta analisa os seus logs de servidor em bruto e visualiza um relatório de tráfego.

Por conta própria:

Se um rastreador de IA se identificar publicamente, vai mostrar sinais identificáveis ao nível do pedido. Verifique as strings de user-agent presentes nos pedidos HTTP. Para aceder a esta informação, tem de ir aos logs do seu servidor e procurar campos que correspondam a identidades de agentes de IA:

  • GPTBot
  • ChatGPT-User
  • ClaudeBot

Passo 2: Perceba que ações os agentes de IA realizam no seu site (o que estão a fazer)

Com uma ferramenta de deteção especializada: plataformas de governança de agentes de IA como o cside AI Agent Detection ou o HUMAN Agentic Trust monitorizam a execução no navegador, os fluxos de navegação e os padrões comportamentais. Isto muda a análise de "isto é um bot?" para "o que está este bot a tentar alcançar?". Uma camada de deteção moderna vai ver:

  • Se um agente está a acionar fluxos de login ou de checkout
  • Tentativas repetidas contra endpoints sensíveis
  • Submissões automatizadas de formulários

Por conta própria: descobrir manualmente o que os agentes de IA estão a fazer exige analisar logs do servidor, tempos de pedido e padrões de execução de JavaScript.

Passo 3: Perceba a intenção por trás dos agentes de IA (representam um risco)

Exemplo de agentes de confiança e não fiáveis no dashboard de uma ferramenta de deteção de agentes de IA (cside)
Exemplo de agentes de confiança e não fiáveis no dashboard de uma ferramenta de deteção de agentes de IA (cside)

Compreender a intenção de um agente de IA exige distinguir entre automação útil e automação prejudicial. As ferramentas tradicionais de deteção de bots não foram criadas para lidar com agentes que imitam o comportamento humano e correm dentro do ambiente de navegador autêntico de um utilizador.

Com uma Ferramenta de Deteção Especializada: soluções como o cside AI Agent Detection ou a plataforma Agent Trust da DataDome foram criadas para a internet agêntica. Ajudam a distinguir entre agentes de IA de consumo que auxiliam em pesquisas e compras e agentes de IA fraudulentos que abusam de códigos promocionais, extraem informação ou criam perfis falsos.

Em vez de tomarem decisões binárias sobre identidade, estas plataformas usam regras avançadas de pontuação de risco criadas por engenheiros de segurança. Estas analisam sinais como:

  • Pedidos excessivos ou anómalos
  • Utilização de VPNs ou proxies
  • Ambientes de execução de navegador suspeitos
  • Fingerprinting para detetar a reutilização de dispositivos em fluxos de risco (como o resgate de códigos promocionais)
  • Interações e análise comportamental

Passo 4: Governe os agentes de IA com base no comportamento (bloquear, confiar ou orientar)

Depois de perceber o que os agentes de IA estão a fazer no seu site, pode decidir como deixá-los interagir com o seu site. A reação instintiva é bloquear tudo exceto os rastreadores que ajudam com SEO ou pesquisa por IA. Essa abordagem é boa para a segurança, mas exclui agentes de IA legítimos que possam estar a investigar produtos, a reservar bilhetes, a preencher formulários ou a submeter pedidos de informação.

É por isso que a deteção tradicional de bots fica aquém na era agêntica. Estas soluções dão-lhe apenas lógica básica de permitir/negar. A era agêntica exige mais nuance. "Bots" agênticos serão criados por consumidores diariamente, tão comuns quanto navegar na internet. Uma estratégia madura de governança agêntica determina "o que deve esta sessão agêntica ter permissão para fazer?".

Por exemplo:

  • Os agentes de investigação podem precisar apenas de acesso de leitura ao seu site
  • Os agentes baseados em tarefas podem ter permissão para submeter formulários ou pedir informação
  • Esses mesmos agentes baseados em tarefas podem ter a permissão para agir revogada em páginas sensíveis, como portais de gestão de perfil

Plataformas como o cside AI Agent Detection suportam este tipo de governança baseada no comportamento. Os dashboards facilitam às equipas de fraude a obtenção de dados para travar o abuso de agentes de IA numa fase inicial. Os developers recebem um SDK e bibliotecas para personalizar a experiência para agentes baseados em navegador, potenciando ainda mais o comércio agêntico.

Por que o robots.txt não chega para bloquear agentes de IA

O robots.txt é uma diretiva voluntária, não um controlo de segurança. Pede a rastreadores específicos que não acedam ao seu site, mas não os impede tecnicamente de o fazer. O robots.txt pode ser um mecanismo útil para bloquear os grandes rastreadores (Meta, ChatGPT, GoogleBot) que prometem respeitar esta diretiva, mas não faz muito para travar a fraude por agentes de IA.

Os assistentes de IA e os rastreadores de busca nem sempre cumprem o robots.txt

Visualização de dados: frequência de verificações do robots.txt entre agentes de IA e bots.
Visualização de dados: frequência de verificações do robots.txt entre agentes de IA e bots. Fonte: "Scrapers Selectively Respect robots.txt Directives", Duke University

Um relatório de investigação académica de 2025 da Duke University mostra que apenas cerca de 60% dos assistentes de IA e rastreadores de busca de IA vão consultar ou cumprir os pedidos de "disallow" do robots.txt. Essa média é provavelmente enviesada em alta pelos bots do ChatGPT e do GoogleBot, que respeitam a diretiva mais de 99% das vezes.

Alguns bots populares, como o Perplexity, só vão respeitar a diretiva "disallow" cerca de 20% das vezes.

Os agentes de IA que usam navegadores headless (como agentes personalizados criados por consumidores) são os que menos respeitam o robots.txt, cumprindo as diretivas "disallow" cerca de 10% das vezes.

Falsificação de user-agent para contornar o robots.txt

O robots.txt baseia-se em "strings de user-agent" autodeclaradas. É como perguntarem-lhe o seu nome. Pode autodeclarar o que quiser. Se estiver a tentar entrar num evento e souber que o nome "Brad Pitt" está na lista, pode dizer que esse é o seu nome. No mundo real, podem pedir-lhe alguma prova. Em contrapartida, o robots.txt não tem forma de confirmar se as identidades são de facto válidas.

Assim, agentes fraudulentos podem afirmar ser o "Claudebot" ou o "GPTBot". Se essas identidades forem permitidas no seu site, o robots.txt vai deixá-las passar sem qualquer problema.

A deteção tradicional de bots (como o Cloudflare) não deteta agentes de IA

Os sistemas tradicionais de deteção de bots foram concebidos para uma era em que a automação corria a partir de servidores de nuvem ou de redes de proxy óbvias. Estes sistemas dependem fortemente de sinais da camada de rede e de bases de dados de reputação, com visibilidade limitada sobre a execução de JavaScript e as interações no site.

A ascensão da automação baseada em navegador alojada localmente

Uma classe crescente de automação corre agora dentro de ambientes de navegador reais:

  • Agentes de consumo que correm em extensões de navegador como o Manus ou a extensão de navegador da Claude
  • Automações criadas por developers que usam ferramentas de navegador headless como o Playwright ou o Selenium, que correm em máquinas ou até em dispositivos móveis
  • Agentes fraudulentos que usam ferramentas de navegador headless de código aberto para executar ataques

Esta categoria de agentes surgiu, em parte, para facilitar que consumidores/developers legítimos criem bots de IA que interagem com a web. Também surgiu como um esforço intencional para evitar a deteção por parte de ferramentas legadas de governança de bots.

Captura de ecrã de um fornecedor de navegador headless a anunciar a capacidade de contornar ferramentas de deteção legadas como o Cloudflare e a DataDome
Esta captura de ecrã é de um fornecedor de navegador headless que vamos manter sem nome, mas que anuncia explicitamente a capacidade de contornar ferramentas de deteção legadas como o Cloudflare e a DataDome

Estes agentes baseados em navegador headless não se identificam claramente. Na verdade, tentam de forma intencional parecer um utilizador humano real, o que torna a deteção de fraude mais difícil (e contamina as análises pelo caminho).

Apanhar agentes baseados em navegador headless exige uma ferramenta especializada de deteção de agentes de IA que analise sinais comportamentais e contexto profundo do navegador.

Como a cside ajuda as empresas a bloquear atacantes agênticos

Dashboard da cside para Deteção de Agentes de IA
Dashboard da cside para Deteção de Agentes de IA

A cside é uma plataforma de segurança web, especializada na monitorização de sinais da camada do navegador para reduzir a fraude nas empresas. O cside AI Agent Detection ajuda-o a identificar, classificar e governar o tráfego agêntico no seu site.

  • Obtenha um dashboard com os agentes que estão a aceder ao seu site e o que estão a fazer
  • Pontuações de risco automáticas a partir de sinais comportamentais para apanhar agentes de IA maus (incluindo os baseados em navegador e alojados localmente) que escapam às defesas tradicionais contra bots
  • Dê aos seus developers ferramentas para colocar guardrails em torno do que os agentes podem fazer
  • Previna fraude por agentes de IA, como abuso de códigos promocionais, pirataria de conteúdo, testes de cartões de crédito, descoberta de vulnerabilidades e scraping avançado.

Pode começar já a ver o tráfego agêntico no seu site com uma conta gratuita.

Juan Combariza
Growth Marketer

Researching & writing about client side security.

FAQ

Frequently Asked Questions

Pode utilizar o robots.txt para solicitar que os rastreadores de IA não acedam ao seu site, mas trata-se apenas de uma diretiva voluntária. Os principais motores de busca podem respeitá-la, enquanto agentes maliciosos ou mal configurados vão ignorá-la. O robots.txt não tem mecanismo de aplicação nem validação de identidade, sendo um ponto de partida e não uma verdadeira estratégia de prevenção de fraude.

Muitas ferramentas legadas de deteção de bots foram criadas numa época em que a automação vinha de infraestruturas de nuvem óbvias e seguia padrões de tráfego previsíveis. Os agentes de IA modernos operam dentro de ambientes de navegador reais, por vezes alojados localmente nos dispositivos dos utilizadores, e são concebidos para imitar de perto o comportamento humano, tornando a deteção significativamente mais difícil.

A abordagem correta depende do seu objetivo. Se quer apenas limitar os principais rastreadores de busca ou os scrapers de treino de LLM, o robots.txt pode ser suficiente. Controlos no lado do servidor, como o bloqueio de IP, oferecem uma aplicação mais robusta. No entanto, para prevenir fraude conduzida por IA ou automação baseada em navegador, precisa de uma plataforma especializada em deteção de agentes de IA, como a cside.

Um rastreador de IA normalmente lê conteúdo disponível publicamente e segue em frente depois de obter as páginas. Um agente de IA fraudulento interage ativamente com o seu site, testando formulários de login, abusando de fluxos promocionais, extraindo dados estruturados ou executando automações prejudiciais. Os rastreadores costumam identificar-se, enquanto os agentes de IA fraudulentos ocultam a sua identidade e tentam parecer utilizadores legítimos.

A deteção de agentes de IA é o processo de identificação de sessões de navegador automatizadas operadas por sistemas de IA em vez de utilizadores humanos. Ao contrário da deteção de bots tradicional, que procura padrões de automatização no lado do servidor, a deteção de agentes de IA foca-se em sinais comportamentais dentro do ambiente do navegador: como um agente navega, executa JavaScript e interage com os elementos da página. Como os agentes de IA modernos operam dentro de ambientes de navegador reais e são concebidos para imitar o comportamento humano, é necessária uma monitorização especializada do lado do cliente.

As ferramentas especializadas de deteção de agentes de IA instalam um snippet de JavaScript leve no seu site que monitoriza sinais a partir do interior da sessão do navegador do visitante. Estes incluem padrões de interação (movimento do rato, velocidade de scroll, cadência de digitação), contexto de execução JavaScript (indicadores de navegador headless, artefactos de frameworks de automatização), sinais de fingerprinting (renderização de canvas, propriedades WebGL) e sequências comportamentais (fluxo de navegação, tempo em cada elemento, padrões de preenchimento de formulários). Estes sinais combinam-se numa pontuação de risco por sessão, permitindo às equipas de segurança bloquear, desafiar ou permitir sessões com base na intenção avaliada.

A detecção especializada de agentes de IA é o único dos quatro métodos criado para deter a fraude em vez de apenas frear os rastreadores. O robots.txt é um pedido voluntário, os controles de servidor e as regras de IP são facilmente contornados com proxies residenciais, e a detecção de bots tradicional tem dificuldade com agentes que rodam dentro de navegadores reais. Se você enfrenta abuso de promoções, teste de cartões ou tomada de contas por agentes de IA, uma ferramenta como cside que pontua cada sessão pelo comportamento é a escolha certa.

Sim, eles resolvem problemas diferentes. O robots.txt e os controles de servidor são formas econômicas de frear rastreadores bem-comportados como GPTBot e ClaudeBot e de reduzir a carga desnecessária do servidor, então mantenha-os. Eles não fazem nada contra agentes que falsificam identidades ou rodam dentro de navegadores reais, e é aí que entra a detecção especializada. Pense no robots.txt como higiene básica e no cside como a camada de aplicação que pontua e governa o comportamento real de cada sessão.

Priorize as ferramentas que analisam o comportamento dentro da sessão do navegador, e não apenas a reputação de IP ou as cadeias de user-agent. Procure detecção precisa de agentes headless hospedados localmente como Playwright e Selenium, pontuação de risco por sessão em vez de permitir ou negar de forma binária, visibilidade do que os agentes realmente fazem e controles de governança para permitir agentes de consumo úteis enquanto bloqueia o abuso. O cside é implementado como um único script próprio e cobre tudo isso sem rotear o seu tráfego.

O cside lê mais de 250 sinais dentro de cada sessão de navegador, incluindo padrões de interação, o contexto de execução de JavaScript, artefatos de headless e de automação, e a impressão digital do dispositivo, e os combina em uma pontuação de risco por sessão. Como ferramentas como Playwright, Selenium, Manus e Comet rodam dentro de navegadores reais e imitam o comportamento humano, a inspeção em nível de rede sozinha não consegue vê-las. O cside é instalado como um único script próprio, então observa a sessão diretamente em vez de adivinhar pela reputação de IP.

Sim, essa distinção é justamente o objetivo da pontuação de risco baseada em comportamento. O cside classifica cada sessão pela forma como navega, executa JavaScript, reutiliza dispositivos e toca fluxos sensíveis como login ou pagamento, em vez de tomar uma decisão binária sobre a identidade. Um agente de pesquisa que explora produtos recebe uma pontuação diferente de um que testa cartões roubados ou recicla códigos promocionais, então você pode permitir, desafiar ou bloquear por sessão e até conceder ações limitadas a agentes confiáveis por meio do SDK para desenvolvedores.

Você adiciona um único script de JavaScript próprio ao seu site, sem alteração de DNS e sem rotear o tráfego, e o tráfego agêntico começa a aparecer no painel. O cside não fica na frente do seu tráfego; ele observa a sessão e busca os scripts de terceiros do seu lado. O preço segue um modelo medido com base em sessões ou visualizações de página, com planos por níveis e uma conta gratuita para começar, então você pode falar com a equipe para dimensioná-lo.

Monitore e proteja seus scripts de terceiros

Gain full visibility and control over every script delivered to your users to enhance site security and performance.

Comece grátis ou experimente o Business com um teste de 14 dias.

Interface do painel cside mostrando monitoramento de scripts e análises de segurança
Related Articles
Agende uma demonstração

Quer ver isso em detalhe com um engenheiro?

Trinta minutos, no seu próprio site. Sem slides.

Agende uma demo personalizada para ver:

Como alcançar a conformidade com os requisitos 6.4.3 e 11.6.1 do PCI DSS em 1 dia
Por que scripts de terceiros são um risco de segurança para você e seus visitantes
Como monitorar vazamentos de privacidade e consentimento (RGPD, CCPA) em cada terceiro
Como conter abuso de cadastros, compartilhamento de contas e fraude de chargeback com device intelligence
Como detectar e controlar agentes de IA e bots que acessam seu site em tempo real

Prefere só mandar uma pergunta?

Procurando horários livres…

Apenas humanos de verdade. A gente saberia.

Problemas para agendar? Abrir o agendador em uma nova aba

O que você está tentando resolver?

Conte em uma linha e voltamos com algo útil, não com um discurso genérico.

Costumamos ajudar com:

Ver quais scripts de terceiros rodam no seu site
Evidências para PCI DSS 6.4.3 e 11.6.1
Bots, agentes de IA e roubo de contas

Prefere agendar um horário? Escolher um horário