Bate-papos privados de Claude expostos nos resultados de pesquisa do Google e do Bing
O que acontece entre você e um chatbot de IA nem sempre ficam entre você e um chatbot. Basta perguntar Google.
No fim de semana, as pessoas ficaram surpresas ao descobrir que alguns Antrópico Cláudio os bate-papos podem ser facilmente encontrados por meio de pesquisa na web. O problema, que parece ter sido sinalizado pela primeira vez por um redatorexpôs bate-papos que incluíam pessoas pedindo conselhos sobre a qual partido político deveriam se filiar, se os advogados no Kansas são obrigados a se reportar quando acreditam que cometeram uma violação ética e dramatizações eróticas.
Cláudio permite os usuários compartilhem com outras pessoas “instantâneos” de bate-papos, criando uma URL pública para um tópico específico do chatbot. As razões pelas quais alguns desses URLs foram indexados pelos principais mecanismos de pesquisa se resumem às funções básicas de sites, mecanismos de pesquisa e à colisão dos dois quando a IA generativa entra na mistura.
Basicamente, o Anthropic instrui rastreadores da web, como aqueles usados por mecanismos de busca como Google e Bing, a não indexar bate-papos que um usuário decide compartilhar com outras pessoas. A empresa faz isso por meio de algo chamado arquivo robots.txt, que há muito é considerado a forma padrão de informar aos web scrapers quais partes de um site são apropriadas para acesso. O robots.txt da Anthropic tornou os bate-papos “compartilhados” fora dos limites dos web scrapers desde pelo menos setembro de 2025, de acordo com um instantâneo na máquina Wayback.
Mas é mais difícil impedir que páginas sejam incluídas nos resultados de mecanismos de pesquisa do que você imagina.
Bing, que ainda mostra “cerca de 612 resultados” se você pesquisar “site:claude.ai/share”no momento da redação deste artigo, diz em sua documentação técnica que os desenvolvedores podem bloquear os rastreadores da web do mecanismo de pesquisa usando robots.txt – mas que os desenvolvedores da web também devem incluir uma tag “noindex” em páginas individuais também.
Alguns dos bate-papos que apareceram nos resultados de pesquisa sinalizados na postagem do Reddit foram excluídos no momento em que o WIRED os visualizou, e os resultados não aparecem mais no Google quando você pesquisa a consulta “compartilhar” que ainda funcionava no Bing. Em um guia do desenvolvedoro Google diz que ignora as instruções do robots.txt se essa página estiver vinculada a outro lugar na Internet e o proprietário da página também não incluir uma tag html “noindex” especial na página ou uma “tag x-robots” no cabeçalho de resposta da página.
A WIRED revisou uma amostra das páginas de bate-papo expostas de Claude e descobriu que elas não incluíam a tag “noindex” que tanto o Bing quanto o Google dizem levar em consideração ao decidir se indexam ou não uma página.
A Microsoft, dona do Bing, não fez comentários antes da publicação. A Anthropic não respondeu a vários pedidos de comentários.
O porta-voz do Google, Ned Adriance, disse à WIRED que a indexação dos bate-papos compartilhados de Claude é de responsabilidade da Anthropic. “Nem o Google nem qualquer outro mecanismo de busca controla quais páginas são tornadas públicas na web, e essas páginas foram indexadas em muitos mecanismos de busca”,
Adriane diz. “Damos aos proprietários de sites controles claros para decidir se as páginas podem ser rastreadas ou indexadas, e sempre respeitamos essas diretivas.”
A Anthropic não respondeu às perguntas sobre por que não incluiu a tag “noindex” nas páginas de bate-papo compartilhadas.
Em setembro passado, a Anthropic foi criticada pelo mesmo problema e disse Forbes que usa o robots.txt para informar aos rastreadores que não devem acessar os bate-papos compartilhados. Mas, como aponta o relatório da Forbes, não há garantia de que isso impedirá os mecanismos de busca de indexar páginas específicas da web.
Mesmo que o robots.txt nem sempre funcione para evitar que as páginas sejam indexadas nos motores de busca, os laboratórios de IA ainda o utilizam para outros fins. Muitos laboratórios promessa criadores que seus sites não serão usados como material de treinamento de IA, desde que os desenvolvedores se certifiquem de “proibir” certos rastreadores em seus arquivos robots.txt, e os próprios laboratórios também sigam esse conselho.
Veja também
Por dentro da missão de resgate selvagem que levou 4 baleias...
Análise do projetor Soundcore Nebula P1i: novo design, armad...
Os 10 melhores aspiradores portáteis testados com WIRED de 2...
Os influenciadores do bem-estar estão promovendo alternativa...
Todas as maneiras de facilitar a leitura no seu telefone
As melhores almofadas para dormir para mochila, testadas na...
Análise da GoPro Mission 1 Pro: a melhor câmera de ação que...
Por que a Leatherology faz algumas das melhores bolsas para...
3 coisas inteligentes que você pode fazer com um antigo Kind...
