Saltar para o conteúdo principal

Recurso

Pesquisa narrada e rastreamento da web na ClawAI

Como a ClawAI pesquisa na web: um planejador que escolhe entre buscar e rastrear, um registro de trabalho narrado ao vivo, acesso em níveis que respeita o robots.txt e fontes citadas.

Todos os recursos · Última revisão:

Quem decide é um planejador, não uma palavra-chave

No modo de pesquisa Auto, um modelo planejador lê a mensagem e escolhe um de quatro caminhos: responder com o que já sabe, buscar na web, rastrear um site específico ou rastrear e depois buscar. Um link que você cola é sempre aberto. Se o modelo planejador devolver algo inutilizável, o próximo modelo é tentado, em vez de a pesquisa parar em silêncio.

Você também pode escolher o modo no compositor: desligado, Auto, apenas busca, busca e acesso às páginas, ou busca e extração de conteúdo estruturado.

Um registro de trabalho que você pode acompanhar

Cada etapa — o plano, cada busca, cada página acessada ou ignorada — é transmitida para um registro narrado acima da resposta à medida que acontece, e salva com a resposta para continuar lá depois de atualizar a página. As fontes usadas pela resposta aparecem listadas junto dela, para que você possa abri-las e conferir por conta própria.

Acesso em níveis que segue as regras

As páginas são acessadas do jeito mais barato primeiro: a API oficial do site, quando existe, depois uma requisição HTTP simples, e só então um navegador headless quando a página realmente exige, com um serviço de leitura e cópias de arquivos da web como alternativas posteriores. Um rastreamento pode cobrir até duzentas páginas de um mesmo site.

O robots.txt é respeitado em cada acesso sob o user agent ClawAI-ResearchBot, e uma página não permitida não é tentada de outra forma. Barreiras de login e bloqueios legais interrompem o acesso, captchas nunca são resolvidos, cada redirecionamento é verificado contra endereços de rede privada e uma cópia arquivada é sempre identificada como tal.

Perguntas frequentes

A ClawAI respeita o robots.txt?
Sim, em cada acesso, sob o user agent ClawAI-ResearchBot. Uma página que o robots.txt não permite é ignorada e não é tentada por outro método de acesso.
Posso ver o que a pesquisa realmente fez?
Sim. Um registro de trabalho narrado mostra o plano, cada busca e cada página acessada ou ignorada, e fica salvo com a resposta junto com a lista de fontes utilizadas.
A pesquisa na web está disponível em todos os planos?
Os modos de pesquisa são recursos de plano (RESEARCH_MODE, WEB_SEARCH, WEB_FETCH e WEB_EXTRACT) com cotas próprias, que o operador define por plano. A página de preços mostra o que cada plano inclui.

Experimente em vez de confiar na nossa palavra

O ciclo de pesquisa roda em um serviço de pesquisa próprio, com níveis de acesso editáveis pelo administrador, e é medido em superfícies próprias, não como tokens comuns de chat.