Función
Investigación narrada y rastreo web en ClawAI
Cómo investiga ClawAI en la web: un planificador que elige entre buscar o rastrear, un registro de trabajo narrado en directo, descargas por niveles que respetan robots.txt y fuentes citadas.
Todas las funciones · Última revisión:
Decide un planificador, no una palabra clave
En el modo de investigación Auto, un modelo planificador lee el mensaje y elige uno de cuatro caminos: responder con lo que ya sabe, buscar en la web, rastrear un sitio concreto, o rastrear y después buscar. Un enlace que pegues siempre se abre. Si el modelo planificador devuelve algo inservible, se prueba el siguiente modelo en lugar de que la investigación se detenga en silencio.
También puedes elegir tú el modo en el compositor: desactivado, Auto, solo búsqueda, búsqueda y descarga de páginas, o búsqueda y extracción de contenido estructurado.
Un registro de trabajo que puedes seguir
Cada paso —el plan, cada búsqueda, cada página descargada u omitida— se transmite en directo a un registro narrado encima de la respuesta y se guarda con ella, así que sigue ahí después de recargar. Las fuentes en las que se basó la respuesta aparecen junto a ella, para que puedas abrirlas y comprobarlas tú mismo.
Descargas por niveles que siguen las normas
Las páginas se descargan empezando por lo más barato: la API oficial del sitio cuando existe, después una petición HTTP simple y, solo cuando una página lo requiere, un navegador sin interfaz, con un servicio lector e instantáneas de archivo como últimos recursos. Un rastreo puede cubrir hasta doscientas páginas de un mismo sitio.
robots.txt se respeta en cada descarga con el agente de usuario ClawAI-ResearchBot, y una página no permitida no se reintenta por otra vía. Los muros de inicio de sesión y los bloqueos legales detienen la descarga, los captchas nunca se resuelven, cada redirección se comprueba contra direcciones de redes privadas y una copia archivada siempre se etiqueta como tal.
Preguntas frecuentes
- ¿ClawAI respeta robots.txt?
- Sí, en cada descarga, con el agente de usuario ClawAI-ResearchBot. Una página que robots.txt no permite se omite y no se reintenta mediante otro método de descarga.
- ¿Puedo ver qué hizo realmente la investigación?
- Sí. Un registro de trabajo narrado muestra el plan, cada búsqueda y cada página descargada u omitida, y se guarda con la respuesta junto con la lista de fuentes que utilizó.
- ¿La investigación web está disponible en todos los planes?
- Los modos de investigación son funciones del plan (RESEARCH_MODE, WEB_SEARCH, WEB_FETCH y WEB_EXTRACT) con sus propias asignaciones, que el operador fija por plan. La página de precios muestra qué incluye cada plan.
Pruébalo en lugar de confiar en nuestra palabra
El ciclo de investigación se ejecuta en su propio servicio de investigación, con niveles de descarga editables por el administrador, y se mide en sus propias superficies en lugar de como tokens de chat ordinarios.