Funzionalità
Ricerca narrata ed esplorazione del web in ClawAI
Come ClawAI fa ricerca sul web: un pianificatore che sceglie se cercare o esplorare, un registro di lavoro narrato in diretta, un recupero a livelli che rispetta robots.txt e fonti citate.
Tutte le funzionalità · Ultima revisione:
Decide un pianificatore, non una parola chiave
Nella modalità di ricerca Auto, un modello di pianificazione legge il messaggio e sceglie uno di quattro percorsi: rispondere con ciò che sa già, cercare sul web, esplorare un sito specifico, oppure esplorare e poi cercare. Un link che incolli viene sempre aperto. Se il modello di pianificazione restituisce qualcosa di inutilizzabile, si prova il modello successivo invece di interrompere la ricerca in silenzio.
Puoi anche scegliere tu la modalità nel compositore: disattivata, Auto, solo ricerca, ricerca con recupero delle pagine, oppure ricerca con estrazione di contenuti strutturati.
Un registro di lavoro che puoi seguire
Ogni passaggio — il piano, ogni ricerca, ogni pagina recuperata o saltata — viene trasmesso in tempo reale in un registro narrato sopra la risposta, e salvato con la risposta così che resti lì anche dopo un aggiornamento della pagina. Le fonti su cui si basa la risposta sono elencate insieme a essa, così puoi aprirle e verificarle tu stesso.
Un recupero a livelli che rispetta le regole
Le pagine vengono recuperate partendo dal metodo più economico: l’API ufficiale del sito quando esiste, poi una semplice richiesta HTTP, poi il passaggio a un browser headless solo quando una pagina lo richiede, con un servizio di lettura e le copie d’archivio come ripieghi successivi. Un’esplorazione può coprire fino a duecento pagine di uno stesso sito.
robots.txt viene rispettato a ogni recupero con lo user agent ClawAI-ResearchBot, e una pagina non consentita non viene ritentata in altro modo. Le pagine che richiedono l’accesso e i blocchi legali fermano il recupero, i captcha non vengono mai risolti, ogni reindirizzamento viene controllato contro gli indirizzi di rete privati e una copia d’archivio è sempre indicata come tale.
Domande frequenti
- ClawAI rispetta robots.txt?
- Sì, a ogni recupero, con lo user agent ClawAI-ResearchBot. Una pagina vietata da robots.txt viene saltata e non viene ritentata con un altro metodo di recupero.
- Posso vedere cosa ha fatto davvero la ricerca?
- Sì. Un registro di lavoro narrato mostra il piano, ogni ricerca e ogni pagina recuperata o saltata, e viene salvato con la risposta insieme all’elenco delle fonti utilizzate.
- La ricerca web è disponibile su ogni piano?
- Le modalità di ricerca sono funzionalità di piano (RESEARCH_MODE, WEB_SEARCH, WEB_FETCH e WEB_EXTRACT) con limiti propri, che l’operatore fissa per ciascun piano. La pagina dei prezzi mostra cosa include ogni piano.
Provalo invece di fidarti della nostra parola
Il ciclo di ricerca gira in un proprio servizio di ricerca con livelli di recupero modificabili dall’amministratore, misurato su superfici proprie invece che come normali token di chat.