Passer au contenu principal

Fonctionnalité

Traitement des fichiers et documents dans ClawAI

Comment ClawAI ingère les fichiers — envoi, découpage, OCR, contrôles à l’envoi — et les génère en retour sous forme d’images, de documents et de recherches avec sources citées.

Toutes les fonctionnalités · Dernière révision:

Envoi, découpage et livraison adaptée à chaque modèle

ClawAI accepte PDF, DOCX, tableurs, CSV, JSON, Markdown, texte brut, fichiers de code et images. Un fichier est découpé en passages et indexé, pour que seules les parties pertinentes à une question entrent dans la requête, et chaque modèle reçoit la forme qu’il traite le plus fiablement — une image native, un PDF natif ou du texte extrait — chaque message indiquant la forme réellement reçue par chaque modèle. Les fichiers peuvent être joints par message, y compris dans les exécutions Compare, pour interroger plusieurs modèles sur le même document à la fois.

OCR pour les documents scannés, et contrôles à chaque envoi

Un PDF scanné sans couche de texte passe par l’OCR avant d’atteindre un modèle, et est signalé quand la confiance de reconnaissance est faible. Chaque envoi est scanné contre les virus, vérifié par rapport au type de fichier déclaré, examiné pour des noms de fichiers dangereux, et rejeté si une archive s’avère être une bombe de décompression — les envois comptent contre les limites de taille et de stockage d’un plan, et les fichiers sont retirés selon un calendrier de conservation ou supprimables à tout moment.

Générer des images, des documents et des recherches citées

En sortie, ClawAI peut produire une image à partir d’une description, exporter n’importe quelle réponse ou une conversation entière en fichier formaté PDF, DOCX, CSV, HTML, Markdown, TXT ou JSON, et exécuter une tâche de recherche qui parcourt le web, récupère et lit des pages, et répond avec les sources réellement utilisées. La génération d’images, la génération de fichiers et la recherche sont chacune mesurées séparément (IMAGE, FILE_GENERATION, et les quotas RESEARCH_MODE / WEB_SEARCH / WEB_FETCH / WEB_EXTRACT), distinctes de l’usage de jetons du chat ordinaire. Voir « comment fonctionne l’appel d’outils IA » et « que sont les sorties IA structurées », tous deux liés ci-dessous, pour le mécanisme derrière une forme de sortie définie.

Questions fréquentes

Quels types de fichiers puis-je envoyer ?
PDF, DOCX, tableurs, CSV, JSON, Markdown, texte brut, fichiers de code et images. Chaque modèle reçoit la forme qu’il traite le plus fiablement, et le message indique la forme réellement reçue par chaque modèle.
ClawAI peut-il lire un document scanné sans couche de texte ?
Oui — un PDF scanné passe par l’OCR avant d’atteindre un modèle, et est signalé quand la confiance de reconnaissance est faible.
Dans quels formats puis-je exporter un document ?
PDF, DOCX, CSV, HTML, Markdown, TXT et JSON. L’export de document est une surface mesurée distincte, séparée du chat ordinaire et de l’usage de recherche.

Essayez-le plutôt que de nous croire sur parole

Envoi, découpage, OCR et contrôles à l’entrée ; génération d’images, export de documents et recherches citées à la sortie — des fonctionnalités réelles, livrées et mesurées séparément, pas un seul mode fichier mélangé.