機能
ClawAIのファイルと文書の処理
ClawAIがファイルを取り込む方法(アップロード、チャンク分割、OCR、アップロード検査)と、画像、文書、出典付き調査として再び出力する方法を、実装済みの機能に基づいて詳しく解説します。
すべての機能 · 最終確認日:
アップロード、チャンク分割、モデルごとの最適な配信
ClawAIはPDF、DOCX、表計算、CSV、JSON、Markdown、プレーンテキスト、コードファイル、画像を受け付けます。ファイルは断片に分割されインデックス化され、質問に関連する部分だけがプロンプトに入ります。各モデルは最も確実に扱える形式(ネイティブ画像、ネイティブPDF、抽出テキスト)を受け取り、各メッセージにどのモデルが実際にどの形式を受け取ったかが表示されます。ファイルはCompare実行を含め、メッセージごとに添付でき、複数モデルに同一文書について同時に質問できます。
スキャン文書へのOCR、そしてアップロードごとの検査
テキストレイヤーのないスキャンPDFはモデルに届く前にOCRを通過し、認識信頼度が低い場合はフラグが立てられます。すべてのアップロードはウイルススキャンされ、申告されたファイル種別と照合され、危険なファイル名がないか検査され、アーカイブが展開爆弾だと判明した場合は拒否されます。アップロードはプランのファイルサイズと保存容量の上限に計上され、ファイルは保存期間に従って削除されるか、いつでも自分で削除できます。
画像、文書、出典付き調査の生成
出力側では、ClawAIは説明文から画像を生成し、任意の回答や会話全体をPDF、DOCX、CSV、HTML、Markdown、TXT、JSONの整形済みファイルとしてエクスポートし、ウェブを検索してページを取得・読解し実際に使用した出典とともに回答する調査タスクを実行できます。画像生成、ファイル生成、調査はそれぞれ別に計測され(IMAGE、FILE_GENERATION、およびRESEARCH_MODE / WEB_SEARCH / WEB_FETCH / WEB_EXTRACTの割り当て)、通常のチャットのトークン使用とは異なります。定義済み出力形式の背後にある仕組みは下記リンクの「AIツール呼び出しの仕組み」と「構造化AI出力とは」を参照してください。
よくある質問
- どのファイル種別をアップロードできますか?
- PDF、DOCX、表計算、CSV、JSON、Markdown、プレーンテキスト、コードファイル、画像です。各モデルは最も確実に扱える形式を受け取り、メッセージには各モデルが実際に受け取った形式が表示されます。
- ClawAIはテキストレイヤーのないスキャン文書を読めますか?
- はい。スキャンPDFはモデルに届く前にOCRを通過し、認識信頼度が低い場合はフラグが立てられます。
- 文書をどの形式でエクスポートできますか?
- PDF、DOCX、CSV、HTML、Markdown、TXT、JSONです。文書エクスポートは通常のチャットや調査利用とは別の、独自の計測区分です。
言葉より、実際に試してください
入力側のアップロード、チャンク分割、OCR、アップロード検査。出力側の画像生成、文書エクスポート、出典付き調査。これらは実在し実装済みで別々に計測される機能であり、混然一体のファイルモードではありません。