機能
ClawAIの実況付きリサーチとWebクロール
ClawAIがWebをどう調べるかを解説します。検索かクロールかを選ぶプランナー、リアルタイムで実況される作業ログ、robots.txtを守る段階的な取得、そして出典の明示まで、仕組みをそのままご紹介します。
すべての機能 · 最終確認日:
キーワードではなく、プランナーが判断する
Autoリサーチモードでは、計画用のモデルがメッセージを読み、4つの道筋から1つを選びます。既に知っていることから答える、Webを検索する、特定のサイトをクロールする、クロールしてから検索する、のいずれかです。貼り付けたリンクは必ず開かれます。計画用のモデルが使えない結果を返した場合は、調査が黙って止まるのではなく、次のモデルが試されます。
モードは入力欄で自分で選ぶこともできます。オフ、Auto、検索のみ、検索とページ取得、検索と構造化コンテンツの抽出から選べます。
見守ることのできる作業ログ
計画、すべての検索、取得またはスキップしたすべてのページといった各ステップは、起きたその場で回答の上にある実況ログへストリーミングされ、回答と一緒に保存されるため、ページを更新しても残っています。回答が根拠とした出典も一緒に一覧表示されるので、自分で開いて確認できます。
ルールを守る段階的な取得
ページは最も低コストな方法から取得されます。公式APIがあればまずそれを使い、次に通常のHTTPリクエスト、ページが必要とする場合に限ってヘッドレスブラウザーへと段階を上げ、さらに後段のフォールバックとしてリーダーサービスとアーカイブのスナップショットを使います。1回のクロールで1つのサイトの最大200ページを対象にできます。
robots.txtはClawAI-ResearchBotというユーザーエージェントで、すべての取得において守られ、許可されていないページを別の方法で再試行することはありません。ログインの壁や法的なブロックがあれば取得は止まり、CAPTCHAを解くことは決してなく、すべてのリダイレクトはプライベートネットワークのアドレスに対してチェックされ、アーカイブのコピーには必ずその旨が表示されます。
よくある質問
- ClawAIはrobots.txtを守りますか?
- はい。ClawAI-ResearchBotというユーザーエージェントで、すべての取得において守ります。robots.txtが許可していないページはスキップされ、別の取得方法で再試行されることもありません。
- リサーチが実際に何をしたのか確認できますか?
- はい。実況付きの作業ログに、計画、各検索、取得またはスキップした各ページが表示され、使用した出典の一覧とともに回答と一緒に保存されます。
- Webリサーチはすべてのプランで使えますか?
- リサーチモードはプランの機能(RESEARCH_MODE、WEB_SEARCH、WEB_FETCH、WEB_EXTRACT)で、それぞれ独自の割り当てがあり、運営者がプランごとに設定します。各プランに含まれる内容は料金ページでご確認いただけます。
言葉より、実際に試してください
リサーチループは専用のリサーチサービスで動作し、取得の段階は管理者が編集できます。通常のチャットのトークンとしてではなく、独自の計量区分で記録されます。