メイン コンテンツにスキップ

機能

オーケストレーションラボ:比較・審査・コンセンサス・エスカレーション

複数のモデルを一つのプロンプトに当てるClawAIのラボを紹介します。JudgeとCritic付きのCompare、Consensus、Escalation、Best-of-N、Verify、Repair、Pipelinesなど、それぞれの仕組みを解説します。

すべての機能 · 最終確認日:

審査員と批評家を伴うCompare

Compareは一つのプロンプトを複数のモデルに送り、それぞれの回答をレイテンシーやトークン数とともに並べて表示します。Judgeをオンにすると独立したモデルが明示された基準で各回答を採点し、Criticをオンにすると各回答の弱点を書き出します。Compareは通常のスレッドの中でも動くので、会話を離れずに一つの回答を確かめられます。

ConsensusとEscalation

Consensusは2〜5つのモデルに同じ質問をし、意見が一致する部分から一つの回答をまとめ、一致しない部分を明示します。Escalationは安価なモデルから始め、回答が基準に届かないときだけ上位のモデルへ進むため、強力なモデルの料金を払うのは質問が本当にそれを必要とするときだけです。

Verify、Repair、そしてその他のラボ

Best-of-Nは複数の候補を生成し、最も優れたものを残します。Verifyは別のモデルに回答の正しさを確認させます。Repairは回答を作り直すのではなく、既存の回答の特定の欠陥を修正します。Decomposeは大きなタスクをステップに分割します。ロールパックは役割に特化したモデルの間で問題を受け渡し、Cost ensembleは品質と費用のバランスを取り、Pipelinesは複数の段階を名前付きで再実行できる一つのワークフローに連結します。

各ラボは運営者がプランごとに有効にし、ラボの実行は通常のチャットとは別に計量されます。Compare、Judge、Criticはそれぞれ独自の区分で、その他のラボはオーケストレーションの区分で記録されます。

よくある質問

CompareとConsensusの違いは何ですか?
Compareはすべてのモデルの回答を並べて表示し、判断はあなたに委ねます(必要に応じてJudgeのスコアも付けられます)。Consensusは回答を一つにまとめ、モデル間で意見が分かれた点を明示します。
Escalationはどのように費用を節約しますか?
安価なモデルから始め、回答が基準を満たさないときだけ強力なモデルに移るため、簡単な質問で最も高価なモデルの料金を払うことはありません。
ラボはすべてのプランで使えますか?
各ラボは運営者がプランごとに有効にするため、利用できるかどうかはプランによって異なります。各プランに含まれる内容は料金ページに掲載しています。

言葉より、実際に試してください

Compare、Consensus、Escalation、Repair、Decompose、Best-of-N、Verify、Pipeline、Cost ensemble、ロールパックは、それぞれ専用のページ、エンドポイント、結果カードを備えて出荷されています。