ฟีเจอร์
แล็บการประสานงาน: เปรียบเทียบ ตัดสิน ฉันทามติ ยกระดับ
แล็บของ ClawAI ที่นำหลายโมเดลมาทำงานกับพรอมป์ตเดียว — Compare พร้อม Judge และ Critic, Consensus, Escalation, Best-of-N, Verify, Repair, Pipelines และอื่น ๆ
ฟีเจอร์ทั้งหมด · ตรวจสอบล่าสุด:
เปรียบเทียบ พร้อมผู้ตัดสินและผู้วิจารณ์
Compare ส่งพรอมป์ตเดียวไปยังหลายโมเดลและแสดงคำตอบเคียงข้างกัน พร้อมเวลาแฝงและจำนวนโทเค็น เปิด Judge แล้วโมเดลอิสระจะให้คะแนนแต่ละคำตอบตามเกณฑ์ที่ชัดเจน เปิด Critic แล้วจะได้บันทึกจุดอ่อนของแต่ละคำตอบ Compare ยังทำงานภายในเธรดปกติได้ คุณจึงตรวจสอบคำตอบเดียวได้โดยไม่ต้องออกจากบทสนทนา
ฉันทามติและการยกระดับ
Consensus ถามคำถามเดียวกันกับสองถึงห้าโมเดล แล้วสังเคราะห์คำตอบเดียวจากจุดที่เห็นตรงกัน พร้อมทำเครื่องหมายจุดที่เห็นต่าง Escalation เริ่มจากโมเดลราคาประหยัดและขยับขึ้นไปตามลำดับเฉพาะเมื่อคำตอบยังไม่ดีพอ คุณจึงจ่ายค่าโมเดลที่แข็งแกร่งก็ต่อเมื่อคำถามต้องการจริง ๆ
ตรวจสอบ ซ่อมแซม และเครื่องมืออื่น ๆ ในชุด
Best-of-N สร้างคำตอบผู้สมัครหลายตัวแล้วเก็บตัวที่ดีที่สุด Verify ให้โมเดลที่สองตรวจความถูกต้องของคำตอบ Repair แก้ข้อบกพร่องเฉพาะจุดในคำตอบที่มีอยู่แทนการสร้างใหม่ Decompose แบ่งงานใหญ่เป็นขั้นตอน Role packs ส่งต่อปัญหาระหว่างโมเดลที่เชี่ยวชาญแต่ละบทบาท Cost ensemble ชั่งคุณภาพกับค่าใช้จ่าย และ Pipelines เชื่อมหลายขั้นตอนเป็นเวิร์กโฟลว์เดียวที่ตั้งชื่อและรันซ้ำได้
แต่ละแล็บเปิดใช้ตามแผนโดยผู้ดูแลระบบ และการรันแล็บคิดการใช้งานแยกจากแชทปกติ — Compare, Judge และ Critic อยู่บนพื้นผิวของตัวเอง ส่วนแล็บอื่น ๆ อยู่บนพื้นผิวการประสานงาน
คำถามที่พบบ่อย
- Compare กับ Consensus ต่างกันอย่างไร?
- Compare แสดงคำตอบของทุกโมเดลเคียงข้างกันและให้คุณตัดสินเอง โดยเลือกเพิ่มคะแนนจาก Judge ได้ ส่วน Consensus รวมคำตอบเป็นหนึ่งเดียวและทำเครื่องหมายจุดที่โมเดลเห็นต่างกัน
- การยกระดับช่วยประหยัดเงินได้อย่างไร?
- เริ่มจากโมเดลที่ถูกกว่าและขยับไปใช้โมเดลที่แข็งแกร่งกว่าเฉพาะเมื่อคำตอบไม่ถึงเกณฑ์ คำถามง่าย ๆ จึงไม่ต้องจ่ายค่าโมเดลที่แพงที่สุดเลย
- แล็บมีในทุกแผนหรือไม่?
- แต่ละแล็บเปิดใช้ตามแผนโดยผู้ดูแลระบบ ความพร้อมใช้งานจึงขึ้นอยู่กับแผนของคุณ หน้าราคาแสดงรายการว่าแต่ละแผนมีอะไรบ้าง
ลองใช้เองแทนที่จะเชื่อคำพูดของเรา
Compare, Consensus, Escalation, Repair, Decompose, Best-of-N, Verify, Pipeline, Cost ensemble และ Role pack เปิดใช้งานแล้วทั้งหมด แต่ละตัวมีหน้า เอนด์พอยต์ และการ์ดผลลัพธ์ของตัวเอง