Funzionalità
Laboratori di orchestrazione: confronto, giudice, consenso, escalation
I laboratori di ClawAI che mettono più modelli sullo stesso prompt — Compare con Judge e Critic, Consensus, Escalation, Best-of-N, Verify, Repair, Pipeline e altri ancora.
Tutte le funzionalità · Ultima revisione:
Compare, con un giudice e un critico
Compare invia un prompt a più modelli e mostra le loro risposte affiancate, con latenza e conteggio dei token. Attiva Judge e un modello indipendente valuta ogni risposta secondo criteri espliciti; attiva Critic e scrive cosa c’è di debole in ciascuna. Compare funziona anche dentro una normale conversazione, così puoi verificare una singola risposta senza uscire dalla chat.
Consenso ed escalation
Consensus pone la stessa domanda a un numero di modelli da due a cinque e sintetizza un’unica risposta a partire dai punti in cui concordano, segnalando quelli in cui divergono. Escalation parte da un modello economico e sale di livello solo quando la risposta non è all’altezza, così paghi un modello potente quando la domanda ne ha davvero bisogno.
Verifica, riparazione e il resto del banco di lavoro
Best-of-N genera più candidati e tiene il migliore. Verify fa controllare a un secondo modello la correttezza di una risposta. Repair corregge un difetto specifico in una risposta esistente invece di rigenerarla. Decompose suddivide un compito ampio in passaggi. I Role pack passano un problema tra modelli specializzati per ruolo, Cost ensemble bilancia qualità e spesa, e Pipeline concatena più fasi in un unico flusso di lavoro con nome e rieseguibile.
Ogni laboratorio viene abilitato per piano dall’operatore, e le esecuzioni dei laboratori sono misurate separatamente dalla chat normale — Compare, Judge e Critic su superfici proprie, gli altri laboratori sulla superficie di orchestrazione.
Domande frequenti
- Qual è la differenza tra Compare e Consensus?
- Compare mostra affiancate le risposte di ogni modello e lascia a te il verdetto, eventualmente con un punteggio di Judge. Consensus fonde le risposte in una sola e segnala i punti su cui i modelli non sono d’accordo.
- In che modo l’escalation fa risparmiare?
- Parte da un modello più economico e passa a uno più potente solo quando la risposta non raggiunge il livello richiesto, così le domande facili non pagano mai il modello più costoso.
- I laboratori sono disponibili su ogni piano?
- Ogni laboratorio viene attivato per piano dall’operatore, quindi la disponibilità dipende dal tuo piano. La pagina dei prezzi elenca cosa include ciascun piano.
Provalo invece di fidarti della nostra parola
Compare, Consensus, Escalation, Repair, Decompose, Best-of-N, Verify, Pipeline, Cost ensemble e Role pack sono tutti rilasciati, ciascuno con la propria pagina, il proprio endpoint e la propria scheda dei risultati.