Funzionalità
Instradamento dei modelli e orchestrazione in ClawAI
Le sette modalità di instradamento che decidono quale modello risponde a un messaggio, e le nove primitive di orchestrazione che mettono più modelli sullo stesso problema, così come sono in ClawAI.
Tutte le funzionalità · Ultima revisione:
Sette modalità di instradamento, non un predefinito nascosto
ClawAI classifica ogni messaggio e può inviarlo automaticamente a un modello adatto, oppure puoi decidere tu la regola. Le modalità: Auto (classifica per compito e sceglie un modello forte per quella classe), Manual Model (fissa un modello per la conversazione), Local-Only (ogni richiesta resta su hardware che controlli, via Ollama o llama.cpp), Privacy-First (una modalità distinta con priorità proprie per tenere una richiesta fuori dal percorso cloud generico), Low Latency (privilegia il modello che risponde più rapidamente), High Reasoning (privilegia il modello di ragionamento più forte indipendentemente da velocità o costo) e Cost Saver (privilegia il modello più economico ancora capace di gestire la richiesta). Vedi «cos’è l’instradamento dei modelli AI», collegato sotto, per il funzionamento generale di un router.
Nove modi per mettere più di un modello su un problema
Quando un modello non basta, le primitive di orchestrazione di ClawAI — registrate sul ledger sotto la superficie ORCHESTRATION, distinta dalla chat ordinaria — sono Compare (fino a cinque modelli sullo stesso prompt, affiancati), Consensus (sintetizzare una risposta da dove più modelli concordano, segnalando i disaccordi), Escalation (partire economico e salire automaticamente solo quando la qualità non basta), Best-of-N (generare più candidati e mantenere il più forte), Repair (correggere un difetto specifico in una risposta esistente invece di rigenerarla), Verify (un secondo modello verifica la correttezza con un limite configurabile di revisioni), Role pack (un piccolo team di modelli specializzati per ruolo che si passano il lavoro) Pipeline (concatenare più di queste fasi in un flusso nominato e rieseguibile) e Judge e Critic (un modello indipendente valuta una risposta secondo criteri espliciti, con un feedback scritto del passaggio Critic sui punti deboli). Compare e Judge sono ciascuno soggetto individualmente al piano (COMPARE_MODE, JUDGE_MODE, CRITIC_REVIEW); vedi «cos’è il consenso AI» e «cos’è un giudice AI», entrambi collegati sotto, per come funziona la valutazione stessa.
Cosa succede quando un provider fallisce a metà richiesta
Una decisione di instradamento non è una scommessa unica: se il provider o il modello a cui è stata inviata una richiesta fallisce a metà elaborazione, ClawAI può passare automaticamente a un altro modello, e la risposta registra quale modello è effettivamente intervenuto — non solo quello scelto inizialmente. Vedi «cos’è il fallback dei modelli», collegato sotto, per come viene presa quella decisione di fallback.
Domande frequenti
- Quante modalità di instradamento ha ClawAI?
- Sette: Auto, Manual Model, Local-Only, Privacy-First, Low Latency, High Reasoning e Cost Saver. Auto è quella predefinita; le altre sei esistono per quando vuoi decidere tu l’instradamento, o orientarlo in una direzione precisa.
- Qual è la differenza tra Compare e Consensus?
- Compare mostra la risposta di ogni modello allo stesso prompt affiancate, con latenza e conteggio dei token per modello, lasciando a te la lettura. Consensus sintetizza una risposta da dove i modelli concordano e segnala i disaccordi.
- Posso vedere quale modello ha risposto davvero, e perché?
- Sì — ogni risposta riporta il provider e il modello che l’ha prodotta, il ragionamento dietro la scelta di instradamento, e quanto è costata sul tuo piano. Se un provider è fallito e un altro modello è intervenuto, anche questo viene registrato.
Provalo invece di fidarti della nostra parola
Sette modalità di instradamento e nove primitive di orchestrazione sono meccanismi reali e distribuiti in ClawAI, non un unico predefinito nascosto — Compare, Judge e Critic sono ciascuno soggetto individualmente al piano e misurato sulla propria superficie del ledger.