Recurso
Roteamento de modelos e orquestração na ClawAI
Os sete modos de roteamento que decidem qual modelo responde a uma mensagem, e as nove primitivas de orquestração que colocam vários modelos no mesmo problema, como existem na ClawAI.
Todos os recursos · Última revisão:
Sete modos de roteamento, não um padrão oculto
A ClawAI classifica cada mensagem e pode enviá-la automaticamente a um modelo adequado, ou você pode definir a regra você mesmo. Os modos: Auto (classifica pela tarefa e escolhe um modelo forte para essa classe), Manual Model (fixa um modelo para a conversa), Local-Only (cada solicitação permanece em hardware que você controla, via Ollama ou llama.cpp), Privacy-First (um modo distinto com prioridades próprias para manter uma solicitação fora do caminho de nuvem genérico), Low Latency (prefere o modelo que responde mais rapidamente), High Reasoning (prefere o modelo de raciocínio mais forte, independentemente de velocidade ou custo) e Cost Saver (prefere o modelo mais barato ainda capaz de atender a solicitação). Veja «o que é roteamento de modelos IA», ligado abaixo, para o funcionamento geral de um roteador.
Nove formas de colocar mais de um modelo em um problema
Quando um modelo não basta, as primitivas de orquestração da ClawAI — registradas no razão sob a superfície ORCHESTRATION, distinta do chat comum — são Compare (até cinco modelos no mesmo prompt, lado a lado), Consensus (sintetizar uma resposta a partir de onde vários modelos concordam, sinalizando as discordâncias), Escalation (começar barato e subir automaticamente só quando a qualidade não é suficiente), Best-of-N (gerar vários candidatos e manter o mais forte), Repair (corrigir um defeito específico em uma resposta existente em vez de regenerá-la), Verify (um segundo modelo verifica a correção com um limite configurável de revisões), Role packs (uma pequena equipe de modelos especializados por papel que se revezam) Pipelines (encadear várias dessas etapas em um fluxo nomeado e reexecutável) e Judge e Critic (um modelo independente pontua uma resposta segundo critérios explícitos, com retorno escrito da passagem Critic sobre os pontos fracos). Compare e Judge estão cada um sujeitos individualmente ao plano (COMPARE_MODE, JUDGE_MODE, CRITIC_REVIEW); veja «o que é consenso de IA» e «o que é um juiz de IA», ambos ligados abaixo, para como a própria avaliação funciona.
O que acontece quando um provedor falha no meio da solicitação
Uma decisão de roteamento não é uma aposta única: se o provedor ou o modelo para o qual uma solicitação foi enviada falhar no meio do processamento, a ClawAI pode migrar automaticamente para outro modelo, e a resposta registra qual modelo realmente assumiu — não apenas o escolhido inicialmente. Veja «o que é fallback de modelo», ligado abaixo, para como essa decisão de fallback é tomada.
Perguntas frequentes
- Quantos modos de roteamento a ClawAI tem?
- Sete: Auto, Manual Model, Local-Only, Privacy-First, Low Latency, High Reasoning e Cost Saver. Auto é o padrão; os outros seis existem para quando você quer decidir o roteamento você mesmo, ou direcioná-lo de forma específica.
- Qual é a diferença entre Compare e Consensus?
- Compare mostra a resposta de cada modelo ao mesmo prompt lado a lado, com latência e contagem de tokens por modelo, deixando a leitura para você. Consensus sintetiza uma resposta a partir de onde os modelos concordam e sinaliza as discordâncias.
- Posso ver qual modelo realmente respondeu, e por quê?
- Sim — cada resposta traz o provedor e o modelo que a produziu, o raciocínio por trás da escolha de roteamento, e quanto custou do seu plano. Se um provedor falhou e outro modelo assumiu, isso também é registrado.
Experimente em vez de confiar na nossa palavra
Sete modos de roteamento e nove primitivas de orquestração são mecanismos reais e já disponíveis na ClawAI, não um único padrão oculto — Compare, Judge e Critic estão cada um sujeitos individualmente ao plano e medidos em sua própria superfície do razão.