Saltar para o conteúdo principal

Adequação do modelo

Como escolher um modelo para cargas de trabalho privadas e locais

O que muda quando um pedido permanece em hardware sob seu controle em vez de um provedor na nuvem, e como os modos de routing Local-Only e Privacy-First da ClawAI se adequam a cargas de trabalho privadas. Confirme o catálogo em tempo real antes de escolher um plano.

Todas as tarefas · Última revisão:

O que realmente muda ao executar um modelo localmente

Um provedor na nuvem, noutro ponto do catálogo da ClawAI, executa um modelo na sua própria infraestrutura e cobra por pedido; o Ollama e o llama.cpp, em vez disso, carregam um modelo de pesos abertos em hardware sob o seu controle, para que o pedido nunca saia dele. Isso muda quem consegue ver o pedido, não a capacidade de um determinado modelo — veja IA local, na página de provedores de modelos, para o mecanismo completo em vez de o repetir aqui.

Os modos de routing Local-Only e Privacy-First da ClawAI

O routing Local-Only mantém todos os pedidos em hardware sob o seu controle, usando Ollama ou llama.cpp em vez de qualquer provedor na nuvem. O Privacy-First é um modo separado com prioridades próprias; ambos existem especificamente porque nem toda carga de trabalho deve usar o routing Auto por padrão. Escolher entre eles, ou fixar um modelo local específico no modo Manual Model, é uma decisão de carga de trabalho que vale a pena tomar de forma deliberada em vez de deixar a um padrão de uso geral.

Como escolher qual modelo de pesos abertos executar

Esta página propositadamente não nomeia nenhum modelo de pesos abertos específico, pela mesma razão que a página de provedores de IA local também não o faz: o campo evolui mais depressa do que uma página estática consegue acompanhar, e uma recomendação desatualizada é pior do que nenhuma. Veja o que é IA local-first, ligado abaixo, para como pensar sobre a troca entre um modelo de pesos abertos executado por si e um provedor na nuvem.

Nenhum modelo específico é nomeado aqui de propósito — os modelos de pesos abertos e as suas capacidades mudam rapidamente, e é você quem escolhe quais executar. Confirme o comportamento do plano para cargas de trabalho locais na página de preços. Confirme o catálogo em tempo real na página de preços

Perguntas frequentes

Qual modelo de pesos abertos devo executar para uma carga de trabalho privada?
Esta página não recomenda nenhum — veja o que é IA local-first, ligado abaixo, para como pensar sobre essa escolha, já que o modelo certo depende do seu hardware e da sua tarefa de uma forma que uma página estática não consegue acompanhar com responsabilidade.
Qual é a diferença entre o routing Local-Only e o Privacy-First?
O Local-Only mantém todos os pedidos em hardware sob o seu controle via Ollama ou llama.cpp; o Privacy-First é um modo de routing separado com prioridades próprias. Ambos existem porque nem toda carga de trabalho deve usar o routing Auto por padrão.
Executar um modelo localmente custa algo através da ClawAI?
A ClawAI não cobra uma tarifa por token para um modelo executado localmente da forma como cobra para um provedor na nuvem, já que não há nenhum provedor na nuvem a ser faturado — o custo é o hardware que já usa. Confirme o comportamento atual do plano na página de preços.

Experimente em vez de confiar apenas na nossa palavra

O modo de routing Local-Only da ClawAI mantém todos os pedidos em hardware sob o seu controle via Ollama ou llama.cpp — um conector real e já disponível, não um item de roadmap.