Saltar para o conteúdo principal

Caso de uso

Implementação privada e local com a ClawAI

Como os modos de routing Local-Only e Privacy-First da ClawAI mantêm um pedido em hardware sob seu controle, usando os conectores Ollama e llama.cpp em vez de um provedor na nuvem.

Todos os casos de uso · Última revisão:

O que realmente muda ao executar localmente

Um provedor na nuvem, noutro ponto do catálogo da ClawAI, executa um modelo na sua própria infraestrutura e cobra por pedido; o Ollama e o llama.cpp, em vez disso, carregam um modelo de pesos abertos em hardware sob o seu controle, para que o pedido nunca saia dele. Isso muda quem consegue ver o pedido, não a capacidade de um determinado modelo.

Os modos de routing Local-Only e Privacy-First

O routing Local-Only mantém todos os pedidos em hardware sob o seu controle, usando Ollama ou llama.cpp em vez de qualquer provedor na nuvem. O Privacy-First é um modo separado com prioridades próprias; ambos existem porque nem toda carga de trabalho deve usar o routing Auto por padrão, e escolher entre eles é uma decisão deliberada, não algo a deixar por padrão sem examinar.

Quando uma carga de trabalho privada ou local é a escolha certa

Uma carga de trabalho privada ou local é definida por onde o pedido é executado, não pelo tipo de tarefa — programação, escrita ou pesquisa podem todas ser executadas desta forma se o requisito for que nada saia de hardware sob o seu controle. Veja como escolher um modelo para cargas de trabalho privadas e locais e o que é IA local-first, ambos ligados abaixo, para as trocas a ponderar.

Perguntas frequentes

Qual é a diferença entre o routing Local-Only e o Privacy-First?
O Local-Only mantém todos os pedidos em hardware sob o seu controle via Ollama ou llama.cpp; o Privacy-First é um modo de routing separado com prioridades próprias. Ambos existem porque nem toda carga de trabalho deve usar o routing Auto por padrão.
Qual modelo de pesos abertos devo executar localmente?
Esta página não recomenda nenhum — veja o que é IA local-first, ligado abaixo, para como pensar sobre essa escolha, já que o modelo certo depende do seu hardware e da sua tarefa.
Posso executar qualquer tipo de tarefa localmente, ou só algumas?
Uma carga de trabalho privada ou local é definida por onde o pedido é executado, não pela tarefa — programação, escrita ou pesquisa podem todas ser executadas desta forma se manter tudo em hardware sob o seu controle importar mais do que qual tarefa é.

Experimente em vez de confiar apenas na nossa palavra

Os modos de routing Local-Only e Privacy-First da ClawAI mantêm um pedido em hardware sob o seu controle via os conectores Ollama e llama.cpp — conectores reais e já disponíveis, não um item de roadmap.