Local e privado
O que é IA local?
IA local roda um modelo em hardware que você controla. O que muda em privacidade e custo, o que exige de hardware e onde ela compete de verdade.
Todos os guias · Última revisão:
O que muda
Os dados são a razão de verdade. Um prompt enviado a um modelo hospedado é processado por aquele provedor sob os termos dele. Um prompt a um modelo local não é enviado a lugar nenhum, a única versão dessa garantia que não depende da política de terceiros.
Também elimina a cobrança por token, os limites de uso e a possibilidade de um modelo ser aposentado sob os seus pés. Um modelo baixado continua funcionando.
O formato do custo, não o custo
IA local não é automaticamente mais barata. Ela converte um custo variável em fixo: você compra ou aluga hardware, e daí a inferência é quase gratuita na margem.
É um bom negócio em volume alto e constante e um mau negócio para uso ocasional. Uma GPU parada a maior parte do dia custa mais do que as chamadas de API que substituiu.
Os limites honestos
Modelos que rodam confortavelmente numa única máquina geralmente não são os maiores disponíveis. Nas tarefas de raciocínio mais duras a distância para um modelo de fronteira hospedado é real.
Para muitíssimas tarefas do dia a dia — resumir, redigir, extrair, classificar, código de rotina — a distância é bem menor do que se supõe, e as propriedades de privacidade e custo costumam pesar mais do que o último incremento de capacidade.
Mais útil como híbrido
O padrão comum não é só local nem só nuvem. É local para o que é sensível ou de alto volume, hospedado para as perguntas mais difíceis, e uma política decidindo o que é o quê — exatamente para o que serve um roteador.
Perguntas frequentes
- De que hardware preciso?
- Depende inteiramente do tamanho do modelo e da quantização, e quem der um número único está chutando. A restrição dominante é a memória disponível: os pesos precisam caber, e o que cabe determina o que você consegue rodar.
- IA local é privada por definição?
- A chamada ao modelo é. O resto da aplicação pode não ser: busca, telemetria e outras integrações ainda podem sair. Privacidade é propriedade do sistema inteiro, não de um componente.
- Modelos locais podem usar meus documentos?
- Sim. A recuperação funciona igual, e quando tanto a recuperação quanto o modelo são locais os documentos não saem do seu hardware em momento algum.
Experimente em vez de ler sobre isso
O ClawAI roda modelos locais via Ollama e llama.cpp, e seu modo de roteamento somente local mantém toda a cadeia de fallback em provedores locais em vez de buscar um modelo em nuvem.