Saltar para o conteúdo principal

Fornecedor de modelos

Modelos de IA locais de pesos abertos na ClawAI

Execute você mesmo modelos de pesos abertos com Ollama ou llama.cpp através da ClawAI, em vez de enviar requisições a um fornecedor na nuvem. O mecanismo e como ele difere dos fornecedores em nuvem desta página.

Todos os fornecedores · Última revisão:

Modelos para os quais a ClawAI pode encaminhar

  • GLM 5.3

    • Ferramentas
  • GLM 5.3 Flash

    • Ferramentas
  • GLM 5.2

    Contexto: 976,000

    • Ferramentas
  • GLM 5.1

    Contexto: 198,000

    • Ferramentas
  • Mistral Large 3:675b

    Contexto: 256,000

    • Ferramentas
  • Nemotron 3 nano:30b

    Contexto: 1,000,000

    • Ferramentas
  • Nemotron 3 Super

    Contexto: 256,000

    • Ferramentas
  • Nemotron 3 Ultra

    Contexto: 256,000

    • Ferramentas
  • Deepseek v4 flash:0731

    Contexto: 1,000,000

    • Ferramentas
  • Deepseek v4 pro:0813

    Contexto: 1,000,000

    • Ferramentas
  • Deepseek v4.1 Flash

    • Ferramentas
  • gemma4:31b

    Contexto: 256,000

    • GPT oss:120b

      Contexto: 128,000

      • Ferramentas
    • GPT oss:20b

      Contexto: 128,000

      • Ferramentas
    • Kimi k2.6

      Contexto: 256,000

      • Ferramentas
    • Kimi k2.7 Code

      Contexto: 256,000

      • Ferramentas
    • Kimi k3

      Contexto: 1,000,000

      • Ferramentas
    • Minimax m2.7

      Contexto: 200,000

      • Ferramentas
    • Minimax m3

      Contexto: 512,000

      • Ferramentas
    • qwen3.5:397b

      Contexto: 256,000

      • Ferramentas

    Esta lista é lida em tempo real a partir dos modelos para os quais o ClawAI pode encaminhar neste momento, pelo que muda à medida que fornecedores são ligados ou modelos são descontinuados. Confirme o catálogo em tempo real na página de preços

    O que realmente muda ao executar um modelo localmente

    Um fornecedor na nuvem, neste site, executa um modelo na sua própria infraestrutura e cobra por requisição. Já o Ollama e o llama.cpp carregam um modelo de pesos abertos em hardware que você controla — sua própria máquina, ou um servidor que você opera — de modo que a requisição nunca sai dele. Isso muda quem pode ver a requisição, não o que o modelo é capaz de fazer; um modelo de pesos abertos executado localmente é algo de natureza diferente de qualquer um dos fornecedores em nuvem listados em outras partes deste conjunto, não um substituto direto para um deles.

    Ollama e llama.cpp são duas ferramentas diferentes

    Ambos são conectores reais da ClawAI, mas servem a situações diferentes — o Ollama foca na facilidade de baixar e executar um modelo com configurações padrão sensatas, e o llama.cpp dá controle mais direto sobre como um modelo é executado, ao custo de uma configuração mais manual. A comparação completa está em Ollama vs llama.cpp, com link abaixo, em vez de ser repetida aqui.

    Escolhendo qual modelo de pesos abertos executar

    Esta página propositalmente não nomeia nenhum modelo de pesos abertos específico, porque o campo se move mais rápido do que uma página estática consegue acompanhar, e uma recomendação desatualizada é pior do que nenhuma. O que é IA local-first, com link abaixo, explica os modelos de pesos abertos e o trade-off em relação aos fornecedores em nuvem com mais profundidade do que uma página de produto deveria.

    Perguntas frequentes

    A IA local custa alguma coisa através da ClawAI?
    A ClawAI não cobra uma tarifa por token para um modelo executado localmente da forma que cobra de um fornecedor na nuvem, já que nenhum fornecedor na nuvem está sendo faturado — o custo é o hardware que você já opera. Confirme o comportamento atual do plano na página de preços.
    Qual modelo de pesos abertos devo executar?
    Esta página não recomenda nenhum — veja o que é IA local-first, com link abaixo, para saber como pensar sobre essa escolha, já que o modelo certo depende do seu hardware e da sua tarefa de um jeito que uma página estática não consegue acompanhar com responsabilidade.
    Um modelo executado localmente é tão capaz quanto um modelo na nuvem?
    Isso depende inteiramente do modelo de pesos abertos específico e do seu hardware, e esta página não fará uma afirmação genérica em nenhum sentido. Veja como avaliar modelos de IA, com link abaixo, para saber como verificar isso na sua própria carga de trabalho.

    Experimente em vez de confiar na nossa palavra

    Os conectores Ollama e llama.cpp da ClawAI são conectores reais e já lançados — o modo de roteamento Somente Local mantém cada requisição em hardware que você controla.