Passer au contenu principal

Fournisseur de modèles

Modèles d’IA locaux à poids ouverts dans ClawAI

Exécutez vous-même des modèles à poids ouverts avec Ollama ou llama.cpp via ClawAI, au lieu d’envoyer des requêtes à un fournisseur cloud. Le mécanisme et sa différence avec les fournisseurs cloud de cette page.

Tous les fournisseurs · Dernière vérification:

Modèles vers lesquels ClawAI peut router

  • GLM 5.3

    • Outils
  • GLM 5.3 Flash

    • Outils
  • GLM 5.2

    Contexte: 976,000

    • Outils
  • GLM 5.1

    Contexte: 198,000

    • Outils
  • Mistral Large 3:675b

    Contexte: 256,000

    • Outils
  • Nemotron 3 nano:30b

    Contexte: 1,000,000

    • Outils
  • Nemotron 3 Super

    Contexte: 256,000

    • Outils
  • Nemotron 3 Ultra

    Contexte: 256,000

    • Outils
  • Deepseek v4 flash:0731

    Contexte: 1,000,000

    • Outils
  • Deepseek v4 pro:0813

    Contexte: 1,000,000

    • Outils
  • Deepseek v4.1 Flash

    • Outils
  • gemma4:31b

    Contexte: 256,000

    • GPT oss:120b

      Contexte: 128,000

      • Outils
    • GPT oss:20b

      Contexte: 128,000

      • Outils
    • Kimi k2.6

      Contexte: 256,000

      • Outils
    • Kimi k2.7 Code

      Contexte: 256,000

      • Outils
    • Kimi k3

      Contexte: 1,000,000

      • Outils
    • Minimax m2.7

      Contexte: 200,000

      • Outils
    • Minimax m3

      Contexte: 512,000

      • Outils
    • qwen3.5:397b

      Contexte: 256,000

      • Outils

    Cette liste est lue en direct parmi les modèles vers lesquels ClawAI peut router actuellement ; elle évolue donc à mesure que des fournisseurs sont connectés ou que des modèles sont retirés. Vérifiez le catalogue en direct sur la page tarifs

    Ce que change réellement l’exécution locale

    Un fournisseur cloud de ce site exécute un modèle sur sa propre infrastructure et facture par requête. Ollama et llama.cpp chargent au contraire un modèle à poids ouverts sur du matériel que vous contrôlez — votre propre machine, ou un serveur que vous exploitez — de sorte que la requête ne le quitte jamais. Cela change qui peut voir la requête, pas ce dont le modèle est capable ; un modèle à poids ouverts exécuté localement est d’une autre nature que les fournisseurs cloud listés ailleurs dans cet ensemble, pas un remplacement direct de l’un d’eux.

    Ollama et llama.cpp sont deux outils différents

    Les deux sont des connecteurs ClawAI réels, mais ils conviennent à des situations différentes — Ollama privilégie la simplicité de récupération et d’exécution d’un modèle avec des réglages par défaut sensés, tandis que llama.cpp offre un contrôle plus direct sur la façon dont un modèle s’exécute, au prix d’une configuration plus manuelle. La comparaison complète se trouve sur Ollama contre llama.cpp, lié ci-dessous, plutôt que d’être répétée ici.

    Choisir quel modèle à poids ouverts exécuter

    Cette page ne nomme volontairement aucun modèle à poids ouverts précis, car le domaine évolue plus vite qu’une page statique ne peut le suivre, et une recommandation périmée est pire que l’absence de recommandation. Qu’est-ce que l’IA locale-first, lié ci-dessous, explique les modèles à poids ouverts et l’arbitrage face aux fournisseurs cloud plus en profondeur qu’une page produit ne le devrait.

    Questions fréquentes

    L’IA locale coûte-t-elle quelque chose via ClawAI ?
    ClawAI ne facture pas de tarif au jeton pour un modèle exécuté localement comme il le fait pour un fournisseur cloud, puisqu’aucun fournisseur cloud n’est facturé — le coût est le matériel que vous exploitez déjà. Vérifiez le comportement actuel du plan sur la page tarifs.
    Quel modèle à poids ouverts devrais-je exécuter ?
    Cette page n’en recommande aucun — voir qu’est-ce que l’IA locale-first, lié ci-dessous, pour savoir comment aborder ce choix, le bon modèle dépendant de votre matériel et de votre tâche d’une manière qu’une page statique ne peut pas suivre de façon responsable.
    Un modèle exécuté localement est-il aussi capable qu’un modèle cloud ?
    Cela dépend entièrement du modèle à poids ouverts précis et de votre matériel, et cette page ne fera aucune affirmation générale dans un sens ou dans l’autre. Voir comment évaluer les modèles d’IA, lié ci-dessous, pour vérifier sur votre propre charge de travail.

    Essayez-le plutôt que de nous croire sur parole

    Les connecteurs Ollama et llama.cpp de ClawAI sont des connecteurs réels et livrés — le mode de routage Local uniquement garde chaque requête sur du matériel que vous contrôlez.