Fournisseur de modèles
Modèles d’IA locaux à poids ouverts dans ClawAI
Exécutez vous-même des modèles à poids ouverts avec Ollama ou llama.cpp via ClawAI, au lieu d’envoyer des requêtes à un fournisseur cloud. Le mécanisme et sa différence avec les fournisseurs cloud de cette page.
Tous les fournisseurs · Dernière vérification:
Modèles vers lesquels ClawAI peut router
GLM 5.3
GLM 5.3 Flash
GLM 5.2
GLM 5.1
Mistral Large 3:675b
Nemotron 3 nano:30b
Nemotron 3 Super
Nemotron 3 Ultra
Deepseek v4 flash:0731
Deepseek v4 pro:0813
Deepseek v4.1 Flash
gemma4:31b
GPT oss:120b
GPT oss:20b
Kimi k2.6
Kimi k2.7 Code
Kimi k3
Minimax m2.7
Minimax m3
qwen3.5:397b
Cette liste est lue en direct parmi les modèles vers lesquels ClawAI peut router actuellement ; elle évolue donc à mesure que des fournisseurs sont connectés ou que des modèles sont retirés. Vérifiez le catalogue en direct sur la page tarifs
Ce que change réellement l’exécution locale
Un fournisseur cloud de ce site exécute un modèle sur sa propre infrastructure et facture par requête. Ollama et llama.cpp chargent au contraire un modèle à poids ouverts sur du matériel que vous contrôlez — votre propre machine, ou un serveur que vous exploitez — de sorte que la requête ne le quitte jamais. Cela change qui peut voir la requête, pas ce dont le modèle est capable ; un modèle à poids ouverts exécuté localement est d’une autre nature que les fournisseurs cloud listés ailleurs dans cet ensemble, pas un remplacement direct de l’un d’eux.
Ollama et llama.cpp sont deux outils différents
Les deux sont des connecteurs ClawAI réels, mais ils conviennent à des situations différentes — Ollama privilégie la simplicité de récupération et d’exécution d’un modèle avec des réglages par défaut sensés, tandis que llama.cpp offre un contrôle plus direct sur la façon dont un modèle s’exécute, au prix d’une configuration plus manuelle. La comparaison complète se trouve sur Ollama contre llama.cpp, lié ci-dessous, plutôt que d’être répétée ici.
Choisir quel modèle à poids ouverts exécuter
Cette page ne nomme volontairement aucun modèle à poids ouverts précis, car le domaine évolue plus vite qu’une page statique ne peut le suivre, et une recommandation périmée est pire que l’absence de recommandation. Qu’est-ce que l’IA locale-first, lié ci-dessous, explique les modèles à poids ouverts et l’arbitrage face aux fournisseurs cloud plus en profondeur qu’une page produit ne le devrait.
Questions fréquentes
- L’IA locale coûte-t-elle quelque chose via ClawAI ?
- ClawAI ne facture pas de tarif au jeton pour un modèle exécuté localement comme il le fait pour un fournisseur cloud, puisqu’aucun fournisseur cloud n’est facturé — le coût est le matériel que vous exploitez déjà. Vérifiez le comportement actuel du plan sur la page tarifs.
- Quel modèle à poids ouverts devrais-je exécuter ?
- Cette page n’en recommande aucun — voir qu’est-ce que l’IA locale-first, lié ci-dessous, pour savoir comment aborder ce choix, le bon modèle dépendant de votre matériel et de votre tâche d’une manière qu’une page statique ne peut pas suivre de façon responsable.
- Un modèle exécuté localement est-il aussi capable qu’un modèle cloud ?
- Cela dépend entièrement du modèle à poids ouverts précis et de votre matériel, et cette page ne fera aucune affirmation générale dans un sens ou dans l’autre. Voir comment évaluer les modèles d’IA, lié ci-dessous, pour vérifier sur votre propre charge de travail.
Essayez-le plutôt que de nous croire sur parole
Les connecteurs Ollama et llama.cpp de ClawAI sont des connecteurs réels et livrés — le mode de routage Local uniquement garde chaque requête sur du matériel que vous contrôlez.