Proveedor de modelos
Modelos de IA locales de peso abierto en ClawAI
Ejecuta tú mismo modelos de peso abierto con Ollama o llama.cpp a través de ClawAI, en lugar de enviar solicitudes a un proveedor en la nube. Qué es el mecanismo y en qué se diferencia de los proveedores en la nube de esta página.
Todos los proveedores · Última revisión:
Modelos a los que ClawAI puede enrutar
GLM 5.3
GLM 5.3 Flash
GLM 5.2
GLM 5.1
Mistral Large 3:675b
Nemotron 3 nano:30b
Nemotron 3 Super
Nemotron 3 Ultra
Deepseek v4 flash:0731
Deepseek v4 pro:0813
Deepseek v4.1 Flash
gemma4:31b
GPT oss:120b
GPT oss:20b
Kimi k2.6
Kimi k2.7 Code
Kimi k3
Minimax m2.7
Minimax m3
qwen3.5:397b
Esta lista se lee en directo de los modelos a los que ClawAI puede enrutar en este momento, por lo que cambia a medida que se conectan proveedores o se retiran modelos. Confirma el catálogo en vivo en la página de precios
Qué cambia realmente al ejecutar un modelo localmente
Un proveedor en la nube de este sitio ejecuta un modelo en su propia infraestructura y cobra por solicitud. Ollama y llama.cpp, en cambio, cargan un modelo de peso abierto en hardware que tú controlas — tu propia máquina, o un servidor que operas tú — de modo que la solicitud nunca sale de ahí. Eso cambia quién puede ver la solicitud, no de lo que el modelo es capaz; un modelo de peso abierto ejecutado localmente es algo distinto de cualquiera de los proveedores en la nube listados en el resto de este conjunto, no un sustituto directo de uno de ellos.
Ollama y llama.cpp son dos herramientas distintas
Ambos son conectores reales de ClawAI, pero encajan en situaciones distintas: Ollama se centra en la facilidad de descargar y ejecutar un modelo con valores por defecto sensatos, mientras que llama.cpp ofrece un control más directo sobre cómo se ejecuta un modelo, a costa de una configuración más manual. La comparación completa está en Ollama frente a llama.cpp, enlazado más abajo, en lugar de repetirse aquí.
Elegir qué modelo de peso abierto ejecutar
Esta página no nombra deliberadamente ningún modelo de peso abierto concreto, porque el campo avanza más rápido de lo que una página estática puede seguir, y una recomendación desactualizada es peor que ninguna. Qué es la IA local-first, enlazado más abajo, explica los modelos de peso abierto y el equilibrio frente a los proveedores en la nube con más profundidad de la que debería tener una página de producto.
Preguntas frecuentes
- ¿Cuesta algo la IA local a través de ClawAI?
- ClawAI no cobra una tarifa por token para un modelo ejecutado localmente como sí hace con un proveedor en la nube, ya que no hay ningún proveedor en la nube al que facturar — el coste es el hardware que ya tienes en marcha. Confirma el comportamiento actual del plan en la página de precios.
- ¿Qué modelo de peso abierto debería ejecutar?
- Esta página no recomienda ninguno en concreto — consulta qué es la IA local-first, enlazado más abajo, para saber cómo abordar esa elección, ya que el modelo adecuado depende de tu hardware y tu tarea de una forma que una página estática no puede seguir de manera responsable.
- ¿Es un modelo ejecutado localmente tan capaz como uno en la nube?
- Eso depende por completo del modelo de peso abierto concreto y de tu hardware, y esta página no hará una afirmación general en un sentido ni en otro. Mira cómo evaluar modelos de IA, enlazado más abajo, para comprobarlo con tu propia carga de trabajo.
Pruébalo en vez de creer solo en nuestra palabra
Los conectores de Ollama y llama.cpp de ClawAI son conectores reales y ya disponibles — el modo de enrutamiento Solo local mantiene cada solicitud en hardware que tú controlas.