Saltar al contenido principal

Local y privado

¿Qué es la IA local?

La IA local ejecuta un modelo en hardware que controlas. Qué cambia en privacidad y coste, qué exige en hardware y dónde compite de verdad.

Todas las guías · Última revisión:

Qué cambia

Los datos son el motivo de verdad. Un prompt enviado a un modelo alojado lo procesa ese proveedor bajo sus términos. Un prompt a un modelo local no se manda a ninguna parte, que es la única versión de esa garantía que no depende de la política de un tercero.

También elimina la facturación por token, los límites de uso y la posibilidad de que retiren un modelo bajo tus pies. Un modelo que has descargado sigue funcionando.

La forma del coste, no el coste

La IA local no es automáticamente más barata. Convierte un coste variable en uno fijo: compras o alquilas hardware y a partir de ahí la inferencia es casi gratis al margen.

Es un buen trato con volumen alto y sostenido y un mal trato para uso ocasional. Una GPU parada la mayor parte del día sale más cara que las llamadas de API que sustituyó.

Los límites honestos

Los modelos que corren con holgura en una sola máquina no suelen ser los mayores disponibles. En las tareas de razonamiento más duras la distancia con un modelo de frontera alojado es real.

Para muchísimo trabajo cotidiano —resumir, redactar, extraer, clasificar, código rutinario— la distancia es mucho menor de lo que se supone, y las propiedades de privacidad y coste suelen importar más que el último incremento de capacidad.

Su mejor forma es híbrida

El patrón habitual no es solo local ni solo nube. Es local para lo sensible o de mucho volumen, alojado para las preguntas más duras, y una política que decide cuál es cuál, que es exactamente para lo que sirve un enrutador.

Preguntas frecuentes

¿Qué hardware necesito?
Depende por completo del tamaño del modelo y de la cuantización, y quien te dé una cifra única está adivinando. La restricción dominante es la memoria disponible: los pesos tienen que caber, y lo que cabe determina lo que puedes ejecutar.
¿La IA local es privada por definición?
La llamada al modelo sí. El resto de la aplicación puede no serlo: búsqueda, telemetría y otras integraciones siguen pudiendo salir fuera. La privacidad es una propiedad del sistema entero, no de un componente.
¿Los modelos locales pueden usar mis documentos?
Sí. La recuperación funciona igual, y cuando tanto la recuperación como el modelo son locales los documentos no salen de tu hardware en ningún momento.

Pruébalo en lugar de leer sobre ello

ClawAI ejecuta modelos locales mediante Ollama y llama.cpp, y su modo de enrutado solo local mantiene toda la cadena de respaldo en proveedores locales en vez de buscar un modelo en la nube.