Caso d’uso
Distribuzione privata e locale con ClawAI
Come le modalità di routing Local-Only e Privacy-First di ClawAI mantengono una richiesta su hardware che controlli, usando i connettori Ollama e llama.cpp invece di un provider cloud.
Tutti gli scenari d’uso · Ultima revisione:
Cosa cambia davvero eseguendo un modello in locale
Un provider cloud altrove nel catalogo di ClawAI esegue un modello sulla propria infrastruttura e addebita un costo per richiesta; Ollama e llama.cpp caricano invece un modello a pesi aperti su hardware che controlli, così la richiesta non lo lascia mai. Questo cambia chi può vedere la richiesta, non le capacità di un dato modello.
Le modalità di routing Local-Only e Privacy-First
Il routing Local-Only mantiene ogni richiesta su hardware che controlli, usando Ollama o llama.cpp anziché un provider cloud. Il routing Privacy-First è una modalità separata con priorità proprie; entrambe esistono perché non ogni carico di lavoro dovrebbe usare per default il routing Auto, e scegliere tra le due è una decisione deliberata, non un’impostazione da lasciare senza esame.
Quando un carico privato o locale è la scelta giusta
Un carico di lavoro privato o locale si definisce in base a dove viene eseguita la richiesta, non al tipo di compito — programmazione, scrittura o ricerca possono tutti essere eseguiti in questo modo se il requisito è che nulla lasci l’hardware che controlli. Consulta come scegliere un modello per carichi privati e locali e cos’è l’AI local-first, entrambi linkati più sotto, per i compromessi da valutare.
Domande frequenti
- Qual è la differenza tra il routing Local-Only e Privacy-First?
- Local-Only mantiene ogni richiesta su hardware che controlli tramite Ollama o llama.cpp; Privacy-First è una modalità di routing separata con priorità proprie. Entrambe esistono perché non ogni carico di lavoro dovrebbe usare per default il routing Auto.
- Quale modello a pesi aperti dovrei eseguire in locale?
- Questa pagina non ne consiglia uno — consulta cos’è l’AI local-first, linkato più sotto, per capire come ragionare sulla scelta, dato che il modello giusto dipende dal tuo hardware e dal tuo compito.
- Posso eseguire qualsiasi tipo di compito in locale, o solo alcuni?
- Un carico di lavoro privato o locale si definisce in base a dove viene eseguita la richiesta, non al compito — programmazione, scrittura o ricerca possono tutti essere eseguiti in questo modo se restare su hardware che controlli conta più di quale sia il compito.
Provalo invece di fidarti della nostra parola
Le modalità di routing Local-Only e Privacy-First di ClawAI mantengono una richiesta su hardware che controlli tramite i connettori Ollama e llama.cpp — connettori reali, già disponibili, non una voce di roadmap.