Zum Hauptinhalt springen

Modellauswahl

Das richtige Modell für private, lokale Workloads wählen

Was sich ändert, wenn eine Anfrage auf selbst kontrollierter Hardware bleibt statt bei einem Cloud-Anbieter, und wie die Routing-Modi Local-Only und Privacy-First von ClawAI zu privaten Workloads passen. Vor der Planwahl den aktuellen Katalog prüfen.

Alle Aufgaben · Zuletzt geprüft:

Was das lokale Ausführen eines Modells tatsächlich ändert

Ein Cloud-Anbieter an anderer Stelle im Katalog von ClawAI führt ein Modell auf seiner eigenen Infrastruktur aus und berechnet pro Anfrage; Ollama und llama.cpp laden stattdessen ein offenes Modell auf Hardware, die Sie selbst kontrollieren, sodass die Anfrage diese nie verlässt. Das ändert, wer die Anfrage sehen kann, nicht, wozu ein gegebenes Modell fähig ist — den vollständigen Mechanismus finden Sie unter „Lokale KI“ auf der Seite mit den Modellanbietern, statt ihn hier zu wiederholen.

Die Routing-Modi Local-Only und Privacy-First von ClawAI

Local-Only-Routing hält jede Anfrage auf selbst kontrollierter Hardware, über Ollama oder llama.cpp statt über einen Cloud-Anbieter. Privacy-First-Routing ist ein eigener Modus mit eigenen Prioritäten; beide existieren gerade deshalb, weil nicht jeder Workload standardmäßig auf Auto-Routing gehören sollte. Zwischen beiden zu wählen, oder im Manual-Model-Modus ein bestimmtes lokales Modell festzulegen, ist eine Workload-Entscheidung, die es wert ist, bewusst getroffen zu werden, statt sie einer Allzweck-Voreinstellung zu überlassen.

Welches offene Modell Sie ausführen sollten

Diese Seite nennt bewusst kein bestimmtes offenes Modell, aus demselben Grund, aus dem die Anbieterseite für lokale KI es auch nicht tut: Das Feld bewegt sich schneller, als eine statische Seite es nachverfolgen kann, und eine veraltete Empfehlung ist schlimmer als keine. Im verlinkten Beitrag „Was ist Local-First-KI“ erfahren Sie, wie Sie den Kompromiss zwischen einem selbst betriebenen offenen Modell und einem Cloud-Anbieter abwägen.

Hier wird absichtlich kein bestimmtes Modell genannt — offene Modelle und ihre Fähigkeiten ändern sich schnell, und Sie entscheiden selbst, welche Sie ausführen. Das Planverhalten für lokale Workloads können Sie auf der Preisseite prüfen. Aktuellen Katalog auf der Preisseite prüfen

Häufig gestellte Fragen

Welches offene Modell sollte ich für einen privaten Workload ausführen?
Diese Seite empfiehlt keins — im verlinkten Beitrag „Was ist Local-First-KI“ erfahren Sie, wie Sie diese Wahl angehen, da das richtige Modell von Ihrer Hardware und Aufgabe abhängt, in einer Weise, die eine statische Seite nicht verantwortungsvoll nachverfolgen kann.
Was ist der Unterschied zwischen Local-Only- und Privacy-First-Routing?
Local-Only hält jede Anfrage über Ollama oder llama.cpp auf selbst kontrollierter Hardware; Privacy-First ist ein eigener Routing-Modus mit eigenen Prioritäten. Beide existieren, weil nicht jeder Workload standardmäßig auf Auto-Routing gehören sollte.
Kostet das lokale Ausführen eines Modells über ClawAI etwas?
ClawAI berechnet für ein lokal ausgeführtes Modell keinen Preis pro Token, wie es das bei einem Cloud-Anbieter tut, da hier kein Cloud-Anbieter abgerechnet wird — die Kosten sind die Hardware, die Sie ohnehin bereits betreiben. Das aktuelle Planverhalten können Sie auf der Preisseite prüfen.

Selbst ausprobieren statt uns nur zu glauben

Der Local-Only-Routing-Modus von ClawAI hält jede Anfrage über Ollama oder llama.cpp auf selbst kontrollierter Hardware — eine reale, bereits ausgelieferte Anbindung, kein Vorhaben auf der Roadmap.