Funktion
Modell-Routing und Orchestrierung in ClawAI
Die sieben Routing-Modi, die entscheiden, welches Modell eine Nachricht beantwortet, und die neun Orchestrierungs-Bausteine, die mehrere Modelle auf ein Problem ansetzen — beides wie in ClawAI ausgeliefert.
Alle Funktionen · Zuletzt geprüft:
Sieben Routing-Modi statt eines verborgenen Standards
ClawAI klassifiziert jede Nachricht und kann sie automatisch an ein passendes Modell senden, oder Sie legen die Regel selbst fest. Die Modi: Auto (klassifiziert nach Aufgabe und wählt ein starkes Modell für diese Klasse), Manual Model (fixiert ein Modell für das Gespräch), Local-Only (jede Anfrage bleibt auf Hardware, die Sie kontrollieren, über Ollama oder llama.cpp), Privacy-First (ein eigener Modus mit eigenen Prioritäten, um eine Anfrage aus dem allgemeinen Cloud-Pfad herauszuhalten), Low Latency (bevorzugt das Modell mit der schnellsten Antwortzeit), High Reasoning (bevorzugt das stärkste Denkmodell, unabhängig von Geschwindigkeit oder Kosten) und Cost Saver (bevorzugt das günstigste Modell, das die Anfrage noch bewältigt). Siehe „Was ist KI-Modell-Routing“, unten verlinkt, für die allgemeine Funktionsweise eines Routers.
Neun Wege, mehr als ein Modell auf ein Problem anzusetzen
Reicht ein Modell nicht, greifen ClawAIs Orchestrierungs-Bausteine — auf dem Ledger unter der Fläche ORCHESTRATION erfasst, getrennt vom normalen Chat: Compare (bis zu fünf Modelle auf eine Eingabe, nebeneinander), Consensus (eine Antwort aus der Übereinstimmung mehrerer Modelle synthetisieren und Abweichungen markieren), Escalation (günstig starten, automatisch aufsteigen, nur wenn die Qualität nicht reicht), Best-of-N (mehrere Kandidaten erzeugen, den stärksten behalten), Repair (einen bestimmten Fehler in einer bestehenden Antwort beheben statt neu zu erzeugen), Verify (ein zweites Modell prüft die Korrektheit mit begrenzter Revisionsrunde), Rollen-Pakete (ein kleines Team rollenspezialisierter Modelle übergibt sich gegenseitig) Pipelines (mehrere dieser Stufen zu einem benannten, wiederholbaren Ablauf verketten) und Judge und Critic (ein unabhängiges Modell bewertet eine Antwort anhand expliziter Kriterien, mit schriftlichem Critic-Feedback zu Schwachstellen). Compare und Judge sind je einzeln planabhängig (COMPARE_MODE, JUDGE_MODE, CRITIC_REVIEW); siehe „Was ist KI-Konsens“ und „Was ist ein KI-Richter“, beide unten verlinkt, für die Bewertung selbst.
Was passiert, wenn ein Anbieter während der Anfrage ausfällt
Eine Routing-Entscheidung ist keine einmalige Wette: Fällt der Anbieter oder das Modell, an das eine Anfrage ging, mitten in der Bearbeitung aus, kann ClawAI automatisch auf ein anderes Modell ausweichen, und die Antwort verzeichnet, welches Modell tatsächlich eingesprungen ist — nicht nur das ursprünglich gewählte. Siehe „Was ist Modell-Fallback“, unten verlinkt, für die Entscheidung dahinter.
Häufig gestellte Fragen
- Wie viele Routing-Modi hat ClawAI?
- Sieben: Auto, Manual Model, Local-Only, Privacy-First, Low Latency, High Reasoning und Cost Saver. Auto ist der Standard; die anderen sechs sind für den Fall gedacht, dass Sie die Routing-Entscheidung selbst treffen oder in eine bestimmte Richtung lenken wollen.
- Was unterscheidet Compare von Consensus?
- Compare zeigt die Antworten aller Modelle auf dieselbe Eingabe nebeneinander, mit Latenz und Token-Zahl pro Modell, und überlässt das Lesen Ihnen. Consensus fasst aus der Übereinstimmung der Modelle eine Antwort zusammen und markiert Abweichungen.
- Sehe ich, welches Modell tatsächlich geantwortet hat und warum?
- Ja — jede Antwort trägt den Anbieter und das Modell, das sie erzeugt hat, die Begründung der Routing-Entscheidung und die Kosten gegen Ihr Kontingent. Ist ein Anbieter ausgefallen und ein anderes Modell eingesprungen, wird das ebenfalls verzeichnet.
Probieren Sie es selbst aus, statt uns zu glauben
Sieben Routing-Modi und neun Orchestrierungs-Bausteine sind reale, ausgelieferte Mechanismen in ClawAI, kein einzelner verborgener Standard — Compare, Judge und Critic sind je einzeln planabhängig und auf einer eigenen Ledger-Fläche gemessen.