Funktion
Orchestrierungs-Labs: Vergleich, Richter, Konsens, Eskalation
Die ClawAI-Labs, die mehrere Modelle auf einen Prompt ansetzen — Compare mit Judge und Critic, Consensus, Escalation, Best-of-N, Verify, Repair, Pipelines und mehr.
Alle Funktionen · Zuletzt geprüft:
Compare, mit Richter und Kritiker
Compare schickt einen Prompt an mehrere Modelle und zeigt ihre Antworten nebeneinander, mit Latenz und Token-Zahlen. Schalten Sie Judge ein, bewertet ein unabhängiges Modell jede Antwort anhand expliziter Kriterien; schalten Sie Critic ein, hält es fest, was an jeder Antwort schwach ist. Compare läuft auch in einem normalen Thread, sodass Sie eine einzelne Antwort prüfen können, ohne das Gespräch zu verlassen.
Konsens und Eskalation
Consensus stellt zwei bis fünf Modellen dieselbe Frage, fasst aus ihren Übereinstimmungen eine Antwort zusammen und markiert, wo sie abweichen. Escalation beginnt mit einem günstigen Modell und steigt nur dann in der Kette auf, wenn die Antwort nicht ausreicht — so zahlen Sie für ein starkes Modell nur, wenn die Frage es wirklich braucht.
Verify, Repair und der Rest der Werkbank
Best-of-N erzeugt mehrere Kandidaten und behält den stärksten. Bei Verify prüft ein zweites Modell eine Antwort auf Korrektheit. Repair behebt einen bestimmten Fehler in einer bestehenden Antwort, statt sie neu zu erzeugen. Decompose zerlegt eine große Aufgabe in Schritte. Rollen-Pakete reichen ein Problem zwischen rollenspezialisierten Modellen weiter, Cost Ensemble wägt Qualität gegen Kosten ab, und Pipelines verketten mehrere Stufen zu einem benannten, wiederholbaren Ablauf.
Jedes Lab wird vom Betreiber pro Plan freigeschaltet, und Lab-Läufe werden getrennt vom normalen Chat abgerechnet — Compare, Judge und Critic auf eigenen Flächen, die übrigen Labs auf der Orchestrierungsfläche.
Häufig gestellte Fragen
- Was ist der Unterschied zwischen Compare und Consensus?
- Compare zeigt die Antwort jedes Modells nebeneinander und überlässt Ihnen das Urteil, optional mit einer Judge-Bewertung. Consensus führt die Antworten zu einer zusammen und markiert die Punkte, an denen die Modelle uneins sind.
- Wie spart Eskalation Geld?
- Sie beginnt mit einem günstigeren Modell und wechselt nur dann zu einem stärkeren, wenn die Antwort die Messlatte nicht erreicht — einfache Fragen zahlen so nie für das teuerste Modell.
- Sind die Labs in jedem Plan enthalten?
- Jedes Lab wird vom Betreiber pro Plan eingeschaltet, die Verfügbarkeit hängt also von Ihrem Plan ab. Die Preisseite listet auf, was jeder Plan enthält.
Probieren Sie es selbst aus, statt uns zu glauben
Compare, Consensus, Escalation, Repair, Decompose, Best-of-N, Verify, Pipeline, Cost Ensemble und Rollen-Pakete sind jeweils mit eigener Seite, eigenem Endpunkt und eigener Ergebniskarte ausgeliefert.