Возможность
Маршрутизация моделей и оркестрация в ClawAI
Семь режимов маршрутизации, решающих, какая модель отвечает на сообщение, и девять примитивов оркестрации, ставящих несколько моделей на одну задачу, — так, как это реализовано в ClawAI.
Все возможности · Последняя проверка:
Семь режимов маршрутизации, а не одна скрытая настройка
ClawAI классифицирует каждое сообщение и может автоматически отправить его в подходящую модель, или вы можете сами задать правило. Режимы: Auto (классифицирует по задаче и выбирает сильную модель для этого класса), Manual Model (закрепляет одну модель за разговором), Local-Only (каждый запрос остаётся на оборудовании, которое вы контролируете, через Ollama или llama.cpp), Privacy-First (отдельный режим со своими приоритетами, чтобы держать запрос вне общего облачного пути), Low Latency (предпочитает модель, которая отвечает быстрее всего), High Reasoning (предпочитает модель с самым сильным рассуждением независимо от скорости или стоимости) и Cost Saver (предпочитает самую дешёвую модель, всё ещё способную обработать запрос). См. «что такое маршрутизация моделей ИИ», ссылка ниже, об общем принципе работы маршрутизатора.
Девять способов задействовать несколько моделей на одной задаче
Когда одной модели недостаточно, примитивы оркестрации ClawAI — фиксируемые в журнале под поверхностью ORCHESTRATION, отдельно от обычного чата, — это Compare (до пяти моделей на один запрос, рядом друг с другом), Consensus (синтезировать ответ там, где несколько моделей сходятся, и отметить расхождения), Escalation (начать с дешёвой модели и автоматически повышать уровень только когда качество недостаточно), Best-of-N (сгенерировать несколько вариантов и оставить самый сильный), Repair (исправить конкретный дефект в существующем ответе вместо его полной регенерации), Verify (вторая модель проверяет корректность с настраиваемым лимитом ревизий), Role packs (небольшая команда специализированных по роли моделей, передающих задачу друг другу) Pipelines (объединить несколько таких этапов в один именованный, повторно запускаемый рабочий процесс) и Judge и Critic (независимая модель оценивает ответ по явным критериям, с письменной обратной связью Critic о слабых местах). Compare и Judge каждый индивидуально зависят от плана (COMPARE_MODE, JUDGE_MODE, CRITIC_REVIEW); см. «что такое консенсус ИИ» и «что такое ИИ-судья», обе ссылки ниже, о том, как работает сама оценка.
Что происходит, если провайдер отказывает в середине запроса
Решение о маршрутизации — не одноразовая ставка: если провайдер или модель, куда был отправлен запрос, отказывает в середине обработки, ClawAI может автоматически переключиться на другую модель, и ответ фиксирует, какая модель реально подключилась — а не только изначально выбранная. См. «что такое резервное переключение моделей», ссылка ниже, о том, как принимается это решение.
Частые вопросы
- Сколько режимов маршрутизации в ClawAI?
- Семь: Auto, Manual Model, Local-Only, Privacy-First, Low Latency, High Reasoning и Cost Saver. Auto — режим по умолчанию; остальные шесть существуют для случаев, когда вы хотите сами решать маршрутизацию или направить её в конкретную сторону.
- В чём разница между Compare и Consensus?
- Compare показывает ответы всех моделей на один запрос рядом друг с другом, с задержкой и числом токенов по каждой модели, оставляя чтение вам. Consensus синтезирует ответ там, где модели сходятся, и отмечает расхождения.
- Могу ли я видеть, какая модель реально ответила и почему?
- Да — каждый ответ содержит провайдера и модель, которая его создала, обоснование выбора маршрутизации и стоимость из вашей квоты. Если провайдер отказал и подключилась другая модель, это тоже фиксируется.
Попробуйте сами, а не верьте нам на слово
Семь режимов маршрутизации и девять примитивов оркестрации — реальные, уже реализованные механизмы в ClawAI, а не единая скрытая настройка — Compare, Judge и Critic каждый индивидуально зависят от плана и измеряются на собственной поверхности журнала.