به محتوای اصلی بروید

مبانی

هماهنگ‌سازی مدل‌های زبانی چیست؟

هماهنگ‌سازی مدل زبانی لایه‌ای است که تصمیم می‌گیرد کدام مدل اجرا شود، به چه ترتیبی و با خروجی چه کنند. تفاوتش با نوشتن پرسش و با عامل‌ها.

همهٔ توضیح‌ها · آخرین بازبینی:

این مهندسی پرسش نیست

مهندسی پرسش یک فراخوانی را بهتر می‌کند. هماهنگ‌سازی تصمیم می‌گیرد چند فراخوانی باشد، کدام مدل‌ها انجامشان دهند و خروجی‌ها چگونه ترکیب شوند. می‌شود پرسش‌های عالی داشت و هیچ هماهنگ‌سازی نداشت؛ نتیجه سامانه‌ای است که با یک ساعت بد یک ارائه‌دهنده از کار می‌افتد.

این تمایز مهم است چون این دو را متفاوت بهینه می‌کنند. پرسش بهتر ارزان است و کیفیت را کمی بالا می‌برد. هماهنگ‌سازی بهتر توکن می‌برد و پایداری را به‌طور محسوس بالا می‌برد.

لایهٔ هماهنگ‌سازی چه چیزهایی را تصمیم می‌گیرد

کدام مدل. آیا از بیش از یکی بپرسیم. آیا پیش از بازگرداندن، پاسخ را وارسی کنیم. هنگام رد، اتمام مهلت یا محدودیت نرخ چه کنیم. آیا خروجی این گام ورودی گام بعد شود. و آیا کل این کار پیش از شروع از پس هزینه‌اش برمی‌آییم.

هرکدام یک سیاست است و هرکدام می‌تواند مستقل از دیگری اشتباه باشد. برای همین بهتر است هماهنگ‌سازی لایه‌ای مستقل نامیده شود تا اینکه تصمیم‌ها در سراسر کد پراکنده شوند.

روش‌های رایج

مسیریابی درخواست را به مدل مناسب می‌فرستد. پشتیبان، شکست را مدیریت می‌کند. هم‌رأیی از چند مدل می‌پرسد و توافق را می‌سنجد. «بهترین از N» نامزد می‌سازد و یکی را نگه می‌دارد. داور به پاسخ‌ها نمره می‌دهد. راستی‌آزمایی یک ادعا را با چیزی بیرون از مدل می‌سنجد. خط لوله‌ها گام‌ها را زنجیر می‌کنند. تجزیه، یک درخواست بزرگ را به درخواست‌های کوچک‌تر می‌شکند.

ClawAI نُه مورد از این‌ها را به‌صورت حالت‌های هماهنگ‌سازی جداگانه پیاده کرده، به‌علاوهٔ داور و مقایسه به‌عنوان سطح‌های مستقل. هرکدام اینجا صفحه‌ای دارند که پیش از تصمیم شما توضیح می‌دهد چه هستند.

کِی هماهنگ نکنیم

هماهنگ‌سازی هزینه و تأخیر را چند برابر می‌کند. هم‌رأیی روی سه مدل تقریباً سه برابر توکن می‌برد و به‌اندازهٔ کندترین طول می‌کشد. برای پرسشی که پاسخش را با یک نگاه وارسی می‌کنید، این معاملهٔ بدی است.

قاعده‌ای که دوام می‌آورد: وقتی هماهنگ کنید که اشتباه‌کردن گران باشد و وارسی‌کردن دشوار. وگرنه یک درخواست به یک مدل بفرستید و پاسخ را بخوانید.

پرسش‌های پرتکرار

هماهنگ‌سازی همان چارچوب عامل‌هاست؟
هم‌پوشانی دارند ولی یکی نیستند. عامل خودش گام بعدی‌اش را تصمیم می‌گیرد، معمولاً با ابزار. هماهنگ‌سازی سیاست پیرامونی است — کدام مدل، چند تا، هنگام شکست چه — و به همان اندازه برای جریانی بدون هیچ عاملی هم صدق می‌کند.
آیا هماهنگ‌سازی به چارچوب نیاز دارد؟
نه. تلاش دوباره با مدلی دیگر خودش هماهنگ‌سازی است. چارچوب‌ها وقتی کمک می‌کنند که سیاست‌ها آن‌قدر زیاد شوند که وگرنه در هر قابلیت از نو پیاده‌شان می‌کردید.
چقدر هزینه دارد؟
به توکن، تقریباً متناسب با تعداد فراخوانی‌هایی که سیاست انجام می‌دهد. یک فراخوانی مسیریابی‌شده تقریباً به‌اندازهٔ فراخوانی بدون مسیریابی هزینه دارد؛ هم‌رأیی روی سه مدل حدود سه برابر. هزینه پیش‌بینی‌پذیر است و همین آن را به تصمیمی بودجه‌ای بدل می‌کند نه یک قمار.

به‌جای خواندن، امتحانش کنید

ClawAI کنار گفت‌وگوی معمولی 9 حالت هماهنگ‌سازی اجرا می‌کند و ثبت می‌کند هر اجرا از چه مدل‌هایی استفاده کرده؛ پس هزینهٔ هر روش دیده می‌شود نه حدس زده.