حلبة النماذج (Model Arena)
أرسل موجّهًا واحدًا إلى عدة نماذج جنبًا إلى جنب، وقارن استجاباتها، واختر الأفضل لبناء لوحة صدارة بمعدل الفوز. محايدة تجاه المزوّدين — قارن OpenAI وAnthropic وOllama وvLLM وGemini في عرض واحد، مجانًا وباستضافة ذاتية.
ترسل حلبة النماذج (Model Arena) موجّهًا واحدًا إلى عدة نماذج جنبًا إلى جنب، وتتيح لك مقارنة الاستجابات واختيار الأفضل، وتبني لوحة صدارة بمعدل الفوز. وهي محايدة تجاه المزوّدين: يُبنى كل نموذج عبر مصنع نقاط النهاية في Potato، فيمكنك مقارنة OpenAI وAnthropic وOllama وvLLM وGemini وOpenRouter في العرض نفسه.
التفعيل
yaml
arena:
enabled: true
models:
- {label: "GPT-4o", endpoint_type: openai, model: gpt-4o}
- {label: "Claude", endpoint_type: anthropic, model: claude-sonnet-4-6}
- {label: "Llama", endpoint_type: ollama, model: llama3.2, base_url: http://localhost:11434}يقابل كل مُدخل إعدادَ نقطة نهاية (endpoint_type وmodel وbase_url وtemperature، مع ai_config اختياريًا للمفاتيح/المعاملات). عند التفعيل، تعرض لوحة تحكم المشرف رابط Arena.
كيف تعمل
- أدخل موجّهًا فيذهب إلى كل النماذج بالتوازي. فشل نموذج واحد (مفتاح سيئ، تعطّل مزوّد) لا يحجب البقية أبدًا؛ إذ تعرض بطاقته الخطأ.
- تُعرض الاستجابات جنبًا إلى جنب، ومع كل منها زمن الاستجابة الخاص بذلك النموذج.
- انقر على Pick as best لتسجيل تفضيل وتحديث لوحة الصدارة (عدد مرات الفوز والمقارنات ومعدل الفوز لكل نموذج).
واجهة API
| الطريقة | المسار | الغرض |
|---|---|---|
| POST | /admin/arena/api/run | {prompt} → استجابات لكل نموذج |
| POST | /admin/arena/api/preference | {prompt, winner, ranking?} → تسجيل اختيار |
| GET | /admin/arena/api/leaderboard | معدل الفوز لكل نموذج |
bash
curl -X POST localhost:8000/admin/arena/api/run -H "X-API-Key: <key>" \
-H "Content-Type: application/json" -d '{"prompt": "Explain RLHF in one sentence."}'مواضيع ذات صلة
- المرجع الكامل على Read the Docs — الإعداد الكامل وواجهة API، مطابق للإصدار
- مجموعات البيانات والتجارب — للمقارنة دون اتصال وعلى نطاق مجموعات البيانات
- المقارنة الثنائية — تعليق تفضيلات A/B في مسار العمل الرئيسي