Skip to content

حلبة النماذج (Model Arena)

أرسل موجّهًا واحدًا إلى عدة نماذج جنبًا إلى جنب، وقارن استجاباتها، واختر الأفضل لبناء لوحة صدارة بمعدل الفوز. محايدة تجاه المزوّدين — قارن OpenAI وAnthropic وOllama وvLLM وGemini في عرض واحد، مجانًا وباستضافة ذاتية.

ترسل حلبة النماذج (Model Arena) موجّهًا واحدًا إلى عدة نماذج جنبًا إلى جنب، وتتيح لك مقارنة الاستجابات واختيار الأفضل، وتبني لوحة صدارة بمعدل الفوز. وهي محايدة تجاه المزوّدين: يُبنى كل نموذج عبر مصنع نقاط النهاية في Potato، فيمكنك مقارنة OpenAI وAnthropic وOllama وvLLM وGemini وOpenRouter في العرض نفسه.

التفعيل

yaml
arena:
  enabled: true
  models:
    - {label: "GPT-4o",  endpoint_type: openai,    model: gpt-4o}
    - {label: "Claude",  endpoint_type: anthropic, model: claude-sonnet-4-6}
    - {label: "Llama",   endpoint_type: ollama,    model: llama3.2, base_url: http://localhost:11434}

يقابل كل مُدخل إعدادَ نقطة نهاية (endpoint_type وmodel وbase_url وtemperature، مع ai_config اختياريًا للمفاتيح/المعاملات). عند التفعيل، تعرض لوحة تحكم المشرف رابط Arena.

كيف تعمل

  1. أدخل موجّهًا فيذهب إلى كل النماذج بالتوازي. فشل نموذج واحد (مفتاح سيئ، تعطّل مزوّد) لا يحجب البقية أبدًا؛ إذ تعرض بطاقته الخطأ.
  2. تُعرض الاستجابات جنبًا إلى جنب، ومع كل منها زمن الاستجابة الخاص بذلك النموذج.
  3. انقر على Pick as best لتسجيل تفضيل وتحديث لوحة الصدارة (عدد مرات الفوز والمقارنات ومعدل الفوز لكل نموذج).

واجهة API

الطريقةالمسارالغرض
POST/admin/arena/api/run{prompt} → استجابات لكل نموذج
POST/admin/arena/api/preference{prompt, winner, ranking?} → تسجيل اختيار
GET/admin/arena/api/leaderboardمعدل الفوز لكل نموذج
bash
curl -X POST localhost:8000/admin/arena/api/run -H "X-API-Key: <key>" \
  -H "Content-Type: application/json" -d '{"prompt": "Explain RLHF in one sentence."}'

مواضيع ذات صلة