Lokal LLM benchmark dashboard

Ochiq kodli sun'iy intellekt modellarining o'zbekcha va inglizcha so'rovlardagi hamda chuqurlashtirilgan topshiriqlardagi samaradorlik taqqoslashi

Benchmark natijalari saqlangan
Jami so'rovlar (testlar)
280
7 ta model × 20 ta savol × 2 til
Sinovdan o'tgan modellar
7
Gemma 3, Gemma 4, Qwen & GPT-OSS
Eng yuqori sifat ko'rsatkichi
Q27B (7.52)
Inglizcha javob tarjimasi
Token tejamkorligi (prompt)
+45%
Ingliz tilida kamroq token

📋 Modellarning 20 ta savol bo'yicha ko'rsatkichlari jadvali

Model To'g'ridan-to'g'ri o'zbekcha ball Inglizcha javob tarjimasi balli G'oliblik (UZ / EN) O'rtacha vaqt (UZ / EN) Prompt tokenlar (UZ / EN) Tezlik (token/sek)

🎯 Ma'no sifati (1-10 shkala bo'yicha LLM Judge balli)

⚡ Generatsiya tezligi (token / sekund)

⏱️ Bajarilish vaqti (o'rtacha sekundlarda)

🔤 Kirish tokenlari sarfi (prompt tokenlar)