# Arabench

> Arabic LLM benchmarking across 8 quality categories

- Skill: `moshe-ship/arabench-3` (Agent Skill)
- Install (CLI): `npx skillmds@latest add moshe-ship/arabench-3`
- Raw SKILL.md: https://api.skillmd.com/api/skills/moshe-ship/arabench-3/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: AI & ML
- License: MIT
- Author: moshe-ship (https://skillmd.com/u/moshe-ship)
- Updated: 2026-09-22
- Page: https://skillmd.com/skills/moshe-ship/arabench-3

---

# arabench — معيار جودة العربية للنماذج

أداة لتقييم جودة الذكاء الاصطناعي بالعربي عبر 8 فئات.

## الأوامر

### تشغيل المعيار الكامل
```bash
arabench run
```

### اختبار سريع لمزوّد واحد
```bash
arabench quick PROVIDER_NAME
```

### مقارنة مزوّدين
```bash
arabench compare PROVIDER_A PROVIDER_B
```

### عرض لوحة النتائج
```bash
arabench leaderboard
```

### شرح فئة تقييم
```bash
arabench explain CATEGORY
```
الفئات: translation, grammar, dialect, diacritization, summarization, qa, generation, culture

## متى تستخدم
- المستخدم يسأل "أي نموذج أفضل بالعربي؟"
- يريد مقارنة بين Claude و GPT أو غيرهم
- يريد يعرف نقاط ضعف نموذج معين بالعربي

