Modellerin Karşılaştırması: Zeka, Performans ve Fiyat Analizi
Yapay zeka modellerinin zeka, fiyat, çıktı hızı, gecikme ve bağlam penceresi gibi temel metriklerdeki karşılaştırması. Ayrıntılı metrikleri görmek için herhangi bir modele tıklayın.
Zeka
Claude Opus 5 (63.1), Claude Fable 5 (62.1) ve GPT-5.6 Sol (60.9) en zeki modeller.
Çıktı Hızı (token/sn)
Gemini 3.5 Flash-Lite (393), Gemini 3.6 Flash (231) ve Qwen3.7 Max (206) en hızlı modeller.
Gecikme (saniye)
Command A+ (0.40s), gpt-oss-120b (0.89s) ve Gemma 4 31B (1.16s) en düşük gecikmeye sahip.
Fiyat (1M token başına $)
Gemma 4 31B ($0.00), Command A+ ($0.00) ve DeepSeek V4 Flash 0731 (R… ($0.28) en uygun fiyatlı modeller.
Kapsam
Toplam 33 model karşılaştırılıyor; 12 tanesi açık ağırlıklı, 26 tanesi akıl yürütme modeli.
Yapay Zeka Zeka Endeksi
Akıl yürütme, kodlama, matematik ve bilgi değerlendirmelerinin birleşik skoru — yüksek olan daha iyi
Skorlar Artificial Analysis metodolojisine dayanır.
Ajan Endeksi
Uzun soluklu ajan görevlerindeki başarı — yüksek olan daha iyi
GDPval-AA v2
Ekonomik görevler
T3-Banking
Ajan / araç kullanımı
Terminal-Bench 2.1
Ajan / kodlama
SciCode
Kodlama
Humanity's Last Exam
Akıl yürütme
GPQA Diamond
Bilimsel akıl yürütme
CritPt
Fizik
AA-LCR
Uzun bağlam
AA-Omniscience Doğruluk
Bilgi
AA-Omniscience Halüsinasyonsuzluk
Bilgi
AA-Briefcase
Bilgi işi
AutomationBench-AA
Otomasyon
MMMU-Pro
Çok modlu
Harvey LAB-AA
Hukuk
T2-Bench Telecom
Ajan / araç kullanımı
Terminal-Bench Hard
Ajan / kodlama
IFBench
Talimat takibi
IT-Bench SRE
Ajan / operasyon
APEX-Agents-AA
Ajan / finans
Çıktı Hızı
Saniyede üretilen token — yüksek olan daha iyi
İlk Token Süresi
İstek gönderildikten sonra ilk tokenın gelmesine kadar geçen saniye — düşük olan daha iyi
| # | Model | Geliştirici | Zeka | Hız | Gecikme | Girdi $/1M | Çıktı $/1M | Bağlam |
|---|---|---|---|---|---|---|---|---|
| 1 | Claude Opus 5 (Adaptive Reasoning, Max Effort) akıl yürütme | Anthropic | 63.1 | 57 | 32.48s | $5.00 | $25.00 | — |
| 2 | Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) akıl yürütme | Anthropic | 62.1 | 67 | 92.59s | $10.00 | $50.00 | — |
| 3 | GPT-5.6 Sol (max) akıl yürütme | OpenAI | 60.9 | 65 | 122.00s | $5.00 | $30.00 | — |
| 4 | Kimi K3 (max) akıl yürütme açık | Kimi | 59.7 | 43 | 2.70s | $3.00 | $15.00 | — |
| 5 | Qwen3.8 Max akıl yürütme | Alibaba | 58.1 | 83 | 2.82s | $2.00 | $6.00 | — |
| 6 | Claude Opus 4.8 (Adaptive Reasoning, Max Effort) akıl yürütme | Anthropic | 57.3 | 60 | 17.92s | $5.00 | $25.00 | — |
| 7 | Muse Spark 1.2 (xhigh) akıl yürütme | Meta | 56.8 | — | — | $1.25 | $4.25 | — |
| 8 | GPT-5.6 Terra (max) akıl yürütme | OpenAI | 56.6 | 134 | 166.47s | $2.00 | $12.00 | — |
| 9 | Grok 4.5 (high) akıl yürütme | SpaceXAI | 55.8 | 59 | 7.64s | $2.00 | $6.00 | — |
| 10 | Claude Sonnet 5 (Adaptive Reasoning, Max Effort) akıl yürütme | Anthropic | 55.3 | 73 | 164.50s | $2.00 | $10.00 | — |
| 11 | GLM-5.2 (max) akıl yürütme açık | Z AI | 52.6 | 121 | 1.43s | $1.35 | $4.29 | — |
| 12 | GPT-5.6 Luna (max) akıl yürütme | OpenAI | 52.3 | 192 | 105.89s | $0.20 | $1.20 | — |
| 13 | DeepSeek V4 Flash 0731 (Reasoning, Max Effort) akıl yürütme açık | DeepSeek | 51.8 | 122 | 1.21s | $0.14 | $0.28 | — |
| 14 | Gemini 3.6 Flash (high) akıl yürütme | 51.6 | 231 | 20.23s | $1.50 | $7.50 | — | |
| 15 | Ling 3.0 Tiny Intelligence, Performans ve Fiyat Analizi açık | InclusionAI (Ant Group) | 50.0 | — | — | $0.00 | $1.00 | 10000000 |
| 16 | Qwen.qwen3 VL 32B Thinking GGUF | Image-to-Text | 50.0 | — | — | — | — | — |
| 17 | GPT 5 Codex | Openai | 50.0 | — | — | $0.06 | $5.00 | — |
| 18 | Claude 3 Opus | Anthropic | 50.0 | — | — | — | — | — |
| 19 | Grok 4 Fast | xAi Grok | 50.0 | — | — | — | — | — |
| 20 | GPT 4.1 Mini | OpenAi | 50.0 | — | — | — | — | — |
| 21 | Gemini 2.0 Flash Lite | 50.0 | — | — | $0.49 | $2.10 | 1048000 | |
| 22 | Qwen3.7 Max akıl yürütme | Alibaba | 46.7 | 206 | 2.27s | $2.50 | $7.50 | — |
| 23 | MiniMax-M3 akıl yürütme açık | MiniMax | 45.4 | 120 | 1.48s | $0.30 | $1.20 | — |
| 24 | MiMo-V2.5-Pro akıl yürütme açık | Xiaomi | 42.9 | 77 | 2.83s | $0.44 | $0.87 | — |
| 25 | Inkling (xhigh) akıl yürütme açık | Thinking Machines | 42.3 | 74 | 1.80s | $1.00 | $4.05 | — |
| 26 | Nemotron 3 Ultra 550B A55B (Reasoning) akıl yürütme açık | NVIDIA | 38.3 | 158 | 2.03s | $0.60 | $2.75 | — |
| 27 | Gemini 3.5 Flash-Lite akıl yürütme | 37.4 | 393 | 8.82s | $0.30 | $2.50 | — | |
| 28 | Mistral Medium 3.5 akıl yürütme açık | Mistral | 30.4 | 136 | 2.24s | $1.50 | $7.50 | — |
| 29 | Claude 4.5 Haiku (Reasoning) akıl yürütme | Anthropic | 29.9 | 92 | 15.43s | $1.00 | $5.00 | — |
| 30 | Gemma 4 31B (Reasoning) akıl yürütme açık | 29.7 | 35 | 1.16s | $0.00 | $0.00 | — | |
| 31 | gpt-oss-120b (high) akıl yürütme açık | OpenAI | 24.1 | 172 | 0.89s | $0.15 | $0.59 | — |
| 32 | Command A+ akıl yürütme açık | Cohere | 22.8 | 193 | 0.40s | $0.00 | $0.00 | — |
| 33 | GPT-5.5 Pro (xhigh) akıl yürütme | OpenAI | — | — | — | — | — | — |