KI-Modell-Ranking (LLM-Leaderboard)

Neueste KI-Modelle

Language models ranked by Artificial Analysis Index

Modell
Name des KI-Modells und Anbieterorganisation
Intelligenz
Artificial Analysis Intelligence Index - composite reasoning and capability score across the benchmark suite
Value Score
Qualität, Geschwindigkeit und gemischter Token-Preis als relativer Wert-Score
Speed
Inference-Durchsatz in Tokens pro Sekunde - wie schnell das Modell Antworten generiert
Google KI-Anbieter-Logo - Gemini 3.6 Flash (high)
#1 Gemini 3.6 Flash (high)
von Google · 21. Juli 2026
50.133301 tok/s
Google KI-Anbieter-Logo - Gemini 3.5 Flash-Lite
#2 Gemini 3.5 Flash-Lite
von Google · 21. Juli 2026
36.545373 tok/s
Kimi KI-Anbieter-Logo - K3
#3 K3
von Kimi · 16. Juli 2026
57.11638 tok/s
Thinking Machines KI-Anbieter-Logo - Inkling (xhigh)
#4 Inkling (xhigh)
von Thinking Machines · 15. Juli 2026
40.71761 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Sol (medium)
#5 GPT-5.6 Sol (medium)
von OpenAI · 9. Juli 2026
53.61162 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Luna (medium)
#6 GPT-5.6 Luna (medium)
von OpenAI · 9. Juli 2026
38.129181 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Luna (max)
#7 GPT-5.6 Luna (max)
von OpenAI · 9. Juli 2026
51.238203 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Luna (Non-reasoning)
#8 GPT-5.6 Luna (Non-reasoning)
von OpenAI · 9. Juli 2026
26.620179 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Sol (max)
#9 GPT-5.6 Sol (max)
von OpenAI · 9. Juli 2026
58.91270 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Terra (medium)
#10 GPT-5.6 Terra (medium)
von OpenAI · 9. Juli 2026
45.619110 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Terra (max)
#11 GPT-5.6 Terra (max)
von OpenAI · 9. Juli 2026
55.026157 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Luna (high)
#12 GPT-5.6 Luna (high)
von OpenAI · 9. Juli 2026
46.135199 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Sol (low)
#13 GPT-5.6 Sol (low)
von OpenAI · 9. Juli 2026
49.41058 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Terra (xhigh)
#14 GPT-5.6 Terra (xhigh)
von OpenAI · 9. Juli 2026
51.625131 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Luna (low)
#15 GPT-5.6 Luna (low)
von OpenAI · 9. Juli 2026
33.325185 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Sol (high)
#16 GPT-5.6 Sol (high)
von OpenAI · 9. Juli 2026
55.91161 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Terra (Non-reasoning)
#17 GPT-5.6 Terra (Non-reasoning)
von OpenAI · 9. Juli 2026
34.015115 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Luna (xhigh)
#18 GPT-5.6 Luna (xhigh)
von OpenAI · 9. Juli 2026
49.137191 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Sol (Non-reasoning)
#19 GPT-5.6 Sol (Non-reasoning)
von OpenAI · 9. Juli 2026
41.2859 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Terra (high)
#20 GPT-5.6 Terra (high)
von OpenAI · 9. Juli 2026
49.023129 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Sol (xhigh)
#21 GPT-5.6 Sol (xhigh)
von OpenAI · 9. Juli 2026
57.71265 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Terra (low)
#22 GPT-5.6 Terra (low)
von OpenAI · 9. Juli 2026
40.519123 tok/s
Meta KI-Anbieter-Logo - Muse Spark 1.1 (xhigh)
#23 Muse Spark 1.1 (xhigh)
von Meta · 9. Juli 2026
50.640124 tok/s
China Mobile KI-Anbieter-Logo - JT-4.1 Flash 236B A21B
#24 JT-4.1 Flash 236B A21B
von China Mobile · 9. Juli 2026
38.8k. A.k. A.
SpaceXAI KI-Anbieter-Logo - Grok 4.5 (high)
#25 Grok 4.5 (high)
von SpaceXAI · 8. Juli 2026
53.82174 tok/s
Tencent KI-Anbieter-Logo - Hy3
#26 Hy3
von Tencent · 6. Juli 2026
41.2k. A.61 tok/s
Anthropic KI-Anbieter-Logo - Claude Sonnet 5 (Adaptive Reasoning, Max Effort)
#27 Claude Sonnet 5 (Adaptive Reasoning, Max Effort)
von Anthropic · 30. Juni 2026
53.42188 tok/s
Anthropic KI-Anbieter-Logo - Claude Sonnet 5 (Adaptive Reasoning, Low Effort)
#28 Claude Sonnet 5 (Adaptive Reasoning, Low Effort)
von Anthropic · 30. Juni 2026
k. A.67 tok/s
Anthropic KI-Anbieter-Logo - Claude Sonnet 5 (Adaptive Reasoning, Medium Effort)
#29 Claude Sonnet 5 (Adaptive Reasoning, Medium Effort)
von Anthropic · 30. Juni 2026
k. A.72 tok/s
Anthropic KI-Anbieter-Logo - Claude Sonnet 5 (Non-reasoning, High Effort)
#30 Claude Sonnet 5 (Non-reasoning, High Effort)
von Anthropic · 30. Juni 2026
41.71463 tok/s
Anthropic KI-Anbieter-Logo - Claude Sonnet 5 (Adaptive Reasoning, High Effort)
#31 Claude Sonnet 5 (Adaptive Reasoning, High Effort)
von Anthropic · 30. Juni 2026
k. A.70 tok/s
Anthropic KI-Anbieter-Logo - Claude Sonnet 5 (Adaptive Reasoning, Xhigh Effort)
#32 Claude Sonnet 5 (Adaptive Reasoning, Xhigh Effort)
von Anthropic · 30. Juni 2026
k. A.81 tok/s
LongCat KI-Anbieter-Logo - 2.0
#33 2.0
von LongCat · 29. Juni 2026
33.5k. A.k. A.
OpenAI KI-Anbieter-Logo - GPT-5.5 Instant (June 2026)
#34 GPT-5.5 Instant (June 2026)
von OpenAI · 25. Juni 2026
28.96k. A.
Z AI KI-Anbieter-Logo - GLM-5.2 (max)
#35 GLM-5.2 (max)
von Z AI · 16. Juni 2026
51.139197 tok/s
Z AI KI-Anbieter-Logo - GLM-5.2 (Non-reasoning)
#36 GLM-5.2 (Non-reasoning)
von Z AI · 16. Juni 2026
34.123111 tok/s
SpaceXAI KI-Anbieter-Logo - Grok Build 0.1 0616
#37 Grok Build 0.1 0616
von SpaceXAI · 16. Juni 2026
39.82454 tok/s
Kimi KI-Anbieter-Logo - K2.7 Code
#38 K2.7 Code
von Kimi · 12. Juni 2026
41.92248 tok/s
Google KI-Anbieter-Logo - DiffusionGemma 26B A4B
#39 DiffusionGemma 26B A4B
von Google · 10. Juni 2026
13.5k. A.k. A.
Anthropic KI-Anbieter-Logo - Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)
#40 Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)
von Anthropic · 9. Juni 2026
59.9970 tok/s
Cohere KI-Anbieter-Logo - North Mini Code
#41 North Mini Code
von Cohere · 9. Juni 2026
19.8k. A.96 tok/s
NVIDIA KI-Anbieter-Logo - Nemotron 3 Ultra 550B A55B (Reasoning)
#42 Nemotron 3 Ultra 550B A55B (Reasoning)
von NVIDIA · 4. Juni 2026
37.839211 tok/s
Google KI-Anbieter-Logo - Gemma 4 12B (Reasoning)
#43 Gemma 4 12B (Reasoning)
von Google · 3. Juni 2026
22.064128 tok/s
Google KI-Anbieter-Logo - Gemma 4 12B (Non-reasoning)
#44 Gemma 4 12B (Non-reasoning)
von Google · 3. Juni 2026
13.235113 tok/s
Nex AGI KI-Anbieter-Logo - Nex-N2-Pro
#45 Nex-N2-Pro
von Nex AGI · 2. Juni 2026
41.046134 tok/s
MiniMax KI-Anbieter-Logo - M3
#46 M3
von MiniMax · 1. Juni 2026
44.45497 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.7 Plus
#47 Qwen3.7 Plus
von Alibaba · 1. Juni 2026
39.03252 tok/s
StepFun KI-Anbieter-Logo - Step 3.7 Flash
#48 Step 3.7 Flash
von StepFun · 29. Mai 2026
30.352401 tok/s
Anthropic KI-Anbieter-Logo - Claude Opus 4.8 (Adaptive Reasoning, Max Effort)
#49 Claude Opus 4.8 (Adaptive Reasoning, Max Effort)
von Anthropic · 28. Mai 2026
55.71264 tok/s
Liquid AI KI-Anbieter-Logo - LFM2.5-8B-A1B
#50 LFM2.5-8B-A1B
von Liquid AI · 28. Mai 2026
8.3k. A.344 tok/s
Multiverse Computing KI-Anbieter-Logo - HyperNova 60B 2605
#51 HyperNova 60B 2605
von Multiverse Computing · 26. Mai 2026
17.879406 tok/s
OpenBMB KI-Anbieter-Logo - MiniCPM5-1B (Non-reasoning)
#52 MiniCPM5-1B (Non-reasoning)
von OpenBMB · 25. Mai 2026
11.7k. A.k. A.
OpenBMB KI-Anbieter-Logo - MiniCPM5-1B (Reasoning)
#53 MiniCPM5-1B (Reasoning)
von OpenBMB · 25. Mai 2026
12.0k. A.k. A.
Cohere KI-Anbieter-Logo - Command A+
#54 Command A+
von Cohere · 20. Mai 2026
22.5k. A.177 tok/s
Google KI-Anbieter-Logo - Gemini 3.5 Flash (medium)
#55 Gemini 3.5 Flash (medium)
von Google · 19. Mai 2026
45.428293 tok/s
Google KI-Anbieter-Logo - Gemini 3.5 Flash (minimal)
#56 Gemini 3.5 Flash (minimal)
von Google · 19. Mai 2026
34.921241 tok/s
Google KI-Anbieter-Logo - Gemini 3.5 Flash (high)
#57 Gemini 3.5 Flash (high)
von Google · 19. Mai 2026
50.231283 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.7 Max
#58 Qwen3.7 Max
von Alibaba · 19. Mai 2026
46.027207 tok/s
China Mobile KI-Anbieter-Logo - JT-35B-Flash
#59 JT-35B-Flash
von China Mobile · 14. Mai 2026
28.4k. A.k. A.
OpenBMB KI-Anbieter-Logo - MiniCPM-V 4.6 1.3B
#60 MiniCPM-V 4.6 1.3B
von OpenBMB · 11. Mai 2026
4.2k. A.k. A.
InclusionAI KI-Anbieter-Logo - Ring-2.6-1T
#61 Ring-2.6-1T
von InclusionAI · 8. Mai 2026
30.637129 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.5 Instant (May 2026)
#62 GPT-5.5 Instant (May 2026)
von OpenAI · 5. Mai 2026
33.57k. A.
SpaceXAI KI-Anbieter-Logo - Grok 4.3 (Non-reasoning)
#63 Grok 4.3 (Non-reasoning)
von SpaceXAI · 30. Apr. 2026
24.81796 tok/s
SpaceXAI KI-Anbieter-Logo - Grok 4.3 (medium)
#64 Grok 4.3 (medium)
von SpaceXAI · 30. Apr. 2026
36.032122 tok/s
SpaceXAI KI-Anbieter-Logo - Grok 4.3 (low)
#65 Grok 4.3 (low)
von SpaceXAI · 30. Apr. 2026
35.427105 tok/s
SpaceXAI KI-Anbieter-Logo - Grok 4.3 (high)
#66 Grok 4.3 (high)
von SpaceXAI · 30. Apr. 2026
37.634123 tok/s
Mistral KI-Anbieter-Logo - Medium 3.5
#67 Medium 3.5
von Mistral · 29. Apr. 2026
29.919135 tok/s
NVIDIA KI-Anbieter-Logo - Nemotron 3 Nano Omni 30B A3B Reasoning
#68 Nemotron 3 Nano Omni 30B A3B Reasoning
von NVIDIA · 29. Apr. 2026
14.946318 tok/s
IBM KI-Anbieter-Logo - Granite 4.1 30B
#69 Granite 4.1 30B
von IBM · 29. Apr. 2026
8.9k. A.k. A.
IBM KI-Anbieter-Logo - Granite 4.1 3B
#70 Granite 4.1 3B
von IBM · 29. Apr. 2026
4.7k. A.k. A.
IBM KI-Anbieter-Logo - Granite 4.1 8B
#71 Granite 4.1 8B
von IBM · 29. Apr. 2026
6.730129 tok/s
DeepSeek KI-Anbieter-Logo - V4 Flash (Reasoning, High Effort)
#72 V4 Flash (Reasoning, High Effort)
von DeepSeek · 24. Apr. 2026
37.561k. A.
DeepSeek KI-Anbieter-Logo - V4 Pro (Reasoning, Max Effort)
#73 V4 Pro (Reasoning, Max Effort)
von DeepSeek · 24. Apr. 2026
44.34174 tok/s
DeepSeek KI-Anbieter-Logo - V4 Flash (Reasoning, Max Effort)
#74 V4 Flash (Reasoning, Max Effort)
von DeepSeek · 24. Apr. 2026
40.3100115 tok/s
DeepSeek KI-Anbieter-Logo - V4 Flash (Non-reasoning)
#75 V4 Flash (Non-reasoning)
von DeepSeek · 24. Apr. 2026
28.770113 tok/s
DeepSeek KI-Anbieter-Logo - V4 Pro (Reasoning, High Effort)
#76 V4 Pro (Reasoning, High Effort)
von DeepSeek · 24. Apr. 2026
43.14068 tok/s
DeepSeek KI-Anbieter-Logo - V4 Pro (Non-reasoning)
#77 V4 Pro (Non-reasoning)
von DeepSeek · 24. Apr. 2026
31.22967 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.5 Pro (xhigh)
#78 GPT-5.5 Pro (xhigh)
von OpenAI · 23. Apr. 2026
k. A.k. A.
Tencent KI-Anbieter-Logo - Hy3-preview (Non-reasoning)
#79 Hy3-preview (Non-reasoning)
von Tencent · 23. Apr. 2026
26.166158 tok/s
Tencent KI-Anbieter-Logo - Hy3-preview (Reasoning)
#80 Hy3-preview (Reasoning)
von Tencent · 23. Apr. 2026
33.685150 tok/s
InclusionAI KI-Anbieter-Logo - Ling-2.6-1T
#81 Ling-2.6-1T
von InclusionAI · 23. Apr. 2026
26.119k. A.
OpenAI KI-Anbieter-Logo - GPT-5.5 (xhigh)
#82 GPT-5.5 (xhigh)
von OpenAI · 23. Apr. 2026
54.81492 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.5 (medium)
#83 GPT-5.5 (medium)
von OpenAI · 23. Apr. 2026
50.41076 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.5 (Non-reasoning)
#84 GPT-5.5 (Non-reasoning)
von OpenAI · 23. Apr. 2026
35.4777 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.5 (high)
#85 GPT-5.5 (high)
von OpenAI · 23. Apr. 2026
53.11284 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.5 (low)
#86 GPT-5.5 (low)
von OpenAI · 23. Apr. 2026
43.5981 tok/s
Xiaomi KI-Anbieter-Logo - MiMo-V2.5-Pro (Non-reasoning)
#87 MiMo-V2.5-Pro (Non-reasoning)
von Xiaomi · 22. Apr. 2026
27.92060 tok/s
Xiaomi KI-Anbieter-Logo - MiMo-V2.5-Pro
#88 MiMo-V2.5-Pro
von Xiaomi · 22. Apr. 2026
42.23958 tok/s
Xiaomi KI-Anbieter-Logo - MiMo-V2.5
#89 MiMo-V2.5
von Xiaomi · 22. Apr. 2026
37.26063 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.6 27B (Reasoning)
#90 Qwen3.6 27B (Reasoning)
von Alibaba · 22. Apr. 2026
37.12260 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.6 27B (Non-reasoning)
#91 Qwen3.6 27B (Non-reasoning)
von Alibaba · 22. Apr. 2026
30.51860 tok/s
InclusionAI KI-Anbieter-Logo - Ling 2.6 Flash
#92 Ling 2.6 Flash
von InclusionAI · 21. Apr. 2026
14.141152 tok/s
Kimi KI-Anbieter-Logo - K2.6 (Non-reasoning)
#93 K2.6 (Non-reasoning)
von Kimi · 20. Apr. 2026
34.61841 tok/s
Kimi KI-Anbieter-Logo - K2.6
#94 K2.6
von Kimi · 20. Apr. 2026
44.22356 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.6 Max Preview
#95 Qwen3.6 Max Preview
von Alibaba · 20. Apr. 2026
40.01646 tok/s
Anthropic KI-Anbieter-Logo - Claude Opus 4.7 (Non-reasoning, High Effort)
#96 Claude Opus 4.7 (Non-reasoning, High Effort)
von Anthropic · 16. Apr. 2026
42.7950 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.6 35B A3B (Non-reasoning)
#97 Qwen3.6 35B A3B (Non-reasoning)
von Alibaba · 16. Apr. 2026
24.230173 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.6 35B A3B (Reasoning)
#98 Qwen3.6 35B A3B (Reasoning)
von Alibaba · 16. Apr. 2026
31.648152 tok/s
Anthropic KI-Anbieter-Logo - Claude Opus 4.7 (Adaptive Reasoning, Max Effort)
#99 Claude Opus 4.7 (Adaptive Reasoning, Max Effort)
von Anthropic · 16. Apr. 2026
53.51161 tok/s
China Mobile KI-Anbieter-Logo - JT-MINI
#100 JT-MINI
von China Mobile · 15. Apr. 2026
18.5k. A.k. A.

Zeige 100 von 578 Modelle

Das KI-Modell-Leaderboard verstehen

Dieses umfassende KI-Modell-Leaderboard hilft Ihnen, zu vergleichen und auszuwählen die besten Large Language Models (LLMs) für Ihre Anforderungen. Wir erfassen standardisierte KI-Benchmarks, Token-Preise, Inference-Geschwindigkeit und Modellfähigkeiten bei allen großen KI-Anbietern wie OpenAI, Anthropic, Google, Meta, und DeepSeek.

Kern-KI-Benchmarks erklärt

MMLU-ProTestet breites Wissen über 14 akademische Fachbereiche
GPQADenken & Problemlösung auf Promotionsniveau
AIME 2025Mathematisches Denken auf Spitzenniveau
Coding IndexLiveCodeBench + SciCode kombiniert
Math IndexAIME + MATH-500 kombiniert

Wichtige Kennzahlen

Token-PreisgestaltungInput- vs. Output-Kosten pro 1 Mio. Tokens
Inference-GeschwindigkeitTokens/Sekunde für Antwortzeit
VeröffentlichungsdatumNeueste Techniken & Wissensstand
Benchmark-ScoresFähigkeitsvergleich von 0-100 %

So wählen Sie das richtige KI-Modell für Ihren Use Case

Für Forschung & Analyse

Priorisieren Sie Modelle mit hohen MMLU-Pro- (70 %+) und GPQA-Werten (60 %+), wenn es um komplexe Denkaufgaben, wissenschaftliche Recherche und technische Dokumentation geht

Für Kostenoptimierung

Sortieren Sie nach Input-/Output-Preisen - kleinere Modelle liefern bei einfachen Aufgaben oft 80 % der Flaggschiff-Leistung zu 10 % der Kosten

Für Mathe & MINT

Filtern Sie nach Math-Index oder AIME-2025-Scores (50 %+) für quantitative Analysen, Engineering-Berechnungen und wissenschaftliche Anwendungen

Alle Benchmark-Scores und Preisdaten werden täglich von Artificial Analysis aktualisiert, um die neuesten Modellversionen und Fähigkeiten abzubilden. Nutzen Sie die Sortierfilter oben, um KI-Modelle nach Intelligenz, Kosten, Coding-Fähigkeit, Mathe-Leistung, Geschwindigkeit oder Veröffentlichungsdatum zu finden.

Häufig gestellte Fragen

Was ist MMLU-Pro und warum gilt es als Standard-Benchmark für KI-Intelligenz?

MMLU-Pro (Massive Multitask Language Understanding - Professional) ist der umfassendste KI-Benchmark und testet Modelle in 14 akademischen Fachbereichen, darunter Mathematik, Naturwissenschaften, Geschichte, Recht und Ethik. Die Werte reichen von 46 % (Grundkompetenz) bis 87 % (nahe Expertenniveau). Modelle über 75 % zeigen starke allgemeine Intelligenz für professionelle Anwendungen, während Werte unter 60 % auf Einschränkungen bei komplexen Denkaufgaben hindeuten.

Was misst GPQA und welche Modelle erzielen die höchsten Werte?

GPQA (Graduate-level Google-Proof Q&A) prüft Denken auf Promotionsniveau mit Fragen, die bewusst "Google-proof" sind - sie erfordern tiefes Verständnis statt bloßer Faktenrecherche. Spitzenmodelle wie GPT-5.1 (87,3 %), GPT-5 mini (82,8 %) und o3 (82,7 %) sind bei GPQA besonders stark und eignen sich für Forschung, technische Analysen und komplexe Problemlösung. Modelle unter 50 % GPQA haben oft Schwierigkeiten bei anspruchsvollem Denken und liefern eher oberflächliche Antworten.

Was ist AIME 2025 und wie bewertet es die mathematischen Fähigkeiten von KI?

AIME 2025 (American Invitational Mathematics Examination) ist ein Benchmark auf Wettbewerbsniveau, der fortgeschrittene Problemlösung, Algebra, Geometrie und Zahlentheorie testet. Werte über 80 % (wie GPT-5 Codex mit 98,7 % oder GPT-5.1 mit 94 %) zeigen außergewöhnliches mathematisches Denken für Engineering, Scientific Computing und quantitative Analysen. Modelle unter 50 % können bei mehrstufigen mathematischen Aufgaben Probleme haben oder benötigen eine explizite Aufschlüsselung.

Wie wird die Preisgestaltung von KI-Modellen berechnet und was gilt als kosteneffizient?

Die Preise von KI-Modellen werden pro 1 Million Tokens berechnet (etwa 750.000 Wörter). Input-Preise betreffen den Text, den Sie senden, Output-Preise die generierten Antworten. Günstige Modelle wie Llama 3.3 70B kosten $0.54/$0.71 pro Million Tokens, Mid-Tier-Modelle wie GPT-5 nano $0.05/$0.40, Premium-Modelle wie GPT-5 $1.25/$10. Bei typischen Anwendungen mit einem Input-/Output-Verhältnis von 3:1 können Budget-Modelle 10- bis 20-mal günstiger sein und dennoch 70-80 % der Leistung liefern.

Welche KI-Modelle eignen sich am besten für Coding und Programmierung?

Sortieren Sie nach Coding Index um die besten Programmiermodelle zu sehen. Unser Coding Index kombiniert LiveCodeBench, SciCode und Coding-Benchmarks. Zu den Top-Performern gehören GPT-5.1 (57,5), GPT-5 mini (51,4) und GPT-5 Codex (53,5). Diese Modelle sind stark bei Codegenerierung, Debugging, Refactoring und der Erklärung komplexer Algorithmen. Für kostenbewusste Entwickler bieten Modelle mit 40+ Punkten im Coding Index ein sehr gutes Preis-Leistungs-Verhältnis für Routineaufgaben.

Wie oft werden KI-Modell-Benchmarks und Rankings aktualisiert?

Unser Leaderboard wird täglich mit der Artificial Analysis API synchronisiert, damit Benchmark-Scores (MMLU-Pro, GPQA, AIME 2025), Preise und Inference-Geschwindigkeit die neuesten Modellversionen widerspiegeln. Neue Modell-Releases erscheinen sofort unter der Sortierung "Neueste". Benchmark-Scores können sich ändern, wenn Anbieter aktualisierte Versionen veröffentlichen - zum Beispiel erreichte GPT-5.1 (veröffentlicht im November 2025) 69,7 Intelligenzpunkte gegenüber 68,5 bei GPT-5 aus August 2025.

Welche Inference-Geschwindigkeit (Tokens/Sekunde) brauche ich für meine Anwendung?

Die Inference-Geschwindigkeit bestimmt, wie schnell Modelle Antworten erzeugen. Für Echtzeit-Chatbots und interaktive Anwendungen sind 100+ Tokens/Sekunde sinnvoll (z. B. gpt-oss-120B mit 340 tok/s). Für Hintergrundverarbeitung und Batch-Jobs reichen 50-100 tok/s. Premium-Reasoning-Modelle wie GPT-5 (103 tok/s) balancieren Geschwindigkeit und Fähigkeiten. Wichtig: Höhere Geschwindigkeit bedeutet nicht automatisch bessere Qualität - langsamere Modelle liefern oft durchdachtere, detailliertere Antworten.

Kann ich diese KI-Modelle kostenlos testen, bevor ich mich entscheide?

Ja! Probieren Sie unsere kostenlose KI-Chatoberfläche aus, um verschiedene Modelle sofort ohne Account zu testen. Viele Anbieter haben ebenfalls kostenlose Stufen: OpenAI (ChatGPT mit Tageslimits), Anthropic (Claude mit Nutzungslimits), Google (Gemini Free Tier) und Open-Source-Modelle wie Llama 3.3. Vergleichen Sie die Leistung für Ihren konkreten Use Case, bevor Sie auf bezahlte Pläne wechseln.