KI-Modell-Ranking (LLM-Leaderboard)

Schnellste KI-Modelle

Language models ranked by Artificial Analysis Index

Modell
Name des KI-Modells und Anbieterorganisation
Intelligenz
Artificial Analysis Intelligence Index - composite reasoning and capability score across the benchmark suite
Value Score
Qualität, Geschwindigkeit und gemischter Token-Preis als relativer Wert-Score
Speed
Inference-Durchsatz in Tokens pro Sekunde - wie schnell das Modell Antworten generiert
Inception KI-Anbieter-Logo - Mercury 2
#1 Mercury 2
von Inception · 20. Feb. 2026
21.4391045 tok/s
Google KI-Anbieter-Logo - Gemini 3.5 Flash-Lite
#2 Gemini 3.5 Flash-Lite
von Google · 21. Juli 2026
36.545600 tok/s
IBM KI-Anbieter-Logo - Granite 4.0 H Small
#3 Granite 4.0 H Small
von IBM · 22. Sept. 2025
5.218470 tok/s
Liquid AI KI-Anbieter-Logo - LFM2.5-VL-1.6B
#4 LFM2.5-VL-1.6B
von Liquid AI · 5. Jan. 2026
1.0k. A.410 tok/s
IBM KI-Anbieter-Logo - Granite 3.3 8B (Non-reasoning)
#5 Granite 3.3 8B (Non-reasoning)
von IBM · 16. Apr. 2025
1.87407 tok/s
StepFun KI-Anbieter-Logo - Step 3.7 Flash
#6 Step 3.7 Flash
von StepFun · 29. Mai 2026
30.352401 tok/s
Multiverse Computing KI-Anbieter-Logo - HyperNova 60B 2605
#7 HyperNova 60B 2605
von Multiverse Computing · 26. Mai 2026
17.879381 tok/s
Liquid AI KI-Anbieter-Logo - LFM2.5-8B-A1B
#8 LFM2.5-8B-A1B
von Liquid AI · 28. Mai 2026
8.3k. A.343 tok/s
OpenAI KI-Anbieter-Logo - gpt-oss-120b (low)
#9 gpt-oss-120b (low)
von OpenAI · 5. Aug. 2025
14.933337 tok/s
NVIDIA KI-Anbieter-Logo - Nemotron 3 Nano Omni 30B A3B Reasoning
#10 Nemotron 3 Nano Omni 30B A3B Reasoning
von NVIDIA · 29. Apr. 2026
14.946319 tok/s
Google KI-Anbieter-Logo - Gemini 3.1 Flash-Lite
#11 Gemini 3.1 Flash-Lite
von Google · 3. März 2026
25.038315 tok/s
Google KI-Anbieter-Logo - Gemini 3.6 Flash (high)
#12 Gemini 3.6 Flash (high)
von Google · 21. Juli 2026
50.133311 tok/s
Google KI-Anbieter-Logo - Gemini 2.5 Flash-Lite (Reasoning)
#13 Gemini 2.5 Flash-Lite (Reasoning)
von Google · 17. Juni 2025
11.431304 tok/s
StepFun KI-Anbieter-Logo - Step 3.5 Flash 2603
#14 Step 3.5 Flash 2603
von StepFun · 2. Apr. 2026
26.076301 tok/s
Google KI-Anbieter-Logo - Gemini 3.5 Flash (medium)
#15 Gemini 3.5 Flash (medium)
von Google · 19. Mai 2026
45.428299 tok/s
OpenAI KI-Anbieter-Logo - gpt-oss-120b (high)
#16 gpt-oss-120b (high)
von OpenAI · 5. Aug. 2025
23.852297 tok/s
Google KI-Anbieter-Logo - Gemini 3.5 Flash (high)
#17 Gemini 3.5 Flash (high)
von Google · 19. Mai 2026
50.231287 tok/s
StepFun KI-Anbieter-Logo - Step 3.5 Flash
#18 Step 3.5 Flash
von StepFun · 2. Feb. 2026
25.574285 tok/s
Amazon KI-Anbieter-Logo - Nova Micro
#19 Nova Micro
von Amazon · 3. Dez. 2024
4.721280 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.5 Omni Flash
#20 Qwen3.5 Omni Flash
von Alibaba · 30. März 2026
19.041260 tok/s
Google KI-Anbieter-Logo - Gemini 3.5 Flash (minimal)
#21 Gemini 3.5 Flash (minimal)
von Google · 19. Mai 2026
34.921256 tok/s
OpenAI KI-Anbieter-Logo - gpt-oss-20b (high)
#22 gpt-oss-20b (high)
von OpenAI · 5. Aug. 2025
14.955253 tok/s
OpenAI KI-Anbieter-Logo - gpt-oss-20b (low)
#23 gpt-oss-20b (low)
von OpenAI · 5. Aug. 2025
14.350250 tok/s
Google KI-Anbieter-Logo - Gemini 2.5 Flash-Lite (Non-reasoning)
#24 Gemini 2.5 Flash-Lite (Non-reasoning)
von Google · 17. Juni 2025
6.919247 tok/s
Amazon KI-Anbieter-Logo - Nova 2.0 Lite (Non-reasoning)
#25 Nova 2.0 Lite (Non-reasoning)
von Amazon · 29. Okt. 2025
11.814240 tok/s
OpenAI KI-Anbieter-Logo - o3-mini (high)
#26 o3-mini (high)
von OpenAI · 31. Jan. 2025
15.613240 tok/s
Google KI-Anbieter-Logo - Gemini 2.5 Flash (Reasoning)
#27 Gemini 2.5 Flash (Reasoning)
von Google · 20. Mai 2025
20.125231 tok/s
Google KI-Anbieter-Logo - Gemini 3 Flash Preview (Reasoning)
#28 Gemini 3 Flash Preview (Reasoning)
von Google · 17. Dez. 2025
37.840230 tok/s
SpaceXAI KI-Anbieter-Logo - Grok 4.20 0309 v2 (Reasoning)
#29 Grok 4.20 0309 v2 (Reasoning)
von SpaceXAI · 7. Apr. 2026
37.024227 tok/s
Google KI-Anbieter-Logo - Gemini 2.5 Flash (Non-reasoning)
#30 Gemini 2.5 Flash (Non-reasoning)
von Google · 20. Mai 2025
14.117227 tok/s
OpenAI KI-Anbieter-Logo - o3-mini
#31 o3-mini
von OpenAI · 31. Jan. 2025
19.015224 tok/s
Google KI-Anbieter-Logo - Gemini 3 Flash Preview (Non-reasoning)
#32 Gemini 3 Flash Preview (Non-reasoning)
von Google · 17. Dez. 2025
27.429218 tok/s
Amazon KI-Anbieter-Logo - Nova 2.0 Lite (medium)
#33 Nova 2.0 Lite (medium)
von Amazon · 29. Okt. 2025
19.023216 tok/s
NVIDIA KI-Anbieter-Logo - Nemotron 3 Ultra 550B A55B (Reasoning)
#34 Nemotron 3 Ultra 550B A55B (Reasoning)
von NVIDIA · 4. Juni 2026
37.839215 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.1 Codex (high)
#35 GPT-5.1 Codex (high)
von OpenAI · 13. Nov. 2025
34.721213 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.4 mini (medium)
#36 GPT-5.4 mini (medium)
von OpenAI · 17. März 2026
29.826210 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.1 Codex mini (high)
#37 GPT-5.1 Codex mini (high)
von OpenAI · 13. Nov. 2025
30.642210 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.7 Max
#38 Qwen3.7 Max
von Alibaba · 19. Mai 2026
46.027207 tok/s
OpenAI KI-Anbieter-Logo - GPT-4o (Nov '24)
#39 GPT-4o (Nov '24)
von OpenAI · 20. Nov. 2024
11.26204 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Luna (max)
#40 GPT-5.6 Luna (max)
von OpenAI · 9. Juli 2026
51.238203 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Luna (high)
#41 GPT-5.6 Luna (high)
von OpenAI · 9. Juli 2026
46.135199 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Luna (xhigh)
#42 GPT-5.6 Luna (xhigh)
von OpenAI · 9. Juli 2026
49.137197 tok/s
NVIDIA KI-Anbieter-Logo - Nemotron Nano 12B v2 VL (Non-reasoning)
#43 Nemotron Nano 12B v2 VL (Non-reasoning)
von NVIDIA · 28. Okt. 2025
4.69196 tok/s
Z AI KI-Anbieter-Logo - GLM-5.2 (max)
#44 GLM-5.2 (max)
von Z AI · 16. Juni 2026
51.139196 tok/s
Amazon KI-Anbieter-Logo - Nova 2.0 Lite (high)
#45 Nova 2.0 Lite (high)
von Amazon · 29. Okt. 2025
18.222194 tok/s
SpaceXAI KI-Anbieter-Logo - Grok 4.20 0309 v2 (Non-reasoning)
#46 Grok 4.20 0309 v2 (Non-reasoning)
von SpaceXAI · 7. Apr. 2026
21.814191 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 Next 80B A3B Instruct
#47 Qwen3 Next 80B A3B Instruct
von Alibaba · 11. Sept. 2025
13.717190 tok/s
OpenAI KI-Anbieter-Logo - GPT-4.1 nano
#48 GPT-4.1 nano
von OpenAI · 14. Apr. 2025
9.626189 tok/s
Amazon KI-Anbieter-Logo - Nova 2.0 Lite (low)
#49 Nova 2.0 Lite (low)
von Amazon · 29. Okt. 2025
17.822187 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Luna (Non-reasoning)
#50 GPT-5.6 Luna (Non-reasoning)
von OpenAI · 9. Juli 2026
26.620186 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Luna (low)
#51 GPT-5.6 Luna (low)
von OpenAI · 9. Juli 2026
33.325185 tok/s
OpenAI KI-Anbieter-Logo - GPT-5 nano (minimal)
#52 GPT-5 nano (minimal)
von OpenAI · 7. Aug. 2025
8.024183 tok/s
AI21 Labs KI-Anbieter-Logo - Jamba 1.6 Mini
#53 Jamba 1.6 Mini
von AI21 Labs · 6. März 2025
2.66182 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Luna (medium)
#54 GPT-5.6 Luna (medium)
von OpenAI · 9. Juli 2026
38.129182 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.4 mini (xhigh)
#55 GPT-5.4 mini (xhigh)
von OpenAI · 17. März 2026
40.035180 tok/s
OpenAI KI-Anbieter-Logo - o4-mini (high)
#56 o4-mini (high)
von OpenAI · 16. Apr. 2025
25.621179 tok/s
OpenAI KI-Anbieter-Logo - GPT-5 nano (high)
#57 GPT-5 nano (high)
von OpenAI · 7. Aug. 2025
19.961178 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 Next 80B A3B (Reasoning)
#58 Qwen3 Next 80B A3B (Reasoning)
von Alibaba · 11. Sept. 2025
16.714177 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.4 mini (Non-Reasoning)
#59 GPT-5.4 mini (Non-Reasoning)
von OpenAI · 17. März 2026
16.614176 tok/s
Cohere KI-Anbieter-Logo - Command A+
#60 Command A+
von Cohere · 20. Mai 2026
22.5k. A.175 tok/s
Mistral KI-Anbieter-Logo - Small 4 (Reasoning)
#61 Small 4 (Reasoning)
von Mistral · 16. März 2026
19.643175 tok/s
OpenAI KI-Anbieter-Logo - GPT-5 (ChatGPT)
#62 GPT-5 (ChatGPT)
von OpenAI · 7. Aug. 2025
15.39175 tok/s
Arcee AI KI-Anbieter-Logo - Trinity Large Thinking
#63 Trinity Large Thinking
von Arcee AI · 1. Apr. 2026
24.544174 tok/s
OpenAI KI-Anbieter-Logo - GPT-5 nano (medium)
#64 GPT-5 nano (medium)
von OpenAI · 7. Aug. 2025
19.058174 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.4 nano (medium)
#65 GPT-5.4 nano (medium)
von OpenAI · 17. März 2026
30.250174 tok/s
OpenAI KI-Anbieter-Logo - GPT-5 Codex (high)
#66 GPT-5 Codex (high)
von OpenAI · 23. Sept. 2025
36.122173 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.6 35B A3B (Non-reasoning)
#67 Qwen3.6 35B A3B (Non-reasoning)
von Alibaba · 16. Apr. 2026
24.230173 tok/s
NVIDIA KI-Anbieter-Logo - Nemotron 3 Super 120B A12B (Reasoning)
#68 Nemotron 3 Super 120B A12B (Reasoning)
von NVIDIA · 11. März 2026
25.446172 tok/s
Amazon KI-Anbieter-Logo - Nova Lite
#69 Nova Lite
von Amazon · 3. Dez. 2024
6.924168 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.5 35B A3B (Non-reasoning)
#70 Qwen3.5 35B A3B (Non-reasoning)
von Alibaba · 24. Feb. 2026
24.033166 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.4 nano (xhigh)
#71 GPT-5.4 nano (xhigh)
von OpenAI · 17. März 2026
38.263163 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.2 Codex (xhigh)
#72 GPT-5.2 Codex (xhigh)
von OpenAI · 11. Dez. 2025
40.121162 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.4 nano (Non-Reasoning)
#73 GPT-5.4 nano (Non-Reasoning)
von OpenAI · 17. März 2026
17.629161 tok/s
Meta KI-Anbieter-Logo - Llama 3.1 Instruct 8B
#74 Llama 3.1 Instruct 8B
von Meta · 23. Juli 2024
7.631161 tok/s
NVIDIA KI-Anbieter-Logo - Nemotron 3 Nano 30B A3B (Reasoning)
#75 Nemotron 3 Nano 30B A3B (Reasoning)
von NVIDIA · 15. Dez. 2025
14.254161 tok/s
Mistral KI-Anbieter-Logo - Small (Feb '24)
#76 Small (Feb '24)
von Mistral · 26. Feb. 2024
3.63160 tok/s
Mistral KI-Anbieter-Logo - Ministral 3 3B
#77 Ministral 3 3B
von Mistral · 2. Dez. 2025
6.824159 tok/s
Mistral KI-Anbieter-Logo - Small 3
#78 Small 3
von Mistral · 30. Jan. 2025
6.920158 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Terra (max)
#79 GPT-5.6 Terra (max)
von OpenAI · 9. Juli 2026
55.026157 tok/s
Mistral KI-Anbieter-Logo - Small 3.1
#80 Small 3.1
von Mistral · 17. März 2025
14.743156 tok/s
Tencent KI-Anbieter-Logo - Hy3-preview (Non-reasoning)
#81 Hy3-preview (Non-reasoning)
von Tencent · 23. Apr. 2026
26.166156 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 30B A3B 2507 (Reasoning)
#82 Qwen3 30B A3B 2507 (Reasoning)
von Alibaba · 30. Juli 2025
14.419156 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 30B A3B 2507 Instruct
#83 Qwen3 30B A3B 2507 Instruct
von Alibaba · 29. Juli 2025
9.117156 tok/s
OpenAI KI-Anbieter-Logo - o3
#84 o3
von OpenAI · 16. Apr. 2025
30.418155 tok/s
Mistral KI-Anbieter-Logo - Small 3.2
#85 Small 3.2
von Mistral · 20. Juni 2025
10.631155 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.4 (xhigh)
#86 GPT-5.4 (xhigh)
von OpenAI · 5. März 2026
51.424152 tok/s
InclusionAI KI-Anbieter-Logo - Ling 2.6 Flash
#87 Ling 2.6 Flash
von InclusionAI · 21. Apr. 2026
14.141152 tok/s
Anthropic KI-Anbieter-Logo - Claude 4.5 Haiku (Reasoning)
#88 Claude 4.5 Haiku (Reasoning)
von Anthropic · 15. Okt. 2025
29.624151 tok/s
Tencent KI-Anbieter-Logo - Hy3-preview (Reasoning)
#89 Hy3-preview (Reasoning)
von Tencent · 23. Apr. 2026
33.685150 tok/s
Mistral KI-Anbieter-Logo - Small 4 (Non-reasoning)
#90 Small 4 (Non-reasoning)
von Mistral · 16. März 2026
12.427149 tok/s
OpenAI KI-Anbieter-Logo - GPT-3.5 Turbo
#91 GPT-3.5 Turbo
von OpenAI · 30. Nov. 2022
3.65149 tok/s
OpenAI KI-Anbieter-Logo - GPT-4.1
#92 GPT-4.1
von OpenAI · 14. Apr. 2025
19.412149 tok/s
Amazon KI-Anbieter-Logo - Nova 2.0 Pro Preview (low)
#93 Nova 2.0 Pro Preview (low)
von Amazon · 27. Nov. 2025
19.612149 tok/s
Google KI-Anbieter-Logo - Gemini 2.5 Pro
#94 Gemini 2.5 Pro
von Google · 5. Juni 2025
25.816148 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.5 122B A10B (Non-reasoning)
#95 Qwen3.5 122B A10B (Non-reasoning)
von Alibaba · 24. Feb. 2026
27.630147 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.5 35B A3B (Reasoning)
#96 Qwen3.5 35B A3B (Reasoning)
von Alibaba · 24. Feb. 2026
29.340145 tok/s
Mistral KI-Anbieter-Logo - Small (Sep '24)
#97 Small (Sep '24)
von Mistral · 17. Sept. 2024
4.710145 tok/s
Amazon KI-Anbieter-Logo - Nova 2.0 Pro Preview (Non-reasoning)
#98 Nova 2.0 Pro Preview (Non-reasoning)
von Amazon · 27. Nov. 2025
14.49143 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 VL 8B Instruct
#99 Qwen3 VL 8B Instruct
von Alibaba · 14. Okt. 2025
8.417140 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.5 122B A10B (Reasoning)
#100 Qwen3.5 122B A10B (Reasoning)
von Alibaba · 24. Feb. 2026
32.335140 tok/s

Zeige 100 von 578 Modelle

Das KI-Modell-Leaderboard verstehen

Dieses umfassende KI-Modell-Leaderboard hilft Ihnen, zu vergleichen und auszuwählen die besten Large Language Models (LLMs) für Ihre Anforderungen. Wir erfassen standardisierte KI-Benchmarks, Token-Preise, Inference-Geschwindigkeit und Modellfähigkeiten bei allen großen KI-Anbietern wie OpenAI, Anthropic, Google, Meta, und DeepSeek.

Kern-KI-Benchmarks erklärt

MMLU-ProTestet breites Wissen über 14 akademische Fachbereiche
GPQADenken & Problemlösung auf Promotionsniveau
AIME 2025Mathematisches Denken auf Spitzenniveau
Coding IndexLiveCodeBench + SciCode kombiniert
Math IndexAIME + MATH-500 kombiniert

Wichtige Kennzahlen

Token-PreisgestaltungInput- vs. Output-Kosten pro 1 Mio. Tokens
Inference-GeschwindigkeitTokens/Sekunde für Antwortzeit
VeröffentlichungsdatumNeueste Techniken & Wissensstand
Benchmark-ScoresFähigkeitsvergleich von 0-100 %

So wählen Sie das richtige KI-Modell für Ihren Use Case

Für Forschung & Analyse

Priorisieren Sie Modelle mit hohen MMLU-Pro- (70 %+) und GPQA-Werten (60 %+), wenn es um komplexe Denkaufgaben, wissenschaftliche Recherche und technische Dokumentation geht

Für Kostenoptimierung

Sortieren Sie nach Input-/Output-Preisen - kleinere Modelle liefern bei einfachen Aufgaben oft 80 % der Flaggschiff-Leistung zu 10 % der Kosten

Für Mathe & MINT

Filtern Sie nach Math-Index oder AIME-2025-Scores (50 %+) für quantitative Analysen, Engineering-Berechnungen und wissenschaftliche Anwendungen

Alle Benchmark-Scores und Preisdaten werden täglich von Artificial Analysis aktualisiert, um die neuesten Modellversionen und Fähigkeiten abzubilden. Nutzen Sie die Sortierfilter oben, um KI-Modelle nach Intelligenz, Kosten, Coding-Fähigkeit, Mathe-Leistung, Geschwindigkeit oder Veröffentlichungsdatum zu finden.

Häufig gestellte Fragen

Was ist MMLU-Pro und warum gilt es als Standard-Benchmark für KI-Intelligenz?

MMLU-Pro (Massive Multitask Language Understanding - Professional) ist der umfassendste KI-Benchmark und testet Modelle in 14 akademischen Fachbereichen, darunter Mathematik, Naturwissenschaften, Geschichte, Recht und Ethik. Die Werte reichen von 46 % (Grundkompetenz) bis 87 % (nahe Expertenniveau). Modelle über 75 % zeigen starke allgemeine Intelligenz für professionelle Anwendungen, während Werte unter 60 % auf Einschränkungen bei komplexen Denkaufgaben hindeuten.

Was misst GPQA und welche Modelle erzielen die höchsten Werte?

GPQA (Graduate-level Google-Proof Q&A) prüft Denken auf Promotionsniveau mit Fragen, die bewusst "Google-proof" sind - sie erfordern tiefes Verständnis statt bloßer Faktenrecherche. Spitzenmodelle wie GPT-5.1 (87,3 %), GPT-5 mini (82,8 %) und o3 (82,7 %) sind bei GPQA besonders stark und eignen sich für Forschung, technische Analysen und komplexe Problemlösung. Modelle unter 50 % GPQA haben oft Schwierigkeiten bei anspruchsvollem Denken und liefern eher oberflächliche Antworten.

Was ist AIME 2025 und wie bewertet es die mathematischen Fähigkeiten von KI?

AIME 2025 (American Invitational Mathematics Examination) ist ein Benchmark auf Wettbewerbsniveau, der fortgeschrittene Problemlösung, Algebra, Geometrie und Zahlentheorie testet. Werte über 80 % (wie GPT-5 Codex mit 98,7 % oder GPT-5.1 mit 94 %) zeigen außergewöhnliches mathematisches Denken für Engineering, Scientific Computing und quantitative Analysen. Modelle unter 50 % können bei mehrstufigen mathematischen Aufgaben Probleme haben oder benötigen eine explizite Aufschlüsselung.

Wie wird die Preisgestaltung von KI-Modellen berechnet und was gilt als kosteneffizient?

Die Preise von KI-Modellen werden pro 1 Million Tokens berechnet (etwa 750.000 Wörter). Input-Preise betreffen den Text, den Sie senden, Output-Preise die generierten Antworten. Günstige Modelle wie Llama 3.3 70B kosten $0.54/$0.71 pro Million Tokens, Mid-Tier-Modelle wie GPT-5 nano $0.05/$0.40, Premium-Modelle wie GPT-5 $1.25/$10. Bei typischen Anwendungen mit einem Input-/Output-Verhältnis von 3:1 können Budget-Modelle 10- bis 20-mal günstiger sein und dennoch 70-80 % der Leistung liefern.

Welche KI-Modelle eignen sich am besten für Coding und Programmierung?

Sortieren Sie nach Coding Index um die besten Programmiermodelle zu sehen. Unser Coding Index kombiniert LiveCodeBench, SciCode und Coding-Benchmarks. Zu den Top-Performern gehören GPT-5.1 (57,5), GPT-5 mini (51,4) und GPT-5 Codex (53,5). Diese Modelle sind stark bei Codegenerierung, Debugging, Refactoring und der Erklärung komplexer Algorithmen. Für kostenbewusste Entwickler bieten Modelle mit 40+ Punkten im Coding Index ein sehr gutes Preis-Leistungs-Verhältnis für Routineaufgaben.

Wie oft werden KI-Modell-Benchmarks und Rankings aktualisiert?

Unser Leaderboard wird täglich mit der Artificial Analysis API synchronisiert, damit Benchmark-Scores (MMLU-Pro, GPQA, AIME 2025), Preise und Inference-Geschwindigkeit die neuesten Modellversionen widerspiegeln. Neue Modell-Releases erscheinen sofort unter der Sortierung "Neueste". Benchmark-Scores können sich ändern, wenn Anbieter aktualisierte Versionen veröffentlichen - zum Beispiel erreichte GPT-5.1 (veröffentlicht im November 2025) 69,7 Intelligenzpunkte gegenüber 68,5 bei GPT-5 aus August 2025.

Welche Inference-Geschwindigkeit (Tokens/Sekunde) brauche ich für meine Anwendung?

Die Inference-Geschwindigkeit bestimmt, wie schnell Modelle Antworten erzeugen. Für Echtzeit-Chatbots und interaktive Anwendungen sind 100+ Tokens/Sekunde sinnvoll (z. B. gpt-oss-120B mit 340 tok/s). Für Hintergrundverarbeitung und Batch-Jobs reichen 50-100 tok/s. Premium-Reasoning-Modelle wie GPT-5 (103 tok/s) balancieren Geschwindigkeit und Fähigkeiten. Wichtig: Höhere Geschwindigkeit bedeutet nicht automatisch bessere Qualität - langsamere Modelle liefern oft durchdachtere, detailliertere Antworten.

Kann ich diese KI-Modelle kostenlos testen, bevor ich mich entscheide?

Ja! Probieren Sie unsere kostenlose KI-Chatoberfläche aus, um verschiedene Modelle sofort ohne Account zu testen. Viele Anbieter haben ebenfalls kostenlose Stufen: OpenAI (ChatGPT mit Tageslimits), Anthropic (Claude mit Nutzungslimits), Google (Gemini Free Tier) und Open-Source-Modelle wie Llama 3.3. Vergleichen Sie die Leistung für Ihren konkreten Use Case, bevor Sie auf bezahlte Pläne wechseln.