KI-Modell-Ranking (LLM-Leaderboard)

Beste KI-Mathe-Modelle

Language models ranked by Artificial Analysis Index

Modell
Name des KI-Modells und Anbieterorganisation
Intelligenz
Artificial Analysis Intelligence Index - composite reasoning and capability score across the benchmark suite
Value Score
Qualität, Geschwindigkeit und gemischter Token-Preis als relativer Wert-Score
Speed
Inference-Durchsatz in Tokens pro Sekunde - wie schnell das Modell Antworten generiert
Z AI KI-Anbieter-Logo - GLM-4.5V (Non-reasoning)
#1 GLM-4.5V (Non-reasoning)
von Z AI · 11. Aug. 2025
1.4159 tok/s
Google KI-Anbieter-Logo - Gemini 3.5 Flash (high)
#2 Gemini 3.5 Flash (high)
von Google · 19. Mai 2026
41.927206 tok/s
Xiaomi KI-Anbieter-Logo - MiMo-V2.5-Pro
#3 MiMo-V2.5-Pro
von Xiaomi · 22. Apr. 2026
32.63235 tok/s
China Mobile KI-Anbieter-Logo - JT-35B-Flash
#4 JT-35B-Flash
von China Mobile · 14. Mai 2026
21.8k. A.k. A.
Inception KI-Anbieter-Logo - Mercury 2
#5 Mercury 2
von Inception · 20. Feb. 2026
14.929821 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.5 Omni Plus
#6 Qwen3.5 Omni Plus
von Alibaba · 30. März 2026
24.023124 tok/s
Amazon KI-Anbieter-Logo - Nova 2.0 Omni (medium)
#7 Nova 2.0 Omni (medium)
von Amazon · 26. Nov. 2025
14.715k. A.
OpenAI KI-Anbieter-Logo - GPT-5.2 Codex (xhigh)
#8 GPT-5.2 Codex (xhigh)
von OpenAI · 11. Dez. 2025
33.014k. A.
Alibaba KI-Anbieter-Logo - Qwen3.5 122B A10B (Non-reasoning)
#9 Qwen3.5 122B A10B (Non-reasoning)
von Alibaba · 24. Feb. 2026
20.624145 tok/s
Google KI-Anbieter-Logo - Gemma 4 12B (Non-reasoning)
#10 Gemma 4 12B (Non-reasoning)
von Google · 3. Juni 2026
7.320110 tok/s
Google KI-Anbieter-Logo - Gemini 3.5 Flash (minimal)
#11 Gemini 3.5 Flash (minimal)
von Google · 19. Mai 2026
28.018189 tok/s
Anthropic KI-Anbieter-Logo - Claude 3.5 Haiku
#12 Claude 3.5 Haiku
von Anthropic · 22. Okt. 2024
6.5k. A.k. A.
OpenAI KI-Anbieter-Logo - GPT-3.5 Turbo
#13 GPT-3.5 Turbo
von OpenAI · 30. Nov. 2022
1.01k. A.
Google KI-Anbieter-Logo - Gemini 2.0 Flash Thinking Experimental (Jan '25)
#14 Gemini 2.0 Flash Thinking Experimental (Jan '25)
von Google · 21. Jan. 2025
7.4k. A.k. A.
Alibaba KI-Anbieter-Logo - Qwen2.5 Coder Instruct 32B
#15 Qwen2.5 Coder Instruct 32B
von Alibaba · 11. Nov. 2024
1.6k. A.k. A.
Perplexity KI-Anbieter-Logo - Sonar Reasoning
#16 Sonar Reasoning
von Perplexity · 28. Jan. 2025
5.9k. A.k. A.
Google KI-Anbieter-Logo - Gemma 3 270M
#17 Gemma 3 270M
von Google · 14. Aug. 2025
1.0k. A.k. A.
SpaceXAI KI-Anbieter-Logo - Grok 4.20 0309 (Reasoning)
#18 Grok 4.20 0309 (Reasoning)
von SpaceXAI · 10. März 2026
29.516k. A.
OpenAI KI-Anbieter-Logo - GPT-5.1 Codex (high)
#19 GPT-5.1 Codex (high)
von OpenAI · 13. Nov. 2025
27.914k. A.
Meta KI-Anbieter-Logo - Muse Spark 1.2 (xhigh)
#20 Muse Spark 1.2 (xhigh)
von Meta · 5. Aug. 2026
46.840260 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Luna (low)
#21 GPT-5.6 Luna (low)
von OpenAI · 9. Juli 2026
25.841110 tok/s
Anthropic KI-Anbieter-Logo - Claude Fable 5.1 (Adaptive Reasoning, Low Effort, Default Fallback)
#22 Claude Fable 5.1 (Adaptive Reasoning, Low Effort, Default Fallback)
von Anthropic · 1. Sept. 2026
47.8856 tok/s
Mistral KI-Anbieter-Logo - Medium 3.1
#23 Medium 3.1
von Mistral · 12. Aug. 2025
8.411124 tok/s
OpenAI KI-Anbieter-Logo - GPT-5 nano (minimal)
#24 GPT-5 nano (minimal)
von OpenAI · 7. Aug. 2025
2.48156 tok/s
Google KI-Anbieter-Logo - Gemini 2.5 Pro Preview (May' 25)
#25 Gemini 2.5 Pro Preview (May' 25)
von Google · 6. Mai 2025
16.18k. A.
OpenAI KI-Anbieter-Logo - o3-mini (high)
#26 o3-mini (high)
von OpenAI · 31. Jan. 2025
9.68238 tok/s
OpenAI KI-Anbieter-Logo - o1-preview
#27 o1-preview
von OpenAI · 12. Sept. 2024
11.02k. A.
DeepSeek KI-Anbieter-Logo - V3.2 Exp (Non-reasoning)
#28 V3.2 Exp (Non-reasoning)
von DeepSeek · 29. Sept. 2025
15.126k. A.
Apodex KI-Anbieter-Logo - 1.1
#29 1.1
von Apodex · 30. Aug. 2026
34.934k. A.
OpenAI KI-Anbieter-Logo - GPT-5.6 Sol (low)
#30 GPT-5.6 Sol (low)
von OpenAI · 9. Juli 2026
40.81067 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 Coder 480B A35B Instruct
#31 Qwen3 Coder 480B A35B Instruct
von Alibaba · 22. Juli 2025
11.9557 tok/s
Google KI-Anbieter-Logo - Gemini 3.5 Flash-Lite
#32 Gemini 3.5 Flash-Lite
von Google · 21. Juli 2026
27.636371 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.5 2B (Non-reasoning)
#33 Qwen3.5 2B (Non-reasoning)
von Alibaba · 2. März 2026
1.0k. A.k. A.
Mistral KI-Anbieter-Logo - Devstral 2
#34 Devstral 2
von Mistral · 9. Dez. 2025
12.7k. A.118 tok/s
Anthropic KI-Anbieter-Logo - Claude 3.5 Sonnet (Oct '24)
#35 Claude 3.5 Sonnet (Oct '24)
von Anthropic · 22. Okt. 2024
4.22k. A.
DeepSeek KI-Anbieter-Logo - V3.1 Terminus (Reasoning)
#36 V3.1 Terminus (Reasoning)
von DeepSeek · 22. Sept. 2025
23.516k. A.
Alibaba KI-Anbieter-Logo - Qwen3 Omni 30B A3B Instruct
#37 Qwen3 Omni 30B A3B Instruct
von Alibaba · 22. Sept. 2025
1.0192 tok/s
SpaceXAI KI-Anbieter-Logo - Grok Build 0.1 0616
#38 Grok Build 0.1 0616
von SpaceXAI · 16. Juni 2026
31.72067 tok/s
IBM KI-Anbieter-Logo - Granite 4.2 3B
#39 Granite 4.2 3B
von IBM · 25. Aug. 2026
10.756211 tok/s
Amazon KI-Anbieter-Logo - Nova 2.0 Pro Preview (medium)
#40 Nova 2.0 Pro Preview (medium)
von Amazon · 27. Nov. 2025
15.59117 tok/s
Thinking Machines KI-Anbieter-Logo - Inkling (xhigh)
#41 Inkling (xhigh)
von Thinking Machines · 15. Juli 2026
32.21773 tok/s
Kimi KI-Anbieter-Logo - K2.6
#42 K2.6
von Kimi · 20. Apr. 2026
35.82046 tok/s
DeepSeek KI-Anbieter-Logo - R1 (Jan '25)
#43 R1 (Jan '25)
von DeepSeek · 20. Jan. 2025
12.07k. A.
DeepSeek KI-Anbieter-Logo - R1 Distill Llama 8B
#44 R1 Distill Llama 8B
von DeepSeek · 20. Jan. 2025
1.0k. A.k. A.
Alibaba KI-Anbieter-Logo - Qwen3 0.6B (Non-reasoning)
#45 Qwen3 0.6B (Non-reasoning)
von Alibaba · 28. Apr. 2025
1.0k. A.k. A.
Alibaba KI-Anbieter-Logo - Qwen3.5 397B A17B (Reasoning)
#46 Qwen3.5 397B A17B (Reasoning)
von Alibaba · 16. Feb. 2026
26.12091 tok/s
Liquid AI KI-Anbieter-Logo - LFM2 1.2B
#47 LFM2 1.2B
von Liquid AI · 10. Juli 2025
1.0k. A.k. A.
Kimi KI-Anbieter-Logo - K2.6 (Non-reasoning)
#48 K2.6 (Non-reasoning)
von Kimi · 20. Apr. 2026
27.71546 tok/s
Mistral KI-Anbieter-Logo - Magistral Small 1
#49 Magistral Small 1
von Mistral · 10. Juni 2025
5.0k. A.k. A.
IBM KI-Anbieter-Logo - Granite 4.2 30B
#50 Granite 4.2 30B
von IBM · 25. Aug. 2026
16.52376 tok/s
Liquid AI KI-Anbieter-Logo - LFM 40B
#51 LFM 40B
von Liquid AI · 30. Sept. 2024
1.0k. A.k. A.
MiniMax KI-Anbieter-Logo - M2.5
#52 M2.5
von MiniMax · 12. Feb. 2026
26.83496 tok/s
Mistral KI-Anbieter-Logo - Small 4 (Non-reasoning)
#53 Small 4 (Non-reasoning)
von Mistral · 16. März 2026
6.615148 tok/s
Anthropic KI-Anbieter-Logo - Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)
#54 Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)
von Anthropic · 24. Juli 2026
53.41256 tok/s
Anthropic KI-Anbieter-Logo - Claude 3.7 Sonnet (Reasoning)
#55 Claude 3.7 Sonnet (Reasoning)
von Anthropic · 24. Feb. 2025
20.5k. A.k. A.
Anthropic KI-Anbieter-Logo - Claude Sonnet 5 (Adaptive Reasoning, Low Effort)
#56 Claude Sonnet 5 (Adaptive Reasoning, Low Effort)
von Anthropic · 30. Juni 2026
k. A.61 tok/s
Xiaomi KI-Anbieter-Logo - MiMo-V2-Flash (Feb 2026)
#57 MiMo-V2-Flash (Feb 2026)
von Xiaomi · 16. Dez. 2025
26.4k. A.k. A.
Z AI KI-Anbieter-Logo - GLM-5-Turbo
#58 GLM-5-Turbo
von Z AI · 15. März 2026
31.0k. A.k. A.
InclusionAI KI-Anbieter-Logo - Ling-1T
#59 Ling-1T
von InclusionAI · 8. Okt. 2025
6.9k. A.k. A.
OpenAI KI-Anbieter-Logo - gpt-oss-20b (low)
#60 gpt-oss-20b (low)
von OpenAI · 5. Aug. 2025
8.431227 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.5 27B (Reasoning)
#61 Qwen3.5 27B (Reasoning)
von Alibaba · 24. Feb. 2026
26.92276 tok/s
OpenAI KI-Anbieter-Logo - o3
#62 o3
von OpenAI · 16. Apr. 2025
23.714116 tok/s
Google KI-Anbieter-Logo - Gemini 1.5 Pro (May '24)
#63 Gemini 1.5 Pro (May '24)
von Google · 15. Mai 2024
1.0k. A.k. A.
LG AI Research KI-Anbieter-Logo - K-EXAONE 2.0
#64 K-EXAONE 2.0
von LG AI Research · 12. Aug. 2026
23.1k. A.k. A.
Alibaba KI-Anbieter-Logo - Qwen3 4B (Reasoning)
#65 Qwen3 4B (Reasoning)
von Alibaba · 28. Apr. 2025
2.7k. A.k. A.
Z AI KI-Anbieter-Logo - GLM-5.3-Flash
#66 GLM-5.3-Flash
von Z AI · 26. Aug. 2026
46.26847 tok/s
DeepSeek KI-Anbieter-Logo - V3.1 (Reasoning)
#67 V3.1 (Reasoning)
von DeepSeek · 21. Aug. 2025
14.515k. A.
NVIDIA KI-Anbieter-Logo - Llama 3.3 Nemotron Super 49B v1 (Reasoning)
#68 Llama 3.3 Nemotron Super 49B v1 (Reasoning)
von NVIDIA · 18. März 2025
6.4k. A.k. A.
StepFun KI-Anbieter-Logo - Step 3.5 Flash 2603
#69 Step 3.5 Flash 2603
von StepFun · 2. Apr. 2026
19.560217 tok/s
Mistral KI-Anbieter-Logo - Large 2 (Jul '24)
#70 Large 2 (Jul '24)
von Mistral · 24. Juli 2024
1.71k. A.
Upstage KI-Anbieter-Logo - Solar Pro 4
#71 Solar Pro 4
von Upstage · 6. Aug. 2026
32.73270 tok/s
Databricks KI-Anbieter-Logo - DBRX Instruct
#72 DBRX Instruct
von Databricks · 27. März 2024
1.0k. A.k. A.
Z AI KI-Anbieter-Logo - GLM-4.5 (Reasoning)
#73 GLM-4.5 (Reasoning)
von Z AI · 28. Juli 2025
13.3k. A.k. A.
Alibaba KI-Anbieter-Logo - Qwen2.5 Instruct 32B
#74 Qwen2.5 Instruct 32B
von Alibaba · 19. Sept. 2024
1.9k. A.k. A.
Google KI-Anbieter-Logo - Gemini 2.5 Flash-Lite (Non-reasoning)
#75 Gemini 2.5 Flash-Lite (Non-reasoning)
von Google · 17. Juni 2025
1.44319 tok/s
Nous Research KI-Anbieter-Logo - Hermes 3 - Llama-3.1 70B
#76 Hermes 3 - Llama-3.1 70B
von Nous Research · 15. Aug. 2024
1.0134 tok/s
Cohere KI-Anbieter-Logo - North Mini Code
#77 North Mini Code
von Cohere · 9. Juni 2026
13.5k. A.56 tok/s
Perplexity KI-Anbieter-Logo - Sonar Reasoning Pro
#78 Sonar Reasoning Pro
von Perplexity · 28. Jan. 2025
11.8k. A.k. A.
OpenAI KI-Anbieter-Logo - GPT-5.5 (xhigh)
#79 GPT-5.5 (xhigh)
von OpenAI · 23. Apr. 2026
45.61185 tok/s
Mistral KI-Anbieter-Logo - Medium
#80 Medium
von Mistral · 11. Dez. 2023
1.01130 tok/s
OpenAI KI-Anbieter-Logo - GPT-6 Astra (xhigh)
#81 GPT-6 Astra (xhigh)
von OpenAI · 3. Sept. 2026
54.3957 tok/s
Amazon KI-Anbieter-Logo - Nova 2.0 Omni (Non-reasoning)
#82 Nova 2.0 Omni (Non-reasoning)
von Amazon · 26. Nov. 2025
4.85k. A.
IBM KI-Anbieter-Logo - Granite 4.0 Micro
#83 Granite 4.0 Micro
von IBM · 22. Sept. 2025
1.0k. A.k. A.
Anthropic KI-Anbieter-Logo - Claude 3 Haiku
#84 Claude 3 Haiku
von Anthropic · 4. März 2024
1.01k. A.
Anthropic KI-Anbieter-Logo - Claude Opus 5 (Adaptive Reasoning, Low Effort)
#85 Claude Opus 5 (Adaptive Reasoning, Low Effort)
von Anthropic · 24. Juli 2026
43.81054 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.5 9B (Non-reasoning)
#86 Qwen3.5 9B (Non-reasoning)
von Alibaba · 2. März 2026
14.12786 tok/s
Mistral KI-Anbieter-Logo - 7B Instruct
#87 7B Instruct
von Mistral · 27. Sept. 2023
1.02108 tok/s
Google KI-Anbieter-Logo - Gemini 2.5 Flash (Reasoning)
#88 Gemini 2.5 Flash (Reasoning)
von Google · 20. Mai 2025
13.918223 tok/s
OpenAI KI-Anbieter-Logo - GPT-6 Astra (Non-reasoning)
#89 GPT-6 Astra (Non-reasoning)
von OpenAI · 3. Sept. 2026
47.810k. A.
Google KI-Anbieter-Logo - Gemma 3 4B Instruct
#90 Gemma 3 4B Instruct
von Google · 12. März 2025
1.0k. A.k. A.
Alibaba KI-Anbieter-Logo - Qwen3.5 122B A10B (Reasoning)
#91 Qwen3.5 122B A10B (Reasoning)
von Alibaba · 24. Feb. 2026
24.828133 tok/s
Xiaomi KI-Anbieter-Logo - MiMo-V2.5
#92 MiMo-V2.5
von Xiaomi · 22. Apr. 2026
29.55152 tok/s
SpaceXAI KI-Anbieter-Logo - Grok 4.1 Fast (Reasoning)
#93 Grok 4.1 Fast (Reasoning)
von SpaceXAI · 19. Nov. 2025
23.9k. A.k. A.
Nous Research KI-Anbieter-Logo - Hermes 4 - Llama-3.1 70B (Non-reasoning)
#94 Hermes 4 - Llama-3.1 70B (Non-reasoning)
von Nous Research · 27. Aug. 2025
1.3284 tok/s
NVIDIA KI-Anbieter-Logo - Nemotron 3 Nano 30B A3B (Non-reasoning)
#95 Nemotron 3 Nano 30B A3B (Non-reasoning)
von NVIDIA · 15. Dez. 2025
1.87157 tok/s
Anthropic KI-Anbieter-Logo - Claude Sonnet 5 (Adaptive Reasoning, Max Effort)
#96 Claude Sonnet 5 (Adaptive Reasoning, Max Effort)
von Anthropic · 30. Juni 2026
45.11675 tok/s
SpaceXAI KI-Anbieter-Logo - Grok 3
#97 Grok 3
von SpaceXAI · 19. Feb. 2025
12.34k. A.
Z AI KI-Anbieter-Logo - GLM 5V Turbo (Reasoning)
#98 GLM 5V Turbo (Reasoning)
von Z AI · 1. Apr. 2026
27.6k. A.k. A.
Mistral KI-Anbieter-Logo - Small 3.1
#99 Small 3.1
von Mistral · 17. März 2025
8.627151 tok/s
Anthropic KI-Anbieter-Logo - Claude Opus 4.5 (Reasoning)
#100 Claude Opus 4.5 (Reasoning)
von Anthropic · 24. Nov. 2025
33.6853 tok/s

Zeige 100 von 642 Modelle

Das KI-Modell-Leaderboard verstehen

Dieses umfassende KI-Modell-Leaderboard hilft Ihnen, zu vergleichen und auszuwählen die besten Large Language Models (LLMs) für Ihre Anforderungen. Wir erfassen standardisierte KI-Benchmarks, Token-Preise, Inference-Geschwindigkeit und Modellfähigkeiten bei allen großen KI-Anbietern wie OpenAI, Anthropic, Google, Meta, und DeepSeek.

Kern-KI-Benchmarks erklärt

MMLU-ProTestet breites Wissen über 14 akademische Fachbereiche
GPQADenken & Problemlösung auf Promotionsniveau
AIME 2025Mathematisches Denken auf Spitzenniveau
Coding IndexLiveCodeBench + SciCode kombiniert
Math IndexAIME + MATH-500 kombiniert

Wichtige Kennzahlen

Token-PreisgestaltungInput- vs. Output-Kosten pro 1 Mio. Tokens
Inference-GeschwindigkeitTokens/Sekunde für Antwortzeit
VeröffentlichungsdatumNeueste Techniken & Wissensstand
Benchmark-ScoresFähigkeitsvergleich von 0-100 %

So wählen Sie das richtige KI-Modell für Ihren Use Case

Für Forschung & Analyse

Priorisieren Sie Modelle mit hohen MMLU-Pro- (70 %+) und GPQA-Werten (60 %+), wenn es um komplexe Denkaufgaben, wissenschaftliche Recherche und technische Dokumentation geht

Für Kostenoptimierung

Sortieren Sie nach Input-/Output-Preisen - kleinere Modelle liefern bei einfachen Aufgaben oft 80 % der Flaggschiff-Leistung zu 10 % der Kosten

Für Mathe & MINT

Filtern Sie nach Math-Index oder AIME-2025-Scores (50 %+) für quantitative Analysen, Engineering-Berechnungen und wissenschaftliche Anwendungen

Alle Benchmark-Scores und Preisdaten werden täglich von Artificial Analysis aktualisiert, um die neuesten Modellversionen und Fähigkeiten abzubilden. Nutzen Sie die Sortierfilter oben, um KI-Modelle nach Intelligenz, Kosten, Coding-Fähigkeit, Mathe-Leistung, Geschwindigkeit oder Veröffentlichungsdatum zu finden.

Häufig gestellte Fragen

Was ist MMLU-Pro und warum gilt es als Standard-Benchmark für KI-Intelligenz?

MMLU-Pro (Massive Multitask Language Understanding - Professional) ist der umfassendste KI-Benchmark und testet Modelle in 14 akademischen Fachbereichen, darunter Mathematik, Naturwissenschaften, Geschichte, Recht und Ethik. Die Werte reichen von 46 % (Grundkompetenz) bis 87 % (nahe Expertenniveau). Modelle über 75 % zeigen starke allgemeine Intelligenz für professionelle Anwendungen, während Werte unter 60 % auf Einschränkungen bei komplexen Denkaufgaben hindeuten.

Was misst GPQA und welche Modelle erzielen die höchsten Werte?

GPQA (Graduate-level Google-Proof Q&A) prüft Denken auf Promotionsniveau mit Fragen, die bewusst "Google-proof" sind - sie erfordern tiefes Verständnis statt bloßer Faktenrecherche. Spitzenmodelle wie GPT-5.1 (87,3 %), GPT-5 mini (82,8 %) und o3 (82,7 %) sind bei GPQA besonders stark und eignen sich für Forschung, technische Analysen und komplexe Problemlösung. Modelle unter 50 % GPQA haben oft Schwierigkeiten bei anspruchsvollem Denken und liefern eher oberflächliche Antworten.

Was ist AIME 2025 und wie bewertet es die mathematischen Fähigkeiten von KI?

AIME 2025 (American Invitational Mathematics Examination) ist ein Benchmark auf Wettbewerbsniveau, der fortgeschrittene Problemlösung, Algebra, Geometrie und Zahlentheorie testet. Werte über 80 % (wie GPT-5 Codex mit 98,7 % oder GPT-5.1 mit 94 %) zeigen außergewöhnliches mathematisches Denken für Engineering, Scientific Computing und quantitative Analysen. Modelle unter 50 % können bei mehrstufigen mathematischen Aufgaben Probleme haben oder benötigen eine explizite Aufschlüsselung.

Wie wird die Preisgestaltung von KI-Modellen berechnet und was gilt als kosteneffizient?

Die Preise von KI-Modellen werden pro 1 Million Tokens berechnet (etwa 750.000 Wörter). Input-Preise betreffen den Text, den Sie senden, Output-Preise die generierten Antworten. Günstige Modelle wie Llama 3.3 70B kosten $0.54/$0.71 pro Million Tokens, Mid-Tier-Modelle wie GPT-5 nano $0.05/$0.40, Premium-Modelle wie GPT-5 $1.25/$10. Bei typischen Anwendungen mit einem Input-/Output-Verhältnis von 3:1 können Budget-Modelle 10- bis 20-mal günstiger sein und dennoch 70-80 % der Leistung liefern.

Welche KI-Modelle eignen sich am besten für Coding und Programmierung?

Sortieren Sie nach Coding Index um die besten Programmiermodelle zu sehen. Unser Coding Index kombiniert LiveCodeBench, SciCode und Coding-Benchmarks. Zu den Top-Performern gehören GPT-5.1 (57,5), GPT-5 mini (51,4) und GPT-5 Codex (53,5). Diese Modelle sind stark bei Codegenerierung, Debugging, Refactoring und der Erklärung komplexer Algorithmen. Für kostenbewusste Entwickler bieten Modelle mit 40+ Punkten im Coding Index ein sehr gutes Preis-Leistungs-Verhältnis für Routineaufgaben.

Wie oft werden KI-Modell-Benchmarks und Rankings aktualisiert?

Unser Leaderboard wird täglich mit der Artificial Analysis API synchronisiert, damit Benchmark-Scores (MMLU-Pro, GPQA, AIME 2025), Preise und Inference-Geschwindigkeit die neuesten Modellversionen widerspiegeln. Neue Modell-Releases erscheinen sofort unter der Sortierung "Neueste". Benchmark-Scores können sich ändern, wenn Anbieter aktualisierte Versionen veröffentlichen - zum Beispiel erreichte GPT-5.1 (veröffentlicht im November 2025) 69,7 Intelligenzpunkte gegenüber 68,5 bei GPT-5 aus August 2025.

Welche Inference-Geschwindigkeit (Tokens/Sekunde) brauche ich für meine Anwendung?

Die Inference-Geschwindigkeit bestimmt, wie schnell Modelle Antworten erzeugen. Für Echtzeit-Chatbots und interaktive Anwendungen sind 100+ Tokens/Sekunde sinnvoll (z. B. gpt-oss-120B mit 340 tok/s). Für Hintergrundverarbeitung und Batch-Jobs reichen 50-100 tok/s. Premium-Reasoning-Modelle wie GPT-5 (103 tok/s) balancieren Geschwindigkeit und Fähigkeiten. Wichtig: Höhere Geschwindigkeit bedeutet nicht automatisch bessere Qualität - langsamere Modelle liefern oft durchdachtere, detailliertere Antworten.

Kann ich diese KI-Modelle kostenlos testen, bevor ich mich entscheide?

Ja! Probieren Sie unsere kostenlose KI-Chatoberfläche aus, um verschiedene Modelle sofort ohne Account zu testen. Viele Anbieter haben ebenfalls kostenlose Stufen: OpenAI (ChatGPT mit Tageslimits), Anthropic (Claude mit Nutzungslimits), Google (Gemini Free Tier) und Open-Source-Modelle wie Llama 3.3. Vergleichen Sie die Leistung für Ihren konkreten Use Case, bevor Sie auf bezahlte Pläne wechseln.