KI-Modell-Ranking (LLM-Leaderboard)

Günstigste KI-Modelle

Language models ranked by Artificial Analysis Index

Modell
Name des KI-Modells und Anbieterorganisation
Intelligenz
Artificial Analysis Intelligence Index - composite reasoning and capability score across the benchmark suite
Value Score
Qualität, Geschwindigkeit und gemischter Token-Preis als relativer Wert-Score
Speed
Inference-Durchsatz in Tokens pro Sekunde - wie schnell das Modell Antworten generiert
Google KI-Anbieter-Logo - Gemma 4 E4B (Non-reasoning)
#1 Gemma 4 E4B (Non-reasoning)
von Google · 3. Apr. 2026
3.31241 tok/s
Meta KI-Anbieter-Logo - Llama 3.1 Instruct 8B
#2 Llama 3.1 Instruct 8B
von Meta · 23. Juli 2024
2.014140 tok/s
Google KI-Anbieter-Logo - Gemma 4 E4B (Reasoning)
#3 Gemma 4 E4B (Reasoning)
von Google · 3. Apr. 2026
6.42339 tok/s
IBM KI-Anbieter-Logo - Granite 4.2 3B
#4 Granite 4.2 3B
von IBM · 25. Aug. 2026
10.756211 tok/s
IBM KI-Anbieter-Logo - Granite 3.3 8B (Non-reasoning)
#5 Granite 3.3 8B (Non-reasoning)
von IBM · 16. Apr. 2025
1.0216 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.5 4B (Non-reasoning)
#6 Qwen3.5 4B (Non-reasoning)
von Alibaba · 2. März 2026
10.02918 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.5 4B (Reasoning)
#7 Qwen3.5 4B (Reasoning)
von Alibaba · 2. März 2026
13.94123 tok/s
Sarvam KI-Anbieter-Logo - 30B (high)
#8 30B (high)
von Sarvam · 6. März 2026
1.15k. A.
Multiverse Computing KI-Anbieter-Logo - HyperNova 60B 2605 (high, based on gpt-oss-120b)
#9 HyperNova 60B 2605 (high, based on gpt-oss-120b)
von Multiverse Computing · 26. Mai 2026
11.755345 tok/s
Amazon KI-Anbieter-Logo - Nova Micro
#10 Nova Micro
von Amazon · 3. Dez. 2024
1.05278 tok/s
Sarvam KI-Anbieter-Logo - 105B (high)
#11 105B (high)
von Sarvam · 6. März 2026
6.222k. A.
Meta KI-Anbieter-Logo - Llama 3 Instruct 8B
#12 Llama 3 Instruct 8B
von Meta · 18. Apr. 2024
1.04k. A.
NVIDIA KI-Anbieter-Logo - Nemotron Nano 9B V2 (Reasoning)
#13 Nemotron Nano 9B V2 (Reasoning)
von NVIDIA · 18. Aug. 2025
3.2981 tok/s
OpenAI KI-Anbieter-Logo - GPT-5 nano (minimal)
#14 GPT-5 nano (minimal)
von OpenAI · 7. Aug. 2025
2.48156 tok/s
NVIDIA KI-Anbieter-Logo - Nemotron 3 Nano 30B A3B (Non-reasoning)
#15 Nemotron 3 Nano 30B A3B (Non-reasoning)
von NVIDIA · 15. Dez. 2025
1.87157 tok/s
NVIDIA KI-Anbieter-Logo - Nemotron Nano 9B V2 (Non-reasoning)
#16 Nemotron Nano 9B V2 (Non-reasoning)
von NVIDIA · 18. Aug. 2025
1.87134 tok/s
Alibaba KI-Anbieter-Logo - Qwen2.5 Turbo
#17 Qwen2.5 Turbo
von Alibaba · 18. Nov. 2024
1.03104 tok/s
NVIDIA KI-Anbieter-Logo - Nemotron 3 Nano 30B A3B (Reasoning)
#18 Nemotron 3 Nano 30B A3B (Reasoning)
von NVIDIA · 15. Dez. 2025
8.635159 tok/s
IBM KI-Anbieter-Logo - Granite 4.1 8B
#19 Granite 4.1 8B
von IBM · 29. Apr. 2026
1.15115 tok/s
OpenAI KI-Anbieter-Logo - GPT-5 nano (medium)
#20 GPT-5 nano (medium)
von OpenAI · 7. Aug. 2025
12.942163 tok/s
OpenAI KI-Anbieter-Logo - GPT-5 nano (high)
#21 GPT-5 nano (high)
von OpenAI · 7. Aug. 2025
13.744146 tok/s
Meta KI-Anbieter-Logo - Llama 2 Chat 7B
#22 Llama 2 Chat 7B
von Meta · 18. Juli 2023
1.03k. A.
NVIDIA KI-Anbieter-Logo - Nemotron 3.5 Lightning
#23 Nemotron 3.5 Lightning
von NVIDIA · 11. Aug. 2026
16.464296 tok/s
OpenAI KI-Anbieter-Logo - gpt-oss-20b (high)
#24 gpt-oss-20b (high)
von OpenAI · 5. Aug. 2025
9.136168 tok/s
Amazon KI-Anbieter-Logo - Nova Lite
#25 Nova Lite
von Amazon · 3. Dez. 2024
1.45168 tok/s
IBM KI-Anbieter-Logo - Granite 4.0 H Small
#26 Granite 4.0 H Small
von IBM · 22. Sept. 2025
1.0226 tok/s
Tencent KI-Anbieter-Logo - Hy3-preview (Reasoning)
#27 Hy3-preview (Reasoning)
von Tencent · 23. Apr. 2026
26.882k. A.
IBM KI-Anbieter-Logo - Granite 4.2 8B
#28 Granite 4.2 8B
von IBM · 25. Aug. 2026
13.951143 tok/s
Tencent KI-Anbieter-Logo - Hy3-preview (Non-reasoning)
#29 Hy3-preview (Non-reasoning)
von Tencent · 23. Apr. 2026
19.660k. A.
OpenAI KI-Anbieter-Logo - gpt-oss-20b (low)
#30 gpt-oss-20b (low)
von OpenAI · 5. Aug. 2025
8.431227 tok/s
Z AI KI-Anbieter-Logo - GLM-4.7-Flash (Reasoning)
#31 GLM-4.7-Flash (Reasoning)
von Z AI · 19. Jan. 2026
16.63484 tok/s
NVIDIA KI-Anbieter-Logo - Nemotron 3 Nano Omni 30B A3B Reasoning
#32 Nemotron 3 Nano Omni 30B A3B Reasoning
von NVIDIA · 29. Apr. 2026
9.030328 tok/s
Z AI KI-Anbieter-Logo - GLM-4.7-Flash (Non-reasoning)
#33 GLM-4.7-Flash (Non-reasoning)
von Z AI · 19. Jan. 2026
9.627116 tok/s
InclusionAI KI-Anbieter-Logo - Ling 3.0 Flash
#34 Ling 3.0 Flash
von InclusionAI · 4. Aug. 2026
27.4100328 tok/s
DeepSeek KI-Anbieter-Logo - V4 Flash (Non-reasoning)
#35 V4 Flash (Non-reasoning)
von DeepSeek · 24. Apr. 2026
22.162k. A.
Google KI-Anbieter-Logo - Gemma 4 12B (Non-reasoning)
#36 Gemma 4 12B (Non-reasoning)
von Google · 3. Juni 2026
7.320110 tok/s
StepFun KI-Anbieter-Logo - Step 3.5 Flash 2603
#37 Step 3.5 Flash 2603
von StepFun · 2. Apr. 2026
19.560217 tok/s
Google KI-Anbieter-Logo - Gemini 2.5 Flash-Lite (Non-reasoning)
#38 Gemini 2.5 Flash-Lite (Non-reasoning)
von Google · 17. Juni 2025
1.44319 tok/s
Mistral KI-Anbieter-Logo - Small 3.1
#39 Small 3.1
von Mistral · 17. März 2025
8.627151 tok/s
Mistral KI-Anbieter-Logo - Small 3.2
#40 Small 3.2
von Mistral · 20. Juni 2025
5.015136 tok/s
Mistral KI-Anbieter-Logo - Ministral 3 3B
#41 Ministral 3 3B
von Mistral · 2. Dez. 2025
1.76216 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.5 Omni Flash
#42 Qwen3.5 Omni Flash
von Alibaba · 30. März 2026
12.929236 tok/s
Google KI-Anbieter-Logo - Gemini 2.5 Flash-Lite Preview (Sep '25) (Non-reasoning)
#43 Gemini 2.5 Flash-Lite Preview (Sep '25) (Non-reasoning)
von Google · 25. Sept. 2025
7.317k. A.
OpenAI KI-Anbieter-Logo - GPT-4.1 nano
#44 GPT-4.1 nano
von OpenAI · 14. Apr. 2025
4.111119 tok/s
Google KI-Anbieter-Logo - Gemini 2.5 Flash-Lite Preview (Sep '25) (Reasoning)
#45 Gemini 2.5 Flash-Lite Preview (Sep '25) (Reasoning)
von Google · 8. Sept. 2025
9.221k. A.
Swiss AI Initiative KI-Anbieter-Logo - Apertus 8B Instruct
#46 Apertus 8B Instruct
von Swiss AI Initiative · 2. Sept. 2025
1.03k. A.
Allen Institute for AI KI-Anbieter-Logo - Olmo 3 7B Instruct
#47 Olmo 3 7B Instruct
von Allen Institute for AI · 20. Nov. 2025
1.03k. A.
Xiaomi KI-Anbieter-Logo - MiMo-V2-Flash (Reasoning)
#48 MiMo-V2-Flash (Reasoning)
von Xiaomi · 16. Dez. 2025
24.561k. A.
StepFun KI-Anbieter-Logo - Step 3.5 Flash
#49 Step 3.5 Flash
von StepFun · 2. Feb. 2026
19.159224 tok/s
Mistral KI-Anbieter-Logo - Small 3
#50 Small 3
von Mistral · 30. Jan. 2025
1.44141 tok/s
Sapiens AI KI-Anbieter-Logo - Agnes 2.5 Pro Beta
#51 Agnes 2.5 Pro Beta
von Sapiens AI · 26. Aug. 2026
39.598k. A.
Google KI-Anbieter-Logo - Gemini 2.5 Flash-Lite (Reasoning)
#52 Gemini 2.5 Flash-Lite (Reasoning)
von Google · 17. Juni 2025
5.616373 tok/s
Google KI-Anbieter-Logo - Gemma 4 12B (Reasoning)
#53 Gemma 4 12B (Reasoning)
von Google · 3. Juni 2026
15.643112 tok/s
Google KI-Anbieter-Logo - Gemma 4 26B A4B (Reasoning)
#54 Gemma 4 26B A4B (Reasoning)
von Google · 2. Apr. 2026
19.243k. A.
Nous Research KI-Anbieter-Logo - Hermes 4 - Llama-3.1 70B (Non-reasoning)
#55 Hermes 4 - Llama-3.1 70B (Non-reasoning)
von Nous Research · 27. Aug. 2025
1.3284 tok/s
Nous Research KI-Anbieter-Logo - Hermes 4 - Llama-3.1 70B (Reasoning)
#56 Hermes 4 - Llama-3.1 70B (Reasoning)
von Nous Research · 27. Aug. 2025
4.3886 tok/s
Google KI-Anbieter-Logo - Gemma 4 26B A4B (Non-reasoning)
#57 Gemma 4 26B A4B (Non-reasoning)
von Google · 2. Apr. 2026
13.92377 tok/s
DeepSeek KI-Anbieter-Logo - V4 Flash (Reasoning, High Effort)
#58 V4 Flash (Reasoning, High Effort)
von DeepSeek · 24. Apr. 2026
30.471k. A.
DeepSeek KI-Anbieter-Logo - V4 Flash (Reasoning, Max Effort)
#59 V4 Flash (Reasoning, Max Effort)
von DeepSeek · 24. Apr. 2026
33.177k. A.
Microsoft KI-Anbieter-Logo - Phi-4
#60 Phi-4
von Microsoft · 12. Dez. 2024
1.0237 tok/s
Xiaomi KI-Anbieter-Logo - MiMo-V2.5
#61 MiMo-V2.5
von Xiaomi · 22. Apr. 2026
29.55152 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.5 9B (Reasoning)
#62 Qwen3.5 9B (Reasoning)
von Alibaba · 2. März 2026
14.82982 tok/s
InclusionAI KI-Anbieter-Logo - Ring-flash-2.0
#63 Ring-flash-2.0
von InclusionAI · 19. Sept. 2025
2.65k. A.
InclusionAI KI-Anbieter-Logo - Ling-flash-2.0
#64 Ling-flash-2.0
von InclusionAI · 17. Sept. 2025
4.165 tok/s
Tencent KI-Anbieter-Logo - Hy3
#65 Hy3
von Tencent · 6. Juli 2026
33.26295 tok/s
Google KI-Anbieter-Logo - Gemma 4 31B (Non-reasoning)
#66 Gemma 4 31B (Non-reasoning)
von Google · 2. Apr. 2026
15.22457 tok/s
Mistral KI-Anbieter-Logo - Small 4 (Non-reasoning)
#67 Small 4 (Non-reasoning)
von Mistral · 16. März 2026
6.615148 tok/s
Z AI KI-Anbieter-Logo - GLM-5.3-Flash
#68 GLM-5.3-Flash
von Z AI · 26. Aug. 2026
46.26847 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 Next 80B A3B Instruct
#69 Qwen3 Next 80B A3B Instruct
von Alibaba · 11. Sept. 2025
7.815175 tok/s
Mistral KI-Anbieter-Logo - Small (Feb '24)
#70 Small (Feb '24)
von Mistral · 26. Feb. 2024
1.02146 tok/s
Mistral KI-Anbieter-Logo - Small 4 (Reasoning)
#71 Small 4 (Reasoning)
von Mistral · 16. März 2026
12.830163 tok/s
Mistral KI-Anbieter-Logo - Ministral 3 8B
#72 Ministral 3 8B
von Mistral · 2. Dez. 2025
3.5896 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.8-Flash-Next
#73 Qwen3.8-Flash-Next
von Alibaba · 26. Aug. 2026
45.66866 tok/s
OpenAI KI-Anbieter-Logo - GPT-4o mini
#74 GPT-4o mini
von OpenAI · 18. Juli 2024
1.43138 tok/s
Upstage KI-Anbieter-Logo - Solar Pro 3
#75 Solar Pro 3
von Upstage · 6. Apr. 2026
8.520130 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 Next 80B A3B (Reasoning)
#76 Qwen3 Next 80B A3B (Reasoning)
von Alibaba · 11. Sept. 2025
10.720191 tok/s
OpenAI KI-Anbieter-Logo - gpt-oss-120b (low)
#77 gpt-oss-120b (low)
von OpenAI · 5. Aug. 2025
8.921189 tok/s
Upstage KI-Anbieter-Logo - Solar Mini
#78 Solar Mini
von Upstage · 25. Jan. 2024
1.02k. A.
OpenAI KI-Anbieter-Logo - gpt-oss-120b (high)
#79 gpt-oss-120b (high)
von OpenAI · 5. Aug. 2025
15.637162 tok/s
IBM KI-Anbieter-Logo - Granite 4.2 30B
#80 Granite 4.2 30B
von IBM · 25. Aug. 2026
16.52376 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 VL 32B Instruct
#81 Qwen3 VL 32B Instruct
von Alibaba · 21. Okt. 2025
5.3773 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 32B (Reasoning)
#82 Qwen3 32B (Reasoning)
von Alibaba · 28. Apr. 2025
5.711103 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 32B (Non-reasoning)
#83 Qwen3 32B (Non-reasoning)
von Alibaba · 28. Apr. 2025
3.06105 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 VL 32B (Reasoning)
#84 Qwen3 VL 32B (Reasoning)
von Alibaba · 21. Okt. 2025
11.91989 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.5 9B (Non-reasoning)
#85 Qwen3.5 9B (Non-reasoning)
von Alibaba · 2. März 2026
14.12786 tok/s
Z AI KI-Anbieter-Logo - GLM-4.5-Air
#86 GLM-4.5-Air
von Z AI · 28. Juli 2025
10.51274 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 VL 8B Instruct
#87 Qwen3 VL 8B Instruct
von Alibaba · 14. Okt. 2025
2.85113 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 8B (Reasoning)
#88 Qwen3 8B (Reasoning)
von Alibaba · 28. Apr. 2025
2.8239 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 8B (Non-reasoning)
#89 Qwen3 8B (Non-reasoning)
von Alibaba · 28. Apr. 2025
1.0140 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 VL 8B (Reasoning)
#90 Qwen3 VL 8B (Reasoning)
von Alibaba · 14. Okt. 2025
4.97114 tok/s
Meta KI-Anbieter-Logo - Llama 4 Scout
#91 Llama 4 Scout
von Meta · 5. Apr. 2025
4.6787 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Luna (low)
#92 GPT-5.6 Luna (low)
von OpenAI · 9. Juli 2026
25.841110 tok/s
SpaceXAI KI-Anbieter-Logo - Grok 4 Fast (Non-reasoning)
#93 Grok 4 Fast (Non-reasoning)
von SpaceXAI · 19. Sept. 2025
10.519k. A.
Alibaba KI-Anbieter-Logo - Qwen3 30B A3B (Reasoning)
#94 Qwen3 30B A3B (Reasoning)
von Alibaba · 28. Apr. 2025
3.64106 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Luna (max)
#95 GPT-5.6 Luna (max)
von OpenAI · 9. Juli 2026
43.477133 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 VL 30B A3B Instruct
#96 Qwen3 VL 30B A3B Instruct
von Alibaba · 3. Okt. 2025
4.38111 tok/s
AI21 Labs KI-Anbieter-Logo - Jamba 1.5 Mini
#97 Jamba 1.5 Mini
von AI21 Labs · 22. Aug. 2024
1.02k. A.
SpaceXAI KI-Anbieter-Logo - Grok 4 Fast (Reasoning)
#98 Grok 4 Fast (Reasoning)
von SpaceXAI · 19. Sept. 2025
20.838k. A.
OpenAI KI-Anbieter-Logo - GPT-5.6 Luna (medium)
#99 GPT-5.6 Luna (medium)
von OpenAI · 9. Juli 2026
30.246107 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 30B A3B 2507 (Reasoning)
#100 Qwen3 30B A3B 2507 (Reasoning)
von Alibaba · 30. Juli 2025
8.612154 tok/s

Zeige 100 von 415 Modelle

Das KI-Modell-Leaderboard verstehen

Dieses umfassende KI-Modell-Leaderboard hilft Ihnen, zu vergleichen und auszuwählen die besten Large Language Models (LLMs) für Ihre Anforderungen. Wir erfassen standardisierte KI-Benchmarks, Token-Preise, Inference-Geschwindigkeit und Modellfähigkeiten bei allen großen KI-Anbietern wie OpenAI, Anthropic, Google, Meta, und DeepSeek.

Kern-KI-Benchmarks erklärt

MMLU-ProTestet breites Wissen über 14 akademische Fachbereiche
GPQADenken & Problemlösung auf Promotionsniveau
AIME 2025Mathematisches Denken auf Spitzenniveau
Coding IndexLiveCodeBench + SciCode kombiniert
Math IndexAIME + MATH-500 kombiniert

Wichtige Kennzahlen

Token-PreisgestaltungInput- vs. Output-Kosten pro 1 Mio. Tokens
Inference-GeschwindigkeitTokens/Sekunde für Antwortzeit
VeröffentlichungsdatumNeueste Techniken & Wissensstand
Benchmark-ScoresFähigkeitsvergleich von 0-100 %

So wählen Sie das richtige KI-Modell für Ihren Use Case

Für Forschung & Analyse

Priorisieren Sie Modelle mit hohen MMLU-Pro- (70 %+) und GPQA-Werten (60 %+), wenn es um komplexe Denkaufgaben, wissenschaftliche Recherche und technische Dokumentation geht

Für Kostenoptimierung

Sortieren Sie nach Input-/Output-Preisen - kleinere Modelle liefern bei einfachen Aufgaben oft 80 % der Flaggschiff-Leistung zu 10 % der Kosten

Für Mathe & MINT

Filtern Sie nach Math-Index oder AIME-2025-Scores (50 %+) für quantitative Analysen, Engineering-Berechnungen und wissenschaftliche Anwendungen

Alle Benchmark-Scores und Preisdaten werden täglich von Artificial Analysis aktualisiert, um die neuesten Modellversionen und Fähigkeiten abzubilden. Nutzen Sie die Sortierfilter oben, um KI-Modelle nach Intelligenz, Kosten, Coding-Fähigkeit, Mathe-Leistung, Geschwindigkeit oder Veröffentlichungsdatum zu finden.

Häufig gestellte Fragen

Was ist MMLU-Pro und warum gilt es als Standard-Benchmark für KI-Intelligenz?

MMLU-Pro (Massive Multitask Language Understanding - Professional) ist der umfassendste KI-Benchmark und testet Modelle in 14 akademischen Fachbereichen, darunter Mathematik, Naturwissenschaften, Geschichte, Recht und Ethik. Die Werte reichen von 46 % (Grundkompetenz) bis 87 % (nahe Expertenniveau). Modelle über 75 % zeigen starke allgemeine Intelligenz für professionelle Anwendungen, während Werte unter 60 % auf Einschränkungen bei komplexen Denkaufgaben hindeuten.

Was misst GPQA und welche Modelle erzielen die höchsten Werte?

GPQA (Graduate-level Google-Proof Q&A) prüft Denken auf Promotionsniveau mit Fragen, die bewusst "Google-proof" sind - sie erfordern tiefes Verständnis statt bloßer Faktenrecherche. Spitzenmodelle wie GPT-5.1 (87,3 %), GPT-5 mini (82,8 %) und o3 (82,7 %) sind bei GPQA besonders stark und eignen sich für Forschung, technische Analysen und komplexe Problemlösung. Modelle unter 50 % GPQA haben oft Schwierigkeiten bei anspruchsvollem Denken und liefern eher oberflächliche Antworten.

Was ist AIME 2025 und wie bewertet es die mathematischen Fähigkeiten von KI?

AIME 2025 (American Invitational Mathematics Examination) ist ein Benchmark auf Wettbewerbsniveau, der fortgeschrittene Problemlösung, Algebra, Geometrie und Zahlentheorie testet. Werte über 80 % (wie GPT-5 Codex mit 98,7 % oder GPT-5.1 mit 94 %) zeigen außergewöhnliches mathematisches Denken für Engineering, Scientific Computing und quantitative Analysen. Modelle unter 50 % können bei mehrstufigen mathematischen Aufgaben Probleme haben oder benötigen eine explizite Aufschlüsselung.

Wie wird die Preisgestaltung von KI-Modellen berechnet und was gilt als kosteneffizient?

Die Preise von KI-Modellen werden pro 1 Million Tokens berechnet (etwa 750.000 Wörter). Input-Preise betreffen den Text, den Sie senden, Output-Preise die generierten Antworten. Günstige Modelle wie Llama 3.3 70B kosten $0.54/$0.71 pro Million Tokens, Mid-Tier-Modelle wie GPT-5 nano $0.05/$0.40, Premium-Modelle wie GPT-5 $1.25/$10. Bei typischen Anwendungen mit einem Input-/Output-Verhältnis von 3:1 können Budget-Modelle 10- bis 20-mal günstiger sein und dennoch 70-80 % der Leistung liefern.

Welche KI-Modelle eignen sich am besten für Coding und Programmierung?

Sortieren Sie nach Coding Index um die besten Programmiermodelle zu sehen. Unser Coding Index kombiniert LiveCodeBench, SciCode und Coding-Benchmarks. Zu den Top-Performern gehören GPT-5.1 (57,5), GPT-5 mini (51,4) und GPT-5 Codex (53,5). Diese Modelle sind stark bei Codegenerierung, Debugging, Refactoring und der Erklärung komplexer Algorithmen. Für kostenbewusste Entwickler bieten Modelle mit 40+ Punkten im Coding Index ein sehr gutes Preis-Leistungs-Verhältnis für Routineaufgaben.

Wie oft werden KI-Modell-Benchmarks und Rankings aktualisiert?

Unser Leaderboard wird täglich mit der Artificial Analysis API synchronisiert, damit Benchmark-Scores (MMLU-Pro, GPQA, AIME 2025), Preise und Inference-Geschwindigkeit die neuesten Modellversionen widerspiegeln. Neue Modell-Releases erscheinen sofort unter der Sortierung "Neueste". Benchmark-Scores können sich ändern, wenn Anbieter aktualisierte Versionen veröffentlichen - zum Beispiel erreichte GPT-5.1 (veröffentlicht im November 2025) 69,7 Intelligenzpunkte gegenüber 68,5 bei GPT-5 aus August 2025.

Welche Inference-Geschwindigkeit (Tokens/Sekunde) brauche ich für meine Anwendung?

Die Inference-Geschwindigkeit bestimmt, wie schnell Modelle Antworten erzeugen. Für Echtzeit-Chatbots und interaktive Anwendungen sind 100+ Tokens/Sekunde sinnvoll (z. B. gpt-oss-120B mit 340 tok/s). Für Hintergrundverarbeitung und Batch-Jobs reichen 50-100 tok/s. Premium-Reasoning-Modelle wie GPT-5 (103 tok/s) balancieren Geschwindigkeit und Fähigkeiten. Wichtig: Höhere Geschwindigkeit bedeutet nicht automatisch bessere Qualität - langsamere Modelle liefern oft durchdachtere, detailliertere Antworten.

Kann ich diese KI-Modelle kostenlos testen, bevor ich mich entscheide?

Ja! Probieren Sie unsere kostenlose KI-Chatoberfläche aus, um verschiedene Modelle sofort ohne Account zu testen. Viele Anbieter haben ebenfalls kostenlose Stufen: OpenAI (ChatGPT mit Tageslimits), Anthropic (Claude mit Nutzungslimits), Google (Gemini Free Tier) und Open-Source-Modelle wie Llama 3.3. Vergleichen Sie die Leistung für Ihren konkreten Use Case, bevor Sie auf bezahlte Pläne wechseln.