KI-Modell-Ranking (LLM-Leaderboard)

Beste KI-Mathe-Modelle

Language models ranked by Artificial Analysis Index

Modell
Name des KI-Modells und Anbieterorganisation
Intelligenz
Artificial Analysis Intelligence Index - composite reasoning and capability score across the benchmark suite
Value Score
Qualität, Geschwindigkeit und gemischter Token-Preis als relativer Wert-Score
Speed
Inference-Durchsatz in Tokens pro Sekunde - wie schnell das Modell Antworten generiert
OpenAI KI-Anbieter-Logo - GPT-5.2 (xhigh)
#1 GPT-5.2 (xhigh)
von OpenAI · 11. Dez. 2025
42.21587 tok/s
OpenAI KI-Anbieter-Logo - GPT-5 Codex (high)
#2 GPT-5 Codex (high)
von OpenAI · 23. Sept. 2025
36.122173 tok/s
Google KI-Anbieter-Logo - Gemini 3 Flash Preview (Reasoning)
#3 Gemini 3 Flash Preview (Reasoning)
von Google · 17. Dez. 2025
37.840230 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.2 (medium)
#4 GPT-5.2 (medium)
von OpenAI · 11. Dez. 2025
38.012k. A.
DeepSeek KI-Anbieter-Logo - V3.2 Speciale
#5 V3.2 Speciale
von DeepSeek · 1. Dez. 2025
22.2k. A.k. A.
Xiaomi KI-Anbieter-Logo - MiMo-V2-Flash (Reasoning)
#6 MiMo-V2-Flash (Reasoning)
von Xiaomi · 16. Dez. 2025
31.255k. A.
OpenAI KI-Anbieter-Logo - GPT-5.1 Codex (high)
#7 GPT-5.1 Codex (high)
von OpenAI · 13. Nov. 2025
34.721213 tok/s
Google KI-Anbieter-Logo - Gemini 3 Pro Preview (high)
#8 Gemini 3 Pro Preview (high)
von Google · 18. Nov. 2025
39.613k. A.
Z AI KI-Anbieter-Logo - GLM-4.7 (Reasoning)
#9 GLM-4.7 (Reasoning)
von Z AI · 22. Dez. 2025
33.735117 tok/s
KwaiKAT KI-Anbieter-Logo - KAT-Coder-Pro V1
#10 KAT-Coder-Pro V1
von KwaiKAT · 11. Nov. 2025
28.3k. A.k. A.
Kimi KI-Anbieter-Logo - K2 Thinking
#11 K2 Thinking
von Kimi · 6. Nov. 2025
32.736131 tok/s
Amazon KI-Anbieter-Logo - Nova 2.0 Lite (high)
#12 Nova 2.0 Lite (high)
von Amazon · 29. Okt. 2025
18.222194 tok/s
OpenAI KI-Anbieter-Logo - GPT-5 (high)
#13 GPT-5 (high)
von OpenAI · 7. Aug. 2025
34.719111 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.1 (high)
#14 GPT-5.1 (high)
von OpenAI · 13. Nov. 2025
36.920110 tok/s
OpenAI KI-Anbieter-Logo - gpt-oss-120b (high)
#15 gpt-oss-120b (high)
von OpenAI · 5. Aug. 2025
23.852297 tok/s
SpaceXAI KI-Anbieter-Logo - Grok 4
#16 Grok 4
von SpaceXAI · 10. Juli 2025
33.37k. A.
DeepSeek KI-Anbieter-Logo - V3.2 (Reasoning)
#17 V3.2 (Reasoning)
von DeepSeek · 1. Dez. 2025
32.039k. A.
OpenAI KI-Anbieter-Logo - GPT-5 (medium)
#18 GPT-5 (medium)
von OpenAI · 7. Aug. 2025
33.717103 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.1 Codex mini (high)
#19 GPT-5.1 Codex mini (high)
von OpenAI · 13. Nov. 2025
30.642210 tok/s
Anthropic KI-Anbieter-Logo - Claude Opus 4.5 (Reasoning)
#20 Claude Opus 4.5 (Reasoning)
von Anthropic · 24. Nov. 2025
40.8970 tok/s
NVIDIA KI-Anbieter-Logo - Nemotron 3 Nano 30B A3B (Reasoning)
#21 Nemotron 3 Nano 30B A3B (Reasoning)
von NVIDIA · 15. Dez. 2025
14.254161 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 235B A22B 2507 (Reasoning)
#22 Qwen3 235B A22B 2507 (Reasoning)
von Alibaba · 25. Juli 2025
19.6980 tok/s
OpenAI KI-Anbieter-Logo - GPT-5 mini (high)
#23 GPT-5 mini (high)
von OpenAI · 7. Aug. 2025
25.330111 tok/s
OpenAI KI-Anbieter-Logo - o4-mini (high)
#24 o4-mini (high)
von OpenAI · 16. Apr. 2025
25.621179 tok/s
LG AI Research KI-Anbieter-Logo - K-EXAONE (Reasoning)
#25 K-EXAONE (Reasoning)
von LG AI Research · 31. Dez. 2025
24.7k. A.k. A.
Amazon KI-Anbieter-Logo - Nova 2.0 Omni (medium)
#26 Nova 2.0 Omni (medium)
von Amazon · 26. Nov. 2025
20.915k. A.
DeepSeek KI-Anbieter-Logo - V3.1 (Reasoning)
#27 V3.1 (Reasoning)
von DeepSeek · 21. Aug. 2025
20.715k. A.
DeepSeek KI-Anbieter-Logo - V3.1 Terminus (Reasoning)
#28 V3.1 Terminus (Reasoning)
von DeepSeek · 22. Sept. 2025
30.415k. A.
SpaceXAI KI-Anbieter-Logo - Grok 4 Fast (Reasoning)
#29 Grok 4 Fast (Reasoning)
von SpaceXAI · 19. Sept. 2025
27.435k. A.
OpenAI KI-Anbieter-Logo - gpt-oss-20b (high)
#30 gpt-oss-20b (high)
von OpenAI · 5. Aug. 2025
14.957253 tok/s
SpaceXAI KI-Anbieter-Logo - Grok 4.1 Fast (Reasoning)
#31 Grok 4.1 Fast (Reasoning)
von SpaceXAI · 19. Nov. 2025
30.6k. A.k. A.
InclusionAI KI-Anbieter-Logo - Ring-1T
#32 Ring-1T
von InclusionAI · 13. Okt. 2025
16.2k. A.k. A.
Amazon KI-Anbieter-Logo - Nova 2.0 Pro Preview (medium)
#33 Nova 2.0 Pro Preview (medium)
von Amazon · 27. Nov. 2025
21.813134 tok/s
Amazon KI-Anbieter-Logo - Nova 2.0 Lite (medium)
#34 Nova 2.0 Lite (medium)
von Amazon · 29. Okt. 2025
19.023216 tok/s
OpenAI KI-Anbieter-Logo - o3
#35 o3
von OpenAI · 16. Apr. 2025
30.418155 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 VL 235B A22B (Reasoning)
#36 Qwen3 VL 235B A22B (Reasoning)
von Alibaba · 23. Sept. 2025
20.6959 tok/s
Prime Intellect KI-Anbieter-Logo - INTELLECT-3
#37 INTELLECT-3
von Prime Intellect · 27. Nov. 2025
15.6k. A.k. A.
ServiceNow KI-Anbieter-Logo - Apriel-v1.6-15B-Thinker
#38 Apriel-v1.6-15B-Thinker
von ServiceNow · 25. Nov. 2025
20.5k. A.k. A.
Anthropic KI-Anbieter-Logo - Claude 4.5 Sonnet (Reasoning)
#39 Claude 4.5 Sonnet (Reasoning)
von Anthropic · 29. Sept. 2025
36.41067 tok/s
Google KI-Anbieter-Logo - Gemini 2.5 Pro
#40 Gemini 2.5 Pro
von Google · 5. Juni 2025
25.816148 tok/s
DeepSeek KI-Anbieter-Logo - V3.2 Exp (Reasoning)
#41 V3.2 Exp (Reasoning)
von DeepSeek · 29. Sept. 2025
25.431k. A.
ServiceNow KI-Anbieter-Logo - Apriel-v1.5-15B-Thinker
#42 Apriel-v1.5-15B-Thinker
von ServiceNow · 30. Sept. 2025
21.2k. A.k. A.
Google KI-Anbieter-Logo - Gemini 3 Pro Preview (low)
#43 Gemini 3 Pro Preview (low)
von Google · 18. Nov. 2025
33.111k. A.
Z AI KI-Anbieter-Logo - GLM-4.6 (Reasoning)
#44 GLM-4.6 (Reasoning)
von Z AI · 30. Sept. 2025
28.72046 tok/s
Z AI KI-Anbieter-Logo - GLM-4.6V (Reasoning)
#45 GLM-4.6V (Reasoning)
von Z AI · 8. Dez. 2025
16.81761 tok/s
Baidu KI-Anbieter-Logo - ERNIE 5.0 Thinking Preview
#46 ERNIE 5.0 Thinking Preview
von Baidu · 13. Nov. 2025
21.9k. A.k. A.
OpenAI KI-Anbieter-Logo - GPT-5 mini (medium)
#47 GPT-5 mini (medium)
von OpenAI · 7. Aug. 2025
30.93399 tok/s
SpaceXAI KI-Anbieter-Logo - Grok 3 mini Reasoning (high)
#48 Grok 3 mini Reasoning (high)
von SpaceXAI · 19. Feb. 2025
22.52641 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 VL 32B (Reasoning)
#49 Qwen3 VL 32B (Reasoning)
von Alibaba · 21. Okt. 2025
17.91096 tok/s
ByteDance Seed KI-Anbieter-Logo - Seed-OSS-36B-Instruct
#50 Seed-OSS-36B-Instruct
von ByteDance Seed · 20. Aug. 2025
18.32334 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 Next 80B A3B (Reasoning)
#51 Qwen3 Next 80B A3B (Reasoning)
von Alibaba · 11. Sept. 2025
16.714177 tok/s
Anthropic KI-Anbieter-Logo - Claude 4.5 Haiku (Reasoning)
#52 Claude 4.5 Haiku (Reasoning)
von Anthropic · 15. Okt. 2025
29.624151 tok/s
InclusionAI KI-Anbieter-Logo - Ring-flash-2.0
#53 Ring-flash-2.0
von InclusionAI · 19. Sept. 2025
8.211k. A.
OpenAI KI-Anbieter-Logo - GPT-5 nano (high)
#54 GPT-5 nano (high)
von OpenAI · 7. Aug. 2025
19.961178 tok/s
OpenAI KI-Anbieter-Logo - GPT-5 (low)
#55 GPT-5 (low)
von OpenAI · 7. Aug. 2025
31.21494 tok/s
MiniMax KI-Anbieter-Logo - M2.1
#56 M2.1
von MiniMax · 23. Dez. 2025
31.43487 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 4B 2507 (Reasoning)
#57 Qwen3 4B 2507 (Reasoning)
von Alibaba · 6. Aug. 2025
12.0k. A.k. A.
Alibaba KI-Anbieter-Logo - Qwen3 VL 30B A3B (Reasoning)
#58 Qwen3 VL 30B A3B (Reasoning)
von Alibaba · 3. Okt. 2025
13.317123 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 Max Thinking (Preview)
#59 Qwen3 Max Thinking (Preview)
von Alibaba · 3. Nov. 2025
25.01163 tok/s
Mistral KI-Anbieter-Logo - Magistral Medium 1.2
#60 Magistral Medium 1.2
von Mistral · 18. Sept. 2025
17.9742 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 235B A22B (Reasoning)
#61 Qwen3 235B A22B (Reasoning)
von Alibaba · 28. Apr. 2025
13.4662 tok/s
Z AI KI-Anbieter-Logo - GLM-4.5-Air
#62 GLM-4.5-Air
von Z AI · 28. Juli 2025
16.51871 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 Max
#63 Qwen3 Max
von Alibaba · 23. Sept. 2025
24.01057 tok/s
Mistral KI-Anbieter-Logo - Magistral Small 1.2
#64 Magistral Small 1.2
von Mistral · 17. Sept. 2025
11.31084 tok/s
Motif Technologies KI-Anbieter-Logo - Motif-2-12.7B-Reasoning
#65 Motif-2-12.7B-Reasoning
von Motif Technologies · 4. Dez. 2025
12.8k. A.k. A.
Anthropic KI-Anbieter-Logo - Claude 4.1 Opus (Reasoning)
#66 Claude 4.1 Opus (Reasoning)
von Anthropic · 5. Aug. 2025
33.74k. A.
TII UAE KI-Anbieter-Logo - Falcon-H1R-7B
#67 Falcon-H1R-7B
von TII UAE · 4. Jan. 2026
9.8k. A.k. A.
LG AI Research KI-Anbieter-Logo - EXAONE 4.0 32B (Reasoning)
#68 EXAONE 4.0 32B (Reasoning)
von LG AI Research · 15. Juli 2025
10.6k. A.k. A.
ByteDance Seed KI-Anbieter-Logo - Doubao Seed Code
#69 Doubao Seed Code
von ByteDance Seed · 11. Nov. 2025
26.0k. A.k. A.
Korea Telecom KI-Anbieter-Logo - Mi:dm K 2.5 Pro Preview
#70 Mi:dm K 2.5 Pro Preview
von Korea Telecom · 11. Dez. 2025
k. A.k. A.
MBZUAI Institute of Foundation Models KI-Anbieter-Logo - K2-V2 (high)
#71 K2-V2 (high)
von MBZUAI Institute of Foundation Models · 5. Dez. 2025
14.2k. A.k. A.
OpenAI KI-Anbieter-Logo - GPT-5 nano (medium)
#72 GPT-5 nano (medium)
von OpenAI · 7. Aug. 2025
19.058174 tok/s
Google KI-Anbieter-Logo - Gemini 2.5 Flash Preview (Sep '25) (Reasoning)
#73 Gemini 2.5 Flash Preview (Sep '25) (Reasoning)
von Google · 25. Sept. 2025
23.8k. A.k. A.
MiniMax KI-Anbieter-Logo - M2
#74 M2
von MiniMax · 26. Okt. 2025
28.33497 tok/s
Allen Institute for AI KI-Anbieter-Logo - Olmo 3.1 32B Think
#75 Olmo 3.1 32B Think
von Allen Institute for AI · 12. Dez. 2025
8.1k. A.k. A.
NVIDIA KI-Anbieter-Logo - Llama Nemotron Super 49B v1.5 (Reasoning)
#76 Llama Nemotron Super 49B v1.5 (Reasoning)
von NVIDIA · 25. Juli 2025
12.41692 tok/s
Korea Telecom KI-Anbieter-Logo - Mi:dm K 2.5 Pro
#77 Mi:dm K 2.5 Pro
von Korea Telecom · 11. Dez. 2025
16.4k. A.k. A.
DeepSeek KI-Anbieter-Logo - R1 0528 (May '25)
#78 R1 0528 (May '25)
von DeepSeek · 28. Mai 2025
20.19k. A.
NVIDIA KI-Anbieter-Logo - Nemotron Nano 12B v2 VL (Reasoning)
#79 Nemotron Nano 12B v2 VL (Reasoning)
von NVIDIA · 28. Okt. 2025
9.017118 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 Max (Preview)
#80 Qwen3 Max (Preview)
von Alibaba · 5. Sept. 2025
19.2861 tok/s
Anthropic KI-Anbieter-Logo - Claude 4 Sonnet (Reasoning)
#81 Claude 4 Sonnet (Reasoning)
von Anthropic · 22. Mai 2025
28.98k. A.
Alibaba KI-Anbieter-Logo - Qwen3 Omni 30B A3B (Reasoning)
#82 Qwen3 Omni 30B A3B (Reasoning)
von Alibaba · 22. Sept. 2025
9.614107 tok/s
Allen Institute for AI KI-Anbieter-Logo - Olmo 3 32B Think
#83 Olmo 3 32B Think
von Allen Institute for AI · 20. Nov. 2025
6.4k. A.k. A.
Z AI KI-Anbieter-Logo - GLM-4.5 (Reasoning)
#84 GLM-4.5 (Reasoning)
von Z AI · 28. Juli 2025
19.5k. A.k. A.
Google KI-Anbieter-Logo - Gemini 2.5 Flash (Reasoning)
#85 Gemini 2.5 Flash (Reasoning)
von Google · 20. Mai 2025
20.125231 tok/s
Anthropic KI-Anbieter-Logo - Claude 4 Opus (Reasoning)
#86 Claude 4 Opus (Reasoning)
von Anthropic · 22. Mai 2025
31.04k. A.
Z AI KI-Anbieter-Logo - GLM-4.5V (Reasoning)
#87 GLM-4.5V (Reasoning)
von Z AI · 11. Aug. 2025
9.1652 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 32B (Reasoning)
#88 Qwen3 32B (Reasoning)
von Alibaba · 28. Apr. 2025
11.56100 tok/s
Deep Cogito KI-Anbieter-Logo - Cogito v2.1 (Reasoning)
#89 Cogito v2.1 (Reasoning)
von Deep Cogito · 18. Nov. 2025
44k. A.
Alibaba KI-Anbieter-Logo - Qwen3 VL 30B A3B Instruct
#90 Qwen3 VL 30B A3B Instruct
von Alibaba · 3. Okt. 2025
10.019126 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 30B A3B (Reasoning)
#91 Qwen3 30B A3B (Reasoning)
von Alibaba · 28. Apr. 2025
9.311113 tok/s
Alibaba KI-Anbieter-Logo - Qwen3 235B A22B 2507 Instruct
#92 Qwen3 235B A22B 2507 Instruct
von Alibaba · 21. Juli 2025
18.21169 tok/s
InclusionAI KI-Anbieter-Logo - Ling-1T
#93 Ling-1T
von InclusionAI · 8. Okt. 2025
12.8k. A.k. A.
Allen Institute for AI KI-Anbieter-Logo - Olmo 3 7B Think
#94 Olmo 3 7B Think
von Allen Institute for AI · 20. Nov. 2025
4.0k. A.k. A.
Alibaba KI-Anbieter-Logo - Qwen3 VL 235B A22B Instruct
#95 Qwen3 VL 235B A22B Instruct
von Alibaba · 23. Sept. 2025
14.3948 tok/s
NVIDIA KI-Anbieter-Logo - Nemotron Nano 9B V2 (Reasoning)
#96 Nemotron Nano 9B V2 (Reasoning)
von NVIDIA · 18. Aug. 2025
8.82583 tok/s
Nous Research KI-Anbieter-Logo - Hermes 4 - Llama-3.1 405B (Reasoning)
#97 Hermes 4 - Llama-3.1 405B (Reasoning)
von Nous Research · 27. Aug. 2025
9.0537 tok/s
Nous Research KI-Anbieter-Logo - Hermes 4 - Llama-3.1 70B (Reasoning)
#98 Hermes 4 - Llama-3.1 70B (Reasoning)
von Nous Research · 27. Aug. 2025
10.01992 tok/s
Google KI-Anbieter-Logo - Gemini 2.5 Flash-Lite Preview (Sep '25) (Reasoning)
#99 Gemini 2.5 Flash-Lite Preview (Sep '25) (Reasoning)
von Google · 8. Sept. 2025
15.124k. A.
Alibaba KI-Anbieter-Logo - Qwen3 VL 32B Instruct
#100 Qwen3 VL 32B Instruct
von Alibaba · 21. Okt. 2025
11.1771 tok/s

Zeige 100 von 578 Modelle

Das KI-Modell-Leaderboard verstehen

Dieses umfassende KI-Modell-Leaderboard hilft Ihnen, zu vergleichen und auszuwählen die besten Large Language Models (LLMs) für Ihre Anforderungen. Wir erfassen standardisierte KI-Benchmarks, Token-Preise, Inference-Geschwindigkeit und Modellfähigkeiten bei allen großen KI-Anbietern wie OpenAI, Anthropic, Google, Meta, und DeepSeek.

Kern-KI-Benchmarks erklärt

MMLU-ProTestet breites Wissen über 14 akademische Fachbereiche
GPQADenken & Problemlösung auf Promotionsniveau
AIME 2025Mathematisches Denken auf Spitzenniveau
Coding IndexLiveCodeBench + SciCode kombiniert
Math IndexAIME + MATH-500 kombiniert

Wichtige Kennzahlen

Token-PreisgestaltungInput- vs. Output-Kosten pro 1 Mio. Tokens
Inference-GeschwindigkeitTokens/Sekunde für Antwortzeit
VeröffentlichungsdatumNeueste Techniken & Wissensstand
Benchmark-ScoresFähigkeitsvergleich von 0-100 %

So wählen Sie das richtige KI-Modell für Ihren Use Case

Für Forschung & Analyse

Priorisieren Sie Modelle mit hohen MMLU-Pro- (70 %+) und GPQA-Werten (60 %+), wenn es um komplexe Denkaufgaben, wissenschaftliche Recherche und technische Dokumentation geht

Für Kostenoptimierung

Sortieren Sie nach Input-/Output-Preisen - kleinere Modelle liefern bei einfachen Aufgaben oft 80 % der Flaggschiff-Leistung zu 10 % der Kosten

Für Mathe & MINT

Filtern Sie nach Math-Index oder AIME-2025-Scores (50 %+) für quantitative Analysen, Engineering-Berechnungen und wissenschaftliche Anwendungen

Alle Benchmark-Scores und Preisdaten werden täglich von Artificial Analysis aktualisiert, um die neuesten Modellversionen und Fähigkeiten abzubilden. Nutzen Sie die Sortierfilter oben, um KI-Modelle nach Intelligenz, Kosten, Coding-Fähigkeit, Mathe-Leistung, Geschwindigkeit oder Veröffentlichungsdatum zu finden.

Häufig gestellte Fragen

Was ist MMLU-Pro und warum gilt es als Standard-Benchmark für KI-Intelligenz?

MMLU-Pro (Massive Multitask Language Understanding - Professional) ist der umfassendste KI-Benchmark und testet Modelle in 14 akademischen Fachbereichen, darunter Mathematik, Naturwissenschaften, Geschichte, Recht und Ethik. Die Werte reichen von 46 % (Grundkompetenz) bis 87 % (nahe Expertenniveau). Modelle über 75 % zeigen starke allgemeine Intelligenz für professionelle Anwendungen, während Werte unter 60 % auf Einschränkungen bei komplexen Denkaufgaben hindeuten.

Was misst GPQA und welche Modelle erzielen die höchsten Werte?

GPQA (Graduate-level Google-Proof Q&A) prüft Denken auf Promotionsniveau mit Fragen, die bewusst "Google-proof" sind - sie erfordern tiefes Verständnis statt bloßer Faktenrecherche. Spitzenmodelle wie GPT-5.1 (87,3 %), GPT-5 mini (82,8 %) und o3 (82,7 %) sind bei GPQA besonders stark und eignen sich für Forschung, technische Analysen und komplexe Problemlösung. Modelle unter 50 % GPQA haben oft Schwierigkeiten bei anspruchsvollem Denken und liefern eher oberflächliche Antworten.

Was ist AIME 2025 und wie bewertet es die mathematischen Fähigkeiten von KI?

AIME 2025 (American Invitational Mathematics Examination) ist ein Benchmark auf Wettbewerbsniveau, der fortgeschrittene Problemlösung, Algebra, Geometrie und Zahlentheorie testet. Werte über 80 % (wie GPT-5 Codex mit 98,7 % oder GPT-5.1 mit 94 %) zeigen außergewöhnliches mathematisches Denken für Engineering, Scientific Computing und quantitative Analysen. Modelle unter 50 % können bei mehrstufigen mathematischen Aufgaben Probleme haben oder benötigen eine explizite Aufschlüsselung.

Wie wird die Preisgestaltung von KI-Modellen berechnet und was gilt als kosteneffizient?

Die Preise von KI-Modellen werden pro 1 Million Tokens berechnet (etwa 750.000 Wörter). Input-Preise betreffen den Text, den Sie senden, Output-Preise die generierten Antworten. Günstige Modelle wie Llama 3.3 70B kosten $0.54/$0.71 pro Million Tokens, Mid-Tier-Modelle wie GPT-5 nano $0.05/$0.40, Premium-Modelle wie GPT-5 $1.25/$10. Bei typischen Anwendungen mit einem Input-/Output-Verhältnis von 3:1 können Budget-Modelle 10- bis 20-mal günstiger sein und dennoch 70-80 % der Leistung liefern.

Welche KI-Modelle eignen sich am besten für Coding und Programmierung?

Sortieren Sie nach Coding Index um die besten Programmiermodelle zu sehen. Unser Coding Index kombiniert LiveCodeBench, SciCode und Coding-Benchmarks. Zu den Top-Performern gehören GPT-5.1 (57,5), GPT-5 mini (51,4) und GPT-5 Codex (53,5). Diese Modelle sind stark bei Codegenerierung, Debugging, Refactoring und der Erklärung komplexer Algorithmen. Für kostenbewusste Entwickler bieten Modelle mit 40+ Punkten im Coding Index ein sehr gutes Preis-Leistungs-Verhältnis für Routineaufgaben.

Wie oft werden KI-Modell-Benchmarks und Rankings aktualisiert?

Unser Leaderboard wird täglich mit der Artificial Analysis API synchronisiert, damit Benchmark-Scores (MMLU-Pro, GPQA, AIME 2025), Preise und Inference-Geschwindigkeit die neuesten Modellversionen widerspiegeln. Neue Modell-Releases erscheinen sofort unter der Sortierung "Neueste". Benchmark-Scores können sich ändern, wenn Anbieter aktualisierte Versionen veröffentlichen - zum Beispiel erreichte GPT-5.1 (veröffentlicht im November 2025) 69,7 Intelligenzpunkte gegenüber 68,5 bei GPT-5 aus August 2025.

Welche Inference-Geschwindigkeit (Tokens/Sekunde) brauche ich für meine Anwendung?

Die Inference-Geschwindigkeit bestimmt, wie schnell Modelle Antworten erzeugen. Für Echtzeit-Chatbots und interaktive Anwendungen sind 100+ Tokens/Sekunde sinnvoll (z. B. gpt-oss-120B mit 340 tok/s). Für Hintergrundverarbeitung und Batch-Jobs reichen 50-100 tok/s. Premium-Reasoning-Modelle wie GPT-5 (103 tok/s) balancieren Geschwindigkeit und Fähigkeiten. Wichtig: Höhere Geschwindigkeit bedeutet nicht automatisch bessere Qualität - langsamere Modelle liefern oft durchdachtere, detailliertere Antworten.

Kann ich diese KI-Modelle kostenlos testen, bevor ich mich entscheide?

Ja! Probieren Sie unsere kostenlose KI-Chatoberfläche aus, um verschiedene Modelle sofort ohne Account zu testen. Viele Anbieter haben ebenfalls kostenlose Stufen: OpenAI (ChatGPT mit Tageslimits), Anthropic (Claude mit Nutzungslimits), Google (Gemini Free Tier) und Open-Source-Modelle wie Llama 3.3. Vergleichen Sie die Leistung für Ihren konkreten Use Case, bevor Sie auf bezahlte Pläne wechseln.