KI-Modell-Ranking (LLM-Leaderboard)

Teuerste KI-Modelle

Language models ranked by Artificial Analysis Index

Modell
Name des KI-Modells und Anbieterorganisation
Intelligenz
Artificial Analysis Intelligence Index - composite reasoning and capability score across the benchmark suite
Value Score
Qualität, Geschwindigkeit und gemischter Token-Preis als relativer Wert-Score
Speed
Inference-Durchsatz in Tokens pro Sekunde - wie schnell das Modell Antworten generiert
OpenAI KI-Anbieter-Logo - o1-pro
#1 o1-pro
von OpenAI · 19. März 2025
12.81k. A.
OpenAI KI-Anbieter-Logo - GPT-5.4 Pro (xhigh)
#2 GPT-5.4 Pro (xhigh)
von OpenAI · 5. März 2026
k. A.k. A.
OpenAI KI-Anbieter-Logo - GPT-4
#3 GPT-4
von OpenAI · 14. März 2023
1.50k. A.
OpenAI KI-Anbieter-Logo - o3-pro
#4 o3-pro
von OpenAI · 10. Juni 2025
25.74k. A.
OpenAI KI-Anbieter-Logo - o1-preview
#5 o1-preview
von OpenAI · 12. Sept. 2024
11.02k. A.
Anthropic KI-Anbieter-Logo - Claude 4 Opus (Non-reasoning)
#6 Claude 4 Opus (Non-reasoning)
von Anthropic · 22. Mai 2025
19.13k. A.
OpenAI KI-Anbieter-Logo - o1
#7 o1
von OpenAI · 5. Dez. 2024
17.13k. A.
Anthropic KI-Anbieter-Logo - Claude 3 Opus
#8 Claude 3 Opus
von Anthropic · 4. März 2024
6.01k. A.
Anthropic KI-Anbieter-Logo - Claude 4 Opus (Reasoning)
#9 Claude 4 Opus (Reasoning)
von Anthropic · 22. Mai 2025
24.34k. A.
Anthropic KI-Anbieter-Logo - Claude 4.1 Opus (Reasoning)
#10 Claude 4.1 Opus (Reasoning)
von Anthropic · 5. Aug. 2025
26.95k. A.
Anthropic KI-Anbieter-Logo - Claude 4.1 Opus (Non-reasoning)
#11 Claude 4.1 Opus (Non-reasoning)
von Anthropic · 5. Aug. 2025
21.74k. A.
Anthropic KI-Anbieter-Logo - Claude Fable 5.1 (Adaptive Reasoning, Low Effort, Default Fallback)
#12 Claude Fable 5.1 (Adaptive Reasoning, Low Effort, Default Fallback)
von Anthropic · 1. Sept. 2026
47.8856 tok/s
OpenAI KI-Anbieter-Logo - GPT-6 Astra (xhigh)
#13 GPT-6 Astra (xhigh)
von OpenAI · 3. Sept. 2026
54.3957 tok/s
OpenAI KI-Anbieter-Logo - GPT-6 Astra (Non-reasoning)
#14 GPT-6 Astra (Non-reasoning)
von OpenAI · 3. Sept. 2026
47.810k. A.
OpenAI KI-Anbieter-Logo - GPT-6 Astra (max)
#15 GPT-6 Astra (max)
von OpenAI · 3. Sept. 2026
54.7962 tok/s
Anthropic KI-Anbieter-Logo - Claude Fable 5.1 (Adaptive Reasoning, Medium Effort, Default Fallback)
#16 Claude Fable 5.1 (Adaptive Reasoning, Medium Effort, Default Fallback)
von Anthropic · 1. Sept. 2026
49.9857 tok/s
Anthropic KI-Anbieter-Logo - Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback)
#17 Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback)
von Anthropic · 1. Sept. 2026
56.8967 tok/s
OpenAI KI-Anbieter-Logo - GPT-4 Turbo
#18 GPT-4 Turbo
von OpenAI · 6. Nov. 2023
2.3033 tok/s
Anthropic KI-Anbieter-Logo - Claude Fable 5.1 (Adaptive Reasoning, Xhigh Effort, Default Fallback)
#19 Claude Fable 5.1 (Adaptive Reasoning, Xhigh Effort, Default Fallback)
von Anthropic · 1. Sept. 2026
53.8969 tok/s
Anthropic KI-Anbieter-Logo - Claude Fable 5.1 (Adaptive Reasoning, High Effort, Default Fallback)
#20 Claude Fable 5.1 (Adaptive Reasoning, High Effort, Default Fallback)
von Anthropic · 1. Sept. 2026
51.7856 tok/s
OpenAI KI-Anbieter-Logo - GPT-6 Astra (low)
#21 GPT-6 Astra (low)
von OpenAI · 3. Sept. 2026
49.3859 tok/s
Anthropic KI-Anbieter-Logo - Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)
#22 Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)
von Anthropic · 9. Juni 2026
53.2970 tok/s
OpenAI KI-Anbieter-Logo - GPT-6 Astra (high)
#23 GPT-6 Astra (high)
von OpenAI · 3. Sept. 2026
53.4961 tok/s
OpenAI KI-Anbieter-Logo - GPT-6 Astra (medium)
#24 GPT-6 Astra (medium)
von OpenAI · 3. Sept. 2026
52.2858 tok/s
Anthropic KI-Anbieter-Logo - Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)
#25 Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)
von Anthropic · 24. Juli 2026
53.41256 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.5 (xhigh)
#26 GPT-5.5 (xhigh)
von OpenAI · 23. Apr. 2026
45.61185 tok/s
Anthropic KI-Anbieter-Logo - Claude Opus 5 (Adaptive Reasoning, Low Effort)
#27 Claude Opus 5 (Adaptive Reasoning, Low Effort)
von Anthropic · 24. Juli 2026
43.81054 tok/s
Anthropic KI-Anbieter-Logo - Claude Opus 4.5 (Reasoning)
#28 Claude Opus 4.5 (Reasoning)
von Anthropic · 24. Nov. 2025
33.6853 tok/s
Anthropic KI-Anbieter-Logo - Claude Opus 4.7 (Non-reasoning, High Effort)
#29 Claude Opus 4.7 (Non-reasoning, High Effort)
von Anthropic · 16. Apr. 2026
35.4846 tok/s
Anthropic KI-Anbieter-Logo - Claude Opus 4.5 (Non-reasoning)
#30 Claude Opus 4.5 (Non-reasoning)
von Anthropic · 24. Nov. 2025
27.8646 tok/s
Anthropic KI-Anbieter-Logo - Claude Opus 4.6 (Non-reasoning, High Effort)
#31 Claude Opus 4.6 (Non-reasoning, High Effort)
von Anthropic · 5. Feb. 2026
30.8737 tok/s
Anthropic KI-Anbieter-Logo - Claude Opus 4.6 (Adaptive Reasoning, Max Effort)
#32 Claude Opus 4.6 (Adaptive Reasoning, Max Effort)
von Anthropic · 5. Feb. 2026
36.4843 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.5 (medium)
#33 GPT-5.5 (medium)
von OpenAI · 23. Apr. 2026
41.6971 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.5 (Non-reasoning)
#34 GPT-5.5 (Non-reasoning)
von OpenAI · 23. Apr. 2026
27.3677 tok/s
Anthropic KI-Anbieter-Logo - Claude Opus 5 (Adaptive Reasoning, High Effort)
#35 Claude Opus 5 (Adaptive Reasoning, High Effort)
von Anthropic · 24. Juli 2026
52.01255 tok/s
Anthropic KI-Anbieter-Logo - Claude Opus 4.8 (Adaptive Reasoning, Max Effort)
#36 Claude Opus 4.8 (Adaptive Reasoning, Max Effort)
von Anthropic · 28. Mai 2026
46.41162 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.5 (high)
#37 GPT-5.5 (high)
von OpenAI · 23. Apr. 2026
44.11078 tok/s
Anthropic KI-Anbieter-Logo - Claude Opus 5 (Adaptive Reasoning, Max Effort)
#38 Claude Opus 5 (Adaptive Reasoning, Max Effort)
von Anthropic · 24. Juli 2026
54.11258 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.5 Instant (June 2026)
#39 GPT-5.5 Instant (June 2026)
von OpenAI · 25. Juni 2026
21.68134 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.5 (low)
#40 GPT-5.5 (low)
von OpenAI · 23. Apr. 2026
35.3875 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.5 Instant (May 2026)
#41 GPT-5.5 Instant (May 2026)
von OpenAI · 5. Mai 2026
26.78k. A.
OpenAI KI-Anbieter-Logo - GPT-4o (May '24)
#42 GPT-4o (May '24)
von OpenAI · 13. Mai 2024
3.0194 tok/s
Anthropic KI-Anbieter-Logo - Claude Opus 4.7 (Adaptive Reasoning, Max Effort)
#43 Claude Opus 4.7 (Adaptive Reasoning, Max Effort)
von Anthropic · 16. Apr. 2026
44.31052 tok/s
Anthropic KI-Anbieter-Logo - Claude Opus 5 (Adaptive Reasoning, Medium Effort)
#44 Claude Opus 5 (Adaptive Reasoning, Medium Effort)
von Anthropic · 24. Juli 2026
49.51153 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Sol (low)
#45 GPT-5.6 Sol (low)
von OpenAI · 9. Juli 2026
40.81067 tok/s
SpaceXAI KI-Anbieter-Logo - Grok 3
#46 Grok 3
von SpaceXAI · 19. Feb. 2025
12.34k. A.
Mistral KI-Anbieter-Logo - Large (Feb '24)
#47 Large (Feb '24)
von Mistral · 26. Feb. 2024
1.00k. A.
OpenAI KI-Anbieter-Logo - GPT-5.6 Sol (medium)
#48 GPT-5.6 Sol (medium)
von OpenAI · 9. Juli 2026
46.01272 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Sol (Non-reasoning)
#49 GPT-5.6 Sol (Non-reasoning)
von OpenAI · 9. Juli 2026
32.9867 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Sol (high)
#50 GPT-5.6 Sol (high)
von OpenAI · 9. Juli 2026
48.31273 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Sol (max)
#51 GPT-5.6 Sol (max)
von OpenAI · 9. Juli 2026
51.31585 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Sol (xhigh)
#52 GPT-5.6 Sol (xhigh)
von OpenAI · 9. Juli 2026
49.81481 tok/s
Anthropic KI-Anbieter-Logo - Claude 3.5 Sonnet (Oct '24)
#53 Claude 3.5 Sonnet (Oct '24)
von Anthropic · 22. Okt. 2024
4.22k. A.
Anthropic KI-Anbieter-Logo - Claude Sonnet 4.6 (Non-reasoning, High Effort)
#54 Claude Sonnet 4.6 (Non-reasoning, High Effort)
von Anthropic · 17. Feb. 2026
29.0944 tok/s
Kimi KI-Anbieter-Logo - K3 (low)
#55 K3 (low)
von Kimi · 16. Juli 2026
38.81139 tok/s
SpaceXAI KI-Anbieter-Logo - Grok 4
#56 Grok 4
von SpaceXAI · 10. Juli 2025
26.510k. A.
Anthropic KI-Anbieter-Logo - Claude 4.5 Sonnet (Reasoning)
#57 Claude 4.5 Sonnet (Reasoning)
von Anthropic · 29. Sept. 2025
29.0946 tok/s
Anthropic KI-Anbieter-Logo - Claude 4.5 Sonnet (Non-reasoning)
#58 Claude 4.5 Sonnet (Non-reasoning)
von Anthropic · 29. Sept. 2025
22.7740 tok/s
Anthropic KI-Anbieter-Logo - Claude 4 Sonnet (Reasoning)
#59 Claude 4 Sonnet (Reasoning)
von Anthropic · 22. Mai 2025
22.29k. A.
Anthropic KI-Anbieter-Logo - Claude 3.5 Sonnet (June '24)
#60 Claude 3.5 Sonnet (June '24)
von Anthropic · 21. Juni 2024
2.71k. A.
Anthropic KI-Anbieter-Logo - Claude 4 Sonnet (Non-reasoning)
#61 Claude 4 Sonnet (Non-reasoning)
von Anthropic · 22. Mai 2025
19.17k. A.
Anthropic KI-Anbieter-Logo - Claude 3.7 Sonnet (Non-reasoning)
#62 Claude 3.7 Sonnet (Non-reasoning)
von Anthropic · 24. Feb. 2025
17.27k. A.
Anthropic KI-Anbieter-Logo - Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort)
#63 Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort)
von Anthropic · 17. Feb. 2026
38.51159 tok/s
Anthropic KI-Anbieter-Logo - Claude Sonnet 4.6 (Non-reasoning, Low Effort)
#64 Claude Sonnet 4.6 (Non-reasoning, Low Effort)
von Anthropic · 17. Feb. 2026
27.4841 tok/s
Kimi KI-Anbieter-Logo - K3 (max)
#65 K3 (max)
von Kimi · 16. Juli 2026
50.21540 tok/s
Cohere KI-Anbieter-Logo - Command A
#66 Command A
von Cohere · 13. März 2025
2.1157 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.4 (Non-reasoning)
#67 GPT-5.4 (Non-reasoning)
von OpenAI · 5. März 2026
21.1893 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.4 (low)
#68 GPT-5.4 (low)
von OpenAI · 5. März 2026
32.11397 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.7 Max
#69 Qwen3.7 Max
von Alibaba · 19. Mai 2026
37.023202 tok/s
OpenAI KI-Anbieter-Logo - GPT-4o (Aug '24)
#70 GPT-4o (Aug '24)
von OpenAI · 6. Aug. 2024
3.9291 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.4 (xhigh)
#71 GPT-5.4 (xhigh)
von OpenAI · 5. März 2026
42.822149 tok/s
OpenAI KI-Anbieter-Logo - GPT-4o (Nov '24)
#72 GPT-4o (Nov '24)
von OpenAI · 20. Nov. 2024
5.43137 tok/s
Amazon KI-Anbieter-Logo - Nova Premier
#73 Nova Premier
von Amazon · 30. Apr. 2025
6.9231 tok/s
SpaceXAI KI-Anbieter-Logo - Grok 4.20 0309 (Reasoning)
#74 Grok 4.20 0309 (Reasoning)
von SpaceXAI · 10. März 2026
29.516k. A.
DeepSeek KI-Anbieter-Logo - R1 (Jan '25)
#75 R1 (Jan '25)
von DeepSeek · 20. Jan. 2025
12.07k. A.
Anthropic KI-Anbieter-Logo - Claude Sonnet 5 (Adaptive Reasoning, Low Effort)
#76 Claude Sonnet 5 (Adaptive Reasoning, Low Effort)
von Anthropic · 30. Juni 2026
k. A.61 tok/s
OpenAI KI-Anbieter-Logo - o3
#77 o3
von OpenAI · 16. Apr. 2025
23.714116 tok/s
Mistral KI-Anbieter-Logo - Large 2 (Jul '24)
#78 Large 2 (Jul '24)
von Mistral · 24. Juli 2024
1.71k. A.
Anthropic KI-Anbieter-Logo - Claude Sonnet 5 (Adaptive Reasoning, Max Effort)
#79 Claude Sonnet 5 (Adaptive Reasoning, Max Effort)
von Anthropic · 30. Juni 2026
45.11675 tok/s
SpaceXAI KI-Anbieter-Logo - Grok 4.6 (medium)
#80 Grok 4.6 (medium)
von SpaceXAI · 12. Aug. 2026
48.42062 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Terra (medium)
#81 GPT-5.6 Terra (medium)
von OpenAI · 9. Juli 2026
37.21483 tok/s
OpenAI KI-Anbieter-Logo - GPT-4.1
#82 GPT-4.1
von OpenAI · 14. Apr. 2025
13.28161 tok/s
SpaceXAI KI-Anbieter-Logo - Grok 4.20 0309 (Non-reasoning)
#83 Grok 4.20 0309 (Non-reasoning)
von SpaceXAI · 10. März 2026
16.29k. A.
Alibaba KI-Anbieter-Logo - Qwen3.8 Max
#84 Qwen3.8 Max
von Alibaba · 3. Aug. 2026
46.91940 tok/s
SpaceXAI KI-Anbieter-Logo - Grok 4.5 (high)
#85 Grok 4.5 (high)
von SpaceXAI · 8. Juli 2026
45.51958 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Terra (high)
#86 GPT-5.6 Terra (high)
von OpenAI · 9. Juli 2026
41.31687 tok/s
Alibaba KI-Anbieter-Logo - Qwen3.8 2.4T A95B
#87 Qwen3.8 2.4T A95B
von Alibaba · 12. Aug. 2026
46.71940 tok/s
Anthropic KI-Anbieter-Logo - Claude Sonnet 5 (Adaptive Reasoning, Xhigh Effort)
#88 Claude Sonnet 5 (Adaptive Reasoning, Xhigh Effort)
von Anthropic · 30. Juni 2026
k. A.84 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Terra (Non-reasoning)
#89 GPT-5.6 Terra (Non-reasoning)
von OpenAI · 9. Juli 2026
26.31082 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Terra (xhigh)
#90 GPT-5.6 Terra (xhigh)
von OpenAI · 9. Juli 2026
44.41786 tok/s
Google KI-Anbieter-Logo - Gemini 3 Pro Preview (low)
#91 Gemini 3 Pro Preview (low)
von Google · 18. Nov. 2025
26.312k. A.
AI21 Labs KI-Anbieter-Logo - Jamba 1.5 Large
#92 Jamba 1.5 Large
von AI21 Labs · 22. Aug. 2024
1.01k. A.
Anthropic KI-Anbieter-Logo - Claude Sonnet 5 (Adaptive Reasoning, High Effort)
#93 Claude Sonnet 5 (Adaptive Reasoning, High Effort)
von Anthropic · 30. Juni 2026
k. A.69 tok/s
Google KI-Anbieter-Logo - Gemini 3.1 Pro Preview
#94 Gemini 3.1 Pro Preview
von Google · 19. Feb. 2026
36.719115 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Terra (max)
#95 GPT-5.6 Terra (max)
von OpenAI · 9. Juli 2026
46.823110 tok/s
SpaceXAI KI-Anbieter-Logo - Grok 4.6 (low)
#96 Grok 4.6 (low)
von SpaceXAI · 12. Aug. 2026
41.81755 tok/s
SpaceXAI KI-Anbieter-Logo - Grok 4.6 (high)
#97 Grok 4.6 (high)
von SpaceXAI · 12. Aug. 2026
50.62164 tok/s
OpenAI KI-Anbieter-Logo - GPT-5.6 Terra (low)
#98 GPT-5.6 Terra (low)
von OpenAI · 9. Juli 2026
32.41387 tok/s
Google KI-Anbieter-Logo - Gemini 3 Pro Preview (high)
#99 Gemini 3 Pro Preview (high)
von Google · 18. Nov. 2025
32.415k. A.
Anthropic KI-Anbieter-Logo - Claude Sonnet 5 (Non-reasoning, High Effort)
#100 Claude Sonnet 5 (Non-reasoning, High Effort)
von Anthropic · 30. Juni 2026
33.51263 tok/s

Zeige 100 von 415 Modelle

Das KI-Modell-Leaderboard verstehen

Dieses umfassende KI-Modell-Leaderboard hilft Ihnen, zu vergleichen und auszuwählen die besten Large Language Models (LLMs) für Ihre Anforderungen. Wir erfassen standardisierte KI-Benchmarks, Token-Preise, Inference-Geschwindigkeit und Modellfähigkeiten bei allen großen KI-Anbietern wie OpenAI, Anthropic, Google, Meta, und DeepSeek.

Kern-KI-Benchmarks erklärt

MMLU-ProTestet breites Wissen über 14 akademische Fachbereiche
GPQADenken & Problemlösung auf Promotionsniveau
AIME 2025Mathematisches Denken auf Spitzenniveau
Coding IndexLiveCodeBench + SciCode kombiniert
Math IndexAIME + MATH-500 kombiniert

Wichtige Kennzahlen

Token-PreisgestaltungInput- vs. Output-Kosten pro 1 Mio. Tokens
Inference-GeschwindigkeitTokens/Sekunde für Antwortzeit
VeröffentlichungsdatumNeueste Techniken & Wissensstand
Benchmark-ScoresFähigkeitsvergleich von 0-100 %

So wählen Sie das richtige KI-Modell für Ihren Use Case

Für Forschung & Analyse

Priorisieren Sie Modelle mit hohen MMLU-Pro- (70 %+) und GPQA-Werten (60 %+), wenn es um komplexe Denkaufgaben, wissenschaftliche Recherche und technische Dokumentation geht

Für Kostenoptimierung

Sortieren Sie nach Input-/Output-Preisen - kleinere Modelle liefern bei einfachen Aufgaben oft 80 % der Flaggschiff-Leistung zu 10 % der Kosten

Für Mathe & MINT

Filtern Sie nach Math-Index oder AIME-2025-Scores (50 %+) für quantitative Analysen, Engineering-Berechnungen und wissenschaftliche Anwendungen

Alle Benchmark-Scores und Preisdaten werden täglich von Artificial Analysis aktualisiert, um die neuesten Modellversionen und Fähigkeiten abzubilden. Nutzen Sie die Sortierfilter oben, um KI-Modelle nach Intelligenz, Kosten, Coding-Fähigkeit, Mathe-Leistung, Geschwindigkeit oder Veröffentlichungsdatum zu finden.

Häufig gestellte Fragen

Was ist MMLU-Pro und warum gilt es als Standard-Benchmark für KI-Intelligenz?

MMLU-Pro (Massive Multitask Language Understanding - Professional) ist der umfassendste KI-Benchmark und testet Modelle in 14 akademischen Fachbereichen, darunter Mathematik, Naturwissenschaften, Geschichte, Recht und Ethik. Die Werte reichen von 46 % (Grundkompetenz) bis 87 % (nahe Expertenniveau). Modelle über 75 % zeigen starke allgemeine Intelligenz für professionelle Anwendungen, während Werte unter 60 % auf Einschränkungen bei komplexen Denkaufgaben hindeuten.

Was misst GPQA und welche Modelle erzielen die höchsten Werte?

GPQA (Graduate-level Google-Proof Q&A) prüft Denken auf Promotionsniveau mit Fragen, die bewusst "Google-proof" sind - sie erfordern tiefes Verständnis statt bloßer Faktenrecherche. Spitzenmodelle wie GPT-5.1 (87,3 %), GPT-5 mini (82,8 %) und o3 (82,7 %) sind bei GPQA besonders stark und eignen sich für Forschung, technische Analysen und komplexe Problemlösung. Modelle unter 50 % GPQA haben oft Schwierigkeiten bei anspruchsvollem Denken und liefern eher oberflächliche Antworten.

Was ist AIME 2025 und wie bewertet es die mathematischen Fähigkeiten von KI?

AIME 2025 (American Invitational Mathematics Examination) ist ein Benchmark auf Wettbewerbsniveau, der fortgeschrittene Problemlösung, Algebra, Geometrie und Zahlentheorie testet. Werte über 80 % (wie GPT-5 Codex mit 98,7 % oder GPT-5.1 mit 94 %) zeigen außergewöhnliches mathematisches Denken für Engineering, Scientific Computing und quantitative Analysen. Modelle unter 50 % können bei mehrstufigen mathematischen Aufgaben Probleme haben oder benötigen eine explizite Aufschlüsselung.

Wie wird die Preisgestaltung von KI-Modellen berechnet und was gilt als kosteneffizient?

Die Preise von KI-Modellen werden pro 1 Million Tokens berechnet (etwa 750.000 Wörter). Input-Preise betreffen den Text, den Sie senden, Output-Preise die generierten Antworten. Günstige Modelle wie Llama 3.3 70B kosten $0.54/$0.71 pro Million Tokens, Mid-Tier-Modelle wie GPT-5 nano $0.05/$0.40, Premium-Modelle wie GPT-5 $1.25/$10. Bei typischen Anwendungen mit einem Input-/Output-Verhältnis von 3:1 können Budget-Modelle 10- bis 20-mal günstiger sein und dennoch 70-80 % der Leistung liefern.

Welche KI-Modelle eignen sich am besten für Coding und Programmierung?

Sortieren Sie nach Coding Index um die besten Programmiermodelle zu sehen. Unser Coding Index kombiniert LiveCodeBench, SciCode und Coding-Benchmarks. Zu den Top-Performern gehören GPT-5.1 (57,5), GPT-5 mini (51,4) und GPT-5 Codex (53,5). Diese Modelle sind stark bei Codegenerierung, Debugging, Refactoring und der Erklärung komplexer Algorithmen. Für kostenbewusste Entwickler bieten Modelle mit 40+ Punkten im Coding Index ein sehr gutes Preis-Leistungs-Verhältnis für Routineaufgaben.

Wie oft werden KI-Modell-Benchmarks und Rankings aktualisiert?

Unser Leaderboard wird täglich mit der Artificial Analysis API synchronisiert, damit Benchmark-Scores (MMLU-Pro, GPQA, AIME 2025), Preise und Inference-Geschwindigkeit die neuesten Modellversionen widerspiegeln. Neue Modell-Releases erscheinen sofort unter der Sortierung "Neueste". Benchmark-Scores können sich ändern, wenn Anbieter aktualisierte Versionen veröffentlichen - zum Beispiel erreichte GPT-5.1 (veröffentlicht im November 2025) 69,7 Intelligenzpunkte gegenüber 68,5 bei GPT-5 aus August 2025.

Welche Inference-Geschwindigkeit (Tokens/Sekunde) brauche ich für meine Anwendung?

Die Inference-Geschwindigkeit bestimmt, wie schnell Modelle Antworten erzeugen. Für Echtzeit-Chatbots und interaktive Anwendungen sind 100+ Tokens/Sekunde sinnvoll (z. B. gpt-oss-120B mit 340 tok/s). Für Hintergrundverarbeitung und Batch-Jobs reichen 50-100 tok/s. Premium-Reasoning-Modelle wie GPT-5 (103 tok/s) balancieren Geschwindigkeit und Fähigkeiten. Wichtig: Höhere Geschwindigkeit bedeutet nicht automatisch bessere Qualität - langsamere Modelle liefern oft durchdachtere, detailliertere Antworten.

Kann ich diese KI-Modelle kostenlos testen, bevor ich mich entscheide?

Ja! Probieren Sie unsere kostenlose KI-Chatoberfläche aus, um verschiedene Modelle sofort ohne Account zu testen. Viele Anbieter haben ebenfalls kostenlose Stufen: OpenAI (ChatGPT mit Tageslimits), Anthropic (Claude mit Nutzungslimits), Google (Gemini Free Tier) und Open-Source-Modelle wie Llama 3.3. Vergleichen Sie die Leistung für Ihren konkreten Use Case, bevor Sie auf bezahlte Pläne wechseln.