KI-Modell-Ranking (LLM-Leaderboard)

Schnellste KI-Modelle

Language models ranked by Artificial Analysis Index

Beste Empfehlungen

Mit diesen Modellen starten

Schnelle Empfehlungen aus aktuellen Benchmark-, Geschwindigkeits- und Preisdaten.

Insgesamt am besten

Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)

von Anthropic

Bester Wert

V4 Flash (Reasoning, Max Effort)

von DeepSeek

Beste für Coding

GPT-5.6 Sol (xhigh)

von OpenAI

Schnellste brauchbare Option

Gemini 3.6 Flash (high)

von Google

Modell Name des KI-Modells und Anbieterorganisation	Intelligenz Artificial Analysis Intelligence Index - composite reasoning and capability score across the benchmark suite	Value Score Qualität, Geschwindigkeit und gemischter Token-Preis als relativer Wert-Score	Speed Inference-Durchsatz in Tokens pro Sekunde - wie schnell das Modell Antworten generiert	Context Maximum context window size - how much text, code, or conversation the model can process at once	Price Kosten pro 1 Million Tokens — Input (Text, den Sie senden) / Output (Text, den das Modell erzeugt)	Vergleichen
#1 Mercury 2 von Inception · 20. Feb. 2026	21.4	39	1045 tok/s	128K	$0.25/$0.75	Details
#2 Gemini 3.5 Flash-Lite von Google · 21. Juli 2026	36.5	45	600 tok/s	1.0M	$0.30/$2.50	Details
#3 Granite 4.0 H Small von IBM · 22. Sept. 2025	5.2	18	470 tok/s	131K	$0.06/$0.25	Details
#4 LFM2.5-VL-1.6B von Liquid AI · 5. Jan. 2026	1.0	k. A.	410 tok/s	k. A.	k. A./k. A.	Details
#5 Granite 3.3 8B (Non-reasoning) von IBM · 16. Apr. 2025	1.8	7	407 tok/s	131K	$0.03/$0.25	Details
Mit führenden KI-Modellen chatten Nutze Claude, ChatGPT und Gemini zusammen mit EU-gehosteten Modellen wie Deepseek, Qwen und Kimi. Kostenlos chatten EU-gehostete Inferenz Server in Deutschland und Finnland. Entwickelt fuer strenge GDPR- und ISO-27001-Compliance-Anforderungen. API-Zugang erhalten
#6 Step 3.7 Flash von StepFun · 29. Mai 2026	30.3	52	401 tok/s	256K	$0.20/$1.15	Details
#7 HyperNova 60B 2605 von Multiverse Computing · 26. Mai 2026	17.8	79	381 tok/s	k. A.	$0.04/$0.14	Details
#8 LFM2.5-8B-A1B von Liquid AI · 28. Mai 2026	8.3	k. A.	343 tok/s	k. A.	k. A./k. A.	Details
#9 gpt-oss-120b (low) von OpenAI · 5. Aug. 2025	14.9	33	337 tok/s	1.1M	$0.15/$0.60	Details
#10 Nemotron 3 Nano Omni 30B A3B Reasoning von NVIDIA · 29. Apr. 2026	14.9	46	319 tok/s	k. A.	$0.07/$0.30	Details
#11 Gemini 3.1 Flash-Lite von Google · 3. März 2026	25.0	38	315 tok/s	1.0M	$0.25/$1.50	Details
#12 Gemini 3.6 Flash (high) von Google · 21. Juli 2026	50.1	33	311 tok/s	1.0M	$1.50/$7.50	Details
#13 Gemini 2.5 Flash-Lite (Reasoning) von Google · 17. Juni 2025	11.4	31	304 tok/s	1.0M	$0.10/$0.40	Details
#14 Step 3.5 Flash 2603 von StepFun · 2. Apr. 2026	26.0	76	301 tok/s	256K	$0.10/$0.30	Details
#15 Gemini 3.5 Flash (medium) von Google · 19. Mai 2026	45.4	28	299 tok/s	1.0M	$1.50/$9.00	Details
#16 gpt-oss-120b (high) von OpenAI · 5. Aug. 2025	23.8	52	297 tok/s	1.1M	$0.15/$0.60	Details
#17 Gemini 3.5 Flash (high) von Google · 19. Mai 2026	50.2	31	287 tok/s	1.0M	$1.50/$9.00	Details
#18 Step 3.5 Flash von StepFun · 2. Feb. 2026	25.5	74	285 tok/s	256K	$0.10/$0.30	Details
#19 Nova Micro von Amazon · 3. Dez. 2024	4.7	21	280 tok/s	k. A.	$0.04/$0.14	Details
#20 Qwen3.5 Omni Flash von Alibaba · 30. März 2026	19.0	41	260 tok/s	1.0M	$0.10/$0.80	Details
#21 Gemini 3.5 Flash (minimal) von Google · 19. Mai 2026	34.9	21	256 tok/s	131K	$1.50/$9.00	Details
#22 gpt-oss-20b (high) von OpenAI · 5. Aug. 2025	14.9	55	253 tok/s	1.1M	$0.06/$0.20	Details
#23 gpt-oss-20b (low) von OpenAI · 5. Aug. 2025	14.3	50	250 tok/s	1.1M	$0.07/$0.20	Details
#24 Gemini 2.5 Flash-Lite (Non-reasoning) von Google · 17. Juni 2025	6.9	19	247 tok/s	1.0M	$0.10/$0.40	Details
#25 Nova 2.0 Lite (Non-reasoning) von Amazon · 29. Okt. 2025	11.8	14	240 tok/s	k. A.	$0.30/$2.50	Details
#26 o3-mini (high) von OpenAI · 31. Jan. 2025	15.6	13	240 tok/s	k. A.	$1.10/$4.40	Details
#27 Gemini 2.5 Flash (Reasoning) von Google · 20. Mai 2025	20.1	25	231 tok/s	1.0M	$0.30/$2.50	Details
#28 Gemini 3 Flash Preview (Reasoning) von Google · 17. Dez. 2025	37.8	40	230 tok/s	1.0M	$0.50/$3.00	Details
#29 Grok 4.20 0309 v2 (Reasoning) von SpaceXAI · 7. Apr. 2026	37.0	24	227 tok/s	2.0M	$2.00/$6.00	Details
#30 Gemini 2.5 Flash (Non-reasoning) von Google · 20. Mai 2025	14.1	17	227 tok/s	1.0M	$0.30/$2.50	Details
#31 o3-mini von OpenAI · 31. Jan. 2025	19.0	15	224 tok/s	k. A.	$1.10/$4.40	Details
#32 Gemini 3 Flash Preview (Non-reasoning) von Google · 17. Dez. 2025	27.4	29	218 tok/s	1.0M	$0.50/$3.00	Details
#33 Nova 2.0 Lite (medium) von Amazon · 29. Okt. 2025	19.0	23	216 tok/s	k. A.	$0.30/$2.50	Details
#34 Nemotron 3 Ultra 550B A55B (Reasoning) von NVIDIA · 4. Juni 2026	37.8	39	215 tok/s	512K	$0.68/$2.67	Details
#35 GPT-5.1 Codex (high) von OpenAI · 13. Nov. 2025	34.7	21	213 tok/s	400K	$1.25/$10.00	Details
#36 GPT-5.4 mini (medium) von OpenAI · 17. März 2026	29.8	26	210 tok/s	400K	$0.75/$4.50	Details
#37 GPT-5.1 Codex mini (high) von OpenAI · 13. Nov. 2025	30.6	42	210 tok/s	1.1M	$0.25/$2.00	Details
#38 Qwen3.7 Max von Alibaba · 19. Mai 2026	46.0	27	207 tok/s	1.0M	$2.50/$7.50	Details
#39 GPT-4o (Nov '24) von OpenAI · 20. Nov. 2024	11.2	6	204 tok/s	1.1M	$2.50/$10.00	Details
#40 GPT-5.6 Luna (max) von OpenAI · 9. Juli 2026	51.2	38	203 tok/s	1.1M	$1.00/$6.00	Details
#41 GPT-5.6 Luna (high) von OpenAI · 9. Juli 2026	46.1	35	199 tok/s	1.1M	$1.00/$6.00	Details
#42 GPT-5.6 Luna (xhigh) von OpenAI · 9. Juli 2026	49.1	37	197 tok/s	1.1M	$1.00/$6.00	Details
#43 Nemotron Nano 12B v2 VL (Non-reasoning) von NVIDIA · 28. Okt. 2025	4.6	9	196 tok/s	512K	$0.20/$0.60	Details
#44 GLM-5.2 (max) von Z AI · 16. Juni 2026	51.1	39	196 tok/s	1.0M	$1.40/$4.40	Details
#45 Nova 2.0 Lite (high) von Amazon · 29. Okt. 2025	18.2	22	194 tok/s	k. A.	$0.30/$2.50	Details
#46 Grok 4.20 0309 v2 (Non-reasoning) von SpaceXAI · 7. Apr. 2026	21.8	14	191 tok/s	2.0M	$2.00/$6.00	Details
#47 Qwen3 Next 80B A3B Instruct von Alibaba · 11. Sept. 2025	13.7	17	190 tok/s	1.0M	$0.50/$2.00	Details
#48 GPT-4.1 nano von OpenAI · 14. Apr. 2025	9.6	26	189 tok/s	1.1M	$0.10/$0.40	Details
#49 Nova 2.0 Lite (low) von Amazon · 29. Okt. 2025	17.8	22	187 tok/s	k. A.	$0.30/$2.50	Details
#50 GPT-5.6 Luna (Non-reasoning) von OpenAI · 9. Juli 2026	26.6	20	186 tok/s	1.1M	$1.00/$6.00	Details
#51 GPT-5.6 Luna (low) von OpenAI · 9. Juli 2026	33.3	25	185 tok/s	1.1M	$1.00/$6.00	Details
#52 GPT-5 nano (minimal) von OpenAI · 7. Aug. 2025	8.0	24	183 tok/s	1.1M	$0.05/$0.40	Details
#53 Jamba 1.6 Mini von AI21 Labs · 6. März 2025	2.6	6	182 tok/s	k. A.	$0.20/$0.40	Details
#54 GPT-5.6 Luna (medium) von OpenAI · 9. Juli 2026	38.1	29	182 tok/s	1.1M	$1.00/$6.00	Details
#55 GPT-5.4 mini (xhigh) von OpenAI · 17. März 2026	40.0	35	180 tok/s	400K	$0.75/$4.50	Details
#56 o4-mini (high) von OpenAI · 16. Apr. 2025	25.6	21	179 tok/s	k. A.	$1.10/$4.40	Details
#57 GPT-5 nano (high) von OpenAI · 7. Aug. 2025	19.9	61	178 tok/s	400K	$0.05/$0.40	Details
#58 Qwen3 Next 80B A3B (Reasoning) von Alibaba · 11. Sept. 2025	16.7	14	177 tok/s	1.0M	$0.50/$6.00	Details
#59 GPT-5.4 mini (Non-Reasoning) von OpenAI · 17. März 2026	16.6	14	176 tok/s	400K	$0.75/$4.50	Details
#60 Command A+ von Cohere · 20. Mai 2026	22.5	k. A.	175 tok/s	k. A.	k. A./k. A.	Details
#61 Small 4 (Reasoning) von Mistral · 16. März 2026	19.6	43	175 tok/s	262K	$0.15/$0.60	Details
#62 GPT-5 (ChatGPT) von OpenAI · 7. Aug. 2025	15.3	9	175 tok/s	128K	$1.25/$10.00	Details
#63 Trinity Large Thinking von Arcee AI · 1. Apr. 2026	24.5	44	174 tok/s	262K	$0.23/$0.88	Details
#64 GPT-5 nano (medium) von OpenAI · 7. Aug. 2025	19.0	58	174 tok/s	400K	$0.05/$0.40	Details
#65 GPT-5.4 nano (medium) von OpenAI · 17. März 2026	30.2	50	174 tok/s	400K	$0.20/$1.25	Details
#66 GPT-5 Codex (high) von OpenAI · 23. Sept. 2025	36.1	22	173 tok/s	400K	$1.25/$10.00	Details
#67 Qwen3.6 35B A3B (Non-reasoning) von Alibaba · 16. Apr. 2026	24.2	30	173 tok/s	262K	$0.38/$2.25	Details
#68 Nemotron 3 Super 120B A12B (Reasoning) von NVIDIA · 11. März 2026	25.4	46	172 tok/s	262K	$0.25/$0.78	Details
#69 Nova Lite von Amazon · 3. Dez. 2024	6.9	24	168 tok/s	k. A.	$0.06/$0.24	Details
#70 Qwen3.5 35B A3B (Non-reasoning) von Alibaba · 24. Feb. 2026	24.0	33	166 tok/s	262K	$0.25/$2.00	Details
#71 GPT-5.4 nano (xhigh) von OpenAI · 17. März 2026	38.2	63	163 tok/s	400K	$0.20/$1.25	Details
#72 GPT-5.2 Codex (xhigh) von OpenAI · 11. Dez. 2025	40.1	21	162 tok/s	400K	$1.75/$14.00	Details
#73 GPT-5.4 nano (Non-Reasoning) von OpenAI · 17. März 2026	17.6	29	161 tok/s	400K	$0.20/$1.25	Details
#74 Llama 3.1 Instruct 8B von Meta · 23. Juli 2024	7.6	31	161 tok/s	k. A.	$0.07/$0.09	Details
#75 Nemotron 3 Nano 30B A3B (Reasoning) von NVIDIA · 15. Dez. 2025	14.2	54	161 tok/s	512K	$0.05/$0.20	Details
#76 Small (Feb '24) von Mistral · 26. Feb. 2024	3.6	3	160 tok/s	262K	$1.00/$3.00	Details
#77 Ministral 3 3B von Mistral · 2. Dez. 2025	6.8	24	159 tok/s	k. A.	$0.10/$0.10	Details
#78 Small 3 von Mistral · 30. Jan. 2025	6.9	20	158 tok/s	262K	$0.10/$0.30	Details
#79 GPT-5.6 Terra (max) von OpenAI · 9. Juli 2026	55.0	26	157 tok/s	1.1M	$2.50/$15.00	Details
#80 Small 3.1 von Mistral · 17. März 2025	14.7	43	156 tok/s	262K	$0.10/$0.30	Details
#81 Hy3-preview (Non-reasoning) von Tencent · 23. Apr. 2026	26.1	66	156 tok/s	k. A.	$0.12/$0.43	Details
#82 Qwen3 30B A3B 2507 (Reasoning) von Alibaba · 30. Juli 2025	14.4	19	156 tok/s	1.0M	$0.20/$2.40	Details
#83 Qwen3 30B A3B 2507 Instruct von Alibaba · 29. Juli 2025	9.1	17	156 tok/s	1.0M	$0.20/$0.80	Details
#84 o3 von OpenAI · 16. Apr. 2025	30.4	18	155 tok/s	k. A.	$2.00/$8.00	Details
#85 Small 3.2 von Mistral · 20. Juni 2025	10.6	31	155 tok/s	262K	$0.10/$0.30	Details
#86 GPT-5.4 (xhigh) von OpenAI · 5. März 2026	51.4	24	152 tok/s	272K	$2.50/$15.00	Details
#87 Ling 2.6 Flash von InclusionAI · 21. Apr. 2026	14.1	41	152 tok/s	262K	$0.10/$0.30	Details
#88 Claude 4.5 Haiku (Reasoning) von Anthropic · 15. Okt. 2025	29.6	24	151 tok/s	k. A.	$1.00/$5.00	Details
#89 Hy3-preview (Reasoning) von Tencent · 23. Apr. 2026	33.6	85	150 tok/s	k. A.	$0.12/$0.43	Details
#90 Small 4 (Non-reasoning) von Mistral · 16. März 2026	12.4	27	149 tok/s	262K	$0.15/$0.60	Details
#91 GPT-3.5 Turbo von OpenAI · 30. Nov. 2022	3.6	5	149 tok/s	1.1M	$0.50/$1.50	Details
#92 GPT-4.1 von OpenAI · 14. Apr. 2025	19.4	12	149 tok/s	1.1M	$2.00/$8.00	Details
#93 Nova 2.0 Pro Preview (low) von Amazon · 27. Nov. 2025	19.6	12	149 tok/s	k. A.	$1.25/$10.00	Details
#94 Gemini 2.5 Pro von Google · 5. Juni 2025	25.8	16	148 tok/s	66K	$1.25/$10.00	Details
#95 Qwen3.5 122B A10B (Non-reasoning) von Alibaba · 24. Feb. 2026	27.6	30	147 tok/s	262K	$0.40/$3.20	Details
#96 Qwen3.5 35B A3B (Reasoning) von Alibaba · 24. Feb. 2026	29.3	40	145 tok/s	262K	$0.25/$2.00	Details
#97 Small (Sep '24) von Mistral · 17. Sept. 2024	4.7	10	145 tok/s	262K	$0.20/$0.60	Details
#98 Nova 2.0 Pro Preview (Non-reasoning) von Amazon · 27. Nov. 2025	14.4	9	143 tok/s	k. A.	$1.25/$10.00	Details
#99 Qwen3 VL 8B Instruct von Alibaba · 14. Okt. 2025	8.4	17	140 tok/s	1.0M	$0.18/$0.70	Details
#100 Qwen3.5 122B A10B (Reasoning) von Alibaba · 24. Feb. 2026	32.3	35	140 tok/s	262K	$0.40/$3.20	Details

Zeige 100 von 578 Modelle

Das KI-Modell-Leaderboard verstehen

Dieses umfassende KI-Modell-Leaderboard hilft Ihnen, zu vergleichen und auszuwählen die besten Large Language Models (LLMs) für Ihre Anforderungen. Wir erfassen standardisierte KI-Benchmarks, Token-Preise, Inference-Geschwindigkeit und Modellfähigkeiten bei allen großen KI-Anbietern wie OpenAI, Anthropic, Google, Meta, und DeepSeek.

Kern-KI-Benchmarks erklärt

MMLU-ProTestet breites Wissen über 14 akademische Fachbereiche

GPQADenken & Problemlösung auf Promotionsniveau

AIME 2025Mathematisches Denken auf Spitzenniveau

Coding IndexLiveCodeBench + SciCode kombiniert

Math IndexAIME + MATH-500 kombiniert

Wichtige Kennzahlen

Token-PreisgestaltungInput- vs. Output-Kosten pro 1 Mio. Tokens

Inference-GeschwindigkeitTokens/Sekunde für Antwortzeit

VeröffentlichungsdatumNeueste Techniken & Wissensstand

Benchmark-ScoresFähigkeitsvergleich von 0-100 %

So wählen Sie das richtige KI-Modell für Ihren Use Case

Für Forschung & Analyse

Priorisieren Sie Modelle mit hohen MMLU-Pro- (70 %+) und GPQA-Werten (60 %+), wenn es um komplexe Denkaufgaben, wissenschaftliche Recherche und technische Dokumentation geht

Für Kostenoptimierung

Sortieren Sie nach Input-/Output-Preisen - kleinere Modelle liefern bei einfachen Aufgaben oft 80 % der Flaggschiff-Leistung zu 10 % der Kosten

Für Mathe & MINT

Filtern Sie nach Math-Index oder AIME-2025-Scores (50 %+) für quantitative Analysen, Engineering-Berechnungen und wissenschaftliche Anwendungen

Alle Benchmark-Scores und Preisdaten werden täglich von Artificial Analysis aktualisiert, um die neuesten Modellversionen und Fähigkeiten abzubilden. Nutzen Sie die Sortierfilter oben, um KI-Modelle nach Intelligenz, Kosten, Coding-Fähigkeit, Mathe-Leistung, Geschwindigkeit oder Veröffentlichungsdatum zu finden.

Häufig gestellte Fragen

Was ist MMLU-Pro und warum gilt es als Standard-Benchmark für KI-Intelligenz?

MMLU-Pro (Massive Multitask Language Understanding - Professional) ist der umfassendste KI-Benchmark und testet Modelle in 14 akademischen Fachbereichen, darunter Mathematik, Naturwissenschaften, Geschichte, Recht und Ethik. Die Werte reichen von 46 % (Grundkompetenz) bis 87 % (nahe Expertenniveau). Modelle über 75 % zeigen starke allgemeine Intelligenz für professionelle Anwendungen, während Werte unter 60 % auf Einschränkungen bei komplexen Denkaufgaben hindeuten.

Was misst GPQA und welche Modelle erzielen die höchsten Werte?

GPQA (Graduate-level Google-Proof Q&A) prüft Denken auf Promotionsniveau mit Fragen, die bewusst "Google-proof" sind - sie erfordern tiefes Verständnis statt bloßer Faktenrecherche. Spitzenmodelle wie GPT-5.1 (87,3 %), GPT-5 mini (82,8 %) und o3 (82,7 %) sind bei GPQA besonders stark und eignen sich für Forschung, technische Analysen und komplexe Problemlösung. Modelle unter 50 % GPQA haben oft Schwierigkeiten bei anspruchsvollem Denken und liefern eher oberflächliche Antworten.

Was ist AIME 2025 und wie bewertet es die mathematischen Fähigkeiten von KI?

AIME 2025 (American Invitational Mathematics Examination) ist ein Benchmark auf Wettbewerbsniveau, der fortgeschrittene Problemlösung, Algebra, Geometrie und Zahlentheorie testet. Werte über 80 % (wie GPT-5 Codex mit 98,7 % oder GPT-5.1 mit 94 %) zeigen außergewöhnliches mathematisches Denken für Engineering, Scientific Computing und quantitative Analysen. Modelle unter 50 % können bei mehrstufigen mathematischen Aufgaben Probleme haben oder benötigen eine explizite Aufschlüsselung.

Wie wird die Preisgestaltung von KI-Modellen berechnet und was gilt als kosteneffizient?

Die Preise von KI-Modellen werden pro 1 Million Tokens berechnet (etwa 750.000 Wörter). Input-Preise betreffen den Text, den Sie senden, Output-Preise die generierten Antworten. Günstige Modelle wie Llama 3.3 70B kosten $0.54/$0.71 pro Million Tokens, Mid-Tier-Modelle wie GPT-5 nano $0.05/$0.40, Premium-Modelle wie GPT-5 $1.25/$10. Bei typischen Anwendungen mit einem Input-/Output-Verhältnis von 3:1 können Budget-Modelle 10- bis 20-mal günstiger sein und dennoch 70-80 % der Leistung liefern.

Welche KI-Modelle eignen sich am besten für Coding und Programmierung?

Sortieren Sie nach Coding Index um die besten Programmiermodelle zu sehen. Unser Coding Index kombiniert LiveCodeBench, SciCode und Coding-Benchmarks. Zu den Top-Performern gehören GPT-5.1 (57,5), GPT-5 mini (51,4) und GPT-5 Codex (53,5). Diese Modelle sind stark bei Codegenerierung, Debugging, Refactoring und der Erklärung komplexer Algorithmen. Für kostenbewusste Entwickler bieten Modelle mit 40+ Punkten im Coding Index ein sehr gutes Preis-Leistungs-Verhältnis für Routineaufgaben.

Wie oft werden KI-Modell-Benchmarks und Rankings aktualisiert?

Unser Leaderboard wird täglich mit der Artificial Analysis API synchronisiert, damit Benchmark-Scores (MMLU-Pro, GPQA, AIME 2025), Preise und Inference-Geschwindigkeit die neuesten Modellversionen widerspiegeln. Neue Modell-Releases erscheinen sofort unter der Sortierung "Neueste". Benchmark-Scores können sich ändern, wenn Anbieter aktualisierte Versionen veröffentlichen - zum Beispiel erreichte GPT-5.1 (veröffentlicht im November 2025) 69,7 Intelligenzpunkte gegenüber 68,5 bei GPT-5 aus August 2025.

Welche Inference-Geschwindigkeit (Tokens/Sekunde) brauche ich für meine Anwendung?

Die Inference-Geschwindigkeit bestimmt, wie schnell Modelle Antworten erzeugen. Für Echtzeit-Chatbots und interaktive Anwendungen sind 100+ Tokens/Sekunde sinnvoll (z. B. gpt-oss-120B mit 340 tok/s). Für Hintergrundverarbeitung und Batch-Jobs reichen 50-100 tok/s. Premium-Reasoning-Modelle wie GPT-5 (103 tok/s) balancieren Geschwindigkeit und Fähigkeiten. Wichtig: Höhere Geschwindigkeit bedeutet nicht automatisch bessere Qualität - langsamere Modelle liefern oft durchdachtere, detailliertere Antworten.

Kann ich diese KI-Modelle kostenlos testen, bevor ich mich entscheide?

Ja! Probieren Sie unsere kostenlose KI-Chatoberfläche aus, um verschiedene Modelle sofort ohne Account zu testen. Viele Anbieter haben ebenfalls kostenlose Stufen: OpenAI (ChatGPT mit Tageslimits), Anthropic (Claude mit Nutzungslimits), Google (Gemini Free Tier) und Open-Source-Modelle wie Llama 3.3. Vergleichen Sie die Leistung für Ihren konkreten Use Case, bevor Sie auf bezahlte Pläne wechseln.