Claude Sonnet 5.5 max
Anthropic
Coding Score
„Das beste Modell“ hängt davon ab, was du brauchst. Der Gesamt-Score gewichtet Intelligenz, Coding und Agenten-Fähigkeiten — die anderen Ansichten sortieren dieselben Live-Daten nach genau einer Stärke.
Die fünf stärksten Modelle je Aufgabe, gemessen an genau einer passenden Kennzahl.
KI Weekly Coding-Index aus Terminal-Bench 4.0 und SciCode
Bei Wissensfragen kann ein Modell richtig antworten, zugeben, dass es etwas nicht weiß, oder eine Antwort erfinden. Wer viel weiß, erfindet nicht automatisch wenig.

Kostenlos mit Anmeldung
Melde dich an, um weiterzulesen
Alle 12 Modelle freischalten – kostenlos mit deinem KI-Weekly-Konto.
Anthropic
Coding Score
Meta
Inference-Tempo
Xiaomi
Open-Source Score
Anthropic
pro Index-Aufgabe
Bild- und Videomodelle werden im direkten Vergleich bewertet: Menschen wählen zwischen zwei Ergebnissen zum selben Prompt, daraus entsteht eine Elo-Zahl. Vier Disziplinen, je zehn Modelle — sortiert nach Elo, mit dem Abstand zur Nummer eins.
Vom ersten Release bis heute: Welche Labs und Modelle haben die Spitze mit ihrem heutigen KI Weekly Score verschoben?
| ModellA–Z | LabAnbieter | KonfigEffort | Score0–100 | IntelligenzAA-Index | CodingKI Weekly | Preis$ / 1M Tok. | TempoTok./s | ErschienenRelease | LandHerkunft | LizenzGewichte |
|---|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5#1 | Anthropic | Max, Default Fallback | 59,6 | 57,6 | 62,0 | 8,00 $ | 95 | Sept. 2026 | USA | Proprietär |
| Claude Sonnet 5.5#2 | Anthropic | Max, Default Fallback | 58,6 | 56,0 | 62,8 | 4,00 $ | 129 | Sept. 2026 | USA | Proprietär |
| Claude Fable 5.1#3 | Anthropic | Max, Default Fallback | 54,7 | 53,4 | 55,7 | 20,00 $ | 66 | Sept. 2026 | USA | Proprietär |
| Gemini 4 Argon#4 | High | 54,0 | 52,6 | 58,6 | 4,00 $ | – | Sept. 2026 | USA | Proprietär | |
| GPT-6 Astra#5 | OpenAI | Max | 53,9 | 52,7 | 58,2 | 20,00 $ | 47 | Sept. 2026 | USA | Proprietär |
| GPT-6.1 Sol#6 | OpenAI | Max | 52,8 | 51,8 | 55,4 | 4,00 $ | 55 | Sept. 2026 | USA | Proprietär |
| Claude Opus 5#7 | Anthropic | Max | 52,0 | 50,8 | 51,4 | 10,00 $ | 52 | Juli 2026 | USA | Proprietär |
| Claude Fable 5#8 | Anthropic | Max, Opus 4.8 Fallback | 50,0 | 49,6 | 48,6 | 20,00 $ | 65 | Juni 2026 | USA | Proprietär |
| GPT-6 Sol#9 | OpenAI | Max | 48,3 | 47,6 | 48,5 | 4,00 $ | 88 | Sept. 2026 | USA | Proprietär |
| Muse Spark 1.3#10 | Meta | Max | 48,2 | 48,1 | 41,8 | 2,00 $ | 211 | Sept. 2026 | USA | Proprietär |
| GPT-5.6 Sol#11 | OpenAI | Max | 47,6 | 47,0 | 45,6 | 8,00 $ | 78 | Juli 2026 | USA | Proprietär |
| MiMo-V2.6-Pro#12 | Xiaomi | Standard | 47,1 | 46,3 | 43,5 | 0,544 $ | 40 | Sept. 2026 | China | Open Source |
| Qwen3.8 Max#13 | Alibaba | 0902 | 46,6 | 45,4 | 43,3 | 3,00 $ | 37 | Sept. 2026 | China | Proprietär |
| GLM-5.3#14 | Z AI | Max | 46,6 | 44,8 | 47,6 | 2,15 $ | 82 | Aug. 2026 | China | Open Source |
| Grok 4.7#15 | SpaceXAI | Xhigh | 46,5 | 46,4 | 36,3 | 3,00 $ | 73 | Sept. 2026 | USA | Proprietär |
| Step 5 Preview#16 | StepFun | Standard | 44,3 | 43,7 | 41,9 | 1,43 $ | 88 | Sept. 2026 | China | Proprietär |
| Grok 4.6#17 | SpaceXAI | High | 43,9 | 44,3 | 33,0 | 3,00 $ | 62 | Aug. 2026 | USA | Proprietär |
| GLM 5.3 Flash#18 | Z AI | Standard | 42,9 | 41,8 | 39,1 | 0,238 $ | 51 | Aug. 2026 | China | Open Source |
| GPT-5.6 Terra#19 | OpenAI | Max | 42,7 | 42,1 | 41,9 | 4,50 $ | 108 | Juli 2026 | USA | Proprietär |
| Ling 3.1 Flash#20 | InclusionAI | Standard | 42,4 | 41,1 | 40,2 | 0,45 $ | 214 | Okt. 2026 | China | Proprietär |

Kostenlos mit Anmeldung
Melde dich an, um weiterzulesen
Alle 479 Modelle durchsuchen – kostenlos mit deinem KI-Weekly-Konto.
Unser redaktionelles Fähigkeitsprofil auf Daten von Artificial Analysis. Drei Indizes im geometrischen Mittel; Preis und Tempo separat:
AA Intelligence Index v4.3 auf seiner festen Originalskala. Der breite Fähigkeitsindex bildet die Basis unseres geometrischen Gesamtscores.
Coding (aus Terminal-Bench 4.0 und SciCode), berechnet von KI Weekly aus Artificial-Analysis-Benchmarks. Die Zusatzgewichtung betont Programmierarbeit.
Agenten (aus AA-Briefcase, GDPval-AA und AutomationBench), berechnet von KI Weekly aus Artificial-Analysis-Benchmarks.
Das gewichtete geometrische Mittel aus AA Intelligence und zwei von KI Weekly berechneten Teilwerten: Intelligenz (70 %), Coding (15 %) und Agenten (15 %). Coding und Agenten überlappen mit Intelligence und werden bewusst zusätzlich betont. AA Intelligence in Version 4.3 und beide abgeleiteten Werte sind Pflicht. Preis und Tempo verändern den Gesamtscore nicht. Die Gewichte sind eine redaktionelle Entscheidung, keine objektive Erfolgswahrscheinlichkeit.
Alle Benchmark-, Preis- und Tempo-Daten stammen von Artificial Analysis — einem unabhängigen Institut, das Modelle standardisiert und kontinuierlich vermisst. Anbieter können dort weder für Ergebnisse noch für Listungen bezahlen. Die Score-Berechnung, Gewichtung und Aufbereitung darüber ist von KI Weekly.
Täglich. Ein automatischer Abgleich holt jede Nacht die neuesten Messwerte, berechnet alle Scores neu und aktualisiert sämtliche Seiten — ohne manuelles Zutun. Neue Modelle tauchen in der Regel innerhalb von 24 bis 48 Stunden nach Release auf.
Ein Score verlangt AA Intelligence v4.3 sowie Coding aus Terminal-Bench 4.0 und SciCode und Agenten aus AA-Briefcase, GDPval-AA und AutomationBench. Fehlt ein Baustein, bleibt der Gesamtscore offen. Fehlendes Tempo oder fehlende Preise sind kein Ausschlussgrund. Der Free-Zugang liefert keinen Messstatus; unbekannt bedeutet nicht vollständig gemessen.
Ein Mischpreis aus Input- und Output-Token im Verhältnis 3:1 — das entspricht typischer Nutzung, bei der Prompts länger sind als Antworten. Ein Modell mit 1 $ Input- und 4 $ Output-Preis hat also einen Blended-Preis von 1,75 $ pro 1 Mio. Token.
Viele Modelle werden in mehreren Reasoning-Stufen vermessen — GPT-5.5 etwa von „low“ bis „xhigh“. Im Leaderboard zählt die beste Konfiguration je Modell; auf den Detailseiten sind alle Varianten einzeln aufgeführt und vergleichbar.
Modelle, deren Gewichte zum Download verfügbar sind — sie lassen sich selbst hosten und feintunen. Lizenzen mit Forschungs- oder Nicht-kommerziell-Klauseln kennzeichnen wir als eingeschränkt. Streng genommen heißt das „Open Weights“, wir verwenden den geläufigeren Begriff Open Source.
Datenbasis: Artificial Analysis · Score-Berechnung: KI Weekly
| ModellA–Z | LabAnbieter | KonfigEffort | Score0–100 | IntelligenzAA-Index | CodingKI Weekly | Preis$ / 1M Tok. | TempoTok./s | ErschienenRelease | LandHerkunft | LizenzGewichte |
|---|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5#1 | Anthropic | Max, Default Fallback | 59,6 | 57,6 | 62,0 | 8,00 $ | 95 | Sept. 2026 | USA | Proprietär |
| Claude Sonnet 5.5#2 | Anthropic | Max, Default Fallback | 58,6 | 56,0 | 62,8 | 4,00 $ | 129 | Sept. 2026 | USA | Proprietär |
| Claude Fable 5.1#3 | Anthropic | Max, Default Fallback | 54,7 | 53,4 | 55,7 | 20,00 $ | 66 | Sept. 2026 | USA | Proprietär |
| Gemini 4 Argon#4 | High | 54,0 | 52,6 | 58,6 | 4,00 $ | – | Sept. 2026 | USA | Proprietär | |
| GPT-6 Astra#5 | OpenAI | Max | 53,9 | 52,7 | 58,2 | 20,00 $ | 47 | Sept. 2026 | USA | Proprietär |
| GPT-6.1 Sol#6 | OpenAI | Max | 52,8 | 51,8 | 55,4 | 4,00 $ | 55 | Sept. 2026 | USA | Proprietär |
| Claude Opus 5#7 | Anthropic | Max | 52,0 | 50,8 | 51,4 | 10,00 $ | 52 | Juli 2026 | USA | Proprietär |
| Claude Fable 5#8 | Anthropic | Max, Opus 4.8 Fallback | 50,0 | 49,6 | 48,6 | 20,00 $ | 65 | Juni 2026 | USA | Proprietär |
| GPT-6 Sol#9 | OpenAI | Max | 48,3 | 47,6 | 48,5 | 4,00 $ | 88 | Sept. 2026 | USA | Proprietär |
| Muse Spark 1.3#10 | Meta | Max | 48,2 | 48,1 | 41,8 | 2,00 $ | 211 | Sept. 2026 | USA | Proprietär |
| GPT-5.6 Sol#11 | OpenAI | Max | 47,6 | 47,0 | 45,6 | 8,00 $ | 78 | Juli 2026 | USA | Proprietär |
| MiMo-V2.6-Pro#12 | Xiaomi | Standard | 47,1 | 46,3 | 43,5 | 0,544 $ | 40 | Sept. 2026 | China | Open Source |
| Qwen3.8 Max#13 | Alibaba | 0902 | 46,6 | 45,4 | 43,3 | 3,00 $ | 37 | Sept. 2026 | China | Proprietär |
| GLM-5.3#14 | Z AI | Max | 46,6 | 44,8 | 47,6 | 2,15 $ | 82 | Aug. 2026 | China | Open Source |
| Grok 4.7#15 | SpaceXAI | Xhigh | 46,5 | 46,4 | 36,3 | 3,00 $ | 73 | Sept. 2026 | USA | Proprietär |
| Step 5 Preview#16 | StepFun | Standard | 44,3 | 43,7 | 41,9 | 1,43 $ | 88 | Sept. 2026 | China | Proprietär |
| Grok 4.6#17 | SpaceXAI | High | 43,9 | 44,3 | 33,0 | 3,00 $ | 62 | Aug. 2026 | USA | Proprietär |
| GLM 5.3 Flash#18 | Z AI | Standard | 42,9 | 41,8 | 39,1 | 0,238 $ | 51 | Aug. 2026 | China | Open Source |
| GPT-5.6 Terra#19 | OpenAI | Max | 42,7 | 42,1 | 41,9 | 4,50 $ | 108 | Juli 2026 | USA | Proprietär |
| Ling 3.1 Flash#20 | InclusionAI | Standard | 42,4 | 41,1 | 40,2 | 0,45 $ | 214 | Okt. 2026 | China | Proprietär |

Kostenlos mit Anmeldung
Melde dich an, um weiterzulesen
Alle 479 Modelle durchsuchen – kostenlos mit deinem KI-Weekly-Konto.
KI Weekly Coding-Index aus Terminal-Bench 4.0 und SciCode

Kostenlos mit Anmeldung
Melde dich an, um weiterzulesen
Alle 12 Modelle freischalten – kostenlos mit deinem KI-Weekly-Konto.