KI-Modelle Vergleich
Benchmark-Matrix
Daten vom 13. September 2026
🇩🇪
Deutsch
🇺🇸
English
🇩🇪
Deutsch
✓
🇨🇭
Deutsch (Schweiz)
🇮🇹
Italiano
🇸🇪
Svenska
🇫🇷
Français
🇪🇸
Español
🇳🇱
Nederlands
🇨🇳
中文
🇹🇭
ไทย
🇨🇿
Čeština
🇭🇺
Magyar
Dunkel
Hell
Referenz:
Claude Code + Sonnet 5 Medium = 100% Qualität / 100% Limit / 100% Zuverlässigkeit
Grüne Qualität = besser als Referenz
Grünes Limit = sparsamer als Referenz
Grüne Zuverlässigkeit = höhere Autonomie
Laravel
39
HTML5 / CSS / JavaScript
39
Godot / Spieleentwicklung
39
Blender / 3D
39
C++ / Native Apps
39
Dokumente
39
Forschung / Analyse / Deep Research
39
Business / Finanzen / Kalkulationen
39
Auswahl / Einkaufen / Suche
39
Nachrichten / Politik / Technik
39
Medizin / Gesundheit
39
Persönlicher Rat / Psychologie / Philosophie
39
Umgebung:
Alle Umgebungen
39
Claude Code
15
Codex
10
Antigravity
10
Grok Build
4
Umgebung
Modell
Effort
Qualität
Qualität
↕
Limitverbrauch
Limit
↕
Zuverlässigkeit
Zuverlässigk.
↕