AI 模型对比评测
基准评测矩阵
数据截至 2026年9月13日
🇨🇳
中文
🇺🇸
English
🇩🇪
Deutsch
🇨🇭
Deutsch (Schweiz)
🇮🇹
Italiano
🇸🇪
Svenska
🇫🇷
Français
🇪🇸
Español
🇳🇱
Nederlands
🇨🇳
中文
✓
🇹🇭
ไทย
🇨🇿
Čeština
🇭🇺
Magyar
暗黑
明亮
基准基线:
Claude Code + Sonnet 5 Medium = 100% 质量 / 100% 额度 / 100% 可靠性
绿色质量 = 优于基准
绿色额度 = 比基准更节省
绿色可靠性 = 更高自主性
Laravel
39
HTML5 / CSS / JavaScript
39
Godot / 游戏开发
39
Blender / 3D
39
C++ / 原生应用
39
文档处理
39
深度调研 / 综合分析
39
商业 / 财务 / 测算
39
选品 / 购物 / 搜索
39
新闻 / 时政 / 科技
39
医疗 / 健康
39
个人建议 / 心理 / 哲学
39
环境:
全部环境
39
Claude Code
15
Codex
10
Antigravity
10
Grok Build
4
环境
模型
Effort
质量
质量
↕
额度消耗
额度
↕
可靠性
可靠性
↕