排名01專有模型
Claude Fable 5.1
Anthropic
- 綜合推理 第 1 位
- 文本偏好 第 3 位
- 智能代理任務 第 1 位
98
100%
3 項評測訊號
集合多個公開 LLM 評測榜單的訊號,整理成一個可讀、可追溯、每日自動更新的模型排名快照。
模型
20
訊號
44
更新日期
2026-09-08
香港時間每日 00:00 自動更新
共識快照
多個公開評測訊號,整理成一張決策表。
共識分數並非原始跑分,而是跨評測排名位置的加權結果;同一產品線的不同推理強度與版本會合併,只取最佳成績。
Anthropic
98
100%
3 項評測訊號
Anthropic
93
100%
3 項評測訊號
OpenAI
90
40%
1 項評測訊號
Anthropic
88
100%
3 項評測訊號
Meta
79
40%
1 項評測訊號
OpenAI
73
100%
3 項評測訊號
Anthropic
73
60%
2 項評測訊號
Kimi
69
100%
3 項評測訊號
Anthropic
63
60%
2 項評測訊號
Tencent
63
30%
1 項評測訊號
Anthropic
61
60%
2 項評測訊號
58
100%
3 項評測訊號
Meta
56
30%
1 項評測訊號
Alibaba
54
100%
3 項評測訊號
OpenAI
54
60%
2 項評測訊號
Z AI
49
100%
3 項評測訊號
48
30%
1 項評測訊號
Meta
41
100%
3 項評測訊號
Alibaba
41
40%
1 項評測訊號
SpaceXAI
39
100%
3 項評測訊號
計算方法
如果要把這個排行榜接到貴公司的模型選型、提示詞測試或智能代理工作流程,我們可以幫你拆成可重跑的評測流程。