能力坐标
模型不靠声量,
靠坐标说话。
每日读取官方评测,把模型能力拆成综合智能、编程与智能体三条清晰坐标。
- 更新频率
- 每日 00:00
- 榜单规模
- 3 × TOP 20
- 数据时间
- 9月27日 00:15
当前坐标 / AGENTIC
智能体能力指数
衡量模型规划、工具调用与完成多步骤自主任务的能力。
2026-09-27
- 01Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback)Anthropic · 2026-09-0157.9
- 02Claude Fable 5.1 (Adaptive Reasoning, Xhigh Effort, Default Fallback)Anthropic · 2026-09-0157.2
- 03Claude Opus 5 (Adaptive Reasoning, Max Effort)Anthropic · 2026-07-2456.5
- 04Qwen3.8 Max (0902)Alibaba · 2026-09-0256.0
- 05Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)Anthropic · 2026-07-2455.6
- 06Muse Spark 1.3 (max)Meta · 2026-09-0255.5
- 07Qwen3.8-Flash-NextAlibaba · 2026-08-2653.6
- 08Claude Fable 5.1 (Adaptive Reasoning, High Effort, Default Fallback)Anthropic · 2026-09-0153.1
- 09GLM-5.3 (max)Z AI · 2026-08-1853.1
- 10Grok 4.6 (high)SpaceXAI · 2026-08-1253.0
- 11Grok 4.6 (xhigh)SpaceXAI · 2026-08-1252.5
- 12Claude Opus 5 (Adaptive Reasoning, High Effort)Anthropic · 2026-07-2452.3
- 13Muse Spark 1.3 (xhigh)Meta · 2026-09-0251.5
- 14GPT-6 Astra (max)OpenAI · 2026-09-0351.0
- 15GLM 5.3 FlashZ AI · 2026-08-2650.9
- 16Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)Anthropic · 2026-06-0950.7
- 17Grok 4.6 (medium)SpaceXAI · 2026-08-1250.6
- 18Claude Fable 5.1 (Adaptive Reasoning, Medium Effort, Default Fallback)Anthropic · 2026-09-0150.2
- 19GPT-5.6 Sol (max)OpenAI · 2026-07-0950.2
- 20GPT-6 Astra (xhigh)OpenAI · 2026-09-0350.2