全球产品
全球模型
前沿
评测基准
开源项目
行业动态
技术解读
集群网络交换机
Agent
搜索
分享
产品榜单
AI++指数
开源项目
全部
行业动态
全部
技术解读
全部
集群网络
旗舰总览
超级集群
交换机
交换芯片
光互联
铜连接
白盒开放
DPU
网络OS
前
前沿
模
模型
测
评测
行
行业
源
开源
技
技术
比
模型对比
热
产品对比
问
Agent
群
交流群
评测基准榜
Artificial Analysis 公开指数 · 分数越高越好 · 点击可进模型详情
· 最后更新 今天 18:31
综合智能
写代码
当助手
生成榜单图
名次
模型
综合智能
写代码
当助手
1
Claude Fable 5.1
多模态
1M 上下文
53.4
81.6
58
2
Qwen3.8 Max
多模态
1M 上下文
53.4
68.9
49.9
3
GPT-6 Astra
多模态
1.1M 上下文
52.8
76.9
51.5
4
Claude Opus 5
多模态
1M 上下文
50.7
78
56.2
5
Claude Fable 5
多模态
1M 上下文
49.7
76.5
51
6
GPT-5.6 Sol
多模态
1.1M 上下文
47.1
77.4
50.5
7
GLM-5.3
文本
1.3M 上下文
44.9
74.8
53.4
8
Grok 4.6
多模态
500K 上下文
44.4
76.8
53.4
9
Kimi K3
多模态
1.0M 上下文
43.8
76.2
50.6
10
GPT-5.6 Terra
多模态
1.1M 上下文
42.3
76.7
43.7
11
Claude Opus 4.8
多模态
1M 上下文
42
74.3
42.6
12
GLM-5.3-Flash
多模态
1.3M 上下文
41.9
71.5
51.2
13
Gemini 3.8 Flash
多模态
1.0M 上下文
41.2
76.3
41.1
14
Qwen3.8 Max
多模态
1M 上下文
40.3
71.8
49.6
15
Qwen3.8 2.4T A95B
文本
1.0M 上下文
40
71.9
50.4
16
Muse Spark 1.2
多模态
1.0M 上下文
39.8
72.2
44
17
Gemini 3.7 Flash
多模态
1.0M 上下文
39.4
76.1
36.4
18
Grok 4.5
多模态
500K 上下文
39.1
72.4
42.1
19
GPT-5.5
多模态
1.1M 上下文
38.6
74.9
37.3
20
Claude Sonnet 5
多模态
1M 上下文
38.4
71.5
44.3
21
GPT-5.6 Luna
多模态
1.1M 上下文
37.5
71.4
42.7
22
DeepSeek V4 Pro 0813
文本
1.0M 上下文
36.3
68.8
42.3
23
DeepSeek V4 Flash 0731
文本
1.3M 上下文
34.5
69.1
41.7
24
Gemini 3.6 Flash
多模态
1.0M 上下文
34.3
69.2
30.2
25
Muse Spark 1.1
多模态
1.0M 上下文
34.3
71.3
27.5
26
Qwen3.8 27B
多模态
1M 上下文
33.9
68.1
46.5
27
Gemini 3.5 Flash
多模态
1.0M 上下文
33
70.1
27.3
28
DeepSeek V4 Pro
文本
1.0M 上下文
30.9
59.4
27.7
29
Claude Sonnet 4.6
多模态
1M 上下文
30.5
63
33.1
30
Gemini 3.1 Pro Preview
多模态
1.0M 上下文
30.4
68.8
10.3
31
Qwen3.7 Max
文本
1M 上下文
29.9
66
23.9
32
MiniMax-M3
多模态
1.0M 上下文
29.6
58.6
30.8
33
Ling 3.0 Flash
文本
262K 上下文
27.4
50.6
21.1
34
MiMo-V2.5-Pro
文本
1.1M 上下文
26.4
60.2
22.7
35
Kimi K2.7 Code
多模态
262K 上下文
26.3
60.8
22.5
36
Inkling Small
多模态
1.0M 上下文
26.1
52.9
25
37
Qwen3.7 Plus
多模态
1M 上下文
25.8
55.9
19.7
38
Hy3
文本
262K 上下文
25.8
58.8
25.6
39
Inkling
多模态
1.0M 上下文
25.5
52.1
24.3
40
Grok 4.3
多模态
1M 上下文
25.4
42.2
17.2
41
DeepSeek V4 Flash
文本
1.0M 上下文
24.8
52
27.9
42
GPT-5.4 mini
多模态
400K 上下文
24.6
56.1
19.7
43
Nemotron 3 Ultra 550B A55B
文本
262K 上下文
23.4
49.3
21.7
44
MiniMax-M2.7
文本
205K 上下文
23.2
52.6
16.8
45
Gemini 3.5 Flash-Lite
多模态
1.0M 上下文
22.7
49.3
15.9
46
MiMo-V2.5
多模态
1.1M 上下文
22.3
56.8
17.4
47
Qwen3.6 27B
多模态
262K 上下文
21.9
53.7
20.1
48
Claude 4.5 Sonnet
多模态
1M 上下文
21.2
52.1
17.5
49
GPT-5.4 nano
多模态
400K 上下文
21.2
56.1
17.7
50
LongCat 2.0
文本
1.0M 上下文
19.7
45.3
15.9
51
Qwen3.5 397B A17B
多模态
262K 上下文
19.1
48.2
10.6
52
Nova 2.0 Lite
多模态
1M 上下文
18.4
23
3.1
53
Claude 4.5 Haiku
多模态
200K 上下文
17.6
43.9
10.3
54
GPT-5 mini
多模态
400K 上下文
17.4
15.6
8.9
55
Ring-2.6-1T
文本
262K 上下文
17.3
42.8
12.9
56
K2 Think V2
文本
262K 上下文
17.2
21
1.8
57
Qwen3 Next 80B A3B
文本
262K 上下文
16.9
17.4
2.1
58
Gemini 2.5 Pro
多模态
1.0M 上下文
16.7
33.3
3.5
59
Qwen3.5 122B A10B
多模态
262K 上下文
16.2
45.7
9.6
60
Gemini 3.1 Flash-Lite
多模态
1.0M 上下文
16
34.7
3.2
61
DeepSeek V3.1 Terminus
文本
164K 上下文
15.4
43.5
8.9
62
Gemma 4 31B
多模态
262K 上下文
15.4
43.4
6.7
63
Mistral Medium 3.5
多模态
262K 上下文
14.9
46.9
9.4
64
GPT-4.1 mini
多模态
1.0M 上下文
14.8
20.2
1.8
65
Mistral Medium 3.1
多模态
131K 上下文
14.7
20.5
6.1
66
Command A+
文本
256K 上下文
13.9
27.8
3.6
67
Granite 4.2 8B
文本
131K 上下文
13.9
22.4
3.8
68
Nemotron 3 Super 120B A12B
文本
262K 上下文
13.6
37.7
4.1
69
Nemotron 3.5 Lightning
文本
1M 上下文
13.6
26.8
6.1
70
Qwen3 235B A22B 2507
文本
131K 上下文
12.7
22.1
1.3
71
Claude 3.5 Haiku
12.4
15.9
1.9
72
gpt-oss-120b
文本
131K 上下文
12.3
30.4
6.2
73
Ling 3.0 Tiny
文本
262K 上下文
11.9
26.5
7.1
74
Mercury 2
文本
128K 上下文
11.5
31.1
4
75
Mistral Small 4
多模态
262K 上下文
11.5
26.6
1.4
76
DeepSeek R1
文本
64K 上下文
11.4
24.6
1.1
77
o3-mini
文本
200K 上下文
11
16.3
0.9
78
Trinity Large Thinking
文本
262K 上下文
10.9
25.8
1.2
79
Qwen3 Coder Next
文本
262K 上下文
10.1
36.2
3.6
80
Qwen3 30B A3B 2507
文本
82K 上下文
9.8
12.1
0.9
81
DeepSeek V3 0324
文本
164K 上下文
9.7
21.2
0.8
82
Mistral Large 3
多模态
262K 上下文
9.7
20.1
2.4
83
GPT-4.1 nano
多模态
1.0M 上下文
9.6
11.1
1.2
84
Llama 3.3 Instruct 70B
文本
131K 上下文
9.4
11.9
0.3
85
Devstral 2
文本
262K 上下文
9.4
31.3
4.9
86
Llama 4 Maverick
多模态
1.0M 上下文
9.3
16.3
0.6
87
gpt-oss-20b
文本
131K 上下文
9
20.7
1.4
88
NVIDIA Nemotron 3 Nano 30B A3B
文本
262K 上下文
8.9
14.4
1
89
DeepSeek V3
文本
164K 上下文
8.5
23
0.8
90
Devstral Small 2
8.4
29.3
4.8
91
Solar Pro 3
文本
131K 上下文
7.8
16.2
1.4
92
Llama 3.1 Instruct 8B
文本
131K 上下文
7.6
5.4
0.5
93
Mistral Small 3.1
文本
33K 上下文
7.4
26.3
2.1
94
Qwen3 32B
文本
131K 上下文
7.2
15.3
0.9
95
Llama 4 Scout
多模态
1.3M 上下文
6.5
8.2
0.5
96
Qwen3 14B
文本
131K 上下文
6.4
13.8
0.9
97
Phi-4 Mini Instruct
文本
16K 上下文
6
3.8
0.3
98
Ministral 3 14B
多模态
262K 上下文
6
14.4
1.1
99
Ministral 3 8B
多模态
262K 上下文
5.5
9.7
0.6
100
Qwen3 8B
文本
131K 上下文
5.2
9
0.8
AI++指数
全部
1
Hermes Agent
办公智能体
97.5
2
Claude Code
Coding
93.4
3
Kilo Code
Coding
92.1
4
Zazen (Freebuff fork)
办公智能体
91.2
5
Cline
Coding
91.1
6
pi
Coding
90.2
7
OpenClaw
办公智能体
89.6
8
omp
Coding
88.7
前沿
全部
开源 · 6小时前
Open WebUI v0.11.3 发布:sub-agents 后台子代理 + 工具调用前人工审批成标配
产品 · 1天前
Nous Research 给 Hermes Agent 换上浏览器管理后台:CLI 党的全功能面板
产品 · 2天前
HeyDitto 1.0.3 更新:接入 Hippius 去中心化私密存储,记忆可存在自己的密钥下
开源 · 4天前
Claude Code 记忆层开源项目 claude-mem 冲上用量榜:给编程 Agent 补跨会话长期记忆
工具 · 5天前
Sentry 推出 MCP Server:让 Claude Code / Cursor 直接拉生产错误做根因分析
工具 · 6天前
Qwen Code live-host v0.2.0:OpenTUI 迁移、模型热重载、AUTO 模式永不自动批准越界写
最新模型
全部
对比
GPT-6 Astra
OpenAI
·
09.05
52.8
Qwen3.8 Max (0902)
Qwen
·
09.04
40.3
Gemini 3.8 Flash
Google
·
09.02
41.2
Claude Fable 5.1
Anthropic
·
09.02
53.4
Granite 4.2 8B
IBM
·
09.01
22.4
GLM 5.3 Flash
Z.ai
·
08.26
41.9
行业动态
全部
产业观察 · 2026-09-09
个人 Agent 网关成新品类:OpenClaw 养虾热潮与自托管智能体的入口之争
竞争格局 · 2026-09-08
开源 Coding Agent 2026:Qwen Code 入场,Claude Code 的护城河被三条路同时撬动
产业观察 · 2026-09-01
AI 3D 生成迎来产业化分水岭:VAST 30 亿融资 + Tripo P2.0,影眸同日发布世界生成模型
产业观察 · 2026-09-05
Bun 1.4 把运行时变成『全栈平台』:JS 运行时之战从『跑得快』卷到『什么都不用装』
融资并购 · 2026-09-04
Palo Alto 收购 Portkey:AI 网关从「省钱工具」被重新定价为「安全合规层」
开源项目
全部
OpenClaw Foundation
OpenClaw:在 WhatsApp / Telegram 里直接使唤的本地个人 Agent 网关
Significant Gravitas
AutoGPT
LangGenius
Dify
Ollama Inc.
Ollama
open-webui
Open WebUI
技术解读
全部
训练方法
GRPO:DeepSeek 用来训练推理模型的「去 Critic」强化学习方法
推理部署
PagedAttention:把操作系统的虚拟内存思想搬进 LLM 推理
模型能力
Test-time Compute:把「思考时间」当作新的扩展维度
智能体
Open WebUI 的 sub-agents 架构:把长任务拆给后台子代理,主对话为何不再卡顿
工程实践
Qwen Code 的 Agent 架构:从 Gemini CLI 分叉后,它如何把子代理并行、自动记忆与常驻 daemon 塞进终端
关注公众号
加入交流群
我是 AI++ Agent
跟我对话,帮你从站内数据里找到产品、模型与资讯机会~
当前评测基准里编码/智能体最强的模型是哪些?