Large Language Models

docAnalyzer keeps pace with releases from Alibaba, Anthropic, DeepSeek, Google, Minimax, Moonshot AI, OpenAI, Xiaomi, and xAI, adding new models within days so you can pick the right fit for every workflow. We surface 22 models across 9 creators, each benchmarked for quality, speed, and responsiveness.

Refreshed 2026-09-20

52.7 top quality · GPT-6 Astra
351 tok/s top speed · Gemini 3.5 Flash Lite
0 ms top responsiveness · GPT-5 nano
Model
GPT-6 Astra OpenAI
52.7
60 tok/s
206.39 s
Claude Opus 5 Anthropic
50.8
52 tok/s
29.83 s
GPT-5.6 Sol OpenAI
47.0
65 tok/s
64.46 s
Qwen3.8 Max Alibaba
45.4
39 tok/s
1.72 s
Grok 4.6 xAI
44.3
58 tok/s
35.83 s
Kimi K3 Moonshot AI
43.6
40 tok/s
2.81 s
GPT-5.6 Terra OpenAI
42.1
91 tok/s
115.76 s
Gemini 3.8 Flash Google
40.9
312 tok/s
12.22 s
DeepSeek V4.1 Flash DeepSeek
39.5
225 tok/s
810 ms
Claude Sonnet 5 Anthropic
38.2
78 tok/s
116.56 s
GPT-5.6 Luna OpenAI
37.3
155 tok/s
81.86 s
Qwen 3.8 27B Alibaba
33.7
44 tok/s
1.25 s
Gemini 3.1 Pro Preview Google
29.7
125 tok/s
24.64 s
Qwen3.7 Max Alibaba
29.5
0 tok/s
0 ms
MiniMax M3 Minimax
29.2
110 tok/s
980 ms
MiMo V2.5 Pro Xiaomi
26.0
50 tok/s
3.48 s
Qwen3.7 Plus Alibaba
25.2
67 tok/s
1.61 s
MiMo V2.5 Xiaomi
25.2
32 tok/s
2.24 s
Grok 4.3 xAI
24.9
0 tok/s
0 ms
Gemini 3.5 Flash Lite Google
22.2
351 tok/s
6.71 s
Claude Haiku 4.5 Anthropic
16.9
114 tok/s
13.49 s
GPT-5 nano OpenAI
13.0
0 tok/s
0 ms

* Latency uses a logarithmic scale: shorter time means a longer bar.