Neura Intelligence Index
AI Model Benchmarks
Neura Market
Marketplace
Directories
Resources
Sell
Search...
β
K
Sign In
Get Started
Back to Leaderboard
TerminalBench
Terminal/CLI task completion β executing shell commands to achieve goals.
coding
0-100 percent
Model Rankings (25)
#
Model
Score
Provider
Source
1
Claude Sonnet 4.5
πΊπΈ
50
Anthropic
verified
2
MiniMax M2.1
π¨π³
47.9
MiniMax
verified
3
M
Kimi K2-Thinking-0905
π¨π³
47.1
Moonshot AI
verified
4
MiniMax M2
π¨π³
46.3
MiniMax
verified
5
Claude Opus 4.1
πΊπΈ
43.3
Anthropic
verified
6
Nova 2 Pro
πΊπΈ
41.3
Amazon
verified
7
Claude Haiku 4.5
πΊπΈ
41
Anthropic
verified
8
Z
GLM-4.6
π¨π³
40.5
Zhipu AI
verified
9
M
LongCat-Flash-Chat
π¨π³
39.5
Meituan
verified
10
Claude Opus 4
πΊπΈ
39.2
Anthropic
verified
11
DeepSeek-V3.2-Exp
π¨π³
37.7
DeepSeek
verified
12
Z
GLM-4.5
π¨π³
37.5
Zhipu AI
verified
13
Claude Sonnet 4
πΊπΈ
35.5
Anthropic
verified
14
Claude 3.7 Sonnet
πΊπΈ
35.2
Anthropic
verified
15
M
LongCat-Flash-Lite
π¨π³
33.8
Meituan
verified
16
Z
GLM-4.7
π¨π³
33.3
Zhipu AI
verified
17
Nova 2 Lite
πΊπΈ
32.5
Amazon
verified
18
DeepSeek-V3.1
π¨π³
31.3
DeepSeek
verified
19
X
MiMo-V2-Flash
π¨π³
30.5
Xiaomi
verified
20
Z
GLM-4.5-Air
π¨π³
30
Zhipu AI
verified
21
M
Kimi K2 Instruct
π¨π³
30
Moonshot AI
verified
22
Nemotron 3 Super (120B A12B)
πΊπΈ
25.8
NVIDIA
verified
23
M
Kimi K2-Instruct-0905
π¨π³
25
Moonshot AI
verified
24
Nemotron 3 Nano (30B A3B)
πΊπΈ
8.5
NVIDIA
verified
25
DeepSeek-R1-0528
π¨π³
5.7
DeepSeek
verified
TerminalBench β AI Model Leaderboard & Results | Neura Market