RankingTerminal-Bench 4.0

Terminal-Bench 4.0

Data updated 23 Sept 2026

Bucket
Coding
Unit
percent
Direction
Higher is better
Version
4.0
Display harness
Terminal-Bench 4.0 reported
Board
https://www.tbench.ai/

Compare published benchmark results with category weights →

Models

Results are ordered by score in the display harness, followed by models with no result. Other harnesses are listed separately below. Missing results remain unknown.

101–125 of 455 entries

ModelScoreEvidenceSource-recorded date
ERNIE-4.5-VL-424B-A47B-PTBaidu
ERNIE-5.0Baidu
ERNIE-5.0-thinking-expBaidu
ERNIE-5.0-thinking-latestBaidu
ERNIE-5.0-thinking-previewBaidu
ERNIE-5.1Baidu
EXAONE 3.0 7.8B InstructLG AI Research
EXAONE 3.5 2.4B InstructLG AI Research
EXAONE 3.5 32B InstructLG AI Research
EXAONE 3.5 7.8B InstructLG AI Research
EXAONE 4.0 1.2BLG AI Research
EXAONE 4.0 32BLG AI Research
EXAONE 4.0.1 32BLG AI Research
EXAONE 4.5 33BLG AI Research
EXAONE Deep 2.4BLG AI Research
EXAONE Deep 32BLG AI Research
EXAONE Deep 7.8BLG AI Research
Gemini 2.5 FlashGoogle
Gemini 2.5 Flash-LiteGoogle
Gemini 2.5 ProGoogle
Gemini 3 Flash PreviewGoogle
Gemini 3.1 Flash-LiteGoogle
Gemini 3.1 ProGoogle
Gemini 3.5 FlashGoogle
Gemini 3.5 Flash-LiteGoogle