The leaders, at a glance

AI coding model ranking

Compare AI coding models and effort settings using matched programming and software engineering benchmarks.

Coding leaders

Experimental comparison score · 0–100

For the selected profile and sources. Scores are experimental; small gaps may not be meaningful. How scoring works · Effort evidence collected

Explore all 109 sources Independent evaluations and lab reports

Distinct source pages with published results in the catalog. Multiple results and page sections count as one source.

Every ranked row is a measured configuration. The default view shows the highest-scoring supported configuration per model. In Value, the budget is applied first. Select All efforts for the full comparison. How effort ranking works.

Customize ranking
Adjust weights

Full ranking

175 entries

Custom capability ranking of measured model configurations. Scores are experimental; missing results remain unknown.
RankModelScoreCapability coverageanalyst-agentbriefcaseaimeapex-agentsaa-lcrautomationbenchcritptenterprise-opsgdp-pdfgdpvalgmmlugpqaharveyhleifbenchitbenchlivecodebenchmath500mmlu-prommmu-proomnisciencescicodetau-benchterminal-bencharc-agideepsweswe-bench-proarc-agi-3frontiercodeenigma-evalswe-atlas-qnaswe-atlas-refactoringswe-atlas-test-writinglivebench-mathlivebench-codinglivebench-languagelivebench-datamulti-swe-benchlivebench-reasoninglivebench-instructionsswe-rebenchepoch-game-puzzlesfrontiermathsimpleqavals-finance-agentvals-code-migrationvals-legal-researchvals-excel-modelingvibe-codechartographyosworldcharxivswe-bench-multilingualdeepsearchqaofficeqamcp-atlastoolathlonmrcrbrowsecomp
76Doubao Seed Code · ReasoningByteDance11.8Eligible · 100%14 published · 2 families · 1 selected capabilities76.4108/108 peersIndependent evidence76.4197/197 peersIndependent evidence56.3200/200 peersIndependent evidence41.663/63 peersIndependent evidence59.7212/212 peersIndependent evidence64.9208/208 peersIndependent evidence64.3178/178 peersIndependent evidence85.6112/112 peersIndependent evidence92.2114/114 peersIndependent evidence59.4114/114 peersIndependent evidence69.1198/198 peersIndependent evidence61.7171/171 peersIndependent evidence72.6169/169 peersIndependent evidence
77K EXAONE 2.0 750B A37B · ReasoningLG AI Research11.1Eligible · 100%10 published · 2 families · 1 selected capabilities60.1197/197 peersIndependent evidence66.8200/200 peersIndependent evidence56.3123/123 peersIndependent evidence73.8212/212 peersIndependent evidence71.7208/208 peersIndependent evidence17.9198/198 peersIndependent evidence41.591/91 peersIndependent evidence38.0112/112 peersIndependent evidence51.1125/125 peersIndependent evidence
78GPT-5 Mini · HighOpenAI10.9Eligible · 100%25 published · 4 families · 1 selected capabilities30.187/87 peersIndependent evidence93.1108/108 peersIndependent evidence77.0197/197 peersIndependent evidence46.389/89 peersIndependent evidence25.3200/200 peersIndependent evidence51.188/88 peersIndependent evidence50.8123/123 peersIndependent evidence81.063/63 peersIndependent evidence71.7212/212 peersIndependent evidence74.4208/208 peersIndependent evidence92.0178/178 peersIndependent evidence94.9112/112 peersIndependent evidence87.0114/114 peersIndependent evidence63.7114/114 peersIndependent evidence69.5198/198 peersIndependent evidence31.591/91 peersIndependent evidence60.6202/202 peersIndependent evidence37.3201/201 peersIndependent evidence33.338/38 peersIndependent evidence37.23/3 peersIndependent evidence
79o4-mini · HighOpenAI10.7Eligible · 100%16 published · 2 families · 1 selected capabilities93.1108/108 peersIndependent evidence56.6197/197 peersIndependent evidence61.0200/200 peersIndependent evidence61.0212/212 peersIndependent evidence66.2208/208 peersIndependent evidence80.2178/178 peersIndependent evidence99.4112/112 peersIndependent evidence97.560/60 peersIndependent evidence85.4114/114 peersIndependent evidence59.8114/114 peersIndependent evidence66.1198/198 peersIndependent evidence59.3171/171 peersIndependent evidence53.7169/169 peersIndependent evidence36.638/38 peersIndependent evidence
80Mistral Medium 3.5 · ReasoningMistral10.5Eligible · 100%22 published · 2 families · 1 selected capabilities41.528/28 peersIndependent evidence39.487/87 peersIndependent evidence46.9198/198 peersIndependent evidence47.989/89 peersIndependent evidence25.2200/200 peersIndependent evidence43.641/41 peersIndependent evidence33.388/88 peersIndependent evidence53.6123/123 peersIndependent evidence55.1212/212 peersIndependent evidence22.537/37 peersIndependent evidence62.5208/208 peersIndependent evidence81.2178/178 peersIndependent evidence51.8114/114 peersIndependent evidence67.4198/198 peersIndependent evidence37.791/91 peersIndependent evidence75.6202/202 peersIndependent evidence55.6201/201 peersIndependent evidence
81K EXAONE 236B A23B · ReasoningLG AI Research10.4Eligible · 100%15 published · 2 families · 1 selected capabilities92.2108/108 peersIndependent evidence62.4197/197 peersIndependent evidence68.8200/200 peersIndependent evidence30.9123/123 peersIndependent evidence32.563/63 peersIndependent evidence64.0212/212 peersIndependent evidence65.0208/208 peersIndependent evidence78.1178/178 peersIndependent evidence86.6112/112 peersIndependent evidence87.4114/114 peersIndependent evidence35.2198/198 peersIndependent evidence68.7171/171 peersIndependent evidence55.4201/201 peersIndependent evidence
82GLM-4.6 · ReasoningZ.ai9.5Eligible · 100%16 published · 2 families · 1 selected capabilities88.6108/108 peersIndependent evidence56.0197/197 peersIndependent evidence70.8200/200 peersIndependent evidence52.6123/123 peersIndependent evidence73.163/63 peersIndependent evidence63.1212/212 peersIndependent evidence66.3208/208 peersIndependent evidence50.3178/178 peersIndependent evidence72.8112/112 peersIndependent evidence83.0114/114 peersIndependent evidence75.1198/198 peersIndependent evidence60.2202/202 peersIndependent evidence64.6201/201 peersIndependent evidence
83Qwen3.5-122B-A10B · ReasoningQwen9.3Eligible · 100%19 published · 2 families · 1 selected capabilities35.687/87 peersIndependent evidence87.7197/197 peersIndependent evidence45.389/89 peersIndependent evidence63.2200/200 peersIndependent evidence35.888/88 peersIndependent evidence56.9123/123 peersIndependent evidence86.263/63 peersIndependent evidence82.2212/212 peersIndependent evidence79.8208/208 peersIndependent evidence94.2178/178 peersIndependent evidence79.2114/114 peersIndependent evidence67.3198/198 peersIndependent evidence35.191/91 peersIndependent evidence74.5202/202 peersIndependent evidence53.2201/201 peersIndependent evidence
84DeepSeek-R1-0528 · ReasoningDeepSeek9.2Eligible · 100%14 published · 2 families · 1 selected capabilities74.2108/108 peersIndependent evidence57.0197/197 peersIndependent evidence73.2200/200 peersIndependent evidence75.963/63 peersIndependent evidence69.4212/212 peersIndependent evidence67.7208/208 peersIndependent evidence41.1178/178 peersIndependent evidence87.5112/112 peersIndependent evidence94.660/60 peersIndependent evidence90.4114/114 peersIndependent evidence79.9198/198 peersIndependent evidence47.8171/171 peersIndependent evidence57.8169/169 peersIndependent evidence
85GLM-4.5 · ReasoningZ.ai9.2Eligible · 100%13 published · 2 families · 1 selected capabilities72.8108/108 peersIndependent evidence52.4197/197 peersIndependent evidence25.5200/200 peersIndependent evidence63.0212/212 peersIndependent evidence61.5208/208 peersIndependent evidence52.4178/178 peersIndependent evidence81.0112/112 peersIndependent evidence88.560/60 peersIndependent evidence86.3114/114 peersIndependent evidence70.8198/198 peersIndependent evidence51.7171/171 peersIndependent evidence66.0169/169 peersIndependent evidence
86Qwen3-235B-A22B-Thinking-2507 · ReasoningQwen9.0Eligible · 100%22 published · 3 families · 1 selected capabilities19.787/87 peersIndependent evidence94.5108/108 peersIndependent evidence76.3197/197 peersIndependent evidence31.389/89 peersIndependent evidence25.2200/200 peersIndependent evidence42.288/88 peersIndependent evidence26.8123/123 peersIndependent evidence71.663/63 peersIndependent evidence63.7212/212 peersIndependent evidence67.0208/208 peersIndependent evidence63.0178/178 peersIndependent evidence89.4112/112 peersIndependent evidence95.660/60 peersIndependent evidence89.2114/114 peersIndependent evidence62.5198/198 peersIndependent evidence42.091/91 peersIndependent evidence44.8202/202 peersIndependent evidence34.8201/201 peersIndependent evidence
87Amazon Nova 2 Pro Preview · MediumAmazon9.0Eligible · 100%16 published · 2 families · 1 selected capabilities91.2108/108 peersIndependent evidence49.8198/198 peersIndependent evidence24.9200/200 peersIndependent evidence37.3123/123 peersIndependent evidence64.8212/212 peersIndependent evidence50.8208/208 peersIndependent evidence97.7178/178 peersIndependent evidence80.9112/112 peersIndependent evidence84.0114/114 peersIndependent evidence48.6114/114 peersIndependent evidence60.9198/198 peersIndependent evidence87.5171/171 peersIndependent evidence58.8201/201 peersIndependent evidence
88GPT-5 Nano · MediumOpenAI8.7Eligible · 100%14 published · 2 families · 1 selected capabilities75.8108/108 peersIndependent evidence45.8197/197 peersIndependent evidence25.2200/200 peersIndependent evidence40.2212/212 peersIndependent evidence48.0208/208 peersIndependent evidence79.1178/178 peersIndependent evidence85.3112/112 peersIndependent evidence53.2114/114 peersIndependent evidence34.0114/114 peersIndependent evidence43.6198/198 peersIndependent evidence37.8171/171 peersIndependent evidence58.3169/169 peersIndependent evidence7.338/38 peersIndependent evidence
89Command A Plus 05 2026 · ReasoningCohere8.3Eligible · 100%19 published · 2 families · 1 selected capabilities24.887/87 peersIndependent evidence34.0198/198 peersIndependent evidence29.189/89 peersIndependent evidence56.1200/200 peersIndependent evidence12.088/88 peersIndependent evidence39.9123/123 peersIndependent evidence58.1212/212 peersIndependent evidence58.9208/208 peersIndependent evidence91.0178/178 peersIndependent evidence45.4114/114 peersIndependent evidence8.0198/198 peersIndependent evidence29.991/91 peersIndependent evidence49.2202/202 peersIndependent evidence52.6201/201 peersIndependent evidence
90Claude Haiku 4.5 · ReasoningAnthropic8.3Eligible · 100%27 published · 3 families · 1 selected capabilities46.228/28 peersIndependent evidence43.387/87 peersIndependent evidence84.0108/108 peersIndependent evidence64.1198/198 peersIndependent evidence37.789/89 peersIndependent evidence25.4200/200 peersIndependent evidence25.841/41 peersIndependent evidence37.288/88 peersIndependent evidence51.3123/123 peersIndependent evidence64.063/63 peersIndependent evidence40.8212/212 peersIndependent evidence17.837/37 peersIndependent evidence54.0208/208 peersIndependent evidence66.3178/178 peersIndependent evidence29.928/28 peersIndependent evidence64.0112/112 peersIndependent evidence49.2114/114 peersIndependent evidence34.9114/114 peersIndependent evidence44.2198/198 peersIndependent evidence43.991/91 peersIndependent evidence47.6202/202 peersIndependent evidence50.2201/201 peersIndependent evidence
91Qwen3.6-35B-A3B · ReasoningQwen8.2Eligible · 100%18 published · 2 families · 1 selected capabilities45.487/87 peersIndependent evidence78.1197/197 peersIndependent evidence43.389/89 peersIndependent evidence55.7200/200 peersIndependent evidence49.888/88 peersIndependent evidence60.1123/123 peersIndependent evidence76.6212/212 peersIndependent evidence76.8208/208 peersIndependent evidence77.1178/178 peersIndependent evidence80.4114/114 peersIndependent evidence48.6198/198 peersIndependent evidence27.891/91 peersIndependent evidence69.0202/202 peersIndependent evidence55.0201/201 peersIndependent evidence
92gpt-oss-20b · HighOpenAI7.6Eligible · 100%26 published · 3 families · 1 selected capabilities4.287/87 peersIndependent evidence44.2150/150 peersIndependent evidence0.026/26 peersIndependent evidence23.5198/198 peersIndependent evidence3.189/89 peersIndependent evidence72.2200/200 peersIndependent evidence25.988/88 peersIndependent evidence27.5123/123 peersIndependent evidence27.363/63 peersIndependent evidence17.9213/213 peersIndependent evidence55.5208/208 peersIndependent evidence76.8178/178 peersIndependent evidence87.6112/112 peersIndependent evidence44.3114/114 peersIndependent evidence31.5198/198 peersIndependent evidence31.491/91 peersIndependent evidence44.6202/202 peersIndependent evidence33.2201/201 peersIndependent evidence7.850/50 peersIndependent evidence
93Qwen3-Next-80B-A3B-Thinking · ReasoningQwen7.3Eligible · 100%16 published · 2 families · 1 selected capabilities85.1108/108 peersIndependent evidence63.7197/197 peersIndependent evidence25.5200/200 peersIndependent evidence18.5123/123 peersIndependent evidence57.063/63 peersIndependent evidence57.7212/212 peersIndependent evidence60.2208/208 peersIndependent evidence72.5178/178 peersIndependent evidence88.8112/112 peersIndependent evidence81.1114/114 peersIndependent evidence49.9198/198 peersIndependent evidence37.9202/202 peersIndependent evidence34.5201/201 peersIndependent evidence
94Magistral Medium 1.2 · ReasoningMistral7.2Eligible · 100%17 published · 2 families · 1 selected capabilities79.9108/108 peersIndependent evidence53.0197/197 peersIndependent evidence56.1200/200 peersIndependent evidence19.6123/123 peersIndependent evidence51.763/63 peersIndependent evidence52.9212/212 peersIndependent evidence52.8208/208 peersIndependent evidence50.0178/178 peersIndependent evidence83.2112/112 peersIndependent evidence73.6114/114 peersIndependent evidence37.5114/114 peersIndependent evidence56.7198/198 peersIndependent evidence39.8202/202 peersIndependent evidence40.5201/201 peersIndependent evidence
95NVIDIA-Nemotron-3-Super-120B-A12B-BF16 · ReasoningNVIDIA7.1Eligible · 100%21 published · 2 families · 1 selected capabilities3.887/87 peersIndependent evidence3.126/26 peersIndependent evidence49.0198/198 peersIndependent evidence38.789/89 peersIndependent evidence78.0200/200 peersIndependent evidence4.341/41 peersIndependent evidence30.488/88 peersIndependent evidence39.1123/123 peersIndependent evidence65.5212/212 peersIndependent evidence73.7208/208 peersIndependent evidence85.9178/178 peersIndependent evidence0.028/28 peersIndependent evidence65.8198/198 peersIndependent evidence25.791/91 peersIndependent evidence53.7202/202 peersIndependent evidence49.5201/201 peersIndependent evidence
96o3-mini · HighOpenAI7.0Eligible · 100%22 published · 3 families · 1 selected capabilities18.287/87 peersIndependent evidence41.0197/197 peersIndependent evidence14.289/89 peersIndependent evidence53.6200/200 peersIndependent evidence25.188/88 peersIndependent evidence21.2123/123 peersIndependent evidence59.4212/212 peersIndependent evidence6.2208/208 peersIndependent evidence77.9178/178 peersIndependent evidence78.9112/112 peersIndependent evidence96.060/60 peersIndependent evidence64.9114/114 peersIndependent evidence56.5198/198 peersIndependent evidence43.291/91 peersIndependent evidence26.0202/202 peersIndependent evidence23.2201/201 peersIndependent evidence25.438/38 peersIndependent evidence
97GLM-4.5-Air · ReasoningZ.ai6.8Eligible · 100%13 published · 2 families · 1 selected capabilities78.7108/108 peersIndependent evidence48.5197/197 peersIndependent evidence25.5200/200 peersIndependent evidence51.4212/212 peersIndependent evidence42.9208/208 peersIndependent evidence34.5178/178 peersIndependent evidence70.2112/112 peersIndependent evidence76.260/60 peersIndependent evidence72.5114/114 peersIndependent evidence34.5198/198 peersIndependent evidence56.1171/171 peersIndependent evidence63.7169/169 peersIndependent evidence
98Mistral Small 4 · ReasoningMistral6.3Eligible · 100%19 published · 2 families · 1 selected capabilities0.028/28 peersIndependent evidence22.687/87 peersIndependent evidence51.1197/197 peersIndependent evidence20.589/89 peersIndependent evidence55.8200/200 peersIndependent evidence1.888/88 peersIndependent evidence30.1123/123 peersIndependent evidence61.1212/212 peersIndependent evidence51.4208/208 peersIndependent evidence58.8178/178 peersIndependent evidence32.6114/114 peersIndependent evidence60.4198/198 peersIndependent evidence31.691/91 peersIndependent evidence31.6202/202 peersIndependent evidence38.9201/201 peersIndependent evidence
99Qwen3-Coder-Next · Non-reasoningQwen6.2Eligible · 100%18 published · 2 families · 1 selected capabilities27.887/87 peersIndependent evidence48.8197/197 peersIndependent evidence24.389/89 peersIndependent evidence25.4200/200 peersIndependent evidence29.588/88 peersIndependent evidence40.9123/123 peersIndependent evidence38.363/63 peersIndependent evidence51.8212/212 peersIndependent evidence51.5208/208 peersIndependent evidence29.7178/178 peersIndependent evidence32.4198/198 peersIndependent evidence24.991/91 peersIndependent evidence45.5202/202 peersIndependent evidence44.0201/201 peersIndependent evidence
100Amazon Nova 2 Lite · HighAmazon6.2Eligible · 100%15 published · 2 families · 1 selected capabilities96.4108/108 peersIndependent evidence61.0197/197 peersIndependent evidence54.6200/200 peersIndependent evidence29.0123/123 peersIndependent evidence69.9212/212 peersIndependent evidence59.9208/208 peersIndependent evidence83.8178/178 peersIndependent evidence76.9112/112 peersIndependent evidence77.4114/114 peersIndependent evidence45.7114/114 peersIndependent evidence49.8198/198 peersIndependent evidence67.1171/171 peersIndependent evidence42.2201/201 peersIndependent evidence

About this ranking

This profile gives coding all the weight. Only configurations with sufficient coding evidence receive a rank. Results from programming and software engineering evaluations are grouped into benchmark families so that repeated evaluations do not dominate. A model's position here can differ from its overall rank.

View the Capability ranking →

Behind the ranking

273 entries with published results · 175 ranked · 0 provisional estimates.

Explore seven capabilities, the original results, and gaps in the evidence.

Cite this ranking

Include the model and effort setting, the selected profile, and the dated data downloads. A shared link uses the latest data; it does not freeze a ranking in time.

UnifyBench ranking
Data updated: 12 Sept 2026
Mode: custom; evidence: documented; configurations: best
Weights: v3;agentic:0,hard_reasoning:0,coding:100,human_pref:0,knowledge:0,multimodal:0,long_context:0
https://unifybench.ai/rankings/coding?page=4

Catalog data · Effort measurements · Configuration scoring rules · Methodology

Catalog dated 12 Sept 2026. Effort evidence collected 12 Sept 2026. Collection dates are not evaluation dates.

What does the score mean?

The adjusted comparison score estimates performance against the same reference panel from matched published comparisons. Capability pools matched comparisons across families and checks aggregate breadth and independent corroboration. Custom profiles require support in every selected capability. Missing results never count as losses.

Family details show observed win shares against available reference peers. Those descriptive values are supporting evidence, not adjusted capability scores. Provider reports and independent results remain labeled. Matching reported settings do not establish equal inference effort, and score differences do not establish statistical significance.

Read the full methodology →