RankingVulcanBench v3
VulcanBench v3
- Bucket
- Supporting evidence
- Unit
- percent
- Direction
- Higher is better
- Version
- v3
- Display harness
- VulcanBench v3 bare-bones API · Report 07 · high
- Board
- https://vulcanbench.com/benchmarks.html
The available records have no admitted matched comparison in the capability core. Raw results remain available below.
Compare published benchmark results with category weights →
Models
Other harnesses
These runs use other harnesses. Capability scoring matches configurations separately; model details identify which source records contribute.
| Model | Score | Harness | Evidence | Source-recorded date |
|---|---|---|---|---|
| Claude Opus 5Anthropic | 78.3% | VulcanBench v3 bare-bones API · Report 10 · high | official board | 2026-07-26 |
| Claude Opus 5Anthropic | 87% | VulcanBench v3 bare-bones API · Report 10 · low | official board | 2026-07-26 |
| Claude Opus 5Anthropic | 82.6% | VulcanBench v3 bare-bones API · Report 10 · medium | official board | 2026-07-26 |
| GLM-5.3Z.ai | 73.9% | VulcanBench v3 bare-bones API · Report 18 · high | official board | 2026-08-24 |
| GLM-5.3Z.ai | 78.3% | VulcanBench v3 bare-bones API · Report 18 · low | official board | 2026-08-24 |
| GLM-5.3Z.ai | 65.2% | VulcanBench v3 bare-bones API · Report 18 · max | official board | 2026-08-24 |
| GPT-5.6 SolOpenAI | 78.3% | VulcanBench v3 bare-bones API · Report 07 · low | official board | 2026-07-12 |
| GPT-5.6 SolOpenAI | 82.6% | VulcanBench v3 bare-bones API · Report 07 · medium | official board | 2026-07-12 |
| Grok 4.6xAI | 73.9% | VulcanBench v3 bare-bones API · Report 14 · high | official board | 2026-08-12 |
| Grok 4.6xAI | 82.6% | VulcanBench v3 bare-bones API · Report 14 · low | official board | 2026-08-12 |
| Grok 4.6xAI | 87% | VulcanBench v3 bare-bones API · Report 14 · medium | official board | 2026-08-12 |
| Grok 4.6xAI | 78.3% | VulcanBench v3 bare-bones API · Report 14 · xhigh | official board | 2026-08-12 |
| Grok-4.5xAI | 82.6% | VulcanBench v3 bare-bones API · Report 07 · low | official board | 2026-07-12 |
| Grok-4.5xAI | 91.3% | VulcanBench v3 bare-bones API · Report 07 · medium | official board | 2026-07-12 |
| Kimi K3Moonshot | 73.9% | VulcanBench v3 bare-bones API · Report 08 · max | official board | 2026-07-19 |
| Muse Spark 1.2Meta | 73.9% | VulcanBench v3 bare-bones API · Report 19 · high | official board | 2026-08-25 |
| Muse Spark 1.2Meta | 87% | VulcanBench v3 bare-bones API · Report 19 · low | official board | 2026-08-25 |
| Muse Spark 1.2Meta | 52.2% | VulcanBench v3 bare-bones API · Report 19 · xhigh | official board | 2026-08-25 |
| Qwen 3.8-MaxQwen | 81.2% | VulcanBench v3 bare-bones API · Report 12 · low | official board | 2026-08-04 |
| Qwen 3.8-MaxQwen | 71% | VulcanBench v3 bare-bones API · Report 12 · medium | official board | 2026-08-04 |
| Qwen 3.8-MaxQwen | 55.1% | VulcanBench v3 bare-bones API · Report 12 · xhigh | official board | 2026-08-04 |
| Qwen3.8-27BQwen | 82.6% | VulcanBench v3 bare-bones API · Report 17 · low | official board | 2026-08-21 |
| Qwen3.8-27BQwen | 82.6% | VulcanBench v3 bare-bones API · Report 17 · medium | official board | 2026-08-21 |
| Qwen3.8-27BQwen | 73.9% | VulcanBench v3 bare-bones API · Report 17 · xhigh | official board | 2026-08-21 |