RankingBrowseComp · source release snapshot; version as labeled
BrowseComp · source release snapshot; version as labeled
- Bucket
- Agentic
- Unit
- percent
- Direction
- Higher is better
- Version
- source release snapshot; version as labeled
- Display harness
- Mistral Medium 3.5 model card performance charts
- Board
- https://huggingface.co/mistralai/Mistral-Medium-3.5-128B
Compare published benchmark results with category weights →
Models
| Model | Score | Harness | Evidence | Source-recorded date |
|---|---|---|---|---|
| Mistral Small 4Mistral | 21.3%Reported settings & sourceMaximum reasoning; Mistral same-lab comparison; tau3 4trials GPT5.2low user simulator; BrowseComp context-discard setup in card. First-party chart numeric label, visually verified. Mistral Medium 3.5 model card performance charts · images/image2.png · reviewed 2026-09-06 | Mistral Medium 3.5 model card performance charts | lab self-report | 2026-09-06 |
| Magistral Medium 1.2Mistral | 10%Reported settings & sourceMaximum reasoning; Mistral same-lab comparison; tau3 4trials GPT5.2low user simulator; BrowseComp context-discard setup in card. First-party chart numeric label, visually verified. Mistral Medium 3.5 model card performance charts · images/image2.png · reviewed 2026-09-06 | Mistral Medium 3.5 model card performance charts | lab self-report | 2026-09-06 |
| Mistral Medium 3.1Mistral | 7.8%Reported settings & sourceMaximum reasoning; Mistral same-lab comparison; tau3 4trials GPT5.2low user simulator; BrowseComp context-discard setup in card. First-party chart numeric label, visually verified. Mistral Medium 3.5 model card performance charts · images/image2.png · reviewed 2026-09-06 | Mistral Medium 3.5 model card performance charts | lab self-report | 2026-09-06 |