Gemini 3.1 Flash: benchmark results
Google's Gemini 3.1 Flash, the fast mid-tier of the Gemini 3.1 generation (March 2026). Provider: Google. Released 2026-03-03. Access: API.
Unified ELO 1648 ± 1, rank #133 of 1392 rated models, from 15 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| HarmVideoBench | 81.3 | Macro Avg. (self-reported) | 90 |
| Can Large Language Models Handle Discourse Par | 70.1 | Overall Avg (MS) (self-reported) | 88.9 |
| Chess Puzzles (Epoch AI) | 24 | Accuracy (%) | 71.2 |
| HOLMES | 54.31 | Overall Accuracy (self-reported) | 70 |
| Open Financial LLM - BloombergGPT | 80.88 | Average Score | 60 |
| Vision2Code | 3.17 | Avg. (self-reported) | 55.6 |
| Beyond Function Calling | 41.6 | Overall (self-reported) | 54.5 |
| BEAR-Bench | 59.8 | Overall (%) | 53.3 |
| TaxBench | 15.93 | Mean pass^5 (computed) (self-reported) | 53.3 |
| CC-OCR V2 | 61.36 | Average (self-reported) | 50 |
| CheXpercept | 87.1 | Stage 1 (End-to-End) (self-reported) | 46.2 |
| PerfCodeBench | 45.89 | CGRE (self-reported) | 36.8 |
Interactive version: theaggregate.ai/model?slug=gemini-3-1-flash · How It Works · Data refreshed daily, snapshot 2026-09-05.