Gemini 3.5 Flash (High): benchmark results
Gemini 3.5 Flash evaluated at the high reasoning-effort setting. Provider: Google. Released 2026-05-19. Access: API.
Unified ELO 1713 ± 1, rank #76 of 1761 rated models, from 156 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| AA APEX-Agents | 47.05 | Pass@1 (%) | 100 |
| Computer Anthology Terminal Tasks (Gemini CLI) | 24.4 | pass@1 (%) | 100 |
| AA-LCR | 81 | Accuracy (self-reported) | 98.3 |
| UGI - Writing | 69.71 | Writing Score | 98.1 |
| Chatbot Arena (Text - Math) | 1504 | Arena Score | 97.8 |
| UGI - Natural Intelligence | 68.98 | NatInt Score | 97.4 |
| UGI Leaderboard | 55.37 | UGI Score | 96.4 |
| Chess Puzzles (Epoch AI) | 50 | Accuracy (%) | 96.3 |
| AA Omniscience - Law | 57.6 | Accuracy (%) | 96 |
| Chatbot Arena (Vision - Chinese) | 1351 | Arena Score | 95.6 |
| Vals AI MedCode | 55.83 | Accuracy (%) | 95.5 |
| AA IFBench | 76.33 | Accuracy (%) | 95.3 |
Interactive version: theaggregate.ai/model?slug=gemini-3-5-flash-high · How It Works · Data refreshed daily, snapshot 2026-09-05.