Gemma 3 27B (IT) — benchmark results
Instruction-tuned Gemma 3 27B checkpoint. Provider: Google. Released 2025-03-12. Access: Open.
Unified ELO 1586 ± 5, rank #509 of 1776 rated models, from 1450 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| MEGA-Bench Task - Camera Trajectory To Video Selection | 71.4 | Task Score (%) | 100 |
| MEGA-Bench Task - Cultural VQA | 66.7 | Task Score (%) | 100 |
| MEGA-Bench Task - Figurative Speech Explanation | 86.9 | Task Score (%) | 100 |
| MEGA-Bench Task - Medical Parasite Detection | 78.6 | Task Score (%) | 100 |
| MEGA-Bench Task - Text Style | 85.7 | Task Score (%) | 100 |
| MEGA-Bench Task - Web Action Grounding | 85.7 | Task Score (%) | 100 |
| MT-Bench PL - Math | 8.25 | Judge Score (0-10) | 100 |
| MT-Bench PL - Overall | 9.28 | Judge Score (0-10) | 100 |
| MT-Bench PL - Roleplay | 9.95 | Judge Score (0-10) | 100 |
| MT-Bench PL - Writing | 9.7 | Judge Score (0-10) | 100 |
| Open Persian LLM - ARC Challenge | 90.6 | Accuracy (%) | 100 |
| OpenEval - Omni-MATH | 40.01 | Accuracy (%) | 100 |
Interactive version: theaggregate.ai/model?slug=gemma-3-27b-it · How the rankings work · Data refreshed daily, snapshot 2026-07-22.