Gemma 3 27B (IT): benchmark results
Instruction-tuned Gemma 3 27B checkpoint. Provider: Google. Released 2025-03-12. Access: Open.
Unified ELO 1539 ± 1, rank #485 of 1392 rated models, from 1512 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| MEGA-Bench Task - Camera Trajectory To Video Selection | 71.4 | Task Score (%) | 100 |
| MEGA-Bench Task - Cultural VQA | 66.7 | Task Score (%) | 100 |
| MEGA-Bench Task - Figurative Speech Explanation | 86.9 | Task Score (%) | 100 |
| MEGA-Bench Task - Medical Parasite Detection | 78.6 | Task Score (%) | 100 |
| MEGA-Bench Task - Text Style | 85.7 | Task Score (%) | 100 |
| MEGA-Bench Task - Web Action Grounding | 85.7 | Task Score (%) | 100 |
| MIMIC-CDM | 70.48 | Accuracy (%) | 100 |
| MIMIC-CDM - Appendicitis | 89.9 | Accuracy (%) | 100 |
| MIMIC-CDM - Diverticulitis | 66.1 | Accuracy (%) | 100 |
| MT-Bench PL - Math | 8.25 | Judge Score (0-10) | 100 |
| MT-Bench PL - Overall | 9.28 | Judge Score (0-10) | 100 |
| MT-Bench PL - Roleplay | 9.95 | Judge Score (0-10) | 100 |
Interactive version: theaggregate.ai/model?slug=gemma-3-27b-it · How It Works · Data refreshed daily, snapshot 2026-09-05.