Open LLM Leaderboard v1 - TruthfulQA MC2: leaderboard
Metric: MC2 (%) (0-shot). Source: huggingface.co. Saturation forecast: Around December 2026. 7162 models tracked.
Top models
| # | Model | Score |
|---|---|---|
| 1 | Myrrh_solar_10.7b_3.0 | 79.87 |
| 2 | luxia-21.4B-alignment-v1.2 | 79.16 |
| 3 | final_model_test_v2 | 79.16 |
| 4 | Neuralmultiverse-7B-slerp | 78.97 |
| 5 | DARE_TIES_13B | 78.66 |
| 6 | MixTAO-7Bx2-MoE-v8.1 | 78.57 |
| 7 | CarbonBeagle-11B-truthy | 78.55 |
| 8 | YamshadowExperiment28-7B | 78.53 |
| 9 | MoE_13B_DPO | 78.47 |
| 10 | test1 | 78.32 |
| 11 | UNA-ThePitbull-21.4B-v2 | 78.24 |
| 12 | NeuralSynthesis-7B-v0.1 | 78.15 |
| 13 | NeuralSynthesis-7B-v0.3 | 78.13 |
| 14 | CognitiveFusion2-4x7B-BF16 | 78.12 |
| 15 | MultiverseEx26-7B-slerp | 78.12 |
Interactive version: theaggregate.ai/benchmark?slug=open-llm-leaderboard-v1-truthfulqa-mc2 · How It Works · Data refreshed daily, snapshot 2026-09-23.