Einstein-v7-Qwen2-7B: benchmark results

Weyaxi's science-focused full fine-tune of Qwen2 7B, trained on ~40 datasets spanning physics, chemistry, biology, and math in ChatML format. Provider: Other. Released 2024-06-24. Access: Open.

Unified ELO 1531 ± 1, rank #603 of 1553 rated models, from 7 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard45.25Average Score (%)91.4
Open LLM Leaderboard - MuSR14.06Score77
Open LLM Leaderboard - MMLU-Pro34.4Score74.7
Open LLM Leaderboard - MATH Level 519.94Score70.8
Open LLM Leaderboard - BBH32.84Score63.3
Open LLM Leaderboard - GPQA6.6Score55.6
Open LLM Leaderboard - IFEval41Score41.3

Interactive version: theaggregate.ai/model?slug=einstein-v7-qwen2-7b · How It Works · Data refreshed daily, snapshot 2026-09-08.