Einstein-v7-Qwen2-7B — benchmark results

Weyaxi's science-focused full fine-tune of Qwen2 7B, trained on ~40 datasets spanning physics, chemistry, biology, and math in ChatML format. Provider: Other. Released 2024-06-24. Access: Open.

Unified ELO 1446 ± 29, rank #1020 of 1776 rated models, from 7 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard440.83Average Score (%)81.6
Open LLM Leaderboard - MuSR14.06Score77
Open LLM Leaderboard - MMLU-Pro34.4Score74.7
Open LLM Leaderboard - MATH Level 519.94Score70.8
Open LLM Leaderboard - BBH32.84Score63.3
Open LLM Leaderboard - GPQA6.6Score55.6
Open LLM Leaderboard - IFEval41Score41.3

Interactive version: theaggregate.ai/model?slug=einstein-v7-qwen2-7b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.