Mi:dm K 2.5 Pro hits 80.9% on MMLU-Pro but only 10% on long-context reasoning — independently measured, not self-reporte...

Mi:dm K 2.5 Pro hits 80.9% on MMLU-Pro but only 10% on long-context reasoning — independently measured, not self-reported.https://olud.ai/leaderboard.html#LLM #Benchmarks #OpenSource #AI

Read Original

Related