Robuta

https://arxiv.org/abs/2410.17558v2 [2410.17558v2] CLR-Bench: Evaluating Large Language Models in College-level Reasoning Abstract page for arXiv paper 2410.17558v2: CLR-Bench: Evaluating Large Language Models in College-level Reasoning large language models