Authors
Loading...
This paper identifies flaws in reasoning LLMs during problem solving, suggesting new evaluation metrics for systematic exploration.
Lu et al. (2025) studied this question.