Authors
Loading...
Evaluation demonstrates limited performance of large language models in academic text processing, suggesting caution in peer review applications.
Li et al. (2025) studied this question.