Authors
Loading...
Comparative evaluation reveals humanlike metacognitive accuracy alongside overconfidence in large language models, indicating severe limitations in adapting confidence to past performance.
Cash et al. (2025) studied this question.
Synapse has enriched 2 closely related papers on similar clinical questions. Consider them for comparative context: