Authors
Loading...
Comparative analysis shows DeepSeek-R1 outperforms GPT-4o API in nursing examination accuracy, indicating model reliability issues.
Li et al. (2026) studied this question.