Key points are not available for this paper at this time.
초록 본 연구는 진보된 인공지능(AI) 언어 모델인 ChatGPT-4의 안과 지식 평가 프로그램(OKAP) 시험에서의 성능을 이전 모델인 ChatGPT-3.5와 비교하여 평가하는 것을 목표로 한다. 두 모델은 다양한 안과 주제 범위를 포함하는 180개의 OKAP 연습 문제에서 테스트되었다. 결과는 ChatGPT-4가 ChatGPT-3.5보다 유의미하게 뛰어난 성과를 보였음을 나타냈다(81% 대 57%; p<0.001), 이는 의학 지식 평가의 향상을 시사한다. ChatGPT-4의 우수한 성능은 안과 교육 및 클리닉 의사 결정 지원 시스템에서의 잠재적 적용 가능성을 시사한다. 향후 연구는 AI 모델을 개선하고, 기본 및 전문 지식의 균형 잡힌 표현을 보장하며, AI를 의학 교육 및 실무에 통합하는 최적의 방법을 규명하는 데 초점을 맞춰야 한다.
Teebagy 외 (Mon,)는 이 질문을 연구하였다.