Key points are not available for this paper at this time.
背景 外周动脉疾病(PAD)是动脉粥样硬化的一种常见但常被忽视的表现,显著导致心血管发病率和死亡率。随着对人工智能(AI)医疗信息依赖性的增加,评估AI生成的健康内容的准确性和可读性变得至关重要,特别是针对常见心血管疾病。 目的 本研究评估OpenAI的ChatGPT(旧金山,加利福尼亚州)和Google的Gemini(山景城,加利福尼亚州)在回答有关PAD的常见问题时生成的响应的准确性、完整性和可读性。AI响应与克利夫兰诊所的PAD常见问题解答(FAQs)进行了比较,以评估AI生成响应作为患者教育工具的可靠性。 方法 ChatGPT 4.0和Gemini 1.0在三种格式下被提示(无提示(格式1)、患者级提示(格式2)和医师级提示(格式3))后回答克利夫兰诊所关于PAD的19个问题。根据内容一致性的百分比,将响应分为正确、部分正确或不正确。使用Flesch-Kincaid(FK)年级水平评估可读性,并分析字数差异。使用卡方检验和单因素方差分析(ANOVA)进行统计分析,显著性阈值为p < 0.05。 结果 ChatGPT提供了70%的正确和30%的部分正确响应,没有不正确的答案。Gemini提供了52%的正确、45%的部分正确和3%的不正确响应。ChatGPT的准确性显著优于Gemini,p值 < 0.05。FK分析显示两种聊天机器人的可读性没有显著差异(平均FK年级:ChatGPT为10.81;Gemini为10.73),虽然两者都高于患者教育的推荐阅读水平。ChatGPT的响应显著长于Gemini,p值 < 0.0001。 结论 ChatGPT和Gemini都对关于PAD的常见问题提供了大多准确和全面的响应,显示出它们作为适当提供者监督下的患者补充教育工具的潜力。然而,这些材料的年级阅读水平超过了国家指南设定的推荐阅读水平,这需要改进AI驱动的健康沟通。鉴于对AI在医疗保健中日益依赖,未来的研究应探索增强AI生成的医疗内容以提高患者可及性的方法,并评估其对患者结果的影响。
Patel等人(Sun,)研究了这个问题。