人工智能能否提供专家级质量的伦理建议?人类会信任它吗?我们使用《纽约时报》(NYT)专栏《伦理学家》中发布的困境来探讨这些问题,比较人们对AI生成建议(GPT-4)与NYT专家建议的看法。首先,我们调查了多样参与者(N = 187),包括普通人、MBA学生和专家学者及宗教领袖小组对AI建议的有用性感知。我们发现人们认为AI生成的伦理建议质量与专家建议相当,两者在有用性评分上没有显著差异。在直接选择时,57%的参与者偏好AI生成的建议。基于这些发现,我们进行了一个包含三个条件的实验(N = 642),研究人类愿意接受这种建议的程度。我们的结果表明,在观察建议之前,人类在这一背景下表现出强烈的算法抗拒,72.6%的参与者更愿意听取人类的伦理建议。然而,在接触到AI生成的建议质量后,算法抗拒显著降低至53.2%。当隐藏建议来源时,算法抗拒进一步降低至46.3%。综合来看,我们的发现表明,虽然人类最初对AI生成的伦理建议表现出强烈抵制,但当他们亲身体验AI指导的质量时,这种抵制显著减少,这表明对算法伦理推理的信任可能比先前假设的更具可塑性,并且可能随着人们直接接触AI在道德决策中的能力而演变。
Meincke等(周四)研究了这个问题。
Synapse has enriched 5 closely related papers on similar clinical questions. Consider them for comparative context: