Zusammenfassung Wir untersuchen, ob KI-Systeme Menschen bei kreativen Aufgaben übertreffen, die unterschiedlich offen sind. Zu diesem Zweck generierten wir kreative Antworten mit drei Versionen von ChatGPT und rekrutierten 738 Teilnehmer, umblind die sechs kreativen Antworten zu bewerten, die zufällig aus drei Gruppen entnommen wurden – jede mit 160 Antworten – die sowohl von Menschen als auch von KI generiert wurden. Dieser Prozess ergab 4.428 individuelle Bewertungen. Unsere Ergebnisse zeigen, dass unabhängig von der verwendeten GPT-Version die menschlich generierten Antworten signifikant und erheblich höhere Durchschnittswerte als die von Maschinen generierten Antworten in offenen Aufgaben erreichen. Umgekehrt übertreffen die von KI generierten Antworten die menschlichen in geschlossenen Aufgaben. Darüber hinaus schätzen wir, dass die menschliche Vorstellungskraft zwischen 22 % und 45 % des kreativen Scores in offenen Aufgaben ausmacht.
Charness et al. (Wed,) haben diese Frage untersucht.