Key points are not available for this paper at this time.
本文提出了PARADISE(对话系统评估的范式),这是一个评估口语对话代理的通用框架。该框架将任务要求与代理的对话行为解耦,支持对话策略之间的比较,能够计算子对话和整体对话的性能,明确各种因素对性能的相对贡献,并通过针对任务复杂性进行归一化,使得能够比较执行不同任务的代理。
Walker等人(星期二)研究了这个问题。
Synapse has enriched 5 closely related papers on similar clinical questions. Consider them for comparative context: