Key points are not available for this paper at this time.
代码重复是软件系统中一个记录在案的问题。针对检测软件中的重复,已有相当多的研究工作,并且有几种有效的工具可以执行这一任务。然而,这类工具的一个普遍问题是返回的结果集可能过大,无法在没有辅助工具支持的情况下处理。本文的目标是描述一个旨在帮助理解软件系统中克隆现象的完整工具的标准。此外,我们展示了这样的工具的原型,并通过对Apache httpd Web服务器的案例研究演示其特性的价值。例如,在我们的研究中,我们发现仅占系统代码17%的单个子系统包含了38.8%的克隆。
Kapser等人(Sat,)研究了这个问题。