Key points are not available for this paper at this time.
背景:为了找出在原核生物基因组中寻找基因的最佳实践,并将其作为自动注释管道的标准,收集了来自各种公共资源的1,004,576个肽,并用于评估各种基因调用方法。这些肽来自45个细菌复制子,平均GC含量从31%到74%,偏向于较高GC含量的基因组。使用自动、手动和半手动方法来统计三种广泛使用的基因调用方法中的错误,证据是肽映射在调用的基因边界之外。结果:我们发现,三种方法预测的一致基因集仅占各个方法预测基因的约70%(要求起始和结束重合)。肽数据对于评估基因调用者之间的一些差异很有用,但由于任何蛋白质组学研究固有的局限性,结果并不可靠到足以使结果具有结论性。结论:从本分析中没有出现单一、明确、一致的最佳实践,因为现有的蛋白质组学数据不足以提供准确性差异的客观测量。然而,由于这项研究,参与者之间的软件、参考数据和程序得到了更好的匹配,代表着朝着急需标准化迈进的一步。在缺乏足够实验数据以实现通用标准的情况下,我们的建议是,社区可以使用这些方法中的任何一种,只要在比较的所有数据集中采用单一方法。
Tripp等人(周五)研究了这个问题。