Key points are not available for this paper at this time.
동기: 자동 생성된 단백질 데이터에 대한 주석은 UniProt(범용 단백질 자원) 웹 페이지에서 2004년 4월에 공개될 예정이다. TrEMBL 섹션의 500,000개 이상의 단백질 항목의 데이터 내용은 자동 주석 파이프라인의 출력에 의해 개선될 것으로 예상된다. 그러나 자동으로 추가된 데이터의 일부는 오류가 있을 것이며, 이는 다른 출처에서 오는 정보의 일부와 마찬가지이다. 우리는 C4.5 데이터 마이닝 알고리즘을 사용하는 단순 배제 메커니즘과 결정 트리 접근 방법에 기반한 후처리 시스템인 Xanthippe를 제시한다. 결과: Xanthippe가 많은 부분의 주석 오류를 감지하고 플래그를 지정하며 자동 생성된 데이터와 다른 출처의 주석의 신뢰도를 상당히 증가시킨다는 것이 보여진다. Swiss-Prot와의 교차 검증에서 단백질 설명, 댓글 및 키워드의 오류가 성공적으로 필터링되었음을 보여준다. Xanthippe는 예측 시스템과 원활하게 결합할 수 있는 모순적인 응용 프로그램이다. 이는 자동 주석의 정밀도를 일정한 재현율로 개선하거나 일정한 정밀도로 재현율을 증가시키는 데 사용할 수 있다. 사용 가능성: Xanthippe 규칙의 응용 프로그램은 http://www.ebi.uniprot.org/에서 브라우징할 수 있다.
Wieser 외 (Mon,)는 이 질문을 연구하였다.
Synapse has enriched 5 closely related papers on similar clinical questions. Consider them for comparative context: