스팸 필터링 문제를 해결하는 데 있어 핵심 요소 중 하나는 텍스트 벡터화 방법입니다. 이 기사는 텍스트를 의도성 쌍에 맞추는 기반의 벡터화 방법을 제안합니다. 의도성 쌍 목록이 추출되고 텍스트 발화로부터 합성 데이터셋이 생성됩니다. 신경망이 설계되고 훈련되어 각 의도성이 모델 입력으로 제공된 텍스트 표현에 얼마나 속하는지를 평가합니다. 개발된 방법은 로지스틱 회귀와 엔론 데이터셋 및 SMS 데이터셋을 사용하여 스팸 메시지 필터링 문제에 대해 테스트됩니다.
Zhukov et al. (Mon,)은 이 질문을 연구하였다.