Key points are not available for this paper at this time.
사람들은 매일 온라인 비디오 공유 사이트를 통해 의견, 이야기 및 리뷰를 공유하고 있습니다. 이러한 의견 영상에서 감정과 주관성을 연구하는 분야는 학계와 산업계에서 점점 더 많은 관심을 받고 있습니다. 감정 분석이 텍스트에서는 성공을 거두었지만, 영상 및 멀티미디어 콘텐츠에 대해서는 아직 충분히 연구되지 않은 주제입니다. 이 분야 연구에 가장 큰 장애물은 적절한 데이터셋, 방법론, 기준선, 그리고 다양한 모달리티 정보가 서로 어떻게 연관되는지에 대한 통계적 분석의 부족입니다. 본 논문은 과학 커뮤니티에 온라인 영상에서 감정과 주관성 분석을 위한 최초의 의견 수준 주석 코퍼스인 Multimodal Opinion-level Sentiment Intensity dataset(MOSI)을 소개합니다. 이 데이터셋은 주관성, 감정 강도, 프레임별 및 의견별 주석이 달린 시각적 특징, 그리고 밀리초 단위로 주석이 달린 오디오 특징에 대해 엄격히 라벨링되어 있습니다. 또한, 본 논문에서는 향후 연구를 위한 기준선과 구어 단어와 시각적 제스처를 함께 모델링하는 새로운 다중 모달 융합 접근법을 제시합니다.
Zadeh 외 연구진(월요일)은 이 질문을 연구했습니다.