Key points are not available for this paper at this time.
Das auf einem Codebuch basierende (Bag-of-Words) Modell ist ein weit verbreitetes Modell zur Bildklassifikation. Wir analysieren aktuelle Kodierungsstrategien in diesem Modell und stellen fest, dass Salienz die grundlegende Eigenschaft der Kodierung ist. Die Salienz in der Kodierung bedeutet, dass, wenn ein visueller Code einem Deskriptor viel näher ist als andere Codes, er eine sehr starke Antwort erhält. Die saliente Darstellung unter maximaler Pooling-Operation führt zu einer leistungsstarken Performance auf vielen Datenbanken und Wettbewerben. Die meisten aktuellen Kodierungsschemata erkennen jedoch nicht die Rolle der salienten Darstellung, was zu großen Abweichungen bei der Darstellung von lokalen Deskriptoren führen kann. In diesem Papier schlagen wir „saliente Kodierung“ vor, die das Verhältnis zwischen dem nächstgelegenen Code der Deskriptoren und anderen Codes verwendet, um Deskriptoren zu beschreiben. Dieser Ansatz kann eine saliente Darstellung ohne Abweichungen garantieren. Wir untersuchen die saliente Kodierung auf zwei Bildklassifikationsdatenbanken (15-Scenes und PASCAL VOC2007). Die experimentellen Ergebnisse zeigen, dass unser Ansatz alle anderen Kodierungsmethoden bei der Bildklassifikation übertrifft.
Huang et al. (Wed,) haben diese Frage untersucht.