Milmer reports 96.72% four-class accuracy on DEAP by fusing facial frames selected via multiple instance learning with EEG tokens in a transformer, but the evaluation protocol is not fully described.
Husformer: A multi-modal transformer for multi-modal human state recognition,
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
citation-role summary
baseline 1
citation-polarity summary
fields
cs.CV 1years
2025 1verdicts
REJECT 1roles
baseline 1polarities
baseline 1representative citing papers
citing papers explorer
-
Milmer: a Framework for Multiple Instance Learning based Multimodal Emotion Recognition
Milmer reports 96.72% four-class accuracy on DEAP by fusing facial frames selected via multiple instance learning with EEG tokens in a transformer, but the evaluation protocol is not fully described.