Elena Ryumina

dblp:276/1530 · DBLP profile ↗
← Back
12ranked-venue papers
7as first author
12since 2021 · last 2026
0000-0002-4135-6949ORCID · verified

Domains — the database's venue-derived domains; a paper can count in several

Artificial intelligence and machine learning · 12 · 7 first-author · 12 since 2021Graphics, computer vision, multimedia, augmented reality and games · 6 · 3 first-author · 6 since 2021
YearPublicationVenuePosition
2026 Audio-visual occlusion-robust gender recognition and age estimation approach based on multi-task cross-modal attention
Maxim Markitantov, Elena Ryumina, Alexey Karpov 0001
Expert Syst. Appl.2
2025 Multi-Modal Multi-Task Affective States Recognition Based on Label Encoder Fusion
abstract
Despite recent advances in multi-modal approaches, recognizing the full range of human affective states, including emotions and sentiments, remains challenging due to complex interactions between different modalities and the hierarchical nature of affective states. This work presents a novel approach for multi-modal multi-task emotion and sentiment recognition that integrates audio, video, and text data. We introduce a Label Encoder Fusion Strategy, which produces and processes uni-modal emotion and sentiment predictions, which are used alongside modality-specific features during the fusion process to provide additional contextual information. We conduct elaborate multi-corpus experiments on the RAMAS, MELD, and CMU-MOSEI corpora. The proposed approach achieves state-of-the-art performance in both affective tasks. On MELD, we achieve a macro F1 (MF) of 40.9% and 67.02% for emotion and sentiment recognition. On CMU-MOSEI, the mean MF is 62.30% and MF is 62.00% for the same tasks.
Maxim Markitantov, Elena Ryumina, Heysem Kaya, Alexey Karpov 0001
INTERSPEECH2
2025 Multi-corpus emotion recognition method based on cross-modal gated attention fusion
Elena Ryumina, Dmitry Ryumin, Alexandr Axyonov, Denis Ivanko, Alexey Karpov 0001
Pattern Recognit. Lett.1
2024 OCEAN-AI: open multimodal framework for personality traits assessment and HR-processes automatization
Elena Ryumina, Dmitry Ryumin, Alexey Karpov 0001
INTERSPEECH1
2024 Audio-visual speech recognition based on regulated transformer and spatio-temporal fusion strategy for driver assistive systems
Dmitry Ryumin, Alexandr Axyonov, Elena Ryumina, Denis Ivanko, Alexey M. Kashevnik, Alexey Karpov 0001
Expert Syst. Appl.3
2024 OCEAN-AI framework with EmoFormer cross-hemiface attention approach for personality traits assessment
Elena Ryumina, Maxim Markitantov, Dmitry Ryumin, Alexey Karpov 0001
Expert Syst. Appl.1
2024 Gated Siamese Fusion Network based on multimodal deep and hand-crafted features for personality traits assessment
Elena Ryumina, Maxim Markitantov, Dmitry Ryumin, Alexey Karpov 0001
Pattern Recognit. Lett.1
2023 Multimodal Personality Traits Assessment (MuPTA) Corpus: The Impact of Spontaneous and Read Speech
abstract
Automatic personality traits assessment (PTA) provides high-level, intelligible predictive inputs for subsequent critical downstream tasks, such as job interview recommendations and mental healthcare monitoring. In this work, we introduce a novel Multimodal Personality Traits Assessment (MuPTA) corpus. Our MuPTA corpus is unique in that it contains both spontaneous and read speech collected in the midly-resourced Russian language. We present a novel audio-visual approach for PTA that is used in order to set up baseline results on this corpus. We further analyze the impact of both spontaneous and read speech types on the PTA predictive performance. We find that for the audio modality, the PTA predictive performances on short signals are almost equal regardless of the speech type, while PTA using video modality is more accurate with spontaneous speech compared to read one regardless of the signal length.
Elena Ryumina, Dmitry Ryumin, Maxim Markitantov, Heysem Kaya, Alexey Karpov 0001
INTERSPEECH1
2022 Biometric Russian Audio-Visual Extended MASKS (BRAVE-MASKS) Corpus: Multimodal Mask Type Recognition Task
Maxim Markitantov, Elena Ryumina, Dmitry Ryumin, Alexey Karpov 0001
INTERSPEECH2
2022 In search of a robust facial expressions recognition model: A large-scale visual cross-corpus study
Elena Ryumina, Denis Dresvyanskiy, Alexey Karpov 0001
Neurocomputing1
2021 Annotation Confidence vs. Training Sample Size: Trade-Off Solution for Partially-Continuous Categorical Emotion Recognition
Elena Ryumina, Oxana Verkholyak, Alexey Karpov 0001
Interspeech1
2021 Ensemble-Within-Ensemble Classification for Escalation Prediction from Speech
Oxana Verkholyak, Denis Dresvyanskiy, Anastasia Dvoynikova, Denis Kotov, Elena Ryumina, Alena Velichko, Danila Mamontov, Wolfgang Minker, Alexey Karpov 0001
Interspeech5