Latency-Aware Hybrid Transformer–Capsule Network for Audio-Visual Emotion Recognition in Edge–Fog–Cloud Environments
This study proposes a latency-aware hybrid Transformer–capsule network for audio-visual emotion recognition in a simulated edge–fog–cloud environment that incorporates a deterministic latency-aware task-allocation mechanism for coordinating operations across edge, fog, and cloud resources.