Radar-enhanced multimodal speech recognition under occlusion and noise: methodology and experimental analysis