The application discloses a kind of based on retrieval enhancement cross-
modal condition
diffusion model
emotion recognition method and
system, the method receives text, speech, image
multimodal data, detects modality integrity and extracts existing
modal feature;If there is missing mode, based on existing
modal feature in external sample
library retrieval similar sample, weighted fusion generates retrieval enhancement representation;Cross-modal condition
diffusion model is constructed, and missing modal feature is recovered by combining forward
diffusion into information,
reverse diffusion and iteration unified cross-modal attention mechanism;Splice complete modal feature, pass through Transform fusion network and joint
loss function optimization, output emotion category and intensity.The application breaks through the limitation that existing generation model only relies on local information, fully utilizes the combination
advantage of external retrieval and diffusion generation, can maintain stable performance under a variety of missing patterns, and has wide application prospect.