In this chapter, using micro-videos as an example, we study the issues involved in multimodal fusion mentioned above. We propose a dynamic multimodal fusion method that treats the multimodal fusion of each item as an independent task. More specifically, we develop a novel meta-learning-based multimodal fusion model, named Meta Multimodal Fusion (MetaMMF), to dynamically integrate multimodal information for micro-video recommendation.

错误:搜索内容不能为空,请输入英文关键词
错误:关键词超出字数限制,请精简
高级检索

Dynamic Multimodal Fusion via Meta-Learning Towards Multimodal Recommendation

  • Fan Liu,
  • Zhenyang Li,
  • Liqiang Nie

摘要

In this chapter, using micro-videos as an example, we study the issues involved in multimodal fusion mentioned above. We propose a dynamic multimodal fusion method that treats the multimodal fusion of each item as an independent task. More specifically, we develop a novel meta-learning-based multimodal fusion model, named Meta Multimodal Fusion (MetaMMF), to dynamically integrate multimodal information for micro-video recommendation.