2025深度学习发论文&模型涨点之——多模态可解释性
多模态可解释性(Multimodal Interpretability)是指在多模态系统中,能够以人类可理解的方式解释系统的输出或决策过程。随着多模态大模型(MLLMs)的快速发展,其复杂性和规模带来了可解释性的挑战,但同时也推动了相关研究的进展。
-
Token 级别:研究视觉词元或视觉文本词元对模型决策的影响。
-
Embedding 级别:评估多模态嵌入(如视觉嵌入、文本嵌入、跨模态嵌入)如何在模型中融合信息。
-
神经元和网络层:分析个体神经元、神经元组以及不同网络层在决策中的作用。
- 架构设计:通过引入可解释模块或基于因果推理的方法,增强模型的透明度。
小编整理了一些多模态可解释性【论文】合集,以下放出部分,全部论文PDF版皆可领取。
需要的同学扫码添加我
回复“多模态可解释性”即可全部领取

论文精选
论文1:
Explainable Multimodal Emotion Recognition
可解释的多模态情感识别
方法
1925



被折叠的 条评论
为什么被折叠?



