问答-多层多标签-HCL-MTC、M3C-HG

1.与彭爽对接,重新确定csv格式

2.HiACM论文为几区、引用量

3.查找近两年24-25年相关论文

  • 发表时间:2020年
  • 会议/刊位:ACL 2020
  • 分区/级别:CCF A类会议

任务明确:查找近两年24-25年相关论文模型

输入一个中文文本,模型能够多标签预测出:

  • 跨分支预测:道理/人生,生活/教育
  • 同分支多子节点预测:修行/佛家,修行/儒家

1. HCL-MTC--层级对比学习多标签文本分类模型-2025

Hierarchical contrastive learning for multi-label text classification-2025.pdfhttps://www.yuque.com/attachments/yuque/0/2025/pdf/54964068/1760445319602-6a0f7364-a570-4f22-9339-5aa2958640fd.pdf

1.1. 发表信息

1.2. 解读

标签层次结构表示为有向图 G=(V,E),标签的层级结构(树状组织,含父子、兄弟关系及语义依赖)

图 1. RCV1-v2 数据集的标签树结构样本,其中灰色、黄色、绿色、蓝色分别表示根标签、第一级标签、第二级标签、第三级标签。变量 s 表示标签 i 与标签 j 之间的相似度。

层级对比损失:父子对可以双向传递信息,而不同父节点之间的信息保持区分

  • 最大化区分性:拉远不相关父节点间的距离。
    • 模型会学习让 修行生活 的特征表示更有区别。
  • 最小化相关性:拉近相关父子节点间的距离。
    • 模型会学习让 修行道家 的特征表示更加接近。

每个标签节点(包括一级和二级)的增强特征被送入一个分类器,使用Sigmoid函数独立计算概率

实验结果:该模型显著优于 HiAGM-TP

1.3. e.g.

输入文本:承道家 “上善若水” 之仁,怀佛家 “慈悲喜舍” 之念。

  1. 前向传播
  • 模型读入句子:“承道家 ‘上善若水’ 之仁,怀佛家 ‘慈悲喜舍’ 之念。”
  • 经过文本编码器、特征提取器、线性转换器和GCN层,最终输出所有标签的预测概率。
  • 假设初始模型的预测可能是错误的,例如:

修行/道家: 0.4 (错误)--未成功激活

修行/佛家: 0.9 (正确)--正确激活

修行/儒家: 0.1 (正确)

生活/食品: 0.8 (错误)--错误激活

道理/天道: 0.6 (正确)

  1. 随机采样节点对(用于层次对比损失)

以父节点 修行 为中心进行采样:

  • 采样其他父节点:从 生活、道理 中随机抽一个,比如抽到 生活。
  • 采样一个子节点:从 道家、佛家、儒家 中随机抽一个,比如抽到 道家。

本次训练步关注的节点对:

  • 修行 和 生活 (用于区分性损失 - 让它们更不同)
  • 修行 和 道家 (用于相关性损失 - 让它们更相似)

  1. 计算损失

二元交叉熵损失:

  • 惩罚错误激活:模型将 生活/食品 (真实为0) 预测为0.8。损失函数将产生一个很大的惩罚。
  • 惩罚未成功激活:模型将 修行/道家 (真实为1) 预测为0.4。损失函数将鼓励其输出更高的概率。
  • 奖励正确激活:模型将 修行/佛家 (真实为1) 预测为0.9。损失很小。

采样层次对比损失:

  • 相关性损失 :计算 修行 和 道家 的特征相似度。由于它们是真实的父子关系,损失函数会惩罚这个相似度过低。反向传播时会拉近“修行”和“道家”节点的特征向量。
  • 区分性损失 :计算 修行 和 生活 的特征相似度。损失函数会惩罚这个相似度过高。反向传播时会推远“修行”和“生活”节点的特征向量,帮助模型厘清“修行”和“生活”这两个不同领域的边界。

  1. 反向传播与参数更新

将上述所有损失相加得到总损失。

关键步骤:通过反向传播算法,计算总损失对模型每一个参数的梯度。

更新以下部分的参数:

  • 记忆“上善若水”属于道家,“慈悲喜舍”属于佛家
  • 增强了 修行 与 道家 之间的父子相关性,厘清了 修行 与 生活 这两个父节点之间的区分性。

2. M3C-HG--基于超图的多模态多标签分类方法-2024

2.1. 发表信息

  • 发表时间:2024年9月
  • 期刊:计算机工程与科学 (Computer Engineering & Science)
    • ISSN: 1007-130X

2.2. 解读

M3C-HG 包含四个阶段:

  1. 特征提取
    • 文本特征:使用 Sentence-BERT 提取 384 维句子嵌入。
  2. 关系挖掘
    • 超图构建:基于 K-近邻(K=21)构建图像、文本和导演信息的超图,合并为多模态超图。
    • 超边卷积:使用两层超图卷积层捕获高阶关联信息,增强特征表示。
  3. 标签预测
    • 使用全连接层 + Sigmoid 输出每个标签的概率。
    • 设定阈值(0.5)筛选预测标签。

3. 总结

这周主要还是在找论文,重点于最新的近两年发布的,找到了2个比较相关的,感觉HCL-MTC比较好,并且他的实验结果比上周的模型HiAGM效果更好;另外一个是M3C-HG,可以同时用于图像、文本,主要是构造有向边构建超图。这两篇论文都只是大概了解,还没有精读。除了论文,结合项目的数据库设计,重新修改了csv文件的格式。

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值