1.与彭爽对接,重新确定csv格式
2.HiACM论文为几区、引用量
3.查找近两年24-25年相关论文

- 发表时间:2020年
- 会议/刊位:ACL 2020
- 分区/级别:CCF A类会议
任务明确:查找近两年24-25年相关论文模型
输入一个中文文本,模型能够多标签预测出:
- 跨分支预测:道理/人生,生活/教育
- 同分支多子节点预测:修行/佛家,修行/儒家
1. HCL-MTC--层级对比学习多标签文本分类模型-2025
1.1. 发表信息
- 发表时间:2025年4月23日
- 期刊:Scientific Reports(Nature Portfolio 旗下期刊),SCIE 3 区
- 开源:https://github.com/hanggun/HCL-MTC.git
1.2. 解读
标签层次结构表示为有向图 G=(V,E),标签的层级结构(树状组织,含父子、兄弟关系及语义依赖)

图 1. RCV1-v2 数据集的标签树结构样本,其中灰色、黄色、绿色、蓝色分别表示根标签、第一级标签、第二级标签、第三级标签。变量 s 表示标签 i 与标签 j 之间的相似度。
层级对比损失:父子对可以双向传递信息,而不同父节点之间的信息保持区分
- 最大化区分性:拉远不相关父节点间的距离。
- 模型会学习让
修行和生活的特征表示更有区别。
- 模型会学习让
- 最小化相关性:拉近相关父子节点间的距离。
- 模型会学习让
修行和道家的特征表示更加接近。
- 模型会学习让
每个标签节点(包括一级和二级)的增强特征被送入一个分类器,使用Sigmoid函数独立计算概率

实验结果:该模型显著优于 HiAGM-TP
1.3. e.g.
输入文本:承道家 “上善若水” 之仁,怀佛家 “慈悲喜舍” 之念。
- 前向传播
- 模型读入句子:“承道家 ‘上善若水’ 之仁,怀佛家 ‘慈悲喜舍’ 之念。”
- 经过文本编码器、特征提取器、线性转换器和GCN层,最终输出所有标签的预测概率。
- 假设初始模型的预测可能是错误的,例如:
修行/道家: 0.4 (错误)--未成功激活
修行/佛家: 0.9 (正确)--正确激活
修行/儒家: 0.1 (正确)
生活/食品: 0.8 (错误)--错误激活
道理/天道: 0.6 (正确)
- 随机采样节点对(用于层次对比损失)
以父节点 修行 为中心进行采样:
- 采样其他父节点:从 生活、道理 中随机抽一个,比如抽到 生活。
- 采样一个子节点:从 道家、佛家、儒家 中随机抽一个,比如抽到 道家。
本次训练步关注的节点对:
- 修行 和 生活 (用于区分性损失 - 让它们更不同)
- 修行 和 道家 (用于相关性损失 - 让它们更相似)
- 计算损失
二元交叉熵损失:
- 惩罚错误激活:模型将 生活/食品 (真实为0) 预测为0.8。损失函数将产生一个很大的惩罚。
- 惩罚未成功激活:模型将 修行/道家 (真实为1) 预测为0.4。损失函数将鼓励其输出更高的概率。
- 奖励正确激活:模型将 修行/佛家 (真实为1) 预测为0.9。损失很小。
采样层次对比损失:
- 相关性损失 :计算 修行 和 道家 的特征相似度。由于它们是真实的父子关系,损失函数会惩罚这个相似度过低。反向传播时会拉近“修行”和“道家”节点的特征向量。
- 区分性损失 :计算 修行 和 生活 的特征相似度。损失函数会惩罚这个相似度过高。反向传播时会推远“修行”和“生活”节点的特征向量,帮助模型厘清“修行”和“生活”这两个不同领域的边界。
- 反向传播与参数更新
将上述所有损失相加得到总损失。
关键步骤:通过反向传播算法,计算总损失对模型每一个参数的梯度。
更新以下部分的参数:
- 记忆“上善若水”属于道家,“慈悲喜舍”属于佛家
- 增强了 修行 与 道家 之间的父子相关性,厘清了 修行 与 生活 这两个父节点之间的区分性。
2. M3C-HG--基于超图的多模态多标签分类方法-2024
2.1. 发表信息
- 发表时间:2024年9月
- 期刊:计算机工程与科学 (Computer Engineering & Science)
- ISSN: 1007-130X
2.2. 解读

M3C-HG 包含四个阶段:
- 特征提取
- 文本特征:使用 Sentence-BERT 提取 384 维句子嵌入。
- 关系挖掘
- 超图构建:基于 K-近邻(K=21)构建图像、文本和导演信息的超图,合并为多模态超图。
- 超边卷积:使用两层超图卷积层捕获高阶关联信息,增强特征表示。
- 标签预测
- 使用全连接层 + Sigmoid 输出每个标签的概率。
- 设定阈值(0.5)筛选预测标签。
3. 总结
这周主要还是在找论文,重点于最新的近两年发布的,找到了2个比较相关的,感觉HCL-MTC比较好,并且他的实验结果比上周的模型HiAGM效果更好;另外一个是M3C-HG,可以同时用于图像、文本,主要是构造有向边构建超图。这两篇论文都只是大概了解,还没有精读。除了论文,结合项目的数据库设计,重新修改了csv文件的格式。

23

被折叠的 条评论
为什么被折叠?



