从入门到工业落地:生成式推荐系统学习路线 + 论文合集

目录

概述

一、生成式推荐:宏观技术全景

1. 核心定义与范式变革

2. 技术演进三阶段

3. 核心技术分支

二、经典论文全景清单(按路线学习)

路线 0:传统序列推荐 & 判别式精排(必读基础)

路线 1:LLM 指令与对齐(生成式推荐奠基)

路线 2:语义 ID 与生成式检索(核心架构)

路线 3:端到端工业生成框架(落地核心)

路线 4:扩散生成 & 高效推理(效率突破)

路线 5:推荐 Agent & 多模态(2026 前沿)

路线 6:综述与体系(入门必读)

三、阶梯式学习路径(直接照做即可)

阶段 0:前置基础(1 周)

阶段 1:生成式入门(1–2 周)

阶段 2:核心架构(3–4 周)

阶段 3:工业落地(4–6 周)

阶段 4:前沿创新(长期)

四、2026 关键发展方向

结语


本篇属于生成式推荐系统专栏开篇,接下来会围绕下面的论文进行讲解,希望和大家能一起,跟上生成式推荐领域发展的进程。

概述

推荐系统正经历从判别式检索排序生成式序列创造的根本性范式跃迁。传统多阶段级联架构(召回 - 粗排 - 精排 - 重排)支撑了过去十年工业级规模化落地,但也面临语义割裂、阶段目标冲突、特征工程依赖重、长尾与冷启动能力弱等固有瓶颈。

生成式推荐以大模型与序列生成为核心,将推荐重构为用户行为序列 → 物品 Token / 语义 ID的端到端生成任务,统一检索、排序、推理与内容生成,兼具强语义理解、跨域泛化、可解释与可交互能力,成为下一代推荐系统的核心方向。


一、生成式推荐:宏观技术全景

1. 核心定义与范式变革

生成式推荐不依赖对候选集逐点打分,而是基于用户历史行为、偏好描述、多模态内容,直接生成物品 ID、语义序列、推荐理由、交互内容,实现从 “匹配” 到 “创造” 的升级。

核心优势:

  • 端到端统一:消解召回 - 排序链路割裂,单模型完成全链路
  • 语义与知识赋能:借助 LLM 世界知识,突破协同过滤的数据依赖
  • 灵活泛化:零 / 少样本适配冷启动、跨域、对话式推荐
  • 可解释与可控:支持自然语言指令、约束与理由生成

2. 技术演进三阶段

  1. 生成式协同过滤:VAE/GAN 建模用户 - 物品分布
  2. LLM 驱动生成推荐:提示、微调、对齐,融合行为与语义
  3. 工业级统一生成框架:语义 ID、大序列模型、偏好对齐、端到端部署

3. 核心技术分支

LLM 指令对齐、语义 ID 与生成式检索、端到端工业框架、扩散生成、高效推理、推荐 Agent、多模态生成推荐。


二、经典论文全景清单(按路线学习)

路线 0:传统序列推荐 & 判别式精排(必读基础)

为理解生成式革命,先掌握经典判别式范式。

  1. SASRec(ICDM 2018)序列推荐里程碑https://arxiv.org/abs/1808.06473
  2. BERT4Rec(CIKM 2019)双向序列建模标杆https://arxiv.org/abs/1904.06690
  3. HyFormer(SIGIR 2022)高效混合注意力序列模型https://arxiv.org/abs/2207.05782
  4. HSTU(ICML 2024)超长序列大模型与缩放定律https://arxiv.org/abs/2406.00355
  5. RankMixer(2025)工业级高效精排架构https://arxiv.org/abs/2502.04866

路线 1:LLM 指令与对齐(生成式推荐奠基)

  1. Recommendation as Instruction Following(2023)https://arxiv.org/abs/2305.07001
  2. TALLRec(RecSys 2023)轻量对齐范式https://arxiv.org/abs/2305.00447
  3. LLMs are Zero-Shot Rankers(ECIR 2024)https://arxiv.org/abs/2305.08845
  4. RecLM(ACL 2025)指令微调统一框架https://arxiv.org/abs/2412.19302
  5. DPO4Rec(ICME 2025)偏好对齐入门https://arxiv.org/abs/2410.05939
  6. RLHF4Rec(2026)人类反馈对齐https://arxiv.org/abs/2601.03721

路线 2:语义 ID 与生成式检索(核心架构)

  1. TIGER(NeurIPS 2023)语义 ID 开山之作https://arxiv.org/abs/2305.05065
  2. Better Generalization with Semantic IDs(2023)https://arxiv.org/abs/2306.08121
  3. GRID(2025)语义 ID 工业原型https://arxiv.org/abs/2507.22224
  4. Generating Long Semantic IDs in Parallel(KDD 2025)https://arxiv.org/abs/2506.05781
  5. Semantic ID Transformer(ICLR 2026)https://arxiv.org/abs/2603.09217

路线 3:端到端工业生成框架(落地核心)

  1. OneRec(快手 2025)首个规模化端到端生成推荐https://arxiv.org/abs/2502.18965
  2. OneRec Technical Report(快手 2025)工程部署https://arxiv.org/abs/2506.13695
  3. OneRec-V2(快手 2025)低成本高效架构https://arxiv.org/abs/2508.20900
  4. Incremental Learning for LLM-Rec(CIKM 2024)https://arxiv.org/abs/2312.15599

路线 4:扩散生成 & 高效推理(效率突破)

  1. Diffusion Recommender Model(SIGIR 2023)https://arxiv.org/abs/2306.02487
  2. Softmax DPO for Recommendation(NeurIPS 2024)https://arxiv.org/abs/2409.12592
  3. ThinkRec(WWW 2026)推理链可解释推荐https://arxiv.org/abs/2505.15091

路线 5:推荐 Agent & 多模态(2026 前沿)

  1. AgentRec(2025)交互式推荐智能体https://arxiv.org/abs/2511.03278
  2. Multi-Modal Generative Rec(CVPR 2026)https://arxiv.org/abs/2603.08155

路线 6:综述与体系(入门必读)

  1. Generative Recommendation: A Survey(2025)最全综述https://arxiv.org/abs/2510.27157
  2. LLMs for Generative Recommendation: A Survey(2024)https://arxiv.org/abs/2309.01157
  3. Preference Alignment Survey(2026)https://arxiv.org/abs/2601.02749

三、阶梯式学习路径(直接照做即可)

阶段 0:前置基础(1 周)

  • 学习:SASRec、BERT4Rec、HyFormer、HSTU、RankMixer
  • 目标:理解序列建模、精排、传统多阶段架构

阶段 1:生成式入门(1–2 周)

  • 学习:2 篇综述 + Instruction Following + TALLRec
  • 目标:建立生成式推荐全局认知

阶段 2:核心架构(3–4 周)

  • 学习:语义 ID(TIGER/GRID)+ 偏好对齐(DPO 系列)
  • 目标:掌握两大主流技术路线

阶段 3:工业落地(4–6 周)

  • 学习:OneRec / OneRec-V2 全套
  • 目标:端到端训练、对齐、部署、线上迭代

阶段 4:前沿创新(长期)

  • 方向:扩散、Agent、多模态、推理链、低延迟部署

四、2026 关键发展方向

  • 高效生成与超低延迟推理
  • 多模态统一语义 ID 与表示
  • 可信生成(去幻觉、可解释、公平性)
  • Agent 化交互、反思、工具增强推荐
  • 端边云协同与超大规模训练部署

结语

生成式推荐不止是技术升级,更是推荐系统的范式革命:从被动匹配走向主动创造,从数据驱动走向知识 + 数据双轮驱动。

如果你也在研究生成式推荐、LLM 对齐、语义 ID、端到端架构,欢迎一起交流。

内容概要:本文围绕微电网群的双层优化与分布式优化问题,提出基于交替方向乘子法(ADMM)的分布式协同优化控制策略,并通过Matlab代码实现仿真验证。研究构建了上层为微电网间能量协调与优化调度、下层为各微电网内部源-荷-储精细化运行管理的双层优化模型。采用ADMM算法将集中式优化问题分解为多个可并行求解的子问题,实现了计算的分布式化与信息隐私保护,显著提升了系统的可扩展性与鲁棒性。文中系统阐述了模型构建原理、ADMM算法设计流程及其收敛性分析,并通过仿真实验验证了该方法在降低系统综合运行成本、提高可再生能源消纳能力以及维持系统稳定运行方面的有效性。; 适合人群:具备电力系统分析、优化理论基础,熟悉Matlab编程,从事微电网、分布式能源系统、智能电网等领域研究的研究生、科研人员及工程技术人员。; 使用场景及目标:① 学习和掌握基于ADMM的分布式优化方法在微电网群协同能量管理中的具体应用;② 实现微电网群多主体参与下的经济调度与仿真分析;③ 深入理解双层优化架构的设计理念与分布式求解算法的实现机制。; 阅读建议:建议结合所提供的Matlab代码进行动手实践,重点剖析模型建立与算法实现的关键细节,可通过调整系统参数、改变运行场景等方式,深入探究ADMM算法的收敛特性及其对优化效果的影响。
内容概要:本文聚焦于风电出力不确定性的精确建模问题,提出采用拉丁超立方抽样(LHS)方法生成具有统计代表性的风电场景,并结合先进的场景缩减技术以降低计算复杂度。通过Matlab编程实现了LHS在高维随机变量空间中的均匀采样,有效克服了传统蒙特卡洛方法样本收敛慢、效率低的问题。在此基础上,引入基于聚类分析或概率距离度量的场景缩减算法,对初始大规模场景集进行优化合并,保留关键概率特征与出力趋势,构建出精简且具代表性的典型场景集。该方法显著提升了电力系统随机优化模型(如机组组合、储能调度、微电网能量管理)的求解效率与数值稳定性,同时确保输入场景的合理性与真实性,具备良好的可复现性与工程应用价值。; 适合人群:适用于具备一定电力系统分析基础和Matlab编程能力,从事新能源并网、随机规划、场景生成、电力市场及综合能源系统优化等方向研究的研究生、科研人员及工程技术人员。; 使用场景及目标:①掌握拉丁超立方抽样在风电不确定性建模中的理论原理与Matlab实现技巧;②学习并应用场景生成与缩减技术,提升随机优化问题的建模与求解效率;③为含高比例风电的电力系统调度、风险评估与决策分析提供高质量的输入场景支撑。; 阅读建议:建议读者结合所提供的Matlab代码逐模块调试运行,深入理解抽样策略、距离计算、聚类缩减等核心算法的实现细节,并尝试将其集成到具体的优化模型中进行验证与拓展,以强化科研实践能力与创新思维。
内容概要:本文围绕基于交替方向乘子法(ADMM)的多主体综合能源系统分布式协同优化展开研究,提出了一种利用ADMM算法实现多个能源主体间高效协同优化的解决方案。该方法将集中式优化问题分解为多个可并行求解的子问题,各主体在保护自身数据隐私的前提下,仅通过交换少量边界信息即可完成全局协同优化,有效解决了传统集中式方法存在的通信负担重、隐私泄露风险高等问题。研究涵盖了模型构建、算法设计、收敛性分析及仿真验证全过程,并以Matlab代码实现了算法原型,展示了其在提升系统运行效率、促进可再生能源消纳方面的潜力。该研究不仅提供了完整的算法实现框架,还深入探讨了ADMM在多区域电网、多微网及产消者等复杂场景下的适用性与扩展能力,为现代综合能源系统的分布式管理提供了理论依据和技术支持。; 适合人群:具备一定电力系统、优化理论及Matlab编程基础的研究生、科研人员或从事综合能源系统相关工作的工程技术人员。; 使用场景及目标:①应用于多区域电网、多微网、产消者(Prosumer)等多主体参与的综合能源系统协同调度;②实现数据隐私保护下的分布式优化,避免中心节点收集全局敏感信息;③学习ADMM算法在电力系统中的具体建模与实现方法,掌握其收敛特性与参数整定技巧。; 阅读建议:读者应结合提供的Matlab代码进行实践,重点关注ADMM算法的迭代流程、惩罚因子设定及其对收敛速度的影响,同时可通过修改系统规模与参数设置,进一步探究算法在不同场景下的适应性与性能表现。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值