2501_91802731
码龄1年
求更新 关注
提问 私信
  • 博客:12,147
    12,147
    总访问量
  • 36
    原创
  • 0
    粉丝
  • 15
    关注
IP属地以运营商信息为准,境内显示到省(区、市),境外显示到国家(地区)
IP 属地:辽宁省
加入CSDN时间: 2025-04-23
博客简介:

2501_91802731的博客

查看详细资料
个人成就
  • 获得283次点赞
  • 内容获得0次评论
  • 获得239次收藏
  • 博客总排名38,383名
  • 原力等级
    原力等级
    3
    原力分
    0
    本月获得
    255
创作历程
  • 36篇
    2026年
成就勋章

TA关注的专栏 0

TA关注的收藏夹 0

TA关注的社区 1

TA参与的活动 0

兴趣领域 设置
  • Python
    httpx
创作活动更多

编程达人挑战赛·第12期

作为写代码的你,是否也渴望被更多人看到?技术人员普遍有一个共性——明明技术很强,却没人知道你做了什么;花了很多时间踩坑,却没人因你少走弯路;脑子里有一堆干货,但却不懂如何有效地输出。 在如今写代码的人越来越多的时代,能够清晰表达自己思路与技术的人却少之又少。 因此,我们发起了这个【编程达人挑战赛】——帮助你将代码变成作品,将技术转化为真正的价值,同时激励更多的人坚持写作与分享。 注:活动细则介绍请看此贴:[https://bbs.csdn.net/topics/619791811](https://bbs.csdn.net/topics/619791811)。

725人参与 去参加
  • 最近
  • 文章
  • 专栏
  • 代码仓
  • 资源
  • 收藏
  • 关注/订阅/互动
更多
  • 最近

  • 文章

  • 专栏

  • 代码仓

  • 资源

  • 收藏

  • 关注/订阅/互动

  • 社区

  • 帖子

  • 问答

  • 课程

  • 视频

搜索 取消

急诊分诊准确率怎么提升23%?中山大学团队npj Digital Medicine:80万节点知识数据混合图谱驱动自主智能体,分诊+23.13%、药物相互作用检测+13.05%、用药推荐+5.47%

思陌智能体定制,由沈阳思陌智能科技有限公司(思陌智能科研服务)打造,专注为医疗机构提供知识问答、科研助手、临床决策支持等AI智能体定制开发服务。从需求分析到部署上线全流程覆盖。
原创
博文更新于 51 分钟前 ·
17 阅读 ·
0 点赞 ·
0 评论 ·
0 收藏

【技术解读】大模型个性化如何不更新权重实现微调?Weightless Fine-Tuning 以不到 7% 算力逼近 SFT

密歇根大学团队提出 Weightless Fine-Tuning(WFT):训练无关、只在解码时介入,不更新任何模型权重,仅用 dropout 交叉协方差估计出的跨前缀传输算子,把作者训练序列上的监督残差搬运到当前提示的 logit 空间。在 3 个 LaMP 个性化基准上 WFT 平均性能最优、单项追平或反超 SFT,预算受限下仅用不到 7% 有效算力逼近 SFT 效果。
原创
博文更新于 11 小时前 ·
120 阅读 ·
2 点赞 ·
0 评论 ·
1 收藏

AI心理健康聊天机器人为何越聊越危险?UCL×牛津Nature Medicine用SIM-VAIL审计9大模型810场对话:风险随轮次显著累积F=517.73,早期单点干预即可显著降险

思陌智能体定制,由沈阳思陌智能科技有限公司(思陌智能科研服务)打造,专注为医疗机构提供知识问答、科研助手、临床决策支持等AI智能体定制开发服务。从需求分析到部署上线全流程覆盖。
原创
博文更新于 昨天 07:24 ·
346 阅读 ·
10 点赞 ·
0 评论 ·
2 收藏

大模型 RL 对齐训练如何避免奖励黑客?Rubric Dropout 随机丢弃评分细则法解析

论文用 Qwen3-8B 实测 rubric-as-reward RL 的奖励黑客现象:训练裁判分数一路攀升、更强金标准裁判却先见顶后回落(HealthBench-Hard 回落 3 分、ResearchQA 回落 22 分)。作者提出一行式修复 Rubric Dropout——每步随机丢弃部分评分细则,在 OOD 评测上稳定提升 +6~+7 分且领域内零代价。
原创
博文更新于 前天 20:49 ·
532 阅读 ·
11 点赞 ·
0 评论 ·
5 收藏

医疗AI智能体真比裸大模型更会看病吗?协和肿瘤医院×德累斯顿工大npj基准评测OpenManus/Manus:准确率仅提升0.5%~8.9%且多数不显著,token却多烧10~100倍

思陌智能体定制,由沈阳思陌智能科技有限公司(思陌智能科研服务)打造,专注为医疗机构提供知识问答、科研助手、临床决策支持等AI智能体定制开发服务。从需求分析到部署上线全流程覆盖。
原创
博文更新于 前天 07:15 ·
400 阅读 ·
12 点赞 ·
0 评论 ·
5 收藏

DPO 对齐训练如何避免 token 贡献一刀切?Se-DPO 自演化 Token Credit 方法解析

UCLA 吴英年团队与上海人工智能实验室提出 Se-DPO,用自演化 token credit 按每个 token 对偏好结果的贡献调制 KL 正则化,仅增加一个两层 MLP 校准网络(零外部模型),在 AlpacaEval 2 上较 DPO 提升 9.8 点、Arena-Hard 提升 7.1 点。
原创
博文更新于 2026.08.16 ·
557 阅读 ·
19 点赞 ·
0 评论 ·
11 收藏

线上问诊AI会误诊、开错药吗?MedGuard声明级风险守门员实测:声明级F1达0.7677、REAL子集精度95.73%,9大基线平均领先21.2%

思陌智能体定制,由沈阳思陌智能科技有限公司(思陌智能科研服务)打造,专注为医疗机构提供知识问答、科研助手、临床决策支持等AI智能体定制开发服务。从需求分析到部署上线全流程覆盖。
原创
博文更新于 2026.08.16 ·
508 阅读 ·
13 点赞 ·
0 评论 ·
6 收藏

大模型量化后非英语能力为何退化 2-4 倍?LCD 语言条件反量化方法解析

2026年8月 arXiv 论文发现 INT3 GPTQ 量化让非英语语言困惑度退化达英语的 2-4 倍,提出 LCD 语言条件反量化——给已量化模型附加按语言区分的 rank-2 LoRA 修正,仅增 0.12% 参数、单 GPU 20 分钟内训练,在 Qwen2.5-3B 与 Llama-3.2-3B 上恢复 70-83% 困惑度差距。
原创
博文更新于 2026.08.15 ·
314 阅读 ·
9 点赞 ·
0 评论 ·
4 收藏

生成式AI放进基层诊所真能改善患者结局吗?Nature Medicine 9691例整群RCT给出诚实答案:AI Consult治疗失败率无显著改善,但诊断/病历/方案质量显著提升

思陌智能体定制,由沈阳思陌智能科技有限公司(思陌智能科研服务)打造,专注为医疗机构提供知识问答、科研助手、临床决策支持等AI智能体定制开发服务。从需求分析到部署上线全流程覆盖。
原创
博文更新于 2026.08.15 ·
447 阅读 ·
12 点赞 ·
0 评论 ·
7 收藏

中轴型脊柱关节炎如何突破 6.7 年诊断延迟?解放军总医院×清华 SpAgents 四智能体协同系统实现 94% 敏感性早筛并赋能基层

思陌智能体定制,由沈阳思陌智能科技有限公司(思陌智能科研服务)打造,专注为医疗机构提供知识问答、科研助手、临床决策支持等AI智能体定制开发服务。从需求分析到部署上线全流程覆盖。
原创
博文更新于 2026.08.14 ·
351 阅读 ·
9 点赞 ·
0 评论 ·
11 收藏

多专家 LoRA 为何越加越臃肿?MoEGen 超网络生成式低秩更新解析

东北大学等团队提出 MoEGen,将 MoE 式 PEFT 从「专家选择」转向「专家条件化的参数生成」:每个专家仅用一个 32 维向量表示,由轻量超网络按实例生成低秩更新。LLaMA3-8B 在 8 项常识推理基准平均达 87.9,仅训练 0.44% 参数,医疗+法律跨域联合适配领先最强基线 4.6–6.2 分。
原创
博文更新于 2026.08.13 ·
364 阅读 ·
9 点赞 ·
0 评论 ·
4 收藏

只靠医生已写好的病历就能筛出认知障碍?麻省总医院Pythia五智能体工作流自主优化提示,真实世界特异度98%、开源可本地部署

思陌智能体定制,由沈阳思陌智能科技有限公司(思陌智能科研服务)打造,专注为医疗机构提供知识问答、科研助手、临床决策支持等AI智能体定制开发服务。从需求分析到部署上线全流程覆盖。
原创
博文更新于 2026.08.13 ·
361 阅读 ·
10 点赞 ·
0 评论 ·
6 收藏

大模型怎样从用户反馈中持续自我改进?SLIFT 双适配器选择性自学习框架解析

清华大学与腾讯提出 SLIFT 选择性自学习框架,将用户反馈分解为 Fix/Spec/Null 三类并训练 Generalist 与 Specialist 双 LoRA 适配器。Qwen3-8B 在 MemoryBench 平均 Norm-Score 达 55.85,较基线提升 6.68 分,且 MMLU-Pro 知识推理零退化。
原创
博文更新于 2026.08.12 ·
355 阅读 ·
8 点赞 ·
0 评论 ·
16 收藏

普通心内科医生遇到复杂心脏病容易误诊漏诊怎么办?谷歌AMIE辅助诊疗RCT验证:临床显著错误率降46%、遗漏率降52%

思陌智能体定制,由沈阳思陌智能科技有限公司(思陌智能科研服务)打造,专注为医疗机构提供知识问答、科研助手、临床决策支持等AI智能体定制开发服务。从需求分析到部署上线全流程覆盖。
原创
博文更新于 2026.08.12 ·
364 阅读 ·
7 点赞 ·
0 评论 ·
6 收藏

病理报告文书太耗时、又不敢让AI碰诊断怎么办?UPMC把智能体锁死在文书层:94例活检结构识别100%、零幻觉诊断,出报告从76秒压到39秒

思陌智能体定制,由沈阳思陌智能科技有限公司(思陌智能科研服务)打造,专注为医疗机构提供知识问答、科研助手、临床决策支持等AI智能体定制开发服务。从需求分析到部署上线全流程覆盖。
原创
博文更新于 2026.08.11 ·
316 阅读 ·
5 点赞 ·
0 评论 ·
6 收藏

微调后模型输出千篇一律怎么办?CreativeInstruct 创造力标记法与 GRPO 增益解读

北卡罗来纳大学教堂山分校团队提出 CreativeInstruct,让对齐模型学会自行注入 [StartCreativity] 标记切换生成模式。Llama-3.1 8B 结构多样性 LLM-GED 从 0.366 升至 0.545,人工评测 70.3% 场次判定更有创造力,且在该检查点上做 GRPO 使 AMC 准确率从 0.438 提升到 0.478。
原创
博文更新于 2026.08.11 ·
328 阅读 ·
9 点赞 ·
0 评论 ·
11 收藏

大模型后训练没有标注答案怎么办?U-OPSD 零标注自蒸馏追平并超过有监督 GRPO

加州大学圣迭戈分校提出 U-OPSD,用模型自己的多数投票结果替代人工标注答案做在策略自蒸馏。Qwen3-8B 在五个竞赛数学基准上平均分从 43.57 提升到 54.31(+10.74),超过用了真实标注的 GRPO(45.43)和 OPSD(52.04),而全程一条标注数据都没用。
原创
博文更新于 2026.08.10 ·
347 阅读 ·
6 点赞 ·
0 评论 ·
7 收藏

病理AI换一个任务就得重训一个模型?SPARK用4个智能体以语言为接口、零训练自造分析工具,18个队列5400余例验证参数与预后/MSI/PD-L1显著相关

思陌智能体定制,由沈阳思陌智能科技有限公司(思陌智能科研服务)打造,专注为医疗机构提供知识问答、科研助手、临床决策支持等AI智能体定制开发服务。从需求分析到部署上线全流程覆盖。
原创
博文更新于 2026.08.10 ·
352 阅读 ·
8 点赞 ·
0 评论 ·
8 收藏

任务知识该写进提示词还是微调进权重?KV-Skill 外挂算子把 4B 模型准确率从 23.4 拉到 77.2

密歇根大学提出 KV-Skill,把任务技能从提示词文本编译成模型可直接读取的外挂低秩算子。Qwen3.5-4B 在 LiveMath 上准确率从文本技能的 23.4 提升到 77.2,且不占用任何提示词位置;在同等参数预算的强化学习对比中 8 个设置赢下 7 个。
原创
博文更新于 2026.08.09 ·
334 阅读 ·
12 点赞 ·
0 评论 ·
12 收藏

多模态大模型能直接读眼科影像吗?AgentEYE 用专科VLM工具+循证检索解耦架构,302例诊断正确性从36.5分提到71.9分,有害输出率29%→3.5%

思陌智能体定制,由沈阳思陌智能科技有限公司(思陌智能科研服务)打造,专注为医疗机构提供知识问答、科研助手、临床决策支持等AI智能体定制开发服务。从需求分析到部署上线全流程覆盖。
原创
博文更新于 2026.08.09 ·
329 阅读 ·
5 点赞 ·
0 评论 ·
7 收藏
加载更多