翻译:Scalable Diffusion Models with Transformers-CSDN博客
笔记:15、Scalable Diffusion Models with Transformers_adaptive normalization layers-CSDN博客
Scalable diffusion models with transformers-CSDN博客
论文阅读:Scalable Diffusion Models with Transformers-CSDN博客
tranformer: 详解Transformer中Self-Attention以及Multi-Head Attention_transformer multi head-CSDN博客
BatchNorm:batch方向做归一化,计算N*H*W的均值
LayerNorm:channel方向做归一化,计算C*H*W的均值
ViT:Vision Transformer详解-CSDN博客
【Transformer系列】深入浅出理解ViT(Vision Transformer)模型_vit模型-CSDN博客
Self -Attention、Multi-Head Attention、Cross-Attention_cross attention-CSDN博客
DiT: 一文带你搞懂DiT(Diffusion Transformer)_dit模型-CSDN博客
ViT更新:【Backbone】TransNeXt:最新ViT模型(原理+常用神经网络汇总)-CSDN博客
多头注意力(Multi-Head Attention)和交叉注意力(Cross-Attention)是两种常用的注意力机制的原理及区别-CSDN博客



1162

被折叠的 条评论
为什么被折叠?



