与Sora同架构的Stable Diffusion 3.0 震撼发布

本文为博客 VIP 文章,开通 VIP 后可阅读全文

开通 VIP

Stability AI 发布了 Stable Diffusion 3,这款图像生成 AI 模型再次刷新了人们的认知。

这款由 Stability AI 倾力打造的文本变图模型,可是迄今为止最强大的“黑科技”!无论你想生成多主题的奇幻场景,还是高精度的风景写真,统统不在话下!

Stability AI 强调了该版本的几个亮点,其中首要的就是文字渲染能力,他们在其官网上一连给了三幅含有文字的图片,不仅文字清晰而且也没有任何拼写错误。

Stability AI 的首席执行官 Mostaque 也在 X(Twitter)上狂炫带有文字的图片:

图片

图片

Stable Diffusion 3.0 中改进的排版是 Stability AI 在新模型中构建的几个改进的结果。

Stability AI 的首席执行官 Mostaque 说:“这归功于 Transformer 架构和额外的文本编码器。现在可以实现完整的句子和一致的风格。”

另一个亮点是“多主题生成”:用一句话,就能描绘出用户脑中的万千世界!

Stability AI

一文解读:Stable Diffusion 3究竟厉害在哪里? 阅读详情

相关推荐

Stable Diffusion v3.0 api使用教程

今天Stable Diffusion v3.0的api终于可以使用, 效果真的出奇的好.我这里测试了下给予Python环境的调用, 效果也是非常的好.

专注于人工智能领域的小何尚 2702

Stable Diffusion 3 来了 —— 充满了巨大的改进

Stable Diffusion 3 是来自 Stability AI 的最新、能力最强的文本到图像模型。它在处理多主题提示、图像质量甚至文本渲染能力方面都有显著改进。该模型套件目前的参数范围从 8 亿到 80 亿。它结合了扩散变换器架构(类似于 Sora)和流匹配。扩散变换器架构扩散变换器(DiT)架构是一种新颖的扩散模型类别,它结合了变换器技术。通常使用卷积 U-Net 骨干的传统扩散模型不,DiT 使用变换器在图像的潜在块上进行操作。扩散变换器(DiT)架构

数智笔记 2014

重磅!Stable Diffusion 3.0正式开源!史上最强AI绘画模型!(附安装方法和下载地址)

正如承诺的那样,Stability AI在6月12日正式开源了Stable Diffusion 3(Medium版本)!不愧是AI生图领域的“开源英雄”。接下来就讲讲,怎么在本地部署最新的Stable Diffusion 3,大致分为以下几步

白帽阿叁的博客 6166

Sora架构Stable Diffusion 3.0 震撼发布!4 秒视频生成却翻车,网友:还是等 Sora 吧!

Stability AI 发布Stable Diffusion 3,这款图像生成 AI 模型再次刷新了人们的认知。这款由 Stability AI 倾力打造的文本变图模型,可是迄今为止最强大的“黑科技”!无论你想生成多主题的奇幻场景,还是高精度的风景写真,统统不在话下!Stability AI 强调了该版本的几个亮点,其中首要的就是文字渲染能力,他们在其官网上一连给了三幅含有文字的图片,不仅文字清晰而且也没有任何拼写错误。

Android_XG的博客 752

Stable Diffusion 3重磅发布

提示(意译版):在一幅充满史诗感的动漫画面中,一位巫师屹立于夜幕笼罩的山巅之上,正用他的法杖向漆黑无垠的夜空中施展一道震撼宇宙的魔法。这道法术在夜空中绽放,化作由五彩缤纷的能量构成的「Stable Diffusion 3」字样,犹如夜空中最璀璨的星辰。提示(意译版):这张电影级视觉效果的照片,捕捉到了一个静谧的教室瞬间,一颗鲜红的苹果静静地躺在桌子上,而在它背后的黑板上,则用醒目的粉笔字写着——「要么做大,要么回家」。提示:在这幅夜幕下的摄影作品中,一辆标有「SD3」字样的运动赛车正在赛道上疾驰。

u012854516的专栏 2313

Sora架构Stable Diffusion 3来了,样能「理解」物理世界,对复杂事物理解出色!

今日份炸弹又来了!深夜,Stability AI放出了Stable Diffusion 3.0,它采用了和爆火Sora样的DiT架构,画面质量、文字渲染、复杂对象理解大提升,Midjourney、DALL-E 3都显得黯然失色了。

白帽阿叁的博客 1360

Stable Diffusion 3震撼发布,采用Sora源技术,文字终于不乱码了

Stable Diffusion 3Sora 一样采用了 diffusion transformer 架构。继 OpenAI 的 Sora 连续一周霸屏后,昨晚,生成式 AI 顶级技术公司 Stability AI 也放了一个大招 ——Stable Diffusion 3。该公司表示,这是他们最强大的文生图模型。之前的版本相比,Stable Diffusion 3 生成的图在质量上实现了很大改进,支持多主题提示,文字书写效果也更好了。

2401_86065041的博客 1217

Stable Diffusion 3横空出世!模型Sora架构,也能理解物理世界

最近,每天都有新炸弹,各家纷纷开大了。昨天的炸弹,是Stable Diffusion 3。AI生图效果,再次到达全新里程碑!提示(意译版):在一幅充满史诗感的动漫画面中,一位巫师屹立于夜幕笼罩的山巅之上,正用他的法杖向漆黑无垠的夜空中施展一道震撼宇宙的魔法。这道法术在夜空中绽放,化作由五彩缤纷的能量构成的「StableDiffusion 3」字样,犹如夜空中最璀璨的星辰。网友复刻版,样惊艳:网友惊呼:这种prompt的一致性是我见过最好的!

m0_59162559的博客 1200

Stable Diffusion 3 震撼发布,采用Sora源技术,文字终于不乱码了

Stable Diffusion 3Sora 一样采用了 diffusion transformer 架构。继 OpenAI 的 Sora 连续一周霸屏后,昨晚,生成式 AI 顶级技术公司 Stability AI 也放了一个大招 ——Stable Diffusion 3。该公司表示,这是他们最强大的文生图模型。之前的版本相比,Stable Diffusion 3 生成的图在质量上实现了很大改进,支持多主题提示,文字书写效果也更好了。

机器学习社区 1154

Stable Diffusion 3深夜横空出世!模型Sora架构,也能「理解」物理世界

(全套教程文末领取哈)

xiaolinyui的博客 1018

紧随 SoraStable Diffusion 3 开启文生图技术新篇章

人工智能领域,图像生成技术一直是研究的热点。随着深度学习技术的飞速发展,生成对抗网络(GANs)和变分自编码器(VAEs)等模型已经能够创造出令人惊叹的图像。然而,这些技术在处理复杂文本提示和多主题图像生成方面仍存在局限性。

2301_80239908的博客 862
上一篇: 多模态AI产业链全景梳理
下一篇: 模型上下文长度达到10000000,又一批创业者完蛋了?
richerg85
博客等级 码龄18年 3462粉丝 · 360原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值