Stable Diffusion 3 强势来袭，从此将文字绘画出来不是难题！

Stability AI 刚发布 StableDiffusion3 模型进行公测。该模型采用 diffusion transformer 架构，显著提高了在多主题提示、图像质量和拼写能力方面的性能。感兴趣的小伙伴，赠送全套AIGC学习资料，包含AI绘画、AI人工智能等前沿科技教程和软件工具，具体看这里。AIGC技术的未来发展前景广阔，随着人工智能技术的不断发展，AIGC技术也将不断提高。未来，AI

程序员小何SS

906人浏览 · 2024-10-24 15:08:37

程序员小何SS · 2024-10-24 15:08:37 发布

介绍

Stability AI 刚发布 StableDiffusion3 模型进行公测。该模型采用 diffusion transformer 架构，显著提高了在多主题提示、图像质量和拼写能力方面的性能。

特点

spelling abilities

就是可以将提示词中所需要绘制的文本展现在图片上。如下案例：

Prompt: cinematic photo of a red apple on a table in a classroom, on the blackboard are the words "go big or go home" written in chalk

提示词：教室桌子上红苹果的照片，黑板上用粉笔写着“go big or go home”

可以看出提示词中的 go big or go home 完整的展示在黑板上面，又准又狠！

multi-subject prompts

就是可以将用户提示词中的所提到的所有要素都展现出来。如下案例：

prompt：Resting on the kitchen table is an embroidered cloth with the text 'good night' and an embroidered baby tiger. Next to the cloth there is a lit candle. The lighting is dim and dramatic

提示词：厨房的桌子上放着一块绣花布，上面写着“晚安”和一只绣着的小老虎。布旁边有一支点燃的蜡烛。灯光昏暗而戏剧性

可以从图片中看出，桌子上的绣花布，晚安的字样，绣出来的小老虎，布旁边的点燃的蜡烛，昏暗的等黄，这些要素都完整的体现了出来！Perfect！

image quality

把图像质量又提升了一个台阶，从此高清写真不在话下！

Prompt: studio photograph closeup of a chameleon over a black background

提示词：黑色背景中变色龙的工作室照片特写

原理概要

Stable Diffusion 3 模型的参数范围在在 800M 到 8B 之间，整个模型的实现结合了 diffusion transformer 架构和 flow matching
机制。该模型的技术报告目前还未公布，不过不难推测，主要的模型还是
DiT 和 flow matching 机制。Stable Diffusion 3
模型致力于打造安全、负责任的目标，并且防止滥用，从开始训练模型时，持续到测试、评估和部署的整个过程，都增加了很多安全措施。

DiT 的主要贡献在于扩散模型可以成功地用 transformer 替换 U-Net 主干，它不仅继承了 Transformer
模型类的优秀扩展特性，性能还优于先前使用 U-Net 的模型。Paper 入口请看文末参考部分。

flow matching 机制提出了基于连续归一化流（CNFs）的生成模型新范式，以及 flow matching
的概念，这是一种基于回归固定条件概率路径的矢量场的免模拟 CNFs 的方法。结果发现使用带有扩散路径的 flow matching
，可以使得训练出来的模型更稳定。Paper 入口请看文末参考部分。

与 DALLE-3、MJ6 效果对比

Prompt: a painting of an astronaut riding a pig wearing a tutu holding a pink umbrella, on the ground next to the pig is a robin bird wearing a top hat, in the corner are the words "stable diffusion"

使用 DALLE-3 输入相同的 Prompt 生成的图像，虽然在关键的图像内容都生成了，但是可以看出在文本生成方面略输一筹，需要显示的“stable diffusion”拼写发生了错误。

使用 midjourneyv6 输入相同的 Prompt 生成的图像，可以看出和 DALLE-3 有同样的问题，可以看出 stable diffusion 3 完胜。

如果有对stable
diffusion感兴趣、想学习的小伙伴，不用担心0基础，

写在最后

感兴趣的小伙伴，赠送全套AIGC学习资料，包含AI绘画、AI人工智能等前沿科技教程和软件工具，具体看这里。

在这里插入图片描述

AIGC技术的未来发展前景广阔，随着人工智能技术的不断发展，AIGC技术也将不断提高。未来，AIGC技术将在游戏和计算领域得到更广泛的应用，使游戏和计算系统具有更高效、更智能、更灵活的特性。同时，AIGC技术也将与人工智能技术紧密结合，在更多的领域得到广泛应用，对程序员来说影响至关重要。未来，AIGC技术将继续得到提高，同时也将与人工智能技术紧密结合，在更多的领域得到广泛应用。

在这里插入图片描述

一、AIGC所有方向的学习路线

AIGC所有方向的技术点做的整理，形成各个领域的知识点汇总，它的用处就在于，你可以按照下面的知识点去找对应的学习资源，保证自己学得较为全面。

在这里插入图片描述

二、AIGC必备工具

工具都帮大家整理好了，安装就可直接上手！
在这里插入图片描述

三、最新AIGC学习笔记

当我学到一定基础，有自己的理解能力的时候，会去阅读一些前辈整理的书籍或者手写的笔记资料，这些笔记详细记载了他们对一些技术点的理解，这些理解是比较独到，可以学到不一样的思路。
在这里插入图片描述

四、AIGC视频教程合集

观看全面零基础学习视频，看视频学习是最快捷也是最有效果的方式，跟着视频中老师的思路，从基础到深入，还是很容易入门的。

在这里插入图片描述

五、实战案例

纸上得来终觉浅，要学会跟着视频一起敲，要动手实操，才能将自己的所学运用到实际当中去，这时候可以搞点实战案例来学习。
在这里插入图片描述

在这里插入图片描述

天启AI社区

GitCode 天启AI是一款由 GitCode 团队打造的智能助手，基于先进的LLM（大语言模型）与多智能体 Agent 技术构建，致力于为用户提供高效、智能、多模态的创作与开发支持。它不仅支持自然语言对话，还具备处理文件、生成 PPT、撰写分析报告、开发 Web 应用等多项能力，真正做到“一句话，让 Al帮你完成复杂任务”。

更多推荐