Stable Diffusion 3 正式开源,Stability AI推出了强大的文生图模型SD3-M,为用户带来免费试用机会。

知名开源大模型平台Stability AI于2024年6月12日晚上9点钟在推特上宣布正式开源了 Stable Diffusion 3 Medium(SD3-M) 权重,为广大用户带来了免费试用的机会。而且官方还宣称SD3-M是他们Stable Diffusion 3 系列钟最新、最先进的文本转图像AI模型!
试玩地址:https://huggingface.co/spaces/stabilityai/stable-diffusion-3-medium

我们都知道SD3是一款强大的文生图模型,拥有20亿参数,因其高效的推理速度和卓越的生成效果而备受瞩目。
具有一些显著的特点:
Stable Diffusion 3 Medium 模型以其卓越的图像生成能力而著称,能够输出具有照片级真实感的图像,细节丰富、色彩鲜艳、光照自然。通过采用创新的16通道VAE等技术,该模型显著提升了图像质量,尤其在手部和面部等细节上,克服了其他模型普遍存在的不足。在理解复杂提示方面,Stable Diffusion 3 Medium 表现出色,能够深入理解空间关系、构图元素、动作和风格等复杂概念。用户可以根据需要选择使用一个或多个文本编码器,以平衡生成过程中的性能和效率。排版质量也得到了显著提升,得益于其独特的扩散变压器架构,生成的文本在拼写、字距、字母形状和间距方面的错误大幅减少,提供了前所未有的文本质量。此外,Stable Diffusion 3 Medium 模型在资源利用方面表现出色,其较小的VRAM占用使得它能够在标准消费者级GPU上高效运行,而不会牺牲性能。模型的微调能力同样值得称赞,它能够从有限的数据集中学习细微的细节,使得定制化输出更加精确和完美。这些特点使得Stable Diffusion 3 Medium 成为市场上最具吸引力和实用性的文本到图像生成模型之一。SD3-M版本的开源允许用户探索其在不同领域的应用潜力。该模型采用了多模态扩散变换器(MMDiT)架构,在图片质量、排版、复杂文本提示和资源效率等方面取得了显著提升。仅需2-10秒即可生成图像,对硬件需求相对较低,适用于PC、手机、平板等多种设备。
SD3-M还与英伟达、AMD合作进行了特定硬件的优化,针对RTX GPU、TensorRT、最新CPU以及MI-300X进行了优化,性能最高可提升50%。该模型使用了包含10亿张图片的公开和合成数据进行了预训练,并针对特定艺术风格和领域,使用了3000万张图片进行微调以及300万张偏好图片,使其对用户的文本提示理解和嵌入图片文字的效果更为优秀。
通过在线demo展示,SD3-M生成效果惊艳非凡,能够生成高耸的摩天大楼、宁静的海滩景色、热带雨林以及20世纪50年代的老式餐厅等各种图像。免费在线试用为用户提供了无限的探索可能。
需要注意的是,目前SD3-M仅用于学术研究,无法进行商业化应用。如有商业需求,用户需要联系Stability AI进行商业授权。
Stable Diffusion 3的开源和免费试用为用户提供了探索其在不同领域应用潜力的机会,有望为人工智能领域的发展带来更多的可能性和机遇。
Stability AI官方公告
地址:http://stability.ai/news/stable-diffusion-3-medium
Hugging Face模型链接
地址:https://huggingface.co/stabilityai/stable-diffusion-3-medium
通过SD3-M的开源和免费试用,用户有机会探索其在不同领域应用潜力,并为人工智能领域的发展带来更多可能性和机遇。
最新发现
相关资讯
科大讯飞总裁吴晓如:大模型协同大过竞争
科大讯飞总裁吴晓如:大模型协同大过竞争产业端特别是传统产业,尚不能感受大模型发展带来的变革?吴晓如表示,接受大模型较快的是数字化程度较高的领域,它们有丰富的数据;其次是应用价值较大的领域,它们对数
2025-10-14 11:11:47
清华系前腾讯Robotics X核心成员创业,业内首款能“单手玩手机”的灵巧手来了|涌现新项目
一款能把脉、操作鼠标的“六边形”产品。
2025-09-17 11:00:00
华为全新小艺拟人化实时音视频对话功能适配机型公布,含MateXTs三折叠等
华为小艺智慧助手已在今年8月底推送了1137300版本升级,部分机型在更新该版本的小艺智慧助手后,新增支持“小艺看世界”功能。目前华为官网已公布该功能适配机型,包含MateXTs三
2025-09-17 10:30:00
通义千问系列最强大的语言模型:Qwen3-Max-Preview上线
阿里通义千问今日在官网和OpenRouter上线了最新的Qwen-3-Max-Preview模型。根据官网描述,该模型是通义千问系列中最强大的语言模型。
2025-09-17 10:00:00
AMD谈AI显卡:没有性能就没有人买推理一直有优势
9月5日消息,GPU显卡不仅决定了游戏性能,也是AI领域各大厂商竞争的焦点,NVIDIA一家占了90%以上的份额,AMD也紧追不舍。AMDCFO首席财务官JeanHu日前在花旗TMT大会上也谈到了
2025-09-17 09:30:00
支持百万卡扩展,中科曙光发布国内首个开放架构AI超集群系统
该系统以GPU为核心,实现了“算、存、网、电、冷、管、软”一体化紧耦合设计,可为万亿参数大模型训练推理、行业大模型微调、多模态大模型开发、AI4S等场景提供算力底座。
2025-09-17 09:00:00
今日热榜
当AI制药不再讲故事
2025-03-12 17:29:46ZCOOLxCanva可画:Canva可画创作者大赛“变飞为宝计划”,4/3截止征集
2025-06-21 13:01:44“AI+养老”,晚年更美好
2025-01-15 18:30:24东信集团发布首个AIGC营销大模型,赋能智能营销
2025-04-30 11:31:48美国人工智能政策与中国应对策略
2025-05-06 11:25:29男子用AI造谣“女儿被抱走”:内容是编的图是网上找的
2025-08-07 09:20:35AI体育训练场“常驻”京张遗址公园
2025-02-11 14:50:36深圳人工智能先锋城市建设加速推进
2025-05-04 19:56:38“国内AIApp产品TOP100”榜单揭晓美图秀秀斩获第三名
2025-02-24 16:54:27爱奇艺融入AI搜索,首次将生成式AI(AIGC)应用于剧情搜索等三大场景
2025-07-06 13:00:48热门推荐