Stable Diffusion 3(简称 SD3)是一款强大的文生图模型,拥有20亿参数,以其高效的推理速度和优秀的生成效果备受瞩目。6月12日晚,知名开源大模型平台 Stability AI 正式开源了 SD3-M 权重,为广大用户带来了免费试用的机会。(试玩视频放在文章上面了!)
SD3-M的主要特点
SD3-M 在平均生成图片时间上极具优势,仅需2—10秒左右,同时对硬件的需求也相对较低,适用于PC、手机、平板等多种设备。此外,SD3-M 还与英伟达、AMD 合作进行了特定硬件的优化,针对 RTX GPU、TensorRT、最新 CPU 以及 MI-300X 进行了优化,性能最高可提升50%。
创新架构
该模型采用了多模态扩散变换器(MMDiT)架构,在图片质量、排版、复杂文本提示、语义理解和资源效率等方面均取得了极大的提升。SD3-M 使用了包含10亿张图片的公开和合成数据进行了预训练,并针对特定艺术风格和领域,使用了3000万张图片进行微调以及300万张偏好图片,使其对用户的文本提示理解和嵌入图片文字的效果更为优秀。
惊艳的生成效果
通过在线 demo 展示,SD3-M 生成效果惊艳非凡。从高耸的摩天大楼到宁静的海滩景色,从热带雨林到20世纪50年代的老式餐厅,SD3-M 展现出了出色的图像生成能力。免费在线试用也为用户提供了无限的探索可能。
使用限制与机会
需要注意的是,目前 SD3-M 仅用于学术研究,无法进行商业化应用。如有商业需求,用户需要联系 Stability AI 进行商业授权。
结论
SD3-M 的开源,用户可以免费试用这一超强的文生图模型,探索其在不同领域的应用潜力。希望这一举措能够为人工智能领域的发展带来更多的可能性和机遇。
SD3-M产品入口:
试玩地址:
数据统计
相关导航
💡 爱派 AiPy 简介 爱派(AiPy) 是一款基于 LL...
Google Colab
Google Colab
facefusion
facefusion是一款创新的开源A...
Freepik Reimagine
Millions of free graphic resources. ✓ Photos ✓ AI images ✓ Vectors ✓ Templates ✓ Videos. Find out about our real-time AI art generator.
星火公文写作助手:让公文撰写更高效便捷
星火公文写作助手:让公文撰...
SpeechEasy:将文本转化为自然语音的高效AI语音合成工具
SpeechEasy:将文本转化为自...
百度AI开放平台
百度AI开放平台提供全球领先的语音、图像、NLP等多项人工智能技术,开放对话式人工智能系统、智能驾驶系统两大行业生态,共享AI领域最新的应用场景和解决方案,帮您提升竞争力,开创未来。
快转字幕
快转字幕
暂无评论...
