一发布就失望 Stable Diffusion 3有什么大问题
前不久,Stability AI发布了开源的Stable Diffusion 3 Medium,让各大探索AI的网友们兴奋不已,毕竟SD1.5、SDXL的发布已经带来了很多震撼,这次的SD3更是期待拉满,很多网友都在开源的第一时间去下载,然而体验似乎并没有Stability AI所说的那么神。
在一开始的宣传中,Stability AI表示SD3已经能生成文字,但目前只能生成英文,中文还无法识别,而且最重要的是,SD3似乎在人物生成上开了倒车,对于人画像的生成,SD3经常产出畸形的人物形态,特别是人的四肢、手脚方面的错误,整体体验还不如上一代模型。
也就是说,只要不生成人物的四肢,SD3模型在局部画面上的表现还是很精致的,在物品和动物的生成上,SD3也基本没有什么问题,对于复杂的长提示词也有着很高的识别率,但是就是画不好四肢健全的人类,在这方面反而退化了一般,引起了很多人的不解。(图片来自量子位)
国外论坛Reddit用户则分析称,表示SD3的人体四肢理解错误,是因为在训练时,开发者过多干预内容,设置过滤限制级内容,而且通过的条件非常苛刻,从而导致AI识别错误,一些正常的图片也因此被识别为限制级内容,因此在公开的SD3模型中,人体的效果因为训练不足而导致畸形。
这就解释了,为什么SD3并未翻起很大风浪,因为除了会识别英文外,最主要的人体识别反而开了倒车,原本在解决手部问题,这下子演变成了还要解决四肢的问题,需要很长的提示词去修复,但对于非人类,SD3的效果还是出奇的好,细节都很到位,也遵循物理规则,可惜这一版本并不完美。
当然这也许和Stability AI陷入困境有关,在此之前,公司财务状况并不佳,且ceo辞职,曾经的主要成员也离开,加上裁员风波,如今能推出SD3也是不容易,更有网友表示公司内部混乱,如今不成熟的SD3就是证明,但终究它还是推出了,并且开源了,这都遵守了之前的承诺,也许只是单纯的出错了呢?(图为Stable Diffusion 3 模型架构)
但这也只是个中杯的SD3,也就是说后续还有大杯和小杯的推出,也许要经历过这次问题后,Stability AI会对训练数据进行修改,完善出更好的SD3也说不定,而且现在也有SD1.5与SDXL的在持续创作与使用,如果修改后的SD3能在SDXL的基础上再进步,那就值得赞赏,当然SD3如果支持其他语言的理解那就更好了
目前SD3模型还暂时只支持ComfyUI,想要体验的网友可以下载ComfyUI进行尝试,虽然SD3开源的为中杯版本,但对于显卡的要求,还是比较推荐大显存会更好,因此我们推荐使用影驰RTX 4070 Ti SUPER星曜OC显卡。
影驰RTX 4070 Ti SUPER星曜OC显卡,相比于4070 Ti,显存上为更大的16GB GDDR6X,并且核心性能也得到了加强,无论是AI创作者还是游戏玩家,都能感受到明显的提升,同时16GB显存也是非常适合AI软件运行,是一款不容错过的高性能大显存的显卡,如果你对这张显卡感兴趣,欢迎前往影驰官方商城挑选~
本文链接:http://www.sanshiling.com/content-21-3034-1.html
免责声明:本文为转载,非本网原创内容,不代表本网观点。其原创性以及文中陈述文字和内容未经本站证实,对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。
-
合资插混最强匮电也是龙 雪佛兰探界者Plus上市:14.99万起!
雪佛兰首款智电插混SUV探界者Plus今日正式上市,共推4款配置车型,售价区间14 99-17 99万元。该车采用新一代设计语言,延续美式SUV典型的设 [详细] -
光峰科技发布2023年财报:营收22.13亿元 经营现金流大增105%
4月26日晚间,光峰科技披露2023年年报。年报显示,2023年光峰科技实现营业收入22 13亿元;归母净利润实现1 03亿元;整体毛利率达到36 22%; [详细] -
张艺谋《第二十条》网播上线:爱奇艺、腾讯视频、优酷会员免费看
今日,张艺谋电影《第二十条》正式开启网播,上线爱奇艺、腾讯视频、优酷、芒果TV、B站等视频平台,开通平台会员后可免费观看。据了解,《 [详细] -
《蛋仔派对》注重保护未成年人网络安全 保护未成年人不受到诈骗
在目前这个飞速发展的数字化时代,互联网让我们的娱乐生活得到了极大的丰富,各种各样的游戏层出不穷,但网络安全问题也随之凸显,大额充值 [详细] -
百度:AI专利申请量、授权量国内第一
在第24个世界知识产权日来临之际,百度昨日举办专利运用赋能AI产业高质量发展论坛。在论坛上,百度首席技术官王海峰透露,百度在以大模型为 [详细]