木道寻08

这个屌丝很懒，什么也没留下！

热门标签

最近大火的两大AI绘图工具 Midjourney VS StableDiffusion_midjourney和stablediffusion_midjounery

作者：木道寻08 | 2024-08-19 07:05:34

踩

midjounery

大家好，今天给大家介绍一下最近大火的两大AI绘图工具，Midjourney （官网）和stable diffusion（官网）。

下面将分别从上手难易程度、出图效果、出图效率、使用成本进行对比。

1、上手难易度

首先我们来看上手难易度。

Midjourney提供了一个友好的界面来帮助用户了解和操作每一步。它还提供了一个简单的模板，可以让用户快速开始并轻松创建和发布他们的消息。midjourney是基于discord搭建的绘画平台，先注册discord，用discord的账号可以直接登录midjourney，完成后即可进入Midjourney对应的对话框，通过输入不同的命令来调用不同功能。此外，Midjourney还允许用户使用现有的媒体，可以轻松地添加图片等。

在这里插入图片描述

进入之后，你可以看到midjourney的公共绘画区，很多人在这里生成图片，实时更新。

在这里插入图片描述

左侧栏里可以浏览频道，还有一些newbies-110，newbies-140这些是新手区，可以点进去生成自己的图片。

在这里插入图片描述

StableDiffusion，目前是开源的，也就是可以直接在本地部署，它需要用户深入了解技术知识，才能使用它来发布信息。它需要用户熟练掌握编码和数据库技术，才能完全利用它的所有功能。此外，StableDiffusion要求用户自己导入图像，视频等媒体，而不像Midjourney那样提供现成的媒体。当然对于硬件也是有要求的，基本要3g以上显卡显存至少要8gb。同时StableDiffusion模型占据的硬盘也比较多，至少有20-30G空间。当然也可以通过云部署的方式，比如通过Google的clap来部署StableDiffusion，即可通过url进行访问并使用。当然，想要得到更加丰富多彩的图片效果，还需结合不同的模型loray等。

StableDiffusion 大模型的切换，首先是这个界面左上角，在这里可以切换你所安装的模型。

在这里插入图片描述

文生图，这里与 Midjourney 不同的是，StableDiffusion 有一个反向关键词（意思是不要图片出现什么），文生图的关键词格式与 Midjourney 基本一致。

在这里插入图片描述

下面这块参数就是设置图片的一些基本参数，分辨率、尺寸等等，具体参数见下文

在这里插入图片描述

图生图，这个也很好理解，放参考图然后输入提示词，与其他 AI 绘画软件一致。

在这里插入图片描述

图片信息，意思是你用 SD 画的图，放在这里来，右边会显示这个图片的一些参数，包括关键词。

在这里插入图片描述

综合来讲，从上手难易度来说，Midjourney 更容易上手，StableDiffusion 稍难于上手！

2、两大ai绘图工具的出图效果

Midjourney 的底层原理是基于生成对抗网络和深度学习技术，当然我们还是更关注它的出图效果。我们可以看到Midjourney生成的图片都比较精美，目前版本已经升级到v5，真人生成会更加真实，细节处理的也比较到位。但是手指的处理上还是会出现瑕疵，Midjourney生成图片的可控性并不强，需要不断调整prompt，所以这也是目前最大的瓶颈。

例如，想要输入：可爱的女孩，手捧鲜花，背景是情人节活动气球装饰，用在线翻译帮忙翻译成英文关键词，输入：Lovely girl, holding flowers, with Valentine’s Day balloons in the background

机器人会在一分钟之内生成4张图片：

在这里插入图片描述

而StableDiffusion 用ldm潜在扩散模型，其目标是消除高斯噪声在训练图像上的连续应用，可以将其视为一系列去噪自动编码器。stable diffusion结合不同的模型，lauray可以生成各种不同风格的图片，通过正向提示词和反向提示词，可以更好的生成想要的图片。stable diffusion不仅仅具备纹身图、图声图、图、声纹这些功能，其嵌入的control net解决了空间一致性问题。以前根本没有有效的方法来告诉ai模型要保留输入图像的哪些部分control net。通过引入一种方法来改变这一点是StableDiffusion，能够使用额外的输入条件来告诉模型确切的做什么，甚至引入三dopen pose，生成人物的姿势或者动作，来精准控制需要生成的图片。这个是目前在a i绘图方面得到较高认可的功能。

例如：油画

prompt: portrait of bob barker playing twister with scarlett johansson, an oil painting by ross tran and thomas kincade

在这里插入图片描述

比如，这样的赛博朋克风

prompt: Cyberpunk, 8k resolution, castle, the rose sea, dream

在这里插入图片描述

从出图效果看，StableDiffusion在可控性和应用广度上都略胜一筹。

3、出图效率

StableDiffusion 有一个弊端，就是速度非常慢，动辄半个小时起步。

Midjourney是Disco Diffusion的原作者Somnai所加入的AI艺术项目实验室，Midjourney 对 Disco Diffusion 进行了改进，平均1分钟能出图。

自我介绍一下，小编13年上海交大毕业，曾经在小公司待过，也去过华为、OPPO等大厂，18年进入阿里一直到现在。

深知大多数Python工程师，想要提升技能，往往是自己摸索成长或者是报班学习，但对于培训机构动则几千的学费，着实压力不小。自己不成体系的自学效果低效又漫长，而且极易碰到天花板技术停滞不前！

因此收集整理了一份《2024年Python开发全套学习资料》，初衷也很简单，就是希望能够帮助到想自学提升又不知道该从何学起的朋友，同时减轻大家的负担。

既有适合小白学习的零基础资料，也有适合3年以上经验的小伙伴深入学习提升的进阶课程，基本涵盖了95%以上Python开发知识点，真正体系化！

由于文件比较大，这里只是将部分目录大纲截图出来，每个节点里面都包含大厂面经、学习笔记、源码讲义、实战项目、讲解视频，并且后续会持续更新

如果你觉得这些内容对你有帮助，可以添加V获取：vip1024c （备注Python）

如果你也是看准了Python，想自学Python，在这里为大家准备了丰厚的免费学习大礼包，带大家一起学习，给大家剖析Python兼职、就业行情前景的这些事儿。

一、Python所有方向的学习路线

Python所有方向路线就是把Python常用的技术点做整理，形成各个领域的知识点汇总，它的用处就在于，你可以按照上面的知识点去找对应的学习资源，保证自己学得较为全面。

二、学习软件

工欲善其必先利其器。学习Python常用的开发软件都在这里了，给大家节省了很多时间。

三、全套PDF电子书

书籍的好处就在于权威和体系健全，刚开始学习的时候你可以只看视频或者听某个人讲课，但等你学完之后，你觉得你掌握了，这时候建议还是得去看一下书籍，看权威技术书籍也是每个程序员必经之路。

四、入门学习视频

我们在看视频学习的时候，不能光动眼动脑不动手，比较科学的学习方法是在理解之后运用它们，这时候练手项目就很适合了。

四、实战案例

光学理论是没用的，要学会跟着一起敲，要动手实操，才能将自己的所学运用到实际当中去，这时候可以搞点实战案例来学习。

五、面试资料

我们学习Python必然是为了找到高薪的工作，下面这些面试题是来自阿里、腾讯、字节等一线互联网大厂最新的面试资料，并且有阿里大佬给出了权威的解答，刷完这一套面试资料相信大家都能找到满意的工作。

成为一个Python程序员专家或许需要花费数年时间，但是打下坚实的基础只要几周就可以，如果你按照我提供的学习路线以及资料有意识地去实践，你就有很大可能成功！
最后祝你好运！！！

一个人可以走的很快，但一群人才能走的更远。不论你是正从事IT行业的老鸟或是对IT行业感兴趣的新人，都欢迎扫码加入我们的的圈子（技术交流、学习资源、职场吐槽、大厂内推、面试辅导），让我们一起学习成长！

几周就可以，如果你按照我提供的学习路线以及资料有意识地去实践，你就有很大可能成功！
最后祝你好运！！！

一个人可以走的很快，但一群人才能走的更远。不论你是正从事IT行业的老鸟或是对IT行业感兴趣的新人，都欢迎扫码加入我们的的圈子（技术交流、学习资源、职场吐槽、大厂内推、面试辅导），让我们一起学习成长！
[外链图片转存中…(img-ub1coZ9k-1712811022968)]

声明：本文内容由网友自发贡献，不代表【wpsshop博客】立场，版权归原作者所有，本站不承担相应法律责任。如您发现有侵权的内容，请联系我们。转载请注明出处：https://www.wpsshop.cn/w/木道寻08/article/detail/1001185