不求甚解的Comfyui小白指北经验之谈 鉴于发的好几次帖子,大家伙都很热情,且很多坛友都留言说出教程,所以有了这个帖子。一、一些题外话,只是有感而发其实这个东西,类似于信息茧房,看起来很高大上,只要自己原意走出舒适区,主动的去花点心思去搜一搜,学一学,很容易就能上手。因为说到底我们都只是使用者,不是开发者,不用会代码、会训练模型、会参数微调,只需要明白它们的用法即可,而且AI发展到现在,利用Claude、Gemini等能力比较好的AI工具,拷打AI帮你写代码也不是什么难事。且开源的最大好处,就是有很多开源人是真的抱着无私分享的精神,无偿的分享知识技术的,这也是我一直对开源的开发者怀着无比敬意的原因。先叠个甲,本人也是纯自娱自乐,非专业。说说我玩这个的契机吧,两年前(23年),点爆开源AI圈的ChilloutMix文生图融合模型面世(第一个大面积出圈的较好的支持了nsfw的融合大模型,算是对标了当时闭源卖钱的novelAI),彼时大家都用的还是StableDiffusionWebUI,当时我也算是半小白,刚接触不久,但是因为我写的一套古风提示词,以及一些Embeddings的搭配产生了奇妙的化学反应,我将那套图传到了civital的评论区,被作者给邀请到了他的discord。后来这个模型迅速火爆成为了C站第一,作者是个日本人,在dc群里讨论说他很困扰,害怕自己的模型太火了招来麻烦,甚至还跑过来私聊我找安慰,他以为我是专门整这个的哈哈。那会novelAI还处在舆论的风口浪尖,涉及到未经绘画网站众原创作者允许扒了各种绘画训练集拿来训练,很多人都有法律、版权这方面的担忧。作者最后决定急流勇退,将模型版权直接转给了C站官方,解散了大的dc群,另拉了一个小群,只邀请了一小群他觉得还比较合得来的人。两年过去,那个群也基本上没啥人说话了。作者关于训练集的担心,到现在基本没什么人讨论这个事情了。不知道作者现在想来,会不会觉得当年是一个天大的机会没把握住呢?扯远了,本帖子不是教程,只是指路,就是告诉大家能去哪里最快找到能上手的东西,而不是教你新建文件夹然后安装git 和python然后打开命令行开始clone环境到本地,这种对新手小白非常不友好。至于更详细的教程,从基础概念到高端操作,一搜一大把,不用我班门弄斧了。二、基础环境准备(1)一台中高配电脑,40系16G显存64G内存为佳,下限可至20系8G显存和32G内存,再低就不推荐本地部署运行了,真心不建议折腾。(2)可以开tun模式(即可以代理底层网络)的梯子以及足够的流量,Comfyui运行时属于命令行,必须tun模式才能稳定的从国外各类数据库、模型库下文件,我默认坛友们都是墙内的哈,国外的不用管。若无梯子,可能无法更新部分自定义节点,或者无法下载一些自定义节点需要的模型,依赖库安装失败会导致部分功能无法正常使用。(3)如果以上都没有又想玩的话,建议使用云平台,其中对小白最友好的应该是Runninghub了,优点很多,首先是现在很多b站up都和官方合作,(它家合作门槛蛮低的,b站1000粉就行,我还差200哈哈),分享的工作流点进去就能玩,其次平台节点全,不用自己配置环境,且官方更新很勤,很多最新的开源节点模型都会第一时间更新和支持。当然了算力是要收米的,想凭本事白嫖的需要规划好它每天送的100点算力哈哈,因为不累计,当天清零。使用合作up的邀请码可以得1000点有效期一年的算力(我只有800粉,不够合作,我的邀请码只能得500算力,不发出来害坛友了_(:з」∠)_)。这个1000点,大概够跑5000秒,也就是一个多小时,只有运行才算时间,跟一般的云平台只要开着就计费不一样。我一般用来跑本地跑不动或者懒得下模型的流,以及一些偏实验性质,环境很难配置或者容易引起冲突的功能。为了引流避嫌我就不贴链接了,大家自己去搜一搜即可。三、赛博菩萨推荐赛博菩萨指面向纯小白的AI领域相关作者,最出名的应该就是b站的秋葉大佬,我这里主要列一下我关注的更新质量很高,且对新手很友好的up。(1)秋葉aaaki:https://space.bilibili.com/12566101/dynamic最出圈的一位技术大佬,不过现在进入半退休状态,每天都是直播打打游戏,只有有重大技术更新时会在动态锐评。其开发的秋葉整合包对新手非常友好,可以在链接的动态里找到,最新的是8月份的整合包。我到现在还是用的它的秋叶启动器,功能非常齐全,包含了非常多的可以在界面操作的功能,正常可能都需要命令行代码操作,包括可以自由切换内核和自定义节点的commit版本,自动补全安装依赖,便捷安装自定义节点,且具备一定的故障排查功能。内置了国内部分镜像链接,对于无法访问外网的用户也很友好,当然了现在一些国内镜像出了问题,这也是我推荐自备梯子的原因。如果国内镜像下载有问题,需要将其设置中使用国内镜像的选项关闭,这样就会直接从国外下载。启动器的使用,B站使用教程非常多,他自己应该也有配套教程。(2)T8star-Aix:https://space.bilibili.com/385085361/dynamic韩国女星高允贞狂热粉丝,更新狂魔,基本上有新技术就会第一时间跟进。人很平易近人,评论区经常挨个回复,也是看着他从1万多粉涨到了现在的6万粉。跟runninghub官方应该现实里是朋友,其工作流基本都有runninghub在线版本,且每期都会附上模型链接、github项目地址等等。另外他有根据秋叶包制作的图文整合包、视频整合包、数字人整合包、本地解码整合包(规避runninghub在线nsfw安全审查的)等,可以在他空间搜关键词,都能找到,很好的解决了新手安装自定义节点上手难,依赖冲突容易报错的问题(在学会用AI解决依赖安装问题前,我也经常头疼这个问题),节点很齐全,包罗万象,缺点就是非常大,新手可能不知道自己需要啥,其实有很多东西,你日常是用不到可以删掉的,这个就是一个经验逐渐增长的过程了。另外要提一嘴的就是runninghub的本地解码,这也是我愿意用这个平台的原因,不能涩涩的AI是不完整的,合理规避平台安审是非常必要的。相关骚操作可以参考他的本地解码系列合集。(3)刘悦的技术博客:https://space.bilibili.com/3031494/dynamic这位算的上整合包狂魔,每次一个新技术出现,都会手搓一个单功能的整合包,把相关东西打包发出来,很适合那种不爱自己折腾且硬盘空间大的纯小白。他基于的是官方的,不是秋葉启动器,所以维护起来比较难。为数不多的没在云平台传工作流的up。(4)AIwood爱屋研究室:https://space.bilibili.com/503934057/dynamic定位与T8类似,也是以分享最新技术为主、且都附有工作流。(5)Work-Fisher:https://space.bilibili.com/17919458/dynamicYZ_金鱼:https://space.bilibili.com/14843708/dynamic两位新人up主,分享的工作流都很有想法很好用。金鱼那边貌似最近刚发了一个comfyui的基础教程,推荐看看。(6)非针对小白的技术up:ComfyUI中文(官方账号)、Smthem、小志Jason等,他们分享的东西多数属于进阶内容。四、模型来源与常用网站(1)Civital(C站),国外最大的面向用户的AI模型网站,界面简单易懂,模型均附有图片,方便筛选查找,发帖发图片及被点赞也有一些奖励点数,可以用来在网站上生图、训练模型。基本上主流的nsfw大模型、lora均能在上面找到。今年上半年貌似因为国外政策原因,自断臂膀进行了一波清洗,移除了大量真人lora、脱衣编辑lora等,不过依旧是最好用的模型网站之一。(2)hugging face(抱脸),国外最大的专业AI模型网站,包罗万象,也是很多专业开源团队(黑森林、阿里系、字节系、腾讯系等)开源模型时的首选平台,很多依赖库的相关文件也基本保存在该网站上。且该网站审查程度较低,支持个人模型储存,存在很多被Civital枪毙的lora备份,就是界面很冗杂,非常类似github的那种设计理念,不太好找到相关模型。有免费的服务器可以使用,可以用来配置一些轻量的AI应用,需要一定编程基础。(3)Modelscope(魔搭社区),国内的模型网站,对标HF,模型可能没有HF那么全,但应该大差不差,流量不足时可以先去这里找找。(4)LiblibAI(哩布哩布AI),国内模型和在线工作流网站,对标C站,就是商业化气息太重了我不爱用,一堆模型全是仅限会员下载使用的,还有一堆加密的模型。不过能找到很多符合国人审美的免费优秀lora。五、推荐模型(1)文生图只推荐flux和qwen image,更早的sd1.5和sdxl(包括pony等)没啥讨论的必要了。其中flux也退版本了,只推荐基于它训练的chroma,chroma的一大特点是专门针对nsfw做了对应训练,而且效果很棒,如果不是因为flux底模参数太少,至今仍有一战之力,开源模型中基本没有涩涩效果比它好的,本地推荐fp8版本,16G可以无障碍运行:https://huggingface.co/Clybius/Chroma-fp8-scaled/tree/main/Chroma1-HDqwen image推荐两个更适合国人体质的微调模型:白转千问fp8版本:https://www.liblib.art/modelinfo/22aa5711ae604deabf888c9f7fcc9e08?from=search&versionUuid=ec3c4c83c7d94ca48e5cb1b2372bc519满血版在c站,同名,本地跑需要24G显存:https://civitai.com/models/1993473/white-qwen?modelVersionId=2256407小志的重平衡微调:https://civitai.com/models/2064895/qwen-rebalance-v10?modelVersionId=2336581(2)编辑模型,主要是flux kontext和qwen image edit 2509,主模型和对应的量化版本HF很多,我就不贴了。对应的改图工作流也很多,我上面列举的up也有很多工作流。(3)视频模型,目前主要是wan2.2,其中最近比较火的两个魔改模型:smoothmix:https://civitai.com/models/1995784/smooth-mix-wan-22-i2vt2v-14blightx2v:https://huggingface.co/collections/lightx2v/wan22-lightx2v具体用法一两句话说不清楚,去看我列出来的上面的up的视频,他们相关视频讲的很详细。https://www.bilibili.com/video/BV1SqsizcEDh
(4)视频编辑模型,即wan animate,参考T8的系列视频:https://www.bilibili.com/video/BV1K446z3E7P六、想到哪写到哪的经验之谈(1)本地虚拟内存,最好设置50G以上,部分工作流内存消耗很恐怖。本地显存8G一般只能运行Q4-Q6的量化模型,16G能运行fp8的,24G一般可以运行多数满血模型。(2)报错后将后台黑色cmd窗口的报错代码发给AI让它帮忙解决,可以解决大约七到八成的问题,推荐使用google ai studio。(3)模型大小很恐怖,本地空间不足的话记得经常把不用的东西删掉。或者花点小钱转在线平台省心省力。(4)提示词的调教尤其重要,比较省心的办法是让gork4帮你写,毕竟它基本不审查,你给它个比较露骨的例子即可。不过grok对比gemini pro2.5等模型,还是比较蠢的,比较高端的玩法,是把gemini给破限,我一般在sillyTavern里完成,不过这个说起来就更复杂了,而且也没啥人做相关的视频,相关内容都集中在玩AIRP的dc社区里,我就不展开了。(5)qwen系、wan等模型均是支持中文的,且qwen系图像上也可以生成中文,可以多加尝试。
评论 (0)
登录 后参与讨论。
还没有评论,来抢沙发吧。