猫眼影戏
猫眼影戏
黄伟夫
手机审查
猫眼影戏记者 林敏 报道Q8X2R7L1T4J5M9B6W3
梦瑶 发自 凹非寺量子位 | 公众号 QbitAI
太香了太香了,妥妥完爆ChatGPT和Nano Banana!
刚刚,ViT焦点作者、Meta超等智能团队成员Lucas Beyer连发三条帖子,怒赞通义千问不久前宣布的开源模子Qwen—Image—Layered。
在他看来,这才是图像天生的准确翻开方法~
他还顺便自补了一句:这个模子偏向自己着实也想做来着,只是太忙,一直没来得及下手……(笑)
真话实说,Qwen—Image—Layered模子确实纷歧般,由于它可以让我们真正实现ps级别的拆图自由。
也就是说现在图片元素也支持细腻化修改了:
连网友们看了模子效果后都不禁叹息:咋有种开源PhotoShop的感受,amazing啊~
以是,这套让Lucas Beyer重复点赞的模子究竟强在哪儿,咱一起来看!
图片也能像PS一样拆拆拆了
若是说Nano Banana手艺点在生图,那Qwen—Image—Layered模子则厉害在:《拆图》。
相信各人都有过类似的履历,我们平时用大模子生图时总会碰的到一个抓狂问题,那就是图片天生so easy,细节修改so抓狂。。
AI生出来的图片里,经;嵊幸恍┬∠附诓惶轿,但我们又没法只改局部,只能整张丢回模子重新天生,效果往往还不如上一版…
Qwen—Image—Layered模子的焦点能力,就是专治「一图定生死」这事儿的。
它能将一张通俗图片剖析成多个包括透明度信息的RGBA疏散图层,实现真正意义上的图片素材的可编辑性。
光说看法有点笼统,咱直接看例子~
在官计划例中,一张完整图片输入之后,模子会自动把画面拆成6个包括差别元素的图层,配景是配景,人物是人物,装饰是装饰,互不滋扰。
看到这儿各人是不是突然感受,这个很是适适用在海报制作等细节较多的图片上??(雀实
可是Qwen—Image—Layered模子能做的还不止只是疏散图层这么简朴,我们还可以对图层举行二次编辑修改。
好比最基础的:改配景,不动主体。
只替换配景图层的颜色,一张橙色配景的海报,瞬间就能换成蓝色版本:
再好比,直接换主体。
坚持构图稳固,把原图里的长发女孩,换成短发女孩,险些看不出拼接修改痕迹:
再来看下面这个——文字编辑。
我们可以只修改图片中的局部文字,哪怕第一次天生的文字有幻觉问题也不怕了:
除了基本的替换编辑功效外,Qwen—Image—Layered模子还支持调解元素的巨细、删除不想要的元素等等。
例如像这样,我们可以删除掉画面中不想要的元素工具,只保存自己想留的画面元素:
又或者在不拉伸、不失真的条件下,轻松调解元素的巨细比例,着实有点像PS里的自由缩放功效:
值得注重的是,Qwen—Image—Layered模子分层不限于牢靠的图层数目,支持可变层剖析,例如我们可以凭证需要将图像剖析为3层或8层:
这个能力很是适合我们在差别的编辑需求场景下使用,可以凭证我们想局部编辑的元素数目多或少而定。
虽然,若是只是想改文字,差未几两三层就够了,若是修改需求较量多较量重大,多拆几层反而更好操作~
除了适才说的这些,模子还支持在已剖析的图层基础上做进一步剖析,进而实现无限剖析,听上去很像无限套娃…
像下面这位网友,用Qwen—Image—Layered把人物元素举行一次性分层处置惩罚,最后甚至可以一起拆到只剩下一个线稿层:
再来看这位网友,原自己物和配景完全糊在一起的一张图,被模子直接拆成了主体和配景两个自力元素:
简朴说就是:只要画面里不止一个元素,它就能拆、还能一直拆……
拆图的本事来自于扩散模子
有朋侪看到这儿该问了,小小模子背后能有这PS一样平常的能力,用的是啥神奇邪术?
不藏着掖着,Qwen—Image—Layered的焦点手艺,实质上是一套端到端的「扩散模子」。
它并不是用来天生图片的那种扩散模子,而是专门为「拆图片」这件事设计的——
模子直接输入一张完整的RGB照片,通过扩散历程,一步步展望出多个带透明度信息的RGBA图层。
这里有一个绕不开的条件是:
我们平时看到的图片着实只有RGB三个通道,但真正的图层编辑,离不开Alpha(透明度)通道。
为此,Qwen—Image—Layered专门设计了一套四通道的RGBA-VAE,把RGB输入和RGBA输出,统一压缩到统一个隐藏空间中:
详细来说,当输入是一张通俗RGB图片时,模子会自动把Alpha通道补成1(完全不透明),在初始化阶段还会智慧地复用预训练参数,阻止在透明度建模时蜕化。
这样一来,模子从一最先就「懂透明」,差别图层也就不会被混在一起。
并且在结构上模子也不是死板拆层,它的焦点Transformer—VLD-MMDiT会凭证图片重漂后,自动决议需要拆成几多层。
为了阻止前一层把后一层盖住的问题,模子还加了一套Layer3D RoPE(三维位置编码),简朴说就是给差别图层打上明确的层级标签,让模子在空间温顺序上都分得清晰~
还不止云云,在隐藏空间里中,模子能够被逐步「指导」去学会:哪些像素该属于哪一层、哪些区域需要保存透明度、哪些内容应该被疏散开来。
这样一来哪怕图层再多对模子来说也都是小case了~
并且在训练战略上模子也不是从零教的,而是基于Qwen-Image预训练天生模子逐步升级:
第一阶段让模子学会文本天生单RGBA图层,第二阶段让模子学会扩展到多图层合成,第三阶段让模子真正学会从图片反向拆解多图层。
每阶段几百K步训练,加上重修损失和感知损失,确保语义疏散清洁、不冗余。
这样一来利益很直接,以前要领(如LayerD)要递归抠远景再补配景,容易积累过失,或者用支解+修复,遮挡区补欠好。
Qwen—Image—Layered模子直接实现端到端天生完整RGBA层,阻止这些问题,尤其善于重大遮挡、半透明和文字。
相较于Nano Banana的“一次抽图定生死”,Qwen—Image—Layered的拆图能力能让Lucas Beyer这么喜欢,也就不希奇了…
现在模子已经开源,感兴趣的朋侪可以试试~
github开源地点:https://github.com/QwenLM/Qwen-Image-Layered
??时势1:美女裙子底部偷拍秘
??12月31日,(新春走基层)探访重庆新建规模最大高铁站:金属屋面施工忙,
同砚们,你们知道电话号码119是做什么的吗?对,是火灾电话。也就是当爆发火灾的时间,我们可以拨打119电话,消防队员就会以最快的速率来资助灭火。
,又粗又大又长又硬又黄免费视频。??12月31日,广东去年新收一审行政案件和行政非诉审查案件“双下降”,
“小不点来我们云天宫吧,到时间我们带你去看雪海,喝最香醇的兽奶。”两个小女人启齿,冲小石昊眨动眼睛。
,色哟哟AV网站,一级av一片,夜色综合。??时势2:色呦呦在线国产亚洲
??12月31日,海南离岛免税政策实施13年 累计购物金额超2200亿元,
“是啊,幽雨,石国的雨族可是想求你手中这最后一块符牌呢,为他们的一个十分强盛的子嗣铺路,欲进补天阁。你就不再思量一下了?”中年人性。
,午夜在线一级,在线观看黄AⅤ免费无毒网站,久久成年视频。??12月31日,2023年安徽省粮食产量830.16亿斤 再创新高,
场景再变,漂亮的大湖瞬间模糊。
,人人操人人搞人人摸人与马,少妇水多A片太爽了,九九黄色 在线播放。??时势3:女帝裸妆网站
??12月31日,“龙的传人”书画艺术交流展台北开幕 ,
事实上,各地都云云,这是一个普遍的现状,就是石村与狈村相隔几十几里,两族人数月也不会碰上一次面。
,国产精品秘 入口水果派,欧美自拍偷拍首页,美女黄色视频久久。??12月31日,中外诗人角逐“放翁杯” 致敬爱国诗人陆游诞辰899周年, 虽然,泽连斯基绕飞半个地球去请小马科斯,也由于除了中国之外,尚有一些新兴市场国家中的大国不去。这时间,他希望菲律宾前往,也无非是体现在西欧以外,有一些更多装点此次聚会门面的国家出席。,色呦呦入口免费观看,亚毛基地,001board第一原创征文免费下载。
??时势4:欧美丰满熟妇色XXXXX
??12月31日,前三季度,我国水运固定资产投资超1500亿元 高铁时代,我们为何还要修运河?,
晚上好!
,亚洲AV无码秘 蜜桃希岛爱理,欧美性爱潮喷,www.800. av。??12月31日,欧盟拟对中国电动汽车征收临时反补贴税 欧洲多国反对,
一位在可可西里索南达吉站加入藏羚羊;ね氲淖栽刚咴谒娜罩局行聪抡庋欢温睦骸耙惶煲估,我们看到一处被偷猎者洗劫的时势,成百只被剥了皮的藏羚羊的遗体赤裸裸地躺在草地上。我们的车灯晃过。突然,有一只羊从死羊堆中腾空而起,冲着我们的车就奔驰过来。它全身上下已经没有皮了,偷猎分子的枪声只是震晕了它。也就是说,它是被活活剥皮的。我望见它的眼神,很恐慌。有人说:只有通过动物的眼睛,才华在滔滔红尘中看到一丝善良。但现在,这样善良温柔的眼睛里,竟只剩下恐慌。
,精品亚洲,午夜影院性交,黑客破解大白天小俩囗实战。【“港澳台侨大学生国情教育基地”揭牌仪式在贵州省社会主义学院举行】
责编:宗华
审核:阿拉米达
责编:左成慈
Copyright (C) 2001- dzwww.com. All Rights Reserved
新闻信息效劳允许证 - 音像制品出书允许证 - 广播电视节目制作谋划允许证 - 网络视听允许证 - 网络文化谋划允许证
山东省互联网传媒集团主理 联系电话:0531-85193202 违法不良信息举报电话:0531-85196540
Copyright (C) 2001- Dzwww 鲁ICP备09023866号-1