猫眼影戏
猫眼影戏
何文田
手机审查
猫眼影戏记者 颜伟 报道Q8X2R7L1T4J5M9B6W3
这项由Meta AI研究团队与伦敦国王学院联合完成的研究于2024年12月揭晓,研究编号为arXiv:2512.06905v1。感兴趣的读者可以通过该编号在学术数据库中盘问完整论文。
研究团队面临的问题着实很容易明确。当你想要制作一段视频,好比让梵高泛起在咖啡馆里喝咖啡,或者让《戴珍珠耳环的少女》这幅名画中的女孩在窗前变换姿势,现有的手艺需要大宗特殊准备的训练质料。这些质料必需包括参考图像、对应视频和文字形貌三者的完善组合,就像需要同时拥有食谱、制作历程视频和制品照片才华学会做菜一样。
问题在于,制作这样的训练质料本钱极高,就像要为每道菜都准备完整的教学套餐一样难题。研究团队发明,现有要领需要构建包括参考图像-视频-文本三元组的专门数据集,这个历程涉及重大的数据网络、标注、聚类和筛选流程,不但腾贵并且难以大规模扩展。
Meta AI的研究团队提出了一个巧妙的解决计划,他们开发了名为Saber的框架。这个系统的焦点头脑是通过一种"遮罩训练战略"来模拟参考图像到视频的天生历程。就像学习绘画时,先生不需要专门准备每一种参考照片,而是随机遮挡一幅完整画作的某些部分,让学生凭证可见部分推测和重现整幅作品。
Saber在训练历程中会随机选择视频中的某些帧,然后用种种形状的遮罩部分笼罩这些帧,将被遮罩的区域作为"参考图像"。这种要领让模子学会了怎样从部分信息中提取身份特征和外观特征,然后将这些特征融入到天生的视频中。研究团队设计了多种遮罩形状,包括椭圆、傅里叶黑点、凸多边形和凹多边形等,确保训练的多样性。
为了阻止常见的"复制粘贴"问题,研究团队还引入了遮罩增强手艺。这就像在制作拼图时,不是简朴地把原片断直接放回原位,而是对片断举行旋转、缩放、翻转等变换后再安排。这样可以让天生的视频越发自然,阻止泛起生硬的拼接痕迹。
在模子设计方面,Saber接纳了一种巧妙的注重力机制。系统将参考图像和目的视频帧在特征空间中毗连,通过自注重力机制让视频部分和参考部分相互交互,同时通过交织注重力机制连系文本提醒的语义指导。这种设计确保了参考图像的身份信息能够准确转达到天生的视频中,同时坚持与文本形貌的一致性。
研究团队在OpenS2V-Eval基准测试上举行了周全评估。这个测试包括180个提醒,涵盖简单参考和多重参考等七个种别。效果显示,Saber在总体评分上抵达了57.91%,凌驾了需要专门训练数据的要领。特殊是在NexusScore这个最能反应参考到视频性能的指标上,Saber取得了47.22%的效果,比其他要领横跨显著幅度。
值得注重的是,Saber展现出了优异的泛化能力。它不但能处置惩罚差别数目的参考图像,还能凭证遮罩比例的调解来顺应远景主体或配景场景的差别需求。当需要坚持远景角色时,系统使用较小的遮罩比例,而需要坚持配景情形时,则使用较大的遮罩比例。
研究团队还发明了Saber的一些有趣能力。好比,当提供统一个主体的多个视角作为参考时,系统能够准确识别这些图像形貌的是统一个工具,并将多视角的外观特征融合到一个连贯的视频主体中。别的,通过改变文本形貌中的主体信息,好比将"穿蓝色衬衫的男子"改为"穿玄色背心的男子",Saber能够准确地调解天生视频中对应主体的外观。
在现实应用中,Saber的推理历程相当直观。关于每个参考图像,系统首先使用预训练的物体支解器提取远景主体区域遮罩。若是用户希望参考图像提供配景场景而非远景主体,则跳过支解办法,使用完整的未遮罩图像。然后,系统将参考图像标准化并对被遮罩的配景区域填充零值,最后通过调解巨细和填充操作处置惩罚到目的视频尺寸。
研究团队举行了详细的消融研究来验证各个组件的主要性。他们发明,相比于在专门的参考到视频数据集上训练,遮罩训练战略能够提升1.67%的总体评分。简单类型遮罩的体现显着不如多种类型遮罩的组合,说明遮罩多样性关于泛化能力至关主要。牢靠远景面积比例会导致6.18%的性能下降,证实遮罩转变的主要性。
遮罩增强手艺的效果也很显着。在没有增强的情形下,模子会泛起严重的复制粘贴伪影,直接将参考内容原样安排到天生视频中。而应用了旋转、缩放、翻转和剪切等增强后,天生的视频显得越发自然和连贯。
注重力遮罩机制同样要害。若是移除注重力遮罩,模子在提取参考图像主体时会泛起显着的灰色伪影,无法准确疏散主体和配景。而使用注重力遮罩后,这些问题获得了有用解决,天生的视频质量显著提升。
与现有要领相比,Saber在多个场景中都展现出了优势。在简单人物参科场景中,竞争要领要么无法将参考主体嵌入天生视频,要么保存复制粘贴问题,而Saber能够天生一致且切合文本形貌的面部身份。在简单物体参科场景中,Saber准确捕获了物体的形状和外观特征。在多重参科场景中,Saber能够同时整合多个主体,而其他要领往往只能处置惩罚其中一个或泛起身份重复。
这项研究的意义在于为参考到视频天生开发了新的生长路径。通过消除对腾贵专门数据集的依赖,Saber使得这项手艺能够使用大规模的视频-文本数据举行训练,这为未来的规;さ于嘶。同时,Saber的零样本特征意味着它能够处置惩罚训练中未见过的主体种别,具有更强的适用性。
虽然,这项手艺也保存一定的局限性。当参考图像数目显著增添时,好比抵达12张,天生可能会泛起剖析征象,导致片断化的组合而缺乏连贯明确。别的,在重大提醒下的细腻运动控制和时间一致性仍然是挑战。
说究竟,Saber代表了视频天外行艺生长的一个主要里程碑。它证实晰通过巧妙的训练战略设计,可以在不增添数据网络本钱的情形下实现高质量的参考到视频天生。这种要领不但在手艺上具有立异性,在现实应用中也更具可行性,为个性化视频天生、定制化故事讲述和虚拟化身等应用场景提供了新的可能性。
Q&A
Q1:Saber是什么样的手艺?
A:Saber是Meta AI开发的一种新型视频天外行艺,它能够凭证参考图像和文字形貌天生坚持角色身份的视频。与古板要领差别,Saber不需要专门的训练数据集,而是通过"遮罩训练"战略来学习怎样从部分信息中提取特征并天生完整视频。
Q2:遮罩训练战略是怎样事情的?
A:遮罩训练就像让AI学习拼图游戏一样。系统随机选择视频中的某些帧,用种种形状的遮罩笼罩部分区域,然后学习怎样凭证可见部分推测和重现整个视频。这种要领让模子学会从参考图像中提取身份特征,并将这些特征自然地融入到新天生的视频中。
Q3:Saber相比其他视频天生要领有什么优势?
A:Saber最大的优势是不需要腾贵的专门训练数据,却能在测试中逾越那些需要专门数据的要领。它还能无邪处置惩罚差别数目的参考图像,支持多主体和多视角输入,并且能够凭证文字形貌准确调解天生内容,阻止了常见的复制粘贴问题。
??时势1:高新黄色大片
??01月08日,未来三天广东南部仍有较强降雨 有暴雨灾害中高风险,
“竟然需要几个大部族齐动,更有四富家主亲至,这个山村认真不简朴。 辈簧偃嗽尢。
,www.免费Av。??01月08日,道中华丨体验傣族烤奶茶,
石子陵提着战矛,如一头飞天神魔般横空而来,一声长啸,体内一头重大的远古凶兽浮现,随着他一起杀至。
,又黄又硬又粗又大免费无遮挡,狼友视频在线一级,一个色综合色。??时势2:17c男桶女唧唧
??01月08日,冬日里的新疆校园足球队:在冰天雪地里点燃“足球梦”,
5.卫生整齐。运动会时代,每个班级必需建设一支卫生自愿者效劳队,一是包管本班大本营周边的卫生;二是学校操场、角逐点等卫生的保洁,包管校园无纸屑、无垃圾。同时,要求运动会时代,只能泛起矿泉水,不允许带零食(除运发动增补能量外)入校,特殊是口香糖,一经发明扣班级的精神文明分数。
,麻酥酥西施黄瓜,中文字幕精品视频一区,淫荡妈妈口交黑人阳具视频。??01月08日,全国台联第三十届台胞青年冬令营海外营开营,
“呜呜……还没睡呢。”一群孩子惨兮兮的说道。不过他们并不疲困,反而精神兴旺,不然也不至于在这里泡着了。
,人人操人人人人插人人干人人,菁草免费,自拍偷拍 色综合。??时势3:铁粉空间网页版资源免费在线观看
??01月08日,“艺术设计跨市域协同创新联盟”在沪成立 培养高素质文创人才,
问题不大。 凭证支付宝的划定,一样平常情形下,逾期一天后就会最先催收。催收的方法主要包括短信、电话、邮件等多种形式。支付宝会通过这些方法提醒用户尽快还款,并会对逾期用户举行一定的处分,如增添利息、降低信用品级等。随着移动支付的普及,支付宝已经成为了人们生涯中不可或缺的一部分。然而,随之而来的逾期问题也引...
??01月08日,8月6日“农产品批发价格200指数”比昨天上升0.95个点,
首先,要认清周边地区的生长态势。从地理情形来说,与我市相邻的周边都会都位于豫鄂皖接壤处,都是三省的边沿化地区;从经济生长情形看,同属于欠蓬勃地区,经济现状基内情近,都是农业大市;从生长基础来讲,已往的条件平分秋色,都是在年前后撤地设市的。因此,我们周边市的经济社会生长情形大致相同,统一水平,统一起跑线。可是从最近我们相识的情形看,爆发了新的转变,真是不看不知道,不比不知晓,一看一比吓一跳,周边几个都会生长速率惊人,特殊是城镇化建设的效果特殊显著,可以说是日新月异,面目大变。一是加速城镇化历程的愿望特殊强烈。面临天下各地城镇化快速生长的现实,我们这些欠蓬勃的中西部地区,都注重于通过加速城镇化发动和增进经济社会生长,加速城镇化历程的愿望和要求尤为强烈和迫切,正在千方百战略求城镇化快速生长。位居我市之西的市,坚持市、县、镇三级联动,形成四城联创,加速推进城镇化康健协调生长。该市明确提出,“”时代的斗争目的是把市中心城区建设成为鄂豫陕毗邻地区特大中心都会,全市城镇化率每年提高个百分点,县以上建制镇区常住生齿每年增添,到年,全市城镇化率抵达,中心城区生齿抵达万人,城区面积抵达平方公里,并向远期万生齿、平方公里的目的起劲。这几年坚持区域性中心都会、县城、小城镇同步生长、“三头并进”的城镇化生长目的,力争在今年底,使城镇生齿抵达万人,城镇化水平抵达。紧邻我市东部的省市实验非平衡生长战略,优先生长重点中心城镇和建制镇,以钻营实现城镇化跨越式生长,力争到年城镇生齿抵达万,城镇化率抵达。二是推进城镇化建设的力度超常有力。相邻各市都把加速城镇化历程作为生长经济的突破口和赢得新一轮区域竞争优势的重大战略来抓,纷纷接纳超通例步伐,增强向导实力,实验优惠政策,加大资金投入,强力推进生长。市把提高都会化水平,扩大都会规模,增强都会发动辐射能力,作为全市事情的重中之重,去年一年投入亿多元用于城镇建设,这相当已往几年城建投入的总和,投入力度显着加大。市也不吝重金加大城镇化建设的资金投入,近三年该市用于城镇基础设施的资金达亿元之多,全市城镇面目大为改观。市通过深入开展建设星级城镇活动,加速农村生齿的转移,使小城镇获得快速生长,近年全市城镇生齿增添万人。年以来,市县累计投资城镇基础设施建设近亿元,使城区面积抵达平方公里,常住生齿万多人,占全县总生齿的,全县城镇化率抵达。三是城镇化水平显著提升。近几年,周边几个都会城镇化的程序显着加速,城镇化率每年都以个百分点以上的速率递增。阻止年底,城镇化率水平都在以上,最高是省市抵达,其次是我省市抵达,我市为。预计到今年底有些都会城镇化率将突破。城镇规模迅速扩张。周边各市都接纳建设新区等步伐,拉大都会框架。近年来,省县城镇建成区面积扩大了一倍,转移了近万农民进城进镇就业和生涯。年底,周边个省辖市的中心城区生齿均在万人以上,面积平方公里以上。其中抵达万人以上的有市、市,万以上生齿的有市、市、市;万以上生齿的有市、市。市中心城区生齿最多,市区生齿已达万人;中心城区建成区面积最大,抵达平方公里。城镇综合效劳功效增强。市中心城区垃圾处置惩罚率达,供水普及率,燃气普及率,人均公共绿化面积平方米。城镇经济实力大大增强。城镇化快速生长,对经济拉行动用愈来愈显着。今年元至九月份,周边都会经济总量大幅攀升,其中,市抵达亿元,市抵达亿元,市抵达亿元,市抵达亿元,划分为全省第位、第位、第位和第位,我市国民生产总值为亿元,居全省第位。
,天天天欲色欲色www,人人爱人人操人人搞,色视频人妖专区。??时势4:99热在线观看
??01月08日,通用电气(GE)医疗在天津启动创新研发中心建设,
他一拳砸出,霹雳一声,前方一头巨兽连忙惨叫,整具身体都炸开了,血肉横飞,碎骨四溅,时势极其血腥。
,十七岁免费观看完整版,三角洲行动黄漫,七七久久桃花综合。??01月08日,推动经济实现良性循环 今年扩内需如何发力?,
“不可,太危险了,一旦惊动它,我大都难以活命。”小不点止步。
?第一百六十八章 得药,小萝吃狙全免费播放,日本免费在线,久久久久国产一级A片。责编:赵康华
审核:杜修妻
责编:亚历山德罗尼
Copyright (C) 2001- Dzwww 鲁ICP备09023866号-1