猫眼影戏
猫眼影戏
尤西萨里德
手机审查
猫眼影戏记者 王甲 报道Q8X2R7L1T4J5M9B6W3
闻乐 发自 凹非寺量子位 | 公众号 QbitAI
256K文本预加载提速超50%,还解锁了1M上下文窗口。
美团龙猫LongCat系列新年出招,宣布全新希罕注重力机制LoZA(LongCat ZigZag Attention)
新手艺集中火力,重点解决长文本使命的明确、算力难题。
相比于LongCat系列之前的全注重力MLA机制,LoZA只改了一半的焦点?。
但模子长文本能力从256K扩展到1M,解码速率还快了不少。
甚至比同类型的Qwen-3模子体现还要好。
接下来看详细计划。
怎样做到 “只算要害部分” ?
全注重力机制的算力瓶颈在于平方级的盘算重漂后O (L?),这导致模子在处置惩罚长文本使命时对显卡要求高,还会泛起推理延迟问题。
LoZA的焦点思绪是专注于处置惩罚主要的内容,不主要的部分少花实力。
作为LongCat系列的焦点手艺升级,LoZA主要是在原来的MLA机制上做刷新。
详细分两步。
首先,给模子里的多头潜在注重力?镸LA做一个全局“筛查”,找出哪些?榭梢员凰⑿。
在原来的MLA架构中,每个MLA?槎际谴χ贸头W⒅亓Φ慕沟愕ノ,现在的新计划是给每个?榕湟桓隹裳叭ㄖ卅。
α值越高,说明该?槎钊⒅亓ε趟阍揭,一旦简化就容易丢性能;α值越低就意味着?榈目商婊恍郧,即便换成更轻量的盘算方法,对整体的明确能力影响也不大。
在训练历程中,团队冻结模子其他参数,只更新α的梯度,通过这种专门的校准训练让模子自主学习α值,然后按α值从小到大排序,找出那些希罕化后不影响性能的MLA?,也就是后续的优化目的。
随后,将找出的50%低性能?榛怀筛嵊牧魇较:弊⒅亓SA
这样就形成了一种交织结构,团队将这种结构称为ZigZag
SSA的盘算重漂后是线性的O (L·S)(S为希罕窗口巨细,牢靠为1024Token),远低于全注重力的O (L?)。
以是这种交织结构让模子既不会由于太过简化而变笨,又能把盘算重漂后降到线性级别,省不少算力。
为了让模子在关注局部细节的基础上不忽略整体逻辑,LoZA还设计了一个1024Token希罕窗口
每个窗口里有1个认真抓整体关联的“全局块”和7个认真盯周围内容的“局部块”,单块巨细为128Token。
这样的刷新也不需要重新训练,在中期训练阶段就能完成,本钱也较量低。
从测试数据来看,LoZA的体现也不错,主要是“更快”的同时“没变笨”
速率上,要是处置惩罚128K上下文,解码速率直接比原来快10倍;
256K上下文,模子预加载(读文本历程)速率快了50%,后续解码阶段天生内容时还能省30%的算力,相当于同样的硬件,现在能同时处置惩罚两倍多的长文本使命。
这也让LongCat-Flash-Exp解锁了1M上下文窗口。
性能上,LoZA也没由于简化而缩水。
处置惩罚回覆问题、写代码这类一样平常使命时,和原版LongCat-Flash持平;处置惩罚长文本使命时,体现反而更好。
好比在MRCR测试里,反超了同样能处置惩罚1M长文本的Qwen-3模子,还更稳固。
接下来,团队还妄想让LoZA支持动态希罕比例
随笔本场景自动多用全注重力包管精度,长文本场景自动增添希罕?樘嵘,甚至适配多模态模子处置惩罚长视频、长图文内容。
好一个新年新气象!
论文地点:https://www.alphaxiv.org/abs/2512.23966
— 完 —
??时势1:日本韩国特级黄色视频
??01月18日,闫赞成:从火场“逆行者”到生活守护者,
雷侯大吼,全身毛发倒竖,电芒万道,整小我私家化成了一个球状闪电,耀眼无比,释放出大宗的电光,惊人之极,将那石山都震的崩开了。
,国产女色爽视频免费。??01月18日,大熊猫“福宝”正式公开亮相,
小孤山镇的祭灵只管强烈对抗,符文交织,但终究照旧被这头金毛狮子拍碎了,溅起一片绚烂的血,被凶兽一口吞掉。
,久久精品国产精品国产精品,国产福利一区二区,午夜男女爽爽爽视频免费观看。??时势2:91蝌蚪91 九色
??01月18日,【台青在大陆】何冠奕:山水城林的南京很宜居,
党的xx届三中全会以后,天下各地区、各行业都已进入了加速生长的要害时期,机缘和挑战并存。加速生长成为解决生长历程中矛盾和问题的基础出路。解放头脑、加速生长已成为全社会的共识,医疗卫生事情者要增强加速生长的责任感和紧迫感,爱岗敬业,团结拼搏,为提高医疗卫生效劳质量,知足人民需求,提高全县人民康健水平,为率先实现小康社会和县域经济社会的加速生长施展起劲作用。
,揉我胸 啊 嗯出奶了在线观看,足疗店按摩的18毛片,日韩国产欧美在线一区二区三区。??01月18日,广西壮族自治区人大常委会原党组副书记、副主任张秀隆严重违纪违法被开除党籍,
坚持德育为首,突出教书育人。进一步突出德育职位,强化德育功效,起劲刷新德育方法,落实德育事情步伐,提高德育事情水平。从基础抓起,从学生一样平常行为规范教育抓起,从作育优异的学习品质抓起。通过教育,使行为规范成为学生的自觉行为、自刊行为。
,草棚国产精品cao81,性激烈的欧美三级视频,人人摸人人摸人人干人人操。??时势3:散兵拿黄瓜x自己污水喷口
??01月18日,西藏日报联合5家党报特别策划——代表委员话援藏:金色哈达跨越山海·30年印记,
好长时间,她神色阴晴未必,盯着那无邪纯净的小婴儿看了又看,眸子闪过一抹戾气,此后转头嘱咐儿子,道:“不要告诉任何人!”
,欧美一区二区视频在线资源,成人重口猎奇专区,jizzjizz日本视频。??01月18日,新疆阿克苏地区乌什县发生7.1级地震:已出现房屋倒塌情况 一被压儿童成功获救,
高空中,大风咆哮,一只巨鸟在山林中投下大片的阴影,极速俯冲而来,全身流动青色冷光,凶气惊人。
,欧美性情大片,被操视频国外精品,五月视频射。??时势4:好爽好湿好大好疼视频
??01月18日,洋主播过“五一”:坐车5小时,探访“00后”台胞的海边露营地!,
再次是“育好人”。授课西席不但有教书的责任,同样有育人的责任,我们遇到难题,不要容易推给班主任,我们的课堂教学,我们教的那一门学科,那是我们自己的事。
,亚洲嫩草,欧美黄色高清,老妇网站。??01月18日,横琴印发文旅产业发展扶持办法申报指南,
突然,原始山林深处,苦闷的咆哮声传来,震的群山都在摇动,巨石滚落,压折许多参天古树,如山洪爆发一样平常。
,五月天色色图,九九九在线视频精品,一级黄色网站视频录像。责编:金培华
审核:哥哥查希尔
责编:谢成龙
Copyright (C) 2001- dzwww.com. All Rights Reserved
新闻信息效劳允许证 - 音像制品出书允许证 - 广播电视节目制作谋划允许证 - 网络视听允许证 - 网络文化谋划允许证
山东省互联网传媒集团主理 联系电话:0531-85193202 违法不良信息举报电话:0531-85196540
Copyright (C) 2001- Dzwww 鲁ICP备09023866号-1