猫眼影戏
猫眼影戏
邱莉莉
手机审查
猫眼影戏记者 刘冬杰 报道Q8X2R7L1T4J5M9B6W3
闻乐 发自 凹非寺量子位 | 公众号 QbitAI
256K文本预加载提速超50%,还解锁了1M上下文窗口。
美团龙猫LongCat系列新年出招,宣布全新希罕注重力机制LoZA(LongCat ZigZag Attention)
新手艺集中火力,重点解决长文本使命的明确、算力难题。
相比于LongCat系列之前的全注重力MLA机制,LoZA只改了一半的焦点?。
但模子长文本能力从256K扩展到1M,解码速率还快了不少。
甚至比同类型的Qwen-3模子体现还要好。
接下来看详细计划。
怎样做到 “只算要害部分” ?
全注重力机制的算力瓶颈在于平方级的盘算重漂后O (L?),这导致模子在处置惩罚长文本使命时对显卡要求高,还会泛起推理延迟问题。
LoZA的焦点思绪是专注于处置惩罚主要的内容,不主要的部分少花实力。
作为LongCat系列的焦点手艺升级,LoZA主要是在原来的MLA机制上做刷新。
详细分两步。
首先,给模子里的多头潜在注重力?镸LA做一个全局“筛查”,找出哪些?榭梢员凰⑿。
在原来的MLA架构中,每个MLA?槎际谴χ贸头W⒅亓Φ慕沟愕ノ,现在的新计划是给每个?榕湟桓隹裳叭ㄖ卅。
α值越高,说明该?槎钊⒅亓ε趟阍揭,一旦简化就容易丢性能;α值越低就意味着?榈目商婊恍郧,即便换成更轻量的盘算方法,对整体的明确能力影响也不大。
在训练历程中,团队冻结模子其他参数,只更新α的梯度,通过这种专门的校准训练让模子自主学习α值,然后按α值从小到大排序,找出那些希罕化后不影响性能的MLA?,也就是后续的优化目的。
随后,将找出的50%低性能?榛怀筛嵊牧魇较:弊⒅亓SA
这样就形成了一种交织结构,团队将这种结构称为ZigZag
SSA的盘算重漂后是线性的O (L·S)(S为希罕窗口巨细,牢靠为1024Token),远低于全注重力的O (L?)。
以是这种交织结构让模子既不会由于太过简化而变笨,又能把盘算重漂后降到线性级别,省不少算力。
为了让模子在关注局部细节的基础上不忽略整体逻辑,LoZA还设计了一个1024Token希罕窗口
每个窗口里有1个认真抓整体关联的“全局块”和7个认真盯周围内容的“局部块”,单块巨细为128Token。
这样的刷新也不需要重新训练,在中期训练阶段就能完成,本钱也较量低。
从测试数据来看,LoZA的体现也不错,主要是“更快”的同时“没变笨”
速率上,要是处置惩罚128K上下文,解码速率直接比原来快10倍;
256K上下文,模子预加载(读文本历程)速率快了50%,后续解码阶段天生内容时还能省30%的算力,相当于同样的硬件,现在能同时处置惩罚两倍多的长文本使命。
这也让LongCat-Flash-Exp解锁了1M上下文窗口。
性能上,LoZA也没由于简化而缩水。
处置惩罚回覆问题、写代码这类一样平常使命时,和原版LongCat-Flash持平;处置惩罚长文本使命时,体现反而更好。
好比在MRCR测试里,反超了同样能处置惩罚1M长文本的Qwen-3模子,还更稳固。
接下来,团队还妄想让LoZA支持动态希罕比例
随笔本场景自动多用全注重力包管精度,长文本场景自动增添希罕?樘嵘,甚至适配多模态模子处置惩罚长视频、长图文内容。
好一个新年新气象!
论文地点:https://www.alphaxiv.org/abs/2512.23966
— 完 —
??时势1:女人被弄高潮的免费视频
??01月18日,香港启德体育园首次试业运行顺畅,
直到这一刻清静才被突破,诸强从惊悚中逐步回过神来,带着敬畏,带着恐惧,不敢正视那株柳树
,国产呦交精品视频。??01月18日,2023年四川农产品质量安全例行监测合格率为99.4%, “我们重视瑞士为准备和会所做事情,多次向瑞方提出建设性意见,瑞士方面临此一直予以起劲评价和谢谢。当今天下种种聚会许多,能否加入,怎么加入,中方将凭证自身态度自主决议。”这是王毅的原话。,久久久线视频极,色哟哟视频在线观看免费播放,91特黄大片子。
??时势2:男生自慰Gay网站
??01月18日,每天售出200万本!图书市场搭上抖音电商“快车”,
鼎壁绚烂,先民的祭祀再次传出,无比弘大,远古凶禽猛兽霸烈,诸神模糊,皆洒出绚烂,神秘莫测。
,91网站官方版,一级特黄AAA免费视频,国产 拗女V888。??01月18日,大湾区定有大发展,
现在其子一样的强势绝顶,一身实力震惊皇都,老辈人物都不是敌手,宛若一尊黄金战神般,怎不令人心颤。
,纳西达乳液狂飙,9国产在线观看,都有什么免费的黄色网站。??时势3:一级A片黄片毛片
??01月18日,2024东亚文化之都青少年宁波交流活动收官 共绘“海丝繁花”,
可是现在却被小不点两脚踏翻,踩在了脚底,这着实惊掉了一地下巴,这个看起来憨憨的孩子,竟然这般强盛?!
,美女18禁止黄的网站,花火脚心lvk,日韩免费色视。??01月18日,特稿|“比天空更宽阔的胸怀”——习近平主席与法国文化,
高一的学弟学妹,军训场上的飒爽英姿告诉我,你们已离别无知无畏的懵懂少年,成为激情满怀、斗志高昂的至心英雄;演武场上的声声呐喊,正如你们的人生畅想,恰似排山倒海,定可石破天惊。走进一中,你们选择了勤勉与斗争,也就选择了希望与收获;走进一中,你们选择了纪律与约束,也就选择了理智与自由;走进一中,你们选择了痛苦和艰难,也就选择了练达与成熟;走进一中,你们选择了拼搏与逾越,也就选择了绚烂与乐成。一中是你们梦圆的场合,也必将是你们明智而无悔的选择。
,免费观看一级毛片A片在线,欧美性爱zozozo xxxx,性❌❌❌无尽❌❌❌91。??时势4:人人se
??01月18日,新疆阿克苏地区乌什县发生7.1级地震 新疆多地震感强烈,
4.保管物品。角逐时代,班级休息处的的物品,班级物品,特殊是珍贵物品要安排职员看好,管好。
,澳门精品一区视频,国产一区二区丰满熟女,拳交性爱app。??01月18日,高考后,如何进行心理调适|科普时间,
第四,创设一个情形:文明有序
,国产精品原创剧情在线观看网,免费看AV在线网站网址手机,视频可以看黄片。责编:卢宁州
审核:李桦
责编:李启诚
Copyright (C) 2001- dzwww.com. All Rights Reserved
新闻信息效劳允许证 - 音像制品出书允许证 - 广播电视节目制作谋划允许证 - 网络视听允许证 - 网络文化谋划允许证
山东省互联网传媒集团主理 联系电话:0531-85193202 违法不良信息举报电话:0531-85196540
Copyright (C) 2001- Dzwww 鲁ICP备09023866号-1