猫眼影戏
猫眼影戏
文青
手机审查
猫眼影戏记者 郑英伯 报道Q8X2R7L1T4J5M9B6W3
闻乐 发自 凹非寺量子位 | 公众号 QbitAI
256K文本预加载提速超50%,还解锁了1M上下文窗口。
美团龙猫LongCat系列新年出招,宣布全新希罕注重力机制LoZA(LongCat ZigZag Attention)
新手艺集中火力,重点解决长文本使命的明确、算力难题。
相比于LongCat系列之前的全注重力MLA机制,LoZA只改了一半的焦点?。
但模子长文本能力从256K扩展到1M,解码速率还快了不少。
甚至比同类型的Qwen-3模子体现还要好。
接下来看详细计划。
怎样做到 “只算要害部分” ?
全注重力机制的算力瓶颈在于平方级的盘算重漂后O (L?),这导致模子在处置惩罚长文本使命时对显卡要求高,还会泛起推理延迟问题。
LoZA的焦点思绪是专注于处置惩罚主要的内容,不主要的部分少花实力。
作为LongCat系列的焦点手艺升级,LoZA主要是在原来的MLA机制上做刷新。
详细分两步。
首先,给模子里的多头潜在注重力?镸LA做一个全局“筛查”,找出哪些?榭梢员凰⑿。
在原来的MLA架构中,每个MLA?槎际谴χ贸头W⒅亓Φ慕沟愕ノ,现在的新计划是给每个?榕湟桓隹裳叭ㄖ卅。
α值越高,说明该?槎钊⒅亓ε趟阍揭,一旦简化就容易丢性能;α值越低就意味着?榈目商婊恍郧,即便换成更轻量的盘算方法,对整体的明确能力影响也不大。
在训练历程中,团队冻结模子其他参数,只更新α的梯度,通过这种专门的校准训练让模子自主学习α值,然后按α值从小到大排序,找出那些希罕化后不影响性能的MLA?,也就是后续的优化目的。
随后,将找出的50%低性能?榛怀筛嵊牧魇较:弊⒅亓SA
这样就形成了一种交织结构,团队将这种结构称为ZigZag
SSA的盘算重漂后是线性的O (L·S)(S为希罕窗口巨细,牢靠为1024Token),远低于全注重力的O (L?)。
以是这种交织结构让模子既不会由于太过简化而变笨,又能把盘算重漂后降到线性级别,省不少算力。
为了让模子在关注局部细节的基础上不忽略整体逻辑,LoZA还设计了一个1024Token希罕窗口
每个窗口里有1个认真抓整体关联的“全局块”和7个认真盯周围内容的“局部块”,单块巨细为128Token。
这样的刷新也不需要重新训练,在中期训练阶段就能完成,本钱也较量低。
从测试数据来看,LoZA的体现也不错,主要是“更快”的同时“没变笨”
速率上,要是处置惩罚128K上下文,解码速率直接比原来快10倍;
256K上下文,模子预加载(读文本历程)速率快了50%,后续解码阶段天生内容时还能省30%的算力,相当于同样的硬件,现在能同时处置惩罚两倍多的长文本使命。
这也让LongCat-Flash-Exp解锁了1M上下文窗口。
性能上,LoZA也没由于简化而缩水。
处置惩罚回覆问题、写代码这类一样平常使命时,和原版LongCat-Flash持平;处置惩罚长文本使命时,体现反而更好。
好比在MRCR测试里,反超了同样能处置惩罚1M长文本的Qwen-3模子,还更稳固。
接下来,团队还妄想让LoZA支持动态希罕比例
随笔本场景自动多用全注重力包管精度,长文本场景自动增添希罕?樘嵘,甚至适配多模态模子处置惩罚长视频、长图文内容。
好一个新年新气象!
论文地点:https://www.alphaxiv.org/abs/2512.23966
— 完 —
??时势1:A V看
??01月19日,“捏捏乐”让5岁孩子“上头” 是解压治愈还是情绪消费?,
那几头生灵有人形的、有禽类、也有兽类,正在起劲前行,想靠近不老泉,池内金色波纹滔天,太过绚烂,故此只能见到他们的背影轮廓。
,欧美一级在线观看播放。??01月19日,叙利亚反对派武装攻入哈马市 武装人员出现在城市街头,
各人好!离别了炎夏的担心与躁动,迎来了凉爽怡人的秋天;离别了假期的清静与悄然,迎来了充满欢声笑语的校园;离别了属于历史的绚烂,迎来了创立未来绚烂的今天。虽然也迎来了新的希望、新的挑战。
,成年人在线播放视频,在线男人网,日韩性爱第一页。??时势2:亚洲精品ty久久久久久久久久
??01月19日,艺术创作者“抄照片”画作卖出10万 尴尬不是个案,
2、提高冬训活力,还必需顺应时代生长,方法要领上一直融入现代元素,始终占领宣布道育阵地的制高点。除了原有的广播、电视、报纸等古板公共传媒平台以及远程教育网络外,还要用好云媒体、微博微信、网络党课等一批新手艺,拓展冬训笼罩面,提高冬训实效性。这次冬训,我局拟开展冬训在线学习、答题活动,人事科迁就这项事情做详细安排,目的只有一个;保质保量完成学习使命。
,欧美AAAA片中文字幕,亚洲欧美日韩综合在线,永久免费精品。??01月19日,总书记@你来认领家乡特产,
“止。 弊宄で岷,没有让他们连忙下手。
,在线看片无码永久免费Aⅴ动漫,国产av进入,欧美一级做受视频大全免费。??时势3:my53777.com
??01月19日,“网红城市”旅游热 重庆港澳政协委员议“长红”之道,
同砚们,脱离母校,是人生的一个主要驿站,在你们即将脱离熟悉的整体,脱离朝夕相处、至心相待的先生和同砚的时刻,作为校长我真诚祝愿你们:不管你将走向何方,面临新的学习情形,最先新的生涯,一定要有勇于拼搏的顽强毅力、不拍波折的奋进精神,自动顺应、尽快融入,以阳光心态要有微笑面临生涯,相信阳光总在风雨后。
,打屁股的网站,国产精品福利在线一区,白白发布首页。??01月19日,凤凰卫视香港台4月22日起正式在香港TVB免费电视85频道开播,
药劲真的太大了,就地就让他有了显着的感受,四肢百骸像是在被磨炼,全身的淤血尽退,那青一块紫一块的伤迅速好了,体内骨头亦莹鹤发光。
,用各种工具虐弄她小泬,日本少妇aa特黄大片蜜芽,观看一级免费黄色网站。??时势4:国产一精品孕妇在线
??01月19日,备战秋季防火期 西藏林芝森林消防开展徒步拉练活动,
山脉最深处,强烈的大战开启,犹如神话一样平常,那铺天盖地的金色大爪子每一次落下都会抓崩一条山岭。
,国产人人操一区,日本公妇乱视频,调教小男娃的小嫩茎。??01月19日,省卫健委主任,离任一年后被查,
他竟说出了话,声音急促,眸光吓人。
,兽皇videos极品另类仙踪林,色又黄又爽18禁免费网站现观看,又大又粗又长又硬又爽不快。责编:阮晋勇
审核:安德鲁斯
责编:赵世秋
Copyright (C) 2001- dzwww.com. All Rights Reserved
新闻信息效劳允许证 - 音像制品出书允许证 - 广播电视节目制作谋划允许证 - 网络视听允许证 - 网络文化谋划允许证
山东省互联网传媒集团主理 联系电话:0531-85193202 违法不良信息举报电话:0531-85196540
Copyright (C) 2001- Dzwww 鲁ICP备09023866号-1