日韩欧美中文字幕在线人妻中文,以简单为核心,却拥有强大的功能与丰富的内容

k1体育麻将胡了

搜索 猫眼影戏 融媒体矩阵
  • 山东手机报

  • 猫眼影戏

  • 公共网官方微信

  • 公共网官方微博

  • 抖音

  • 人民号

  • 天下党媒平台

  • 央视频

  • 百家号

  • 快手

  • 头条号

  • 哔哩哔哩

首页 >新闻 >社会新闻

DeepSeek-OCR是「长文本明确」未来偏向吗?中科院新基准给出谜底

2026-01-12 03:11:14
泉源:

猫眼影戏

作者:

陈炳忠

手机审查

  猫眼影戏记者 张先鸿 报道Q8X2R7L1T4J5M9B6W3

新智元报道

编辑:LRST

【新智元导读】DeepSeek-OCR的视觉文本压缩(VTC)手艺通过将文本编码为视觉Token,实现高达10倍的压缩率,大幅降低大模子处置惩罚长文本的本钱。可是,视觉语言模子能否明确压缩后的高密度信息?中科院自动化所等推出VTCBench基准测试,评估模子在视觉空间中的认知极限,包括信息检索、关联推理和恒久影象三大使命。

近期,DeepSeek-OCR依附其立异的「视觉文本压缩」(Vision-Text Compression, VTC)范式引发了手艺圈的高度关注,以少少的视觉Token实现高效的文本信息编码,为长文本处置惩罚开发了新路径。

这一突破性希望让大模子处置惩罚超长文档的本钱大幅降低,但也抛出了一个焦点问题:当长文本被高度压缩为2D图像后,视觉语言模子(VLM)真的能明确其中的内容吗?

为相识答这一疑问,来自中科院自动化所、中国科学院香港立异研究院等机构的研究团队推出了首个专门针对视觉-文本压缩范式的基准测试——VTCBench。

论文链接:https://arxiv.org/abs/2512.15649

VTCBench链接: https://github.com/Moenupa/VTCBench

VLMEvalKit链接:https://github.com/bjzhb666/VLMEvalKit

Huggingface链接: https://huggingface.co/datasets/MLLM-CL/VTCBench

图 1:视觉-文本压缩 (VTC) 流程演示及VTCBench

与古板大模子直接读取成千上万的纯文本Token差别,VTC范式(如DeepSeek-OCR)先将长文档渲染 (Rendering)为高密度的2D图像,再由视觉编码器转化为少量的视觉Token。

该手艺可实现2倍至10倍的Token压缩率,显著降低了长文本处置惩罚时的盘算与显存开销。

VTCBench现已在GitHub和Huggingface周全开源,其衍生版本VTCBench-Wild是一个统一的、全方位评估模子在重大现实场景下视觉文本压缩的鲁棒性,现已集成到VLMevalkit。

焦点使命

权衡「看得见」之后的「看得懂」

现在的VLM也许能精彩地完成OCR识别,但在处置惩罚 VTC 压缩后的高密度信息时,其长文本明确能力仍存疑。

VTCBench通过三大使命,系统性地评估模子在视觉空间中的认知极限:

1.VTC-Retrieval (信息检索):在视觉「大海」中寻找特定事实的「针」(Needle-in-a-Haystack),测试模子对空间漫衍信息的捕获能力。

2.VTC-Reasoning (关联推理):挑战模子在险些没有文本重叠的情形下,通过关联推理寻找事实,逾越纯粹的词汇检索。

3.VTC-Memory (恒久影象):模拟超长对话,评估模子在视觉压缩框架下,抵御时间与结构性信息衰减的能力。

别的,团队同步推出了VTCBench-Wild,引入 99 种差别的渲染设置(涵盖多种字体、字号、行高及配景),全方位检测模子在重大现实场景下的鲁棒性。

揭秘视觉压缩背后的认知瓶颈

图 2:VTCBench针对模子在长图像中检索信息的热力争。横轴代表上下文长度,纵轴代表要害事实(Needle)在文档中的深度。展现了模子体现的「迷失」与突破。

测试效果泛起出显著的「U 型曲线」:与文本模子类似,视觉语言模子(VLM)能够精准捕获开头和最后的信息,但关于中心部分的事实,明确能力会随着文档变长而强烈衰退。这证实晰纵然在视觉空间,模子依然保存严重的「空间注重力私见」,是未来 VTC 架构优化的要害偏向。

行业洞察

视觉压缩是长文本的终局吗?

通过对GPT、Gemini、Claude、QwenVL、InternVL、Gemma、KimiVL、Seed1.5等10余种尖端模子的深度评测,可以发明:

虽然VTC极大提升了效率,但现有VLM在重大推理和影象使命上的体现仍普遍弱于纯文本LLM;

消融实验证实,信息密度是决议模子性能的要害因素,直接影响视觉编码器的识别精度;

Gemini-3-Pro在VTCBench-Wild上体现惊艳,其视觉明确能力已险些追平其纯文本基准,证实晰VTC是实现大规模长文本处置惩罚的极其可行的路径!

总结

若是说古板的长文本处置惩罚是「逐字阅读」,那么DeepSeek-OCR所引领的VTC范式就是「过目成诵」的摄影式影象。VTCBench的泛起,正是为了确保模子在拥有这种「超能力」的同时,依然能够读懂字里行间的微言大义。

参考资料:

https://arxiv.org/abs/2512.15649

秒追ASI

?点赞、转发、在看一键三连?

点亮星标,锁定新智元极速推送!

??时势1:真人一级片

??01月12日,两岸媒体人走进聊城共探“两河之美”,

  一是加速县城建设。要凭证“新区出形象、旧城变面目、沿河出特色、治理上水平”的要求,连系“两区一带”的整体结构,突出抓好“四区”、四厂”建设,强力组织10项重点工程。详细讲:①8条蹊径配套建设工程,涉及施工单位要起劲创立条件,近期要陆续开工,力争3月尾前完成滨河路配套建设,6月尾确保三里河景观路建成通车。②金府步行街一期工程已经启动,7月尾前要完成主体工程;二期工程拆迁6月尾前组织实验,8月尾前完成使命。③影戏院、体育场区域开发项目,3月尾前要拆迁完毕,4月份动工建设,6月尾前完成休闲广场的主体工程建设。④县体育中心建设项目,近期要完成妄想设计,订出红线,城关镇要认真做好土地租用事情。⑤一高中分校、文化“三馆”和广播电视传输中心建设项目,二期3000万元准备已到位,近期要马上组织招投标。⑥三里河景区建设工程,确保5月尾前橡胶坝建成蓄水,并完成护坡的招投标事情。⑦城北公园一期工程,3月中旬前完成拆迁和租地事情,5月份前完成绿化使命。⑧县纺织工业区设施配套工程,近期要启动,并拿出第一期3平方公里的妄想设计。⑨自来水厂、污水处置惩罚厂、垃圾处置惩罚厂项目建设要争取早日开工建设。自来水厂项目,一批300万元国债资金已下拨,建设部分要抓紧引资兴建;污水处置惩罚厂项目征地、定位、放线初设事情已完成,发改委、建设局要分头做好上报审批,力争3月份最先招投标,年底前完成建设使命;垃圾处置惩罚厂项目,有关部分要起劲配合,按省政府要求,力争年底前开工建设。⑩安居工程一期建设项目,要尽快完善相关手续,近期开工建设,年底前建成完工。上述工程建设时间紧迫,使命难题,各有关单位要统筹安排,全心组织,全力攻坚,确保施工进度和质量,打造城区精品工程,力争以重点工程的大突破推进都会品位的大提升。同时,适时调解行政区划,将与县城联系细密的州里纳入城区规模,进一步统一妄想和建设,增强县城的群集、辐射能力,提高综合竞争力。

,18岁免费观看的视频网站。

??01月12日,韩国瑜、江启臣当选新一届台立法机构正副负责人,

  老族长逐步解说,从源头为小不点排遣疑惑,将自己所知晓的一切道出,让他从心田生出一种神往,这即是在“种道”。

,OTK实践狠揍外网,亚洲国产精品高清一区二区三区,久久本道久久综合伊人。

??时势2:国产一级视频内射

??01月12日,新疆乌什县发生7.1级地震 截至8时3级及以上余震达40次,

招商银行信用卡逾期1个月会被起诉,还不起怎么办

,吃胸摸下www,yw.193.com,美女網站。

??01月12日,金融生鲜季丨“小仙草”为村民撑起“致富伞”,

  仅片晌间,小不点连击三个天才,占有优势,令三富家的强者都面色阴森,这着实让人难以置信,一个小山村罢了,居然有这样一个惊世的奇才,认真称得上天纵之资!

,人妻无码久久系列,UU372CM,一级a片黄片夫妻免费看。

??时势3:奂费看久久久久久一级毛片

??01月12日,【理响中国】扩大高水平对外开放的实现途径,

  狈山拔出巨剑,冲向小不点,冷森森的冷光在山林中划过,五六千斤的臂力凶猛的惊人,双手轮动阔剑,像是劈出了一道闪电。

,外国草逼,人人爱人人操人人搞,侃爷老婆全课视频入口。

??01月12日,穗首个旧改项目广泛应用数智化技术,

  下面,我宣布银行分行开业庆典现在最先。

,久久精品视频这里,国产视频正在播放,黄片视频免费观。

??时势4:久久久久国产一级A片

??01月12日,防暑科普丨高温来袭 这些防御指南措施要牢记 ,

  针对现在我们在清静方面保存的问题,连系我们学校的现真相形,学校提出以下几点要求:

,黄色黄页网站免费在线观看,1024精品久久久久久久久,视频二区 在线。

??01月12日,24岁舞蹈生在圆明园兼职“安陵容”:仙气飘飘再现皇家冰嬉,

  两个天才快速逃避,唯恐被击中,只要擦着,肯定会骨断筋折!

,国语对白刺激真实精品,虞姬清凉图片,又黄又湿又爽吸乳视频。

责编:斯珀

审核:徐新红

责编:肖恩哈林顿

相关推荐 换一换

Copyright (C) 2001-   dzwww.com. All Rights Reserved

新闻信息效劳允许证 - 音像制品出书允许证 - 广播电视节目制作谋划允许证 - 网络视听允许证 - 网络文化谋划允许证

山东省互联网传媒集团主理  联系电话:0531-85193202  违法不良信息举报电话:0531-85196540

鲁ICP备09023866号-1   鲁公网安备 37010202000111号  

Copyright (C) 2001- Dzwww   鲁ICP备09023866号-1

网站地图