LeCun团队揭示LLM语义压缩本质 极:“致统计压”缩牺牲!细节

2025-07-23 17:20:16      来源:求是网

当我们读到“苹果”“香蕉”“西瓜”这些词,虽然颜色不同、形状不同、味道也不同,但仍会下意识地归为“水果”。

哪怕是第一次见到“火龙果”这个词,也能凭借语义线索判断它大概也是一种水果。

这种能力被称为语义压缩,它让我们能够高效地组织知识、迅速地对世界进行分类。

那问题来了:大型语言模型(LLM)虽然语言能力惊人,但它们在语义压缩方面能做出和人类一样的权衡吗?

为探讨这一问题,图灵奖得主LeCun团队,提出了一种全新的信息论框架。

该框架通过对比人类与LLM在语义压缩中的策略,揭示了两者在压缩效率与语义保真之间的根本差异:

LLM偏向极致的统计压缩,而人类更重细节与语境。

语义压缩对比框架

要实证性地研究LLM的表征方式与人类概念结构之间的关系,需要两个关键要素:

稳健的人类概念分类基准

研究团队基于认知科学中的三项经典研究(Rosch1973、1975和McCloskeyGlucksberg1978),构建了一个涵盖1049个项目、34个语义类别的统一基准。

这些数据不仅提供了类别归属信息,还包含人类对各项目“典型性”的评分,反映了人类认知中概念形成的深层结构。

相比现代众包数据,这些经过专家严格设计的数据集更具可信度与解释力,为LLM的类人性评估提供了高保真的比较基础。

多样化的LLM模型选择

为全面评估不同大型语言模型在概念表征上的差异,研究团队选取了30+LLMs(BERT、LlamA、Gemma、Qwen等),参数规模从3亿到720亿不等。

所有模型均从输入嵌入层提取静态词元表示,以贴近人类分类实验中“去上下文”的刺激方式,确保模型和人类的认知基准保持一致,便于公平比较。

为分析LLM与人类在表达和组织语义信息时的差异,研究引入了一个信息论框架。

该框架借鉴了两大经典信息论原理:

速率失真理论:描述压缩效率与信息失真之间的最优权衡;

信息瓶颈原理:关注在压缩表示的同时,最大程度保留与目标相关的信息。

LLM与人类在表征策略上的关键差异

研究发现,LLM的概念分类结果与人类语义分类的对齐程度显著高于随机水平。

这一结果验证了LLM在语义组织方面的基本能力,并为后续更细粒度的语义结构对比奠定了基础。

但是大型语言模型真的理解细节吗?

答案是:LLM难以处理细粒度的语义差异。它们的内部概念结构与人类对类别归属的直觉不相符。

人类典型性判断与LLM余弦相似度之间的斯皮尔曼相关系数较弱且大多数不显著,表明两者在概念表征结构上存在差异。

那LLM和人类在信息压缩与语义保真上存在哪些关键差异呢?

LLM侧重于统计压缩,力求最大程度地减少冗余信息;而人类则更注重适应性和丰富性,强调保持灵活性和上下文的完整性。

研究团队

这项研究由斯坦福大学与纽约大学联合开展,团队成员均来自这两所高校。

其中,第一作者为斯坦福大学博士后研究员ChenShani。

更让网友震惊的的是,YannLeCun也为此研究的作者之一。

YannLeCun是当今人工智能领域最具影响力的科学家之一,现任Meta(原Facebook)首席人工智能科学家,同时也是纽约大学教授。

LeCun早在1980年代便开始研究神经网络,最著名的贡献是提出了卷积神经网络(CNN)的核心架构——LeNet-5,用于手写数字识别。

该网络是现代深度学习模型的雏形,为后续图像识别和计算机视觉技术的发展奠定了坚实基础。

他与GeoffreyHinton、YoshuaBengio被誉为“深度学习三巨头”,共同推动了深度学习的理论与应用突破。

2018年,三人因在深度学习领域的杰出贡献,荣获了计算机科学领域的最高奖项——图灵奖。

除了技术创新,LeCun还积极推动深度学习技术在工业界的应用,尤其是在Meta,领导团队将人工智能技术应用于大规模系统。

他同时是自监督学习的积极倡导者,认为这是实现通用人工智能(AGI)的关键路径之一。

可以说,LeCun的研究对人工智能技术的演进产生了重要影响。

论文地址:https://arxiv.org/abs/2505.17117

参考链接:https://x.com/ziv_ravid/status/1928118800139841760

  张先生说,因为网球人群的增多,网球运动关联经济也更加活跃。球衣、球袜、球包以及打球的各种装备和周边产品,包括网球训练课都在走俏。比赛数量的增加,更是提升了各地运动场馆的利用率。

责编:路问香编辑

海螺

  公器私用,将地质调查、矿产开发等权力作为敛财纳贿的工具,搞权钱交易,利用职务便利为他人在企业经营、项目承揽、矿权审批等方面谋利,并非法收受巨额财物;

多所高校明确年不招复读生

  根据美国CNBC网站梳理的数据,通用汽车及其合资公司在华市场份额从2015年的15%左右降至去年的8.6%,中国市场盈利占通用汽车全部盈利的比例也有所下降。2022年,斯特兰蒂斯集团表示只在中国地区保留其旗下Jeep品牌的进口业务。

男子长期蹲坑玩手机肠子掉出

  兰州机场T1+T2面积8.9万平方米,去年吞吐量超过1700万人次,可以说不堪重负。乌鲁木齐机场T1+T2+T3面积18.48万平方米,需要承载超过2700万人次的吞吐量。

冯文娟怀孕

  去哪儿数据显示,消息发布后,去哪儿平台“澳大利亚”机票搜索量环比增长四成以上。在去哪儿平台上,飞往澳大利亚的航线覆盖多个城市。悉尼可直飞北京、上海、广州、深圳、成都、杭州、重庆、南京、厦门、天津、济南、西安、海口、郑州、太原等多个城市,暑期从郑州、重庆、天津往返悉尼更便宜,价格在2500元左右。此外,墨尔本可直飞北京、上海、广州、成都、杭州、南京、厦门、青岛、海口等城市,上海、广州也有直飞布里斯班的航班在售。从旅游订单来看,大堡礁、悉尼歌剧院、出海观海豚受到旅客欢迎,8-12日团预订更多。在澳大利亚,旅客可以出海观鲸、看企鹅归巢,体验特色风情。

肖战给化妆师发红包

  携程集团副总裁秦静认为,随着这一政策的施行,将加速中国与澳大利亚之间的旅游交流及经贸互动。同时,政策也将惠及在澳大利亚生活的逾百万华人华侨,使得他们回国探亲或旅游的过程更为简便顺畅。秦静指出,作为亚太地区的重要国家,中国与澳大利亚在经济上具有高度的互补性,合作潜力巨大,未来也期盼在旅游领域激发更强劲的合作动力。

男子因眼睛小被频繁误判疲劳驾驶

  乌鲁木齐不缺国际和地区航线。2024年,乌鲁木齐机场累计运营定期客货运输航线共240条。其中,国际定期客运航线26条,与高加索地区三国与中亚五国实现全部通航,通航中亚航点数量为国内十大枢纽机场之首。/p>

两地明确医生可告知艾滋病患者配偶

  国家防灾减灾救灾委员会办公室、应急管理部会同国家粮食和物资储备局向河北、山西、内蒙古、山东、河南5省(区)调拨3万件中央救灾物资,支持地方做好抗旱救灾各项工作。/p>

热搜播客正式出道

  除了国际航线网络的短板,乌鲁木齐也缺乏国际顶级航司入驻。国泰航空凭借座舱、餐食、服务等方面的表现,建立起国际品牌形象,常年与新加坡航空、阿联酋航空、卡塔尔航空这样的顶级航司保持同一水准。通过国泰开航,乌鲁木齐有望在国际市场引起更多关注。