跳到正文
OpenReview · Representation learning· Chenghao Xiao; Yang Long; Noura Al Moubayed·· 2022-01-01精选AI 评分73

对比式句子表示学习的各向同性与学习动态研究

On Isotropy and Learning Dynamics of Contrastive-based Sentence Representation Learning

AI 导读

基于摘要分析。本文研究对比学习为何能够改善句子表示学习(SRL),主要对象是句子级 NLP 语义表示,而非 EEG 或 BCI。作者从各向同性、上下文化和学习动态三个角度分析表示空间的变化,旨在为后续句子表示学习方法的设计提供依据。 作者报告,对比学习使表示空间更具各向同性,并提高句内相似性,即同一句子中的 token 在语义空间中趋向相近位置。作者还将一种现象形式化为“spurious contextualization”(伪上下文化),并报告该现象在具有语义意义的 token 上减弱、在功能性 token 上增强;其具体定义与测量方式需查阅全文确认。训练过程中,嵌入空间整体朝原点移动,更多区域变得更明确,但摘要未说明相应几何量的定义及其与下游效果的定量关系。 作者通过改变训练温度、批量大小和池化方法考察上述现象的学习动态。摘要未提供具体模型、对比目标形式、数据集、评估划分或数值结果,实验协议、消融及统计信息尚未验证。因此,不能据此将各向同性增强等同于任务性能提升,也不能判断这些现象是否适用于其他模态。 平台推测(待验证):其可迁移价值更可能是表示诊断视角,而非直接复用句子语义结论。假设 EEG 对比学习中的表示集中或局部特征过度趋同会影响判别能力,可复用各向同性与训练轨迹分析;但需根据 EEG 的时间片段或通道结构重新定义局部相似性,不能直接对应语义 token 与功能性 token。低信噪比、跨被试差异及小数据条件可能使几何变化主要反映噪声或被试身份。一个小规模可证伪实验是在固定 Cross-subject 划分、编码器及增强策略下,仅改变对比学习温度,同时记录各向同性、片段相似性与下游 Accuracy,检验几何改善是否伴随判别能力改善。已有 EEG 相关工作尚未检索确认。

阅读价值

值得阅读之处在于作者将对比式句子表示学习的效果与表示各向同性、句内 token 聚合及训练动态联系起来,为检查对比学习表示空间提供了具体分析视角,但其 EEG 适用性尚未验证。

来源:OpenReview · Representation learning · openreview.net