跳到正文
OpenReview · State space models· Mohamed Abdalla Mabrok; Yalda Zafari·· 2025-12-31精选AI 评分75

基于状态空间的语言模型的可控性分析

Controllability Analysis of State Space-based Language Model

AI 导读

基于摘要分析。该研究针对 Mamba 等状态空间模型(SSMs)内部动态难以解释的问题,提出基于可控性的 Influence Score,用于衡量位置 k 的 token 对后续状态和输出的影响,并通过不同 Mamba 变体的诊断实验考察其表现。 机制上,Influence Score 由 Mamba 的离散状态空间参数导出,通过类似系统可观测性分析的反向递推计算。它提供的是内部影响强度的诊断视角,而非摘要中已证明的任务性能或因果贡献指标;具体定义、计算代价及状态影响与输出影响的关系尚需全文核对。 作者在 mamba-130m、mamba-2.8b 和 mamba-2.8b-slimpj 上开展六类实验,分别考察温度、提示复杂度、token 类型、层深、token 位置和输入扰动。作者报告:在这些模型与实验条件下,Influence Score 随模型规模和训练数据增加而提高;模型呈现近因偏置,影响集中于中后层;在所比较变体中,mamba-2.8b-slimpj 特有地更重视内容词,并在噪声存在时降低内部影响。摘要未提供定量分数、样本构成及统计不确定性,规模与训练数据效应是否被独立区分,以及实验协议、消融及统计信息尚未验证。 平台推测(待验证):若 EEG 序列模型采用可访问离散状态空间参数的 Mamba,该递推诊断机制或可用于分析不同时间片对后续状态与任务输出的影响。可复用部分是参数驱动的影响计算;需改造部分包括 EEG 时间片或通道的 token 化方式、输出定义及跨被试比较中的尺度校准。低信噪比可能使内部影响反映伪迹而非有效神经信息,被试差异、通道配置和小数据训练也可能削弱解释稳定性。一个可证伪的小实验是在固定被试内划分的 EEG Mamba 模型上,比较高、低 Influence Score 时间片受等强度扰动后的输出变化,检验分数能否预测扰动敏感性;这不等同于验证生理因果性。已有 EEG 相关工作尚未检索确认。复现语言模型结果仍需核对分数公式、层间汇总方式、提示与扰动设置及实现材料。

阅读价值

值得阅读的具体原因是作者提出了可从 Mamba 离散状态空间参数计算的 token 影响诊断指标,可用于核查位置与层深相关的内部动态,但其解释效度及向 EEG 的迁移价值尚未验证。

来源:OpenReview · State space models · openreview.net