跳到正文
5月1日周五
  1. OpenReview · State space models76

    SF-Mamba:重新思考用于视觉的状态空间模型

    基于摘要分析。本文针对视觉 Mamba 的扫描机制限制图像 patch 间非因果交互、多扫描策略带来数据重排开销,以及短 token 序列下计算速度较慢的问题,提出 SF-Mamba,尝试同时改善视觉编码的信息流与计算效率。 核心机制包括两项:辅助 patch swapping,在单向扫描中编码双向信息流;batch folding 配合周期性状态重置,以提升 GPU 并行度。其思路不是单纯增加扫描方向,而是重新组织 patch 交互与计算执行。摘要未说明交换规则、折叠维度、状态重置周期,以及这些操作如何保持上下文信息,具体实现尚未验证。 作者报告,在图像分类、目标检测、实例分割和语义分割实验中,SF-Mamba 在不同模型规模下优于作者所称的最先进基线,并提升吞吐量。摘要未提供数据集、划分、评价指标、数值、硬件环境及吞吐测量条件,因此目前不能量化性能收益或判断不同设置下的可比性;实验协议、消融及统计信息尚未验证。摘要提供了代码仓库,但代码内容、运行依赖与复现结果尚未核验。 平台推测(待验证):若 EEG 被组织为时间片段或通道—时间 token,patch swapping 可能为单向扫描补充双向上下文,batch folding 则可能改善短序列训练或推理的 GPU 利用率。这一假设依赖 token 的时空结构及计算规模,视觉任务中的收益不能直接视为 BCI 效果。迁移时需改造交换规则以匹配电极与时间关系,并核对周期性状态重置是否截断关键时序信息;低信噪比、跨被试差异、通道变化和小数据可能削弱收益,在线因果解码也需单独评估。可先在固定 EEG 数据划分和硬件条件下,对比原始单向 Mamba 与分别加入两项机制的版本,记录任务指标、吞吐及延迟,以检验机制收益能否迁移。相关 EEG 工作尚未检索确认。

    阅读价值:值得核对 SF-Mamba 如何以 patch swapping 和 batch folding 同时改善视觉状态空间模型的信息交互与 GPU 吞吐,但性能优势及其对 EEG 的迁移价值尚需验证。

3月10日周二
  1. OpenReview · EEG68

    面向长序列 EEG 建模的高效自监督框架

    基于摘要分析。该研究针对 EEG 低信噪比、被试间差异及 Transformer 长序列建模计算开销较高的问题,提出自监督框架 EEGM2,将 Mamba-2 集成到 U 形编码器—解码器中,并采用联合 L1-spectral loss,兼顾时域动态与频谱特征。 核心机制是利用 Mamba-2 的选择性信息传播捕获长程依赖。作者称该框架具有线性复杂度,相较 Transformer 方法可减少内存使用并加快推理。联合 L1-spectral loss 的设计意图是同时约束时域与频域信息,但具体损失定义、权重、预训练任务、输入表示及训练流程尚未验证,不能仅凭摘要判断其信息保留效果或各组件贡献。 作者报告 EEGM2 在短序列和长序列建模中达到最先进性能,并表现出较强的 Cross-subject 泛化与跨域迁移能力。摘要未提供数据集、被试数、序列长度、划分方式、指标数值及对照基线,因此尚不能量化性能收益,也不能将跨域迁移直接等同于 Cross-dataset 或 Cross-session 结果。实验协议、消融及统计信息尚未验证。 复现时应重点核对不同序列长度下的计算量、峰值内存和推理延迟,以及对应硬件、批量大小和基线配置;同时检查 Cross-subject 划分与迁移评估条件,以区分架构效率收益和训练设置的影响。作者提供了模型与代码仓库,但仓库内容、权重及运行条件尚未核验。面向资源受限 BCI 设备的适用性是作者提出的应用判断,摘要未给出设备端实测证据。

11月6日周四
  1. OpenReview · State space models70

    RPCASSM:用于红外小目标检测的鲁棒主成分分析状态空间模型

    基于摘要分析。该研究针对远距离红外成像中小目标占比低、主流视觉状态空间模型难以准确建模目标边缘的问题,提出基于鲁棒主成分分析(RPCA)范式的 RPCASSM,分别设计背景状态空间模块(BSSM)与目标状态空间模块(TSSM)。核心贡献是依据红外小目标的空间结构特性定制扫描机制,而非直接沿用主流视觉状态空间框架。 机制方面,BSSM 利用空间异质信号的显著性,通过空间探针扫描机制(SPCM)建模背景信息;TSSM 利用目标的稀疏性与局部高亮特征,通过可变形提示扫描机制(DPCM)聚焦目标的可变形空间。摘要将该设计与 RPCA 范式关联,但具体分解形式、模块耦合方式、损失函数及训练和推理流程尚未验证,不能据此认定网络显式求解了某种 RPCA 优化目标。 作者报告,在现有基准数据集上的实验支持 RPCASSM 设计的有效性,并称其改善了红外小目标边缘结构的建模。摘要未提供数据集名称、划分协议、对照基线或定量指标,因此目前无法判断收益幅度及适用范围;实验协议、消融及统计信息尚未验证。 平台推测(待验证):其背景与稀疏局部目标分开建模的机制,可能启发 EEG 中背景活动与短暂事件的分离,但这是迁移假设,不是已证实的 BCI 效果。该方法依赖图像中的空间异质性、目标稀疏性和局部高亮,而 EEG 事件未必稀疏或高幅,电极邻接结构也不同于图像网格。可复用的是分模块建模思路,扫描路径与可变形提示机制则需适配时间轴及通道拓扑;低信噪比、伪迹高幅响应、跨被试差异和小数据训练均可能导致失败。一个可证伪的小实验是在固定 EEG 数据划分和相同训练条件下,比较通用状态空间模型与适配后的双模块模型,检验事件检出及时间定位是否改善,并核对是否增加伪迹误检。相关 EEG 工作尚未检索确认。

    阅读价值:值得阅读其依据背景与稀疏目标结构分别设计状态空间扫描机制的思路,但边缘建模收益及相对基线的有效性仍需核对全文实验。

7月8日周二
  1. OpenReview · State space models71

    MS-SSM:用于高效序列建模的多尺度状态空间模型

    基于摘要分析。MS-SSM 针对传统状态空间模型(SSM)有效记忆受限、难以同时捕获多尺度依赖的问题,将序列动态表示在多个分辨率上,并为各分辨率配置专门的状态空间动力学;同时引入输入依赖的 scale-mixer,动态融合不同分辨率的信息。 核心机制是同时建模细粒度高频模式与粗粒度全局趋势,以改善记忆效率和长程建模。相较于摘要所述依赖扩大状态尺寸来提升召回能力的传统 SSM,本文侧重多分辨率处理与动态跨尺度融合。分辨率如何构造、各尺度状态如何更新、scale-mixer 的具体形式,以及训练目标、稳定性约束和复杂度尚未验证。 作者报告,在包括 Long Range Arena、hierarchical reasoning、time series classification 和 image recognition 的基准实验中,MS-SSM 持续优于此前的 SSM 模型,并保持计算效率。摘要未提供具体分数、数据划分、对照模型配置或效率测量条件,因此无法判断提升幅度及性能与成本的权衡;实验协议、消融及统计信息尚未验证。 平台推测(待验证):假设多尺度机制能区分 EEG 的局部快速变化与较慢的时序背景,其可能缓解长序列建模中的记忆压缩瓶颈,但原领域结果不等于 EEG/BCI 有效。可尝试复用多尺度状态动态与 scale-mixer,需按采样率和目标信号调整分辨率构造,并适配多通道输入。低信噪比可能使动态融合追随伪迹,降采样可能损失任务相关信息,跨被试差异与小数据也可能限制泛化。一个可检验的小实验是在固定 EEG 任务和相同 Cross-subject 划分下,对比单尺度 SSM、多尺度但固定融合、完整 MS-SSM,并控制参数量与训练预算,联合检查任务指标、推理成本和噪声扰动下的稳定性。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得核对多分辨率状态空间动力学与输入依赖 scale-mixer 能否在计算成本可比时改善长程记忆,以及各模块对性能的独立贡献;其 EEG 迁移价值尚未验证。

6月13日周五
  1. OpenReview · State space models73

    DyGMamba:利用状态空间模型高效建模连续时间动态图中的长期时间依赖

    基于摘要分析。DyGMamba 面向连续时间动态图(CTDG)表示学习,试图同时解决长节点交互历史带来的计算开销,以及从长历史中识别关键时间信息的难题。其核心贡献是结合节点级与时间级状态空间模型(SSM),在编码历史交互的同时动态选择重要信息。 机制上,DyGMamba 源于 Mamba:节点级 SSM 首先编码节点历史交互序列,时间级 SSM 再提取历史图中的时间模式,并用其输出动态选择交互历史中的关键信息。摘要支持这种功能分工,但未说明选择操作、时间间隔编码、损失形式和训练细节,不能据此推断具体网络结构或复杂度阶数。 作者在动态图链接预测任务上验证该方法,并报告其在多数情况下达到最先进水平,同时保持较高的计算资源效率,使有限计算预算下捕获长期时间依赖成为可能。摘要未提供数据集、划分、对照基线、指标数值或资源测量条件,因此尚不能判断优势集中在哪类图、历史长度或预测协议;实验协议、消融及统计信息尚未验证。 平台推测(待验证):该机制可能适用于将 EEG 表示为带时间戳交互事件图的研究,探索长时依赖与关键交互筛选,但原领域有效不等于 BCI 有效。可复用的是历史交互序列编码和时间信息选择思路;需要改造的是 EEG 通道或脑区节点定义、边事件构建及任务监督。其依赖的事件图结构与常规连续 EEG 信号并不等同,低信噪比可能产生不稳定边事件,跨被试通道差异和小数据也可能削弱选择机制。一个可检验的小实验是在固定 EEG 图构建、数据划分与计算预算下,对比完整机制和不使用时间级动态选择的版本,检查长历史是否带来稳定收益。已有 EEG 相关工作尚未检索确认;具体复现仍需取得全文及核对实现条件。

    阅读价值:值得核对其节点级历史编码与时间级动态信息选择的协同机制,以及长交互历史下预测性能和计算资源开销的权衡;摘要中的领先结果仍需结合具体评估协议验证。

1月1日周三
  1. OpenReview · State space models72

    DefMamba:可变形视觉状态空间模型

    基于摘要分析。DefMamba 针对视觉 Mamba 将图像按预定义扫描顺序展平为一维序列、可能难以充分利用空间结构的问题,提出结合多尺度骨干与 deformable mamba(DM)模块的视觉基础模型,通过动态调整扫描路径增强相关输入特征的提取。 核心机制是 deformable scanning(DS)策略:不完全沿固定顺序处理图像,而是动态调整扫描路径,优先处理重要信息。作者认为,这有助于学习图像结构并捕捉物体细节变化。摘要未说明扫描位置如何生成、是否使用额外监督,以及动态扫描与状态空间计算如何衔接;具体损失、训练配置、参数规模和计算开销尚未验证。 作者报告,DefMamba 在 image classification、object detection、instance segmentation 和 semantic segmentation 等视觉任务上达到领先性能,但摘要未提供数据集、划分、基线或指标数值,因此无法评估各任务的收益幅度及效率权衡。实验协议、消融及统计信息尚未验证。摘要称代码已开源,但当前材料不足以核对实现入口、权重及复现条件。 平台推测(待验证):迁移假设是,若 EEG 的通道空间关系与时序变化能够形成有意义的扫描结构,动态扫描可能缓解固定通道或时空遍历顺序对局部相关性的限制。可考虑复用状态空间处理与动态扫描思路,但需改造图像空间坐标、多尺度特征组织和扫描约束。原方法依赖的图像网格结构不能直接等同于 EEG 电极布局;低信噪比可能使扫描路径追随伪迹,跨被试及通道配置变化也可能破坏路径稳定性,小数据则可能增加路径学习的过拟合风险。一个可检验的小实验是在同一 EEG 数据划分、预处理与训练预算下,对比固定扫描与可学习扫描,并检查任务指标、计算开销及噪声扰动下的路径稳定性。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得核对其可变形扫描相较固定扫描顺序的空间结构建模收益与计算开销,但摘要中的领先性能主张及向 EEG 迁移的有效性尚未验证。

  2. OpenReview · State space models72

    DefMamba:可变形视觉状态空间模型

    基于摘要分析。DefMamba 针对视觉 Mamba 将图像按预定义顺序展平为一维序列、难以充分利用空间结构的问题,提出结合多尺度骨干结构与 deformable mamba(DM)模块的视觉模型。核心贡献是通过 deformable scanning(DS)策略动态调整扫描路径,使特征处理优先关注重要信息。 机制与证据:摘要将空间结构利用不足归因于固定扫描顺序,并以可变形扫描改善图像结构学习和物体细节变化的捕捉。多尺度结构与动态扫描的具体结合方式、路径生成机制、训练目标及计算开销尚未验证。作者将 DefMamba 称为视觉基础模型,但摘要未提供预训练数据、规模或迁移设置,不能据此判断其基础模型能力。 作者报告,在 image classification、object detection、instance segmentation 和 semantic segmentation 等视觉任务上取得 state-of-the-art 性能;摘要未给出数据集、评估划分、指标数值和对照基线,因此无法判断优势幅度或不同任务间的可比性。实验协议、消融及统计信息尚未验证。摘要称代码已开源,但具体仓库、训练配置和复现条件尚未核实。 平台推测(待验证):迁移假设是,将固定扫描改为内容相关扫描,可能改善 EEG 时空特征的选择与整合;这不是已证实的 BCI 效果。原方法依赖图像的空间结构及视觉任务数据,具体监督方式与数据规模未知。可考虑复用动态扫描思想,但需将二维图像空间改造为电极拓扑与时间结构,并约束扫描保留时序关系。低信噪比可能使路径追踪伪迹,跨被试及通道布局差异可能破坏空间对应,小数据可能导致扫描策略过拟合。一个可证伪的小实验是:在相同数据划分、训练预算与骨干配置下,比较固定扫描和电极拓扑约束的动态扫描在 Cross-subject EEG 分类中的表现,同时检查噪声扰动后的路径稳定性。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其可变形扫描如何缓解视觉 Mamba 固定扫描顺序对空间结构利用的限制,但性能优势及向 EEG 迁移的可行性尚需核对全文与实验。

  3. OpenReview · State space models72

    DefMamba:可变形视觉状态空间模型

    基于摘要分析。DefMamba 针对视觉 Mamba 将图像按预定义扫描顺序展平为一维序列、可能削弱空间结构利用的问题,提出结合多尺度骨干与 deformable mamba(DM)模块的视觉模型。核心贡献是通过 deformable scanning(DS)动态调整扫描路径,优先处理重要信息,以增强空间结构及目标细节的表征。 机制与证据:摘要将改进归因于动态扫描,而非仅采用固定顺序的序列化。作者报告,DefMamba 在 image classification、object detection、instance segmentation 和 semantic segmentation 任务上达到领先性能;但材料未提供数据集、划分、指标数值、对照模型或计算成本,尚不能判断收益幅度及效率权衡。扫描路径如何生成、是否可微、训练目标,以及多尺度骨干和 DS 的独立贡献,均需查阅全文;实验协议、消融及统计信息尚未验证。作者称代码已开源,但材料未给出可核对的仓库地址,运行环境、配置及权重可用性尚未验证。摘要称其为视觉基础模型,预训练规模与迁移评估范围仍待核对。 平台推测(待验证):迁移假设是,若 EEG 的通道拓扑与时频表示提供稳定的空间结构,内容自适应扫描可能缓解固定序列化难以利用通道关系的问题。可考虑复用动态扫描思想,但扫描坐标、通道邻接及输入编码需针对 EEG 改造;其监督需求和数据规模依赖尚不明确。低信噪比可能使路径追随伪迹,跨被试差异与通道缺失可能破坏结构,小数据也可能使路径学习过拟合。一个可检验的小实验是在同一 EEG 任务、固定 Cross-subject 划分和相同训练预算下,仅替换固定扫描与动态扫描,并比较预先选定的同一指标及通道扰动下的稳定性。该实验只是迁移验证建议,不代表已有 EEG 效果;相关 EEG 工作尚未检索确认。

    阅读价值:值得核对 DefMamba 的动态扫描机制及其相对固定扫描顺序的收益,但摘要中的领先性能主张与向 EEG 迁移的价值均需进一步验证。

  4. OpenReview · EEG61

    结合时空网络与图注意力架构的 EEG 工作负荷分类

    基于摘要分析。本研究针对 EEG 认知工作负荷估计,将 EEGNet 与 Graph Attention Networks(GATs)结合,旨在联合建模 EEG 的时空特征及电极间关系。核心贡献是融合电极空间距离与信号相关性构建动态图,并利用 GAT 的多头注意力进行特征提取和工作负荷分类。 技术机制:EEGNet-GAT 混合架构将时空特征建模与图关系建模结合,以表达 EEG 中复杂的空间和时间动态。摘要明确动态图同时利用电极距离与信号相关性,但未说明图的更新频率、相关性计算窗口、边权融合方式,以及 EEGNet 与 GAT 的具体连接位置;网络结构、损失函数和训练细节尚未验证。 数据与结果:研究使用 COG-BCI 数据集,涉及 N-Back 和 Multi-Attribute Task Battery-II(MATB-II)任务。作者报告,在其工作负荷分类评估中,N-Back 的 Accuracy 为 92.13%,MATB-II 的 Accuracy 为 96.08%,并称优于独立 EEGNet。摘要未提供被试数量、类别定义、数据划分、被试内或跨被试协议及 EEGNet 基线数值,因此不能据此量化增益或判断跨被试泛化能力;实验协议、消融及统计信息尚未验证。 复现与应用边界:复现时需核对预处理、分窗、图构建、训练与测试划分,以及动态图相对静态图和仅使用电极距离或信号相关性的贡献。作者提出该架构具有实时认知工作负荷估计潜力,但摘要未提供推理延迟、在线评估或实际部署结果,实时适用性尚未验证。

  5. OpenReview · State space models72

    DefMamba:可变形视觉状态空间模型

    基于摘要分析。DefMamba 针对视觉 Mamba 将图像按预定义扫描顺序展平成一维序列、难以充分利用空间结构的问题,提出结合多尺度骨干与 deformable mamba(DM)模块的视觉模型。其核心贡献是通过 deformable scanning(DS,可变形扫描)动态调整扫描路径,优先处理重要信息,以增强空间结构与目标细节的表征。 机制与结果:摘要将 DefMamba 称为视觉基础模型,但其预训练数据、规模与迁移设置尚未验证。动态扫描改变了特征进入序列处理的次序,而不只是采用固定遍历方式;扫描路径的生成方式、是否可微、训练目标及额外计算开销仍需正文确认。作者报告,DefMamba 在 image classification、object detection、instance segmentation 和 semantic segmentation 等视觉任务上达到领先性能;摘要未提供数据集、指标、划分或对照数值,因此目前无法评估收益幅度及不同任务间的一致性。作者称代码已开源,但材料未提供可核对的仓库地址。实验协议、消融及统计信息尚未验证。 平台推测(待验证):若动态扫描能够根据输入选择有意义的邻接关系,其机制可能用于缓解 EEG 时空序列展平后电极空间关系被弱化的问题;但图像规则网格与 EEG 电极拓扑并不等价。可复用的是 SSM 序列建模与自适应扫描思路,需改造的是电极位置编码、时空扫描约束和重要性估计。低信噪比下扫描可能追随伪迹,跨被试或通道配置变化可能使路径不稳定,小数据也可能不足以学习可靠路径。一个可证伪的小实验是在同一 EEG 任务、固定跨被试划分和匹配训练预算下,仅替换固定扫描与动态扫描,比较任务指标、路径稳定性及计算开销。此项迁移并非作者已验证结果,相关 EEG 工作尚未检索确认。

    阅读价值:值得核对其动态扫描路径如何保留空间结构,以及相对固定扫描的收益与计算代价;摘要中的领先性能结论仍需结合任务协议和对照实验验证。

  6. OpenReview · State space models70

    DSSM:用于人体动作生成的双状态空间模型

    基于摘要分析。该研究面向文本驱动的人体动作生成,针对词级文本描述与关节级动作表示之间特征信息量不均衡、影响潜在空间特征融合的问题,提出 Dual State Space Model(DSSM),通过从粗到细重建融合特征缓解模态间失衡。 机制上,DSSM 包含 Masked State Space Model(MSSM)与 Hierarchical State Space Block(HSSB)两个单元,并引入状态空间模型(SSM)以利用时序信息、降低计算复杂度。摘要未说明掩码对象、层级组织、融合位置、损失函数及训练与推理流程,这些细节尚未验证。作者声称这是首次将 SSM 引入文本驱动的动作序列生成,该优先性尚未独立核实。 作者报告,在 HumanML3D 与 KITML 基准数据集上达到 SOTA 表现;但摘要未提供具体指标、数值、数据划分或对照基线,因此无法判断优势幅度,也无法核对计算复杂度收益。实验协议、消融及统计信息尚未验证。摘要提供了 GitHub 代码地址,但代码完整性、依赖环境及复现条件尚未核验。 平台推测(待验证):其原问题是文本与动作序列的信息量不平衡,机制依赖文本—关节序列的跨模态对应关系;具体监督形式和训练规模尚未明确。假设 EEG 与文本或运动学信号的融合也受到模态信息量失衡影响,可考察粗到细融合重建与 SSM 时序建模的复用价值,但需改造 EEG 输入表示、通道处理及模态对齐方式。低信噪比、跨被试差异、通道配置变化与小数据可能使重建过程偏向更强模态,削弱 EEG 信息。一个可检验的小实验是在固定划分的配对 EEG—运动学任务中,对比常规融合与该重建机制,并通过削弱或移除 EEG 输入检验是否真正利用 EEG;这不构成已验证的 BCI 效果,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得关注其以 MSSM 与 HSSB 从粗到细重建文本—动作融合特征的机制,但作者报告的性能优势及其对 EEG 多模态融合的适用性尚需分别核对与验证。

  7. OpenReview · State space models71

    SSMLoRA:利用状态空间模型增强低秩适应

    基于摘要分析。SSMLoRA 针对语言模型参数高效微调中 LoRA 表现随插入位置变化、部分插入可能造成参数冗余的问题,引入状态空间模型(SSM)连接低秩矩阵,使适配过程能够利用前一低秩空间的计算,并支持更稀疏的插入。 机制上,摘要描述了输入到低秩空间的映射,以及低秩空间之间的计算复用;其目标不仅是减少可训练参数,还包括减少不必要的适配模块插入。SSM 状态如何传递、低秩矩阵如何连接、插入位置如何选择,以及训练损失与推理开销,均需全文核对,不能仅凭摘要确定具体结构。 作者报告,在 General Language Understanding Evaluation(GLUE)benchmark 上,SSMLoRA 使用 LoRA 一半的适配参数即可取得相当表现;这一结论限于摘要所述 GLUE 对照,基础模型、各任务指标、数据划分、低秩维度及参数统计口径尚未验证。作者还认为其结构有望处理更长输入序列,但摘要未提供长序列实验结果,因此不能视为已验证优势。实验协议、消融及统计信息尚未验证。摘要提供了代码仓库链接,代码完整性与可复现性仍待检查。 平台推测(待验证):若 EEG 预训练模型采用多处 LoRA 适配,可假设低秩空间之间的状态传递有助于减少插入点。可复用的是低秩适配与状态连接思路,需改造的是 EEG 骨干接口、跨模块状态定义及通道布局适配。该假设依赖可适配的预训练骨干和足够的任务监督;低信噪比、跨被试差异、通道变化及小样本可能使共享状态传播噪声或产生过拟合。一个可证伪的小实验是在固定跨被试划分与同一 EEG 骨干上,对比常规 LoRA、稀疏 LoRA 和 SSMLoRA,同时控制可训练参数预算与训练条件,检验收益是否来自状态连接而非参数配置。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得核对 SSM 连接低秩空间是否能降低 LoRA 对插入位置的敏感性:作者报告在 GLUE 上以一半适配参数取得相当表现,但具体参数口径、插入方案与评估协议尚未验证。

12月31日周二
  1. OpenReview · EEG66

    结合 EEGNet 与 SPDNet:面向想象言语解码的端到端架构

    基于摘要分析。该研究针对从 EEG 解码想象言语的问题,将 EEGNet 与 Cross-Covariance(CCV)矩阵表征结合,并采用 SPDNet 所提出的双线性变换提取判别特征,构建面向想象言语解码的端到端架构。想象言语指在不实际发声的情况下,在脑内模拟给定提示的发音过程。 技术机制上,研究尝试结合 CNN 特征学习与矩阵表征学习:EEGNet 提供卷积建模组件,CCV 矩阵提供另一种信号表示,双线性变换用于从矩阵中提取判别信息。摘要未说明 CCV 矩阵的具体构造、其与 EEGNet 的连接位置,以及满足 SPDNet 相关矩阵约束的处理方式;损失函数、训练流程和推理细节尚未验证。因此,目前能确认的是组件组合思路,不能据此还原完整网络结构。 作者报告,在两个公开数据集上,该方法达到与当时先进方法相当的性能,并在两个数据集上均显著优于 EEGNet。摘要未提供数据集名称、被试数量、评估指标、具体数值,也未交代被试内或跨被试等划分协议,因而无法量化增益或判断其泛化范围。 复现时应重点核对预处理、CCV 计算方式、矩阵约束及数值稳定性、各组件的训练衔接,以及与 EEGNet 对照时的数据划分和训练条件是否一致。实验协议、消融及统计信息尚未验证;代码和实现可得性亦需查阅全文或来源记录确认。

1月1日周一
  1. OpenReview · EEG73

    EEGMamba:用于 EEG 分类的双向状态空间模型与混合专家

    基于摘要分析。EEGMamba 面向不同任务中 EEG 信号长度、通道数不一致,以及 Transformer 长序列建模计算开销较大的问题,将 Spatio-Temporal-Adaptive(ST-Adaptive)模块、Bidirectional Mamba 和 Mixture of Experts(MoE)整合为统一的多任务 EEG 分类框架。 机制上,ST-Adaptive 通过空间自适应卷积对不同长度和通道数的 EEG 进行统一特征提取,并引入 class token 实现时间维度适配;摘要未说明具体的长度对齐与通道映射方式。Bidirectional Mamba 用于进一步提取 EEG 特征,作者旨在兼顾长序列处理的分类准确性与推理速度。Task-aware MoE 配置一个通用专家,以建模不同任务 EEG 的差异与共性;专家路由、任务信息如何输入以及训练损失尚未验证。 作者报告,在八个公开 EEG 数据集上进行了测试,覆盖癫痫发作检测、情绪识别、睡眠分期和运动想象四类任务,并报告性能优于对照方法。摘要未提供数据集名称、被试规模、评价指标、具体分数或对照基线,也未明确被试内、跨被试、跨会话或跨数据集划分,因此不能据此确认对未见任务的泛化能力,或量化准确性与速度之间的收益。 复现时应重点核对多任务联合训练与评估协议、异构通道和序列长度的处理,以及 ST-Adaptive、双向建模和通用专家各自的贡献;推理效率比较还需结合输入长度、硬件与计时条件。实验协议、消融及统计信息尚未验证。摘要称代码将于近期发布,当前材料不能确认代码已公开。

    阅读价值:值得核对 EEGMamba 如何通过输入适配、双向状态空间建模和任务感知专家机制处理异构 EEG,但其跨任务泛化与推理效率优势仍需结合全文中的训练划分和对照实验验证。

  2. OpenReview · State space models79

    VMamba:视觉状态空间模型

    基于摘要分析。本文研究如何构建计算高效的视觉网络,将状态空间语言模型 Mamba 适配为具有线性时间复杂度的视觉骨干 VMamba,核心贡献是用 2D Selective Scan(SS2D)处理二维视觉数据与一维选择性扫描之间的结构差异。 技术机制:VMamba 由 Visual State-Space(VSS)块堆叠构成,SS2D 沿四条扫描路径遍历二维数据,以收集不同来源和视角的上下文信息。作者据此构建一系列 VMamba 架构,并通过架构与实现层面的改进加速。摘要未给出具体扫描方向、状态更新公式、损失、训练配置及各加速措施,尚不能核对其计算开销与性能收益的来源。 结果与复现:作者报告,VMamba 在多种视觉感知任务上表现良好,相较现有基准模型具有更优的输入规模扩展效率。摘要未列出任务、数据集、指标、数值或对照配置,因此不能据此判断优势幅度,也不能将线性时间复杂度直接等同于实际运行速度。实验协议、消融及统计信息尚未验证。材料提供了源码仓库,但实现与论文版本的对应关系及完整复现条件仍需核对。 平台推测(待验证):迁移假设是将 EEG 的时间与通道,或时频表示,组织为二维输入,借用多路径选择性扫描建模上下文。原方法依赖二维结构,预训练数据规模与监督设置在摘要中未说明;EEG 的通道排列并不天然等同于图像邻接关系,因此可考察 SS2D 与 VSS 模块,但需改造输入编码、通道拓扑和任务输出。低信噪比、跨被试差异、缺失通道及小数据可能使扫描路径引入不稳定依赖或过拟合。一个可证伪的小实验是在固定 EEG 任务、训练预算与数据划分下,对比二维多路径扫描、仅时间扫描及常规基线,并扰动通道顺序,检验收益是否依赖人为排列;这不是论文已验证的结果,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其以四条扫描路径将一维选择性扫描适配到二维视觉数据的机制,以及输入规模扩展效率的评估;该机制对 EEG 的适用性尚未验证。

  3. OpenReview · State space models78

    VMamba:视觉状态空间模型

    基于摘要分析。本文研究如何构建计算高效的视觉网络,将状态空间语言模型 Mamba 迁移为具有线性时间复杂度的视觉骨干 VMamba,核心贡献是通过 2D Selective Scan(SS2D)适配二维视觉数据的结构。 机制上,VMamba 由 Visual State-Space(VSS)块堆叠构成,其中 SS2D 沿四条扫描路径遍历,以连接一维选择性扫描的有序处理方式与二维视觉数据的非序列结构,从不同方向汇集上下文信息。作者据此构建了一组 VMamba 架构,并通过架构与实现层面的改进加速。摘要未展开具体扫描顺序、状态更新形式、训练目标或加速实现,相关细节尚未验证。 作者报告,VMamba 在多种视觉感知任务中展现出良好性能,相较既有基准模型具有输入规模扩展效率优势。摘要未提供任务名称、数据集、数据划分、对照模型、数值指标及复杂度测量条件,因此不能据此量化性能提升,或将线性复杂度直接等同于实际运行速度优势。实验协议、消融及统计信息尚未验证。材料提供了公开代码仓库,复现仍需核对具体配置、训练预算与软硬件环境。 平台推测(待验证):若 EEG 被表示为通道×时间或时频二维结构,SS2D 的多方向上下文聚合可能用于建模长程依赖;这一假设依赖二维排列能够保留有意义的通道或时频关系,视觉领域结果不等于 EEG/BCI 效果。可考察复用 VSS 与扫描机制,但需改造输入编码、通道排列和任务输出。低信噪比、不规则电极布局、跨被试差异及小数据训练可能削弱收益,预训练与监督规模要求也尚未验证。一个可检验的小实验是在固定 EEG 数据划分、训练预算和相近模型容量下,对照多方向 SS2D 与单方向扫描,并扰动通道排列,观察任务指标及计算成本是否稳定改善。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其以四条扫描路径将一维选择性扫描适配到二维视觉数据的机制,并核对输入规模扩展效率的对照实验;该机制对 EEG 的适用性尚未验证。

  4. OpenReview · EEG66

    使用 EEGNet 和 Siamese Network 在多任务 EEG 数据库中进行个人身份识别与认证

    基于摘要分析。该研究面向 EEG 生物特征识别,分别采用 EEGNet 进行个人身份识别、采用结合 EEGNet 与 Siamese Network 的 SiamEEGNet 进行身份认证,并建立多任务 EEG 数据库用于评估。身份识别旨在判定个体身份,身份认证则通过两段 EEG 的特征距离或相似度判断身份是否匹配。 机制方面,身份识别模块直接输入预处理后的 EEG,将信号映射到嵌入空间以提取身份特征,并通过分类模块完成识别。SiamEEGNet 包含两个参数相同的 EEGNet 子网络,移除 EEGNet 的分类模块,加入距离度量层比较两个子网络的输出。摘要未明确训练损失、配对采样策略、距离函数及认证阈值的确定方式,这些细节尚未验证。 数据库包含 24 名被试、五种心理任务;每名被试参加四次会话,每次会话包含 125 个试次,会话间隔从数天至数月。该采集设计提供了考察任务变化与时间变化下身份特征稳定性的条件,但摘要未交代训练与测试划分,不能据此认定结果属于 Cross-session 或跨任务评估。 作者报告,在该数据库的身份识别实验中,平均识别 Accuracy 为 99.84%,并描述 F1 较高,但未提供具体 F1 数值;在身份认证实验中,SiamEEGNet 的 False Rejection Rate(FRR)为 2.29%,False Acceptance Rate(FAR)为 4.75%。上述结果的具体划分、任务组合及阈值背景尚未验证,不能直接与其他协议下的结果比较。 复现与应用评估应重点核对 EEG 预处理、会话隔离、认证配对构建、阈值选择、对照基线及统计信息,数据和代码的可获得性也尚未验证。摘要以传统生物识别的活体检测风险作为研究动机,但所述识别与认证指标本身不能证明系统具备抗伪造或活体检测能力。

1月1日周日
  1. OpenReview · State space models76

    用于语音识别的多头状态空间模型

    基于摘要分析。该研究针对语音识别中的序列建模,提出带特殊门控机制的多头状态空间模型 MH-SSM,使并行头学习局部与全局时间动态;同时提出以 MH-SSM 层增强 transformer 模块的 Stateformer。 机制与对照:MH-SSM 被设计为 transformer 编码器中多头注意力的可直接替换模块。作者报告,在 LibriSpeech 语音识别任务上,该架构显著优于 transformer transducer,但摘要未提供这一替换方案的具体分数及显著性检验细节。Stateformer 则采用增强 transformer 模块的方式,不能与完全替换注意力的方案混为一谈。门控形式、状态空间参数化、训练目标及推理实现尚未验证。 结果:作者报告,Stateformer 在不使用外部语言模型的条件下,开发集 word error rate 为 1.76%/4.37%,测试集为 1.91%/4.36%,并称其达到 LibriSpeech 任务的当时最优表现。摘要未明确两组数值对应的子集名称,因此不补写;训练数据配置、对照设置、消融及统计信息尚未验证,也不能据此推断其计算效率优势。 平台推测(待验证):假设局部与全局时间动态的并行建模能缓解 EEG 长序列中短时事件与较长时间依赖难以兼顾的问题,可尝试复用 MH-SSM 序列模块,但需改造 EEG 通道输入与任务输出。原任务依赖语音序列及语音识别监督,其收益对训练规模的依赖尚不清楚;低信噪比、通道差异、跨被试分布变化及小数据可能使门控学到噪声或被试特异模式。一个可证伪的小实验是在同一 EEG 任务、固定跨被试划分和训练预算下,仅将基线编码器的多头注意力替换为 MH-SSM,比较预先指定的任务指标与跨被试稳定性。已有 EEG 相关工作尚未检索确认。

    阅读价值:MH-SSM 通过带门控的并行状态空间头建模局部与全局时间动态,值得核对其替换及增强注意力模块的实现与对照,但语音识别收益能否迁移至 EEG 尚未验证。

  2. OpenReview · EEG56

    使用结合通道选择的改进图神经网络进行 EEG 情绪识别

    基于摘要分析:现有材料仅包含 Highlights,未取得论文全文。研究面向 EEG 情绪识别,提出结合通道选择的改进图神经网络,同时捕获通道内与通道间特征,并允许动态调整通道保留比例。 机制方面,材料指出图表示结合了功能连接,作者认为这种图具有更强的表征能力。通道选择使模型能够在不同通道保留比例下进行识别,但功能连接的计算方式、图的构建与更新策略、通道选择准则,以及通道内和通道间特征如何融合均尚未验证,不能据此推断具体网络结构或损失形式。 结果方面,作者报告模型在多个数据集上的平均 Accuracy 超过 90%,并在保留 20% EEG 通道的条件下达到超过 80% 的 Accuracy。材料未提供数据集名称、被试数量、被试内或跨被试协议、数据划分及对照基线,因此这些数字只能作为作者报告的概括性结果,不能用于跨协议比较,也不足以判断跨被试泛化能力。 复现时应核对通道选择是否仅利用训练数据、保留比例调整与性能评估的关系,以及功能连接图相对其他图构建方式的增益。上述内容是待核验事项,并非已确认的问题;实验协议、消融及统计信息尚未验证,代码与复现条件也尚未验证。

12月31日周五
  1. OpenReview · EEG60

    基于多特征联合学习的 EEG 视觉分类

    基于摘要分析。该研究针对 EEG 多类别视觉分类,采集被试观看不同类别图像时的 EEG,构建对应 80 个 ImageNet 对象类别的 image-EEG 数据集,并提出 dual-EEGNet 联合学习时空与时频特征。 核心机制是使用两个 EEGNet 分支:一个提取 EEG 信号的时空嵌入,另一个提取时频嵌入,以联合特征进行视觉类别识别。其可核对的研究价值在于考察两类表征是否具有互补性;摘要未说明时频变换、特征融合方式、网络具体配置、损失函数及训练流程,这些细节尚未验证。 作者报告,在所构建数据集上的多类别视觉分类实验中,联合特征模型相较其他方法具有更好的 Accuracy,并认为 EEG 能够反映观看不同类别图像时的脑活动差异。摘要未给出具体 Accuracy、对照方法或评估划分,因此不能判断该优势属于被试内、跨被试还是跨会话,也不能据此认定对未见图像或未见被试的泛化能力。 复现需核对被试数量、每类刺激与试次数、采集和预处理流程、训练与测试划分,以及两个分支各自贡献的消融结果。尤其需要确认图像、试次、被试和会话在划分中的组织方式,以明确分类结果的适用范围。实验协议、消融及统计信息尚未验证;数据与代码的公开情况也尚未验证。

1月1日周五
  1. OpenReview · EEG67

    基于层次图卷积网络的 EEG 情绪识别

    基于摘要分析。该研究针对 EEG 情绪识别中相邻电极关系与通道不对称信息利用不足的问题,提出基于层次图卷积网络(HGCN)的 ERHGCN,将多类 EEG 特征与空间关系建模结合,用于 valence(效价)和 arousal(唤醒度)分类。 方法先从五个频带提取六类特征:功率谱密度(PSD)、微分熵(DE)、差分不对称性(DASM)、比值不对称性(RASM)、不对称性(ASM)及 differential caudality(DCAU)。随后,HGCN 对纵向与横向相邻电极对采用不同处理方式,以提取更深层的空间特征;六类特征输入 HGCN 后,通过两个全连接层整合。摘要支持的主要方法特点是对两种方向的电极邻接关系进行差异化建模,而非仅依赖时间或频率特征。具体图构建、边权定义、层次结构、损失函数与训练流程尚未验证。 作者报告,在 DEAP 数据集上的 valence 和 arousal 分类任务中,Accuracy 分别为 90.56% 和 88.79%。摘要未说明这些数值对应被试内还是跨被试评估,也未提供训练与测试划分、分类标签设置或对照基线,因此不能据此判断跨被试泛化能力,或与不同协议下的结果直接比较。 复现与阅读时需核对:频带与特征计算方式、纵向和横向电极对的定义,以及空间关系建模相对单独使用频域或不对称性特征的贡献。实验协议、消融及统计信息尚未验证;代码与实现可用性也无法由当前材料确认。

  2. OpenReview · EEG72

    基于三维特征表示与空洞全卷积网络的 EEG 情绪识别

    基于摘要分析。针对高维 EEG 情绪识别中稳健且具有代表性的特征学习问题,研究提出结合三维特征表示与空洞全卷积网络的框架 3DFR-DFCN,将电极空间关系及频带相关信息组织为输入,并引入谱范数正则化以降低模型对受扰动 EEG 特征的敏感性。 方法首先将一维特征序列扩展为不同频带的二维电极网格,以利用通道间与频带间相关信息;再将多个激活模式下的电极网格构建为三维 EEG 数组,捕捉其互补信息。DFCN 对该数组进行跨频带、跨通道特征学习,谱范数正则化项(SNR)用于约束扰动敏感性。摘要未明确激活模式的定义、原始特征类型、三维数组各轴的具体组织方式及正则化的数学形式,这些细节尚未验证。 作者报告在 DEAP 和 DREAMER 上开展了被试依赖与被试独立实验。DEAP 上,两类实验按被试依赖/被试独立顺序,valence 分类平均 Accuracy 为 94.59%/81.03%,arousal 为 95.32%/79.91%,dominance 为 94.78%/80.23%。这些数值属于不同评估协议,不能混为单一性能结论;摘要未提供具体数据划分、分类标签设置、对照基线或 DREAMER 的结果数值。 研究的可核对价值在于检验空间与频带信息联合组织、空洞卷积及谱范数正则化各自的贡献,以及其在被试独立条件下的有效性。复现需核对特征提取流程、电极网格映射、激活模式构造、训练配置与划分协议;实验协议、消融及统计信息尚未验证。摘要提出该信息整合对实际或临床情绪评估有意义,但不能据此视为已完成临床有效性验证。

    阅读价值:值得核对其三维 EEG 特征组织与谱范数正则化如何支持跨通道、跨频带学习,以及 DEAP 上被试依赖与被试独立评估结果的差异,但具体划分和稳健性证据尚未验证。

  3. OpenReview · EEG65

    一种用于去除 EEG 肌肉伪迹的新型卷积神经网络模型

    基于摘要分析。该研究针对 EEG 中肌电(EMG)伪迹去除效果受限及模型过拟合的问题,提出一种特征维度逐渐增加、同时对时间序列进行下采样的卷积神经网络(CNN),探索网络架构对去噪性能与泛化能力的影响。 核心机制是沿网络处理过程逐步提高特征维度,并降低时间序列分辨率。摘要明确给出了这两项结构设计,但未提供具体层数、卷积配置、下采样方式、损失函数及训练细节,因此尚不能确定各设计对效果的独立贡献,也不能将作者观察到的改善归因于某一单独模块。 作者报告,在 EEGdenoiseNet 上,该模型显著优于四个基准网络,并相较其他类型的卷积网络大幅缓解过拟合。摘要未给出基准名称、评价指标、数值、数据划分或被试内/跨被试等协议背景,因而目前不能量化改进幅度,也不能确认其对真实采集 EEG 或跨被试场景的适用性。实验协议、消融及统计信息尚未验证。 复现时值得核对训练与测试数据的构建及划分方式、肌电污染条件、过拟合的判定依据,以及去除伪迹后是否保留有效 EEG 成分。作者将结果解释为深层网络架构可能有助于避免过拟合并改善 EMG 伪迹去除;这一解释仍需结合全文中的对照与消融证据评估。代码、模型配置及完整复现条件尚未验证。

1月1日周三
  1. OpenReview · EEG65

    基于堆叠可微分神经计算机的 EEG 数据分析

    基于摘要分析。研究围绕如何扩展可微分神经计算机(Differentiable Neural Computer,DNC)的学习能力并用于 EEG 数据分析,提出堆叠增强版 DNC 的架构。核心贡献是将原有 Long Short-Term Memory(LSTM)控制器替换为循环卷积网络控制器,并调整记忆访问结构,以处理 EEG 地形图数据。 机制方面,作者先通过与常规循环神经网络对比,对 DNC 的架构本质给出直观解释,并讨论其可堆叠性;随后提出面向 EEG 的堆叠架构。摘要明确涉及控制器、记忆访问与堆叠三个设计环节,但未提供堆叠层数、模块连接方式、记忆读写细节、损失函数或训练流程。循环卷积控制器如何利用 EEG 地形图的空间结构,以及不同改造分别贡献多少性能,尚需核对正文。 结果方面,作者报告在一个开源 EEG 数据集上获得比较中的最高平均 Accuracy;在一个专有 EEG 数据集上,经参数微调后获得比较中的最低平均误差。摘要未给出数据集名称、具体任务、数值、对照基线、被试数量或数据划分,也未说明属于被试内、跨被试还是跨会话评估,因此不能据此判断提升幅度或泛化能力,两种指标也不能直接互换比较。作者还通过分析训练后模型的行为特征,讨论堆叠 DNC 用于 EEG 信号处理的适用性与潜力;具体分析证据尚未验证。 复现时应优先核对 EEG 地形图构建方法、控制器与记忆访问实现、微调协议及基线设置,并确认开源数据的获取条件和专有数据结果的可复核范围。实验协议、消融及统计信息尚未验证;摘要提及数据集开源,不等于模型代码或权重已公开。