跳到正文

算法、任务与模态

SSM 最新动态

SSM 研究索引;按可核对的标签归档,不以热度评价质量。

119 条精选近 30 天 15 条共收录 158 条

更新

精选归档 · 第 6 页

1月1日周一第 101–119 条
  1. OpenReview · State space models71

    Pan-Mamba:基于状态空间模型的有效全色锐化

    基于摘要分析。Pan-Mamba 研究全色锐化问题,即融合低分辨率多光谱图像与高分辨率全色图像,生成高分辨率多光谱图像;其核心贡献是利用 Mamba 的全局信息建模能力,并设计两个面向跨模态交互与融合的组件。 机制方面,channel swapping Mamba 通过交换部分全色与多光谱特征通道,开展轻量级跨模态交互;cross-modal Mamba 则利用模态之间的内在关系增强信息表示。摘要未提供具体状态空间参数化、特征序列化方式、损失函数、训练与推理设置,不能据此确定网络结构细节或计算成本。 作者报告,在多个数据集上的实验中,Pan-Mamba 超过所比较的当前先进方法,获得更好的全色锐化融合结果;但摘要未给出数据集名称、划分、基线、指标或数值,因此尚不能判断优势幅度及不同评估协议下的稳健性。作者将该工作描述为首次探索 Mamba 在全色锐化中的潜力,此优先性主张尚未独立核实。摘要提供了源码地址,但实现与复现条件尚未验证;实验协议、消融及统计信息亦尚未验证。 平台推测(待验证):迁移假设是将跨模态信息交换机制用于 EEG 与其他同步信号的融合,而非直接复用图像锐化网络。原任务依赖空间对应且分辨率互补的图像输入;EEG 场景需重新定义时间对齐、通道映射、特征序列化和任务监督。可能复用的是跨模态交换与融合模块,需改造的是输入表示及输出目标。低信噪比、跨被试差异、通道缺失和小数据可能使交换特征引入噪声或过拟合。一个可证伪的小实验是在固定数据划分与相近参数预算下,对同步 EEG 多模态任务比较简单融合、加入 channel swapping 及进一步加入 cross-modal Mamba 的表现,并测试模态噪声扰动下的稳定性;这不构成已验证的 BCI 效果,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其 channel swapping Mamba 与 cross-modal Mamba 如何实现跨模态信息交换,但融合优势及向 EEG 多模态任务迁移的有效性仍需核对实验与验证。

  2. OpenReview · State space models73

    SMamba:通过可伸缩状态空间模型实现任意尺度超分辨率

    基于摘要分析。该研究针对任意尺度超分辨率(ASSR),提出正文称为 S³Mamba 的方法,利用 Scalable State Space Model(SSSM)构建由低分辨率图像导出的可伸缩连续表示空间,使单一模型能够处理不同放大尺度。其核心贡献是将尺度调制引入状态空间模型的离散化过程,并结合尺度感知自注意力增强不同尺度下的全局重要特征感知。 机制与创新:ASSR 借助 Implicit Neural Representations(INR)建立坐标与像素值的连续表示,突破固定放大倍数的限制。作者认为,现有 CNN 和 Transformer 方法面临计算复杂度及长程依赖建模方面的挑战。SSSM 在离散化时调制状态转移矩阵与步长采样矩阵,作者声称由此实现线性计算复杂度的连续表示建模。摘要未给出调制函数、尺度条件的具体输入方式、训练损失及推理流程;线性复杂度对应的计算范围,以及加入自注意力后的整体开销,尚需全文核对。 结果与证据边界:作者报告,在合成与真实场景基准上取得最先进性能,并在任意超分辨率尺度下表现出较强泛化能力。摘要未列出数据集名称、训练与测试尺度划分、对照基线、指标或具体数值,因此不能判断未见尺度上的收益及适用边界。实验协议、消融及统计信息尚未验证。 平台推测(待验证):可迁移的假设是,尺度条件化的状态空间离散化可能用于 EEG 不同采样间隔下的连续时间表示;但图像空间放大与 EEG 时间采样变化并非同一任务,原领域结果不能视为 BCI 有效性的证据。可考虑复用条件化离散化模块,将图像坐标与像素监督改为时间坐标和信号重建监督,并处理通道拓扑及抗混叠约束。低信噪比、跨被试差异、通道不一致和小数据可能使模型主要拟合插值规律。一个可证伪的小实验是在固定被试划分及统一抗混叠降采样流程下,对比该模块、普通状态空间模型和传统插值在未见采样间隔上的重建误差及下游任务表现。相关 EEG 工作尚未检索确认。

    阅读价值:值得核对其通过尺度调制状态空间离散化来构建连续表示的机制,以及线性复杂度的适用范围;作者报告的任意尺度泛化优势仍需结合全文实验协议验证。

  3. OpenReview · State space models77

    STREAM:面向稀疏几何数据的通用状态空间模型

    基于摘要分析。STREAM 面向点云、事件视觉等稀疏且非结构化的几何数据,将几何结构显式编码进状态空间模型的参数化,而不是仅依赖序列化预处理及模型自行推断几何关系。其核心贡献是利用坐标的相对差异控制状态空间模型的步长,并基于 Mamba selective state-space model 与修改后的 CUDA kernel 实现高效计算。 机制上,状态空间模型的线性动态由时间或空间坐标等一维变量驱动,STREAM 将相对坐标差注入这一动态变量对应的步长。作者称,由此形成的几何操作可在 O(N) 步中计算 N 个点之间的全点对交互;该表述不应直接等同于已验证的端到端运行时间或显存复杂度,具体交互定义、点的遍历顺序与实现条件尚需正文核对。 作者报告,在从头训练的 ModelNet40 和 ScanObjectNN 点云分析任务中,STREAM 改善了 PointMamba 基线表现,但摘要未提供具体指标数值。作者还报告,在 DVS128 Gestures 数据集全部 11 个类别的测试中取得 100% Accuracy,并声称这是首次达到该结果;测试划分、预处理、重复实验及统计信息尚未验证。摘要另称模型在事件视觉和音频分类等基准上具有竞争力,具体对照与实验协议尚未验证。 平台推测(待验证):假设相对坐标驱动的状态更新能保留不规则采样结构,它可能对应 EEG 中不规则时间采样或稀疏电极空间建模的问题。可考虑复用状态更新机制,但需改造 EEG 信号的点表示、时空坐标及遍历方式;低信噪比、跨被试差异、通道缺失与小数据训练都可能削弱该归纳偏置。一个可检验的小实验是在固定 EEG 数据划分和相同输入表示下,比较相对坐标步长与固定步长,并测试通道缺失时的性能变化。此为迁移假设,不是已证实的 BCI 收益;相关 EEG 工作尚未检索确认。复现还需核对完整模型配置、CUDA kernel、训练条件及代码可用性。

    阅读价值:值得核对 STREAM 将相对坐标差注入状态空间步长的机制及其修改后的 CUDA 实现,以评估稀疏几何归纳偏置的收益;摘要中的全点对交互与测试准确率仍需结合完整实验协议验证。

  4. OpenReview · State space models72

    VmambaIR:用于图像恢复的视觉状态空间模型

    基于摘要分析。VmambaIR 面向从退化输入恢复高质量图像的问题,将 State Space Models(SSMs)引入图像恢复,旨在兼顾长程依赖建模与计算效率。其核心贡献是采用 Unet 架构堆叠 Omni Selective Scan(OSS)块,以多方向扫描缓解 SSM 的单向建模限制。 机制方面,每个 OSS 块由 OSS 模块与 Efficient Feed-Forward Network(EFFN)组成。作者提出的 omni selective scan 对六个方向的图像信息流进行建模,并将 SSM 的线性复杂度作为相对于 Transformer 二次复杂度的效率优势。摘要未说明六个方向的具体定义、扫描与融合方式、EFFN 结构、损失函数及训练策略,这些细节尚未验证。 作者报告,在 image deraining、single image super-resolution 和 real-world image super-resolution 等任务中,VmambaIR 达到 SOTA,同时使用更少的计算资源与参数。摘要未提供数据集、数据划分、对照模型、评价指标或资源测量条件,因此该结论目前只能作为作者报告,不能据此量化优势或比较不同任务的性能。实验协议、消融及统计信息尚未验证。 平台推测(待验证):该方法原本依赖具有空间邻接关系的图像数据;多方向扫描与高效长程建模可能为 EEG 去噪提供机制参考,但原领域有效不等于 BCI 有效。可考虑复用 SSM 与扫描模块,需改造时间—通道表示、扫描顺序及训练目标,并核对是否依赖成对退化/参考信号监督。低信噪比、跨被试差异、不规则通道布局和小数据可能削弱效果,恢复过程也可能损伤 ERP 等任务相关成分。一个可证伪的小实验是在固定被试划分与噪声条件下,比较单向扫描和多方向扫描的 EEG 去噪误差、ERP 波形保真度及资源开销,检查效率收益是否伴随信号失真。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其 Omni Selective Scan 如何以线性复杂度缓解 SSM 的单向建模限制,并核对图像恢复效果与资源开销的对照证据;其对 EEG 的适用性尚未验证。

  5. OpenReview · State space models76

    GrassNet:状态空间模型与图神经网络的结合

    GrassNet 针对谱图神经网络中多项式滤波器低阶截断、缺乏图谱整体建模的问题,引入结构化状态空间模型(SSMs)来学习图谱滤波器。基于摘要分析,未取得论文全文。 核心机制是利用 SSMs 建模图信号在不同频率上的关联,并为图谱中的各频率生成特定校正。作者指出,传统多项式方法对相同频率的信号施加相同调制,在谱高度集中或存在大量数值相同的谱值时可能受到限制;作者声称 GrassNet 能学习任意图谱滤波器,并在理论上具有比多项式滤波器更强的表达能力。如何定义频率序列、如何处理重复特征值及对应特征空间、表达能力结论依赖哪些假设,均需查阅正文核对。 作者报告,在九个公开基准上的实验显示 GrassNet 在真实图建模任务中表现优于对照方法。摘要未提供基准名称、任务、划分、对照配置或具体指标,因此不能量化收益或判断不同协议下的可比性;实验协议、消融及统计信息尚未验证。实现、计算成本和复现条件也尚未验证。 平台推测(待验证):假设 EEG 被表示为具有明确拉普拉斯算子的通道图,GrassNet 的跨图谱频率关联建模可能用于检验多项式滤波表达受限这一瓶颈;这里的图谱频率不等同于 EEG 的时间频率。可考虑复用谱滤波机制,但通道图构建、时间信息整合和跨被试图对齐需要改造。低信噪比可能使图结构不稳定,通道变化可能改变谱基,小数据也可能增加过拟合风险。一个可证伪的小实验是在固定 EEG 通道图、相同时间编码器和相同跨被试划分下,对比 GrassNet 滤波与多项式滤波,并检查收益对图构建及通道扰动的敏感性。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得核对 GrassNet 如何利用 SSM 建模跨频率关联,以及其处理重复谱值和提升滤波表达能力的理论条件,这些机制为评估谱图方法在 EEG 图建模中的适用性提供了具体切入点。

  6. OpenReview · State space models72

    DGMamba:通过广义状态空间模型实现域泛化

    基于摘要分析。该研究针对视觉域泛化中的分布偏移问题,提出 DGMamba,尝试在保留 Mamba 全局感受野与线性复杂度优势的同时,减少隐藏状态和图像扫描机制对域特异信息的依赖。 框架包含 Hidden State Suppressing(HSS)与 Semantic-aware Patch refining(SPR)。HSS 用于减弱与域特异特征相关的隐藏状态对输出预测的影响。SPR 旨在让模型更关注对象而非上下文,其中 Prior-Free Scanning(PFS)打乱图像中的非语义 patch,以形成更灵活的序列;Domain Context Interchange(DCI)通过跨域融合 patch,将不匹配的非语义与语义信息组合起来,对 Mamba 进行正则化。摘要未提供隐藏状态筛选、语义识别、扫描操作及损失函数的具体实现,尚不能据此重建模型。 作者报告,在四个常用域泛化 benchmark 上,DGMamba 相较现有先进模型取得更优结果;摘要未列出 benchmark 名称、域划分、对照基线或指标数值,实验协议、消融及统计信息尚未验证。作者表示代码将公开,不等同于代码已可获取。 平台推测(待验证):其潜在 EEG 迁移路径是抑制被试或会话相关的域特异状态,以缓解跨被试、跨会话分布偏移。但原方法依赖图像 patch 的语义与上下文区分,以及跨域 patch 融合;EEG 中哪些时段、通道或频段属于任务信息而非背景信息,需要重新定义,不能直接套用对象与背景的划分。可尝试复用状态抑制思路,改造序列构建和跨域融合模块;低信噪比、通道差异及小数据可能导致任务相关状态被误抑制,或融合产生不合理信号。一个可证伪的小实验是在固定的跨被试 EEG 划分下,比较基础 Mamba 与仅加入 HSS 改造的版本,核对域信息降低是否伴随任务性能改善。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得核对的是 DGMamba 如何通过隐藏状态抑制与语义感知 patch 处理降低域特异信息影响;这些机制提供了域泛化研究的具体切入点,但摘要中的性能优势及其 EEG 可迁移性尚未验证。

  7. OpenReview · State space models70

    PhysMamba:用于远程生理测量的状态空间对偶模型

    基于摘要分析。该研究针对从面部视频提取生理信号的 Remote Photoplethysmography(rPPG)在现实环境中受运动伪迹与噪声干扰的问题,提出 PhysMamba,以基于 State Space Duality 的双路径时频交互学习更具代表性的特征。这是一项远程生理测量方法研究,不是直接的 EEG 或 BCI 验证。 核心机制是通过两条路径开展时频信息交互,并使用改进的 Cross-Attention State Space Duality(CASSD)促进路径间的信息交换与特征互补。摘要未说明两条路径的具体输入表示、CASSD 的计算形式、损失函数或训练与推理流程,这些技术细节尚未验证。 作者报告在 PURE、UBFC-rPPG 和 MMPD 数据集上进行了对比实验,并声称 PhysMamba 达到最先进性能,尤其适用于复杂环境。但摘要未提供具体指标、数值、数据划分、对照方法及复杂环境的定义,因此无法判断优势大小或不同评估协议下的泛化能力。实验协议、消融及统计信息尚未验证;复现还需核对视频预处理、参考生理信号、训练配置和实现可用性。 平台推测(待验证):若双路径时频互补确实能增强抗噪能力,其机制可能对应 EEG 中时域动态与频谱线索联合建模的需求。迁移需将面部视频输入模块改造为多通道 EEG 表征,并明确监督信号与数据规模,不能假定视频运动伪迹与 EEG 伪迹具有相同结构。低信噪比、跨被试差异、通道配置变化和小数据训练可能削弱交互模块的收益。一个可证伪的小实验是在固定 EEG 数据划分与匹配模型容量下,比较单路径、双路径无交互及加入 CASSD 的版本,并在相同噪声条件下评估;这仅是迁移假设,不是论文已验证结果。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得核对 PhysMamba 的双路径时频交互与 CASSD 如何应对运动伪迹和噪声,但摘要中的领先性能主张及其向 EEG 的迁移价值尚需验证。

  8. OpenReview · State space models72

    MambaVLT:用于视觉-语言跟踪的时间演化多模态状态空间模型

    基于摘要分析。MambaVLT 针对视觉-语言跟踪中时序信息利用不足、参考特征难以动态更新的问题,提出基于 Mamba 的多模态状态空间模型,通过随时间演化的状态表示支持目标跟踪,并自适应调节视觉与语言参考的权重。 机制方面,模型包含 time-evolving hybrid state space block 和 selective locality enhancement block,用于捕获多模态上下文信息与自适应更新参考特征;另设 modality-selection module,动态调整视觉和语言参考的权重,以缓解任一参考模态可能产生的歧义。摘要将 Mamba 状态演化的时序记忆能力与线性复杂度作为方法动机,但具体状态更新公式、模块连接、损失、训练流程及端到端计算开销尚未验证。 作者报告,该方法在多个基准上相较先进跟踪器表现良好;摘要未提供基准名称、数据划分、对照模型或量化指标,因此尚不能判断优势幅度及适用条件。实验协议、消融及统计信息尚未验证,代码与复现条件也需核对全文。 平台推测(待验证):其原问题依赖连续视觉序列及视觉、语言参考,时序状态更新与动态模态选择可能为 EEG 与辅助模态融合提供机制参考,对应长时序建模和模态可靠性变化的瓶颈;这不代表已验证的 EEG/BCI 效果。可考虑复用状态更新和模态选择思路,但需改造输入编码、时间对齐、参考表示与任务输出。EEG 的低信噪比、跨被试差异、通道变化及小数据可能导致状态累积噪声或模态权重失稳。一个可检验的小实验是在固定被试和划分的 EEG 多模态任务中,保持编码器与训练预算一致,对比固定融合与动态模态选择,并在辅助模态受扰时检验性能变化。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其如何利用随时间演化的状态空间更新多模态参考特征,以及动态调节模态权重;具体性能优势与 EEG 迁移价值尚未验证。

  9. OpenReview · State space models71

    基于残差分析的非线性响应状态空间模型改进

    基于摘要分析。本文研究具有未知非线性响应的状态空间模型学习问题,以神经网络近似观测方程中的未知非线性部分,并提出基于残差分析的迭代算法,改善隐状态推断与参数估计。 机制上,模型保留线性状态方程,观测方程则包含线性与非线性部分,其中非线性部分的结构未知。算法利用线性模型的残差学习这一未知项,再迭代改进模型。作者称可通过 minorization-maximization 原理说明迭代改进性质;具体优化目标、更新步骤、神经网络结构及成立条件尚未验证。 作者报告,在一个数值示例和电池容量估计案例中,该方法的参数估计与隐状态推断优于既有工具。摘要未提供评价指标、数值结果、基线名称或数据划分,因此不能判断收益幅度及适用范围;实验协议、消融及统计信息尚未验证。复现需核对全文中的模型定义、初始化、残差构造、交替更新与停止条件,以及案例数据和实现可用性。 平台推测(待验证):若 EEG 时序可近似为线性潜在状态演化与非线性观测映射,该机制可能用于修正线性状态空间模型的观测偏差。可复用的是残差驱动的非线性拟合与迭代估计思路;需改造的是 EEG 多通道观测映射及噪声模型。摘要未说明原任务的数据规模和监督需求。低信噪比可能使残差学习吸收伪迹而非有效信号,小数据以及被试、通道差异也可能削弱稳定性。一个可检验的小实验是先在具有已知潜在状态的 EEG 风格模拟数据上,固定训练与测试划分,对比线性模型和残差改进模型,分别检查状态恢复与观测预测误差,并改变噪声强度以检验收益是否稳健。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读的是以线性模型残差学习未知非线性观测项、并用 minorization-maximization 原理支持迭代改进的机制,但其对 EEG 隐状态估计的适用性尚未验证。

  10. OpenReview · State space models74

    Mamba-CL:在零空间中优化选择性状态空间模型以实现持续学习

    基于摘要分析。该研究面向持续学习中的灾难性遗忘,提出 Mamba-CL,通过在历史任务特征子空间的正交方向更新参数,持续微调大规模 Mamba 基础模型的核心 SSM,力求保留既有知识并学习新任务。 核心机制是将参数更新限制在历史特征子空间对应的零空间内。作者围绕 Mamba 的四个关键时不变参数推导整体一致性约束,处理 SSM 的递归状态空间结构与非线性离散化过程,再以零空间投影实现正交更新。作者声称,该方法在理论上保证各 SSM 模块在先前与当前任务上的输出一致性目标;具体保证的假设、约束范围,以及模块级一致性如何对应最终任务性能,需结合全文核对。 作者报告,在四个类别增量学习基准上,Mamba-CL 展现出抗遗忘效果,性能优于所比较的先进方法。摘要未提供基准名称、任务序列、数据划分、指标或具体数值,因此无法判断提升幅度及不同协议下的可比性。实验协议、消融及统计信息尚未验证。摘要称代码位于补充材料中,但其可获取性、运行配置与复现要求尚未核对。 平台推测(待验证):该机制可能对应 EEG 持续学习中新增类别或连续会话更新引起的遗忘,但依赖历史特征子空间能稳定表征需保留的知识。可复用的是零空间投影与参数一致性约束;需改造的是 EEG 时序输入、通道适配和特征子空间估计。低信噪比、跨被试差异、通道变化及小样本可能使子空间估计不稳定,或过度限制更新、妨碍新任务学习。一个可检验的假设是:在固定 EEG 类别增量协议下,使用相同 Mamba 骨干与数据划分,对照普通顺序微调和零空间约束更新,检验历史类别 Accuracy 的保留是否以新类别学习能力下降为代价。上述迁移不属于本文已验证结果,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得核对其针对 Mamba 核心 SSM 参数推导的一致性约束与零空间投影实现,尤其是理论保证的适用条件及抗遗忘与新任务学习能力之间的权衡。

  11. OpenReview · State space models78

    MambaByte:无 token 的选择性状态空间模型

    基于摘要分析。MambaByte 研究直接从原始字节学习的无 token 语言建模,旨在避免子词分词的归纳偏置,同时缓解字节序列更长带来的计算与内存压力。其核心贡献是将 Mamba 状态空间模型(SSM)用于字节序列的自回归训练,并提出结合 tokenized drafting 与 byte-level verification 的推测解码适配方案。 机制上,摘要将标准自回归 Transformer 随序列长度增长的内存需求,与 Mamba 的固定大小记忆状态及高效解码进行对照。MambaByte 的建模单位是字节,而非子词;推测解码则用 token 化序列生成草稿,再在字节层面验证。具体状态更新、选择性机制、训练损失及草稿验证流程尚未验证。 作者报告,MambaByte 在语言建模任务上可与先进的子词 Transformer 竞争,部分表现更优,并保留无 token 模型的噪声鲁棒性优势。作者还报告,其推测解码适配方案相较标准 MambaByte 实现获得 2.6 倍推理加速,解码效率与子词 Mamba 相近。摘要未提供对应数据集、模型规模、任务指标、硬件、生成长度及对照配置,因此这些结果只能在作者所述比较范围内理解,实验协议、消融及统计信息尚未验证。 平台推测(待验证):其固定大小状态机制可能对应 EEG 长时序处理中随窗口长度增长的资源瓶颈,但字节语言建模依赖离散序列与自回归监督,不能直接等同于连续、多通道 EEG 建模。可考察 SSM 主干的复用,输入编码与训练目标需改造;tokenized drafting 的优势是否成立则取决于 EEG 是否存在合适的离散草稿表示。低信噪比、跨被试分布差异、通道变化及小数据可能削弱效果。一个可检验的小实验是在固定数据划分和参数预算下,比较 SSM 与 Transformer 在不同 EEG 窗口长度上的任务指标、峰值内存及推理延迟。上述仅为迁移假设,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其以固定大小状态处理长字节序列的机制,以及结合 tokenized drafting 与 byte-level verification 的推测解码方案;摘要中的语言建模与效率结论仍需结合完整实验协议核对。

  12. OpenReview · State space models73

    SMamba:通过可伸缩状态空间模型实现任意尺度超分辨率

    基于摘要分析。研究针对任意尺度超分辨率(ASSR):用单一模型将低分辨率图像重建为任意目标尺度的高分辨率图像。作者提出正文称为 S³Mamba 的方法,通过 Scalable State Space Model(SSSM)构建可随尺度调整的连续表示空间,并结合尺度感知自注意力提取不同尺度下的重要全局特征。 机制上,摘要将隐式神经表示(INR)描述为连接坐标与像素值、重建连续信号的途径。SSSM 在离散化过程中调制状态转移矩阵及步长采样矩阵,作者称由此实现具有线性计算复杂度的连续尺度建模。尺度感知自注意力用于补充不同尺度下的全局特征感知;具体调制公式、尺度条件的注入方式、训练损失,以及线性复杂度是否涵盖完整网络,尚未验证。 作者报告,在合成与真实场景基准上的实验取得了最先进的性能及任意超分辨率尺度下的泛化能力。摘要未提供基准名称、训练与测试尺度划分、对照方法、指标或数值,因而尚不能核对其提升幅度,或区分已见尺度与未见尺度的泛化。实验协议、消融及统计信息尚未验证;代码与复现条件亦未确认。 平台推测(待验证):假设该尺度条件化的连续表示机制可用于 EEG 时间轴重采样或缺失采样点重建,其潜在对应问题是不同采样率下的信号表示一致性,而不是直接提升 BCI 分类效果。可考虑复用尺度调制的状态空间模块,但需将二维图像坐标改为时间坐标,并处理通道结构、频带约束与抗混叠;原任务依赖低分辨率输入及高分辨率重建目标,迁移所需监督和数据规模尚不明确。低信噪比、小样本及跨被试差异可能使模型重建伪波形或失真频谱。一个可证伪的小实验是在按被试隔离的数据上,对高采样率 EEG 进行抗混叠降采样,比较该机制与常规插值在未见采样比例下的波形、频谱及下游任务表现。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得核对其通过离散化过程中的状态转移与步长采样调制实现连续尺度建模的机制,尤其是线性复杂度的适用范围及尺度外泛化证据;其对 EEG 的价值尚未验证。

  13. OpenReview · State space models73

    探索视觉状态空间模型对后门攻击的鲁棒性

    基于摘要分析。该研究考察 Visual State Space Model(VSS)对后门攻击的鲁棒性,重点分析状态空间模型(SSM)机制与图像 patch 处理如何影响触发器的有效性,并据此研究一种在每个 patch 中重复出现、旨在抵抗 patch 扰动的后门触发方式。 后门攻击使受感染模型在特定触发器出现时输出目标标签,而在正常样本上保持正常行为。作者报告,在所考察的不同触发器与模型对照中,SSM 捕获 patch 内上下文信息的机制使 VSS 比不含 SSM 的模型更容易受到后门触发器影响;另一方面,所测试的 patch 处理方式能够有效破坏这些触发器。逐 patch 重复触发的设计针对这一现象,试图使后门在 patch 扰动下仍然有效。摘要未提供具体触发器形式、投毒过程或 patch 处理操作。 作者报告,在三个数据集及多种后门攻击的实验范围内,VSS 的后门鲁棒性与 Transformers(ViTs)相近,但低于仅堆叠 Gated CNN blocks、不含 SSM 的 Gated CNNs。数据集名称、模型配置、训练与评估划分、投毒比例、攻击成功率及正常样本性能尚未验证,因此不能据此作定量比较或推广到所有 VSS 架构。实验协议、消融及统计信息尚未验证,复现时应重点核对架构对照是否控制了训练条件,以及 patch 处理对正常任务性能的影响。 平台推测(待验证):如果 EEG 分类模型也采用分段 token 与 SSM 上下文建模,重复的局部触发模式可能形成类似安全风险,但图像 patch 结论不能直接外推到 EEG。可复用的是局部触发、分段扰动与无 SSM 对照的评估思路;需改造的是适合 EEG 时间段及通道结构的触发方式。低信噪比、跨被试差异、通道布局变化和小数据条件均可能改变触发效果。一个可检验的小实验是在固定 EEG 数据划分和训练条件下,对比 SSM 与非 SSM 模型受到单段及重复分段触发时的攻击成功率和正常样本 Accuracy,同时评估分段扰动的影响。相关 EEG 后门研究尚未检索确认。

    阅读价值:该研究通过后门触发器与 patch 处理的对照分析考察 SSM 的安全风险,值得核对其能否区分 SSM 机制本身与其他架构、训练因素的影响。

1月1日周日
  1. OpenReview · State space models76

    用于语音识别的多头状态空间模型

    基于摘要分析。该研究针对语音识别中的序列建模,提出带特殊门控机制的多头状态空间模型 MH-SSM,使并行头学习局部与全局时间动态;同时提出以 MH-SSM 层增强 transformer 模块的 Stateformer。 机制与对照:MH-SSM 被设计为 transformer 编码器中多头注意力的可直接替换模块。作者报告,在 LibriSpeech 语音识别任务上,该架构显著优于 transformer transducer,但摘要未提供这一替换方案的具体分数及显著性检验细节。Stateformer 则采用增强 transformer 模块的方式,不能与完全替换注意力的方案混为一谈。门控形式、状态空间参数化、训练目标及推理实现尚未验证。 结果:作者报告,Stateformer 在不使用外部语言模型的条件下,开发集 word error rate 为 1.76%/4.37%,测试集为 1.91%/4.36%,并称其达到 LibriSpeech 任务的当时最优表现。摘要未明确两组数值对应的子集名称,因此不补写;训练数据配置、对照设置、消融及统计信息尚未验证,也不能据此推断其计算效率优势。 平台推测(待验证):假设局部与全局时间动态的并行建模能缓解 EEG 长序列中短时事件与较长时间依赖难以兼顾的问题,可尝试复用 MH-SSM 序列模块,但需改造 EEG 通道输入与任务输出。原任务依赖语音序列及语音识别监督,其收益对训练规模的依赖尚不清楚;低信噪比、通道差异、跨被试分布变化及小数据可能使门控学到噪声或被试特异模式。一个可证伪的小实验是在同一 EEG 任务、固定跨被试划分和训练预算下,仅将基线编码器的多头注意力替换为 MH-SSM,比较预先指定的任务指标与跨被试稳定性。已有 EEG 相关工作尚未检索确认。

    阅读价值:MH-SSM 通过带门控的并行状态空间头建模局部与全局时间动态,值得核对其替换及增强注意力模块的实现与对照,但语音识别收益能否迁移至 EEG 尚未验证。

1月1日周五
  1. OpenReview · State space models80

    深度状态空间高斯过程

    基于摘要分析。研究针对深度高斯过程(DGP)回归的状态空间建模与计算问题,通过层级随机微分方程表示,将回归转化为可序贯求解的状态估计问题,并提出状态空间 MAP、贝叶斯滤波与平滑方案。 核心机制是在层级结构中,对下一层 GP 的长度尺度和幅度赋予经过变换的 GP 先验,使这些参数能够随输入变化。作者将该结构表示为由线性随机微分方程(SDE)组成的非线性层级系统,其中每个 SDE 对应一个条件 GP;利用状态空间 DGP 的马尔可夫性质进行序贯估计。作者报告计算复杂度随观测数量线性增长,但摘要未提供状态维度、计算常数及具体运行时间,不能据此判断相对其他 DGP 实现的实际加速幅度。 作者报告在合成非平稳信号上展示模型与方法的表现,并将其用于 LIGO 测量中的引力波检测。摘要未给出定量指标、数据划分或对照结果;具体核函数、状态空间表示条件、推断近似、实验协议、消融及统计信息尚未验证。 平台推测(待验证):该机制可能对应 EEG 中局部平滑程度与幅度随时间变化的非平稳建模需求。迁移假设依赖时间序列结构、观测模型和可用数据规模,可复用层级先验及滤波/平滑框架,但需要改造多通道观测与噪声模型,并核对所选 GP 的 SDE 表示条件。低信噪比可能使幅度变化与伪迹混淆,通道增加可能抬高状态估计成本,小数据与跨被试差异也可能造成先验失配。可先在固定被试内划分下,比较该方法与平稳状态空间 GP 对遮蔽 EEG 片段的重建误差、预测不确定性及运行时间,检验非平稳层级建模是否带来收益;这不等同于验证 BCI 解码效果。相关 EEG 工作尚未检索确认。

    阅读价值:值得阅读其将层级非平稳 GP 回归转化为序贯状态估计的机制;作者报告计算复杂度随观测数量线性增长,但其在 EEG 上的适用性与效率收益尚未验证。

1月1日周三
  1. OpenReview · State space models80

    深度状态空间高斯过程

    基于摘要分析。该研究针对深度高斯过程(DGP)回归的计算问题,通过状态空间表示,将层次化 GP 回归转化为可用序贯方法求解的状态估计问题,并提出状态空间最大后验(MAP)估计、贝叶斯滤波与平滑方案。 核心机制是在层次结构中,为下一层 GP 的长度尺度与幅度设置经过变换的 GP 先验,使这些特征能够随输入变化。作者将 DGP 表示为由线性随机微分方程(SDE)组成的非线性层次系统,其中每个 SDE 对应一个条件 GP,再利用状态空间 DGP 的马尔可夫性质进行序贯估计。这一区别于直接处理整体 GP 回归的计算路径,是理解该方法的重点;它不是通常意义上的深度神经网络结构。作者报告计算复杂度随测量数量线性增长,但具体适用的 GP 类别、状态维度及近似条件尚未验证。 作者报告在合成非平稳信号上展示了模型与方法的表现,并将方法用于 LIGO 测量中的引力波检测。摘要未提供具体指标、对照基线或数据划分,因此不能据此判断性能优势的幅度。实验协议、消融及统计信息尚未验证;复现还需核对先验变换、SDE 构造、离散化与推断设置,代码可用性尚未验证。 平台推测(待验证):迁移假设是,随时间变化的长度尺度与幅度先验可能适合描述 EEG 的非平稳性,而序贯估计可能有助于长时序处理。可复用的是层次先验及滤波、平滑框架;需改造的是多通道观测模型、通道间关系及噪声模型。该方法依赖可构造状态空间表示的 GP 与序列观测,但摘要不足以确定其监督形式和数据规模要求。低信噪比、伪迹、跨被试差异和小数据条件可能使层次参数难以辨识。一个可检验的小实验是在固定被试内划分与相同观测条件下,比较该方法与平稳状态空间 GP 的 EEG 时序回归误差、预测不确定性校准及运行时间;滤波与平滑应分别评估。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其将层次化非平稳 GP 回归转为状态估计的机制,以及作者所述计算复杂度随测量数量线性增长的适用条件;对 EEG 时序建模的价值尚待验证。

1月1日周日
  1. OpenReview · State space models76

    用于学习非线性动力系统的灵活状态空间模型

    基于摘要分析。该研究针对非线性动力系统的学习,将状态转移函数与观测函数表示为基函数展开,并从数据中学习展开系数。核心贡献是利用与 Gaussian processes 的联系构造系数先验,以调节模型灵活性、抑制过拟合,同时设计基于序贯 Monte Carlo 的参数学习算法。 机制上,基函数展开承担非线性函数表示,系数先验则可视为正则化,用于在表达能力与泛化之间取得平衡。作者将这一设计与 Gaussian process state-space model 联系起来,但摘要未给出基函数类型、先验具体形式或二者的精确对应。学习算法用于估计展开系数及其他未知参数;作者称其具有理论保证,保证的条件与范围尚未验证。 作者报告,该方法在一个经典基准及真实数据上获得了有前景的结果。摘要未提供基准名称、数据规模、划分协议、对照方法或量化指标,因此尚不能判断收益大小及适用范围;实验协议、消融及统计信息尚未验证。复现需进一步核对基函数选择、先验设置、隐状态推断流程、序贯 Monte Carlo 的计算配置及参数学习细节。 平台推测(待验证):若 EEG 时序中的潜在动态可由该类非线性状态空间模型近似,基函数表示与系数正则化可能有助于限制小数据条件下的模型复杂度;这是迁移假设,而非已证实的 BCI 效果。原方法依赖时序观测及隐状态建模,具体监督需求与数据规模要求尚未验证。可考虑复用函数展开、先验与学习框架,但需适配 EEG 的多通道观测、噪声特性及跨被试差异。低信噪比、通道配置变化和有限训练数据可能使隐状态难以辨识,或导致先验约束不合适。一个可证伪的小实验是在固定通道、固定划分的被试内 EEG 数据上,以留出时段的预测误差比较该模型、线性状态空间模型与弱正则化版本,检验非线性表示及先验是否带来稳定收益。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其如何通过与 Gaussian processes 相联系的系数先验约束非线性状态空间模型的灵活性,以及配套序贯 Monte Carlo 学习算法;其对 EEG 动态建模的适用性尚未验证。

1月1日周五
  1. OpenReview · State space models75

    用于学习非线性动力系统的灵活状态空间模型

    基于摘要分析。该研究面向非线性动力系统学习,将状态转移函数和观测函数表示为基函数展开,并从数据中学习展开系数。其核心贡献是利用与 Gaussian processes 的联系构建系数先验,以调节模型灵活性、抑制过拟合,并设计基于 sequential Monte Carlo 的参数学习算法。 机制上,基函数展开承担非线性函数的表示,系数先验则可理解为正则化:作者希望保留展开形式的表达能力,同时改善泛化。学习算法用于估计展开系数及其他未知参数;摘要称其具有学习方面的理论保证,但保证的具体对象、成立条件和收敛性质尚未验证。基函数类型、先验形式、隐状态设定、训练流程与推理成本也需查阅全文。 作者报告,该方法在一个经典 benchmark 和真实数据上取得有希望的结果,但摘要未给出数据名称、划分协议、对照方法或量化指标,因而不能判断收益大小,也不能与其他协议下的结果直接比较。实验协议、消融及统计信息尚未验证。 平台推测(待验证):若 EEG 的时序变化可由低维隐状态及非线性观测关系近似,该框架可能用于潜在动力学建模;这是假设,不是已证实的 EEG/BCI 效果。可复用部分是基函数表示、系数先验和序贯推断思路,需改造的是多通道观测关系、噪声假设及被试差异处理。低信噪比、通道变化和小数据可能使隐状态难以辨识,跨被试非平稳性也可能削弱泛化。一个可检验的小实验是在固定通道的单被试 EEG 上,采用互不重叠的训练与测试时间段,在匹配基函数规模和推断预算的条件下,对比带该先验与弱正则化版本的留出预测误差及稳定性。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其如何将基函数展开、Gaussian processes 关联先验与 sequential Monte Carlo 学习结合,以兼顾非线性动力学表达能力和正则化;具体理论保证及实验收益仍需全文核对。

1月1日周四
  1. OpenReview · State space models72

    用于声学回声削减与去混响的变分贝叶斯状态空间模型

    基于摘要分析。研究针对 A/D 与 D/A 转换器不同步时的语音去混响、声学回声削减和降噪问题,提出基于变分贝叶斯的联合优化方法,利用两个状态空间模型分别描述时变回声滤波器和无噪多通道语音信号。 核心机制是将转换器异步条件下的声学回声削减滤波器视为时变状态向量;第二个模型则将无噪多通道语音信号视为状态向量,使去混响滤波器能够在含噪环境中更新。作者通过变分贝叶斯框架优化这两类模型,交替执行两个基于 Kalman smoother 的参数优化阶段。具体状态转移、观测模型、概率分布与优化目标尚未验证。 作者报告,在真实远程会议室录制的数据上,即使 A/D 与 D/A 转换器异步,所提方法也比作者此前的传统方法更有效地削减声学回声、语音混响和背景噪声。摘要未提供数值指标、数据规模或划分方式,实验协议、消融及统计信息尚未验证;因此无法判断收益大小及不同噪声条件下的稳定性。 平台推测(待验证):迁移假设是,时变干扰参数与潜在干净多通道信号的联合状态估计,可能用于 EEG 非平稳伪迹抑制。原方法依赖多通道时序观测及声学回声、混响的结构假设,具体参考信号和监督需求需查正文;可复用的是双状态建模与交替平滑优化思路,需改造的是 EEG 观测模型、伪迹动力学及通道耦合关系。低信噪比、跨被试差异、通道变化和小数据可能导致状态估计不稳定,或把任务相关脑活动误当作干扰。一个可证伪的小实验是在固定被试内划分的 EEG 上注入已知时变伪迹,对比单状态与双状态估计,并同时检查伪迹残留和原始 ERP 波形保真度。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读的是以两个状态空间模型及交替 Kalman 平滑优化联合处理时变回声与含噪多通道信号的机制,其对 EEG 伪迹建模的可迁移性尚未验证。