跳到正文

算法、任务与模态

Mamba 最新动态

Mamba 研究索引;按可核对的标签归档,不以热度评价质量。

59 条精选近 30 天 5 条共收录 90 条

更新

精选归档 · 第 3 页

6月18日周二第 41–59 条
  1. OpenReview · State space models75

    ProtMamba:一种感知同源性但无需序列比对的蛋白质状态空间模型

    基于摘要分析。ProtMamba 针对蛋白质设计中如何利用同源序列的进化信息、同时避免依赖不完善的多序列比对构建流程这一问题,提出基于 Mamba 的蛋白质语言模型。其核心贡献是将拼接的同源序列作为长上下文输入,在不进行序列比对的情况下建模同源信息。 机制与训练:模型在大规模拼接同源序列数据上训练,通过 fill-in-the-middle 目标结合自回归与掩码语言建模。作者报告,相比基于注意力的模型,ProtMamba 能高效处理包含数百条蛋白质序列的长上下文。摘要未给出数据集名称、具体规模、模型参数量、目标实现及计算效率测量条件,这些信息尚未验证。 结果与证据边界:作者报告模型可用于新序列生成和适应度预测,并在模型规模较小的情况下取得与其他蛋白质语言模型有竞争力的表现,认为这体现了长上下文条件信息的重要性。具体指标、对照模型、数据划分、同源关系控制、消融及统计信息尚未验证,因此不能据此判断性能提升幅度或将效果单独归因于 Mamba、同源上下文或训练目标。 平台推测(待验证):其长上下文条件建模机制可能为 EEG 中利用多段相关记录提供思路,但蛋白质同源序列的进化关系并不等同于跨被试或跨会话的 EEG 关联。迁移假设依赖可靠的记录分组与上下文构造,需要改造连续信号表示、通道编码和训练目标;低信噪比、通道差异及小数据可能使长上下文引入无关信息。一个可检验的小实验是在固定 EEG 任务与数据划分下,比较相关记录上下文、随机记录上下文和无上下文条件,检验收益是否来自上下文相关性。该实验仅为迁移假设,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读的具体原因是 ProtMamba 以无需多序列比对的同源序列长上下文建模探索进化信息利用,并结合 fill-in-the-middle 训练目标;其性能与规模优势仍需结合全文中的评估协议和对照核验。

1月1日周一
  1. OpenReview · State space models75

    Coupled Mamba:通过耦合状态空间模型增强多模态融合

    基于摘要分析。该研究针对多模态融合中复杂的模态内与模态间关联,提出 Coupled SSM,并构建 Coupled Mamba,在保留模态内状态演化过程独立性的同时耦合不同模态的状态链,试图兼顾跨模态交互建模与硬件感知并行计算。 核心机制是跨模态隐状态转移:当前状态依赖本模态状态链及相邻状态链在前一时间步的状态。为适配硬件感知并行设计,作者通过引入历史状态、推导状态方程得到全局卷积核。其可核对的机制特点是将模态交互引入状态演化过程;具体耦合拓扑、参数化方式、训练目标及并行实现细节尚未验证。 作者报告,在 CMU-MOSEI、CH-SIMS、CH-SIMSV2 的多域输入实验中,相较摘要所称的当前先进方法,三个数据集的 F1-Score 分别提高 0.4%、0.9% 和 2.3%;摘要未明确这些百分比表示相对增幅还是百分点差值,因此不能转换解读。作者还报告推理速度提升 49%、GPU 显存节省 83.7%,但对应基线、硬件、输入规模及测量条件尚未验证。数据划分、实验协议、消融及统计信息均需结合全文核对。 平台推测(待验证):该机制可能适用于具有时间对应关系的 EEG 与其他模态序列融合,但原任务结果不等于 BCI 有效。可复用的是跨模态状态耦合思路;需改造输入编码、采样率对齐和缺失模态处理。EEG 低信噪比、跨被试差异及小数据条件可能使耦合传播噪声或增加过拟合风险。一个可检验的小实验是在同一同步多模态数据集与相同跨被试划分下,对比独立状态链、简单后期融合与耦合状态链,并检验单模态受噪声污染时的性能变化。相关 EEG 工作尚未检索确认。

    阅读价值:值得核对其跨模态状态耦合与硬件并行实现:摘要给出了具体的状态交互机制及效果、效率结果,但比较基线与评估协议仍需全文验证。

  2. OpenReview · EEG73

    EEGMamba:用于 EEG 分类的双向状态空间模型与混合专家

    基于摘要分析。EEGMamba 面向不同任务中 EEG 信号长度、通道数不一致,以及 Transformer 长序列建模计算开销较大的问题,将 Spatio-Temporal-Adaptive(ST-Adaptive)模块、Bidirectional Mamba 和 Mixture of Experts(MoE)整合为统一的多任务 EEG 分类框架。 机制上,ST-Adaptive 通过空间自适应卷积对不同长度和通道数的 EEG 进行统一特征提取,并引入 class token 实现时间维度适配;摘要未说明具体的长度对齐与通道映射方式。Bidirectional Mamba 用于进一步提取 EEG 特征,作者旨在兼顾长序列处理的分类准确性与推理速度。Task-aware MoE 配置一个通用专家,以建模不同任务 EEG 的差异与共性;专家路由、任务信息如何输入以及训练损失尚未验证。 作者报告,在八个公开 EEG 数据集上进行了测试,覆盖癫痫发作检测、情绪识别、睡眠分期和运动想象四类任务,并报告性能优于对照方法。摘要未提供数据集名称、被试规模、评价指标、具体分数或对照基线,也未明确被试内、跨被试、跨会话或跨数据集划分,因此不能据此确认对未见任务的泛化能力,或量化准确性与速度之间的收益。 复现时应重点核对多任务联合训练与评估协议、异构通道和序列长度的处理,以及 ST-Adaptive、双向建模和通用专家各自的贡献;推理效率比较还需结合输入长度、硬件与计时条件。实验协议、消融及统计信息尚未验证。摘要称代码将于近期发布,当前材料不能确认代码已公开。

    阅读价值:值得核对 EEGMamba 如何通过输入适配、双向状态空间建模和任务感知专家机制处理异构 EEG,但其跨任务泛化与推理效率优势仍需结合全文中的训练划分和对照实验验证。

  3. OpenReview · State space models71

    TrackSSM:基于状态空间模型的通用运动预测器

    基于摘要分析。TrackSSM 针对多目标跟踪(MOT)中运动模型难以兼顾效率与跨场景有效性的问题,提出基于数据依赖状态空间模型(SSM)的统一编码器—解码器框架,利用历史轨迹预测目标边界框的时间位置,为轨迹关联提供位置信息。 核心模块 Flow-SSM 以历史轨迹的位置及运动信息引导边界框的时间状态转移。运动编码器使用 Mamba-Block 编码历史轨迹,flow decoder 则通过级联的 Flow-SSM 运动解码模块,利用编码后的 flow 信息完成位置预测。训练采用 Step-by-Step Linear(S²L)策略:在目标前一帧与当前帧的位置之间进行线性插值,构造逐步线性训练的伪标签,以引导边界框的时间转移。这里的 flow 是轨迹运动信息,摘要不足以将其等同于图像光流。 作者报告 TrackSSM 适用于多种跟踪场景,并在多个基准上取得良好跟踪表现,但摘要未列出基准名称、数据划分、对照方法、具体指标或计算成本,因此无法核对性能提升幅度及效率收益。摘要声明代码和模型已公开;实现细节、实验协议、消融及统计信息尚未验证,也不能据此推断论文接收或发表状态。 平台推测(待验证):假设以历史信息调节状态转移的机制能够适应 EEG 的时变动态,可将其作为 EEG 时序预测的候选模块。原方法依赖可定位的目标轨迹及相邻帧位置监督;EEG 没有直接对应的边界框,需要改造输入表示、预测输出和监督目标,而 Mamba 编码器与条件化状态转移思路可能复用。低信噪比、通道差异、跨被试非平稳性及小数据训练都可能使运动建模收益无法迁移;线性插值还可能平滑掉真实的快速变化。一个可证伪的小实验是在固定 EEG 数据划分和相同训练预算下,比较 Mamba 基线与加入历史信息引导状态转移的模型在短时序预测中的误差,再单独核对插值监督是否带来收益。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其以历史位置和运动信息引导数据依赖状态转移、并用插值伪标签训练运动解码器的机制;摘要未给出定量结果,其优势及向 EEG 时序建模迁移的可行性尚未验证。

  4. OpenReview · State space models70

    PhysMamba:用于远程生理测量的状态空间对偶模型

    基于摘要分析。该研究针对从面部视频提取生理信号的 Remote Photoplethysmography(rPPG)在真实环境中易受运动伪影和噪声影响的问题,提出 PhysMamba,利用 State Space Duality 构建时频交互双路径模型,以学习更具代表性的特征。 机制方面,作者设计 Cross-Attention State Space Duality(CASSD),促进两条路径之间的信息交换与特征互补。摘要将时频交互及跨路径融合与噪声条件下的鲁棒性提升联系起来,但具体时频表示、状态空间实现、交互位置、损失函数及训练流程尚未验证。 作者报告在 PURE、UBFC-rPPG 和 MMPD 数据集上开展比较实验,并达到 SOTA,尤其在复杂环境下表现突出。摘要未提供具体指标、数值、数据划分及对照方法,因此目前无法判断优势幅度,也不能确定这些结果属于数据集内评估还是 Cross-dataset 评估。实验协议、消融及统计信息尚未验证;复现还需核对视频预处理、信号标签、评估流程及实现可用性。 平台推测(待验证):若 CASSD 的时频互补机制不依赖面部视频的特定空间结构,可探索其对 EEG 非平稳信号和伪影干扰的适用性。可复用候选是双路径信息交互模块,需改造视频输入与特征编码;原方法对监督信号、数据规模和时频表示的依赖尚不明确。EEG 的低信噪比、跨被试差异、通道变化及小数据条件可能使交互模块放大伪影或过拟合。一个可检验的小实验是在固定 Cross-subject EEG 划分、相同预处理与训练预算下,对比单路径、双路径无交互及 CASSD 交互模型,并检查受控噪声扰动下的性能变化。该迁移假设不构成已验证的 EEG/BCI 效果,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得关注其通过 CASSD 实现时频双路径信息交互的机制,但复杂环境下的鲁棒性优势仍需结合完整实验协议、指标与消融核对。

  5. OpenReview · State space models72

    DGMamba:通过广义状态空间模型实现域泛化

    基于摘要分析。DGMamba 研究视觉域泛化中的分布偏移问题,尝试在保留 Mamba 全局感受野与线性复杂度优势的同时,通过抑制域特异隐藏状态、调整图像 patch 扫描和组合方式,提高对未见域的泛化能力。 核心机制包括 Hidden State Suppressing(HSS)与 Semantic-aware Patch Refining(SPR)。HSS 用于减轻与域特异特征相关的隐藏状态对输出预测的影响。SPR 旨在让模型更多关注对象而非上下文,包含 Prior-Free Scanning(PFS)和 Domain Context Interchange(DCI):PFS 打乱图像中的非语义 patch,构造更灵活的序列;DCI 通过跨域融合 patch,将不匹配的非语义与语义信息组合起来,对 Mamba 施加正则化。摘要未提供隐藏状态识别与抑制的具体实现、语义 patch 判定方法或损失形式。 作者报告,在四个常用 DG benchmark 上,DGMamba 获得优于所比较先进模型的结果;摘要未列出 benchmark 名称、指标数值、训练与测试域划分及具体基线,因此尚不能判断收益幅度及各模块贡献。实验协议、消融及统计信息尚未验证。摘要表示代码将公开,并非已确认发布。 平台推测(待验证):假设 EEG 中也能区分任务相关信息与被试或会话特异背景,HSS 的抑制思路可能对应跨被试、跨会话分布偏移;但图像对象与背景的划分不能直接等同于 EEG 的时间段或通道。可考虑复用隐藏状态抑制与背景重组思路,需改造 patch 定义、任务相关性判定及扫描顺序,避免破坏时序和通道关系。低信噪比、小数据及被试间差异可能使判定不稳定,误抑制有效信号。一个可证伪的小实验是在固定跨被试划分下,对比基础 Mamba 与仅加入 HSS 的版本,保持训练数据和调参预算一致,检查未见被试表现是否改善;这一迁移假设尚无本文证据支持,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读的具体原因是 DGMamba 将域泛化中的域特异特征抑制与图像扫描机制改造分别落实为 HSS 和 SPR,可据此核对状态空间模型的泛化收益来源,但其 EEG 迁移价值尚未验证。

  6. OpenReview · State space models70

    采用分形扫描的可扩展视觉状态空间模型

    基于摘要分析。该研究针对视觉 State Space Models(SSMs)中图像 patch 序列化可能破坏空间关系的问题,提出以分形扫描曲线替代线性扫描,旨在改善空间邻近性保持并适应不同图像分辨率。 核心机制是调整二维图像 patch 到一维序列的排列方式,使 SSM 在序列建模时更有效地利用空间结构。作者认为,现有线性扫描容易产生重复模式与偏置,而分形曲线能够保持较高的空间邻近性、减少冗余并提升复杂模式建模能力。摘要未说明具体分形曲线、扫描实现、模型结构或训练配置,因此不能进一步确定其计算与存储开销。 作者报告在图像分类、检测和分割任务中取得优于对照方法的表现,但摘要未提供数据集、划分、基线名称、指标或数值,无法量化收益或比较不同协议下的结果。实验协议、消融及统计信息尚未验证;复现需取得完整的扫描规则、分辨率适配方式、训练设置及对照配置。 平台推测(待验证):该机制依赖 patch 的二维空间邻接关系,可为 EEG 通道×时间表示的序列化提供思路,但图像空间邻近不等同于电极间的功能关系。可复用的是扫描与序列排列模块,需改造的是电极拓扑映射和时间顺序约束;低信噪比、跨被试差异、通道布局变化及小数据可能削弱收益。一个可检验的小实验是在固定 EEG 表示、SSM 主干与训练配置下,对比线性扫描和分形扫描,使用一致的 Cross-subject 划分,检查任务指标及时间邻接是否受到破坏。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得核对分形扫描如何保留图像 patch 的空间邻近关系,以及其相对线性扫描的收益是否在不同分辨率和任务下稳定;摘要尚不足以判断收益幅度与计算代价。

  7. OpenReview · State space models79

    VMamba:视觉状态空间模型

    基于摘要分析。本文研究如何构建计算高效的视觉网络,将状态空间语言模型 Mamba 适配为具有线性时间复杂度的视觉骨干 VMamba,核心贡献是用 2D Selective Scan(SS2D)处理二维视觉数据与一维选择性扫描之间的结构差异。 技术机制:VMamba 由 Visual State-Space(VSS)块堆叠构成,SS2D 沿四条扫描路径遍历二维数据,以收集不同来源和视角的上下文信息。作者据此构建一系列 VMamba 架构,并通过架构与实现层面的改进加速。摘要未给出具体扫描方向、状态更新公式、损失、训练配置及各加速措施,尚不能核对其计算开销与性能收益的来源。 结果与复现:作者报告,VMamba 在多种视觉感知任务上表现良好,相较现有基准模型具有更优的输入规模扩展效率。摘要未列出任务、数据集、指标、数值或对照配置,因此不能据此判断优势幅度,也不能将线性时间复杂度直接等同于实际运行速度。实验协议、消融及统计信息尚未验证。材料提供了源码仓库,但实现与论文版本的对应关系及完整复现条件仍需核对。 平台推测(待验证):迁移假设是将 EEG 的时间与通道,或时频表示,组织为二维输入,借用多路径选择性扫描建模上下文。原方法依赖二维结构,预训练数据规模与监督设置在摘要中未说明;EEG 的通道排列并不天然等同于图像邻接关系,因此可考察 SS2D 与 VSS 模块,但需改造输入编码、通道拓扑和任务输出。低信噪比、跨被试差异、缺失通道及小数据可能使扫描路径引入不稳定依赖或过拟合。一个可证伪的小实验是在固定 EEG 任务、训练预算与数据划分下,对比二维多路径扫描、仅时间扫描及常规基线,并扰动通道顺序,检验收益是否依赖人为排列;这不是论文已验证的结果,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其以四条扫描路径将一维选择性扫描适配到二维视觉数据的机制,以及输入规模扩展效率的评估;该机制对 EEG 的适用性尚未验证。

  8. OpenReview · State space models73

    SMamba:通过可伸缩状态空间模型实现任意尺度超分辨率

    基于摘要分析。该研究针对任意尺度超分辨率(ASSR),提出正文称为 S³Mamba 的方法,旨在用单一模型将低分辨率图像重建到任意目标尺度。其核心贡献是通过 Scalable State Space Model(SSSM)构建可伸缩的连续表示空间,并结合尺度感知自注意力强化不同尺度下的全局重要特征建模。 机制上,Implicit Neural Representations(INR)通过坐标与像素值之间的连续表示支持任意尺度重建。作者认为,现有基于 CNN 和 Transformer 的方法受到计算复杂度及长程依赖建模能力的限制;SSSM 在离散化过程中调制状态转移矩阵与步长采样矩阵,以实现尺度可调的连续表示建模。作者报告该机制具有线性计算复杂度,但摘要未说明其对应的复杂度变量、完整网络开销或具体调制形式,尚需全文核对。 作者报告,在合成及真实场景基准上的实验取得了最先进性能和任意超分辨率尺度下的较强泛化能力。摘要未提供数据集名称、训练与测试尺度划分、对照方法、指标或数值,因此目前不能定量判断收益,也不能确认对未见尺度的具体泛化范围;实验协议、消融及统计信息尚未验证。 平台推测(待验证):其潜在 EEG 关联是将尺度条件化的状态空间建模用于不同采样率下的连续时间信号重建,而非直接复用图像超分辨率效果。该假设依赖可建立的时间坐标和低、高采样率监督配对;可考察复用 SSSM 的离散化调制机制,输入表示与尺度感知模块则需适配 EEG 的时间轴、通道布局及生理频带。低信噪比、跨被试差异、通道缺失和小数据可能导致噪声放大或虚假高频重建,且上采样不能保证恢复已丢失的生理信息。一个可证伪的小实验是对高采样率 EEG 进行受控抗混叠降采样,在按被试隔离的划分中比较该机制、固定尺度模型与插值基线,并测试未见采样倍率下的波形误差及频谱保真度。相关 EEG 工作尚未检索确认。

    阅读价值:值得关注其通过离散化过程中的状态转移与步长采样调制构建尺度连续表示的机制,但任意尺度泛化、计算开销及向 EEG 迁移的有效性仍需核对全文或实验验证。

  9. OpenReview · State space models78

    VMamba:视觉状态空间模型

    基于摘要分析。本文研究如何构建计算高效的视觉网络,将状态空间语言模型 Mamba 迁移为具有线性时间复杂度的视觉骨干 VMamba,核心贡献是通过 2D Selective Scan(SS2D)适配二维视觉数据的结构。 机制上,VMamba 由 Visual State-Space(VSS)块堆叠构成,其中 SS2D 沿四条扫描路径遍历,以连接一维选择性扫描的有序处理方式与二维视觉数据的非序列结构,从不同方向汇集上下文信息。作者据此构建了一组 VMamba 架构,并通过架构与实现层面的改进加速。摘要未展开具体扫描顺序、状态更新形式、训练目标或加速实现,相关细节尚未验证。 作者报告,VMamba 在多种视觉感知任务中展现出良好性能,相较既有基准模型具有输入规模扩展效率优势。摘要未提供任务名称、数据集、数据划分、对照模型、数值指标及复杂度测量条件,因此不能据此量化性能提升,或将线性复杂度直接等同于实际运行速度优势。实验协议、消融及统计信息尚未验证。材料提供了公开代码仓库,复现仍需核对具体配置、训练预算与软硬件环境。 平台推测(待验证):若 EEG 被表示为通道×时间或时频二维结构,SS2D 的多方向上下文聚合可能用于建模长程依赖;这一假设依赖二维排列能够保留有意义的通道或时频关系,视觉领域结果不等于 EEG/BCI 效果。可考察复用 VSS 与扫描机制,但需改造输入编码、通道排列和任务输出。低信噪比、不规则电极布局、跨被试差异及小数据训练可能削弱收益,预训练与监督规模要求也尚未验证。一个可检验的小实验是在固定 EEG 数据划分、训练预算和相近模型容量下,对照多方向 SS2D 与单方向扫描,并扰动通道排列,观察任务指标及计算成本是否稳定改善。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其以四条扫描路径将一维选择性扫描适配到二维视觉数据的机制,并核对输入规模扩展效率的对照实验;该机制对 EEG 的适用性尚未验证。

  10. OpenReview · State space models71

    Pan-Mamba:基于状态空间模型的有效全色锐化

    基于摘要分析。Pan-Mamba 研究全色锐化问题,即融合低分辨率多光谱图像与高分辨率全色图像,生成高分辨率多光谱图像;其核心贡献是利用 Mamba 的全局信息建模能力,并设计两个面向跨模态交互与融合的组件。 机制方面,channel swapping Mamba 通过交换部分全色与多光谱特征通道,开展轻量级跨模态交互;cross-modal Mamba 则利用模态之间的内在关系增强信息表示。摘要未提供具体状态空间参数化、特征序列化方式、损失函数、训练与推理设置,不能据此确定网络结构细节或计算成本。 作者报告,在多个数据集上的实验中,Pan-Mamba 超过所比较的当前先进方法,获得更好的全色锐化融合结果;但摘要未给出数据集名称、划分、基线、指标或数值,因此尚不能判断优势幅度及不同评估协议下的稳健性。作者将该工作描述为首次探索 Mamba 在全色锐化中的潜力,此优先性主张尚未独立核实。摘要提供了源码地址,但实现与复现条件尚未验证;实验协议、消融及统计信息亦尚未验证。 平台推测(待验证):迁移假设是将跨模态信息交换机制用于 EEG 与其他同步信号的融合,而非直接复用图像锐化网络。原任务依赖空间对应且分辨率互补的图像输入;EEG 场景需重新定义时间对齐、通道映射、特征序列化和任务监督。可能复用的是跨模态交换与融合模块,需改造的是输入表示及输出目标。低信噪比、跨被试差异、通道缺失和小数据可能使交换特征引入噪声或过拟合。一个可证伪的小实验是在固定数据划分与相近参数预算下,对同步 EEG 多模态任务比较简单融合、加入 channel swapping 及进一步加入 cross-modal Mamba 的表现,并测试模态噪声扰动下的稳定性;这不构成已验证的 BCI 效果,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其 channel swapping Mamba 与 cross-modal Mamba 如何实现跨模态信息交换,但融合优势及向 EEG 多模态任务迁移的有效性仍需核对实验与验证。

  11. OpenReview · State space models73

    SMamba:通过可伸缩状态空间模型实现任意尺度超分辨率

    基于摘要分析。该研究针对任意尺度超分辨率(ASSR),提出正文称为 S³Mamba 的方法,利用 Scalable State Space Model(SSSM)构建由低分辨率图像导出的可伸缩连续表示空间,使单一模型能够处理不同放大尺度。其核心贡献是将尺度调制引入状态空间模型的离散化过程,并结合尺度感知自注意力增强不同尺度下的全局重要特征感知。 机制与创新:ASSR 借助 Implicit Neural Representations(INR)建立坐标与像素值的连续表示,突破固定放大倍数的限制。作者认为,现有 CNN 和 Transformer 方法面临计算复杂度及长程依赖建模方面的挑战。SSSM 在离散化时调制状态转移矩阵与步长采样矩阵,作者声称由此实现线性计算复杂度的连续表示建模。摘要未给出调制函数、尺度条件的具体输入方式、训练损失及推理流程;线性复杂度对应的计算范围,以及加入自注意力后的整体开销,尚需全文核对。 结果与证据边界:作者报告,在合成与真实场景基准上取得最先进性能,并在任意超分辨率尺度下表现出较强泛化能力。摘要未列出数据集名称、训练与测试尺度划分、对照基线、指标或具体数值,因此不能判断未见尺度上的收益及适用边界。实验协议、消融及统计信息尚未验证。 平台推测(待验证):可迁移的假设是,尺度条件化的状态空间离散化可能用于 EEG 不同采样间隔下的连续时间表示;但图像空间放大与 EEG 时间采样变化并非同一任务,原领域结果不能视为 BCI 有效性的证据。可考虑复用条件化离散化模块,将图像坐标与像素监督改为时间坐标和信号重建监督,并处理通道拓扑及抗混叠约束。低信噪比、跨被试差异、通道不一致和小数据可能使模型主要拟合插值规律。一个可证伪的小实验是在固定被试划分及统一抗混叠降采样流程下,对比该模块、普通状态空间模型和传统插值在未见采样间隔上的重建误差及下游任务表现。相关 EEG 工作尚未检索确认。

    阅读价值:值得核对其通过尺度调制状态空间离散化来构建连续表示的机制,以及线性复杂度的适用范围;作者报告的任意尺度泛化优势仍需结合全文实验协议验证。

  12. OpenReview · State space models77

    STREAM:面向稀疏几何数据的通用状态空间模型

    基于摘要分析。STREAM 面向点云、事件视觉等稀疏且非结构化的几何数据,将几何结构显式编码进状态空间模型的参数化,而不是仅依赖序列化预处理及模型自行推断几何关系。其核心贡献是利用坐标的相对差异控制状态空间模型的步长,并基于 Mamba selective state-space model 与修改后的 CUDA kernel 实现高效计算。 机制上,状态空间模型的线性动态由时间或空间坐标等一维变量驱动,STREAM 将相对坐标差注入这一动态变量对应的步长。作者称,由此形成的几何操作可在 O(N) 步中计算 N 个点之间的全点对交互;该表述不应直接等同于已验证的端到端运行时间或显存复杂度,具体交互定义、点的遍历顺序与实现条件尚需正文核对。 作者报告,在从头训练的 ModelNet40 和 ScanObjectNN 点云分析任务中,STREAM 改善了 PointMamba 基线表现,但摘要未提供具体指标数值。作者还报告,在 DVS128 Gestures 数据集全部 11 个类别的测试中取得 100% Accuracy,并声称这是首次达到该结果;测试划分、预处理、重复实验及统计信息尚未验证。摘要另称模型在事件视觉和音频分类等基准上具有竞争力,具体对照与实验协议尚未验证。 平台推测(待验证):假设相对坐标驱动的状态更新能保留不规则采样结构,它可能对应 EEG 中不规则时间采样或稀疏电极空间建模的问题。可考虑复用状态更新机制,但需改造 EEG 信号的点表示、时空坐标及遍历方式;低信噪比、跨被试差异、通道缺失与小数据训练都可能削弱该归纳偏置。一个可检验的小实验是在固定 EEG 数据划分和相同输入表示下,比较相对坐标步长与固定步长,并测试通道缺失时的性能变化。此为迁移假设,不是已证实的 BCI 收益;相关 EEG 工作尚未检索确认。复现还需核对完整模型配置、CUDA kernel、训练条件及代码可用性。

    阅读价值:值得核对 STREAM 将相对坐标差注入状态空间步长的机制及其修改后的 CUDA 实现,以评估稀疏几何归纳偏置的收益;摘要中的全点对交互与测试准确率仍需结合完整实验协议验证。

  13. OpenReview · State space models72

    DGMamba:通过广义状态空间模型实现域泛化

    基于摘要分析。该研究针对视觉域泛化中的分布偏移问题,提出 DGMamba,尝试在保留 Mamba 全局感受野与线性复杂度优势的同时,减少隐藏状态和图像扫描机制对域特异信息的依赖。 框架包含 Hidden State Suppressing(HSS)与 Semantic-aware Patch refining(SPR)。HSS 用于减弱与域特异特征相关的隐藏状态对输出预测的影响。SPR 旨在让模型更关注对象而非上下文,其中 Prior-Free Scanning(PFS)打乱图像中的非语义 patch,以形成更灵活的序列;Domain Context Interchange(DCI)通过跨域融合 patch,将不匹配的非语义与语义信息组合起来,对 Mamba 进行正则化。摘要未提供隐藏状态筛选、语义识别、扫描操作及损失函数的具体实现,尚不能据此重建模型。 作者报告,在四个常用域泛化 benchmark 上,DGMamba 相较现有先进模型取得更优结果;摘要未列出 benchmark 名称、域划分、对照基线或指标数值,实验协议、消融及统计信息尚未验证。作者表示代码将公开,不等同于代码已可获取。 平台推测(待验证):其潜在 EEG 迁移路径是抑制被试或会话相关的域特异状态,以缓解跨被试、跨会话分布偏移。但原方法依赖图像 patch 的语义与上下文区分,以及跨域 patch 融合;EEG 中哪些时段、通道或频段属于任务信息而非背景信息,需要重新定义,不能直接套用对象与背景的划分。可尝试复用状态抑制思路,改造序列构建和跨域融合模块;低信噪比、通道差异及小数据可能导致任务相关状态被误抑制,或融合产生不合理信号。一个可证伪的小实验是在固定的跨被试 EEG 划分下,比较基础 Mamba 与仅加入 HSS 改造的版本,核对域信息降低是否伴随任务性能改善。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得核对的是 DGMamba 如何通过隐藏状态抑制与语义感知 patch 处理降低域特异信息影响;这些机制提供了域泛化研究的具体切入点,但摘要中的性能优势及其 EEG 可迁移性尚未验证。

  14. OpenReview · State space models70

    PhysMamba:用于远程生理测量的状态空间对偶模型

    基于摘要分析。该研究针对从面部视频提取生理信号的 Remote Photoplethysmography(rPPG)在现实环境中受运动伪迹与噪声干扰的问题,提出 PhysMamba,以基于 State Space Duality 的双路径时频交互学习更具代表性的特征。这是一项远程生理测量方法研究,不是直接的 EEG 或 BCI 验证。 核心机制是通过两条路径开展时频信息交互,并使用改进的 Cross-Attention State Space Duality(CASSD)促进路径间的信息交换与特征互补。摘要未说明两条路径的具体输入表示、CASSD 的计算形式、损失函数或训练与推理流程,这些技术细节尚未验证。 作者报告在 PURE、UBFC-rPPG 和 MMPD 数据集上进行了对比实验,并声称 PhysMamba 达到最先进性能,尤其适用于复杂环境。但摘要未提供具体指标、数值、数据划分、对照方法及复杂环境的定义,因此无法判断优势大小或不同评估协议下的泛化能力。实验协议、消融及统计信息尚未验证;复现还需核对视频预处理、参考生理信号、训练配置和实现可用性。 平台推测(待验证):若双路径时频互补确实能增强抗噪能力,其机制可能对应 EEG 中时域动态与频谱线索联合建模的需求。迁移需将面部视频输入模块改造为多通道 EEG 表征,并明确监督信号与数据规模,不能假定视频运动伪迹与 EEG 伪迹具有相同结构。低信噪比、跨被试差异、通道配置变化和小数据训练可能削弱交互模块的收益。一个可证伪的小实验是在固定 EEG 数据划分与匹配模型容量下,比较单路径、双路径无交互及加入 CASSD 的版本,并在相同噪声条件下评估;这仅是迁移假设,不是论文已验证结果。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得核对 PhysMamba 的双路径时频交互与 CASSD 如何应对运动伪迹和噪声,但摘要中的领先性能主张及其向 EEG 的迁移价值尚需验证。

  15. OpenReview · State space models72

    MambaVLT:用于视觉-语言跟踪的时间演化多模态状态空间模型

    基于摘要分析。MambaVLT 针对视觉-语言跟踪中时序信息利用不足、参考特征难以动态更新的问题,提出基于 Mamba 的多模态状态空间模型,通过随时间演化的状态表示支持目标跟踪,并自适应调节视觉与语言参考的权重。 机制方面,模型包含 time-evolving hybrid state space block 和 selective locality enhancement block,用于捕获多模态上下文信息与自适应更新参考特征;另设 modality-selection module,动态调整视觉和语言参考的权重,以缓解任一参考模态可能产生的歧义。摘要将 Mamba 状态演化的时序记忆能力与线性复杂度作为方法动机,但具体状态更新公式、模块连接、损失、训练流程及端到端计算开销尚未验证。 作者报告,该方法在多个基准上相较先进跟踪器表现良好;摘要未提供基准名称、数据划分、对照模型或量化指标,因此尚不能判断优势幅度及适用条件。实验协议、消融及统计信息尚未验证,代码与复现条件也需核对全文。 平台推测(待验证):其原问题依赖连续视觉序列及视觉、语言参考,时序状态更新与动态模态选择可能为 EEG 与辅助模态融合提供机制参考,对应长时序建模和模态可靠性变化的瓶颈;这不代表已验证的 EEG/BCI 效果。可考虑复用状态更新和模态选择思路,但需改造输入编码、时间对齐、参考表示与任务输出。EEG 的低信噪比、跨被试差异、通道变化及小数据可能导致状态累积噪声或模态权重失稳。一个可检验的小实验是在固定被试和划分的 EEG 多模态任务中,保持编码器与训练预算一致,对比固定融合与动态模态选择,并在辅助模态受扰时检验性能变化。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其如何利用随时间演化的状态空间更新多模态参考特征,以及动态调节模态权重;具体性能优势与 EEG 迁移价值尚未验证。

  16. OpenReview · State space models74

    Mamba-CL:在零空间中优化选择性状态空间模型以实现持续学习

    基于摘要分析。该研究面向持续学习中的灾难性遗忘,提出 Mamba-CL,通过在历史任务特征子空间的正交方向更新参数,持续微调大规模 Mamba 基础模型的核心 SSM,力求保留既有知识并学习新任务。 核心机制是将参数更新限制在历史特征子空间对应的零空间内。作者围绕 Mamba 的四个关键时不变参数推导整体一致性约束,处理 SSM 的递归状态空间结构与非线性离散化过程,再以零空间投影实现正交更新。作者声称,该方法在理论上保证各 SSM 模块在先前与当前任务上的输出一致性目标;具体保证的假设、约束范围,以及模块级一致性如何对应最终任务性能,需结合全文核对。 作者报告,在四个类别增量学习基准上,Mamba-CL 展现出抗遗忘效果,性能优于所比较的先进方法。摘要未提供基准名称、任务序列、数据划分、指标或具体数值,因此无法判断提升幅度及不同协议下的可比性。实验协议、消融及统计信息尚未验证。摘要称代码位于补充材料中,但其可获取性、运行配置与复现要求尚未核对。 平台推测(待验证):该机制可能对应 EEG 持续学习中新增类别或连续会话更新引起的遗忘,但依赖历史特征子空间能稳定表征需保留的知识。可复用的是零空间投影与参数一致性约束;需改造的是 EEG 时序输入、通道适配和特征子空间估计。低信噪比、跨被试差异、通道变化及小样本可能使子空间估计不稳定,或过度限制更新、妨碍新任务学习。一个可检验的假设是:在固定 EEG 类别增量协议下,使用相同 Mamba 骨干与数据划分,对照普通顺序微调和零空间约束更新,检验历史类别 Accuracy 的保留是否以新类别学习能力下降为代价。上述迁移不属于本文已验证结果,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得核对其针对 Mamba 核心 SSM 参数推导的一致性约束与零空间投影实现,尤其是理论保证的适用条件及抗遗忘与新任务学习能力之间的权衡。

  17. OpenReview · State space models78

    MambaByte:无 token 的选择性状态空间模型

    基于摘要分析。MambaByte 研究直接从原始字节学习的无 token 语言建模,旨在避免子词分词的归纳偏置,同时缓解字节序列更长带来的计算与内存压力。其核心贡献是将 Mamba 状态空间模型(SSM)用于字节序列的自回归训练,并提出结合 tokenized drafting 与 byte-level verification 的推测解码适配方案。 机制上,摘要将标准自回归 Transformer 随序列长度增长的内存需求,与 Mamba 的固定大小记忆状态及高效解码进行对照。MambaByte 的建模单位是字节,而非子词;推测解码则用 token 化序列生成草稿,再在字节层面验证。具体状态更新、选择性机制、训练损失及草稿验证流程尚未验证。 作者报告,MambaByte 在语言建模任务上可与先进的子词 Transformer 竞争,部分表现更优,并保留无 token 模型的噪声鲁棒性优势。作者还报告,其推测解码适配方案相较标准 MambaByte 实现获得 2.6 倍推理加速,解码效率与子词 Mamba 相近。摘要未提供对应数据集、模型规模、任务指标、硬件、生成长度及对照配置,因此这些结果只能在作者所述比较范围内理解,实验协议、消融及统计信息尚未验证。 平台推测(待验证):其固定大小状态机制可能对应 EEG 长时序处理中随窗口长度增长的资源瓶颈,但字节语言建模依赖离散序列与自回归监督,不能直接等同于连续、多通道 EEG 建模。可考察 SSM 主干的复用,输入编码与训练目标需改造;tokenized drafting 的优势是否成立则取决于 EEG 是否存在合适的离散草稿表示。低信噪比、跨被试分布差异、通道变化及小数据可能削弱效果。一个可检验的小实验是在固定数据划分和参数预算下,比较 SSM 与 Transformer 在不同 EEG 窗口长度上的任务指标、峰值内存及推理延迟。上述仅为迁移假设,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其以固定大小状态处理长字节序列的机制,以及结合 tokenized drafting 与 byte-level verification 的推测解码方案;摘要中的语言建模与效率结论仍需结合完整实验协议核对。

  18. OpenReview · State space models73

    SMamba:通过可伸缩状态空间模型实现任意尺度超分辨率

    基于摘要分析。研究针对任意尺度超分辨率(ASSR):用单一模型将低分辨率图像重建为任意目标尺度的高分辨率图像。作者提出正文称为 S³Mamba 的方法,通过 Scalable State Space Model(SSSM)构建可随尺度调整的连续表示空间,并结合尺度感知自注意力提取不同尺度下的重要全局特征。 机制上,摘要将隐式神经表示(INR)描述为连接坐标与像素值、重建连续信号的途径。SSSM 在离散化过程中调制状态转移矩阵及步长采样矩阵,作者称由此实现具有线性计算复杂度的连续尺度建模。尺度感知自注意力用于补充不同尺度下的全局特征感知;具体调制公式、尺度条件的注入方式、训练损失,以及线性复杂度是否涵盖完整网络,尚未验证。 作者报告,在合成与真实场景基准上的实验取得了最先进的性能及任意超分辨率尺度下的泛化能力。摘要未提供基准名称、训练与测试尺度划分、对照方法、指标或数值,因而尚不能核对其提升幅度,或区分已见尺度与未见尺度的泛化。实验协议、消融及统计信息尚未验证;代码与复现条件亦未确认。 平台推测(待验证):假设该尺度条件化的连续表示机制可用于 EEG 时间轴重采样或缺失采样点重建,其潜在对应问题是不同采样率下的信号表示一致性,而不是直接提升 BCI 分类效果。可考虑复用尺度调制的状态空间模块,但需将二维图像坐标改为时间坐标,并处理通道结构、频带约束与抗混叠;原任务依赖低分辨率输入及高分辨率重建目标,迁移所需监督和数据规模尚不明确。低信噪比、小样本及跨被试差异可能使模型重建伪波形或失真频谱。一个可证伪的小实验是在按被试隔离的数据上,对高采样率 EEG 进行抗混叠降采样,比较该机制与常规插值在未见采样比例下的波形、频谱及下游任务表现。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得核对其通过离散化过程中的状态转移与步长采样调制实现连续尺度建模的机制,尤其是线性复杂度的适用范围及尺度外泛化证据;其对 EEG 的价值尚未验证。