跳到正文

算法、任务与模态

Mamba 最新动态

Mamba 研究索引;按可核对的标签归档,不以热度评价质量。

206 条精选近 30 天 16 条共收录 276 条

更新

精选归档 · 第 11 页

1月1日周一第 201–206 条
  1. OpenReview · State space models72

    PathMamba:用于病理图像多类别分割的弱监督状态空间模型

    基于摘要分析。该研究针对病理图像多类别分割中密集像素标注成本高的问题,提出仅使用图像级标签训练的弱监督状态空间模型 PathMamba,通过结合像素级与 patch 级特征学习局部细节和全局上下文。 方法首先将像素视为实例,基于 Multi-Instance Multi-Label Learning 提取像素级特征图,再将其注入 Contrastive Mamba Block。该模块结合状态空间模型与对比学习,提取病理图像中的非因果双粒度特征;作者另提出 Deep Contrast Supervised Loss,以更充分利用有限的标注信息。摘要未给出对比样本构造、双粒度特征交互方式、损失公式及推理流程,具体机制尚需全文核对。 作者报告,在两个公开病理图像数据集上,PathMamba 优于所比较的先进弱监督方法,并能生成区域一致性更好的分割结果。摘要未列出数据集名称、划分协议、评价指标、分数及对照方法,因此无法判断提升幅度及适用范围;实验协议、消融及统计信息尚未验证。摘要提供了代码仓库,但其运行条件与结果可复现性尚未验证。 平台推测(待验证):其可考察的跨领域机制是由样本级弱标签学习局部特征,并结合细粒度与粗粒度上下文;这不等于已证实的 EEG/BCI 效果。若 EEG 任务具有记录级标签而缺少事件级标注,可假设将像素实例改为时间窗实例、将 patch 改为较长片段,探索弱监督事件定位。状态空间与多实例学习模块可能可复用,但图像空间邻域、粒度定义和对比关系均需改造。低信噪比、跨被试差异、通道配置变化及小数据条件可能使局部特征聚焦于伪迹而非目标事件。一个可证伪的小实验是在具有事件标注的 EEG 数据上,仅用记录级标签训练,以保留的事件标注评估定位,并在相同被试划分下比较多实例学习基线与加入双粒度模块后的结果。相关 EEG 工作尚未检索确认。

    阅读价值:值得阅读其以图像级标签结合像素级与 patch 级特征进行多类别分割的机制,重点核对 Contrastive Mamba Block 与 Deep Contrast Supervised Loss 的具体实现及贡献;其对 EEG/BCI 的适用性尚未验证。

  2. OpenReview · State space models74

    VFIMamba:基于状态空间模型的视频帧插值

    基于摘要分析。VFIMamba 研究视频帧插值(VFI)中的帧间建模问题,利用 Selective State Space Models(S6)实现高效、数据依赖的跨帧信息交互,并引入课程学习以学习不同运动幅度下的帧间动态。其主要研究对象是视频中间帧生成,而非 EEG 或 BCI。 核心机制是 Mixed-SSM Block(MSB):先将相邻帧的 token 交错排列,再进行多方向 S6 建模。作者认为,这种设计能够在保持线性复杂度的同时促进跨帧信息传递,针对卷积方法感受野受限、注意力方法计算开销较高的问题提供替代路径。课程学习逐步培养模型对不同运动幅度的建模能力,但摘要未说明运动幅度的定义、课程阶段、损失函数及训练细节,相关信息尚未验证。 作者报告,VFIMamba 在多个基准上达到当时最优表现,尤其适用于高分辨率场景;在 X-TEST 数据集上,4K 帧与 2K 帧的提升分别为 0.80 dB 和 0.96 dB。摘要未明确该 dB 数值对应的指标、对照方法或数据划分,因此不能据此确认收益来源,也不能直接与其他协议下的结果比较。实验协议、消融、统计信息以及实际运行时间和显存开销尚未验证。 平台推测(待验证):若将相邻帧之间的交错建模视作相邻 EEG 时间窗之间的信息交互,MSB 的序列组织方式与 S6 模块可能为长时序建模提供可检验的思路。该假设依赖 EEG 时间窗间存在可学习的连续动态;视觉 token 编码、空间扫描方向及运动幅度课程需要改造,不能直接照搬。低信噪比、通道布局差异、跨被试分布变化及小数据训练可能削弱效果。可在固定 Cross-subject 划分与相同训练预算下,对比相邻时间窗交错排列和普通时间顺序输入,评估任务指标与计算开销,以检验交错组织是否有独立收益。已有 EEG 相关工作尚未检索确认,原视频结果不构成 BCI 有效性的证据。

    阅读价值:值得阅读的是相邻帧 token 交错排列与多方向 S6 建模如何实现线性复杂度的跨帧信息交互;作者报告的高分辨率收益仍需结合指标、对照基线和完整评估协议核对。

  3. OpenReview · State space models73

    RSMamba:基于状态空间模型的遥感图像分类

    基于摘要分析。该研究面向遥感场景分类,提出基于状态空间模型(SSM)的 RSMamba,旨在通过全局感受野与线性建模复杂度改善整幅图像的语义理解;其核心贡献是动态多路径激活机制,用于增强 Mamba 对二维非因果数据的建模能力。 机制方面,作者采用 Mamba 的硬件感知设计,并针对其原有因果序列建模方式与二维图像结构之间的不适配引入多路径激活,同时保留原有 Mamba 的建模机制。摘要未提供路径构造、激活规则、图像序列化方式、训练目标及具体架构细节,这些内容尚未验证。作者将其定位为潜在视觉基础模型骨干,但摘要并未展示基础模型预训练或迁移评估。 结果方面,作者报告在 UC Merced、AID、RESISC45 遥感图像分类数据集上的 F1 分别为 95.25、92.63、95.18,并称优于同期 Vim 和 VMamba。摘要未说明数值单位、训练与测试划分、F1 平均方式及对照训练条件,因此不能据此作严格的跨方法比较;实验协议、消融及统计信息尚未验证。材料提供了代码仓库,但实现与论文结果的一致性尚未核对。 平台推测(待验证):可迁移假设是,多路径机制或可用于离线 EEG 分类中的通道—时间联合建模,缓解单一序列顺序对跨通道关系表达的限制。可考虑复用 SSM 模块,重新设计 EEG 输入表示、通道顺序与路径构造;遥感图像的二维空间结构不能直接等同于 EEG 通道—时间结构。低信噪比、跨被试差异、通道布局变化及小数据规模均可能使收益消失,非因果路径也需与在线 BCI 的因果约束区分。一个可检验的小实验是在固定 Cross-subject 划分与训练预算下,对比单路径 Mamba 和多路径变体的离线 EEG 分类表现,并检查通道顺序扰动后的稳定性。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读的是其以动态多路径激活机制拓展 Mamba 对二维非因果数据的建模能力,但摘要中的遥感分类结果尚不能证明其适用于 EEG 或 BCI。

  4. OpenReview · State space models73

    SMamba:通过可伸缩状态空间模型实现任意尺度超分辨率

    基于摘要分析。研究针对任意尺度超分辨率(ASSR):用单一模型将低分辨率图像重建为任意目标尺度的高分辨率图像。作者提出正文称为 S³Mamba 的方法,通过 Scalable State Space Model(SSSM)构建可随尺度调整的连续表示空间,并结合尺度感知自注意力提取不同尺度下的重要全局特征。 机制上,摘要将隐式神经表示(INR)描述为连接坐标与像素值、重建连续信号的途径。SSSM 在离散化过程中调制状态转移矩阵及步长采样矩阵,作者称由此实现具有线性计算复杂度的连续尺度建模。尺度感知自注意力用于补充不同尺度下的全局特征感知;具体调制公式、尺度条件的注入方式、训练损失,以及线性复杂度是否涵盖完整网络,尚未验证。 作者报告,在合成与真实场景基准上的实验取得了最先进的性能及任意超分辨率尺度下的泛化能力。摘要未提供基准名称、训练与测试尺度划分、对照方法、指标或数值,因而尚不能核对其提升幅度,或区分已见尺度与未见尺度的泛化。实验协议、消融及统计信息尚未验证;代码与复现条件亦未确认。 平台推测(待验证):假设该尺度条件化的连续表示机制可用于 EEG 时间轴重采样或缺失采样点重建,其潜在对应问题是不同采样率下的信号表示一致性,而不是直接提升 BCI 分类效果。可考虑复用尺度调制的状态空间模块,但需将二维图像坐标改为时间坐标,并处理通道结构、频带约束与抗混叠;原任务依赖低分辨率输入及高分辨率重建目标,迁移所需监督和数据规模尚不明确。低信噪比、小样本及跨被试差异可能使模型重建伪波形或失真频谱。一个可证伪的小实验是在按被试隔离的数据上,对高采样率 EEG 进行抗混叠降采样,比较该机制与常规插值在未见采样比例下的波形、频谱及下游任务表现。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得核对其通过离散化过程中的状态转移与步长采样调制实现连续尺度建模的机制,尤其是线性复杂度的适用范围及尺度外泛化证据;其对 EEG 的价值尚未验证。

  5. OpenReview · State space models76

    ChangeMamba:基于时空状态空间模型的遥感变化检测

    基于摘要分析。该研究面向遥感变化检测,探索以 Mamba 状态空间模型兼顾全局空间上下文建模与多时相特征交互,针对二元变化检测(BCD)、语义变化检测(SCD)和建筑物损伤评估(BDA),分别提出 MambaBCD、MambaSCD 和 MambaBDA。研究对象是遥感影像,而非 EEG 或 BCI。 机制上,三种框架均采用 Visual Mamba 作为编码器,以学习输入影像的全局空间上下文;共有的变化解码器包含三种时空关系建模机制,用于多时相特征交互及变化信息提取。摘要将其动机归结为 CNN 感受野受限以及 Transformer 训练、部署计算开销较高,但未给出三种机制的具体操作、损失函数或训练配置,也不能据此确认实际计算与内存收益。 作者报告,在五个基准数据集上,所提框架优于所比较的 CNN 和 Transformer 方法,且未使用复杂训练策略或技巧;作者还报告了对退化数据的鲁棒性。摘要未提供数据集名称、划分、指标、数值、退化类型及对照配置,因此结果适用范围、实验协议、消融及统计信息尚未验证。摘要提供了源码仓库,复现仍需核对正文中的预处理、训练设置与评估流程。 平台推测(待验证):可迁移的假设是利用状态空间建模连接较长上下文,并在配对时段间显式交互;对应 EEG 中长时序依赖及跨时段变化识别问题。可考察状态空间模块与时段交互模块,但需将影像空间扫描改造成适配电极拓扑和时间序列的表示,并重新定义监督目标。低信噪比、通道差异、被试差异与小数据可能使模型学到伪变化;遥感退化鲁棒性不等于 EEG 鲁棒性。一个可检验的小实验是在固定 EEG 时段分类任务和相同数据划分下,对照单时段状态空间编码器与加入配对时段交互的版本,比较任务指标及噪声扰动下的性能变化。已有相关 EEG 工作尚未检索确认。

    阅读价值:值得阅读其 Visual Mamba 编码器与多时相变化解码器的配合机制,以考察全局空间建模和时相交互的实现;摘要报告了遥感基准及退化数据结果,但其 EEG/BCI 适用性尚未验证。

  6. OpenReview · State space models71

    RSMamba:基于状态空间模型的遥感图像分类

    基于摘要分析。该研究面向遥感图像场景分类,提出基于状态空间模型(SSM)的 RSMamba,旨在兼顾整幅图像的全局理解与线性建模复杂度;核心贡献是通过动态多路径激活机制增强 Mamba 对非因果二维图像数据的建模能力,而非提出 EEG 或 BCI 方法。 技术机制:摘要将遥感场景的复杂性、多样性及其时空分辨率变化列为分类难点。RSMamba 采用硬件感知的 Mamba 设计,在保留原有建模机制的同时,引入动态多路径激活,以应对原始 Mamba 的因果序列建模方式与二维图像结构之间的不匹配。路径如何构造、动态激活如何实现,以及训练目标和推理流程,摘要未提供细节,尚未验证。 结果与复现:作者报告,RSMamba 在多个遥感图像分类数据集上表现更优,但摘要未给出数据集名称、划分协议、对照配置、指标或数值,不能据此量化优势。作者据此提出其作为未来视觉基础模型骨干的潜力,这不等于已经完成基础模型验证。摘要表示代码将公开,当前可用性尚未验证;实验协议、消融及统计信息亦尚未验证。 平台推测(待验证):若多路径机制确实能够减少单一序列顺序对建模的限制,则可能为离线 EEG 的时间—通道联合建模提供参考。可考虑复用 SSM 建模模块,但图像路径需改造成符合电极拓扑与时间结构的路径,分类输入和任务监督也需适配。低信噪比、通道布局变化、跨被试差异及小样本训练可能削弱收益;非因果建模还需与在线 BCI 的因果约束区分。一个可检验的小实验是在固定 EEG 数据划分、预处理及训练预算下,对照单路径 Mamba 与多路径变体,分别检查被试内和跨被试表现,并测试通道扰动下的稳定性。以上仅为机制迁移假设,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读的是其以动态多路径激活机制扩展 Mamba 对非因果二维数据的建模能力,但性能优势及其对 EEG 的迁移价值仍需分别验证。