跳到正文

算法、任务与模态

SSM 最新动态

SSM 研究索引;按可核对的标签归档,不以热度评价质量。

238 条精选近 30 天 29 条共收录 304 条

更新

精选归档 · 第 12 页

1月1日周一第 221–238 条
  1. OpenReview · State space models73

    探索视觉状态空间模型对后门攻击的鲁棒性

    基于摘要分析。该研究考察 Visual State Space Model(VSS)对后门攻击的鲁棒性,重点分析状态空间模型(SSM)机制与图像 patch 处理如何影响触发器的有效性,并据此研究一种在每个 patch 中重复出现、旨在抵抗 patch 扰动的后门触发方式。 后门攻击使受感染模型在特定触发器出现时输出目标标签,而在正常样本上保持正常行为。作者报告,在所考察的不同触发器与模型对照中,SSM 捕获 patch 内上下文信息的机制使 VSS 比不含 SSM 的模型更容易受到后门触发器影响;另一方面,所测试的 patch 处理方式能够有效破坏这些触发器。逐 patch 重复触发的设计针对这一现象,试图使后门在 patch 扰动下仍然有效。摘要未提供具体触发器形式、投毒过程或 patch 处理操作。 作者报告,在三个数据集及多种后门攻击的实验范围内,VSS 的后门鲁棒性与 Transformers(ViTs)相近,但低于仅堆叠 Gated CNN blocks、不含 SSM 的 Gated CNNs。数据集名称、模型配置、训练与评估划分、投毒比例、攻击成功率及正常样本性能尚未验证,因此不能据此作定量比较或推广到所有 VSS 架构。实验协议、消融及统计信息尚未验证,复现时应重点核对架构对照是否控制了训练条件,以及 patch 处理对正常任务性能的影响。 平台推测(待验证):如果 EEG 分类模型也采用分段 token 与 SSM 上下文建模,重复的局部触发模式可能形成类似安全风险,但图像 patch 结论不能直接外推到 EEG。可复用的是局部触发、分段扰动与无 SSM 对照的评估思路;需改造的是适合 EEG 时间段及通道结构的触发方式。低信噪比、跨被试差异、通道布局变化和小数据条件均可能改变触发效果。一个可检验的小实验是在固定 EEG 数据划分和训练条件下,对比 SSM 与非 SSM 模型受到单段及重复分段触发时的攻击成功率和正常样本 Accuracy,同时评估分段扰动的影响。相关 EEG 后门研究尚未检索确认。

    阅读价值:该研究通过后门触发器与 patch 处理的对照分析考察 SSM 的安全风险,值得核对其能否区分 SSM 机制本身与其他架构、训练因素的影响。

  2. OpenReview · State space models71

    RSMamba:基于状态空间模型的遥感图像分类

    基于摘要分析。该研究面向遥感图像场景分类,提出基于状态空间模型(SSM)的 RSMamba,旨在兼顾整幅图像的全局理解与线性建模复杂度;核心贡献是通过动态多路径激活机制增强 Mamba 对非因果二维图像数据的建模能力,而非提出 EEG 或 BCI 方法。 技术机制:摘要将遥感场景的复杂性、多样性及其时空分辨率变化列为分类难点。RSMamba 采用硬件感知的 Mamba 设计,在保留原有建模机制的同时,引入动态多路径激活,以应对原始 Mamba 的因果序列建模方式与二维图像结构之间的不匹配。路径如何构造、动态激活如何实现,以及训练目标和推理流程,摘要未提供细节,尚未验证。 结果与复现:作者报告,RSMamba 在多个遥感图像分类数据集上表现更优,但摘要未给出数据集名称、划分协议、对照配置、指标或数值,不能据此量化优势。作者据此提出其作为未来视觉基础模型骨干的潜力,这不等于已经完成基础模型验证。摘要表示代码将公开,当前可用性尚未验证;实验协议、消融及统计信息亦尚未验证。 平台推测(待验证):若多路径机制确实能够减少单一序列顺序对建模的限制,则可能为离线 EEG 的时间—通道联合建模提供参考。可考虑复用 SSM 建模模块,但图像路径需改造成符合电极拓扑与时间结构的路径,分类输入和任务监督也需适配。低信噪比、通道布局变化、跨被试差异及小样本训练可能削弱收益;非因果建模还需与在线 BCI 的因果约束区分。一个可检验的小实验是在固定 EEG 数据划分、预处理及训练预算下,对照单路径 Mamba 与多路径变体,分别检查被试内和跨被试表现,并测试通道扰动下的稳定性。以上仅为机制迁移假设,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读的是其以动态多路径激活机制扩展 Mamba 对非因果二维数据的建模能力,但性能优势及其对 EEG 的迁移价值仍需分别验证。

4月25日周二
  1. OpenReview · State space models72

    用于多视图强化学习的信息论状态空间模型

    基于摘要分析。本文研究 Multi-View Reinforcement Learning(MVRL)中如何利用来自多个来源、具有时间依赖且可能间歇缺失的观测进行最优控制,提出 Fuse2Control(F2C),以信息论方法从多视图观测序列中捕获底层状态空间模型。 核心问题是:多视图表示学习所提取的潜在表示并不必然适合控制任务,尤其是在观测具有时间依赖、部分视图间歇缺失时。F2C 的目标是聚合各视图中与任务相关的信息,并以状态空间模型支持控制。摘要未给出具体信息论目标、损失形式、状态转移与观测模型参数化、训练或推理流程,因此这些机制尚待全文核对。 作者报告,在多种控制任务上的实验中,F2C 能有效聚合多视图的任务相关信息,随视图数量线性扩展,并对任意缺失视图情形保持鲁棒性。摘要未说明线性扩展具体指计算量、存储量还是其他开销,也未提供任务名称、对照基线、缺失模式、结果指标或数值;实验协议、消融及统计信息尚未验证,不能据此确定其相对优势大小。 平台推测(待验证):若将多通道 EEG 或同步多模态神经观测组织为时间对齐的多视图序列,并具备控制任务反馈,F2C 的状态建模与缺失视图处理思路可能对应 BCI 中传感器缺失和时序信息整合问题。可考虑复用多视图融合与状态表示思路,但观测编码、时间同步和控制反馈接口需适配;低信噪比、跨被试差异、通道冗余及小数据训练可能使潜在状态不能稳定保留控制相关信息。一个可检验的小实验是在固定被试内划分和同一控制任务下,对完整观测与预设通道组间歇缺失条件进行比较,核对 F2C 相对同一基线的控制表现及随视图数变化的计算开销。原领域有效不等于 BCI 有效,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得核对 Fuse2Control 如何从时序多视图观测中提取控制相关状态并处理缺失视图;作者报告的线性扩展性与缺失鲁棒性具有方法阅读价值,但其 EEG/BCI 适用性尚未验证。

1月1日周日
  1. OpenReview · State space models76

    用于语音识别的多头状态空间模型

    基于摘要分析。该研究针对语音识别中的序列建模,提出带特殊门控机制的多头状态空间模型 MH-SSM,使并行头学习局部与全局时间动态;同时提出以 MH-SSM 层增强 transformer 模块的 Stateformer。 机制与对照:MH-SSM 被设计为 transformer 编码器中多头注意力的可直接替换模块。作者报告,在 LibriSpeech 语音识别任务上,该架构显著优于 transformer transducer,但摘要未提供这一替换方案的具体分数及显著性检验细节。Stateformer 则采用增强 transformer 模块的方式,不能与完全替换注意力的方案混为一谈。门控形式、状态空间参数化、训练目标及推理实现尚未验证。 结果:作者报告,Stateformer 在不使用外部语言模型的条件下,开发集 word error rate 为 1.76%/4.37%,测试集为 1.91%/4.36%,并称其达到 LibriSpeech 任务的当时最优表现。摘要未明确两组数值对应的子集名称,因此不补写;训练数据配置、对照设置、消融及统计信息尚未验证,也不能据此推断其计算效率优势。 平台推测(待验证):假设局部与全局时间动态的并行建模能缓解 EEG 长序列中短时事件与较长时间依赖难以兼顾的问题,可尝试复用 MH-SSM 序列模块,但需改造 EEG 通道输入与任务输出。原任务依赖语音序列及语音识别监督,其收益对训练规模的依赖尚不清楚;低信噪比、通道差异、跨被试分布变化及小数据可能使门控学到噪声或被试特异模式。一个可证伪的小实验是在同一 EEG 任务、固定跨被试划分和训练预算下,仅将基线编码器的多头注意力替换为 MH-SSM,比较预先指定的任务指标与跨被试稳定性。已有 EEG 相关工作尚未检索确认。

    阅读价值:MH-SSM 通过带门控的并行状态空间头建模局部与全局时间动态,值得核对其替换及增强注意力模块的实现与对照,但语音识别收益能否迁移至 EEG 尚未验证。

  2. OpenReview · State space models73

    用于多视图强化学习的信息论状态空间模型

    基于摘要分析。本文研究 Multi-View Reinforcement Learning(MVRL):智能体如何利用多个来源的观测学习最优控制,尤其关注观测之间的时间依赖,以及部分视图间歇性缺失的问题。作者提出 Fuse2Control(F2C),以信息论方法从多视图观测序列中捕获底层状态空间模型,为控制任务聚合相关信息。 机制与贡献:原问题并非一般的多视图表示学习,而是面向控制的时序状态建模。其核心思路是从多来源序列中提取与任务相关的潜在状态,处理单纯提取多视图表示难以直接适用于控制的问题。摘要未提供信息论目标的具体形式、状态转移与观测模型的参数化方式、训练损失或推理流程,不能据此将 F2C 等同于某类具体状态空间网络。 结果与证据边界:作者报告,在多种控制任务的实验中,F2C 能有效聚合多个视图中的任务相关信息,随视图数量线性扩展,并对任意视图缺失情形保持鲁棒性。摘要未列明任务名称、数据规模、对照基线、指标或数值,也未说明线性扩展对应计算量、内存还是其他量;缺失模式、实验协议、消融及统计信息尚未验证。 平台推测(待验证):若将多来源神经信号或辅助传感器表示为时间对齐的观测视图,该方法可能对应 BCI 中多模态融合与输入缺失的瓶颈。可考察复用状态建模与视图聚合思路,但观测编码、时序对齐及控制反馈需针对 EEG 改造;低信噪比、跨被试差异和小样本可能使潜在状态捕获非任务因素。一个可检验的假设是:在固定数据划分和训练预算下,加入控制相关状态建模能否比简单融合更好地抵抗视图缺失;可先在具备控制反馈的多视图小规模任务中,对照完整输入与预设缺失模式测试。原文未报告 EEG/BCI 验证,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得关注其将多视图时序观测融合为控制相关潜在状态、并处理间歇性视图缺失的机制,但具体信息论目标、线性扩展的计量对象及缺失协议仍需全文核对。

  3. OpenReview · State space models77

    使用状态空间 Transformer 进行高效电影场景检测

    基于摘要分析。研究针对电影场景检测需要跨越长视频片段进行推理、而常见视频识别模型侧重短时分析的问题,提出可端到端训练的 TranS4mer,以分层的局部与长程建模捕获电影场景线索。原论文研究对象是电影视频,并非 EEG 或 BCI。 核心模块 S4A 结合 structured state-space sequence(S4)与自注意力(A)。输入为已划分为镜头的帧序列:模块先通过自注意力捕获镜头内部的短程依赖,再用状态空间运算聚合镜头之间的长程线索;多个 S4A 模块堆叠构成 TranS4mer。其机制依赖帧—镜头的层级结构,区别于仅对短视频片段建模的方案。具体监督信号、损失函数、模块数量、训练规模与镜头划分方式尚未验证。 作者报告,TranS4mer 在 MovieNet、BBC 和 OVSD 三个电影场景检测数据集上优于此前方法;相较标准 Transformer,速度为其 2 倍,所需 GPU 显存约为其三分之一。摘要未给出检测指标、数据划分、基线配置及测速硬件、序列长度等条件,因此这些结果不能脱离原评估协议比较。实验协议、消融及统计信息尚未验证。作者表示将发布代码和模型,材料不能确认其已公开。 平台推测(待验证):迁移假设是,将 EEG 长记录划为局部时间窗,以自注意力处理窗内关系、以 S4 聚合跨窗依赖,可能缓解长序列全局注意力的计算负担。可复用的是局部—长程分工,需改造视频特征输入、分段策略及任务输出,并重新设计监督目标。EEG 缺少天然镜头边界,低信噪比、跨被试差异、通道配置变化及小数据训练均可能使该结构失效。可检验的小实验是在同一 EEG 数据划分与训练预算下,对比该结构、纯自注意力及纯 S4,检验长上下文是否带来任务指标收益,并记录显存与运行时间;这不是原论文已证实的结论,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得关注其以镜头内自注意力与镜头间状态空间运算分工处理长视频的机制;作者报告了效率优势,但能否迁移到 EEG 长序列建模尚未验证。

  4. OpenReview · State space models75

    ODE-RSSM:从不规则采样数据中学习随机循环状态空间模型

    基于摘要分析。该研究针对具有非线性和随机性的输入—输出系统,提出连续时间随机循环状态空间模型 ODE-RSSM,以解决多数离散时间 SSM 难以处理不规则采样观测的问题。其主要贡献是用 ODE-Net 描述相邻观测时点之间的潜状态演化,并通过重参数化支持不同时间跨度的 ODE 批量并行求解。 机制上,ODE-RSSM 将连续时间演化引入潜状态建模;批量求解方法受到积分上下限等价线性变换的启发,旨在提高不规则采样序列的训练效率。摘要未说明随机状态的具体分布、观测模型、损失函数及 ODE 求解器配置,这些实现条件尚未验证。 作者报告,在三个输入—输出数据集的开环预测评估中,ODE-RSSM 优于所比较的基线,包括预测时点间隔不均匀、间隔长度分布变化的情形。其中一个数据集为具有较强长期延迟和随机性的私有工业数据集 rollout。摘要未提供具体指标、数值、数据划分或基线名称,实验协议、消融及统计信息尚未验证。材料提供了代码仓库,但代码可运行性及私有数据实验的可复现性尚未验证。 平台推测(待验证):若 EEG 任务存在采样缺失、异步多模态观测或不规则事件间隔,连续时间潜状态演化和非均匀时间跨度批量求解可能具有方法参考价值;原领域有效不等于 BCI 有效。可复用部分是时间演化与求解机制,需改造观测编码、输入—输出定义和随机状态建模以适配 EEG 通道及任务监督。低信噪比、跨被试差异、通道缺失和小数据可能使潜状态估计不稳定,连续轨迹也可能难以描述短暂事件。一个可检验的小实验是在固定被试内划分下,对同一 EEG 预测任务施加不同程度的时间点删除,比较 ODE-RSSM 与离散时间模型在相同可见观测及预测时点上的误差和运行成本。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读的是其面向不规则时间间隔的连续时间潜状态建模,以及非均匀时间跨度下批量 ODE 求解的重参数化机制;这些机制对缺失或异步神经信号的适用性尚未验证。

10月17日周一
  1. OpenReview · State space models78

    基于模型的强化学习中深度状态空间模型的不确定性研究

    基于摘要分析。本文研究基于模型的强化学习中 Recurrent State Space Models(RSSMs)的不确定性建模与推断机制,提出 Variational Recurrent Kalman Network(VRKN),以更明确地区分偶然不确定性与认知不确定性。原论文主要研究对象是强化学习中的环境动态模型,并非 EEG 解码或 BCI。 作者报告,RSSMs 使用的次优推断方案会使模型高估真实系统的偶然不确定性,而这种高估产生的隐式正则化有助于其在基于模型的强化学习中取得效果。作者进一步提出假说:该正则化可能发挥与显式建模认知不确定性相似的作用。这一功能解释应与作者报告的高估现象区分,不能视为已普遍证实的等价关系。 VRKN 在潜在空间中使用 Kalman 更新进行精确平滑推断,并通过 Monte Carlo Dropout 建模认知不确定性。作者指出,Kalman 更新使其能够自然处理缺失观测,以及每个时间步观测数量不同的传感器融合问题。具体潜在状态假设、训练目标与平滑推断实现尚未验证。 作者报告,在需要准确刻画偶然不确定性的任务中,以 VRKN 替代 RSSM 可改善性能,而在确定性的标准基准上表现相当。摘要未提供任务名称、数据规模、评价指标或具体数值;实验协议、消融及统计信息尚未验证,不能据此推断其在所有强化学习任务中均优于 RSSM。 平台推测(待验证):若将 EEG 建模为潜在动态过程的带噪观测,这种区分两类不确定性并处理缺失观测的机制,可能对应信号缺失或异步多模态融合问题。可考察复用潜在状态更新与不确定性建模组件,但需改造 EEG 观测编码、时间尺度及监督目标;低信噪比、跨被试分布变化、通道配置差异和小数据可能使潜在动态假设或不确定性估计失效。一个可检验的小实验是在固定被试内划分、训练数据和下游任务的条件下,比较 RSSM 与 VRKN 在逐步增加缺失时间窗时的预测误差与不确定性校准表现。原领域结果不等于 BCI 有效性,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读的是作者对 RSSMs 中偶然不确定性高估与隐式正则化关系的分析,以及用 VRKN 分开建模两类不确定性的替代方案;其对 EEG 缺失观测与多模态融合的价值尚未验证。

1月1日周六
  1. OpenReview · State space models77

    使用状态空间 Transformer 的高效电影场景检测

    基于摘要分析。本文研究电影场景检测:场景理解需要跨越较长电影片段整合线索,而多数视频识别模型侧重短时分析。作者提出可端到端训练的 State-Space Transformer 模型 TranS4mer,通过结合局部自注意力与长程状态空间运算,建模电影中的短程和长程依赖。 核心模块 S4A 结合 structured state-space sequence(S4)与自注意力(A)。输入是已划分为电影镜头的帧序列;模块先用自注意力捕获镜头内短程依赖,再用状态空间运算聚合镜头间长程线索。TranS4mer 由多个 S4A 模块堆叠构成,具体堆叠数量、特征提取方式、损失函数及训练配置尚未验证。该设计的关键在于利用镜头这一层级结构,分别处理局部关系与跨镜头上下文。 作者报告,在 MovieNet、BBC 和 OVSD 三个电影场景检测数据集上,TranS4mer 优于此前方法;相较标准 Transformer,速度为其 2 倍,GPU 显存需求约为其三分之一。摘要未给出检测指标、划分协议、具体对照配置及效率测量条件,因此这些结果仅适用于作者所述电影场景检测评估,实验协议、消融及统计信息尚未验证。作者表示将发布代码和模型,材料不能确认其已公开。 平台推测(待验证):可检验的迁移假设是,将局部交互与长程状态聚合分离,可能缓解长时 EEG 建模的计算负担。可复用的是 S4A 的分工机制,但电影镜头结构不能直接等同于 EEG 时间窗;需要改造信号编码、时间分段与任务监督。摘要也不足以判断原方法的数据规模要求。低信噪比、跨被试差异、通道布局变化及小数据训练均可能使局部注意力学习到噪声,或使长程聚合混合不同生理状态。一个小规模可证伪实验是在同一 EEG 数据集、固定跨被试划分及相同输入长度和训练预算下,对比局部注意力加 S4、纯注意力和纯 S4,核对任务指标与速度、显存,并测试时间窗长度变化。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读的是 TranS4mer 将镜头内自注意力与镜头间 S4 状态空间聚合分工结合的长序列建模机制;其效率优势由作者报告,对 EEG 的迁移价值尚未验证。

1月1日周五
  1. OpenReview · State space models74

    图卷积神经网络的非线性状态空间推广

    基于摘要分析。本文研究图卷积神经网络(GCNN)在网络数据上的表示学习,从状态空间视角解释图卷积,并提出以非线性、参数化状态更新进行层内节点聚合的一类推广模型,旨在改善特征提取与传播稳定性之间的权衡。 核心机制:作者将图卷积模块描述为一种简约的线性状态空间模型,其中状态更新矩阵是图移位算子。作者指出,这种更新本身非参数化,且随图谱性质可能出现状态爆炸或衰减,使 GCNN 的可学习自由度需要同时承担特征提取与处理不稳定性的任务。所提方法将节点特征聚合改为非线性、参数化的状态空间过程,并构建两种受递推机制启发的架构,分别不采用和采用节点门控,从而增加控制状态更新的手段。摘要未给出具体状态方程、门控形式、损失函数或训练配置,尚不能判断其稳定性保障属于理论性质还是经验改善。 结果与证据边界:作者报告,在 source localization 和 authorship attribution 任务上,所提非线性状态空间推广模型优于基线 GCNN。摘要未提供数据集、划分、评价指标和数值;实验协议、消融及统计信息尚未验证。这里的 source localization 未被明确描述为 EEG 源定位,不能据此视为脑信号验证。 平台推测(待验证):迁移假设是,当 EEG 通道或脑区被表示为图节点、节点具有信号特征且图移位算子已定义时,可学习状态更新与节点门控可能缓解多步图传播中的特征衰减或放大。可复用的是层内聚合机制;需改造和核对的是 EEG 图构建、时序特征接口及训练监督。低信噪比、跨被试连接差异、通道变化及小数据条件可能使额外参数过拟合,或使门控抑制弱但有效的信号。一个可检验的小实验是在固定 EEG 图、相同特征与预先确定的跨被试划分下,对比 GCNN、无门控和有门控版本,在控制参数预算的同时考察任务指标及传播状态幅值;该实验是迁移建议,并非论文已验证结果。相关 EEG 工作尚未检索确认。

    阅读价值:值得阅读的具体原因是作者将图卷积的传播稳定性与状态空间更新联系起来,并提出可参数化的非线性节点聚合机制;其对 EEG 图建模的价值尚未验证。

  2. OpenReview · State space models80

    深度状态空间高斯过程

    基于摘要分析。研究针对深度高斯过程(DGP)回归的状态空间建模与计算问题,通过层级随机微分方程表示,将回归转化为可序贯求解的状态估计问题,并提出状态空间 MAP、贝叶斯滤波与平滑方案。 核心机制是在层级结构中,对下一层 GP 的长度尺度和幅度赋予经过变换的 GP 先验,使这些参数能够随输入变化。作者将该结构表示为由线性随机微分方程(SDE)组成的非线性层级系统,其中每个 SDE 对应一个条件 GP;利用状态空间 DGP 的马尔可夫性质进行序贯估计。作者报告计算复杂度随观测数量线性增长,但摘要未提供状态维度、计算常数及具体运行时间,不能据此判断相对其他 DGP 实现的实际加速幅度。 作者报告在合成非平稳信号上展示模型与方法的表现,并将其用于 LIGO 测量中的引力波检测。摘要未给出定量指标、数据划分或对照结果;具体核函数、状态空间表示条件、推断近似、实验协议、消融及统计信息尚未验证。 平台推测(待验证):该机制可能对应 EEG 中局部平滑程度与幅度随时间变化的非平稳建模需求。迁移假设依赖时间序列结构、观测模型和可用数据规模,可复用层级先验及滤波/平滑框架,但需要改造多通道观测与噪声模型,并核对所选 GP 的 SDE 表示条件。低信噪比可能使幅度变化与伪迹混淆,通道增加可能抬高状态估计成本,小数据与跨被试差异也可能造成先验失配。可先在固定被试内划分下,比较该方法与平稳状态空间 GP 对遮蔽 EEG 片段的重建误差、预测不确定性及运行时间,检验非平稳层级建模是否带来收益;这不等同于验证 BCI 解码效果。相关 EEG 工作尚未检索确认。

    阅读价值:值得阅读其将层级非平稳 GP 回归转化为序贯状态估计的机制;作者报告计算复杂度随观测数量线性增长,但其在 EEG 上的适用性与效率收益尚未验证。

  3. OpenReview · State space models71

    状态空间人工神经网络的改进初始化方法

    基于摘要分析。本文研究黑箱非线性状态空间系统辨识中的参数初始化问题,提出针对递归人工神经网络状态空间模型的改进初始化方法,并强调在模型结构中保留显式线性项的重要性。核心目标是降低非线性优化收敛到性能较差局部极小值的风险。 机制上,人工神经网络用于灵活表示状态方程与输出方程,待优化参数包括网络权重和偏置。所提方法从非线性系统的线性近似出发初始化部分网络权重,其余权重使用随机值或零初始化。摘要未说明线性近似的获取方式、各类初始化对应的具体参数、显式线性项的位置,以及损失函数和优化流程,相关细节尚未验证。 作者报告,在两个基准示例上,相较此前提出的方法,该初始化方案展现了有效性。摘要未提供基准名称、数据划分、对照方法名称、评价指标或数值,因此尚不能判断提升幅度及适用范围;实验协议、消融及统计信息尚未验证。复现需进一步核对模型方程、线性模型辨识过程、随机初始化设置,以及是否在相同模型容量和优化预算下比较。 平台推测(待验证):若 EEG 任务可表述为连续时序的状态演化与观测预测,该方法可能对应小数据下递归模型训练不稳定的问题。可复用的是以线性近似初始化非线性模型及保留显式线性项的思路;需改造的是 EEG 观测方程、通道组织与任务目标。迁移依赖足够的连续序列及可辨识的线性动态,低信噪比、跨被试差异或通道变化可能使线性近似失配。一个可检验的小实验是在固定 EEG 被试内预测协议下,对比随机初始化与该初始化,并分别控制显式线性项的有无,考察多次随机运行的预测误差与收敛稳定性;这属于迁移假设,不是已证实的 BCI 效果。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得核对其如何将系统的线性近似用于递归状态空间神经网络初始化,以及显式线性项是否改善优化;摘要仅报告两个基准示例,EEG/BCI 适用性尚未验证。

1月1日周三
  1. OpenReview · State space models80

    深度状态空间高斯过程

    基于摘要分析。该研究针对深度高斯过程(DGP)回归的计算问题,通过状态空间表示,将层次化 GP 回归转化为可用序贯方法求解的状态估计问题,并提出状态空间最大后验(MAP)估计、贝叶斯滤波与平滑方案。 核心机制是在层次结构中,为下一层 GP 的长度尺度与幅度设置经过变换的 GP 先验,使这些特征能够随输入变化。作者将 DGP 表示为由线性随机微分方程(SDE)组成的非线性层次系统,其中每个 SDE 对应一个条件 GP,再利用状态空间 DGP 的马尔可夫性质进行序贯估计。这一区别于直接处理整体 GP 回归的计算路径,是理解该方法的重点;它不是通常意义上的深度神经网络结构。作者报告计算复杂度随测量数量线性增长,但具体适用的 GP 类别、状态维度及近似条件尚未验证。 作者报告在合成非平稳信号上展示了模型与方法的表现,并将方法用于 LIGO 测量中的引力波检测。摘要未提供具体指标、对照基线或数据划分,因此不能据此判断性能优势的幅度。实验协议、消融及统计信息尚未验证;复现还需核对先验变换、SDE 构造、离散化与推断设置,代码可用性尚未验证。 平台推测(待验证):迁移假设是,随时间变化的长度尺度与幅度先验可能适合描述 EEG 的非平稳性,而序贯估计可能有助于长时序处理。可复用的是层次先验及滤波、平滑框架;需改造的是多通道观测模型、通道间关系及噪声模型。该方法依赖可构造状态空间表示的 GP 与序列观测,但摘要不足以确定其监督形式和数据规模要求。低信噪比、伪迹、跨被试差异和小数据条件可能使层次参数难以辨识。一个可检验的小实验是在固定被试内划分与相同观测条件下,比较该方法与平稳状态空间 GP 的 EEG 时序回归误差、预测不确定性校准及运行时间;滤波与平滑应分别评估。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其将层次化非平稳 GP 回归转为状态估计的机制,以及作者所述计算复杂度随测量数量线性增长的适用条件;对 EEG 时序建模的价值尚待验证。

1月1日周日
  1. OpenReview · State space models76

    用于学习非线性动力系统的灵活状态空间模型

    基于摘要分析。该研究针对非线性动力系统的学习,将状态转移函数与观测函数表示为基函数展开,并从数据中学习展开系数。核心贡献是利用与 Gaussian processes 的联系构造系数先验,以调节模型灵活性、抑制过拟合,同时设计基于序贯 Monte Carlo 的参数学习算法。 机制上,基函数展开承担非线性函数表示,系数先验则可视为正则化,用于在表达能力与泛化之间取得平衡。作者将这一设计与 Gaussian process state-space model 联系起来,但摘要未给出基函数类型、先验具体形式或二者的精确对应。学习算法用于估计展开系数及其他未知参数;作者称其具有理论保证,保证的条件与范围尚未验证。 作者报告,该方法在一个经典基准及真实数据上获得了有前景的结果。摘要未提供基准名称、数据规模、划分协议、对照方法或量化指标,因此尚不能判断收益大小及适用范围;实验协议、消融及统计信息尚未验证。复现需进一步核对基函数选择、先验设置、隐状态推断流程、序贯 Monte Carlo 的计算配置及参数学习细节。 平台推测(待验证):若 EEG 时序中的潜在动态可由该类非线性状态空间模型近似,基函数表示与系数正则化可能有助于限制小数据条件下的模型复杂度;这是迁移假设,而非已证实的 BCI 效果。原方法依赖时序观测及隐状态建模,具体监督需求与数据规模要求尚未验证。可考虑复用函数展开、先验与学习框架,但需适配 EEG 的多通道观测、噪声特性及跨被试差异。低信噪比、通道配置变化和有限训练数据可能使隐状态难以辨识,或导致先验约束不合适。一个可证伪的小实验是在固定通道、固定划分的被试内 EEG 数据上,以留出时段的预测误差比较该模型、线性状态空间模型与弱正则化版本,检验非线性表示及先验是否带来稳定收益。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其如何通过与 Gaussian processes 相联系的系数先验约束非线性状态空间模型的灵活性,以及配套序贯 Monte Carlo 学习算法;其对 EEG 动态建模的适用性尚未验证。

1月1日周五
  1. OpenReview · State space models75

    用于学习非线性动力系统的灵活状态空间模型

    基于摘要分析。该研究面向非线性动力系统学习,将状态转移函数和观测函数表示为基函数展开,并从数据中学习展开系数。其核心贡献是利用与 Gaussian processes 的联系构建系数先验,以调节模型灵活性、抑制过拟合,并设计基于 sequential Monte Carlo 的参数学习算法。 机制上,基函数展开承担非线性函数的表示,系数先验则可理解为正则化:作者希望保留展开形式的表达能力,同时改善泛化。学习算法用于估计展开系数及其他未知参数;摘要称其具有学习方面的理论保证,但保证的具体对象、成立条件和收敛性质尚未验证。基函数类型、先验形式、隐状态设定、训练流程与推理成本也需查阅全文。 作者报告,该方法在一个经典 benchmark 和真实数据上取得有希望的结果,但摘要未给出数据名称、划分协议、对照方法或量化指标,因而不能判断收益大小,也不能与其他协议下的结果直接比较。实验协议、消融及统计信息尚未验证。 平台推测(待验证):若 EEG 的时序变化可由低维隐状态及非线性观测关系近似,该框架可能用于潜在动力学建模;这是假设,不是已证实的 EEG/BCI 效果。可复用部分是基函数表示、系数先验和序贯推断思路,需改造的是多通道观测关系、噪声假设及被试差异处理。低信噪比、通道变化和小数据可能使隐状态难以辨识,跨被试非平稳性也可能削弱泛化。一个可检验的小实验是在固定通道的单被试 EEG 上,采用互不重叠的训练与测试时间段,在匹配基函数规模和推断预算的条件下,对比带该先验与弱正则化版本的留出预测误差及稳定性。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其如何将基函数展开、Gaussian processes 关联先验与 sequential Monte Carlo 学习结合,以兼顾非线性动力学表达能力和正则化;具体理论保证及实验收益仍需全文核对。

  2. OpenReview · State space models80

    非线性状态空间模型的结构化推断网络

    基于摘要分析。本文研究线性与非线性状态空间模型的高效学习,提出统一算法,联合训练生成模型与推断网络,覆盖以深度神经网络建模发射分布和状态转移分布的变体。 核心机制是使用循环神经网络参数化具有结构的变分近似,以逼近潜在状态的后验分布,同时学习生成模型与编译式推断网络(compiled inference network)。其方法重点在于推断端的后验结构,而非仅以神经网络替换生成端的分布。摘要未给出具体后验依赖关系、分布族、损失表达式或训练与推理流程,这些细节尚未验证。 作者报告在合成及真实数据集上展示了方法的可扩展性与适用性,并报告结构化后验近似带来了显著更高的留出数据似然。摘要未提供数据集名称、划分方式、对照基线、具体数值及统计检验信息,因此不能判断收益大小或直接比较不同实验协议;实验协议、消融及统计信息尚未验证。 平台推测(待验证):若 EEG 序列可由潜在状态及其转移过程描述,该机制可能用于非线性潜在动态建模和时序推断,但原领域的似然提升不等于 BCI 解码效果提升。可考虑复用状态空间生成模型与结构化推断思路,需针对 EEG 的通道观测、噪声和序列切分改造发射模型与训练流程;摘要未说明是否依赖任务标签或需要多大数据规模。低信噪比、跨被试分布差异、通道变化及小数据可能使模型拟合非任务相关动态。一个可检验的小实验是在固定被试内划分与相同生成模型下,对比结构化和非结构化变分近似,分别评估留出似然及固定下游解码器的表现,检验生成建模收益是否转化为任务收益。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其如何用具有结构的变分后验联合学习推断网络与状态空间生成模型;作者报告该近似提升了留出数据似然,但其对 EEG 潜在动态建模的价值尚未验证。

  3. OpenReview · State space models80

    非线性状态空间模型的结构化推断网络

    基于摘要分析。本文研究如何高效学习线性与非线性状态空间模型,提出统一学习算法,将结构化变分推断网络与生成模型联合训练,适用于发射分布和状态转移分布由深度神经网络建模的情形。 核心机制是用循环神经网络参数化结构化变分近似,以逼近潜在状态的后验分布,同时学习可直接执行推断的 compiled inference network 与生成模型。其方法重点不仅在于使用非线性生成函数,也在于通过结构化后验近似处理序列推断。摘要未说明后验的具体因子分解、循环网络结构、损失形式或训练与推理流程,这些细节尚未验证。 作者报告,该算法在合成与真实数据上展现了可扩展性和适用性,并且采用结构化后验近似所得模型具有显著更高的留出数据似然。摘要未提供数据集名称、划分方式、对照方法、似然数值或显著性检验信息,因此不能据此判断提升幅度,也不能将似然改善等同于下游分类性能提升;实验协议、消融及统计信息尚未验证。 平台推测(待验证):该方法原本面向具有潜在动态状态的序列生成建模,依赖观测序列及其时间结构。若 EEG 的潜在动态能被状态转移与观测发射机制合理描述,结构化后验近似可能用于时序表征学习。可复用的是生成模型与推断网络联合学习的框架;需改造的是多通道 EEG 的观测模型、噪声假设及跨被试处理。低信噪比、通道差异和小样本可能使潜在状态主要拟合伪迹或被试特征。一个可检验的小实验是:固定 EEG 数据划分、生成模型与训练预算,仅比较结构化和非结构化后验近似,核对留出似然及下游任务指标是否同时改善。该假设不是已证实的 BCI 效果,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其利用循环神经网络参数化结构化变分后验、联合学习推断网络与状态空间生成模型的机制;作者报告留出数据似然有所提高,但具体对照、统计证据及 EEG 适用性尚未验证。

1月1日周四
  1. OpenReview · State space models72

    用于声学回声削减与去混响的变分贝叶斯状态空间模型

    基于摘要分析。研究针对 A/D 与 D/A 转换器不同步时的语音去混响、声学回声削减和降噪问题,提出基于变分贝叶斯的联合优化方法,利用两个状态空间模型分别描述时变回声滤波器和无噪多通道语音信号。 核心机制是将转换器异步条件下的声学回声削减滤波器视为时变状态向量;第二个模型则将无噪多通道语音信号视为状态向量,使去混响滤波器能够在含噪环境中更新。作者通过变分贝叶斯框架优化这两类模型,交替执行两个基于 Kalman smoother 的参数优化阶段。具体状态转移、观测模型、概率分布与优化目标尚未验证。 作者报告,在真实远程会议室录制的数据上,即使 A/D 与 D/A 转换器异步,所提方法也比作者此前的传统方法更有效地削减声学回声、语音混响和背景噪声。摘要未提供数值指标、数据规模或划分方式,实验协议、消融及统计信息尚未验证;因此无法判断收益大小及不同噪声条件下的稳定性。 平台推测(待验证):迁移假设是,时变干扰参数与潜在干净多通道信号的联合状态估计,可能用于 EEG 非平稳伪迹抑制。原方法依赖多通道时序观测及声学回声、混响的结构假设,具体参考信号和监督需求需查正文;可复用的是双状态建模与交替平滑优化思路,需改造的是 EEG 观测模型、伪迹动力学及通道耦合关系。低信噪比、跨被试差异、通道变化和小数据可能导致状态估计不稳定,或把任务相关脑活动误当作干扰。一个可证伪的小实验是在固定被试内划分的 EEG 上注入已知时变伪迹,对比单状态与双状态估计,并同时检查伪迹残留和原始 ERP 波形保真度。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读的是以两个状态空间模型及交替 Kalman 平滑优化联合处理时变回声与含噪多通道信号的机制,其对 EEG 伪迹建模的可迁移性尚未验证。