跳到正文

算法、任务与模态

SSM 最新动态

SSM 研究索引;按可核对的标签归档,不以热度评价质量。

292 条精选近 30 天 30 条共收录 375 条

更新

精选归档 · 第 15 页

1月1日周五第 281–292 条
  1. OpenReview · State space models80

    深度状态空间高斯过程

    基于摘要分析。研究针对深度高斯过程(DGP)回归的状态空间建模与计算问题,通过层级随机微分方程表示,将回归转化为可序贯求解的状态估计问题,并提出状态空间 MAP、贝叶斯滤波与平滑方案。 核心机制是在层级结构中,对下一层 GP 的长度尺度和幅度赋予经过变换的 GP 先验,使这些参数能够随输入变化。作者将该结构表示为由线性随机微分方程(SDE)组成的非线性层级系统,其中每个 SDE 对应一个条件 GP;利用状态空间 DGP 的马尔可夫性质进行序贯估计。作者报告计算复杂度随观测数量线性增长,但摘要未提供状态维度、计算常数及具体运行时间,不能据此判断相对其他 DGP 实现的实际加速幅度。 作者报告在合成非平稳信号上展示模型与方法的表现,并将其用于 LIGO 测量中的引力波检测。摘要未给出定量指标、数据划分或对照结果;具体核函数、状态空间表示条件、推断近似、实验协议、消融及统计信息尚未验证。 平台推测(待验证):该机制可能对应 EEG 中局部平滑程度与幅度随时间变化的非平稳建模需求。迁移假设依赖时间序列结构、观测模型和可用数据规模,可复用层级先验及滤波/平滑框架,但需要改造多通道观测与噪声模型,并核对所选 GP 的 SDE 表示条件。低信噪比可能使幅度变化与伪迹混淆,通道增加可能抬高状态估计成本,小数据与跨被试差异也可能造成先验失配。可先在固定被试内划分下,比较该方法与平稳状态空间 GP 对遮蔽 EEG 片段的重建误差、预测不确定性及运行时间,检验非平稳层级建模是否带来收益;这不等同于验证 BCI 解码效果。相关 EEG 工作尚未检索确认。

    阅读价值:值得阅读其将层级非平稳 GP 回归转化为序贯状态估计的机制;作者报告计算复杂度随观测数量线性增长,但其在 EEG 上的适用性与效率收益尚未验证。

  2. OpenReview · State space models71

    状态空间人工神经网络的改进初始化方法

    基于摘要分析。本文研究黑箱非线性状态空间系统辨识中的参数初始化问题,提出针对递归人工神经网络状态空间模型的改进初始化方法,并强调在模型结构中保留显式线性项的重要性。核心目标是降低非线性优化收敛到性能较差局部极小值的风险。 机制上,人工神经网络用于灵活表示状态方程与输出方程,待优化参数包括网络权重和偏置。所提方法从非线性系统的线性近似出发初始化部分网络权重,其余权重使用随机值或零初始化。摘要未说明线性近似的获取方式、各类初始化对应的具体参数、显式线性项的位置,以及损失函数和优化流程,相关细节尚未验证。 作者报告,在两个基准示例上,相较此前提出的方法,该初始化方案展现了有效性。摘要未提供基准名称、数据划分、对照方法名称、评价指标或数值,因此尚不能判断提升幅度及适用范围;实验协议、消融及统计信息尚未验证。复现需进一步核对模型方程、线性模型辨识过程、随机初始化设置,以及是否在相同模型容量和优化预算下比较。 平台推测(待验证):若 EEG 任务可表述为连续时序的状态演化与观测预测,该方法可能对应小数据下递归模型训练不稳定的问题。可复用的是以线性近似初始化非线性模型及保留显式线性项的思路;需改造的是 EEG 观测方程、通道组织与任务目标。迁移依赖足够的连续序列及可辨识的线性动态,低信噪比、跨被试差异或通道变化可能使线性近似失配。一个可检验的小实验是在固定 EEG 被试内预测协议下,对比随机初始化与该初始化,并分别控制显式线性项的有无,考察多次随机运行的预测误差与收敛稳定性;这属于迁移假设,不是已证实的 BCI 效果。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得核对其如何将系统的线性近似用于递归状态空间神经网络初始化,以及显式线性项是否改善优化;摘要仅报告两个基准示例,EEG/BCI 适用性尚未验证。

1月1日周三
  1. OpenReview · State space models80

    深度状态空间高斯过程

    基于摘要分析。该研究针对深度高斯过程(DGP)回归的计算问题,通过状态空间表示,将层次化 GP 回归转化为可用序贯方法求解的状态估计问题,并提出状态空间最大后验(MAP)估计、贝叶斯滤波与平滑方案。 核心机制是在层次结构中,为下一层 GP 的长度尺度与幅度设置经过变换的 GP 先验,使这些特征能够随输入变化。作者将 DGP 表示为由线性随机微分方程(SDE)组成的非线性层次系统,其中每个 SDE 对应一个条件 GP,再利用状态空间 DGP 的马尔可夫性质进行序贯估计。这一区别于直接处理整体 GP 回归的计算路径,是理解该方法的重点;它不是通常意义上的深度神经网络结构。作者报告计算复杂度随测量数量线性增长,但具体适用的 GP 类别、状态维度及近似条件尚未验证。 作者报告在合成非平稳信号上展示了模型与方法的表现,并将方法用于 LIGO 测量中的引力波检测。摘要未提供具体指标、对照基线或数据划分,因此不能据此判断性能优势的幅度。实验协议、消融及统计信息尚未验证;复现还需核对先验变换、SDE 构造、离散化与推断设置,代码可用性尚未验证。 平台推测(待验证):迁移假设是,随时间变化的长度尺度与幅度先验可能适合描述 EEG 的非平稳性,而序贯估计可能有助于长时序处理。可复用的是层次先验及滤波、平滑框架;需改造的是多通道观测模型、通道间关系及噪声模型。该方法依赖可构造状态空间表示的 GP 与序列观测,但摘要不足以确定其监督形式和数据规模要求。低信噪比、伪迹、跨被试差异和小数据条件可能使层次参数难以辨识。一个可检验的小实验是在固定被试内划分与相同观测条件下,比较该方法与平稳状态空间 GP 的 EEG 时序回归误差、预测不确定性校准及运行时间;滤波与平滑应分别评估。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其将层次化非平稳 GP 回归转为状态估计的机制,以及作者所述计算复杂度随测量数量线性增长的适用条件;对 EEG 时序建模的价值尚待验证。

  2. OpenReview · State space models71

    利用深度编码器从视频数据进行非线性状态空间模型辨识

    基于摘要分析。本文研究如何从视频等高维输入输出数据辨识非线性状态空间模型,核心贡献是用神经网络编码器从历史输入与输出估计模型状态,并将编码器与动力学联合学习。研究对象是高维观测下的动态系统辨识,而非 EEG 解码或 BCI。 机制上,编码器学习 reconstructability map(状态可重构映射),将过去的输入输出转换为模型状态估计,为动力学建模提供状态表示。作者还提出 multiple shooting(多重打靶法)的改进重构形式与批量优化,以控制高维、大规模数据下的计算时间。摘要未给出网络结构、损失函数、历史窗口长度、优化细节或计算成本对照,具体实现尚未验证。 作者在单位盒内可控小球的模拟环境视频流上应用该方法,并报告所得模型具有较低的仿真误差和良好的长期预测能力。摘要未提供误差指标、预测时域、训练与测试划分或基线结果,因此无法量化效果或判断泛化范围;实验协议、消融及统计信息尚未验证。 平台推测(待验证):其可迁移假设是,历史多通道 EEG 与可记录的任务输入能够提供足够信息,使编码器估计具有预测价值的潜在状态,从而缓解高维观测与动态建模之间的困难。可复用部分是历史窗口编码、状态转移学习和分段优化;需改造观测表示、任务输入定义及噪声处理。EEG 低信噪比、跨被试与通道差异,以及小数据条件下潜在状态的可辨识性不足,均可能使该假设失败。一个可检验的小实验是在固定通道的被试内 EEG 数据上,按独立试次划分训练与测试集,以相同历史窗口比较该思路与线性状态空间基线的多步信号预测误差;该实验仅检验动态预测,不代表 BCI 解码有效性。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读的是将历史输入输出的状态估计编码器与非线性动力学联合学习,并结合 multiple shooting 与批量优化处理高维观测;其长时预测证据限于模拟视频环境,EEG 适用性尚未验证。

1月1日周日
  1. OpenReview · State space models76

    用于学习非线性动力系统的灵活状态空间模型

    基于摘要分析。该研究针对非线性动力系统的学习,将状态转移函数与观测函数表示为基函数展开,并从数据中学习展开系数。核心贡献是利用与 Gaussian processes 的联系构造系数先验,以调节模型灵活性、抑制过拟合,同时设计基于序贯 Monte Carlo 的参数学习算法。 机制上,基函数展开承担非线性函数表示,系数先验则可视为正则化,用于在表达能力与泛化之间取得平衡。作者将这一设计与 Gaussian process state-space model 联系起来,但摘要未给出基函数类型、先验具体形式或二者的精确对应。学习算法用于估计展开系数及其他未知参数;作者称其具有理论保证,保证的条件与范围尚未验证。 作者报告,该方法在一个经典基准及真实数据上获得了有前景的结果。摘要未提供基准名称、数据规模、划分协议、对照方法或量化指标,因此尚不能判断收益大小及适用范围;实验协议、消融及统计信息尚未验证。复现需进一步核对基函数选择、先验设置、隐状态推断流程、序贯 Monte Carlo 的计算配置及参数学习细节。 平台推测(待验证):若 EEG 时序中的潜在动态可由该类非线性状态空间模型近似,基函数表示与系数正则化可能有助于限制小数据条件下的模型复杂度;这是迁移假设,而非已证实的 BCI 效果。原方法依赖时序观测及隐状态建模,具体监督需求与数据规模要求尚未验证。可考虑复用函数展开、先验与学习框架,但需适配 EEG 的多通道观测、噪声特性及跨被试差异。低信噪比、通道配置变化和有限训练数据可能使隐状态难以辨识,或导致先验约束不合适。一个可证伪的小实验是在固定通道、固定划分的被试内 EEG 数据上,以留出时段的预测误差比较该模型、线性状态空间模型与弱正则化版本,检验非线性表示及先验是否带来稳定收益。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其如何通过与 Gaussian processes 相联系的系数先验约束非线性状态空间模型的灵活性,以及配套序贯 Monte Carlo 学习算法;其对 EEG 动态建模的适用性尚未验证。

1月1日周五
  1. OpenReview · State space models75

    用于学习非线性动力系统的灵活状态空间模型

    基于摘要分析。该研究面向非线性动力系统学习,将状态转移函数和观测函数表示为基函数展开,并从数据中学习展开系数。其核心贡献是利用与 Gaussian processes 的联系构建系数先验,以调节模型灵活性、抑制过拟合,并设计基于 sequential Monte Carlo 的参数学习算法。 机制上,基函数展开承担非线性函数的表示,系数先验则可理解为正则化:作者希望保留展开形式的表达能力,同时改善泛化。学习算法用于估计展开系数及其他未知参数;摘要称其具有学习方面的理论保证,但保证的具体对象、成立条件和收敛性质尚未验证。基函数类型、先验形式、隐状态设定、训练流程与推理成本也需查阅全文。 作者报告,该方法在一个经典 benchmark 和真实数据上取得有希望的结果,但摘要未给出数据名称、划分协议、对照方法或量化指标,因而不能判断收益大小,也不能与其他协议下的结果直接比较。实验协议、消融及统计信息尚未验证。 平台推测(待验证):若 EEG 的时序变化可由低维隐状态及非线性观测关系近似,该框架可能用于潜在动力学建模;这是假设,不是已证实的 EEG/BCI 效果。可复用部分是基函数表示、系数先验和序贯推断思路,需改造的是多通道观测关系、噪声假设及被试差异处理。低信噪比、通道变化和小数据可能使隐状态难以辨识,跨被试非平稳性也可能削弱泛化。一个可检验的小实验是在固定通道的单被试 EEG 上,采用互不重叠的训练与测试时间段,在匹配基函数规模和推断预算的条件下,对比带该先验与弱正则化版本的留出预测误差及稳定性。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其如何将基函数展开、Gaussian processes 关联先验与 sequential Monte Carlo 学习结合,以兼顾非线性动力学表达能力和正则化;具体理论保证及实验收益仍需全文核对。

  2. OpenReview · State space models80

    非线性状态空间模型的结构化推断网络

    基于摘要分析。本文研究线性与非线性状态空间模型的高效学习,提出统一算法,联合训练生成模型与推断网络,覆盖以深度神经网络建模发射分布和状态转移分布的变体。 核心机制是使用循环神经网络参数化具有结构的变分近似,以逼近潜在状态的后验分布,同时学习生成模型与编译式推断网络(compiled inference network)。其方法重点在于推断端的后验结构,而非仅以神经网络替换生成端的分布。摘要未给出具体后验依赖关系、分布族、损失表达式或训练与推理流程,这些细节尚未验证。 作者报告在合成及真实数据集上展示了方法的可扩展性与适用性,并报告结构化后验近似带来了显著更高的留出数据似然。摘要未提供数据集名称、划分方式、对照基线、具体数值及统计检验信息,因此不能判断收益大小或直接比较不同实验协议;实验协议、消融及统计信息尚未验证。 平台推测(待验证):若 EEG 序列可由潜在状态及其转移过程描述,该机制可能用于非线性潜在动态建模和时序推断,但原领域的似然提升不等于 BCI 解码效果提升。可考虑复用状态空间生成模型与结构化推断思路,需针对 EEG 的通道观测、噪声和序列切分改造发射模型与训练流程;摘要未说明是否依赖任务标签或需要多大数据规模。低信噪比、跨被试分布差异、通道变化及小数据可能使模型拟合非任务相关动态。一个可检验的小实验是在固定被试内划分与相同生成模型下,对比结构化和非结构化变分近似,分别评估留出似然及固定下游解码器的表现,检验生成建模收益是否转化为任务收益。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其如何用具有结构的变分后验联合学习推断网络与状态空间生成模型;作者报告该近似提升了留出数据似然,但其对 EEG 潜在动态建模的价值尚未验证。

  3. OpenReview · State space models80

    非线性状态空间模型的结构化推断网络

    基于摘要分析。本文研究如何高效学习线性与非线性状态空间模型,提出统一学习算法,将结构化变分推断网络与生成模型联合训练,适用于发射分布和状态转移分布由深度神经网络建模的情形。 核心机制是用循环神经网络参数化结构化变分近似,以逼近潜在状态的后验分布,同时学习可直接执行推断的 compiled inference network 与生成模型。其方法重点不仅在于使用非线性生成函数,也在于通过结构化后验近似处理序列推断。摘要未说明后验的具体因子分解、循环网络结构、损失形式或训练与推理流程,这些细节尚未验证。 作者报告,该算法在合成与真实数据上展现了可扩展性和适用性,并且采用结构化后验近似所得模型具有显著更高的留出数据似然。摘要未提供数据集名称、划分方式、对照方法、似然数值或显著性检验信息,因此不能据此判断提升幅度,也不能将似然改善等同于下游分类性能提升;实验协议、消融及统计信息尚未验证。 平台推测(待验证):该方法原本面向具有潜在动态状态的序列生成建模,依赖观测序列及其时间结构。若 EEG 的潜在动态能被状态转移与观测发射机制合理描述,结构化后验近似可能用于时序表征学习。可复用的是生成模型与推断网络联合学习的框架;需改造的是多通道 EEG 的观测模型、噪声假设及跨被试处理。低信噪比、通道差异和小样本可能使潜在状态主要拟合伪迹或被试特征。一个可检验的小实验是:固定 EEG 数据划分、生成模型与训练预算,仅比较结构化和非结构化后验近似,核对留出似然及下游任务指标是否同时改善。该假设不是已证实的 BCI 效果,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其利用循环神经网络参数化结构化变分后验、联合学习推断网络与状态空间生成模型的机制;作者报告留出数据似然有所提高,但具体对照、统计证据及 EEG 适用性尚未验证。

1月1日周四
  1. OpenReview · State space models72

    用于声学回声削减与去混响的变分贝叶斯状态空间模型

    基于摘要分析。研究针对 A/D 与 D/A 转换器不同步时的语音去混响、声学回声削减和降噪问题,提出基于变分贝叶斯的联合优化方法,利用两个状态空间模型分别描述时变回声滤波器和无噪多通道语音信号。 核心机制是将转换器异步条件下的声学回声削减滤波器视为时变状态向量;第二个模型则将无噪多通道语音信号视为状态向量,使去混响滤波器能够在含噪环境中更新。作者通过变分贝叶斯框架优化这两类模型,交替执行两个基于 Kalman smoother 的参数优化阶段。具体状态转移、观测模型、概率分布与优化目标尚未验证。 作者报告,在真实远程会议室录制的数据上,即使 A/D 与 D/A 转换器异步,所提方法也比作者此前的传统方法更有效地削减声学回声、语音混响和背景噪声。摘要未提供数值指标、数据规模或划分方式,实验协议、消融及统计信息尚未验证;因此无法判断收益大小及不同噪声条件下的稳定性。 平台推测(待验证):迁移假设是,时变干扰参数与潜在干净多通道信号的联合状态估计,可能用于 EEG 非平稳伪迹抑制。原方法依赖多通道时序观测及声学回声、混响的结构假设,具体参考信号和监督需求需查正文;可复用的是双状态建模与交替平滑优化思路,需改造的是 EEG 观测模型、伪迹动力学及通道耦合关系。低信噪比、跨被试差异、通道变化和小数据可能导致状态估计不稳定,或把任务相关脑活动误当作干扰。一个可证伪的小实验是在固定被试内划分的 EEG 上注入已知时变伪迹,对比单状态与双状态估计,并同时检查伪迹残留和原始 ERP 波形保真度。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读的是以两个状态空间模型及交替 Kalman 平滑优化联合处理时变回声与含噪多通道信号的机制,其对 EEG 伪迹建模的可迁移性尚未验证。

1月1日周五
  1. OpenReview · State space models73

    混合线性/非线性状态空间模型的参数辨识

    基于摘要分析。本文研究含条件线性高斯子结构的混合线性/非线性状态空间模型,主要贡献是在最大似然框架下推导用于参数辨识的 expectation maximization(EM)型算法。次要贡献是扩展已有 Rao-Blackwellized particle smoother(RBPS),使其能够处理文中研究的完全相互连接模型。 核心机制是利用模型中的条件线性高斯结构,求解参数估计过程中涉及的非线性隐状态平滑问题。作者称该问题可通过 RBPS 高效求解;从方法机制看,Rao-Blackwellization 利用可条件解析处理的子结构,减少需要粒子近似的部分。不过,摘要未给出具体状态分解、相互连接方式、EM 更新公式或平滑器实现,不能据此确定适用的全部模型类别及计算收益。 摘要未提供数据集、样本规模、对照方法或定量结果,因此尚不能判断参数估计精度、收敛表现及相对已有 RBPS 的优势幅度。实验协议、消融及统计信息尚未验证。复现前需取得全文,核对模型假设、参数可辨识性、粒子数、初始化、停止条件及计算成本。 平台推测(待验证):若 EEG 动态模型能明确分解为非线性潜状态与条件线性高斯观测或子状态,该方法可能用于联合估计隐状态和模型参数;原论文研究的是通用状态空间模型,并非已验证的 EEG/BCI 方法。可复用的是 EM 参数估计与 RBPS 平滑框架,需要改造的是 EEG 状态定义、观测关系及噪声模型。低信噪比、非高斯伪迹、跨被试差异、通道变化和小数据可能使结构假设失效或导致参数辨识不稳定。一个可检验的小实验是在参数已知、满足该结构的模拟 EEG 时序上,对比 RBPS 与未利用该结构的粒子平滑器,在相同计算预算下评估参数恢复误差和状态估计误差,再逐步加入噪声模型失配。已有 EEG 相关工作尚未检索确认。

    阅读价值:该文值得关注之处是将条件线性高斯子结构用于最大似然参数辨识,并扩展 Rao-Blackwellized particle smoother 以处理完全相互连接的模型;其对 EEG 潜状态建模的适用性尚未验证。

1月1日周日
  1. OpenReview · State space models73

    谐波状态空间模型的高效 Kalman 平滑

    基于摘要分析。本文研究信号分析中的谐波概率模型,主要应用背景是声学建模;核心贡献是在其线性高斯状态空间表示下,为 Rauch-Tung-Striebel 平滑器的反向过程提出 rotation-corrected(旋转校正)低秩近似,以降低平滑推断的计算成本。 作者给出的常规平滑推断复杂度为 O(TH²),其中 T 为时间序列长度,H 为模型频率数量的两倍。近似方法以 S 表示近似秩,摘要将其复杂度记为“Q(TSH)”;该符号是否为排版问题尚未验证,不能直接改写为 O(TSH)。作者称该近似有效,但摘要未提供误差指标、运行时间、频率设置或对照实验,实验协议、消融及统计信息尚未验证。全文需重点核对旋转校正的具体形式、秩的选择方式及精度与计算量的权衡。 平台推测(待验证):若 EEG 分析任务使用显式谐波组成的线性高斯状态空间模型,该反向低秩近似可能用于降低长序列、多频率条件下的离线平滑开销;这一假设并不等于已证实的 EEG 或 BCI 效果。可复用部分是平滑器反向近似机制,需适配 EEG 观测矩阵、噪声模型及频率设置。低信噪比、非平稳频率和跨被试或通道差异可能影响模型适配;小数据下噪声与动力学参数估计的不稳定也需评估。一个可检验的小实验是在固定频率与参数的合成含噪谐波序列上,对比完整平滑器与不同秩近似的后验均值误差、运行时间及内存,再以固定协议的 EEG 片段检验适配性。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读的是对 Rauch-Tung-Striebel 平滑器反向过程采用 rotation-corrected 低秩近似的机制及其复杂度收益,但近似误差、实际加速和 EEG 适用性尚未验证。

1月1日周二
  1. OpenReview · State space models74

    用于高速公路行程时间预测的状态空间神经网络

    基于摘要分析。本文研究高速公路行程时间预测中可观测交通量之间复杂的非线性时空关系,基于该问题的状态空间表述推导递归状态空间神经网络(SSNN)。其主要贡献是以内部状态建模交通动态,并通过分析状态与权重配置构建 Reduced SSNN,在缩减参数的同时保持预测性能。 机制与结果:SSNN 面向实际经历的行程时间预测,而非 EEG 或 BCI 任务。作者报告,模型明显优于当时的实践方法,预测残差近似服从零均值正态分布,通常处于真实预期行程时间的 10% 范围内;摘要未明确对应基线、数据划分及误差计算细节,不能将这一表述改写为 Accuracy 或固定误差上限。作者还报告,内部状态与权重分析显示模型形成了与底层交通过程密切相关的内部表征,据此剔除不显著参数;Reduced SSNN 保留 63 个可调权重,模型规模减少 72%,且预测性能未下降。上述结果均限于摘要所述交通预测评估,实验协议、消融及统计信息尚未验证。 复现需核对:交通数据来源、输入变量、采样间隔、预测时域、训练与测试划分、状态更新形式、训练目标,以及参数筛减准则。摘要不足以确认该 SSNN 与现代同名状态空间模型的具体结构关系。 平台推测(待验证):迁移假设是,递归状态表征和基于内部分析的参数缩减可能用于 EEG 时序预测中的动态建模与小模型设计。可借鉴状态更新与缩减思路,但须改造交通输入、预测目标及状态解释方式;原方法依赖哪些时空观测、监督信号和训练规模仍需全文核对。EEG 的低信噪比、跨被试差异、通道变化和小数据可能使状态解释及参数重要性不稳定。一个可检验的小实验是在固定被试内划分下比较完整模型与缩减模型的 EEG 短时预测误差及参数量,检验压缩能否保持泛化性能。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读的是以状态空间建模组织非线性时空预测,并依据内部状态与权重分析缩减模型的思路;其交通预测效果由作者报告,对 EEG 的适用性尚未验证。