跳到正文

算法、任务与模态

Optimization 最新动态

Optimization 研究索引;按可核对的标签归档,不以热度评价质量。

191 条精选近 30 天 128 条共收录 216 条

更新

精选归档 · 第 10 页

1月1日周日第 181–191 条
  1. OpenReview · State space models75

    ODE-RSSM:从不规则采样数据中学习随机循环状态空间模型

    基于摘要分析。该研究针对具有非线性和随机性的输入—输出系统,提出连续时间随机循环状态空间模型 ODE-RSSM,以解决多数离散时间 SSM 难以处理不规则采样观测的问题。其主要贡献是用 ODE-Net 描述相邻观测时点之间的潜状态演化,并通过重参数化支持不同时间跨度的 ODE 批量并行求解。 机制上,ODE-RSSM 将连续时间演化引入潜状态建模;批量求解方法受到积分上下限等价线性变换的启发,旨在提高不规则采样序列的训练效率。摘要未说明随机状态的具体分布、观测模型、损失函数及 ODE 求解器配置,这些实现条件尚未验证。 作者报告,在三个输入—输出数据集的开环预测评估中,ODE-RSSM 优于所比较的基线,包括预测时点间隔不均匀、间隔长度分布变化的情形。其中一个数据集为具有较强长期延迟和随机性的私有工业数据集 rollout。摘要未提供具体指标、数值、数据划分或基线名称,实验协议、消融及统计信息尚未验证。材料提供了代码仓库,但代码可运行性及私有数据实验的可复现性尚未验证。 平台推测(待验证):若 EEG 任务存在采样缺失、异步多模态观测或不规则事件间隔,连续时间潜状态演化和非均匀时间跨度批量求解可能具有方法参考价值;原领域有效不等于 BCI 有效。可复用部分是时间演化与求解机制,需改造观测编码、输入—输出定义和随机状态建模以适配 EEG 通道及任务监督。低信噪比、跨被试差异、通道缺失和小数据可能使潜状态估计不稳定,连续轨迹也可能难以描述短暂事件。一个可检验的小实验是在固定被试内划分下,对同一 EEG 预测任务施加不同程度的时间点删除,比较 ODE-RSSM 与离散时间模型在相同可见观测及预测时点上的误差和运行成本。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读的是其面向不规则时间间隔的连续时间潜状态建模,以及非均匀时间跨度下批量 ODE 求解的重参数化机制;这些机制对缺失或异步神经信号的适用性尚未验证。

12月31日周五
  1. OpenReview · State space models78

    用于状态空间模型可扩展变分推断的 neural moving average model

    基于摘要分析。本文研究如何将依赖小批量训练的变分推断扩展到具有时间依赖的状态空间模型,提出潜在时间状态的生成模型 neural moving average model,使训练能够低成本地使用时间序列子序列,而不必从整个分布中抽样。 核心机制是支持子序列的局部采样,以降低每次变分推断训练迭代的计算成本。摘要将其与主要适用于独立数据模型的小批量变分推断作对照;具体生成结构、时间依赖范围、变分目标、梯度估计方式及子序列边界处理尚未验证,不能仅凭名称推断其网络结构或损失形式。 作者报告,在 autoregressive、Lotka-Volterra、FitzHugh-Nagumo 和 stochastic volatility 模型上,该方法能在较短时间内获得准确的参数估计。摘要未提供误差指标、运行时间、数据规模、对照基线或重复实验统计,因此无法量化计算收益,也不能据此判断其相对其他推断方法的优势。实验协议、消融及统计信息尚未验证;复现还需核对模型设定、先验、采样与优化配置及实现可用性。 平台推测(待验证):若 EEG 被建模为由潜在状态驱动的连续观测序列,局部采样机制可能用于降低长序列贝叶斯参数估计的成本,而非直接提供 BCI 解码器。可考虑复用局部采样与小批量优化思路,但需改造多通道观测模型,并核对局部时间依赖假设是否适用。低信噪比、长程依赖、跨被试差异和小数据条件可能使局部近似产生偏差。一个可检验的小实验是在参数已知的模拟多通道状态空间序列上,固定数据与计算预算,比较局部小批量推断和全序列推断的参数误差及运行时间,再逐步增加噪声和依赖长度。已有 EEG 相关工作尚未检索确认,原领域结果不构成 BCI 有效性的证据。

    阅读价值:值得阅读其利用 neural moving average model 局部采样潜在状态、支持时间序列小批量变分推断的机制,但参数估计精度、计算收益及 EEG 适用性尚需验证。

1月1日周五
  1. OpenReview · State space models79

    利用深度编码器网络进行非线性状态空间辨识

    基于摘要分析。本文研究非线性动力系统的状态空间辨识,针对长序列仿真误差优化计算开销大、目标高度非凸的问题,提出将数据划分为多个独立片段,并以编码器估计各片段初始状态的方法;主要研究对象不是 EEG 或 BCI。 核心机制是采用类似 multiple shooting 的分段方式近似仿真损失,使优化能够使用随数据规模扩展的随机梯度方法。其关键贡献是用前馈神经网络读取历史输入与输出样本,估计每个片段起点的隐状态。作者称,分段还可对非凸代价函数产生平滑作用。摘要未提供状态转移模型的具体结构、历史窗口长度、片段长度及损失的精确形式,这些实现条件尚未验证。 作者报告在两个知名基准上展示了方法的效率与性能,其中在 Wiener–Hammerstein benchmark 上获得作者所称的最低已知仿真误差。摘要未给出另一基准名称、误差数值、数据划分或对照方法,因此不能据此量化改进幅度;实验协议、消融及统计信息尚未验证。 平台推测(待验证):若 EEG 任务可表述为具有可观测历史输出及可用输入信息的动力系统辨识问题,该机制可能帮助缓解长序列训练开销和片段初始隐状态不确定性,但原领域有效不等于 BCI 有效。可复用的是分段训练与初始状态编码器,需改造的是输入定义、多通道观测模型和历史窗口。EEG 的低信噪比、跨被试及通道差异可能使历史样本难以可靠恢复隐状态,小数据也可能导致编码器过拟合。一个可检验的小实验是在固定被试内、按时间分离的训练与测试片段上,对比历史编码初始化与固定初始化,在相同状态模型及训练预算下评估多步预测误差和训练开销;这仅检验动力学建模假设,不代表 BCI 解码收益。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读的是其用历史输入输出编码分段初始状态、近似长序列仿真损失的机制,可供非线性动力系统辨识复现参考,但其对 EEG/BCI 的适用性尚未验证。

  2. OpenReview · State space models71

    状态空间人工神经网络的改进初始化方法

    基于摘要分析。本文研究黑箱非线性状态空间系统辨识中的参数初始化问题,提出针对递归人工神经网络状态空间模型的改进初始化方法,并强调在模型结构中保留显式线性项的重要性。核心目标是降低非线性优化收敛到性能较差局部极小值的风险。 机制上,人工神经网络用于灵活表示状态方程与输出方程,待优化参数包括网络权重和偏置。所提方法从非线性系统的线性近似出发初始化部分网络权重,其余权重使用随机值或零初始化。摘要未说明线性近似的获取方式、各类初始化对应的具体参数、显式线性项的位置,以及损失函数和优化流程,相关细节尚未验证。 作者报告,在两个基准示例上,相较此前提出的方法,该初始化方案展现了有效性。摘要未提供基准名称、数据划分、对照方法名称、评价指标或数值,因此尚不能判断提升幅度及适用范围;实验协议、消融及统计信息尚未验证。复现需进一步核对模型方程、线性模型辨识过程、随机初始化设置,以及是否在相同模型容量和优化预算下比较。 平台推测(待验证):若 EEG 任务可表述为连续时序的状态演化与观测预测,该方法可能对应小数据下递归模型训练不稳定的问题。可复用的是以线性近似初始化非线性模型及保留显式线性项的思路;需改造的是 EEG 观测方程、通道组织与任务目标。迁移依赖足够的连续序列及可辨识的线性动态,低信噪比、跨被试差异或通道变化可能使线性近似失配。一个可检验的小实验是在固定 EEG 被试内预测协议下,对比随机初始化与该初始化,并分别控制显式线性项的有无,考察多次随机运行的预测误差与收敛稳定性;这属于迁移假设,不是已证实的 BCI 效果。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得核对其如何将系统的线性近似用于递归状态空间神经网络初始化,以及显式线性项是否改善优化;摘要仅报告两个基准示例,EEG/BCI 适用性尚未验证。

  3. OpenReview · State space models76

    非线性状态空间模型的高斯变分状态估计

    基于摘要分析。本文研究非线性状态空间模型中的滤波与平滑:由于非线性函数积分通常难以求解,状态后验分布往往没有闭式解,作者采用基于变分推断的假设高斯近似,并将状态估计重新表述为优化问题。 核心机制是以高斯分布近似所需的状态分布,再使用具有精确一阶和二阶导数的标准优化程序求解。摘要称,该方法所需假设较少,可直接用于具有高斯或非高斯概率模型的非线性系统;但这不意味着近似后验能够完整保留非高斯分布的多峰性或尾部特征。具体变分目标、高斯分布参数化、滤波与平滑的计算流程及导数计算方式尚未验证。 作者报告,在一个具有挑战性的标量系统、一个简单机器人系统模型,以及采用 von Mises-Fisher 分布的目标跟踪问题中,该方法优于其他假设高斯状态估计方法。摘要未提供具体指标、数值或对照算法名称,实验协议、消融及统计信息尚未验证,也不能据此判断实时计算成本或优势的适用范围。 平台推测(待验证):若 EEG 问题可以明确建模为潜在状态的非线性动态演化及带噪观测,该优化式状态估计机制可能用于潜在神经状态跟踪。它依赖可计算的状态转移与观测概率模型,而不是直接面向 EEG 分类的训练框架;可考虑复用变分优化求解部分,但需要重新设计 EEG 观测模型、动态模型及参数辨识过程。低信噪比、跨被试差异、通道变化和小数据下的模型失配,均可能削弱估计稳定性;高斯近似也可能难以描述多峰后验。 一个可检验的小实验是:先在具有已知潜在状态的模拟 EEG 观测上固定同一动态模型与噪声条件,对比该方法与其他假设高斯滤波、平滑方法的状态估计误差和计算耗时,再逐步降低信噪比以检验优势是否保持。这仅是迁移假设,不构成已验证的 EEG 或 BCI 效果;已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其将非线性滤波与平滑统一表述为可使用精确一阶、二阶导数求解的高斯变分优化问题的机制;作者报告的性能优势及其对 EEG 状态估计的适用性仍需分别核对与验证。

1月1日周三
  1. OpenReview · State space models76

    使用深度编码器网络进行非线性状态空间辨识

    基于摘要分析。本文研究动力系统的非线性状态空间辨识:直接最小化仿真误差在大数据集上计算昂贵,且优化问题具有较强非凸性。作者提出将数据划分为多个独立片段以近似仿真损失,并用编码器从历史输入与输出样本估计每个片段的初始状态。 核心机制类似 multiple shooting:把长序列仿真分解为片段级计算,从而支持随数据规模扩展的随机梯度优化。作者指出,这种分段方式还对非凸代价函数具有平滑作用。主要贡献是以一个前馈神经网络实现初始状态编码器,而非仅依赖长序列仿真来确定状态。摘要未提供状态转移与输出函数的具体形式、历史窗口长度、片段长度或损失表达式,相关实现尚未验证。 作者报告,该 state-space encoder 方法在两个知名基准上展示了效率与性能,其中在 Wiener–Hammerstein benchmark 上达到作者所称的最低已知仿真误差。摘要未给出另一基准名称、误差数值、数据划分或对照配置,因此不能据此量化优势;实验协议、消融及统计信息尚未验证。 平台推测(待验证):若 EEG 任务需要从历史观测估计隐状态并进行连续动态预测,这种片段初始状态编码机制可能缓解长序列训练的计算负担。该假设依赖连续时序结构、可定义的输入与输出以及足够的历史观测;可复用分段训练和初始状态编码思路,但需改造观测模型与输入定义。低信噪比、跨被试及通道差异可能使编码器将伪迹或个体特征误当作动态状态,小数据也可能不足以学习稳定的状态估计。一个可检验的小实验是在固定被试内数据划分与相同状态空间模型下,对比长序列仿真训练和分段编码器训练,评估留出连续片段的预测误差与计算成本,并检查历史窗口和片段长度的影响。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读的具体原因是利用历史输入与输出编码各数据片段的初始状态,使非线性状态空间辨识可采用分段仿真与随机梯度优化;其对 EEG 动态建模的价值尚未验证。

1月1日周二
  1. OpenReview · State space models73

    基于多通道非负矩阵分解的状态空间模型语音去混响快速收敛算法

    基于摘要分析。本文研究多通道语音去混响中状态空间模型的参数优化效率,提出一种省去 Kalman smoother 步骤的迭代算法,以降低传统期望最大化(EM)优化中的计算负担。研究对象是声学语音去混响,并非 EEG 解码或 BCI。 核心机制是在参数优化阶段固定潜在状态向量的部分充分统计量,据此构造原始状态空间模型对数似然的近似代价函数,并采用类似多通道非负矩阵分解的辅助函数方法优化参数。所需充分统计量由 Kalman filter 部分估计,算法交替执行 Kalman filter 与近似代价函数最小化,无需传统方法使用的 Kalman smoother。具体固定哪些统计量、辅助函数形式及近似成立条件尚未验证。 作者报告,在摘要所述实验中,该方法比传统方法更快地提高原始似然;在含噪环境下的语音去混响实验中能够有效降低混响。摘要未提供数据集、通道配置、噪声与混响条件、定量指标或运行时间,因此不能将似然提升更快直接等同于已证实的实时处理收益。实验协议、消融及统计信息尚未验证。 平台推测(待验证):若 EEG 研究采用具有可估计潜在状态及充分统计量的状态空间模型,该优化思路可能用于检验能否减少平滑步骤的计算开销,而不是直接复用语音去混响模型。可考虑复用滤波与辅助函数优化框架,但观测模型、噪声假设及目标函数需按 EEG 数据重建;语音多通道结构与 EEG 通道混合并不等价,低信噪比、通道相关性和小数据可能使近似优化偏离有效解。一个可检验的小实验是在固定模型、初始化与数据划分下,对比传统 EM 与该近似优化的原始似然、运行时间及状态估计误差。相关 EEG 工作尚未检索确认。

    阅读价值:值得核对其以辅助函数近似优化替代 Kalman smoother 的计算收益,以及近似目标与原始似然之间的关系;摘要支持语音去混响用途,但尚未验证 EEG/BCI 适用性。

1月1日周日
  1. OpenReview · State space models76

    用于学习非线性动力系统的灵活状态空间模型

    基于摘要分析。该研究针对非线性动力系统的学习,将状态转移函数与观测函数表示为基函数展开,并从数据中学习展开系数。核心贡献是利用与 Gaussian processes 的联系构造系数先验,以调节模型灵活性、抑制过拟合,同时设计基于序贯 Monte Carlo 的参数学习算法。 机制上,基函数展开承担非线性函数表示,系数先验则可视为正则化,用于在表达能力与泛化之间取得平衡。作者将这一设计与 Gaussian process state-space model 联系起来,但摘要未给出基函数类型、先验具体形式或二者的精确对应。学习算法用于估计展开系数及其他未知参数;作者称其具有理论保证,保证的条件与范围尚未验证。 作者报告,该方法在一个经典基准及真实数据上获得了有前景的结果。摘要未提供基准名称、数据规模、划分协议、对照方法或量化指标,因此尚不能判断收益大小及适用范围;实验协议、消融及统计信息尚未验证。复现需进一步核对基函数选择、先验设置、隐状态推断流程、序贯 Monte Carlo 的计算配置及参数学习细节。 平台推测(待验证):若 EEG 时序中的潜在动态可由该类非线性状态空间模型近似,基函数表示与系数正则化可能有助于限制小数据条件下的模型复杂度;这是迁移假设,而非已证实的 BCI 效果。原方法依赖时序观测及隐状态建模,具体监督需求与数据规模要求尚未验证。可考虑复用函数展开、先验与学习框架,但需适配 EEG 的多通道观测、噪声特性及跨被试差异。低信噪比、通道配置变化和有限训练数据可能使隐状态难以辨识,或导致先验约束不合适。一个可证伪的小实验是在固定通道、固定划分的被试内 EEG 数据上,以留出时段的预测误差比较该模型、线性状态空间模型与弱正则化版本,检验非线性表示及先验是否带来稳定收益。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其如何通过与 Gaussian processes 相联系的系数先验约束非线性状态空间模型的灵活性,以及配套序贯 Monte Carlo 学习算法;其对 EEG 动态建模的适用性尚未验证。

1月1日周五
  1. OpenReview · State space models75

    用于学习非线性动力系统的灵活状态空间模型

    基于摘要分析。该研究面向非线性动力系统学习,将状态转移函数和观测函数表示为基函数展开,并从数据中学习展开系数。其核心贡献是利用与 Gaussian processes 的联系构建系数先验,以调节模型灵活性、抑制过拟合,并设计基于 sequential Monte Carlo 的参数学习算法。 机制上,基函数展开承担非线性函数的表示,系数先验则可理解为正则化:作者希望保留展开形式的表达能力,同时改善泛化。学习算法用于估计展开系数及其他未知参数;摘要称其具有学习方面的理论保证,但保证的具体对象、成立条件和收敛性质尚未验证。基函数类型、先验形式、隐状态设定、训练流程与推理成本也需查阅全文。 作者报告,该方法在一个经典 benchmark 和真实数据上取得有希望的结果,但摘要未给出数据名称、划分协议、对照方法或量化指标,因而不能判断收益大小,也不能与其他协议下的结果直接比较。实验协议、消融及统计信息尚未验证。 平台推测(待验证):若 EEG 的时序变化可由低维隐状态及非线性观测关系近似,该框架可能用于潜在动力学建模;这是假设,不是已证实的 EEG/BCI 效果。可复用部分是基函数表示、系数先验和序贯推断思路,需改造的是多通道观测关系、噪声假设及被试差异处理。低信噪比、通道变化和小数据可能使隐状态难以辨识,跨被试非平稳性也可能削弱泛化。一个可检验的小实验是在固定通道的单被试 EEG 上,采用互不重叠的训练与测试时间段,在匹配基函数规模和推断预算的条件下,对比带该先验与弱正则化版本的留出预测误差及稳定性。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其如何将基函数展开、Gaussian processes 关联先验与 sequential Monte Carlo 学习结合,以兼顾非线性动力学表达能力和正则化;具体理论保证及实验收益仍需全文核对。

  2. OpenReview · State space models80

    非线性状态空间模型的结构化推断网络

    基于摘要分析。本文研究线性与非线性状态空间模型的高效学习,提出统一算法,联合训练生成模型与推断网络,覆盖以深度神经网络建模发射分布和状态转移分布的变体。 核心机制是使用循环神经网络参数化具有结构的变分近似,以逼近潜在状态的后验分布,同时学习生成模型与编译式推断网络(compiled inference network)。其方法重点在于推断端的后验结构,而非仅以神经网络替换生成端的分布。摘要未给出具体后验依赖关系、分布族、损失表达式或训练与推理流程,这些细节尚未验证。 作者报告在合成及真实数据集上展示了方法的可扩展性与适用性,并报告结构化后验近似带来了显著更高的留出数据似然。摘要未提供数据集名称、划分方式、对照基线、具体数值及统计检验信息,因此不能判断收益大小或直接比较不同实验协议;实验协议、消融及统计信息尚未验证。 平台推测(待验证):若 EEG 序列可由潜在状态及其转移过程描述,该机制可能用于非线性潜在动态建模和时序推断,但原领域的似然提升不等于 BCI 解码效果提升。可考虑复用状态空间生成模型与结构化推断思路,需针对 EEG 的通道观测、噪声和序列切分改造发射模型与训练流程;摘要未说明是否依赖任务标签或需要多大数据规模。低信噪比、跨被试分布差异、通道变化及小数据可能使模型拟合非任务相关动态。一个可检验的小实验是在固定被试内划分与相同生成模型下,对比结构化和非结构化变分近似,分别评估留出似然及固定下游解码器的表现,检验生成建模收益是否转化为任务收益。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其如何用具有结构的变分后验联合学习推断网络与状态空间生成模型;作者报告该近似提升了留出数据似然,但其对 EEG 潜在动态建模的价值尚未验证。

1月1日周四
  1. OpenReview · State space models72

    用于声学回声削减与去混响的变分贝叶斯状态空间模型

    基于摘要分析。研究针对 A/D 与 D/A 转换器不同步时的语音去混响、声学回声削减和降噪问题,提出基于变分贝叶斯的联合优化方法,利用两个状态空间模型分别描述时变回声滤波器和无噪多通道语音信号。 核心机制是将转换器异步条件下的声学回声削减滤波器视为时变状态向量;第二个模型则将无噪多通道语音信号视为状态向量,使去混响滤波器能够在含噪环境中更新。作者通过变分贝叶斯框架优化这两类模型,交替执行两个基于 Kalman smoother 的参数优化阶段。具体状态转移、观测模型、概率分布与优化目标尚未验证。 作者报告,在真实远程会议室录制的数据上,即使 A/D 与 D/A 转换器异步,所提方法也比作者此前的传统方法更有效地削减声学回声、语音混响和背景噪声。摘要未提供数值指标、数据规模或划分方式,实验协议、消融及统计信息尚未验证;因此无法判断收益大小及不同噪声条件下的稳定性。 平台推测(待验证):迁移假设是,时变干扰参数与潜在干净多通道信号的联合状态估计,可能用于 EEG 非平稳伪迹抑制。原方法依赖多通道时序观测及声学回声、混响的结构假设,具体参考信号和监督需求需查正文;可复用的是双状态建模与交替平滑优化思路,需改造的是 EEG 观测模型、伪迹动力学及通道耦合关系。低信噪比、跨被试差异、通道变化和小数据可能导致状态估计不稳定,或把任务相关脑活动误当作干扰。一个可证伪的小实验是在固定被试内划分的 EEG 上注入已知时变伪迹,对比单状态与双状态估计,并同时检查伪迹残留和原始 ERP 波形保真度。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读的是以两个状态空间模型及交替 Kalman 平滑优化联合处理时变回声与含噪多通道信号的机制,其对 EEG 伪迹建模的可迁移性尚未验证。