跳到正文

算法、任务与模态

MoE 最新动态

MoE 研究索引;按可核对的标签归档,不以热度评价质量。

42 条精选近 30 天 31 条共收录 48 条

更新

精选归档 · 第 3 页

5月28日周二第 41–42 条
  1. OpenReview · Representation learning75

    以多样性实现统一:改进多模态 VAEs 的表征学习

    基于摘要分析。该研究针对多模态 VAEs 中共享表征的硬约束可能限制模态信息保留的问题,提出 mixture-of-experts prior,以软约束引导各模态的潜在表征靠近共享的 aggregate posterior。核心贡献是用较柔性的跨模态对齐替代编码器输出、解码器输入或二者的强制共享。 机制上,作者认为现有共享结构对模型施加了硬约束,而所提先验可在形成共同表征的同时,更好地保留各模态原始特征中的信息。摘要未给出先验的具体参数化、aggregate posterior 的构造方式、损失形式及训练与推理流程,不能据此判断其实现复杂度或与既有方法的结构差异。 作者报告,在多个基准数据集及一个具有挑战性的真实神经科学数据集上,相比现有方法,所学潜在表征和缺失模态补全均有改善。摘要未提供数据集名称、神经信号类型、被试数、划分协议、对照方法或具体指标;实验协议、消融及统计信息尚未验证,也无法判断表征改善对应何种下游任务。 平台推测(待验证):假设用于 EEG 与其他同步模态的联合建模,软共享机制可能缓解不同模态信息被强制压入共同表征的瓶颈。其依赖模态间存在可学习的共享结构,配对数据与监督条件仍需核对;可考虑复用先验与软对齐思想,但需改造 EEG 编解码模块及缺失模态处理流程。低信噪比、跨被试差异、通道变化和小数据条件可能使共享表征受较强模态主导。一个可检验的小实验是在同一配对数据与固定跨被试划分下,对比硬共享和软约束模型,并在预先规定的模态缺失条件下评估补全及下游任务表现。以上不是已验证的 EEG/BCI 结果,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得核对其 mixture-of-experts prior 如何在跨模态共享与模态特有信息保留之间实现软约束,以及缺失模态补全的收益是否在不同缺失条件下稳定;摘要中的神经科学实验尚不足以确认 EEG/BCI 适用性。

1月1日周一
  1. OpenReview · EEG73

    EEGMamba:用于 EEG 分类的双向状态空间模型与混合专家

    基于摘要分析。EEGMamba 面向不同任务中 EEG 信号长度、通道数不一致,以及 Transformer 长序列建模计算开销较大的问题,将 Spatio-Temporal-Adaptive(ST-Adaptive)模块、Bidirectional Mamba 和 Mixture of Experts(MoE)整合为统一的多任务 EEG 分类框架。 机制上,ST-Adaptive 通过空间自适应卷积对不同长度和通道数的 EEG 进行统一特征提取,并引入 class token 实现时间维度适配;摘要未说明具体的长度对齐与通道映射方式。Bidirectional Mamba 用于进一步提取 EEG 特征,作者旨在兼顾长序列处理的分类准确性与推理速度。Task-aware MoE 配置一个通用专家,以建模不同任务 EEG 的差异与共性;专家路由、任务信息如何输入以及训练损失尚未验证。 作者报告,在八个公开 EEG 数据集上进行了测试,覆盖癫痫发作检测、情绪识别、睡眠分期和运动想象四类任务,并报告性能优于对照方法。摘要未提供数据集名称、被试规模、评价指标、具体分数或对照基线,也未明确被试内、跨被试、跨会话或跨数据集划分,因此不能据此确认对未见任务的泛化能力,或量化准确性与速度之间的收益。 复现时应重点核对多任务联合训练与评估协议、异构通道和序列长度的处理,以及 ST-Adaptive、双向建模和通用专家各自的贡献;推理效率比较还需结合输入长度、硬件与计时条件。实验协议、消融及统计信息尚未验证。摘要称代码将于近期发布,当前材料不能确认代码已公开。

    阅读价值:值得核对 EEGMamba 如何通过输入适配、双向状态空间建模和任务感知专家机制处理异构 EEG,但其跨任务泛化与推理效率优势仍需结合全文中的训练划分和对照实验验证。