跳到正文

算法、任务与模态

EEG 最新动态

EEG 研究索引;按可核对的标签归档,不以热度评价质量。

85 条精选近 30 天 58 条共收录 138 条

更新

精选归档 · 第 4 页

3月2日周一第 61–80 条
  1. OpenReview · EEG73

    我们需要领域专用的时间序列模型吗?来自 EEG 分类基准的启示

    基于摘要分析。该研究以 EEG 分类为案例,考察在异构时间序列上进行大规模预训练的通用时间序列基础模型,是否能够有效迁移到专门领域。核心贡献是比较通用模型、EEG 基础模型与经典神经网络基线,并通过线性探测、微调及随机初始化对照,分析模型性能的可能来源。 研究评估了 Mantis(约 8M 参数)和 MOMENT(超过 300M 参数),使用四个公开 EEG 数据集:TUEV、FACED、BCI-IV-2A 和 Error。摘要明确列出了线性探测与微调两种评估方式,但未提供各数据集的具体任务设置、被试内或跨被试等划分、指标及基线名称,因此不能将不同任务或协议下的表现直接合并比较。 作者报告,微调后的通用模型常能达到与 EEG 专用模型相当的表现,而线性探测的迁移表现较差。作者还报告,随机初始化的 Mantis 与预训练版本表现相近,并据此提出:其架构而非预训练可能解释了相当部分性能。这一解释不等于通用预训练对所有 EEG 任务无效,也不能直接推广至 MOMENT。 复现时值得核对预训练与随机初始化版本是否采用一致的数据划分、训练预算和模型选择流程,并分别查看各数据集的结果与不确定性。具体性能数值、实验协议、消融及统计信息尚未验证;全文、实现与复现条件也尚未核实。

    阅读价值:值得核对其通用时间序列基础模型与 EEG 专用模型的对照,以及 Mantis 预训练与随机初始化的比较,以区分预训练迁移收益和架构本身的贡献。

1月26日周一
  1. OpenReview · EEG77

    EEG 基础模型值得采用吗?在多种 BCI 任务中与传统解码器的比较评估

    基于摘要分析。该研究考察 EEG 基础模型相较于传统解码方法,尤其是经典非神经网络方法,是否具有稳定优势;核心贡献是跨数据集、解码任务和六种评估协议的比较基准,并引入 ST-EEGFormer 作为预训练基线。 方法方面,ST-EEGFormer 是基于 Vision Transformer(ViT)的时空 EEG 模型,仅使用 masked autoencoding(MAE)在超过 8M 个 EEG 片段上预训练。摘要未提供片段长度、来源构成、预训练与下游数据的关系,以及掩码策略和微调配置,这些复现条件尚未验证。研究覆盖多种 EEG 基础模型、紧凑神经网络与经典非神经网络解码器,并采用统计检验;具体模型、数据集、任务及六种协议的定义未在摘要中列出,不能据此确定其被试内、跨被试或跨会话设置。 作者报告,微调后的基础模型在数据充足、群体层面的评估中表现较好,但在数据稀缺场景下,往往不能显著优于紧凑神经网络,甚至经典非神经网络解码器。作者还报告,线性探测的表现持续偏弱,下游任务之间的性能差异较大,所比较的神经网络解码器未呈现清晰的缩放规律。摘要未给出具体指标、效应量或统计检验细节,因此这些结论不能扩展为所有 EEG 基础模型或所有 BCI 场景的普遍判断。 作者将结果解释为预训练与下游微调之间存在较大落差,复杂预训练任务的收益可能因此被削弱,并指出有未显式揭示的架构因素影响性能。阅读全文时需核对架构因素如何被隔离、预训练和微调贡献如何比较,以及各协议的数据划分、调参预算和统计方法。实验协议、消融及统计信息尚未验证;当前材料支持将其作为 EEG 基础模型收益边界的评估研究,而非认定基础模型无效。

    阅读价值:该研究通过多任务、六种评估协议及统计检验比较 EEG 基础模型与传统解码器,值得核对其数据稀缺场景下的收益边界及预训练与微调贡献的区分。

11月27日周四
  1. OpenReview · EEG79

    从少量 EEG 试次估计事件相关电位

    基于摘要分析。研究针对传统 ERP 估计需要平均大量 EEG 试次以降低噪声与信号变异的问题,提出不确定性感知自编码器 EEG2ERP,将任意数量的 EEG 试次映射为对应 ERP,并建模估计的不确定性。 核心机制是使用 bootstrap 构造训练目标,并引入独立的方差解码器描述 ERP 估计的不确定性。摘要未说明可变试次数输入如何组织、具体损失函数、网络结构及方差输出的校准方法,这些实现细节尚未验证。作者声称这是首个将 EEG 信号映射为对应 ERP 的深度学习方法;该优先性声明尚未独立检索确认。 评估采用面向新被试泛化的零样本场景,即 Cross-subject 评估,涉及三个公开数据来源:ERP CORE,包含来自 40 名被试、覆盖六种 ERP 范式的超过 50,000 个 EEG 试次;P300 Speller BCI 数据集;以及同时包含 EEG 与 MEG 的面孔感知神经成像数据集。摘要未交代各数据源的训练与测试划分,也未说明面孔感知数据中 MEG 的具体使用方式,不能据此认定采用了 EEG–MEG 联合建模或 Cross-dataset 评估。 作者报告,在上述新被试零样本评估的少试次条件下,EEG2ERP 持续优于常规平均和稳健平均方法,但摘要未提供误差指标、具体试次数、效应大小或统计信息。这一结果支持进一步核查其减少 ERP 研究试次需求的潜力,不等同于已验证 P300 在线分类性能或临床效用。 复现可从材料提供的 EEG2ERP 代码仓库入手,重点核对 ERP 参考目标的构造、bootstrap 采样流程、被试划分、不同试次数下的比较,以及方差预测与实际估计误差是否一致。实验协议、消融及统计信息尚未验证。

    阅读价值:值得关注 EEG2ERP 如何结合 bootstrap 训练目标与独立方差解码器,在新被试零样本条件下估计少试次 ERP;其误差优势及不确定性校准仍需核对全文与代码。

9月23日周二
  1. OpenReview · EEG72

    EEG 基础模型:当前进展与未来方向的批判性综述

    基于摘要分析。本文关注自监督 EEG 基础模型(EEG-FMs)能否支持稳健、可扩展的 EEG 特征提取,以及现有证据是否足以判断其真实应用准备程度。作者对十个早期第一代 EEG-FMs 进行批判性综述,围绕原始输入数据表示、自监督表征学习和评估策略三个维度,综合方法趋势、实证发现与待解决问题。 在方法层面,作者指出,现有 EEG-FMs 的模型架构与自监督方式大量借鉴语言和视觉领域。摘要未列出纳入综述的模型名称,也未展开各模型的输入组织、学习目标、训练数据规模或适用任务,因此不能据此判断具体技术路线的优劣。 在评估层面,作者报告,现有 EEG-FMs 的评估具有异质性且总体受限,难以据此判断模型开箱即用的实际价值。这是综述作者对所纳入工作的综合判断,不等于所有 EEG-FMs 均缺乏实用性,也不能替代在具体任务和数据划分下的验证。摘要未提供性能数值、对照基线或被试内、跨被试、跨会话及跨数据集协议,具体评估结论与证据覆盖范围尚未验证。 作者建议未来采用标准化且贴近真实使用条件的评估,展示实质性的规模扩展效应,并在 EEG-FM 全流程中作出有原则、可信赖的方法选择;同时与领域专家合作发展基准、软件工具、技术方法及临床和科学应用。这些是研究方向建议,而非已证实的性能或临床收益。 阅读全文时宜核对十个模型的纳入标准、文献覆盖范围、不同评估协议的可比性,以及规模扩展效应和可信赖性所对应的具体证据。实验协议、消融及统计信息尚未验证。本文提供的是综述性分析框架,而不是新模型发布或临床验证。

    阅读价值:该综述从输入表示、自监督学习与评估策略三个环节审视早期 EEG 基础模型,值得用于核对现有模型的开箱即用证据与评估可比性,但具体比较结论仍需全文验证。

9月19日周五
  1. OpenReview · EEG71

    stLaBraM:采用因子化时空片段嵌入进行自监督学习的可解释 EEG 基础模型

    基于摘要分析。该研究针对 EEG 基础模型在自监督掩码建模中难以兼顾性能与可解释性的问题,提出 stLaBraM,在 patch embedding 模块中引入可解释的空间与时间滤波,以改善 EEG 表征学习,并分析与掩码建模相关的神经源特征。 机制与创新:标题将方法概括为因子化时空片段嵌入,摘要明确的改动集中在空间、时间滤波及其可解释性,而非仅报告下游分类性能。作者将原始 LaBraM 作为对照,讨论自监督预训练的重建损失及 masked language model(MLM)表现。因子化的具体实现、滤波器约束、掩码策略、重建目标和损失形式尚未验证。 结果:作者报告,相较 LaBraM,该方法在自监督预训练中显著降低重建损失,并在标准 EEG 分类基准上取得更好的表现;摘要未提供数据集名称、评价指标、数值、数据划分或被试内、跨被试等协议,因此目前不能判断增益幅度及其适用范围。作者还报告,模型能够提供与自监督掩码建模相关的神经源二阶动力学性质和皮层位置的解释,但这些解释的计算方式、定位依据与验证程序尚未明确。 验证与复现:阅读全文时应重点核对时空滤波如何分解、如何从滤波器得到神经源解释,以及预训练数据、模型规模和下游评估条件是否与 LaBraM 对齐。还需核对重建损失改善与分类增益之间的关系,以及解释结果对被试差异、通道配置和噪声的稳定性。实验协议、消融及统计信息尚未验证,代码、权重和复现条件亦未由所给材料确认;摘要中的临床应用动机不能视为已完成临床验证。

    阅读价值:值得阅读的具体原因是其将可解释的空间与时间滤波引入 EEG 基础模型的 patch embedding,并以 LaBraM 为对照讨论重建与分类表现;性能增益及神经源解释的可靠性仍需全文验证。

9月16日周二
  1. OpenReview · EEG78

    ELASTIQ:通过语义任务指令与查询实现 EEG–语言对齐

    ELASTIQ 针对 EEG 基础模型难以将语言指令作为表征学习先验、进而统一不同标签与任务的问题,提出结合谱–时域预训练和指令调优的 EEG–语言对齐方法。基于摘要分析,未取得论文全文,其核心贡献是将任务语义指导引入 EEG 表征,使 EEG 嵌入与文本标签嵌入对齐。 预训练阶段采用联合 Spectral–Temporal Reconstruction(STR)模块:频率掩码作为全局频谱扰动,配合两种时间目标,其中随机掩码用于捕捉上下文依赖,因果掩码用于建模序列动态。摘要未披露具体重建目标、损失组合或掩码比例。指令调优阶段采用 Instruction-conditioned Q-Former(IQF),这是基于查询的交叉注意力 Transformer,通过可学习查询将指令嵌入注入 EEG tokens,并与文本标签嵌入对齐。该机制区别于仅学习 EEG 表征的思路,但各模块的独立贡献仍需结合正文消融核对。 作者报告在涵盖运动想象、情绪识别、SSVEP、covert speech 和医疗健康任务的 20 个数据集上进行评估,其中 14 个数据集达到作者所称的最先进表现,并在全部五类任务中获得最佳平均结果。摘要未给出数据集名称、被试数、数据划分、被试内或跨被试等协议、对照方法及具体指标,因此这些结果不能直接用于判断跨被试、跨会话或跨数据集泛化能力。 作者还报告,分析支持显式任务指令作为语义先验,引导 EEG 嵌入形成连贯且具有语言语义基础的空间,并将这一观察称为首次发现;该优先性与证据强度尚未核对。值得进一步检查语义空间分析的量化依据、指令措辞敏感性,以及未见任务或标签条件下的泛化表现。实验协议、消融及统计信息尚未验证。作者表示将发布代码与预训练权重,摘要并未确认其已公开,当前复现条件仍待核实。

    阅读价值:值得核对 STR 预训练与 IQF 指令调优如何实现 EEG–语言对齐,尤其是显式任务指令相较无指令对照是否改善跨任务语义组织与解码表现;具体实验协议及消融尚未验证。

9月11日周四
  1. OpenReview · EEG78

    EEG-X:设备无关且噪声鲁棒的 EEG 基础模型

    基于摘要分析。EEG-X 针对记录设备与配置差异导致的跨数据集变化,以及 EEG 低信噪比问题,提出结合通道空间位置编码、噪声感知掩码重建和特征空间重建损失的 EEG 基础模型,旨在学习更具跨域适应性与噪声鲁棒性的表征。 核心机制包括三部分:其一,基于位置的通道嵌入编码空间信息,使模型能够处理不同通道数量、通道组合和记录长度。其二,在原始空间与潜在空间采用噪声感知掩码—重建策略;与重建原始含噪 EEG 的做法不同,重建目标来自伪迹去除后的信号,作者意图借此使表征更关注神经活动而非噪声。其三,dictionary-inspired convolutional transformation(DiCT)层在计算重建 MSE 损失前,将信号投影至结构化特征空间;作者认为该设计可降低噪声敏感性,并捕捉频率与波形形状相关的相似性。具体去伪迹流程、掩码规则、DiCT 实现及各目标的组合方式尚未验证。 作者报告,在来自不同设备的数据集及多个下游 EEG 任务上,EEG-X 优于所比较的现有先进方法,并在预训练与下游数据电极布局不同的跨域设置中表现突出。摘要未提供数据集名称、任务明细、被试数量、划分方式、指标或数值,因此不能据此量化收益,也不能将这里的跨域结果直接等同于跨被试或跨会话性能。 复现时值得核对位置嵌入对通道坐标的依赖、去伪迹处理是否保留任务相关信号,以及各模块在不同设备与电极布局下的独立贡献;这些属于待核对事项,而非已确认的缺陷。摘要提供了模型与代码入口,但其可用性、训练配置、实验协议、消融及统计信息尚未验证。

    阅读价值:值得核对和复现的是 EEG-X 将位置编码、去伪迹重建目标与 DiCT 特征空间损失结合,以应对电极布局差异和低信噪比;作者报告的跨域优势仍需结合完整实验协议验证。

4月2日周三
  1. OpenReview · EEG71

    EEG-EyeTrack:面向时间序列与函数型数据分析的基准、开放挑战及基线

    研究面向从 EEG 信号重建眼动的回归问题,提出 EEG-EyeTrack 基准数据集,并为函数型数据分析(Functional Data Analysis,FDA)应用设计开放挑战与评估指标,同时使用 functional neural networks 建立基线。以下基于摘要分析,未取得论文全文。 方法与贡献:该工作的重点是数据与评估框架,而不只是单一预测模型。主要任务是以 EEG 为输入重建眼动,functional neural networks 用于提供这一回归任务的基线。摘要未说明 EEG 与眼动的同步方式、预测目标的具体表示、模型结构、损失函数或训练流程,尚不能判断其如何利用时间序列的函数型结构。 数据与结果:作者报告在采用消费级硬件的新数据集,以及采用研究级硬件的 EEGEyeNet 数据集上给出了基线结果。摘要未提供具体指标名称、数值、被试规模、数据划分或对照模型,因此不能量化性能,也不能据此认定模型具有跨硬件或 Cross-dataset 泛化能力。两类硬件数据上的结果是否采用一致任务和评估协议,需要核对全文。 阅读与复现重点:应核对开放挑战的定义、评估指标如何衡量眼动重建质量、EEG 与眼动标签的对齐及预处理方式,以及被试内、跨被试或跨会话划分是否适用于所报告结果。实验协议、消融及统计信息尚未验证;数据访问条件、基线实现与运行配置也尚未验证。该材料支持将其视为 EEG 眼动重建与 FDA 方法比较的候选基准,但不支持推断其在其他 BCI 任务上的效果。

    阅读价值:值得阅读的具体原因是该研究将 EEG 眼动重建组织为函数型数据分析基准,并提供开放挑战、评估指标及 functional neural networks 基线;其评估协议与跨硬件适用性仍需全文核对。

1月1日周三
  1. OpenReview · EEG74

    EEGCiD:将 EEG 凝缩到扩散模型中

    基于摘要分析。EEGCiD 针对 EEG 模型开发中大量数据带来的存储与共享隐私问题,将原始数据集的知识凝缩到扩散模型和少量潜在编码中,生成信息集中的合成样本集;其目标并非复现外观逼真的 EEG,而是保留用于解码的代表性信息。 核心机制分为模型预训练与数据凝缩两阶段。首先,使用原始 EEG 数据预训练确定性去噪扩散隐式模型 DDIM,以存储数据集知识;骨干采用包含空间与时间自注意力模块 STSA 的 transformer,替代传统 U-Net。随后,从原始数据集中随机选取部分样本,经 DDIM 前向过程得到凝缩潜在编码 z,并通过匹配合成样本与原始数据在多个 EEG 解码模型中的特征分布来优化 z。摘要将这一过程称为集成特征匹配,但具体损失形式、解码模型配置及优化细节尚未验证。 作者报告,在三个 EEG 数据集上的实验中,凝缩数据集在有限样本量条件下取得更优分类表现,并能有效抵御成员推断攻击(MIA)。摘要未提供数据集名称、被试数量、被试内或跨被试等评估协议、对照方法及具体指标,因此无法量化收益,也不能据此认定对其他隐私攻击同样有效。 复现时需核对凝缩样本预算、DDIM 训练与采样设置、特征匹配模型及下游解码模型的关系,以及原始数据、潜在编码和扩散模型权重各自的存储与发布成本。隐私结论需结合 MIA 的攻击者能力、访问权限和评估协议解释;合成信号不与原始信号视觉相似,本身不等于隐私保证。实验协议、消融及统计信息尚未验证。

    阅读价值:值得关注其将确定性 DDIM 与多解码模型特征匹配结合的 EEG 数据集凝缩机制,但分类收益与隐私保护结论仍需结合数据划分、存储核算及 MIA 威胁模型核对。

  2. OpenReview · EEG74

    EEGCiD:将 EEG 凝缩到扩散模型中

    EEGCiD 针对 EEG 模型开发所需大量数据带来的存储与共享隐私问题,提出将原始数据集知识凝缩到扩散模型及小规模潜在编码集合中的方法,以生成信息集中的合成 EEG 样本,而非以外观接近原始信号为主要目标。基于摘要分析,未取得论文全文。 核心机制分为知识建模与数据凝缩两个阶段:首先使用原始 EEG 数据预训练确定性 denoising diffusion implicit model(DDIM),以保存数据集知识;其骨干采用包含空间与时间自注意力模块(STSA)的 transformer,替代传统 U-Net。随后,从原始数据集中随机选取样本子集,经 DDIM 前向过程得到凝缩潜在编码 z,再通过匹配合成样本与原始数据在多个 EEG 解码模型中的特征分布来优化 z。该集成特征匹配策略意在将对解码任务有用的信息集中到较小的合成数据集中;具体损失形式、解码模型组合及优化细节尚未验证。 作者报告,在三个 EEG 数据集上,凝缩数据集在有限样本条件下取得较好的分类表现,并能有效防御成员推断攻击(MIA)。摘要未提供数据集名称、任务、被试数、被试内或跨被试划分、凝缩样本规模、分类指标数值及对照设置,因此无法量化分类收益,也不能比较不同协议下的效果。实验协议、消融及统计信息尚未验证。 复现与应用评估需核对 DDIM 预训练成本、潜在编码优化成本,以及生成合成数据所需模型权重是否计入总存储开销。隐私结论还需核对 MIA 的攻击者能力、访问权限和评估指标;合成样本不与原始信号外观相似,本身不能构成隐私保证。作者报告的 MIA 防护效果应限定于其实际测试设置,不能据此推断身份或健康信息的其他泄露风险均已消除。

    阅读价值:值得阅读其将确定性 DDIM 与多解码模型特征分布匹配结合的 EEG 数据凝缩机制,但分类收益与成员推断攻击防护效果仍需结合压缩规模、评估协议和攻击设置核对。

  3. OpenReview · EEG72

    EEGDM:基于生成式扩散模型的 EEG 表征学习

    基于摘要分析。该研究针对 EEG 标注有限、信号变异性高导致的表征学习困难,提出生成式扩散表征学习框架 EEGDM,并将预训练得到的潜在 EEG 表征用于下游分类,探索区别于现有 EEG 基础模型的技术路径。 核心机制是用于扩散预训练的结构化状态空间模型 SSMDP:作者以其捕获 EEG 的时间动态,并在 Denoising Diffusion Probabilistic Model(DDPM)框架下训练。随后,作者提出 latent fusion transformer(LFT),利用所得潜在表征完成分类。摘要未说明扩散噪声设定、具体训练目标、潜在表征提取位置及 LFT 的融合方式,这些实现细节尚未验证。 评估采用涉及发作间期癫痫样放电的 TUEV 与涉及癫痫发作检测的 CHB-MIT,并与现有方法及 EEG 基础模型比较。作者报告 EEGDM 优于所比较的方法,但摘要未提供具体指标、数值、基线名单及被试内或跨被试等划分信息,因而尚不能判断优势幅度、统计可靠性或跨协议泛化能力。这些任务属于 EEG 临床事件识别,不能直接视为已验证的 BCI 控制效果。 作者将大型 EEG 基础模型的训练与推理成本、模型增大时收益有限作为研究动机,但摘要并未给出 EEGDM 的参数量、训练开销或推理效率,不能据此确认其计算成本优势。复现时需核对数据预处理、预训练与下游数据的划分关系、分类协议、基线配置以及 SSMDP 和 LFT 的独立贡献;实验协议、消融及统计信息尚未验证。摘要提供了源码与 checkpoint 链接,但其内容、可运行性和复现实验条件尚未核验。

    阅读价值:值得核对其以结构化状态空间模型进行扩散预训练、再融合潜在 EEG 表征的机制,以及相对 EEG 基础模型的分类收益与计算成本;摘要中的性能优势尚需结合完整实验协议验证。

9月27日周五
  1. OpenReview · EEG74

    EEGMamba:结合混合专家的双向状态空间模型用于 EEG 多任务分类

    基于摘要分析。该研究针对 EEG 分类中长序列建模的计算开销,以及不同任务之间信号长度、通道数不一致带来的适配问题,提出 EEGMamba,将 Spatio-Temporal-Adaptive(ST-Adaptive)模块、双向 Mamba 和 Mixture of Experts(MoE)整合为多任务分类框架。 机制上,ST-Adaptive 通过空间自适应卷积对不同长度与通道数的 EEG 进行统一特征提取,并引入 class token 实现时间维度适配;双向 Mamba 用于进一步提取 EEG 特征,旨在兼顾长序列处理的分类表现、推理速度与内存使用;任务感知 MoE 配置通用专家,以建模不同 EEG 任务之间的差异与共性。摘要未提供这些模块的具体结构、专家路由方式、损失函数或多任务训练流程,相关细节尚未验证。 作者报告在八个公开 EEG 数据集上开展评估,覆盖癫痫发作检测、情绪识别、睡眠分期分类和运动想象四类任务,并报告具有性能优势;但摘要未列出数据集名称、被试数、数据划分、对照基线或具体指标,因此尚不能判断优势对应被试内、跨被试、跨会话还是跨数据集协议,也不能将多任务学习直接等同于对未见任务的泛化。作者将其称为首个真正实现 EEG 多任务学习的通用分类网络,该优先性主张尚未检索确认。 复现时需核对不同任务是否联合训练、任务信息如何用于 MoE 路由、通道与长度适配的实现,以及各模块的消融结果;推理速度和内存优势还需结合硬件、输入长度及比较基线核验。实验协议、消融及统计信息尚未验证。材料仅表示代码计划近期发布,不能据此确认代码或预训练权重已公开。

    阅读价值:值得阅读的是 EEGMamba 将长度与通道适配、双向状态空间建模及任务感知专家机制组合用于 EEG 多任务分类,但其多任务训练协议、性能优势和计算效率仍需全文核对。

9月26日周四
  1. OpenReview · EEG76

    以大型时空 Transformer 为基础模型学习鲁棒 EEG 表征

    基于摘要分析。研究针对 EEG 基础模型难以适应不同记录配置、BCI 控制范式及有限标注数据的问题,提出时空 EEG Transformer(ST-EEGFormer),通过自监督预训练与下游微调学习可迁移的 EEG 表征。其主要贡献是将不同通道配置和信号时长的建模,与跨 MI、P300、SSVEP 范式的适应性评估结合起来。 方法将原始 EEG 切分为片段(patches),投影到嵌入空间,并加入空间与时间嵌入。作者以掩码自编码器(MAE)任务进行自监督预训练,预训练数据由六个公开运动想象(MI)数据集、一个公开 P300 数据集和一个公开稳态视觉诱发电位(SSVEP)数据集组成。摘要未提供片段长度、空间位置编码方式、掩码策略、重建目标细节或模型规模,尚不能确认其处理不同通道配置的具体实现条件。 评估包括预训练所涉及八个数据集上的下游分类微调,以及两个未参与预训练的公开数据集:癫痫发作分类数据集和在线 MI BCI 数据集。对照模型包括简单线性模型、EEGNet、监督学习模型 EEG Conformer,以及基础模型 BIOT 和 Large Brain Model(LaBraM)。作者报告,预训练后的 ST-EEGFormer 在八个预训练数据集的下游分类中均取得高于所比较模型的 Accuracy,并在新数据集、有限训练数据条件下表现出较强泛化能力;摘要未给出具体数值或有限数据的规模。 这些结果支持进一步核查统一时空表征与 MAE 预训练的适应性,但不能直接解释为已验证的跨被试、跨会话或无需微调的泛化。数据集名称、被试数、训练与测试划分、预训练与评估样本的关系、各基线微调预算、消融及统计信息尚未验证。作者还提供模型及支撑结果的特征可视化,其解释性结论需结合正文审阅;代码、权重与完整复现条件尚未验证。

    阅读价值:值得阅读其跨 MI、P300 与 SSVEP 范式的统一预训练设计,以及在未参与预训练的数据集上检验有限训练数据条件下泛化能力的实验;作者报告的优势仍需结合具体划分、微调预算与统计结果核对。

  2. OpenReview · EEG73

    EEG2Video:面向从 EEG 信号解码动态视觉感知

    基于摘要分析。研究针对既有视觉重建工作主要关注静态刺激的问题,探索从 EEG 解码动态视觉感知,贡献包括 EEG-video 配对数据集、视频元信息标注,以及采用 Seq2Seq 架构的视频重建基线 EEG2Video。 数据与任务:作者报告记录了 20 名被试观看 1400 个动态视频片段时的 EEG,视频涵盖 40 个概念。摘要强调 EEG 的高时间分辨率(1000 Hz)适于捕捉快速脑活动变化,但实际采集与预处理配置尚未验证。作者还为视频标注颜色、动态属性、是否包含人等元信息,以探索这些属性能否从 EEG 中解码;摘要未提供各属性任务的具体结果。 方法与结果:EEG2Video 使用 Seq2Seq 架构,旨在更好地对齐视频中的动态运动与高时间分辨率 EEG 信号。作者报告在语义分类任务中取得 79.8% 的 2-way Accuracy,视频重建的结构相似性指数(SSIM)为 0.256。摘要未说明候选样本构造、数据划分、被试内或跨被试评估设置、对照基线及 SSIM 的计算与汇总方式,因此这些数值不能直接用于跨研究比较,也不足以单独判定动态重建质量。 验证与复现:值得重点核对 EEG 与视频的时间对齐方式、Seq2Seq 的输入输出表示,以及重建是否保留动态信息而不只是语义或静态外观。实验协议、消融及统计信息尚未验证。摘要称数据集与代码将很快发布,这属于发布计划,不能视为已经公开可用;复现仍需确认资源开放状态及完整训练、评估配置。

    阅读价值:值得阅读的具体原因是其提供动态视频与 EEG 配对数据,并以 Seq2Seq 基线探索时序对齐的视频重建;重建效果及泛化能力仍需结合全文协议核对。

1月1日周一
  1. OpenReview · EEG73

    EEGMamba:用于 EEG 分类的双向状态空间模型与混合专家

    基于摘要分析。EEGMamba 面向不同任务中 EEG 信号长度、通道数不一致,以及 Transformer 长序列建模计算开销较大的问题,将 Spatio-Temporal-Adaptive(ST-Adaptive)模块、Bidirectional Mamba 和 Mixture of Experts(MoE)整合为统一的多任务 EEG 分类框架。 机制上,ST-Adaptive 通过空间自适应卷积对不同长度和通道数的 EEG 进行统一特征提取,并引入 class token 实现时间维度适配;摘要未说明具体的长度对齐与通道映射方式。Bidirectional Mamba 用于进一步提取 EEG 特征,作者旨在兼顾长序列处理的分类准确性与推理速度。Task-aware MoE 配置一个通用专家,以建模不同任务 EEG 的差异与共性;专家路由、任务信息如何输入以及训练损失尚未验证。 作者报告,在八个公开 EEG 数据集上进行了测试,覆盖癫痫发作检测、情绪识别、睡眠分期和运动想象四类任务,并报告性能优于对照方法。摘要未提供数据集名称、被试规模、评价指标、具体分数或对照基线,也未明确被试内、跨被试、跨会话或跨数据集划分,因此不能据此确认对未见任务的泛化能力,或量化准确性与速度之间的收益。 复现时应重点核对多任务联合训练与评估协议、异构通道和序列长度的处理,以及 ST-Adaptive、双向建模和通用专家各自的贡献;推理效率比较还需结合输入长度、硬件与计时条件。实验协议、消融及统计信息尚未验证。摘要称代码将于近期发布,当前材料不能确认代码已公开。

    阅读价值:值得核对 EEGMamba 如何通过输入适配、双向状态空间建模和任务感知专家机制处理异构 EEG,但其跨任务泛化与推理效率优势仍需结合全文中的训练划分和对照实验验证。

  2. OpenReview · EEG79

    EEGPT:通过自回归预训练释放 EEG 通用基础模型的潜力

    EEGPT 针对 EEG 数据格式多样、预训练范式与迁移方法受限的问题,结合电极级建模、自回归预训练和多任务迁移,旨在构建可适配不同采集设备、被试与任务的通用 EEG 基础模型。基于摘要分析,未取得论文全文。 核心机制:作者将每个电极作为基本建模单元,以整合不同电极配置的 EEG 数据;摘要称预训练数据涉及最多 138 个电极,共计 37.5M 个预训练样本,但样本单位、切片方式及数据组成尚未验证。预训练采用 next signal prediction,而非传统 masked autoencoder,目标是捕捉 EEG 的序列与时间依赖;具体预测粒度、序列组织、损失函数与推理流程尚未验证。作者还探索了参数规模最高为 1.1B 的模型的 scaling laws,但摘要未提供规模与性能之间的定量关系。 迁移机制:作者提出跨任务共享的可学习电极图网络,用于多任务迁移学习,并报告任务间具有兼容性与协同作用。摘要称模型支持最多 138 个电极及其任意组合输入;电极身份编码、不同设备的输入对齐方式、缺失电极处理和任务特定模块仍需核对正文。 结果与证据边界:作者报告在覆盖 5 个不同任务的 12 个 benchmarks 上进行评估,并在全部下游任务中优于现有专用模型,同时称广泛消融支持其有效性。摘要未列出任务与数据集名称、被试数、被试内或跨被试等划分协议、基线、指标及数值,因此不能据此量化优势,也不能确认跨设备、跨被试适配的具体评估前提。实验协议、消融及统计信息尚未验证。 复现重点是核对异构数据整合规则、自回归目标与电极图迁移各自的贡献,以及预训练数据和下游评估的关系。摘要中的“首次”及“最大”等表述属于作者主张,尚未独立核实。作者表示将发布代码和模型,当前材料不能确认其已公开。

    阅读价值:值得核对其电极级建模、自回归预训练与共享电极图的多任务迁移如何协同处理异构 EEG,并复现作者报告的跨任务优势;具体划分、对照与统计证据尚未验证。

  3. OpenReview · EEG77

    利用 EEGformer 降低可穿戴癫痫发作检测的误报:面向 MCU 的紧凑 Transformer 模型

    基于摘要分析。研究针对可穿戴设备长期连续监测 EEG 时的癫痫发作自动检测问题,提出紧凑 Transformer 模型 EEGformer,仅使用颞区通道,并通过面向硬件的设计探索兼顾检测延迟、误报率及低功耗 MCU 部署需求。 技术机制:摘要将 Transformer 用于无需手工特征提取的端到端时间序列处理,核心贡献在于将少通道采集条件与端侧计算约束纳入模型设计。具体网络结构、输入窗口、损失函数、训练策略及硬件优化方法尚未验证,不能据摘要判断性能收益分别来自模型设计、预处理还是检测后处理。 检测结果:作者报告,在 CHB-MIT 数据集上,相较于面向颞区采集的现有最先进模型,发作起始检测延迟降低 20%,同时达到 73% 的癫痫发作检测概率和每小时 0.15 次误报(FP/h)。摘要未给出对照模型名称、绝对延迟、被试内或跨被试协议及数据划分,因此这些结果应限定于作者所用评估条件。作者另报告,在一个新的、具有挑战性的头皮 EEG 数据集上,检测到 88% 的标注发作事件,误报率为 0.45 FP/h;该数据集名称、被试规模和评估划分尚未验证,两组结果不能直接比较。 部署结果:作者在单核 Apollo4 MCU 以及并行 GAP8、GAP9 MCU 上评估部署,报告最节能的 GAP9 实现每次推理耗时 13.7 ms、能耗 0.31 mJ。作者据此认为模型可支持少通道、具有多日续航的可穿戴检测系统;但单次推理指标不等于整机续航实测,推理频率、采集与通信功耗及电池条件仍需核对。 复现重点是确认颞区通道配置、连续记录的训练与测试划分、发作事件匹配规则、误报统计时长,以及检测阈值对检出概率、误报率和延迟的影响。实验协议、消融及统计信息尚未验证,代码与部署资源的可用性也尚未确认。该研究属于 EEG 临床监测算法与端侧部署研究,摘要中的检测结果不应直接视为临床有效性验证。

    阅读价值:值得阅读的具体原因是,作者将颞区少通道 EEG 癫痫发作检测的误报率、检测延迟与 MCU 推理能耗联合评估,为可穿戴端侧模型的设计提供了可核对的参考,但数据划分和检测协议仍需全文验证。

  4. OpenReview · EEG73

    EEG2Video:面向从 EEG 信号解码动态视觉感知

    基于摘要分析。本研究针对既有视觉重建研究主要关注静态刺激的问题,构建动态视频观看过程中的 EEG-video 配对数据,并提出基于 Seq2Seq 的 EEG2Video 基线,探索从 EEG 信号重建动态视觉感知。 数据与任务:作者报告,数据集记录了 20 名被试观看 40 个概念类别、共 1400 个动态视频片段时的 EEG。摘要提及 EEG 的高时间分辨率(1000 Hz),但具体采集与预处理协议尚未验证。作者还为视频标注颜色、动态属性及是否包含人等元信息,以考察这些属性能否从 EEG 中解码;摘要未提供各属性的独立实验结果。 核心机制:EEG2Video 使用 Seq2Seq 架构,旨在更好地对齐视频中的动态运动与高时间分辨率脑信号。其阅读价值在于将视觉解码从静态内容扩展到动态序列,但 EEG 编码方式、视频表示、时间对齐策略、损失函数及训练与推理流程均需全文核对,不能仅凭摘要判断模型是否实际利用了运动特异信息。 结果与证据边界:作者报告,模型在语义分类任务中取得 79.8% 的 2-way Accuracy,视频重建的结构相似性指数 SSIM 为 0.256。摘要未说明候选构造、数据划分、被试内或跨被试协议、对照基线及 SSIM 的计算与汇总方式,因此这些数值不能直接与其他协议下的结果比较,也不足以确认跨被试泛化或运动重建质量。 复现条件:摘要称数据集与代码将于近期发布,现有材料不能确认已公开。实验协议、消融及统计信息尚未验证;复现时应核对视频与被试的训练测试划分、时序对齐,以及动态信息相对静态语义信息的贡献。

    阅读价值:值得阅读的具体原因是其构建 EEG-video 配对数据并以 Seq2Seq 探索动态视觉重建,可用于研究 EEG 时间信息与视频运动的对应关系,但评估划分及动态信息解码的独立贡献尚未验证。

  5. OpenReview · EEG74

    面向可穿戴 BCI 低功耗实时 EEG 分类的优化 EEGNet 处理器

    基于摘要分析。该研究针对既有 EEGNet 处理器采用高精度定点数所带来的功耗和资源开销,提出低精度 EEGNet(LPEEGNet)处理器,通过算法量化与硬件架构协同优化,支持可穿戴 BCI 的低功耗实时 EEG 分类。 算法方面,作者通过低精度量化将 EEGNet 重构为 LPEEGNet;摘要未提供量化位宽、量化训练方式或各层精度配置。硬件方面,处理器采用数据驱动处理流程,以层融合构建异构流式架构,利用全局特征图存储改善访存效率,并结合层间并行与层内流水线提升推理效率。其可核对的技术重点是低精度计算、数据搬运与并行调度的联合设计,而不只是压缩模型。 作者报告,在 FPGA 实验中,相比摘要所称的最先进 EEGNet 处理器,该实现的功耗、LUT 利用量和推理延迟分别降低 52.6%、36.2% 和 25.8%;作者另报告,在一个 ERP 数据集上的 Accuracy 为 93.06%。摘要未明确数据集名称、被试数、被试内或跨被试评估协议、数据划分及对照处理器配置,因此这些结果只能在原文所述实验范围内理解,不能直接与其他协议下的分类结果比较。作者据此认为该处理器更适合可穿戴 BCI,但实际可穿戴系统中的收益仍需结合完整实验条件核对。 复现时需确认量化配置及精度变化、FPGA 型号与运行频率、功耗测量范围、延迟计量口径,以及对照实现是否采用可比的网络与硬件条件。实验协议、消融及统计信息尚未验证;摘要也不足以确认端到端在线 BCI 的实时性表现。

    阅读价值:该研究将 EEGNet 低精度量化与 FPGA 流式架构联合优化,值得核对其分类精度、功耗和延迟之间的权衡,尤其是量化配置与硬件对照条件。

9月22日周五
  1. OpenReview · EEG71

    通过几何感知建模学习拓扑无关的 EEG 表征

    基于摘要分析。该研究针对不同 EEG 数据资源的通道选择不一致,以及信号固有的结构与空间信息难以统一利用的问题,提出将不同通道选择映射到统一拓扑,并在此基础上构建 MMM 预训练框架,以学习拓扑无关的 EEG 表征、支持跨数据集预训练。 MMM 包含 Multi-dimensional position encoding(多维位置编码)、Multi-level channel hierarchy(多级通道层级)和 Multi-stage pre-training strategy(多阶段预训练策略)。摘要明确的机制路径是先统一通道拓扑,再通过上述三个组件组织空间信息、通道层级及预训练过程;但统一拓扑的具体定义、通道映射方式、位置编码构造、层级组织及各训练阶段的目标尚未验证,不能据此推断网络结构或损失形式。 作者报告,该方法在情绪识别基准数据集上相较此前最先进方法取得明显提升。摘要未提供数据集名称、指标、数值、对照方法或数据划分,因此不能量化提升,也不能判断结果属于 Within-subject、Cross-subject 或 Cross-dataset 评估。支持跨数据集预训练是研究目标,不等同于已经验证跨数据集下游泛化;实验协议、消融及统计信息尚未验证。 复现时应优先核对统一拓扑如何处理通道缺失与不同电极配置、预训练数据如何组合,以及三个组件各自的贡献。尤其需要确认情绪识别评估中的被试与数据集划分、预训练和下游数据的关系,以及比较方法是否采用相同协议。这些均是需全文核对的事项,而非已发现的研究缺陷。

    阅读价值:值得阅读的具体原因是其以统一通道拓扑连接不同 EEG 资源,并结合位置编码、通道层级与分阶段预训练;这些设计为跨数据集预训练提供了可核对的机制路径,但性能增益及跨通道配置泛化仍需全文验证。