跳到正文

算法、任务与模态

Neural Decoding 最新动态

Neural Decoding 研究索引;按可核对的标签归档,不以热度评价质量。

152 条精选近 30 天 79 条共收录 247 条

更新

精选归档 · 第 8 页

1月1日周一第 141–152 条
  1. OpenReview · EEG73

    从 EEG 脑记录中学习鲁棒的深度视觉表征

    基于摘要分析。该研究面向从 EEG 解码视觉信息的问题,提出两阶段方法:先从 EEG 提取特征、学习鲁棒的深度视觉表征,再将所得表征用于图像生成和分类。其贡献包括对特征提取流程泛化能力的评估,以及将未见图像映射至 EEG 空间并近似重建的框架。 方法方面,摘要提及使用深度学习架构,分别结合监督学习与对比学习,在三个数据集上验证特征提取流程,并开展零样本 EEG 分类。具体网络结构、对比学习目标、两阶段训练衔接及零样本任务的类别划分尚未验证;多个数据集上的评估也不能直接视为 Cross-dataset 迁移实验。 作者报告,仅用 EEG 的单模态学习获得了被试不变、线性可分的视觉表征,其 k-means Accuracy 优于 EEG 与图像的联合表征学习。该结论的被试划分、线性可分性检验、聚类标签匹配方式和比较数值未在摘要中展开,是否采用严格 Cross-subject 评估尚未验证。 图像生成方面,作者报告其 EEG 图像合成方法在 EEGCVPR40 和 Thoughtviz 上的 Inception Score 分别提升 62.9% 和 36.13%,并声称优于 GAN 相关的现有最佳表现。这些数字为相对提升而非百分点;具体对照方法、原始分数、数据划分及统计信息尚未验证。摘要所述“未见图像映射至 EEG 空间再重建”还需与实际 EEG 输入的图像重建协议区分,不能仅凭摘要确认其对未见视觉类别的脑信号解码能力。 复现时应优先核对 EEG 预处理、被试与刺激划分、监督信息的使用、单模态与联合学习的对照条件,以及生成指标的计算协议。全文、实验消融及代码可用性尚未验证。

    阅读价值:值得核对其仅用 EEG 学习视觉表征与 EEG—图像联合表征的对照,以及零样本分类和图像生成的评估协议,以判断表征可分性与跨被试泛化是否同时成立。

  2. OpenReview · EEG73

    EEG2Video:面向从 EEG 信号解码动态视觉感知

    基于摘要分析。本研究针对既有视觉重建研究主要关注静态刺激的问题,构建动态视频观看过程中的 EEG-video 配对数据,并提出基于 Seq2Seq 的 EEG2Video 基线,探索从 EEG 信号重建动态视觉感知。 数据与任务:作者报告,数据集记录了 20 名被试观看 40 个概念类别、共 1400 个动态视频片段时的 EEG。摘要提及 EEG 的高时间分辨率(1000 Hz),但具体采集与预处理协议尚未验证。作者还为视频标注颜色、动态属性及是否包含人等元信息,以考察这些属性能否从 EEG 中解码;摘要未提供各属性的独立实验结果。 核心机制:EEG2Video 使用 Seq2Seq 架构,旨在更好地对齐视频中的动态运动与高时间分辨率脑信号。其阅读价值在于将视觉解码从静态内容扩展到动态序列,但 EEG 编码方式、视频表示、时间对齐策略、损失函数及训练与推理流程均需全文核对,不能仅凭摘要判断模型是否实际利用了运动特异信息。 结果与证据边界:作者报告,模型在语义分类任务中取得 79.8% 的 2-way Accuracy,视频重建的结构相似性指数 SSIM 为 0.256。摘要未说明候选构造、数据划分、被试内或跨被试协议、对照基线及 SSIM 的计算与汇总方式,因此这些数值不能直接与其他协议下的结果比较,也不足以确认跨被试泛化或运动重建质量。 复现条件:摘要称数据集与代码将于近期发布,现有材料不能确认已公开。实验协议、消融及统计信息尚未验证;复现时应核对视频与被试的训练测试划分、时序对齐,以及动态信息相对静态语义信息的贡献。

    阅读价值:值得阅读的具体原因是其构建 EEG-video 配对数据并以 Seq2Seq 探索动态视觉重建,可用于研究 EEG 时间信息与视频运动的对应关系,但评估划分及动态信息解码的独立贡献尚未验证。

9月22日周五
  1. OpenReview · EEG75

    DeWave:用于 EEG 到文本翻译的 EEG 波形离散编码

    基于摘要分析。DeWave 研究开放词汇 EEG 到文本翻译,针对现有方法依赖眼动注视或事件标记进行词级分割的问题,提出通过离散 EEG 编码与预训练语言模型对齐的框架,并探索不依赖词级顺序标记的整段信号翻译。 核心机制是使用量化变分编码器生成离散 codex 表征,再将编码序列与预训练语言模型对齐。作者认为,文本–EEG 对比对齐训练能够缓解眼动注视顺序与词语顺序不一致的问题,而具有不变性的离散 codex 可减少个体 EEG 差异带来的干扰。摘要未提供量化实现、损失函数、训练阶段或语言模型名称,上述机制的具体实现及各模块贡献尚未验证。 作者报告,在 ZuCo Dataset 上,DeWave 达到 41.35 BLEU-1 和 33.71 Rouge-F,对应此前基线分别为 40.1 和 31.7。摘要未交代这一比较的被试内或跨被试协议、数据划分与基线名称,因此不能据此判断跨被试泛化能力。另在不使用词级顺序标记的整段 EEG 翻译条件下,作者报告 20.5 BLEU-1 和 29.5 Rouge-1。两组结果的输入条件不同,且 Rouge-F 与 Rouge-1 的指标表述不同,不宜直接作等价比较。 阅读全文时需核对离散表征的不变性如何约束与评估、训练和推理各自依赖哪些文本或事件信息,以及整段信号的切分与对齐方式。被试数量、实验划分、消融、统计信息和复现资源尚未验证。摘要中的结果不能直接证明系统已具备自由表达场景下的实时 BCI 能力;作者关于整段翻译的“首次”主张也尚未独立核验。

    阅读价值:值得阅读的具体原因是 DeWave 将离散 EEG 编码与预训练语言模型对齐,并报告了不依赖词级顺序标记的整段 EEG 到文本翻译结果;其对跨被试差异的缓解程度及推理条件仍需全文核验。

9月20日周三
  1. OpenReview · EEG72

    BELT-2:面向多任务脑解码的 EEG—语言表征自举对齐

    BELT-2 研究如何将 EEG 表征与语言表征对齐,并连接大语言模型(LLMs)以支持多任务脑解码;核心方法结合 BPE 级对齐、多任务 EEG 编码器与 prefix-tuning。基于摘要分析,未取得论文全文。 技术机制方面,作者采用 byte pair encoding(BPE)级 EEG—语言对齐,并在 EEG 领域联合进行多任务训练与解码;随后利用 EEG 编码器的中间输出,通过 prefix-tuning 连接 LLMs。该设计将 EEG 表征学习与语言生成接口结合,但摘要未说明 EEG 与 BPE 单元的对应构造、对齐损失、多任务的具体组成、LLM 型号,以及训练时哪些模块冻结或更新,相关细节尚未验证。 结果方面,作者报告在 ZuCo 数据集上获得 BLEU-1 为 52.2% 的解码结果,但摘要未提供数据划分、被试内或跨被试协议及对照基线,因此不能据此判断跨被试泛化能力。作者还报告在其他翻译基准上提升 31%–162%,但未明确基准名称、指标、对照方法及提升的计算口径,不能将其解释为准确率或百分点提升。作者声称该方法能够从非侵入式脑信号解码连贯、可读的句子,并声称相关设计具有首次性;这些主张尚需正文与既有工作核对。 复现时需核对 EEG 预处理、EEG—文本配对方式、训练与测试划分、多任务监督来源,以及文本生成阶段是否使用额外文本条件。尤其应区分 EEG 提供的信息与 LLM 语言先验对生成质量的贡献;摘要不足以确定这一贡献分解。实验协议、消融及统计信息尚未验证。摘要称代码可通过匿名链接获取,但当前材料未给出该链接,代码可访问性与复现条件尚未验证。

    阅读价值:值得阅读的具体原因是 BELT-2 将 BPE 级 EEG—语言表征对齐、多任务训练与 LLM prefix-tuning 结合,可用于考察语言先验与 EEG 表征对文本解码的各自贡献,但其评估协议与提升幅度仍需全文核对。

1月17日周二
  1. OpenReview · EEG80

    机器学习癫痫发作预测:一种存在问题却被普遍接受的做法

    基于摘要分析。本研究关注机器学习 EEG 癫痫发作预测中,已发表的高预测表现为何未能转化为临床应用,并通过实证研究检验一种常见标注与验证做法可能引入的混杂。其主要贡献是以真实 EEG 中与生物学完全脱钩的“伪发作”任务,检验模型能否利用非发作信号获得虚高的验证准确率。 被考察的做法是:将短 EEG 窗口按时间组赋予标签,再从这些窗口中随机抽取样本进行验证。作者研究这一流程中的混杂,并训练人工神经网络学习真实 EEG 上人为设置的“伪发作”。该设计意在区分模型对真实发作前生物标志物的学习,与对其他信号特征的学习,而非提出新的发作预测算法。 作者报告,在上述按时间组标注、随机抽取窗口验证的流程下,非发作信号也能够形成机器学习可利用的决策边界,使验证准确率虚高;模型能够学习与生物学脱钩的“伪发作”是其核心证据。摘要未提供具体准确率、数据集、被试数、窗口长度、神经网络结构或被试内/跨被试协议,不能据此量化偏差大小,也不能认定所有既有研究均受影响。 作者认为,部分既有工作的结果可能受到这一混杂影响,并建议更严格地缓解混杂。全文中的具体指南、对照设置、实验协议、消融及统计信息尚未验证。阅读与复现时应重点核对时间组如何定义、训练与验证窗口之间的时间关系,以及“伪发作”标签如何构造,再判断结论适用范围。该研究直接涉及 EEG 预测评估,但其发现不应未经检验就推广到所有 EEG 解码或 BCI 任务,也不构成临床有效性证据。

    阅读价值:该研究通过真实 EEG 中与生物学脱钩的“伪发作”任务检验验证混杂,为核对癫痫发作预测中的标注与数据划分是否支撑临床相关结论提供了具体切入点。

1月1日周日
  1. OpenReview · EEG74

    EEG Conformer:用于 EEG 解码与可视化的卷积 Transformer

    基于摘要分析。该研究针对 EEG 解码中 CNN 感受野有限、可能难以捕获长期依赖的问题,提出紧凑的 EEG Conformer,将局部特征提取与全局关联建模整合到统一的 EEG 分类框架,并提供脑地形图可视化策略。 核心机制是先通过一维时间卷积和空间卷积学习低层局部特征,再直接连接自注意力模块,提取局部时间特征之间的全局关联,最后使用基于全连接层的分类器预测 EEG 类别。其方法价值在于将卷积与自注意力作为互补模块,而非单独依赖局部卷积;具体网络深度、参数量、损失函数、训练配置与推理成本尚未验证。 可视化方面,作者将类激活映射投影到脑地形图,以增强分类结果的可解释性。摘要未提供该投影的具体计算流程或解释性验证结果,因此不能据此认定可视化已经揭示了可靠的神经生理机制。 作者报告,在涵盖 EEG 运动想象与情绪识别范式的三个公开数据集上,方法取得了当时的 state-of-the-art 性能,并提出其有潜力成为通用 EEG 解码的新基线。摘要未列出数据集名称、被试数量、数据划分、被试内或跨被试等评估协议、对照方法与具体指标,故目前无法核对性能提升的幅度或跨协议可比性;实验协议、消融及统计信息尚未验证。 作者说明代码已公开,可作为复现入口。复现时需结合全文与实现核对 EEG 预处理、输入窗口、卷积和注意力配置、训练策略及评估划分,并分别检验全局关联模块的增益与脑地形图可视化的稳定性。摘要尚不足以确定其跨被试、跨会话泛化能力。

    阅读价值:值得核对其局部卷积特征与全局自注意力的组合机制,以及类激活映射到脑地形图的可视化策略;摘要提供了公开代码入口,但性能优势及解释性仍需结合完整实验协议验证。

  2. OpenReview · EEG72

    使用 Transfer Euclidean Alignment 减少人类与小鼠创伤性脑损伤 EEG 的种内与种间协变量偏移

    基于摘要分析。研究针对睡眠 EEG 在不同被试及数据集间变异较大、优质人类生物医学数据有限的问题,提出迁移学习方法 Transfer Euclidean Alignment,并在人类与小鼠的创伤性脑损伤(TBI)有无二分类任务中评估其作用。主要研究对象是 TBI 相关 EEG 分类,而非 BCI 控制或意图解码。 方法与评估:作者将该方法用于多种基于规则的经典机器学习模型以及基于 EEGNet 的深度学习模型,考察不同数据集之间的种内和种间迁移。摘要没有提供对齐变换的具体定义、参考统计量的估计方式、标签需求或训练与推理流程,因此无法确认其相对于常规 Euclidean Alignment 的技术差异。 结果:作者报告,在所评估的 TBI 二分类数据集上,种内数据集的平均提升为 14.42%,种间数据集为 5.53%。摘要未说明这些百分数对应的评价指标、相对增幅还是百分点变化,也未给出对照基线、数据划分及平均方式,不能将其直接解读为 Accuracy 的百分点提升,或比较两类迁移的难度。 局限与复现核对:数据集名称、被试及动物数量、睡眠阶段、通道配置、预处理、被试独立性、模型训练设置、消融及统计信息尚未验证。复现时应重点核对源域与目标域的构成、对齐统计量使用的数据范围,以及人类与小鼠记录之间的特征对应关系。 平台推测(待验证):若该方法确实通过 EEG 统计量对齐减少域差异,其机制可能用于缓解 BCI 的跨被试或跨会话偏移,但原任务效果不等于 BCI 有效性。需根据正文确认可复用的对齐模块,并适配通道与特征定义;低信噪比、小样本统计估计及任务相关差异可能导致失效。一个可检验的小实验是在固定跨被试 EEG 分类划分下,对比无对齐、常规 Euclidean Alignment 与该方法,保持分类器和目标域数据使用条件一致。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得核对 Transfer Euclidean Alignment 在人类与小鼠睡眠 EEG 的 TBI 二分类中如何缓解种内与种间协变量偏移,但摘要中的提升未明确指标与划分协议,不能据此认定其对 BCI 任务有效。

1月1日周六
  1. OpenReview · EEG73

    EEGformer:面向低通道数可穿戴连续监测设备的基于 Transformer 的原始 EEG 癫痫检测

    基于摘要分析。该研究针对长期连续癫痫监测对低误报、佩戴舒适性和低功耗的要求,提出紧凑的 Transformer 模型 EEGformer,直接使用四个颞区通道的原始 EEG 进行癫痫发作检测,并在微控制器(MCU)上验证实时推理的可行性。 核心思路是利用 Transformer 捕捉时间序列中的长程依赖,减少对针对特定数据设计的手工特征的依赖。摘要未提供输入窗口、具体模型结构、损失函数、训练策略或预处理细节,因此不能据此认定信号完全未经预处理。 作者报告,在所检查的八名患者的癫痫发作事件中,模型检出率为 73%;仅考虑其中六名患者时,事件检出率为 100%,不能将这一子集结果推广到全部患者。作者报告平均发作起始检测延迟为 15.2 秒,误报率为 0.8 FP/h;多数测试获得 100% 特异性,但 40 次测试中有 5 次异常表现,作者将其主要归因于 EEG 伪迹。事件检出率、特异性与每小时误报率反映不同层面的表现,不应相互替代。被试内或跨被试协议、数据划分以及各指标的统计口径尚未验证。 作者以 CHB-MIT Scalp EEG 数据集为参照,与针对目标数据集设计手工特征的先进分类器比较,报告准确性结果接近、发作起始检测延迟降低超过 20%;与两种经优化的卷积神经网络方法比较,作者报告在全部准确性指标上更优。具体基线、指标数值、消融及统计信息尚未验证。 部署方面,作者报告模型在 Ambiq Apollo4 MCU、96 MHz 工作频率下,单次推理耗时 405 毫秒、能耗 1.79 毫焦耳。这支持其嵌入式推理可行性,但不等于已验证整机长期续航或临床连续监测安全性。复现需进一步核对通道选择、窗口与报警规则、患者级划分、伪迹处理,以及推理数值精度和资源占用;代码与权重可用性尚未验证。

    阅读价值:值得阅读的具体原因是作者同时报告了四通道原始 EEG 癫痫发作检测表现与 MCU 实测时延、能耗,可用于核对低功耗连续监测中检测灵敏度、误报和部署成本的权衡,但临床适用性尚未验证。

  2. OpenReview · EEG78

    用于 EEG 解码的深度黎曼网络

    基于摘要分析。本研究针对深度黎曼网络(Deep Riemannian Networks,DRNs)在 EEG 解码中的架构设计、端到端学习及内部数据变换问题,提出 EE(G)-SPDNet,并通过广泛的超参数分析探索深度学习与黎曼几何解码方法的结合。 方法与机制:研究重点包括网络规模、端到端学习能力及网络内部表示与传统 EEG 解码方式的关联。EE(G)-SPDNet 被描述为一种宽型、端到端 DRN,可直接从原始 EEG 学习任务相关信息,无需手工设计滤波器组。摘要未提供其具体层结构、黎曼几何运算、损失函数或训练配置,这些实现细节尚未验证。 实验与结果:作者报告,在五个公开 EEG 数据集上测试网络并与先进 ConvNets 比较,EE(G)-SPDNet 可以取得优于这些对照模型的解码表现。摘要未列出数据集名称、任务、被试数、被试内或跨被试等评估协议及具体指标,因此不能据此判断优势大小、适用任务或泛化范围。 滤波与表示分析:作者报告,模型使用了具有生理合理性的频率区域;端到端学习得到的滤波器比面向传统 alpha、beta、gamma 频段的带通滤波器更复杂,且通道特异性滤波可改善性能。这些观察支持进一步研究可学习滤波与空间通道差异的作用,但不能仅凭摘要将生理合理性等同于机制解释或跨场景鲁棒性。 局限与复现核对:作者的架构分析提示,网络可能未充分利用黎曼几何特有的信息,仍有改进空间。复现需核对各数据集的预处理与划分、ConvNet 基线配置、网络宽度与端到端训练的对照,以及通道特异性滤波的具体实现。实验协议、消融及统计信息尚未验证,代码可用性亦尚未确认。

    阅读价值:值得阅读的具体原因是其结合架构分析与滤波分析,考察端到端黎曼几何网络如何从原始 EEG 学习任务相关信息;摘要中的性能优势仍需结合具体数据划分、ConvNet 基线及统计结果核对。

  3. OpenReview · EEG72

    MAtt:用于 EEG 解码的流形注意力网络

    基于摘要分析。该研究针对深度神经网络与几何学习在 EEG 解码中结合不足的问题,提出流形注意力网络 mAtt,以流形注意力机制在黎曼对称正定(SPD)流形上刻画 EEG 的时空表征,探索几何深度学习用于非侵入式 BCI 信号解码的路径。 核心机制是将注意力与 SPD 流形表征相结合,而非仅在普通欧氏特征空间中学习。摘要强调时空表征在该流形上进行,但未提供 EEG 到 SPD 表征的构造方式、注意力计算形式、网络结构、损失函数或训练与推理流程,相关实现尚未验证。几何学习对噪声 EEG 的稳健性是论文提出的研究动机,不能据此直接认定 mAtt 已通过独立抗噪实验。 作者报告,在时间同步与时间异步 EEG 数据集上的评估表明,mAtt 相较其他领先深度学习方法具有解码优势;但摘要未列出数据集名称、任务、被试数、划分方式、基线名称或量化指标,因此无法判断优势的幅度及其适用的被试内、跨被试或跨会话条件。作者还报告,模型解释性分析显示 mAtt 能捕捉有信息量的 EEG 特征并处理脑动态的非平稳性;该结论的具体分析方法、证据及适用范围仍需核对。 复现时应重点确认 SPD 表征如何构造并保持正定性、流形注意力如何实现,以及同步与异步任务的评估协议;同时核对对照方法、预处理、消融和统计信息。这些内容尚未验证,当前材料不足以判断其在跨被试、跨会话或低信噪比条件下的泛化能力。

    阅读价值:值得阅读的是其将注意力机制与 SPD 流形上的 EEG 表征学习结合的具体路径,但作者所报告的解码优势及非平稳性处理能力仍需结合全文实验协议与解释性证据核对。

  4. OpenReview · EEG73

    从 EEG 信号连续解码协调运动中的双手轨迹

    基于摘要分析。该研究针对协调双手运动的连续轨迹解码问题,提出双手 BCI 范式,并结合 EEGNet 与 long short-term memory network(LSTM)构建多任务深度学习模型,从 EEG 同时重建双手的位置和速度。 任务要求被试完成朝左、中、右目标的双手伸达运动,同时采集 EEG。研究对象是实际协调运动中的轨迹重建,摘要未将其描述为运动想象任务。模型结合 EEGNet 与 LSTM,但具体模块连接、任务间参数共享、损失函数、输入时间窗及推理流程尚未验证,不能仅凭模型名称推定其实现细节。 作者报告,在 13 名被试的实验中,位置和速度解码的总体平均合并相关系数(CC)分别为 0.54 和 0.42,对应的合并归一化均方根误差(NRMSE)分别为 0.22 和 0.23;两类指标均显著优于机会水平(p<0.05)。摘要未说明“合并”的具体方式,也未交代被试内或跨被试协议、训练与测试划分及机会水平的构造方法,因此这些数值只能作为该研究所述实验条件下的结果,不能直接与其他协议比较。 作者报告,该模型在连续轨迹解码的 CC 和 NRMSE 上显著优于若干常用方法,但摘要未列出基线名称、具体差值和统计检验细节。其主要贡献是提供从 EEG 同时解码协调双手轨迹的可行性证据;离线轨迹相关性不等同于在线闭环控制性能。复现前需核对 EEG 预处理、轨迹同步与归一化、数据划分、多任务训练配置及评估聚合方式;实验协议、消融及统计信息尚未验证,数据与代码可用性亦尚未验证。

    阅读价值:该研究将 EEG 连续解码拓展到协调双手的位置与速度重建,值得核对其多任务建模及轨迹评估协议,但摘要结果尚不能证明在线双手控制的有效性。

1月1日周二
  1. OpenReview · EEG73

    MAD-EEG:用于解码多声部音乐中目标乐器听觉注意的 EEG 数据集

    基于摘要分析。该研究针对多声部音乐中目标乐器的 EEG 听觉注意解码问题,提出公开可用的 MAD-EEG 数据集,为单试次注意解码及其他 EEG 音乐分析任务提供研究材料。 数据与任务:摘要所述数据包含 8 名被试的 20 通道 EEG;被试听独奏、二重奏和三重奏音乐片段,并注意一个预先指定的乐器。刺激通过扬声器而非耳机播放,设计涵盖混合中乐器的数量与类型、空间呈现、音乐风格和旋律变化。其核心研究对象是音乐聆听中的选择性听觉注意,而不是运动想象或通用 EEG 分类。 初步验证:作者使用一种常用于语音刺激的先进刺激重建算法,从 EEG 响应重建音频表征,并比较重建表征与被注意及未被注意声源表征的相关性。作者报告,在该初步音乐实验中,重建表征与被注意声源的相关性更高;摘要未给出具体相关系数、解码 Accuracy、数据划分或统计检验,因此不能据此量化单试次、跨被试或跨会话性能。作者将该结果解释为数据集适用于相关注意解码研究。 阅读与复现重点:需核对音频表征及重建算法的具体定义、刺激与 EEG 的时间对齐、参考与预处理方式、试次数与时长,以及训练测试划分是否区分音乐片段和被试。摘要称数据免费公开,但数据文件、访问条件、配套实现及完整实验协议尚未验证;消融及统计信息也尚未验证。扬声器呈现及多种刺激变化是该数据集的重要场景特征,但它们对解码性能的独立影响仍需依据全文与数据确认。

    阅读价值:该数据集将 EEG 听觉注意解码扩展到扬声器播放的多声部音乐,并提供目标乐器注意任务,值得用于核对语音刺激重建方法在音乐场景中的适用性,但摘要中的初步相关性结果尚不足以确定单试次解码性能。