跳到正文

算法、任务与模态

Neural Decoding 最新动态

Neural Decoding 研究索引;按可核对的标签归档,不以热度评价质量。

68 条精选近 30 天 43 条共收录 109 条

更新

精选归档 · 第 4 页

9月26日周四第 61–68 条
  1. OpenReview · EEG76

    以大型时空 Transformer 为基础模型学习鲁棒 EEG 表征

    基于摘要分析。研究针对 EEG 基础模型难以适应不同记录配置、BCI 控制范式及有限标注数据的问题,提出时空 EEG Transformer(ST-EEGFormer),通过自监督预训练与下游微调学习可迁移的 EEG 表征。其主要贡献是将不同通道配置和信号时长的建模,与跨 MI、P300、SSVEP 范式的适应性评估结合起来。 方法将原始 EEG 切分为片段(patches),投影到嵌入空间,并加入空间与时间嵌入。作者以掩码自编码器(MAE)任务进行自监督预训练,预训练数据由六个公开运动想象(MI)数据集、一个公开 P300 数据集和一个公开稳态视觉诱发电位(SSVEP)数据集组成。摘要未提供片段长度、空间位置编码方式、掩码策略、重建目标细节或模型规模,尚不能确认其处理不同通道配置的具体实现条件。 评估包括预训练所涉及八个数据集上的下游分类微调,以及两个未参与预训练的公开数据集:癫痫发作分类数据集和在线 MI BCI 数据集。对照模型包括简单线性模型、EEGNet、监督学习模型 EEG Conformer,以及基础模型 BIOT 和 Large Brain Model(LaBraM)。作者报告,预训练后的 ST-EEGFormer 在八个预训练数据集的下游分类中均取得高于所比较模型的 Accuracy,并在新数据集、有限训练数据条件下表现出较强泛化能力;摘要未给出具体数值或有限数据的规模。 这些结果支持进一步核查统一时空表征与 MAE 预训练的适应性,但不能直接解释为已验证的跨被试、跨会话或无需微调的泛化。数据集名称、被试数、训练与测试划分、预训练与评估样本的关系、各基线微调预算、消融及统计信息尚未验证。作者还提供模型及支撑结果的特征可视化,其解释性结论需结合正文审阅;代码、权重与完整复现条件尚未验证。

    阅读价值:值得阅读其跨 MI、P300 与 SSVEP 范式的统一预训练设计,以及在未参与预训练的数据集上检验有限训练数据条件下泛化能力的实验;作者报告的优势仍需结合具体划分、微调预算与统计结果核对。

  2. OpenReview · EEG73

    EEG2Video:面向从 EEG 信号解码动态视觉感知

    基于摘要分析。研究针对既有视觉重建工作主要关注静态刺激的问题,探索从 EEG 解码动态视觉感知,贡献包括 EEG-video 配对数据集、视频元信息标注,以及采用 Seq2Seq 架构的视频重建基线 EEG2Video。 数据与任务:作者报告记录了 20 名被试观看 1400 个动态视频片段时的 EEG,视频涵盖 40 个概念。摘要强调 EEG 的高时间分辨率(1000 Hz)适于捕捉快速脑活动变化,但实际采集与预处理配置尚未验证。作者还为视频标注颜色、动态属性、是否包含人等元信息,以探索这些属性能否从 EEG 中解码;摘要未提供各属性任务的具体结果。 方法与结果:EEG2Video 使用 Seq2Seq 架构,旨在更好地对齐视频中的动态运动与高时间分辨率 EEG 信号。作者报告在语义分类任务中取得 79.8% 的 2-way Accuracy,视频重建的结构相似性指数(SSIM)为 0.256。摘要未说明候选样本构造、数据划分、被试内或跨被试评估设置、对照基线及 SSIM 的计算与汇总方式,因此这些数值不能直接用于跨研究比较,也不足以单独判定动态重建质量。 验证与复现:值得重点核对 EEG 与视频的时间对齐方式、Seq2Seq 的输入输出表示,以及重建是否保留动态信息而不只是语义或静态外观。实验协议、消融及统计信息尚未验证。摘要称数据集与代码将很快发布,这属于发布计划,不能视为已经公开可用;复现仍需确认资源开放状态及完整训练、评估配置。

    阅读价值:值得阅读的具体原因是其提供动态视频与 EEG 配对数据,并以 Seq2Seq 基线探索时序对齐的视频重建;重建效果及泛化能力仍需结合全文协议核对。

  3. OpenReview · EEG76

    基于 EEG 嵌入与引导扩散的视觉解码和重建

    基于摘要分析。该研究针对 EEG 视觉解码与图像重建,提出端到端零样本框架:通过 Adaptive Thinking Mapper(ATM)将神经信号映射到与 CLIP 嵌入共享的子空间,再用两阶段、多路引导的扩散生成策略结合高层语义与低层视觉信息。 机制方面,第一阶段将 EEG 嵌入与高层 CLIP 嵌入对齐,并通过先验扩散模型将 EEG 嵌入细化为图像先验;同时从 EEG 解码模糊图像,以保留低层特征。第二阶段将高层 CLIP 嵌入、模糊图像以及从 EEG 潜变量得到的文本描述共同输入预训练扩散模型。其方法特点是以互补条件引导生成,而非仅依赖单一语义嵌入。摘要未说明 ATM 的具体结构、对齐损失、文本描述生成方式及各模块的训练或冻结策略,相关细节尚未验证。 作者报告,该框架在零样本视觉分类、检索和重建任务上达到 SOTA,并在 MEG 数据模态上展示了适用性;作者还分析了不同时间窗与脑区对解码和重建的影响。但摘要未提供数据集、被试数、具体指标、数值或对照基线,也未明确零样本的类别划分及被试内、跨被试或跨会话设置,因此不能据此判断性能提升幅度或泛化范围。 复现时应重点核对零样本训练与测试划分、视觉刺激及 EEG 预处理、扩散模型的预训练来源,以及高层嵌入、模糊图像和文本描述各自的贡献。图像生成的语义一致性与 EEG 所支持的细节恢复能力需分开评估,生成图像逼真不直接等同于忠实重建。摘要提供了代码仓库链接,但代码可用性、运行条件、实验协议、消融及统计信息尚未验证。作者提出的 BCI 应用潜力也不等同于已完成在线或实际应用验证。

    阅读价值:值得阅读的具体原因是其将 EEG 对齐的高层语义、低层模糊图像与潜变量生成的文本描述共同用于扩散重建,可重点核对各引导信息的贡献及零样本评估协议;作者报告的性能优势尚需全文验证。

1月3日周三
  1. OpenReview · EEG72

    从 EEG 脑记录中学习鲁棒的深度视觉表征

    基于摘要分析。该研究关注如何从 EEG 中学习可用于视觉图像分类与重建的鲁棒表征,提出两阶段方法:先提取 EEG 特征并学习深度表征,再将所学表征用于图像生成和分类。 在表征学习阶段,作者使用深度学习架构,结合监督学习与对比学习,在三个数据集上评估特征提取流程的泛化能力,并开展零样本 EEG 分类。摘要未给出具体网络结构、损失形式、三个数据集的完整名称及零样本类别划分,因此尚不能确定这些实验对应跨被试、跨会话还是跨数据集泛化。 作者报告,仅使用 EEG 的单模态学习能够获得被试不变、线性可分的视觉表征,其 k-means Accuracy 优于 EEG 与图像联合表征学习。该对照有助于考察图像模态是否必然改善 EEG 表征,但摘要未提供具体分数、被试划分、聚类评估方式及被试不变性的验证细节,结论仍需结合正文核对。 在生成阶段,作者提出将未见图像映射到 EEG 空间并进行近似重建的框架。作者报告,EEG 图像合成方法在 EEGCVPR40 和 Thoughtviz 上的 Inception Score 分别提升 62.9% 和 36.13%,并声称优于 GAN 相关的现有最佳表现;摘要未明确比较基线、数据划分与计算设置。这些数字是 Inception Score 的相对提升,而非分类 Accuracy 或百分点增益,也不能单独说明重建图像与原始刺激的一致性。 复现时应核对 EEG 预处理、视觉刺激与试次划分、监督及对比学习所用信息、零样本任务定义,以及生成阶段实际使用的输入。尤其需区分“将未见图像映射到 EEG 空间后重建”与“仅凭实测 EEG 重建未见刺激”两种评估情形。实验协议、消融及统计信息,以及代码和模型的可用性尚未验证。

    阅读价值:值得核对其仅用 EEG 学习视觉表征与 EEG—图像联合表征的对照,以及零样本分类和未见图像重建的评估协议,以判断作者所称被试不变性与泛化能力的适用范围。

1月1日周一
  1. OpenReview · EEG79

    EEGPT:通过自回归预训练释放 EEG 通用基础模型的潜力

    EEGPT 针对 EEG 数据格式多样、预训练范式与迁移方法受限的问题,结合电极级建模、自回归预训练和多任务迁移,旨在构建可适配不同采集设备、被试与任务的通用 EEG 基础模型。基于摘要分析,未取得论文全文。 核心机制:作者将每个电极作为基本建模单元,以整合不同电极配置的 EEG 数据;摘要称预训练数据涉及最多 138 个电极,共计 37.5M 个预训练样本,但样本单位、切片方式及数据组成尚未验证。预训练采用 next signal prediction,而非传统 masked autoencoder,目标是捕捉 EEG 的序列与时间依赖;具体预测粒度、序列组织、损失函数与推理流程尚未验证。作者还探索了参数规模最高为 1.1B 的模型的 scaling laws,但摘要未提供规模与性能之间的定量关系。 迁移机制:作者提出跨任务共享的可学习电极图网络,用于多任务迁移学习,并报告任务间具有兼容性与协同作用。摘要称模型支持最多 138 个电极及其任意组合输入;电极身份编码、不同设备的输入对齐方式、缺失电极处理和任务特定模块仍需核对正文。 结果与证据边界:作者报告在覆盖 5 个不同任务的 12 个 benchmarks 上进行评估,并在全部下游任务中优于现有专用模型,同时称广泛消融支持其有效性。摘要未列出任务与数据集名称、被试数、被试内或跨被试等划分协议、基线、指标及数值,因此不能据此量化优势,也不能确认跨设备、跨被试适配的具体评估前提。实验协议、消融及统计信息尚未验证。 复现重点是核对异构数据整合规则、自回归目标与电极图迁移各自的贡献,以及预训练数据和下游评估的关系。摘要中的“首次”及“最大”等表述属于作者主张,尚未独立核实。作者表示将发布代码和模型,当前材料不能确认其已公开。

    阅读价值:值得核对其电极级建模、自回归预训练与共享电极图的多任务迁移如何协同处理异构 EEG,并复现作者报告的跨任务优势;具体划分、对照与统计证据尚未验证。

  2. OpenReview · EEG73

    从 EEG 脑记录中学习鲁棒的深度视觉表征

    基于摘要分析。该研究面向从 EEG 解码视觉信息的问题,提出两阶段方法:先从 EEG 提取特征、学习鲁棒的深度视觉表征,再将所得表征用于图像生成和分类。其贡献包括对特征提取流程泛化能力的评估,以及将未见图像映射至 EEG 空间并近似重建的框架。 方法方面,摘要提及使用深度学习架构,分别结合监督学习与对比学习,在三个数据集上验证特征提取流程,并开展零样本 EEG 分类。具体网络结构、对比学习目标、两阶段训练衔接及零样本任务的类别划分尚未验证;多个数据集上的评估也不能直接视为 Cross-dataset 迁移实验。 作者报告,仅用 EEG 的单模态学习获得了被试不变、线性可分的视觉表征,其 k-means Accuracy 优于 EEG 与图像的联合表征学习。该结论的被试划分、线性可分性检验、聚类标签匹配方式和比较数值未在摘要中展开,是否采用严格 Cross-subject 评估尚未验证。 图像生成方面,作者报告其 EEG 图像合成方法在 EEGCVPR40 和 Thoughtviz 上的 Inception Score 分别提升 62.9% 和 36.13%,并声称优于 GAN 相关的现有最佳表现。这些数字为相对提升而非百分点;具体对照方法、原始分数、数据划分及统计信息尚未验证。摘要所述“未见图像映射至 EEG 空间再重建”还需与实际 EEG 输入的图像重建协议区分,不能仅凭摘要确认其对未见视觉类别的脑信号解码能力。 复现时应优先核对 EEG 预处理、被试与刺激划分、监督信息的使用、单模态与联合学习的对照条件,以及生成指标的计算协议。全文、实验消融及代码可用性尚未验证。

    阅读价值:值得核对其仅用 EEG 学习视觉表征与 EEG—图像联合表征的对照,以及零样本分类和图像生成的评估协议,以判断表征可分性与跨被试泛化是否同时成立。

  3. OpenReview · EEG73

    EEG2Video:面向从 EEG 信号解码动态视觉感知

    基于摘要分析。本研究针对既有视觉重建研究主要关注静态刺激的问题,构建动态视频观看过程中的 EEG-video 配对数据,并提出基于 Seq2Seq 的 EEG2Video 基线,探索从 EEG 信号重建动态视觉感知。 数据与任务:作者报告,数据集记录了 20 名被试观看 40 个概念类别、共 1400 个动态视频片段时的 EEG。摘要提及 EEG 的高时间分辨率(1000 Hz),但具体采集与预处理协议尚未验证。作者还为视频标注颜色、动态属性及是否包含人等元信息,以考察这些属性能否从 EEG 中解码;摘要未提供各属性的独立实验结果。 核心机制:EEG2Video 使用 Seq2Seq 架构,旨在更好地对齐视频中的动态运动与高时间分辨率脑信号。其阅读价值在于将视觉解码从静态内容扩展到动态序列,但 EEG 编码方式、视频表示、时间对齐策略、损失函数及训练与推理流程均需全文核对,不能仅凭摘要判断模型是否实际利用了运动特异信息。 结果与证据边界:作者报告,模型在语义分类任务中取得 79.8% 的 2-way Accuracy,视频重建的结构相似性指数 SSIM 为 0.256。摘要未说明候选构造、数据划分、被试内或跨被试协议、对照基线及 SSIM 的计算与汇总方式,因此这些数值不能直接与其他协议下的结果比较,也不足以确认跨被试泛化或运动重建质量。 复现条件:摘要称数据集与代码将于近期发布,现有材料不能确认已公开。实验协议、消融及统计信息尚未验证;复现时应核对视频与被试的训练测试划分、时序对齐,以及动态信息相对静态语义信息的贡献。

    阅读价值:值得阅读的具体原因是其构建 EEG-video 配对数据并以 Seq2Seq 探索动态视觉重建,可用于研究 EEG 时间信息与视频运动的对应关系,但评估划分及动态信息解码的独立贡献尚未验证。

1月1日周六
  1. OpenReview · EEG73

    EEGformer:面向低通道数可穿戴连续监测设备的基于 Transformer 的原始 EEG 癫痫检测

    基于摘要分析。该研究针对长期连续癫痫监测对低误报、佩戴舒适性和低功耗的要求,提出紧凑的 Transformer 模型 EEGformer,直接使用四个颞区通道的原始 EEG 进行癫痫发作检测,并在微控制器(MCU)上验证实时推理的可行性。 核心思路是利用 Transformer 捕捉时间序列中的长程依赖,减少对针对特定数据设计的手工特征的依赖。摘要未提供输入窗口、具体模型结构、损失函数、训练策略或预处理细节,因此不能据此认定信号完全未经预处理。 作者报告,在所检查的八名患者的癫痫发作事件中,模型检出率为 73%;仅考虑其中六名患者时,事件检出率为 100%,不能将这一子集结果推广到全部患者。作者报告平均发作起始检测延迟为 15.2 秒,误报率为 0.8 FP/h;多数测试获得 100% 特异性,但 40 次测试中有 5 次异常表现,作者将其主要归因于 EEG 伪迹。事件检出率、特异性与每小时误报率反映不同层面的表现,不应相互替代。被试内或跨被试协议、数据划分以及各指标的统计口径尚未验证。 作者以 CHB-MIT Scalp EEG 数据集为参照,与针对目标数据集设计手工特征的先进分类器比较,报告准确性结果接近、发作起始检测延迟降低超过 20%;与两种经优化的卷积神经网络方法比较,作者报告在全部准确性指标上更优。具体基线、指标数值、消融及统计信息尚未验证。 部署方面,作者报告模型在 Ambiq Apollo4 MCU、96 MHz 工作频率下,单次推理耗时 405 毫秒、能耗 1.79 毫焦耳。这支持其嵌入式推理可行性,但不等于已验证整机长期续航或临床连续监测安全性。复现需进一步核对通道选择、窗口与报警规则、患者级划分、伪迹处理,以及推理数值精度和资源占用;代码与权重可用性尚未验证。

    阅读价值:值得阅读的具体原因是作者同时报告了四通道原始 EEG 癫痫发作检测表现与 MCU 实测时延、能耗,可用于核对低功耗连续监测中检测灵敏度、误报和部署成本的权衡,但临床适用性尚未验证。