跳到正文

算法、任务与模态

Neural Decoding 最新动态

Neural Decoding 研究索引;按可核对的标签归档,不以热度评价质量。

88 条精选近 30 天 56 条共收录 137 条

更新

精选归档 · 第 5 页

9月17日周二第 81–88 条
  1. OpenReview · EEG71

    NECOMIMI:基于扩散模型的神经认知多模态 EEG 引导图像生成

    基于摘要分析。NECOMIMI 研究如何利用 EEG 信号生成图像,提出结合 NERV EEG encoder 与扩散模型的框架,将研究任务从 EEG-image 分类扩展到图像生成。研究同时提出 Category-based Assessment Table(CAT)Score,以语义概念评价 EEG 生成图像,并在 ThingsEEG 数据集上建立评估基准。 技术机制方面,摘要明确了 EEG 编码器和扩散生成模型两个核心组成部分,但未说明编码表示如何接入扩散模型、是否使用其他模态作为条件,以及训练目标、预训练来源和推理流程。因此,目前可以确认的是 EEG 引导图像生成这一方法方向,尚不能据此重建完整实现。摘要将既有工作概括为主要通过对比学习进行 EEG-image 分类,这属于作者对相关工作的定位,不等于所有既有研究都局限于分类。 结果方面,作者报告 NERV EEG encoder 在 2-way、4-way 和 200-way 零样本分类任务中达到 SoTA,并在其提出的 CAT Score 上取得领先结果;摘要未提供具体分数、比较基线、候选类别构造或数据划分,无法判断这些结论适用于何种被试内、跨被试或跨会话协议。分类表现与生成图像质量是不同评估维度,不能相互替代。 作者报告,模型倾向于生成风景等抽象或概括性的图像,而非具体对象,并将这一现象联系到 EEG 噪声较高、分辨率有限带来的视觉还原挑战。这提示阅读时应区分语义层面的匹配与具体对象细节的恢复,但该现象是否源于 EEG 信息限制、生成模型先验或训练设计,尚需正文证据。 复现需核对 ThingsEEG 的预处理与划分、EEG 与图像的配对方式、零样本任务定义、扩散模型条件接口,以及 CAT Score 的计算规则和评价可靠性。实验协议、消融及统计信息尚未验证;摘要中的图像生成结果也不能直接作为实际 BCI 应用有效性的证据。

    阅读价值:值得阅读的具体原因是其将 EEG 与视觉表示的关联扩展到扩散式图像生成,并提出语义概念评估指标 CAT Score;作者报告的抽象化生成倾向也提供了检查语义一致性与具体对象还原能力的切入点,但性能及评估有效性尚需全文核验。

1月3日周三
  1. OpenReview · EEG72

    从 EEG 脑记录中学习鲁棒的深度视觉表征

    基于摘要分析。该研究关注如何从 EEG 中学习可用于视觉图像分类与重建的鲁棒表征,提出两阶段方法:先提取 EEG 特征并学习深度表征,再将所学表征用于图像生成和分类。 在表征学习阶段,作者使用深度学习架构,结合监督学习与对比学习,在三个数据集上评估特征提取流程的泛化能力,并开展零样本 EEG 分类。摘要未给出具体网络结构、损失形式、三个数据集的完整名称及零样本类别划分,因此尚不能确定这些实验对应跨被试、跨会话还是跨数据集泛化。 作者报告,仅使用 EEG 的单模态学习能够获得被试不变、线性可分的视觉表征,其 k-means Accuracy 优于 EEG 与图像联合表征学习。该对照有助于考察图像模态是否必然改善 EEG 表征,但摘要未提供具体分数、被试划分、聚类评估方式及被试不变性的验证细节,结论仍需结合正文核对。 在生成阶段,作者提出将未见图像映射到 EEG 空间并进行近似重建的框架。作者报告,EEG 图像合成方法在 EEGCVPR40 和 Thoughtviz 上的 Inception Score 分别提升 62.9% 和 36.13%,并声称优于 GAN 相关的现有最佳表现;摘要未明确比较基线、数据划分与计算设置。这些数字是 Inception Score 的相对提升,而非分类 Accuracy 或百分点增益,也不能单独说明重建图像与原始刺激的一致性。 复现时应核对 EEG 预处理、视觉刺激与试次划分、监督及对比学习所用信息、零样本任务定义,以及生成阶段实际使用的输入。尤其需区分“将未见图像映射到 EEG 空间后重建”与“仅凭实测 EEG 重建未见刺激”两种评估情形。实验协议、消融及统计信息,以及代码和模型的可用性尚未验证。

    阅读价值:值得核对其仅用 EEG 学习视觉表征与 EEG—图像联合表征的对照,以及零样本分类和未见图像重建的评估协议,以判断作者所称被试不变性与泛化能力的适用范围。

1月1日周一
  1. OpenReview · EEG79

    EEGPT:通过自回归预训练释放 EEG 通用基础模型的潜力

    EEGPT 针对 EEG 数据格式多样、预训练范式与迁移方法受限的问题,结合电极级建模、自回归预训练和多任务迁移,旨在构建可适配不同采集设备、被试与任务的通用 EEG 基础模型。基于摘要分析,未取得论文全文。 核心机制:作者将每个电极作为基本建模单元,以整合不同电极配置的 EEG 数据;摘要称预训练数据涉及最多 138 个电极,共计 37.5M 个预训练样本,但样本单位、切片方式及数据组成尚未验证。预训练采用 next signal prediction,而非传统 masked autoencoder,目标是捕捉 EEG 的序列与时间依赖;具体预测粒度、序列组织、损失函数与推理流程尚未验证。作者还探索了参数规模最高为 1.1B 的模型的 scaling laws,但摘要未提供规模与性能之间的定量关系。 迁移机制:作者提出跨任务共享的可学习电极图网络,用于多任务迁移学习,并报告任务间具有兼容性与协同作用。摘要称模型支持最多 138 个电极及其任意组合输入;电极身份编码、不同设备的输入对齐方式、缺失电极处理和任务特定模块仍需核对正文。 结果与证据边界:作者报告在覆盖 5 个不同任务的 12 个 benchmarks 上进行评估,并在全部下游任务中优于现有专用模型,同时称广泛消融支持其有效性。摘要未列出任务与数据集名称、被试数、被试内或跨被试等划分协议、基线、指标及数值,因此不能据此量化优势,也不能确认跨设备、跨被试适配的具体评估前提。实验协议、消融及统计信息尚未验证。 复现重点是核对异构数据整合规则、自回归目标与电极图迁移各自的贡献,以及预训练数据和下游评估的关系。摘要中的“首次”及“最大”等表述属于作者主张,尚未独立核实。作者表示将发布代码和模型,当前材料不能确认其已公开。

    阅读价值:值得核对其电极级建模、自回归预训练与共享电极图的多任务迁移如何协同处理异构 EEG,并复现作者报告的跨任务优势;具体划分、对照与统计证据尚未验证。

  2. OpenReview · EEG73

    从 EEG 脑记录中学习鲁棒的深度视觉表征

    基于摘要分析。该研究面向从 EEG 解码视觉信息的问题,提出两阶段方法:先从 EEG 提取特征、学习鲁棒的深度视觉表征,再将所得表征用于图像生成和分类。其贡献包括对特征提取流程泛化能力的评估,以及将未见图像映射至 EEG 空间并近似重建的框架。 方法方面,摘要提及使用深度学习架构,分别结合监督学习与对比学习,在三个数据集上验证特征提取流程,并开展零样本 EEG 分类。具体网络结构、对比学习目标、两阶段训练衔接及零样本任务的类别划分尚未验证;多个数据集上的评估也不能直接视为 Cross-dataset 迁移实验。 作者报告,仅用 EEG 的单模态学习获得了被试不变、线性可分的视觉表征,其 k-means Accuracy 优于 EEG 与图像的联合表征学习。该结论的被试划分、线性可分性检验、聚类标签匹配方式和比较数值未在摘要中展开,是否采用严格 Cross-subject 评估尚未验证。 图像生成方面,作者报告其 EEG 图像合成方法在 EEGCVPR40 和 Thoughtviz 上的 Inception Score 分别提升 62.9% 和 36.13%,并声称优于 GAN 相关的现有最佳表现。这些数字为相对提升而非百分点;具体对照方法、原始分数、数据划分及统计信息尚未验证。摘要所述“未见图像映射至 EEG 空间再重建”还需与实际 EEG 输入的图像重建协议区分,不能仅凭摘要确认其对未见视觉类别的脑信号解码能力。 复现时应优先核对 EEG 预处理、被试与刺激划分、监督信息的使用、单模态与联合学习的对照条件,以及生成指标的计算协议。全文、实验消融及代码可用性尚未验证。

    阅读价值:值得核对其仅用 EEG 学习视觉表征与 EEG—图像联合表征的对照,以及零样本分类和图像生成的评估协议,以判断表征可分性与跨被试泛化是否同时成立。

  3. OpenReview · EEG73

    EEG2Video:面向从 EEG 信号解码动态视觉感知

    基于摘要分析。本研究针对既有视觉重建研究主要关注静态刺激的问题,构建动态视频观看过程中的 EEG-video 配对数据,并提出基于 Seq2Seq 的 EEG2Video 基线,探索从 EEG 信号重建动态视觉感知。 数据与任务:作者报告,数据集记录了 20 名被试观看 40 个概念类别、共 1400 个动态视频片段时的 EEG。摘要提及 EEG 的高时间分辨率(1000 Hz),但具体采集与预处理协议尚未验证。作者还为视频标注颜色、动态属性及是否包含人等元信息,以考察这些属性能否从 EEG 中解码;摘要未提供各属性的独立实验结果。 核心机制:EEG2Video 使用 Seq2Seq 架构,旨在更好地对齐视频中的动态运动与高时间分辨率脑信号。其阅读价值在于将视觉解码从静态内容扩展到动态序列,但 EEG 编码方式、视频表示、时间对齐策略、损失函数及训练与推理流程均需全文核对,不能仅凭摘要判断模型是否实际利用了运动特异信息。 结果与证据边界:作者报告,模型在语义分类任务中取得 79.8% 的 2-way Accuracy,视频重建的结构相似性指数 SSIM 为 0.256。摘要未说明候选构造、数据划分、被试内或跨被试协议、对照基线及 SSIM 的计算与汇总方式,因此这些数值不能直接与其他协议下的结果比较,也不足以确认跨被试泛化或运动重建质量。 复现条件:摘要称数据集与代码将于近期发布,现有材料不能确认已公开。实验协议、消融及统计信息尚未验证;复现时应核对视频与被试的训练测试划分、时序对齐,以及动态信息相对静态语义信息的贡献。

    阅读价值:值得阅读的具体原因是其构建 EEG-video 配对数据并以 Seq2Seq 探索动态视觉重建,可用于研究 EEG 时间信息与视频运动的对应关系,但评估划分及动态信息解码的独立贡献尚未验证。

9月20日周三
  1. OpenReview · EEG72

    BELT-2:面向多任务脑解码的 EEG—语言表征自举对齐

    BELT-2 研究如何将 EEG 表征与语言表征对齐,并连接大语言模型(LLMs)以支持多任务脑解码;核心方法结合 BPE 级对齐、多任务 EEG 编码器与 prefix-tuning。基于摘要分析,未取得论文全文。 技术机制方面,作者采用 byte pair encoding(BPE)级 EEG—语言对齐,并在 EEG 领域联合进行多任务训练与解码;随后利用 EEG 编码器的中间输出,通过 prefix-tuning 连接 LLMs。该设计将 EEG 表征学习与语言生成接口结合,但摘要未说明 EEG 与 BPE 单元的对应构造、对齐损失、多任务的具体组成、LLM 型号,以及训练时哪些模块冻结或更新,相关细节尚未验证。 结果方面,作者报告在 ZuCo 数据集上获得 BLEU-1 为 52.2% 的解码结果,但摘要未提供数据划分、被试内或跨被试协议及对照基线,因此不能据此判断跨被试泛化能力。作者还报告在其他翻译基准上提升 31%–162%,但未明确基准名称、指标、对照方法及提升的计算口径,不能将其解释为准确率或百分点提升。作者声称该方法能够从非侵入式脑信号解码连贯、可读的句子,并声称相关设计具有首次性;这些主张尚需正文与既有工作核对。 复现时需核对 EEG 预处理、EEG—文本配对方式、训练与测试划分、多任务监督来源,以及文本生成阶段是否使用额外文本条件。尤其应区分 EEG 提供的信息与 LLM 语言先验对生成质量的贡献;摘要不足以确定这一贡献分解。实验协议、消融及统计信息尚未验证。摘要称代码可通过匿名链接获取,但当前材料未给出该链接,代码可访问性与复现条件尚未验证。

    阅读价值:值得阅读的具体原因是 BELT-2 将 BPE 级 EEG—语言表征对齐、多任务训练与 LLM prefix-tuning 结合,可用于考察语言先验与 EEG 表征对文本解码的各自贡献,但其评估协议与提升幅度仍需全文核对。

1月1日周六
  1. OpenReview · EEG73

    EEGformer:面向低通道数可穿戴连续监测设备的基于 Transformer 的原始 EEG 癫痫检测

    基于摘要分析。该研究针对长期连续癫痫监测对低误报、佩戴舒适性和低功耗的要求,提出紧凑的 Transformer 模型 EEGformer,直接使用四个颞区通道的原始 EEG 进行癫痫发作检测,并在微控制器(MCU)上验证实时推理的可行性。 核心思路是利用 Transformer 捕捉时间序列中的长程依赖,减少对针对特定数据设计的手工特征的依赖。摘要未提供输入窗口、具体模型结构、损失函数、训练策略或预处理细节,因此不能据此认定信号完全未经预处理。 作者报告,在所检查的八名患者的癫痫发作事件中,模型检出率为 73%;仅考虑其中六名患者时,事件检出率为 100%,不能将这一子集结果推广到全部患者。作者报告平均发作起始检测延迟为 15.2 秒,误报率为 0.8 FP/h;多数测试获得 100% 特异性,但 40 次测试中有 5 次异常表现,作者将其主要归因于 EEG 伪迹。事件检出率、特异性与每小时误报率反映不同层面的表现,不应相互替代。被试内或跨被试协议、数据划分以及各指标的统计口径尚未验证。 作者以 CHB-MIT Scalp EEG 数据集为参照,与针对目标数据集设计手工特征的先进分类器比较,报告准确性结果接近、发作起始检测延迟降低超过 20%;与两种经优化的卷积神经网络方法比较,作者报告在全部准确性指标上更优。具体基线、指标数值、消融及统计信息尚未验证。 部署方面,作者报告模型在 Ambiq Apollo4 MCU、96 MHz 工作频率下,单次推理耗时 405 毫秒、能耗 1.79 毫焦耳。这支持其嵌入式推理可行性,但不等于已验证整机长期续航或临床连续监测安全性。复现需进一步核对通道选择、窗口与报警规则、患者级划分、伪迹处理,以及推理数值精度和资源占用;代码与权重可用性尚未验证。

    阅读价值:值得阅读的具体原因是作者同时报告了四通道原始 EEG 癫痫发作检测表现与 MCU 实测时延、能耗,可用于核对低功耗连续监测中检测灵敏度、误报和部署成本的权衡,但临床适用性尚未验证。

  2. OpenReview · EEG73

    从 EEG 信号连续解码协调运动中的双手轨迹

    基于摘要分析。该研究针对协调双手运动的连续轨迹解码问题,提出双手 BCI 范式,并结合 EEGNet 与 long short-term memory network(LSTM)构建多任务深度学习模型,从 EEG 同时重建双手的位置和速度。 任务要求被试完成朝左、中、右目标的双手伸达运动,同时采集 EEG。研究对象是实际协调运动中的轨迹重建,摘要未将其描述为运动想象任务。模型结合 EEGNet 与 LSTM,但具体模块连接、任务间参数共享、损失函数、输入时间窗及推理流程尚未验证,不能仅凭模型名称推定其实现细节。 作者报告,在 13 名被试的实验中,位置和速度解码的总体平均合并相关系数(CC)分别为 0.54 和 0.42,对应的合并归一化均方根误差(NRMSE)分别为 0.22 和 0.23;两类指标均显著优于机会水平(p<0.05)。摘要未说明“合并”的具体方式,也未交代被试内或跨被试协议、训练与测试划分及机会水平的构造方法,因此这些数值只能作为该研究所述实验条件下的结果,不能直接与其他协议比较。 作者报告,该模型在连续轨迹解码的 CC 和 NRMSE 上显著优于若干常用方法,但摘要未列出基线名称、具体差值和统计检验细节。其主要贡献是提供从 EEG 同时解码协调双手轨迹的可行性证据;离线轨迹相关性不等同于在线闭环控制性能。复现前需核对 EEG 预处理、轨迹同步与归一化、数据划分、多任务训练配置及评估聚合方式;实验协议、消融及统计信息尚未验证,数据与代码可用性亦尚未验证。

    阅读价值:该研究将 EEG 连续解码拓展到协调双手的位置与速度重建,值得核对其多任务建模及轨迹评估协议,但摘要结果尚不能证明在线双手控制的有效性。