跳到正文

研究类型与证据

论文/研究 最新动态

论文/研究 类型索引,不代表质量等级。

682 条精选近 30 天 437 条共收录 864 条

更新

精选归档 · 第 31 页

1月16日周二第 601–620 条
  1. OpenReview · Representation learning76

    NfgTransformer:标准式博弈的等变表示学习

    基于摘要分析。本文研究标准式博弈(Normal-form games,NFGs)的神经网络表示,核心问题是:策略重新编号不改变博弈本身,但模型应随策略置换相应变换其表示或输出。作者提出利用这一等变性的 NfgTransformer,以统一的 NFG 表示支持多种博弈论任务。 机制与贡献:摘要将策略置换等变性作为架构的归纳偏置,而非将策略排列视为具有固定语义的输入顺序。这一区分关注等变性而非单纯的不变性:博弈意义保持一致,策略相关表示仍需与重新编号对应。具体输入编码、注意力结构、等变性实现方式、损失函数与训练流程尚未验证。 结果与证据:作者报告,该方法在均衡求解、偏离收益估计(deviation gain estimation)与排序等任务中达到最先进性能,并称模型具有可解释性和多用途性。摘要未提供数据来源、博弈规模、训练与测试划分、对照基线、指标或具体数值,因此这些性能主张的适用范围,以及实验协议、消融及统计信息尚未验证。 平台推测(待验证):其可借鉴之处是依据任务的真实对称性设计表示,但策略重新编号的等价性不能直接推广为 EEG 通道任意置换的等价性,因为通道通常具有电极位置和生理意义。是否能迁移到 EEG/BCI,需先确认对应的数据结构与对称性假设;现有材料不足以支持具体迁移方案或效果判断,相关 EEG 工作尚未检索确认。复现首先需要核对全文中的博弈生成或采样方式、监督信号、评估协议及实现可获得性。

    阅读价值:值得阅读其如何将策略置换等变性纳入统一的博弈表示,并核对该归纳偏置在均衡求解、偏离收益估计与排序任务中的实际贡献;摘要中的性能与可解释性主张尚需全文验证。

  2. OpenReview · Representation learning76

    基于随机数据投影器的自监督表征学习

    基于摘要分析。该研究针对自监督表征学习(SSRL)对人工设计的数据增强及变换不变性假设的依赖,提出通过重构随机数据投影来学习表征的方法,不依赖数据增强或掩码。作者认为,这一路径可减少不同模态及应用特定增强约束带来的适配困难。 核心机制是以随机数据投影的重构作为学习任务,而非借助增强视图或掩码建模获得监督信号。摘要未说明投影的构造与分布、重构目标的具体定义、损失形式,以及编码器和重构模块的配置,因此尚不能判断哪些随机投影能够保留任务相关信息,也不能将其等同于某种已知的对比学习或降维方法。 作者报告,在覆盖多种模态与实际应用的表征学习任务中,该方法优于多个先进 SSRL 基线;但摘要未提供任务名称、数据集、数据划分、指标或具体数值。“适用于任意数据模态和网络架构”是作者提出的广泛适用性主张,其实际边界仍需结合全文核对。实验协议、消融及统计信息尚未验证。 平台推测(待验证):若随机投影重构能保留 EEG 中的任务相关时空结构,它可能为难以设计可靠增强的小数据表征学习提供替代路径。可考虑复用重构学习思路,但需适配多通道时序输入、通道布局和尺度归一化。低信噪比可能使重构任务偏向噪声或伪迹,跨被试差异与通道变化也可能削弱表征稳定性。一个可检验的小实验是在固定 Cross-subject 划分、仅用训练被试进行自监督训练的前提下,以相同编码器和下游评估流程比较随机投影重构与增强式 SSRL,并检查投影设置变化对结果的影响。以上属于迁移假设,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得核对随机数据投影重构如何在不依赖数据增强或掩码的条件下学习表征,以及其跨模态优势的评估边界;对 EEG 的适用性尚未验证。

1月3日周三
  1. OpenReview · EEG72

    从 EEG 脑记录中学习鲁棒的深度视觉表征

    基于摘要分析。该研究关注如何从 EEG 中学习可用于视觉图像分类与重建的鲁棒表征,提出两阶段方法:先提取 EEG 特征并学习深度表征,再将所学表征用于图像生成和分类。 在表征学习阶段,作者使用深度学习架构,结合监督学习与对比学习,在三个数据集上评估特征提取流程的泛化能力,并开展零样本 EEG 分类。摘要未给出具体网络结构、损失形式、三个数据集的完整名称及零样本类别划分,因此尚不能确定这些实验对应跨被试、跨会话还是跨数据集泛化。 作者报告,仅使用 EEG 的单模态学习能够获得被试不变、线性可分的视觉表征,其 k-means Accuracy 优于 EEG 与图像联合表征学习。该对照有助于考察图像模态是否必然改善 EEG 表征,但摘要未提供具体分数、被试划分、聚类评估方式及被试不变性的验证细节,结论仍需结合正文核对。 在生成阶段,作者提出将未见图像映射到 EEG 空间并进行近似重建的框架。作者报告,EEG 图像合成方法在 EEGCVPR40 和 Thoughtviz 上的 Inception Score 分别提升 62.9% 和 36.13%,并声称优于 GAN 相关的现有最佳表现;摘要未明确比较基线、数据划分与计算设置。这些数字是 Inception Score 的相对提升,而非分类 Accuracy 或百分点增益,也不能单独说明重建图像与原始刺激的一致性。 复现时应核对 EEG 预处理、视觉刺激与试次划分、监督及对比学习所用信息、零样本任务定义,以及生成阶段实际使用的输入。尤其需区分“将未见图像映射到 EEG 空间后重建”与“仅凭实测 EEG 重建未见刺激”两种评估情形。实验协议、消融及统计信息,以及代码和模型的可用性尚未验证。

    阅读价值:值得核对其仅用 EEG 学习视觉表征与 EEG—图像联合表征的对照,以及零样本分类和未见图像重建的评估协议,以判断作者所称被试不变性与泛化能力的适用范围。

1月1日周一
  1. OpenReview · EEG73

    EEGMamba:用于 EEG 分类的双向状态空间模型与混合专家

    基于摘要分析。EEGMamba 面向不同任务中 EEG 信号长度、通道数不一致,以及 Transformer 长序列建模计算开销较大的问题,将 Spatio-Temporal-Adaptive(ST-Adaptive)模块、Bidirectional Mamba 和 Mixture of Experts(MoE)整合为统一的多任务 EEG 分类框架。 机制上,ST-Adaptive 通过空间自适应卷积对不同长度和通道数的 EEG 进行统一特征提取,并引入 class token 实现时间维度适配;摘要未说明具体的长度对齐与通道映射方式。Bidirectional Mamba 用于进一步提取 EEG 特征,作者旨在兼顾长序列处理的分类准确性与推理速度。Task-aware MoE 配置一个通用专家,以建模不同任务 EEG 的差异与共性;专家路由、任务信息如何输入以及训练损失尚未验证。 作者报告,在八个公开 EEG 数据集上进行了测试,覆盖癫痫发作检测、情绪识别、睡眠分期和运动想象四类任务,并报告性能优于对照方法。摘要未提供数据集名称、被试规模、评价指标、具体分数或对照基线,也未明确被试内、跨被试、跨会话或跨数据集划分,因此不能据此确认对未见任务的泛化能力,或量化准确性与速度之间的收益。 复现时应重点核对多任务联合训练与评估协议、异构通道和序列长度的处理,以及 ST-Adaptive、双向建模和通用专家各自的贡献;推理效率比较还需结合输入长度、硬件与计时条件。实验协议、消融及统计信息尚未验证。摘要称代码将于近期发布,当前材料不能确认代码已公开。

    阅读价值:值得核对 EEGMamba 如何通过输入适配、双向状态空间建模和任务感知专家机制处理异构 EEG,但其跨任务泛化与推理效率优势仍需结合全文中的训练划分和对照实验验证。

  2. OpenReview · EEG79

    EEGPT:通过自回归预训练释放 EEG 通用基础模型的潜力

    EEGPT 针对 EEG 数据格式多样、预训练范式与迁移方法受限的问题,结合电极级建模、自回归预训练和多任务迁移,旨在构建可适配不同采集设备、被试与任务的通用 EEG 基础模型。基于摘要分析,未取得论文全文。 核心机制:作者将每个电极作为基本建模单元,以整合不同电极配置的 EEG 数据;摘要称预训练数据涉及最多 138 个电极,共计 37.5M 个预训练样本,但样本单位、切片方式及数据组成尚未验证。预训练采用 next signal prediction,而非传统 masked autoencoder,目标是捕捉 EEG 的序列与时间依赖;具体预测粒度、序列组织、损失函数与推理流程尚未验证。作者还探索了参数规模最高为 1.1B 的模型的 scaling laws,但摘要未提供规模与性能之间的定量关系。 迁移机制:作者提出跨任务共享的可学习电极图网络,用于多任务迁移学习,并报告任务间具有兼容性与协同作用。摘要称模型支持最多 138 个电极及其任意组合输入;电极身份编码、不同设备的输入对齐方式、缺失电极处理和任务特定模块仍需核对正文。 结果与证据边界:作者报告在覆盖 5 个不同任务的 12 个 benchmarks 上进行评估,并在全部下游任务中优于现有专用模型,同时称广泛消融支持其有效性。摘要未列出任务与数据集名称、被试数、被试内或跨被试等划分协议、基线、指标及数值,因此不能据此量化优势,也不能确认跨设备、跨被试适配的具体评估前提。实验协议、消融及统计信息尚未验证。 复现重点是核对异构数据整合规则、自回归目标与电极图迁移各自的贡献,以及预训练数据和下游评估的关系。摘要中的“首次”及“最大”等表述属于作者主张,尚未独立核实。作者表示将发布代码和模型,当前材料不能确认其已公开。

    阅读价值:值得核对其电极级建模、自回归预训练与共享电极图的多任务迁移如何协同处理异构 EEG,并复现作者报告的跨任务优势;具体划分、对照与统计证据尚未验证。

  3. OpenReview · EEG77

    利用 EEGformer 降低可穿戴癫痫发作检测的误报:面向 MCU 的紧凑 Transformer 模型

    基于摘要分析。研究针对可穿戴设备长期连续监测 EEG 时的癫痫发作自动检测问题,提出紧凑 Transformer 模型 EEGformer,仅使用颞区通道,并通过面向硬件的设计探索兼顾检测延迟、误报率及低功耗 MCU 部署需求。 技术机制:摘要将 Transformer 用于无需手工特征提取的端到端时间序列处理,核心贡献在于将少通道采集条件与端侧计算约束纳入模型设计。具体网络结构、输入窗口、损失函数、训练策略及硬件优化方法尚未验证,不能据摘要判断性能收益分别来自模型设计、预处理还是检测后处理。 检测结果:作者报告,在 CHB-MIT 数据集上,相较于面向颞区采集的现有最先进模型,发作起始检测延迟降低 20%,同时达到 73% 的癫痫发作检测概率和每小时 0.15 次误报(FP/h)。摘要未给出对照模型名称、绝对延迟、被试内或跨被试协议及数据划分,因此这些结果应限定于作者所用评估条件。作者另报告,在一个新的、具有挑战性的头皮 EEG 数据集上,检测到 88% 的标注发作事件,误报率为 0.45 FP/h;该数据集名称、被试规模和评估划分尚未验证,两组结果不能直接比较。 部署结果:作者在单核 Apollo4 MCU 以及并行 GAP8、GAP9 MCU 上评估部署,报告最节能的 GAP9 实现每次推理耗时 13.7 ms、能耗 0.31 mJ。作者据此认为模型可支持少通道、具有多日续航的可穿戴检测系统;但单次推理指标不等于整机续航实测,推理频率、采集与通信功耗及电池条件仍需核对。 复现重点是确认颞区通道配置、连续记录的训练与测试划分、发作事件匹配规则、误报统计时长,以及检测阈值对检出概率、误报率和延迟的影响。实验协议、消融及统计信息尚未验证,代码与部署资源的可用性也尚未确认。该研究属于 EEG 临床监测算法与端侧部署研究,摘要中的检测结果不应直接视为临床有效性验证。

    阅读价值:值得阅读的具体原因是,作者将颞区少通道 EEG 癫痫发作检测的误报率、检测延迟与 MCU 推理能耗联合评估,为可穿戴端侧模型的设计提供了可核对的参考,但数据划分和检测协议仍需全文验证。

  4. OpenReview · State space models73

    探索视觉状态空间模型对后门攻击的鲁棒性

    基于摘要分析。本文研究 Visual State Space Model(VSS)对后门攻击的鲁棒性,重点考察 State Space Model(SSM)机制如何影响触发器敏感性,并研究 patch 处理对后门触发器的影响。后门攻击的目标是在特定触发器出现时使受感染模型输出攻击者指定的标签,同时在正常样本上维持正常行为。 作者报告,SSM 捕获 patch 内上下文信息的机制使 VSS 比不含 SSM 的模型更易受到后门触发器影响;另一方面,所考察的 patch 处理能够有效扰乱这些触发器。基于此,作者进一步考察在每个 patch 中重复出现、以抵抗 patch 扰动的后门触发方式。摘要未给出具体 patch 处理操作、触发器构造、投毒设置或训练细节,机制归因仍需结合正文与消融核对。 作者报告,在三个未具名数据集和多种后门攻击的实验中,VSS 的后门鲁棒性与 Transformers(ViTs)相近,但弱于仅堆叠 Gated CNN blocks、不含 SSM 的 Gated CNNs。摘要未提供具体指标、数值、数据划分及对照配置,不能据此量化差距或推断干净样本性能;实验协议、消融及统计信息尚未验证。 平台推测(待验证):若 EEG 模型将时间序列切分为 patch 并使用 SSM,重复触发模式与 patch 上下文聚合之间的关系可能成为安全性检查线索,但视觉实验不等于 EEG/BCI 验证。迁移需改造视觉 patch 和触发器为符合 EEG 时间、通道结构的输入模式;低信噪比、跨被试差异及小数据训练可能改变触发器可学习性。一个可检验的小实验是在固定数据划分和投毒条件下,对比含 SSM 与不含 SSM 的模型,测试局部及重复触发器在 patch 扰动前后的攻击成功率与干净样本 Accuracy。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读的具体原因是其将 VSS 的后门敏感性与 SSM 的 patch 内上下文机制及 patch 处理联系起来,并提供与 ViTs、无 SSM 的 Gated CNNs 对照的安全性研究线索;具体实验协议与机制归因尚未验证。

  5. OpenReview · Representation learning76

    通过异构匿名游走进行异构结构表示学习

    基于摘要分析。该研究关注异构网络中的结构相似性表示:节点类型与连接结构的多样组合,使主要面向同构网络的结构学习方法难以直接适用。作者提出 heterogeneous anonymous walk(HAW)及两种变体,并构建 HAW embedding(HAWE)及其变体,以学习节点周围异构结构的表示。 机制上,作者称 HAW 具有区分异构结构的理论保证;HAWE 则通过预测各节点邻域中出现的游走来训练嵌入,以数据驱动方式避免直接使用数量极大的所有可能游走。摘要未给出匿名化规则、节点类型编码、理论保证的适用条件、具体损失与游走采样方式,均需核对全文。其方法重点是结构相似性,而非仅根据连接邻近性学习表示。 作者报告,在合成与真实网络上的实验中,所提方法相较经典同构和异构方法表现突出,并可用于大规模网络;同时以这些实验建立异构结构学习基准。摘要未提供网络名称、任务、数据划分、对照方法、指标或运行成本,无法量化优势或判断不同协议下的可比性;实验协议、消融及统计信息尚未验证。 平台推测(待验证):若将 EEG 数据组织为带有明确节点类型的图,HAW 的类型与结构联合表示可能用于研究不同记录之间的结构对应,相关瓶颈是跨被试、通道配置变化时图结构难以对齐。该迁移假设依赖稳定且有意义的节点类型和边定义,并非原文已验证的 EEG 结果。可考虑复用游走编码与邻域预测机制,但需改造 EEG 图构建及节点类型定义;低信噪比造成的边不稳定、通道缺失和小样本都可能使嵌入主要学习记录差异。一个小规模可证伪实验是:固定 EEG 图构建和下游模型,在同一跨被试划分下比较 HAWE、同构匿名游走表示与打乱节点类型的对照,检验类型信息是否带来稳定增益。相关 EEG 工作尚未检索确认。

    阅读价值:值得阅读的是 HAW 对异构结构区分能力的理论刻画及 HAWE 的邻域游走预测机制,但其理论条件、基准协议和规模化效果仍需全文核对,EEG 迁移价值尚未验证。

  6. OpenReview · State space models70

    PhysMamba:用于远程生理测量的状态空间对偶模型

    基于摘要分析。该研究针对从面部视频提取生理信号的 Remote Photoplethysmography(rPPG)在真实环境中易受运动伪影和噪声影响的问题,提出 PhysMamba,利用 State Space Duality 构建时频交互双路径模型,以学习更具代表性的特征。 机制方面,作者设计 Cross-Attention State Space Duality(CASSD),促进两条路径之间的信息交换与特征互补。摘要将时频交互及跨路径融合与噪声条件下的鲁棒性提升联系起来,但具体时频表示、状态空间实现、交互位置、损失函数及训练流程尚未验证。 作者报告在 PURE、UBFC-rPPG 和 MMPD 数据集上开展比较实验,并达到 SOTA,尤其在复杂环境下表现突出。摘要未提供具体指标、数值、数据划分及对照方法,因此目前无法判断优势幅度,也不能确定这些结果属于数据集内评估还是 Cross-dataset 评估。实验协议、消融及统计信息尚未验证;复现还需核对视频预处理、信号标签、评估流程及实现可用性。 平台推测(待验证):若 CASSD 的时频互补机制不依赖面部视频的特定空间结构,可探索其对 EEG 非平稳信号和伪影干扰的适用性。可复用候选是双路径信息交互模块,需改造视频输入与特征编码;原方法对监督信号、数据规模和时频表示的依赖尚不明确。EEG 的低信噪比、跨被试差异、通道变化及小数据条件可能使交互模块放大伪影或过拟合。一个可检验的小实验是在固定 Cross-subject EEG 划分、相同预处理与训练预算下,对比单路径、双路径无交互及 CASSD 交互模型,并检查受控噪声扰动下的性能变化。该迁移假设不构成已验证的 EEG/BCI 效果,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得关注其通过 CASSD 实现时频双路径信息交互的机制,但复杂环境下的鲁棒性优势仍需结合完整实验协议、指标与消融核对。

  7. OpenReview · State space models75

    “总有另一个计数器”:检测恶意与良性代码概率性交错执行场景中的微架构攻击

    基于摘要分析。本文研究攻击者将恶意代码以极低频率交错插入良性代码后,基于 Hardware Performance Counters(HPCs,硬件性能计数器)的防御是否仍能识别微架构攻击。作者提出统计建模与 LLM 检测方法,主张概率性交错并不必然使攻击不可检测。 理论部分使用 Gaussian Mixture Models 与 Dip Test for Unimodality 建模交错攻击;作者声称,在适当选择 HPC 的条件下可证明攻击具有可检测性,并讨论同时交错多种攻击的更强威胁模型。摘要未给出证明假设、计数器选择规则或统计检验的具体实施条件,这些尚需全文核对。 实现部分以 LLM 作为检测工具。作者给出的理由是,LLM 能结合较多 HPC 的上下文,并可通过提示切换统计分析方法;这属于作者的方法动机,摘要不足以确认其相对传统机器学习的性能、成本或稳定性优势。具体 LLM、输入表示、提示、采样与决策流程尚未验证。 作者报告,在摘要列举的 Spectre v1/v2/v3、Meltdown 及采用改进 gadgets 的 Spectre v2 等推测执行攻击实验中,即使交错频率低至 10⁻⁶,仍达到 100% 攻击检测率,并将方法定位于攻击特征可能事先未知的 non-profiled 场景。该结果不能直接外推到任意硬件或负载;实验规模、良性负载构成、数据划分、误报率、检测延迟、基线、消融及统计信息尚未验证。 平台推测(待验证):其潜在跨领域价值在于从多变量背景噪声中发现稀疏异常成分,而非已验证的 EEG/BCI 解码效果。若探索 EEG 应用,可复用统计分布检验思路,但需重构信号特征、时间窗口与异常定义;低信噪比、非平稳性、跨被试及通道差异可能使混合成分难以辨识,统计多峰性也不等同于目标神经事件。一个可证伪的小实验是在固定被试内划分下,对具有已知事件时间的 EEG 逐步降低目标事件比例,比较该统计思路与简单异常检测基线,并同时记录检出率和误报率。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得核对其“选择适当 HPC 后,低频恶意执行仍可被统计识别”的理论条件及 LLM 检测实现,但摘要报告的 100% 检测率尚需结合误报率、采样窗口和评估协议验证。

  8. OpenReview · State space models72

    DGMamba:通过广义状态空间模型实现域泛化

    基于摘要分析。DGMamba 研究视觉域泛化中的分布偏移问题,尝试在保留 Mamba 全局感受野与线性复杂度优势的同时,通过抑制域特异隐藏状态、调整图像 patch 扫描和组合方式,提高对未见域的泛化能力。 核心机制包括 Hidden State Suppressing(HSS)与 Semantic-aware Patch Refining(SPR)。HSS 用于减轻与域特异特征相关的隐藏状态对输出预测的影响。SPR 旨在让模型更多关注对象而非上下文,包含 Prior-Free Scanning(PFS)和 Domain Context Interchange(DCI):PFS 打乱图像中的非语义 patch,构造更灵活的序列;DCI 通过跨域融合 patch,将不匹配的非语义与语义信息组合起来,对 Mamba 施加正则化。摘要未提供隐藏状态识别与抑制的具体实现、语义 patch 判定方法或损失形式。 作者报告,在四个常用 DG benchmark 上,DGMamba 获得优于所比较先进模型的结果;摘要未列出 benchmark 名称、指标数值、训练与测试域划分及具体基线,因此尚不能判断收益幅度及各模块贡献。实验协议、消融及统计信息尚未验证。摘要表示代码将公开,并非已确认发布。 平台推测(待验证):假设 EEG 中也能区分任务相关信息与被试或会话特异背景,HSS 的抑制思路可能对应跨被试、跨会话分布偏移;但图像对象与背景的划分不能直接等同于 EEG 的时间段或通道。可考虑复用隐藏状态抑制与背景重组思路,需改造 patch 定义、任务相关性判定及扫描顺序,避免破坏时序和通道关系。低信噪比、小数据及被试间差异可能使判定不稳定,误抑制有效信号。一个可证伪的小实验是在固定跨被试划分下,对比基础 Mamba 与仅加入 HSS 的版本,保持训练数据和调参预算一致,检查未见被试表现是否改善;这一迁移假设尚无本文证据支持,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读的具体原因是 DGMamba 将域泛化中的域特异特征抑制与图像扫描机制改造分别落实为 HSS 和 SPR,可据此核对状态空间模型的泛化收益来源,但其 EEG 迁移价值尚未验证。

  9. OpenReview · State space models79

    VMamba:视觉状态空间模型

    基于摘要分析。本文研究如何构建计算高效的视觉网络,将状态空间语言模型 Mamba 适配为具有线性时间复杂度的视觉骨干 VMamba,核心贡献是用 2D Selective Scan(SS2D)处理二维视觉数据与一维选择性扫描之间的结构差异。 技术机制:VMamba 由 Visual State-Space(VSS)块堆叠构成,SS2D 沿四条扫描路径遍历二维数据,以收集不同来源和视角的上下文信息。作者据此构建一系列 VMamba 架构,并通过架构与实现层面的改进加速。摘要未给出具体扫描方向、状态更新公式、损失、训练配置及各加速措施,尚不能核对其计算开销与性能收益的来源。 结果与复现:作者报告,VMamba 在多种视觉感知任务上表现良好,相较现有基准模型具有更优的输入规模扩展效率。摘要未列出任务、数据集、指标、数值或对照配置,因此不能据此判断优势幅度,也不能将线性时间复杂度直接等同于实际运行速度。实验协议、消融及统计信息尚未验证。材料提供了源码仓库,但实现与论文版本的对应关系及完整复现条件仍需核对。 平台推测(待验证):迁移假设是将 EEG 的时间与通道,或时频表示,组织为二维输入,借用多路径选择性扫描建模上下文。原方法依赖二维结构,预训练数据规模与监督设置在摘要中未说明;EEG 的通道排列并不天然等同于图像邻接关系,因此可考察 SS2D 与 VSS 模块,但需改造输入编码、通道拓扑和任务输出。低信噪比、跨被试差异、缺失通道及小数据可能使扫描路径引入不稳定依赖或过拟合。一个可证伪的小实验是在固定 EEG 任务、训练预算与数据划分下,对比二维多路径扫描、仅时间扫描及常规基线,并扰动通道顺序,检验收益是否依赖人为排列;这不是论文已验证的结果,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其以四条扫描路径将一维选择性扫描适配到二维视觉数据的机制,以及输入规模扩展效率的评估;该机制对 EEG 的适用性尚未验证。

  10. OpenReview · State space models73

    SMamba:通过可伸缩状态空间模型实现任意尺度超分辨率

    基于摘要分析。该研究针对任意尺度超分辨率(ASSR),提出正文称为 S³Mamba 的方法,旨在用单一模型将低分辨率图像重建到任意目标尺度。其核心贡献是通过 Scalable State Space Model(SSSM)构建可伸缩的连续表示空间,并结合尺度感知自注意力强化不同尺度下的全局重要特征建模。 机制上,Implicit Neural Representations(INR)通过坐标与像素值之间的连续表示支持任意尺度重建。作者认为,现有基于 CNN 和 Transformer 的方法受到计算复杂度及长程依赖建模能力的限制;SSSM 在离散化过程中调制状态转移矩阵与步长采样矩阵,以实现尺度可调的连续表示建模。作者报告该机制具有线性计算复杂度,但摘要未说明其对应的复杂度变量、完整网络开销或具体调制形式,尚需全文核对。 作者报告,在合成及真实场景基准上的实验取得了最先进性能和任意超分辨率尺度下的较强泛化能力。摘要未提供数据集名称、训练与测试尺度划分、对照方法、指标或数值,因此目前不能定量判断收益,也不能确认对未见尺度的具体泛化范围;实验协议、消融及统计信息尚未验证。 平台推测(待验证):其潜在 EEG 关联是将尺度条件化的状态空间建模用于不同采样率下的连续时间信号重建,而非直接复用图像超分辨率效果。该假设依赖可建立的时间坐标和低、高采样率监督配对;可考察复用 SSSM 的离散化调制机制,输入表示与尺度感知模块则需适配 EEG 的时间轴、通道布局及生理频带。低信噪比、跨被试差异、通道缺失和小数据可能导致噪声放大或虚假高频重建,且上采样不能保证恢复已丢失的生理信息。一个可证伪的小实验是对高采样率 EEG 进行受控抗混叠降采样,在按被试隔离的划分中比较该机制、固定尺度模型与插值基线,并测试未见采样倍率下的波形误差及频谱保真度。相关 EEG 工作尚未检索确认。

    阅读价值:值得关注其通过离散化过程中的状态转移与步长采样调制构建尺度连续表示的机制,但任意尺度泛化、计算开销及向 EEG 迁移的有效性仍需核对全文或实验验证。

  11. OpenReview · State space models70

    用于图像去模糊的高效视觉状态空间模型

    基于摘要分析。本文针对图像去模糊中长程依赖建模与高分辨率计算成本之间的矛盾,提出高效视觉状态空间模型 EVSSM,以状态空间模型(SSMs)提取非局部信息,并通过视觉扫描模块降低多固定方向扫描带来的计算开销。 核心机制是:在各个基于 SSM 的模块之前施加不同几何变换,以捕获有用的非局部信息。摘要将其与采用多个固定方向扫描的既有方法对照,强调扫描方式的效率改进;具体变换类型、扫描顺序、网络结构、损失函数及训练配置尚未验证。作者以 Transformer 模型计算复杂度随图像分辨率呈二次增长作为研究动机,但摘要没有给出 EVSSM 的复杂度公式或实测资源消耗。 作者报告,EVSSM 在图像去模糊基准数据集和真实拍摄图像上,相较现有先进方法表现良好。摘要未列出数据集名称、划分、对照方法或定量指标,因此尚不能判断性能增益、效率收益及二者的权衡;实验协议、消融及统计信息尚未验证。 平台推测(待验证):若将 EEG 表示为通道×时间或时频特征,SSM 的序列建模和扫描组织方式可能用于捕获较长时间范围的依赖。但原方法依赖图像空间结构,其几何变换不能直接视为 EEG 的有效变换:通道排列具有电极拓扑意义,时间方向也有特定语义。可复用候选是 SSM 建模与扫描组织思路,需改造的是输入表示及变换规则;低信噪比、跨被试差异、通道缺失和小数据训练均可能使收益消失。可检验的小实验是在固定数据划分和训练预算下,对照单方向扫描、多个固定方向扫描与保留电极拓扑的变换方案,分别报告被试内及跨被试性能、推理耗时和显存占用。该假设并非本文已验证的 EEG 结果,已有 EEG 相关工作尚未检索确认。

    阅读价值:值得核对几何变换驱动的视觉扫描如何兼顾非局部建模与计算效率,但摘要未提供定量性能或复杂度数据,其优势及向 EEG 的迁移价值尚未验证。

  12. OpenReview · EEG73

    从 EEG 脑记录中学习鲁棒的深度视觉表征

    基于摘要分析。该研究面向从 EEG 解码视觉信息的问题,提出两阶段方法:先从 EEG 提取特征、学习鲁棒的深度视觉表征,再将所得表征用于图像生成和分类。其贡献包括对特征提取流程泛化能力的评估,以及将未见图像映射至 EEG 空间并近似重建的框架。 方法方面,摘要提及使用深度学习架构,分别结合监督学习与对比学习,在三个数据集上验证特征提取流程,并开展零样本 EEG 分类。具体网络结构、对比学习目标、两阶段训练衔接及零样本任务的类别划分尚未验证;多个数据集上的评估也不能直接视为 Cross-dataset 迁移实验。 作者报告,仅用 EEG 的单模态学习获得了被试不变、线性可分的视觉表征,其 k-means Accuracy 优于 EEG 与图像的联合表征学习。该结论的被试划分、线性可分性检验、聚类标签匹配方式和比较数值未在摘要中展开,是否采用严格 Cross-subject 评估尚未验证。 图像生成方面,作者报告其 EEG 图像合成方法在 EEGCVPR40 和 Thoughtviz 上的 Inception Score 分别提升 62.9% 和 36.13%,并声称优于 GAN 相关的现有最佳表现。这些数字为相对提升而非百分点;具体对照方法、原始分数、数据划分及统计信息尚未验证。摘要所述“未见图像映射至 EEG 空间再重建”还需与实际 EEG 输入的图像重建协议区分,不能仅凭摘要确认其对未见视觉类别的脑信号解码能力。 复现时应优先核对 EEG 预处理、被试与刺激划分、监督信息的使用、单模态与联合学习的对照条件,以及生成指标的计算协议。全文、实验消融及代码可用性尚未验证。

    阅读价值:值得核对其仅用 EEG 学习视觉表征与 EEG—图像联合表征的对照,以及零样本分类和图像生成的评估协议,以判断表征可分性与跨被试泛化是否同时成立。

  13. OpenReview · State space models78

    VMamba:视觉状态空间模型

    基于摘要分析。本文研究如何构建计算高效的视觉网络,将状态空间语言模型 Mamba 迁移为具有线性时间复杂度的视觉骨干 VMamba,核心贡献是通过 2D Selective Scan(SS2D)适配二维视觉数据的结构。 机制上,VMamba 由 Visual State-Space(VSS)块堆叠构成,其中 SS2D 沿四条扫描路径遍历,以连接一维选择性扫描的有序处理方式与二维视觉数据的非序列结构,从不同方向汇集上下文信息。作者据此构建了一组 VMamba 架构,并通过架构与实现层面的改进加速。摘要未展开具体扫描顺序、状态更新形式、训练目标或加速实现,相关细节尚未验证。 作者报告,VMamba 在多种视觉感知任务中展现出良好性能,相较既有基准模型具有输入规模扩展效率优势。摘要未提供任务名称、数据集、数据划分、对照模型、数值指标及复杂度测量条件,因此不能据此量化性能提升,或将线性复杂度直接等同于实际运行速度优势。实验协议、消融及统计信息尚未验证。材料提供了公开代码仓库,复现仍需核对具体配置、训练预算与软硬件环境。 平台推测(待验证):若 EEG 被表示为通道×时间或时频二维结构,SS2D 的多方向上下文聚合可能用于建模长程依赖;这一假设依赖二维排列能够保留有意义的通道或时频关系,视觉领域结果不等于 EEG/BCI 效果。可考察复用 VSS 与扫描机制,但需改造输入编码、通道排列和任务输出。低信噪比、不规则电极布局、跨被试差异及小数据训练可能削弱收益,预训练与监督规模要求也尚未验证。一个可检验的小实验是在固定 EEG 数据划分、训练预算和相近模型容量下,对照多方向 SS2D 与单方向扫描,并扰动通道排列,观察任务指标及计算成本是否稳定改善。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得阅读其以四条扫描路径将一维选择性扫描适配到二维视觉数据的机制,并核对输入规模扩展效率的对照实验;该机制对 EEG 的适用性尚未验证。

  14. OpenReview · EEG73

    EEG2Video:面向从 EEG 信号解码动态视觉感知

    基于摘要分析。本研究针对既有视觉重建研究主要关注静态刺激的问题,构建动态视频观看过程中的 EEG-video 配对数据,并提出基于 Seq2Seq 的 EEG2Video 基线,探索从 EEG 信号重建动态视觉感知。 数据与任务:作者报告,数据集记录了 20 名被试观看 40 个概念类别、共 1400 个动态视频片段时的 EEG。摘要提及 EEG 的高时间分辨率(1000 Hz),但具体采集与预处理协议尚未验证。作者还为视频标注颜色、动态属性及是否包含人等元信息,以考察这些属性能否从 EEG 中解码;摘要未提供各属性的独立实验结果。 核心机制:EEG2Video 使用 Seq2Seq 架构,旨在更好地对齐视频中的动态运动与高时间分辨率脑信号。其阅读价值在于将视觉解码从静态内容扩展到动态序列,但 EEG 编码方式、视频表示、时间对齐策略、损失函数及训练与推理流程均需全文核对,不能仅凭摘要判断模型是否实际利用了运动特异信息。 结果与证据边界:作者报告,模型在语义分类任务中取得 79.8% 的 2-way Accuracy,视频重建的结构相似性指数 SSIM 为 0.256。摘要未说明候选构造、数据划分、被试内或跨被试协议、对照基线及 SSIM 的计算与汇总方式,因此这些数值不能直接与其他协议下的结果比较,也不足以确认跨被试泛化或运动重建质量。 复现条件:摘要称数据集与代码将于近期发布,现有材料不能确认已公开。实验协议、消融及统计信息尚未验证;复现时应核对视频与被试的训练测试划分、时序对齐,以及动态信息相对静态语义信息的贡献。

    阅读价值:值得阅读的具体原因是其构建 EEG-video 配对数据并以 Seq2Seq 探索动态视觉重建,可用于研究 EEG 时间信息与视频运动的对应关系,但评估划分及动态信息解码的独立贡献尚未验证。

  15. OpenReview · State space models73

    SMamba:通过可伸缩状态空间模型实现任意尺度超分辨率

    基于摘要分析。该研究针对任意尺度超分辨率(ASSR),提出正文称为 S³Mamba 的方法,利用 Scalable State Space Model(SSSM)构建由低分辨率图像导出的可伸缩连续表示空间,使单一模型能够处理不同放大尺度。其核心贡献是将尺度调制引入状态空间模型的离散化过程,并结合尺度感知自注意力增强不同尺度下的全局重要特征感知。 机制与创新:ASSR 借助 Implicit Neural Representations(INR)建立坐标与像素值的连续表示,突破固定放大倍数的限制。作者认为,现有 CNN 和 Transformer 方法面临计算复杂度及长程依赖建模方面的挑战。SSSM 在离散化时调制状态转移矩阵与步长采样矩阵,作者声称由此实现线性计算复杂度的连续表示建模。摘要未给出调制函数、尺度条件的具体输入方式、训练损失及推理流程;线性复杂度对应的计算范围,以及加入自注意力后的整体开销,尚需全文核对。 结果与证据边界:作者报告,在合成与真实场景基准上取得最先进性能,并在任意超分辨率尺度下表现出较强泛化能力。摘要未列出数据集名称、训练与测试尺度划分、对照基线、指标或具体数值,因此不能判断未见尺度上的收益及适用边界。实验协议、消融及统计信息尚未验证。 平台推测(待验证):可迁移的假设是,尺度条件化的状态空间离散化可能用于 EEG 不同采样间隔下的连续时间表示;但图像空间放大与 EEG 时间采样变化并非同一任务,原领域结果不能视为 BCI 有效性的证据。可考虑复用条件化离散化模块,将图像坐标与像素监督改为时间坐标和信号重建监督,并处理通道拓扑及抗混叠约束。低信噪比、跨被试差异、通道不一致和小数据可能使模型主要拟合插值规律。一个可证伪的小实验是在固定被试划分及统一抗混叠降采样流程下,对比该模块、普通状态空间模型和传统插值在未见采样间隔上的重建误差及下游任务表现。相关 EEG 工作尚未检索确认。

    阅读价值:值得核对其通过尺度调制状态空间离散化来构建连续表示的机制,以及线性复杂度的适用范围;作者报告的任意尺度泛化优势仍需结合全文实验协议验证。

  16. OpenReview · State space models77

    STREAM:面向稀疏几何数据的通用状态空间模型

    基于摘要分析。STREAM 面向点云、事件视觉等稀疏且非结构化的几何数据,将几何结构显式编码进状态空间模型的参数化,而不是仅依赖序列化预处理及模型自行推断几何关系。其核心贡献是利用坐标的相对差异控制状态空间模型的步长,并基于 Mamba selective state-space model 与修改后的 CUDA kernel 实现高效计算。 机制上,状态空间模型的线性动态由时间或空间坐标等一维变量驱动,STREAM 将相对坐标差注入这一动态变量对应的步长。作者称,由此形成的几何操作可在 O(N) 步中计算 N 个点之间的全点对交互;该表述不应直接等同于已验证的端到端运行时间或显存复杂度,具体交互定义、点的遍历顺序与实现条件尚需正文核对。 作者报告,在从头训练的 ModelNet40 和 ScanObjectNN 点云分析任务中,STREAM 改善了 PointMamba 基线表现,但摘要未提供具体指标数值。作者还报告,在 DVS128 Gestures 数据集全部 11 个类别的测试中取得 100% Accuracy,并声称这是首次达到该结果;测试划分、预处理、重复实验及统计信息尚未验证。摘要另称模型在事件视觉和音频分类等基准上具有竞争力,具体对照与实验协议尚未验证。 平台推测(待验证):假设相对坐标驱动的状态更新能保留不规则采样结构,它可能对应 EEG 中不规则时间采样或稀疏电极空间建模的问题。可考虑复用状态更新机制,但需改造 EEG 信号的点表示、时空坐标及遍历方式;低信噪比、跨被试差异、通道缺失与小数据训练都可能削弱该归纳偏置。一个可检验的小实验是在固定 EEG 数据划分和相同输入表示下,比较相对坐标步长与固定步长,并测试通道缺失时的性能变化。此为迁移假设,不是已证实的 BCI 收益;相关 EEG 工作尚未检索确认。复现还需核对完整模型配置、CUDA kernel、训练条件及代码可用性。

    阅读价值:值得核对 STREAM 将相对坐标差注入状态空间步长的机制及其修改后的 CUDA 实现,以评估稀疏几何归纳偏置的收益;摘要中的全点对交互与测试准确率仍需结合完整实验协议验证。

  17. OpenReview · State space models76

    GrassNet:状态空间模型与图神经网络的结合

    GrassNet 针对谱图神经网络中多项式滤波器低阶截断、缺乏图谱整体建模的问题,引入结构化状态空间模型(SSMs)来学习图谱滤波器。基于摘要分析,未取得论文全文。 核心机制是利用 SSMs 建模图信号在不同频率上的关联,并为图谱中的各频率生成特定校正。作者指出,传统多项式方法对相同频率的信号施加相同调制,在谱高度集中或存在大量数值相同的谱值时可能受到限制;作者声称 GrassNet 能学习任意图谱滤波器,并在理论上具有比多项式滤波器更强的表达能力。如何定义频率序列、如何处理重复特征值及对应特征空间、表达能力结论依赖哪些假设,均需查阅正文核对。 作者报告,在九个公开基准上的实验显示 GrassNet 在真实图建模任务中表现优于对照方法。摘要未提供基准名称、任务、划分、对照配置或具体指标,因此不能量化收益或判断不同协议下的可比性;实验协议、消融及统计信息尚未验证。实现、计算成本和复现条件也尚未验证。 平台推测(待验证):假设 EEG 被表示为具有明确拉普拉斯算子的通道图,GrassNet 的跨图谱频率关联建模可能用于检验多项式滤波表达受限这一瓶颈;这里的图谱频率不等同于 EEG 的时间频率。可考虑复用谱滤波机制,但通道图构建、时间信息整合和跨被试图对齐需要改造。低信噪比可能使图结构不稳定,通道变化可能改变谱基,小数据也可能增加过拟合风险。一个可证伪的小实验是在固定 EEG 通道图、相同时间编码器和相同跨被试划分下,对比 GrassNet 滤波与多项式滤波,并检查收益对图构建及通道扰动的敏感性。已有 EEG 相关工作尚未检索确认。

    阅读价值:值得核对 GrassNet 如何利用 SSM 建模跨频率关联,以及其处理重复谱值和提升滤波表达能力的理论条件,这些机制为评估谱图方法在 EEG 图建模中的适用性提供了具体切入点。