采集入库后仍需完成相关性判断与论文分析,待处理条目暂不公开。精选门槛处于试运行,尚未完成人工标注校准。当前仅展示精选推荐,从最近 250 篇达到质量门槛的候选中排序。查看全部符合当前筛选的已公开论文 →
数据与复现预印本基于摘要分析
Beyond Trained Models: Compiling GNNs for a Sound Explainer Benchmark
基于摘要分析。该研究针对 GNN 解释器评估中的一个关键假设:数据中预设的 motif 不一定是训练后模型实际依赖的依据。作者提出以编译替代训练,通过 Gracr 将分级模态逻辑公式转换为 GNN 权重,并据此构建具有精确解释真值的 GracrBench。
阅读价值 · 该研究以行为由构造确定的 GNN 建立精确解释真值,值得用于核对解释器是否真正解释模型,而非仅恢复数据中预设的 motif;其形式化保证与评估细节仍需全文验证。
首次公开 2026-10-02 · 最新源版本 2026-10-02 · 首次发现 2026-10-09
展开技术分析、元数据与版本记录
基于摘要分析。该研究针对 GNN 解释器评估中的一个关键假设:数据中预设的 motif 不一定是训练后模型实际依赖的依据。作者提出以编译替代训练,通过 Gracr 将分级模态逻辑公式转换为 GNN 权重,并据此构建具有精确解释真值的 GracrBench。
核心机制是让模型复现给定逻辑公式的行为,使解释真值不再仅来自数据生成时植入的结构,而能够依据已知模型行为形式化定义并精确计算。作者称 Gracr 是首个将分级模态逻辑公式编译为 GNN 权重的编译器;其适用公式范围、编译约束及形式化保证尚未验证。
作者报告,在若干常用基准中,预设 motif 与模型实际决策依据之间的假设并不成立,例如仅凭节点度统计即可完成任务。在 GracrBench 的六项任务、十一种解释器评估中,作者报告多数解释器对间接影响,或同一逻辑公式的不同实现不够稳健。摘要未提供具体任务、解释器名单、指标数值及数据划分,实验协议、消融及统计信息尚未验证。
其主要价值是区分“恢复预设图结构”与“忠实解释模型行为”,并为解释器提供更细粒度的诊断条件。需要核对精确真值如何处理多种有效解释,以及编译模型与训练模型之间的行为和结构差异;这些差异可能限制评估结论向实际应用的外推。
平台推测(待验证):若 EEG 分析采用通道或脑区图上的 GNN,该基准可作为解释器的受控测试环境,但不能直接证明解释结果具有神经生理意义。迁移需明确图节点、边和逻辑条件如何对应 EEG 特征,并评估低信噪比、跨被试变化及通道配置变化的影响。一个可检验的小实验是在固定通道图上构造逻辑行为相同、实现不同的编译模型,比较解释器相对精确真值的表现是否稳定,再逐步加入特征噪声。已有 EEG 相关工作尚未检索确认。
- 作者:
- Steve Azzolin; Francesco Paolo Nerini; Stefano Teso; Francesco Bonchi; Bruno Lepri; André Panisson; Andrea Passerini
- 机构:
- 尚未验证
- 发表平台:
- arxiv
- 标识:
- 2610.03526
学术质量 82 / 100 · 兴趣权重 2 · 前沿观察,迁移价值待评估
- arxiv · v1 · 2026-10-02 · 预印本
数据与复现预印本基于摘要分析
Dissecting the Score: Calibrated Diagnosis of EEG Foundation Models
基于摘要分析。该研究关注 EEG 基础模型的下游任务得分能否反映其对生理相关信号的利用,提出以神经生理学为共同参照的跨架构诊断基准,用受控输入干预揭示任务评分难以呈现的信号依赖,并检验这些依赖能否在下游阶段改变。
阅读价值 · 值得阅读的是其通过配对对照和已知信号依赖的合成 EEG 校验来诊断模型预测依据,并区分固定模型的信号敏感性与下游接口可改变的行为;具体协议及解释有效性仍需全文核对。
首次公开 2026-09-18 · 最新源版本 2026-10-05 · 首次发现 2026-10-09
展开技术分析、元数据与版本记录
基于摘要分析。该研究关注 EEG 基础模型的下游任务得分能否反映其对生理相关信号的利用,提出以神经生理学为共同参照的跨架构诊断基准,用受控输入干预揭示任务评分难以呈现的信号依赖,并检验这些依赖能否在下游阶段改变。
诊断时,作者先固定各模型的适配器、预训练骨干与读出,再对输入实施八种诊断协议,不进一步训练。配对对照用于区分目标干预与主要副作用;其中三种代表性协议在具有已知信号依赖的合成 EEG 上得到校验。该设计针对普通输入扰动的解释局限:观察到的变化也可能来自适配器、读出或扰动自身引入的伪影,而不只是目标生理特征。
作者报告,在五个已发布模型和四项任务中,预测往往对全局或低层信号属性更敏感,而非对预期与任务相关的特定脑区和 EEG 节律更敏感。在运动想象任务中,交换两半球对应电极使 AUROC 降低 0.18–0.28,而完全遮蔽预先定义的中央感觉运动区域,性能变化小于 0.04;摘要未单独明确后一数值的指标。在癫痫发作检测中,两个保留输入幅值的模型在原始波形被 RMS 匹配背景完全替换后仍保持较强预测能力,但保留原始波形并大幅衰减幅值时,表现低于随机水平;摘要未提供具体分数及随机水平的定义。
作者还报告,冻结预训练骨干、以镜像增强重新拟合读出,可使运动想象预测对左右电极交换的响应更一致。这支持部分诊断行为可通过下游接口改变,但不等同于证明骨干已学到或未学到生理表征,也不能仅凭局部遮蔽效应判定模型完全不利用该区域。
复现需核对八种协议的具体干预及配对控制、模型与任务清单、适配器和读出设置、合成 EEG 的生成假设,以及镜像增强的拟合流程。数据集、被试数量、被试内或跨被试划分、统计不确定性、消融及代码可用性尚未验证;上述结果应限定在作者所评估的模型与任务范围内。
- 作者:
- 未提供/匿名
- 机构:
- 尚未验证
- 发表平台:
- ICLR 2027 Conference Submission
- 标识:
- GJhOE6XOE5
学术质量 81 / 100 · 兴趣权重 2 · 按原研究证据理解,不推断适用范围
- openreview · 元数据快照 · 2026-10-05 · 预印本
数据与复现状态未知基于摘要分析
Machine learning seizure prediction: one problematic but accepted practice
基于摘要分析。本研究关注机器学习 EEG 癫痫发作预测中,已发表的高预测表现为何未能转化为临床应用,并通过实证研究检验一种常见标注与验证做法可能引入的混杂。其主要贡献是以真实 EEG 中与生物学完全脱钩的“伪发作”任务,检验模型能否利用非发作信号获得虚高的验证准确率。
阅读价值 · 该研究通过真实 EEG 中与生物学脱钩的“伪发作”任务检验验证混杂,为核对癫痫发作预测中的标注与数据划分是否支撑临床相关结论提供了具体切入点。
首次公开 2023-01-17 · 最新源版本 2025-03-04 · 首次发现 2026-10-09
展开技术分析、元数据与版本记录
基于摘要分析。本研究关注机器学习 EEG 癫痫发作预测中,已发表的高预测表现为何未能转化为临床应用,并通过实证研究检验一种常见标注与验证做法可能引入的混杂。其主要贡献是以真实 EEG 中与生物学完全脱钩的“伪发作”任务,检验模型能否利用非发作信号获得虚高的验证准确率。
被考察的做法是:将短 EEG 窗口按时间组赋予标签,再从这些窗口中随机抽取样本进行验证。作者研究这一流程中的混杂,并训练人工神经网络学习真实 EEG 上人为设置的“伪发作”。该设计意在区分模型对真实发作前生物标志物的学习,与对其他信号特征的学习,而非提出新的发作预测算法。
作者报告,在上述按时间组标注、随机抽取窗口验证的流程下,非发作信号也能够形成机器学习可利用的决策边界,使验证准确率虚高;模型能够学习与生物学脱钩的“伪发作”是其核心证据。摘要未提供具体准确率、数据集、被试数、窗口长度、神经网络结构或被试内/跨被试协议,不能据此量化偏差大小,也不能认定所有既有研究均受影响。
作者认为,部分既有工作的结果可能受到这一混杂影响,并建议更严格地缓解混杂。全文中的具体指南、对照设置、实验协议、消融及统计信息尚未验证。阅读与复现时应重点核对时间组如何定义、训练与验证窗口之间的时间关系,以及“伪发作”标签如何构造,再判断结论适用范围。该研究直接涉及 EEG 预测评估,但其发现不应未经检验就推广到所有 EEG 解码或 BCI 任务,也不构成临床有效性证据。
- 作者:
- Joseph West; Zahra Dasht Bozorgi; Jeffrey Herron; Howard Jay Chizeck; Jordan David Chambers
- 机构:
- 尚未验证
- 发表平台:
- Journal of Neural Engineering
- 标识:
- YDQN15Pv1Y
学术质量 80 / 100 · 兴趣权重 2 · 按原研究证据理解,不推断适用范围
- openreview · 元数据快照 · 2025-03-04 · 状态未知
数据与复现预印本基于摘要分析
Simultaneous multi-area recordings in macaque frontoparietal cortex during a manual object-interaction task
基于摘要分析。该研究针对自然化灵巧手行为神经生理数据稀缺、既有记录动作自由度及脑区覆盖有限的问题,构建了包含40种手—物体交互条件的任务范式,并提供额顶皮层多区域同步神经活动、手部运动学及连续解码基准。
阅读价值 · 该数据集结合多脑区同步神经记录、丰富的手—物体交互条件与三维运动学标注,值得用于核对跨日、跨任务及通道可用性变化下的运动 BCI 解码鲁棒性,但具体评估协议与复现条件尚未验证。
首次公开 2026-10-05 · 最新源版本 未知 · 首次发现 2026-10-09
展开技术分析、元数据与版本记录
基于摘要分析。该研究针对自然化灵巧手行为神经生理数据稀缺、既有记录动作自由度及脑区覆盖有限的问题,构建了包含40种手—物体交互条件的任务范式,并提供额顶皮层多区域同步神经活动、手部运动学及连续解码基准。
数据来自一只恒河猴,共20个会话。研究使用覆盖1,920个通道的微电极阵列,同步记录初级运动皮层、前顶内区和腹侧前运动皮层的神经活动;多相机无标记运动捕捉系统采集视频,随后离线提取运动学信息。数据集包含处理后的神经特征、同步的手与肘部关键点三维坐标,以及试次级任务条件和事件时间元数据。1,920个通道描述的是阵列覆盖规模,不能据此认定每个会话均有相同数量的可用通道。
作者提供技术验证,并以多种算法开展连续关键点坐标重建的神经解码基准。作者报告,在所采用的跨日和跨任务评估中,不同算法的解码表现存在差异;通道可用性变化也对应不同的性能退化曲线。摘要未给出算法名称、具体指标、分数、训练与测试划分或统计结果,因此不能据此排序算法,也不能量化多脑区记录相对单脑区记录的增益。实验协议、消融及统计信息尚未验证。
其可核对的研究价值在于将任务多样性、多脑区同步记录与运动学目标放入同一数据资源,为分析灵巧手控制及检验解码器对记录变化的敏感性提供条件。证据目前限于单只动物;向人类运动 BCI 或四肢瘫痪人群推广仍需验证。复现前需核对数据访问方式、神经特征处理流程、同步精度、关键点质量、各会话可用通道,以及跨日和跨任务划分规则;摘要不足以确认这些细节或代码可用性。
- 作者:
- Liu K; Guan S; Luo S; Li Y; Dong Y; Chen W; Chen M; Zhang D; Chen L; Huang S; Chen Y; Jiang H; Wu L; Li R; Zhu F; Xie Y; Sui Y; Min B; Guan S; Li CT; Wang T; He T
- 机构:
- 尚未验证
- 发表平台:
- bioRxiv
- 标识:
- 10.64898/2026.09.29.754877
学术质量 80 / 100 · 兴趣权重 2 · 按原研究证据理解,不推断适用范围
- europepmc · 元数据快照 · 未知 · 预印本
数据与复现预印本基于摘要分析
RNADyn: A Benchmark for Generating and Understanding RNA Dynamics
基于摘要分析。该研究针对静态结构难以完整描述 RNA 构象变化、标准化动力学数据有限,以及轨迹生成与动力学理解通常分离的问题,提出 RNA 分子动力学(MD)基准 RNADynBench,并构建统一模型 RNADynNet,将全原子轨迹生成与动力学表征学习连接起来。
阅读价值 · 值得阅读之处在于将标准化 RNA 动力学基准与生成、表征共享骨干的模型结合,可重点核对物理约束如何改善轨迹与动力学指纹,以及防泄漏划分的具体实现。
首次公开 2026-10-02 · 最新源版本 2026-10-02 · 首次发现 2026-10-09
展开技术分析、元数据与版本记录
基于摘要分析。该研究针对静态结构难以完整描述 RNA 构象变化、标准化动力学数据有限,以及轨迹生成与动力学理解通常分离的问题,提出 RNA 分子动力学(MD)基准 RNADynBench,并构建统一模型 RNADynNet,将全原子轨迹生成与动力学表征学习连接起来。
数据与机制:作者提供了 2585 条经过质量控制、每条时长为 100 ns 的全原子 MD 轨迹,并采用防泄漏数据划分。RNADynNet 使用共享骨干,从单个构象同时支持轨迹生成与动力学指纹提取;其机制结合坐标去噪、单帧到轨迹对齐及物理约束(physical grounding)。具体网络结构、损失形式、物理约束定义与数据划分依据尚未验证。
结果:作者报告,在两个测试集上(其中包含高柔性挑战集),生成轨迹的 RMSF 相关性分别为 0.875 和 0.766;摘要未明确两个数值与各测试集的对应关系。作者还报告,单构象预测与 MD 推导的动力学具有相近的一致性,物理约束能够改善生成动力学及指纹中可恢复的物理信息。上述相关性不等同于完整轨迹精度,仍需结合正文核对指标计算、对照基线、消融与统计不确定性。
适用边界:该工作直接面向 RNA 分子动力学,而非 EEG 或 BCI。其建模依赖原子坐标与分子物理结构,不能据此推定对神经信号有效。平台推测(待验证):生成与动力学表征共享骨干的思路可供时序建模参考,但 EEG 并不具有相同的坐标监督与物理约束条件,因此暂不提出直接迁移结论。相关 EEG 工作尚未检索确认;数据获取方式、实现开放情况、实验协议、消融及统计信息尚未验证。
- 作者:
- Yiming Huang; Lennart Bastian; Hanqun Cao; Luis Vollmers; Tolga Birdal
- 机构:
- 尚未验证
- 发表平台:
- arxiv
- 标识:
- 2610.03712
学术质量 80 / 100 · 兴趣权重 2 · 前沿观察,迁移价值待评估
- arxiv · v1 · 2026-10-02 · 预印本
数据与复现已接收基于摘要分析
Equivalent EEG, Different Representation: Undeclared Acquisition Contracts in EEG Foundation Models
基于摘要分析。研究考察 EEG 采集元数据被模型接口丢弃或重新解释时,物理上等价的记录是否仍产生一致表征,并分析通道身份、通道顺序与幅值单位对三个已发布 EEG 基础模型编码器的影响。作者提出六项一致性测试,以及用于声明通道身份、所需顺序和幅值单位的三个模型卡字段。
阅读价值 · 值得核对其六项一致性测试:作者报告通道身份与幅值约定可显著改变已发布 EEG 基础模型的表征和下游预测,而 Balanced Accuracy 未必随之下降,提示仅看任务指标不足以验证接口行为。
首次公开 2026-10-02 · 最新源版本 2026-10-02 · 首次发现 2026-10-09
展开技术分析、元数据与版本记录
基于摘要分析。研究考察 EEG 采集元数据被模型接口丢弃或重新解释时,物理上等价的记录是否仍产生一致表征,并分析通道身份、通道顺序与幅值单位对三个已发布 EEG 基础模型编码器的影响。作者提出六项一致性测试,以及用于声明通道身份、所需顺序和幅值单位的三个模型卡字段。
通道顺序测试同时重排 EEG 数据行与对应电极名称,因此不改变物理记录;合理接口应保持这种等价性,或明确要求的通道顺序。作者报告,LaBraM 与 EEGPT 在结构上具备此类不变性,数值差异处于浮点误差尺度;CBraMod 含绑定通道索引的卷积,因而对顺序敏感。预训练后的顺序效应为随机权重对照的 0.42 倍,通道轴卷积核能量的 83.1% 集中于中心抽头。
幅值约定的影响更明显。作者报告,三篇模型论文均说明输入尺度,但已发布推理路径均未强制落实该尺度。与直接输入原始微伏数值相比,在声明尺度下,EEGPT 的最大电极身份扰动效应增至 252 倍,CBraMod 的顺序效应增至 4.85 倍;EEGPT 的最大身份误差达到被试间表征距离的 0.67 倍。这些是特定扰动及表征距离比较,不能直接解释为分类性能下降。
在摘要所述 EEGPT 探针评估中,作者报告,一次 C3/C4 错标改变 11.5% 的预测;输入幅值缩小至规定尺度的十分之一改变 51.5% 的预测,Balanced Accuracy 却略有上升。其核心警示不是某种架构约定本身错误,而是接口未声明或未落实会实质影响计算的约定。
摘要未提供数据集、被试数、数据划分、探针训练设置及距离计算细节,实验协议、消融及统计信息尚未验证。复现时需核对发布版本、预处理单位、通道名称与顺序的映射,以及各扰动测试和对照的具体定义。
- 作者:
- Sarthak Tayal
- 机构:
- 尚未验证
- 发表平台:
- ICBINB-BIO Poster
- 标识:
- 01RRyCcswK
学术质量 80 / 100 · 兴趣权重 2 · 按原研究证据理解,不推断适用范围
- openreview · 元数据快照 · 2026-10-02 · 已接收
数据与复现预印本基于摘要分析
Every View Counts: View-Consistent Panoptic Quality for Multi-view Panoptic Segmentation
基于摘要分析。该研究针对多视图全景分割中场景级指标可能弱化跨视图实例遗漏与 ID 变化影响的问题,提出 View-Consistent Panoptic Quality(VC-PQ),将单图像 PQ 扩展至输入视图集合,使实例可见的各个视图获得同等计数权重。
阅读价值 · 值得阅读其评估指标设计:VC-PQ 将实例跨视图可见性与身份一致性纳入评价,并通过分解区分掩码精度、视图一致性和匹配阈值造成的分数损失。
首次公开 2026-10-05 · 最新源版本 2026-10-05 · 首次发现 2026-10-09
展开技术分析、元数据与版本记录
基于摘要分析。该研究针对多视图全景分割中场景级指标可能弱化跨视图实例遗漏与 ID 变化影响的问题,提出 View-Consistent Panoptic Quality(VC-PQ),将单图像 PQ 扩展至输入视图集合,使实例可见的各个视图获得同等计数权重。
多视图全景分割需要为无序图像集合中的每个像素赋予语义类别及场景级实例 ID。摘要指出,近期前馈式 3D 模型可一次前向预测输入视图的标签,但通常沿用逐场景优化方法的 PQ^scene,并在渲染得到的留出视图上评估。PQ^scene 将场景内全部视图拼成一张图,因此实例在某个视图中被遗漏或发生 ID 变化,对匹配对分数的影响与其面积相关,未直接体现受影响的视图数量。
VC-PQ 对预测实例与真值实例可见视图不一致的情况施加惩罚。其分解将分数损失归因于掩码精度、视图一致性及匹配阈值;另外引入一个参数,可恢复拼接评估的面积加权方式以便比较。具体公式、参数取值和匹配实现尚未验证。
作者报告,在 ScanNet++ 和 ScanNetv2 的固定评估协议下,以 VC-PQ 和 PQ^scene 评估近期前馈方法,并利用指标分解分析各方法的失分来源。作者报告,对真值进行受控扰动时,VC-PQ 会响应实例遗漏或 ID 变化涉及的视图数量,而 PQ^scene 会响应这些变化对应的面积。摘要未提供具体分数、方法名单或划分细节,实验协议、消融及统计信息尚未验证。
该工作的贡献是补充多视图一致性的评价维度,而非提出新的分割模型;作者主张将 VC-PQ 与 PQ^scene 并列报告。复现需核对实例可见性定义、跨视图匹配与阈值规则、受控扰动方式,以及两项指标是否在相同视图集合上计算。材料未提供 EEG 或 BCI 验证,不将其视觉任务结果外推为 BCI 效果。
- 作者:
- Youngmin Lee; Byungha Ko; Guhnoo Yun; Dong Hwan Kim
- 机构:
- 尚未验证
- 发表平台:
- arxiv
- 标识:
- 2610.05911
学术质量 79 / 100 · 兴趣权重 2 · 前沿观察,迁移价值待评估
- arxiv · v1 · 2026-10-05 · 预印本
数据与复现预印本基于摘要分析
PlaySuite: A Large-Scale Benchmark for Interactive Visual Intelligence
基于摘要分析。PlaySuite 针对静态感知与推理基准难以衡量模型在动态环境中长期行动能力的问题,提出以开源视频游戏为载体的交互式视觉智能评估基准,贡献包括跨游戏闭环交互框架与标准化游戏进度评判协议。
阅读价值 · 值得阅读其跨游戏闭环评估与进度判定设计,以核对静态推理能力与持续交互表现之间的差距,但评判协议的可靠性及其对 BCI 的适用性尚未验证。
首次公开 2026-10-05 · 最新源版本 2026-10-05 · 首次发现 2026-10-09
展开技术分析、元数据与版本记录
基于摘要分析。PlaySuite 针对静态感知与推理基准难以衡量模型在动态环境中长期行动能力的问题,提出以开源视频游戏为载体的交互式视觉智能评估基准,贡献包括跨游戏闭环交互框架与标准化游戏进度评判协议。
基准收录来自 PyWeek 和 itch.io 的超过 5K 款开源游戏,涵盖不同类型及 Pygame、HTML5、Godot、Unity 等引擎。作者认为,这些独立游戏对当前模型大多属于分布外内容,可降低依赖记忆中的攻略或网络训练材料取得成功的可能性;这一判断不等于已经排除训练数据重叠,具体核查方式尚未验证。
技术上,作者构建了面向 HPC 集群优化的统一闭环交互框架,以支持异构游戏的规模化评估,并采用 Video-LLM-as-a-judge 协议,将可观察的游戏里程碑映射为标准化进度等级。该设计将评估重点从单次视觉问答转向持续行动与目标推进。摘要未提供动作接口、观察频率、交互预算、等级定义或评判模型与人工标注的一致性,这些条件需结合全文核对。
在该游戏评估框架下,作者报告对十四个近期开放模型进行了测试,覆盖视觉语言模型、计算机使用智能体和视觉语言动作模型;结果显示,模型虽具备较强推理能力,仍难以持续推进游戏,并反复出现空间定位、动作执行和自我纠正失败。摘要未给出具体进度分数、模型间差异及统计信息,因此不能据此比较模型优劣。实验协议、消融及统计信息尚未验证。
该研究的主要对象是动态视觉环境中的通用模型,而非 EEG 解码或 BCI。平台推测(待验证):其闭环进度评估思路可能为交互式 BCI 的任务完成度评价提供参考,但这不构成神经信号建模方法或 BCI 有效性的证据,已有 EEG 相关工作尚未检索确认。复现需核对游戏版本与运行依赖、模型配置、动作预算、里程碑规则及评判模型配置;摘要不足以确认这些资源的具体开放情况。
- 作者:
- Dheeraj Varghese; Anna Vettoruzzo; Walter Simoncini; Michelle Lorena Acevedo Callejas; Mohammad Mahdi Derakhshani; Kristof Meding; Joaquin Vanschoren; Cees G. M. Snoek
- 机构:
- 尚未验证
- 发表平台:
- arxiv
- 标识:
- 2610.07127
学术质量 78 / 100 · 兴趣权重 2 · 前沿观察,迁移价值待评估
- arxiv · v1 · 2026-10-05 · 预印本
数据与复现状态未知基于摘要分析
Benchmarking self-supervised video representation learning
基于摘要分析。该研究针对视频自监督表征学习中实验设置不统一、方法间难以比较的问题,提出统一比较基准,并系统研究预训练数据及模型选择对下游表现的影响。作者还依据研究观察提出一种使用有限训练数据的方法,但摘要未说明其具体机制。
阅读价值 · 值得阅读的是其在统一评估条件下考察视频自监督学习对数据规模、分布及噪声等因素的依赖,可为预训练方法的公平比较提供参考;具体协议与结论适用范围尚未验证。
首次公开 2023-12-16 · 最新源版本 2024-03-19 · 首次发现 2026-10-09
展开技术分析、元数据与版本记录
基于摘要分析。该研究针对视频自监督表征学习中实验设置不统一、方法间难以比较的问题,提出统一比较基准,并系统研究预训练数据及模型选择对下游表现的影响。作者还依据研究观察提出一种使用有限训练数据的方法,但摘要未说明其具体机制。
研究覆盖数据集规模、复杂度、数据分布、数据噪声和特征分析五个方面。作者报告,实验涉及七种方法、七种网络架构、五个数据集及两种下游任务;摘要未列出名称、数据划分、评估指标及各方法与架构的组合方式。这些数量仅说明研究覆盖范围,不能据此判断各设置之间的可比性。
作者报告,所提出方法在使用有限训练数据时,优于使用其十倍预训练数据的已有最先进方法。该结论对应的任务、指标、数据来源、对照方法与训练预算尚未验证,不能解读为通用的数据效率优势。复现时需核对统一基准如何控制架构、预训练预算和下游评估方式,以及各项观察是否得到消融与统计分析支持;实验协议、消融及统计信息尚未验证。
平台推测(待验证):对数据规模、分布和噪声的分项评估思路,可用于考察 EEG 自监督预训练在小数据和跨被试条件下的稳定性;可复用的是评估框架,而非尚未披露的视频方法机制。若用于 EEG,需改造输入表示、预训练任务与噪声设置,并控制被试划分。低信噪比、通道差异和小样本可能改变视频领域观察到的规律。一个可检验的小实验是在固定模型与下游标注预算下,改变无标签 EEG 预训练数据规模和噪声强度,以固定跨被试划分检验表征收益是否稳定。相关 EEG 工作尚未检索确认。
- 作者:
- Akash Kumar; Ashlesha Kumar; Vibhav Vineet; Yogesh S Rawat
- 机构:
- 尚未验证
- 发表平台:
- NeurIPS - 4th Workshop on Self-Supervised Learning: Theory and Practice
- 标识:
- OVxMMyglbN
学术质量 78 / 100 · 兴趣权重 2 · 前沿观察,迁移价值待评估
- openreview · 元数据快照 · 2024-03-19 · 状态未知
数据与复现已接收基于摘要分析
URL: A Representation Learning Benchmark for Transferable Uncertainty Estimates
基于摘要分析。研究关注预训练模型迁移到新数据集时,不确定性估计能否与表征一起可靠迁移,提出 Uncertainty-aware Representation Learning(URL)基准。该基准同时评估表征的迁移能力,并使用一项新指标衡量不确定性估计的零样本迁移能力;指标定义与具体计算方式尚未验证。
阅读价值 · URL 将表征迁移能力与不确定性估计的零样本迁移能力分开评估,值得用于核对预训练模型的不确定性是否能随表征一起迁移,但其对 EEG 的适用性尚未验证。
首次公开 2023-09-26 · 最新源版本 2024-01-03 · 首次发现 2026-10-09
展开技术分析、元数据与版本记录
基于摘要分析。研究关注预训练模型迁移到新数据集时,不确定性估计能否与表征一起可靠迁移,提出 Uncertainty-aware Representation Learning(URL)基准。该基准同时评估表征的迁移能力,并使用一项新指标衡量不确定性估计的零样本迁移能力;指标定义与具体计算方式尚未验证。
作者报告,在 ImageNet 上预训练、迁移至八个下游数据集的评估中,比较了十种不确定性估计方法:关注表征本身不确定性或直接估计预测风险的方法,优于基于上游类别概率的方法。摘要未提供下游数据集名称、具体方法清单、分数及数据划分,因此不能据此比较不同协议下的效果。作者认为,可迁移的不确定性量化仍是开放挑战,但不一定与传统表征学习目标冲突;这一判断的适用范围及统计支持需核对全文。
其评估思路区分了“表征能否支持下游任务”与“不确定性是否仍能反映下游风险”,有助于避免将上游类别置信度直接视为跨任务可靠性。来源提供了代码链接,但实现细节、运行条件、实验协议、消融及统计信息尚未验证。
平台推测(待验证):假设 EEG 预训练表征在跨被试或跨数据集迁移时仍包含可识别的风险信息,URL 的双重评估思路可能用于检验表征质量与不确定性质量是否同步变化。可复用的是评估框架;需改造的是 EEG 编码器、下游任务接口及与任务风险对应的评价实现。低信噪比、通道差异和小样本可能使不确定性主要反映采集条件,而非预测错误。一个可检验的小实验是在固定的 Cross-subject 划分下,比较表征不确定性与上游类别概率对下游错误的识别能力,并同时报告任务性能。此处为迁移假设,已有 EEG 相关工作尚未检索确认。
- 作者:
- Michael Kirchhof; Bálint Mucsányi; Seong Joon Oh; Enkelejda Kasneci
- 机构:
- 尚未验证
- 发表平台:
- NeurIPS 2023 Datasets and Benchmarks Poster
- 标识:
- e9n4JjkmXZ
学术质量 78 / 100 · 兴趣权重 2 · 前沿观察,迁移价值待评估
- openreview · 元数据快照 · 2024-01-03 · 已接收
数据与复现预印本基于摘要分析
NEST: A Large-Scale Benchmark for Predicting fMRI in Native Anatomy from EEG and Structural MRI
基于摘要分析。该研究针对现有 EEG-to-fMRI 基准规模较小、未充分纳入被试特异解剖结构的问题,提出 NEST(Native-anatomy EEG--sMRI--fMRI Tri-modal benchmark),用于自然观看影片时从 EEG 和结构 MRI(sMRI)预测原生解剖空间中的四维 fMRI,并提出配套模型 NESTOR。研究主要对象是跨模态脑成像预测,不等同于已验证的 BCI 解码应用。
阅读价值 · 值得阅读的具体原因是 NEST 将原生解剖空间与未见被试评估纳入 EEG-to-fMRI 基准,但分开采集信号的配对方式及未见影片零样本结果能否排除刺激相关捷径,仍需核对全文。
首次公开 2026-09-12 · 最新源版本 2026-10-05 · 首次发现 2026-10-09
展开技术分析、元数据与版本记录
基于摘要分析。该研究针对现有 EEG-to-fMRI 基准规模较小、未充分纳入被试特异解剖结构的问题,提出 NEST(Native-anatomy EEG--sMRI--fMRI Tri-modal benchmark),用于自然观看影片时从 EEG 和结构 MRI(sMRI)预测原生解剖空间中的四维 fMRI,并提出配套模型 NESTOR。研究主要对象是跨模态脑成像预测,不等同于已验证的 BCI 解码应用。
数据与协议:NEST 通过共同的影片时间轴对齐分开采集的 EEG 与 fMRI,而非要求同步采集。作者报告,两部影片对应的被试规模分别为 904 和 963,超过其所比较的最大公开 EEG--fMRI 数据集规模的 40 倍;摘要未说明各模态人数、被试重叠情况及具体配对规则,不能将该规模直接理解为同一被试的同步三模态记录。模型在未见被试上接受评估,指标涵盖体素级重建、脑区时间相关性和功能连接。
方法与结果:NESTOR 使用模态特异条件,将被试 sMRI 作为静态解剖条件,将 EEG 作为随时间变化的条件。作者报告,NESTOR 优于现有 EEG-to-fMRI 模型,并据此强调原生解剖信息的重要性,但摘要未提供具体基线名称、指标数值或增益。作者还报告模型可零样本迁移至未见影片,并将其解释为模型利用 EEG 预测 fMRI、而非仅记忆刺激特异的 fMRI 模式;这一解释的证据强度仍需结合完整评估与对照核查。
复现与局限:需核对 EEG 与 fMRI 的时间对齐、血流动力学时延处理、原生空间输出及跨被试评价方式,并确认训练与测试的被试和影片划分、sMRI 单独输入与刺激信息对照。实验协议、消融及统计信息尚未验证;摘要也未提供模型架构、损失函数、数据访问和代码条件,因此目前不能判断复现成本或将该结果外推为 BCI 性能提升。
- 作者:
- 未提供/匿名
- 机构:
- 尚未验证
- 发表平台:
- ICLR 2027 Conference Submission
- 标识:
- 0fAlQQVRQW
学术质量 78 / 100 · 兴趣权重 2 · 按原研究证据理解,不推断适用范围
- openreview · 元数据快照 · 2026-10-05 · 预印本
数据与复现已接收基于摘要分析
Are EEG Foundation Models Worth It? Comparative Evaluation with Traditional Decoders in Diverse BCI Tasks
基于摘要分析。该研究考察 EEG 基础模型相较于传统解码方法,尤其是经典非神经网络方法,是否具有稳定优势;核心贡献是跨数据集、解码任务和六种评估协议的比较基准,并引入 ST-EEGFormer 作为预训练基线。
阅读价值 · 该研究通过多任务、六种评估协议及统计检验比较 EEG 基础模型与传统解码器,值得核对其数据稀缺场景下的收益边界及预训练与微调贡献的区分。
首次公开 2026-01-26 · 最新源版本 2026-04-11 · 首次发现 2026-10-09
展开技术分析、元数据与版本记录
基于摘要分析。该研究考察 EEG 基础模型相较于传统解码方法,尤其是经典非神经网络方法,是否具有稳定优势;核心贡献是跨数据集、解码任务和六种评估协议的比较基准,并引入 ST-EEGFormer 作为预训练基线。
方法方面,ST-EEGFormer 是基于 Vision Transformer(ViT)的时空 EEG 模型,仅使用 masked autoencoding(MAE)在超过 8M 个 EEG 片段上预训练。摘要未提供片段长度、来源构成、预训练与下游数据的关系,以及掩码策略和微调配置,这些复现条件尚未验证。研究覆盖多种 EEG 基础模型、紧凑神经网络与经典非神经网络解码器,并采用统计检验;具体模型、数据集、任务及六种协议的定义未在摘要中列出,不能据此确定其被试内、跨被试或跨会话设置。
作者报告,微调后的基础模型在数据充足、群体层面的评估中表现较好,但在数据稀缺场景下,往往不能显著优于紧凑神经网络,甚至经典非神经网络解码器。作者还报告,线性探测的表现持续偏弱,下游任务之间的性能差异较大,所比较的神经网络解码器未呈现清晰的缩放规律。摘要未给出具体指标、效应量或统计检验细节,因此这些结论不能扩展为所有 EEG 基础模型或所有 BCI 场景的普遍判断。
作者将结果解释为预训练与下游微调之间存在较大落差,复杂预训练任务的收益可能因此被削弱,并指出有未显式揭示的架构因素影响性能。阅读全文时需核对架构因素如何被隔离、预训练和微调贡献如何比较,以及各协议的数据划分、调参预算和统计方法。实验协议、消融及统计信息尚未验证;当前材料支持将其作为 EEG 基础模型收益边界的评估研究,而非认定基础模型无效。
- 作者:
- Liuyin Yang; Qiang Sun; Ang Li; Marc M. Van Hulle
- 机构:
- 尚未验证
- 发表平台:
- ICLR 2026 Poster
- 标识:
- 5Xwm8e6vbh
学术质量 77 / 100 · 兴趣权重 2 · 按原研究证据理解,不推断适用范围
- openreview · 元数据快照 · 2026-04-11 · 已接收
数据与复现预印本基于摘要分析
EEGAgentBench: Benchmarking LLM Agents on Short- and Long-Horizon EEG Analysis
基于摘要分析。EEGAgentBench 针对现有 EEG 智能体评估任务零散、时间跨度有限及协议不一致的问题,提出统一基准,将评估范围从短片段分类扩展到需要迭代积累证据、调用信号处理工具和进行多步骤推理的长时程分析。
阅读价值 · 值得阅读的具体原因是 EEGAgentBench 将短时程与长时程 EEG 分析纳入统一评估,并通过确定性工具考察智能体的证据积累与多步骤工作流能力;其能力区分结论仍需结合全文中的任务协议和指标核对。
首次公开 2026-09-15 · 最新源版本 2026-10-05 · 首次发现 2026-10-09
展开技术分析、元数据与版本记录
基于摘要分析。EEGAgentBench 针对现有 EEG 智能体评估任务零散、时间跨度有限及协议不一致的问题,提出统一基准,将评估范围从短片段分类扩展到需要迭代积累证据、调用信号处理工具和进行多步骤推理的长时程分析。
基准覆盖六类代表性 EEG 应用,摘要明确举出的应用包括知识问答与睡眠分期;信号时长从 2 秒至近 23 小时,预测目标涵盖类别标签、事件区间和 epoch 级序列。其评估维度包括知识推理、短时程解释、长时程事件检测及序列理解,但各任务的数据来源、被试规模、划分方式和评分规则尚未验证。
机制上,基准提供 10 个确定性 EEG 分析工具,仅暴露与任务相关的信号测量信息,要求智能体自主选择工具、迭代积累证据并构建多步骤工作流。因此,它不仅考察最终预测,也旨在评估推理、工具使用及工作流构建能力;这些过程能力如何被具体计分,仍需核对全文。
作者报告,在该基准上评估了来自 15 个模型家族的 29 个前沿 LLM,结果能够区分模型规模和推理成本之外的智能体能力,并显示当前智能体在长时程 EEG 分析中存在明显局限,尤其是持续证据积累与多步骤推理。摘要未提供具体指标、分数或任务级对照,不能据此判断某个模型更适合实际 EEG 分析。
复现时需核对工具接口与输出约束、长记录的访问方式、提示与调用预算、任务评分及推理成本统计口径,并确认基准数据和实现的可获取性。实验协议、消融及统计信息尚未验证;该材料也不足以支持临床可靠性或实际 BCI 部署效果的结论。
- 作者:
- 未提供/匿名
- 机构:
- 尚未验证
- 发表平台:
- ICLR 2027 Conference Submission
- 标识:
- EIrN2VEOUa
学术质量 77 / 100 · 兴趣权重 2 · 按原研究证据理解,不推断适用范围
- openreview · 元数据快照 · 2026-10-05 · 预印本
数据与复现状态未知基于摘要分析
EEG-FM-Bench: A Comprehensive Benchmark for the Systematic Evaluation and Diagnostic Analyses of EEG Foundation Models
基于摘要分析。研究针对 EEG 基础模型评估协议不一致、迁移效率与规模效应缺乏诊断的问题,提出 EEG-FM-Bench,将标准化下游评估与梯度、表征分析整合为统一基准,以支持模型比较和可复现分析。
阅读价值 · 值得阅读和复现的是其统一下游评估与梯度、表征诊断框架,可用于核对 EEG 基础模型的迁移差异是否与目标对齐和适配方式有关,但具体协议及诊断证据尚未验证。
首次公开 2026-04-30 · 最新源版本 2026-09-22 · 首次发现 2026-10-09
展开技术分析、元数据与版本记录
基于摘要分析。研究针对 EEG 基础模型评估协议不一致、迁移效率与规模效应缺乏诊断的问题,提出 EEG-FM-Bench,将标准化下游评估与梯度、表征分析整合为统一基准,以支持模型比较和可复现分析。
基准覆盖 14 个数据集、10 种范式,包含多种微调策略、任务组织方式和分类器配置。摘要未列出具体数据集、模型清单、被试数量,以及被试内、跨被试或跨会话划分,因此这些覆盖数量不能直接说明其对不同泛化场景的代表性。
作者报告,多任务学习在数据稀缺的 EEG 场景中常可作为正则化手段缓解过拟合,但特定任务范式下可能出现负迁移;重建目标与下游任务之间的梯度冲突限制了当前预训练效率。作者还报告,在已发布检查点和匹配的下游协议下,模型规模或数据规模本身不足以完全解释迁移表现,目标对齐、适配兼容性及 EEG 特定设计似乎也是重要因素。这些结论应限定于所评估的检查点与协议,不能据此推断扩大规模普遍无效;摘要未提供具体性能指标或效应量。
复现时值得核对各模型输入与通道处理、微调预算、分类器配置及数据划分如何匹配,并检查梯度冲突的测量方法、表征诊断与迁移结果之间的证据关系。作者提供了代码地址,但代码可运行性、实验协议、消融及统计信息尚未验证。
- 作者:
- Wei Xiong; Jiangtong Li; Jie Li; Kun Zhu; Changjun Jiang
- 机构:
- 尚未验证
- 发表平台:
- ICML 2026 regular
- 标识:
- vGeNaFHdET
学术质量 77 / 100 · 兴趣权重 2 · 按原研究证据理解,不推断适用范围
- openreview · 元数据快照 · 2026-09-22 · 状态未知
数据与复现预印本基于摘要分析
A multi-scenario EEG dataset for auditory attention decoding in naturalistic multi-talker environments
基于摘要分析。本研究针对现有开放听觉注意解码(Auditory Attention Decoding,AAD)EEG 数据集多采用理想化单一竞争说话者范式、难以覆盖日常交流复杂性的问题,提出 SoundBubble-EEG 数据集。其核心贡献是将注意目标设为动态说话者群体,并在多群体干扰及多种自然化场景下记录 EEG,为研究多说话者语音理解、神经语音追踪和跨场景泛化提供资源。
阅读价值 · SoundBubble-EEG 将 AAD 的研究对象扩展到动态目标说话者群体与多群体干扰,为核对现有算法在自然化多说话者环境中的适用性提供了具体数据资源,但其评估协议与基线结果尚未验证。
首次公开 2026-10-07 · 最新源版本 2026-10-07 · 首次发现 2026-10-09
展开技术分析、元数据与版本记录
基于摘要分析。本研究针对现有开放听觉注意解码(Auditory Attention Decoding,AAD)EEG 数据集多采用理想化单一竞争说话者范式、难以覆盖日常交流复杂性的问题,提出 SoundBubble-EEG 数据集。其核心贡献是将注意目标设为动态说话者群体,并在多群体干扰及多种自然化场景下记录 EEG,为研究多说话者语音理解、神经语音追踪和跨场景泛化提供资源。
作者报告,数据集包含来自 30 名参与者的超过 25 小时、128 通道高密度 EEG 记录。实验要求听者选择性关注指定的目标说话者群体,即“sound bubble”,同时面对其他多说话者干扰群体;场景包括餐厅、家庭观看电视和会议讨论。与摘要所描述的常见单一竞争说话者范式相比,该设计将声学、空间与语义变化纳入任务环境,但具体刺激构建、群体动态变化方式及注意标签定义尚未验证。
作者将该资源定位为现实声学与语义变化条件下的 AAD 基准,并认为其可能支持听觉神经科学和神经引导助听技术的发展。摘要未提供解码算法、数据划分、基线性能或跨场景泛化结果,因此不能据此认定已有方法在这些场景中的有效性,也不能将数据集发布等同于助听技术的临床验证。
复现与评估时需核对 EEG 与语音的同步及预处理方式、目标群体和个体说话者的标签粒度,以及训练与测试在被试、会话、场景和语音材料上的划分关系。数据访问条件、实验协议、消融及统计信息尚未验证;跨场景测试尤其需要明确哪些声学或语义因素发生变化,避免把不同任务难度下的指标直接比较。
- 作者:
- Shu Peng; Rui Liu; Yufei Zhang; Wenlong You; Zhige Chen; Jiachen Xi; Qiyuan Sun; Yan Liu; Kay Chen Tan; Jibin Wu
- 机构:
- 尚未验证
- 发表平台:
- arxiv
- 标识:
- 2610.09539
学术质量 77 / 100 · 兴趣权重 2 · 按原研究证据理解,不推断适用范围
- arxiv · v1 · 2026-10-07 · 预印本
数据与复现预印本基于摘要分析
Towards Financial World Modeling
基于摘要分析。该研究关注金融世界模型所需的状态表征:表征不仅应服务于单项预测,还应支持规划、决策及训练时未知的任务。其贡献包括引入 Market-1T 数据集、制定评估协议,以及大规模比较金融表征学习策略。
阅读价值 · 值得关注其将预测效用与潜在结构探测并行评估的思路:作者报告预测性能相近的编码器可能形成不同的市场状态表征,但这类差异是否影响下游规划以及能否迁移至 EEG 尚未验证。
首次公开 2026-10-06 · 最新源版本 2026-10-06 · 首次发现 2026-10-09
展开技术分析、元数据与版本记录
基于摘要分析。该研究关注金融世界模型所需的状态表征:表征不仅应服务于单项预测,还应支持规划、决策及训练时未知的任务。其贡献包括引入 Market-1T 数据集、制定评估协议,以及大规模比较金融表征学习策略。
数据与评估:作者介绍,Market-1T 包含美国股票在 2008—2025 年间、以 1 Hz 分辨率记录的近一万亿条观测;摘要未明确每条观测的字段或计数单位。研究比较了 18 种编码器训练策略,覆盖近二十年的市场状态变化,并从常见金融任务的预测效用和潜在结构探测两个角度评价表征。具体任务、时间划分、训练数据使用范围、对照配置及统计信息尚未验证。
核心发现:作者报告,预测性能相近的编码器可能以非常不同的方式组织市场状态。这提示单项预测表现不足以完整描述表征结构,但摘要未给出具体指标,也未确认潜在结构差异能否转化为更好的规划或决策表现。作者将该工作定位为支持 DINO-WM、V-JEPA 2 和 LeWM 等世界模型的金融表征训练与评估基础,不应据此视为已验证的完整金融世界模型。
平台推测(待验证):可迁移至 EEG 的主要是评估思路,而非已证实有效的编码器。假设在相近任务性能下,潜在结构探测能揭示不同表征对被试、会话或生理状态的依赖,则可用于补充跨被试、跨会话评估。需将资产与市场状态相关的探测目标改造为 EEG 任务和采集条件相关目标;金融数据的规模及跨资产结构不能直接类比 EEG。低信噪比、通道差异和小样本可能使探测结果主要反映采集条件。一个可检验的小实验是在固定跨被试划分下,对任务性能相近的编码器同时探测任务标签与被试身份,检查其潜在结构差异是否对应泛化差异。相关 EEG 工作尚未检索确认。复现所需的数据访问方式、实现、训练细节及计算资源尚未验证。
- 作者:
- Humzah Merchant; Alec Guthrie; Simon Mahns; Randall Balestriero; Bradford Levy
- 机构:
- 尚未验证
- 发表平台:
- arxiv
- 标识:
- 2610.09048
学术质量 77 / 100 · 兴趣权重 2 · 前沿观察,迁移价值待评估
- arxiv · v1 · 2026-10-06 · 预印本
数据与复现预印本基于摘要分析
MMPostTrainBench: Benchmarking Autonomous Research for Multimodal Post-Training
基于摘要分析。本文研究 LLM agents 能否通过迭代实验与反馈持续改善多模态模型,提出 MMPostTrainBench 基准,并针对能力退化与候选选择问题提出 MMResearch 框架。贡献侧重于评估自主研究过程,而非仅比较最终模型的目标任务表现。
阅读价值 · 该基准将多模态自主研究中的目标任务收益、非目标能力退化与候选模型选择分开评估,值得核对其预算控制和独立评估协议,但摘要不足以确认其对 EEG/BCI 的适用性。
首次公开 2026-10-04 · 最新源版本 2026-10-04 · 首次发现 2026-10-09
展开技术分析、元数据与版本记录
基于摘要分析。本文研究 LLM agents 能否通过迭代实验与反馈持续改善多模态模型,提出 MMPostTrainBench 基准,并针对能力退化与候选选择问题提出 MMResearch 框架。贡献侧重于评估自主研究过程,而非仅比较最终模型的目标任务表现。
MMPostTrainBench 包含八项任务,覆盖图像、音频、视频、联合音视频理解及图像驱动的软件修复。agents 从共同基础模型出发,在固定预算内利用开发阶段反馈开展研究,提交模型后接受独立评估。评估同时考察目标与非目标任务表现、迭代改善、模型选择和研究诚信;具体任务数据、预算单位、数据划分及诚信判定规则尚未验证。
作者报告,在上述八项任务的评估中,52.1% 的“模型—任务”均值低于基础模型,提交模型还出现非目标任务能力退化。作者报告,模型表现未随研究迭代稳定改善,最终提交模型相较于已评估的最佳候选最多落后 5.38 个百分点;摘要未说明该差距对应的具体任务和指标。作者将多模态自主研究的额外困难归结为感知、跨模态对齐及时间定位中的错误。
MMResearch 将基于媒体的证据连接到研究假设与干预,通过层级记忆跨轮次保留发现,并利用开发阶段评估保留候选模型。作者报告,将其加入现有代码 agent 运行环境后,Claude Opus 4.8 配合 Claude Code 的提交模型 Accuracy 最高提高 7.75 个百分点,GPT-5.6-sol 配合 Codex 最高提高 2.33 个百分点。具体任务、对照配置、重复实验、消融及统计信息尚未验证,不能将这些最高增益视为跨任务平均收益。
平台推测(待验证):其过程评估与候选保留机制可能用于 EEG 自动化建模研究,但多模态任务上的收益不等于 EEG/BCI 收益;相关 EEG 工作尚未检索确认。迁移时需另行核对被试隔离、开发反馈使用范围和低信噪比下候选选择的稳定性。
- 作者:
- Yuxin Liu; Yuxuan Wang; Zhenxin Lei; Lingchen Meng; Yuchong Sun; Junming Lin; Hongcheng Liu; Yunfei Chu; Qize Yang; Jin Xu; Lei Zhang; Zhendong Mao
- 机构:
- 尚未验证
- 发表平台:
- arxiv
- 标识:
- 2610.05398
学术质量 77 / 100 · 兴趣权重 2 · 前沿观察,迁移价值待评估
- arxiv · v1 · 2026-10-04 · 预印本
数据与复现预印本基于摘要分析
EntiNeuro: Multi-Entity Visual Decoding and Video Reconstruction from EEG Signals
基于摘要分析。该研究关注动态视觉场景中多个语义实体能否从 EEG 同时解码并用于视频重建,提出多实体视觉解码数据集 EntiNeuro、评估基准 EntiBench,以及分层 EEG 重建框架 EntiRecon。
阅读价值 · 值得阅读的具体原因是其将多实体组合控制、同步 EEG 与眼动记录及实体识别和视频重建评估结合起来,但重建收益的 EEG 与眼动贡献仍需结合全文核对。
首次公开 2026-09-16 · 最新源版本 2026-10-05 · 首次发现 2026-10-09
展开技术分析、元数据与版本记录
基于摘要分析。该研究关注动态视觉场景中多个语义实体能否从 EEG 同时解码并用于视频重建,提出多实体视觉解码数据集 EntiNeuro、评估基准 EntiBench,以及分层 EEG 重建框架 EntiRecon。
数据与任务:EntiNeuro 包含 624 段动态视频,覆盖八种预定义的跨类别实体组合,并采集了 20 名参与者在三个会话中的同步 EEG 与眼动记录。这里的“跨类别组合”描述刺激内容,并非 Cross-dataset 或 Cross-subject 评估协议。EntiBench 用于评估多实体场景中的实体识别与视频重建;具体实体类别、刺激呈现方式、训练测试划分及被试内、跨被试或跨会话评估设置尚未验证。
核心机制:EntiRecon 将粗粒度实体语义与细粒度 EEG 条件结合,并以眼动作为辅助注意引导。其针对的瓶颈是以往 EEG 视觉解码主要聚焦单一主导语义目标或整体场景内容,难以明确评估多个实体的信息保留情况。摘要未说明语义预测模块、重建模型、训练损失、条件注入方式,以及眼动在训练和推理阶段的具体使用边界。
结果与证据:作者报告,实验支持从 EEG 解码多实体语义信息;在本文多实体场景评估中,EntiRecon 相较既有 EEG-to-video 重建方法改善了语义保真度与多实体保真度。摘要未提供指标定义、数值、基线名称或统计信息,因此不能量化收益,也不能判断其跨被试、跨会话泛化能力。
复现时需核对视频及实体组合如何划分、同一刺激是否跨集合出现、EEG 与眼动预处理及同步方式,以及去除眼动引导或改变 EEG 条件后的对照结果,以区分各类输入对重建的贡献。数据、代码与评估脚本的可用性,实验协议、消融及统计信息尚未验证;当前结果应理解为多实体视觉解码与重建的研究证据,而非已验证的通用 BCI 能力。
- 作者:
- 未提供/匿名
- 机构:
- 尚未验证
- 发表平台:
- ICLR 2027 Conference Submission
- 标识:
- BBbDsl4JxS
学术质量 77 / 100 · 兴趣权重 2 · 按原研究证据理解,不推断适用范围
- openreview · 元数据快照 · 2026-10-05 · 预印本
数据与复现状态未知基于摘要分析
ROAMM: A Benchmark Dataset for Multimodal Human Attention Decoding and EEG-to-Text Modeling During Naturalistic Reading
基于摘要分析。该研究针对自然阅读中的心智游移(mind-wandering,MW)检测及 EEG-to-text 建模,提出 Reading Observed At Mindless Moments(ROAMM)多模态数据集,并提供标准化跨被试 MW 检测基准。
阅读价值 · ROAMM 将自然阅读中的同步 EEG、眼动与心智游移标注纳入标准化跨被试评估,值得用于核对注意状态与 EEG-to-text 解码表现的关系,但标注可靠性及具体解码协议尚未验证。
首次公开 2026-04-30 · 最新源版本 2026-09-22 · 首次发现 2026-10-09
展开技术分析、元数据与版本记录
基于摘要分析。该研究针对自然阅读中的心智游移(mind-wandering,MW)检测及 EEG-to-text 建模,提出 Reading Observed At Mindless Moments(ROAMM)多模态数据集,并提供标准化跨被试 MW 检测基准。
数据集包含 44 名参与者在自然、多页阅读过程中采集的共 50 小时同步 EEG 与眼动记录,同时提供眼动事件、页面级理解得分,以及通过回顾性自我报告获得的文本跨度级 MW 标注。这些信息支持联合研究生理信号、阅读行为、理解表现与注意状态,但摘要未说明各类标注的时间对齐方式、跨度定义及回顾性报告的可靠性。
在 MW 检测任务中,作者采用留一被试法(leave-one-subject-out)的 Cross-subject 评估,报告监督模型最高达到 0.609 AUROC;该指标不能解释为 Accuracy。模型类型、输入模态、训练与验证划分细节、对照基线及统计不确定性尚未验证,因此不能据此判断某一种模态或方法的优势。
作者还在带有或不带有 MW 标签的阅读片段上评估 EEG-to-text 解码,并报告 MW 发作期间解码表现下降。摘要未提供具体解码指标、下降幅度或该任务的数据划分协议,亦不足以确认这种关联具有因果解释。
该数据集的直接研究价值在于为自然阅读条件下的 MW 检测、EEG-to-text 解码和多模态表示学习提供共同数据与评估入口。复现前需核对数据获取条件、EEG 与眼动预处理、同步与标注流程,以及 EEG-to-text 的文本目标和评估设置;实验协议、消融及统计信息尚未验证。
- 作者:
- Haorui Sun; Ardyn Vivienne Olszko; Niharika Singh; David C. Jangraw
- 机构:
- 尚未验证
- 发表平台:
- ICML 2026 regular
- 标识:
- zqLPdt09fE
学术质量 77 / 100 · 兴趣权重 2 · 按原研究证据理解,不推断适用范围
- openreview · 元数据快照 · 2026-09-22 · 状态未知
数据与复现预印本基于摘要分析
ML-OPF-Bench: Benchmarking Machine Learning for Optimal Power Flow
基于摘要分析。ML-OPF-Bench 针对最优潮流(Optimal Power Flow,OPF)研究中测试案例、实现与评价指标不一致的问题,为 AC-OPF 和 DC-OPF 提供统一机器学习评估流程。其贡献是同时考察系统规模、分布偏移及资源预算,并用多目标框架评估速度、预测精度与运行可行性之间的权衡。
阅读价值 · 该基准值得阅读的具体原因是将预测精度与约束可行性分开评估,并在分布偏移和资源预算下检验二者的关系;其对 EEG/BCI 评估的借鉴价值尚未验证。
首次公开 2026-10-03 · 最新源版本 2026-10-03 · 首次发现 2026-10-09
展开技术分析、元数据与版本记录
基于摘要分析。ML-OPF-Bench 针对最优潮流(Optimal Power Flow,OPF)研究中测试案例、实现与评价指标不一致的问题,为 AC-OPF 和 DC-OPF 提供统一机器学习评估流程。其贡献是同时考察系统规模、分布偏移及资源预算,并用多目标框架评估速度、预测精度与运行可行性之间的权衡。
评估机制:基准在一致流程下比较代表性 ML 算法,并通过压力测试考察不同工况和资源条件。摘要提及数据规模与计算规模分析,以及强制满足目标约束的后处理,但未给出算法清单、约束处理方式、具体数据构造、划分或多目标排序规则,相关实现尚未验证。
作者报告:在该基准的评估条件下,预测精度不能可靠反映运行可行性;在高负载、拥塞工况中,即使分布内表现较强的方法也会失去优势,可行性主要由约束后处理维持,而非纯 ML 预测器本身。作者还报告,随数据规模变化,预测精度与约束违反呈现不同轨迹;增加计算投入的收益递减,更大模型并不稳定地表现更好。摘要未提供具体数值,实验协议、消融及统计信息尚未验证。
复现条件:作者称已将基准开源为可扩展 Python 包,支持接入新的学习式 OPF 算法并按统一标准评估;当前材料未提供代码地址、依赖、数据获取方式或运行预算,尚不能据此确认复现成本。
平台推测(待验证):可迁移的主要是评估设计,而非电网约束本身。其原问题依赖电力系统工况与明确的运行约束;对应 EEG/BCI 的假设是,分类指标改善未必代表跨被试或跨会话条件下满足预先定义的使用要求。可复用统一流程、分布偏移压力测试和资源预算控制,需重新定义 EEG 任务指标及使用要求;低信噪比、通道差异和小样本可能使多目标比较不稳定。一个小规模可证伪实验是固定模型与划分,比较分布内和跨会话表现,检验 Accuracy 排序是否与预定义的错误率及延迟要求一致;该假设不能视为已证实的 BCI 结论,已有 EEG 相关工作尚未检索确认。
- 作者:
- Xinyi Liu; Xuan He; Danny H. K. Tsang; Yize Chen
- 机构:
- 尚未验证
- 发表平台:
- arxiv
- 标识:
- 2610.04307
学术质量 77 / 100 · 兴趣权重 2 · 前沿观察,迁移价值待评估
- arxiv · v1 · 2026-10-03 · 预印本
数据与复现预印本基于摘要分析
RideBench: A Large-Scale Exogenous-Aware Benchmark for Ride-Hailing Time Series Forecasting
基于摘要分析。该研究针对天气、节假日和大型活动影响下的网约车时间序列预测,发布由 DiDi 市场数据合成的 Ride-Hailing 数据集,并构建外生信息感知预测基准 RideBench,以评估常规及长预测范围下现有方法的适用性。
阅读价值 · 值得阅读其对未来已知外生变量与长预测范围的评估设计,但作者报告的收益尚需结合数据划分、外生信息可用性和具体指标核对,不能直接视为 EEG/BCI 的迁移证据。
首次公开 2026-10-08 · 最新源版本 2026-10-08 · 首次发现 2026-10-09
展开技术分析、元数据与版本记录
基于摘要分析。该研究针对天气、节假日和大型活动影响下的网约车时间序列预测,发布由 DiDi 市场数据合成的 Ride-Hailing 数据集,并构建外生信息感知预测基准 RideBench,以评估常规及长预测范围下现有方法的适用性。
数据与评估:Ride-Hailing 覆盖 200 个空间区域、连续四年的半小时时间序列,包含 Weather Disturbance、Holiday Effect 和 Large-scale Event Impact 三类代表性外生场景。RideBench 设置未来一周预测与未来八周预测,后者最多包含 2,688 个预测步;评估超过 30 种方法,包括仅使用内生信息的模型、外生信息感知模型及时间序列基础模型。摘要未给出数据合成细节、训练与测试划分、具体模型名单及指标定义,这些内容尚未验证。
作者报告:在未来一周预测中,未来已知外生变量带来明显收益,尤其是在天气、节假日及大型活动场景下;但现有外生信息感知模型仍难充分捕捉复杂外部条件引发的模式变化。在未来八周预测中,现有模型难以同时兼顾低逐点误差、准确的整体趋势和可靠的近期预测。摘要未提供具体分数、对照差值或统计不确定性,不能据此量化收益或排序模型;实验协议、消融及统计信息尚未验证。
平台推测(待验证):其可借鉴价值主要在评估设计,而非已证实的 EEG 算法。假设任务日程等真正提前可知的上下文能够帮助 EEG 状态预测,可复用“内生信息与外生信息分开对照”的思路;但需改造空间区域与半小时序列的组织方式,以适配被试、通道和 EEG 时间尺度。低信噪比、跨被试差异及小数据可能削弱收益。一个可证伪的小实验是在固定跨会话划分下,对比同一预测模型使用或不使用预先确定的任务日程,核对不同预测范围的误差,并确保外生信息在预测时确实可用。该假设不等于已验证的 BCI 效果,已有 EEG 相关工作尚未检索确认。
- 作者:
- Shengsheng Lin; Jing Hu; Zhengyang Hu; Jiazheng Sun; Zichun Cao; Siwei Sun; Zhichao Zou; Enyun Yu; Dongdong Li; Xinyi Hu; Weiwei Lin
- 机构:
- 尚未验证
- 发表平台:
- arxiv
- 标识:
- 2610.11164
学术质量 76 / 100 · 兴趣权重 2 · 前沿观察,迁移价值待评估
- arxiv · v1 · 2026-10-08 · 预印本
数据与复现预印本基于摘要分析
GNN-CB: A Graph Neural Network Competition Benchmark for Human and LLM Evaluation
基于摘要分析。该研究关注 LLM 能否在真实竞赛约束下自主完成端到端 Graph Neural Network(GNN)编程任务,提出面向人类与 LLM 的竞赛基准 GNN-CB。其贡献是将多种图学习任务纳入统一自动评估流程,并提供可复现执行管线;作者将其称为首个此类竞赛基准,该优先性尚未独立核验。
阅读价值 · 值得阅读其隐藏测试集、统一评分及受限执行修复协议如何支持人类与 LLM 的 GNN 编程能力比较,但具体公平性与可复现性仍需核对全文。
首次公开 2026-10-04 · 最新源版本 2026-10-04 · 首次发现 2026-10-09
展开技术分析、元数据与版本记录
基于摘要分析。该研究关注 LLM 能否在真实竞赛约束下自主完成端到端 Graph Neural Network(GNN)编程任务,提出面向人类与 LLM 的竞赛基准 GNN-CB。其贡献是将多种图学习任务纳入统一自动评估流程,并提供可复现执行管线;作者将其称为首个此类竞赛基准,该优先性尚未独立核验。
任务与协议:GNN-CB 包含 18 个经过整理的竞赛,覆盖节点级、边级和图级预测,以及不同图类别、领域和难度层级。提交通过隐藏测试集与标准化评分进行评估。人类参与者在受控竞赛约束下完成任务;LLM 使用固定的零样本提示协议,采用 plan-then-code 范式,并允许次数受限的 execute-and-repair 循环。同一协议还支持非智能体与自主智能体评估,但摘要未说明其工具权限、执行预算及具体差异。
结果:作者报告,在所评估协议下,LLM 很少达到 Human Top 表现,且跨竞赛表现较不稳定;没有单一模型在所有任务上占优,LLM 在少数竞赛中获胜,而人类在多数任务上保持最高分。摘要未提供模型名单、各任务指标、分数或重复运行统计,因此不能量化差距,也不能将这些结论推广到其他提示与资源预算。具体数据集、训练与测试划分、人类参与者构成、消融及统计信息尚未验证。
复现与适用范围:作者表示已公开基准及评估框架,并提供自动评估基础设施、动态排行榜和可复现执行管线;环境依赖与版本固定方式仍需核对。该材料评估的是图学习编程能力,而非 EEG/BCI 任务效果。平台推测(待验证):其隐藏测试与受限执行协议可作为未来 EEG 图学习编程评估的设计参考,但需另行定义被试划分、图构建规则和工具预算,不能据此推断 LLM 具备跨被试建模能力;已有 EEG 相关工作尚未检索确认。
- 作者:
- Murad Hossen; Tasneem Selim; Gurur Gamgam; Tuga Yousif; Abderrahmane Kasmi; Ikram Aissiou; Mubaraq Onipede; Faran Taimoor Butt; Sanae Zrigui; Rosa Y. G. Paccotacya-Yanque; Ignatius Balayo; Ikram Elhouiti; Hadil Affes; Bijay Adhikari; Sargam Goyal; Muhammad Ibrahim Isah; Mohammad Idrees Bhat; Samuel Kangoni Matia; Peguy Kem-Meka Tiotsop Kadzue; Maha Trabelsi; Emmanuel Owusu; Vinit; Nour Majdoub; Tamiru Alemnew; Islem Rekik
- 机构:
- 尚未验证
- 发表平台:
- arxiv
- 标识:
- 2610.05387
学术质量 76 / 100 · 兴趣权重 2 · 按原研究证据理解,不推断适用范围
- arxiv · v1 · 2026-10-04 · 预印本
数据与复现预印本基于摘要分析
CoEEG: Benchmarking Collaborative Learning in EEG Decoding
基于摘要分析。CoEEG 针对 EEG 解码中的被试间差异、单用户标注稀缺及隐私限制下的数据分散问题,构建联合比较模型与协作学习协议的基准。其贡献是将 MI(运动想象)、SSVEP、P300 三种范式、不同模型家族及共享边界放入统一评估框架,而非将协作学习视为普遍有效的训练方案。
阅读价值 · CoEEG 将 EEG 范式、模型家族与参数共享边界纳入同一评估框架,值得核对其协作收益、弱势客户端表现及通信成本之间的权衡,但具体协议与统计可靠性尚未验证。
首次公开 2026-09-05 · 最新源版本 2026-10-05 · 首次发现 2026-10-09
展开技术分析、元数据与版本记录
基于摘要分析。CoEEG 针对 EEG 解码中的被试间差异、单用户标注稀缺及隐私限制下的数据分散问题,构建联合比较模型与协作学习协议的基准。其贡献是将 MI(运动想象)、SSVEP、P300 三种范式、不同模型家族及共享边界放入统一评估框架,而非将协作学习视为普遍有效的训练方案。
基准覆盖具有范式特定先验的传统机器学习模型、从头训练的深度模型及 EEG 基础模型,共比较十种模型和四种涵盖非协作与协作训练的协议。摘要未给出协议名称、客户端构成、具体数据集或被试划分,不能据此判定结果属于何种 Within-subject、Cross-subject 或 Cross-session 设置。
作者报告,SSVEP 中十种模型有九种从协作中获益,并将这一现象解释为被试间决策边界较为共享;P300 中,只有各客户端保留私有分类头时,所有模型才均获益;MI 的收益则集中于独立训练表现较差的模型。在六个联邦评估组合中,从头训练模型家族的平均表现更高,但某个基础模型在其中两个组合取得单模型最佳成绩;摘要未说明这些组合的定义及对应指标。
作者以测得的表征对齐程度和推断的决策边界共享程度解释共享边界的作用,并报告私有分类头在 MI 中产生分化,未改善最弱客户端。摘要还报告 SSVEP 中最弱客户端下降 20.7 个百分点、最强客户端下降 9.3 个百分点,但对应指标、参照协议与客户端分组方式尚未验证,不能据此推导绝对表现。
作者报告,纳入参数量、内存及通信后,轻量模型在多数设置中具有更好的性能—成本权衡,最大基础模型的传输量最高达 378.73 GiB;该数值对应的训练轮次、统计范围及通信方向尚未验证。复现时应重点核对共享与私有模块、客户端数据划分、弱势客户端定义和成本核算口径;实验协议、消融及统计信息尚未验证。
- 作者:
- 未提供/匿名
- 机构:
- 尚未验证
- 发表平台:
- ICLR 2027 Conference Submission
- 标识:
- Txxd5YsX8h
学术质量 76 / 100 · 兴趣权重 2 · 按原研究证据理解,不推断适用范围
- openreview · 元数据快照 · 2026-10-05 · 预印本
数据与复现状态未知基于摘要分析
CineBrain: A Large-Scale Multi-Modal Brain Dataset During Naturalistic Audiovisual Narrative Processing
基于摘要分析。该研究面向自然视听叙事加工与刺激重建,发布同步采集 EEG 和 fMRI 的 CineBrain 数据集,并提出多模态解码框架 CineSync 与重建评估协议 Cine-Benchmark。主要研究对象是动态视听刺激下的脑信号及其多模态重建,而非运动想象或其他传统 BCI 分类任务。
阅读价值 · 同步 EEG–fMRI 自然叙事数据及语义、感知双维度重建评估值得核对,尤其可用于研究两类信号的互补贡献,但融合收益及基准划分仍需全文验证。
首次公开 2025-01-01 · 最新源版本 2026-07-22 · 首次发现 2026-10-09
展开技术分析、元数据与版本记录
基于摘要分析。该研究面向自然视听叙事加工与刺激重建,发布同步采集 EEG 和 fMRI 的 CineBrain 数据集,并提出多模态解码框架 CineSync 与重建评估协议 Cine-Benchmark。主要研究对象是动态视听刺激下的脑信号及其多模态重建,而非运动想象或其他传统 BCI 分类任务。
数据方面,摘要称每位参与者观看来自电视剧 The Big Bang Theory 的约六小时叙事内容,共六名参与者;不能据此将内容时长直接等同于最终可用记录时长。作者将 CineBrain 称为首个在动态视听刺激下同步记录 EEG 和 fMRI 的大规模数据集,该优先性主张尚未独立核实。其设计利用 EEG 的高时间分辨率与 fMRI 的深部脑区空间覆盖形成互补。
方法方面,CineSync 结合 Multi-Modal Fusion Encoder 与基于扩散的 Neural Latent Decoder,用于融合 EEG、fMRI 并重建复杂视听刺激。摘要未说明时间对齐、血流动力学延迟处理、信号预处理、训练损失或扩散模型的条件输入方式,相关实现尚未验证。Cine-Benchmark 从语义与感知维度评估重建,但具体指标与评估流程尚未提供。
作者报告,CineSync 改善了复杂视听刺激的重建质量,并在其采用的评估条件下达到最先进的视频重建表现,同时初步实现了结合 EEG 与 fMRI 的视频及音频重建。摘要未给出具体分数、对照方法或被试内、跨被试及跨会话划分,因此目前不能量化融合收益或判断泛化能力。
复现时应核对数据开放与刺激使用条件、同步采集下的 EEG 伪迹处理、训练与测试的叙事片段划分,以及 EEG 单模态、fMRI 单模态和融合模型的对照。六名参与者的样本范围也需纳入泛化评估。实验协议、消融及统计信息尚未验证;摘要列有项目页,但数据、代码与模型权重的实际可获取性尚未验证。该工作不能直接作为仅依赖 EEG 的 BCI 重建效果证据。
- 作者:
- Jianxiong Gao; Yichang Liu; Baofeng Yang; Jianfeng Feng; Yanwei Fu
- 机构:
- 尚未验证
- 发表平台:
- CoRR 2025
- 标识:
- eB38SKcn6U
学术质量 76 / 100 · 兴趣权重 2 · 按原研究证据理解,不推断适用范围
- openreview · 元数据快照 · 2026-07-22 · 状态未知
数据与复现预印本基于摘要分析
Grounded in Time: A Multi-Source Dataset and Benchmark for Temporal Grounding in Robotic Manipulation
基于摘要分析。该研究面向机器人操作中仅凭当前观测无法确定适当动作的问题,提出 GiT(Grounded in Time)数据集与基准,用于评估模型能否依据过去事件推断任务相关状态并作出操作决策。其贡献是将依赖历史的语义推断纳入生物实验室、家庭与工业场景的策略学习和评估。
阅读价值 · GiT 通过当前观测相似但历史事件不同的反事实任务对检验策略是否真正利用历史,值得阅读其标注与评估协议;对 EEG/BCI 的迁移价值尚未验证。
首次公开 2026-10-03 · 最新源版本 2026-10-03 · 首次发现 2026-10-09
展开技术分析、元数据与版本记录
基于摘要分析。该研究面向机器人操作中仅凭当前观测无法确定适当动作的问题,提出 GiT(Grounded in Time)数据集与基准,用于评估模型能否依据过去事件推断任务相关状态并作出操作决策。其贡献是将依赖历史的语义推断纳入生物实验室、家庭与工业场景的策略学习和评估。
数据与机制:GiT 包含覆盖 18 项双臂任务的真实机器人及 Universal Manipulation Interface(UMI)风格示范,另提供仿真数据和覆盖九项任务的 ManiSkill 评估套件。细粒度子任务标注支持策略学习;带标注的反事实任务对使相似当前观测因先前事件不同而对应不同动作,为检验模型对历史的利用提供针对性条件。摘要未说明历史输入形式、记忆模块、训练损失或数据规模。
结果与核对事项:作者报告,对代表性端到端 vision-language-action(VLA)模型的仿真评估及部分真实任务评估显示,依赖历史的操作能力仍有较大改进空间。摘要未提供具体指标、分数、模型名称或数据划分,因而不能量化差距或比较模型优劣。实验协议、消融及统计信息尚未验证;复现需核对任务划分、反事实配对规则、历史窗口及真实与仿真评估条件。作者称数据集与基准已在项目页面提供,具体资源内容尚未核验。
平台推测(待验证):可迁移的是“当前证据相近、历史上下文不同”的评估设计,而非直接将机器人数据用于 EEG。假设某类 EEG/BCI 任务的正确决策确实依赖先前提示或交互状态,可构造匹配当前输入、改变历史上下文的配对测试,对比无历史、真实历史与打乱历史条件。需重新定义 EEG 输入、上下文标注和目标,且低信噪比、跨被试差异及小样本可能使模型依赖伪相关;历史提示也可能被利用而非 EEG 本身,因此需单独核对各信息源的贡献。已有 EEG 相关工作尚未检索确认。
- 作者:
- Yi Wang; Yang Yang; Guangqi Xu; Sumin Lin; Ning Kang; Pengxiang Lu; Xiaotong Chen; Zeyu Xue; Ping Deng; Xing Liu; Chenguang Yang; Zhenyu Lu
- 机构:
- 尚未验证
- 发表平台:
- arxiv
- 标识:
- 2610.04255
学术质量 76 / 100 · 兴趣权重 2 · 按原研究证据理解,不推断适用范围
- arxiv · v1 · 2026-10-03 · 预印本