跳到正文

算法、任务与模态

Multi-branch 最新动态

Multi-branch 研究索引;按可核对的标签归档,不以热度评价质量。

2 条精选近 30 天 2 条共收录 2 条

更新

Multi-branch的精选

10月3日周六第 1–2 条
  1. arXiv · 表征与预训练82

    定格于一帧:JEPA 世界模型的速度盲区

    基于摘要分析。本文研究 JEPA 世界模型以单帧嵌入作为预测目标时的速度可辨识性问题,提出三阶段诊断协议 RateIdent,以及将潜变量分为姿态编码和显式有限差分运动编码、并联合预测的 TI-JEPA。 核心机制:作者指出,在无运动模糊、图像仅由场景配置决定的渲染条件下,单帧无法区分同一配置下的不同速度,因此编码器也不能从该帧恢复速度。该论证针对特定观测生成条件,不宜直接推广至含运动模糊或其他运动线索的图像。TI-JEPA 通过有限差分引入时间变化信息,作者称其无需特权监督;具体差分对象、训练损失与 RateIdent 各阶段操作尚未验证。 作者报告,在 PushT、Reacher、Cube、TwoRoom 四个基准的官方检查点上,所有线性速度探针表现均处于或低于机会水平,而位置探针的 R² 约为 0.95。在线性探针协议之外能否提取速度,以及机会水平的定义,需核对正文。作者还报告,在三个具有物理动力学的环境中,TI-JEPA 相比匹配记忆基线,在到达目标并停止的规划任务上获得跨随机种子的显著改进:Pendulum 最终距离降低 55%(p=3.2×10^-10),CartPole 降低 64%(p=5.1×10^-15)。摘要称该结果在官方 ViT-Tiny 与 AdaLN-transformer 规模下得到复现;从头训练的真实 dm_control Reacher 图像实验中,分支分离程度约为具备记忆基线的 38 倍,但该指标定义尚未验证。相较相同模型规模的循环 RSSM 风格预测器,作者报告 TI-JEPA 在三个环境中的两个上达到或超过其 rollout 准确性,并保留姿态与运动的独立可探测性。实验划分、消融及统计信息尚未验证。 平台推测(待验证):可检验的迁移假设是,将 EEG 的窗口状态与跨窗口变化显式分离,可能改善动态状态预测;但 EEG 并非配置到图像的确定性渲染,原文的不可辨识性论证不能直接迁移。可复用编码分离思路,需改造时间差分尺度与观测编码;低信噪比、被试差异、通道变化及小数据可能使差分分支放大噪声。小规模实验可在相同输入历史和参数预算下比较分离编码与记忆基线的下一窗口预测误差,并检验跨被试稳定性。相关 EEG 工作尚未检索确认。

    阅读价值:值得核对其单帧表征无法辨识速度的适用条件,并复现 TI-JEPA 相对匹配记忆基线的改进,以区分运动信息缺失与预测器能力不足。

  2. arXiv · 表征与预训练76

    通过表征多样性与多分支架构扩展无线基础模型

    基于摘要分析。该研究关注预训练数据有限时,扩大无线基础模型容量未必稳定改善下游表现的问题,提出将自监督目标多样性作为另一条扩展路径:通过组合重建、预测与对比学习所强调的不同信号属性,支持多种下游任务。 方法包含两个阶段:首先融合由不同目标独立训练的编码器所产生的冻结表征,以检验目标互补性的收益,但这需要维护多个编码器;随后设计联合训练的多分支架构,以共享主干和目标专属分支,在标准单目标编码器的参数预算内保留多目标收益。摘要未给出具体损失、融合方式、分支结构及训练配比。 作者在包含 spectrogram 与 channel state information 的异构语料上预训练,并评估覆盖通信、感知和定位的六项下游任务。作者报告,在输出嵌入维度相同的条件下,融合方法在全部六项任务上优于所评估的单目标编码器,参数量约为其三分之一;这一参数比例的统计口径需查阅全文核对。作者报告,多分支架构在单编码器参数预算内保留了大部分融合收益。表征分析显示不同目标具有互补贡献,新增收益中相当一部分保留于与重建表征子空间正交的成分。具体数据集、划分、指标、对照配置、消融及统计信息尚未验证。 平台推测(待验证):其可迁移假设是,重建、预测与对比目标可能分别保留 EEG 中不同的时频和判别信息,为有限数据下单一预训练目标的信息偏向提供补充。可复用的是共享主干、目标专属分支及表征互补性分析;需改造的是 EEG 输入表征、预测任务和对比样本构造,并确认所用无标签数据规模足以支撑联合训练。低信噪比可能使重建目标保留伪迹,跨被试及通道差异可能引入非任务信息,小数据下也可能出现目标冲突。可检验的小实验是在固定 EEG 数据划分、参数预算、嵌入维度及下游评估协议下,比较单目标编码器与多目标多分支模型,并检验增益是否伴随互补表征,而非仅来自训练投入变化。已有 EEG 相关工作尚未检索确认。

    阅读价值:该研究通过冻结表征融合与共享主干多分支架构两条路径检验自监督目标多样性的价值,值得核对其参数统计、任务评估与表征互补性分析,但迁移至 EEG 的收益尚未验证。