/ EN

arXiv

50 条
2026 年 9 月

iMINDBench 发布:跨机构颅内脑电解码有了统一考卷

颅内脑电信号来自植入大脑内部的电极,一直被看作解码人的意图的理想信号来源,但各家数据集和预处理方式不同,模型到底有没有变好很难说清。研究团队把三家机构的自然观影数据、15项解码任务、统一的预处理流程和固定的评估划分放进同一个基准,结果发现:预训练系统在自己那套预处理流程里通常能赢过基线,可换到别的机构数据上,传统频谱基线的表现依然有竞争力。更值得注意的是,把其他受试者或其他机构的数据增加到25倍,相比只用同一场次数据训练,提升依然有限,甚至要看具体任务。

预训练让脑机接口解码器少用九成以上标注数据

训练一个能读懂大脑信号的解码器,通常要为每一位新受试者重新采集大量带标注的数据,这既费时,对患者也是负担。这项研究提出的MAPA方法先用跨受试者累积的未标注颅内脑电记录做自监督预训练,再迁移到新受试者身上。难点在于颅内脑电的电极触点位置和神经解剖结构因人而异,MAPA在常规掩码自编码器上加了两种空间编码——解剖区域嵌入和相对位置编码。在跨受试者测试中,只需约164次带标注的试验就能达到原本需要3500次才能达到的准确率。研究团队称,MAPA在Neuroprobe基准的会话内、跨会话和跨受试者三种模式下都刷新了最好成绩,且无需微调。这意味着未来植入式脑机接口的校准过程可能大幅缩短。

用核磁数据约束脑电解码,单指动作识别准确率提升至74.53%

手指在大脑运动皮层里的代表区挨得很近,从头皮脑电里分辨单根手指的动作一直很难。研究团队先用同步采集的脑电与功能核磁数据学出一套频谱投影,再用核磁给出的类别几何结构去修正脑电预测。12名健康受试者的测试中,两分类动作执行的组平均准确率从66.93%升到74.53%,三分类从44.83%升到56.58%;运动想象任务上两分类从80.78%升到85.63%。推理阶段只用脑电,不需要配对的核磁数据。

随机森林算法识别真实与想象动作,消费级脑电也能用

受试者做动作和只在脑中想象动作,脑电信号能不能被机器分开?一项预印本研究用随机森林算法在消费级和研究级脑电系统上做了测试,结果显示算法能区分两类活动,还能判断出对应的是身体哪个部位。脑电是理解大脑与人体运动相关电活动的基础工具,脑机接口正是利用这类电活动开发辅助技术,尤其是面向身体残障人士的技术;但从脑电信号中提取特征和模式仍然复杂,因此常交由机器学习算法处理。研究同时指出,不同人之间的脑电差异会拖累分类准确率——这意味着同一套模型换个人用,效果可能就打折扣。该研究为预印本,尚未经同行评审。

P300拼写器并非组件越多越好,四组件全因子试验揭示反协同效应

P300脑机接口拼写器常被设计成把多个各自有效的组件全部打开,默认组件越多性能越好。一项预印本研究用四组件全因子试验检验了这个假设:组件的价值是有条件的,而不是可叠加的。受试者校准是最强的单一贡献者;欧几里得对齐能在零校准设置下弥补校准的缺失;把各自有用的组件叠加起来反而可能拉低性能,作者称之为组件反协同。语言模型的支持也并非普遍有益,其效果强烈依赖底层脑电流水线的强度。

乘客脑电帮自动驾驶AI提前识别风险,模型平衡准确率95.3%

研究者让乘客在高度自动化车辆中观看驾驶场景,同时记录脑电信号,训练模型判断前方是否存在风险以及危险出现在哪里。3D-CRNN在风险预测任务上达到95.3%±2.7%的平衡准确率,危险识别从80.9%提升到85.0%;跨被试测试中,模型对未见过乘客的平衡准确率降至64.9%±8.5%,说明离实际部署仍有距离。

联邦学习框架NEXUS-MI把运动想象脑机接口骨干网流量降低约42%

运动想象脑机接口的个体差异大,校准数据少,联邦学习能在不上传原始脑电的前提下共享模型。这个框架把网关同步当作学习与通信的联合控制问题:原始脑电和分类头留在本地,边缘协调器维护共享骨干网络。在BCICIV-2a和OpenBMI两个数据集上,通信感知协调把服务器到客户端的骨干网流量减少约42%,队列平均准确率差异很小且随实现而变。但平均值掩盖了个体脆弱性,BCICIV-2a上相对理想链路参考的损失最高约12个百分点。

生成式AI拉低攻击门槛,脑机接口风险触及认知自主权

研究团队把脑机接口的攻击面拆成五个方向:伪造神经信号、靠去同步规避检测、重放劫持、窃听(Vein Tapping)和嵌入式后门。他们用自建的EEGle框架跑出17个新的神经特异性攻击实例,并发现后门设计存在一条隐蔽性与有效性的取舍曲线。研究还指出,生成式AI正在拉低非专业攻击者的门槛。该研究为预印本,尚未经同行评审,作者为Zahra Tarkhani、Georgios Akkogiounoglou、Lorena Qendro、Isabel Tscherniak和Anil Madhavapeddy。论文把这一攻击类别命名为NERVE Attacks,称五个维度相互正交,合起来覆盖完整的脑机接口技术栈。团队将EEGle提供给社区,用于构建和验证这类设备的安防能力,并把风险概括为认知自主权、心理隐私和人身安全三点,具体情形包括神经数据外泄,以及脑机接口所连接的外部设备被恶意控制。

升温不能超过1摄氏度,10毫瓦通信预算撑不起千通道脑接口

植入式脑机接口要从实验室样机走向长期临床系统,就得在几毫米到几厘米深的脑组织里塞进数千到数百万根电极,同时不把组织加热超过1摄氏度。该综述把感应、中场、射频、超声、磁电、光学、超宽带和电准静态等无线链路放在深度、尺寸、数据率三个临床坐标上比较。作者指出,几乎所有临床相关植入体都工作在弱耦合状态,耦合系数只有10的负3次方到10的负1次方。结论是:在约10毫瓦的通信预算下,窄带高Q链路适合供电和低速数据,但每比特1到10纳焦耳的能效撑不起千通道以上接口所需的10兆比特每秒到数十吉比特每秒上行速率。该研究为预印本,尚未经同行评审。

微调降到10分钟,PNPL竞赛让脑机语音适配进入临床可行范围

一项于2026年9月3日上传至arXiv的预印本公布了2026年PNPL竞赛的任务设定。该竞赛基于扩展的LibriBrain100数据集,包含32名新增被试,每人约40分钟数据,并新增约80小时的个体内数据。竞赛设2个赛道,Deep赛道关注个体内词分类,追求最佳性能;Broad赛道关注跨被试泛化,将个体微调数据从约40分钟逐步减少至20分钟、10分钟,接近临床可行范围。2025年竞赛的获胜者在语音检测和音素分类任务上分别达到95.6%和73.6%的F1分数。该预印本未经同行评审。

脑电信号提前预判决策正确性,高负荷下团队准确率升至88%

一项预印本研究显示,从脑电图(EEG)提取的空间协方差特征能在操作员做出反应前预判其决策是否正确,且该信号在高认知负荷下有效。在虚拟现实目标检测任务中,23名参与者分别在高、低负荷条件下操作。当团队规模从2人增至16人时,利用该神经信号对投票加权,使争议试验的准确率从57%提升至88%;但在低负荷下反而有害。研究指出,基于EEG的决策可靠性信号并非通用的团队增强工具,而是依赖于工作负荷的条件性信号,这对协作脑机接口系统在实际团队中的部署时机与方式具有参考意义。该预印本上传至arXiv,尚未经过同行评审。

逐层对比学习挑出神经可见层,脑电图像检索准确率升至86.4%

一项预印本研究提出,通过逐层对比学习选择CLIP模型的中间层作为神经可见性最优层(NVOL),可改善脑电(EEG)信号与图像语义特征之间的跨模态对齐。在THINGS-EEG数据集上,基于NVOL的200-way图像检索平均Top-1准确率达78.1%,结合CSLS后升至86.4%。该框架还把检索与生成耦合,利用条件扩散先验重建受试者特异的NVOL特征,再映射至CLIP空间驱动Stable Diffusion XL生成图像,在语义与结构指标上优于单阶段末层扩散。该研究2026年9月2日上传至arXiv,尚未经同行评审。

语音脑机接口缺少统一度量,新指标OVMI让不同系统可比

语音脑机接口(speech BCI)将神经活动转化为语言,有望帮助瘫痪患者恢复沟通。然而,由于不同系统使用不同的数据集、记录方法、语音类型和词汇表,其报告的准确率等指标难以直接比较。研究人员提出开放词汇互信息(OVMI),一种信息论度量,用于在统一尺度上评估不同系统的通信能力。研究表明,仅基于系统支持词汇计算的准确率等常规指标可能高估系统传达用户意图语音的能力。通过选择最大化OVMI的词汇,在3个语音领域中实现了最高16.3%的相对准确率提升。该研究以预印本形式发布于arXiv,尚未经过同行评审。

脑机接口评估不能只看解码准确率,慢快框架把控制权交还时机列为指标

人工智能正把脑机接口从特定任务的神经解码器变成能补全语言、平滑运动、调节康复支持并调整刺激的自适应系统。一位独立研究者警告,这类系统可能过度优化短期成功指标,偏离用户的长期目标。该研究者将这种闭环失效模式定义为“神经适应过拟合”,并提出按解码器证据、不确定性、临床风险、疲劳及用户目标来调节AI辅助节奏的框架,区分快速辅助、谨慎辅助与慢速辅助,覆盖通信、运动控制、神经康复和闭环神经调控等应用。文章强调,评估此类系统不应只看解码准确率和任务表现,还要看AI辅助何时自主行动、何时寻求确认、何时保留用户努力或交还控制权。

按单条样本挑选脑电基础模型,7个公开基准逼近理想上界

一支研究团队在arXiv上传预印本,提出名为EEG-AS的实例级算法选择框架,把脑电基础模型的挑选问题下沉到单条样本一级。近年脑电基础模型在各类神经解码任务上表现见长,但没有任何一个能在所有数据集、所有样本上稳居最优,而逐样本选模型这一环此前少有人做。EEG-AS用推理阶段即可获得的脑电潜在表征、手工神经生理特征以及一个锚定基础模型刻画每条样本,训练阶段学习从特权预测标记中重建其余模型不可得的行为,推理阶段直接估计这些行为,不必把候选模型逐个跑完,即可在7个脑电基础模型之间完成挑选。研究者称,公开脑电基准上的实验显示,该框架显著缩小了单最佳求解器与逐样本理想上界之间的差距。该文为预印本,尚未经过同行评审。
2026 年 8 月

超100小时脑磁图数据开放:LibriBrain100加速非侵入式语音解码研究

一个名为LibriBrain100的大型脑磁图(MEG)数据集于2026年8月25日发布,包含超过100小时的高质量数据,其中约80小时来自单一受试者,创下同类数据集中个体内数据深度的新纪录。该数据集旨在为神经语音解码研究提供标准化评估基准,并附带开源工具和在线竞赛。研究团队利用现有解码模型在词分类基准上取得了最先进性能,验证了数据质量和大规模个体内数据的价值。此外,数据集还包含32名受试者每人约40分钟的额外数据,以补偿个体数据不足。

眼动加运动想象混合脑机接口,16通道脑电下准确率达100%

运动想象脑机接口一直有两个老问题:不同人之间差别大,能分出的指令少。这项研究让使用者先用眼睛看目标完成选择,再用想象动作确认,把两步合成一步。15名健康参与者、16通道脑电的测试中,混合范式在所有通道配置下都优于单纯运动想象,最高准确率达到100%。研究还发现,注视目标本身能让脑电反应更稳定,这为减少电极数量、降低设备门槛提供了依据。

运动想象解码在线自适应有新法,MRieHy三个数据集超现有最优

研究者提出多特征黎曼超图框架MRieHy,面向运动想象脑机接口解码的在线测试时自适应。框架先以跨天训练数据的协方差矩阵黎曼均值对齐多日分布,再分别以黎曼距离和余弦相似度构建协方差矩阵超图与深度特征超图,经自适应权重融合并与标签投影矩阵联合优化。在线测试时,MRieHy维护近期样本的先进先出缓冲,对缓冲数据执行黎曼对齐后解码。实验在私有四类ECoG数据集与两个公开四类EEG数据集上验证,MRieHy较现有最优基线取得明显性能提升,研究者认为该方法可改善临床运动想象脑机接口的跨天可迁移性与在线运行能力。

首个脑电生成全身运动数据集发布,近2万对样本覆盖数千动作

研究者提出首个用于人体运动合成的脑电-运动-文本数据集EEG2MOTION,含近20,000对配对样本,覆盖数千种动作,并配套开发生成框架EMMM,将脑电编码器与运动解码器结合,直接从非侵入脑电信号生成连贯、逼真的全身运动序列。研究通过多模态对比学习显示,非侵入脑电嵌入可有效与文本、视频和运动表征对齐,以解码高层语义。研究者称这是首个从非侵入脑信号生成多样化全身运动的工作,为非侵入脑机接口走向生成式交互提供了新方向。

两网络接力解码运动想象脑电,两个数据集上表现稳健

该预印本2026年8月13日上传至arXiv,提出一种把卷积神经网络与双向长短期记忆网络结合的混合深度学习架构,用于运动想象脑电信号解码。研究者指出,运动想象脑机接口被视为在大脑与外部设备之间建立灵活通信通路的可行途径,但脑电记录噪声大、与底层脑活动的关系复杂,可靠解码始终困难。在该架构中,卷积网络直接从原始运动想象脑电中学习高层空间与时间表征,双向长短期记忆网络则对所提取特征之间的时间依赖关系建模。研究者在一个公开数据集和一个自行采集的数据集上评估该方法,报告其在二分类与三分类运动想象任务中均表现稳健,并展现出跨被试解码的潜力。该研究为预印本,尚未经过同行评审。

在线脑电类别失衡不再拖垮对齐,OSPDIM纠正几何偏斜

一项预印本研究提出OSPDIM,一种面向在线EEG脑机接口类不平衡标签偏移的无源在线无监督域适应框架。研究指出,黎曼对齐方法(如黎曼中心化变换)在处理协变量偏移时有效,但隐含假设类别先验平衡;实际在线场景中标签分布动态变化,会使标准对齐技术在几何上错位目标数据分布。OSPDIM在黎曼流形的切空间映射中引入流形约束偏置参数,通过信息最大化优化以纠正不平衡数据流造成的几何偏斜,并在线估计与修正几何偏置而非依赖全局批统计。2D SPD矩阵仿真显示OSPDIM可纠正标准中心化失效的错位;在多个运动想象数据集上,OSPDIM显著优于标准黎曼基线,尤其在线场景中。该研究为预印本,尚未经过同行评审。

行为数据先热身,神经解码用一成校准数据顶全量训练

一项预印本研究提出NeuroPB,一种通过预训练行为表征迁移来扩展神经解码规模的框架,先在大规模运动行为数据上预训练运动编码器,再以有限配对神经-行为记录将神经活动对齐到行为表征空间,随后优化神经编码器与轻量运动解码器以重建连续运动。研究者称,在多个猕猴运动数据集上,行为预训练使center-out轨迹解码R²提升11%、随机目标任务提升8%,且用机器人轨迹预训练可达到与猕猴轨迹相当的性能;固定神经数据量时性能随预训练数据规模增加而提升,仅需10%校准即可匹配从头训练。该研究为预印本,尚未经过同行评审。

EEG-fNIRS融合解码想象手写,FRED总体准确率0.7952而fNIRS单独解码处于随机水平

研究者称,用于想象手写解码的EEG-fNIRS融合框架FRED于2026年8月4日以预印本形式上传至arXiv,尚未经过同行评审。想象手写是非侵入式神经解码的时间丰富范式,EEG-fNIRS融合承诺互补神经信息,但融合通常是启发式的,缺乏对频段冗余的原则性处理。FRED用频率去相关时间集成做想象手写解码。研究者称,集成在公开、私有与总体测试分区上达到0.8076/0.7242/0.7492的准确率,无需测试集适配或输出约束,完整系统达到0.8498/0.7718/0.7952并在私有分区排名第4;模态审计发现fNIRS单独解码处于随机水平(总体0.2511),把fNIRS加到EEG上准确率仅变化+0.0025。

双模块轻量级架构让EEG实时步态解码端到端延迟达70.5ms

该预印本提出一种用于实时EEG步态解码的双模块轻量级架构,旨在实现下肢外骨骼的闭环控制。研究者称,现有基于EEG的闭环控制受运动伪影和低信噪比限制,其双模块设计将任务拆分,前端PolyTVL将32通道EEG压缩为紧凑表示,后端LSTM对4个步态相位(站立、启动、执行、终止)进行分类。研究显示,闭环部署中v01(PolyTVL+LSTM)的步态启动成功率为55.3%(Rex辅助)和52.7%(自主),平均端到端处理时间70.5ms(±41.5)。作者称该手稿已被IEEE MLSP 2026接收发表。

EEG引导目标说话人提取应对试验内注意切换,SAGE的SI-SDR达8.67dB切换延迟2.04秒

研究者称,EEG引导的目标说话人提取框架SAGE于2026年8月3日以预印本形式上传至arXiv,尚未经过同行评审。在试验内听觉注意切换场景下,神经噪声与固有延迟会延迟或干扰注意跟踪,传统方法难以应对动态切换,常在切换点造成不连续。SAGE把试验内切换当作动态选择处理,用稳健分离器生成两条候选语音流,并用EEG引导的切换感知门控模块产生平滑融合权重、抑制切换伪影。研究者称,SAGE还集成延迟补偿对齐与不确定性驱动的保守策略,优于基线方法,达到8.67dB SI-SDR与88.24% STOI,平均切换延迟降至2.04秒。

脑电基础模型分层迁移,STEAM在14项评估平均排名居首

一项预印本研究提出STEAM,一种面向脑电图(EEG)解码的分层迁移框架,通过双分支时空编码器与共享软专家混合(SSMoE)模块,在EEG基础模型中协调通用表征学习与范式特定专业化,使互补的表征可通过一组紧凑的软槽交换信息。研究者称,在7个下游数据集、14个评估设置中,STEAM以有竞争力的推理成本取得最佳平均排名;其层级预训练策略可在不从头重训的情况下进一步针对目标范式提升解码准确率。该工作面向EEG基础模型的可迁移性与高效下游适配问题,属于脑机接口解码算法的基础方法研究。该研究为预印本,尚未经过同行评审。

三路线分数融合让EEG图像检索Top-1准确率达73.5%

该预印本提出CORTIVA,一个用于EEG与MEG到图像检索的候选分数融合框架。研究者称,不同于现有方法先将异构视觉监督压缩为单一嵌入再排序,CORTIVA让三条解码路线对齐到异构视觉目标、独立为同一候选库打分,仅在排序前合并温度缩放的分数向量,从而保留互补证据。研究显示,在200选1的THINGS-EEG2基准上,CORTIVA在10名被试上达到Top-1准确率73.5%、Top-5达95.3%,超最强已报告基线10.3和5.4个百分点;用模态特定神经编码器时,同一融合原则在THINGS-MEG上达到Top-1为42.4%。该研究为预印本,尚未经过同行评审。
© 2026 BCIwiki.com 产业简报 主题索引 提交线索 订阅本站 修订记录 关于我们