脑机百科消息(bciwiki.com),一个名为LibriBrain100的大型脑磁图(MEG)数据集于2026年8月25日上传至arXiv预印本平台,包含超过100小时的高质量数据,其中约80小时来自单一受试者,创下同类数据集中个体内数据深度的新纪录。该数据集旨在为神经语音解码研究提供标准化评估基准,并附带开源工具和在线竞赛。
研究团队利用现有解码模型在词分类基准上取得了最先进性能,验证了数据质量和大规模个体内数据的价值。此外,团队还收集了32名受试者每人约40分钟的额外数据,展示了多受试者数据在补偿个体数据不足方面的作用。该数据集提供了标准的训练、验证和测试划分,并可通过开源的Python库进行下载和预处理。
该研究由Francesco Mantegna、Dulhan Jayalath、Gereon Elvers等学者完成,作者希望LibriBrain100能够加速非侵入式脑机接口的发展,帮助严重瘫痪患者恢复沟通能力。