新闻中心

耶鲁、剑桥等开发MindLLM,将脑成像直接转换为文本

2025-03-04
浏览次数:
返回列表

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

图片

编辑 | 萝卜皮

将功能性磁共振成像 (fMRI) 信号解码为文本一直是神经科学界面临的一项重大挑战,它有望推动脑机接口的发展,并加深对大脑机制的了解。然而,现有的方法往往存在预测性能不佳、任务种类有限以及跨受试者泛化能力较差等问题。

针对这一问题,耶鲁大学(Yale University)、达特茅斯学院(Dartmouth College)和剑桥大学(University of Cambridge)的研究人员提出了 MindLLM,一种专为主题无关且用途广泛的 fMRI 到文本解码而设计的模型。

此外,研究人员提出了一种新方法——大脑指令调整 (BIT),可增强模型从 fMRI 信号中捕获不同语义表示的能力,从而促进更通用的解码。

在全面的 fMRI 到文本基准上的评估中, MindLLM 优于基线,下游任务提高了 12.0%,未知主题泛化提高了 16.4%,新任务适应提高了 25.0%。此外,MindLLM 中的注意力模式为其决策过程提供了可解释的见解。

该研究以「MindLLM: A Subject-Agnostic and Versatile Model for fMRI-to-Text Decoding」为题,于 2025 年 2 月 18 日发布在 arXiv 预印平台。

图片

解码人类大脑活动(fMRI)为文本在神经科学领域引起了广泛关注。这一技术不仅为认知、行为和意识研究提供了新视角,还具有重要的社会应用价值。

例如,它可以帮助语言障碍者恢复沟通能力,使他们能够轻松表达思想;同时,它还能实现健康人群对数字设备(如具身 AI 或假肢)的神经控制,使操作更加直观和精确。

然而,该技术仍面临重大挑战:一是需要针对不同应用场景开发多功能解码模型,现有方法如 UMBRAE 虽能映射 fMRI 数据到刺激图像,但无法处理更广泛的任务(如记忆检索);二是缺乏统一且不依赖个体的解码架构,当前方法依赖预处理选择响应体素,导致输入维度不一致和空间信息丢失,影响性能。

研究人员提出了 MindLLM,一种用于 fMRI 到文本解码的主题无关且通用的模型。该方法包括一个主题无关的 fMRI 编码器和一个现成的 LLM。

Zyro AI Background Remover Zyro AI Background Remover

Zyro推出的AI图片背景移除工具

Zyro AI Background Remover 145 查看详情 Zyro AI Background Remover
图片

图示:MindLLM 概述。(来源:论文)

主题无关的 fMRI 编码器将神经科学信息注意层与可学习查询相结合,通过利用体素的空间信息和神经科学先验来实现动态特征提取,从而显著提高预测准确性。值和键的设计将体素的功能信息(在个体之间基本一致)与其 fMRI 值分开,从而使模型能够受益于跨主体共享的先验,并增强对新主体的概括性。

为了应对多功能解码的挑战,研究人员提出了脑指令调整(BIT)。BIT 使用以图像为中介的多样化数据集来训练模型,涵盖旨在捕获 fMRI 数据中编码的语义信息的不同方面的任务,包括感知和场景理解、记忆和知识检索、语言和符号处理以及复杂推理。

图片

图示:我们的模型与之前的统一模型的比较。(来源:论文)

研究人员在综合基准上评估了 MindLLM。结果表明,它的表现优于基线,在各种下游任务中平均提高了 12.0%,在未见过的主题上的泛化提高了 16.4%。

MindLLM 能够有效地适应新任务,在实际应用中表现出很高的可定制性和灵活性。此外,对注意力权重的分析为该团队 fMRI 编码器的工作机制提供了宝贵的见解。

论文链接:https://arxiv.org/abs/2502.15786

相关报道:https://medicalxpress.com/news/2025-02-brain-imaging-text-mindllm.html

以上就是耶鲁、剑桥等开发MindLLM,将脑成像直接转换为文本的详细内容,更多请关注其它相关文章!


# 人工智能  # 理论  # 这一  # 剑桥  # 耶鲁  # 提高了  # 提出了  # Type  # 2025  # ai  # 神经科学  # 大脑  # 科学  # 湖北快手营销推广中心  # 文案翻译网站建设  # 互联网seo优化公司  # 华为营销推广费用  # 惠州仓储seo公司  # 营销文案推广文案怎么写  # 高仿seo风险  # 微博营销推广  # 乌兰察布网络营销的推广  # 沈阳seo服务必选公司  # 官网  # 剑桥大学  # 转换为  # 耶鲁大学  # 多功能 


相关栏目: 【 行业资讯67740 】 【 技术百科0 】 【 网络运营39195


相关推荐: 固态硬盘坏了如何换硬盘  苹果16哪些型号好  43寸电视长宽多少厘米  url解码什么意思  datediff函数怎么用视频  苹果16有哪些改善  电动车eco和power是什么意思  分享一个稳定的ao3镜像网址  夸克投屏为什么那么卡  阿里云盘共享账户怎么用  为什么要用typescript6  区块链的热闹将何去何从?  如何进入cmd命令行  ts什么意思  联想手机如何输入命令行  cos150度等于多少  春运抢票可以抢几次啊  复制 命令如何撤销  如何设置从固态硬盘启动  为什么进行域名解析  单片机蓝牙怎么开启设备  ready是什么意思  pp是什么意思  typescript怎么添加css样式  360桌面壁纸怎么弄掉  如何打开命令框  焊机上power指示灯亮是什么意思  youtube受限模式是什么_youtube受限模式是什么意思  苹果手机16新款颜色有哪些  苹果16更新了哪些功能  市盈率ttm写的亏损是什么意思  为什么选择typescript  typescript如何使用viewer  楔子是什么意思  忐忑不安是什么意思  春运车站抢票和网上抢票  路由器上的power按钮是什么意思  得物怎样降低手续费 得物如何降低手续费教程  空调power灯一直闪是什么意思  如何显示固态硬盘  苹果16系统有哪些功能  linux如何跳回命令行界面  哪些库是typescript  所有删除的聊天记录都可以恢复吗?  iPhone无法打开YouTube原因分析与解决方案  typescript哪个最好  typescript掌握哪些可以做项目  没基础做单片机怎么样  如何winpe cmd命令  单片机怎么控制闪烁技术 

搜索