跳转至

2026-07-19 每日论文

来源 独立页面
arXiv arXiv
bioRxiv bioRxiv
medRxiv medRxiv

arXiv

标题 作者 发布日期 PDF链接 摘要
多步视觉推理的分层去噪 Zezhong Qian 2026-07-16 PDF 视频模型正逐步演变为视觉基础模型,但仍缺乏类人多步推理能力。流式自回归扩散模型虽高效但推理能力有限,而双向扩散虽能实现全局修正,却因密集帧级去噪导致推理成本高昂。这两种范式在复杂推理任务中均难以兼顾逻辑一致性与低延迟流式处理。我们提出HDR(层次化视觉推理去噪框架),通过将层次化隐变量融入因果视频生成实现多步推理。HDR将视频隐变量组织为树状层次结构,在流式输出前实现从粗到细的推理:粗去噪层保留不确定假设用于全局规划,细粒度层逐步将其精炼为具体视觉状态。稀疏层次注意力模式(SHAP)进一步降低了时序注意力成本。我们构建了包含分布外案例的分层多步视频推理基准,涵盖迷宫导航、汉诺塔、一笔画、滑块拼图、推箱子、倒水六类任务。与流式自回归扩散基线相比,HDR将成功率从34.22提升至60.29(相对提升76.2%),平均进度从76.00提升至89.56,展现出更一致的推理轨迹。HDR保持每隐变量0.70秒的低延迟流式处理,推理速度较双向扩散提升54.2倍。在仅使用2%训练数据时仍能保留全数据性能的82.9%,而双向扩散仅保留52.0%。真实机器人实验进一步验证了HDR在物理交互与世界建模中的潜力。项目演示:https://hierarchical-diffusion-reasoning.github.io/。
分区、提示、聚合:语言模型中的统计自洽性 Patrik Wolf 2026-07-16 PDF 上下文学习通常被解释为一种条件推断形式,其中提示指定了上下文,模型的输出被视为相应条件分布的估计。如果这种解释成立,那么大语言模型的估计应满足基本的概率恒等式。特别地,全概率公式断言,先验加权的条件分布在总体上的任何有效划分下会聚合为总体层面的边际分布。在本研究中,我们探究大语言模型的估计在多大程度上遵循这一自洽性原则。我们使用二叉树作为评估框架,递归地将总体划分为粒度逐渐精细的子群体。随后,我们通过上下文向大语言模型提供用语言描述的子群体信息,将得到的估计结果重新聚合为总体层面的估计,并比较不同粒度划分下的结果。通过跨问题领域和最先进前沿模型应用这一协议,我们发现了基本一致性属性的广泛违反。对角色提示的深入研究揭示了一种我们称之为宏观谬误的模式:从更精细的子群体响应中重建的估计往往比直接得到的总体层面估计更符合人类参考数据。这种效应在树结构和估计任务的变化中持续存在,并可通过隐式提示部分恢复。这些发现共同表明,模型拥有相关的子群体知识,但未能可靠地将其传播到聚合估计中。这一差距将统计自洽性确立为评估大语言模型的一个未饱和、无参考的标准。
RoboTTT:机器人策略的上下文扩展 Yunfan Jiang 2026-07-16 PDF 最近的机器人基础模型通常基于单步或短历史视觉运动上下文运行。我们提出测试时训练机器人策略(RoboTTT),这是一种机器人模型与训练方案,能将视觉运动上下文扩展至8000时间步,比现有最优策略高出三个数量级,且推理延迟不增加。在此上下文长度下,我们解锁了新的机器人能力:通过人类视频演示实现一次性上下文模仿学习、实时策略改进、对扰动的鲁棒性,以及在多阶段长周期任务中更强的表现。我们还首次观察到,随着预训练上下文长度增加,闭环性能持续提升。RoboTTT的核心是将测试时训练整合到视觉-语言-动作策略等机器人基础模型中,形成一种序列模型,其循环状态由快速权重构成——这些参数在训练和推理过程中通过梯度下降更新,将历史信息压缩至权重空间,并为长上下文条件检索上下文信息。为扩展训练上下文长度,该方案将序列动作强制与截断时间反向传播相结合。在具有挑战性的真实机器人操作任务中,RoboTTT相比单步上下文基线整体性能提升87%,并完整完成一项耗时五分钟、包含十个阶段的组装任务(所有基线均无法完成)。使用8000时间步上下文训练的RoboTTT,其表现比使用1000时间步预训练的同一模型高出62%,这表明上下文长度可作为机器人基础模型的新扩展维度。视频详见 https://research.nvidia.com/labs/gear/robottt/
MeanFlowNFT:将前向过程强化学习引入平均速度生成器 Yushi Huang 2026-07-16 PDF MeanFlow生成器通过预测时间区间内的平均速度实现快速少步采样,使其在高效生成领域具有吸引力。强化学习已成为将扩散模型和流模型与人类偏好及任务特定目标对齐的有力方法。其中,DiffusionNFT提供了一种高效的前向过程强化学习框架,无需反向过程轨迹或似然估计。然而,将此类强化学习方法应用于MeanFlow仍待探索。DiffusionNFT优化瞬时速度,而MeanFlow使用平均速度进行采样。为弥合这一差距,我们提出MeanFlowNFT。受连接平均速度与瞬时速度的MeanFlow恒等式启发,我们构建了一个诱导的瞬时速度预测器。将DiffusionNFT目标应用于该预测器,使得MeanFlow的奖励优化具有明确定义。采样仍基于平均速度,保留了MeanFlow的快速少步生成特性。我们进一步证明MeanFlowNFT继承了DiffusionNFT的严格策略改进保证。在图像和视频生成上的实验表明,MeanFlowNFT持续改进基线模型。此外,它在大多数指标上(SD3.5-M上8项中的6项)优于先前最先进的强化学习调优少步生成器,且仅需少量采样步数即可超越多步强化学习调优的扩散模型。例如,在Wan 2.1上,4步MeanFlowNFT达到84.33的VBench分数,超越了50步LongCat-Video RL的82.57。
SciDiagramEdit:从论文修订中学习编辑科学图表 Yasheng Sun 2026-07-16 PDF 在科研论文中编辑图表是日常研究工作中常规且耗时的环节:作者在修改稿件时需重新标注组件、调整面板布局、更新视觉风格。然而,通过自然语言指令自动化这一编辑流程颇具挑战性,因为科学图表是信息密集的图形化表达,其中示意图、数据图、照片、图注和箭头等异构视觉元素需遵循严谨的视觉语法组合,以支撑特定论点。为此,我们提出SciDiagramEdit——一个从自然论文修订中学习、并基于图表可编辑矢量源运行的基准测试与技能进化框架,用户可在此框架中与智能体协同检查并编辑单个图元。我们的基准测试从arXiv版本历史中提取修改前后的图表对,每对均对应作者自身的修订意图。为适应编辑指令的多样性,我们采用技能进化的智能体学习方式:智能体提议器通过多轮执行轨迹持续优化智能体的技能规范。最终形成的技能在保留验证集上逐步提升编辑准确率,证明自然论文修订可作为指令驱动图表编辑的有效训练信号。
在线神经时空记忆用于动态新视角合成 Baback Elmieh 2026-07-16 PDF 在线多视角视频流的新视角合成面临一个根本性权衡:在严格实时约束下,既要维持持久的长时记忆以重建暂时遮挡区域,又要保证操作效率。虽然测试时训练(TTT)提供了强大的记忆机制,但标准模型要求每帧进行基于梯度的记忆更新以适应动态场景中的运动变化。高频记忆更新的计算成本阻碍了实时应用,且可能导致长序列中的不稳定性。鉴于记忆更新的计算需求远高于记忆应用,且视频内容存在大量冗余,我们提出将这两个过程的频率解耦。本方法采用周期性记忆更新策略,同时以逐帧方式应用记忆,通过跨视角注意力机制处理先前记忆状态与当前帧之间的形变。为锁定历史上下文,我们引入两个关键机制:辅助记忆损失强制场景信息的持久内化,以及记忆缓存策略通过正则化活动权重防止灾难性漂移。实验表明,本方法在动态人体运动场景及分钟级在线记忆任务中均实现了实时且最先进的性能。
基于运动条件的多视角融合用于超声心动图心肌梗死定位 Guang Yang 2026-07-16 PDF 心肌梗死仍是全球主要死因之一。超声心动图作为广泛可用的评估手段,其关键指标为局部室壁运动异常。既往基于学习的心肌运动分析方法常采用手工特征或密集监督估计,但大量标注需求限制了应用。基础模型近期提升了基于视觉的超声分析,但多数方法仅处理单视图,且节段级定位在视图依赖的模糊性下仍不可靠,尤其在心尖切面。为此,我们提出MCF-Net,一种新颖的运动引导多视图融合框架,通过融合心肌运动线索与基础模型表征实现梗死定位。视觉特征由跨双视图共享的预训练超声基础模型EchoPrime提取。心肌运动通过极稀疏监督建模:单张标注模板帧跨视频传递以初始化点追踪,避免密集标注。运动导出的节段感知软掩码提供粗粒度空间先验,选择性增强困难心肌节段的特征。运动条件融合机制跨视图整合运动与视觉信息,在不覆盖强外观线索的前提下优化预测。在节段级心肌梗死定位中,MCF-Net达到72.4% F1分数与84.9%准确率,优于现有最优的运动仅用、视觉仅用及融合基线方法。
预训练数据可能通过计算宣传被投毒。 Victoria Graf 2026-07-16 PDF 对预训练数据进行投毒,可能使语言模型产生难以检测和消除的有害行为。此前针对预训练数据的投毒研究主要利用维基百科等成熟数据源,这类数据源无法体现预训练语料库典型的大规模与异质性特征,且忽视了投毒数据与数据筛选流程之间的相互作用。我们通过现有网络规模内容注入机制——公共讨论接口——证明投毒攻击在预训练数据中的可行性已超越此前的有限场景。此外,为衡量网络爬取及数据筛选后恶意内容是否被纳入,我们提出HalfLife这一新型分析方法,用于评估基于网络爬取的语言模型训练数据中对抗性内容的包含情况。借助HalfLife,我们探索了通过开放讨论接口对预训练语料库进行网络规模投毒的可行性。本分析揭示了评估投毒注入是否被纳入预训练数据的重要性,并证实第三方网页内容可作为攻击语言模型预训练的潜在载体。
SceneBind:跨视觉、音频与语言绑定“什么”与“哪里” Mingfei Chen 2026-07-16 PDF 我们提出SceneBind,一种融合视觉、音频与语言的联合语义与三维空间理解的实景全模态表征。现有全模态编码器擅长实例级语义(即存在什么),但往往缺乏显式空间结构(即位于何处)。SceneBind通过将每个场景表征为语义-空间实体来弥补这一不足,结合全局语义嵌入与以物体为中心的语义-空间槽位。该表征显式捕捉物体级语义、空间属性及不确定性。我们进一步提出SceneBind Matching,一种整合全局场景相似度与物体对齐的语义-空间匹配方案,支持跨模态场景检索与物体定位。为训练与评估SceneBind,我们构建了包含结构化语义与空间标注的新型真实世界双耳视听数据集,并提出跨模态对齐语义与空间信号的训练协议。SceneBind兼容大规模预训练语义编码器,仅需少量额外令牌即可添加轻量级空间建模。它在场景与空间检索任务上达到最优水平,同时实现向音频-视觉定位等下游任务的强零样本迁移能力。
超越成功率:面向成本的攻防安全智能体评估 Paul Kassianik 2026-07-16 PDF 安全智能体评估通常在高推理预算下衡量峰值攻击能力,重点包括漏洞发现、漏洞利用开发、渗透测试及CTF挑战完成情况。这类评估虽有用但不够全面:在运营安全场景中,每次推理步骤、工具调用、遥测查询和情报补充请求都会消耗预算。我们通过成本-成功双维度视角,在攻击性Cybench挑战和防御性Splunk BOTS v1调查挑战中评估语言模型安全智能体。不同于仅报告最佳成功率,我们对比固定成本水平下的模型表现,并按推理开销与工具开销分解性能。结果显示红蓝队任务存在不同的扩展规律:攻击性CTF性能随测试时计算量增加而提升,扩展的开源权重模型可在保持成本竞争力同时接近前沿专有系统;防御性SOC调查则呈现不同扩展模式——其成功更依赖规范工具使用、遥测导航与选择性情报补充,而非单纯推理预算。我们认为安全智能体基准应在任务成功率之外衡量经济效率与运营适配性。成本感知的SOC原生评估能更清晰揭示当前哪些模型具有实际可用性,以及防御型智能体仍需改进的方向。我们已搭建交互式网站展示研究成果:https://evals.frontier.security

bioRxiv

标题 作者 发布日期 PDF链接 摘要
斑胸草雀听觉端脑中芳香化酶与非芳香化酶神经元的相似突触及电流输入特性 Furest Cataldo, B. 2026-07-19 PDF 雌激素通常以其在性发育和成熟中的作用而闻名,但同时也支持多种大脑功能,包括认知、神经保护和感觉处理。例如,在鸣禽的听觉前脑区域——尾内侧新纹状体(NCM)中,神经雌激素会因同种声音和社会刺激而升高;反之,NCM中升高的神经雌激素已知能快速增强听觉处理,且不受性别影响。尽管神经雌激素对大脑功能至关重要,但芳香化酶(神经雌激素合成酶)神经元与非芳香化酶表达神经元在细胞和生理特性上是否存在差异,目前仍不清楚——这种差异可能类似于其他类固醇生成细胞类型(如肾上腺细胞)中观察到的特化现象。因此,我们系统分析了表达芳香化酶和不表达芳香化酶的NCM神经元,通过离体全细胞电生理记录结合免疫组化揭示芳香化酶表达,以确定它们在突触和电流输入特性上的差异。电流钳记录显示,除达到膜后超极化峰值时间的适度差异外,芳香化酶与非芳香化酶神经元之间无显著差异。同样,突触后电流的电压钳记录也未发现两种细胞类型间的显著差异,表明它们具有相似的突触输入密度。因此,在鸣禽高级纹状体中,芳香化酶与非芳香化酶NCM神经元共享相似的内在膜特性(如兴奋性)和突触输入动力学。我们的发现为以下可能性留出空间:芳香化酶与非芳香化酶神经元在计算和/或调节功能上的差异,可能源于其传入和传出投射的特异性或神经化学特异性。
发育性丰富化增强了拓扑结构化的本体感觉皮层编码 Palacio Manzano, M. 2026-07-19 PDF 本体感觉皮层的组织源于发育过程中肢体使用的经验依赖性模式,而非仅仅反映外周神经支配。然而,这些发育性变化的具体程度和细节仍知之甚少。为探究此问题,我们研究了早期环境富集如何重塑小鼠前肢体感皮层的拓扑结构和功能特性。通过宽场钙成像,我们发现环境富集并未引起中尺度激活图的主要重组。为解析细胞层面的拓扑结构,我们开发了一种大视野荧光宏观镜,能够对整个激活区域内的单个神经元进行无偏成像。我们识别出方向调谐中存在拓扑组织的偏好性,其中体感和运动区域编码近体空间内的不同运动轴。发育性富集在细胞层面重塑了这种各向异性表征。环境富集并未通过均匀化各运动方向上的调谐来减少方向偏差,而是通过锐化其拓扑分离性并将神经元调谐集中于共同的近体空间轴,从而增强了各向异性。因此,我们的研究揭示,丰富的肢体使用和感觉运动探索强化了小鼠本体感觉皮层对朝向身体运动的生态相关特化。
星形胶质细胞中的FMRP调节脆性X综合征中脊髓小清蛋白表达神经元的功能 Qiu, H. 2026-07-19 PDF 触觉过敏是脆性X综合征(FXS)的常见症状,表现为对无害触摸或质地的过度反应。然而,这种感觉处理异常的神经环路机制尚不完全清楚。以往研究主要关注皮层和周围神经元的功能障碍。但作为体感整合的第一个中枢位点,脊髓背角环路同样包含可能促成无害刺激过敏的要素,但其在FXS病理中的作用仍未被充分理解。本研究发现,脊髓中表达小清蛋白(PV)的抑制性中间神经元(PVNs)——这类神经元通过门控触觉输入避免激活伤害性通路——在FXS中功能异常。利用FXS小鼠模型(全基因Fmr1敲除;gKO),我们发现背角PVNs存在功能缺陷,表现为PV表达降低和无法维持强直放电。为确定这些缺陷是否源于细胞内在机制,我们选择性敲除了PVNs中的Fmr1基因。这种敲除未能重现gKO小鼠中观察到的分子和电生理变化。相反,星形胶质细胞特异性敲除Fmr1则复现了gKO小鼠的关键特征,包括PV表达和放电频率下降。为理解放电缺陷的生物物理学基础,我们采用基于电导的Hodgkin-Huxley模型模拟脊髓PVNs。令人惊讶的是,仅修改内在膜电导不足以解释实验数据。事实上,PVN放电需要整合额外的钙依赖性突触外成分,这与星形胶质细胞(而非PVN特异性)缺失FMRP可重现gKO小鼠PVN表型的实验结果一致。综上,这些发现表明脊髓PVNs的缺陷主要源于星形胶质细胞而非PVNs自身FMRP缺失。这揭示了背角抑制性环路的星形胶质细胞依赖性功能障碍是FXS此前未被表征的后果。
兴奋性延迟耦合解释了同相和反相的功能连接 Omurtag, A. 2026-07-19 PDF 脑区间协调的振荡活动支撑认知功能,但支配这种协调的相位关系仍知之甚少。我们利用31名参与者执行运动学习任务时的头皮脑电图数据,发现跨位点相位聚类主要发生在同相或反相关系,两者间的转换由传导延迟调控。同源半球间配对即使距离较远仍保持同相,这与较快的胼胝体传导一致。一个由两个延迟耦合兴奋性群体组成的极简模型无需参数调整即可复现这些特征;稳定性分析表明,同相与反相振荡源于竞争性不稳定性,延迟决定何种模式占主导。任务表现使额顶网络转向同相连接,这种调节能被相位关系指数(PRI)捕捉,但被传统聚类指标遗漏。来自独立数据集的初步证据表明这些模式具有普适性。这些发现挑战了零延迟连接反映容积传导的假设,提供了将传导延迟与相位组织关联的机制性解释,并引入PRI作为对现有测量手段不可见的功能相关连接变化敏感的指标。
早期逆境选择性重塑发育中的大脑中的躯体-认知动作网络 Antonacci, C. 2026-07-19 PDF 早期逆境是影响发育中大脑的最强环境因素之一;然而它是否会重塑皮层网络的区域布局,以及沿哪些维度重塑,目前尚不清楚。在4525名9-18岁青少年的纵向样本中,我们推导了个体化的皮层分区,并将15个网络的地形结构与10个数据驱动的逆境维度相关联。暴露于更高程度的威胁(而非剥夺或不可预测性)可预测躯体-认知动作网络(SCAN)呈剂量依赖性扩张,其效应规模是其他任何网络的近七倍。SCAN向感觉运动极方向扩张,侵入邻近区域,并将功能连接转向感觉运动系统而远离控制系统。这种扩张中介了威胁与认知能力下降之间的关联,该效应在多个时间点、儿童个体内及样本外均得到重复验证。逆境对发育中皮层的影响并非弥散分布于多个系统,而是汇聚于一个将大脑与身体耦合的单一整合网络区域。
学习第二语言阅读会在VWFA中建立与母语表征并行的第二语言表征。 Fan, S. 2026-07-19 PDF 学习第二语言阅读需要大脑将新的书写系统整合到已建立的母语阅读网络中,但这一过程如何重塑视觉词形区(VWFA)仍知之甚少。我们采用被动观看范式的功能性磁共振成像,系统研究了三个处于不同第二语言读写习得阶段的普通话母语儿童组(第二语言前阅读者、第二语言初级阅读者和第二语言高级阅读者)中,VWFA对中文(L1)和英文(L2)词汇的反应演变。我们结合单变量激活分析、表征相似性分析和监督机器学习分类,探究了VWFA重组的两种理论模型:叠加模型(预测L2反应出现时L1反应保持稳定)和竞争模型(预测神经资源从L1向L2的竞争性重新分配)。研究发现,尽管VWFA已对L1词汇表现出稳健的选择性反应,但L2词汇选择性在L2前阅读者中缺失,而在初级阅读者中显著出现,且L1词汇选择性在整个过程中保持稳定。表征相似性分析进一步揭示,VWFA内稳健的L2词汇表征仅在儿童开始学习阅读L2后出现,而L1词汇表征在所有三组中保持稳定。最后,监督机器学习分析成功基于L2(而非L1)激活模式区分了三个L2读写组,表明仅VWFA对L2的反应就足以捕捉儿童的L2读写习得阶段,而对L1的反应对L2学习经验不敏感,不支持竞争模型关于神经资源从L1竞争性重新分配的预测。这些发现共同支持叠加模型,证明VWFA在不损害L1文字处理的前提下,将新书写系统整合到其现有皮质资源中。
大规模人群神经影像学揭示了功能性脑组织中潜在的亚组结构。 Farahibozorg, S. R. 2026-07-19 PDF 大规模功能磁共振成像数据集为理解人类大脑功能的个体间差异以及将这些差异与行为和健康联系起来提供了资源。然而,现有的大多数方法未能弥合群体平均模型与个体特异性模型之间的差距,限制了对个体间结构化亚组异质性的识别。在此,我们开发了一个可扩展的框架,用于在来自19993名英国生物银行参与者的群体规模静息态功能磁共振成像数据中进行无监督亚组发现。利用随机概率功能模式,我们估计了群体信息化的静息态网络个体化空间拓扑结构,并为每位参与者推导出高维功能指纹。随后,我们通过独立对每个指纹特征应用高斯混合模型来识别潜在亚组,从而在1000个功能维度上生成数百个可复现的亚组定义。我们报告了亚组之间在认知、生活方式、身心健康等一系列非成像表型中约5700个显著差异。大脑网络的空间组织揭示了感觉运动系统和高级认知系统中的显著亚组差异,此外还与大脑区域遗传变异模式相对应。这些结果共同表明,大规模功能神经影像包含与行为和生物学变异相关的丰富潜在亚组结构。我们的框架为人类大脑功能的分层模型和群体神经科学提供了可解释且可扩展的基础。
功能连接梯度依赖于皮层采样位置和大脑状态。 Li, M. 2026-07-19 PDF 功能连接分析常将邻近皮层位置采样的信号视为可互换的,尽管灰白质边界存在解剖学和血流动力学过渡。我们检验了采样位置是否构成宏观功能组织的状态敏感维度。在176名人类连接组计划年轻成人(含四次7T静息态和四次电影观看扫描)中,BOLD时间序列从个体特异性中厚层和灰白质边界表面采样,汇总至400个皮层分区,并嵌入共同功能梯度空间。电影观看减少了表面间主梯度分离,但该效应存在空间异质性:视觉、边缘和默认网络趋同,而突显/腹侧注意皮层分化。沙普利分解与反事实分析表明,状态变化反映两种表面表征的协同重构,而非单一表面趋近另一表面。原始连接性模式的变化追踪梯度变化,表明该结果并非仅由嵌入引入。两种表面在电影观看期间均表现出刺激锁定的被试间功能连接。然而,刺激共享分离仅部分捕捉电影状态组织,且无法解释电影减静息态的变化。最后,在172名匹配被试中,静息态分离图谱从7T泛化至3T,但绝对幅度与跨场个体排序稳定性较低。这些发现确立了皮层采样位置作为功能连接几何的可解释测量维度。其空间组织在采集间可重复,但幅度与状态依赖性存在变异,强调BOLD信号相对于皮层边界的采样位置可影响宏观脑组织的结论。
通过微流控分离和DIA-MS技术对人类iPSC衍生神经元的深层轴突蛋白质组学分析 Sauter, C. M. 2026-07-19 PDF 神经元的一个关键特征是其区室化为胞体、树突和轴突。轴突高度特化用于长距离信号传递,但在神经退行性病变中也表现出独特的脆弱性,这暗示了轴突蛋白质组的特异性。然而,由于难以分离足够数量的纯轴突材料用于传统质谱分析,轴突蛋白质组的深度表征一直受到限制。本研究将基于微流控的轴突-胞体分离技术与Orbitrap Astral质谱仪上的数据非依赖性采集质谱(DIA-MS)相结合,对人诱导多能干细胞(iPSC)来源的皮层神经元进行区室分辨蛋白质组的深度分析。我们在胞体树突区室中定量了超过9,000种蛋白质,在轴突区室中定量了约6,000种蛋白质——据我们所知,这代表了迄今报道的最深层次人类轴突蛋白质组。差异丰度分析鉴定出1,250种轴突富集蛋白,这些蛋白与囊泡介导运输、突触囊泡动力学和细胞骨架组织等轴突相关通路高度富集。将该工作流程扩展至iPSC来源的下运动神经元后,我们揭示了皮层神经元与下运动神经元共有的417种核心轴突富集蛋白,以及亚型特异性轴突特征——这些功能差异仅通过区室限制性分析才得以显现。我们展示了遗传性痉挛性截瘫和肌萎缩侧索硬化症等神经退行性疾病相关基因的广泛覆盖,为解读疾病相关突变如何差异影响轴突与胞体树突蛋白质稳态建立了定量参考。该工作流程与资源可直接应用于其他神经元亚型和疾病模型,为研究健康与疾病状态下的轴突蛋白质组动态铺平道路。
自发性脑类器官活动中的涌现拓扑结构 Bodnia, E. 2026-07-19 PDF 神经活动普遍被认为组织在嵌入高维状态空间的低维结构中。持续同调直接从成对相关模式中读取此类结构,无需预先假设哪些变量具有相关性。我们将持续同调应用于人类(Lancaster)和小鼠(Pa\c{s}ca)皮层类器官自发活动的微电极阵列记录,涵盖26至234个同步分选单元,探究拓扑数据分析是否能在神经记录实际提供的节点数量下解析结构。在相关空间中构建加权网络并通过Vietoris-Rips过滤对其进行表征,我们发现18个数据集中有14个的第一同调群($H_1$,环)显著高于保持速率和种群分布的零模型。这种环结构占据非冗余核心:它对随机移除单元具有鲁棒性,但会被定向移除承载该结构的单元所破坏。拓扑丰富度随网络规模增长,仅在较大网络中第二同调群($H_2$)显著高于零模型。这些结果表明,持续同调能在实验实际提供的尺度上解析神经记录中的结构化拓扑。

medRxiv

标题 作者 发布日期 PDF链接 摘要
术前脑电图特征预测深部脑刺激治疗强迫症疗效的指标 Wang, W. 2026-07-19 PDF 深部脑刺激(DBS)对难治性强迫症(OCD)有效,但疗效存在异质性,且无应答者需承担手术和经济负担。我们试图寻找一种可推广、非侵入性的术前DBS应答特征。基于一项随机、双盲、假对照的伏隔核/内囊前肢DBS试验(N=24;NCT04967560)的术前静息态脑电图(EEG)数据,我们开发了一种针对小样本优化的机器学习方法,发现右侧额颞电极较低相对delta功率是六个月症状改善的稳健预测因子,可解释>40%的结局变异,并将应答率较全纳入者提升>20%。该EEG特征相对于健康对照存在异常,但与基线症状严重程度无关,且仅在主动刺激(而非假刺激)条件下具有预测性。值得注意的是,该特征在独立队列中前瞻性预测了结局(8例患者中7例)。该特征在睁眼和闭眼记录中均具有普适性,经源空间脑磁图验证,并表现出优异的短期和长期重测信度。机制上,该EEG特征与右侧额颞非周期性指数高度相关,其预测强度集中于富含抑制性神经元标志物的皮层区域,提示该特征与兴奋-抑制平衡相关。此外,纵向特征变化追踪了临床改善,为其作为靶点参与度读数的应用提供了概念验证支持。这些发现建立了一个可推广、具有生物学基础的EEG特征,用于指导严重OCD患者DBS治疗的选择。
GutCore:用于全病例胃癌分析的内镜基础模型 Kim, S. 2026-07-19 PDF 背景与目的 内镜人工智能通常基于精选的单张图像进行验证,而胃癌诊断需要整合完整的检查过程。我们开发了GutCore,并评估了全病例内镜图像能否用于患者层面的胃癌浸润深度、生物标志物及预后评估。 方法 GutCore基于来自十余家医院的560万张去标识化内镜图像进行预训练。我们将其与五个通用、医学及内镜专用基础模型进行对比,使用开放图像级数据集及内部三级医疗中心2019-2023年间11,035例去标识化内镜检查(其中8,049例为早期或进展期胃癌,2,986例为良性胃炎或肠上皮化生)。所有检查图像被整合用于患者层面的癌症状态、浸润深度、分子生物标志物及总生存期评估。 结果 整合每次检查的全部存储图像后,无需选择代表性帧即可实现患者层面胃癌评估。GutCore在癌症检测中AUC达0.995,固有肌层浸润AUC为0.960,SM2及以上浸润AUC为0.804。组织定义生物标志物状态预测中,EB病毒状态和MLH1缺失表现最佳(AUC分别为0.831和0.854),HER2表现较低(AUC为0.673)。在保留的进展期胃癌测试集中,GutCore推导的风险组显示显著生存差异(log-rank P < .0001;高风险组与低风险组风险比为13.18;95% CI 6.06-28.66),且在病理II期和III期疾病中仍保持分层能力。外部帧级基准测试在解剖标志识别、疾病分级及分割方面表现优异。 结论 GutCore支持利用常规存储的内镜图像进行全病例患者层面胃癌评估。需在独立临床队列中进一步验证以确立其普适性和临床实用性。
高血压性心脏病中一过性心尖保留现象由拉普拉斯定律解释 Hwang, I.-C. 2026-07-19 PDF 背景:左心室纵向应变(LS)的尖端保留是心脏淀粉样变性的超声心动图线索,但也可能发生于高血压性心脏病(HHD)。目的:确定HHD中的尖端保留是否与根据拉普拉斯定律估算的区域左心室壁应力相关。方法:我们回顾性研究了1559例HHD患者、47例轻链型心脏淀粉样变性(ALCA)患者和409例正常血压对照者。人工智能辅助超声心动图量化了基底段、中段和心尖水平的节段性LS、室壁厚度和腔室半径。壁应力估算为平均血压(MBP)×半径/(2×室壁厚度)。尖端保留定义为相对区域应变比(RRSR)≥1.0。结果:14例HHD患者(0.9%)、13例ALCA患者(27.7%)和0例对照者存在尖端保留。在伴有尖端保留的HHD患者中,抗高血压治疗后RRSR从1.11±0.13降至0.72±0.10(P<0.001),伴随壁应力降低、基底段和中段LS改善,所有14例患者的尖端保留均消失。在整个HHD队列中,MBP和左心室质量指数的变化与RRSR变化独立相关。在伴有尖端保留的HHD患者的探索性分析中,基底壁应力降低与RRSR降低相关(ΔRRSR×100的β=0.267,95% CI 0.023-0.511;P=0.036)。在ALCA中,良好的血液学反应是RRSR降低的唯一决定因素。结论:HHD中的尖端保留虽不常见但可逆,可能代表一种与区域壁应力相关的负荷敏感性变形模式,符合拉普拉斯定律。
澳大利亚昆士兰州的体力活动与预期寿命:生命表分析 Wanjau, M. N. 2026-07-19 PDF 为估算昆士兰人通过增加体力活动水平可能实现的预期寿命增益。设计 生命表分析。设定、参与者 我们模拟了2025年昆士兰40岁及以上人口。模拟情景 我们采用两种方法。第一种方法,我们估算了设备测量体力活动四分位数之间的预期寿命差异,其中四分位数1代表最不活跃群体,四分位数4代表最活跃群体。第二种方法,我们将昆士兰观察到的设备测量体力活动水平与所有个体均达到每天≥12,000步或≤2,000步的情景进行比较。我们按年龄组和体力活动四分位数将每日步数转换为以4.8公里/小时速度进行中等强度步行的等效每日分钟数。敏感性分析中探索了其他情景。主要结果 预期寿命变化,以及模拟人群一生中总生命年增益。效益也转化为每额外步行一小时所获得的寿命分钟数。结果 如果所有40岁及以上昆士兰人都达到最活跃四分位数的活动水平,出生时预期寿命可达88.3岁,比观察到的活动水平下的预期寿命增加4.8年。最不活跃四分位数与最活跃四分位数个体之间的预期寿命差异为9.7年。达到最活跃四分位数的活动水平要求最低活动四分位数的个体每天额外进行85.9分钟的中等强度步行,每额外增加一小时体力活动平均可带来约3小时(177分钟)的寿命增益。在基于步数的模型中,最活跃情景(所有人每天≥12,000步)的预期寿命比最不活跃情景(所有人每天≤2,000步)高出约7.1年。结论 增加体力活动可为昆士兰人带来显著的预期寿命增益,其中最不活跃个体的增益最大。我们的研究结果强化了优先投资于促进体力活动的项目和环境的必要性。
一种预测宿主群体干预措施对减少虫媒传染病暴发规模效果的新方法 Coutinho, F. A. B. 2026-07-19 PDF 本文提出了一种新模型,用于评估干预措施对媒介传播感染(如登革热)人类宿主的影响。这类感染每年暴发且规模不同。该模型适用于这些暴发,且实际上独立于其强度,即无需稳态假设。模型以官方报告的按年龄分层的媒介传播感染病例数为输入,属于确定性模型,不考虑随机性。我们的目标是评估干预措施的效果(有效性),并依据一个观测事实:同一媒介传播的感染病例年龄分布比例,与传播强度及研究地理区域均无关(至少在巴西地区如此)。这一发现已在正文中强调,并构成我们计算的基础。通过模拟登革热疫苗的假设性干预,可确定疫苗接种活动的最优策略。
一项随机、双盲、安慰剂对照的单次递增剂量研究,旨在确定健康成人中无致幻作用的裸盖菇素剂量。 Levy-Cooperman, N. 2026-07-19 PDF 裸盖菇素对多种精神疾病显示出治疗潜力,但常规剂量(10-25毫克)引起的急性感知和认知改变需要临床监护,限制了其可扩展性。裸盖菇素的治疗相关药理作用能否与其致幻活性分离仍无定论。为填补这一空白,我们开展了一项1期随机双盲安慰剂对照单次剂量递增研究,以表征低剂量裸盖菇素的安全性、药代动力学和药效学特征。56名健康成人按七个连续队列分别接受单次口服裸盖菇素(0.5、1.0、1.5、2.5、3.5或4.0毫克)或匹配安慰剂,每次剂量递增均经药物安全审查委员会审核。所有受试者完成研究,未出现严重不良事件或退出。治疗期间不良事件与安慰剂组相当,主要表现为嗜睡。血浆裸盖菇素快速出现,中位达峰时间<1小时,暴露量与剂量成比例,终末半衰期短。主观药物效应呈剂量相关性,在≤2.5毫克剂量下即可与安慰剂区分。主观评分峰值随剂量增加,但幻觉或意识改变状态评分始终处于低水平且与安慰剂无差异。心理生理学参与通过明确的剂量依赖性瞳孔扩张得到证实,而认知表现(注意力、警觉性、工作记忆、冲动控制)未出现剂量依赖性下降,各剂量组状态焦虑均未增加。这些发现表明,低剂量裸盖菇素的可感知药理学作用可与显著感知改变和认知损害分离。这进一步支持在门诊2期研究中开展重复自我给药低剂量裸盖菇素安全性和可行性的对照研究。ClinicalTrials.gov注册号:NCT07710027
重新审视儿童期逆境与精神病及双相情感障碍中应激敏感脑区之间的联系:一项系统综述与荟萃分析 Petrova, T. 2026-07-19 PDF 背景 与童年逆境(CA)相关的脑部异常已在精神病性障碍(PD)和双相障碍(BD)的临床表现中被报道。本系统综述与荟萃分析探讨了PD和BD中与CA相关的灰质体积(GMV)改变。方法 按照PRISMA指南进行系统综述(PROSPERO编号:CRD42022351133)。检索EMBASE、MEDLINE和PsycINFO数据库,时间范围从建库至2024年6月,纳入研究CA与PD及BD结构性脑成像的文献。采用纽卡斯尔-渥太华量表(NOS)评估研究质量。提取并综合数据时考虑性别差异和CA亚型,脑部发现按关联的存在性和方向性进行分类。对海马体和杏仁核体积进行荟萃分析。结果 系统综述纳入29项研究,共3056名PD和BD参与者(平均年龄36.6岁,标准差16.1,女性占47%),文献发表于2011年至2023年间。研究质量中等,异质性较高。多数研究报告CA与GMV呈显著负相关,尤其在前额叶区域,而海马体和杏仁核的发现大多为阴性或不一致。对部分研究子集的荟萃分析未发现CA与海马体(k=5;p≥0.66)或杏仁核(k=4;p≥0.87)的半球特异性及合并体积存在显著关联。结论 在PD和BD中,CA与海马体或杏仁核体积改变的一致性关联未得到证实。前额叶区域GMV减少的证据更为一致,提示CA的神经生物学影响可能在皮层水平上更显著地被捕捉。
路径、认知与抽签运气:英格兰青少年特发性脊柱侧弯影像与转诊服务的质性研究 Robinson-Smith, L. 2026-07-19 PDF 引言 青少年特发性脊柱侧凸(AIS)需频繁进行X光检查以管理病情,导致年轻患者面临累积性辐射风险。尽管存在减少辐射的影像学检查手段,但英国国家医疗服务体系(NHS)内这些技术的可及性仍不均衡,向患者提供的信息也参差不齐。本定性研究调查了英格兰地区AIS影像学检查中的系统性、地域性及人际互动动态。 研究设计 本定性研究采用深度半结构化访谈,对象包括来自NHS儿科脊柱中心的医疗专业人员(HCPs)、13至25岁AIS患者及青少年AIS患者的父母/照护者。 研究地点 英格兰。 研究对象 共22名HCPs(来自英格兰13/24个NHS儿科脊柱中心)、19名10-25岁AIS患者及11名父母/照护者。 结果 传统X光仍是主要影像学检查手段,但存在显著的地域不平等。最常用的低辐射影像技术是EOS系统(采用狭缝扫描技术),目前仅在英格兰7个中心可用,主要集中于伦敦影像网络。EOS系统的采购目前依赖地方慈善资金而非中央统筹策略,高昂的设备与安装成本被列为主要障碍。初级医疗机构对影像学知识了解不足,地方二级医疗服务缺乏专科经验,导致诊断重复、转诊障碍及低价值的不一致影像检查。这些系统性延误常使支具等保守治疗窗口期缩短。医疗专业人员在履行告知义务与减少患者焦虑之间需谨慎权衡,常对辐射风险采取选择性沟通。而患者家庭对HCPs高度信任,对累积辐射风险认知不足,常将频繁影像检查视为病情进展的 reassuring 标志。在配备EOS系统的中心,临床医生能主动开展透明风险讨论;而在标准X光环境下,医患对话仍是被动且零散的,导致依赖默示同意而非真正知情同意。 结论 英格兰AIS影像学检查存在差异。地理位置决定低辐射技术的可及性及知情同意质量。系统效率低下与碎片化转诊路径导致诊断重复及专科治疗延迟。需通过国家标准化临床路径、统一信息提供及低辐射技术采购的中央统筹策略,消除结构性不平等,确保所有患者获得公平、透明的医疗服务。
新型印尼失语症诊断工具(IDEA)的有效性与可靠性 Prawiroharjo, P. 2026-07-19 PDF 在印度尼西亚,由于缺乏符合文化和语言特点的评估工具,失语症的诊断仍面临挑战。广泛使用的工具如波士顿诊断性失语症检查(BDAE)和西方失语症成套测验(WAB)未针对印尼语境进行改编,而用于诊断、信息和康复的失语症测试(TADIR)虽提供筛查功能,但诊断准确性不足。为弥补这一空白,我们针对印尼语母语者开发了失语症诊断与评估工具(IDEA),并在认知健康的印尼成年人中验证了其效度、信度及常模临界值。研究纳入83名认知正常成年人(经MoCA-Ina筛查),无神经系统疾病史,使用IDEA评估其六个语言域。项目改编自现有工具并经专家审核。采用SPSS v25分析内容效度、内部一致性(Cronbach's α)和结构效度(探索性因子分析)。共纳入83名参与者(中位年龄55.81岁,54%为中等教育水平)。IDEA可行性良好,根据参与者配合程度,平均完成时间为45-60分钟。内容效度经专家一致同意确立。结构效度显示抽样充分性良好(KMO = .872),球形度显著(Bartlett检验χ²(15) = 278.523,p<.001),支持因子分析。六个域的内部一致性信度良好(Cronbach's α = 0.896)。IDEA是评估印尼语母语者失语症的有效可靠工具,作为符合文化背景的评估工具,提供结构化、分域评估,支持经典及进行性失语综合征的鉴别诊断。关键词:失语症,语言评估,印尼语,IDEA,效度
瓜氨酸和粪便弹性蛋白酶1作为胰腺导管腺癌的联合诊断生物标志物 Niazi, U. 2026-07-19 PDF 背景:胰腺导管腺癌(PDAC)的早期检测至关重要。虽然粪便弹性蛋白酶-1(FE-1)是胰腺功能的标准临床标志物,但其对恶性肿瘤的诊断准确性有限。我们旨在寻找能够增强有症状"高风险"患者FE-1检测性能的血浆代谢物。方法:基于DEPEND队列(CRUK C45617/A29908),对可切除PDAC患者(n=23)和健康志愿者(n=24)进行血浆代谢组学分析。预测模型包含特征选择和交叉验证,并在独立外部队列中进一步验证。结果:在发现队列和验证队列中,瓜氨酸在PDAC患者中均显著降低。单独检测瓜氨酸的AUC为0.86(内部验证)和0.88(外部验证)。单独FE-1的AUC为0.67。但瓜氨酸与FE-1联合检测显著提升了诊断性能,联合AUC达到0.96。分层分析显示低分化肿瘤具有独特的代谢组学特征,提示与组织学分级存在关联。结论:将瓜氨酸与FE-1检测整合可显著提升有症状患者的PDAC检出率。这种非侵入性检测组合具有较高的诊断潜力,但需通过前瞻性验证建立临床常规应用的诊断阈值。