跳转至

2026-09-15 每日论文

来源 独立页面
arXiv arXiv
bioRxiv bioRxiv
medRxiv medRxiv

arXiv

标题 作者 发布日期 PDF链接 摘要
GPT-6 Astra 科学人工智能:二维 CFET 的热设计与电热分析 Min-Hui Kim 2026-09-15 PDF 二维CFET反相器的热优化需要针对其电学代价测试结构方案。我们在所提供的电热模型内,使用AI智能体工作流考察这些研究任务。在12 nm节点,Astra选择了一种重新分布的源极互连几何结构,而一个协调智能体则提出了一条指向衬底的散热路径。该组合设计在固定金属体积和20 μW下将峰值温升降低了1.67 K。随后的金属电阻敏感性分析给出了约0.6 K的反相器冷却,同时伴随2%的nFET开态电流损失。有效接触长度缩放进一步表明,当电流下降时,较低的温度可以伴随较高的热阻。复现识别出一致的实现,并保留了一个104.95 K的失败用于诊断。这些结果表明,AI科学家工作流能够提出热结构,在共同约束下对其进行测试,并量化其电学代价。
大语言模型中反事实自我解释的实证研究 Giannis Kalyvas 2026-09-15 PDF 大型语言模型可以轻松地为其自身输出生成解释,但这类自我解释未必忠实于模型的行为。我们通过反事实自我解释来研究这一问题,即模型对输入进行最小编辑,使其自身的预测发生变化。在情感分析和自然语言推理任务中,我们评估了来自LLaMA-3和Qwen-2.5系列的十个指令微调模型,测量其忠实性、最小性以及与人工标注理由的一致性。我们的结果表明,模型规模是解释质量的最强决定因素:更大的模型显著更有可能生成能够翻转其自身预测并针对决策相关证据的反事实。相比之下,理由引导条件生成的是编辑最小化的反事实,同时也更符合人类判断。然而,它并未持续提升忠实性。总体而言,反事实自我解释可以提供关于模型决策的有用行为证据,但其可靠性在很大程度上取决于模型能力,应当通过实证验证而非默认假设。
通过个性化示例检索增强程序性写作:以烹饪食谱为例的研究 Paola Mejia-Domenzain 2026-09-15 PDF 撰写高质量的过程性文本对许多学习者而言是一项具有挑战性的任务。尽管基于示例的学习作为一种反馈方法已展现出潜力,但当所有学习者都接收相同内容而不考虑其个人输入或先前知识时,便会出现局限。因此,一些学习者难以理解或关联这些反馈,觉得其冗余且无用。为解决这一问题,我们提出了RELEX,一个自适应学习系统,旨在通过个性化的基于示例的学习来提升过程性写作。我们系统的核心是一个多步骤示例检索流程,根据每位学习者的独特输入,为其选择更高质量且与情境相关的示例。我们在烹饪食谱领域实例化了我们的系统。具体而言,我们利用一个经过微调的大型语言模型来预测学习者烹饪食谱的质量分数。利用该分数,我们从包含超过18万份食谱的庞大数据库中检索更高质量的食谱。接下来,我们应用BM25实时选择语义上最相似的食谱。最后,我们利用领域知识和正则表达式,为所选示例食谱添加个性化的教学解释。我们通过一项2×2对照研究(个性化与非个性化示例、反思性提示与无提示)对RELEX进行了评估,共有200名参与者。我们的结果表明,提供量身定制的示例有助于提升写作表现和用户体验。
内在机器人奖励:复用VLA表征实现自主评估与策略改进 Tobias Schaffer 2026-09-15 PDF 视觉-语言-动作(VLA)系统已经汇集了机器人学习的两种宝贵资源:丰富的视觉表征和成功任务执行的演示。内在机器人奖励(IRR)提出将这些资源用于第二个互补目的:评估机器人自身的结果并为策略改进提供反馈。成功的演示终点定义了任务特定的参考,而策略的冻结视觉编码器提供了评估新结果的特征空间。核心奖励机制在现有流程中添加了一个参考库和一个评分操作,而不需要单独的学习评估器或额外的感知主干。我们的立场是,这种复用为降低集成工作量、高效计算奖励以及减少反复的人工结果评分提供了一条有前景的路径。基于视觉奖励和从经验中学习的既有研究,IRR将这些思想引入机器人现有的感知和演示流程中。一个可运行的COMAU Racer 3演示器已达到技术就绪水平4(TRL 4)。这一实验室基础支持下一步研究:将内部结果评估与物理策略改进相连接。我们提出了奖励公式、核心研究问题,以及一种将奖励可靠性与任务成功和监督工作量相关联的评估方法。预期贡献是一种可复用的方法,用于从工业机器人系统中已有的数据和经验中学习和改进。
不只是又一个文本基准:让“视觉”回归大型视频模型的视觉问答 Rwiddhi Chakraborty 2026-09-15 PDF 大型视频模型在广泛的视觉问答任务上展现出令人瞩目的性能,这得益于强大的预训练文本和视觉编码器的兴起。此类模型的实用性也已在大量基准测试中得到验证,但有一个重要的前提——这些基准测试中的主流方法是通过文本选项来评估多项选择推理。这是测试这些模型中基于文本推理的一种自然方式,并在社区中就模型行为产生了重要见解。在这项工作中,我们提出了一个不同的问题——当评估模态是视觉而非文本时会发生什么?我们引入了三个新的以视觉为中心的评估基准,分别涉及时间帧检索、视频未来预测和因果记忆扭曲,所有这些都旨在评估大型视频模型中的视觉理解能力。我们的方法补充了前沿模型中评估视频理解的现有方法。我们表明,当前沿模型试图通过视觉查询而非文本进行推理时,表现出显著的弱点。我们最后提供了一个扩展分析部分,为大型视频模型视觉理解的未来改进提供了指引。
使用LLM发现数学形式化建模中的常见错误 Lilian Killich 2026-09-15 PDF 使用逻辑公式、数学方程或正则表达式等数学形式体系进行建模,对计算机科学及其他STEM学科的学生而言是一项重要却充满挑战的任务。识别此过程中出现的常见错误,是朝着通过提供有针对性的高质量反馈(例如在交互式学习系统中)来帮助困难学生迈出的重要一步。我们提出了一种工具支持的工作流程,能够:(1) 识别出可解释大型教育数据集中众多学生错误的常见错误候选;(2) 根据相似性对候选进行聚类;(3) 为教师和计算机科学教育研究者可视化所得的聚类结果。该可视化旨在帮助研究者识别常见的建模错误。常见错误的候选由错误修复变换表示,这些变换将错误的形式化转换为正确的形式化;它们由LLM生成,并通过算法进行验证。我们通过以下方式表明该方法效果良好:重现了文献中手工识别的命题逻辑建模中的常见错误;表明与其他算法方法不同,基于LLM的方法适用于非常大规模的数据集;并将其应用于多种其他形式体系,以展示其可推广至命题逻辑之外。
智能体RDZ:利用AI智能体实现自主区域管理及FR3共存用例 Minh Dat Nguyen 2026-09-15 PDF 无线电动态区(RDZ)允许无线实验在传统频谱监管之外运行,同时持续保证对现有用户的保护。现有的RDZ原型通过手工编写的规则和预定义的工作流程,以程序化方式自动完成这一任务,当实验遇到设计时未预料到的硬件损伤、用户工作流程和设备或干扰机制时,就会变得脆弱。本文介绍了智能体RDZ(A-RDZ),据我们所知,这是首个由智能体使用大型语言模型(LLM)执行频谱管理、实验管理、政策解读和区域编排的RDZ实现。该架构建立在GENESIS智能体框架之上,将自主推理与确定性策略门控和近实时(near-RT)反射机制相结合,使智能体能够改善结果,但绝不会削弱区域的保护保证。我们在硬件在环的Frequency Range 3(FR3)(7.125-24.25 GHz)开放无线接入网(O-RAN)测试平台上验证了A-RDZ,其中5G新空口(NR)实验与仿真的固定卫星服务(FSS)地球站现有用户共存。在一个端到端用例中,监测智能体从实时频谱证据中检测到发射违规,编排器选择一种缓解措施,在恢复干扰预算的同时保持实验继续运行,该操作通过O-RAN控制平面应用并验证。我们报告了从检测到缓解的延迟分解,并讨论了智能体运行的实际限制,包括非确定性推理和决策到行动的转换。
跨标准LoRA适配器的共享前缀KV复用:质量与服务权衡 Dushyant Rajput 2026-09-15 PDF 一个常见的小模型部署方案是运行一个共享主干网络,并配备多个LoRA专家模型,它们在同一上下文上作答。朴素地服务这些专家模型会导致每个专家模型都对共享上下文重新做一次预填充。我们研究一个狭窄而实际的问题:对于已经训练好的标准LoRA适配器——而非为缓存兼容性重新训练的适配器——如果主干网络的预填充KV缓存只计算一次并在各专家模型间复用,能保留多少任务质量,以及在服务成本上能带来什么收益?在一个Qwen3-1.7B主干网络上配备两个适配器(HotpotQA上的抽取式问答、GSM8K上的算术推理),我们扫描专家模型从复用的基础缓存接管的边界,并测量配对质量差异和服务成本。全前缀复用具有最低的预填充成本,并在留出的GSM8K上有较小的质量差异(在160 token预算下Delta = -4.6 EM;320 token下为-3.0;在第二个训练种子下为-0.8——全部偏向原生,仅第一个排除零,且幅度不一致)。部分重计算未显示出任何优势。质量等价性和通用边界选择规则均未得到确立。我们还报告了一个闭式岭KV转换器,它未能胜过直接复用,以及专家依赖对比,其区间均包含零。测得的服务收益是热缓存下的首token时间,它随上下文增长(8K时约16倍);双分支峰值内存仅低12%,而且经检查,前缀从未在各分支间物理共享——该实现复用了KV值但复制了其存储,因此共享缓存的内存节省并未实现。
符号分离:将深度智能体扎根于知识图谱以实现可信的操作数据分析 Baibek Davletiyarov 2026-09-15 PDF 生成式人工智能承诺为数据中心和工业4.0设施中海量的数值遥测数据提供自然语言访问,然而文本到查询以及使用工具的智能体仍然不可靠:即便是前沿模型也只能回答略多于一半的真实世界数据库问题,对于多步骤的操作性问题回答率更低,因为大语言模型必须组织异构数据源之间的关联方式,并且会臆造这些关联,而不仅仅是字段。我们提出符号分离:一个深度智能体可以自由推理,但只能通过一个受本体约束的虚拟知识图谱对数据采取行动,并带有确定性的执行前验证。与工具API的接口契约不同,这种领域语义契约将复杂问题转化为一次经过验证的图遍历,而非由大语言模型推断的连接。将其实例化为神经符号深度分析师,并在49.9 TB的超级计算机遥测数据上针对一个刚性工作流和一个非符号消融进行评测,它将端到端任务成功率从43%提升至86%,防止了任何句法检查都无法捕获的静默数据完整性错误,并将token成本降低2.4倍,使一个较小的本地部署模型能够超越一个较大的模型。
通过随机动态模式分解和深度学习的高保真数字孪生数据模型及其在流体动力学中的应用 Diana A. Bistrian 2026-09-15 PDF 本文的目的是通过非侵入式技术(即不需要将控制方程进行伽辽金投影到降阶模态基上)从数值代码输出中识别高保真数字孪生数据模型。在本文中,作者将数字孪生数据模型(DTM)的概念定义为一个降阶复杂度的模型,其主要特征是镜像原始过程行为。DTM的显著优势在于能够以高精度和降低的CPU时间与硬件成本再现动力学,适用于由于动力学随时间变化的复杂性而难以探索的设置。本文引入了一个新框架,通过结合两种最先进的工具来创建高效的数字孪生数据模型:随机动态模态分解和深度学习人工智能。结果表明,输出与原始源数据一致,并具有降低复杂度的优势。DTM在三个复杂度递增的激波现象数值模拟中进行了研究。作者从数值精度和计算效率方面对新数字孪生数据模型的性能进行了全面评估。

bioRxiv

标题 作者 发布日期 PDF链接 摘要
生物膜在胆汁酸胁迫下促进肠道细菌群落的耐受性和稳定性 Louro, M. 2026-09-15 PDF 已有若干机制被描述来解释细菌物种如何在哺乳动物肠道中定植并持续存在。然而,生物膜形成作为肠道微生物群共生体持续存在的一种机制,仍未得到充分探索。尽管个别肠道共生体形成生物膜的证据开始出现,但其在多物种肠道微生物群群落中的发生情况及相关性仍研究不足。在此,我们建立了一个体外模型,利用Oligo-Mouse Microbiota 12(OMM12)联合体——一个由小鼠肠道分离株组成的明确群落——来研究多物种肠道微生物群生物膜。我们研究了群落生物膜的形成及其对胆汁酸的响应,胆汁酸是宿主来源的、释放到肠道中的类似去污剂的分子,可扰动细菌生长和群落结构。我们鉴定出两个OMM12成员的不同贡献:去除Enterococcus faecalis强烈降低了群落生物膜生物量,而去除Bacteroides caecimuris对生物量影响有限,但强烈改变了物种关联。这些结果连同单培养实验表明,个体生物膜能力并不能直接预测群落层面的贡献。此外,浮游和生物膜群落对胆汁酸胁迫的响应明显不同。浮游培养虽然对胆汁酸更敏感,但表现出恢复力,在去除胆汁胁迫后24小时内恢复生长产量。相比之下,群落生物膜对胆汁酸胁迫表现出更强的耐受性和更多的物种关联。总体而言,我们的发现支持生物膜作为一种群落层面的生活方式,能够缓冲明确的肠道微生物群群落免受宿主相关化学扰动的影响。
妊娠期代谢与病毒双重打击破坏小鼠胎盘特定营养转运系统 Ferraz, T. 2026-09-15 PDF 胎盘会适应以支持营养转运,从而满足生长中胎儿的需要。母体肥胖和病毒感染与不良的胎儿-胎盘发育相关。共同暴露如何影响整个妊娠期的胎盘形态和营养转运仍不清楚。我们假设,共同暴露对胎盘形态和营养转运体表达的影响会大于任一单独暴露。C57BL/6J小鼠在妊娠前及整个妊娠期被喂以对照(CON)或高脂(HF)饮食,并在妊娠日(GD)12.5、15.5或18.5暴露于poly(I:C)或载体。分别通过苏木精和伊红染色、免疫组织化学(报告为免疫反应性(ir)染色面积百分比)和qPCR评估胎盘形态、叶酸和脂肪酸转运体mRNA表达及定位。在GD12.5,HF饮食与交界区(JZ)和迷路区(LZ)面积减少以及母体血窦增加相关,随后在GD15.5出现胎儿血窦减少,到GD18.5时JZ和LZ面积增大。HF饮食和病毒感染在GD12.5分别与胎盘Fat/Cd36 mRNA表达增加相关。然而,在GD12.5,HF饮食和感染与ir-FR-增加相关,而单独HF饮食使ir-PCFT减少。到GD15.5,HF饮食与胎盘ir-FR-减少但ir-PCFT增加相关。在GD18.5,感染与Rfc1 mRNA表达减少相关。HF饮食和感染与SGA和LGA胎儿的患病率更高相关,尤其是在GD18.5。肥胖和感染以区域和妊娠年龄特异性的方式独立且协同地破坏了胎盘形态和营养转运体表达,并对整个妊娠期的胎儿生长产生影响。
当前对种群恢复力的估计在面对方向性环境变化的长期影响时并不稳健 Cant, J. 2026-09-15 PDF 全球的自然系统正面临着由定向环境变化所施加的逐渐变化,即所谓的斜坡干扰。然而,当代对种群恢复力的评估主要关注系统在一次性(即脉冲)干扰后的抵抗力和恢复能力。因此,我们目前对种群统计恢复力的认识忽视了斜坡干扰累积效应对种群动态的潜在影响。通过模拟50年斜坡干扰情景对344个物种、511个种群的存活率和繁殖力动态的影响,我们揭示了定向环境变化将以非线性模式重塑自然种群恢复力的方式。据此,现有的种群恢复力估计在持续不断的环境变化背景下并不稳健。相反,我们证明了有必要量化能量资源在存活与繁殖力之间的相对分配如何影响种群恢复力。我们的发现对使用成熟方法来预测种群在持续全球变化下的恢复力提出了挑战。
预测生态系统对与海上风电场和海洋变暖相关的环境变化的响应 Dye, B. 2026-09-15 PDF 海上风电场(OWFs)正在迅速扩张,以满足日益增长的可再生能源需求,预计其开发将进一步向近海深水区延伸。鉴于人类活动足迹的扩大,更好地理解海上风电场的长期生态后果及其与持续气候变化之间可能存在的相互作用十分重要。我们采用耦合的水动力-生态系统-生物地球化学水柱模型(GOTM-ERSEM-BFM)来研究生态系统对与海上风电场及气候变暖相关环境变化的整体响应。具体而言,我们考察了与海上风电场相关的场景,包括底栖滤食活动减弱(代表海上风电场污染物排放的潜在影响)以及风驱动力减弱,同时结合海表温度升高。这些场景分别单独模拟并组合模拟,以探索潜在的交互效应。这些场景在北海两个对比鲜明的地点进行模拟,分别代表一个充分混合的沿岸站点和一个季节性层化的近海站点。沿岸站点在各场景下表现出相对温和的生态系统响应,而较深的近海站点响应总体更强。在近海站点,层化变化改变了垂向营养盐动态,并导致表层与底层之间生态系统响应出现显著差异。我们的结果表明,生态系统对与海上风电场相关及气候驱动的环境变化的响应强烈依赖于当地环境条件,这表明随着风电场开发从较浅环境向较深环境扩展,其生态后果可能大不相同。
景观结构复杂性影响着生态系统和人类的全球分布 Cant, J. 2026-09-15 PDF 陆地与海洋景观的三维结构将生物过程与非生物过程联系起来,塑造了生物利用其环境的方式。大量研究致力于理解这种结构复杂性与生物多样性之间的关系。然而,针对特定系统量身定制的方法来量化结构复杂性,阻碍了跨系统的比较。我们扩展了一个为量化局部尺度地表环境结构复杂性而开发的几何框架,生成了高度范围、粗糙度和分形维数等关键复杂性指标的全球高分辨率地图。我们展示了这些复杂性属性的格局如何与全球生态系统分布、土地覆盖类型以及人类存在情况相对应。利用几何工具来理解结构复杂性如何与自然和社会生态系统的布局相关联,我们能够更好地预测它们对持续全球变化的响应。
综合药理学与结构分析揭示与合成大麻素受体激动剂效力相关的CB1残基相互作用模式 Kwon, H. 2026-09-15 PDF 背景与目的:在新精神活性物质中,合成大麻素受体激动剂(SCRAs)具有相当大的结构多样性,并且在大麻素受体1(CB1)的效价和效能方面表现出广泛差异,但这些差异背后的分子和受体相互作用特征仍不清楚。我们评估了16种SCRAs的药理学特征,并考察了与CB1效价和效能差异相关的结构特征。实验方法:在基于CB1-G15的Ca2+实验中测量CB1激动剂活性,并在小鼠中评估僵住效应。通过分子对接至活性态CB1结构来表征配体-受体相互作用。对残基水平相互作用谱应用主成分分析(PCA),并检验所得分数与CB1效价和效能之间的关联。关键结果:效价和效能在细胞和动物实验中差异很大,几种SCRAs在两种实验系统中表现出不同的药理学反应。PCA识别出一种相互作用模式,其PC1分数与Emax显著相关,但与EC50无关,其贡献来自激活相关的CB1残基,包括PHE200-TRP356开关。分子描述符分析同样识别出与体外和体内Emax显著相关的结构特征。结论与意义:我们的研究结果表明,CB1效能与结构多样的SCRAs之间不同的受体相互作用模式相关。将功能药理学与受体水平相互作用分析相结合,为理解SCRA效能提供了结构见解,并可能有助于优先选择新出现的化合物进行进一步的药理学和行为学评估。
Osprey-MRSI中磁共振波谱成像(MRSI)数据的全自动开源分析与交互式可视化 Zoellner, H. J. 2026-09-15 PDF 目的:磁共振波谱成像(MRSI)是一种用于研究体内代谢空间分布的多功能技术。然而,MRSI 数据处理要求较高,只有少数软件包支持端到端分析。本研究的目标是在开源软件包“Osprey-MRSI”中实现全自动、端到端的 MRSI 分析。方法:在现有 Osprey 工作流的基础上,实现了 MRSI 特有的分析和可视化功能。修改包括空间变换和滤波操作、MRSI 数据的自动脑掩膜和组织分割、改进的脂质滤波、快速积分图、带有显式 B0 频移校正的线性组合建模,以及质量控制图和代谢图像生成。完全交互式 GUI 和半交互式 HTML 报告为用户提供了友好的方式来检查分析的每一步。所有分析衍生物也以 NIfTI 和 NIfTI-MRS 格式导出,便于可视化以及与其他工具箱和模态协同使用。结果:自动化 MRSI 工作流已成功用于分析来自所有主要厂商(Philips、GE、Siemens)跨多个站点的短 TE 和中等 TE 3T 在体 MRSI 数据集。使用来自各厂商的体模数据和现有 MRSI 处理工具,验证了 MRSI 数据与 MR 图像的正确共配准。结论:Osprey-MRSI 为非专家用户提供了最先进的方法,且只需极少用户交互。该工作流和建模算法的模块化将促进新型 MRSI 特有分析方法的创新与开发。
行波支持节律性注意搜索 Kong, Y. 2026-09-15 PDF 脑活动在空间和时间中展开,产生时空动态,表现为皮层行波——即平滑的相位偏移在皮层上传播。尽管行波已在不同物种和测量尺度上被观察到,但其在人类认知中的功能作用在很大程度上仍是从相关性证据中推断出来的。在健康人类中,大规模神经动态必须通过非侵入性方法进行研究,这限制了对某神经起源的获取。在此,我们检验了全局行波是否在注意过程中因果性地促进区域间通信。使用经颅磁刺激(TMS),我们诱导了可用脑电图检测到的长程行波,并评估了其在注意搜索任务中的神经和行为后果。施加于右侧额叶眼动区的双脉冲TMS短暂扰乱了正在进行的全局波,并选择性地诱导了向枕叶视觉皮层传播的方向特异性和频率特异性行波。这些TMS诱导的前向后theta行波受到相对于搜索试次起始的刺激潜伏期的节律性调制。关键的是,行为表现表现出相同的节律模式,当TMS诱导的行波更为显著时,注意搜索表现得到改善。总之,这些发现提供了因果证据,表明大规模行波在节律性视觉注意过程中支持区域间通信。
沉默基底前脑向边缘下皮层的胆碱能输入使恐惧消退对重现具有抵抗性 Lay, B. P. P. 2026-09-15 PDF 内侧前额叶下边缘皮层(IL)对条件性恐惧的消退至关重要,并接受来自基底前脑的密集胆碱能神经支配,尤其是来自斜角带水平支(HDB)的投射。IL中乙酰胆碱的释放调控恐惧相关过程,但其涉及机制仍知之甚少。我们研究了从HDB到IL的胆碱能投射是否调控恐惧记忆的形成、消退和重现。利用光遗传学技术在雄性和雌性转基因大鼠中,我们在恐惧条件化或消退期间沉默HDB至IL的胆碱能通路。在恐惧条件化期间沉默无效果,而在消退期间沉默增强了消退提取并阻止了恐惧重现。这些效应具有解剖特异性,因为沉默邻近的HDB至前边缘皮层通路没有此类后果。在离体IL脑片中,刺激HDB胆碱能终末优先兴奋中间神经元而非锥体神经元,这与对IL输出的前馈抑制一致。最后,在消退期间阻断IL烟碱型乙酰胆碱受体完全再现了沉默该通路的效应,而毒蕈碱型阻断减弱了重现而不影响消退提取。这些发现表明,从HDB到IL的胆碱能输入控制消退的获得和情境特异性,并确定IL中的烟碱信号作为改善基于消退疗法的潜在靶点。
预测误差的层级结构塑造了情境依赖性感觉表征的学习 Tsai, M. C. 2026-09-15 PDF 感官信息如何被解读取决于情境,然而情境塑造感官处理的神经机制仍知之甚少。为解决这一问题,我们建立了一个计算模型,该模型受小鼠在触觉感官辨别任务逆转学习期间皮层神经元的在体功能成像所约束。在学习过程中,第2/3层躯体感觉神经元增强了对奖赏预测性刺激的反应。该模型通过选择性地对顶端树突输入进行自上而下的增益放大,同时伴随奖赏预测误差的减少和对结果预测信心的增加,解释了这些观察结果。在规则逆转时,外侧眶额皮层通过去抑制性VIP中间神经元,编码了一种情境预测误差,标志着信心的丧失。跨皮层区域的奖赏预测误差和情境预测误差的层级结构,反映在调节初级感觉皮层中模拟锥体神经元顶端活动的自上而下信号中。该模型解释了情境变化如何被检测,以及源自不同皮层区域的奖赏预测误差和情境预测误差信号如何相互作用以重塑感官表征。

medRxiv

标题 作者 发布日期 PDF链接 摘要
可解释的生物标志物程序预测狼疮性肾炎的治疗反应:在四种治疗方案中的患者水平验证 Kumar, P. 2026-09-15 PDF 晚期临床试验失败很大一部分反映的不是靶点的底层生物学,而是入组人群的构成:试验招募了药物无法起效的患者。因此,在治疗前识别可能应答者的方法,所针对的是一种仅靠更好的靶点选择无法解决的失败模式。我们将可解释机器学习应用于狼疮肾炎治疗应答队列的基因表达数据(GSE224705;319 个样本、21,914 个基因),涵盖四种方案:吗替麦考酚酯(MMF)、硫唑嘌呤(AZA)、羟氯喹(HC)和标准治疗(SOC)。我们独立重建了表达矩阵和元数据,重建了各治疗方案特异性队列,并推导出紧凑的多基因程序,用于在每一治疗人群中区分应答者与非应答者。由此得到两个结果。第一,判别性能按方案呈现明显梯度。由五到十个基因组成的紧凑程序在患者层面达到 AUROC 0.847(MMF)和 0.866(AZA),但 HC 仅为 0.718,SOC 仅为 0.623;SOC 程序的表现接近随机(MCC 0.119,平衡准确率 0.555)。应答在转录层面无法判别的方案,对试验设计而言是一个可操作的发现,而非零结果。第二,这些程序被证明比生成它们的差异表达基因列表稳定得多:重建得到的显著基因计数与已发表分析差异显著(MMF 为 222 对 46;AZA 为 4,455 对 157;HC 为 6 对 24;SOC 为 5 对 11),但主导生物学和预测性能得以保留。这些程序也是非冗余的:从 MMF 程序中移除单个基因(TUBB2A)使 AUROC 降低约 0.17。在通路层面,13 个跨治疗富集关系经校正后仍显著,表明应答图谱具有治疗特异性但又相互耦合。这类可推广至患者的程序为富集式试验设计提供了一条具体的近期路径,可在入组前识别特定疗法适合哪些患者。我们的结果也提示,差异表达基因的数量并不能很好地代表应答信号的强度或稳定性。
可手术调整的插入几何结构驱动改良Blalock-Taussig-Thomas分流术中的血栓形成性血流 Qiao, Y. 2026-09-15 PDF 摘要 背景:改良Blalock-Taussig-Thomas分流术(mBTTS)可维持发绀型或单心室心脏病婴儿的肺血流,但分流血栓形成发生率为8-12%,并伴随较高的死亡率。全身抗凝治疗效果有限。目的:本研究检验了通过手术可调整的分流几何形态,是否可能通过管理致血栓性血流动力学,形成第二种、患者特异性的维持分流畅通的方法。方法:根据10名婴儿(4例血栓形成,6例通畅)的计算机断层扫描重建三维mBTTS解剖结构。将来自多普勒超声的搏动性入口波形与根据导管测压逐一校准的三元件Windkessel出口模型耦合。瞬态计算流体动力学模拟预测了壁剪切率(WSR)和伸长应变率(ESR)。评估了与手术相关的几何参数和血流动力学指标之间的关联。结果:在所有10个模型中,模拟压力与所有四个出口的临床测量值密切匹配。尽管解剖变异较大,峰值WSR和ESR在10名患者中的8名一致定位于分流-锁骨下静脉连接处,包括所有4例血栓形成的分流。分流插入角度偏离垂直方向越大,与更高的收缩期和周期平均归一化WSR相关({rho} = 0.94,p < 0.001;{rho} = 0.88,p = 0.002)以及ESR相关({rho} = 0.82,p = 0.007;{rho} = 0.70,p = 0.03)。较大的分流直径与较低的WSR和ESR相关。血栓形成的分流较通畅分流表现出更高的剪切相关指标,尤其是在收缩期。结论:在患者特异性mBTTS解剖结构中,插入角度和分流直径是局部异常血流的决定因素,且集中于分流-锁骨下静脉连接处。患者特异性血流动力学评估可能为分流构建和分期间风险分层提供信息。
绘制听觉脑干反应的诊断空间:一个可解释的分类框架 Clementi, L. 2026-09-15 PDF 背景:听觉脑干反应(ABR)是客观且高度标准化的诱发电位,但其临床解读在很大程度上仍依赖专家的视觉评估。大多数自动化ABR方法侧重于信号检测、阈值估计或波形识别,而将ABR特征与临床有意义类别相联系的诊断推理仍未得到充分形式化。方法:我们开发了一个基于规则的理论框架用于ABR分类。定义了九个临床相关描述符:波I、III和V的波幅;波I、III和V的潜伏期;I/V波幅比;以及I-V和III-V峰间期。生成了完整的理论组合空间,并使用考虑不适用描述符、代数一致性和神经生物学合理性的规则逐步缩减。两名专家评分者独立标记有效配置,并与语言模型辅助和基于逻辑的规则系统进行比较。一致性通过百分比一致率和Cohen's k评估。使用随机森林分析探索描述符重要性。结果:初始的5,832种可能ABR配置空间被缩减为343种有效配置。专家评分者之间表现出高度一致性,一致率为84.55%,Cohen's k = 0.620。专家分类与语言模型辅助规则之间的一致性较低,而基于逻辑的规则与两名评分者均表现出更高一致性,并被保留为最终提出的规则集。诊断空间高度不对称,NORM、PPSHA和PPC占据狭窄区域,而PB和MIXED代表更广泛的诊断域。波I波幅是跨分类代理中最具影响力的描述符。结论:本工作通过将广泛的理论组合空间转化为受约束的诊断域,为ABR分类提供了一个可解释的框架。这项概念验证研究支持将ABR解读建模为植根于听觉神经生物学的结构化诊断空间的可行性,为未来临床验证和半自动化决策支持工具提供了可重复的基础。
打鼾的声音:基于人工智能的阻塞性睡眠呼吸暂停上气道阻塞声学表型分析 Leone, F. 2026-09-15 PDF 背景:药物诱导睡眠内镜(DISE)是目前识别阻塞性睡眠呼吸暂停(OSA)上气道阻塞解剖部位的参考标准,但其有创性和可及性有限限制了其常规应用。由于打鼾是由阻塞性上气道结构振动产生的,其声学特征可能为阻塞解剖部位提供一种无创生物标志物。本研究探讨机器学习能否仅利用声学信息可靠区分腭部打鼾与会厌打鼾。方法:对159例来自中度、非体位性OSA成年患者的DISE录音进行回顾性分析。打鼾事件由两名设盲的专家检查者独立识别并进行解剖学分类。仅纳入观察者间完全一致的事件。提取相应音频片段,并使用频谱、倒谱、时域和谐波声学特征进行表征。采用递归特征消除进行特征选择。使用患者独立的嵌套交叉验证框架开发支持向量机(SVM)和多层感知机(MLP)分类器。结果:最终数据集包含1,759个打鼾事件,包括1,054个腭部录音和705个会厌录音。两种分类器在患者独立验证下均表现出对两个解剖类别的稳健区分能力,ROC AUC值分别为0.90 +/- 0.03(SVM)和0.90 +/- 0.03(MLP),平衡准确率分别为0.83和0.81。最具信息量的预测因子为频谱特征,尤其是频谱能量分布、频谱通量、梅尔频率倒谱系数(MFCCs)和频谱平坦度,而基频对分类贡献极小。结论:打鼾包含可重复的声学信息,反映上气道阻塞的解剖来源。通过将高置信度DISE衍生的解剖标签与严格的机器学习框架相结合,本研究证明了对临床相关阻塞部位进行无创声学表型分析的可行性。我们的工作并非提出一种新的人工智能算法,而是建立了一个面向临床的框架,可能支持未来用于患者选择、治疗规划以及多中心开发综合声学表型模型的决策支持工具。
帕金森病跨人群的溶酶体多基因风险评分。 Sun, W. 2026-09-15 PDF 背景:溶酶体功能障碍已被认为与帕金森病(PD)的发病机制有关。然而,溶酶体多基因风险评分(lyso-PRS)尚未在不同人群的PD中得到广泛评估。目的:(1)评估lyso-PRS在不同人群中预测PD风险的表现;(2)比较欧洲人群中特发性PD(iPD)、GBA1-PD、非显性GBA1携带者(NMC)和健康对照(HC)之间的lyso-PRS;(3)评估欧洲人群PD患者中lyso-PRS与临床结局的关联。方法:我们分析了全球帕金森病遗传学项目(GP2)数据集的Neurobooster阵列数据,包括十个祖先来源的32,054例iPD病例和18,188例健康对照。结果:(1)lyso-PRS在欧洲人群中表现最佳(欧洲-GP2测试队列:AUC = 0.602,p = 2.02e-172;欧洲-TUEPAC验证队列:AUC = 0.632,p = 5.34e-20),在其他人群中表现较差(AUC:0.51-0.59,p<0.05)。(2)在欧洲人群中,lyso-PRS可区分GBA1-PD与HC(AUC = 0.621,p = 7.83e-71)以及与NMC(AUC = 0.621,p = 1.05e-18)。(3)在欧洲-GP2队列中,较高的lyso-PRS与较早的发病年龄显著相关({beta}=-0.21,p=0.022),并与较高的统一帕金森病评定量表(UPDRS)评分显著相关({beta}=0.32-1.13,所有p < 0.05)。结论:lyso-PRS与iPD和GBA1-PD状态相关,在欧洲人群中具有最强的预测性能,这凸显了提高其他祖先人群预测准确性的必要性。在欧洲人群中,lyso-PRS显示出与临床特征的关联;然而,并非所有发现都在验证队列中得到重复,这凸显了在大型和多样化队列中进一步研究的必要性。
空间上下文感知变换器促进基于建模的脑部MRI图像中细微病变的异常检测 Schwarz, J. 2026-09-15 PDF 在高分辨率3D体积中检测微小和细微病变是生物医学成像中一个高度相关但远未解决的任务。我们在此通过我们新颖的半监督空间上下文感知变换器(SpyCAT)异常检测方法,处理检测某些类型致癫痫病变的特定任务。SpyCAT在某种意义上是基于建模的,即它建立在构成正常以及构成对正常的相关偏差的特定假设之上。我们明确使用这些假设来证明我们异常检测方法的归纳偏置。由此产生的SpyCAT系统是基于补丁的,并使用变换器架构来处理从矢量量化变分自编码器获得的离散标记,该自编码器通过对每个补丁进行完整3D卷积来生成反事实补丁。我们在两种致癫痫病变亚型的点注释基础上评估我们的方法,使用基于Metrics Reloaded框架的验证指标,表明SpyCAT能够可靠地识别和定位所考虑的病变类型,并优于最先进的参考方法。
已建立的合并症评分在女性和男性中预测院内死亡率的效果是否相同?一项基于2010-2024年1.667亿德国住院病例的全国性验证 Decker, J. A. 2026-09-15 PDF 目的。确定三种已有的合并症评分(Charlson合并症指数、Elixhauser合并症总和、van Walraven评分)在男女两性中应用同一公式时,是否具有同等良好的校准度和同等程度的区分度,以及任何差异是否达到预先设定的临床相关性阈值。设计。基于人群的回顾性队列研究;对三个既有预测模型进行外部验证(TRIPOD第4类),并进行按性别分层的评估。分析计划在任何汇总数据存在之前,已固定于带有时间戳的研究数据中心提交语法中。地点。德国;对2010至2024报告年度所有按疾病诊断相关组(DRG)计费的急性躯体成人住院病例进行全国完整枚举。参与者。166 693 491例符合预先设定的九步资格筛选的成人住院病例。主要结局指标。院内死亡。主要轴:校准度(总体校准,CITL;校准斜率;各评分五分位组的观察死亡率)。次要轴:区分度(受试者工作特征曲线下面积,AUC)。预先设定的阈值:性别间斜率差异至少0.05,AUC绝对差异至少0.01。结果。总体校准在男女两性中实际上均完美(|CITL| [≤] 0.0004)。各评分在预测如何跟上风险升高方面出现分化,且在女性和男性中方向相反:对于Charlson指数,男性校准斜率为0.968,女性为1.034(差异0.066),Elixhauser总和(0.039)和van Walraven评分(0.029)的差异较小。在同一评分五分位组中,大多数五分位组的观察死亡率男性更高,最大风险比为1.21(95 % CI 1.20至1.22);两个van Walraven五分位组方向相反(0.87和0.97)。区分度差异较小(随机效应AUC差异:Charlson -0.0076,95 % CI -0.0095至-0.0057;Elixhauser总和 +0.0074;van Walraven -0.0026)。结论。当以同一公式应用于男女两性时,三种已有的合并症评分在女性和男性中的校准不同,而它们的区分度仅略有差异。由于这些评分在研究中以及医院间风险调整死亡率比较中被大规模重复使用,校准中的系统性差异不会相互抵消。这支持进行性别特异性重新校准。对医院基准比较的下游影响尚未量化,不应被假定为可忽略。研究注册。OSF DOI 10.17605/OSF.IO/P3QAW。
肠道微生物组衍生的风险评分与未来癌症发展相关 Oosterhout, E. 2026-09-15 PDF 癌症仍然是全球发病和死亡的主要原因,新发癌症病例的发病率正在上升。虽然吸烟、肥胖和饮食等已知生活方式因素会增加癌症风险,但肠道微生物组已成为癌症的一个标志。然而,肠道微生物组在癌症中的作用主要是基于癌症患者在微生物组采样时(现患癌症)的病例对照研究以及功能研究确定的。在此,我们研究了肠道微生物组是否能够识别在随访期间(新发癌症)被诊断出癌症风险增加的个体,这可能是在微生物组采样多年之后。利用基于人群的Lifelines队列和荷兰微生物组计划中5,997名参与者的粪便样本的鸟枪法宏基因组测序,并结合纵向癌症登记数据,我们开发了一种基于28种微生物物种的微生物组衍生风险评分。在调整已知癌症风险因素后,微生物组风险评分较高的个体在长达10年的随访期间接受癌症诊断的风险更高(每增加1个标准差的调整后HR为1.62;95% CI,1.44-1.82;P=1.54e-15)。在包含1,879名微生物组采样时患有癌症的患者和5,341名无癌对照的独立外部数据集中,微生物组风险评分也能区分癌症病例和对照。在基于人群的独立FINRISK队列中,该评分进一步显示出一致的趋势,即在随访期间328名新发癌症个体和5,670名无癌症个体中,无癌生存率降低。总之,这些发现表明肠道微生物组在癌症诊断前数年就存在可检测的特征,并突显了其作为早期癌症风险分层生物标志物的潜力及其在癌症发展中的潜在作用。
晚年学习、认知与老龄化:黎巴嫩贝鲁特中老年成年人的纵向研究(3LC研究) Zeki Al Hazzouri, A. 2026-09-15 PDF 背景:黎巴嫩正在经历显著的人口和社会变迁,老年人约占总人口的10%。晚年学习、认知与老龄化(3LC)研究围绕“老年大学”(UfS)建立,这是贝鲁特美国大学一项长期开展的晚年学习项目。该队列旨在通过纳入UfS参与者以及未参加过该项目、居住在社区的成年人,来利用晚年学习暴露的差异。这为研究晚年学习、生命历程中的社会和生物学因素以及健康行为如何与黎巴嫩的认知老龄化、痴呆风险、心理健康和韧性相关联提供了独特机会。方法:从UfS项目和黎巴嫩周边社区招募50岁及以上的参与者。基线评估包括由访员施测的问卷、标准化人体测量和感官评估,以及用于生物标志物检测和生物样本库保存的血液采集。问卷涵盖健康、心理社会、认知、社会参与和生命历程因素,包括暴露于战争、冲突和社会经济逆境的情况。纵向随访包括计划中的电话随访和面对面评估,间隔约两年。结果:该队列共纳入1,871名参与者,包括536名UfS参与者(350名既往入组者和186名新入组者)以及1,335名社区参与者,其中1,041名在年龄、性别和教育程度上与UfS参与者匹配,另有294名未匹配额外招募。平均年龄为65.6岁(SD=9.0),70.1%的参与者为女性。共从1,541名参与者(82.3%)获得血液样本。结论:3LC研究为研究晚年学习和生命历程因素如何塑造黎巴嫩的认知老龄化、福祉和痴呆风险提供了独特平台。通过整合社会、心理社会、健康和生物学测量指标,该队列为识别认知老龄化的可改变决定因素,并为黎巴嫩及其他资源不足地区的痴呆预防提供信息创造了机会。
中高强度身体活动、年龄依赖性肥胖与高心血管风险老年人的肥胖风险 Fornara, E. 2026-09-15 PDF 目的:探讨高心血管风险老年人中,习惯性中高强度休闲时间体力活动(MVLTPA)与BMI及腰高比(WHtR)纵向轨迹之间的关联,以及肥胖(BMI >=30 kg/m2)和中心性肥胖(WHtR >=0.6)的发生率。方法:在PREDIMED研究的60-80岁参与者中(61%为女性;BMI分析n=5,273,WHtR分析n=4,940),使用明尼苏达问卷评估MVLTPA(MET-min/天,累积均值)。采用带三次样条的混合效应模型,根据MVLTPA水平(>=100[充足] vs <100[不足])估计BMI和WHtR轨迹。使用Cox模型评估新发肥胖结局。结果:报告>=100 MET-min/天的参与者相比活动较少者,BMI和WHtR值更低(差异分别为-1.27至-1.48 kg/m2和-0.021至-0.026),且BMI下降更慢。充足的MVLTPA与中心性肥胖风险降低34%相关(HR 0.66 [0.56; 0.77]),仅在女性中与肥胖风险降低24%相关(HR 0.76 [0.57; 1.00],p-交互=0.084)。非线性分析提示,中心性肥胖风险下降至400 MET-min/天后趋于平台。结论:较高的MVLTPA与高心血管风险老年人有利的肥胖轨迹和较低的中心性肥胖风险相关。