跳转至

medRxiv 2026-10-02

标题 作者 发布日期 PDF链接 摘要
社区环境中的跨专业跌倒预防:基于社会生态视角的老年人观点 Lawton, A. 2026-10-02 PDF 目标:社区居住老年人的跌倒是全球公共卫生问题。尽管跌倒预防照护依赖于医学与相关健康专业人员之间的协作,但老年人对跨专业照护的经历与看法仍未被充分探索。因此,本研究探讨了初级跌倒预防照护的观点与经历,以识别实践中正在提供何种照护、哪些预防机会可能被错过,以及老年人更希望如何提供跌倒预防照护。设计:采用务实取向的定性探索性研究,并使用焦点小组进行数据收集。数据采用反思性主题分析进行分析,主题通过迭代方式形成,随后通过社会生态模型的视角进行解释,以构建一个由消费者知情的社会生态框架,用于社区跌倒预防照护。地点:澳大利亚三个大都市中心(墨尔本、阿德莱德、布里斯班)和两个区域中心(伍登德、沃加沃加)。参与者:36名老年人参加了五个焦点小组。结果:识别出四个主题:对相关健康与跌倒预防的了解、照护可及性、照护协调,以及何时及如何提供照护。每个主题都反映了社会生态各层面之间相互作用的影 响,表明老年人参与跌倒预防的复杂性。结论:尽管对预防性照护有强烈支持,但参与者的经历往往是消费者驱动、反应性和碎片化的。对跌倒和相关健康的了解有限、可及路径不清晰以及照护协调不足,并受到组织和政策背景的影响,被确定为关键障碍。需要进行系统层面的改革,将跌倒预防和相关健康纳入常规照护,并协调资金、协调机制和公共卫生策略,以提供公平、可持续的预防。
通过将多语言多模态机器学习应用于连贯言语,区分加泰罗尼亚语-西班牙语双语者中的非流利/语法缺失型和logopenic型原发性进行性失语 Pugalenthi, L. S. 2026-10-02 PDF 背景 原发性进行性失语症(PPA)的非流利/语法缺失型(nfv)和少词型(lv)变异通过不同的潜在神经认知机制破坏言语流利性。鉴别诊断目前需要数小时的认知语言测试,由于双语服务提供者短缺以及缺乏成熟的评估方法,双语患者还面临额外障碍。在英语使用者中,一种有前景的自动化方法是通过从连贯言语中提取言语时间测量和语言特征,作为机器学习(ML)分类算法的输入,以区分nfvPPA和lvPPA。据我们所知,该方法尚未在双语背景下得到评估。方法 要求34名加泰罗尼亚语-西班牙语同时双语患者(lv = 24,nfv = 10)用其优势语言和非优势语言描述一幅图片(西方失语症成套测验野餐场景)。从参与者录制的回答中,我们提取了四个特征集:言语时间测量,使用PRAAT提取;词级参数,从语料库中提取;语言特征,使用自然语言处理工具SpaCy和CLAN提取;图像-文本一致性得分,使用视觉-语言编码器Multilingual-CLIP提取。每个特征集被输入分类算法,以在参与者的非优势语言和优势语言样本中区分nfv与lv。然后,我们将每个特征集的分类器组合成一个集成模型。我们使用McNemar检验来确定非优势语言和优势语言回答之间分类性能差异的统计显著性。结果 表现最佳的分类器在非优势语言和优势语言中分别达到93%(词级参数)和92%(集成)的F1宏平均得分。对于所有特征集和集成模型,非优势语言和优势语言之间的分类性能没有显著差异。集成建模在任一语言中均未显著改善分类性能。结论 利用多语言多模态机器学习的最新进展,我们使用一种 largely 自动化、时间高效(1-2分钟)且具有生态效度的基于连贯言语的方法,准确区分了患有nfvPPA和lvPPA的加泰罗尼亚语-西班牙语双语个体。未来方向包括在按PPA亚型平衡的更大数据集上评估该方法,并使用连贯言语的自动转录。我们的研究代表着朝着解决当前非英语双语说话者在PPA鉴别诊断中面临的不公平现象迈出了一步。试验注册 临床试验NCT05741853的数据被回顾性分析。
罕见种系变异与胸膜间皮瘤遗传易感性:超越DNA修复 Herman, E. J. 2026-10-02 PDF 少数接触石棉的个体会发生胸膜间皮瘤(PM),提示遗传因素的作用。我们对127名发生PM的EPIC参与者及对照者的血液进行了胚系全外显子组测序。在193个癌症相关基因中评估了罕见致病/可能致病性变异,并评估其与PM风险和总生存期的关联。使用SKAT-O和Firth逻辑回归进行了全外显子组基于基因的罕见变异聚合分析。将PM多基因风险评分(PRS)与PTV状态和石棉暴露进行整合。蛋白质截短变异(PTV)在病例中富集,并与PM风险增加相关(OR=3.5,95% CI 1.3-11.2,p值=0.01)。在调整诊断时年龄和性别后,PTV携带者生存期改善且死亡率较低(HR=0.54,95% CI 0.32-0.92,p值=0.023)。PTV携带者的PRS值较低,在低石棉暴露个体中,其与PM风险增加相关(OR=5.75,95% CI 1.09-58.2,p值=0.023)。基于基因的分析识别出四个新位点。罕见变异和多基因背景可能共同影响PM风险,但需要在更大队列中验证。
多模型大语言模型对品管圈方法学质量的评估:一项设计锚定信度研究 LIn, H. 2026-10-02 PDF 背景:质量控制圈(QCC)报告通常以定性方式评审,但评审工作量和评审者间差异使大规模评估困难。我们评估了多个大语言模型(LLM)能否在一个设计锚定基准上可靠地对QCC方法学质量进行评分。目的:估计QCC质量评分的模型间信度,并评估其与设计锚定的一致性,以及与一小部分公开PMC QCC报告的描述性可比性。方法:对30份合成QCC报告和8份公开PMC QCC报告,由四个主要LLM评估者(GPT、Gemini、Grok、DeepSeek)和一个敏感性评估者(Claude)进行评估;Claude被排除在主要评估组之外,因为合成病例由同一家族模型生成。评估者仅接收报告文本;陷阱清单和设计锚定分数被隐藏,并通过程序化方式验证其缺失。每个病例在八个QCC质量维度上评分,每个评估者运行三次,以中位数汇总,并在主要评估组中估计ICC(A,1)。还考察了锚定校准、在评分前固定的映射下从评估者结构化缺陷输出中检测陷阱、敏感性分析,以及合成报告与PMC报告的描述性比较。结果:主要k=4评估组的模型间信度良好:在来自全部30个病例的239个合并病例-维度行上,ICC(A,1) = 0.843(95% CI 0.812至0.870;病例层面bootstrap 0.782至0.874);各维度估计范围为0.747至0.901。预先指定的包含Claude的k=5分析得到0.833,留一法估计范围为0.835至0.857,最初指定的分数解析器得到0.854。在52个受陷阱影响的病例-维度单元格上,主要评估组共识在设计锚定的1分以内有50个(96.2%),平均绝对误差为0.54,完全一致率为34.6%;51.5%的主要评估组单次运行分数等于锚定分数。87%的评估者运行和94%的(陷阱、评估者)对输出了预期类别的缺陷,而预先指定的关键词检测器分别为55%和68%;由于某些类别无论病例如何都以高基础率输出,这些是上限。所有八个维度均满足描述性合成报告与PMC报告的边际;合成病例倾向于得分更高,仅在行动一致性上显著更高。结论:多模型LLM对QCC方法学质量的评分实现了良好的模型间信度,并与合成锚定分数方向一致,植入的弱点在结构化缺陷输出中被识别的频率远高于关键词匹配。基准可行性已确立;在临床QCC报告中进行专家标注验证是计划的下一步。
肺部和肺外结核的分解动态模型用于疫苗和加强针接种方案评估:以印度VPM1002为案例研究 Revathy, M. 2026-10-02 PDF 摘要 引言 印度肺外结核(EPTB)发病率上升,病死率高于肺结核(PTB)。VPM1002的III期试验未达到主要复合终点,但次要终点显示更强的EPTB信号(疫苗效力42.3%,95% CI -9.1至69.4)。我们未发现已发表的模型能够按疾病类型、营养和社会经济状况以及剂量事件,在动态基线基础上解析结核病。 方法 我们构建了一个确定性模型,包含1,152个人群分区(按年龄、HIV状态、体质指数和社会经济状况分为72层),并校准至WHO印度2015-2024年发病率和死亡率。通过对试验符合方案集和改良意向性治疗估计进行贝叶斯证据合成,分别得出PTB和EPTB效力后验分布,并通过1,000次蒙特卡洛迭代传播。假设保护期为3年或10年,按10年间隔建模三剂接种。经济学分析采用社会视角和卫生系统视角,贴现率为3%。 结果 后验中位效力对EPTB(42.9%,95%可信区间[CrI] -5.6至69.1)高于PTB(14.0%,-19.0至37.9)。在10年保护期下,每1,000,000名目标人群接种三剂可避免5,218例病例(95%不确定性区间153-10,157)、682例死亡(24-1,255)和9,463个伤残调整生命年(DALYs;328-17,404);在3年保护期下,可避免1,961例病例和3,708个DALYs。EPTB约占避免死亡和DALYs的三分之二,但约占避免病例的一半。在10年保护期下,第一次加强针额外避免46%的病例和34%的DALYs,增量效益成本比为19.1(初始剂量为20.7);第二次加强针额外避免8%的病例和4.5%的DALYs,增量效益成本比为6.8。每避免一个DALY的增量成本效果比中位数分别为329美元(10年)和832美元(3年)。 结论 复合终点模型无法显示这种分离。十年后接种加强针的经济效率几乎相当,但避免的疾病更少。这是一个青少年和成人加强针规划,而不是替代婴儿BCG。
基于药物的绩效测量在评估门诊心脏病学临床医生中的可靠性和准确性 Chow, C. 2026-10-02 PDF 背景:多种绩效指标被用于评估常见心血管疾病的管理,如冠状动脉疾病(CAD)、射血分数降低的心力衰竭(HFrEF)和心房颤动(AF)。尽管缺乏可靠性和准确性的证据,这些指标有时仍被用于评估个体临床医生。我们使用全国退伍军人事务部(VA)数据来检验基于药物的绩效指标,以评估门诊心脏病学诊疗中临床医生的表现。方法:这项回顾性研究考察了2017至2023年VA心脏病学临床医生/退伍军人配对数据,以评估针对CAD、HFrEF或伴有高卒中风险的AF的10项基于药物的绩效指标。每项绩效指标的达成定义为在每次符合条件的患者就诊中开具了有指征药物的有效处方,并在临床医生层面进行汇总。可靠性采用beta-二项方法计算。使用贝叶斯因果模型评估病例复杂性对绩效指标达成的影响。最后,我们对一部分病例(n=952)进行了同行评审,以评估三项代表性绩效指标的准确性。结果:在456,071次独特的心脏病学就诊中,312,331次涉及CAD,224,599次涉及HFrEF,178,678次涉及AF。这些患者由1,043名心脏病学临床医生诊治。绩效指标达成率的中位数范围为0.23(HFrEF使用SGLT2i)至0.99(HFrEF使用β受体阻滞剂)。指标可靠性范围为0.63至0.90。病例复杂性未显著影响绩效指标的达成。以同行评审作为金标准,准确性为差至中等(平衡准确度0.51-0.73),且相对于同行评审,这些指标低估了表现。结论:针对CAD、HFrEF和AF的10项基于药物的绩效指标可利用电子健康记录数据高效测量,且大多数指标具有足够的可靠性,可支持临床医生基准比较和潜在诊疗差距的识别。然而,与同行评审相比准确性欠佳,表明这些指标可能不足以作为临床医生质量的独立评估依据。
探索模型信息精准给药中用于模型平均的集成选择:一项他克莫司案例研究扩展至头孢吡肟和英夫利西单抗 Baroudi, S. 2026-10-02 PDF 模型平均结合多个群体药代动力学模型的预测以支持模型引导的精准给药,但如何选择集成模型仍未得到探索。以他克莫司为案例,我们首先在37名肾移植和肝移植受者中评估了27个模型的所有可能集成,这些受者在第1次和第5次就诊时具有完整药代动力学剖面,在第2、3和4次就诊时具有谷浓度。模型按个体目标函数值加权。第5次就诊曲线下面积的预测性能通过从第5次就诊谷浓度或从第1至4次就诊观察估计的个体参数进行评估。然后,将基于相关性和外部评估分数先验选择的七个集成或先前确定的最佳性能集成,在从单次谷浓度到密集采样的十组观察中进行比较。每个集成规模的平均不精确度在超过3-4个模型后达到平台期。最佳集成取决于观察集,在第5次就诊谷浓度下包含三个模型,在第1至4次就诊观察下包含七个或八个模型。在所有观察集中,基于第5次就诊谷浓度优化的集成最为精确,基于分数的集成始终保持精确,而基于第1至4次就诊优化的集成泛化能力较差。仅在第5次就诊时的有限采样策略使所有集成的不精确度保持在20%以下。平台效应可推广至英夫利昔单抗和头孢吡肟。集成组成比集成规模更重要。模型平均应依赖精心选择的集成,而非所有可用模型。
成人报告抑郁症状的频闪灯光刺激:安全性、耐受性、可行性以及分阶段早期研究中的活性对照开发 Nacker, D. 2026-10-02 PDF 频闪灯光刺激(SLS)是一种候选的非药物干预手段,可诱发短暂的视觉和情感体验,在抑郁症中具有潜在应用价值。在疗效测试之前,临床开发需要安全性、耐受性和可行性数据。我们报告了一项在报告抑郁症状的成人中开展的分阶段、单中心项目。研究1测试了11组SLS参数集的安全性和耐受性。研究2评估了活性对照是否在保留会话背景的同时减少主观视觉效应。研究3将84名参与者随机分配至每周四次、每次31分钟、有监督的频闪强调或冲洗强调SLS会话。在研究1中,分析了31名参与者;未发生严重不良反应,平均不适感较低(0.49/10),最高的会话层面80%置信上限为1.13/10,远低于预设阈值。研究2支持健康成人中两种SLS配置在参与者内的体验分离。在研究3中,70/84名随机参与者(83.3%)可获得终点数据:39/42名分配至频闪强调,31/42名分配至冲洗强调。不适感仍然较低,未发生可归因于SLS的严重不良事件。两种配置在研究3的目标样本中均产生了视觉现象学,而研究2中观察到的现象学分离在研究3的组间未能重现。该比较估计的是两种活性SLS配置之间的差异,而非SLS与无刺激之间的差异。探索性抑郁症状估计不精确,受终点数据可获得性差异的限制,应作为终点选择和后续试验设计的参考,而非疗效依据。总体而言,该项目支持对有监督SLS进行进一步对照评估,同时将体验分离、保留率、掩蔽和终点选择确定为下一项试验的优先事项。
抗生素耐药性的全球动态:大肠杆菌中地方性耐药和新发耐药传播的建模研究 Rahbe, E. 2026-10-02 PDF 抗生素耐药性(ABR)是一个全球性威胁,但其动态在不同国家之间差异显著。这种异质性的驱动因素仍不清楚,限制了减缓多重耐药克隆出现和全球传播的努力。我们开发了一个机制建模框架,用于分析全球产超广谱β-内酰胺酶大肠杆菌(ESBL-EC)的动态,并考虑了抗生素消费和国际流动因素。该模型以39个国家(2006-2019年)的数据进行校准,用于探索潜在新发多重耐药克隆的全球传播,例如耐碳青霉烯类大肠杆菌(CR-EC)。模型估计了国家内部传播速率的异质性,以及抗生素使用下ABR获得风险的超额值为9.83(95%可信区间:9.78-9.89)。对潜在CR-EC传播的模拟表明,流动模式驱动早期耐药动态,而长期动态主要由国家内部传播和抗生素使用预测。我们的研究结果表明,在国家层面防止引入是减缓新发威胁的关键,但减少国家内部传播和选择压力是避免固定化的根本。
运动强度与久坐行为对新发帕金森病患者VO2max变化的交互作用:帕金森病运动研究(SPARX)2期随机临床试验 Pae, B. J. 2026-10-02 PDF 背景 帕金森病(PD)与久坐时间增加和心肺适能下降相关,使运动成为疾病管理的重要组成部分。尽管运动可改善心肺适能,但PD患者对运动的反应差异很大。久坐时间可能促成这种变异性,但久坐时间是否会改变对干预的反应以及干预内不同运动强度的反应尚不清楚。我们研究了久坐时间是否与6个月中等强度或高强度有氧运动对PD患者最大摄氧量(VO2max)的影响存在交互作用。方法 本二次分析使用了SPARX 2期随机临床试验的数据,包括128名新发PD患者,随机分配至高强度或中等强度跑台运动,或常规护理,持续6个月。通过使用对应于带交互项的协方差分析(ANCOVA)模型的线性回归模型,评估随机分组与随机化后6个月平均久坐时间之间的交互作用与6个月VO2max变化的关系。结果 与常规护理相比,中等强度组中运动强度与久坐行为对6个月VO2max变化的交互作用不显著({beta}:-1.78,95% CI:-3.76至0.20,p值:0.08),尽管仅限于完成者的敏感性分析显示存在显著交互作用,其中6个月平均久坐时间每增加10%,与常规护理相比,中等强度组的VO2max变化减少2.51 mL/kg/min({beta}:-2.51,95% CI:-4.53至-0.48,p值:0.02)。与常规护理相比,高强度组中运动强度与久坐行为对6个月VO2max变化的交互作用不显著({beta}:-1.46,95% CI:-4.74至1.83,p值:0.38)。敏感性分析显示类似结果。结论 这些产生假设的初步发现表明,久坐时间可能改变参与中等强度有氧运动个体对运动的反应。未来需要足够把握度的随机对照试验来证实这些发现,并确定在为PD患者制定运动处方时是否应考虑久坐行为。