| SleepGPT:一种用于高效睡眠评估的睡眠阶段语言模型 |
Yu, T. |
2026-07-23 |
PDF |
背景:准确且可扩展的睡眠评估对于睡眠障碍诊断及个性化睡眠医学的发展至关重要。当前临床实践主要依赖实验室多导睡眠监测(PSG)结合人工睡眠分期评分,该过程劳动密集、成本高昂,难以推广至大规模人群或长期监测场景。方法:我们提出SleepGPT——首个专为建模睡眠宏观结构时序动态而设计的睡眠分期语言模型。该模型采用自监督方式,基于5793份整夜PSG记录中超过580万条专家标注的睡眠分期标签进行预训练。作为即插即用模块,我们在多种最先进的睡眠分期架构中评估其性能;同时作为序列级表征骨干,结合Transformer模型用于睡眠障碍诊断。性能评估覆盖多个公开数据集及独立临床数据集。结果:在多样化睡眠分期基准测试(总计1,320,654个时段)中,SleepGPT持续提升现有最优模型性能,并实现基于低密度可穿戴脑电图记录(120,095个时段)的高精度分期,接近PSG级表现。当嵌入序列级Transformer诊断框架后,SleepGPT在多个临床队列(总计685例)中准确识别异常睡眠阶段动态及1型发作性睡病。基于注意力的分析揭示了与诊断标签相关的可解释性睡眠宏观结构改变。解读:这些结果表明SleepGPT可作为睡眠阶段序列建模的通用基础模型。通过捕捉宏观结构层面的睡眠时间组织特性,该模型为自动化睡眠分期及睡眠障碍诊断提供了可扩展、可解释且具备临床转化价值的解决方案。值得注意的是,基于睡眠阶段序列而非原始生理信号的操作模式,可降低设备敏感性和场所特异性变异,支持在包括可穿戴设备及真实世界睡眠监测在内的异构记录场景中实现更稳健的部署。 |
| 基因预测的IL-6受体阻断与癌症风险:一项针对肝细胞癌和结直肠癌的多祖先药物靶点孟德尔随机化研究 |
Ranjha, M. M. A. |
2026-07-23 |
PDF |
白细胞介素-6(IL-6)信号驱动慢性炎症,托珠单抗通过靶向该信号进行治疗。基因模拟的IL-6受体阻断是否因果影响肝细胞癌(HCC)或结直肠癌(CRC)风险尚不明确。我们采用两样本药物靶点孟德尔随机化研究,以rs2228145(IL6R Asp358Ala)作为受体阻断的主要工具变量,在四项涵盖欧洲和东亚人群的全基因组关联研究中作为独立单工具变量Wald比进行分析,并与配体水平变异体分开处理(因其作用机制不同)。基因模拟的IL6R阻断与欧洲人群(OR 0.953,95% CI 0.884-1.028)或东亚人群(OR 1.005,95% CI 0.930-1.085)的CRC风险无因果关联,与东亚人群(OR 1.011,95% CI 0.873-1.171)或欧洲人群(OR 1.079,95% CI 0.797-1.462;统计效力32%)的HCC风险也无因果关联。次要探索性分析显示rs1800795(IL6启动子)与欧洲人群CRC风险无关联(OR 1.028,95% CI 0.912-1.159);该变异体在两个队列中均无法有效评估HCC风险。CRC分析统计效力充足(OR 1.2时效力≥99%);HCC分析对中等效应统计效力不足,尤其在欧洲队列(效力32%)。这些结果不支持IL6R阻断对HCC或CRC风险存在显著因果效应,但无法排除对HCC的微弱效应。 |
| 基因预测的白介素-6抑制与癌症风险:一项针对肝细胞癌和结直肠癌的多祖先药物靶点孟德尔随机化研究 |
Ranjha, M. M. A. |
2026-07-23 |
PDF |
白细胞介素-6(IL-6)信号驱动慢性炎症,托珠单抗通过靶向该通路进行治疗。基因模拟的IL-6受体阻断是否因果影响肝细胞癌或结直肠癌风险仍不明确。我们采用两样本药物靶点孟德尔随机化研究,以rs2228145(IL6R Asp358Ala)作为受体阻断的主要工具变量,在四项覆盖欧洲和东亚人群的全基因组关联研究中作为独立单工具变量Wald比进行分析,并与配体水平变异体分开处理(因其作用机制不同)。基因模拟的IL6R阻断与欧洲人群(OR 0.953, 95% CI 0.884-1.028)或东亚人群(OR 1.005, 95% CI 0.930-1.085)的结直肠癌风险无因果关联,与东亚人群(OR 1.011, 95% CI 0.873-1.171)或欧洲人群(OR 1.079, 95% CI 0.797-1.462;统计效力32%)的肝细胞癌风险亦无关联。次要探索性分析显示rs1800795(IL6启动子)与欧洲结直肠癌风险无关(OR 1.028, 95% CI 0.912-1.159);该变异体在两个队列中均无法有效评估肝细胞癌风险。结直肠癌分析具有充分统计效力(OR 1.2时效力≥99%);肝细胞癌分析对中等效应量统计效力不足(欧洲队列仅32%)。这些结果不支持IL6R阻断对肝细胞癌或结直肠癌风险存在显著因果效应,但无法排除对肝细胞癌的微弱影响。 |
| 细胞外囊泡治疗中的质量-失败悖论:152项临床试验与CAR-T细胞疗法的定量基准比较。 |
Glebov, K. |
2026-07-23 |
PDF |
细胞外囊泡(EV)疗法的临床转化停滞,需要解决导致研发延迟和失败的关键及隐性原因。尽管已有超过150项注册临床试验和十五年的临床研究,小细胞外囊泡(sEV)疗法仍未获得FDA批准,这一转化缺陷极少受到定量分析。我们系统评估了截至2025年12月注册的783项EV相关临床试验(其中152项为治疗性试验),将sEV研发管线与同样面临"工艺即产品"生产限制、但已产出六款FDA获批产品的1131项CAR-T细胞疗法试验(中国以外)进行对标。研究发现一个质量-失败悖论:企业资助的sEV试验综合方法学质量高出39%(质量指数2.49 vs. 1.79),但失败率却是学术项目的约五倍(28.6% vs. 5.1%;OR=7.40,95% CI 2.5-22.3,p=0.0004)。跨模态复现的CAR-T试验验证了该关联方向(OR=2.51,p<0.001;Cochran-Mantel-Haenszel合并OR=2.76,p<0.001)。影响24%学术sEV试验的注册终止构成隐性失败模式,重新分类后该悖论消失。过早将定义不完整的产品推入临床,而非方法学严谨性不足,才是制约sEV转化的核心瓶颈。研究数据不透明、临床评估不充分、临床试验阴性(无效)结果未报告,共同制造了隐性危机——消耗公共与私营部门数亿投资、侵蚀投资回报率,并将进展困于重复劳动、资源浪费与错失学习机会的恶性循环。 |
| 通过EdRoSi AI流程优化标题与摘要的优先筛选。 |
Lecot, P. |
2026-07-23 |
PDF |
系统评价的核心在于全面识别证据,但标题与摘要的筛选工作仍极为耗时。优先筛选作为一种基于预估相关性对文献排序的主动学习方法,已成为降低筛选工作量的有效策略。其效率通常通过100%召回率下的抽样节省工作量(WSS@100%)量化,即相较于随机筛选所减少的工作量百分比。尽管现代优先筛选模型在多数基准数据集上表现高效,部分系统评价仍呈现低WSS@100%值,表明检索效果欠佳。本研究旨在提升挑战性数据集中所有相关文献的检索能力,以增强优先筛选的泛化性。我们首先利用SYNERGY基准数据集证明:当前最先进的ASReview LAB v.2开源软件中的ELAS_h3优先筛选模型虽能高效检索多数相关文献,但在处理挑战性数据集中的稀有最终文献时存在困难。为此,我们测试了名为EdRoSi AI的混合方法:前期采用ELAS_h3进行检索,随后利用已检索到的相关文献对生物医学变换器BioMed-RoBERTa-base进行监督微调,以增强对剩余困难案例的检测能力。研究发现,使用10篇后期识别的相关文献与10篇困难不相关文献的标题及摘要微调BioMed-RoBERTa-base模型后,目标文献的检索速度优于单独使用ELAS_h3。该方法将WSS@100%从46.5%(标准差0.0%)提升至83.3%(标准差0.4%),而微调与推理仅增加平均22分钟计算时间。EdRoSi AI优先筛选流程在需要最高召回率的情境中具有重要价值,尤其适用于主题宽泛或多元的范围综述——传统优先筛选方法可能遗漏细微的相关性信号。后续研究需定义数据驱动的停止规则,在最终阶段应用微调后的领域特异性变换器时终止筛选,并评估其在更多挑战性数据集中的泛化能力。 |
| 为英国NHS谈话疗法服务中抑郁和焦虑治疗后的结果构建预测模型 |
Kanso, N. |
2026-07-23 |
PDF |
背景:抑郁和焦虑是英国常见的心理健康问题。NHS谈话疗法提供循证治疗,是最大的治疗服务提供方,但仅有50%的患者康复。准确的结果预测可识别预后不良风险人群,支持个性化诊疗。本研究旨在利用来自大型多元族裔样本的常规收集数据,开发并内部验证多变量预测模型,以实现公平的数据驱动治疗决策。方法:数据涵盖2018年至2024年中在单一NHS信托机构完成高强度治疗的30,999名成年人。建模七项NHS治疗后结局指标:抑郁和焦虑的可靠改善、康复及可靠康复,以及治疗结束时的功能损害。基线预测因子包括社会人口学和临床特征。采用弹性网络逻辑回归开发模型,并通过自助重抽样进行内部验证。结果:样本以女性为主(73%),中位年龄34岁;57%为白人,22%为黑人。模型显示中等到良好的区分度(AUC 0.63-0.77)和强校准能力。关键预测因子与临床预期一致,包括基线症状严重程度、失业、领取福利金、报告残疾或长期疾病、使用精神药物及其他社会人口学因素。结论:本研究凸显了数据驱动工具在NHS谈话疗法中指导临床决策和治疗分层的潜力。早期识别标准治疗获益可能性较低的患者,可支持及时复诊、监测或定制化干预。需开展外部验证和实施研究以确保普适性和医疗公平性。 |
| 从实时临近预报中汲取的经验教训:2024年波多黎各登革热疫情 |
Tran, Q. M. |
2026-07-23 |
PDF |
实时临近预测通过减少掩盖传播动态的报告延迟来增强态势感知。我们利用波多黎各卫生部的病例监测数据,将贝叶斯平滑临近预测方法应用于2024年波多黎各登革热疫情。该方法准确捕捉了疫情轨迹,并持续优于基线模型,尽管报告异常偶尔会降低性能。我们还按登革热病毒血清型和卫生区域以及往年进行了分析。在登革热病例较少的分析中,跨组联合估计参数的模型通常比独立模型表现更好。历史分析显示,报告延迟变异性较高的年份通常表现出更高的不确定性。研究结果强调了实时登革热临近预测的关键经验:在复杂情况下可能需要替代模型,但在稳定的报告模式和持续评估下,临近预测可以成为可靠且有价值的公共卫生工具。 |
| 评估机场对本迪布焦埃博拉病毒病进行症候群筛查的有效性 |
Quilty, B. J. |
2026-07-23 |
PDF |
我们采用随机模拟模型,评估布迪布焦埃博拉病毒病(BVD)机场出境和/或入境症状筛查的有效性。对于从刚果民主共和国或乌干达出发、筛查灵敏度为86%的12小时国际航班,约73%的感染者在出行时能同时规避出境和入境筛查(95%可信区间:68-77%)。在成功登机的感染者中,约92%会在未检测到的情况下抵达目的地(95%可信区间:90-94%)。这一高漏检比例反映了潜伏期(约7.7天;Wamala等2010年)与发病至重症间隔期(约4天;Funk & Abbott 2026年)的相对时长:大多数感染者在症状出现前登机,任何症状筛查均无法检测;而出现症状者会迅速进展至重症,无法出行。由于确诊病例中无发热症状的比例本身存在不确定性,我们同时报告了保守情景——假设所有确诊病例均发热(0%无症状等效病例),此时漏检比例仍高达约64%(95%可信区间:57-70%)。在疫情活跃增长期,近期暴露(即症状前)病例在旅客中占比过高,进一步加剧了这一问题。机场症状筛查对通过航空旅行传播BVD的保护作用有限,应辅以源头疫情控制、加强与疫区有高航空连通性的接收国的临床监测,以及针对来自疫区旅客的离境后自我监测指导。 |
| 撤回:利用遗传学辅助检测药物不良反应——基于三个队列1020464名参与者的遗传代理GLP-1RA孟德尔随机化分析 |
Mason, A. C. |
2026-07-23 |
PDF |
作者已撤回稿件,因为在重新评估用于GLP1-RA的遗传工具时发现,文献中发表的该工具实际上并不适用于药物靶点孟德尔随机化研究。该工具包含大量高度相关的单核苷酸多态性,这违反了孟德尔随机化的核心假设。因此,我们正在使用自己的流程重新生成遗传工具,而非沿用已发表的工具。作者不希望此项工作被引用为该项目的参考文献。如有任何疑问,请联系通讯作者。 |
| 撤回:一项系统综述,旨在批判性评估超加工食品与心血管疾病及高血压研究中的方法学严谨性 |
Mekonnen, T. C. |
2026-07-23 |
PDF |
作者已撤回本稿件,此次撤回旨在修正标题并提交修订更新版本。修订版包含改进的分析、更新的图表以及对所收反馈的回应。新版本将取代之前的预印本。因此,作者不希望此项工作被引用为项目参考。如有任何疑问,请联系通讯作者。 |