跳转至

2026-09-22 每日论文

来源 独立页面
arXiv arXiv
bioRxiv bioRxiv
medRxiv medRxiv

arXiv

标题 作者 发布日期 PDF链接 摘要
OMatG-flash:一种用于可扩展材料发现的全原子流映射与强化伴随匹配方法 Thomas Egg 2026-09-22 PDF 新型无机材料的发现推动了计算和储能等关键领域的技术突破。生成式人工智能有望加速材料发现流程,但当前最先进的流模型和扩散模型仍受限于候选材料提出成本。为解决这一问题,我们提出了OMatG-flash,一种用于无机晶体结构预测(CSP)和从头生成(DNG)的全原子流映射。OMatG-flash是一种材料领域的帕累托最优推理引擎,其采样候选材料所需的推理步骤和实际耗时均比现有流模型和扩散模型少一个数量级,同时展现出与最先进方法相当的基准性能。为实现后训练微调,我们将强化伴随匹配应用于流映射,进一步提升了无条件CSP任务中的匹配率和RMSE。OMatG-flash展示了流映射在加速生成高质量候选无机材料方面的潜力,并标志着在数据密集型材料发现工作流所需的样本吞吐量方面迈出了一步。
结合分层认知过程与过程监督的可解释场景安全理解 Zhiyun Jiang 2026-09-22 PDF 场景安全理解在各种关键领域的情境意识中起着生死攸关的作用。依赖学习场景与安全等级之间直接映射的传统方法往往缺乏可解释性,限制了其在关键应用中的可靠性。克服这一挑战的有效途径在于解读人类认知过程,并为机器模型赋予类似的认知能力。本工作探索了一种将场景安全认知过程建模与过程监督相结合的有效方式。具体而言,我们首先构建了一个分层认知安全结构,这推动了基于多步推理与过程标签的新型高质量场景安全理解数据集的开发。该数据集既可作为基准,也可作为提升大型语言模型(LLMs)安全推理能力的资源,同时还能通过信息流和显著性技术对中间推理步骤进行细粒度分析。在此基础上,我们引入了一个模块化且灵活的过程监督框架,该框架反映了人类认知的分层特性。该框架以LLMs为核心架构,并融合了低秩适应(LoRA)和专家混合(MoE)策略,以实现专家模块之间的专业化与协作,每个模块负责整体推理链中的特定子过程。系统性实验评估与分析证实,与传统方法相比,我们的框架展现出更优越的可解释性和性能特征。
扩散模型中的双重下降与恶性过拟合 Raphaël Urfin 2026-09-22 PDF 深度学习中的传统观点认为,过参数化——即参数数量 (p) 多于训练样本数 (n)——是无害的:更大的模型泛化更好,即使没有正则化,插值模型也能很好地泛化,测试误差遵循双下降曲线。人们可能期望扩散模型也具有同样良性的过拟合,因为其训练可归结为回归,即最小化二次得分匹配损失。然而观察到的却相反:这里的过拟合是灾难性的,驱使模型进入记忆机制。我们通过结合在 CelebA 上训练的 U-Net 实验与一个可推导闭式学习曲线的随机特征模型,解决了这一悖论。我们表明,在每个训练样本固定有 (m) 个噪声实现时,插值峰值确实会出现,但出现在 (p\sim nm) 处,而非标准回归中的 (p\sim n) 处。然而,测试损失的上升要早得多,出现在 (p\sim n) 处,且与 (m) 无关。这种过拟合是有害的,因为尽管训练的隐式正则化完全在起作用,它却驱使模型趋向经验得分,即记忆训练集,而非趋向真实得分。偏差-方差分解揭示了其机制:得分估计器的偏差在 (p\sim n) 处开始增长;过了峰值后方差衰减,如同回归中那样,而偏差持续增长,二者都饱和在一个很大的值上。由于扩散模型以 (m\gg1) 训练,峰值被推到非常大的模型规模,因此处于其之前的上升分支上,此时有害过拟合已经发挥作用。尽管如此,过参数化在与正则化配对时仍然有益:在随机特征理论和 U-Net 实验中,最优正则化的大模型——分别通过岭惩罚或早停——优于任何未正则化的模型。
TimeInteract:面向流式时间序列的实时交互智能 Sheng Pan 2026-09-22 PDF 真实世界的时间序列持续演化,有意义的变化可能在任何时刻出现。然而,现有的时间序列语言模型(TSLMs)本质上仍是静态的。它们要么接收完整序列进行离线处理,要么在流式输入与响应生成之间交替,这导致在交互过程中无法处理新的观测。我们提出一种新范式——时间序列交互:模型持续感知传入的时间序列观测和用户意图,自主决定何时保持沉默或作出响应,并在响应生成期间继续处理新的观测。为实现这一目标,我们开发了TimeInteract,包含三项关键设计:双视角流式时间序列编码器,用于捕捉局部变化与历史动态;响应控制机制,用于学习何时触发响应;解耦流式推理机制,将控制与响应生成分离,以避免阻塞后续观测。我们进一步构建了交互能力的层级体系,从理解逐步推进到自适应。基于该层级体系,我们构建了StreamTSI-34K,这是一个大规模流式时间序列交互数据集,包含34,588个片段和77,505条响应,覆盖合成与真实世界时间序列的单轮与多轮设置。在所有四个交互层级上,TimeInteract均持续优于现有LLMs、VLMs和TSLMs,在具有挑战性的任务上提升最高达23.92分。它还在改善响应触发的同时,实现了接近零的流停滞以及最高达$2.15\times$的推理加速。
关于大型语言模型在代码理解中的词汇迷信:对低词汇质量代码的重新评估 Xin Shen 2026-09-22 PDF 大语言模型(LLMs)的最新进展使其被广泛用于代码相关任务。标识符名称在自然出现的代码中具有统计信息量,但其信息并不总是可靠的。我们研究当前LLMs在重命名保持程序结构不变时,是否对词汇线索赋予了不成比例的权重。我们提出了Face/Off,一个保持语义的标识符重命名框架,并在多个模型和代码理解任务中评估渐进式命名条件。在该框架内,词汇过度强调在所评估的模型和主要任务中普遍存在:随着标识符信息被移除或变得具有误导性,性能通常会下降,且输出往往被导向误导性名称所暗示的含义。这一模式在代表性的提示和微调干预下依然存在,表明词汇过度强调是一个根深蒂固的问题。类型推断控制实验确认了一个边界:当答案可以在没有目标名称的情况下局部恢复时,命名效应较小。这些结果并不意味着标识符没有帮助;相反,它们揭示了当前LLMs在平衡词汇线索与程序结构方面存在系统性脆弱性。我们的发现推动了评估和建模方法的发展,这些方法在保留自然代码规律性益处的同时,使结论建立在准确、形式化的代码语义之上。
在真实世界医疗数据上学习带指导的延迟决策 Emma Sun 2026-09-22 PDF 医学图像解读工作量大且耗时,尽管AI解读可以减轻工作量,但完全自主部署存在潜在安全隐患,且低特异性在实践中可能导致临床医生工作量增加。学习延迟(L2D)通过从输入特征以及AI模型和人类表现中学习,在自主预测和人类专家之间选择性地路由病例,从而解决这一问题。虽然L2D的理论保证已被证明,但其性能尚未在具有人类读者标注的真实世界医学数据集上得到验证。我们在Collab-CXR上评估了两阶段L2D的预测器-拒绝器公式,其中AI预测器模型是固定的,并与可训练的路由或拒绝器模型分离。Collab-CXR是一个多标签胸部X射线数据集,每个病例有多个专家标注。这是首个在具有人类标注的真实世界医学影像数据背景下研究L2D的工作。我们进一步引入了一种新设置,即带指导的L2D,其中决策空间扩展到三种选择:自主预测、延迟给人类专家,或延迟给人类专家并提供AI指导。我们比较了多种拒绝器架构和损失函数,以及不同的输入特征可用性。这在两个更大的数据集VinDr-CXR和CheXpert上进行了复现。我们的结果表明,带指导的两阶段L2D优于经典的两阶段学习延迟,以及人类单独、AI单独和AI指导人类基线。值得注意的是,与当前文献中正式定义的L2D代理损失函数相比,这一性能是通过更简单的损失函数实现的。
面向GROBID的布局引导掩码:大规模科学PDF摄取中的轻量级结构增益 Luca Foppiano 2026-09-22 PDF 将学术PDF转换为机器可读的全文仍然是大规模信息系统的瓶颈。近期基于视觉的解析器提高了准确性,但需要GPU,并可能向提取的文本中引入噪声。GROBID是一种在CPU上运行的模块化字体流解析器,是结构化科学文章的事实标准,并支撑着若干最大的开放学术语料库。我们将其与一个轻量级CPU检测器配对,该检测器定位图、表和副文本(页眉、页脚、页码)区域,编码为带类型区域掩码,其标记被路由到GROBID的专用模型或被丢弃。在两个PMC语料库Bioinformatics(1,926篇文章)和Materials Science(2,595篇)上,依据JATS并采用感知章节的结构化协议进行评分,我们的扩展在大多数指标上优于普通GROBID(NS $+0.025$/$+0.013$;Materials Science上段落召回率$+0.086$,$d_z{=}1.08$),并且标题关联的图恢复在两个语料库上均有改善。在外部Table-BRGM基准上,表格检测的F1从$0.16$提升至$0.94$,表格结构也随之改善(GriTS-Top $0.27 \to 0.78$,低于最强的GPU系统)。在正文文本上,与四个基于视觉的系统(Docling、MinerU、olmOCR、dots.ocr)相比,它在两个语料库上均具有最佳的段落精确率,在Materials Science上具有最佳的章节检测,并且字符错误率与最佳GPU解析器相差在0.004以内。在CPU上端到端运行时,其成本比最便宜的GPU系统(Docling)低$2.7$--$3.2\times$,比生成式解析器低$10$--$14\times$。
MAVP:面向移动操作的地图感知视觉运动策略 Jinhe Tang 2026-09-22 PDF 成功的移动操作需要基座与机械臂的协调运动,同时保持准确的空间定位。然而,经过演示训练的策略可能难以可靠地实现预期的基座运动,导致空间错位以及随后的操作失败。我们提出 MAVP(Map-Aware Visuomotor Policies,地图感知视觉运动策略),一个通过预测显式基座位姿目标并利用定位反馈进行跟踪,从而提高执行可靠性的框架。MAVP 从遥操作演示中重建静态地图,并在共享地图坐标系中表达演示的基座轨迹,从而在演示之间提供一致的空间监督。在执行时,策略接收 RGB 观测、关节状态以及机器人当前的地图坐标系基座位姿,并联合预测目标基座位姿、机械臂动作和夹爪动作。一个底层控制器利用前馈运动和位姿误差反馈来跟踪预测的基座目标,从而能够纠正执行偏差。我们还在训练期间使用位姿噪声增强,以提高对策略位姿输入误差的鲁棒性。在六个真实世界操作任务和三个策略系列上,MAVP 在所有任务中均比无锚定的速度控制取得了更高的任务成功率。视频和额外结果可在 https://123qwedsa123.github.io/mavp/ 获取。
FairMean:在标签投毒攻击下促进分布式学习中的公平性 Huigan Zheng 2026-09-22 PDF 公平感知的分布式学习优先考虑损失较大的客户端以减少性能差异,但标签投毒可以制造大损失,从而引发公平性与鲁棒性之间的冲突。我们提出FairMean来管理这一冲突。FairMean使用局部损失的有界非递减函数对客户端梯度进行加权。递增的权重优先考虑高损失客户端以促进公平性,而上界则防止由损失引起的对中毒客户端梯度的过度放大。在不存在标签投毒的情况下,我们表明最小化FairMean目标比最小化标准平均损失目标更有利于解的公平性。在标签投毒下,我们建立了一个平均平稳性界,其依赖于攻击的项与中毒客户端比例的平方成正比。实验表明,FairMean通过降低准确率方差同时提高最差客户端准确率来促进公平性。
KwaiMind技术报告 Junlong Wu 2026-09-22 PDF 商业图像编辑在通用编辑质量之外,还要求保持产品身份、准确渲染文字并具备用户吸引力。我们提出KwaiMind,一个将通用能力与电商专业化相结合的图像编辑系统。基于智能体的数据引擎维护约180万对高质量编辑样本。KwaiMind构建于多模态扩散Transformer之上,经过持续预训练和有监督微调,随后进行偏好优化和在线强化学习。通用视觉语言评判器以及针对点击率(CTR)、文字渲染和产品一致性的专用奖励引导专用策略,并通过同策略蒸馏进行整合。我们提出Ecom-Bench,涵盖11项商业编辑任务,并配有任务特定的视觉评估和基于CTR的排序。在ImgEdit、GEdit、REDEdit的两个语言划分以及Ecom-Bench视觉质量上,KwaiMind在受评估的开源编辑器中取得最强总体得分,并在所比较系统中取得最高的综合CTR排序得分。离线情况下,CTR引导优化将预测CTR超过原始产品图像的生成图像比例从12.16%提升至37.41%。在在线A/B实验中,基于CTR选择产品主图使实际CTR相对提升约2.44%。这些结果证明了领域特定数据和奖励驱动对齐对商业图像编辑的价值。

bioRxiv

标题 作者 发布日期 PDF链接 摘要
42种核编码酿酒酵母tRNA的假尿苷化图谱 Barry, M. L. 2026-09-22 PDF 假尿苷是最丰富的RNA碱基修饰,因为它在tRNA和rRNA中广泛存在,并在其中作为结构和功能的关键调节因子。然而,在广泛使用的模式生物——出芽酵母酿酒酵母中,tRNA假尿苷位点尚未得到全面注释。在此,我们采用了两种已建立的用于检测tRNA假尿苷化位置的高通量方法:Nanopore直接RNA测序和2-溴丙烯酰胺辅助环化测序。利用DRS,我们对来自七种假尿苷合酶敲除酿酒酵母菌株的胞质tRNA进行了测序,包括Pus1、Pus3和Pus7的缺失菌株。对这些数据的分析验证了三十二个现有的假尿苷注释,并预测了另外十个先前未注释的假尿苷位点。我们的分析还揭示了在缺失某种PUS时,几个非尿苷位点的DRS信号变化,包括在缺失Pus3时第37位修饰丰度的明显变化。然而,液相色谱串联质谱和引物延伸实验表明,缺失Pus3时这些修饰的丰度没有变化,这强调了在解释基于DRS的信号变化时需要谨慎。利用BACS,我们确认了十个DRS预测的新位点,同时进一步检测到十一个先前未注释的假尿苷位点。结合Modomics数据库中现有的修饰注释与我们的DRS和BACS数据集,我们创建了一张所有检测到的假尿苷图谱——总计126个位点,包括21个新位点——以及负责其催化的酶,涵盖四十二个核编码的酿酒酵母tRNA同受体。
肽-RNA光交联与可调RNA链在全蛋白质组范围内映射RNA界面 Sha, S. 2026-09-22 PDF 光交联质谱(MS)能够绘制活细胞中蛋白质-RNA界面,但当前用于肽-RNA交联物的分离流程会去除大部分RNA,因此无法鉴定交联的RNA序列。我们提出pepR-MS,一种以可调长度RNA链富集肽-RNA交联物的方法。为最大化蛋白质组深度,我们应用pepR-MS生成高度截短的RNA加合物,在乳腺癌细胞的589种蛋白质中鉴定出超过34,000个独特交联,并精确定位了数百个结构化结构域和内在无序区域中的RNA接触位点。通过调节核酸酶消化,可保留长达五个核苷酸的较长RNA链,并使用专门的MS策略与交联肽一起测序。对于RNA序列归属,我们进一步引入计算工具SALT,其在单次LC-MS运行中为超过1,600个交联鉴定了肽-RNA序列对。总之,pepR-SALT提供了一个在单氨基酸和核苷酸分辨率下跨蛋白质组和转录组绘制蛋白质-RNA界面的框架。
基因组与功能分区之间的基因树冲突影响了蒺藜科(Zygophylloideae)的系统发育推断 van der Merwe, P. D. W. 2026-09-22 PDF 蒺藜科(Zygophyllaceae)下的驼蹄瓣亚科(Zygophylloideae)包含七属约180种,广泛分布于全球,尤其在干旱地区,在那里它们表现出对干旱的适应,包括C4和CAM光合作用。已有几项研究利用Sanger测序标记分析了驼蹄瓣亚科的系统发育关系,但没有任何研究能够解决该亚科内属间所有较深层次的亲缘关系。在此,我们利用离子半导体测序技术对叶绿体和核核糖体区域进行测序,以分析这些关系,并评估为何这些关系如此难以解决。我们对关键物种——狭义驼蹄瓣属(Zygophyllum sensu stricto)、Roepera、Tetraena、Fagonia、Zygophyllum stapffii及单型属Augea capensis——的39个叶绿体基因和核核糖体18S、5.8S、26S基因及内转录间隔区(ITS)进行了测序;并以蒺藜亚科(Tribuloideae)的蒺藜属(Tribulus)作为外类群。我们将这些序列与已发表的叶绿体基因组数据进行比对,随后采用最大似然法和贝叶斯方法进行系统发育分析,分别对非编码内含子和基因间间隔区,以及参与或不参与光合作用的基因,总结系统发育结果。我们将叶绿体数据与先前涉及更多分类群研究中使用的三个高度变异的非编码叶绿体区域序列相结合,同样也将核核糖体数据与更密集采样的ITS序列相结合,并评估添加此类数据是否能改善对一致拓扑结构的支持。我们使用叶绿体序列矩阵推断了一个定年系统发育。添加数据并不总能改善系统发育分辨率,这显然受到叶绿体光合作用相关基因中非信息性变异以及叶绿体和核信号冲突的影响。与光合作用无关的叶绿体基因为一个与独立数据一致的拓扑结构提供了稳健支持,因此可能代表一个有用的物种树假说。基因树冲突的原因仍不清楚:可能的解释包括光合作用相关基因的功能约束,以及古老快速分化过程中的渐渗杂交和/或不完全谱系分选。进一步的检验将需要对具有不同光合模式的谱系进行更广泛的采样,以及多个信息丰富、独立且选择中性的基因树。
高代谢率的选择降低了岸田鼠肠道微生物群对饮食限制的响应性 Baran, J. K. 2026-09-22 PDF 宿主与微生物群的相互作用对于适应环境变化(如能量可利用性的波动)至关重要。然而,宿主及其微生物群在应对短暂能量限制时表现出协调可塑性的程度仍不清楚。在此,我们研究了具有不同能量需求的宿主在暂时性饮食限制下,宿主和肠道微生物群平行可逆可塑性的能力。我们对来自长期人工选择实验的高有氧代谢品系(A品系)和对照品系(C品系)的岸田鼠(Clethrionomys glareolus)进行了饮食限制(用不可溶性纤维稀释食物),随后给予恢复期。我们在基线、饮食限制后和恢复后测量了与田鼠能量消耗相关的性状和粪便微生物群组成。我们假设A品系田鼠会比C品系田鼠经历更严重和更持久的饮食限制生理效应,而这可能被更高的微生物群响应性所抵消。饮食限制导致食物消耗暂时增加、体重和静息代谢率下降,以及肠道微生物群组成的显著变化,所有这些在恢复期均恢复到接近基线水平。这些效应在选择品系间基本相似,但与我们的预测相反,饮食限制对细菌多样性的影响在C品系中更强。这表明A品系微生物群对饮食变化的抗性更高,可能是由于高代谢能力的定向选择导致宿主对微生物群落的控制增强。总体而言,我们的发现凸显了宿主生理和肠道微生物群在波动环境中具有显著的可逆可塑性能力。
多次引入塑造了北美入侵性黄杨木蛾(Cydalima perspectalis)种群的基因组多样性和种群历史。 Basnet, A. 2026-09-22 PDF 黄杨木蛾(Cydalima perspectalis)是一种入侵性黄杨植物(Buxus spp.)害虫,已迅速扩散至整个欧洲,并自2018年在加拿大首次被发现以来,已遍布北美。了解其传入途径和早期种群结构对于有效监测和管理至关重要。我们整合了全基因组单核苷酸多态性(SNP)、线粒体细胞色素c氧化酶I(COI)以及形态学数据,以研究C. perspectalis在北美各地的早期入侵历史。全基因组分析揭示了北美与欧洲种群之间存在显著的遗传分化,同时北美内部也存在显著的遗传结构。特拉华州在遗传上与其他北美种群不同,且与欧洲种群具有更高的亲缘关系,这与独立的传入历史相一致。相比之下,纽约、马萨诸塞、密歇根、俄亥俄和安大略表现出更高的遗传相似性,表明存在共享祖先和/或区域连通性,而弗吉尼亚和西弗吉尼亚则表现出额外的分化。线粒体数据支持大多数北美种群之间存在共享祖先,而特拉华州与克罗地亚欧洲种群共享一个单倍型组。D统计量分析识别出若干北美和欧洲种群之间存在不对称的等位基因共享,这与多次传入及随后的混合相一致。形态计量分析揭示了若干身体和翅性状存在显著的地理变异。总之,这些互补数据集表明,多次传入、区域遗传结构和混合共同塑造了北美的入侵。这些发现凸显了将基因组方法与苗圃和边境监测相结合的价值,以识别传入途径并为这一新兴园艺害虫的针对性遏制和长期管理提供信息。
TCF25作为GPRASP2稳定性的细胞质调控因子出现 Hardy, L. J. E. 2026-09-22 PDF TCF25是一种保守的真核蛋白,其细胞定位和功能背景仍知之甚少。在此,我们表明在基础条件下,TCF25在多种人类细胞类型中主要位于细胞质,并存在一个耐洋地黄皂苷的核周池,提示其与膜连接组分相关。利用邻近标记技术探索TCF25的近端网络,进一步支持其富集于细胞质和细胞内膜相关蛋白。在公共数据集分析和近端蛋白质组数据的指导下,我们表明TCF25与G蛋白偶联受体相关分选蛋白GPRASP2结合,并通过保护其免受蛋白酶体降解来维持其基础丰度。利用结构建模,我们识别出两种蛋白之间一个假定的相互作用界面,涉及TCF25 C端区域两个间距很近的螺旋,它们对接至GPRASP2的螺旋重复片段。与这一预测一致,删除TCF25第604-664位氨基酸破坏了TCF25与GPRASP2之间的关系。总之,这些发现确立了TCF25的细胞质、膜近端背景,并鉴定出一个对其与GPRASP2结合所必需的C端区域。这些发现提示TCF25参与调控GPRASP2稳定性,为研究其在细胞稳态和疾病中的作用提供了框架。
六自由度-SVC模型预测的驾驶动态波动在五项真实世界驾驶研究中的影响 Buchheit, B. 2026-09-22 PDF 尽管采用了技术性应对措施,研究表明,作为汽车乘客出行时,感觉冲突以及由此引发的晕动症症状(如恶心)仍无法完全避免。因此,可靠地预测晕动症将成为智能车辆的一种可能解决方案,以避免行程中断,例如通过调整驾驶策略或路线规划。在以往工作中,作者已能够为广泛使用的6DOF-SVC模型展示一套面向应用的参数集,用于估算乘客在将视线降低至非驾驶相关任务时的晕动症发生率(MSI)。在本研究中,这些参数通过此前进行的五次晕动症驾驶实验得到了验证并进一步优化。研究还首次表明,基于行驶动力学特征(由路线特性或驾驶风格导致)的预期自然MSI波动,以及实验测定的MSI变化,大约为10%。此外,研究结果表明,参与者似乎具有与其晕动症易感性相关的个体MSI阈值,但该阈值在不同实验间波动过大,不适合实际应用。因此,该模型能够成功估算测试路线上的晕动症风险,但预测的MSI轨迹仍存在不准确性。
一种用于精细运动控制模拟的小鼠前肢远端生理学详细生物力学模型 Lindo Sandoval, N. 2026-09-22 PDF 本研究提出了一种生理学上详细的小鼠远端前肢生物力学模型,该模型整合了内在肌群、肌腱走行以及指级骨骼解剖结构,而这些特征在现有肌肉骨骼模型中往往被简化或省略。通过高分辨率解剖重建和计算建模,我们构建了腕部和指部的生理学表征,能够模拟复杂的前肢运动。该模型能够模拟抓握相关任务中协调的远端前肢运动和指级肌肉行为。我们针对多种任务进行了仿真,包括抓握、伴随旋后的抓握、腕屈曲以及第一指屈曲,并将分析重点放在抓握任务上,因为该任务同时整合了内在肌和外在肌。模型性能通过以下方式评估:比较力矩驱动参考运动与肌肉驱动仿真之间的标记点轨迹、时间 shuffle 对照,以及比较实验记录的电活动与模型预测的肌肉兴奋模式。该模型成功再现了协调的远端前肢运动学,展示了力矩驱动与肌肉驱动仿真方法之间的高度一致性,并生成了与抓握相关运动中实验观测电活动相一致的生理学合理的肌肉兴奋模式。这些发现确立了该模型作为研究小鼠精细运动控制、神经肌肉协调及运动相关障碍的框架,同时为未来研究神经系统疾病及其潜在生物力学机制奠定了基础。
利用基因组语言建模进行新型天然生物合成装配线的生成设计 Lanclos, N. 2026-09-22 PDF 重编程生物合成装配线可以将生物合成扩展到自然界探索的化学空间之外。然而,这仍然困难,因为装配线功能依赖于大型多结构域酶之间的协调相互作用。在这里,我们将gLM2,一个在宏基因组序列上训练的基因组语言模型,与离散扩散和结构域级条件化相结合,以实现生物合成基因簇的生成设计和优化。我们将这种方法应用于一种嵌合I型聚酮合酶(PKS),该酶被工程化以生产δ-戊内酰胺,一种并非由PKS自然合成的分子。通过在完整PKS序列背景下对两个多结构域区域进行迭代重新设计,gLM2逐步提高了δ-戊内酰胺的产量,产生的变体滴度比起始酶高达9.4倍。总之,这些结果表明,进化序列信息可以被学习并应用于复杂的多结构域酶设计问题,扩展生物合成装配线以生产其天然生物合成库之外的分子。
胆管癌相关FGFR2改变的不同表型后果取决于胆管上皮细胞状态 Chiasson-MacKenzie, C. 2026-09-22 PDF 上皮性癌症破坏组织结构,通常由在正常上皮形态发生中发挥重要作用的基因突变驱动。肝内胆管系统是一个上皮管状网络,通过在发育中的肝脏内从头起始并扩张顶端管腔而形成。肝内胆管肿瘤(肝内胆管癌)常携带FGFR2受体酪氨酸激酶的激活性基因组改变,该激酶在其他发育背景下的上皮形态发生中发挥重要作用。利用一个生理性且定量的三维模型,我们证明FGFR信号对胆管形态发生很重要,并且致癌性FGFR2融合和框内缺失会破坏胆管结构。重要的是,我们表明FGFR2突变体的运输和信号传导,以及它们的表型影响,均受细胞上皮状态调控。出乎意料的是,我们还发现不同的驱动肿瘤的FGFR2突变体以完全不同且具有临床相关性的方式破坏胆管形态发生,这增进了我们对形态发生和肿瘤发生的理解,并凸显了对二者进行汇聚研究的重要性。

medRxiv

标题 作者 发布日期 PDF链接 摘要
运动有多安全?英国生物银行中中年体力活动与骨折之间的关联:一项横断面研究 Rolls, C. 2026-09-22 PDF 目的 探讨中年时期休闲时间体力活动(LTPA)的总量与强度同骨折风险之间的关联,并确定遵循世界卫生组织(WHO)体力活动建议是否与骨折风险相关。方法 对英国生物银行40-65岁参与者进行横断面分析,使用自我报告的体力活动和骨折数据。LTPA总量(LTPAV)由步行、中等强度和高强度活动推算得出。参与者按LTPAV五分位数分组,并按是否遵循WHO体力活动建议分组。采用多变量logistic回归分析其与过去五年内自我报告骨折的关联,并进行按性别分层分析。结果 在322,749名参与者中,53%为女性,平均年龄47岁。骨折风险随LTPAV升高而增加,但该关联呈非线性,并因年龄和性别而异。最强关联见于40-49岁男性和女性的最高五分位组(OR分别为1.81,95% CI 1.64-1.99和OR 1.42,95% CI 1.28-1.58)。在相互调整模型中,高强度活动与骨折风险的独立关联最强。达到但未超过WHO体力活动建议,与骨折风险增加无关。结论 在从事较高总量休闲时间体力活动的个体中观察到更高的骨折风险,该关联主要由高强度活动驱动。该关联在40-49岁成年人及男性中最强。符合当前WHO建议的体力活动与骨折风险增加无关,支持继续促进中年时期的体力活动。摘要框O_ST_ABS本主题已知内容C_ST_ABSO_LI休闲时间体力活动(LTPA)已确立健康益处,但也可能增加骨折风险,尤其是在较高活动水平时。 C_LIO_LI骨折风险是否因年龄、性别、活动总量和强度而异仍不清楚。 C_LI 本研究新增内容O_LI较高LTPA总量与骨折风险增加相关,但这仅限于活动总量最高的个体,且在男性中最强。 C_LIO_LI高强度活动与骨折风险的独立关联最强,而符合当前WHO建议的活动水平在两种性别中均与骨折风险增加无关。 C_LI 本研究可能如何影响研究、实践或政策O_LI这些发现支持继续促进中年时期、包括围绝经期前后,符合WHO建议的体力活动。 C_LIO_LI对于高度活跃的个体,未来指南可能不仅需要考虑活动总量,还需考虑高强度活动如何累积,以降低损伤和骨折风险。 C_LI
肾移植病理学中基于BanffNET自动病变评分的连续诊断指标:诊断预测模型的开发与评估 Vranken, A. 2026-09-22 PDF 背景根据Banff分类描述的肾移植活检组织病理学诊断存在显著的观察者间变异和误判,容易导致诊断错误。基于BanffNET自动病变评分提出的连续指数被用于量化肾移植活检的连续表型谱,作为病理学家活检评估的补充。方法使用BanffNET模型对2544例活检的训练队列、3863例活检的大型验证队列以及由67位病理学家评分的36例活检的多阅片者队列进行连续病变评分。采用惩罚回归方法将17项自动病变评分浓缩为四个指数,代表移植物损伤最重要的维度:TCMR/TI指数、AMR/MVI指数、活动性指数和慢性化指数。在训练队列和验证队列中,将BanffNET指数与Banff诊断和组织学指数进行评估。由于病理学家指定的Banff病变和诊断存在观察者间变异,还在多阅片者研究中评估了其与诊断的关联,以及在训练和验证队列中与肾移植失败时间的关联,并在验证队列中与基于活检的分子特征的关联。结果BanffNET TCMR/TI指数、AMR/MVI指数和活动性指数分别对Banff TCMR、Banff MVI和Banff任何诊断显示出极好的区分能力,验证AUC范围为0.80至0.92。此外,BanffNET指数解释了多观察者参考标准、移植失败时间和基于活检的分子诊断中的大量变异。在绝大多数情况下,BanffNET指数解释的变异与病理学家指定的诊断和组织学指数所解释的变异相当或更高。结论BanffNET指数是全切片图像的可重复描述指标,可以补充和增强病理学家对肾移植活检的评估。BanffNET指数与多观察者诊断及相关结局的关联表明,它们在病理学家指定的Banff诊断和组织学指数之外,还捕获了关于组织损伤类型和严重程度的额外信息。
一项为期56天的单臂探索性研究:NatureU Mind Care BeautyU胶囊对成年女性鱼尾纹数量、皮肤水合作用及相关皮肤衰老参数的影响 Law, L. 2026-09-22 PDF 背景:皮肤老化是多因素共同作用的结果,已上市的多成分口服美容补充剂需要专门的临床评价,因为其效果无法仅从单个成分的数据推断。目的:在一项为期56天的单臂开放标签研究中,探讨每日口服NatureU(R) Mind Care BeautyU Caps是否与成年女性参与者自身鱼尾纹皱纹计数(主要终点)、角质层水合度(次要终点)及其他探索性皮肤老化参数的变化相关。方法:一项单中心、开放标签、单臂探索性研究纳入33名36-56岁健康女性,仅当基线面颊水合度低于60 corneometer单位(C.U.)时符合入选条件;31名完成方案。参与者每日口服一粒胶囊,连续56天。在D0、D28和D56使用PRIMOS CR、Corneometer CM 825、Cutometer MPA580、Glossymeter、Colorimeter CL400、Mexameter MX18、VISIA CR、DermaScan及结构化自我评估进行评估。结果:PRIMOS CR鱼尾纹皱纹计数从D0的965.3 {+/-} 333.7降至D56的514.2 {+/-} 171.0(-46.73%;Wilcoxon P = 1.2e-06),Corneometer水合度从44.3 {+/-} 7.8升至70.3 {+/-} 9.9(+58.57%;P = 1.2e-06)。两项指标在全部31名完成者中均发生变化。平均皱纹深度仅出现非显著性变化(-4.81%;P = 0.058),19名参与者下降,12名参与者增加。版本1之后获得的个体参与者数据显示,皱纹计数的降低在基线值5.9倍范围内几乎完全成比例(D56/D0比值0.535 {+/-} 0.041;变异系数7.7%,低于任何其他终点),与基线严重程度不相关(r = -0.15,P = 0.42),在D28时已完成(D56/D28比值0.990 {+/-} 0.096),且与皱纹深度变化(r = +0.30,P = 0.096)或水合度变化(r = +0.23,P = 0.21)不相关。未报告不良反应。结论:连续56天每日摄入与角质层水合度增加相关,这一增加不能仅由低水合度入选标准解释;在一系列假设下,均值回归对观察到的升高贡献上限约为8-30%。同时记录到鱼尾纹皱纹计数减少,但其在参与者间的一致性、与基线严重程度的无关性、在首次随访时即已完成,以及缺乏重现该结果所需的PRIMOS分割阈值、感兴趣区域定义和图像配准参数,意味着作者不将其解释为生物学抗皱效果的证据。该结论取代版本1的结论。研究结果具有假设生成性;需要随机、安慰剂对照试验。
西班牙李斯特菌病住院的时空动态与环境驱动因素(2016-2024):同一健康视角 Garcia-Carretero, R. 2026-09-22 PDF 背景:单核细胞增生李斯特菌可引起高死亡率的侵袭性感染。然而,将人类发病率与牲畜及天气联系起来的生态学研究仍然匮乏。本回顾性研究利用全国住院数据、牲畜普查和气象记录,分析了西班牙人类李斯特菌病的地理分布。方法:应用负二项回归模型、空间自相关(莫兰指数)和双变量局部空间关联指标(LISA)分析。结果:2016年至2024年间,共记录4,391例住院病例。全国平均发病率为每10万居民1.03例,2019年达到峰值。牛密度是主要的环境驱动因素,每增加10头/平方公里,风险增加11%。观察到天气与牲畜的协同作用:与牛相关的风险在较高温度(约21摄氏度)和较低湿度(53%)下呈指数增长,而与山羊相关的发病率在较冷温度(约13摄氏度)下达到峰值。空间映射显示牛宿主呈北部聚集,山羊宿主呈南部隔离,绵羊或猪牲畜未发现关联。结论:人畜共患病风险受环境条件影响,天气作为生物触发因素。本研究强调了反刍动物养殖实践的关键作用,以及采用“同一健康”监测方法的必要性,该方法整合气象和养殖数据以预测季节性暴发并优化食物链安全。
对开源自动大腿肌肉MRI分割算法的基准测试 Moore, C. M. 2026-09-22 PDF 医学图像的自动分割可以加速临床和研究工作流程,但现有工具很少在共享基准上进行独立比较,这使得难以评估真正的进展。这对于磁共振成像(MRI)中的肢体肌肉分割尤为关键,因为该分割支撑着用于神经肌肉疾病生物标志物的体积分析、影像组学和脂肪分数定量——在这些应用中,分割误差会直接影响解读。尽管已有多种涵盖不同架构的开源分割工具,但文献中尚未出现独立的直接对比。我们通过评估八种工具来填补这一空白,其中六种可独立运行,另外两种则旨在作为辅助算法,用于在肌肉已以某种方式完成初始标注之后使用。我们在三个基础数据集的三维 MRI 体积上评估这些工具,随后又针对衍生数据集进行评估,同时考察定量指标和定性可用性。我们的结果揭示了不同方法和数据集之间存在显著的性能差异,许多方法在病理病例上准确性下降。在大规模数据集上训练的领域专用模型始终优于基础模型和更新的通用架构。我们的结果揭示了准确性、泛化性和易用性之间的实际权衡,这些权衡对临床采用至关重要,同时引发了对在代表性不足的人群和病理上部署的担忧。
每日食用全果费约果粉(Feiolix)对代谢特征的影响:一项随机对照试验 Shrestha, A. 2026-09-22 PDF 背景:糖尿病前期是血糖浓度高于正常范围但低于2型糖尿病诊断阈值的中间状态。超重且患有糖尿病前期的成年人进展为2型糖尿病和代谢失衡的风险增加。Feiolix——一种富含脱落酸、多酚和膳食纤维的全果费约果粉,可能通过互补途径支持代谢健康。目的:评估低剂量和高剂量Feiolix与安慰剂相比对HbA1C、胰高血糖素样肽(GLP-1)及其他代谢参数的影响。方法:年龄21-65岁、患有糖尿病前期即糖化血红蛋白(HbA1c)5.7-6.4%且超重、体重指数(BMI)为25.0-29.9 kg/m2的成年人被随机分配接受Feiolix-LD(300 mg/天)或Feiolix-HD(1,150 mg/天),或安慰剂(麦芽糊精),为期12周。每月进行人体测量,并在基线和干预后12周采集空腹血样。在基线和12周时采集餐后血样。结局包括HbA1c、GLP-1、空腹血浆葡萄糖、胰岛素抵抗、脂质标志物、体重和BMI。分析采用以基线值作为协变量的ANCOVA模型进行。结果:在筛选的41人中,39人被随机分组(每组13人);一名参与者从Feiolix-LD组退出。在第12周,Feiolix-HD组HbA1c下降0.5%,Feiolix-LD组下降0.4%,两组的下降幅度均显著大于安慰剂组(p < 0.05);与安慰剂相比,Feiolix补充剂显著降低了空腹血糖、胰岛素、HOMA-IR、总胆固醇和LDL-胆固醇。Feiolix-HD显著减弱了安慰剂组中观察到的甘油三酯升高,并与第2个月时相比安慰剂组体重和BMI的显著降低相关。然而,各治疗组之间未观察到GLP-1的变化。未报告与治疗相关的不良事件。结论:本研究支持Feiolix补充剂改善代谢健康(包括血糖和脂质结局)的潜力,并在较高剂量下对体重和BMI具有额外益处。本研究支持Feiolix补充剂改善代谢健康(包括血糖和脂质结局)的潜力,并在较高剂量下对体重和BMI具有额外益处。
电子健康辅助设备配置培训工具评估:一项准实验研究 Sudhakar, R. 2026-09-22 PDF 背景:约25亿人需要辅助产品,但获取仍然有限,部分原因是缺乏训练有素的人员。电子健康工具可能有助于加强劳动力能力并将证据转化为实践。世界卫生组织的辅助产品培训项目是一个开放获取的电子健康工具,旨在加强辅助产品的提供。然而,其对学习者结果的影响仍未得到充分评估。本研究评估了辅助产品培训模块的可用性和可接受性,以及移动辅助器具提供方面自我效能的变化。方法:我们对完成世界卫生组织辅助产品培训“辅助产品简介”模块的健康科学学生进行了一项准实验前后研究。我们使用系统可用性量表评估可用性,使用技术接受模型和可接受性理论框架评估可接受性,并使用班杜拉多维感知自我效能感量表的改编版本评估自我效能。我们使用描述性统计和配对样本t检验分析数据。结果:在53名参与者中,33人完成了两次评估。可用性超过既定基准(76.97 +/- 9.66),表明用户体验积极。可接受性研究结果显示各领域反应良好,易用性和干预一致性评分较高,负担评分相对较低。所有能力的平均自我效能从模块前的2.32 +/- 0.58提高到模块后的4.23 +/- 0.36(p < 0.001),反映出在辅助产品提供方面信心的显著提升。结论:电子健康辅助产品培训模块表现出高于平均水平的可用性和良好的可接受性,同时显著提高了辅助产品提供方面的自我效能。这些发现凸显了电子健康培训实施在加强劳动力能力和弥合全球健康培训差距方面的潜力。
携带LRRK2 G2385R和R1628P变异的帕金森病患者的周围免疫炎症标志物及临床相关性 Ding, H. X. 2026-09-22 PDF 帕金森病(PD)中亚洲流行的LRRK2 G2385R和R1628P变异携带者的外周炎症特征仍不明确。我们通过多重免疫分析检测了240名参与者血浆免疫炎症标志物(即IL-6、TNF-、CCL2、CX3CL1、CCL5和VCAM-1):PD-G2385R(n=53)、PD-R1628P(n=58)、PD-G2385R+R1628P(n=5)、特发性PD(iPD;n=62)和对照组(n=62),并分析其临床生物学相关性,包括单核细胞LRRK2激酶活性(pRab10Thr73)。与iPD和/或对照组相比,PD-G2385R中TNF-、CCL2、CX3CL1和CCL5较低,而PD-R1628P中IL-6、TNF-、CCL2和CCL5较低。较高的LRRK2激酶活性与较低的TNF-相关。CX3CL1在iPD中与较重的运动严重程度相关,但在两个变异组中与较轻的残疾相关。CCL5在PD-G2385R中与较少的运动并发症相关,而IL-6和VCAM-1在PD-R1628P中与较差的残疾和/或认知相关。这些发现表明,PD中的免疫炎症特征及其临床相关性因基因型而异,对未来免疫调节试验的分层具有意义。
眼科护理需求的隐性负担:视力定义如何改变六国12项RAAB调查中的需求估计 Bastawrous, A. 2026-09-22 PDF 目的:快速评估可避免盲(RAAB)调查被广泛用于估计50岁及以上成年人中盲和视力损害的患病率及原因。我们研究了眼保健需求的估计在多大程度上取决于使用呈现视力还是针孔视力,以及单眼还是双眼损害。方法:我们分析了2018年至2023年间在印度、尼泊尔、巴基斯坦、肯尼亚、坦桑尼亚和乌干达开展的12项RAAB调查。比较了三种个体层面的指标:至少一只眼的呈现视力(PVA)、较好眼的PVA,以及较好眼的针孔视力。估计值针对两阶段整群设计进行了调整,并按WHO世界标准人口进行了年龄标准化。结果:在检查的48,185名参与者中(应答率94.3%),基于较好眼针孔视力的视力损害(9-19%)显著低于较好眼PVA(18-37%)或至少一只眼PVA(33-51%)。年龄增长(每岁调整比值比[AOR] 1.106;95%置信区间[CI] 1.103-1.109)、女性(AOR 1.13;CI 1.08-1.19)和南亚调查地点(AOR 3.04;CI 2.78-3.33)与损害独立相关。年龄标准化扩大了调查地点之间的差异(患病率比粗为1.50,标准化为1.66)。结论:在两个区域所调查的地区,仍有相当程度的视力损害持续存在。呈现视力与针孔视力之间的巨大差距表明存在相当大且可解决的负担,而将估计仅限于较好眼的双眼损害则遗漏了另外相当大一部分需求。南亚地点较高的患病率最可能反映的是调查地点选择和未矫正屈光不正,而非区域流行病学差异。
阿尔茨海默病、路易体及血管神经病理的遗传关联揭示共享与独特的生物学通路 Morgan, K. 2026-09-22 PDF 引言:阿尔茨海默病、路易体病和血管神经病理学是大多数常见痴呆症的基础。大规模遗传研究往往依赖临床诊断,因此可能受到误诊和同时发生的共病神经病理的影响。方法:利用Brains for Dementia Research队列中可获得的扩展神经病理学数据,本研究基于痴呆中常见的神经病理进行了全基因组关联分析。遗传数据在Illumina Neurobooster芯片上生成,并使用PLINK中的标准分析流程进行分析。结果:在APOE位点内及其周围观察到若干关联,但仅与阿尔茨海默病神经病理相关。尽管不同神经病理组之间存在共同基因关联的汇聚,但各个SNP存在不同的关联。讨论:不同的神经病理结局似乎由不同的遗传变异驱动,但汇聚于与神经元结构和通讯相关的共同基因和生物学过程。理解这些共同通路可能为混合性神经病理和年龄相关神经退行性变的机制提供新的见解。