2026-08-12 每日论文
| 来源 | 独立页面 |
|---|---|
| arXiv | arXiv |
| bioRxiv | bioRxiv |
| medRxiv | medRxiv |
arXiv
| 标题 | 作者 | 发布日期 | PDF链接 | 摘要 |
|---|---|---|---|---|
| AdvFD:通过对抗性弗雷歇距离损失提升视觉生成 | Mingju Gao | 2026-08-11 | Fréchet距离近来作为一种有效的分布级目标函数,用于生成器后训练,补充了传统的样本级扩散和流匹配损失。然而,直接优化Fréchet目标可能导致Fréchet黑客现象。目标指标持续改善,但视觉质量和其他特征空间中的Fréchet对齐可能停滞或恶化。我们将此失败归因于现有Fréchet损失所使用的静态预训练特征空间。这些特征空间提供了不完整且固定的视角,用于观察真实分布与生成分布之间的差异。为解决此限制,我们提出对抗性Fréchet距离(AdvFD),它通过校准的对抗学习表示来补充FD-Loss中的静态表示目标。AdvFD在原始静态Fréchet目标基础上,增加了一个可学习表示,该表示对抗性地最大化真实样本与生成样本之间的Fréchet差异,而生成器则在由此产生的自适应特征空间中最小化相同差异。为防止对抗性表示通过特征放大而平凡地增加目标,我们进一步引入真实特征白化,它规范化其尺度和协方差几何,并稳定最小-最大优化。大量实验表明,AdvFD在JiT和pMF骨干网络以及不同模型规模上,一致地改善了一步生成器后训练。 | |
| 手术WAM:面向数据高效手术机器人学习的世界-动作模型 | Wenrui Bao | 2026-08-11 | 学习可靠的手术操作策略受到动作标注演示稀缺的瓶颈制约:遥操作手术机器人(如dVRK)的同步运动轨迹采集成本高昂,而手术任务要求精确的接触处理、长时程推理和双臂协调。内窥镜视频相对于同步的视频-运动学轨迹而言成本较低且数据丰富,利用它的自然方式是学习手术场景的世界模型。然而,现有手术世界模型主要将视频用于模拟或策略评估,很少将学到的动力学转化为闭环控制。这一差距引出了我们的核心问题:在固定预算的动作标注演示下,无动作视频预训练能否提升闭环手术操作?为回答此问题,我们引入了手术世界-动作模型(Surgical WAM),一种基于Cosmos Policy构建的统一生成模型,可联合预测未来内窥镜观察和可执行的手术机器人动作块。Surgical WAM首先从无动作视频中学习手术视觉动力学,然后在固定的动作标注预算上进行微调;部署时,它作为闭环、滚动时域控制器,执行每个预测动作块的短前缀,并根据结果观察重新规划。在四个模拟手术操作任务套件上,视频预训练将平均成功率从63.5%提升至77.8%,其中PegTransfer任务绝对提升20个百分点,最大改进出现在接触密集和双臂协调任务上。这些结果表明,无动作视频为在有限动作监督下学习手术机器人控制提供了可迁移的视觉动力学先验,将数据高效的视频预训练定位为扩展手术机器人学习的实用路径。 | |
| 为了在足球表征学习中捕捉人体运动的不确定性 | Yizhou Xu | 2026-08-11 | 本文提出了一种自监督表示学习框架,用于理解足球中基于3D骨架的人体运动,以未来运动预测作为学习目标。由于人体运动本质上具有不确定性,考虑多种可能的未来对于捕捉潜在的运动动态和学习有效的表示至关重要。为此,我们引入了一个运动预测的条件模块,该模块在3D欧几里得空间中对离散化未来运动的概率分布进行建模,通过未来轨迹的显式监督学习多模态性。在大规模足球运动员跟踪数据上的实验表明,我们的方法显著提高了运动预测的准确性。此外,学习到的表示有效迁移到多个足球下游应用中,展示了强大的跨任务泛化能力。 | |
| VidForensics-M1:基于可验证时间 grounding 的元检测强化学习用于AI生成视频取证 | Bowei Liu | 2026-08-11 | 视频生成模型的最新进展显著提升了合成视频的真实感,模糊了生成内容与真实内容之间的界限,并引发了对虚假信息的担忧。现有的基于MLLM的检测器主要依赖监督微调或标签级强化学习,其中粗粒度的监督限制了其对未见场景和新兴视频生成器的泛化能力。为克服这些限制,我们首次将元检测引入AI生成视频检测,通过在强化学习中联合优化预测标签和支持证据,实现可靠的伪造检测。这一范式需要可靠的证据信号及有效机制将其整合进标签级优化。文本理由提供了伪造伪影的语义描述,但其生成和验证依赖外部模型,使监督易受幻觉和语义偏差影响。相比之下,时间定位提供了更客观且可验证的证据,因为操纵区间可在伪造构建过程中精确控制。基于此洞察,我们提出一种自动化数据构建流水线,通过用边界帧条件视频生成模型替换时间片段,生成配对的真实-伪造视频。此外,我们引入证据引导的奖励再分配,根据证据质量在标签正确的响应间重新分配奖励,实现证据感知的信用分配。这保留了可靠的标签监督,同时鼓励检测器获取细粒度且可验证的伪造定位能力。大量实验表明,VidForensics-M1有效利用可验证的时间证据,实现了稳健且可泛化的AI生成视频检测。 | |
| ConVAWG:面向针对妇女和女童暴力行为的受控合成对话生成的检索接地框架 | Chen Lyu | 2026-08-11 | 合成对话生成为在难以获取、发布或标注真实数据的敏感领域中研究对话动态提供了一种途径。潜在的虐待可能发生在线上或线下:威胁和胁迫可以直接出现在消息中,而监视、隔离、跟踪和身体暴力等行为可能在对话中被计划、披露或提及。隐私和法律限制使得发布大规模真实对话数据集变得困难;现有工作主要集中在线上滥用的句子级毒性上,留下了将滥用建模为关系性和时间展开现象的空白。在本研究中,我们专注于将针对女性及女孩的暴力(VAWG)场景建模为多轮对话。我们引入了ConVAWG,一个基于检索的框架,用于生成符合CPS对齐的合成VAWG聊天对话。ConVAWG从人物种子、英国国家统计局报告的 demographic 模式、官方犯罪定义和检索到的家庭凶杀案审查案例中构建场景;将其转换为分层事件时间线;生成多场景角色扮演对话;并对适当的语句应用目标导向的激活控制毒性控制。我们发布了超过6,000个多轮对话事件,涵盖200个场景,并带有丰富的场景、事件和轮次级元数据。广泛的人工评估、LLM作为评审的评估、消融研究和下游任务显示了强大的对话质量和领域保真度。 | |
| 超越特征袋:稀疏自编码器中的集合级不稳定性 | Nikolai Bolik | 2026-08-11 | Shani等人(2026)表明,大语言模型表示大致恢复了人类类别边界,但未能反映细粒度的典型性结构。他们的分析使用稠密模型表示上的余弦相似度。我们重新审视其方法,采用重叠稀疏自编码器(SAE)潜在集上的重叠作为更具可解释性的相似度度量。我们首先验证这种集合级度量是有意义的:SAE潜在集能在受控玩具模型中恢复类似并集的组合结构,并在自然文本中诱导语义上连贯的邻域。将人类概念分析扩展到SAE集合相似度,我们发现SAE激活集在恢复人类类别边界或类别内典型性方面,并不比稠密嵌入或残差流状态更忠实,而是追踪模型内部的相似性结构。为进一步探究这一差距,我们在良好控制的语义修改下研究活跃潜在集,揭示出人类对概念变化的判断与SAE活跃集变化之间存在显著不匹配。我们将此解释为证据,表明在理想化设置之外,SAE特征并不通过简单的词袋式语义进行组合。 | |
| 格罗滕迪克常数的长视野AI研究:人机数学协作案例研究 | Alan Li | 2026-08-11 | AI智能体在数学研究中应用日益广泛,但如何有效使用它们往往并不明确。为此,我们提供了一个关于如何使用AI改进格罗滕迪克常数$K_G$界限的广泛案例研究,该常数捕捉了组合问题与其连续松弛之间的难度差异。具体而言,尽管$K_G$的精确值尚不明确,我们最近将已知的最佳界限收紧为 [ \frac{6\pi}{11} \;\le\; K_G \;\le\; \frac{\pi}{2\log(1+\sqrt2)} - 10^{-4}. ] 关键的是,这些改进是通过一个AI研究系统实现的,该系统能够得出领域专家认为新颖的见解。我们详细讨论了使用AI进行数学研究的经验,特别涉及其优势与不足,以及我们为AI创造理想条件以实现突破性见解的经验。 | |
| 测试时自演化GUI视觉定位:基于反思引导的在线策略自蒸馏 | Shiyu Xuan | 2026-08-11 | GUI视觉定位是GUI智能体的基础能力。现有模型通常在部署后冻结参数,限制了其适应未见界面的能力。尽管近期方法尝试通过测试时强化学习来适应模型,但它们无法对失败的探索进行反思。为克服此问题,我们提出了一种测试时自进化框架,使模型在部署后无需人工标注的真实值即可改进。该框架构建了探索、评估、反思和内化的闭环。具体而言,智能体首先通过预测给定指令的定位坐标来探索未见界面。为评估这些探索,我们引入了一个基于MLLM的反射器来评估生成结果并提供相应的推理反思。为将反思知识内化到模型权重中,我们提出了反思引导的在线策略自蒸馏方法,通过条件自教师将高层推理转化为密集的令牌级监督。此外,我们设计了一种对比校准方法,以防止错误的自回归前缀在失败探索期间破坏监督信号。跨六个基准的广泛实验证明了我们框架的有效性,平均准确率比基础模型提高了7.4%。据我们所知,这是首个成功利用在线策略自蒸馏进行GUI视觉定位测试时适应的研究。通过填补部署后适应的空白,我们的框架完善了GUI智能体的自进化能力。代码将发布。 | |
| 如何验证概率性声明的一致性 | Orr Paradise | 2026-08-11 | 当一个概率预测器回答许多条件概率查询时,其答案是否自洽,并且能否在多项式时间内验证?这个问题对AI安全具有重要意义,其中安全性源于对AI行动可能导致的非预期结果的概率预测的诚实性。我们构建了一个交互式PCP如下。设预测模型由概率电路P和输出预测置信度的电路Q指定。P和Q共同隐式指定了指数多的概率声明。我们展示了一个协议,其中多项式时间验证者可以验证(P,Q)的近似一致性。验证者获得电路对(P,Q),并在少数点上评估它们;同时,它获得一个证明预言机,即一个据称与(P,Q)预测一致的见证概率分布的编码,在与单个不可信证明者交互时,它在少数位置读取该编码。在此过程中,我们必须确保存在一个与模型预测一致的稀疏见证分布。为此,我们首先考虑显式概率声明一致性的见证分布,而不是由预测器指定的声明:假设有m个声明,每个形式为Pr[Y = 1 | X = x] = p,涉及n个布尔变量。基于Nilsson(Artif. Intell., 1986)发起的工作,我们将显式声明的l_2-近似概率一致性置于NP中,证书长度为O(mn + log B),其中B为输入位精度;我们进一步展示了小的加性完备性-可靠性差距如何消除对B的依赖。这些结果共同为认证概率预测器的自洽性提供了复杂性理论基础。我们将我们的交互式PCP视为训练预测模型证明自身一致性的第一步。 | |
| 软性注意力机制的量子路线图:概率单纯形上软性注意力的精确玻恩规则类比 | Eric A. F. Reinhardt | 2026-08-11 | 注意力机制构成了许多现代AI模型(如Transformer)的基础。在注意力被应用的一类子问题中,输入和输出被约束在概率单纯形上,使得所有输出之和为一。在此设定下,softmax注意力允许一种精确的、逐分量的量子实现。注意力分数是幅度编码输入的块编码投影上的Hadamard测试统计量。指数softmax是由Born规则测量在精确双射下生成的余弦平方族的内点,其边界在有限参数值处表达具有精确零点的稀疏注意力。softmax温度是重复计数,其中后选择测量轮次精确实现离散化的逆温度。值聚合是确定性列加载通道,它扩张了列随机的值矩阵。门控残差是单个辅助比特的制备角度,加法恒等式在混合角π/2处。每个可学习参数都是旋转门角度。组合层在无限次测量极限下是精确的,每个注意力分数对应一步测量并重新加载;完全相干变体通过量子奇异值变换在无限深度极限下是ε近似的。代数核心在Lean 4中进行了机器验证。 |
bioRxiv
| 标题 | 作者 | 发布日期 | PDF链接 | 摘要 |
|---|---|---|---|---|
| SpatialAgent:用于空间生物学的自主AI智能体 | Wang, H. | 2026-08-12 | 人工智能的进展正在变革科学发现,然而空间生物学——一个解读组织内分子组织的领域——仍受限于劳动密集型的工作流程。在此,我们提出SpatialAgent,一个用于空间生物学研究的自主AI代理。SpatialAgent将大型语言模型与计划-行动-结论架构、动态工具和技能检索、多模态解释以及审核生成声明的验证模块相结合。它支持完整的发现循环,从基因面板设计和多模态注释到轨迹推断、细胞间通讯分析、插补和假设生成。在人类和小鼠的脑、心脏、扁桃体、结肠及前列腺数据集中,SpatialAgent超越了已建立的计算基线,并在关键任务中与专家科学家相当或更优。在开放式案例研究中,它恢复了已知的组织结构并生成了空间定位的假设。在一项前瞻性的小鼠前列腺癌Xenium研究中,它设计了一个紧凑的100基因附加面板,分析了21个样本中的420万细胞,改善了细胞类型和恶性状态预测,并捕获了空间结构的肿瘤和微环境程序。SpatialAgent为空间生物学中的自主和协作发现建立了一个框架。 | |
| 白黄麻(Corchorus capsularis)漆酶基因家族的全基因组鉴定:韧皮纤维木质素工程中的潜在靶标 | Parida, S. | 2026-08-12 | 黄麻(Corchorus spp.)是一种重要的工业韧皮纤维作物,因其木质纤维素纤维而备受重视,然而纤维木质化的分子基础仍未得到探索。漆酶(EC 1.10.3.2)是催化木质素聚合最后步骤的关键酶。对白黄麻(Corchorus capsularis)的全基因组分析鉴定出32个推定的漆酶基因(CcaLACs),这些基因在系统发育上分为六个分支。表达谱分析显示,在韧皮部组织中表达占主导地位(16个基因),其次是叶片(8个)和木质部/根组织(4个)。多个CcaLACs从早期生长到收获阶段表现出逐渐上调。与拟南芥漆酶的同源性比对突出了参与木质化的候选基因,这些基因进一步得到转录组和qRT-PCR分析的支持。值得注意的是,关键CcaLACs在dlpf(木质化韧皮纤维缺陷型)低木质素白黄麻突变体中表现出显著降低的表达。CcaLAC表达也对非生物胁迫有响应,包括脱落酸和铜。MicroRNA靶标预测鉴定出Ath-miR397a和Ath-miR397b作为多个CcaLACs的潜在调控因子。结构和亚细胞分析揭示了保守基序、跨膜结构域和多样的细胞定位。基因本体论分析将CcaLACs与木质素和苯丙烷类生物合成联系起来。其中,CcaLAC28和CcaLAC32成为与韧皮纤维木质化相关的强候选基因,代表了未来功能验证以开发低木质素黄麻品种的有前景靶标。 | |
| 关于惯例的定义、测量及其维持所依赖的认知过程之探讨 | Nolan, C. R. | 2026-08-12 | 日常运作中例行程序的好处已被广泛认可,然而,尽管其重要性显而易见,量化例行程序维持的方法及其被打断的原因仍然缺乏。在此,我们提出一种新颖的定义和量化例行程序的方法(转移熵)。利用转移熵,我们表明例行程序可以在需要搜索隐藏目标的方格网格任务中被稳健地引出。通过两项实验(每项N=100),我们显示,使用例行程序——以转移熵量化——会因搜索网格之间的频繁切换而受到稳健干扰,因为当前无关网格特有的位置变得具有竞争性。通过一个追踪任务动态的规范模型,我们表明例行程序的干扰可归因于对完成任务成功几率的敏感性降低。这提示,例行程序的维持可能因对例行程序早期缺乏奖励的过度敏感,或对追求其他任务效用的期望增加而受到干扰。 | |
| 视觉工作记忆的精确度受自主控制 | Sahakian, A. | 2026-08-12 | 视觉工作记忆使我们能够基于最近看到的信息来指导行为。大多数研究基于一个假设,即人们总是尽可能精确地存储视觉信息,无论即将进行的动作需要什么。然而,在日常生活中,不同的(记忆引导的)动作要求不同的精确度水平。在此,我们探讨了人们是否会根据任务需求灵活调整信息编码的深度以及维持视觉信息所投入的努力程度。通过三个实验,参与者需要记忆最多四种颜色,同时我们操纵了延迟报告被视为正确所需的精确度。我们发现,当所需精确度更高时,报告速度变慢,并且在某些情况下更为精确。关键的是,我们发现更高的精确度要求导致了(1)编码期间瞳孔收缩增强,表明编码更深,以及(2)维持期间瞳孔扩张增大,表明认知努力更大。此外,这种维持努力的适应性增加不仅发生在编码前已知精确度要求时(实验1和2),甚至当精确度要求仅在编码后揭示时也是如此(实验3)。因此,视觉信息的维持可以根据不断变化的任务需求灵活调整。然而,这种灵活性存在局限:随着精确度要求的增加,即使不再能提高表现,参与者也会增加努力。综合来看,这些发现表明视觉工作记忆并非总是被最大程度加载的被动存储库。相反,视觉信息的编码、维持和使用方式会根据即将进行的行为需求进行调整。 | |
| 显性知识在运动系统中门控预期抑制:来自TMS oddball范式的证据 | Cost-Chretien, M. E. | 2026-08-12 | 预测加工模型提出,大脑持续对传入的感觉输入生成预测,并在这些预测被违背时通过预测误差更新内部环境模型。这些模型的一个基本假设是,预测误差是自动生成的,即使在没有对预测的明确知识时也是如此。来自无意识患者听觉怪球研究中的证据似乎支持这一观点,但研究结果因刺激特异性适应混淆而复杂化,这使得难以分离出真正的预测效应。为了探究期望抑制或基于预测的衰减是否延伸到运动系统,以及它是否自动运作,我们开发了一种使用脑刺激的新型运动怪球范式。经颅磁刺激(TMS)作用于初级运动皮层,在外周肌肉中诱发运动诱发电位(MEP),提供皮质脊髓兴奋性的指标。通过以怪球方式变化刺激强度,使用重复和偏离序列,我们操纵了TMS脉冲的可预测性,并比较了预期与非预期强度匹配刺激下的MEP振幅。结合控制适应的实验设计以及测试明确知识作用的指令操作,预期TMS产生的MEP小于非预期TMS。关键的是,这种衰减仅在明确知晓序列结构的参与者中观察到。这些发现将期望抑制效应扩展到运动系统,支持基于预测的神经衰减的领域普遍性,同时挑战了预测加工完全自动运作的假设。 | |
| 催化中间体的切割精细调控cGAS信号传导 | Yan, Y. | 2026-08-12 | 环状GMP-AMP合酶(cGAS)的过度激活会驱动炎症和自身免疫疾病,但完全抑制cGAS信号传导可能损害宿主防御。在此我们表明,cGAS信号可通过一个此前未被识别的调控检查点进行调节。细菌cGAS通过涉及2'-5'连接的线性二核苷酸中间体释放和重新结合的两步机制生成cGAMP。我们鉴定出一种CBASS相关的核酸外切酶(Exo),该酶选择性降解这一催化中间体,从而为cGAS激活设定阈值,同时保留免疫功能。这种阈值机制在生命各域中保守:Exo在体外和哺乳动物细胞中抑制人cGAS活性,并在体内减弱cGAS驱动的病理过程。我们的发现将催化中间体监视确定为保护cGAS信号传导的保守策略。 | |
| 革新禽类通报疫病诊断:基于CENOS平台验证直接拭子检测禽流感和新城疫的方法 | EDGE, D. | 2026-08-12 | 现有针对应通报禽病(NADs)的分子诊断方法涉及一套PCR检测,既能进行通用检测,又能在阳性情况下对禽流感病毒(AIV)和新城疫病毒(NDV)进行亚型鉴定。本研究开发并评估了新型快速直接检测AIV和NDV的诊断方法,使用未经处理的禽类泄殖腔(C)和口咽(OP)拭子材料。两种检测均采用闭管直接实时逆转录聚合酶链反应(RRT PCR)方法,通过热处理和专用PCR兼容缓冲液实现病毒裂解,随后用RRT-PCR方法进行检测。引物和探针组基于过去五年全球流行的AIV和NDV序列设计,而非区域特异性序列数据集,以确保检测覆盖所有流行基因型。分析性能评估显示,两种检测均高度敏感且特异,能成功检测所有未提取的目标抗原,且对其他常见禽类病原体无交叉反应。每种检测均能从个位数基因组拷贝数的样本中直接实现病毒裂解和扩增。此外,在C和OP基质材料存在下,低水平病毒RNA也能可靠检测,为野外环境中直接检测这些经济上重要的禽类病原体提供了概念验证。还探索了其他使用场景,包括混合样本筛查和单只鸟的C/OP联合检测。这些发现为后续研究奠定了基础,将采用配对样本检测与验证过的实验室参考方法进行比较。 | |
| 环境特异性机械感知在不同胚胎环境中维持共同的基于泡状突起的迁移程序 | Morimoto, M. | 2026-08-12 | 细胞迁移常常需要细胞穿越具有不同物理和生化特性的组织环境。迁移细胞如何在适应这些异质环境的同时保持共同的迁移程序,目前仍知之甚少。在此,我们展示了鸡胚原始生殖细胞(PGCs)在整个胚胎发生过程中,尽管穿越机械特性不同的组织,仍保持基于泡状突起的共同迁移模式。PGCs在血管内爬行和通过背肠系膜迁移时均形成膜泡。然而,核膜(NE)展开及NE-cPLA2通路的激活仅在通过机械受限的背肠系膜迁移时发生,且该通路在此过程中对泡状突起形成和高效迁移是必需的。相比之下,血管内爬行时的泡状突起形成独立于NE-cPLA2通路,表明不同组织环境中不同的分子机制可产生相同的迁移行为。综合这些发现,提示多样的环境信号汇聚于保守的泡状突起形成机制。我们提出一个层级模型,即迁移细胞通过根据组织环境灵活切换启动泡状突起形成的上游分子机制,来保持共同的迁移程序。 | |
| 连续咽内胚层连接外鳃与内鳃 | Singh, H. | 2026-08-12 | 两栖动物在个体发育过程中同时形成外鳃和内鳃,为研究这些位置不同的呼吸器官之间的发育关系提供了机会。尽管脊椎动物的内鳃被广泛认为源自咽部内胚层,但外鳃长期以来被视为纯粹的外胚层突起,这模糊了它们与其他脊椎动物鳃的关系。在此,我们结合组织学分析与墨西哥蝾螈(Ambystoma mexicanum)和非洲爪蟾(Xenopus laevis)中的直接谱系追踪,以解决两栖动物鳃的胚胎起源问题。我们表明,外鳃作为咽部内胚层的连续上皮延伸发育,该延伸形成其基底层上皮并延伸至远端鳃尖。在爪蟾中,这一延伸与形成内鳃的上皮保持连续。因此,外鳃和内鳃并非代表独立的上皮结构,而是源自咽部内胚层的一个共享上皮区域。这些发现解决了一个关于两栖动物鳃胚胎起源的长期问题,并为理解空间多样的脊椎动物鳃如何通过保守内胚层组织的反复修饰而进化提供了发育视角。 | |
| Bx42通过Prospero引导神经干细胞退出静息状态 | Losurdo, N. | 2026-08-12 | 小头畸形是一种罕见的神经发育障碍,其特征是儿童头部和大脑尺寸严重减小,并伴有多种致残性副作用,包括认知和发育障碍。尽管许多小头畸形病例源于基因突变,但将变异与疾病关联起来的分子机制仍知之甚少。我们此前通过使用人脑类器官建模和果蝇功能研究的患者知情研究,将Bx42鉴定为一种导致小头畸形的基因。在此,我们证明Bx42的缺失通过减少发育早期神经干细胞增殖而导致小头畸形。机制上,我们的数据表明Bx42通过调控神经分化因子Prospero促进从静止期到增殖期的转变。Bx42的减少导致神经干细胞分裂减少,原因是静止期延长。重要的是,我们证明人类同源基因SNW1中的两个患者来源变异是无功能或亚效的,这提供了强有力证据表明这些变异是致病性的并导致小头畸形。总之,我们的发现定义了Bx42/SNW1通路在调控神经干细胞激活和大脑生长中的先前未被认识的作用,为遗传驱动的小头畸形发病机制提供了新的机制见解。 |
medRxiv
| 标题 | 作者 | 发布日期 | PDF链接 | 摘要 |
|---|---|---|---|---|
| 推动人工智能在癌症护理中的临床实施:省级研讨会结果的概念图谱分析 | Nayyar, C. | 2026-08-12 | 背景:人工智能(AI)在医疗保健领域迅速引起关注,研究显示其有望改善质量、效率和结果。癌症护理的多学科性质和高协调需求使其非常适合受益于AI。虽然关于证据采纳态度及AI在医学中实施的态度已有普遍探讨,但针对AI在癌症护理中的文献仍然稀缺。本研究旨在理解患者和专业人士的观点如何对指导负责任、有效的基于证据(EB)的AI在癌症护理中的实施至关重要。方法:我们在2024年不列颠哥伦比亚省(BC)癌症峰会(加拿大温哥华)举办了一次研讨会。讨论围绕三个指导性问题:AI在癌症护理中的担忧、益处和优先事项。来自48名研讨会参与者(患者及家属、AI/计算机科学/癌症研究人员、临床医生和专职医疗人员、信息技术专业人员、医疗管理者)的回应通过概念映射进行结构化概念化,利用多维缩放和层次聚类及子聚类分析,生成利益相关者优先事项的可视化和定量图谱。结果:研讨会共产生265条关于AI在癌症护理实施中感知益处、担忧和优先事项的陈述,并进行了概念映射。识别出两个聚类;聚类1聚焦于“AI实施的挑战与保障措施”,聚类2聚焦于“临床益处与效率提升”。子聚类分析区分出8个主题子聚类(每个聚类4个)。聚类2的平均重要性(P < .001)和可行性(P < .001)评分均显著更高。临床和非临床专业人员的评分之间未发现差异。进一步的“走向区域”分析根据陈述相对于总体平均值在重要性和可行性上的相对优劣进行分类。结论:利益相关者对描述临床益处和效率提升的陈述评分高于描述AI在癌症护理实施中挑战与保障措施的陈述。概念映射分析区分了与工作流程一致的AI应用(被视为可立即实施)和需要长期投资的系统级治理要求。当前发现提供了一个结构化的、利益相关者知情的框架,用于优先排序和排序癌症护理中的AI实施工作,构成了一份促进有意义进展的实用蓝图。 | |
| Boora,一个用于巴西初级保健中超重和肥胖护理的AI辅助数字平台:一项关于感知可用性和可接受性的形成性混合方法评估 | Couto, F. d. F. S. | 2026-08-12 | 目的评估Boora在巴西初级保健用户和卫生专业人员中的感知可用性、可接受性和用户体验(而非临床有效性)。Boora是一个人工智能辅助、人工监督的纵向超重和肥胖护理数字平台原型。设计采用收敛混合方法形成性评估。感知可用性通过系统可用性量表(SUS)测量并进行描述性总结;实际操作后的半结构化访谈采用编码本主题分析(Braun和Clarke)进行分析;两条研究线索通过联合展示进行整合。定性报告遵循定性研究综合报告标准(COREQ)。研究场所巴西统一卫生系统内帕拉州阿纳宁德瓦初级保健网络(2026年1月至2月)。参与者15名超重或肥胖成人(BMI≥25 kg/m²,通过电子健康记录确认),使用患者应用程序24小时;8名初级保健专业人员(护士、医生和营养师),使用专业仪表板约20分钟完成预设任务(使用合成数据)。主要结局指标SUS评分及涉及可用性、可接受性、感知有用性、障碍以及感知临床和工作流程适配性的定性主题。结果Boora在两个队列中均显示出良好的感知可用性(用户均值76.5,SD 10.3;专业人员均值77.5,SD 4.6;均高于SUS规范平均值68)。每个队列出现四个主题。用户重视可访问的界面和可见的进展,但描述了每日记录负担、预期参与度脆弱以及数字素养和可访问性障碍。专业人员重视清晰的界面和面板管理、主动随访的前景,同时需要培训、AI治理、保护时间以及与全国记录的互操作性。整合表明,用户预期的参与度下降正是专业人员认为仪表板可帮助识别的风险,而教育性AI助手是两组中最薄弱和最模糊的组成部分。结论Boora被认为可用且可接受,其感知价值集中在人工监督的纵向随访而非自主自我跟踪或AI建议。这些发现涉及感知可用性和可接受性,而非临床有效性或持续参与。实际采用将取决于可访问性改进、电子记录集成以及符合巴西拟议风险导向AI框架和LGPD原则的明确AI治理。关键点已有知识移动和网络应用程序可支持体重管理,但缺乏结构化专业支持时用户参与度往往随时间下降,且大多数证据来自高收入国家。初级保健中的自主AI建议可能不安全或与临床指南不一致,凸显了人工监督和可审计系统的必要性。本研究新增内容在巴西公共卫生系统中,将患者应用程序与专业仪表板配对的人工智能辅助、人工监督平台原型,经简短实际操作后,被患者和初级保健专业人员认为可用且可接受。混合方法整合表明,用户预期的参与度下降与专业人员认为仪表板可帮助识别的风险相对应,将平台的感知价值定位于人工监督的纵向随访;教育性AI助手是其最薄弱的组成部分。本研究对研究、实践或政策的影响支持将初级保健肥胖工具中的AI设计为可审计、受监督的支持而非自主建议,符合巴西拟议风险导向AI框架的原则。参与者指出,低识字用户的可访问性、与国家电子健康记录的互操作性、保护时间和培训是采用的潜在先决条件,值得进行纵向、真实世界评估。 | |
| 东亚和欧洲队列中难治性精神分裂症的遗传结构:来自GWAS、TWAS和突触通路分析的见解 | Leung, P. B. | 2026-08-12 | 在约四分之一的精神分裂症谱系障碍(SSD)患者中,疾病对标准抗精神病药物治疗无反应,但其背后的生物学机制仍知之甚少。尽管这种治疗抵抗性精神分裂症(TRS)与治疗反应性精神分裂症共享大量遗传易感性,但多巴胺拮抗剂在TRS中的有限疗效表明,多巴胺信号之外机制可能促成治疗抵抗,需识别替代性生物学通路。这是首个跨祖先遗传学研究,通过直接比较两个独立队列——香港(N=798)和STRATA-G联盟(N=1243)——中的治疗抵抗性与治疗反应性精神分裂症患者,来探究TRS的遗传结构。利用整合的多层次分析框架,我们进行了全基因组关联研究(GWAS),结合基于基因和基于基因集的分析、通路多基因风险评分,以及转录组全关联研究(TWAS)。我们进一步进行了聚焦于专家策展的突触通路和脑组织的基因集富集分析。在基因、通路和遗传预测表达水平上,各祖先内均识别出遗传信号。尽管有限功效限制了单个位点发现和跨祖先一致性,富集分析表明各队列间存在异质性信号,包括效应方向差异,但突出了队列特异性的突触相关生物学,特别是涉及突触前囊泡动力学、神经传递和突触组织的通路。总体而言,这些发现强调突触生物学作为SSD中治疗抵抗相关常见变异遗传效应的一种潜在通路级信号,尽管单核苷酸多态性层面发现极少。我们的工作表明,通路级和多组学方法在阐明SSD内生物学上有意义的异质性方面具有前景,并为突触机制作为理解和分层治疗抵抗的潜在靶点提供支持。 | |
| 基于MRI的前列腺癌筛查,按年龄分层与按风险分层两种策略的获益、危害及成本效益比较。 | Callender, T. | 2026-08-12 | 背景 前列腺癌筛查仍存在争议。以MRI为先的筛查策略可能通过检出较少的非显著性癌症,相比以PSA为先的策略减少过度诊断。然而,MRI为先的前列腺癌筛查的益处、危害及成本效益仍不确定。方法 我们模拟了基于年龄和风险分层的MRI为先筛查策略。风险分层涉及多基因风险评分或PSA检测,其中PSA检测以1ng/ml为阳性阈值。我们进行了广泛的情景和敏感性分析,以确定结论对输入参数的稳健性。主要结局为前列腺癌死亡、过度诊断癌症、资源使用和成本效益(从医疗保健视角的净健康效益)。结果 从55-69岁每4年进行一次基于年龄的MRI为先筛查,可减少每1000名筛查男性中6例前列腺癌死亡,其中13%的筛查检出癌症为过度诊断。然而,该策略相比无筛查需要增加15倍的MRI扫描量,且在英国的背景下不具备成本效益。使用多基因风险的风险分层筛查更可能具有成本效益,产生更多质量调整生命年,并导致比对所有男性进行MRI筛查更少的过度诊断癌症。在每获得一个QALY愿意支付25000英镑的阈值下,对55岁男性进行10年绝对前列腺癌风险≥4.8%的筛查,其净健康效益高于无筛查。在MRI前使用PSA分流,根据PSA阳性阈值(1ng/ml或3ng/ml),过度诊断癌症比MRI为先筛查多17-30%。在3ng/ml阈值下,PSA筛查在每QALY愿意支付25000英镑时具有57%的成本效益概率。结论 MRI为先筛查可减少过度诊断,并比PSA筛查产生更多QALY。但额外的资源需求意味着,在英国,风险分层可能对于前列腺癌筛查在临床和成本效益上均被认为是必要的。 | |
| 脑血管-脑脊液耦联受损与路易体病的非运动症状相关 | Ignatavicius, A. | 2026-08-12 | 皮层血氧水平依赖(BOLD)活动与脑脊液流入之间的时间耦合最近被提出作为类淋巴功能的无创标志物,类淋巴系统是一个与睡眠、神经调节和神经退行性变密切相关的全脑清除系统。既往研究报道帕金森病中BOLD-脑脊液耦合减弱,但其在路易体痴呆中的特征、区域特异性及其与共享神经精神症状的相关性仍不清楚。利用静息态功能磁共振成像,我们量化了39名参与者的全局和区域BOLD-脑脊液耦合,包括17名帕金森病患者(平均年龄61.4岁)、10名路易体痴呆患者(平均年龄72.8岁)和12名健康对照者(平均年龄66.2岁),并检查了其与临床和认知测量指标以及皮层下上行唤醒系统体积测量指标的关系。耦合通过全局BOLD信号与脑脊液流入时间序列的时间互相关得出。组间差异及与临床、认知和皮层下上行唤醒系统体积测量指标的关联采用非参数置换检验评估。帕金森病和路易体痴呆患者均表现出较对照组更弱的全局BOLD-脑脊液耦合,患者组之间未检测到显著差异。耦合减弱在单模态和注意网络内最为显著,涵盖路易体疾病中特别易受影响的区域。较弱的耦合与幻觉和认知波动的严重程度、较差的夜间睡眠质量以及受损的注意工作记忆相关,但与总体运动症状负担无关。观察到BOLD-脑脊液耦合与基底前脑和脑干体积之间的关联,尽管部分依赖于年龄,提示神经调节系统退化、衰老和脑液动力学之间存在复杂交互作用。我们的结果提供初步证据表明,脑血管活动与脑脊液流入之间的时间协调破坏可能促成路易体疾病的波动性神经精神特征,并强调BOLD-脑脊液耦合作为类淋巴功能动态体内替代指标的价值。在更大队列中结合多模态成像和病理生物标志物进行复制验证对于确认这些发现并确定脑液失调是否代表潜在可调节的治疗靶点至关重要。 | |
| 2019-2024年英格兰乳腺癌治疗中CDK4/6抑制剂的使用变化与剂量减少:基于OpenPrescribing Hospitals的描述性观察研究 | Fisher, L. | 2026-08-12 | 背景:英国国家健康与临床优化研究所批准在英格兰使用的新型癌症疗法数量正在增加。监测新疗法的采用情况对于评估获取公平性和评价真实世界处方实践至关重要。OpenPrescribing Hospitals平台近期推出,旨在促进英格兰二级医疗开放药品数据的分析。利用该平台,我们着手描述2019年1月至2024年12月期间英格兰国家医疗服务体系医院中细胞周期蛋白依赖性激酶4和6(CDK4/6)抑制剂的使用情况,包括剂量减少的频率。方法:在医院层面计算每种CDK4/6抑制剂相对于总CDK4/6抑制剂使用的月度比例。通过比较2021年和2024年各癌症联盟内每种CDK4/6抑制剂的使用比例,评估区域差异。使用较低剂量的帕博西尼和阿贝西利作为剂量减少的替代指标。结果:2019年至2024年间,CDK4/6抑制剂的使用量增加了3倍以上。2019年,帕博西尼、阿贝西利和瑞博西尼分别占CDK4/6抑制剂使用的78.6%、11.9%和9.5%,而2024年这一比例分别为40.2%、41.2%和18.6%。各癌症联盟中每种药物的使用相对百分比变化存在差异。帕博西尼(60%)和阿贝西利(63%)使用较低剂量的情况较为常见。解释:使用变化似乎对关键证据发表和监管里程碑事件反应灵敏。剂量减少的表观频率高于临床试验中报告的数值。OpenPrescribing Hospitals是一个可访问的公开工具,用于了解英格兰NHS医院中药物的采用和使用情况。 | |
| 撤稿:1958年英国出生队列中从中年到早年老年的内在能力评估 | Ye, Y. | 2026-08-12 | 作者已撤回其稿件,因为该稿件在未获得所有作者完全同意的情况下被提交并公开。因此,作者不希望此作品被引用为项目参考。如有任何疑问,请联系通讯作者。 | |
| 肾病综合征患者肾组织中的A-to-I RNA编辑 | Mezger, V. | 2026-08-12 | 引言RNA编辑已被认为与内源性双链RNA(dsRNA)感知及炎症性疾病相关,但其在病变人类肾组织中的普遍性、遗传调控及后果尚未得到系统性表征。由于ADAR酶通常在同一转录本中编辑多个相邻腺苷,将这些位点整体分析(作为“簇”)可能揭示单一位点分析所遗漏的效应。方法我们分析了来自肾病综合征研究网络215名参与者肾脏中的单一位点和簇A-to-I RNA编辑,这些参与者患有局灶节段性肾小球硬化或微小病变病,并具有显微切割的肾小球和/或肾小管间质RNA测序及血液基因组测序数据。我们测试了单一位点和簇编辑与估算肾小球滤过率、蛋白尿及干扰素刺激基因表达评分的关联。为发现编辑的遗传决定因素,我们进行了单一位点、顺式编辑QTL及簇水平编辑QTL(cledQTL)的定位分析。随后,我们测试了cledQTL与肾脏eQTL及肾脏相关GWAS的共定位。结果肾小管间质中较高的簇平均编辑与较低的干扰素刺激基因活性(P = 4.81 x 10-9)、较少的蛋白尿(P = 0.01)及较高的eGFR(P = 8.52 x 10-5)相关。遗传定位识别出290个肾小球和473个肾小管间质单一位点edQTL,以及21个肾小球和51个肾小管间质cledQTL。我们在cledQTL与GWAS之间识别出10个共定位信号,在cledQTL与eQTL之间识别出14个。51个肾小管间质cledQTL簇中有9个在NEPTUNE中与eGFR单独相关。结论这些结果将A-to-I RNA编辑确定为蛋白尿性肾病中一个可测量且部分受遗传调控的分子表型,并提名肾小管间质转录本的簇编辑作为减弱免疫活性及提高肾功能的潜在贡献因素。簇水平分析识别出额外的遗传调控编辑模式和共定位信号,这些在单一位点水平未被检测到,突显了将邻近编辑位点作为簇进行分析的附加价值。 | |
| 基因组维度解构双相障碍的临床异质性 | the Bipolar Disorder Working Group of the Psychiatric Genomics Consortium, | 2026-08-12 | 双相障碍(BD)的临床异质性具有未解决的遗传基础。我们对来自57个队列(38,022例病例)的226,032名个体中16种BD亚表型进行了全基因组关联研究(GWAS)的荟萃分析;其中10种进入多变量和多性状分析。四个因子(强迫性、精神病性、失调性、内化性)解释了82.8%的共享遗传方差。尽管遗传相关性高,BD1和BD2在不同因子上载荷;87.0%的常见因子位点在两种亚型中均不显著。单相躁狂与精神病性因子而非内化性因子对齐,且可与BD1区分;快速循环显示出可遗传的跨域易感性。我们识别出356个风险位点,其中158个为新发现,包括首次针对精神病性、单相躁狂、快速循环和分裂情感性障碍的单变量GWAS关联——以及249个可信基因(89个高置信度),其中12个具有已批准药物或临床阶段注释。细胞类型关联显示沿精神病性因子存在中脑多巴胺能-GABA能梯度。BD的遗传结构似乎是分层的——一种一般性易感性分解为超越诊断亚型的病程和共病维度。 | |
| 环境AI记录使用对文档负担和财务生产力的纵向影响:一项准实验研究 | Waken, R. | 2026-08-12 | 目的:探讨初级保健中环境AI scribe使用对文档记录时间、笔记书写模式及临床医生财务生产力的纵向影响。方法:我们开展了一项准实验研究,采用中断时间序列设计,以确定AI scribe使用对笔记书写时间、计划外时间(TOSH)、睡衣时间(下午5:30至上午7点)、笔记长度、24小时内笔记关闭以及工作相对价值单位(wRVU)的影响。对于每位初级保健临床医生(医生、高级实践提供者),初始访问日期为第零天;每项指标在第零天前150天(前期)和第零天后150天(后期)进行计算。结果:纳入来自36个诊所的220名临床医生(平均年龄=43.7岁,70.9%为女性;56.4%为医生),共进行314,845次患者就诊。与前期相比,第零天笔记书写时间下降7%(发生率比(IRR)0.93,95%可信区间(CI)[0.89,0.98]),至第150天下降增至16%(IRR 0.84,95%CI [0.82,0.87])。第零天睡衣时间、TOSH或wRVU无变化;然而,至第150天,睡衣时间下降19%(0.81,95%CI [0.73,0.90]),TOSH下降13%(0.87,95%CI [0.77,0.98]),wRVU增加2%(1.02,95%CI [1.01,1.04])。第零天笔记关闭增加5%(1.05,95%CI [1.02,1.08]),至第150天与前期水平无差异。第零天或第150天笔记长度无变化。讨论:随着临床医生将这些工具融入工作流程,AI scribe使用指标随时间出现持续变化。 |