跳转至

2026-08-24 每日论文

来源 独立页面
arXiv arXiv
bioRxiv bioRxiv
medRxiv medRxiv

arXiv

标题 作者 发布日期 PDF链接 摘要
OmniAssistBench:面向全模态大语言模型的助手式交互基准 Xianyun Sun 2026-08-21 PDF 近期,全模态大语言模型(Omni-LLMs)展现出作为实时视频助手的巨大潜力,能够持续感知环境并引导用户实现特定目标。与传统被动式视频理解不同,交互式助手应主动结合视觉状态、用户目标及先验知识,以提供有效帮助。评估这一能力颇具挑战性,因为模型不可预测的响应会动态改变用户后续行为,而静态离线数据集无法适应这种变化。为突破这一瓶颈,我们引入了OmniAssistBench。针对同一用户目标可通过多种方式实现而导致交互路径分叉的问题,我们为模型提供源自源视频的预定义先验,要求其引导用户沿完全相同的路径行进。由于真实交互视频稀缺,我们通过对现有互联网视频进行逆向工程来构建数据集。我们推断逻辑性用户目标,并将视频分割为多轮片段以模拟连续交互。这一严谨流程耗时超过1000个专家工时以构建数据集。结果显示,专有模型Gemini-3-Pro达到满分100分中的66.4分,而开源模型Qwen3-Omni-Instruct获得51.2分。尽管当前模型普遍能理解用户输入,但常给出错误或不完整的回答。具体而言,它们在处理视觉提示(如手势)时存在困难,在多轮交互中难以维持历史上下文,且无法延迟响应直至目标事件发生。结果表明,在模型成为可靠助手之前,仍有大幅改进空间。
牛顿法的原始加速 Nikita Doikov 2026-08-21 PDF 我们提出了一种新的直接加速牛顿法,用于最小化具有Lipschitz连续Hessian的凸函数。该算法仅使用原始变量,并且每次迭代只需进行一次线性求解。通过简单预定的参数选择,它在函数残差方面实现了$O(1/k^3)$的全局收敛速率。据我们所知,这是针对此类问题首次达到该速率且仅依赖每次迭代一次线性系统求解的二阶方法(无需求解辅助非线性正则化子问题,如三次正则化,执行非线性参数搜索,或使用对偶外梯度校正)。我们的方法可以以无Hessian方式实现,使用不精确的线性系统求解器,同时保持快速全局速率。我们进一步将我们的构造扩展到通过Bregman散度的任意几何,以及复合优化问题。
VIALS:生命科学中人工制品视觉解读的基准 Elaine Lau 2026-08-21 PDF 在专业生命科学工作流程中,科学家们常规性地解读视觉产物(凝胶印迹、显微镜图像、质粒图谱、流式细胞术图、分子结构等),以指导研究决策。我们引入VIALS,一个视觉问答基准,包含161项此类解读任务,涵盖生物技术行业实验工作流程中检查的各种产物类型(而非出版物和教科书中的精美图表)。尽管前沿视觉语言模型现在能流畅描述自然图像,我们发现它们无法准确解读这些科学图像,反映出领域知识和特定领域视觉推理能力的局限。相比之下,具备相关领域专业知识的科学家认为这些视觉解读任务直截了当。无法类似地解读此类图像的人工智能,在专业生命科学工作流程中的实用性将受限,因为在这些流程中,此类产物是科学家推理、沟通和决策的核心。
从应用到芯片,权威级AI Jason Hickey 2026-08-21 PDF 六十年来,机器验证一直是主要的成本开销,仅对特殊工件而言才负担得起。在此我们报告,生成式AI逆转了这一关系:在AI速度下,机器验证不仅经济,而且对生产力至关重要——它是不可腐蚀的裁判,使一个人能安全地大规模指挥自主机器工作。在五周内,一位使用消费级AI订阅的研究者指挥一小队AI代理,从应用代码,经过验证的编译器和执行器,到在社区硅穿梭上流片的RISC-V处理器;没有证明经过人工审查,也没有RTL由人类编写。工作纪律——Salt方法——依赖于一个无法通过任何幻觉证明的证明内核:数学主张作为内核检查的工件在代理间传递,人类注意力保留给陈述、设计和裁决。验证逐环节陈述,从Lean 4内核到硅边界的SAT检查等价性。我们发布完整账目:定理来源、预注册的令牌计量器、下限约束的人工时间,以及错误分类账,其捕获编号运行至#256——一个在数学战役的仅追加标志账本上维护的单调计数器,时间从2026-07-07至2026-07-20(一个编号,#79,从未分配;后续捕获记录为无编号)——对照零个错误证明到达记录。
PerturbRx:学习治疗条件下的潜在转换以预测患者药物反应 Yoshitaka Inoue 2026-08-21 PDF 稀缺数据与肿瘤异质性限制了患者层面的癌症治疗反应预测。现有方法基于治疗前分子谱和药物表征预测反应,未显式建模治疗预期诱导的分子变化。我们提出PerturbRx,一种治疗条件化表示学习框架,学习干预诱导的潜在转移,并将其用作患者-药物反应特征。PerturbRx从上下文匹配但细胞未配对的对照和处理的单细胞群体中训练药物和剂量条件化转移预测器,然后冻结并将该预测器迁移至治疗前患者谱,无需治疗后测量。该转移与患者和药物表征结合以预测反应。在TCGA和患者来源异种移植基准上,PerturbRx在评估方法中实现了最强的综合预测性能。这些结果支持扰动预训练的潜在转移作为患者层面药物反应预测的有效表示。
顺序预测中的真实校准度量 Anagha Gokul 2026-08-21 PDF 校准要求概率报告在条件上无偏,并能可靠地解释为概率。校准度量将数值误差分配给未校准的报告。Haghtalab等人(2024)为在线预测提出了一种近似真实的校准度量,但未解决精确真实性与完备性和可靠性是否兼容的问题。我们针对序列二元预测给出了否定答案:即使对于独立结果,精确真实性也与完备性和可靠性不相容。随后,我们证明这种不可能性仅针对精确真实性。我们给出了两种从基础校准度量出发的一般性归约,分别产生加性和乘性近似真实的校准度量。应用乘性归约,对于每个$0 < \varepsilon < 1$,我们构造了一个完备且可靠的校准度量,该度量是$(1+\exp(-T^{(1-\varepsilon)/2}/2))$-乘性真实的。这改进了Haghtalab等人(2024)的近似真实性保证。
自优化流水线中的非对称容量分配 Zhuoyi Yang 2026-08-21 PDF 自我精炼,通常构建为生成、批判和修订三个阶段,是提升大语言模型生成质量的广泛采用范式,也是许多LLM智能体的核心机制。尽管这三个阶段涉及不同的认知需求,但大多数现有方法将模型大小视为实现细节而非研究对象,这可能导致资源浪费。很少有工作系统性地考察模型大小如何影响每个阶段,或有效的自我精炼是否要求生成、批判和修订阶段具备同等能力的模型。我们首次在5个不同领域的基准上,使用Qwen3的6种模型大小和Gemma 3的4种模型大小,对自我精炼流程进行了分阶段模型大小研究。我们得出结论:更大的生成器和修订器通常能提升流程性能,而尺寸不足的修订器甚至可能损害性能。其次,性能对批判器的大小极不敏感,尽管包含即使很小的批判器也始终优于完全省略批判环节。我们的发现表明,模型容量不应在自我精炼流程中均匀分配。相反,不同阶段展现出不同的规模缩放特性,为设计更计算高效的多阶段语言模型系统提供了实用指导。
TurboBias 2.0:面向生产高效ASR系统的流式上下文偏置 Vladimir Bataev 2026-08-21 PDF 上下文适配对于生产级自动语音识别(ASR)系统至关重要,在这些系统中,用户提供的短语必须在严格的延迟约束下被准确识别。尽管许多上下文偏置方法能提高识别准确性,但它们往往未能满足现代生产级ASR系统的实际需求:流式推理、高效的批量解码、用户特定的上下文列表以及低运行时开销。我们提出了TurboBias 2.0,一个面向生产的框架,用于在基于Transducer的ASR系统中实现高效的短语增强。该框架扩展了GPU加速的TurboBias,引入了不区分大小写的增强图以及每流批量解码,允许批次中的每个话语使用独立的上下文偏置配置。这使得多个同时用户能够实现个性化上下文偏置,而无需共享或混合他们的上下文列表。所提出的框架支持离线推理和流式推理,并可与贪婪解码和束搜索解码配合使用。实验表明,TurboBias 2.0在保持低延迟和高吞吐量的同时,提高了上下文短语的识别性能。
自然语言工作流尚非软件:面向可靠智能体执行的工件驱动编译 Xiangzhe Xu 2026-08-21 PDF 自然语言工作流为智能体提供了一种类似软件的接口:领域专家可以编写可复用的流程,智能体则能将其作为指令执行。然而,这一承诺尚不可靠。工作流描述往往隐含数据依赖关系,因此执行者必须推断某一步骤应使用哪些先前结果;智能体在上下文压力下也可能无法遵循长指令或分支指令。我们提出Artic,一种基于工件驱动的工作流编译器,它将自然语言工作流转化为工件驱动的工作流,其中每一步声明其读取和写入的工件,约束条件门控生成的工件,显式控制转移引导执行路径。这种表示暴露了智能体执行时承担的强制负担,使编译器能识别依赖过多状态或包含复杂控制逻辑的步骤,并通过约束优化对其进行细化。为验证LLM辅助转换,Artic将忠实性检查分解为局部义务,并使用基于场景的试运行来测试编译后的工作流区域是否与源工作流一致。我们在来自11个真实世界领域工作流的488个问题实例上评估Artic;它将任务解决率比原始文本工作流提高了28个百分点。我们还表明,Artic编译的工作流在跨模型和重复执行设置中分别提高了32和56个百分点的一致性。
跨设计不确定性在短期定价面板中的体现:来自模拟价格轨迹的证据 Pedro Cadahia Delgado 2026-08-21 PDF 短观测定价面板可能包含大量观测值,却仅提供少量不同的价格变动。本文在一个校准至稀疏定价机制的综合数据生成过程中研究这一区别的推断后果。我们将基于已实现价格轨迹的条件不确定性,与同一定价过程生成的不同轨迹间估计误差的变异分开。在基线模拟中,后者对梯度提升规格的估计误差方差贡献了97.6%。面板内重采样程序使用一条已实现轨迹的信息,无法识别这一跨设计成分。三个结果组织了分析。首先,跨设计离散度由经验关系sigma_hat约等于0.182 V^(-0.271)良好描述,其中V等于变动次数乘以幅度平方。其次,添加共享共同价格路径的区域减少了结果噪声,但不创建独立的价格轨迹;相反,对具有独立设计特定误差的单位进行平均,以标准平方根速率减少离散度。第三,在独立定价单位间估计的Paule-Mandel方差成分,在均匀模拟中显著提高了经验覆盖率,从0.469增至0.931。更广泛的含义是转向设计能创建独立识别变动的数据生成过程,而非仅依赖固定的被动面板。

bioRxiv

标题 作者 发布日期 PDF链接 摘要
时空调控的母源RNA降解因子对斑马鱼发育至关重要 Kushawah, G. 2026-08-24 PDF 母源mRNA降解对母源-合子转变(MZT)至关重要,但其对空间调控的影响在很大程度上尚未被探索。我们鉴定出Cth1是斑马鱼中首个在种系外以时空方式调控的母源编码RNA降解因子,这一调控由保守的3'UTR顺式元件驱动。通过RfxCas13d介导的母源cth1敲低揭示了早期发育缺陷,而这些缺陷在SpyCas9突变体中因配子发生受损导致的不育而无法评估。机制上,Cth1独立于合子基因组激活发挥作用,识别母源3'UTR中的AU富集基序,以时空方式促进去腺苷化和降解;删除这些基序或敲低Cth1可稳定报告基因和内源转录本。这些发现确立了Cth1作为母源程序的关键组成部分,并首次直接证明种系外的时空调控mRNA降解对早期脊椎动物发育有贡献。
冲突介导的群体规模调节:超优与次优群体规模理论 Schniter, E. 2026-08-24 PDF 观察到的群体规模很少与能使每个成员从归属中获得最大收益的规模相匹配。我们提出一个两部分理论,其中群体规模由两个相关冲突调节:内部人与外部人关于接纳的冲突,以及随着规模增大而加剧的拥挤、竞争和社会紧张导致的群体内部冲突。在可互换成员的群体中,有三种策略可用:接纳、排斥和分裂。模型保持每个成员的立场和资源开发策略不变。尽管这两者都变化并决定成员自身的博弈及其收益,但解释这种复杂性及其后果超出了我们的范围。理论的第一部分表明,即使排斥不可用,仅分裂动力学就能使群体规模偏离最优值,方向双向,模式由潜在加入者如何遇到群体以及分裂的几何形状决定。当加入者在共享景观中比较群体且分裂不对称时,立场分布呈双峰:超优大群体与小群体亚优模式共存,这是分裂-融合社会的特征模式。第二部分将排斥和分裂提升为主动决策:现有成员权衡接纳进入的人均成本({beta})与协调排斥成本(c +{gamma} N)和分裂成本(F)。一个单一不等式,{beta} > c +{gamma} N,将种群分为两个机制:在成立处,排斥可行,群体锁定在最优规模;在失败处,群体增长超过最优并经历反复分裂循环。> {varphi} 然后固定该分裂的几何形状,区分成员独立离开的分裂,这产生小女儿群体并给出双峰分布,与多名成员同时离开的分裂不同。模态群体规模、分裂频率和排斥行为共同识别哪个机制支配种群——这一系列预测适用于鱼类、社会昆虫、鸟类和哺乳动物,包括灵长类和人类觅食者。
自然产生的从头开放阅读框作为黑腹果蝇中潜在的锌螯合剂 Lee, U. 2026-08-24 PDF 从头基因起源研究中的一个核心未解难题是,驱动这些进化上年轻的从头蛋白编码基因出现的分子机制和功能仍知之甚少。金属螯合,一种简单、可直接选择且既不需要特定相互作用伙伴又兼容内在无序性的活性,是可能的功能之一。这一可能性通过分析7,849个转录支持且仍在分离中的黑腹果蝇从头开放阅读框的序列特征进行了检验。有趣的是,这些新开放阅读框(neORFs)在金属配位兼容的间距H-x-H和H-x-x-x-H处富集双组氨酸基序,而在与重复掩蔽的基因间ORF相比不兼容的偶数间距处无富集。值得注意的是,这些neORFs还被发现缺乏典型金属结合蛋白的C-x-x-C语法。我报告称,这种H-x-H双组氨酸信号在黑腹果蝇中由(CA)微卫星翻译成His-Thr-His产生,证据是H-x-H基序内的CAC密码子偏好和中心位置苏氨酸的四倍富集。我提出,反复的微卫星扩增为果蝇提供了一类分布广泛、独立起源的候选金属结合从头肽。随后,我追踪了一个neORF(ZMEG),从保守的祖先非编码序列到转录的黑腹果蝇谱系开放阅读框,其(CA)9衍生的组氨酸串呈现候选的His32-His36双组氨酸位点。我提出,这类从头蛋白可能构成一类分子,它们并非由共同祖先统一,而是共享于可进化重复序列的起源,突显了分子进化中涌现偏倚的重要性。
澳大利亚野生蜥蜴种群中的社交距离与真菌疾病 Requena-Garcia, F. 2026-08-24 PDF 群居生活通常能带来显著的适应性收益;然而,个体间的近距离空间关联也可能增加病原体传播的机会,尤其是在种群密度较高的情况下。尽管如此,野生爬行动物在面对真菌疾病时是否表现出回避行为,仍不清楚。我们研究了澳大利亚布里斯班罗马街公园的东部水龙(Intellagama lesueurii),该种群受到新兴真菌病原体Nannizziopsis barbatae(Nb)的影响。利用2018至2023年间涵盖146个个体的五年数据集,我们量化了社会距离(即到最近邻居的最小距离),并将其与每个个体季节性核心家域内重叠的病态同种个体数量相关联。社会距离与病态同种个体数量呈负相关,表明存在强烈的拥挤效应;然而,这种关联在病态个体中较弱,即使在病态同种个体数量较高时,病态个体也被观察到比健康个体保持更大的距离。综合来看,这些模式表明一种与疾病状态和局部疾病背景相关的依赖情境的间距响应,提示感染风险限制了密度驱动的接近行为。我们的发现为疾病压力如何塑造爬行动物的社会间距提供了新见解,并有助于更广泛地理解对新兴传染性真菌疾病的行为反应。
编织DNA的几何结构决定超螺旋分配 Hong, Y. 2026-08-24 PDF DNA的螺旋结构要求复制体在复制过程中相对于亲代DNA旋转,产生超螺旋,这些超螺旋分配在复制叉的前方和后方。DNA底物几何形状对超螺旋分配和扭转阻力的影响尚不清楚。在此,我们设计了端部分离距离与复制期间发现的情况相符的DNA编织底物,使用角光镊测量编织扭矩,并通过蒙特卡洛模拟解释结果。端部分离距离小的底物易于启动编织,表明复制叉在复制过程中会旋转,将超螺旋分配在复制体后方并降低扭转阻力。相反,一端具有显著分离距离的底物施加了明显的“扭转屏障”,阻碍编织启动,表明复制期间复制叉不旋转,因此超螺旋会分配在复制体前方。我们的发现揭示了一种物理机制,其中DNA叉几何形状可能调节复制体动力学,管理拓扑应力,并在体内调控复制进程。
空间免疫生态系统决定HER2低表达乳腺癌的治疗反应 Ogunlusi, O. 2026-08-24 PDF HER2低表达乳腺癌代表一种临床上重要但生物学异质性的疾病状态,其治疗反应背后的空间免疫程序仍知之甚少。在此,我们使用单细胞空间转录组学表征HER2低表达和HER2高表达乳腺肿瘤,并定义与治疗敏感性和耐药性相关的微环境特征。我们识别出多样的恶性、基质和免疫区室,其中树突状细胞在HER2低表达肿瘤中成为高度重塑的群体。聚焦分析解析出不同的树突状细胞状态,包括稳态cDC2、IFN激活的成熟cDC、经典功能性cDC2、浆细胞样DC以及ITGAX阳性单核细胞来源的DC群体。空间邻近性分析进一步揭示,耐药性HER2低表达肿瘤表现出肿瘤上皮细胞与效应免疫群体之间增加的分离,以及髓系富集免疫生态位的富集,这与免疫受限的空间结构一致。独立的TCGA BRCA验证确认了这些树突状细胞状态的临床相关性,其中升高的稳态cDC2特征预测较差生存,而炎症性树突状细胞特征与良好结局相关。耐药性HER2低表达肿瘤的特征是稳态和经典cDC的富集、IFN激活cDC和pDC的耗竭、肿瘤髓系T细胞通讯的改变,以及空间组织化耐药生态位的扩展,而敏感性肿瘤则保留免疫混合生态位,富集抗原呈递和效应免疫相互作用。总之,这些发现表明HER2低表达乳腺癌的治疗耐药性由树突状细胞状态和免疫结构的协调空间重塑驱动,将树突状细胞髓系生态位组织识别为潜在生物标志物和治疗脆弱点。
AFIDs-Validator:一个开放获取的AI引导式解剖标志点放置学习平台 Taha, A. 2026-08-24 PDF 解剖学标志的精准定位是解剖学和影像学中的基础技能,通常通过专家指导非正式传授,需要访问数据和桌面软件。目前缺乏一个开放访问、交互式的资源来教授神经解剖学并提供定量反馈。我们推出了AFIDs-Validator(validator.afids.io),一个开放获取、基于浏览器的平台,结合了引导式教学与定量评估。该平台包含:(1)学习模式,其中语言模型神经解剖学导师在MRI查看器内运行,提供以解剖学为先的教学,响应学习者当前的图像切片、方向和光标位置;(2)验证引擎,接受学习者的标志文件,并返回针对21个脑模板的专家注释参考的逐标志欧几里得误差。为使反馈可解释,我们分析了132名受试者的15,000个标志注释,发现标志难度变化达四倍(中位误差从前连合的0.37毫米到颞角的1.50毫米不等),且每个标志的分布呈重尾特征。这些分布被汇编成逐标志可靠性先验,因此学习者根据训练评分者的经验分布而非任意阈值进行评分,困难标志不会被误认为表现不佳。AFIDs-Validator无需安装、许可软件或本地数据,所有代码、参考数据和导师设计均开放发布。
新颖性与焦虑在快速眼动睡眠期间差异性塑造海马体神经集合的再激活与序列重放 Choi, J. 2026-08-24 PDF 哺乳动物的睡眠在快速眼动(REM)和非快速眼动(NREM)阶段之间交替,每个阶段具有不同的神经活动模式。NREM睡眠期间对清醒经历的再激活是记忆巩固的公认基础,但REM睡眠期间是否发生类似的再激活,由于该状态下的稀疏放电特征以及缺乏检测其中再激活的稳健方法,一直尚不明确。在此,我们结合钙成像与电生理学,监测小鼠海马CA1区的大规模神经元群体,并应用互补的分析方法来检验REM睡眠期间的神经再激活。我们发现,结构化的清醒活动在REM睡眠期间以多种时间组织形式被重新表达,从共激活细胞集合的再激活到时间有序的序列重放。这种再激活受到先前经历的行为情境的选择性塑造。新奇经历增强了序列重放并优化了集合组成,选择性减少了弱贡献神经元的参与;相反,焦虑性经历增加了集合再激活的频率,并强化了强贡献神经元的招募。因此,REM睡眠 emerges as 一个主动的记忆处理阶段,根据行为显著性重组近期经历,对新颖和情绪显著事件分别参与不同的操作。
美国昆虫学家中的公平感知、挑战及基于身份的差异 Barros Bustos, S. H. 2026-08-24 PDF 本研究旨在考察昆虫学家对该学科内公平、包容与排斥的看法,识别推进领域公平所面临的挑战及提出的解决方案。本研究于2023年对47位居住在美国的自我认同为昆虫学家的人士进行了调查。采用混合方法设计,通过定性和定量测量考察了昆虫学家对学科内包容与排斥的看法。受访者强调了对基于种族的资助机会的需求、通过地理多样化外展实现全面包容的努力,以及接触与未来昆虫学家具有相似身份的榜样和导师的机会。研究结果与2013年一项关于有色人种昆虫学家招募与保留的小型研究进行了对比讨论,该研究提供了初步的历史背景。2013年的受访者强调了基于内在和年龄的招募障碍(如缺乏兴趣、K-12外展有限),而2023年的发现则指向结构性不平等和保留需求(如系统性排斥)。鉴于两项研究在样本量和范围上的差异,2013年的对比被解释为探索性的。2023年的研究突显了对昆虫学中持续不平等认知的演变,并确定了构建更具包容性和代表性学科的机会。
适应性实验室进化重塑了恶臭假单胞菌,以实现资源高效的乙酸盐同化 Gurdo, N. 2026-08-24 PDF 醋酸盐是微生物生物技术中一种有吸引力的可再生二碳底物,但其毒性在工艺相关浓度下限制了生长和碳利用效率。在此,我们使用适应性实验室进化来提高基因组缩减的恶臭假单胞菌菌株的醋酸盐耐受性,并结合全基因组测序、反向工程、转录组学、蛋白质组学和13C-醋酸盐通量组学来解析潜在的适应机制。在递增醋酸盐浓度下的进化选择了gacA和fabB中的反复突变,这两个基因分别编码全局响应调节因子和脂肪酸生物合成酶。这些突变的反向工程恢复了大部分进化表型,包括更短的滞后期和显著更高的醋酸盐生物量产量。多组学分析显示,VI型分泌系统、碳水化合物储存功能、脂肪酸代谢和氧化应激相关蛋白的表达受到抑制,表明资源从昂贵的应激和非必需程序中重新分配。通量组学进一步揭示了EDEMP循环减少和乙醛酸支路通量增加,与醋酸盐碳在生物量中的保留改善一致。这些结果确立了恶臭假单胞菌中醋酸盐耐受性作为一种资源效率表型,并确定gacA和fabB为基于醋酸盐的生物生产的可行靶点。

medRxiv

标题 作者 发布日期 PDF链接 摘要
将人内、人传蚊及蚊内疟疾寄生虫动力学模型耦合,以识别疟疾传播的关键驱动因素 Sun, X. 2026-08-24 PDF 疟原虫从人类传播至蚊虫对其生命周期至关重要。然而,由于生物学参数量化不足及系统研究工具有限,人类至蚊虫的传播特性仍未得到充分描述。为填补这一知识空白,我们构建了一个数学模型,并拟合了多次蚊虫喂养实验的数据,以估算量化不足的生物学参数。基于这些定量结果,我们开发了一个人类至蚊虫传播的多尺度模型,旨在识别决定人类对蚊虫传染性的主要宿主因素。我们的主要发现是,对于无症状感染者,1)从暴露到出现传染性的时间主要由人体内控制无性期寄生虫增殖、性别转换和配子体成熟的参数决定;2)对于已建立感染的个体,其传染性主要受人类血液中雄性配子体的可用性、蚊虫吸血量以及蚊虫中肠内配子受精效率的影响。
在2026年前,对维多利亚州健康与医学研究、政策及教育中纳入性别与性别的基准评估:一项混合方法研究 Haupt, S. 2026-08-24 PDF 目的:调查并建立维多利亚州政策、研究和课程中性与性别考量的基线。设计与设置:选取维多利亚州作为澳大利亚的案例研究,采用混合方法考察2020-2025年间(在强制纳入之前)健康与医学大学课程、研究组织政策和研究资助情况。主要结局指标:主要结局包括识别大学课程描述和资助拨款描述中预设的性与性别相关术语;以及大学课程协调员和组织负责人的问卷回复。结果:对维多利亚州九所大学(318门课程/3383个单元)的数据挖掘发现,约93%的单元和约60%的医疗保健课程在描述中缺乏性与性别术语。在维多利亚州运营的医学研究组织中,包括最高机构、研究所、医院和大学,约70%(18/26)的调查回复者报告没有性与性别政策。维多利亚州(3388项)和全澳大利亚(8974项)研究拨款中性与性别术语的纳入率验证了维多利亚州作为澳大利亚案例研究的代表性,分别对应国家健康与医学研究委员会(9.5%/8.9%)、医学研究未来基金(11%/10.2%)和澳大利亚研究委员会(4.8%/4.1%)。来自五项政府倡议的维多利亚州奖项中九分之一,以及来自12个非政府机构的奖项中十分之一,在其指南中包含了性与性别相关术语。结论:这些基线指标表明,性与性别在教育及研究生态系统中仍未得到广泛考虑。这些发现支持在国家和州层面建立包容性研究政策,并在大学教育中制定认证标准的必要性。
Xpert MTB/RIF Ultra检测在HIV广泛流行地区成人疑似结核病患者粪便标本中的诊断性能 Aung, H. K. K. 2026-08-24 PDF 背景:使用Xpert MTB/RIF Ultra检测(Xpert-Ultra检测)从粪便标本中诊断结核病(TB),对于无法产生痰液的疑似TB患者确认诊断至关重要。我们评估了在HIV广泛流行的环境中,成年流动人口粪便标本中Xpert-Ultra检测的诊断性能。方法:在位于泰国-缅甸边境地区的Shoklo疟疾研究单位(SMRU)诊所和Mae Tao诊所(MTC)的门诊和住院部门开展了一项前瞻性横断面研究。2022年11月14日至2023年5月23日期间登记的、基于报告的症状和/或放射学发现符合纳入标准的任何年龄的疑似TB患者均有资格入选。以痰液液体MTB培养作为参考标准,评估粪便中Xpert-Ultra检测的诊断性能,并与痰液标本的涂片镜检和Xpert-Ultra检测性能进行比较。结果:共纳入113名参与者进行分析;其中9人(7.96%)感染人类免疫缺陷病毒(HIV),31人(27.43%)经培养结果确诊为TB。在这些培养确诊的TB病例中,粪便标本中Xpert-Ultra检测的敏感性为90.32%(95%置信区间[CI],74.25%至97.96%)。尽管粪便中Xpert-Ultra检测的敏感性绝对差异比痰液低3.23%(95% CI:-9.46%至3.00%),但两种样本类型之间无统计学显著差异。粪便标本中Xpert-Ultra检测的特异性为98.78%(95% CI,93.39%至99.97%),针对培养阴性TB病例,与痰液Xpert-Ultra检测相比,绝对差异为1.22%(95% CI,-1.16%至3.59%)。该方法显示,其诊断性能符合世界卫生组织(WHO)关于低复杂度检测用于检测结核分枝杆菌(MTB)的目标产品特征。结论:当呼吸道样本难以采集时,粪便标本中的Xpert-Ultra检测可被视为诊断成人疑似肺结核的潜在替代方法。
急性自发性颈动脉夹层患者血清纤维蛋白-1浓度短暂性降低的性别特异性变化:一项前瞻性多中心研究 Pelz, J. O. 2026-08-24 PDF 背景:自发性颈动脉夹层(sCeAD)是一种罕见的血管病变,其病理生理机制尚未完全阐明。血管细胞外基质完整性受损,包括弹性纤维,可能与其发生有关。我们研究了sCeAD患者与对照组在急性和慢性阶段血清中原纤维蛋白-1和可溶性弹性蛋白片段(sELF)是否存在差异。方法:在德国四个卒中中心前瞻性纳入急性sCeAD患者。在基线和6±1个月后采集血样。与sCeAD无关的首次急性缺血性卒中患者和健康个体作为对照组。使用酶联免疫吸附试验测量血清中原纤维蛋白-1和sELF浓度。结果:共纳入61例sCeAD患者、53例首次非CeAD缺血性卒中患者和79例健康对照者。在性别匹配后,急性sCeAD患者血清中原纤维蛋白-1浓度显著低于健康对照者(97 [60; 192] vs. 176 [113; 269] ng/mL;p=0.009)。sCeAD男性和女性患者中原纤维蛋白-1浓度也分别低于相应健康对照者。在sCeAD患者中,6个月后原纤维蛋白-1浓度较基线显著升高(171 [130; 270] vs. 104 [67; 205] ng/mL;p=0.021)。在所有研究组中,男性血清原纤维蛋白-1浓度高于女性。各组或各时间点间sELF浓度无显著差异。讨论:急性sCeAD期间血清原纤维蛋白-1浓度较低,随访期间显著升高,而sELF浓度保持不变。这些发现支持循环中原纤维蛋白-1与急性sCeAD之间的关联,并需进一步研究其在sCeAD病理生理中的作用。原纤维蛋白-1浓度中显著的性别相关差异强调了未来进行性别特异性分析的重要性。
爆发与出生后抗生素暴露驱动生命第一年鼻咽微生物群的发展轨迹 Rajar, P. 2026-08-24 PDF 早产儿早期抗生素暴露和长期住院可能扰乱微生物组发育,并导致不良健康结局。尽管鼻咽微生物组与呼吸道感染相关,但其早期发育研究不足,且通常采用16S rRNA测序评估,缺乏物种级分辨率。在此,我们对66名早产儿从出生至校正月龄6个月(约实际年龄7-10个月)期间收集的345份鼻咽抽吸物进行了全宏基因组测序,研究了鼻咽微生物群动态。鼻咽微生物群表现出高度个体化和年龄结构化模式,受出生后抗生素暴露和住院影响。出生后抗生素暴露对微生物多样性、组成、稳定性和成熟度有显著影响,部分效应持续至校正月龄6个月。新生儿重症监护病房(NICU)中一次意外的粘质沙雷菌暴发留下了持久印记,暴发后超过90%的婴儿在校正月龄6个月时仍观察到持续携带。粘质沙雷菌建立了一种稳定、自我强化的群落类型,仅在暴发后出现,机器学习模型能根据早期微生物组组成准确预测持续携带,即使在分析中排除粘质沙雷菌后也是如此。这些发现强调了理解出生后抗生素和NICU暴发如何塑造鼻咽微生物组轨迹的重要性,并可能对长期呼吸道健康产生影响。
卒中后男性和女性患者对tDCS的不同反应:来自NETS试验的见解 Wolf, S. 2026-08-24 PDF 背景 上肢功能障碍是卒中后最致残的后果之一,然而经颅直流电刺激(tDCS)作为运动康复中广泛研究的辅助手段,在大型随机试验中未显示出一致的获益。未解释的个体间变异可能是促成因素,而性别是其中一个合理来源,因为解剖和神经生理差异影响tDCS反应性。这项对多中心、随机、假刺激对照的NETS试验进行的探索性事后分析,检验了性别作为tDCS反应的调节因素。在主要分析(仅限于干预结束时的主要结局)基础上,所有评估时间点均建模至90天随访,并涵盖国际功能、残疾和健康分类(ICF)三个领域的结局。方法 NETS试验随机分配119例亚急性缺血性卒中患者接受阳极tDCS(1 mA)作用于病灶侧初级运动皮层或假刺激,同时接受标准化康复。采用具有自回归相关结构的纵向混合效应模型,检验治疗与性别交互作用,涉及上肢Fugl-Meyer评估(UEFMA;身体功能)、盒块测试(BBT;活动)和卒中影响量表参与领域(SIS;参与)。敏感性分析包括连续时间模型和性别-治疗-时间三向交互作用。分析在意向性治疗(ITT)和符合方案(PP)人群中进行。结果 在UEFMA和BBT中发现治疗与性别交互作用,但SIS参与领域未发现。接受主动刺激的女性参与者比接受假刺激者改善更多,估计边际均值差异具有临床相关性,分别为6.0分(UEFMA)和8.4分(BBT)。男性在两项测量中均未观察到相关治疗效果。结果在ITT和PP人群中一致。结论 这项探索性分析提供了初步证据,表明性别可能调节卒中后上肢康复中的tDCS反应,效应延伸至ICF损伤和活动领域。结合独立试验中的趋同信号,这些发现提示性别分层设计可能对于检测卒中康复中tDCS疗效是必要的。
使用英国生物银行数据评估慢性疲劳的计算分析方法 Pereira, I. 2026-08-24 PDF 慢性疲劳,以持续的身体和/或精神疲惫为特征,是医学中常见且令人衰弱的症状。尽管其影响重大,临床管理仍具挑战性。一个关键问题是缺乏任何生物标志物;因此,诊断完全依赖于患者的自我报告。这导致患者被污名化,并凸显了对客观诊断工具的需求。在本研究中,我们利用英国生物银行中超过2200名参与者的临床和功能性神经影像数据,探索了构建慢性疲劳计算检测方法的可行性。我们进行了全脑功能性和有效性连接分析,随后基于预注册分析计划以及训练数据和保留测试数据的严格分离,应用了机器学习。我们发现,临床数据,包括既往医疗诊断、癌症史、睡眠相关信息及饮酒情况,能够实现统计学上显著的慢性疲劳预测(平衡准确率61%,p=0.001)。将临床信息与脑连接数据结合,同样实现了统计学上显著的预测(平衡准确率最高达64%),但并未持续优于仅基于临床数据训练的模型。在所有模型中,睡眠相关信息,尤其是失眠症状,成为预测中特别重要的特征。我们的结果表明,慢性疲劳个体之间存在高度异质性。尽管本研究实现的预测性能尚不足以用于临床应用,但我们的发现为未来开发客观疲劳检测方法奠定了基础。特别是,我们的结果强调了睡眠相关信息的重要性,并为利用神经影像信息预测疲劳开辟了新途径。
肝脏CT分割中分布外检测的无标签阈值选择 Nielsen, M. 2026-08-24 PDF 自动化肝脏分割的可靠临床部署需要机制来检测罕见及未见场景中的失败。实现这一目标需要适当校准的阈值,将分布外(OOD)评分转换为失败预测。然而,阈值校准通常依赖专家标记的失败案例,在失败罕见时造成大量标注负担。基于我们先前的工作,该工作使用成对表面Dice相似系数(Pairwise Surface DSC)作为分割质量指标,我们提出了一种无标签框架来校准OOD评分阈值。首先,我们对来自400例内部扫描验证集的成对表面DSC分数拟合了log-t分布,以近似分布内评分分布。新分割根据其在该拟合分布下的极端程度被赋予显著性评分,并使用统计原理上的截断值0.25和0.05将其分为低、中、高风险审查组。拟合的log-t分布与观察到的评分高度吻合,并且对OOD案例的适度污染保持稳健。在包含500例内部和外部扫描的独立测试集上,中风险和高风险类别合并后实现了100%的敏感性和79%的特异性,而仅高风险类别实现了78%的敏感性和96%的特异性。这些结果表明,临床上有意义的失败检测可以从无标签数据中得出。我们的代码可在https://github.com/marshalln7/Label_Free_OOD_Threshold_Selection获取。
标准化延时成像数据库的构建及梯度提升集成框架用于整合受精卵形态动力学参数与传统胚胎评估 ZHAO, M. 2026-08-24 PDF 体外受精(IVF)实验室配备延时培养箱后,会产生大量连续的胚胎图像序列,然而缺乏标准化、带注释的数据库阻碍了可重复的计算工具在胚胎评估中的开发。本文描述了构建一个标准化延时成像数据库的过程,该数据库包含来自218个治疗周期的631个正常受精卵,整合了延时图像序列、患者临床记录和胚胎发育结局。我们进一步提出了一种梯度提升决策树(GBDT)集成框架,该框架将受精卵形态动力学参数——通过经验证的基于CNN的分割算法(美国专利US11210494B2)提取的连续时间序列特征——与传统胚胎评估等级(依据伊斯坦布尔共识的分类特征)相结合。融合框架采用等权重初始化,随后进行迭代残差递减训练,以最优方式整合异质特征类型。消融分析表明,集成模型实现了0.78的AUC,显著优于仅使用形态动力学(AUC 0.71)和仅使用传统方法(AUC 0.65)的模型,证实了两种数据模态的互补价值。该数据库和融合框架为胚胎发育评估提供了可重复的基础,并可推广至生殖医学中的其他多模态数据整合任务。
时间型差异是轮班护士情绪和认知紊乱的关键风险因素 Davies, A. 2026-08-24 PDF 以轮班制为核心的行业日益普遍,加之灵活工作的兴起,使得研究非自然工作与睡眠模式对健康的风险变得至关重要。医疗领域的轮班工作已与情绪失调、警觉性降低及认知影响相关联,其中轮班工作障碍(SWD)在DSM-5中被归类为昼夜节律睡眠-觉醒障碍。这些影响历来归因于与日程相关的睡眠紊乱;然而,某些个体似乎受影响更为严重。衡量个体对改变常规缺乏灵活性的一个指标是时型显著性,这是Caen时型问卷(CCQ)的一个幅度维度。在此,我们使用结构方程模型(SEM)来揭示睡眠和时型显著性如何调控一组英国国家医疗服务体系(NHS)轮班工作者(n=102)的神经精神症状特征。我们构建了一个测量模型,从睡眠障碍(PSQI)、时型显著性(CCQ)、情绪障碍(MDQ)、抑郁(PHQ8)和情绪反应性(ERS)问卷及认知评估中提取潜在构念。识别出构念间的相关性后,将其转化为两个SEM——分别针对日班和轮班制——以睡眠和显著性作为不良效应的预测因子。模型测试了直接效应、显著路径及整体拟合度。我们发现,虽然睡眠主导了日班工作者的疲劳相关症状,但时型显著性决定了轮班制工作者不良效应的严重程度,包括情绪障碍和认知损伤。我们推测,高时型显著性应被视为夜班和轮班工作相关不良效应的风险因素,干预措施应纳入针对时型的矫正策略。