| 从匿名实验中发现盲热力学本体 |
Linzhe Zhang |
2026-09-20 |
PDF |
在机器学习模型能够学习热力学状态方程之前,它必须发现其测量值代表什么:哪些通道随系统尺寸缩放,哪些是强度共轭量,各扇区如何通过接触配对,以及哪个势函数支配稳定性。当传感器仅暴露广延态与强度响应的未知线性混合时,被动观测无法将物理量从坐标伪影中分离出来。我们将这一隐藏热力学本体论的发现问题直接形式化为从匿名受控实验中学习的问题。我们提出了一种操作可辨识性理论以及一种构造性多项式时间算法,该算法从复制对比中提取广延与强度标度扇区,从热接触与互易性中恢复其对偶余切配对,通过离散循环凹性验证全局可容许的凹势函数,并确定储层系综的一个不变拟阵。我们证明残余观测等价性严格为 (x, lambda) ~ (A x, a A^{-T} lambda + beta),从而确立了任何被允许的实验都无法打破的尖锐观测极限。在范德瓦尔斯流体和居里-魏斯磁体上的盲评估证实了在病态混合条件下仍能稳健恢复,正确解析匿名的麦克斯韦联结线,同时拒绝非平衡延拓。来自 NIST WebBook 的六种真实流体的外部验证表明,操作本体论发现能够迁移到真实物理物质上,而不会发生坐标泄漏。 |
| ProxyBuild:文本引导的结构化三维建筑生成,基于网格锚定的程序化代理 |
Xiang Tang |
2026-09-20 |
PDF |
文本引导的3D建筑生成具有巨大的应用潜力,但现有的生成模型通常输出不可分离的单一网格或不可交互的渲染表示。虽然程序化建模可以生成具有层次结构的可编辑建筑,但规则编写费时费力,即使借助大语言模型,在几何约束下有效求解程序规则仍然具有挑战性。本文提出了ProxyBuild,一种用于结构化建筑生成的新型混合框架。我们引入了网格锚定程序化代理(MAPP)作为一种新型中间表示,它将建筑组件紧密锚定在几何壳上,从而将生成任务解耦为两个阶段:代理预测和代理到资产的实例化。首先,我们构建了一个带有MAPP标注的建筑数据集,用于训练我们设计的面-边二分图编码器。通过在异质网格图上显式建模拓扑元素的特征交互,该编码器能够准确推断面和边的语义角色。随后,以LLM解析的文本风格和属性参数为条件,我们通过将空间放置逻辑与硬约束相结合,实现了高精度的资产检索与装配。大量实验表明,ProxyBuild不仅显著缓解了建筑生成中的常见问题,如过度平滑、组件碰撞和结构损坏,还能准确解析来自不同来源的无语义壳。我们的方法在多项指标上优于先前基线,能够从文本稳健地生成结构清晰、细节丰富且可后期编辑的3D建筑,从而为虚拟现实和数字孪生等下游应用提供可靠且可交互的内容基础。 |
| 利用蒸馏学习和硬件协同设计在粒子物理探测器边缘发挥工业基础模型的作用 |
Gia Ancone |
2026-09-20 |
PDF |
未来粒子物理实验中的数据采集(DAQ)系统将从人工智能/机器学习发展的极端中受益:大规模基础模型可以增强特征提取算法的性能,而小规模探测器上的部署则可以实现实时智能数据处理。这项工作首次为粒子物理DAQ微调了一个工业基础模型。从Google Research的TimesFM(时间序列基础模型)的主干出发,我们展示了针对漂移室跟踪器和双读出量热计的实时回归任务的微调。此外,微调后的TimesFM模型被蒸馏到一个学生模型中,并与FPGA实现协同设计,以使这些模型能够在未来对撞机上实时运行。微调后的蒸馏模型达到或超过了此前针对每个任务发表的AI/ML解决方案的性能。此外,从TimesFM进行蒸馏和模型压缩的流程是通用的,可以轻松适应跨领域各种一维波形任务。 |
| 物理系统中基于测试时训练流匹配的贝叶斯滤波 |
Ruiqi Feng |
2026-09-20 |
PDF |
贝叶斯滤波为不确定性下的在线状态估计提供了一个有原则的框架,然而将其应用于具有高维状态和复杂后验分布的系统仍然具有挑战性。近期的生成模型,如流匹配,已在贝叶斯滤波中展现出潜力。然而,它们仍然依赖于后验的粒子表示,从而丢失了完整分布的丰富信息,或者处理与贝叶斯滤波递归结构相冲突的轨迹级逆问题。为解决这一问题,我们提出了一种新视角,即将演化分布直接编码到流匹配模型权重中,即信念流滤波器(BFF)。它是一种生成式滤波框架,在测试时通过梯度下降更新模型权重以跟踪后验演化。由此,BFF绕开了粒子表示的可扩展性问题,或传统滤波器中高斯假设的灵活性限制。我们从理论上证明了BFF的设计在结构上与贝叶斯滤波一致,并且其训练目标针对递归滤波算子。BFF在5个不同的物理系统中得到了实证验证,包括具有混沌动力学和高度稀疏、非线性观测的系统。结果表明,在三个标准一维和二维偏微分方程基准中,BFF在9个指标-基准单元中的8个取得了最佳分数,并且在极端单移动传感器设置以及一个基于真实世界的托卡马克等离子体估计任务上同样领先,展示了其在高维概率空间中精确逼近贝叶斯滤波算子的潜力。 |
| 发现物理表示语言 |
Linzhe Zhang |
2026-09-20 |
PDF |
在一台机器能够发现物理定律之前,它必须先发现自己的测量是什么:哪些观测存在于胞元上,哪些是内延量或外延量,哪些扇区是对偶的,哪些区分仅仅是规范。我们引入物理表示语言发现,即直接从匿名受控实验中恢复这一隐藏本体论的问题。我们给出可辨识性理论以及构造性多项式时间程序,用于恢复载体与微分序列、测量类型与取向扭转、不可逆细化语义、原始-对偶麦克斯韦图,以及任何允许实验都无法打破的剩余等价关系。该理论将物质性 nuisance 转化为交换子,利用细化将量与坐标分离,并且只有在其表示被恢复之后才选择物理。对于一个经认证的有限实验族,我们证明端到端两阶段测量界,以及在维度、精度和置信度上匹配的极小极大速率。盲麦克斯韦实验在联合损坏观测下,在规则和非结构化载体上恢复完整的原始/相对对偶本体论;一个独立的非结构化 RLC 系统表明该结果并非麦克斯韦特有。该框架可扩展到每个载体数万个胞元,而压力审计表明其在严酷物理情形下具有鲁棒性——包括非马尔可夫记忆、非线性、非局域性和复杂本构迟滞。一个公开 FDTD 审计表明,在不完整场数据中出现了匿名旋度结构,同时刻画了完整恢复的信息前提条件。目标是推动科学机器学习从在人类提供的语言中学习定律,转向发现使定律得以表达的语言,从而在观测可辨识性上建立精确的理论极限。 |
| LiteTex-GS:面向高斯泼溅的快速轻量级纹理化 |
Zhiwei Li |
2026-09-20 |
PDF |
高斯泼溅实现了实时新视角合成,但其紧密耦合的几何与外观表示通常需要大量基元来重现高频纹理细节,导致显著的内存和优化成本。近期的纹理化二维高斯方法通过将纹理贴图附加到高斯基元上来缓解这一限制。然而,弥合离散高斯与连续二维网格之间的根本结构鸿沟需要复杂的参数化,从而引入严重的计算开销。这种开销从根本上损害了高斯泼溅原有的效率,使得精细纹理化与计算敏捷性之间的平衡成为尚未解决的挑战。为应对这些挑战,我们提出LiteTex-GS,一种面向高斯泼溅的快速轻量纹理化框架。我们的方法初始化一种极其紧凑的表示,为每个高斯分配极小的局部纹理,并逐步仅向具有显著重建误差的基元分配更高分辨率。为保持精简的几何支架,我们引入一种贡献与面积感知的剪枝策略,剔除低效用高斯。此外,为缓解纹理上采样导致的梯度稀释,我们设计了一种分辨率感知的更新规则,以保持快速稳定的收敛。在标准新视角合成基准上的大量实验表明,与现有纹理化高斯基线相比,我们的方法在使用显著更少参数和更少训练时间的同时,实现了具有竞争力或更优的渲染质量。 |
| 泄漏积分器重构:抑制递归差分时间序列预测中的误差累积 |
Zijiang Yang |
2026-09-20 |
PDF |
我们提出泄漏积分器重构,一种无需训练的方法,可修复递归差分预测的误差累积。我们的第一个贡献是诊断性的:预测一步变化并通过累加求和进行积分,这是对非平稳性的标准补救方法,但它是一个在单位圆上具有极点的离散积分器,我们证明这会使非线性模型的递归展开发散,其336步误差达到表现良好预测器的数倍(归一化MAE为1.6-3.8,而后者约为0.8),在所有测试的神经架构中均如此。我们的第二个、核心贡献是修复方法:用泄漏积分器H(z) = 1/(1 - gamma z^-1),gamma < 1,将极点移至单位圆内,这可证明地限制了累积误差方差。在重构时以单一固定gamma=0.9应用(无需重新训练,对任何已部署的一步或基础模型预测器仅需两行更改),它在每个预测时域上都能缩小误差,在七个发散架构和二十个数据集上的平均增益从H=24时的约3%增长到H=96时的23%、H=192时的37%,以及H=336时的51%(在这些架构上为43-74%)(使用预言极点时为78%)。至关重要的是,它在不存在病态的地方可证明是惰性的(稳定或联合预测器已达到不可约速率),使其成为安全、通用的默认选择。 |
| 一对多,多对一:面向软件工程智能体的类别感知迭代专家训练 |
Jie Zhao |
2026-09-20 |
PDF |
仓库级软件工程(SWE)包含异构的任务类别,在池化智能体强化学习下,其进展可能不均衡:某些类别的提升与其他类别的回退同时出现,而聚合解决率掩盖了这些变化。受这种类别跷跷板现象的启发,我们开发了一个类别感知的专家训练与策略集成框架。可执行任务构建与 SWE Labeler——一个基于证据的多轴标注系统——组织训练池。初始的类别特定强化学习提升了平均训练成功率,但留下了不均衡的实例级进展,促使我们显式地整合成功行为并进行策略自适应任务选择。同源类别专家交替进行长时程 Agentic-miniRL 与刷新-修复-扩展(RRE):更新后的策略刷新实例掌握度,复用其自身已验证的成功轨迹进行修复 SFT,并重新选择任务以进行进一步强化学习。标签路由的多教师同策略蒸馏(MOPD)将各专家整合为一个可部署的学生模型,其中 ReLU 门控的奖励外推仅保留每个教师相对于参考的改进方向。专家训练与策略集成无需外部模型提供解轨迹或动作目标。我们通过聚合与逐类别解决率、相对于每个联合强化学习基线的最小类别提升以及专家增益恢复,评估了池化强化学习与平衡强化学习、专家开发以及单模型集成。最终的 MOPD 策略在 Pro-618 上达到 58.04% 的平均解决率,在 SWE-bench Multilingual 上达到 59.00%,分别较基础模型提升 5.39 和 2.78 个百分点。 |
| 如果你听到了,就帮忙找到它:面向开放词汇音视频事件定位的正交知识蒸馏 |
Yi Xu |
2026-09-20 |
PDF |
开放词汇音视频事件定位(OV-AVEL)根据视频、音频和语言,将文本查询的事件在时间上进行定位。该任务可用的监督来源在时间边界可靠性上可能存在差异:在 OV-AVEBench 上,我们配置的视觉教师模型比配置的音频教师模型提供更可靠的边界线索,尽管后者是一个强大的预训练音频模型,并且在语义上仍然具有信息量。这是一个特定设置下的诊断,而非对视觉和音频的普遍排序。我们将由此产生的挑战表述为监督放置问题:哪些教师信号可以塑造定位决策,哪些应保持辅助地位。基于这一观点,我们提出 OV-OrthKD,一个可靠性感知的非对称蒸馏框架。视觉特征迁移塑造与决策对齐的表示,音频特征迁移丰富互补的辅助子空间,文本原型锚定已见/未见类别语义,正交损失限制两个教师特定投影之间的方向重叠。学生在推理时通过查询感知融合继续使用两种模态,而默认训练配方使音频教师监督不进入片段 logit 路径。在 OV-AVEBench 上,OV-OrthKD 达到 0.816 的片段 AP,并将 F1@0.5 相比官方微调基线整体提升 2.7 个百分点,在未见类别上提升 3.4 个百分点。路径分配、角色互换、损坏和迁移分析一致支持监督放置作为 OV-AVEL 的任务特定设计轴。 |
| 医疗保健中强化学习的证据阶梯:从回顾性策略到可信干预 |
Yunfan Zhao |
2026-09-20 |
PDF |
强化学习(RL)为医疗决策提供了一种自然的语言,其后果随时间展开,然而大多数已报告的进展仍远未达到常规干预的程度。现有综述按算法或临床应用来组织该领域。我们则通过一条证据阶梯来审视医疗强化学习:问题形式化、回顾性识别、策略估计、压力测试、前瞻性评估和生命周期监测。这一视角连接了临床治疗、患者参与和卫生系统运营,同时揭示了一个反复出现的缺口:一个策略在历史数据集中得分高,并不等于有证据表明它能改善医疗。我们综合了每一层级上的假设和失效模式,明确了哪些证据可以跨场景迁移、哪些不能,并提出了用于累积评估的报告规范。 restless bandits 被作为一个特例纳入,而非作为组织框架。核心教训是:医疗强化学习应被评估为嵌入在不断变化的社会技术系统中的一种干预,而不仅仅是回顾性奖励的优化器。 |