| DexCompose:利用单只灵巧手实现多任务操作的灵巧策略复用 |
Dihong Huang |
2026-06-26 |
PDF |
灵巧操作策略能够解决单一技能问题,但如何组合这些策略使单只机械手完成多项任务仍具挑战。在现有操作技能基础上添加新任务时,往往会对重叠手指和接触模式产生冲突性需求,导致维持原有操作结果与执行新任务之间出现破坏性干扰。我们提出DexCompose——一种角色感知的残差组合框架,通过显式的手指级动作所有权复用预训练的灵巧策略实现多任务操作。给定两个预训练的全手策略,DexCompose首先从第一项技能中收集成功的任务后状态,并在候选手指掩码上执行释放测试,以识别维持已建立技能状态所需的关键手指。随后训练两个非对称残差模块:用于任务维持的有界残差稳定器,以及仅在分配给新任务的动作子空间内适配冻结下游策略的上下文感知残差。我们在涵盖四项物体保持技能与四项下游交互的16个复合灵巧操作任务上评估该框架,DexCompose实现了77.4%的平均复合成功率,表明具有双残差的结构化动作所有权为超越传统策略链路的灵巧技能组合提供了可行方向。 |
| 感知准则:将多模态评估校准至人类感知 |
Yana Wei |
2026-06-26 |
PDF |
我们提出PerceptionRubrics,一种基于评分标准的评估框架,旨在解决基准测试分数饱和与真实世界脆弱性之间的鸿沟。通过将评估从整体语义匹配转向严格的原子化审计,PerceptionRubrics将1,038张信息密集的图像与超过12,000条实例级评分标准配对。这些标准源自通过新型循环同行评审共识流程构建的金标准描述,并提炼为双重流系统:必须正确(基本事实)与易错(细粒度细节)评分标准。关键之处在于,PerceptionRubrics实现了门控评分机制:与线性平均值不同,对强制性视觉事实的失败会触发尖锐的二元惩罚。广泛评估得出关键见解:(1)可靠性鸿沟:模型常能正确验证碎片化元素,但在严格合取约束下失败,暴露出密集领域的脆弱性;(2)开源-闭源分层:与推理趋势相反,我们揭示了开源与专有前沿之间持续存在的8%感知差距;(3)人类对齐的严谨性:我们的门控指标显著优于传统基准测试,验证了严格的感知保真度是可靠生成的前提条件。 |
| StructSplat:基于未标定稀疏视图的可泛化三维高斯泼溅 |
Jia-Chen Zhao |
2026-06-26 |
PDF |
我们提出StructSplat,一种前馈式且可泛化的3D高斯重建框架,可直接在未标定图像上运行,无需相机参数。现有方法要么依赖逐场景优化,要么假设已知相机位姿,且常将几何与外观纠缠在统一主干网络中,限制了重建保真度与泛化能力。我们的核心思想是采用结构化表征,在重建过程中为几何、语义和纹理线索分配明确角色。具体而言,我们引入像素对齐特征注入机制,实现从2D观测中精确建模纹理;融入语义感知先验提升全局一致性;设计相机对齐策略防止信息泄露并增强泛化性。实验表明,本方法在挑战性基准上显著超越先前方法。在DL3DV上,我们的PSNR达28.045,较AnySplat(22.377)提升+5.67 dB。跨数据集评估中,本方法在ACID上较AnySplat提升+1.94 dB,在RealEstate10K上提升+1.72 dB。项目页面:https://structsplat.github.io 代码:https://github.com/J-C-Zhao/StructSplat |
| 正类单标签学习中的意外发现 |
Shai Ben-David |
2026-06-26 |
PDF |
仅从正样本进行二分类是PAC学习的一种变体,其中学习器接收未知目标概念正区域中的独立同分布样本,但评估时使用原始分布(该分布在正负区域均有质量)。该模型可追溯至Natarajan [1987, STOC],非恰当学习的刻画已广为人知——甚至出现在教科书中。然而,恰当正样本学习的刻画长期悬而未决。本文重新审视并解决了这一问题:一个概念类仅从正样本可恰当学习当且仅当其具有有限VC维且满足新的组合条件——我们称之为一致外部可分性。结合若干分离结果,该刻画揭示了与标准PAC学习截然不同的惊人图景:恰当与非恰当学习存在分离,随机化与确定性恰当学习存在分离,存在无任何ERM可作为学习器的概念类,且有限VC维甚至不足以支持非一致学习。在此过程中,我们引入了新的组合维度,相信这些维度将在学习理论中具有更广泛的意义。 |
| 哪个纳什均衡?零和纳什多面体上依赖于求解器的选择 |
Luis Leal |
2026-06-26 |
PDF |
许多两人零和博弈并不存在唯一的纳什均衡,而是存在一个凸集:由所有共享极小化极大值V*但规定不同行为的策略构成的超多面体。标准求解器各自收敛到某个均衡,且被视为可互换。我们探究这些求解器是否实际上选择了纳什集的不同成员,且这种选择由算法而非随机种子系统性地决定。通过使用包含六个具有解析已知纳什集的表格化精确可解测试平台(包括二维纳什多面体和库恩扑克),我们发现:(i) 选择由算法而非随机种子决定,但不同算法族仅在非对称纳什集上存在差异;(ii) 正则化最后迭代方法(R-NaD、磁镜像下降)选择最大熵成员,即其均匀参考系在纳什集上的信息投影——在二维多面体上精确成立,在库恩扑克中达到最大熵的99.7%;而遗憾平均方法(CFR、CFR+、虚拟博弈)则漂移至低熵面;我们在随机生成的180个博弈集合中验证了这一点,其中R-NaD在100%收敛的博弈中达到最大熵成员,而CFR+在94%的博弈中严格低于该值(配对Wilcoxon检验p<10^-27);(iii) 所选成员对次优对手的下游影响随序贯/隐藏信息结构扩大但保持有界——在库恩扑克中最大熵成员是严格更优的对冲策略,而在矩阵博弈中成员间存在差异但无一方占优。我们还报告了两个纠正常见直觉的负面结果:移除CFR的正象限(max(R,0))投影不会消除边界漂移;R-NaD的选择是锚点跟随型而非初始化无关型。我们将最大熵/I-投影特征表述为一个得到强数据支持的猜想,并通过解析基准进行了全程验证。 |
| 非凸非Lipschitz优化中Bregman ADMM的二阶KKT保证 |
Shuang Li |
2026-06-26 |
PDF |
我们分析在双侧相对光滑性条件下的非凸线性约束问题的Bregman ADMM,该条件用相对于Bregman核的Hessian比较替代了标准Lipschitz梯度假设。这一设定涵盖了矩阵和张量模型中出现的多项式目标函数,这类问题可能不存在全局Lipschitz梯度常数。我们证明,在不变的开状态空间域上,Bregman ADMM的一次迭代定义了一个光滑的原对偶不动点映射,其严格鞍点KKT点是不稳定不动点;因此,从随机初始化出发,迭代以概率零收敛到严格鞍点。结合现有的一阶收敛结果,这保证了极限KKT点几乎必然达到二阶平稳性。我们将分析扩展到分布式优化的多块星形共识形式。技术新颖之处在于两块谱论证中结合Bregman特定对称化和缩放步骤的行列式约简,以及利用共识情形中星形图结构的零空间消去。分布式矩阵分解的数值实验验证了理论,对称张量分解示例展示了超越可分离共识设定的更广泛Bregman近端分裂思想。 |
| VGB掩码扩散模型:面向奖励满足与样本编辑的高效测试时缩放 |
Kijung Jeon |
2026-06-26 |
PDF |
推理时扩展是一种提升生成模型的有前景范式,尤其当输出必须满足结构约束或优化下游奖励时。我们考虑掩码扩散模型(MDM),并引入MDM-VGB,这是一种离散扩散采样器,通过理论上有依据的奖励引导重掩码来增强去掩码生成。受经典Jerrum-Sinclair回溯马尔可夫链在奖励倾斜生成中近期成功的启发,MDM-VGB将回溯随机游走从固定前缀树扩展到掩码状态图,允许令牌在任意位置进行去掩码和重掩码。由此产生的采样器倾向于选择能导向更高价值部分配置的去掩码和重掩码操作,从而同时实现高效的高奖励生成和低奖励样本的有效修复。我们证明MDM-VGB对过程验证器噪声具有鲁棒性,并实现二次复杂度,而流行的测试时启发式方法(如最佳N选一)由于误差累积可能产生指数复杂度。我们的理论发现得到了强大实证性能的佐证,特别是在数独和QM9等流行的约束满足与科学基准测试上。 |
| 民主式ICAI:通过辩论从偏好中推导出指导原则 |
Kevin Kingslin |
2026-06-26 |
PDF |
基于偏好的对齐方法往往难以捕捉人类判断背后的推理过程。许多评估依赖于多个相互作用的评判标准,但成对标签仅揭示最终选择,而非形成偏好的考量因素。逆向宪法AI通过将偏好总结为自然语言原则提升了决策的可解释性,但其单次解释无法涵盖复杂决策中的细微差异。我们提出民主化逆向宪法AI这一创新方法,通过结构化角色辩论收集多种竞争性理由,从而更广泛、更具表现力地呈现影响每次比较的因素。基于这些更丰富的信号,我们推导出更清晰、更全面的指导原则,并借助基于大语言模型和决策树的评判者来引导决策建模。在创意偏好基准MuCE-Pref和LiTBench的多个创意任务类别上的实验表明,民主化逆向宪法AI能产生更可靠的偏好结构。相较于审慎提示和基于原则的基线方法,它在跨任务的平均偏好预测上表现更优,同时生成的宪法更受大语言模型标注者的青睐。 |
| 使用可解释神经网络连接从头算对称性与全局核质量 |
Phong Dang |
2026-06-26 |
PDF |
从头计算建模已确立维格纳SU(4)和埃利奥特SU(3)为轻中质量核中核力的主导对称性。我们探究这些对称性是否也支配整个核素图的核结合能。研究目标并非高精度预测,而是通过可解释的对称性模型获取物理洞见。基于SU(3)和SU(4)卡西米尔算子,我们构建三种神经网络质量模型:用于点预测的特征信息神经网络、添加不确定性量化功能的高斯信息神经网络,以及以卡西米尔算子为算子基的维格纳信息神经网络质量公式。所有模型均基于AME2016训练,并在AME2020新增核素上验证。相较于液滴基线模型,仅使用SU(4)算子即可将训练集和测试集的均方根误差降低近一半,外推误差降低约五分之一——表明维格纳对称性携带超越体性质的预测信息。尽管结构紧凑,维格纳信息神经网络仍达到最低验证均方根误差0.430 MeV,与最先进质量模型相当——我们将其视为对称性基础捕获重要物理学的证据,而非单纯基准测试。维格纳信息神经网络进一步揭示:i)中子滴线附近二次SU(4)卡西米尔算子增强,标志维格纳对称性恢复;ii)超重核区四次算子出现意外增益。由此我们将涌现对称性从单个原子核的隐藏序提升为整个核素图的支配原理。 |
| PAC-贝叶斯二次闭环控制证书 |
Domagoj Herceg |
2026-06-26 |
PDF |
PAC-Bayesian界为数据依赖的随机预测器提供了有限样本保证,但将其应用于基于学习的控制较为困难,因为自然目标函数是二次型轨迹代价。此类损失函数无界、非Lipschitz连续,并导致依赖于响应的Chernoff项。我们采用系统级综合参数化方法,该方法直接暴露线性系统的闭环轨迹映射,使二次型控制损失适用于显式认证。此外,我们为可行闭环响应的后验分布提供了一组PAC-Bayes-Chernoff证书。对于具有任意协方差的高斯扰动轨迹,我们推导出精确的单侧高斯变换,以及通过闭环灵敏度量表示的易处理二次上界。我们还针对逐点闭环响应证书不可用或存在支撑集相关可容许性问题的情况,推导了后验局部化替代量。尽管PAC-Bayes认证的是非退化后验分布,但SLS损失的凸二次形式将证书传递至后验均值响应。我们提出一种确定性均值响应部署结果,该结果特别适用于控制场景,同时在界中保留随机后验分布。此外,我们为此部署提供了数据驱动界,从预言机界过渡而来。最小化该界自然产生从数据中选择控制器的学习算法。在双积分器上的数值实验表明,该算法作为灵敏度感知的有限样本正则化器,在低数据量情况下改善了留出代价并降低了闭环灵敏度。 |