| 以价值移植引导语言模型目标 |
Pengcheng Jiang |
2026-09-28 |
PDF |
推理模型常常表现得像是在追求目标,但它们的努力并不总是指向用户所意图的方向,有时会导致它们追求非预期的结果。先前的工作已经考察了模型如何通过一个“价值轴”在内部追踪其朝目标推进的进展。我们研究改变这一信号是否能够将模型的搜索重新定向到另一个目标。我们测试了价值移植:在每个 token 处,我们沿候选价值轴移动宿主模型的激活,移动量为供体与宿主在价值坐标上的差异(乘以一个较大的标量),旨在将宿主重定向到供体的目标。我们在被微调为诚实和作弊变体的 Qwen3-8B 和 GPT-OSS-20B 模型中研究了这一干预。我们测试了若干候选价值轴,包括一个自我评分轴,该轴由高与低诱发进展自我评分之前的激活构建而成。该干预在两个方向上均有效:诚实的供体减少了作弊宿主中的测试博弈,而作弊的供体增加了诚实宿主中的测试博弈,表明这一信号能够影响模型遵循哪种策略。在可解的编码任务上,来自诚实供体的移植还改善了作弊宿主的隐藏测试表现。价值移植也能跨模型家族生效,为这一干预在与模型控制相关的场景中提供了初步证据。 |
| PReCache:通过低秩预计算和中性重构实现多LoRA代理的高效KV缓存共享 |
Hyesung Jeon |
2026-09-28 |
PDF |
多LoRA智能体系统通过共享一个公共骨干模型来实现高效的角色专业化。然而,每个智能体都会重复处理不断增长的共享轨迹并构建自己的KV缓存,在长时程任务中引入了大量的内存和计算冗余。现有的KV缓存共享方法减少了这种重复预填充,但它们要么需要额外训练或架构约束,要么保留大量模型计算。此外,直接复用缓存会导致当前智能体依赖前一个智能体的适配器所生成的缓存状态,从而削弱其自身LoRA所编码的角色特定行为。我们提出PReCache,一种无需训练的KV缓存共享框架,包含两种设计,即PreLRShared和ReBaseShared,它们共享使用预训练权重计算的基础缓存,并预计算一个紧凑的智能体特定低秩(LR)缓存。为消除重复预填充,PreLRShared在首次处理共享上下文时为每个智能体预计算其LR缓存,使当前智能体能够使用自己的LR缓存,而无需重新处理前序智能体已处理的上下文。为提高共享准确性,ReBaseShared从无适配器的隐藏状态中重建共享基础缓存,减少由前一个智能体的适配表示所导致的残余误差。为最小化其重建成本,我们提出两种推理方案,分别针对单流推理和并发服务,在每轮智能体结束后执行重建或与其执行并行进行重建。在多个模型和智能体基准上,PreLRShared相比无KV缓存共享的推理实现了最高3.1倍的TTFT加速和2.3倍的每请求吞吐量提升。在所评估的缓存共享方法中,ReBaseShared总体上最好地保持了准确性,相对于无缓存共享的推理平均仅下降1.1个点。 |
| 具有反馈的因果发现的统计成本 |
Sunmin Oh |
2026-09-28 |
PDF |
是什么决定了学习循环因果结构不可避免的样本代价?对于循环线性非高斯模型,我们研究从观测数据中进行精确凝聚恢复:识别强连通分量(SCC)划分以及分量之间的所有边。我们为该目标建立了首个关于样本复杂度的信息论下界。对于 $p$ 个变量、最大 SCC 规模 $s_{\max}$ 以及最大外部父节点数 $d_B$,在正则模型类的最坏情况下,任何估计器都需要阶为 $s_{\max}\log(ep/s_{\max})+d_B\log(ep/d_B)$ 的样本。这些界区分了 SCC 成员资格与外部父节点选择的代价。在主可逆性且无相关忠实性条件下,我们建立了一个总体块外生性原则,通过残差独立性和包含最小性来识别未知根 SCC。稀疏调整刻画表明,小调整集足以识别 SCC 及其直接外部父节点,而无需对所有先前恢复的变量进行回归。这些刻画产生了 BlockExo,在适当条件下,无需知道 $s_{\max}$ 或 $d_B$ 即可达到结构匹配的样本界。模拟支持了我们样本界的结构依赖性,并展示了 BlockExo 在与其他循环因果发现方法比较中的样本高效恢复能力。 |
| 跳出框框思考:滑动窗口KV推理中的信息保留与传递 |
Timothy DeLise |
2026-09-28 |
PDF |
滑动窗口KV推理是指在处理序列时增量进行,同时仅保留固定大小的近期键和值状态缓存。它可以在推理时应用于预训练的因果Transformer,无需额外训练,并且随着处理更多token,其KV缓存内存保持固定。由于缓存状态是在先前token的上下文中计算的,它们可能携带来自当前窗口之外的信息,并将其传递给后续状态。本研究使用五个开放权重模型进行了一系列实验,涵盖Qwen、Llama、Mistral和Muse Glimmer。我们研究源自紧邻上下文窗口之外的信息能否通过滚动KV缓存持续存在,并保持对检索有用。初步结果表明,与从原始token重新计算最终固定窗口相比,保留先前计算的状态在所测试的模型中改善了检索。随后我们测量了这种效应的延伸范围,发现Muse Glimmer和Mistral 7B表现出最强的\emph{潜在信息传递}:即使在相关源token已离开缓存之后,它们仍能恢复信息。这两个模型在其已发布架构中都采用了滑动窗口注意力,这一关联促使我们测试使用滑动窗口训练是否能促进更可靠的信息保留。 |
| ARCH-B:架构表示、理解与层次基准 |
Kieran Sagar Parikh |
2026-09-28 |
PDF |
多模态模型日益能够解读视觉环境,但其在照片、平面图、立面图、剖面图和效果图之间识别同一建筑的能力仍缺乏充分表征。我们提出ARCH-B,一个包含11种跨表征原型、354道四选一题目的基准,基于一个包含390万张建筑图像的建筑关联语料库构建,采用视觉相似干扰项、模型引导的难度筛选和人工验证。我们评估了25个多模态模型,并收集了非专家人类参与者的5830份回答。模型准确率范围为10.45%至83.90%,而人类基线为35.35%。模型在混合表征异常检测和照片匹配上表现相对较好,但在平面图与照片对应上仍然较弱。人类和模型在各原型上的难度仅呈弱相关(Spearman's ρ=0.33)。留出评估证实,筛选过程中识别出的难度可泛化至策展模型之外。ARCH-B为跨建筑媒介的视觉对应和表征迁移提供了诊断性评估。 |
| StructSim:通过结构表示在大规模上度量思想相似性 |
Yaqing yang |
2026-09-28 |
PDF |
测量想法相似性是创造力评估的基础,尤其是当大语言模型能够以日益增长的规模生成想法时。然而,文本嵌入将想法压缩为单一向量,难以捕捉结构相似性,包括核心组件与支撑组件之间的部分重叠,以及不同抽象层次之间的差异。我们引入一种共享结构表示,将想法分解为目的、机制和实现组件,并在多层概念图中组织相关组件。基于这一表示,我们定义了成对相似性度量和集合级机制覆盖度度量,用于评估想法多样性。我们使用受控想法三元组和12位专家的评估来验证我们的方法,重点关注核心机制、实现和支撑组件的差异。与嵌入基线相比,我们的方法在结构相似性上与专家判断的一致性提高了31%,并且更好地反映了专家对想法集合覆盖度的评估,支持可扩展的想法相似性和多样性评估。 |
| Kafila:在可信的异构商用机器集合上服务大型语言模型 |
Murtaza Rangwala |
2026-09-28 |
PDF |
一个研究小组或朋友圈的成员合起来拥有若干台消费级计算机,没有一台大到足以运行一个有能力的大语言模型。现有系统在任何人皆可加入的开放集群中汇聚这类算力,而一个只接纳可信机器的群体无法使用这种方式。限定成员资格恰恰移除了它们所依赖的东西:集群将模型的每一部分放在若干对等节点上,并绕开慢的那个。一个有界会话必须用上它接纳的每一台设备。它的流水线以某个收到它无法快速处理的份额的设备的速度推进,因此划分必须在开始服务之前就正确。我们提出 Kafila,其协议从 NAT 之后组装出一个环,优先选择直连路径,在打洞失败处进行中继,而其规划器测量每台设备的内存带宽、容量与可达性,为固定的环顺序精确划分模型,并将持有嵌入与输出投影的头部与这一划分放在一起,而非事先确定。在三个设备群中能力各异的机器上,从共享局域网到横跨两大洲的五台设备,Kafila 相比 GPipe 中流水线并行的均等划分,将最慢流水线阶段缩短最多 $5.2\times$,相比 exo 中个人设备推理的按内存比例划分缩短最多 $3\times$,在那些划分下不足一半的设备仍在工作时,让 75% 到 87% 的已投入硬件保持工作,并服务一个任何均等划分都无法放置到该设备群上的模型。这对用户的价值取决于一个 token 中有多少是计算而非网络。在成员共享网络的情况下,同样的划分带来均等划分 $1.56\times$ 的吞吐量和按内存比例划分 $1.25\times$ 的吞吐量,而在四个并发用户下这一领先优势累积到 $3.2\times$ 而非衰减,每个用户几乎以单用户的速率获得服务。 |
| SCOPD:面向高效视觉语言模型的稀疏上下文同策略自蒸馏 |
Ahmadreza Jeddi |
2026-09-28 |
PDF |
推理型视觉语言模型(VLM)将图像和视频作为长序列的视觉 token 进行处理,导致推理成本高昂。免训练 token 剪枝可降低这一成本,但激进的压缩会急剧降低性能,这通常被归因于任务相关视觉信息的不可逆丢失。我们表明这一解释并不完整。在固定上下文的 Pass@K 分析中,对同一剪枝后视觉表示进行重复采样,能够恢复许多贪心解码所遗漏的样本,这表明有用的视觉证据可能仍然可获取,但被不可靠地使用。我们将此称为表示—利用差距。受此观察启发,我们提出 SCOPD,一种稀疏上下文同策略自蒸馏框架,其中学生模型从剪枝后的视觉 token 生成推理轨迹,而特权全上下文教师模型对相同的同策略前缀进行监督。SCOPD 不需要真实答案、架构改动或额外的推理时计算。我们进一步提出 SCOPD+,它使用小幅视觉预算干预来识别视觉敏感的响应位置,并选择性地对其进行蒸馏。在 10% 视觉 token 保留率下,Vanilla 模型在 13 个基准上保留了其未剪枝性能的 86.37%。SCOPD 将其提升至 90.49%,而 SCOPD+ 进一步将其提升至 92.43%。跨 token 预算、基准和剪枝算子,我们的结果表明,高效推理不仅取决于哪些视觉信息在剪枝后得以保留,还取决于模型学会使用这些信息的可靠程度。 |
| 非负矩阵分解的奇异性及其在贝叶斯推断中的应用 |
Naoki Hayashi |
2026-09-28 |
PDF |
非负矩阵分解(NMF)是一种奇异统计模型,其贝叶斯渐近性质由实对数典范阈值(RLCT)决定。我们研究分解映射的局部几何,并推导出NMF的RLCT的上界。设$H$为模型内维数,$H_0$为真实$M\times N$矩阵的非负秩。假设真实矩阵在参数域内部允许内维数为$H_0$的严格正分解,我们证明,对于光滑正先验,$λ\leq {(H-H_0)\min(M,N)+H_0(M+N-H_0)}/2$。当$H_0\geq3$时,该上界严格改进了先前的上界。证明使用了一个局部解析正规形式,将独立的线性坐标与剩余矩阵乘积分离。当$H=H_0$且也等于真实矩阵的普通秩时,我们得到精确值$λ=H_0(M+N-H_0)/2$。在奇异学习理论的标准假设下,这些结果给出了期望贝叶斯泛化误差和贝叶斯自由能的首项系数的上界。 |
| 受限强化学习中的视觉-语言信号:安全收益而无预期 |
Samuel Tetteh |
2026-09-28 |
PDF |
安全强化学习寻求在满足安全约束的同时最大化任务性能的策略。然而,在驾驶基准中,碰撞代价通常仅在碰撞发生时出现,无法对逼近的危险提供提前预警。冻结的视觉语言模型可以提供密集的语义反馈,但其评分是否能预判碰撞以及哪个组件驱动了所观察到的安全改进仍不清楚。回合制代价也可能偏向于任务进展甚微的策略。为弥补这些空白,我们提出 VLM-Safe-RL,一个通过奖励塑形和增强乘子更新将冻结 CLIP 信号集成到 PPO-Lagrangian 中的框架。在 MetaDrive Hard 上,该环境结合了最密集的交通与最大的地图,灾难率从 31.6\% 降至 19.4\%。FormulaOne-L2 分析未发现 CLIP 信号能预判碰撞的证据,并表明 VLM 项对拉格朗日乘子的影响可忽略不计。这些发现表明,所观察到的灾难率下降是有条件的,且没有碰撞预判的证据。 |