11392 条条目 · 106 个活跃源
2026年9月16日
04:00
arXiv cs.LG

面向高维叶轮机械设计问题求解的动态聚合策略增强高效全局优化算法

提出DA-EGO,动态聚合分解并迭代更新子空间,高效求解高维黑箱问题,基准与叶轮机械设计验证有效。

04:00
arXiv cs.LG

因果神经集合滤波用于在线多目标跟踪

提出因果神经集合滤波:仅编码当前量测,递归航迹状态携带历史证据,精度提升、参数减半、推理加速。

04:00
arXiv cs.LG

OmniHarness:通过符号策略学习实现可泛化视觉生成

将执行抽象为符号策略,支持组合、验证与自主练习,提升可泛化视觉生成,创意任务解决率达95%。

04:00
arXiv cs.LG

HintMiner:基于语言模型与自监督学习从问答网页帖子中自动挖掘问题提示

HintMiner利用语言模型与自监督学习,从问答网页中自动挖掘问题提示,实验验证有效。

04:00
arXiv cs.LG

POSPAN:面向语言模型预训练的位置约束片段掩码

提出POSPAN框架,组合片段长度与位置约束分布实现多样化掩码,实验证明位置约束有效提升预训练。

04:00
arXiv cs.LG

有限域全不同系统的带符号 p 进残差编码:数独案例研究

提出带符号p进残差编码有限域全不同约束;全局极小对应冲突数,数独81系数案例无需独热。

04:00
arXiv cs.LG

无需训练:面向可执行人类活动识别的智能体启发式学习工作台

无需训练,用智能体启发式学习生成可执行HAR策略,11个数据集表现强劲,策略可检视、编辑与重放。

04:00
arXiv cs.LG

基于物理约束与决策条件自回归Transformer的信号交叉口驾驶行为估计

基于449次信号交叉口数据提出两阶段模型,先判停走,再以物理约束自回归Transformer生成轨迹

04:00
arXiv cs.LG

基于Transformer增强神经算子的叶轮机械叶栅全景气动性能预测方法

提出Transformer增强神经算子(TNO)全景气动预测框架,先预测N-S基本量再算叶栅性能;在Rotor 37上精度超FNO/DeepONet,下游成本降四个数量级。

04:00
arXiv cs.LG

基于环境实证验证的开放权重电商智能体评估

构建确定性可复现的电商环境,逐动作留存证据并细粒度评估开放权重智能体,揭示终端成功率所掩盖的多种能力缺陷。

04:00
arXiv cs.LG

超越分布匹配:弱语义先验下的语义一致表格扩散

提出语义一致表格扩散,将弱语义先验作为生成条件,兼顾分布保真与跨列规则一致,提升下游效用。

04:00
arXiv cs.LG

代理标签信用风险预测中监督漂移的决策支持审计协议

提出锁定多信号审计协议,含五层、阈值与决策规则;LendingClub上排序稳定、oracle差距小,主要漂移为基率与概率尺度失配,重校准可缓解。

04:00
arXiv cs.LG

面向小型协作组情感感知的伪标签增强

在四人协作数据上比较伪标签增强:可提升稀疏标签情感感知,人格相似度仅作同队筛选。

04:00
arXiv cs.LG

面向智能体反事实推理的基础模型蒸馏:混合 LLM+SLM 架构中的成本、延迟与治理

将TabPFN蒸馏为紧凑学生模型,参数压缩逾6000倍,准确率保留超95%,降低延迟与成本。

04:00
arXiv cs.LG

大语言模型化身造假大师:为制造业生成合成时间序列数据

用微调大语言模型与RAG生成制造业合成时间序列数据,效果优于ARIMA和LSTM,提升异常检测表现。

04:00
arXiv cs.LG

部分传感器重叠下的跨机床CNC迁移:模式自适应动作条件JEPA

部分传感器重叠下跨机床CNC迁移:模式自适应动作条件JEPA;源域预测精度不足以评估工业表示,跨机适应需独立评测。

04:00
arXiv cs.LG

基于迭代神经扩张的骨架原型

SPINE以Mapper图初始化嵌入式1-复形原型,按最近复形分类;17基准上排名最佳,多数显著优于竞争法。

04:00
arXiv cs.LG

LLM 推理,闪存中一瞬即达!

提出仅整数量化与稀疏字典KV缓存压缩,实现Flash存内LLM推理,精度略降而KV流量降15倍。

04:00
arXiv cs.LG

SWB-DM:面向部分参与下拜占庭鲁棒联邦学习的带延迟动量缓存的校准切片-Wasserstein重心聚合器

SWB-DM用切片Wasserstein重心、校准裁剪与延迟动量缓存,增强部分参与下的拜占庭鲁棒性。

04:00
arXiv cs.LG

基于稀疏自编码器的测试时遗忘

提出ARIA:用稀疏自编码器在推理时门控遗忘知识,不改权重,遗忘-保留权衡更优且抗攻击。

04:00
arXiv cs.LG

记录本身就是任务的一部分:跨维护、安全与召回报告的文本分类器匹配记录评估

记录选择影响文本分类评估;同案不同记录差异可大于模型差异,应按决策时信息评估并说明记录与标签来源。

04:00
arXiv cs.LG

稠密输出头与稀疏路由器中的 Z-Loss 反向几何

从反向传播视角解析Z-loss梯度,揭示相同前向值可产生不同参数更新,架构感知变体降低尾部且保持困惑度。

04:00
arXiv cs.LG

漂移场网络:从现场与卫星观测中学习海洋拉格朗日平流场

提出DFN,用卫星观测预测海表流场,模拟预训练加平流损失微调,7天漂流定位误差较业务模型降20公里。

04:00
arXiv cs.LG

高效推理蒸馏:通过合成思维链与难度感知微调构建小型视频语言模型

仅需约900样本与合成思维链,微调2B模型,两小时内超越四倍大模型;思维链后置可显著增强小模型推理。

04:00
arXiv cs.LG

固定状态递归中的联想召回解剖:匹配状态分解、干扰墙与突破它的课程

分解固定状态递归的联想召回:卷积主导,干扰而非容量是瓶颈,距离课程将召回从0.021提至1.000。

04:00
arXiv cs.LG

诱饵方向优化:针对大语言模型消融攻击的事后防御

DDO向MLP注入非线性诱饵信号,误导消融估计器,无需微调即把攻击成功率压至10%以下。

04:00
arXiv cs.LG

面向聚合洞察生成的差分隐私语义计划

提出DP-SPIN:记录映射为语义草图,发布加噪概念质量,后处理生成差分隐私聚合摘要并验证。

04:00
arXiv cs.LG

物理感知ACOPF代理学习的缩放定律

ACOPF代理缩放:MSE约束违反随规模增长约为AL两倍;AL训练时间增10倍,违反降近30倍,内存几乎不增。

04:00
arXiv cs.LG

我如何学会不再担忧并爱上 StopGrads:驻点性、收敛性与流映射学习案例研究

提出 StopGrad 回归原理,证明流映射目标唯一驻点为真实流映射并具收敛性,可将训练内存减半。

04:00
arXiv cs.LG

注意力平均场预测平均表征动态并揭示上下文特定计算

提出注意力平均场,通过平均注意力核迭代预测表征几何演化;偏离平均场可度量上下文特定计算。

04:00
arXiv cs.LG

基于自监督跨模态重建的机械多模态时间序列鲁棒故障检测

提出跨模态重建异常检测框架,通过模态互重建与自适应阈值应对分布偏移,增强故障检测鲁棒性。

04:00
arXiv cs.LG

用于基于仿真的滤波的生成模型:形式化与实证比较

统一生成滤波框架并比较三类新滤波器;均可刻画多模态后验,无单一最优,选择取决于在线预算与集合规模。

04:00
arXiv cs.LG

面向海冰类型预测的多标签比例学习

将海冰类型预测重构为弱监督多标签比例学习,提出MIL+MLPL框架和多模态融合,实验显著提升精度。

04:00
arXiv cs.LG

基于完全一阶梯度的联邦随机双层优化

提出仅用一阶梯度的联邦随机方差缩减双层优化算法,免二阶矩阵,恒定单时间尺度学习率,实验验证有效。

04:00
arXiv cs.LG

基于模型的强化学习实现液滴自主导航

基于模型的强化学习实现液滴自主导航,无需仿真,在部分可观测下穿越直角与弧形路径,策略可迁移。

04:00
arXiv cs.LG

基于后验事件传输的单轮联邦贝叶斯模型认证不确定性传播

提出后验事件传输认证框架,将本地后验事件经联邦平均聚合传播,为单轮联邦贝叶斯模型给出部署安全概率下界。

04:00
arXiv cs.LG

面向表格机器学习的智能体搜索空间

LLM智能体可为表格模型扩展超参搜索空间,45个数据集上平均提升0.6%,中小回归任务达2.0%,且不增加调优成本。

04:00
arXiv cs.LG

面向噪声标签不平衡学习的有界调整与可靠性引导嵌入

BARGE结合有界先验调整评分与可靠性引导嵌入,无需噪声率或转移矩阵,长尾含噪标签下均衡误差最低。

04:00
arXiv cs.LG

面向物理层密钥生成的信道信息引导神经网络

信道信息引导神经网络,从IQ测量生成物理层密钥;射线追踪增广提升密钥率并通过NIST测试。

04:00
arXiv cs.LG

面向联邦临床中心的自适应贝叶斯伙伴选择

提出ABPS联邦框架,按Shapley效用与UCB自适应选伙伴,可主动弃联,通信降九成而精度不降。

04:00
arXiv cs.LG

时间序列基础模型在人流计数预测中表现如何?一项跨数据集比较研究

跨两个数据集评测七种人流预测方法:历史数据有限时季节朴素法仍强,数据丰富且季节性强时基础模型占优。

04:00
arXiv cs.LG

论门控的重要性:状态空间模型中的记忆化与上下文学习

门控使状态空间模型偏向权重记忆而延迟或阻碍上下文学习,但常有利于长序列泛化,揭示其对训练与泛化的关键作用。

04:00
arXiv cs.LG

OPD-Aha:多模态同策略蒸馏中从语言惯性到视觉反思

利用教师视觉偏好重建蒸馏目标,促使学生反思纠错,提升多模态推理。

04:00
arXiv cs.LG

为社会模拟解释与引导LLM智能体

LLM社会模拟受黑箱制约;比较提示、SAE与探针引导,SAE和探针更能解释并调控智能体的偏好与能力。

04:00
arXiv cs.LG

解码器设计对心电图波形边界识别至关重要

提出R-U-Net,以ResNet-18编码器搭配U-Net解码器,心电图边界识别精度超越FCN基线,且解码器设计比半监督方法贡献更大。

04:00
arXiv cs.LG

面向隐半马尔可夫模型的高性能张量化维特比算法

提出HSMM维特比算法的张量形式,首次实现GPU加速,单核/多核/GPU分别提速14/200/570倍。

04:00
arXiv cs.LG

扭曲高斯过程变换的在线梯度计算

证明扭曲GP瞬时负对数似然梯度可精确递归计算,提出在线联合更新潜GP矩并优化扭曲参数的方法。

04:00
arXiv cs.LG

FlowATC:基于流匹配的航空器轨迹预测

提出FlowATC流匹配航迹预测,仅用ADS-B历史轨迹,无需航路标签;性能优于基线,可输出概率占用。

04:00
arXiv cs.LG

层重要性揭示了 Transformer 与状态空间模型的什么?

层重要性分必要性与可塑性;Transformer 中二者随深度反相关,状态空间模型则重叠,并导致不同遗忘。

04:00
arXiv cs.LG

通过精确分布式样条合并从碎片化观测中恢复物理参数

分布式样条精确合并,无需共享原始数据即等价集中拟合,重建场并求导反演物理参数,误差仅约0.1%。