11852 条条目 · 106 个活跃源
2026年7月13日
04:00
arXiv cs.LG

面向物联网系统中多元时间序列异常检测的联邦低秩Koopman学习

提出FedKAD联邦Koopman框架,低秩共识+Stiefel-ADMM,检测性能优,训练快2100倍、通信低80倍、延迟低79倍。

04:00
arXiv cs.LG

部分观测动作的随机线性赌博机

提出TOFU-POV算法解决部分观测随机线性赌博机,利用低维动作子空间实现√T遗憾。

04:00
arXiv cs.LG

基于成对比较的最优Top-k识别

提出渐近最优算法,用鞍点问题学习比较分配,实现自适应Top-k识别。

04:00
arXiv cs.LG

稀疏奖励游戏中的AlphaZero:局限性与辅助监督

AlphaZero在稀疏奖励游戏中难达完美;辅助损失(AZAL)显著提升一致性,Chomp上可达完美,Connect Four仅改善。

04:00
arXiv cs.LG

群不变谱嵌入

群不变谱嵌入通过将对称性融入核函数,提升收敛速率,恢复数据内在几何,优于标准方法。

04:00
arXiv cs.LG

Eluna:一种用于仓库操作自动化的智能体大语言模型系统,具备推理与任务执行能力

Eluna是图引导多智能体系统,通过渐进式披露和异步蒸馏实现仓库SOP可靠执行,达94%专家一致率。

04:00
arXiv cs.LG

FairSelect:多层次与交叉性算法公平性的系统评估

FairSelect系统评估多阶段公平性策略,发现干预效果非加性且依赖上下文,能改善子群公平性并保持模型性能。

04:00
arXiv cs.LG

NL-PAC: 规范歧义性与大语言模型中介监督中的可认证最小最大风险下界

NL-PAC框架量化LLM监督中规范歧义风险下界,通过阈值解码认证,但担保局限于特定条件。

04:00
arXiv cs.LG

EvoLP:用于实时边缘系统中模型压缩的自进化延迟预测器

EvoLP是一种自进化延迟预测器,可高精度预测边缘设备推理延迟,并指导模型压缩满足实时约束。

04:00
arXiv cs.LG

使用变分图自编码器的潮流可行性评估

提出VGAE检测潮流解可行性,在IEEE 118节点系统上评估AI求解器解的有效性。

04:00
arXiv cs.LG

面向LLM路由的考虑相关性的上下文赌博机与代理奖励

提出两种利用代理奖励的上下文赌博机算法,鲁棒处理噪声并提升样本效率,理论实验验证优势。

04:00
arXiv cs.LG

基于广义泊松流的变长生成式蛋白质设计

通过广义泊松流实现变长蛋白质生成,无需预设长度,提升设计可行性与分布拟合。

04:00
arXiv cs.LG

EXHOLD:滴滴大规模网约车匹配中的体验感知实时延迟控制

EXHOLD两阶段框架通过体验分级与延迟优化,显著提升滴滴巴西网约车匹配效率及司乘体验。

04:00
arXiv cs.LG

从更少中学习更多:基于后见之明的强化学习

通过后见重标记从失败轨迹学习,LfH在VLA后训练中样本效率提升5倍。

04:00
arXiv cs.LG

COBS: 累积量阶块稀疏注意力

COBS通过二阶累积量近似块注意力质量,在32k长上下文检索中填补86%性能差距,KV读取仅1.21倍基线。

04:00
arXiv cs.LG

大模型绿色发展综述:从资源高效架构到软硬件协同设计

综述大模型绿色发展,聚焦资源高效架构与软硬件协同设计,涵盖优化、训练、硬件及可持续应用。

04:00
arXiv cs.LG

多任务贝叶斯优化的陷阱与补救措施

多任务高斯过程错误估计跨任务相关性,根源为标准化偏差和样本率,三种补救措施仅在简单任务有效。

04:00
arXiv cs.LG

扩散模型中的量子电路:公平比较研究与角度嵌入失败的机制分析

量子电路在扩散模型中表现与经典相当,未显示参数优势;揭示角度嵌入因无界分数目标导致相位混叠的失败机制。

04:00
arXiv cs.LG

机器学习在桌面RPG游戏设计中怪物等级预测的应用

采用机器学习预测桌面RPG怪物等级,树集成模型达高精度,可辅助游戏平衡设计。

04:00
arXiv cs.LG

LionVote:针对Lion优化器的逐层学习率自适应

LionVote通过逐层诊断调整学习率尺度,在ViT任务上以69.7%准确率超越Lion和AdamW。

04:00
arXiv cs.LG

COAST:空间转录组学中基因表达预测的上下文感知差分学习

COAST利用上下文感知差分学习,联合绝对与相对表达回归,提升组织学基因表达预测的准确性和分布一致性。

04:00
arXiv cs.LG

存在但缩放:加法激活引导从聊天到智能体的迁移

加法激活引导迁移至智能体后,效果真实但缩放,拒绝绕过行为因模型而异,安全影响不可预测。

04:00
arXiv cs.LG

分布漂移下的时序知识图谱预测:一种合成评估

合成生成器评估七种TKG模型,分布漂移下鲁棒性依赖信号类型,结构变化挑战最大。

04:00
arXiv cs.LG

理解非凸优化中的无调度方法:速率保证与逃逸鞍点

本文证明无调度梯度下降和随机梯度下降在非凸优化中达到最优收敛率,并证明能逃逸鞍点。

04:00
arXiv cs.LG

窄遗忘,广保留:作为不对称泛化问题的机器遗忘

针对LLM遗忘中的欠/过遗忘问题,提出SUITE评估法与JensUn++算法,实现最佳遗忘与保留权衡。

04:00
arXiv cs.LG

基于InfoNCE损失的对比学习中相似性搜索的泛化

证明InfoNCE中k个负样本的泛化误差随k增大而稳定,与理想交叉熵差距为O(1/k)。

04:00
arXiv cs.LG

完全可训练的深度可微逻辑门网络与查找表网络

提出连接优化方法,用概率分布选择连接并学习门类型,显著减少门数且提升准确率。

04:00
arXiv cs.LG

Shortcut Trajectory Planning for Efficient Offline Reinforcement Learning

04:00
arXiv cs.LG

图神经网络实现可扩展与可迁移的节点中心性近似

GNN可扩展近似介数与接近中心性,混合分布训练提升跨图迁移,接近中心性对拓扑敏感,推理加速达97.7倍。

04:00
arXiv cs.LG

电动汽车的车载自适应电池功率预测

提出车载自适应方法,调整预训练模型以应对数据分布变化,使电池功率预测误差降低7.49%-14.88%。

04:00
arXiv cs.LG

学习基于几何的线弹性位移场物理信息代理模型

提出物理信息DeepONet,从边界条件与断裂几何预测位移场,无需有限元数据,通过局部惩罚弱施加无牵引边界条件,验证可行性。

04:00
arXiv cs.LG

自回归潜在扩散用于3D分子生成

KRONOS框架结合自回归与潜在扩散,实现无条件和片段条件3D分子生成,性能领先自回归方法,媲美扩散模型。

04:00
arXiv cs.LG

SYNRARE:用于机器学习基准测试的合成罕见病电子健康记录生成

SYNRARE基于Synthea的图形界面,快速生成合成罕见病EHR,助力ML算法基准测试。

04:00
arXiv cs.LG

Data-Efficient Deep Learning: Empirical Guidelines for Training Set Size Estimation in Inertial Sensor Classification

04:00
arXiv cs.LG

主动拒绝机制实现通用机器学习原子间势的可靠泛化

ATR通过主动拒绝不可靠结构,仅用0.2%真实标签生成289万高质量伪标签,显著提升泛化与动力学鲁棒性。

04:00
arXiv cs.LG

Clean2FX: 标签条件化的干净到效果吉他音频转换建模

Clean2FX用配对数据训练U-Net模型实现标签条件化电吉他效果转换,优于VAE,其中失真效果提升最明显。

04:00
arXiv cs.LG

动作因子化多智能体强化学习用于可扩展量子设备调优

提出QADAPT框架,通过动作因子化解耦干扰,实现零样本泛化至未见过尺寸量子设备,加速校准。

04:00
arXiv cs.LG

TSAI-MetaFraud:元宇宙生态系统中金融欺诈交易与行为风险检测的基准数据集

TSAI-MetaFraud是元宇宙虚拟经济多模态欺诈分析基准数据集,集成行为、交易与图信息,支持多任务检测。

04:00
arXiv cs.LG

深度神经网络中统计不可检测的后门

对抗训练者可植入统计不可检测后门,提供对抗样本,无后门则无法生成。

04:00
arXiv cs.LG

CoCoT-EEG: 基于对比预训练的多尺度卷积Transformer用于脑电解码

CoCoT用对比预训练和多尺度卷积Transformer,在EEG解码中超越重建预训练模型,且数据高效,从零训练即优于单任务模型。

04:00
arXiv cs.LG

基于变量投影的图正则化低秩矩阵补全

提出图正则化RTRMC方法,利用行列关系提升低秩矩阵补全的准确性和鲁棒性。

04:00
arXiv cs.LG

门控线性:用于时间序列预测的互补线性基自适应路由

GatedLinear通过三分量融合门自适应路由三种线性基,以小参数实现SOTA预测且可解释。

04:00
arXiv cs.LG

高维M估计中的影响诊断:精确渐近性

在高维凸M估计中,推导了去一影响的极限分布,并揭示大影响样本靠近决策边界。

04:00
arXiv cs.LG

高概率求解随机不动点方程

提出VR-GHAL方法,高概率求解随机不动点方程,在有限方差下达几何残差界,复杂度为ε^{-5}至ε^{-2}。

04:00
arXiv cs.LG

控制拉盖尔镶嵌:控制系统上的半离散最优传输

研究基于代理最优运动成本的最优传输,定义了控制拉盖尔镶嵌(CLT)并举例说明。

04:00
arXiv cs.LG

FlowDAgger:潜空间中生成式机器人策略的人机协同适应

提出FlowDAgger,通过动作反演将人类干预映射为潜噪声,微调轻量策略适应冻结生成式机器人策略,高效保留先验技能。

04:00
arXiv cs.LG

GenVid2Robot:利用刚体几何一致性从视频生成到机器人操作

通过刚体几何一致性验证,将生成视频运动转化为可执行机器人轨迹,提升操作可靠性。

04:00
arXiv cs.LG

基于信号时序逻辑的非线性系统参数合成学习方法

利用梯度优化与可达性验证,为不确定初始条件下的非线性系统合成鲁棒满足STL规范的参数并提供保证。

04:00
arXiv cs.LG

量子增强合成数据生成:基于量子电路玻恩机的不平衡表格学习方法

混合量子经典框架用量子电路玻恩机生成合成数据,缓解类别不平衡,F1提升5-15%,召回提升10-25%,优于经典方法。

04:00
arXiv cs.LG

订单流何时重要?加密货币期货中状态依赖的L2流动性状态转换

加密期货中,事前L2状态强预测事后流动性,订单流仅对ETH有稳健增益,提出状态优先设计原则。