11672 条条目 · 106 个活跃源
2026年8月3日
04:00
arXiv cs.LG

恰当损失的交换不可知学习的快速速率

针对恰当损失,提出交换不可知学习离线算法,获得最优快速率(log|H|/m)^{2/3},并归约为二阶多校准。

04:00
arXiv cs.LG

FairDiffuseVQVAE:通过向量量化潜变量的条件精化实现表格扩散中的采样时公平性

提出两阶段扩散模型矢量量化自编码加扩散精化推理时均匀采样保护属性实现公平公平指标最优AUC降15

04:00
arXiv cs.LG

高效大模型对抗训练:低秩防御与电路引导代理

提出两种加速策略:防御端用表征微调并解决令牌匹配问题,攻击端提取相关电路构建轻量代理模型,兼顾效率与理论保证。

04:00
arXiv cs.LG

超越特征与结构对齐:为图基础模型学习可迁移的传播知识

提出传播感知图基础模型,将边与特征维度的传播关系作为可迁移单元,经原型库学习跨域传播知识,实现自适应聚合,提升泛化。

04:00
arXiv cs.LG

学习用于神经网络验证的前瞻引理

提出基于前瞻的验证框架,生成不稳定ReLU引理并构建蕴含图剪枝,在Marabou和α-β-CROWN上性能提升,证明不可满足实例增34%。

04:00
arXiv cs.LG

基于动态交互场的SILVA网络:结构化隐层与向量吸引子

提出SILVA网络,在不动点架构中分离刺激、局部/全局交互、阻尼与读出;实验显示各作用因任务而异,便于训练诊断。

04:00
arXiv cs.LG

异构压缩客户端下的联邦基础模型微调

提出奇异值分解联邦微调,自包含客户端,嵌套流形与两阶段聚合,置信损失降噪,优于基线,内存减半。

04:00
arXiv cs.LG

动力学感知的稀疏噪声数据控制方程识别

针对稀疏噪声导数估计不可靠,用库普曼上采样预处理,提升微分方程辨识精度,优于非动力学方法。

04:00
arXiv cs.LG

DFSC:面向分数阶科学机器学习的误差可控可微分Mittag-Leffler传播

误差可控的可微分分数阶传播方法,用米塔格-莱弗勒谱层分离已知动力学与数据修正,自适应保证精度,支持多算子路径。

04:00
arXiv cs.LG

基于蒙特卡洛树搜索的多智能体系统自主修复

提出MARS框架,用蒙特卡洛树搜索自主修复多智能体系统,结合诊断引导和分类评估,性能提升且成本相当。

04:00
arXiv cs.LG

基于警方事故叙述对前沿大语言模型进行官方事故数据库编码基准测试

六款前沿LLM对照阿肯色致命事故数据库编码,结果不及多数类基线,关键词规则相当;属性差异大于模型差异。

04:00
arXiv cs.LG

谁在哪里获胜?面向局部优越性的共形模型比较

提出共形局部模型比较法:三分割校准局部胜者,仅当置信界排除平局时判定,有限样本保证,条件增益优于全局选择。

04:00
arXiv cs.LG

DASH-OPD:基于迟滞的差异感知切换用于同策略蒸馏

提出DASH-OPD,通过双向迟滞切换教师与学生执行器,依据多轮证据累积避免高频切换,在ALFWorld上超越基线且效率更高。

04:00
arXiv cs.LG

手术风险分层与结局预测中缺失了什么:端到端机器学习方法的范围综述

综述190项研究,发现ML预测手术风险存在数据单一、预处理报告不全、缺乏基准与可解释性等问题,需加强标准化。

04:00
arXiv cs.LG

PiDDM:物理信息可微退化建模用于锂离子电池健康状态预测

融合退化物理的神经网络模型,提升锂离子电池SOH预测精度与物理一致性,避免非物理再生。

04:00
arXiv cs.LG

SERUM:用户建模的状态提取与精炼

SERUM多阶段框架从屏幕视频提取状态模型,迭代精炼减幻觉,合并同义词,预测优于基线,人工认可。

04:00
arXiv cs.LG

课程设计至关重要:基于合成数据的高效关系PFN预训练

渐进式课程显著提升关系PFN预训练效率,单表课程即可媲美关系数据,数据量大幅减少。

04:00
arXiv cs.LG

StraightDP:面向修正流Transformer的几何感知差分隐私

提出修正流几何感知DP:小预算释放类条件矩,其余用于DP-SGD,在MNIST上ε=1达0.81准确率。

04:00
arXiv cs.LG

PluRel到RDB-PFN:模式引导的合成关系预训练

最佳课程方案以55倍更少任务恢复87.6%性能,证明外部合成数据配合课程设计有效,且早期真实模式更优。

04:00
arXiv cs.LG

HERO:面向长时程自回归神经算子的历史增强展开训练

提出历史增强展开训练(HERO),以历史相对监督增强绝对轨迹监督,提升长时程精度稳定性,无推理开销。

04:00
arXiv cs.LG

隐式机器学习力场加速分子动力学模拟

隐式机器学习力场以不动点方程复用跨时间步表示,兼具浅层算力与深层精度,加速两到五倍且不降分辨率。

04:00
arXiv cs.LG

MBDiff:多视图行为感知扩散模型用于概率性公用事业数据插补

提出多视图行为感知扩散模型,从多视角学习用户行为以指导概率性公用事业数据插补,性能优于最新方法。

04:00
arXiv cs.LG

样本高效的分层强化学习:通过最优策略识别

提出HBPI-UCRL算法并行学习高层与低层策略,证明在满足两个条件时样本复杂度为多项式,且稀疏奖励下优于非分层方法。

04:00
arXiv cs.LG

分析AI应用权限评论,揭示用户担忧

用AI生成评论训练模型,自动分类应用商店评论中的权限问题,准确率82%,发现用户按对应用的情感而非权限类型表达担忧。

04:00
arXiv cs.LG

基于大语言的流体系统仿真代码生成:模型与提示策略基准测试

比较十种大模型与六种提示策略生成流体系统仿真代码,语法尚可,仿真保真度差距大。

04:00
arXiv cs.LG

面向图域自适应的跨分辨率语义学习

提出跨分辨率语义学习(CReSL),通过多分辨率表示、原型传输与目标嫁接,解决图域自适应中的分辨率偏移,提升迁移效果。

04:00
arXiv cs.LG

探索HDFS日志数据中的块异常检测

提出流式HDFS日志块异常检测流程,结合并行计算、LLM-BiLSTM模型与Kafka管道,实现实时检测。

04:00
arXiv cs.LG

SAF-OPD:用于同策略蒸馏的稳定优势融合

提出SAF框架,用稀疏压缩和预热退火解决策略蒸馏与奖励信号融合的熵坍缩,稳定提升数学推理和代码生成。

04:00
arXiv cs.LG

统一少样本、零样本、持续与上下文学习,实现边缘端多功能设备自适应

提出ECL框架,统一少样本、零样本、持续与上下文学习,在边缘低功耗设备上取得SOTA性能,免除云端依赖。

04:00
arXiv cs.LG

节俭贝叶斯优化:数据和资源受限发现的可扩展代理模型

提出计算感知的贝叶斯优化基准,发现高斯过程开销高但无优势,可扩展替代更优,并给出代理模型推荐框架。

04:00
arXiv cs.LG

UniPolymer:面向聚酰亚胺设计的性质预测、结构推荐与评估统一框架

提出UniPolymer框架,预测聚酰亚胺Tg并评估生成结构,R²=0.93,合格率73.79%

04:00
arXiv cs.LG

评估图神经网络在分布式能源渗透率递增下的故障定位泛化能力

时空图网络在分布式能源渗透率变化下故障定位泛化更强,拓扑感知对高渗透率场景至关重要。

04:00
arXiv cs.LG

ALIVE:预算多源学习中的排除前警告

ALIVE提出审计控制层,在预算多源学习中用缓存证据与警告实现排除前预警,降低证据成本并提升精度。

04:00
arXiv cs.LG

TFGformer:基于时频图学习与协变量融合的多变量时间序列预测

提出CrossRAG检索增强预测框架,融合形状感知记忆、对比学习与交叉注意力,在七个基准上表现最佳。

04:00
arXiv cs.LG

转录管理的Transformer:单调多智能体坍缩与双弹出转录本的普适性

固定因果变换器:两个弹出转录本即普适;单弹出为确定性上下文无关语言,无弹出仅有限状态变换。

04:00
arXiv cs.LG

利用熵信息探索边界之外

提出熵信息探索法,通过边界外探索奖励,优于现有方法,应对稀疏延迟奖励。

04:00
arXiv cs.LG

端到端公平性优化与公平决策聚焦学习

提出端到端公平优化框架及公平决策聚焦学习,联合优化预测精度、预测公平和决策遗憾,推导梯度与泛化界。

04:00
arXiv cs.LG

MolGVR:基于化学约束的文本到分子生成框架

提出MolGVR生成-验证-精炼框架,利用化学约束校验并修正候选分子,提升文本到分子生成的精确匹配性能。

04:00
arXiv cs.LG

无参数重尾赌博机

解决重尾赌博机COLT开放问题:无需已知尾参数,算法达次线性遗憾;并刻画未知重尾的统计代价。

04:00
arXiv cs.LG

自适应FastOPD:面向高效同策略蒸馏的进度感知展开视界扩展策略

同策略蒸馏在线展开成本高。提出自适应FastOPD,仅在学习平台期且当前视界充分使用时扩展展开,性能最优且训练时间减少49.1%-71.2%。

04:00
arXiv cs.LG

DreamQAS:学习面向VQE高效的量子架构搜索的决策有用世界模型

DreamQAS以模型RL预测VQE反馈,减少真实VQE调用,多数分子任务误差最低,提升决策效用。

04:00
arXiv cs.LG

在线缓存:学习带误差校正的动态缓存策略以实现高效扩散推理

提出在线缓存动态框架,联合学习缓存时机与误差校正,自适应分配计算资源,近3倍加速且保质量,优于现有基线。

04:00
arXiv cs.LG

顿悟幻象:真正均衡缓解灾难性遗忘

高熵均衡模型缓解灾难性遗忘,表明完美泛化不等于鲁棒性。

04:00
arXiv cs.LG

一种用于可解释的阿尔茨海默病早期诊断的神经符号方法

提出神经符号方法,从语音音频提取阿尔茨海默病进展标志,构建贝叶斯网络推理,发现已知及新关系。

04:00
arXiv cs.LG

顶点插入会使金字塔宽度增加

给出六整数点反例:多面体添加顶点后旧顶点仍为顶点,但金字塔宽度增加,并附精确验证。

04:00
arXiv cs.LG

CENDRe:基于自然域表征的概念提取

提出CENDRe:通过聚类自动确定概念数量,在时域和频域定位概念,为CNN时间序列分类提供可解释证据。

04:00
arXiv cs.LG

TerraNova:人类世的基础模型

TerraNova融合地球物理与社会数据,原生几何训练,支持时间、海洋、不确定性,并快速适应新变量。

04:00
arXiv cs.LG

部分大于整体:面向多策略LLM高效训练的自动任务排序

自动多策略微调优于单策略,通过任务分组排序组织优化路径,用独立QLoRA解耦异质任务,TRACE最佳44.78。

04:00
arXiv cs.LG

以人为中心的可解释性-性能系数验证

提出EPC指标,平衡特征稀疏性与模型性能,经表格、文本、图像多模态验证,与人类解释高度一致。

04:00
arXiv cs.LG

交互式模仿学习何时有帮助?基于价值的模仿学习中的表征权衡

专家交互可放松表征需求,只需价值函数可实现性,无需精确策略;新算法OVI高效且优于离线与交互基线,并证明交互必要性。