11502 条条目 · 106 个活跃源
2026年8月31日
04:00
arXiv cs.LG

峰间学习:幂律各向异性下核岭回归的尖锐渐近

研究各向异性高斯数据下核岭回归的渐近行为,揭示幂律各向异性如何重塑学习曲线,包括方差峰和偏差转变。

04:00
arXiv cs.LG

学习合成增强推断的规模-权重前沿

提出合成增强推断框架,用规模-权重前沿同时保证覆盖,并收窄置信区间。

04:00
arXiv cs.LG

Aero Hand Open:面向灵巧操作学习的仿真就绪腱驱动手

发布仿真就绪的腱驱动手,附仿真模型、驱动映射与强化学习包,策略仿真训练后可直接部署,无需微调及状态估计。

04:00
arXiv cs.LG

轨迹平衡:GFlowNets中改进的信用分配

提出轨迹平衡目标,改进长序列信用分配,确保精确采样并提升收敛、多样性与鲁棒性。

04:00
arXiv cs.LG

扩散模型作为即插即用先验

将扩散模型视为可微即插即用先验,经带噪去噪网络迭代推断高维数据,适用于条件生成与分割等任务。

04:00
arXiv cs.LG

关于加权Dikin游走d²混合的两个证明

加权Dikin游走混合:多面体采样得二次混合界,PSD锥为四次;新四阶条件将卡方散度界改进至二次。

04:00
arXiv cs.LG

改进的扩散采样器离策略训练

研究用扩散模型从非归一化密度采样,比较多种方法,提出基于局部搜索和重放缓冲区的探索策略,提升采样质量。

04:00
arXiv cs.LG

联合贝叶斯图结构与参数推断的单一生成流网络

提出用单一GFlowNet联合推断贝叶斯网络结构及参数,两阶段采样,能处理非线性模型,准确且优于现有方法。

04:00
arXiv cs.LG

预期进球模型的偏差干扰终结能力评估

预期进球模型有偏差,用AI公平性校准后发现梅西被低估17%,其终结能力比精英射手高27%。

04:00
arXiv cs.LG

大型推理模型从有缺陷的思考中学习更好的对齐

RECAP方法:通过反对齐预填充训练,使大型推理模型纠正错误推理,提升安全性与越狱鲁棒性,且不增加推理成本。

04:00
arXiv cs.LG

先移位再学习:在强化学习中实现低秩表示

提出先移位再学习的强化学习方法:证明移位后继度量具有低秩性,给出估计误差界,并用实验验证其有效性。

04:00
arXiv cs.LG

基于自组织映射与合成重放的类增量持续学习

基于自组织映射的生成式持续学习框架,统计内存合成重放,免样本存储,类增量性能优于无记忆法。

04:00
arXiv cs.LG

面向视觉、语言和控制的扩散模型中难解推断的摊销

提出相对轨迹平衡,实现扩散先验下任意后验的摊销采样,证明渐进正确,用于视觉、语言、控制及离线强化学习。

04:00
arXiv cs.LG

RegCL:面向多感官媒体视觉定位的紧凑持续SAM自适应

RegCL无回放,通过增量合并将多域分割知识整合进单一SAM适配器,五个数据集表现优异,适用多感官媒体。

04:00
arXiv cs.LG

注意力即条件作用:经典学习理论对线性Transformer的预测

线性注意状态更新等价于经典条件模型:纠错注意有线索竞争,连续注意没有;阻断闭式解,容量指数1.22/1.89。

04:00
arXiv cs.LG

LLM序列决策的元提示优化

提出对抗赌博机启发的元提示优化,自动优化任务描述与示例,应对非平稳奖励,显著提升大模型序列决策性能。

04:00
arXiv cs.LG

模型偏差校准的贝叶斯实验设计:Kullback--Leibler散度与Wasserstein距离之争

比较KL散度与Wasserstein距离作BED效用函数:无模型偏差时KL收敛更快,有偏差时Wasserstein更稳健。

04:00
arXiv cs.LG

噪声效用测量下博弈中基于抱负的扰动学习自动机:A部分——非零和博弈中的随机稳定性

提出基于抱负的扰动学习自动机,在噪声测量下分析多人正效用博弈的随机稳定性,并证明其可等效为有限维马尔可夫链。

04:00
arXiv cs.LG

ABC:基于连续时间与空间中非马尔可夫扩散桥的任意子集自回归

ABC模型:连续时空非马尔可夫扩散桥,从邻近状态生成,噪声随物理时间缩放,支持任意子集条件,视频与天气预测领先。

04:00
arXiv cs.LG

单纯形到欧几里得双射:用于共轭且校准的多分类高斯过程分类

利用艾奇逊几何将概率单纯形映射到无约束欧氏空间,提出共轭校准的高斯过程多分类模型,兼容稀疏回归,预测可靠。

04:00
arXiv cs.LG

InfoMamba:免注意力的Mamba-Transformer混合模型

提出免注意力混合模型,用瓶颈线性滤波作全局接口,信息最大化融合,性能优且近线性扩展。

04:00
arXiv cs.LG

一个模型通用于所有:跨异构数据集与范式的脑电情绪识别通用预训练

通用脑电预训练:单通道自监督+多变量微调(ART/GAT),跨数据集泛化强,多项基准SOTA。

04:00
arXiv cs.LG

SemEnrich:面向视觉语言学习的放射学报告自监督语义增强

提出自监督语义聚类增强法,为放射报告补充阳性/中性发现,提升多项指标,优于随机增强。

04:00
arXiv cs.LG

PolicyLong:迈向同策略上下文扩展

同策略动态数据构建:用当前模型迭代重筛数据,训练分布随能力演化,长上下文性能超越现有方法。

04:00
arXiv cs.LG

Var-JEPA:联合嵌入预测架构的变分形式——桥接预测式与生成式自监督学习

变分JEPA用单一ELBO显式建模潜变量生成,无需反坍塌正则,表格数据上超越T-JEPA。

04:00
arXiv cs.LG

预算约束下的因果赌博机:连接增量建模与序列决策

提出预算约束因果赌博机:边花预算边学用户响应,优于离线与在线基线;数据效率临界点7500样本。

2026年8月28日
04:00
arXiv cs.LG

FedCMAPSS:剩余使用寿命估计中联邦学习的基准测试集

提出FedCMAPSS基准,基于C-MAPSS数据集,设五个标准化任务模拟工业异质性,评估联邦优化算法,开源促进可复现的预测性维护研究。

04:00
arXiv cs.LG

NeuronFuzz:安全神经元引导的大语言模型安全评测模糊测试

利用安全神经元激活作为连续反馈,免生成响应即可高效发现越狱攻击,显著提升跨模型攻击成功率。

04:00
arXiv cs.LG

面向标记属性图学习的SLM条件化层次关系路由

提出小语言模型条件化层次关系路由,融入图消息选择,保留结构证据并支持可解释分析。

04:00
arXiv cs.LG

有限牛顿-舒尔茨Muon:非光滑非凸优化中的平滑优势

有限牛顿-舒尔茨迭代平滑极映射,使该优化器以对数深度收敛到非光滑非凸稳定点;精确极更新反而不收敛。

04:00
arXiv cs.LG

代数多重网格加速的高效标签传播

提出代数多重网格加速的标签传播框架,大幅降低计算开销,适用于大规模图像数据,少量标注即可获准确结果。

04:00
arXiv cs.LG

二值化神经网络的剪枝:专用框架与全局加权算法

提出二值化网络的专用框架与全局加权剪枝法,在VGG11上实现70%剪枝率且精度不变,优于现有41%。

04:00
arXiv cs.LG

超越能力基准:从生产事件元数据学习LLM云服务的运维指纹

提出OpEmbed,从支持工单元数据学习LLM云服务运维指纹,提升运维预测与跨模型故障迁移。

04:00
arXiv cs.LG

无悔隐私:差分隐私推理时对齐

校准噪声同时解决奖励黑客与隐私;两种算法实现零额外成本差分隐私对齐,优于原方法。

04:00
arXiv cs.LG

CG4AI:一种在约束条件下训练AI模型的列生成框架

提出CG4AI列生成框架,混合AI模型并施加线性约束,保证可行性并提升精度。

04:00
arXiv cs.LG

潜在诊断分类法:构建分类器并诊断其决策的框架,应用于提示注入检测

提出潜在诊断分类法框架,构建分类器并诊断决策;发现77%自信决策不稳健,区分两类失败模式。

04:00
arXiv cs.LG

公平图神经网络的子图过滤

提出SF-GNN框架,识别并过滤偏置边,抑制消息传递中的结构偏差,实现公平与精度的更好权衡。

04:00
arXiv cs.LG

NeoTriFuse:缺失异质性下可靠性感知的多模态融合用于新生儿死亡风险预测

提出可靠性感知多模态融合框架,将缺失数据作为可靠性信号动态调节模态贡献,提升新生儿死亡风险预测。

04:00
arXiv cs.LG

一个后缀破解所有:面向合并模型族的盆地感知越狱

模型合并即使子模型均安全对齐,也暴露预训练基座的越狱风险。BAJ优化生成可迁移后缀,高效绕过防御。

04:00
arXiv cs.LG

使用智能网络的分布式训练

提出让网络主动参与分布式训练,用组播与FPGA缓解带宽延迟,优化同步调度,缩小与本地训练的差距。

04:00
arXiv cs.LG

Diff Mining:对数几率差异揭示微调目标

通过比较微调模型与基础模型的对数几率差异,识别微调目标,仅需输出对数几率即可高效检测。

04:00
arXiv cs.LG

强化学习中的主动课程精炼

提出PATH框架,利用环境前置关系构成课程图,主动采样扩展路径并重分配训练至未掌握区域,提升鲁棒性与泛化。

04:00
arXiv cs.LG

迈向公平的低碳出行:面向扩展中共享单车系统的公平感知需求预测

提出公平感知图神经网络,预测扩展中共享单车需求,缓解冷启动和收入不平等,同时保持高精度。

04:00
arXiv cs.LG

共享演员无需共享评论家:并行强化学习中的价值不匹配效应

并行强化学习中共享评论家因价值不匹配损害学习,给评论家环境索引可显著提升性能。

04:00
arXiv cs.LG

用于曲线重建和点云数据分析的贝叶斯方法与马尔可夫链蒙特卡洛算法

提出全贝叶斯点云曲线重建框架,基于蒙特卡洛采样推断,量化不确定性,实验验证准确。

04:00
arXiv cs.LG

通信约束下公平且个性化的去中心化学习统一框架

提出统一框架DMFL-SQ,融合个性化、公平性与稀疏量化事件触发通信,保收敛、降通信、提公平。

04:00
arXiv cs.LG

到达并生存:利用单比特失败信号扩展安全目标条件策略学习

针对CRL忽略失败终止致高估,提出Safe-CRL用单比特失败信号纠正,提升安全目标策略的到达与生存。

04:00
arXiv cs.LG

多类学习的算法原理难以获得:正则化与适当学习的局限

多类学习不可归约为适当学习;适当学习需训练误差;正则化非通用,并刻画SRM可学性。

04:00
arXiv cs.LG

从初筛预测可定量性以优先排序剂量反应分析

研究表明,可从低成本的初筛结果预测后续剂量反应测试能否获得可用药效,据此优先安排检测,优化资源分配。

04:00
arXiv cs.LG

超立方体上随机tanh神经网络导数的高概率界

宽随机tanh网络混合导数高概率界:一阶导数界与深度无关,高阶导数至多按深度多项式增长。