11722 条条目 · 106 个活跃源
2026年7月27日
04:00
arXiv cs.LG

基于KL散度的轨迹正则化随机最优控制

提出轨迹正则化随机最优控制,将轨迹KL散度转化为二次漂移惩罚,保持动态规划结构,导出HJB方程,LQ有闭式解,参数平衡性能与参考。

04:00
arXiv cs.LG

剩余使用寿命与故障模式预测的通用价值函数

提出基于向量GVF与TD(n,λ)的预测方法,优于传统监督法,尤其适用于标签稀缺场景。

04:00
arXiv cs.LG

用于多主体时空数据分析的变分低秩张量分解

提出ST-VTD框架,融合LL1低秩空间与LSTM时间先验,经摊销变分推断与组ICA预热,有效提升多主体fMRI因子恢复。

04:00
arXiv cs.LG

Hopformer:面向时间序列预测的同质性追求Transformer

提出两阶段框架:SPA提取共同趋势,LoRA微调Transformer建模残差,理论保证且MASE平均提升6.56%。

04:00
arXiv cs.LG

利用异方差神经网络学习双向因果交互

提出SEM-DNN方法,通过条件协方差对角化识别双向因果,无需外部工具,有效恢复结构效应。

04:00
arXiv cs.LG

QC-PHAST搜索:有限池稀有区域发现的经典-量子查询基准

QC-PHAST是一种证据门控的查询核算协议,用于判断有限池中经典或量子搜索的适用性。

04:00
arXiv cs.LG

通用BCI个性化:面向冻结EEG骨干和基础模型的单一API

提出骨干无关的EEG个性化API,低成本适配多种冻结骨干,效果接近微调。

04:00
arXiv cs.LG

通过极分解的奇异值软阈值方法

通过极分解计算奇异值软阈值,GPU显著加速,但仅适合低精度应用。

04:00
arXiv cs.LG

PinEqualizer:Pinterest全漏斗内容探索与去偏系统

提出全漏斗内容探索去偏方案,减少现有内容偏好,提升新鲜内容探索与用户参与度。

04:00
arXiv cs.LG

异构不平衡临床数据上的联邦学习策略死亡预测基准比较

FedProx在AUC-ROC和AUC-PR上最优,但集中式模型仍略优;需关注客户端异质性。

04:00
arXiv cs.LG

基于需求学习与履约成本的在线定价与分配

提出OCSAA算法联合定价与库存,实现√T遗憾界,整合统计学习与运筹优化。

04:00
arXiv cs.LG

空间增强的时间融合变换器:面向时变输入参数动力系统的可解释多输出预测

提出SE-TFT扩展TFT实现多输出预测,可解释注意力权重揭示时空相关性。

04:00
arXiv cs.LG

把握时机:面向联邦学习关键学习期的基于合同的激励机制

提出R3T框架,针对联邦学习关键学习期设计合同激励,减轻信息不对称,提升云效用,训练速度提升2-3倍。

04:00
arXiv cs.LG

说话人相关的嗓音疲劳模型的元学习方法

将说话人自适应重构为元学习问题,三种方法均优于传统模型,Transformer性能最强。

04:00
arXiv cs.LG

基于图的相关系数矩阵生成:一种凸优化方法

提出凸优化框架生成图结构稀疏相关矩阵,可调控非对角均值,用于图形模型推断基准测试。

04:00
arXiv cs.LG

Reflector:面向样本作曲的编排感知和声检索

Reflector用间隔类预言机和学习嵌入实现编排感知和声检索,实时跟踪和声变化,三维空间揭示结构性关系,嵌入保留预言机判断并覆盖全库。

04:00
arXiv cs.LG

HD3C:面向边缘设备的高效医疗数据分类

HD3C轻量分类框架用于边缘设备,节能350倍且准确率损失<1%,鲁棒性强。

04:00
arXiv cs.LG

Eluder维度:局部化它!

提出广义线性模型eluder维下界,引入局部化方法获得一阶遗憾界,改进伯努利bandit与强化学习结果。

04:00
arXiv cs.LG

LiMuon:面向大模型的轻量快速Muon优化器

提出LiMuon优化器,基于动量方差减少和随机SVD,降低内存与样本复杂度,理论证明O(ε⁻³)收敛,实验验证有效。

04:00
arXiv cs.LG

安全的上下文强化学习

首次提出SCARED方法,在无参数更新下实现安全上下文强化学习,确保累计代价不超预算,并自适应安全预算。

04:00
arXiv cs.LG

利用模型曲率关联DP-SGD的跨迭代噪声

提出NoiseCurve,利用模型曲率优化跨迭代噪声关联,显著提升DP-SGD精度。

04:00
arXiv cs.LG

Transformer中的数值脆弱性:一种用于风险估计和选择性稳定的逐层理论

提出逐层分解输出失配,推导风险估计与BGSS控制器,实验验证有效控制低精度执行误差。

04:00
arXiv cs.LG

AdamNX:一种基于新型二阶矩估计指数衰减机制的Adam改进算法

提出AdamNX,使用时变二阶矩衰减率,使训练平台期更新趋近动量SGD,在图像分类、目标检测、语义分割上验证。

04:00
arXiv cs.LG

gp2Scale:一类紧支撑非平稳核函数与分布式计算,实现千万数据点上的精确高斯过程

提出gp2Scale,利用紧支撑非平稳核识别稀疏结构,实现千万数据点精确高斯过程,无需近似且可定制。

04:00
arXiv cs.LG

使用强化学习将天气和气候模型中的可调参数替换为状态依赖函数

用强化学习在线学习状态依赖参数化替代固定参数,在理想化测试中提升模型精度且物理合理。

2026年7月24日
04:00
arXiv cs.LG

多模态CoLRAG-TF:面向复杂PDF的三重过滤检索

提出四轴融合架构,通过三重过滤与贝叶斯优化,在复杂PDF上实现高效多跳推理,召回率达0.9909,答案相似度提升71.6%。

04:00
arXiv cs.LG

CLOE:基于Christoffel损失的异常检测自动编码器

CLOE结合自编码器与Christoffel函数,通过新损失函数引导表征学习,实现高效高维异常检测。

04:00
arXiv cs.LG

利用大语言模型扩展闭环特征通道配置

扩展采样后精度线性提升,参数效率显著优化,发现了非幂2通道及结构化分配规律。

04:00
arXiv cs.LG

循环Transformer中的自适应深度:诊断学习型暂停门与轨迹读出

研究发现,固定先验深度监督优于联合训练门控,后验置信读出更有效,失败源于轨迹形成而非门表达能力。

04:00
arXiv cs.LG

主动SAE特征平面是否携带更多Holonomy?Gemma中的预注册反转

主动特征平面Holonomy低于混合特征控制,调整后对数对比-0.294,预测被证伪。

04:00
arXiv cs.LG

生成式贝叶斯滤波用于状态估计

GBF框架用条件变分自编码器替代线性观测模型,通过贝叶斯更新与分数采样提升状态估计精度与鲁棒性。

04:00
arXiv cs.LG

PhantomFill:当表单要求答案时,语言模型会编造一个

表单必填字段导致模型普遍编造答案,多数无视“证据不足”选项,指令也被覆盖,仅前沿模型能正确拒绝。

04:00
arXiv cs.LG

多LLM系统中基于结构化专家判断的不确定性感知信任估计

提出Cooke加权信任估计,处理多LLM异质性与污染,实现聚合准确性与可靠性平衡。

04:00
arXiv cs.LG

DataPrep-Bench:大语言模型训练数据准备能力基准测试

首个统一评估LLM数据构建与质量评估的基准,新方法在多个领域显著领先。

04:00
arXiv cs.LG

Muon优化器“顿悟”的关键成分

Muon快速顿悟源于正交化(Newton-Schulz迭代),非谱范数;减少迭代可加速但降低稳定性。

04:00
arXiv cs.LG

Codec-Gauge:学习压缩友好的Transformer KV缓存度量

介绍后训练缓存坐标层Codec-Gauge,通过学习正交变换优化KV缓存压缩,平均降低44%的KL散度。

04:00
arXiv cs.LG

观点:停止被动修补模型,开启主动测试驱动AI开发

主张主动测试驱动AI开发,构建测试空间,数学证明其长期扩展更优、迭代更少。

04:00
arXiv cs.LG

当RLVR缩小推理边界:诊断Pass@k反转

RLVR提升单样本准确率但导致Pass@k反转,根源是丢失基础模型稀有正确轨迹,PBA方法可缓解。

04:00
arXiv cs.LG

ReliableTableQA:可靠性标注需要多少监督?

提出ReliableTableQA框架,表明仅需少量示例即可高效标注表格QA可靠性,GRPO仅在SFT不足时有益。

04:00
arXiv cs.LG

利用生物动力学知识先验实现数据稀缺的生物过程建模

数据稀缺下,将ODE知识以数据级预训练或架构级嵌入注入神经网络,两者性能相当且可替代,模拟预训练提供简单高效方案。

04:00
arXiv cs.LG

从原子到熵:凸域中扩散训练的最优噪声分配

发现扩散训练最优噪声调度集中于有限水平,解耦时采样密度正比于熵率平方根,显著提升效率。

04:00
arXiv cs.LG

通过决策感知机器学习改善基本药物获取

提出决策感知机器学习框架,在塞拉利昂全国部署,使基本药物消费增加19%,惠及约200万妇女儿童。

04:00
arXiv cs.LG

HypNO:双曲守恒律的图基物理信息神经算子

HypNO是图基神经算子,用物理信息消息传递处理激波,准确预测交通流模型解。

04:00
arXiv cs.LG

投资者观点落地:Black-Litterman模型中的神经谓词

神经谓词将金融数据映射为BL模型参数,以数据驱动替代主观不确定性,实现可解释与端到端学习。

04:00
arXiv cs.LG

一种面向零样本数字孪生的图神经网络方法

提出零样本数字孪生框架,结合热力学图神经网络与闭环数据同化,实现几何无关的实时物理模拟。

04:00
arXiv cs.LG

SenCos-GEM: SENet校准与余弦定律约束的几何增强分子表征用于性质预测

提出SenCos-GEM,融合余弦定律几何约束和SENet动态调制,在分子性质预测中实现SOTA,回归任务误差降低8%-13%。

04:00
arXiv cs.LG

自动编码器辅助下的地理空间与人口普查代理联合降尺度方法(JUGAAD)——以印度社会经济指标为例

JuGAAD框架融合人口普查与地理空间数据,经自编码器降维和回归映射,实现印度村级社会经济指标高精度预测。

04:00
arXiv cs.LG

SOAP、Muon及超越:推动大语言模型预训练规模扩展

改进了SOAP和Muon优化器,通过稳定化策略和分布式实现,在数十亿参数模型上超越AdamW,代码已开源。

04:00
arXiv cs.LG

SevDiff: 严重性条件扩散模型用于长尾冲突轨迹生成

SevDiff模型根据目标碰撞时间(TTC)生成轨迹,短TTC时命中率100%,长TTC时优雅退化,物理合理,精度高。

04:00
arXiv cs.LG

基于多智能体强化学习的退化监视下空中走廊冲突解决

基于DQN多智能体强化学习解决退化监视下空中走廊冲突,异构飞行器冲突1秒内解决,安全与容量权衡。