11712 条条目 · 106 个活跃源
2026年7月27日
04:00
arXiv cs.LG

面向智能服务的漂移稳定量子联邦学习

针对异构数据与噪声量子优化导致的客户端漂移与不公平问题,提出DUQFL-Prox框架,利用深度展开优化与近端项提升稳定性、泛化性和公平性。

04:00
arXiv cs.LG

元强化学习的拟蒙特卡洛初始化

QMC初始化在相似任务上加速训练,正交初始化在异质任务上更优。

04:00
arXiv cs.LG

依赖差距的测量:诊断表格生成模型中的列间保真度

提出依赖感知诊断,发现标准指标遗漏列间依赖差距,源于缺乏直接监督,且廉价干预无效。

04:00
arXiv cs.LG

调整速度作为非平稳强化学习的安全约束

通过预测适应需求并主动干预,该框架在非平稳环境中显著减少安全违规。

04:00
arXiv cs.LG

云原生评估即服务:具有共形保证的可扩展AI监控的微服务架构

提出云原生微服务架构EaaS,实现共形预测、漂移检测等可扩展AI评估,验证了理论保证与低延迟性能。

04:00
arXiv cs.LG

面向目标无关的偏微分方程联合嵌入预测控制

基于JEPA的目标无关PDE控制框架,用动能探针规划优于潜L2规划,显著提升Navier-Stokes精度。

04:00
arXiv cs.LG

逻辑门网络的深度可扩展性

提出输入锚定逻辑门网络,解决优化崩溃与拓扑限制,实现超100层深度稳定提升。

04:00
arXiv cs.LG

多时域一致性作为几何:潜在动力学何时收缩,何时不收缩

提高多步一致性权重λ使被动视频潜在动态收缩(扩张降80%、误差减半),但仅限特定任务,领域受限。

04:00
arXiv cs.LG

Molt: 一个可扩展的原生PyTorch智能体强化学习训练框架

Molt是轻量级开源PyTorch框架,性能媲美Megatron,便于算法全链路修改。

04:00
arXiv cs.LG

神经特征治理:扩展神经原子普适性

NAP框架通过贝叶斯方法实现节点级稀疏化(节点减至8%),同时保持准确性、可解释性与不确定性量化。

04:00
arXiv cs.LG

基于精确线性代数的浅层ReLU网络表示

证明n≤10时最大值可用两层ReLU精确表示,更大n时深度上界为log5(n)+1.5694,d≤9的连续分段线性函数也有两层表示。

04:00
arXiv cs.LG

面向O-RAN SLA风险预测的物理约束联邦加性模型

Monotone FedNAM用单调样条约束KPI物理方向,消除违规,形状一致性达1.00,上行流量减65%。

04:00
arXiv cs.LG

自适应OOD检测的自毒化阈值理论与可认证无标签校准

证明自适应OOD检测存在自毒化阈值,提出可认证校准,并揭示无标签时漂移与污染不可区分。

04:00
arXiv cs.LG

面向桥梁诊断代理的隐形因果编码:使用QLoRA的三重引导检索增强微调

提出损坏原因编码器,结合知识三元组与检索增强,QLoRA微调实现87%准确率,内存降低72%。

04:00
arXiv cs.LG

CARNet:周期条件核心聚合与再分配框架

CARNet以线性复杂度集成全局周期信息,高效建模跨变量依赖,多元时间预测性能领先。

04:00
arXiv cs.LG

为二次模型辩护

二次模型能预测LLM长达10%训练窗口的优化动态,Hessian谱与稳定性分析揭示其结构。

04:00
arXiv cs.LG

学习关键信息:用因果证据集监督稀疏注意力路由

注意力不等于因果依赖,用因果证据集训练稀疏注意力路由无需标注即可达教师精度。

04:00
arXiv cs.LG

贝叶斯与频率学派基于机器学习的模拟推断导论

概述贝叶斯与频率学派框架,介绍机器学习SBI方法用于参数估计、经验贝叶斯应用及验证局限。

04:00
arXiv cs.LG

通过反事实正确性界定机器学习辅助决策的因果影响

提出部分识别方法,利用反事实正确性等单调性假设,从先前RCT数据界定新模型的因果效应。

04:00
arXiv cs.LG

基于压缩内容选择的无参数自适应稀疏注意力

用gzip压缩比实现无参数自适应稀疏注意力,性能超越密集与固定稀疏模式,收敛快3.3倍。

04:00
arXiv cs.LG

RED-PIM:使用存内计算减少Transformer的数据移动

RED-PIM将注意力数据移动从O(N²)降至O(N),矩阵缩至d×d,推理延迟降幅最高达99.99%,长文档性能提升99.60%。

04:00
arXiv cs.LG

智能预测后稳健优化

提出鲁棒预测后优化方法应对特征扰动,理论证明误差指数衰减与Fisher一致性,实验显著优于标准方法。

04:00
arXiv cs.LG

生理信号作为说话人脸深度伪造检测的法医模态

利用rPPG生理信号检测说话人脸深度伪造,AUC达0.806,检测难度因生成方法而异。

04:00
arXiv cs.LG

基于图的异构道路网络交通信号控制接口

提出基于图神经网络的交通信号控制接口,通过共享打分与确定性矩阵转换相位,PPO实验验证其异构网络可行性。

04:00
arXiv cs.LG

使用固定深度符号回归搜索前馈神经网络权重更新规则空间

符号回归发现权重更新规则,30个基准中25个优于标准优化器,MSE平均降低44.47%。

04:00
arXiv cs.LG

LeAct:从专家行动中学习推理

提出LeAct方法,从专家行动中恢复隐含推理链,显著提升模型推理性能。

04:00
arXiv cs.LG

数据偏心性、高斯RBF再生核希尔伯特空间渐近性与核PCA

高斯RBF核在大带宽下渐近等距于欧氏空间,其PCA收敛于线性PCA,数据偏心性ρ可预测收敛行为。

04:00
arXiv cs.LG

表格数据上经典机器学习的缩放规律:一项基准研究

大规模课堂验证幂律缩放规律,树模型占优,模型族内指数近似共享,但实现存在差异。

04:00
arXiv cs.LG

静态与时变网络上的方差缩减Q学习

提出VRDQ分布式Q学习算法,通过共识实现线性加速,通信成本极低。

04:00
arXiv cs.LG

通过自适应互补增强补救异质性下基于粗化的GNN训练

ACE方法通过重建特征和各向异性正则化,结合自适应加权,提升异质图训练性能。

04:00
arXiv cs.LG

从扰动校正到几何感知采样:面向长尾学习中均衡平坦极小值的锐度引导均衡采样

提出锐度引导均衡采样(SGS),动态调整采样概率优化损失景观平坦性,显著提升长尾学习尾部类精度,训练时间仅增2%。

04:00
arXiv cs.LG

MissHyper:缺失性引导超图预测中的临床同步性恢复

通过恢复共时间戳上下文与缺失性引导门控,提升临床不规则时间序列多步预测效果。

04:00
arXiv cs.LG

RIS-Kernel:一种通过稀疏注意力实现长上下文大语言模型推理的模型无关架构

RIS稀疏注意力引擎降低复杂度至O(N log N),无需GPU即可在长上下文任务中超越密集基线。

04:00
arXiv cs.LG

LatentFlow:分子图神经网络潜在空间可视分析

LatentFlow通过追踪聚类变化,帮助科学家理解分子GNN潜在空间演化与化学模式。

04:00
arXiv cs.LG

MA-DAR:面向持续时序知识图谱推理的流形对齐动态自适应路由

提出MA-DAR框架,通过流形对齐与动态自适应路由缓解表示冲突,提升持续TKG推理性能。

04:00
arXiv cs.LG

多智能体辩论与视觉信息提取助力SeePhys Pro:ICML 2026 AI4Math第三赛道挑战赛一等奖技术报告

提出视觉信息提取与多智能体辩论两阶段框架,弥合图文模态差距,将公共集准确率从0.643提升至0.802,荣获第一名。

04:00
arXiv cs.LG

关于随机低秩自适应的收敛性分析

LoRA收敛分析:确定性需O(ε⁻⁴)次梯度,随机LoRA-NSGDM需O(ε⁻⁸)次,LoRA-STORM改进至O(ε⁻⁶)次。

04:00
arXiv cs.LG

上下文赌博机的跨域离线策略评估与学习

针对现有方法在少样本、确定性日志策略及新动作等难题,提出跨域设置,利用多源数据显著提升评估与学习效果。

04:00
arXiv cs.LG

潜变量PDE映射:在有限数据下跨几何的高效物理信息学习

提出潜PDE映射,通过变形梯度实现稀疏几何训练下的物理信息学习,在心电PDE中误差降低4-6倍,计算成本低。

04:00
arXiv cs.LG

能量流形自然梯度下降:神经PDE求解器的黎曼优化

提出EMNGD框架,在黎曼流形上优化神经PDE求解器,约束可行切向方向与回缩,实现高精度快速收敛。

04:00
arXiv cs.LG

DCS:一种用于跨模态版权侵权的统一条件敏感性检测框架

提出DCS框架,通过反事实条件分布偏移和双分支条件敏感性检测跨模态版权侵权。

04:00
arXiv cs.LG

CEL:全面反事实解释库与基准

首个统一的反事实解释库与基准,覆盖18个数据集与14种方法,实现公平可重复的定量评估。

04:00
arXiv cs.LG

无泄漏堆叠集成多类分类方法

提出LFS-FRAME框架,融合KAN与XGBoost,通过严格隔离训练验证数据防止泄漏,多类分类准确率达89.85%和81.74%。

04:00
arXiv cs.LG

使用患者感知采样预训练电子健康记录基础模型

提出患者采样预训练方法,控制训练信号分布,在MIMIC-IV上提升AUROC和AUPRC。

04:00
arXiv cs.LG

TriGlue:一种受生物学启发的生成模型,用于生成分子胶诱导的三元复合物

提出受生物学启发的生成框架TriGlue,将分子胶设计解耦为界面估计与条件生成两阶段,生成有效三元复合物。

04:00
arXiv cs.LG

面向公平自监督学习的无偏开放世界正则化

提出UOWReg,通过条件分布匹配确保表示与目标属性统计独立,有效缓解偏差并防止子群体崩塌。

04:00
arXiv cs.LG

从分数逼近到分布逼近:基于分数的扩散模型

证明分数逼近误差可控制生成分布的KL散度,并给出显式上界,建立理论连接。

04:00
arXiv cs.LG

IFCLoRA: 拓扑感知的秩分配方法用于参数高效微调

IFCLoRA在微调前利用信息流中心性分配秩,在低预算下提升大模型微调性能,优于LoRA等方法。

04:00
arXiv cs.LG

异常检测中不平衡情况下的评估指标见解

研究AUROC等四种指标在不平衡异常检测中的行为,通过指标景观图提供直观解释与比较指导。

04:00
arXiv cs.LG

类别平衡Softmax:基于贝叶斯理论的长尾识别方法

提出CBS方法,基于贝叶斯框架和幂律假设,有效缓解长尾识别中的偏好问题,性能优于现有方法。