11522 条条目 · 106 个活跃源
2026年8月26日
04:00
arXiv cs.LG

findr:通过半结构化回归实现透明且公平的信用风险决策

提出findr半结构化回归,分离可解释线性部分与神经残差,并内嵌公平约束,兼顾预测精度、可解释性与公平性。

04:00
arXiv cs.LG

连续吉布斯采样的可证明量子-经典分离

证明连续吉布斯采样首个量子-经典分离:经典需Ω(α)查询,量子仅O(√α),优势为势垒幅度平方根。

04:00
arXiv cs.LG

当相似性由交互驱动:面向机制敏感学习的量子核

提出交互驱动量子核,编码高阶交互,在欺诈检测中优于经典核,价值在表征而非量子加速。

04:00
arXiv cs.LG

通过隐式随机递归稳定时序差分学习

提出隐式TD算法,将更新重构为不动点方程,对步长不敏感,稳定且收敛保证更广。

04:00
arXiv cs.LG

AdAdaGrad:面向自适应梯度方法的自适应批大小方案

提出AdAdaGrad自适应批大小策略,证明非凸优化收敛率O(1/K),提升训练效率与泛化性能。

04:00
arXiv cs.LG

对手感知的强化学习

提出威胁马尔可夫决策过程框架,理论并实验证明强化学习智能体需感知对手威胁。

04:00
arXiv cs.LG

量子最大熵推断与哈密顿量学习

将最大熵推断与学习算法扩展至量子领域,通过谱半径分析收敛率,引入拟牛顿法大幅加速,并用于哈密顿量学习。

04:00
arXiv cs.LG

QABBA:基于整数量化聚合的误差保证符号时间序列压缩

提出量化ABBA(QABBA),减少参数并支持整数运算,保持重构质量,建立误差界,可直接用于大语言模型,实现存储、精度与预测性能的权衡。

04:00
arXiv cs.LG

焦点校准损失:控制深度神经分类器中的后验失真

焦点校准损失在焦点损失上添加布里尔锚项,控制后验失真,虽非适当但分类校准,实验表现竞争性而非主导。

04:00
arXiv cs.LG

TLXML:基于影响函数的元学习任务级解释

TLXML将影响函数用于元学习量化训练任务影响复杂度降为线性可解释性强

04:00
arXiv cs.LG

具有弱正交约束的多项式增强神经网络(PANNs)用于增强函数与偏微分方程逼近

提出多项式增强神经网络,融合深度网络与多项式,用弱正交约束、剪枝及预处理,提升回归与偏微分方程精度。

04:00
arXiv cs.LG

输入凸神经网络$L_p$-Lipschitz常数与Zonotope上$L_p$-范数最大化的参数化复杂度

固定$p\in(1,\infty)\cap\mathbb{Q}$,Zonotope上$L_p$范数最大化关于维数$d$是W[1]-难的;两层ICNN的$L_p$-Lipschitz常数计算亦难。

04:00
arXiv cs.LG

FID 掩盖了什么:生成评估中偏差的检测、排序与诊断

提出ZID综合诊断,用六种统计量输出排序、p值和离散方向,检测FID漏掉的分布偏差,识别欠分散与过分散。

2026年8月25日
04:00
arXiv cs.LG

KAN-Robust-Bench:评估Kolmogorov-Arnold网络鲁棒性的基准

评估多种KAN网络在强逃避攻击下的认证与经验鲁棒性,确定最优防御策略和架构。

04:00
arXiv cs.LG

模型之模型:何时生成专家优于上下文关注、梯度适应或微调?

四机制跨六任务对比:生成专家在匹配质量下成本最低,但高维序列不敌上下文关注;专家权重可插值组合。

04:00
arXiv cs.LG

《星际争霸II》中用于AlphaStar AI控制的运行时动作干扰

提出运行时动作干扰,不改参数调节动作节奏并过滤毒性行为;实验表明能力披露显著改变公平感、信任和毒性感知。

04:00
arXiv cs.LG

基于加权集成学习的网球多模态损伤风险与表现预测

提出加权集成框架,融合可穿戴等多模态数据,预测网球运动员伤病风险与状态,实验效果良好。

04:00
arXiv cs.LG

用于多通道心音同步分类的心音段选择

提出心音段选择算法,多通道同步分类达96.5%准确率,优于单通道和异步方法。

04:00
arXiv cs.LG

AI验证的几何学:独立同分布N中选最优搜索的精确认证极限

人工智能验证几何区分复制与新干预;对独立同分布N选一搜索给出精确认证界限,尺度m²/N,提出双门审计规则。

04:00
arXiv cs.LG

供应链市场波动下的联邦集成预测

提出FEF NCL联邦集成预测法,用负相关学习在供应链市场波动下降低预测误差,合成数据验证优于联邦基线,仍需实际部署检验。

04:00
arXiv cs.LG

ChemDIRT:稳健化学大语言模型评估的多样化指令、表示与任务基准

提出ChemDIRT基准,通过改变指令和分子表示,评估化学大模型在八类任务上的准确性与一致性,检验其稳健性。

04:00
arXiv cs.LG

面向不平衡时间序列量化的类条件高斯混合建模

用Transformer和类条件高斯混合量化不平衡时间序列,经PShift训练,误差低于现有方法。

04:00
arXiv cs.LG

面向大规模PCI分配的同余分解方法与神经块求解器

提出同余分解与神经块求解器,将大规模PCI分配化为最小k划分问题,用图神经网络求解,优于现有方法

04:00
arXiv cs.LG

利用纵向实验室和生命体征轨迹预测早期功能衰退:基于All of Us研究项目的大规模研究

利用常规生物标志物轨迹预测老年功能衰退,模型优于静态指标,可在衰退前3-12个月预警,支持无负担EHR集成。

04:00
arXiv cs.LG

FrugalSOT——模型的节俭搜索

提出资源感知模型选择架构,按请求复杂度分级推理并动态调阈值,在树莓派5上降低开销且保持质量。

04:00
arXiv cs.LG

基于反例的排序

用反例查询学习未知线性序,最多k个虚假反例且k未知;最优复杂度Θ(n log n+nk)。

04:00
arXiv cs.LG

联邦持续学习:一种分布式漂移加罚控制问题

提出FedQCL,用李雅普诺夫漂移加罚控制虚拟队列,显式调节稳定性-塑性平衡,提升精度并显著减少遗忘。

04:00
arXiv cs.LG

Beyond Sparse Weights: When Is Attention Compressible?

04:00
arXiv cs.LG

触及尾部:数据稀缺下校准多样性驱动共形覆盖

数据稀缺下,校准多样性比罕见事件数更能解释共形覆盖方差,多样性选择器提升长期覆盖率,但多样性只是必要非充分条件。

04:00
arXiv cs.LG

读懂情境:循环世界模型状态中的隐式困惑编码

RSSM隐状态隐含困惑信号,正交于主方差,探针可测(AUROC0.72),编辑状态改变行为。

04:00
arXiv cs.LG

锚定偏差:持续学习下针对多模态大语言模型的持久公平性后门攻击

提出持久公平后门攻击,用潜在空间强化与持续学习模拟,使多模态大模型产生持久歧视,且经更新仍有效并规避防御。

04:00
arXiv cs.LG

用于稀疏数据分析的负值归零矩阵补全:潜在低秩结构的大规模学习

研究负元素置零从低秩矩阵恢复稀疏非负矩阵条件 提出可扩展随机交替最小二乘法 揭示果蝇连接组潜在低秩结构

04:00
arXiv cs.LG

学习轨迹上的损失参数化费希尔宽度

费希尔宽度沿学习轨迹演化。损失可作坐标。高斯教师逻辑斯蒂模型中梯度流选极值分支。支持分支式损失参数化。

04:00
arXiv cs.LG

重新思考通信度量:我们应如何衡量意义?

综述语义通信评价指标,按目标、模态等分类,指出缺乏通用标准与多模态KPI等挑战,提出未来方向。

04:00
arXiv cs.LG

混合专家大语言模型中可组合压缩技术的基准评测

提出MoEXBench,评测MoE可组合压缩(剪枝、量化、KV缓存),发现方法间复杂交互影响部署。

04:00
arXiv cs.LG

GeoQ:面向科学代理模型的几何感知条件分位数误差估计

提出GeoQ框架,利用几何感知条件分位数实现科学代理模型的非侵入式逐点误差估计并验证有效性。

04:00
arXiv cs.LG

ChequeMark:面向非工作时间企业存款欺诈检测的集成机器学习框架

提出集成框架ChequeMark,融合XGBoost、孤立森林与GraphSAGE,检测非工作时间支票存款欺诈,增强分布偏移鲁棒性,F1达83.77%,保持可解释性。

04:00
arXiv cs.LG

SynEHR:联合建模跨就诊时间演变与就诊内临床结构的纵向电子健康记录合成

SynEHR联合建模就诊间时间演变与就诊内结构,经LoRA适配语言模型生成临床连贯、时间真实的纵向EHR,优于现有模型。

04:00
arXiv cs.LG

智能电表数据缺失值高级插补方法的大规模评估

大规模电表数据插补评估:OWA最优,自编码器方差大,SoftImpute稳定但精度低。

04:00
arXiv cs.LG

有界精度几何缩放:损失尺度失配下的鲁棒多任务学习

提出有界精度几何缩放(BPGS),对损失尺度失配鲁棒,性能优于同方差不确定性加权,多任务基准上稳定。

04:00
arXiv cs.LG

稳定性边缘的变分结构

边缘耦合推广至动量法,临界点刻画不动点与二周期轨道,海森阵判稳,等同维莱特作用,连接稳定边缘与离散力学。

04:00
arXiv cs.LG

读取、写入、松弛:为何神经PDE代理模型需要全局与局部处理

神经PDE代理需全局与局部处理;新方法RWR交错两者,降低全谱误差,精度高、数据高效、可扩展。

04:00
arXiv cs.LG

TinyML系统的功耗与性能表征

系统评估单片机TinyML应用,分析抽象层开销并建模降耗,助力边缘设备神经网络搜索与CNN优化。

04:00
arXiv cs.LG

架构与训练如何影响TPC表示跨实验的复用

评估TPC数据表示跨实验与探测器复用性,发现架构是任务相关结构的主要来源,随机初始化PointNet表示已具高信息量。

04:00
arXiv cs.LG

MSM-Mem:面向医疗AI代理的通用医学结构化多模态记忆框架

提出医学结构化多模态记忆框架,将临床经验组织为语义、情景和视觉记忆,使医疗AI代理持续改进推理。

04:00
arXiv cs.LG

用于降维保真度的固定半径距离带基准

用固定半径距离带斯皮尔曼相关评估降维保真度,按绝对半径分带,能揭示排名指标忽略的簇内压缩和异常点问题。

04:00
arXiv cs.LG

更多专家,更差动态:混合专家状态空间模型中的逆缩放与谱偏差

混合专家状态空间模型在分机制预测中不如单专家,专家增多反降,完美路由无效;低误差源于平滑,破坏吸引子几何。

04:00
arXiv cs.LG

对良性事实的强化学习加剧了已记忆私有数据的泄露

对良性事实做RL会放大已记忆PII的提取,数据不含隐私也如此;模型越大泄露越严重,攻击者可借无关微调窃取。

04:00
arXiv cs.LG

自适应多级扭曲序列蒙特卡洛用于语言模型罕见事件估计

提出自适应多级扭曲SMC,通过渐进中间事件学习扭曲,提升大语言模型极端罕见不安全行为的概率估计精度。

04:00
arXiv cs.LG

深度神经网络的宽度无关可压缩性

证明深度MLP可压缩至与原始宽度无关的窄网络,压缩宽度仅与误差及有效输入维数相关。