11462 条条目 · 106 个活跃源
2026年9月4日
04:00
arXiv cs.LG

WeatherNext 3: Increasing resolution and performance of global weather models with raw observations

04:00
arXiv cs.LG

Resolution-Aware Experimental Design under Partial Identifiability

04:00
arXiv cs.LG

Out-of-Distribution Generalisation with Sequence Models in Offline Multi-Agent Reinforcement Learning

04:00
arXiv cs.LG

Federated Causal Discovery via Regression-Directed Cumulants

04:00
arXiv cs.LG

Projected Riemannian Gradient Descent for the Bures-Wasserstein Barycenter: Dimension-Independent Linear Convergence at Unit Step Size

04:00
arXiv cs.LG

On the Interaction Between Model Compression and Test-Time Adaptation

04:00
arXiv cs.LG

Neural-Network Maxent: a general extension with learned nonlinearity, applied to time-series for Desert Locust distribution modelling

04:00
arXiv cs.LG

Local Updates, Global Learning (LUGL): Playing Games with non-incremental Learners

04:00
arXiv cs.LG

面向移动网络站点能效低效识别的对等相对表示学习框架

提出无监督对等相对方法,用能量感知MDE嵌入识别高能耗站点,优于传统异常检测,助力大规模网络节能优化。

04:00
arXiv cs.LG

基于地标的损伤相关运动员会话判别:来自分钟级多模态足球监测数据

提出固定地标单表示方法,解决逐分钟数据与会话级标签错配;女足3743个会话评估显示损伤判别效果有限且不确定。

04:00
arXiv cs.LG

OBER+:成果导向教育中连续性感知的报告与可追踪持续改进

成果导向教育报告规则:按监管阈值分级记录纠正措施,量化缺口变化,识别成果重定义导致的虚假下降;实测暴露缺陷。

04:00
arXiv cs.LG

免费暂停标记

提出免费暂停标记,以并行流提供额外计算而不增加序列长度,提升下一词预测,仅增加训练开销。

04:00
arXiv cs.LG

从有序伯努利层级到临界线几何:整数量化、伯努利残差相位与素数幂谱

研究有序伯努利核的逆整数水平集获得临界线几何与整数量化分解伯努利残差相位联系素数幂谱不声称证明黎曼猜想

04:00
arXiv cs.LG

证人解释异常

提出可解释的无监督异常检测法:以方向投影偏离极值基线评分,证人方向即特征归因,线性高效且不损精度。

04:00
arXiv cs.LG

面向数值数据可解释异常检测的可微区间瓶颈

提出可微区间瓶颈自编码器,以重建误差检测异常,内部结构可解释且无需标签;在48个基准上平均性能最优。

04:00
arXiv cs.LG

离线强化学习中的多步近端策略改进

提出多步近端策略改进方法,通过几何流形建模,在近端控制下超越数据支持,提升离线强化学习基线。

04:00
arXiv cs.LG

注意力索引模型的高维学习动力学

研究表明注意力索引模型高维动态由迹序参量和矩层次刻画注意力参数化作为隐式偏差驱动对称破缺与弱恢复

04:00
arXiv cs.LG

突破(决策)边界:联邦学习中面向可解释性的差分隐私噪声动态校准

XCal-FL动态校准DP噪声,用预测对数几率、反事实边界、显著性,医学影像准确率提高一成以上,解释保真度达五倍,隐私预算效率更高。

04:00
arXiv cs.LG

超越终点评分:持续知识更新的时间与容量条件评估

仅凭端点分数与单一适配器排名不足为凭,优劣随评估时间及容量漂移;应报告轨迹与容量扫描,排序稳定才算稳健胜者。

04:00
arXiv cs.LG

RATL:基于检索残差学习实现稳健多元时间序列预测

RATL将历史预测残差作为可检索记忆,检索相似残差并学习路由组合,反馈修正冻结预测器,提升多元时间序列预测。

04:00
arXiv cs.LG

余量-漂移重放:GRPO中原则性重放控制的原语

将重放分为余量排序与漂移门控,不增生成/训练机制,单点干预即在多任务匹配或超越复杂重放法,交互场景省时。

04:00
arXiv cs.LG

退化扩散模型的条件化

用因果最优输运为条件化奇异扩散模型定义近似损失在密度不存在或不光滑时于最弱假设下识别最小熵引导控制

04:00
arXiv cs.LG

OSR:输出空间再分配用于分类模型的自适应标签移除

提出输出空间统计重分配方法,无需原始数据即可近似重训后置信度,效率高且保护隐私,性能接近完整重训。

04:00
arXiv cs.LG

解锁LLM中的无损加速:离散扩散方法

提出扩散增强LLM(Uno),以离散扩散并行解码,无需草稿模型,无损加速达3倍,吞吐量高,性能超越更大规模扩散LLM。

04:00
arXiv cs.LG

中文标题:重尾分布极值分位数处理效应的位置不变估计器

中文摘要:针对重尾结果提出位置不变的极值分位数处理效应估计器,修正位置偏移导致的不稳健,并证明其一致性与渐近正态性。

04:00
arXiv cs.LG

RobustSeiz:面向脑电癫痫检测模型鲁棒性基准测试的开源框架

RobustSeiz开源框架标准化四个脑电数据集,通过临床分布偏移压力测试癫痫检测模型,评估鲁棒性。

04:00
arXiv cs.LG

VestigeKV:NoPE-MLA KV缓存在残留分支中携带自身驱逐信号

无位置编码MLA缓存的残留分支自带驱逐信号,免训练压缩,128倍压缩下检索仍满分。

04:00
arXiv cs.LG

子空间推断实现基于偏好的高效主动奖励学习

用低维子空间扩展卡尔曼滤波序贯推断奖励模型后验,实现基于偏好的高效主动学习,提升样本效率、可扩展性与校准性。

04:00
arXiv cs.LG

硬件感知的FP4 FlashAttention-4

针对Blackwell FP4张量核,提出Direct-P及因果路径,免softmax转换,推理提速2.13倍,训练更新提速1.14倍,且避免MXFP4轨迹发散。

04:00
arXiv cs.LG

一般博弈中的常数后悔:基于高阶乐观方法

提出无耦合高阶乐观折扣(HOOD)算法,用于任意N人标准式博弈,保证个体遗憾O(N^3 log²K),实现常数后悔。

04:00
arXiv cs.LG

前瞻编码提升深度连续时间循环网络的学习

提出递归正交滤波器,用前瞻输入修正深度网络时序误差,缓解梯度衰减,在语音与路径任务上超越基线。

04:00
arXiv cs.LG

FrOGS:跨化学条件下独立合金构型的离散神经采样器

FrOGS耦合自回归与连续时间马尔可夫链,跨化学条件无偏估计配分函数与热力学量,避免模式崩溃。

04:00
arXiv cs.LG

用于微型阿克曼车辆端到端自动驾驶的低成本开放平台

构建低成本开放平台,融合微型车、数字孪生,行为克隆控制,实车误差六点一厘米,支持仿真到实车迁移。

04:00
arXiv cs.LG

迈向大规模群体的强化学习扩展:学习平均场表征

提出依赖未知低维聚合统计量的平均场强化学习框架,离线学习低维表征获近优策略,提升奖励预测与均衡质量。

04:00
arXiv cs.LG

多智能体对战游戏中LLM引导强化学习的自适应NPC行为

LLM引导RL策略选择,对变招对手胜率翻倍至24%,但83.8%选包围,零样本策略分化有限。

04:00
arXiv cs.LG

评估图神经网络在艺术家合作网络中的成功预测

评估GNN在艺术家合作网络中的成功预测。发现节点特征比网络拓扑更具预测力,跨国网络中GNN优势更明显。

04:00
arXiv cs.LG

并发随机博弈的鲁棒PAC学习

首个并发随机博弈鲁棒PAC框架:针对转移不确定性,用鲁棒MDP探索与纳什边界判定,返回社会福利近似最优ε-均衡或证明无均衡,样本复杂度多项式。

04:00
arXiv cs.LG

强子单Z暗物质在CMS开放数据上的流匹配灵敏度研究

基于CMS开放数据用流匹配法预测强子单Z暗物质灵敏度,最高达7.62σ,剔除额外喷流后降低53-71%,凸显其鉴别力。

04:00
arXiv cs.LG

SurfSpec:通过约束口袋-配体几何错配来增强脱靶不可知的特异性

提出SurfSpec框架:基于几何错配下界,无需脱靶结构信息即可优化特异性;反复生长配体填补口袋表面,提升特异性且保持亲和力。

04:00
arXiv cs.LG

面向动态图异常检测的统计特征增强

提出一种统计特征增强方法,将行为交互统计显式编码进输入,提升动态图异常检测性能,并支持事后行为分析。

04:00
arXiv cs.LG

从稀缺标签中学习:多视图超声心动图用于射血分数预测

针对标签稀缺,构建首个PLAX-EF数据集,MAE6.86%,多视图融合6.37%。

04:00
arXiv cs.LG

基于动态谱优化的硅上外延SrTiO3忆阻器氧空位动力学物理信息神经网络代理模型

级联物理信息神经网络与谱优化求解器模拟钛酸锶忆阻器氧空位输运,克服病态,拟合I-V滞回,支持参数反演。

04:00
arXiv cs.LG

你无法逃脱自己的激活:评估意识与多智能体监控

告知智能体激活受监控并反馈,探针仍准确,智能体继续串通,无法逃避自身激活。

04:00
arXiv cs.LG

Population-Calibrated Graph Screening at 835-Million-Address Scale, with Label-Free Transfer to New Chains

04:00
arXiv cs.LG

机器学习辅助定向进化五年回顾:进展与反思

五年来,机器学习未充分变革定向进化,因过度聚焦“最优蛋白”而忽视“在资源约束下获得足够蛋白”,如忽略DNA合成成本,致实用性受限。

04:00
arXiv cs.LG

基于差分隐私与拜占庭鲁棒聚合的联邦学习:面向银行与医疗安全训练的跨域框架

提出DP-BR-FedAvg框架,融合差分隐私与按坐标裁剪均值聚合,在恶意客户端下显著优于FedAvg,并量化隐私与鲁棒性的权衡代价。

04:00
arXiv cs.LG

联邦学习中的隐私泄露:车载边缘网络中面向惯性感知的基于梯度客户端身份推断与防御

车载边缘联邦学习中,服务器从梯度更新可近乎完美识别客户端身份;适度加噪使攻击近随机,精度损失低于5%。

04:00
arXiv cs.LG

什么是光滑性?

光滑性不是函数自身属性,而是函数连同群和生成集的共同属性:由生成集排序不可约表示,低频集中即光滑。

04:00
arXiv cs.LG

BASP:面向大语言模型训练的高效通信批感知序列并行

提出批感知序列并行(BASP),按微批大小分组GPU,缩小通信规模,训练提速最高1.31倍,精度内存不变。

04:00
arXiv cs.LG

原子热力学景观的生成式嵌套采样

提出生成式嵌套采样:条件归一化流替代马尔可夫更新。原子盘系能耗降两个量级,并揭示液体系综是流模型难点。