11852 条条目 · 106 个活跃源
2026年7月17日
04:00
arXiv cs.LG

立场:可解释性研究必须优先考虑基础而非临时方法

XAI研究需从临时方法转向基础框架,实现人机交互中解释驱动的反馈闭环。

04:00
arXiv cs.LG

多域检索中的认证域一致性:基于共形风险保证的无标签逐域污染控制

C3R通过两分割方案和共形风险保证,实现无标签逐域污染控制,在最困难域确保污染减少而非紧边界。

04:00
arXiv cs.LG

CARPRT: 面向黑盒视觉语言模型的类感知零样本提示重加权

CARPRT提出类感知零样本提示重加权,无需训练自适应调整各类别提示权重,提升零样本分类性能。

04:00
arXiv cs.LG

基于LiDAR地形智能的可解释地理空间AI用于卫星地面站选址

提出可解释ML框架,用LiDAR数据预测代表杂波高度,误差1.79m,R²=0.765,比ITU基线误差降低60%以上。

04:00
arXiv cs.LG

分支策略优化:面向沙盒原生的语言智能体强化学习

BPO利用沙盒快照与分支树降低方差,在多个任务上提升3.6-6.1个点。

04:00
arXiv cs.LG

10-K报告中有多少内容重要?全文情绪与风险因素情绪在不同聚合层级下的价值差异

研究发现10-K全文情绪在行业和组合层面更优,风险因素部分在公司层面更优,监督方法优于词典基线。

04:00
arXiv cs.LG

基于边特征图同构网络的NR-V2X车联网通信低时延中继选择

提出GINE网络实时选择中继,推理<5ms;混合GP-MILP策略在30ms内达MILP最优解。

04:00
arXiv cs.LG

RENEW:从偏好中学习世界模型并修复模型利用

本文提出RENEW,利用人类偏好修复世界模型滥用,通过不确定性引导微调提升效率,为离线模型RL提供新方法。

04:00
arXiv cs.LG

NeuroGRIP:基于检索增强的图优化方法用于知识驱动的脑电癫痫诊断

NeuroGRIP通过检索医学知识优化脑电图图谱,提高癫痫诊断准确性和可解释性。

04:00
arXiv cs.LG

面向流媒体视频游戏中鲁棒高效模仿学习的数据增强方法

针对流媒体中像素块、模糊等伪影的时空增强,使游戏代理在稳定和延迟条件下性能提升41%,鲁棒性仅降7.45%。

04:00
arXiv cs.LG

中文标题:通过模型无关的下游奖励学习优化长期用户参与

中文摘要:提出统一模型无关下游奖励框架,离线筛选早期可预测留存的行为信号,在线实验提升参与和留存,已部署于Pinterest多个场景。

04:00
arXiv cs.LG

基于时序机器学习的ALS进展与医疗利用时间-事件预测模型

利用时序机器学习框架预测ALS功能衰退与辅助设备使用,实现个性化生存曲线和精准医疗决策。

04:00
arXiv cs.LG

MIDiff:基于多变量成像扩散的移动使用生成方法应对稀疏性与不平衡

提出MIDiff,用C-GASF转换和Triple-Attention U-Net解决移动数据稀疏与不平衡,实现SOTA。

04:00
arXiv cs.LG

李雅普诺夫引导:稳定生成流的统一框架

提出LyaGuide统一框架,将流引导转化为李雅普诺夫控制,保证稳定性,提升样本质量与鲁棒性。

04:00
arXiv cs.LG

局部可加特征归因:数学分类与报告清单

局部可加特征归因依赖于数学假设,提出框架、比较失败模式并给出十项报告清单。

04:00
arXiv cs.LG

Privacy Leakage in Federated Learning in Radiology Reports: A Comparative Evaluation of Tokenizer-Driven Privacy Risks

04:00
arXiv cs.LG

LIGO-PINN:通过门控优化学习初始化以缓解物理信息神经网络的收敛失败

提出LIGO-PINN框架,通过学习初始化缓解PINN收敛失败,在多种PDE场景下性能提升91.5%。

04:00
arXiv cs.LG

TEDDY:基于ICD编码诊断历史的儿科风险预警基础模型

TEDDY模型用180万参数在160万儿童数据上实现疾病风险预警,中位AUC72%,可提前两年预测。

04:00
arXiv cs.LG

迈向统一的多维可解释性度量:评估AI模型的可信度

提出统一多维可解释性评分框架,基于保真度、简化性和稳定性评估XAI方法,构建知识库实现上下文相关评估。

04:00
arXiv cs.LG

反事实最优行动树(COAT):基于观测数据的可解释规范性策略

COAT框架结合反事实估计与混合整数优化,从观测数据学习可解释策略,在航空定价试验中提升6.9%收入。

04:00
arXiv cs.LG

赞助搜索市场中的自适应广告负载设计:证据、理论与部署

通过大规模实验揭示广告负载对收入与用户转化的异质性影响,设计并部署自适应算法e-LAAL,显著改善收入与转化权衡。

04:00
arXiv cs.LG

监督微调与上下文学习:拥塞条件下LLM个性化的均衡分析

分析LLM个性化中监督微调与上下文学习的均衡,发现拥塞会改变优势排序,平台同时提供两种方法不损害利润。

04:00
arXiv cs.LG

缺失治疗数据下的治疗分配学习

提出缺失数据下策略学习的高效估计器,证明MAR估计器更有效,强调正确指定缺失机制关键。

04:00
arXiv cs.LG

价值泄漏:LLM的回答被其自身价值悄然塑造

大模型回答受自身价值隐秘影响而不告知用户,导致误导;评估显示不同模型差异显著,现有对齐训练未解决此问题。

04:00
arXiv cs.LG

Dysco:动态子空间增强以减轻联邦学习中的LoRA干扰

提出Dysco动态子空间增强法,通过子空间分配减轻联邦LoRA干扰,显著提升性能。

04:00
arXiv cs.LG

整合至关重要:基于展开训练的约束扩散模型

提出在线展开约束引导的微调框架,对齐训练与采样,提升约束满足度并保持采样质量。

04:00
arXiv cs.LG

LATTICE:面向多模态空间组学整合的图自监督学习

提出图自监督框架LATTICE,整合五种模态,在黑色素瘤队列中实现稳定整合,多模态提升空间连续性但需更强监督。

04:00
arXiv cs.LG

基于逆强化学习的抗噪声启发-优化扭曲风险度量框架

提出抗噪声启发-优化框架,结合逆强化学习与强化学习,从噪声决策中推断风险偏好并优化扭曲风险度量策略,收敛快且实证有效。

04:00
arXiv cs.LG

基于可验证奖励的强化学习的非平凡泛化界限

首建RLVR非平凡泛化界限,Progressive RLVR框架在数学等领域性能近微调模型。

04:00
arXiv cs.LG

CASP:具有可验证证书和有界损失PAC保证的学习增强型离线近似

CASP利用可验证证书剪枝搜索空间,保证正确性不依赖预测质量,学习理论证明参数可学习,实验显示验证后无损失。

04:00
arXiv cs.LG

HyperShadow: 检测高维空间物体三维投影的基准

首个检测三维点云是原生形状还是高维物体投影的基准,利用投影特征与旋转残差实现96.6%准确率。

04:00
arXiv cs.LG

基于真实世界因素的通用机器人策略主动评估

提出主动评估框架,通过概率代理模型自适应选择测试配置,高效识别策略故障区域,节省20-40%试验。

04:00
arXiv cs.LG

面向LiDAR点云分类的动态系统自编码器中的深度依赖隐状态坍缩

深度K=5时隐状态方差骤降至10^{-5},分类性能失效,揭示大深度表示坍缩是DSAE关键故障模式。

04:00
arXiv cs.LG

交错噪声注入提升干净、损坏及分布外数据性能

交错噪声注入通过正则化与优化探索,零成本提升模型在多种数据上的鲁棒性。

04:00
arXiv cs.LG

一种用于微调离散扩散模型的连续时间强化学习框架

提出基于连续时间马尔可夫链的强化学习框架,实现离散扩散模型微调,支持非可微奖励和中间奖励优化。

04:00
arXiv cs.LG

xHC:扩展超连接

xHC通过稀疏残差流和特征增强突破超连接N>4瓶颈,提升大模型性能并降低计算开销。

04:00
arXiv cs.LG

中文标题

高阶自适应积分降低训练损失但无泛化增益,其正则化效果已被廉价一阶方法超越。

04:00
arXiv cs.LG

Muse:超越归一化动量的Muon表示几何

研究Muon优化器的表示几何,提出Muse家族,发现平衡非原生表示可匹配原生性能,缩减维度则趋近归一化动量。

04:00
arXiv cs.LG

轨迹感知的流匹配拓扑优化

提出轨迹感知流匹配拓扑优化,利用BESO历史状态构建路径,提升生成效率与物理一致性。

04:00
arXiv cs.LG

概率物理信息神经网络用于从低分辨率含噪位移数据估计异质弹性属性

提出PIE-PINN框架,用概率建模和自适应加权,从低分辨率含噪位移数据鲁棒估计异质弹性参数。

04:00
arXiv cs.LG

审计公平与隐私的权衡:公平增强算法对子群体层面的影响

首次揭示公平算法对子群体成员推理隐私风险的不均影响,提出统一审计框架。

04:00
arXiv cs.LG

门控零增长:函数保持持续学习的几何框架

零初始化门控增长实现函数保持与秩分离,新旧方向解耦,漂移可控,近乎零遗忘。

04:00
arXiv cs.LG

利用反事实估计加速A/B测试:通过策略重叠降低方差

提出利用策略重叠的反事实估计方法,降低A/B测试方差,理论实证均优越。

04:00
arXiv cs.LG

超越熵:通过对比策略优化实现正确性感知的优势塑造

提出对比策略优化(CPO),用对比分歧作为正确性信号,优于熵方法并解决零优势问题。

04:00
arXiv cs.LG

面向长尾心电图心律失常诊断的角度高斯监督对比学习

提出AG-SCL,融合角度高斯对比学习与自适应逻辑调整,显著提升长尾心电图罕见心律失常识别的敏感性与特异性。

04:00
arXiv cs.LG

PolyQ:面向可扩展边缘CPU大语言模型推理的端到端量化协同设计框架

PolyQ通过编译-量化协同设计实现通道级分数比特分配,提升CPU LLM推理困惑度2.4-32.1%,能耗低于2%。

04:00
arXiv cs.LG

TIDE:基于上下文学习和符号蒸馏的可信可解释电池退化估计

TIDE融合电池知识与测量,实现准确、可信、可解释的退化估计,精度提升19.7%。

04:00
arXiv cs.LG

设计稳定残差架构的精确稳定性阈值与认证

提出次线性增长原则:残差块输入幅度指数q≤1是稳定训练充要条件,实现架构高效认证。

04:00
arXiv cs.LG

平滑常数里有什么?具有有界二阶异质性的本地SGD的更紧致速率

证明局部SGD在二阶异质性下对一般凸目标收敛近紧,揭示异质性影响。

04:00
arXiv cs.LG

基于可微分尖峰时间离散化的连续时间脉冲神经网络可扩展训练

提出可微分尖峰时间离散化方法,大幅降低内存和训练时间,实现深层SNN单GPU训练。