11852 条条目 · 106 个活跃源
2026年6月23日
04:00
arXiv cs.LG

Dual-Attention Convolution Experts for Sparse Tensor Completion

04:00
arXiv cs.LG

面向网络弹性医疗物联网的联邦时序注意力智能:轻量级数字孪生与PPO驱动的蜜罐欺骗

提出LDT-FRL框架,融合时序注意力、数字孪生和联邦PPO,异常检测准确率99.95%,收敛快81%,MITM类F1完美。

04:00
arXiv cs.LG

基于感知奖励的语音增强语言模型后训练

用多度量感知奖励后训练语音增强模型,直接优化非可微质量指标,实现SOTA并避免奖励欺骗。

04:00
arXiv cs.LG

鲁棒性不能简化为正则化:超越线性情形的对抗训练研究

对抗风险无法简化为正则化风险,对两层网络及更深架构均不成立。

04:00
arXiv cs.LG

深度学习用于土壤湿度估计:融合卫星数据与最优滞后气象特征

利用最优滞后气象与深度信息,深度学习融合卫星数据显著提升半干旱区土壤湿度估计精度,R²达0.93。

04:00
arXiv cs.LG

通过模拟反向传播:面向样本与学习高效的可微连续控制的解析策略梯度

解析策略梯度(APG)通过可微环境动力学反向传播精确计算梯度,提升样本与学习效率,优于PPO。

04:00
arXiv cs.LG

用树打破链条:具有$\mathcal{O}(\log N)$并行时间复杂度的深度学习

提出层级块局部学习(HBLL),实现O(log N)并行时间训练深度网络,无需端到端反向传播,性能优秀。

04:00
arXiv cs.LG

使用结肠镜前临床特征预测非洲裔美国人的高危结直肠息肉:机器学习模型开发与时间验证

基于结肠镜前特征开发机器学习模型,预测非洲裔美国人高危结直肠息肉,并进行时间外部验证。

04:00
arXiv cs.LG

隐私保护联邦时序图学习与数字孪生引导的自适应欺骗机制

提出联邦TGCN-A2C框架,融合数字孪生与自适应蜜罐,在IoMT中达99.5%+准确率与可解释性。

04:00
arXiv cs.LG

理解Muon优化器的能力与局限:一个河流-山谷视角

Muon优化器早期快后期慢,易过冲振荡,建议最终阶段切换为梯度下降类优化器。

04:00
arXiv cs.LG

融合后门、机器学习和优化的大规模参数混合整数规划

提出BIPC框架,三阶段识别后门变量、监督学习预测、优化校正,大幅加速大规模参数混合整数规划求解质量损失小。

04:00
arXiv cs.LG

快速TurboQuant:一种无乘法器的在线向量量化方法

用快速变换替代密集矩阵,无乘法器在线量化,加速19.7倍并提升召回率。

04:00
arXiv cs.LG

内存不再是瓶颈:面向可扩展协同过滤的内存高效图滤波

Mem-GF利用Krylov子空间近似滤波,无需存储全图,内存和速度显著提升,精度超越现有方法。

04:00
arXiv cs.LG

LIG:用于Transformer层内流分析的逐层集成梯度

提出LIG方法,在模块边界应用集合到集合集成梯度,分析层内信息流,作为无需重新训练的可解释性诊断工具。

04:00
arXiv cs.LG

深度学习表示中的几何与信息压缩

低互信息不等于几何压缩,两者关系非线性且受泛化影响。

04:00
arXiv cs.LG

通过强化学习放置守卫:面向顶点守卫画廊问题的无几何信息神经策略

冻结编码器探针表明,强化训练的表征已编码几何信息,解码器校准不足导致残余失败,可显著提升可行性。

04:00
arXiv cs.LG

何时用大语言模型进行超参数优化才值得?基于预算匹配的表格数据研究发现:热启动的默认配置才是关键,而非模型本身

LLM在超参数优化中并无实质增益,热启动默认配置即达88.7%最佳CV,经典方法很快超越。

04:00
arXiv cs.LG

FAST:自动驾驶并行强化学习中的对齐采样与训练框架

提出FAST框架,通过动态并行采样对齐和掩码填充优化消除拖尾效应,实现1.78倍加速且统计无偏。

04:00
arXiv cs.LG

双峰问题:弥合数学强化学习中的难度差距

发现AC猜想中的双峰难度分布,通过数据生成与算法改进弥合差距,发布大型基准数据集。

04:00
arXiv cs.LG

基于最小生成树的一种新分类方法

提出基于最小生成树的分类算法及其鲁棒版本,通过仿真和飞机轨迹案例验证了有效性。

04:00
arXiv cs.LG

HERALD: 通过CPU-GPU协作KV缓存检索实现高吞吐量块扩散LLM服务

HERALD通过CPU-GPU协作在块扩散LLM中高效检索KV缓存,仅用5-10%预算实现近乎无损精度,延迟降低1.59倍,吞吐量提升2.47倍。

04:00
arXiv cs.LG

信念的成本几何:噪声观测下的有限资源推断

信念成本几何由费希尔信息共形加权,导致几何不变量:确定性不可达,几何与费希尔信息正比,双曲性与高斯极值

04:00
arXiv cs.LG

可解码但不忠实:将自然语言理由与程序化验证器耦合

研究发现可解码性与忠实性存在差距:一致性训练使验证信息可解码,但不能保证生成忠实理由。

04:00
arXiv cs.LG

洛伦兹等变喷注标记器学到了什么?

研究洛伦兹等变喷注标记器内部机制:抑制赝快度,编码质量与N-subjettiness,双向量通道不关键,类向量通道主导。

04:00
arXiv cs.LG

有向无环超图学习框架

提出从观测数据学习有向无环超图的框架,通过张量t-积傅里叶分解实现可微无环约束,捕获联合父节点影响。

04:00
arXiv cs.LG

超越下一步:可变长度潜在世界模型用于长期规划

提出可变长度潜在世界模型(VLWMs),直接建模长时间跨度动态,课程训练优化长程预测,长期规划任务平均提升13%。

04:00
arXiv cs.LG

决策聚焦学习:传统预测模型何时以及为何失败

决策聚焦学习揭示传统预测模型在优化决策中的局限,需重新思考数据收集与距离度量。

04:00
arXiv cs.LG

表达力饱和:任务复杂度增加下仿射区域使用减少

发现任务复杂度增加时网络实际仿射区域使用减少(表达力饱和),导致决策边界退化。

04:00
arXiv cs.LG

面向合成时间序列分类数据集的因果DAG先验

提出因果DAG先验,生成含跨模态因果结构的多变量时间序列分类数据集,微调TabPFN显著提升性能。

04:00
arXiv cs.LG

RocketPFN:通过上下文学习实现精准时间序列分类

RocketPFN无训练,结合随机卷积与上下文学习,分类精度达HC2水平(0.900),推理快,超越多个基础模型。

04:00
arXiv cs.LG

在概率神经网络中嵌入线性等式约束用于动态建模

提出保证线性等式约束满足的概率神经网络,提升预测精度与约束遵守,大数据下训练更快,应用于反应器质量平衡。

04:00
arXiv cs.LG

AdaPrivate-TS: 具有隐私放大的上下文赌博机私密汤普森采样

AdaPrivate-TS结合汤普森采样与批处理zCDP,实现事件级差分隐私,隐私成本对数于T,性能达非私有93-99%,低预算下隐私放大额外提升2-5%。

04:00
arXiv cs.LG

离散化奖励模型

奖励模型过度敏感会导致策略劣化,用蒙特卡洛丢弃法离散化奖励可减少过度敏感并提升策略效果。

04:00
arXiv cs.LG

因果变分深度嵌入:一组用于混杂图像的干预生成器

CauVaDE用离散潜簇模拟混杂因子,通过熵正则化推断干预分布,生成多样化图像并提升FID。

04:00
arXiv cs.LG

Cohort-Anchored Foundation Models for Electronic Health Records: From Risk Scores to Auditable Peer Cohorts

04:00
arXiv cs.LG

UniRank:面向低秩大语言模型压缩的统一秩分配

提出双准则评分排序截断方法,无需微调即可将困惑度降低高达50%。

04:00
arXiv cs.LG

链式思维推理的局部因果归因

提出AttriCoT方法,通过O(U)次前向传播进行因果归因,忠实度优于其他方法,揭示模型与领域间的思维结构差异。

04:00
arXiv cs.LG

因果高斯过程:在未观测混杂下鲁棒评估处理效应

提出通用离散化方法近似任意因果模型,基于此开发因果高斯过程,实现连续域上鲁棒因果效应评估。

04:00
arXiv cs.LG

WiSP:极低资源硬件上混合专家模型服务的工作集视角

WiSP通过路由感知的专家分页和边际价值分配,在内存受限时使解码吞吐量提升至1.95倍。

04:00
arXiv cs.LG

蛋白质接触已在注意力中:分类雅可比矩阵的单次前向传递替代方案

通过选择少量注意力头,单次前向传递即可恢复蛋白质接触,性能优于分类雅可比矩阵,且依赖双向预训练。

04:00
arXiv cs.LG

Mat-Pref:可验证奖励训练提升无机材料的组合推理

Mat-Pref基准证明,两阶段训练(SFT+GRPO)使小模型在无机材料组合推理中超越大模型零样本,GRPO将正确答案转化为众数。

04:00
arXiv cs.LG

可验证搜索并非可学习的思维链

论文证明可验证搜索无法蒸馏为可学习的思维链,模型仅学到记忆和验证,而非搜索过程。

04:00
arXiv cs.LG

多正确答案与不可回答估计的排序与选择

提出统一框架和ENDS算法,解决答案不唯一或不可得时的排序与选择问题,实验表现良好。

04:00
arXiv cs.LG

VegSim:面向情景条件的植被模拟地理空间世界模型

VegSim是基于卫星NDVI和气象数据的地理空间世界模型,支持不同气象情景下的植被动态概率预测与条件模拟。

04:00
arXiv cs.LG

数据剪枝:冗余、有问题的样本及样本间的相互依赖

数据剪枝在噪声下失效,受冗余、问题样本和样本间依赖影响。

04:00
arXiv cs.LG

AgroSense 2.0:跨模态Transformer融合、地理空间栅格集成与可解释多任务学习用于精准作物推荐

提出AgroSense 2.0,融合地理栅格与跨模态Transformer,多任务学习优化推荐,TreeSHAP揭示降雨、湿度等关键因素。

04:00
arXiv cs.LG

基于偏好导向的多目标赌博机的选择性集成

提出偏好导向多目标赌博机及PrefUCB算法,在部分偏好下实现选择性集成并获对数遗憾界。

04:00
arXiv cs.LG

DevoTG:用于建模秀丽隐杆线虫发育连接组的时间图神经网络

提出DevoTG时间图框架,建模线虫发育连接组,线系预测AUC 0.839,识别连接稳定性三类,揭示枢纽神经元作用。

04:00
arXiv cs.LG

模块化强化学习在大语言模型中的应用:从MDP构建到探索与学习

本文综述LLM后训练RL设计,分MDP创建、探索与学习三阶段,揭示方法分布不均与未探索空白,提供框架与方向。

04:00
arXiv cs.LG

通过移位学习:时间序列对比学习中的时间视图构建

提出ShiFT方法,利用时间移位不变性构造确定性视图,在时间序列分类基准上达到最优并缩短训练时间。