11632 条条目 · 106 个活跃源
2026年8月11日
04:00
arXiv cs.LG

FreSH:面向多变量时间序列分类的频率分段层次化多专家框架

频率分段层次多专家框架FreSH,自适应融合多尺度特征,在30个UEA基准和振动数据超越SOTA。

04:00
arXiv cs.LG

控制多样化强化微调:解耦强化学习后训练中的共享控制瓶颈

提出控制多样化强化微调,解耦共享控制瓶颈,提升数学代码逻辑多任务能力,且控制解耦可迁移

04:00
arXiv cs.LG

SAGE:面向生产RAG系统的SLO感知自适应检索

SAGE:学习型SLO感知自适应检索,动态选k,提升SLO合规率,降低延迟和成本,质量损失小。

04:00
arXiv cs.LG

超越聚合校准:分解自动化信用违约预测中收入条件召回率差异

高收入违约者更易被误标噪声,召回率差16.86个百分点;剔除收入利率,差距由贷款、房产等代理变量维持。

04:00
arXiv cs.LG

重放差距:LLM智能体模型切换的静态评估评错了世界

重放评估假设切换模型不影响智能体后续轨迹,但分支实验显示大幅偏离,评分与真实世界不符。

04:00
arXiv cs.LG

有状态CARS:策略约束LLM智能体的精确跨历史复用

提出有状态CARS,通过状态-延续模式精确采样并跨历史复用无效证书,理论证明完备,但无系统优势。

04:00
arXiv cs.LG

面向序数回归的促进单峰性正则化学习

针对序数回归,提出规避尺度偏差的促单峰正则化方法,提升预测性能,小样本更优。

04:00
arXiv cs.LG

机会不等于可实现性:多LLM路由的选择有效诊断

Oracle机会大多不可实现:选择有效区间显示最强路由器仅恢复7.5-14.4%,最优策略下限为零。

04:00
arXiv cs.LG

基于机器学习的铁路车轮缺陷被动超声检测诊断框架

利用被动超声与机器学习实现铁路车轮多类缺陷识别,随机森林分类准确率约0.66,验证了非接触检测可行性。

04:00
arXiv cs.LG

神经劳动分工:受生物启发的模块化架构用于稳健的神经形态计算

受生物神经系统模块化启发,提出可分解脉冲神经网络(D-SNN),分离分类路径,参数少、能耗低,抗灾难性遗忘,决策透明,适用于边缘环境。

04:00
arXiv cs.LG

用于因果推断的因果状态空间模型:估计纵向个体治疗效果

提出两种因果状态空间模型,化解平衡-预测互信息冲突,提升纵向反事实估计精度,优于现有方法。

04:00
arXiv cs.LG

基于特征的知识蒸馏在不同学生设计中的受控研究

在CIFAR-100上,logit蒸馏提升所有学生,FitNets均逊于logit蒸馏,注意力迁移因学生设计而异,固定系数导致训练条件不均。

04:00
arXiv cs.LG

区域尺度下顾及空间异质性的多灾种易发性和风险制图

提出空间异质性感知框架,对比跨区与分区训练用于洪水-滑坡易发性和风险制图。跨区精度高,分区保留环境差异,建议集成。

04:00
arXiv cs.LG

PRISM:基于景观诊断的排列优化预测协议

PRISM基于景观诊断预测排列优化,指导算子选择与搜索价值,实验发现排序优化独立于内容优化。

04:00
arXiv cs.LG

临界态下相关性流支配学习

结合平均场与随机矩阵理论,证明临界点相关性传播至无限深,NTK正比于输出相关,正交初始化抑制有限尺寸修正。

04:00
arXiv cs.LG

图学习能学会电路吗?

提出图电路学习(GCL),用GNN跨任务定位电路,在InterpBench上中位AUROC达0.902,接近EAP-IG的0.910。

04:00
arXiv cs.LG

多标签F1损失的精确秩与凸校准维度下界

确定多标签F1损失秩为s²-s+2,证凸校准维度下界(2/(3√3)-o(1))s²,结合上界得Θ(s²)。

04:00
arXiv cs.LG

重新思考基于学习的影响力最大化:简单神经代理与原生离散搜索

提出SIMBA框架:轻量神经网络代理配合原生离散搜索,替代复杂模型,提升影响传播与数据效率。

04:00
arXiv cs.LG

MGMCL:基于神经ODE的多粒度流形对比学习用于跨被试EEG情绪识别

提出MGMCL,用SPD流形与神经ODE建模连续情绪,多粒度对比学习,跨被试三个数据集最优。

04:00
arXiv cs.LG

齐巴科夫噪声下的最优学习

改进上界匹配已知下界,解决了齐巴科夫噪声下PAC学习二十年的开放问题,确立最优误差保证。

04:00
arXiv cs.LG

普遍可学习概念类下的约束学习

证明非凸无限维约束学习中对偶算法普适PACC可学习,借闭包实现间隙判定精确性,无分布无关阈值。

04:00
arXiv cs.LG

FSTC-Encoder:面向泛化射频感知的特征-空间-时间相关性学习

提出FSTC-Encoder,通过特征-空间-时间相关性建模统一异构射频表征,实现跨域、跨模态高精度泛化。

04:00
arXiv cs.LG

无唯一最小化器也没问题:鲁棒神经分类器的一致性

提出不依赖可辨识性的S散度鲁棒分类器一致性理论,证明经验最小化收敛至最优等价类,实验验证其精度与鲁棒性俱佳。

04:00
arXiv cs.LG

域感知代理的分布外联邦蒸馏

针对联邦蒸馏在分布外场景适应性差,提出域感知代理选择框架,有无代理数据下均显著提升性能,平均达82.9%和80.6%。

04:00
arXiv cs.LG

企业LLM编码助手的任务到模型优化:成本最优路由的数据驱动框架

提出T2MO框架,以完成任务成本为目标,任务分级路由优化模型选择,兼顾质量延迟,降低企业编码助手推理开支。

04:00
arXiv cs.LG

多关系知识图谱增强的轨迹-用户链接嵌入

提出MakeTUL,首次将知识图谱表示学习引入轨迹-用户链接,用多关系流动图与高阶共现增强轨迹序列学习。

04:00
arXiv cs.LG

数字孪生校准中的轨迹设计与预算查询

数据稀缺下数字孪生校准,将轨迹设计与查询预算分配作为显式变量,显著降低估计误差。

04:00
arXiv cs.LG

域感知剪枝:通过正则化概率掩码实现稀疏性与域泛化

域感知剪枝用概率掩码惩罚域敏感权重,实现稀疏且提升域泛化,无需微调。

04:00
arXiv cs.LG

路径依赖的离散摊销推断

提出路径依赖离散摊销推断:用可学习潜动态系统使策略依赖完整轨迹,缓解状态混叠,加速收敛并提升探索。

04:00
arXiv cs.LG

当技能遇见安全:技能融合大模型的自适应越狱鲁棒性基准与刻画

融合模型静态安全测试不可靠,因安全集中在初始token;新基准SkillSafe-Bench显示,脆弱基座模型在语义攻击下60-76%被越狱,需自适应评估。

04:00
arXiv cs.LG

结构交互图上的神经消息传递:面向全归纳图神经网络

提出新框架:将任意属性图映射到统一固定维空间,用结构交互图与关系消息传递,实现全归纳链接预测,并推广知识图谱基础模型。

04:00
arXiv cs.LG

共享边际低秩因子的精确秩空间KL投影:应用于双随机聚类

针对共享边际低秩因子,提出精确KL投影,化为严格凸对偶;用于双随机聚类,算法保可行且收敛。

04:00
arXiv cs.LG

鲁棒声誉驱动的众包联邦学习

提出R2CFL框架,结合鲁棒声誉与最近邻混合防御,抵御隐蔽攻击,提升众包联邦学习的稳健性。

04:00
arXiv cs.LG

基于智能体特定偏好的多智能体强化学习

提出MAGPIE方法,用智能体特定偏好替代全局奖励,证明收敛至纳什均衡,性能媲美手工奖励基线。

04:00
arXiv cs.LG

欺诈运营何时能授权自动化?面向新鲜审计证据与审核工作量的决策支持框架

提出新鲜度约束的审计容量框架,自动化率84.4%、67.4%、81.3%,揭示审计容量权衡。

04:00
arXiv cs.LG

基于LLM的时间序列预测的高效测试时扩展

SCALER框架用轻量Transformer预测未来形状,引导LLM粗到细迭代细化,降低计算开销,提升长短期及零样本预测精度。

04:00
arXiv cs.LG

持续强化学习中的灾难性遗忘

研究任务相似性与强化学习灾难性遗忘的关系,发现无独立显著影响,但存在复杂动态。

04:00
arXiv cs.LG

RippleKV:通过扰动传播进行跨层KV缓存分配

提出RippleKV,用扰动传播衡量各层缓存敏感性并分配预算,在LongBench上取得最优平均性能。

04:00
arXiv cs.LG

块衰落信道下抗丢失的无线视频令牌通信

提出WVTC框架,基于令牌预测结构评估重要性,混合分组与在线调度抗块衰落丢失,无需重传,提升重建质量。

04:00
arXiv cs.LG

无攻击者的博弈:选择压力下LLM驱动搜索中的基准指纹识别

针对评估信号优化的基准会失真:大模型进化搜索会指纹识别评测配置,三成胜出不迁移,需按失败机制分级。

04:00
arXiv cs.LG

PAST:基于完整学生轨迹的特权自适应用于同策略自蒸馏

提出PAST方法,利用学生完整轨迹作为特权信息,仅对失败轨迹调整教师模型,在三个数学推理基准上比基线提升5.6个百分点。

04:00
arXiv cs.LG

LegoLM:大语言模型的结构化权重共享

LegoLM: 结构化权重共享压缩,解决两类失效模式,7B模型4.41X压缩近无损,优于PTQ-8bit。

04:00
arXiv cs.LG

基于滑动窗口与Hirschberg算法的PyTorch 0/1背包问题内存高效激活检查点

滑动窗口与希施伯格算法:激活检查点内存由O(nW)降至O(W),可解规模扩20倍,提速25%。

04:00
arXiv cs.LG

基于树解释的向后兼容性与增强CART算法

提出BCLTX指标抑制决策树更新前后解释变化,并设计CART-BCTX算法,在保持性能和耗时下实现解释兼容。

04:00
arXiv cs.LG

测量并降低大语言模型推理中的WebGPU调度开销

提出顺序分派测量法,证明批量为一时分派开销是瓶颈,减少分派次数可优化大语言模型推理。

04:00
arXiv cs.LG

从共识与分歧中学习:基于少数轨迹对比的无监督在线策略自蒸馏

提出CoDA,利用共识与分歧构建无监督自蒸馏,提升数学推理并抑制错误共识。

04:00
arXiv cs.LG

联邦注意力自编码器与随机聚合方案的异常检测

提出面向注意力自编码器的联邦聚合函数,在KDDCUP10上F1和AUC分别提升2.9%和5.1%。

04:00
arXiv cs.LG

混合神经-经典校正用于冻结时间序列基础模型:高频股票预测的综合消融研究

冻结TimesFM适配高频股票预测,神经+随机森林混合校正有效,GatedLinear+RF最优,参数少9倍,经典残差学习贡献最大。

04:00
arXiv cs.LG

面向自动驾驶中稳健交通标志感知的视觉语言模型蒸馏

提出LAMDA框架,用VLM原型库监督视觉特征,在不增开销下提升交通标志识别对物理攻击的鲁棒性,并保持干净精度。

04:00
arXiv cs.LG

量子-经典物理信息Kolmogorov-Arnold网络求解模糊微分方程

提出量子-经典物理信息KAN求解模糊微分方程,结合ChebyKAN与量子电路,误差分析与实验显示精度更高。