11602 条条目 · 106 个活跃源
2026年8月14日
04:00
arXiv cs.LG

鲁棒数据驱动发现分数阶微分方程:弱形式与帕累托子集选择

提出Weak-Pareto,用弱形式和帕累托选择,从噪声数据中发现分数阶PDE,抑制噪声并恢复稀疏结构。

04:00
arXiv cs.LG

持续学习中基于可学习小波激活的可塑性维持

提出可学习小波激活,分解高频低频,动态注入增强可塑性,正则化防遗忘,理论证明,性能领先。

04:00
arXiv cs.LG

基于粒度球计算的自适应k近邻分类器

基于粒度球计算的自适应k近邻,通过粒度球划分和自适应邻域动态确定k值,提升精度和效率。

04:00
arXiv cs.LG

信息不对称的分幕式马尔可夫决策过程中的去中心化多玩家Q学习

三类信息不对称的分幕式表格MDP下,去中心化多玩家Q学习遗憾界匹配单智能体(至多对数因子)。

04:00
arXiv cs.LG

超越结果奖励:步骤级自蒸馏策略优化用于深度搜索智能体

针对深度搜索奖励稀疏,提出证据锚点与步骤级自蒸馏优化,仅在错误轨迹上按步优势加权,效果超越GRPO。

04:00
arXiv cs.LG

理解纵向联邦学习中的后门漏洞:研究与实践的鸿沟

纵向联邦学习后门研究脱离实际,评估有缺陷;新基准推动务实防御。

04:00
arXiv cs.LG

用动作条件预测一致性诊断JEPA世界模型

提出ACPC诊断:度量干净与扰动视图在相同动作下的分歧,上界预测误差和规划成本,并定义IR与SR指标。

04:00
arXiv cs.LG

动量作为深度学习优化的残差驱动乘子校正

提出AIM框架,将动量视为残差驱动的乘子校正;依此设计RADAR优化器,实验验证优于强自适应基线。

04:00
arXiv cs.LG

目标才是瓶颈:潜在世界模型编码了规划器用不上的信息

规划目标才是瓶颈;仅替换目标函数,无需重训,长程成功率从26%升至98%,规划不再受视界限制。

04:00
arXiv cs.LG

I-SDPO:实例级自适应自蒸馏策略优化

针对组相对策略优化全错无信号,本方法按实例自适应,仅全错时用自蒸馏,避免偏差,科学知识评估平均准确率升至70.31%。

04:00
arXiv cs.LG

CardioState-JEPA:延迟感知的跨模态共享心脏表征学习

提出多模态心脏基础模型,学习共享表征,延迟对齐处理时序偏移,25项任务性能显著提升。

04:00
arXiv cs.LG

重新审视Q-learning的过估计偏差问题:通过动作交集解决大规模离散动作空间

提出动作交集策略:两Q函数共享部分数据实现半解耦,在大型动作空间灵活调节偏差,性能超越SOTA。

04:00
arXiv cs.LG

H-VAEP 与 H-xT:通过概率估计评估手球进攻持球动作价值

首个将xT与VAEP适配手球,用德甲五赛季数据验证,提出H-xT/H-VAEP评估进攻持球动作,并开源代码。

04:00
arXiv cs.LG

基于近体学奖励建模的深度强化学习社交合规导航

提出近体学奖励建模,改进深度强化学习社交导航,在保持性能的同时提升社交合规性。

04:00
arXiv cs.LG

多视角不平衡感知的6G波束成形优化与性能

不平衡感知实验发现网络特征预测6G波束成形最佳;聚类主要受部署环境/设备类型影响;带宽、传感器、移动性最重要。

04:00
arXiv cs.LG

FlowLOB:基于流匹配的高效可控限价订单簿生成

提出FlowLOB生成限价订单簿轨迹,用流匹配仅需10步求解器即可高效采样,真实性和可控性优于基线,并零样本迁移到新标的。

04:00
arXiv cs.LG

对《通过将贝叶斯先验提炼进人工神经网络来模拟快速语言学习》一文的评论

M&G方法未真正注入先验,仅初始化权重;整体贝叶斯解释存疑;MAML过拟合,泛化能力差。

04:00
arXiv cs.LG

面向可解释且可信的热需求预测的全局特征重要性研究

提出一种事前可解释AI方法,用四种无扰动方法评估热需求预测模型全局特征重要性,提升可解释性与可信度。

04:00
arXiv cs.LG

学习数学性质以设计低互相干二元感知矩阵

提出基于学习的感知矩阵构造法,无需数据集,以互相干性质为损失函数,生成低互相干二元矩阵,降低计算成本。

04:00
arXiv cs.LG

关系深度学习中的增量评估与训练

提出增量多阶段评估训练范式,应对关系深度学习中的时序概念漂移,证明迁移学习有效,微调模型优于从头训练。

04:00
arXiv cs.LG

用于检测呼吸跃变型水果中碳化钙催熟及货架期估计的多光谱框架

提出非侵入多光谱框架,区分自然/乙烯利催熟与碳化钙催熟水果,估算成熟进度与剩余货架期;芒果准确率95%,香蕉81%。

04:00
arXiv cs.LG

面向大规模表格数据上可扩展TabPFN推理的平衡自适应原型选择

提出平衡自适应原型选择为表格基础模型构建紧凑上下文在百万行数据上保持性能与校准压缩约两千倍无需显卡

04:00
arXiv cs.LG

利用约束感知扩散学习混合整数规划中的离散决策

提出图扩散模型生成混合整数规划的离散决策,并将可行性投影融入逆扩散过程,大幅提升可行性与求解速度,最高加速425倍。

04:00
arXiv cs.LG

采样运气冒充分配收益:审计神经组合优化的测试时预算分配

神经组合优化采样预算均匀分配在分布内无收益;基于统计的分配在分布偏移下显著提升,并给出修正法。

04:00
arXiv cs.LG

潜在同策略自蒸馏

提出潜在同策略自蒸馏(LOPD),使特权上下文可端到端学习;在工具使用与代码生成上超越现有方法,且仅用30%的采样预算。

04:00
arXiv cs.LG

神经网络关系验证的分支定界方法

提出基于对偶公式选择最优分割神经元的分支定界框架,通过迭代分割关系神经元进行验证,优于现有方法。

04:00
arXiv cs.LG

ProME:原型-边际环境与修复感知选择的群组鲁棒学习

提出ProME,以原型边际划分环境、修复感知选择,对齐部署预测器,理论有界,实验最差组精度最优。

04:00
arXiv cs.LG

基于CNN和LSTM网络的脑电解码

提出CNN-双向LSTM混合网络提取时空特征,对运动想象脑电的二/三分类稳健,且具备跨受试者解码能力。

04:00
arXiv cs.LG

面向合成转录组数据的新型知识引导生成方法

提出MK-TGAN,融合基因图谱先验知识,改进合成转录组数据的真实性与实用性。

04:00
arXiv cs.LG

基于耦合张量分解的知识引导模式发现

提出知识引导的张量分解方法,联合分析真实与模拟数据,提升噪声代谢组学模式发现,并揭示数据与模型差异。

04:00
arXiv cs.LG

超越模拟基准:真实数据稀缺下跌倒检测的运动表征评估

真实数据稀缺下,模拟基准高估性能。核/基础模型退化严重,物理增强符号表征最稳。

04:00
arXiv cs.LG

电力变压器中的虚拟温度传感器:基于神经常微分方程

提出物理感知神经常微分方程框架,从时间序列预测变压器热行为,经挪威15台不同设计变压器验证,实现鲁棒标准预测。

04:00
arXiv cs.LG

进入时间序列的ORBIT:基础模型的训练机制

提出ORBIT训练范式,显式控制数据分布与上下文及预测长度,训练Falcon-2.0,结合新目标函数,实现强零样本预测。

04:00
arXiv cs.LG

TANGCO:学习面向过载驱动级联故障的拓扑感知容量分配

提出图神经网络策略学习抗级联故障的容量分配,超越四种人工启发式,鲁棒性提升明显,并可迁移至新网络。

04:00
arXiv cs.LG

历史信息拉格朗日神经网络

基于历史信息,用循环编码器从位置序列提取潜在上下文,推断速度与参数,实现高精度长期预测和能量守恒。

04:00
arXiv cs.LG

基于马尔可夫跳跃扩散的对称性破缺从头晶体生成

提出SbCD模型,用马尔可夫跳跃扩散模拟对称性破缺,生成完整晶体结构,性能大幅超越现有方法。

04:00
arXiv cs.LG

探针方向是其提示词的属性

探针方向取决于提示词选择而非模型;模型仅占评分方差小部分,需用多个提示词才能可靠比较。

04:00
arXiv cs.LG

测量位置决定测量结果:基于消融的SAE评估中的位置选择

消融评估SAE时,测量位置随字典变化,导致多数方差;固定同一token后方差近零。报告因果指标必须附测量位置。

04:00
arXiv cs.LG

进化的时间价值

提出LVPG,利用进化时间价值做长视界信用分配,提升策略性能并减少回撤。

04:00
arXiv cs.LG

训练AI科学家复现研究

开发可扩展论文复现任务,用自动评分器评估,训练27B参数智能体超越闭源模型,迈向长期科学创新。

04:00
arXiv cs.LG

当局部方差最优性不足时:用于动态4比特量化的RoPE对齐Q/K旋转

RoPE对齐逐对旋转虽达局部方差最优,但未改善动态4比特量化精度,需与全头混合组合。

04:00
arXiv cs.LG

利用黑盒对抗攻击大规模测试全局优化方法

现有基准陈旧,提出以黑盒对抗攻击作为高维优化基准,验证多种进化算法有效,促进与机器学习融合。

04:00
arXiv cs.LG

神经二次型:突发学习与缩放定律的统一最小模型

对称性将各架构统一为二次型最小模型,训练动态化为Lotka-Volterra方程,解释突然学习与幂律缩放。

04:00
arXiv cs.LG

缩减矩阵乘法:面向大模型推理的输入自适应矩阵乘积裁剪

提出免训练、输入自适应的矩阵乘积缩减方法,按保留率裁剪收缩维度,实现精度与效率平滑权衡,加速LLM推理。

04:00
arXiv cs.LG

红外光谱化学传感与分析中从分子到复杂样本的仿真到真实迁移学习

UltraIR预训练于6000万模拟光谱,实现跨仪器/任务的仿真-真实迁移,少样本性能优。

04:00
arXiv cs.LG

带目标正则化的CVR因果效应双稳健估计

针对CVR提出双稳健因果效应估计器,收敛更快,结合目标正则化提升稳定性,实验验证有效。

04:00
arXiv cs.LG

莫罗-约西达非调整朗之万采样的活动迹复杂度界

研究非光滑复合目标的MYULA采样,以活动迹控制离散误差,取代全局曲率,精度依赖由ε^-3改进至ε^-2。

04:00
arXiv cs.LG

恶意软件分类模型的概念漂移检测与自适应再训练

研究发现,基于OCSVM的漂移感知重训在准确率和效率上均优于周期重训及MK-Means等方法,能精准检测恶意软件概念漂移。

04:00
arXiv cs.LG

Vero:AI智能体能构建形式化验证的软件仓库吗?

首个仓库级AI联合实现与证明合成基准Vero,最强智能体仅完成27/43实例。

04:00
arXiv cs.LG

合成人格预训练:从零令牌开始的对齐

提出合成人格预训练,从零令牌植入价值人格,提升宪法遵循与抗越狱,降低道德困境失准,早期干预关键。