11852 条条目 · 106 个活跃源
2026年7月3日
04:00
arXiv cs.LG

再谈一次:从强化学习视角重新审视神经量子态

提出PWO算法,将神经量子态变分优化重构为策略梯度问题,采用信任域裁剪,提升大规模训练的稳定性与效率。

04:00
arXiv cs.LG

深度权重空间中推理过程的动态神经图编码

提出动态神经图编码器处理权重空间,捕获推理时序,使INR分类准确率提升约10%。

04:00
arXiv cs.LG

Predicting Early Stages Of Alzheimer's Disease And Identifying Key Biomarkers Using Deep Artificial Neural Network And Ensemble Of Machine Learning Methodologies

04:00
arXiv cs.LG

DecompRL:通过学习模块化代码生成解决更难的问题

DecompRL用强化学习分解问题为模块代码,重组合成候选解,降低GPU成本,解决传统方法无法解决的问题。

04:00
arXiv cs.LG

Understanding the Robustness of Distributed Self-Supervised Learning Frameworks Against Non-IID Data

04:00
arXiv cs.LG

超越Adam:SOAP和Muon实现更快、标签高效的机器学习原子间势训练

SOAP和SOAP-Muon优化器在训练MLIP时比Adam收敛更快、精度更高,尤其在部分力监督下优势明显。

04:00
arXiv cs.LG

神经元感知的无标注LLM自蒸馏数据选择

提出Neuron-OPSD框架,利用神经元激活指导数据选择与教师构建,在线蒸馏提升域内性能并保持泛化,无需标注。

04:00
arXiv cs.LG

DemoPSD:分歧调制的策略自蒸馏

DemoPSD通过分歧调制平衡师生分布,缓解信息泄露,提升探索与泛化,在科学推理任务上超越现有方法。

04:00
arXiv cs.LG

QFedAgent:量子增强的个性化联邦学习用于多智能体活动识别

提出QFedAgent混合量子-经典联邦学习框架,参数减少约10倍,活动识别准确率97.7%。

04:00
arXiv cs.LG

面向大语言模型的神经元感知主动少样本学习

NeuFS利用神经元激活模式选择高价值样本,提升少样本学习性能与多样性,减少模型幻觉。

04:00
arXiv cs.LG

面向时间序列预测的极端自适应Transformer

Exformer通过局部、步长和极端注意力稀疏组件建模正常与极端事件依赖性,在四个径流数据集上3天预测表现最佳。

04:00
arXiv cs.LG

基于ReLU神经网络的o-极小结构中二分类任务的快速逼近与学习

用ReLU网络逼近o-极小结构中可追踪集,得逼近率,再结合熵估计得二分类学习率,误差阶N^{-m/(m+pn-p)}。

04:00
arXiv cs.LG

空中签名解锁:基于点-体素交叉注意力网络的虚拟与增强现实认证界面

提出空中签名认证界面,基于点-体素交叉注意力网络,在VR/AR中实现安全自然交互,错误率低至2.5%。

04:00
arXiv cs.LG

精确先验变分自编码器(X-VAE):学习数据自适应的潜变量分布高斯混合先验

X-VAE用自编码器潜变量统计作先验,引入缩放因子平衡多样性与保真度,提升可控性和样本质量。

04:00
arXiv cs.LG

嵌入推断攻击

黑盒检索中,通过精心查询可推断嵌入模型(嵌入推断攻击),在RAG系统中有效,并提出了相似度阈值等缓解策略。

04:00
arXiv cs.LG

用于麦克风阵列协方差矩阵上采样与声学成像的CNN模型

用CNN将4麦协方差上采样至32麦,最佳RMSE 0.432,有效提升声学成像分辨率。

04:00
arXiv cs.LG

基于注意力信息融合原型的小样本开放集音频分类

提出融合注意力信息的原型生成方法,实现小样本开放集音频分类,能识别已知类并拒识未知类,性能优于现有方法。

04:00
arXiv cs.LG

量子代价景观中的沟壑:改进VQA预测的机遇

利用NEB算法分析量子代价景观沟壑,构建集成预测框架,提升VQA性能并降低计算成本。

04:00
arXiv cs.LG

Bi-NAS:通过双层神经架构搜索实现推荐系统的有效与个性化解释

提出Bi-NAS框架,结合LLM,通过双层搜索优化推荐解释,提升准确性与个性化。

04:00
arXiv cs.LG

Enerzyme:高效训练反应性神经网络势用于酶催化的框架及其在甲基转移酶中的应用

提出Enerzyme框架,以少于1000数据点高效训练神经网络势,实现酶催化反应近化学精度模拟并展示可迁移性。

04:00
arXiv cs.LG

来自TRIBE的全局预测fMRI驱动信号无法预测YouTube重播热力图

TRIBE模型预测脑信号与YouTube重播行为无显著相关,零结果稳健。

04:00
arXiv cs.LG

BIFROST:为观测空间模拟到现实迁移搭建不变特征表示桥梁

BIFROST利用跨域双模拟目标学习共享表征,实现模拟到现实的零样本策略迁移。

04:00
arXiv cs.LG

边界感知量化:神经分类器的有限尺度决策几何

量化在低比特下显著改变决策边界,边界感知停止策略可有效减少边界偏移和预测翻转。

04:00
arXiv cs.LG

Hamm-Grams:一种挖掘字节正则表达式的算法

提出基于固定长度单字符通配符正则表达式(hamm-grams)的恶意软件特征挖掘算法,利用局部敏感哈希与聚类,提升分类检测鲁棒性。

04:00
arXiv cs.LG

完全随机缺失数据下k均值聚类的统计性质

给出MCAR下k-means聚类中心估计的√n-收敛性和渐近正态性,以及收敛到真中心的充分条件。

04:00
arXiv cs.LG

平均场强化学习

从马尔可夫决策过程视角介绍平均场强化学习,涵盖理论框架、模型分析、动态规划与Q学习,桥接控制与学习方法。

04:00
arXiv cs.LG

使用离散度校准分数量化盲估计房间嵌入的不确定性

提出框架学习鲁棒房间嵌入与不确定性分数,通过多视图KL对齐和秩优化,仅需单次语音即可有效预测。

04:00
arXiv cs.LG

量子启发视觉:利用波粒二象性进行低光照增强

该研究将图像建模为概率波函数,利用光的波粒二象性物理不确定性,提升低光照增强的可解释性与鲁棒性。

04:00
arXiv cs.LG

MMAO-Cls:面向联合特征选择与分类器调优的代谢多智能体优化

MMAO-Cls实现特征选择与分类器调优的混合空间搜索,测试性能优于随机搜索及GA-lite,特征子集最紧凑,但差异不显著。

04:00
arXiv cs.LG

Lynx:用于加速长上下文推理中KV传输的渐进式推测量化

Lynx通过拆分KV缓存为主锚流和残差流,实现渐进传输与推测解码,显著降低首令牌延迟并保持高精度。

04:00
arXiv cs.LG

库普曼算子理论:基础、控制与应用

库普曼算子通过可观测量线性化非线性系统,用EDMD等数据驱动方法实现有限维近似,并用于控制器设计与Koopman MPC。

04:00
arXiv cs.LG

重新思考语义分割中的事后校准

提出平移不变和决策保持校准,改善校准指标且避免分割退化。

2026年7月2日
04:00
arXiv cs.LG

表征作为机制可解释性的瓶颈:显现单元协议

提出显现单元协议,将神经网络组件分析结构化,自动填充并支持查询,显著提升检索效果且满足因果标准。

04:00
arXiv cs.LG

TallyTrain:通信高效的联邦蒸馏

仅传输argmax类索引,实现三个数量级通信减少,非IID下表现优于软标签蒸馏,匹配或超越多种基线。

04:00
arXiv cs.LG

GRPO、Dr. GRPO与DAPO:同一数值的三种运算——组标准差恒等式

三种推理训练方法本质是调整组标准差:分歧决定更新大小,一致则无学习。

04:00
arXiv cs.LG

SNAP-FM: 面向物理约束生成建模的稀疏非线性加速投影

利用稀疏非线性优化加速物理约束生成采样投影步骤,在PDE基准上高效满足约束。

04:00
arXiv cs.LG

SemiScope: 在半监督安全分类中解耦分类器调优与联合优化

通过解耦实验,发现仅调优分类器即可恢复联合优化86%增益,推荐更简方案:自训练+贝叶斯调优+阈值调整。

04:00
arXiv cs.LG

过滤式生成器混合模型用于全合成生存训练

FoGS通过过滤异构生成器样本合成生存数据,在隐私受限临床环境中匹配或超越真实数据训练效果。

04:00
arXiv cs.LG

EVOTS:面向时间序列预测的进化Transformer搜索

提出EVOTS框架,通过进化搜索发现任务自适应Transformer模型,在多元时间序列预测中取得竞争性结果。

04:00
arXiv cs.LG

FRAME:使用分数傅里叶专家混合学习适应域

提出分数傅里叶专家混合,专家阶数可学习并插值空间与傅里叶域,自然去相关,提升多任务性能且开销小。

04:00
arXiv cs.LG

可验证奖励用于校准概率预测

提出无标签可验证奖励及梯度掩码,仅用该奖励训练7B模型达到市场校准水平。

04:00
arXiv cs.LG

热力学AI模型的规模化

提出可扩展反向传播算法训练深度网络用于伊辛机热力学推理,准确率达94.9%,揭示推理成本与准确率权衡。

04:00
arXiv cs.LG

TRIE:随机偏微分方程代理模型的评估框架

TRIE框架评估随机PDE代理模型,点训练网络失败,生成模型最佳,潜在生成模型可提速12倍。

04:00
arXiv cs.LG

StateFlow: 面向长时域时间序列预测的双状态循环建模

StateFlow双状态循环模型利用VARNN捕获主动态和残差记忆,分块解码器直接多步预测,两阶段优化,性能强且紧凑。

04:00
arXiv cs.LG

像冠军一样玩:潜在空间中的反事实反馈生成

提出反事实路径生成框架,为星际争霸II玩家提供多粒度改进反馈,平衡路径发现与可操作性。

04:00
arXiv cs.LG

理解客人偏好与优化双边市场:以Airbnb为例

通过经济建模和因果推断,分析客人预订行为与偏好差异,优化定价和个性化匹配,平衡供需。

04:00
arXiv cs.LG

设备通行证:使时空预训练模型能够跨输入布局泛化

提出Device Passport,融合功能与元数据学习通道嵌入,显著提升预训练模型在新设备布局上的泛化能力。

04:00
arXiv cs.LG

弱形式核岭回归从含噪声数据中学习动力系统

提出弱形式核岭回归(WKRR)学习动力系统,结合弱形式滤波与核回归,在混沌和高维流体数据上表现优越。

04:00
arXiv cs.LG

基于块刘易斯权重的分布鲁棒线性回归

提出群组分布鲁棒最小二乘算法,利用块刘易斯权重构造实现(1+ε)最优解,复杂度优于内点法,可平滑插值平均与鲁棒损失。

04:00
arXiv cs.LG

在模拟复杂系统上验证因果抽象度量

引入复杂系统基准评估三十余种度量,唯有因果度量结合忠实性测试有效,提出CAE作为通用验证度量。