11662 条条目 · 106 个活跃源
2026年8月5日
04:00
arXiv cs.LG

面向单细胞生成的自回归Transformer缩放

首次为单细胞基础模型拟合双指数缩放律与计算最优边界,用自回归变换器和量化VAE生成基因表达向量。

04:00
arXiv cs.LG

用于标记化电子健康记录的联邦生成式事件模型

联邦生成事件模型跨机构训练表现优,迁移损失小,接近集中式性能,主要挑战是学习可迁移表示。

04:00
arXiv cs.LG

图信号处理视角下的LLM上下文学习中数值序列表示

研究发现LLM数值推理中,注意力图与隐状态频谱随输入复杂度分化,形成跨模型一致的内在签名。

04:00
arXiv cs.LG

AcceptMoE:面向高效MoE投机解码的承诺加权自适应验证专家集

承诺加权缓存感知自动筛选验证专家,精度降0.27%,吞吐1.29/2.06倍,传输减约75%。

04:00
arXiv cs.LG

联合仿射谱整形:超越仅权重Muon的权重与偏置更新耦合

提出联合正则逆谱整形,耦合权重与偏置更新,较仅权重整形提升准确率至85.7%、损失降至0.329。

04:00
arXiv cs.LG

并行液体启发逼近网络:面向柔性作业车间调度的高效表示学习

提出PLAN网络,以并行离散化液体动态实现轻量表示学习,调度性能平均提升1.2%-2.3%,延迟降低13.2%-31.7%,参数减少至基线的22%-47%。

04:00
arXiv cs.LG

凸包邻域平滑对偶泛化:控制离线强化学习中的局部修正传播

提出CSDG,将备份分解为样本内目标与局部修正,用混合系数控制传播,无需额外惩罚,性能稳定优异。

04:00
arXiv cs.LG

基于配对受者的尸体供肾移植生存预测评估

提出配对受者评估框架,五种生存预测模型准确率均约60%,较C指数更贴合临床。

04:00
arXiv cs.LG

SMOPD:通过特化-合并在线策略蒸馏实现的多奖励强化学习

提出特化-合并在线策略蒸馏(SMOPD),先训练奖励特化教师,再蒸馏为单一学生策略,解决稀疏与密集奖励信号失衡问题,性能优于GDPO。

04:00
arXiv cs.LG

不确定性下Q学习中TD目标聚合的再思考

提出后继展开聚合深度Q网络,借助动力学模型一步预测约束TD目标聚合,抑制不可靠最大值,减轻过度估计,提升稳定性。

04:00
arXiv cs.LG

在多尺度灰盒贝叶斯优化中利用可分离性

利用灰盒可分离性:外层贝叶斯优化黑箱变量,内层全局优化白箱子问题,遗憾更低、迭代耗时更少。

04:00
arXiv cs.LG

SynEnergy:面向合成能源数据生成的异常语义引导扩散

异常语义引导两阶段扩散,生成保留异常的能源数据,异常保真提升12.21%,下游提升2.96%

2026年8月3日
04:00
arXiv cs.LG

利用物理信息深度学习从显微图像预测钢材疲劳寿命

物理信息深度学习直接从显微图像预测钢材疲劳寿命,R²=0.93,单图耗时<65ms,可替代传统力学测试。

04:00
arXiv cs.LG

GRU、LSTM与Transformer编码器在自动驾驶系统分类中的敏感性分析

评估三种模型分类自动驾驶系统,干净数据宏F1约0.9;事件干扰影响小,时间抖动致F1大幅下降。

04:00
arXiv cs.LG

大语言模型令牌生成的动态系统可区分性保证

将LLM响应分类形式化为两随机线性动态系统假设检验,证明分类错误率随序列长度指数衰减,并给出跨嵌入条件。

04:00
arXiv cs.LG

面向分离式GPU推理的拓扑感知数据移动

分离式推理KV缓存传输无视拓扑差异,提出拓扑感知优化,流水线重叠与CXL扩展,延迟降3-18倍

04:00
arXiv cs.LG

层次化Copula-Gumbel-Top-K路由:固定每令牌路由律下冻结专家混合模型的双侧依赖控制

提出层次化Copula-Gumbel-Top-K路由,固定每令牌路由律下以组内正相关、组间负相关调节专家负载,冻结模型不变,仅训练控制器。

04:00
arXiv cs.LG

MPP-GNN:面向fMRI阿尔茨海默病分类的受试者自适应社区检测

提出MPP-GNN,通过双层优化自适应划分脑功能模块并引导边细化,在AD分类上达到最高AUC,且与Yeo图谱高度对齐。

04:00
arXiv cs.LG

LAWFUL:面向潜变量忠实使用的定律对齐见证框架

LAWFUL框架弥合连续变量物理定律的可解释性缺口,验证神经网络是否内部使用多普勒定律。

04:00
arXiv cs.LG

LARA:残差流中的轻量适配器,用于可组合的适应与对齐

LARA在残差流加低秩校正,不碰权重,性能同LoRA,支持多行为按token路由,仅33MB开销。

04:00
arXiv cs.LG

检测与管理老年人认知障碍的技术进展:趋势、挑战与未来方向

人工智能与多模态技术助力老年人认知障碍检测管理,外部验证与标准化是挑战,未来需个性化方案。

04:00
arXiv cs.LG

SEDR-Seq2P:用于多任务工业非侵入式负载监测的轻量级膨胀残差序列到点网络

提出轻量级SEDR-Seq2P,用于工业多任务NILM,融合膨胀残差与SE注意力;相对Seq2Point降MAE 7%、升R² 1%,相对WaveNet降延迟58%。

04:00
arXiv cs.LG

Mitigating Class-Tail Undercoverage in Medical Vision-Language Models under Clinical Shift

04:00
arXiv cs.LG

TAGTorch:用于几何、拓扑与对称感知机器学习的PyTorch库

TAGTorch库,统一拓扑代数几何,涵盖预处理、架构、训练与分析,填补生态缺口。

04:00
arXiv cs.LG

镜像学习

提出镜像学习,用视频扩散模型和逆动力学将第三人称观察转成伪第一人称数据,提升模仿学习,替代遥操作采集。

04:00
arXiv cs.LG

缺失数据下的流匹配

将缺失坐标作为潜变量平均损失;证明在完全随机缺失下修正精确,方差不增,单次补全最优,实验验证。

04:00
arXiv cs.LG

预训练机器学习原子间势表征作为材料生成与评估的粗粒度坐标

预训练原子间势(如MACE)粗粒度特征用于材料生成与评估,提出CFTD距离同时衡量质量与新颖性,并指导生成模型。

04:00
arXiv cs.LG

用于增强复杂离散选择任务决策的机器学习方法分析

评估四种ML模型在五种选择规则上的表现:半/非参数优于参数,性能随训练集和确定性提高,案例TNN最佳。

04:00
arXiv cs.LG

超梯度双级强化学习:提升样本复杂度

提出免海森矩阵的超梯度双级RL算法,利用玻尔兹曼策略最优性,实现O(ε⁻¹)迭代复杂度与最优样本复杂度,并去除PL假设。

04:00
arXiv cs.LG

将大语言模型知识蒸馏至轻量级强化学习智能体以用于自主网络作战

用网络安全大模型指导强化学习,经在线策略蒸馏至6万参数轻量智能体,在CybORG中保持防御能力。

04:00
arXiv cs.LG

物理信息神经网络与神经算子的特征交互建模

将因子分解机特征交互融入物理信息神经网络与神经算子,提升参数化PDE求解,对激波主导方程增益显著。

04:00
arXiv cs.LG

MMFGU:多模态联邦图遗忘

MMFGU基于目标特定表示解耦,实现多模态联邦图细粒度遗忘,保持保留效用且提速41.5倍

04:00
arXiv cs.LG

通过图神经网络学习最优动态匹配

提出基于图神经网络的价值强化学习框架,学习残差图价值,动态匹配策略优于贪婪规则。

04:00
arXiv cs.LG

挖掘神经网络验证中的判定边界

针对分支定界验证低效问题,利用路径单调性同时分割多个激活函数,指数搜索精确定位判定边界,跳过无关子问题。

04:00
arXiv cs.LG

门控Q学习:按需添加离策略偏差

提出门控Q学习,以连续门控机制按需调整离策略偏差,延长资格迹并加速学习,避免重要性采样。

04:00
arXiv cs.LG

潜变量李-泊松神经网络(LLPNNs):通过可观测数据与潜在动力学揭示李-泊松系统的运动

提出潜变量李-泊松神经网络,从可观测数据学习李-泊松动力学,保持几何结构,适用退化哈密顿系统,预测精准。

04:00
arXiv cs.LG

基于Shapley值的特征归因用于数据脱敏

提出基于Shapley值的特征归因框架,在特征层平衡隐私风险与数据效用,不依赖特定方法,实验显示可降低风险并保持效用。

04:00
arXiv cs.LG

通过异构编辑重组克服LLM驱动程序优化中的最弱环节效应

提出HERO:异构编辑重组克服最弱环节效应,提升LLM程序优化效率与效果。

04:00
arXiv cs.LG

基于并行架构的随机梯度方法自适应性

提出并行框架,组合静态梯度法提升自适应性;多处理器按几何序列搜索T并执行随机梯度下降至满足收敛。

04:00
arXiv cs.LG

反思还是再生成?为何大模型修订失败而人类修订成功

大模型反思实为条件式再生成:客观题零增益,主观题负增益,远不及人类修订的正向效果。

04:00
arXiv cs.LG

恰当损失的交换不可知学习的快速速率

针对恰当损失,提出交换不可知学习离线算法,获得最优快速率(log|H|/m)^{2/3},并归约为二阶多校准。

04:00
arXiv cs.LG

FairDiffuseVQVAE:通过向量量化潜变量的条件精化实现表格扩散中的采样时公平性

提出两阶段扩散模型矢量量化自编码加扩散精化推理时均匀采样保护属性实现公平公平指标最优AUC降15

04:00
arXiv cs.LG

高效大模型对抗训练:低秩防御与电路引导代理

提出两种加速策略:防御端用表征微调并解决令牌匹配问题,攻击端提取相关电路构建轻量代理模型,兼顾效率与理论保证。

04:00
arXiv cs.LG

超越特征与结构对齐:为图基础模型学习可迁移的传播知识

提出传播感知图基础模型,将边与特征维度的传播关系作为可迁移单元,经原型库学习跨域传播知识,实现自适应聚合,提升泛化。

04:00
arXiv cs.LG

学习用于神经网络验证的前瞻引理

提出基于前瞻的验证框架,生成不稳定ReLU引理并构建蕴含图剪枝,在Marabou和α-β-CROWN上性能提升,证明不可满足实例增34%。

04:00
arXiv cs.LG

基于动态交互场的SILVA网络:结构化隐层与向量吸引子

提出SILVA网络,在不动点架构中分离刺激、局部/全局交互、阻尼与读出;实验显示各作用因任务而异,便于训练诊断。

04:00
arXiv cs.LG

异构压缩客户端下的联邦基础模型微调

提出奇异值分解联邦微调,自包含客户端,嵌套流形与两阶段聚合,置信损失降噪,优于基线,内存减半。

04:00
arXiv cs.LG

动力学感知的稀疏噪声数据控制方程识别

针对稀疏噪声导数估计不可靠,用库普曼上采样预处理,提升微分方程辨识精度,优于非动力学方法。

04:00
arXiv cs.LG

DFSC:面向分数阶科学机器学习的误差可控可微分Mittag-Leffler传播

误差可控的可微分分数阶传播方法,用米塔格-莱弗勒谱层分离已知动力学与数据修正,自适应保证精度,支持多算子路径。

04:00
arXiv cs.LG

基于蒙特卡洛树搜索的多智能体系统自主修复

提出MARS框架,用蒙特卡洛树搜索自主修复多智能体系统,结合诊断引导和分类评估,性能提升且成本相当。