11392 条条目 · 106 个活跃源
2026年9月18日
04:00
arXiv cs.LG

ZeroHAT:行为条件化的零样本人类活动轨迹生成

ZeroHAT迁移源域行为并结合目标域公开上下文,零样本生成目标区域活动轨迹,十城实验下游效用达最强基线4.5–6.4倍。

04:00
arXiv cs.LG

训练神经网络以逼近密集多发射器定位中的最优贝叶斯估计器

用合成帧训练神经网络,逼近密集发射器定位的最优贝叶斯估计器,为高通量、大视场、超高时空分辨率SMLM提供依据。

04:00
arXiv cs.LG

基于有限元预训练潜在动力学的稀疏观测地震场地反应预测

提出FLARE-T,以有限元预训练潜在动力学结合稀疏记录校准,提升多深度地震场地反应预测精度。

04:00
arXiv cs.LG

使用相同前向映射的自编码器的精确重建界

研究同一前向映射自编码器,导出最小均匀重建导数误差精确界,并用激光雷达森林扫描验证;增一隐藏维误差极低。

04:00
arXiv cs.LG

常数步长下非线性双时间尺度随机逼近的偏差

研究常数步长下非线性双时间尺度随机逼近,界定两迭代的均方误差与偏差为 O(α+β²/α²) 并证其紧,揭示非线性特有的有限时间效应。

04:00
arXiv cs.LG

COMPASS:十万规模下的有序聚类路由

提出COMPASS算法求解有序聚类旅行商问题,融合搜索与学习加速,支持10万节点且性能领先。

04:00
arXiv cs.LG

在道德风险与逆向选择下学习面向公平小农户碳农业的委托—代理合同

用强化学习设计碳农业合同:利润最大化聚合商放大排斥小农户,因MRV成本随规模递减;按面积计费消除差距。

04:00
arXiv cs.LG

无限制有界契约下的极小极大最优在线契约设计

研究重复契约设计,m种结果下T轮极小极大遗憾达T^{m/(m+1)},并给出最优学习策略与下界。

04:00
arXiv cs.LG

SCGFM-ART:面向以结构为中心的图基础模型的摊销关系传输

SCGFM-ART用分摊关系传输对齐异构图到共享关系图谱,跨域14任务最优,推理快44–85倍。

04:00
arXiv cs.LG

基于深度学习的脑电信号认知与静息状态分类

提出CNN-GRU框架,结合时频特征分类EEG静息与认知状态,三任务准确率76.1%~83.4%。

04:00
arXiv cs.LG

水中微塑料的射频检测与分类

提出ML辅助射频介电谱流式平台,无标记检测分类水中微塑料,八类F1超0.71,盐水环境仍有效。

04:00
arXiv cs.LG

扩散语言模型的并行性、关键窗口与分离结果

证明均匀/高斯扩散可高效并行,且与掩码扩散存在可证明的并行性分离,因后者关键窗口更窄。

04:00
arXiv cs.LG

多源数据的分布鲁棒联邦学习

构建局部模糊集并集式全局模糊集,兼顾客户端间混合与内部分布不确定性,提出联邦算法并证明收敛与泛化保证。

04:00
arXiv cs.LG

当 EOS 词元不一致时:理解在线策略蒸馏中的长度膨胀

在线策略蒸馏中学生回答过长,源于师生EOS终止符不匹配;共享语义停止动作可缓解,但训练后期仍有长度膨胀。

04:00
arXiv cs.LG

CrystalMO-TuRBO:面向高精度联合晶体结构精修的多目标信赖域贝叶斯优化

提出CrystalMO-TuRBO,将X射线与中子衍射差异作为独立目标,用两阶段多目标信赖域贝叶斯优化实现高精度联合晶体精修。

04:00
arXiv cs.LG

递归量子长短期记忆网络用于稳定的短期气温预测

递归量子LSTM较标准QLSTM在多伦多气温预测中收敛更快、误差更低、泛化差距更小。

04:00
arXiv cs.LG

缓解重复博弈中的报复性算法合谋

提出CURB奖励塑形框架,惩罚TV距离,抑制重复博弈中的报复性算法合谋。

04:00
arXiv cs.LG

FL-Net多中心医学数据挖掘——联邦学习的一站式解决方案

FL-Net整合数据协调、发现与容器化工作流,支撑隐私保护、可复现的多中心临床研究。

04:00
arXiv cs.LG

COIN-GP:基于高斯过程回归的部分测量网络化分布式系统中的协同在线学习

针对分布式传感器网络部分观测下状态与未知动态联合估计难题,提出基于观测器的在线分布式高斯过程协同学习框架,并给出数据采集条件与误差上界。

04:00
arXiv cs.LG

PosteriorBench:从点估计到后验匹配——生成式逆求解器评估新基准

提出PosteriorBench基准,以五项指标评估生成式逆求解器的后验分布精度,揭示现有方法的分布匹配差距。

04:00
arXiv cs.LG

RISC-V与机器学习:综述

综述RISC-V在机器学习中的实现与性能权衡,指出标准化与生态碎片化挑战,提出四大研究方向。

04:00
arXiv cs.LG

流行病学因果图识别:挑战、可识别性与算法

研究混合有序、计数与连续数据的DAG因果发现,证明有序-指数族边方向可识别,提出评分穷举与DAGMA优化。

04:00
arXiv cs.LG

稳定的政策学习

提出政策投票装袋,算法稳定性权衡期望福利与采样风险;子样本投票平均可保留福利并提升风险规避效用。

04:00
arXiv cs.LG

Video DeltaNet:面向直播视频生成的视频原生混合注意力

提出视频原生混合注意力,局部Softmax结合逐帧双向线性记忆,实现直播视频生成14.5倍加速。

04:00
arXiv cs.LG

分数中心化稳定离策略强化学习

揭示训练-推理不匹配的不稳定源于漂移;提出加性分数中心化校正项抵消漂移,稳定RL并可叠加重要性采样。

04:00
arXiv cs.LG

基于广义全变差最小化的联邦软聚类

研究联邦软聚类,用广义全变差最小化耦合个性化GMM,比较三类差异度量,分析收敛与异构鲁棒性。

04:00
arXiv cs.LG

异构传输协议干扰下的校准射频指纹识别

同频干扰下异构协议重叠的射频指纹识别,用一维CNN多标签分类并校准阈值,实测准确率73%–97%。

04:00
arXiv cs.LG

随机点积图后续推断的子流形学习(第一部分:理论)

用Isomap学习随机点积图隐位置低维流形的半监督规则,风险随辅助样本增加收敛至oracle规则。

04:00
arXiv cs.LG

引力波信号中超越广义相对论偏差的深度学习探测:基于真实LIGO噪声的探测阈值研究

基于真实LIGO噪声和GW150914,混合CNN检测引力波超越广义相对论偏差,阈值β≈0.25。

2026年9月17日
04:00
arXiv cs.LG

只为分歧付费:模型更新的认证式无回归判定与匹配的标签复杂度界

DISCERN协议仅对模型分歧样本标注,具有限样本保证与匹配标签复杂度界,56%良性更新零标签通过。

04:00
arXiv cs.LG

反思、修订、复用:面向 GUI 智能体的免训练技能演化

GUI 智能体免训练技能演化框架,借"反思-修订-复用"循环从执行反馈中改进技能,三大基准性能显著提升。

04:00
arXiv cs.LG

Grokking 发生在何处:无需模块切换的分布式效用与傅里叶重编码

Grokking 非模块切换,而是既有分布式电路的傅里叶谱重编码,block-0 注意力与 block-1 MLP 分布式生效。

04:00
arXiv cs.LG

超越静态RAG:面向消费级GPU高效长上下文推理的自适应三指标路由框架

面向消费级GPU的RAG推理,提出免训练三指标路由器,动态选择原始/神经/词法压缩,零OOM并提升F1。

04:00
arXiv cs.LG

厘清算法偏见与档案伪迹:大都会艺术博物馆档案中视觉语言模型估值的受控审计

CLIP大都会馆藏性别估值审计:控制混杂后无显著差异,但指标近噪声底,需防微观偏见与档案幸存偏差。

04:00
arXiv cs.LG

当梯度看见秩:训练矩阵记忆中的可证明必要性、因果招募与组合

梯度训练矩阵记忆可学出所需秩:有效秩随绑定数K增长,秩上限致恢复在K附近跃迁,多次组合仍稳,预测吻合。

04:00
arXiv cs.LG

Temperon:训练时间缩短三分之一,达到全时SAM的质量

前段普通SGD探索,末段SAM+Muon精修,省1/3时间且精度不减,可迁移至GPT-2与GLUE。

04:00
arXiv cs.LG

物理信息神经网络、神经算子及其应用讲义

博士课程讲义,介绍物理信息神经网络与神经算子,涵盖实现、开源库及工程、物理、油藏应用与前沿模型。

04:00
arXiv cs.LG

Fathom:卸载KV缓存上稀疏解码的逐查询读取深度

Fathom为卸载KV缓存稀疏解码提出逐查询读取深度,按位平面与反向注水分配键通道比特,减少访存并提速保精度。

04:00
arXiv cs.LG

改进型多臂老虎机的无先验竞争比:尺度、曲率与视界无需先验,但在噪声下不能同时免费

同时未知尺度与曲率时,适应代价 Θ(√(log k/log log k));知一为常数,无噪声无需先验。

04:00
arXiv cs.LG

缺失的“我不知道”:为何三项推理可靠性发现共同指向校准弃答

三项推理可靠性发现分别指向能力、政策与递归缺口,实则共同缺校准弃答;基准对拒答零奖励,须改革评估。

04:00
arXiv cs.LG

DSD:通过扩散技能发现学习多样且可复用的运动技能

提出扩散技能发现DSD,用分数匹配近似状态分布熵梯度,为高维人形控制学习多样且可复用的运动技能。

04:00
arXiv cs.LG

自由推断维度:假设混合下零碰撞导航的复杂度度量

提出自由推断维度dFI,刻画值混合智能体零碰撞导航的复杂度阈值,并给出泛化界与混合策略最优性。

04:00
arXiv cs.LG

通过投机草稿树加速扩散采样

将扩散投机采样联系相对熵编码,提出草稿树丰富候选,采用贪心拒绝采样耦合,保证精确采样,最高加速8.3%。

04:00
arXiv cs.LG

深度强化学习与模型预测控制共享控制权的复合梯度学习

提出复合梯度学习,将MPC纳入DRL训练,以联合动作建模交互;强交互下部分策略更优,平均提升有限。

04:00
arXiv cs.LG

面向可审计次日野火蔓延预测的模块化深度学习机制

提出三种模块化增强并审计次日野火蔓延预测,表明精度、可信度与计算实用性可兼顾。

04:00
arXiv cs.LG

REVERSAL-BENCH:衡量无重置强化学习悬崖的可逆性轴与重置预言机

提出REVERSAL-BENCH,用可逆性参数与重置预言机揭示无重置RL陷入不可恢复状态的可逆性悬崖。

04:00
arXiv cs.LG

曲线上的SAM:面向鲁棒权重空间插值的锐度感知模式连通性

提出锐度感知模式连通性SMC,约束路径邻域平坦性,提升权重插值鲁棒性,CIFAR-10-C最高提升6.09%。

04:00
arXiv cs.LG

原理性Koopman表示与Kalman推断:实现高效时间序列预测

提出K²SVD,学习Koopman主导奇异函数构建低秩表示,并用Kalman滤波推断,预测更高效精准。

04:00
arXiv cs.LG

二次神经网络的正则化最小二乘训练及其在系统辨识中的应用

提出二次神经网络正则化最小二乘训练,给出权重闭式解、下界及灵敏度,并用于非线性系统辨识。

04:00
arXiv cs.LG

面向演化标签空间下开放世界意图发现的不确定性感知持续学习

提出不确定性感知概率框架,融合后验不确定性与多信号决策,在演化标签空间下持续发现新意图。