11852 条条目 · 106 个活跃源
2026年7月16日
04:00
arXiv cs.LG

分布鲁棒且安全的模仿学习

提出联合处理策略与不确定性偏移的分布鲁棒安全模仿学习框架,实现无人机不确定环境下的安全任务。

04:00
arXiv cs.LG

局部冗余:一种基于合成记忆的可塑性的信息论度量

提出局部冗余作为可塑性信息论度量,用合成记忆的期望平方梯度范数高效计算,实验证明其预测下游性能更优。

04:00
arXiv cs.LG

DeepLoop:循环Transformer的深度缩放

DeepLoop提出考虑参数访问的残差缩放规则,稳定循环Transformer深度扩展,提升验证损失和下游准确性。

04:00
arXiv cs.LG

面向银行交易异常检测的可解释人工智能:内部审计视角

基于隔离森林和SHAP的可解释AI框架,精确率0.91召回率0.88,提升审计决策质量。

04:00
arXiv cs.LG

PQFA:用于多模态分类的融合表示并行量子特征增强

PQFA对融合特征使用浅层量子电路进行后融合增强,以更少参数提升多模态分类性能与缺失模态鲁棒性。

04:00
arXiv cs.LG

CLIP潜在空间的超球面几何:一种语义混合模型

基于von Mises-Fisher混合模型拟合CLIP超球面潜在空间,改进了长尾和分布外检测,揭示其语义混合本质。

04:00
arXiv cs.LG

用于多变量风电场SCADA数据过滤的聚类算法

聚类算法过滤风电场SCADA数据精度优于人工过滤,但需专家参与且工作量减少。

04:00
arXiv cs.LG

从新手到专家:众包感知中针对工人性能演化的成本感知赌博机

针对工人性能随经验递增并收敛的众包感知,提出成本感知在线学习框架,联合学习动态奖励与成本,检测饱和并优化预算,性能优于基线。

04:00
arXiv cs.LG

Structured Reinforcement Learning for Bayesian Persuasion : Application to Intelligent Interactive Driving

04:00
arXiv cs.LG

FastCentNN: 使用熵代理加速质心神经网络

FastCentNN以质心移动为熵代理提前分裂,加速CentNN,保持聚类质量,运行时间降低16%(二维)与5%(高维)。

04:00
arXiv cs.LG

有向图流势恢复的规范不变、参数不敏感正则化

规范不变正则化从有向图流恢复势,参数不敏感且保留动态范围,防止岭回归的序反转。

04:00
arXiv cs.LG

神经网络的黑塞谱如何依赖于数据

推导线性网络黑塞谱,发现分类任务中解锐度与最大类别比例直接相关,预测鲁棒。

04:00
arXiv cs.LG

最大鲁棒性满意贝叶斯优化

提出高效贝叶斯优化方法,寻找对最大输入扰动鲁棒的满意解,适用于优化可控但部署后受扰的场景。

04:00
arXiv cs.LG

SIGReg目标作为变分自由能:JEPA世界模型的理论主动推断解释

SIGReg消除先验校准差距,使JEPA目标成为精确变分自由能并对应信息瓶颈;VICReg等不安全,模型缺失状态认知价值。

04:00
arXiv cs.LG

中文标题:微结构条件代理模型用于菌丝复合材料梯度多尺度优化

中文摘要:基于超网络的条件代理模型实现菌丝复合材料多尺度优化,梯度设计使峰值应力降低42%。

04:00
arXiv cs.LG

NodeImport:基于节点重要性评估的不平衡节点分类

通过平衡元集评估节点重要性,动态筛选有价值节点,有效缓解类不平衡,提升图节点分类性能。

04:00
arXiv cs.LG

约束驱动的模型优化:现代机器学习系统中压缩与加速技术选择的行业框架

提出约束驱动的多目标模型优化框架,综合实证证据,指导压缩与加速技术选择。

04:00
arXiv cs.LG

条件可逆神经网络用于数据驱动的无人机控制:二维概念验证

条件可逆神经网络用于无人机控制,开环R²=0.944,闭环位置RMSE与INDI相当,47%跟踪可接受,失败源于指令带宽和数据覆盖。

04:00
arXiv cs.LG

通用函数逼近下的最优高效上下文组合半赌博机

提出SquareCB.Comb算法,达到极小极大最优遗憾界O(√(mAT log|F|)),高效且无需结构假设。

04:00
arXiv cs.LG

DAGR: 通过差分感知目标交叉注意力实现状态条件化的目标表示

DAGR用差分感知交叉注意力状态条件化目标表示,提升导航性能,但非通用改进。

04:00
arXiv cs.LG

MxGPS:用于电力电网基础模型的多重图变换器

MxGPS通过多任务联合训练共享编码器,避免拓扑过拟合,在四个零样本电网中边界违规率为0%,参数仅1.6M。

04:00
arXiv cs.LG

代数可表示性作为Grokking的极限情况:一个具有全纯激活函数的精确可解模型

代数表示性是grokking极限:可表达类坍缩时,网络二值化为立即成功或彻底失败,无记忆与顿悟阶段。

04:00
arXiv cs.LG

分子性质预测的量子与经典拓扑对齐架构实现

提出拓扑对齐归纳偏置,使模型匹配分子键图,量子与经典模型仅用64参数在QM9上达高AUC,实现参数高效。

04:00
arXiv cs.LG

使用CMS 2015D开放数据基于神经样条流的单Z暗物质搜索

用神经样条流在CMS数据中搜索单Z暗物质,联合μμ和ee道设上限,观测上限弱于预期因背景建模偏差。

04:00
arXiv cs.LG

李雅普诺夫指数作为物理信息密集奖励:强化学习发现超越卡皮查摆的稳定化

使用李雅普诺夫指数作为密集奖励,强化学习实现倒立摆严格直立稳定。

04:00
arXiv cs.LG

PiVoT:强杂波下实时大规模多目标检测与跟踪的变分解法

PiVoT通过变分推理实现无训练的端到端多目标检测跟踪,抗杂波且可扩展至千级目标,性能媲美深度学习。

04:00
arXiv cs.LG

基于随机时钟的重尾流匹配

提出HTFM,用随机时钟混合高斯源,提升重尾数据模式覆盖与尾部统计恢复。

04:00
arXiv cs.LG

相关性感知规则:决策树中无关条件的结构性删除

本研究揭示决策树分裂结构机制,提出链接匹配的无关条件删除框架,在保持可靠性下显著简化规则。

04:00
arXiv cs.LG

面向脑肿瘤演变预测与治疗调度的AI增强自适应数字孪生建模

提出AI增强自适应数字孪生框架,融合反应扩散与残差学习、在线更新及模型预测控制,显著提升预测精度并降低肿瘤负荷。

04:00
arXiv cs.LG

面向任务的多AUV系统协同感知与隐蔽传输

提出SVR-MARL框架,利用信息效用优化多AUV协同感知与隐蔽通信,提升任务效率降低暴露风险。

04:00
arXiv cs.LG

VAIOM:连续输入、离散输出的仅解码器金融序列建模

VAIOM用连续输入分类输出解码器模型,在外汇小时数据上概率建模回报,超越LightGBM,验证连续输入与全序列监督的有效性。

04:00
arXiv cs.LG

基于KL散度的非负矩阵分解的高效牛顿算法

提出牛顿型KL-NMF算法,推广HALS求解非可分离代理,收敛快且性能优于现有方法。

04:00
arXiv cs.LG

基于量子厨房水槽的RF频谱图异常检测:架构、表示与硬件验证

多深度重上传QKS在RF异常检测中,DCT表示最优,AUROC达0.8778,硬件验证偏差<0.013。

04:00
arXiv cs.LG

TRACE:基于信用估计的长周期智能体每轮奖励分配

TRACE通过冻结参考模型的对数比状态值和TD变化,无需额外训练即可为长周期工具调用提供稠密奖励,显著提升复杂搜索性能。

04:00
arXiv cs.LG

基于最优传输的线性独立成分分析

提出用Wasserstein距离度量非高斯性,设计OT-ICA算法,无需分布假设,性能优于传统方法。

04:00
arXiv cs.LG

DeepCormack:基于模型的数据驱动算法的费米面断层扫描

DeepCormack用深度学习改进正电子湮灭断层扫描,提升质量并加速费米面研究至数周。

04:00
arXiv cs.LG

灯塔强化学习:通过战略重置点实现样本高效的电路优化

Lighthouse RL通过战略重置点从高性能配置重启,提升样本效率(1.72倍)、优化成功率(100%)和泛化能力,可即插即用。

04:00
arXiv cs.LG

使用高效包装器特征选择改进风能和太阳能预测:一项实证研究

提出CSFS方法,用于风能和太阳能预测特征选择,性能相当且计算成本平均降低21%。

04:00
arXiv cs.LG

利用未标记数据实现可泛化的神经群体解码

提出MOJO框架,联合自监督与监督学习,利用未标记数据提升神经解码性能,在少标签场景表现优异,泛化到多种神经信号。

04:00
arXiv cs.LG

MetaPerch:从元数据中学习用于生物声学基础模型

MetaPerch利用元数据辅助监督,增强生物声学模型表征,应对分布和声学域偏移,跨领域实现强物种识别。

04:00
arXiv cs.LG

秩的变换:架构如何应对深度中的谱病态

Transformer前馈块通过跳跃连接和归一化平衡秩坍缩与集成,双矩阵结构保持秩,影响网络训练性能。

04:00
arXiv cs.LG

预计算TriAttention中的未来偏移平均值

发现TriAttention中未来偏移平均可通过代数恒等式预计算,评分从17次降为1次。

04:00
arXiv cs.LG

HRIBench:以交互为中心的人机协作基准测试

提出HRIBench诊断基准,揭示当前VLA策略在时间协调与意图感知上的局限,微调可显著提升协作性能。

04:00
arXiv cs.LG

保障边缘部署中LLM的安全:隐私与安全挑战

边缘LLM优化引发安全-效率悖论,提出SOES指标与缓解措施,平衡安全、隐私与效率。

04:00
arXiv cs.LG

无线联邦学习中下行链路模型广播的混合时间尺度差分编码

提出混合时间尺度差分编码,应对链路失败,使设备重建全局模型,并设计年龄感知策略提升效率。

04:00
arXiv cs.LG

当文本到图像合成数据适得其反:真实-合成混合训练中放大的隐私风险

首次揭示真实-合成混合训练会放大真实样本的隐私泄露,并提出RSMixLeak评估方法及轻量级风险指标。

04:00
arXiv cs.LG

BARS:良性锚定的排序与选择方法用于减少网络入侵检测中的误报

提出BARS方法,以良性类均值锚定并保序去相关,在攻击占优数据集上误报率降低15%-23%,内存开销低。

04:00
arXiv cs.LG

层次$\mathcal{F}$聚类:聚类成树和有界直径图的近似与难度

提出层次聚类问题的近似算法(树:O(log n log log n),有界直径:O(log n)),并证SSEH下无法常数近似。

04:00
arXiv cs.LG

用于稳定列生成的学习成对深度对偶最优不等式

提出L-PDDOIs学习框架,预测对偶变量成对顺序,减少列生成时间89.7%-93.9%,且保证无边界损失。

04:00
arXiv cs.LG

评估前沿AI智能体作为自主临床安全审计员

测试AI智能体自主执行临床安全审计,Claude Sonnet 4.6和GPT-4.1完美完成,GPT-4o完成率61%。