11852 条条目 · 106 个活跃源
2026年7月8日
04:00
arXiv cs.LG

遗忘算法审计

提出审计器通过推理攻击计算遗忘参数下界,严格算法界小,经验方法界大,可假设检验否定声明。

04:00
arXiv cs.LG

K-ABENA:基于误差N-排除的K自适应反向传播算法(补偿损失样本排除与无偏梯度估计)

提出K-ABENA算法,通过补偿损失排除低损失样本实现无偏梯度估计,节省28-54%计算且性能与全批量SGD无显著差异。

04:00
arXiv cs.LG

AbICL:面向抗原特异性抗体亲和力排序的上下文学习

AbICL利用上下文学习框架提升抗原特异性抗体亲和力排序性能,在AbRank基准上优于现有方法。

04:00
arXiv cs.LG

基于行为与语言模式的信息操作用户无监督异常检测

提出无监督TENSOR方法,融合时间行为与语言模式检测信息操作用户,效果优于基线。

04:00
arXiv cs.LG

水平穿越密度作为隐式神经表示的无网格高频辅助损失

提出无网格Minkowski泛函损失,比持久同调快250倍,但3D中存在采样盲区,持久同调仍更可靠。

04:00
arXiv cs.LG

基于高阶累积量的含隐变量线性因果最稀疏DAG学习

本文提出有限样本方法,用高阶累积量恢复含任意隐变量的最稀疏DAG,性能优于现有方法。

04:00
arXiv cs.LG

利用外梯度实现深度学习中有效的锐度感知最小化

提出EISAM优化器,通过外梯度两步更新提升泛化,降低扰动半径敏感度,优于SGD、Adam和SAM。

04:00
arXiv cs.LG

漂移在所难免:神经架构对时间分布偏移鲁棒性的实证研究

实证比较多种神经网络架构,发现利用局部高判别特征的模型随时间退化快,预训练编码器因稳定表示退化慢。

04:00
arXiv cs.LG

学习何时自动化:人机服务系统中的队列控制

提出UCB-DPP策略,平衡自动化和人工负载,学习未知参数,实现亚线性遗憾和队列稳定。

04:00
arXiv cs.LG

SplineNet:一种用于复杂壳体的等几何深度学习方法

提出SplineNet,等几何深度学习无缝集成CAD/CAE,无数据或数据驱动求解复杂壳体力学行为。

04:00
arXiv cs.LG

稳定性退火选择平滑符号下降的隐式偏置:可分离数据上的速率索引障碍路径

稳定性退火使平滑符号下降的归一化迭代收敛到凸Burg障碍最小化器,刻画了静态几何与对偶路径。

04:00
arXiv cs.LG

面向在线自监督回声状态网络的可扩展扰动学习

通过正交分解分离输入依赖分量,仅扰动该分量,降低有效维度,避免方差随储层增长。

04:00
arXiv cs.LG

x预测即一切:基于端点可解码性的免训练加速生成

提出免训练的截断跳跃采样(TJS),利用端点可解码性提前停止ODE并解码,减少20-70%计算量,质量几乎不变。

04:00
arXiv cs.LG

正常建模即一切:面向多模态信息物理系统的联合潜在聚类异常检测

提出MIIM假设与联合潜在聚类,在三个真实CPS数据集困难子集上AUROC领先,优于深度检测器。

04:00
arXiv cs.LG

自监督隐式CEST重建:基于物理约束的洛伦兹编码

基于物理约束洛伦兹编码的自监督CEST重建,39点采样达57.58dB PSNR和0.9994 SSIM。

04:00
arXiv cs.LG

X-FEMR:一种基于Transformer模型的电子健康记录基础模型的令牌级可解释方法

首次提出令牌级可解释方法,用Transformer代理模型识别关键令牌,临床对齐指标验证,实现可信临床AI。

04:00
arXiv cs.LG

Canopy:面向代谢工程的异构图基础模型

Canopy整合多源数据构建异构图基础模型,预训练后发酵滴度预测R²=0.41,优于基线。

04:00
arXiv cs.LG

在先进加速器上的生成式AI模型性能优化与比较分析

针对生成式AI模型部署挑战,提出混合精度后训练量化评估与微调策略,在HPC和先进加速器上进行分析比较。

04:00
arXiv cs.LG

TILDE:基于倾斜分布擦除的概念遗忘方法

通过分布对齐实现最少偏差条件分布,在有效遗忘的同时保留良性生成质量。

04:00
arXiv cs.LG

张量程序的定量高斯过程极限

给出随机神经网络无限宽极限的定量误差界(宽度平方根倒数),适用于前馈、循环和Transformer架构。

04:00
arXiv cs.LG

物理信息驱动的偏微分方程解族神经嵌入

提出物理信息神经网络框架学习PDE解族嵌入,实现有效降维,2-4个主成分捕获95%方差,频谱轮廓稳健可重复。

04:00
arXiv cs.LG

EntroPath:用于流形学习的最大熵路径系综嵌入

基于最大熵路径系综的流形学习法,恢复测地几何并收敛于平方测地距离,在非均匀采样和分支轨迹上表现优异。

04:00
arXiv cs.LG

GraphBU:基于图原生块单元的MILP实例生成

GraphBU以局部子问题及接口为基本单元生成MILP实例,保持结构,图统计相似度0.934,可行性96.7%,下游PS指标提升8%。

04:00
arXiv cs.LG

图卷积注意力:图去噪和扩散的谱视角

提出图卷积注意力,利用图谱去噪,克服线性注意力局限,提升图去噪与扩散性能。

04:00
arXiv cs.LG

遍历性破缺与涨落-耗散定理违反导致机器学习超越过拟合的泛化能力

动态平均场理论表明,双下降泛化行为源于遍历性破缺相变,响应函数类似超导模型。

04:00
arXiv cs.LG

SHARC:基于SHAP的可解释性在ICAAP和CCAR监管资本机器学习风险模型中的应用

提出SHARC框架,用SHAP分解压力VaR,揭示均值成分主导资本水平,实现可审计解释。

04:00
arXiv cs.LG

深度神经变分空间:深度与复杂性的统一视角

提出深度网络统一函数空间理论,证明范数约束下深度不增加功能多样性,高频特性消失。

04:00
arXiv cs.LG

黑洞黑箱:基于AInstein神经网络的数值黑洞度量

扩展AInstein无监督神经网络至洛伦兹度规,验证施瓦西黑洞并搜索新的一般型解。

04:00
arXiv cs.LG

回归的高阶认证鲁棒性

提出回归认证鲁棒性新框架,利用梯度信息获得比现有方法更紧的证书。

04:00
arXiv cs.LG

在Jean Zay超级计算机上预训练Lucie 7B开源大语言模型的生命周期评估

评估Lucie 7B预训练生命周期,涵盖硬件制造、使用及废弃,报告碳排放、水耗与热回收,为节俭AI设计提供参考。

04:00
arXiv cs.LG

生产环境中稳定模型更新的全范围二分类器校准

提出全FPR曲线校准方法,保证模型更新后分数的一致FPR含义,相对误差≤7.2%,校准产物<200KB。

04:00
arXiv cs.LG

保留还是适应?泛化持续学习

挑战保留中心论,提出转移效率和关键任务阈值,引入预测性持续学习算法,优于传统方法。

04:00
arXiv cs.LG

将GNSS导出的天顶湿延迟融入天气基础模型提升降水预报

首次将GNSS天顶湿延迟融入Aurora模型,强降水预报显著提升,99百分位ETS提高8.8%。

04:00
arXiv cs.LG

DBNN:基于深度二值化神经网络的神经尖峰分类

提出DBNN实现98.7%尖峰分类准确率,无乘法器推理,硬件面积0.014mm²、功耗122nW,适用于低功耗植入式脑机接口。

04:00
arXiv cs.LG

物理正则化机器学习用于车载传感器本体感知定位

提出PRML2混合框架,结合卡尔曼滤波与可微机器学习,实现物理正则化,提升定位精度与泛化能力。

04:00
arXiv cs.LG

IMR:用于多智能体轨迹预测的迭代模式-世界加权回归

提出模式-世界加权回归损失与迭代解码器,解决多样性与精度问题,在Argoverse 2上排名第一。

04:00
arXiv cs.LG

超越启发式调优:基于功效校准的大语言模型水印技术

提出功率校准统计框架,量化参数与检测/失真关系,实现最优权衡,实验验证帕累托最优。

04:00
arXiv cs.LG

均值场贝叶斯神经网络中的宽度鲁棒可学习性

无限宽度与多项式宽度可学习性等价,由缩减熵多项式有界决定

04:00
arXiv cs.LG

关于具有对称散度的图拉普拉斯算子的收敛性

对称散度与距碮平方误差有界,确保图拉普拉斯逐点收敛,以Sinkhorn散度为例。

04:00
arXiv cs.LG

从闭环优化到开放决策:面向预测与自主显微镜的耦合数字孪生

耦合数字孪生框架支持从闭环优化到开放决策,实现扫描探针显微镜的预测与自主操作。

04:00
arXiv cs.LG

基于强盗学习的上下文采购拍卖

提出三种机制,权衡遗憾与激励,实现接近最优的上下文采购拍卖学习。

04:00
arXiv cs.LG

基于列表可解码编码的Boosting

利用列表可解码编码,新算法对满足闭包性质的类仅需O(log(1/ε))次弱学习器调用,突破下界。

04:00
arXiv cs.LG

关于带有双边几何包络保护机制的L-BFGS逆海森近似矩阵条件数上界

提出双边几何包络L-BFGS,动态约束逆海森条件数有界,保持线性复杂度,保证非凸收敛,数值实验提升稳健性。

04:00
arXiv cs.LG

基于证据Mamba的车辆本体定位不确定性感知速度校正

提出EVC-Mamba,利用Mamba和证据学习从车载数据生成虚拟速度传感器,校正IMU漂移,定位精度达外部传感器10%以内,支持40Hz实时。

04:00
arXiv cs.LG

面向旋转曲面码的延迟约束硬件感知量子纠错协同设计与自适应置信门控神经解码

自适应置信门控解码融合神经网络和MWPM,仅路由3.3%-6.2%症候即提升逻辑精度至99.81%。

04:00
arXiv cs.LG

资源受限嵌入式设备上小型语言模型微调的节能GPU DVFS

针对资源受限嵌入式设备上SLM微调,提出基于ML的DVFS设置选择,在Jetson AGX Orin上平均节能13.11%。

04:00
arXiv cs.LG

通过检索增强生成和约束解码减少大模型生成的Web API调用中的错误

提出RAG与CD互补减少LLM生成API调用错误:RAG减少幻觉但可能引入多余参数,CD确保合法性,共同提升正确性。

04:00
arXiv cs.LG

TriA管道:面向特定场景音频分类的大规模自动音频标注管道

TriA管道自动标注音频,构建2130小时数据集,家庭分类准确率提升3.97%,F1提升3.35%。

04:00
arXiv cs.LG

从时空事件数据中发现频繁闭合嵌入子有向无环图

提出从时空事件数据中发现频繁闭合嵌入子DAG的模式挖掘方法,效率显著优于现有算法。

04:00
arXiv cs.LG

多通道扩频代码水印

提出多通道扩频代码水印,24位载荷,后验无训练,抗攻击鲁棒性强,检测准确率高。