11582 条条目 · 106 个活跃源
2026年8月18日
04:00
arXiv cs.LG

一个分数,两种决策:罕见病尾部的选择性预测

罕见病选择性预测需两查:排序器足够正确,置信信号匹配决策。两分差可选但或失信息;无标记分数难断切换。

04:00
arXiv cs.LG

分离面的生成式学习

利用分类器和生成模型,从高不确定区域采样,迭代重建动力系统的分离面。

04:00
arXiv cs.LG

尾部感知的Top-k在线策略蒸馏

提出TA-OPD,保留Top-k蒸馏中缺失的尾部概率,抑制熵增,提升Avg@8达8.05分。

04:00
arXiv cs.LG

一种求解偏微分方程的新型傅里叶特征网络

提出傅里叶特征网络:单隐层傅里叶基函数,最小二乘求系数,免仿射变换,求解偏微分方程精度优于极限学习机。

04:00
arXiv cs.LG

基于可解释神经网络的纳米晶合成尺寸决定机制解析

可解释神经网络揭示纳米晶合成尺寸由三个标量线性方程决定。

04:00
arXiv cs.LG

多尺度物理系统的超分辨数据同化迭代细化扩散方法

提出迭代细化数据同化框架,融合时间先验与生成校正,分层重建超分辨状态,在强多尺度湍流基准上优于现有方法。

04:00
arXiv cs.LG

WANDR:广度和深度研究基准

WANDR基准含500个数据收集任务,要求广泛发现与深度核实,现有最强系统软F1仅0.363,尚未饱和。

04:00
arXiv cs.LG

量子捷径:复相位态动力学缩减序列模型的优化步数

量子式复相位态表示加速序列模型训练:状态空间模型和注意力模型达到同等损失仅需三分之一与二分之一优化步数。

04:00
arXiv cs.LG

ER-KANs:用于数据稀缺科学机器学习的高效鲁棒Kolmogorov-Arnold网络

ER-KAN共享高斯RBF基、课程噪声注入与熵加权正则,在噪杂小数据下比MLP更稳健。

04:00
arXiv cs.LG

基于物理信息神经网络的电池部分放电实时健康状态估计与在线退化预测

基于物理信息神经网络,从任意部分放电曲线估算锂电池健康状态(误差<4%),并实时预测退化趋势。

04:00
arXiv cs.LG

p-自旋玻璃网络:高效单批次持续学习

p-自旋玻璃网络实现内存与样本高效,单批次稳定收敛,去除大批量需求,支持持续学习与边缘AI。

04:00
arXiv cs.LG

生理学信息驱动的数字孪生框架,用于模拟肝脏健康进展

提出肝脏数字孪生HEPATWIN,整合代谢等生理机制,结合患者数据模拟疾病进展,经校准可预测NAFLD、纤维化等,验证效果良好。

04:00
arXiv cs.LG

M-LINKX:基于多视图图学习的脑认知疾病检测

提出多视图图学习框架M-LINKX,融合脑电通道特征与功能连接,提升痴呆症分类性能。

04:00
arXiv cs.LG

NRCD:统一性能标准化的美国大学跑步公开数据库

首个大规模大学跑步公开数据库,含2.9万运动员12.9万成绩,标准化后跨赛变异性降低51%(女)/34%(男)。

04:00
arXiv cs.LG

区分同质性与罕见性:解释图神经网络的失败

研究发现同质节点更易分类,即使罕见;异质节点信息可通过重训分类头恢复。

04:00
arXiv cs.LG

PathFinder:关联多模态数据的联合分解

提出PathFinder方法,通过路径关联矩阵,无需共享维度即可联合分解多模态数据,发现共性模式并预测缺失数据。

04:00
arXiv cs.LG

Grokking是插值流形法向双曲性的丧失吗?

残差Jacobian最小奇异值显示Grokking转变无法向双曲性丧失,支持平滑收缩而非分岔。

04:00
arXiv cs.LG

利用退相干进行简并度计数的量子算法

利用退相干度量与全局最优简并度间的关系,仅测量四比特探针即可计数经典优化问题的全局最优解数量。

04:00
arXiv cs.LG

基于LLM的并行DEVS状态图生成与验证框架

提出大语言模型框架,生成验证PDEVS状态图,用逻辑蕴含修正不一致,提升准确性。

04:00
arXiv cs.LG

帕累托条件化强化学习的命令空间反事实解释

提出CF-ZOO:黑盒搜索最小改变的命令,使帕累托条件策略改选目标动作,生成可操作反事实解释。

04:00
arXiv cs.LG

神经网络能否通过自我实验学习?自我干预学习:从功能后果到预测性自我知识

SIL:网络自我扰动观察后果,学习自身预测模型指导行动;能恢复部分结构,模型不完整,未必优于直接法。

04:00
arXiv cs.LG

任意反馈延迟下的利普希茨老虎机

针对任意反馈延迟的利普希茨老虎机,提出随机/对抗两算法,遗憾界达~O(T^{(d_z+1)/(d_z+2)}+√D),匹配无延迟。

04:00
arXiv cs.LG

决策驱动的正则化:一种学习与优化的混合模型

提出决策驱动正则化双目标模型,平衡预测精度与成本最小化,推广SPO+,数值优于多个基准。

04:00
arXiv cs.LG

几何感知位置编码是否有助于Transformer处理空间不完美信息博弈?

几何感知编码改善信念估计与低数据模仿,但未提升博弈胜率。

04:00
arXiv cs.LG

压缩语言模型的认证:一项审计与统计工具包

压缩模型等价证据不足:净精度差掩盖约5倍翻转,17项声明多未设阈值或公开数据;提出配对等价检验与报告标准。

04:00
arXiv cs.LG

用于逆变器暂态闭环仿真与测量窗口预测的统一Mamba-MoE替代模型

提出Mamba-MoE统一代理模型,同时完成逆变器暂态闭环仿真与测量窗口预测,参数更少且预测区间覆盖良好。

04:00
arXiv cs.LG

基于成对比较反馈的在线凸优化

将成对比较反馈转为近似梯度,获得O(T^{3/4})静态/自适应/动态遗憾;光滑和强凸下改进至O(T^{2/3})和O(√(T log T))。

04:00
arXiv cs.LG

构建高效个性化模型的全局联邦学习策略

直面数据异质性,提出缓解表征崩塌、保留全局知识的训练策略,并发现单全局初始化在充分微调下更优。

04:00
arXiv cs.LG

GATTA:基于测试时增强的图主动学习

提出图主动学习新方法,用测试时增强聚合预测提升不确定性估计,过滤不可靠视图,简单方法媲美复杂模型。

04:00
arXiv cs.LG

EMASAM:通过EMA引导扰动实现计算高效的锐度感知最小化

EMASAM用EMA影子模型与主模型差异定义扰动,免去额外反向传播,降计算成本,保SAM泛化能力。

04:00
arXiv cs.LG

用于含时薛定谔方程的概率保持Transformer

提出硬约束Transformer强制保证含时薛定谔方程概率守恒内在幺正计算效率优于软约束方法

04:00
arXiv cs.LG

PureTD:无评估期搜索的后手棋资金局强化学习

纯自对弈强化学习无需搜索即可训练出接近顶尖水平的后手棋模型,速度快且强于开源引擎。

04:00
arXiv cs.LG

MiNO:PDE的余切丛传播子学习

提出微局域神经算子(MiNO),学习PDE传播子相位与振幅,用振荡积分恢复解,在间断平流中达精度极限,优于PINN和FNO。

04:00
arXiv cs.LG

基础模型适配器的谱秩认证

为LoRA适配器建立有效秩的有限样本推断方法;审计26个适配器表明,校准有效秩通常远小于名义秩,且不同于能量保留。

04:00
arXiv cs.LG

FinFraudBench:面向金融欺诈检测的异质图基准

提出FinFraudBench异质图基准,含两大数据集、六实体十四边,自然欺诈率,评估基线揭示局限。

04:00
arXiv cs.LG

学习重塑内部表示中的幂律各向异性

求解两层网络动力学,发现特征区幂律指数非单调演化,惰性区不变,揭示输入-任务交互生成内部表示幂律各向异性。

04:00
arXiv cs.LG

陆地生态水文学的地球观测基础模型:从表征学习到过程推断

提出框架,指出预训练偏重光学微波、热红外不足,深层推断与物理一致性评估薄弱,需过程感知设计。

04:00
arXiv cs.LG

面向准则评估的语义嵌入结构化:一种原型引导的对比学习方法

提出原型引导对比学习(PGCL),在冻结文本嵌入上做几何正则化,不更新编码器即可提升毒性、情感、评分等准则评估任务。

04:00
arXiv cs.LG

形状算子PCA:面向几何机器学习的曲率感知投影

提出SHOPCA,将形状算子融入PCA协方差,兼顾方差与曲率,无监督选参,提升聚类,小样本胜UMAP。

04:00
arXiv cs.LG

MAPLE:MoE自适应即插即用逐层专家分配

MAPLE按层异质分配专家,不重训练,75%专家超越100%基线,延迟降32.2%,吞吐提47.4%。

04:00
arXiv cs.LG

没有任务每次失败:为何单次审计对智能体损害存在结构性盲区

无任务每次失败;单次审计结构上漏检智能体损害,损害具有随机性,能力越强损害任务越少。

04:00
arXiv cs.LG

不变预训练:构建鲁棒的代码表示

不变预训练用语义保持变换与多正例对比,仅靠代码将鲁棒性在克隆检测提升11点、分类提升19点。

04:00
arXiv cs.LG

卢旺达移动货币洗钱检测:一种机器学习框架

针对卢旺达移动货币洗钱检测,提出机器学习框架,应对类别不平衡,用合成数据训练,高精度下低告警率。

04:00
arXiv cs.LG

1/2-Tsallis-INF 是否也能很好地用于最佳臂识别?

证明1/2-Tsallis-INF无需额外探索也能进行最佳臂识别,错误概率以t^{-2}衰减且指数2紧致。

04:00
arXiv cs.LG

SAGA:融合结构注意力的生成式行为嵌入模型,用于编码多端用户行为序列

SAGA用逐字段分词将跨端行为统一编码,结合字段级注意力与训练目标,提升下游点击和转化。

04:00
arXiv cs.LG

FAST-DeepONet:小样本场景下高维偏微分方程输入的因子增强分支表示

FAST-DeepONet结合固定谱路径与正则化残差投影,在小样本下稳定高维传感器输入;Navier-Stokes误差约0.04,多任务降4.7%-37%,参数少3-7倍。

04:00
arXiv cs.LG

超越场精度:逆PINN参数误差的双轴诊断

提出双轴后训练诊断,区分有限样本分辨率与符号参数偏好,跨多种PDE验证,位移与误差强相关,为后续研究提供方向。

04:00
arXiv cs.LG

迈向未知奖励下推理时对齐的理论

将推理时对齐形式化为弱到强学习,提出对齐维度,证明其有限性完全刻画可学性。

04:00
arXiv cs.LG

SAPE:大型语言模型微调中参数高效的三明治适配器

提出SAPE,一种三明治式硬权重共享的参数高效微调框架,降低内存开销,低参数下达到最优性能。

04:00
arXiv cs.LG

每个专家都算数:ExactMoE实现内存高效的W4A16推理

ExactMoE仅量化路由专家并驻留主机内存,内存降87%,吞吐保82%,精度保99%,专家完整。