11632 条条目 · 106 个活跃源
2026年8月11日
04:00
arXiv cs.LG

多模态可穿戴时间序列数据中采用ORCA式动态归纳偏置自适应的智能体异常检测

ORCA框架:推理时按轻量统计动态调时间感受野,免重训达AUROC 0.99,异质临床数据稳健。

04:00
arXiv cs.LG

自适应性的代价:跨学习问题的匹配下界

提出切片归一化极小极大比刻画自适应代价,获高斯认证有限时域组合律,匹配上下界,实验验证。

04:00
arXiv cs.LG

DistillCache:KL引导的自适应KV缓存淘汰策略,实现内存高效的LLM推理

提出DistillCache强化学习框架,以KL散度奖励指导KV缓存淘汰,在25%预算下保持94.2%准确率,优于现有方法。

04:00
arXiv cs.LG

超越路由:稀疏混合专家中专家调度与聚合的解耦

稀疏MoE中,路由器的专家选择与输出聚合可解耦;固定选择、仅训练轻量聚合头(FDAA)能显著提升性能。

04:00
arXiv cs.LG

元辛神经网络的逼近速率

扩Barron空间至元辛变换,证元辛字典浅层网络蒙特卡洛逼近界;字典原子构建深度网络,解含时薛定谔方程优于物理信息网络。

04:00
arXiv cs.LG

双生展开:交互式视频世界模型中的噪声耦合反事实分支

提出双生展开框架,精确耦合噪声生成反事实轨迹,并用可验证的时空局部性度量评估。

04:00
arXiv cs.LG

想法搜索:以想法引导树搜索探索多样化科学方法

将动态思路库融入树搜索,打破纯树搜索瓶颈,提升单细胞测序数据整合评分。

04:00
arXiv cs.LG

SoftMCC:类别不平衡下无阈值模型选择的MCC-Brier校准桥

SoftMCC结合MCC与Brier校准,实现无阈值模型选择,稳定性领先但效用无优势。

04:00
arXiv cs.LG

梯度显微镜:内存高效梯度计算方法资源利用基准评测

梯度累积最稳,显著降损失;Adam并非通用最优;检查点效果依架构而定,GPU利用率差异大。

04:00
arXiv cs.LG

视觉-语言表示学习中的动态分布感知不确定性跟踪

提出动态分布感知不确定性量化框架,利用高斯混合模型动态估计不确定性,适应测试分布变化,性能超越现有方法。

04:00
arXiv cs.LG

F2STNet:面向图预测的公平联邦频谱-时序建模

提出F2STNet联邦预测框架,结合图傅里叶与状态空间建模,经公平聚合提升精度和客户端指标。

04:00
arXiv cs.LG

数学视觉图表:评估大语言模型数学图表生成能力的综合基准

首个数学图表生成基准,统一评估文本转代码与图像,精选2920个竞赛题图,专家筛选,发现LLM生成能力不足。

04:00
arXiv cs.LG

HOPPER:线性化图序列模型的可学习跳数提取

提出可学习的跳序列提取方法HOPPER,适应图与任务,保持置换等变性,在长程基准上达最优或竞争力,提升图表示学习。

04:00
arXiv cs.LG

基于机制可解释性的面部与语音无标签帕金森病筛查

提出无标签帕金森筛查,融合语音合成退化与面部异常检测,AUROC达0.802。

04:00
arXiv cs.LG

基于电子健康记录数据的域结构化集成框架用于围手术期结局预测

提出域结构化集成框架,基于EHR预测围手术期结局,术后谵妄AUROC达0.899,优于单阶段模型,校准良好。

04:00
arXiv cs.LG

RAVEN:物理信息交互指纹与冻结随机图储备池用于蛋白质-配体结合亲和力预测

提出RAVEN模型,用冻结随机图编码器结合物理化学指纹和异构回归器,在相似性划分数据集上实现强预测性能。

04:00
arXiv cs.LG

SwiftQK:面向查询-键归一化的快速通信高效张量并行方法

SwiftQK提出多GPU RMSNorm核,仅交换标量统计量并重叠通信与计算,使QK-Norm延迟降低81.4%~93.9%,端到端TPOT较基线降29.5%。

04:00
arXiv cs.LG

得分驱动滤波器中尺度参数的在线学习

将增益作为决策变量在线学习,证明镜像更新的动态遗憾界;实证显示有界镜像增益优于常数增益且避免极端尖峰。

04:00
arXiv cs.LG

真实数据弥补光学化学结构识别中的合成到真实差距

仅用合成图像训练时识别器在真实文档上性能骤降;加入少量真实标注数据可大幅提升准确率,效果因基础模型和适配策略而异。

04:00
arXiv cs.LG

概率电路诱导的伪度量用于分布外检测

利用概率电路内部层级,提出层级似然向量与距离,实现无需留出数据的无监督分布外检测,性能优于基线。

04:00
arXiv cs.LG

表格数值拉伸变换

提出拉伸变换框架,将数值特征预处理转为优化问题以平滑目标函数;监督拉伸在38数据集上优于全部基线。

04:00
arXiv cs.LG

MARA:流匹配引导的多智能体资源分配,用于计算资源高效学习

提出MARA,用流匹配预测损失轨迹,多智能体协同分配离散计算资源,任务完成率比LARA高8.54个百分点。

04:00
arXiv cs.LG

强噪声下轴承故障诊断的时频双域多尺度卷积神经网络

提出时频双域多尺度CNN,融合时域与频域特征,强噪声下轴承诊断精度达92.5%,较单域提升7.25%

04:00
arXiv cs.LG

超越可解性:任务可学习性作为LLM强化学习后训练的静态先验

提出TrajVal,从短探测与端点评估估计任务可学习性,作为静态先验提升RL后训练数据效率。

04:00
arXiv cs.LG

FedA2L:去中心化联邦学习中的自适应分层学习率调整

针对数据异质性下统一学习率导致的收敛低效,FedA2L基于模型分歧动态调整层学习率,无需额外通信,加速收敛并减少通信。

2026年8月10日
04:00
arXiv cs.LG

面向可靠的长时程智能体上下文压缩:执行不稳定性的实证研究

提出TRACE框架,用验证器引导的成对延续评估压缩,提升长时程智能体任务性能与稳定性。

04:00
arXiv cs.LG

固定与自适应拓扑深度算子网络:Hausdorff局部凸空间上的泛函测量

提出基于连续线性泛函的固定/自适应拓扑DeepONet,适应非赋范空间,误差分解,在达西流、Navier-Stokes等任务上精度高且内存低。

04:00
arXiv cs.LG

潜在事实核查:通过激活工程检测虚假信息

基于激活工程提取虚假方向,投影末词元至感知机分类,无需微调或检索,证明事实线性可分。

04:00
arXiv cs.LG

分片防止LLM监督失误与对抗性利用

分片将需求分组独立判断,提升专家一致性;即使较弱模型也可胜过整体判断,并能抵御对抗性利用。

04:00
arXiv cs.LG

SNI-GNN:智能网卡辅助的全图GNN训练与网内嵌入预测

SNI-GNN用智能网卡预测嵌入,减少通信21–45%,加速1.3–3.6倍,精度损失≤0.01,可扩展至16GPU。

04:00
arXiv cs.LG

噪声感知下智能体的风险感知决策策略

生物感知噪声下,盲目信任标签致败,不确定性感知策略提升生存率,行为从探索转向保守,凸显不确定性决策重要性。

04:00
arXiv cs.LG

MiGHT-EHR:面向异质时序电子健康记录的多任务图Transformer

提出MiGHT-EHR,统一建模异质实体、纵向轨迹与任务关联,在MIMIC-III/IV上四项临床预测中表现优越,尤其死亡与再入院预测,且表征可解释。

04:00
arXiv cs.LG

ED-CSP:从电子衍射预测晶体结构

新框架ED-CSP利用电子衍射斑点集预测晶体结构,基于485万模拟数据训练,MR@5达57.49%,优于PXRDGen,并证实真实生成能力。

04:00
arXiv cs.LG

对抗性因果干预证伪

提出对抗性因果干预证伪:实验者选择干预检验生成模型因果,区分观测拟合与干预等价,保证识别与收敛。

04:00
arXiv cs.LG

超越注意力:BiomeGPT风格微生物组Transformer中的有符号积分梯度归因

BiomeGPT符号积分梯度归因采用源派生基线,区分菌群致病/保护信号,二阶Hessians揭示交互。

04:00
arXiv cs.LG

鲁棒平均奖励马尔可夫决策过程:基于插入式约简的极小极大最优学习

在生成模型下,学习ε最优鲁棒策略的极小极大样本复杂度,涉及名义/鲁棒偏差跨度,提出插件约简算法。

04:00
arXiv cs.LG

基于表格基础模型的自举条件动作选择

提出一种自举条件动作选择方法,重采样历史,条件化预训练模型选动作,引入臂上下文条件化,后悔度优于基线

04:00
arXiv cs.LG

CrystalGRPO:面向流模型晶体结构预测的目标对齐与覆盖保持强化学习

提出一种后训练框架,联合坐标-晶格策略,融合能量与匹配奖励并覆盖保持;Q模式提升单次命中,C模式提升二十次命中。

04:00
arXiv cs.LG

揭示移除预算混杂:自适应数据清洗的匹配操作点评估框架

自适应清洗的改进常源于移除预算混杂;匹配操作点后多数优势消失,仅特定低患病率与高召回场景保留真实判别力。

04:00
arXiv cs.LG

隐藏拜占庭攻击下多智能体协同系统的在线安全学习

研究隐藏拜占庭攻击下多智能体在线协同安全,刻画信息论极限,提出鲁棒估计-决策学习器并证明遗憾界。

04:00
arXiv cs.LG

目标加权奈曼分配:总体偏移下异质性处理效应的实验设计

提出一种两阶段分层设计,兼顾部署重要性与测量难度,优化目标加权处理效应精度,稳健应对总体构成不确定。

04:00
arXiv cs.LG

通信高效、稳健且实用的分布式与联邦优化的理论基础

提出ProxSkip等新算法,解决联邦学习七大理论与实践难题,实现通信加速与鲁棒性。

04:00
arXiv cs.LG

量化损伤是乘性的,而非加性的

量化损伤是乘性而非加性:决策裕度随位宽收缩,可预测翻转,修复成本最低是增加一个比特。

04:00
arXiv cs.LG

基于牛顿-舒尔茨回缩的推理方法使隐量子马尔可夫模型超越经典HMM

提出基于牛顿舒尔茨回缩的推理算法,首次证明隐量子马尔可夫模型在非量子数据上优于经典HMM,性能提升。

04:00
arXiv cs.LG

CertBind:从多模态连接到可认证检索决策

提出多尺度可认证组合理论:直接路由保留,标记路由恢复,决定性认证,未决弃权;实验恢复0.963无伤害。

04:00
arXiv cs.LG

状态流:强化学习中的神经ODE正则化

提出神经ODE正则化,使潜在状态遵循ODE流,对齐环境动态,提升强化学习性能。

04:00
arXiv cs.LG

扩散语言模型的线性注意力改造

提出块混合注意力,线性化前缀注意力,保留活跃块精确注意力。改造LLaDA仅60小时训练,吞吐提升1.7倍,性能基本保持。

04:00
arXiv cs.LG

稀疏语者

提出差异感知剪枝法,保持输出差异以区分相似输入,超越现有基线,提升大模型稀疏化。

04:00
arXiv cs.LG

对跖分离提取孤立无偏置GLU前馈块的密码分析

用有限差分曲率与x/-x配对观测分离提取GLU块,中位误差<1%,但非端到端攻击。

04:00
arXiv cs.LG

狄利克雷跟随领导者弥合同时多类U校准的差距

提出狄利克雷跟随领导者算法,基于贝叶斯自助法,同时对所有有界及光滑适当损失达到最优遗憾率,消除维度差距。