11672 条条目 · 106 个活跃源
2026年7月31日
04:00
arXiv cs.LG

重尾噪声下Adam的收敛行为

首次证明普通Adam在重尾噪声下收敛至(ρ,ε)-稳定点,但复杂度次优且依赖p;已知域半径时可最优。

04:00
arXiv cs.LG

EvoCause:基于LLM引导的因果图演化用于根因分析

EvoCause利用大语言模型提出因果图编辑,结合专家标签优化根因分析,在合成数据和真实电信基准上显著提升性能。

04:00
arXiv cs.LG

THGFM:双分支时间异构图融合模型

提出双路径架构,融合共享与关系分区时间注意力,引入旋式时间注意,显著提升学术图基准性能。

04:00
arXiv cs.LG

位置而非来源:区分医学视觉语言模型中的推理中介与谄媚

提出CoT-Mediate:推理注入方式影响医学视觉语言模型,位置而非来源决定其采用生成推理。

04:00
arXiv cs.LG

ZUNA1.1:一种更灵活的脑电基础模型,用于去噪与超分辨率

提出380M参数的扩散自编码器,支持任意通道位置及30秒脑电序列重建,性能优于标准方法,开源。

04:00
arXiv cs.LG

TIER-MoE:生物医学分类中多模态融合的基于条件模态风险的信任引导专家路由

模态预期损失定可靠性,结合专家兼容性稀疏路由,在生物医学多模态分类中性能与校准优于SOTA,零样本泛化强。

04:00
arXiv cs.LG

基于压缩的行为相似性:以太坊开放世界女巫发现

利用压缩距离分析交易语法,无需资金关联即可检测以太坊女巫账户,抗时间漂移与对抗扰动。

04:00
arXiv cs.LG

探索式建模:解锁第三预训练轴与端到端生成

探索式建模通过K候选匹配选优训练,实现端到端生成,提升图像、视频、语言性能,效率大幅提升,成为新预训练轴。

04:00
arXiv cs.LG

区块链分析中的建模决策:树模型与序列模型的泄漏感知评估

泄漏感知下,树模型胜出:XGBoost优于序列模型,延迟能耗更低,实时检测女巫机器人。

04:00
arXiv cs.LG

ECG-InterpBench:基于匹配尺度稀疏自编码器的心电图基础模型可解释性基准

提出ECG-InterpBench基准,用匹配容量稀疏自编码器系统评估六个心电图基础模型的可解释性,生成450单元图谱,揭示不同模型在重建保真度与临床可及性上各有优劣。

04:00
arXiv cs.LG

FunL2O:LLM引导的学习优化特征函数设计

提出FunL2O框架,用LLM程序进化自动设计L2O特征函数,在连续与离散优化中优于手工特征。

04:00
arXiv cs.LG

基于条件注意力的上下文感知船舶轨迹预测

提出条件注意力,将天气作为条件而非特征,模态掩码防回退,精度提升15.4%,回退误差降近一个数量级。

04:00
arXiv cs.LG

好的排序器,坏的目标:表达性策略搜索下的双线性对比批评者

对比批评者排序虽好,但作为目标最大化不安全;双线性分数范数漂移导致离支撑假阳性,需值校准标量。

04:00
arXiv cs.LG

面向对撞机物理的多域自适应轻量级基础模型

NEXUS:3百万参数轻量基础模型,预训练于对撞机数据,小样本下游任务高效,可迁移至引力波等多领域。

04:00
arXiv cs.LG

SE(3)-MeanFlow:李群上的少步蛋白质骨架生成

提出SE(3)-MeanFlow,将MeanFlow扩展至李群,实现少步蛋白质骨架生成,性能匹敌甚至超越多步流匹配。

04:00
arXiv cs.LG

低信噪比下信道建模的神经网络辅助CLEAN方法

提出NN-CLEAN,将神经网络嵌入CLEAN迭代,避免网格搜索,5dB时精度达96%,大幅降低复杂度,适用MIMO实时信道估计。

04:00
arXiv cs.LG

神经网络中的隐状态:从模型权重恢复漂移数据的时间结构

用HMM从模型权重轨迹恢复数据漂移的隐状态;同状态内迁移优于跨状态,且不能由时间邻近或类别分布解释。

04:00
arXiv cs.LG

FADEx:基于特征归因与失真的降维解释

提出基于泰勒展开与奇异值分解的局部特征归因法,不受降维方法限制,兼具失真分析,性能优于现有方法。

04:00
arXiv cs.LG

施赖埃尔陪集图重连

提出施赖埃尔陪集图重连法,基于特殊线性群构造低阻旁路,降低有效电阻5-40%,缓解瓶颈并保持精度。

04:00
arXiv cs.LG

矩阵三因子分解中稀疏性诱导的可识别性

针对一般实值矩阵三因子分解,首次建立稀疏性诱导可识别性的严格理论,提出分解策略并推导恢复保证,实验验证理论。

04:00
arXiv cs.LG

策略梯度引导:行为目标驱动的干预

现有引导方法失效;提出策略梯度引导,用行为目标梯度构造任务向量,实现可组合行为干预。

04:00
arXiv cs.LG

结合近邻树与集成学习扩展数据无关的关键实例选择模型

提出一种基于相似性的分层可解释关键实例选择模型,兼容多数据类型,优于其他选择策略,且保持少量关键实例。

04:00
arXiv cs.LG

用于少步生成的潜核离散流映射

提出潜核离散流映射,用共享潜变量聚合多个分解组件,实现相关少步生成,困惑度提升2.1-3.3倍。

04:00
arXiv cs.LG

显式视图路由何时有效?多视图图-文本对齐的受控研究

多视图图-文本对齐中,显式视图路由能显著提升标签和属性检索,但拓扑不专一,且不证明自由路由或等同专家。

04:00
arXiv cs.LG

减法还是回放?语言模型记忆中的精确删除

精确删除取决于记忆表征:可寻址记录用减法删除,纠缠写入需回放重建,实验验证了不同规模模型中的效果与代价。

04:00
arXiv cs.LG

中医式表面肌电手势识别的蒙太奇无关编码器

提出蒙太奇无关编码器,实现跨用户肌电手势识别,无需标定,优于基线,且随用户数增加性能稳定。

04:00
arXiv cs.LG

内存高效的表格基础模型

压缩模型可降低内存至1/7.6,性能相当,部署需求降约87%。

04:00
arXiv cs.LG

多活动情境下里程碑驱动型初创企业的策略

研究多活动初创企业里程碑情境下的最优策略:由风险性和成本效益的有效前沿曲线决定,曲线类型随参数变化。

04:00
arXiv cs.LG

表面肌电手势解码中跨记录会话的识别与无标签自适应

跨会话编码器无需调整即可用,宏F1 0.688超每用户基线;仅特征统计对齐的无标签自适应有效。

04:00
arXiv cs.LG

源中心状态演化的循环Transformer

提出源中心状态演化(SCSE),以零偏差掩码实现锚点精确不变,兼顾输入条件化,提升多数据集文本质量。

04:00
arXiv cs.LG

MUGEN:高效运动理解与生成的统一框架

MUGEN是一种统一运动-语言框架,无需码本,单次采样即可高效理解和生成,多项基准最优。

04:00
arXiv cs.LG

Prox:大语言模型中基于近似中间通道显著性的免训练FFN激活稀疏化

提出两阶段免训练稀疏框架,用近似中间通道显著性和量化代理权重构造掩码,实现前馈网络稀疏执行,提升质量与速度。

04:00
arXiv cs.LG

从未来回望:基于反因果惊奇的键值缓存管理

提出反因果惊奇的缓存淘汰法,删除可被未来预测的冗余token,无需训练,并具快速近似加速。

04:00
arXiv cs.LG

Compliance2LoRA:通过超网络生成的LoRA适配器实现任意策略子集的按需安全对齐

提出超网络生成LoRA适配器,按需对齐任意策略子集,单模型实现多策略合规且不损性能。

04:00
arXiv cs.LG

基于无悔学习的实时硬性峰值信息年龄安全

将硬峰值AoI期限转化为仿射半空间约束,提出OCO-PAoI-Hard算法,实现零逐时隙违规与O(√T)遗憾。

04:00
arXiv cs.LG

自适应实验何时合理:基于决策时信息的认证

提出OPAL框架,用预承诺合同决定是否启用自适应实验,控制风险并保证价值,实验验证其有效性与安全性。

04:00
arXiv cs.LG

分布式网络上用于鲁棒核心集选择的一阶约束三层优化

提出分布式鲁棒核心集选择的三层约束优化框架及F2CTO算法,首个此类方法,达ε-稳定点的非渐近收敛率O(ε^{-3/2})。

04:00
arXiv cs.LG

EEG情绪识别中的评估协议与跨受试者泛化

EEG情绪识别准确率受评估流程影响;受试者依赖与跨受试者结果差异大,应分别报告。

04:00
arXiv cs.LG

卡尔曼遇见课程:面向自适应强化学习微调的高效动态提示选择

基于卡尔曼滤波的提示选择将难度建模为动态状态,自适应策略漂移,无需额外采样,提升精度与效率,达到最优。

04:00
arXiv cs.LG

NMINE:归一化互信息神经估计

提出全神经归一化互信息估计器,融合MINE与MI-NEE,高斯数据上优于KSG基线。

04:00
arXiv cs.LG

理解基于子模信息度量的表示学习目标:方差与分离视角

统一理论揭示子模信息度量作用:总量信息刻画类内方差/协方差,互信息刻画类间分离,实验验证。

04:00
arXiv cs.LG

FedOGL: 对抗联邦开放世界多模态图学习中的灾难性遗忘

提出FedOGL框架,保留语义结构记忆,将灾难性遗忘性能下降降低42.67%,同时保持或提升下游任务表现。

04:00
arXiv cs.LG

低秩适配的紧样本复杂度:匹配界与秩选择

低秩适配的样本复杂度上界与下界均为O~(rd/n);最优秩等于内在秩,过参数化对无正则经验风险最小化有害。

04:00
arXiv cs.LG

DAS-PMVC:一种通过双重对齐与结构增强的部分多视图聚类框架

提出DAS-PMVC框架,利用双对齐与结构增强进行部分多视图聚类,性能超越现有方法。

04:00
arXiv cs.LG

VESTIGE:一种知识引导的掩码策略,用于基因组Transformer的腐蚀感知微调,并在古DNA重建上验证

提出按位置腐蚀分布掩码的VESTIGE,替代均匀掩码,在古DNA重建中显著提升性能,且适用于多种序列腐蚀场景。

04:00
arXiv cs.LG

事件结构化物理信息神经网络用于可微临界清除边界

提出事件结构化物理信息神经网络,精确链接事件阶段,定义可微稳定边界,高效准确估计临界清除时间。

04:00
arXiv cs.LG

迈向具有最优批量大小调度的联合缩放定律

揭示学习率与批量大小联合影响,推导最优批量调度,联合缩放定律优于静态基线。

04:00
arXiv cs.LG

利用双教师信息瓶颈蒸馏改善对抗攻击下的鲁棒性/准确性权衡

双教师信息瓶颈蒸馏:交叉层注意力传递干净与鲁棒特征,保持对抗鲁棒性并提升干净准确率。

04:00
arXiv cs.LG

ROCS:面向请求的计算共享实现高效大规模推荐

提出面向请求的计算共享范式,延迟交互,按请求共享计算,提升效率与质量,已大规模部署。

04:00
arXiv cs.LG

小规模训练,大规模部署:通过几何重整化实现图神经网络的零样本迁移

几何重整化粗粒化图训练GNN,可直接零样本迁移至原始大图,保持性能并降低训练成本。