11420 条条目 · 106 个活跃源
2026年9月14日
04:00
arXiv cs.LG

神经优化器动力学中重尾谱涌现的维度校正命中时间

将重尾谱涌现视为右删失命中时间问题,发现维度校正谱隙律与条件性理论机制。

04:00
arXiv cs.LG

信息诱导的训练几何:精确约简、规范补全与结构化表达力

训练数据经信息通道约束优化器几何,给出仿射不变正定压缩的精确约简、规范补全与结构化表达力。

04:00
arXiv cs.LG

面向跨维度大规模最优传输的双引导分层边缘定位

提出HELLO分层边缘定位求解器,对偶引导初始化与细化,线性内存,百万级跨维度OT数量级加速且达全局最优。

04:00
arXiv cs.LG

谱重尾起始的完整 Adam 定理

证明Adam谱重尾起始的完整定理,给出命中时间阈值律,并表明更强任意梯度定理不可能。

04:00
arXiv cs.LG

面向表格基础模型的注意力量化

表格基础模型注意力Q/K/V量化为FP8并做FP8矩阵乘法,Triton内核提速1.7倍,精度无损。

04:00
arXiv cs.LG

隐于轮次:预测联邦学习中802.11信道争用的时间开销

802.11联邦学习通信耗时随密度增百倍,轮数对负载不敏感,误差2.3%–10.2%,未证公平性。

04:00
arXiv cs.LG

面向抗离群点随机梯度下降的基于分位数的损失过滤

提出基于分位数的损失筛选QkL-SGD,抗离群点且可线性收敛;实验表明中间分位数优于标准SGD与min-k。

04:00
arXiv cs.LG

良性损失景观可与最坏情况困难性共存

树张量网络含梯度下降难学目标,但可实现目标的最小范数局部极小皆全局;困难源于秩亏导致的高阶退化鞍点。

04:00
arXiv cs.LG

提升能量受限本地推理与训练性能的一个简单技巧

将计算与访存任务高频分块交替,可平滑功耗温度尖峰、避免降频,本地推理与训练性能提升、能耗降低最高2%。

04:00
arXiv cs.LG

CanvasAnneal:面向扩散语言模型的课程强化学习

向扩散语言模型初始画布注入教师推理轨迹并逐步撤除,以课程强化学习缓解探索瓶颈,加速收敛。

04:00
arXiv cs.LG

基于正则化的鲁棒强化学习的统一约束视角

统一基于正则化的鲁棒强化学习,推导性能差距上界,将训练转为约束优化并自动调节正则权重。

04:00
arXiv cs.LG

面向演化领域的迁移学习

提出TrED:建模数据可用性随时间演化的迁移学习轨迹;经典设定仅阶段,现有方法多未优化全程,仍待解。

04:00
arXiv cs.LG

迈向可持续氢能系统:基于模型预测控制与强化学习的供应链优化

比较可再生氢供应链四种控制策略:MPC经济性最优,无预测强化学习稳健有竞争力,预测增强未稳定更优。

04:00
arXiv cs.LG

通过对抗重要性采样实现鲁棒策略优化

提出Advis,无需额外交互或辅助网络即可优化最坏情况回报,并发布advrl库与更全面对抗评估。

04:00
arXiv cs.LG

DynSHAP:迈向可解释的动态生存分析

提出动态生存分析可解释SHAP框架DynSHAP,处理纵向不规则数据,归因更准确。

04:00
arXiv cs.LG

MCRL2:面向云微服务调度的多资源交叉注意力表示学习增强型强化学习

提出MCRL2,用多资源交叉注意力表示学习增强强化学习,提升云微服务调度负载均衡、成功率并缩短完成时间。

04:00
arXiv cs.LG

PinDCO:大规模全页感知的动态创意优化

Pinterest广告生产系统通过创意组件融合与像素感知调整,CTR提升3.09%并已上线。

04:00
arXiv cs.LG

Hyperion:一个AI驱动的高性能计算集群,服务于科学与人文研究,利用机器学习预测作业周转时间

南卡罗来纳大学构建AI驱动HPC集群Hyperion,用ML预测作业等待与运行时间并集成Slurm。

04:00
arXiv cs.LG

多种无创生物信号对基于模拟推断的心血管生物标志物估计的影响

基于全身循环模型仿真,发现融合BCG信号可显著提升心血管生物标志物估计精度,并消除多峰后验。

04:00
arXiv cs.LG

基于勒让德近似的接收器表面命中模式用于分子信号检测

提出勒让德展开的接收面命中密度检测器及勒让德Viterbi检测器,利用到达方向特征,优于仅计数检测。

04:00
arXiv cs.LG

通过反射折叠与锥切换对二元仿射细化迭代进行精确 ReLU 实现

证明各阶二元仿射细化迭代可由固定宽度、线性深度 ReLU 精确实现,借助反射折叠与锥切换,无需变量选择器。

04:00
arXiv cs.LG

从集体稳态中学习相互作用核

提出仅凭单快照集体行为学习粒子系统相互作用核,以经验分布正则化求解不适定反问题,稳定准确恢复交互规律。

04:00
arXiv cs.LG

度量感知的深度集合学习对撞机事件几何

度量感知深度集合代理最优传输,学习对撞机事件几何,达百分级误差且吞吐更高,三角不等式违反显著减少。

04:00
arXiv cs.LG

边缘AI的电池代价:移动设备上LLM推理的环境影响研究

设备端LLM推理能效仅为服务器批处理的1/3,88–90%环境负担源于设备隐含碳,本地AI未必更环保

04:00
arXiv cs.LG

未来缪子对撞机中基于生成式机器学习的快速束流诱导本底模拟

提出首个快速生成束流本底的机器学习模型,含扩散与样条流两类,速度提升超十倍,结果逼真,权重公开。

04:00
arXiv cs.LG

面向机器人工厂的高效视觉-语言-动作管理与服务

提出Robion,首个满足SLO的多机器人多模型VLA服务管理系统,负载最高提升6.7倍。

04:00
arXiv cs.LG

通过跨模态对比学习从X射线衍射推断位错微结构

提出跨模态对比学习框架,可直接从X射线衍射预测三维位错结构,1万样本中约500个代表性样本即接近饱和。

04:00
arXiv cs.LG

论AI原生6G网络中对抗性意图注入的识别

定义恶意意图注入威胁模型,研究四种注入策略,提出CNN与自编码器双路径检测,准确率0.97。

04:00
arXiv cs.LG

HoliBench:面向CPS-IoT应用中基础模型的跨平台基准测试与部署工具包

HoliBench跨平台统一评测基础模型精度、延迟与能耗,揭示量化权衡并支持性能组合预测。

04:00
arXiv cs.LG

连续隐式模型中的直接拓扑跟踪

提出连续隐式模型直接追踪拓扑特征的框架,查询模型导数跟踪临界点,无需网格重采样,避免离散伪影。

04:00
arXiv cs.LG

基于成对似然比的成员推断

提出PL-MIA,融合高斯似然比、群体校准与柯西组合检验聚合成对p值,低假阳性下TPR提升逾25%。

04:00
arXiv cs.LG

BRIDGE-EEG:衔接自监督预训练与高效部署的跨数据集脑电分类

提出BRIDGE-EEG,统一时频预处理加蒸馏,轻量模型跨数据集脑电分类媲美大模型且边缘能耗更低。

04:00
arXiv cs.LG

基于随机缩放的加速草图投影牛顿法推断

提出加速草图投影牛顿法,证明渐近正态与泛函中心极限定理,以随机缩放实现免协方差估计的在线推断。

04:00
arXiv cs.LG

学习增强优化:面向战略性两级备件网络设计

图神经网络集成、变邻域搜索与集合划分结合,低分位评分抑制乐观偏差,246节点案例节省提升30.5%。

04:00
arXiv cs.LG

随机微分方程终端分布估计的分裂方法

提出分裂路径树估计SDE终端分布,理论分析误差,较独立采样降10–25%,图像实验MMD降8–13%

04:00
arXiv cs.LG

固定维度下随机梯度预言机的紧采样复杂度

固定维度下随机梯度预言机采样强对数凹分布,复杂度对条件数与TV精度同时紧,自适应无噪声。