11692 条条目 · 106 个活跃源
2026年7月30日
04:00
arXiv cs.LG

分数不是决策:面向LLM代理工具获取的成本感知停止策略

提出CAM-DF方法,训练停止与最优续延的差距,在异构成本下最优,减少37%工具使用且保持任务成功率。

04:00
arXiv cs.LG

语言模型中的天球表示

分析百亿参数语言模型,发现多数模型有可解码的夜空图表示,方差占比65-85%,角度误差12°-21°,为首个曲率高维不可约特征流形实例。

04:00
arXiv cs.LG

层次化时空Transformer用于一致性急诊部门预测

提出HierSTT框架,端到端联合预测医院、区域、国家三级急诊需求,误差降低32%,实现跨层级一致预测。

04:00
arXiv cs.LG

代价敏感共形预测与人在回路放弃在不平衡高风险决策支持中的应用:多领域基准研究

标准共形预测少数类覆盖率低至0.5%,Mondrian共形预测提升61.7个百分点,结合成本控制放弃显著降低决策成本。

04:00
arXiv cs.LG

用于期望持久性图自适应向量化的Voronoi直方图

提出Voronoi直方图实现EPD自适应向量化,无需平滑变换,建立稳定性界,实验验证有效。

04:00
arXiv cs.LG

最小马尔可夫化:全纯覆盖决策过程中的稳定商

构造稳定商,为全纯覆盖决策过程找到最小马尔可夫充分统计量,实现状态压缩与高效强化学习。

04:00
arXiv cs.LG

基于并行轨迹回火的能量模型均衡训练

提出并行轨迹回火算法,实现能量模型均衡训练,高效处理多模态稀疏数据,成本低且性能优越。

04:00
arXiv cs.LG

重尾噪声下在线凸优化的无参数动态遗憾

提出HT-PAder算法,在重尾噪声下实现无参数通用动态遗憾,达到最优路径长度指数。

04:00
arXiv cs.LG

基于耳部PPG和ECG的单拍无袖带血压估计:一种轻量级混合学习框架

提出单拍级无袖带血压估计框架,融合耳部PPG与ECG,采用CNN+LightGBM混合学习,SBP/DBP误差低至4.02/1.79 mmHg,比基线降低28.2%。

04:00
arXiv cs.LG

Two2Four:基于人类运动的四足动物生成式操控

提出两阶段扩散模型,从人类运动自动生成逼真可控的四足动物动作。

04:00
arXiv cs.LG

你真的需要为在线强化学习微调预训练Q函数吗?

预训练Q函数对在线微调效果有限,随机初始化即可;策略集成初始化(IPE)方法可提升1.26倍性能。

04:00
arXiv cs.LG

从非规则期权报价中逆向学习潜在风险中性密度

通过合成与实际数据基准测试,揭示不同学习方法恢复风险中性密度的差异,表明不存在通用最优方案。

04:00
arXiv cs.LG

基于卫星散射仪星座的海上风速精准预报

WindCastNet首次直接利用卫星散射仪星座观测进行海上风场短时预报,1小时误差降低23%,2小时降低7%,优于传统模型。

04:00
arXiv cs.LG

学习型扩散提议何时有助于约束求解?关于连续代数系统的受控研究

学习扩散提议仅在变量独立高维时微弱优于随机多起始,耦合后优势消失,现实系统经典多起始全胜。

04:00
arXiv cs.LG

从分类到回归:利用果蝇求解方程

受果蝇感知启发,用局部模式匹配与加权重构替代全局模型,实现高效回归预测。

04:00
arXiv cs.LG

当核岭回归遇到Hölder-Zygmund类:极小极大最优性与恰当性的失效

证明错误设定KRR达极小极大L2最优速率,但恰当性失效,噪声范数随log n增长。

04:00
arXiv cs.LG

单纯形解混:在对撞机中分离多重轻味喷注

提出单纯形解混框架,从混合样本提取多重轻味喷注,实现对撞机数据驱动的喷注味分离。

04:00
arXiv cs.LG

基于形状的归纳偏置用于肿瘤轮廓的胶质瘤分级

形状对齐框架分离全局与残差形状,MLP以极低参数达71.5%准确率,验证形状归纳偏置有效性。

04:00
arXiv cs.LG

Lilith:训练-推理触发器偏移下的后门泛化

提出Lilith框架,解决触发器偏移下的后门泛化问题,实现高攻击成功率与低性能退化。

04:00
arXiv cs.LG

在k-means++中随机化簇中心数量

预算平滑下随机化簇数,k-means++以常数概率达常数近似比。

04:00
arXiv cs.LG

降阶建模中双重下降的起源与缓解

统一理论解释降阶建模中双重下降的起源、预测与缓解,海表温度和偏微分方程模型验证。

04:00
arXiv cs.LG

回顾性正交设计:从观测数据重构响应曲面

ROD重构条件均值曲面,实现规范不变对比效应与顺序无关平方和,6480种模拟中表现优异。

04:00
arXiv cs.LG

学习字问题:测地线长度与密码学应用

提出WPNet图神经网络,启发式解决字问题并预测测地线长度,成功攻击Wagner-Magyarik公钥密码系统。

04:00
arXiv cs.LG

无Incast的MoE基于速率调度

提出主动公平调度框架,消除MoE网络中的incast现象,保持近100%链路利用率,减少集体完成时间。

04:00
arXiv cs.LG

自适应学习与模型预测控制用于无遗憾跟踪未知动力学

提出自适应在线学习方法,同时学习多个预测器并自适应选择,实现无遗憾跟踪未知切换动力学,经仿真与硬件实验验证。

04:00
arXiv cs.LG

自适应梯度方法用于更广泛的表现性预测优化问题

提出自适应梯度优化方法,弱假设下收敛,通过有限差分估计分布偏移,收敛更快更稳定。

04:00
arXiv cs.LG

混沌即是阶梯:通过重加权超越不变性的域泛化

提出LADDER方法,利用域风格重加权源分类器,无需目标标签即可泛化,超越不变性约束,实验提升准确率。

04:00
arXiv cs.LG

去噪增长复杂度:数据几何与扩散采样的认证调度

提出DGC几何度量,连接扩散采样理论与认证,导出KL误差边界和优化调度

04:00
arXiv cs.LG

多样性约束下的参数化公平资源分配

提出PRA框架,用可控参数软性调节多样性约束,灵活权衡公平与效率,理论最优且实验优于基线。

04:00
arXiv cs.LG

保形率自适应感知

CoRAS自适应选择采集率,保证重建误差,平均测量更少,对难图像分配更多测量。

04:00
arXiv cs.LG

利用大型语言模型实现万物互联中的智能资源分配

利用LLM任务语义推理,实现IoE动态资源调度,降低延迟能耗,提升资源利用率。

04:00
arXiv cs.LG

通过直推式原型细化与类别logit增强的少样本开放集音频分类

提出两阶段直推法,利用潜在内点权重和自适应自由能评分,实现少样本开放集音频分类,效果达SOTA。

04:00
arXiv cs.LG

基于信息量的聚类联邦学习方法用于受管Wi-Fi网络的可靠流量预测

提出基于信息量的两步聚类联邦学习方法,选择最小簇信息量最大方案,实现Wi-Fi流量预测高性能低能耗。

04:00
arXiv cs.LG

基于近异常检测的早期故障预测:一种主动方法

提出无监督方法CANARI,利用Christoffel函数检测近异常,主动预见未来异常,在工业数据上优于双阈值基线。

04:00
arXiv cs.LG

DREvo: 蒸馏重新校准的历史经验以实现驾驭自我进化

DREvo通过证据锚定、重校准与意图蒸馏实现稳定进化,五个基准最高准确率,平均提升16.2%和14.2%。

04:00
arXiv cs.LG

The Sparsity Ceiling: Where Spiking Networks Can and Cannot Trade Activity for Energy

04:00
arXiv cs.LG

稳定且预算可行的聚类联邦学习联盟形成:一种享乐势博弈方法

基于享乐势博弈,实现聚类联邦学习稳定且预算可行的联盟形成,逼近最优社会福利。

04:00
arXiv cs.LG

没有数据不等于没有风险:基于可见性感知图的商业行为风险推断

利用企业关系图结合正无标签学习,可预测记录缺失企业的未来违规风险,超越传统方法。

04:00
arXiv cs.LG

ToxScreen:检测大语言模型是否遭到投毒

发布800个后门模型基准,发现梯度优化恢复触发器失败,基于攻击成功率的token查找有效,并揭示后门与越狱机制差异。

04:00
arXiv cs.LG

利用大型语言模型探究原子中心结构描述符的极限

LLM发现即使考虑七邻簇,3D结构仍不可区分,展示AI跨领域转化知识的潜力。

04:00
arXiv cs.LG

因果掩码Transformer的组合理论

有限精度下,从注意力记忆动态推出表达能力层级,对应四种半群,四类注意力各有紧致界限。

04:00
arXiv cs.LG

特征装袋提供稳定性

提出特征不稳定性指标,证明特征装袋可提升稳定性,子采样越激进改进越大,少量轮次即接近无限装袋。

04:00
arXiv cs.LG

非凸神经网络中噪声解的鲁棒性

研究非凸神经网络有限温度噪声解鲁棒性,温度松弛扩展算法可达区域至OGP阈值之上,热噪声可助困难区泛化。

04:00
arXiv cs.LG

InferScale:面向个性化LLM服务的GPU原生KV注入

InferScale通过GPU原生KV注入复用缓存,检索量增大时首token延迟稳定,吞吐提升3.7-4.5倍。

04:00
arXiv cs.LG

用BAND打破维度诅咒:高维非参数分布估计

提出稀疏贝叶斯网络分布回归(BAND),估计高维混合数据,实现多项式收敛率,显著快于经典无稀疏估计器。

04:00
arXiv cs.LG

GPTQ-2D:立方时间双侧自适应舍入

GPTQ-2D在三次时间内完成双侧自适应舍入,且结果与四倍时间算法一致,按反对角线并行处理。

04:00
arXiv cs.LG

基于场编码的分布式耦合采样器与可验证经验传输

提出场编码编译器,将近似最优蒙日映射的传输场补全为精确边际、值可验证采样器,证书精度仅由分区直径控制。

04:00
arXiv cs.LG

HoF-Bench:无需前沿模型重新发现真实AI发现的CVE

HoF-Bench:基于95个AI发现CVE,极简LLM重发现65个,无需前沿模型。

04:00
arXiv cs.LG

PIKS:通用物理信息核方法

提出通用物理信息核方法(PIKS),证明线性微分约束下的普适一致性,给出有限样本误差界,实验显示可与PINN及有限元法竞争。