11522 条条目 · 106 个活跃源
2026年8月26日
04:00
arXiv cs.LG

PuzzleKV:面向KV缓存压缩的页级低秩分解

PuzzleKV逐页低秩分解KV缓存,免训练校准,60%存储保持96%,量化用18.7%保持93%。

04:00
arXiv cs.LG

FlowNeg:GFlowNet引导的知识图谱嵌入多样困难负采样

FlowNeg用层次生成流网络采样,负样本多样且困难,在KGE基准上平均MRR优于EMU和IF-NS。

04:00
arXiv cs.LG

启示控制

选择价格干预仅揭示影响决策的隐藏状态,区分信息价值与生产复用,提出决策充分启示与深度,并证明仅凭停止翻转风险无法保证正效用。

04:00
arXiv cs.LG

每层都关键:ReLU网络的指数级L2深度层级

证得每增一层可指数节省神经元:深度ℓ宽多项式即可,浅一层需指数宽,否则L2误差≥1/24。

04:00
arXiv cs.LG

UHI-Bench:跨多种气候区城市双源热岛建模基准

提出UHI-Bench首个双源热岛基准,评估20余模型;无统一最优,跨城迁移取决于热岛模式重叠。

04:00
arXiv cs.LG

去噪分数匹配的损失下限:来自薛定谔桥的Fisher几何

去噪分数匹配的额外损失为条件方差,等于Fisher度量迹沿轨迹积分,由薛定谔桥导出,影响模型排名。

04:00
arXiv cs.LG

GATNextHop:一种用于跨拓扑泛化的最短路径路由的图注意力网络

提出GATNextHop模型,以图注意力网络近似最短路径,跨拓扑泛化,合成图训练,真实ISP网络测试,并与Dijkstra对比。

04:00
arXiv cs.LG

MnemoDyn:从4万条fMRI序列学习静息态动态

提出基于动力系统的rs-fMRI模型,用约4万序列训练,多分辨率建模,计算高效,重建优于Transformer,适用下游任务与小样本研究。

04:00
arXiv cs.LG

XP-JEPA:面向可预测潜动力学的交叉预测物理锚定

XP-JEPA用物理轨迹锚定潜动力学,训练后仅需视觉,将漂移从0.361降至0.104,控制成功率提升至78.2%。

04:00
arXiv cs.LG

CoDrift:离线强化学习的组合漂移方法

CoDrift融合条件、边际、价值三个运动场生成动作,在离线及离线转在线场景的73个任务中平均排名最佳。

04:00
arXiv cs.LG

圆上部分最优传输:面向所有传输质量的O(N log N)算法

PAWC:圆上部分最优传输,O(N log N)时间、O(N)内存,返回全部成本与计划,推广至球面。

04:00
arXiv cs.LG

单语义性的逆袭:特化神经元提升多层感知机的数据效率

聚类回归中,多层感知机自然形成与局部特征对齐的特化神经元,用局部低维表示提升数据效率。

04:00
arXiv cs.LG

面向实时边缘可部署虚拟传感的、蒸馏辅助的低延迟激活正则化稀疏神经算子

提出稀疏激活层,无需代理梯度,兼容事件计算,延迟-误差-能耗指标提升五倍,蒸馏再降两倍,助力边缘实时虚拟传感。

04:00
arXiv cs.LG

ChorusTIC:基于 Chorus 上下文学习的免训练多元时间序列分类

提出免训练的多元时间序列上下文分类基础模型,仅用合成片段预训练,在两大公开基准上表现优异。

04:00
arXiv cs.LG

PinSieve:面向企业内容质量分诊的生产级选择性VLM服务与受管控记忆飞轮

选择性VLM服务与记忆飞轮用于内容质量分诊,过滤量2.05倍,生产力+25.7%,成本-16.2%。

04:00
arXiv cs.LG

基于高斯泼溅表示的物理集成算子学习

提出高斯泼溅连续表示,将物理算子无损失地集成进神经算子,长时预测误差降低1.5-2.2倍。

04:00
arXiv cs.LG

从梯度提升树到深度推荐器:生产客户支持推荐器迁移的实践经验

生产推荐系统从梯度提升树迁移至深度成对二元模型,采用负采样、噪声注入和注意力池化技术,后期性能超越原模型。

04:00
arXiv cs.LG

ALPHABET:一种带分组指数传输的拉普拉斯极点历史聚合器

ALPHABET以数千参数压缩历史为极点模态,仅用模态能量与滞后矩,性能媲美大模型且推理训练快数倍。

04:00
arXiv cs.LG

特征主序码本:在单块消费级GPU上将MEDLINE图谱扩展至105万神经元的内存高效稀疏二值自组织映射

特征主序码本提速BMU搜索4.5-8.5倍;72秒训练2990万篇文献,H200达105万神经元。

04:00
arXiv cs.LG

面向可控数据生成的机制电路识别

提出机制电路框架,结合数据评估与可解释性,以电路为接口生成靶向数据,提升下游性能。

04:00
arXiv cs.LG

均匀稳定性的尖锐尾部

构造γ-均匀稳定学习问题,其尾部概率下界匹配无对数上界,确定了均匀稳定性最优高概率与矩依赖至常数。

04:00
arXiv cs.LG

PhysicsBench:工程设计与仿真中生成与预测模型的统一排行榜

PhysicsBench统一评测生成与预测模型,覆盖7任务66模型,揭示数据规模影响排名,为模型选择提供公开依据。

04:00
arXiv cs.LG

网格无关多分辨率深度能量法及其脆性断裂相场建模

提出网格无关多分辨率深度能量法,用神经网络表示位移和相场,最小化增量能量训练,在六类断裂问题中载荷-位移曲线与有限元参考吻合,峰值载荷误差约1%至8%。

04:00
arXiv cs.LG

面向基于LLM的时间序列异常检测的结构化频域证据

提出零样本异常检测框架,在去季节化数据上增加全局与局部FFT频域证据,提升LLM检测性能。

04:00
arXiv cs.LG

知道何时求助:分层大语言模型智能体中的贝叶斯自我升级

将推理中委派建模为贝叶斯最优停止,导出时变阈值策略,证明遗憾以1/√n衰减,并在代码任务中验证。

04:00
arXiv cs.LG

低方差在线策略评估的鲁棒数据收集策略学习

提出双环梯度算法学习鲁棒行为策略,应对转移不确定性,降低评估方差,保证全局收敛。

04:00
arXiv cs.LG

从松弛可指标性到精确可指标性:部分可观测游荡匪帮的$t$步方法

提出$t$步前瞻阈值策略,逼近Whittle指数,误差$O(\beta^t)$,并验证可指标性。数值显示精度大幅提升,逼近最优。

04:00
arXiv cs.LG

PRQ-KMeans:用于语义ID令牌化的投影残差量化

PRQ-KMeans:去全局均值、Top-k相似更新、投影残差,改进语义ID令牌化,效果最优。

04:00
arXiv cs.LG

推理时通过读出反馈引导循环推理模型

通过读出概率生成成对耦合力引导潜变量动态,无需重训提升循环推理模型,在数独和迷宫六对任务中获四对增益。

04:00
arXiv cs.LG

等变协方差张量:保证SPD的张量值几何学习不确定性

提出E(3)等变协方差框架,经矩阵指数映射保证SPD,以对数欧氏等变目标实现张量预测不确定性量化,鲁棒且对称。

04:00
arXiv cs.LG

对比分支策略优化

提出对比分支策略优化,解耦预算与信用分配,用前缀分支对比评估决策,提升工具集成智能体的多步推理性能。

04:00
arXiv cs.LG

基于L1范数Rademacher复杂度的数据依赖早停规则

提出基于L1范数Rademacher复杂度的早停时刻估计框架,无需训练且不依赖概率假设,可用于线性回归与非线性网络。

04:00
arXiv cs.LG

时间序列基础模型的因果分析

提出因果分析框架,通过干预合成时间序列检验基础模型,发现趋势与谐波安全,但存在持续性高估等偏差。

04:00
arXiv cs.LG

自监督预训练何时对表格模型有益?标签稀缺与缺失数据研究

自监督预训练在标签稀缺时增益不稳定,对高缺失数据常有害,但测试期缺失下平均略有提升。

04:00
arXiv cs.LG

用于T2DM可解释疾病轨迹的结构化FHMM模型

提出结构化FHMM,将潜伏健康状态分解为多组件,识别临床轨迹与异质进展,提供T2DM可解释洞察。

04:00
arXiv cs.LG

联合分布对齐用于通用域自适应

提出JAUA算法,以卡方散度对齐联合分布,给出泛化误差上界,并用渐进式伪标签法处理通用域适应,实验表现优越。

04:00
arXiv cs.LG

欺诈基准:金融风险评估中协议敏感的对抗鲁棒性基准测试

提出欺诈基准,金融风控对抗鲁棒性评估对协议敏感,须联合报告预测退化与攻击可行性,将领域约束融入攻击生成。

04:00
arXiv cs.LG

可穿戴设备数据深度多变量插补模型评估

提出真实缺失评估与匹配训练,使深度插补模型严重缺失误差降43%,并发现模型排名取决于评估设计。

04:00
arXiv cs.LG

超越静态可解释性:从预SFT参数预测后SFT机制以实现更好调优

提出前向定位框架,仅用预SFT参数与目标数据预测后SFT机制,避免回顾性偏差,指导微调,性能稳健且可扩展。

04:00
arXiv cs.LG

WarpSAC:重思探索与利用,迈向可扩展离策略强化学习的顶峰

新算法按数据规模调节稳定器,提升离策略RL学习效率与性能

04:00
arXiv cs.LG

熵的测量位置很重要:有界连续控制PPO中的策略几何

连续控制中,熵测量位置影响PPO几何:潜在熵致动作贴界,执行熵使均值内移;但收益无法单独刻画有界策略几何。

04:00
arXiv cs.LG

视情况而定:纳入高维输出空间联合偶然与认知不确定性的相关性

提出低秩加对角协方差结构,联合建模高维输出的偶然与认知不确定性,实现高效稳健的不确定性量化。

04:00
arXiv cs.LG

持续交叉熵

提出持续交叉熵,用诱导概率桥接持久图事件空间,证明稳定性,用于区分同熵图、识别因果方向、作为拓扑损失。

04:00
arXiv cs.LG

监督式UQ集成何时能改进LLM幻觉检测?一项鲁棒性研究

监督集成在30/32设置中优于最佳评分器,100个标注样本即可;黑盒采样近等效,白盒增益有限。

04:00
arXiv cs.LG

从偏微分方程数值模拟器到神经仿真器,再回到数值模拟器

论证神经仿真器与数值求解器同构,用傅里叶分析统一误差与归纳偏置,提出基准,研究未收敛求解器影响并分析优越性。

04:00
arXiv cs.LG

SeisMamba:面向空间分布式地震早期预警的低延迟单台震级估计

提出轻量级Mamba模型SeisMamba,利用单台三分量波形快速估计震级,延迟仅0.55毫秒,精度优于基线,且跨区域泛化良好。

04:00
arXiv cs.LG

基于可验证奖励的在策略蒸馏

提出OPDVR,无需超参数融合可验证奖励与在策略蒸馏,用ReLU门控对齐轨迹正确性,超越标准蒸馏。

04:00
arXiv cs.LG

以渐进式增长穿越损失景观

研究渐进式增长:逐步解锁子空间、冻结正交方向,证明其以体积效应偏向宽盆地;但平坦性不总提升测试性能。

04:00
arXiv cs.LG

条件图GAN联邦:在联邦生成对抗网络中优化图结构分子生成

提出cGraphGANFed,引入评论网络引导生成分子优化用户指标,较原模型在有效性、LogP及QED上显著提升,并增强抗模式崩塌与非独立同分布数据能力。

04:00
arXiv cs.LG

IAPO:面向多轮服务智能体信用分配的影响感知策略优化

提出IAPO,用影响依赖图重分配轨迹优势,解决多轮交互信用分配问题,在三项服务基准上超越现有强化学习方法。