11382 条条目 · 106 个活跃源
2026年9月21日
04:00
arXiv cs.LG

基于泊松过程的可水印多草稿投机采样

提出基于泊松过程的可水印多草稿投机采样,兼顾水印强度与采样效率,并具草稿模型不变性,实验验证。

04:00
arXiv cs.LG

从预训练到精通:最少人工干预下面向长时程操作的真实世界子任务强化学习

PARTS冻结预训练策略,聚焦瓶颈子任务做残差强化学习,成功率32%→61%与50%→95%。

04:00
arXiv cs.LG

深度强化学习中的轨迹展开总相关

最大化轨迹内表示与动作总相关以学任务表征,用生成/判别下界和分块小批量,加内在奖励,提升样本效率与鲁棒性。

04:00
arXiv cs.LG

使用高效符号恢复的端到端硬标签密码分析模型提取

提出新符号恢复算法,无需专用查询,实现黑盒端到端硬标签模型提取,训练模型标签一致率超98%。

04:00
arXiv cs.LG

光滑 ℓ_p / ℓ_q 非对偶凸一阶预言机优化的近最优加速

研究ℓ_q下Hölder连续梯度凸优化,结合选择子移动界与Hölder下降,得到多项式时间一阶法,在高维达近最优率并解决COLT 2015开放问题。

04:00
arXiv cs.LG

切向量场回归的黎曼同时推断

黎曼流形切向量场回归核估计经平行移动与协方差白化得Gumbel极限,构造同时置信管。

04:00
arXiv cs.LG

掩码离散扩散中 tau-leaping 的调度优化

分析掩码离散扩散 tau-leaping 的分解误差,优化采样调度并刻画最优渐近性能。

04:00
arXiv cs.LG

基于矩阵指数不动点迭代引导量子博弈智能体趋于均衡

提出带退火的矩阵指数不动点迭代算法,高效求解量子博弈均衡,较MMWU迭代更少、误差更低。

04:00
arXiv cs.LG

博弈中实现常数遗憾的乘性乐观

提出无耦合规则MORM,在有限一般和博弈自对弈中以一步乐观实现O(√n log d)外部遗憾,且对抗鲁棒。

2026年9月18日
04:00
arXiv cs.LG

基于意图覆盖与查询级信用分配的生成式查询建议

意图驱动框架结合意图感知多样性建模与查询级信用分配,提升点击率、查询质量与意图覆盖。

04:00
arXiv cs.LG

射频卷积神经网络

提出射频卷积神经网络,复用通信混频器在频域单次卷积,实现低功耗边缘CNN推理,能耗低两个数量级。

04:00
arXiv cs.LG

面向高效大语言模型压缩的分层课程学习

分层课程学习压缩大模型:将模型分段迁移并缓存特征,加速收敛、稳定知识迁移,显存和训练时间降超50%。

04:00
arXiv cs.LG

面向高效分布式长上下文扩散语言模型训练的块并行

提出块并行BP与上下文分片CSBP,长上下文BDLM训练吞吐最高提升1.61倍,兼顾显存与下游性能。

04:00
arXiv cs.LG

Stiefel 注意力:当 Transformer 投影矩阵的几何主导优化器选择时——以及何时不会主导

将注意力Q/K投影约束到Stiefel流形,用黎曼Adam优化;权重衰减梯度恒零;CIFAR-10提升8.98个百分点,增益源于自由步长。

04:00
arXiv cs.LG

循环神经网络中学习诱导的动力学转变

提出非平衡动力学平均场理论,揭示学习经反馈增强驱动循环网络从混沌转向稳定,并预测训练输出。

04:00
arXiv cs.LG

词-文档矩阵谱协同聚类的随机SVD近似

词-文档矩阵谱共聚类有两种随机SVD近似;随机投影更稳健,采样法适合稠密矩阵,稀疏文本收益有限,按数据结构选择。

04:00
arXiv cs.LG

如何引导你的语言流

提出探针引导,用冻结扩散模型内部状态构建引导信号,无需额外前向,刷新扩散语言模型生成与问答表现。

04:00
arXiv cs.LG

面向老年护理持续监测的智能鞋垫人体活动识别

智能鞋垫采足底压力与IMU信号,HGB识别坐站走及不稳行走,跨被试宏F1达0.98,支撑老年防跌倒。

04:00
arXiv cs.LG

个性化联邦分层高斯过程:面向异构分布式系统的隐私保护建模

提出pFedHGP,客户端函数分解为共享全局、个性化偏差和局部残差,联邦变分推断保护隐私,分类与空气建模有效。

04:00
arXiv cs.LG

压缩主动子空间用于可扩展贝叶斯推断

提出压缩主动子空间CAS,以结构化等距嵌入压缩参数后再构建子空间,大幅降低内存,支持大模型贝叶斯推断。

04:00
arXiv cs.LG

FCx:一种寻找可行反事实解释的算法

提出FCx算法,用改进VAE与多因子损失生成真实、低成本且可行的反事实解释,并支持硬/软可行性约束。

04:00
arXiv cs.LG

Bayesian Optimization with Rich Auxiliary Information via LLMs

04:00
arXiv cs.LG

通过选择性奖励激励改进离线目标条件强化学习

提出RSIQL,在离线轨迹的中间进展状态注入额外奖励以提供更及时监督,无需分层策略,性能具竞争力。

04:00
arXiv cs.LG

中文标题:机器学习评估炎症生物标志物对老年西班牙裔成年人队列认知障碍的预测价值

老年西班牙裔队列中,贝叶斯模型显示I-309(CCL1)显著提升认知障碍预测,是唯一稳健增量标志物。

04:00
arXiv cs.LG

基于领域知识增强的农业信息神经网络

提出知识增强农业信息神经网络KAINN,融合领域知识,提升农业N2O排放预测精度与可解释性。

04:00
arXiv cs.LG

以采样为代价的搜索:近乎瞬时的潜空间贝叶斯优化

利用球面约束线性模型,实现潜空间贝叶斯优化近乎闭式解,较SOTA提速百倍且性能相当或更优。

04:00
arXiv cs.LG

元胞自动机上的 LSTM-UT 与循环深度 Transformer

研究表明,LSTM-UT 的有界门控记忆在规则30外推与延迟回忆中优于 BUT 和 CoTFormer。

04:00
arXiv cs.LG

锐度感知最小化(SAM)提升细菌拉曼光谱数据分类准确率,助力便携式诊断

拉曼诊断泛化差、预处理复杂;SAM提升细菌分类,准确率最高增10.5%、平均2.7%,助推便携诊断。

04:00
arXiv cs.LG

样本数量并非全部:候选生成策略决定大语言模型测试时扩展的能耗与性能

固定候选数下,8次串行较1次批量能耗高4.64–4.86倍、P95延迟高5.77–6.12倍

04:00
arXiv cs.LG

OceanMoE:面向长时程多变量海洋预报的结构化条件稀疏计算

OceanMoE 融合跨变量共享与条件稀疏专家路由,按预测目标和空间位置专化计算,降低长时程多变量海洋预报误差。

04:00
arXiv cs.LG

FedFIbOS:面向异构联邦学习的基于Fisher重要性的最优子建模

提出基于Fisher信息的最优子建模FedFIbOS,理论保障异构联邦学习,精度提升约10%。

04:00
arXiv cs.LG

复杂度拐点:面向代码生成可靠性的提示侧结构复杂度指数

提出生成前评分的六维提示侧结构复杂度指数,10.5万次生成显示通过率在13.75分处有断点,但非普适阈值。

04:00
arXiv cs.LG

Croissant 的策略配置文件:拒绝作为数据集的属性

为 Croissant 补全策略求值:五算子判定可记录,与原生/ODRL 一致且开销低。

04:00
arXiv cs.LG

物理世界模型中,守恒换来稳定性,因子分解换来反事实能力

长时稳定靠辛积分保持能量守恒,反事实泛化靠显式线性因子分解,二者结构可分离且互不依赖。

04:00
arXiv cs.LG

CoRe:面向多变量时间序列预测的连贯性与关系对齐

模型无关的CoRe以频域连贯和低秩关系图损失替代逐点监督,无需参数,提升多变量时序预测。

04:00
arXiv cs.LG

异构物联网系统中基于意见动力学的联邦学习联盟形成

提出HK意见动力学联盟形成,在本地权重空间聚合,缓解异构IoT联邦学习统计异质性,提升水耗预测精度。

04:00
arXiv cs.LG

优势比汤普森采样:面向对比型多臂老虎机的规范与设计指南

提出优势比汤普森采样:以对数优势比对比的联合后验应对水平漂移,较绝对率记忆大幅降低后悔;对比漂移时则失效。

04:00
arXiv cs.LG

联盟胜过孤立:统一异构联盟数据集可提升分类器性能

合并异构联盟数据集的特征空间并补齐缺失值,构建统一数据集以迁移分类知识,可显著提升分类器性能。

04:00
arXiv cs.LG

学习你自己的思维:抽象 Token 课程

提出抽象Token课程,无需显式监督,让模型形成内部连续抽象思维,在图可达性与算术任务上验证有效。

04:00
arXiv cs.LG

REARL:融合真实交通数据与大语言模型的闭环自动驾驶仿真增强框架

REARL用真实交通数据与大模型闭环修正车辆决策,使仿真车速与车距分布更贴近真实交通。

04:00
arXiv cs.LG

DeliveryGym:面向长时程具身智能体规划的自适应课程强化学习环境

DeliveryGym:3D快递配送环境,用轨迹奖励与自适应课程训练长时程具身规划智能体。

04:00
arXiv cs.LG

PhyRestore:物理结构化的潜在因子修复

恢复受损物理因子并按物理关系重建土壤流失变化;单独损坏时高值恢复更优,联合损坏等情形下优势减弱。

04:00
arXiv cs.LG

基于单距离时间分辨反射测量的双层介质光学特性学习重建

提出机器学习框架,从单距离时间分辨反射测量重建双层介质光学特性,较传统模型更快更准,无需先验层数。

04:00
arXiv cs.LG

超越扁平化标记:基于可复用TriDim模块的结构保持脑电解码

提出可复用TriDim模块,显式保持脑电通道、短时与长时结构,构建TriDimEEG,跨被试解码领先,可替换Transformer。

04:00
arXiv cs.LG

不确定性下多目标优化的期望超体积最大化

将不确定性多目标优化视为贝叶斯决策,最大化期望超体积,结合高斯过程代理与主动学习。

04:00
arXiv cs.LG

面向药物重定位候选实用筛选的预训练医学表示

提出统一预训练医学表示框架,融合层次聚合与交叉引用,实现药物重定位候选筛选与排序。

04:00
arXiv cs.LG

Uni-LaDiR:潜在扩散统一多模态推理

将多模态思维令牌统一到共享潜在空间,用扩散预测后续思维块,视觉推理与机器人操作任务分别提升7.3%和6.1%。

04:00
arXiv cs.LG

AURA:用于电子邮件威胁检测的自适应不确定性路由分析

AURA多模态分析邮件内容与URL,按不确定性路由,模糊样本再交由Transformer语义分析。

04:00
arXiv cs.LG

面向高斯过程决策的在线自适应核混合

HACK将核选择视为在线专家学习,以AdaHedge混合核,理论保证逼近最优,BO等任务稳健。

04:00
arXiv cs.LG

CellRFT:面向单细胞扰动建模的强化微调

提出CellRFT强化微调框架,以生物评估为训练反馈,整合多奖励,提升单细胞扰动预测。