11272 条条目 · 106 个活跃源
2026年10月1日
04:00
arXiv cs.LG

可交换性感知神经后验估计的摊销式数据借用

提出可交换性感知摊销神经后验估计用于外部数据借用;结局漂移下偏差更低,约千倍加速。

04:00
arXiv cs.LG

EFormer:面向连续sEMG手部姿态跟踪的时间对齐局部校正

EFormer融合高频事件与时间对齐局部交叉注意力,降低连续sEMG手姿跟踪误差,MAE较基线降11.38%。

04:00
arXiv cs.LG

DAMPER:回报优先的梯度控制以实现平滑策略

DAMPER以回报优先的冲突投影与自适应幅度控制融合时序一致性梯度,在连续控制任务中显著降低动作振荡。

04:00
arXiv cs.LG

可解释代表性地标的认证近似

提出CAIRN,为自监督可解释地标排序提供端到端误差认证,量化近似误差,优化覆盖与预算,提速且保精度。

04:00
arXiv cs.LG

用对比遗忘集遗忘大语言模型中的欺骗行为

PACT用对比遗忘集和压力感知目标,将大模型欺骗率从50%以上降至3%以下,并保持上下文遵循。

04:00
arXiv cs.LG

世界即图:基于潜空间图的关系世界建模

提出图式对象中心世界模型WAG,借潜空间动态图与对象记忆增强关系建模,提升视觉推理与机器人操作。

04:00
arXiv cs.LG

自适应自洽性:从黑盒采样到分布值反馈

提出ASC-D,自洽性转为分布值反馈的序贯众数识别,轨迹减少46.4%–95.6%,正确认证率最高。

04:00
arXiv cs.LG

噪声潜在结构下的流匹配:超越精确低维支撑

研究噪声潜在结构下的线性流匹配,证明统计速率由潜在维数而非环境维数决定,并给出收敛保证。

04:00
arXiv cs.LG

广义残差闭合:稳定性—可塑性兼容的通用学习动力学

提出广义残差闭合框架,将学习视为递归闭合未来相关差异,统一稳定性—可塑性、表示修正与持续学习。

04:00
arXiv cs.LG

学习何处引导:基于生成模型的高效离线多目标优化的噪声空间几何

离线多目标优化中,仅调初始噪声、学少数敏感方向,低成本引导扩散模型,47任务超体积领先。

04:00
arXiv cs.LG

一种面向算法公平性的秩渐进度量指标

提出基于预测误差分布的秩渐进公平性框架,含AURGF、置换检验与特征剔除,可度量并解释算法不公平。

04:00
arXiv cs.LG

基于 Q 分数匹配与序列价值恢复的无环逆强化学习

用扩散策略将逆强化学习化为无环序列价值恢复,三阶段离线提取奖励,比最快基线提速2-3倍且性能不降。

04:00
arXiv cs.LG

信号路由温度缩放:面向小验证预算的低容量风险条件校准

提出10参数SRTS-BCE,按风险分组调温,小预算降ECE并优于高容量法,校准容量应随数据量调整。

04:00
arXiv cs.LG

SCORE-LM:融合语言模型的状态空间雷达表示用于故障诊断

SCORE-LM将紧凑的状态空间雷达编码器与语言模型结合,实现高精度故障诊断及可理解的维护指导。

04:00
arXiv cs.LG

将对抗轨迹锚定至数据流形:一种双层迁移优化框架

提出MABT框架,将对抗轨迹锚定至数据流形,通过双层优化学习几何对齐初始化,提升迁移攻击效果。

04:00
arXiv cs.LG

更小模型,更优拒绝样本:偏好蒸馏缩放

更小冻结模型生成拒绝样本计算更少却更有效,能训练更强学生;关键是保留任务结构、降低参考策略耦合。

04:00
arXiv cs.LG

并非所有解都同等:深度线性神经网络中功能相似性与表征相似性的解析性分离

深度线性网络分析表明,功能与表征可相互解离,表征相似不等于功能相似;仅参数噪声鲁棒性会限制表征灵活性。

04:00
arXiv cs.LG

同步多视图神经扩散

提出同步多视图神经扩散,统一扩散过程实现视图内外并发融合,兼顾效率与可扩展性,性能显著提升。

04:00
arXiv cs.LG

面向内存与数据高效三维湍流预测的尺度拆分神经算子

尺度拆分神经算子:父预测粗场,子预测局部高分辨斑块;三维湍流NMSE降53%、训练内存降79%。

04:00
arXiv cs.LG

面向受污染人类反馈的鲁棒风险敏感强化学习

提出WSP-CVaR-RLHF,以加权奖励估计与乐观CVaR规划应对偏好翻转,理论更优,实验降遗憾。

04:00
arXiv cs.LG

缺失的系数:面向模型个性化的贝叶斯成对合并

将成对偏好视为隐变量,贝叶斯推断奖励权重后验,以均值作合并系数,无需逐用户训练即可个性化。

04:00
arXiv cs.LG

面向高效自适应谱递归的共享相位与保留控制

SPARC以两个共享标量控制复模态保留与相位旋转,实现高效自适应谱递归,兼顾并行/在线学习与性能速度。

04:00
arXiv cs.LG

切换线性注意力

SwiLA将线性注意力的状态更新建模为混合线性回归的在线EM,各输出维度动态选择组件,以定长递归状态逼近甚至超越softmax注意力。

04:00
arXiv cs.LG

已部署验证器套件中的硬门禁候选资格

部署验证器仅2/13通过校正;跳过检查记通过致检出上限约84%;评估须区分未运行/通过并附拒收证据。

04:00
arXiv cs.LG

HO-FL:面向异构边缘设备的混合阶联邦学习

提出HO-FL混合阶联邦学习,底层用零阶、顶层用一阶优化,按内存划分边界,并优化采样以应对数据异构。

04:00
arXiv cs.LG

用于铁路车门异常检测的跨信号一致性周期感知自编码器

TCAA-CS以开停关周期无监督检测车门异常,融合重构、潜空间与跨信号一致性,召回93.8%、精确97.3%、误报0.5%。

04:00
arXiv cs.LG

稀疏优先推理引擎SparseEngine支持15种稀疏方法,吞吐超10倍,解码快2.5倍。

SparseEngine:稀疏优先推理引擎

04:00
arXiv cs.LG

Argus:真实 EKS 下预测 Spot 中断何时优于简单检查点

Argus在真实EKS验证:SIGTERM检查点可扛Spot回收;预测可零浪费,但提前量过大导致过迁移,周期性检查点仍是强基线。

04:00
arXiv cs.LG

面向蛋白质定向进化的结构感知强化学习

提出结构感知强化学习框架StructEvo,融合突变结构特征并分解突变空间,性能提升最高16.3%,发现GFP上位效应。

04:00
arXiv cs.LG

参数对称性决定过参数化非线性网络中的表征几何

参数对称性经加法、复制、缩放三种特征变换重塑表征,使表征几何分为本质与辅助成分,简并性随过参数化增长。

04:00
arXiv cs.LG

泛化信号未必是模型选择信号

几何代理虽与泛化差距相关,却无法可靠选出部署最优模型:泛化信号未必是模型选择信号。

04:00
arXiv cs.LG

通过状态增广学习无限时域平均奖励CMDP

提出首个计算高效的无限时域平均奖励CMDP算法,达到最优√T遗憾与约束违反。

04:00
arXiv cs.LG

QuanVI:基于量子最大混合态的分数变分推断

QuanVI结合混合态密度算符与量子张量网络,压缩参数、规避简并本征向量不唯一,高维分数变分推断有效。

04:00
arXiv cs.LG

T-Router:学习丘脑路由以实现参数高效强化学习推理

T-Router仅以0.466%参数实现丘脑式路由,复用计算块,推理超越LoRA与全参数GRPO。

04:00
arXiv cs.LG

面向选定高斯过程近最优性证书的预序e值

以预序e值审计GP包络选择,剔除矛盾候选,用存活者最大上界作任意时间有效认证,降低误认证风险。

04:00
arXiv cs.LG

Muon 中的行归一化之谜

研究Muon行归一化:引入维度相关复杂度因子,合成任务更慢,大模型预训练却更优,理论实践仍成谜。

04:00
arXiv cs.LG

CDMD:面向表格数据的跨数据集混合类型扩散模型

提出CDMD,直接在混合类型特征空间上跨数据集联合训练扩散模型,单模型生成质量优于各专用模型。

04:00
arXiv cs.LG

ID 平衡:基于 PID 负载控制的极稀疏 MoE 稳定训练

将无辅助损失方法视为不完整PID控制器,提出ID平衡,随误差增大加强校正,降低负载不均衡并稳定训练。

04:00
arXiv cs.LG

面向大语言模型服务的高带宽闪存特性研究

HBF扩展LLM服务内存,分层存储与缓存感知调度使完成时间降36.1–87.0%、能耗降55.8%,写入寿命延至14.82年。

04:00
arXiv cs.LG

固定步长SGD的精确平稳高斯逼近

固定步长SGD不变分布的精确高斯逼近,归一化迭代1-W距离误差O(√α),四状态例下界匹配。

2026年9月30日
04:00
arXiv cs.LG

超越流形假设:面向流匹配的混合谱参数化

提出混合谱参数化,自适应时间与数据协方差方向,跨架构稳健、加速优化且几乎不增训练成本。

04:00
arXiv cs.LG

PolyStepOR:无需最优决策即可学习决策

PolyStepOR 无需最优参考决策与梯度,借扰动评估和最优传输直接优化实际决策成本,支持约束预测并具理论保证。

04:00
arXiv cs.LG

TimeES:基于演化谱的概率性与确定性时间序列预测

TimeES借演化谱理论,将非平稳序列建模为随机变量调制的演化谱表示,高效实现概率与确定性预测领先。

04:00
arXiv cs.LG

利用机器学习探究空腹血糖的预测因素:昼夜节律时机与年龄交互作用的洞见

基于NHANES数据,可解释机器学习预测空腹血糖,糖化血红蛋白主导,昼夜节律与年龄交互作用弱但值得研究。

04:00
arXiv cs.LG

HoTS:用于图神经网络校准的同配性感知温度缩放

提出同配性感知温度缩放HoTS,用局部同配性和logit熵为节点分配温度,提升GNN节点分类校准。

04:00
arXiv cs.LG

并行扫描下的长度无关状态跟踪

提出NFSM:非仿射可并行扫描RNN,有限精度下实现长度无关状态跟踪,突破仿射模型限制。

04:00
arXiv cs.LG

面向参数恢复的神经似然符号蒸馏

面向参数恢复,将神经似然蒸馏为可解释符号表达式,扩散决策模型上加速超百倍且保精度,可用于贝叶斯层次推断。

04:00
arXiv cs.LG

重新思考大语言模型强化学习中的训练-推理不匹配:根源与纠正

针对大语言模型RLVR训练-推理概率不匹配,提出校准重要性采样CIS,以置信感知截断校正,实验更优。

04:00
arXiv cs.LG

回写Δ:以全新表示重访同一词元

ReFlux回写层间深度增量Δ重访同一词元,动态组合反馈路径,降低困惑度并提升推理准确率。

04:00
arXiv cs.LG

将非平稳多输出高斯过程适配于贝叶斯优化

提出MOLRN-BO,将非平稳多输出高斯过程适配于多目标贝叶斯优化,在12个基准上提升性能与稳健性。