11342 条条目 · 106 个活跃源
2026年9月24日
04:00
arXiv cs.LG

后门留下结构痕迹:FedMAST用于联邦学习中的后门检测与遏制

提出FedMAST,利用结构、谱与历史痕迹检测并遏制联邦学习后门,平均ASR 1.51%,主任务准确率94.84%。

04:00
arXiv cs.LG

Pheno-GS:表型景观尺度的测地 Sinkhorn

提出Pheno-GS,融合图正则、非平衡最优传输与批量计算,高效计算大规模噪声数据的测地传输距离,500个分布提速超200倍。

04:00
arXiv cs.LG

带降噪与偏差校正的隐私保护去中心化优化

提出PRDO,以同批梯度差递归降噪,用精确扩散纠偏;非凸收敛不依赖均匀异构,查询灵敏度更低,实验精度提升。

04:00
arXiv cs.LG

FLEET:从 Logits 熵到文本生成中的增强轨迹

FLEET为LLM引入记忆,以稀疏轨迹调整logits,同精度提速3倍并提升复杂编码准确率。

04:00
arXiv cs.LG

基于风险敏感与评论家一致性正则化的鲁棒对抗强化学习

提出RACER框架,以风险敏感视角改进对抗强化学习,自适应调节扰动并正则化评论家一致性,提升鲁棒性与稳定性。

04:00
arXiv cs.LG

NS-ATTENTION:视觉Transformer中注意力输出的牛顿-舒尔茨变换

提出NS-Attn,无参变换视觉Transformer注意力输出,降低谱集中度并提升有效秩,多个模型和数据集上平均提升0.25-0.83个百分点。

04:00
arXiv cs.LG

MENO:内存高效的神经算子

MENO是基于流形函数编码器的PDE求解器,内存与分辨率无关,支持任意几何离散,泛化强、精度高。

04:00
arXiv cs.LG

极限核 Q(λ):弥合短视界与长视界

提出极限核Q(λ)离策略价值估计器,融合n步截断与极限核长视界近似,复杂度同n步,长视界任务优于基线。

04:00
arXiv cs.LG

表格基础模型在上下文中计算什么?通过注意力门控更新实现原位表征精炼

提出原位表征精炼:支持标签引导注意力门控更新并迁移至查询,表格基准超TabPFN-3。

04:00
arXiv cs.LG

全局树预测器在层级聚合上崩溃:基于五个面板的失效刻画

全局树模型预测层级汇总崩溃,最多低估496倍;按序列缩放、加权聚合行或季节差分可防。

04:00
arXiv cs.LG

当自适应造成伤害:联邦可穿戴设备新用户接入中的划分敏感性与个体级负迁移

严格防泄漏评测六种联邦可穿戴新用户适配:均值准确率掩盖个体负迁移,无策略全面占优。

04:00
arXiv cs.LG

什么变了?真实、虚拟与不可比诊断的漂移检测

将条件双判别器差异迁入嵌入空间,同时消除旋转与标签置换盲区,实现更优漂移检测与类别发现。

04:00
arXiv cs.LG

学习检测符号模型失效:机器学习与 Black-Scholes 的局限

基于260万期权合约,树模型优于核PCA,专家特征更佳;偏差反映市场结构而非模型假象。

04:00
arXiv cs.LG

CAST:基于上下文与异常结构条件的时间序列异常生成

CAST框架:两阶段预训练与微调,借正常数据学系统动态,以异常结构为条件生成异质异常,性能超越现有方法。

04:00
arXiv cs.LG

精确极小极大一比特无偏压缩:重尾必然性与有限随机性近似

证明一比特无偏压缩极小极大下界与随机阈值码达到,揭示高斯最优需临界重尾,并给出有限随机比特近似与优化保证。

04:00
arXiv cs.LG

评估选择决定预测排行榜:来自生产市场面板的证据

评估设计选择(分析单元、误差汇总、区间评分)可逆转预测方法排名,并在M5复现。

04:00
arXiv cs.LG

从推理字符串到偏序:通过商策略优化的验证器认证规则迁移

VCRT重放相邻操作,认证可交换轨道并保留真实依赖,跨环境迁移宏通过率77.60%,超基线64.53%。

04:00
arXiv cs.LG

共享编码器并非共享任务:深度专家池的条件化比较

共享编码器不等于共享任务;条件双判别器嵌入差异可消除旋转虚高与标签置换盲区,双轴门控决策更优。

04:00
arXiv cs.LG

自主科学发现中的虚假科学诱导

合法对象与测量错配使神经代理学习虚假关联;误差一致性而非频率致实验预算错配;监测轴隔离可拦截。

04:00
arXiv cs.LG

相对放电阶段(RDS)分类:一种实用的电池放电进程指标

提出相对放电阶段(RDS)指标,用五类可解释等级表征剩余放电状态,结合SOC估计与轻量时序网络分类,准确率超80%。

04:00
arXiv cs.LG

质量胜于数量:基于特征工程的非法比特币资金流半监督检测

构建半监督框架检测比特币混币非法资金流,证明效果取决于特征质量而非数据量,高保真特征F1达0.84。

04:00
arXiv cs.LG

冲突专家意见的可靠融合

提出概率电路融合框架,依上下文可信度整合黑盒专家意见,无需重训,提升多选问答性能与冲突下可靠性。

04:00
arXiv cs.LG

I-SplineFlow:为少步生成学习单调样条随机插值调度器

提出I-SplineFlow,以积分单调样条参数化随机插值调度器,解耦次数与权重数,改善少步生成FID且训练快。

04:00
arXiv cs.LG

当准确率差距无法认证:审计LLM评判器的跨域重校准

审计13个裁判、8域、1176次迁移:准确率差距与重校准失败弱相关,不能作部署认证,目标域校准更优。

04:00
arXiv cs.LG

线性RNN缩放定律:当更长序列胜过更多序列

线性RNN师生模型揭示缩放律:谱交叉下更长序列抑制初始化瞬态,序列数与长度不再完全可互换。

04:00
arXiv cs.LG

CS-WCP:面向组比例不确定的 LLM 评判器流量漂移的稳健共形集

为组比例不确定的LLM裁判流量漂移,以加权共形集并集提供覆盖保证;覆盖提升但集合偏大,重尾部保护。

04:00
arXiv cs.LG

一类低参数正交矩阵的黎曼结构与优化

研究块对角因子与固定置换交错矩阵的黎曼结构,提出正交双因子高效优化算法,用于矩阵逼近和大语言模型微调。

04:00
arXiv cs.LG

分布与规模:什么决定了测试时预算分配是否划算

决定测试时预算再分配是否划算的是负载内实例难度差异度而非平均难度;计入成本后仍能收回大部分收益。

04:00
arXiv cs.LG

以输入和输出维度为参数,二值量化神经网络训练是W[1]-难的

证明2-QNNT以输入输出维度之和为参数是W[1]难的;ETH下更无相应次指数算法。

04:00
arXiv cs.LG

从失败中学习:面向小型语言模型工具使用智能体的异构图记忆

提出FRESH,将历史成败构建为异构图经验,助小模型工具代理避错复用策略,提升可靠性与成功率。

04:00
arXiv cs.LG

PCQC:面向多轮医疗对话的特权反事实问题信用

PCQC利用特权患者信息构造反事实答案,为多轮医疗对话问题分配信用,提升诊断准确率并减少提问轮次。

04:00
arXiv cs.LG

强化学习始于强化学习之前:面向更优强化学习的同策略蒸馏

同策略蒸馏作为 RL 前置可提升最终表现,收益不只看初始精度;蒸馏目标需结合轨迹来源与后续训练选择。

04:00
arXiv cs.LG

面向混合专家模型的精确分位数均衡与负载误差注入

提出EQB精确全局分位数均衡与LEI负载误差注入,提升MoE全局与局部负载均衡及下游性能。

04:00
arXiv cs.LG

面向作业车间调度的基于图神经网络强化学习的课程学习

用课程学习训练GNN强化学习求解作业车间调度,可缩短训练时间,30×30时最优性差距降约8.1–8.6个百分点。

04:00
arXiv cs.LG

共享全局KV与层特定局部历史

共享全局KV时,保留层特定局部历史可降测试困惑度约1.4%,但缓存更大、长请求延迟更高。

04:00
arXiv cs.LG

LAYERSCOPE:视频与多模态学习表征的逐层刻画

提出无标签逐层分析框架LAYERSCOPE,以几何指标比较视频与多模态模型各层表征,发现中间层常优于末层。

04:00
arXiv cs.LG

Fed-ReMasker:特征级缺失下的联邦表格插补

将ReMasker用于联邦表格插补,使各中心借协作知识填补本地未观测特征;在特征级缺失基准中误差最低且鲁棒。

04:00
arXiv cs.LG

PISCES:面向空间天气异常检测与预警的物理信息太阳风卷积自编码器

PISCES:物理约束太阳风卷积自编码器,无标签训练OMNI数据,分解异常贡献,可提前预警空间天气。

04:00
arXiv cs.LG

概率化且几何感知的刮削层等离子体模拟神经代理模型

提出概率化几何感知神经代理,将曲线网格展为图像张量,用条件流匹配捕捉多态并恢复分叉分支。

04:00
arXiv cs.LG

中文标题:面向在线线性规划的免重求解资源自适应随机梯度下降 中文摘要

提出RASGD,仅用单次请求与当前库存更新资源价格,无需重求解LP,期望遗憾O(log T)达到下界,计算高效。

04:00
arXiv cs.LG

对数深度循环语言建模

以平衡树递归算子实现自回归预测,用对数深度、线性时间建模语言,长度外推稳健,性能接近ALiBi Transformer。

04:00
arXiv cs.LG

用可微分高斯表示学习集体动力学

提出可微分高斯动力学DGD,用高斯混合、可微聚合与反馈递归从聚合计数学习群体动态,预测优于DeepAR。

04:00
arXiv cs.LG

地理空间嵌入可检测原始林,但缓冲空间验证削弱其相较Sentinel特征的优势

地理空间嵌入可识别原始林,但缓冲空间验证下其较Sentinel特征的优势收窄,TESSERA无缓冲时最佳。

04:00
arXiv cs.LG

hyperbolix:JAX 中的双曲深度学习

首个JAX通用双曲深度学习库,涵盖六种流形、各类网络层与黎曼优化器,float32下数值精度高。

04:00
arXiv cs.LG

置信度不足:优化带来的非对称确定性增益阻碍多模态分类

针对多模态优化中强弱模态置信度非对称增益,提出最大置信度正则化MaxCR,校准模态置信度以提升分类性能。

04:00
arXiv cs.LG

面向纵向血糖表征的可迁移证据重建

提出可迁移证据重建TER,跨组不重训读者恢复证据,CGM 14项任务12项最佳,指标显著提升。

04:00
arXiv cs.LG

记忆注意力

提出记忆注意力机制,用token索引记忆结合上下文键构建值,推理时可折叠归一化并支持CPU卸载,实验表明语言建模及下游任务性能均提升。

04:00
arXiv cs.LG

何时何地信任教师:通过熵校准的信用分配统一同策略蒸馏与GRPO

提出UECR-GRPO,在响应与词元级统一验证器与教师信号,以熵校准重分配信用,提升数学推理。

04:00
arXiv cs.LG

支持编译式特征折叠:跨表格基础模型以更低内存获得更多证据

免训练SCFF把二次特征交互转为线性,显存降2倍以上并提升表格模型精度。

04:00
arXiv cs.LG

面向外骨骼个性化的上下文连续偏好学习

提出上下文连续偏好学习,跨相近工况共享偏好数据,仅需五次暴露即可提升外骨骼个性化效果。