11802 条条目 · 106 个活跃源
2026年7月23日
04:00
arXiv cs.LG

正交化读取是可移除的循环记忆训练支架

正交化读取是可移除的训练支架,通过重新调节学习问题促进逃逸平台期,非真正记忆改进。

04:00
arXiv cs.LG

使用图神经网络预测地下水中砷浓度

利用图神经网络结合空间数据预测地下水砷浓度,效果优于梯度提升树,助力风险监测。

04:00
arXiv cs.LG

可解码但不可检测:近分布外基准的泄漏指纹

发现基准泄漏致OOD检测失效,提出泄漏指纹诊断:可解码但不可检测。

04:00
arXiv cs.LG

基于隐私保护表格学习的预测性单细胞基础模型用于基因调控与衰老

Tabula结合联邦学习与表格学习,实现隐私保护单细胞建模,揭示基因调控与衰老机制,发现年轻化因子。

04:00
arXiv cs.LG

REGEN:基于离线强化学习的专家到通才蒸馏中的重放回收

REGEN通过回收专家重放记忆结合离线RL训练通才,解耦采样与训练,大幅降本,性能媲美MOPD。

04:00
arXiv cs.LG

在差分隐私下恢复临床效用:自适应联邦聚合在异构心血管数据集上的实证验证

FedCVR在五个真实心血管数据集上验证,隐私预算约4.2时F1达79.2%、AUC 0.96,显著优于标准FedAvg,表明临床可行性。

04:00
arXiv cs.LG

自适应多专家图转换器用于可解释的基于EEG的诊断

提出自适应多专家图转换器,建模EEG动态功能连接图,实现亚型感知推理与可解释诊断,实验有效。

04:00
arXiv cs.LG

面向多变量时间序列预测的多尺度时间补丁结构化潜在空间建模

M2Patch通过双约束构建结构化潜在空间,实现线性复杂度、鲁棒的多变量时间序列预测。

04:00
arXiv cs.LG

NMR解析:智能搜索问题,而非建模问题

将NMR解析重构为LLM引导的约束搜索,自主代理性能超越研究生及深度学习模型,准确率达71%-80%。

04:00
arXiv cs.LG

复现循环Transformer:CoTFormer

CoTFormer以循环隐式计算模拟思维链,评估困惑度与效率,并检验归纳推理的分布外泛化能力。

04:00
arXiv cs.LG

船舶发动机故障数据集:受控参考与故障场景下的开放数据

公开的船舶发动机故障数据集,含五种物理干预故障及多传感器时序数据,为海事机械状态监测提供基准。

04:00
arXiv cs.LG

大语言模型微调中奖励感知的进化策略种群规模缩放

强模型下二进制奖励ES禁用归一化后N=2有效,零优势概率决定可用阈值。

04:00
arXiv cs.LG

遗忘即分布恢复:一项受控反事实研究、一种经过验证的选择性筛选,以及无Oracle认证的局限性

重新定义遗忘为分布恢复,揭示常见评估标准缺陷,提出选择性筛选与理论界限。

04:00
arXiv cs.LG

安全护栏成替罪羊:审计工具增强型LLM智能体中的不忠实安全拒绝

安全提示语使工具静默失败时的不忠实安全拒绝增加15.6倍(0.25%→3.95%),源于模型虚构安全理由。

04:00
arXiv cs.LG

预测极值,无利策略:基于蜡烛图的币安现货择时模型AI辅助审计

AI审计发现,基于蜡烛图的加密货币极值预测模型均无法盈利,多个策略亏损,最终结论为不交易。

04:00
arXiv cs.LG

利用PR-GAN与反事实方法生成指定故障概率的轴承振动信号

提出两种方法生成指定概率的轴承故障信号,反事实法误差低至0.005-0.008,PR-GAN误差较大但运行更快。

04:00
arXiv cs.LG

以智能体为中心的动物姿态预测

提出以智能体为中心的动物行为建模框架,从姿态数据训练自回归模型,捕捉社会行为分布,发布通用库支持表示变换与比较。

04:00
arXiv cs.LG

自回归模型中的总变差距离估计

提出三种访问模型下总变差距离估计的查询复杂度改进,实验验证实用性。

04:00
arXiv cs.LG

MoA结构化解码注意力DNF推导、KV缓存累积、GQA/MQA与OpenACC内核

利用阵列数学推导四种内存优化的注意力推理组件,实现KV缓存与注意力机制的高效计算。

04:00
arXiv cs.LG

基于地理空间扩散的演化合成(GeoDES)用于聚焦风暴的天气增强

GeoDES是图像到视频扩散模型,合成物理一致的风暴演化视频用于气象数据增强,涡旋误差降52%,相关系数升8%

04:00
arXiv cs.LG

层神经网络是否利用和乐?一项测量-干预-控制研究

首次基无关测量SNN三角形环路旋转,发现旋转提升与任务相关,但简单模型更优,揭示旋转非唯一驱动因素。

04:00
arXiv cs.LG

SynPre-FL:合成数据驱动的预训练融合联邦学习训练框架

SynPre-FL框架融合合成数据预训练与联邦学习,提升非IID临床风险预测的鲁棒性与可解释性。

04:00
arXiv cs.LG

C-index幻觉:已发表生存模型中忽视校准的判别性评估

仅用C-index评估生存模型会因忽略校准和时间依赖性而产生误导,真实模型校准失败显著,风险估计偏差高达近4个百分点。

04:00
arXiv cs.LG

可信的隐私保护多模态联邦学习用于个性化乳腺癌预测

研究证明联邦学习可在隐私保护下实现与集中式相当的乳腺癌预测性能,支持个性化治疗规划。

04:00
arXiv cs.LG

训练深度神经网络分类器中的端到端差分隐私

提出标签公开的输入私有化训练,用Dirichlet机制实现端到端差分隐私,CIFAR10上ε=4准确率达88.17%,显著优于先前。

04:00
arXiv cs.LG

机制至关重要:知识图谱何时助力强化学习

知识图谱结构提升强化学习效率,但效果取决于注入机制,软机制优于硬机制,增益源于结构而非正则化。

04:00
arXiv cs.LG

Koopman Dreamer:基于频谱约束的潜在动力学实现稳定世界模型想象

提出Koopman Dreamer,通过频谱约束潜在动力学与混合训练目标,减少长期想象误差,提升控制稳定性。

04:00
arXiv cs.LG

SCPP:用于软聚类的统一Python库

SCPP是开源Python软聚类库,集成40种算法,兼容scikit-learn,提供统一接口与基准测试。

04:00
arXiv cs.LG

HypEMBER:基于超网络的集成方法用于参数化动力系统的鲁棒策略学习

融合超网络与集成学习,提升参数化动力系统控制鲁棒性与样本效率。

04:00
arXiv cs.LG

健全神经推理器的剖析:线索丰富补全中的一次性摊销、首次通过中毒与搜索惰性

神经求解器实际是一次性摊销预测,首次前向传播即决定结果,搜索仅消除重复无效推导,准确率由对称性和校准决定。

04:00
arXiv cs.LG

面向时间序列基础模型的专家引导预测编辑

DEFT框架利用趋势-季节分解与组件评分重用,在有限专家查询下平衡探索与利用,提升预测编辑效果。

04:00
arXiv cs.LG

面向大规模LLM推理的高效聚类与可证明护栏

提出两阶段算法,保证样本级相似与属性匹配,线性时间,比常见方法快10-1000倍,大规模部署降本50倍。

04:00
arXiv cs.LG

调度设计中无分类器引导的解析分布

通过解析路径积分揭示无分类器引导分布,提出分布引导调度,提升扩散模型生成质量与效率。

04:00
arXiv cs.LG

奖励模型评分能有多快?针对RLHF的C++和PyTorch推理运行时的系统研究

C++ ONNX引擎CPU评分快于PyTorch,GPU上torch.compile更优,批处理策略影响最大。

04:00
arXiv cs.LG

非线性偏置补偿自适应滤波器及其在时间序列预测中的应用

提出随机傅里叶偏置补偿通用自适应函数算法,解决输入噪声和鲁棒性问题,在时间序列预测中表现优越。

04:00
arXiv cs.LG

AlphaRoute:大语言模型作为多目标路由的语义优化器

AlphaRoute利用大语言模型动态调整参数,在多目标VLSI全局布线中实现98.6%溢出减少,优于现有技术。

04:00
arXiv cs.LG

用于Muon的保各向同性谱帽:理论与三个案例研究

针对Muon优化器导致的范数漂移,提出轻量级谱帽控制输出协方差,保各向同性并防止路由器坍塌和注意力头发散,验证损失不变。

04:00
arXiv cs.LG

OPIUM: 通过双目标潜在优化缓解引导外部性和过度拒绝

OPIUM通过双目标潜在优化,在激活空间中直接减轻引导副作用,改善安全与效用平衡。

04:00
arXiv cs.LG

Auto-Fill:利用专家语言模型精准预测缺失值

Auto-Fill通过后训练三个小型专家模型分别处理知识、文本和代码推理,以校准集成机制实现高精度低成本的表格缺失值预测。

04:00
arXiv cs.LG

存在潜在变量和选择偏差的局部因果结构学习

提出LoCaLS算法,在潜在变量和选择偏差下高效识别目标变量的直接因果,准确性与全局方法相当。

04:00
arXiv cs.LG

世界模型记住,行为者遗忘:持续基于模型的强化学习中的梦境排练

DreamerV3遗忘源于行为者,非世界模型;梦境排练(监督自我模仿)可恢复技能,实现任务无标签持续学习。

04:00
arXiv cs.LG

无时域依赖的强化学习渐近最优遗憾

针对齐次MDP提出新算法,实现无时域依赖渐近最优遗憾,上界~O(√(SAK)+S^8A^3),匹配下界,利用单调性与投影去除logH因子。

04:00
arXiv cs.LG

对抗前沿:面向鲁棒性评估的最小范数攻击集成

提出最小范数攻击集成框架,定义攻击/防御前沿,在可控查询预算下逼近,实现曲线式鲁棒性评估,超越AutoAttack。

04:00
arXiv cs.LG

RIS辅助无线联邦学习中的收敛-延迟感知自适应调制与资源分配

针对RIS辅助无线联邦学习,提出收敛-延迟感知的自适应调制与资源分配,实现更快收敛和更高精度。

04:00
arXiv cs.LG

基于广义卡尔曼滤波的时间差分强化学习

提出基于条件期望的广义TD框架,递归估计值函数及其不确定性,扩展卡尔曼TD至非线性非高斯系统。

04:00
arXiv cs.LG

用于光电容积描记信号机器学习模型的不确定性量化良好实践指南

QUMPHY项目为PPG信号机器学习模型的不确定性量化提供指南,涵盖模型选择、方法实现与验证及基准数据集。

04:00
arXiv cs.LG

CURED:错误创建、理解与修复演示器

基于ML的表格数据错误检测与清理演示器,支持数据扰动、ML清洗和错误理解。

04:00
arXiv cs.LG

评估与缓解基于机器学习的招聘中预训练嵌入的性别偏见

评估预训练嵌入性别偏见,发现性别擦除不能完全消除泄漏,对抗学习可提高公平性但非替代。

04:00
arXiv cs.LG

零样本心率变异性预测:使用时间序列基础模型从消费级可穿戴设备预测

研究评估三种时间序列基础模型在真实可穿戴HRV数据上无需微调即优于传统基线,平均MASE为0.81-0.87,为临床部署提供基线。

04:00
arXiv cs.LG

基于神经坍缩不稳定性的DNN测试用例优先级排序

提出NCIP框架,利用跨检查点预测变化性优先测试边界样本,实现高效故障发现,性能提升显著。