11311 条条目 · 106 个活跃源
2026年9月28日
04:00
arXiv cs.LG

PixSim:分析师容量约束下即时支付欺诈、追回与拦截的校准开源模拟器

开源校准的Pix模拟器,在分析师容量约束下模拟即时支付欺诈、追回与拦截,并评估策略。

04:00
arXiv cs.LG

面向虚拟传感的神经算子节能运行

神经算子复用空间计算降低虚拟传感更新能耗,高频下省约20%,固定功耗下最高省22.5%。

04:00
arXiv cs.LG

QSV:用于球面格上耦合四元数注意力的四元数球面视觉

QSV以每token单位四元数替代QKV,在球面kNN图上耦合注意力与特征传输;消融显示传输关键,几何增益不明显。

04:00
arXiv cs.LG

小型语言模型网状网络中的通信强化学习

小型语言模型网状网络学习通信,置信度提示与修正、去中心化投票,提升推理准确率并抗合谋。

04:00
arXiv cs.LG

面向基于深度强化学习的入侵检测系统的可解释概率鲁棒性驱动通用对抗扰动

提出概率鲁棒性驱动的通用对抗扰动,用可解释性约束生成PX-UAP攻击DRL入侵检测,优于现有方法。

04:00
arXiv cs.LG

无需中心极限定理的稳定初始化

提出正弦激活网络的均匀相位初始化,摆脱中心极限定理、解耦各层;在图像/音频拟合任务上超越SOTA,支持μP宽度缩放。

04:00
arXiv cs.LG

浅层 ReLU 网络中的总体损失:偏置与临界点族

给出含偏置浅层ReLU网络总体损失公式(Owen T函数),证明伪极小值族扩展且损失严格下降。

04:00
arXiv cs.LG

交互式智能体中的因果保持:接口分解与选择性适应

因果保持要求冻结状态响应独立机制探测;接口分解与选择性适应可提升机制变化下的因果识别,而非仅任务充分。

04:00
arXiv cs.LG

语言模型中的上下文内绑定容量

语言模型上下文绑定容量随规模幂律增长,受预训练配方影响;干扰降低容量,任务训练超零样本外推但标准不同。

04:00
arXiv cs.LG

面向不确定动力系统的可证明神经网络观测器学习

两阶段训练框架:Lyapunov预训练加LMI微调,实现可证明稳定且更快的神经网络观测器。

04:00
arXiv cs.LG

机制感知集合条件化用于数据受限极端事件模拟

提出机制感知集合条件化,利用局部不稳定几何提升数据受限下极端事件模拟。

04:00
arXiv cs.LG

内生可解释的描述符组合在低数据分子测定中媲美2048维基础嵌入

可审计描述符组合在低数据分子测定中平均AUC 0.762,媲美2048维基础嵌入0.764,满足汇总等效门槛。

04:00
arXiv cs.LG

LUMO(轻量级统一多语言编排器):一种隐私保护型离线语音助手

隐私保护离线语音助手,集成ASR、量化LLM与TTS,在树莓派5低延迟低功耗运行,支持英语和孟加拉语

04:00
arXiv cs.LG

面向深度学习的可微分RNA二级结构提取

提出可微分SDSM归一化,可直接输出RNA碱基配对概率矩阵,免去结构提取,性能优于基线。

04:00
arXiv cs.LG

面向通用的基于表示的过程控制

将窗口级监控重构为参考分布假设检验,结合预训练时序编码器、核密度估计与保形校准实现有限样本有效推断。

04:00
arXiv cs.LG

跨医院分布偏移下的缺失感知共形预测

提出缺失感知共形校准,按测量缺失分组,改善跨医院死亡预测最差组覆盖,但汇总评估或误导。

04:00
arXiv cs.LG

当一万个窗口不等于一万次检验:滑窗时间序列分类的统计置信度审计

滑窗重叠使测试窗口非独立,统计置信度被高估;审计方法按三种泛化情形校准推断,区分预测数量与独立证据。

04:00
arXiv cs.LG

自适应日志记录下的反事实在线共形预测

提出倾向加权在线共形预测及双稳健变体,纠正自适应选择偏差,提升反事实覆盖与决策效果。

04:00
arXiv cs.LG

NEMSim:通过可执行事件-机制先验学习控制条件下的多事件物理动力学

NEMSim将事件属性描述编译为可执行转移结构,学习受控多事件物理动力学,较最强基线RMSE降低58.9%-81.3%。

04:00
arXiv cs.LG

循环Transformer的量化:反馈暴露与校准盲区

循环Transformer低比特量化存在两类失效:非残差循环入口层的反馈暴露,与仅用首步激活校准的校准盲区;跨循环步累积Hessian可全面优于RTN并恢复bf16精度。

04:00
arXiv cs.LG

面向粒子模拟的自适应交互图

用逐粒子方差头驱动交互图自适应,高不确定粒子扩大邻域,在水滴数据集上实现严格帕累托改进。

04:00
arXiv cs.LG

EPOC:面向多步时间序列预测的保端点压缩残差状态在线校正

提出EPOC,用低阶DCT与残差端点压缩状态在线校正,多步预测MSE降15.4%、MAE降9.35%。

04:00
arXiv cs.LG

MOPD-Router:重新审视多教师在线策略蒸馏中的教师路由

逐token路由教师监督、免领域标签的MOPD-Router,ExpertAlign在四类设定均最优。

04:00
arXiv cs.LG

基于贝尔曼分布证书的机会约束MDP学习

提出贝尔曼分布证书,为机会约束MDP给出上下界与无模型策略梯度算法,计算难度未必意味更高统计代价。

04:00
arXiv cs.LG

面向慢性健康管理的同伴锚定反事实路径规划

POROS以同伴可达行为构建反事实进展图,将慢病大行为差距分解为逐步改善路径,显著降低每步增益。

04:00
arXiv cs.LG

用奖励加权传输蒸馏对齐单步生成模型

奖励加权传输蒸馏,仅需生成样本与标量奖励,通过特征空间最优传输与不动点回归后训练单步生成模型。

04:00
arXiv cs.LG

用于同步语音转文本翻译的基于注意力的自适应策略

提出RFAP与DCAP,交叉注意力对齐,免重训流式翻译;RFAP提BLEU降延迟,DCAP低延迟保质

04:00
arXiv cs.LG

CacheReforge:面向演进适配器的陈旧KV缓存有界恢复

将陈旧KV缓存视为分层混合版本对象,按适配器敏感度有界重算,仅重算5.44%层,KL散度降92.4%。

04:00
arXiv cs.LG

对哪种模型变化鲁棒?鲁棒反事实解释的统一评估

统一协议以八类模型变化评测六种鲁棒反事实方法,发现表现随变化族而异、鲁棒保证难迁移,RobX最稳定。

04:00
arXiv cs.LG

面向多缺失数据的鲁棒图聚类网络

提出RGCN,应对属性与结构同时缺失,借双分支插补、多超球混合先验与边界感知对比学习提升聚类。

04:00
arXiv cs.LG

PORL:面向作业车间调度问题的预训练离线强化学习

PORL先在线预训练,再以KL约束离线微调,用于作业车间调度,优于离线RL且更抗数据质量下降。

04:00
arXiv cs.LG

迈向理解河谷型损失景观中的动量加速

河谷景观中,动量靠稳定大学习率、防偏离河道加速;极平坦慢旋河谷下,加速主要源于更大可允许学习率,而非动量本身。

04:00
arXiv cs.LG

学习气候模型中强迫对温度影响的分层因果表征

提出分层因果表征学习框架,分离内部变率与温室气体、气溶胶强迫响应,准确预测全球及区域温度演变。

04:00
arXiv cs.LG

物理信息神经网络的梯度手术

提出物理感知梯度手术PAM-GS,按冲突类型自适应缓解PINN任务干扰,提升精度与平衡性。

04:00
arXiv cs.LG

鲁棒后继特征

提出鲁棒后继特征,统一奖励与转移核泛化,给出GPI性能界并在网格基准验证。

04:00
arXiv cs.LG

混合语言模型中的低比特循环状态

无需校准,格拉姆矩阵加权混合精度量化;4比特混合语言模型循环状态降低负对数似然差距,6比特逼近浮点基线。

04:00
arXiv cs.LG

视觉-语言-动作模型的线性表示假设

VLA中QoI随动力学演化,提出签名式线性表示假设,统一表示与策略,实现线性探测与引导。

04:00
arXiv cs.LG

LipSSM:基于相邻SSM层间度量传递的结构化Lipschitz有界级联状态空间模型

提出LipSSM:在级联状态空间层间迁移度量,获更紧Lipschitz界并建模长程依赖,理论实验验证

04:00
arXiv cs.LG

面向移动系统的元认知选择性集成

MetaSE利用模型可靠性短期持续性维护小活跃集,按需路由,精度媲美全集,速度快2.7倍、省69%内存。

04:00
arXiv cs.LG

域偏移下以教师为锚的训练后量化模型选择

研究域偏移下标签缺失或稀少时的量化模型选择,教师锚定可降低小标签预算下的选择遗憾,标签增多后优势消失。

04:00
arXiv cs.LG

残差流的有效深度

提出“有效深度”指标,量化残差流表示相似度随层距的衰减;16个大模型多低于理论参考,源于残差更新相关而非深度未用。

04:00
arXiv cs.LG

Aurora-X:专为极端时间序列预测打造

Aurora-X:十亿级时间序列基础模型,渐进课程与统一架构,支持概率预测、测试时缩放,多基准达SOTA。

04:00
arXiv cs.LG

基于Fisher信息几何的贝叶斯优化:梯度界与信赖域方法

从信息几何视角研究贝叶斯优化,用Fisher度量拉回得梯度上界,解释高维梯度消失,提出信赖域方法FITR。

04:00
arXiv cs.LG

从捷径学习到离散神经插入排序

针对捷径学习提出离散神经插入排序;长度16训练在64/128达100%排序准确率,但需全局内循环状态监督。

04:00
arXiv cs.LG

SAGE:面向物种分布建模的采样感知全球评估基准

提出SAGE基准,按采样强度与多度分组评估5771种植物;深度学习仅对少记录物种更优,需偏差校正。

04:00
arXiv cs.LG

对数线性复杂度的块稀疏注意力

PISA用金字塔Top-K分层选键,实现O(N log N)块稀疏注意力,语言建模相当、检索更优。

04:00
arXiv cs.LG

构造对抗者:一种结构感知的攻击方法

提出结构感知优化框架,将频率对抗攻击表述为加权ℓ2投影,跨架构生成高效攻击。

04:00
arXiv cs.LG

分布式学习即服务:开发者视角

从开发者视角展示DLaaS:经管理面板声明式启用差分隐私、拆分学习等机制,端到端演示智能家居唤醒词任务。

04:00
arXiv cs.LG

CRNDiff:基于化学反应网络的计数原生扩散框架

CRNDiff用化学反应网络实现计数原生扩散,结合罕见亚群条件采样,在单细胞数据上条件保真度高。

04:00
arXiv cs.LG

WorldTS:面向多模态协变量感知时间序列预测的世界建模

WorldTS以两阶段世界建模将多模态协变量融入潜在状态动态,在21个真实数据集上验证有效。