11842 条条目 · 106 个活跃源
2026年7月20日
04:00
arXiv cs.LG

硬规则与软偏好:融合推理、学习与优化生成个性化打包清单

提出三阶段框架(符号引擎+偏好学习+CP-SAT优化),实现99.7%召回率与100%约束满足,部署后清单完成率翻倍。

04:00
arXiv cs.LG

面向腾讯UNI-REC挑战赛的带双流双线性融合的场感知RankMixer

提出FA-RankMixer模型,采用双流双线性融合与场感知机制,在KDD Cup 2026腾讯UNI-REC挑战赛中排名第九。

04:00
arXiv cs.LG

ASK-NN:一种检测自然语言分布漂移的不对称最近邻检验

基于有向k近邻图的不对称双样本检验,高效检测LLM幻觉与文本分布漂移。

04:00
arXiv cs.LG

知识辅助的多图依赖学习用于多阶段工业过程多元时间序列异常检测

提出知识辅助多图框架,融合过程知识与数据驱动,通过多图注意力网络提升多阶段工业过程异常检测性能。

04:00
arXiv cs.LG

Toward Federated Multimodal Graph Foundation Models: A Topology-Aware Multimodal Alignment Framework

04:00
arXiv cs.LG

跨电网层级的电负荷预测基准:时间序列Transformer优于现有方法

负荷预测基准显示Transformer方法误差降低6.6-10.7%,标准架构最优,长上下文和重训练至关重要。

04:00
arXiv cs.LG

CardioMeta:跨人群与电子健康记录数据的糖尿病、高血压及心血管疾病校准多任务预测

CardioMeta多任务框架联合预测三种心代谢疾病,重点在于泄漏控制、校准概率和跨数据源可靠性。

04:00
arXiv cs.LG

无需更深网络,学习更快:受A*启发的批量选择实现高效CNN训练

提出A*-BS智能批量选择策略,轻量模型性能超越深层网络,训练更高效。

04:00
arXiv cs.LG

CoG引导的容错深度神经网络权重修正方法

提出基于重心(Center of Gravity, CoG)的权重修正方法,无需重训或改架构,大幅提升容错能力,LSTM网络最高提升230倍。

04:00
arXiv cs.LG

面向物理信息学习的可训练样条表示

提出PI-Splines架构,用可训练B样条直接参数化微分方程解,保留残差训练,提供紧支集与解析导数。

04:00
arXiv cs.LG

从扩散到反应-扩散:超图神经网络中过度平滑的动力系统视角

动力系统视角揭示超图过度平滑为横向能量耗散,提出反应-扩散HNRD补偿扩散,保持能量非零,实现深度传播。

04:00
arXiv cs.LG

XAI驱动数据缩减,助力时间序列分类规模化

drXAI通过XAI归因实现80-90%数据缩减,保持分类精度,使大规模模型能处理此前不可及的数据集。

04:00
arXiv cs.LG

AquaAugmentor:一种新颖的用于饮用水可饮用性预测的特征增强算法

提出AquaAugmentor特征增强算法,提升低维数据集上的饮用水可饮用性分类预测性能,经测试准确率和AUC评估有效。

04:00
arXiv cs.LG

使用线性自注意力Transformer在简单线性回归任务中上下文学习闭式解

提出线性自注意力Transformer通过层归一化近似获得简单线性回归闭式解,而非梯度下降。

04:00
arXiv cs.LG

单通道表面肌电图在手势分类中的探索性研究

单通道肌电信号结合特征降维与神经网络,手势分类准确率达90%,适用于低成本低功耗系统。

04:00
arXiv cs.LG

数据原生全局优化的大数据K-means聚类

Big-means++通过样本诱导替代景观和流动最优策略,结合多智能体异步搜索,实现大数据K-means高效全局优化。

04:00
arXiv cs.LG

随机基本图建模的半参数框架

提出半参数框架,融合物理约束与神经网络,实现优于基线的交通流概率建模。

04:00
arXiv cs.LG

ContinuityBench: 多提供商大语言模型路由中有状态故障切换的基准测试与系统研究

提出有状态故障切换架构与指标,实现99.2%对话连续性,优于无状态近0%,并开源测试工具。

04:00
arXiv cs.LG

基于矩阵乘积算子的多元多项式优化(MPO)^2

提出MPO^2框架,结合MPO嵌入与紧凑权重张量,实现特征顺序无关的多项式逼近,性能优于现有张量分解模型。

04:00
arXiv cs.LG

论瓶颈生成架构中边界搜索蒸馏的失效

边界搜索蒸馏在瓶颈生成架构中失败,因耦合分类器与独立采样导致梯度冲突,流形感知合成可替代。

04:00
arXiv cs.LG

使用振荡神经网络求解数独的图着色方法

基于振荡神经网络改进图着色求解器,加入约束,在4×4和9×9数独上实现高精度求解。

04:00
arXiv cs.LG

知识引导的跨模态融合实现成人至儿童心电图迁移:基于标签条件的对比对齐

PEACE框架通过知识引导与标签条件对比对齐,在少样本下实现成人ECG向儿童高效迁移,零样本AUC达59.39%。

04:00
arXiv cs.LG

QUADS: 通过双侧量化误差对齐稳定MoE的NVFP4强化学习

QUADS利用双侧误差对齐稳定NVFP4 MoE强化学习,精度达BF16,吞吐量比FP8高16%。

04:00
arXiv cs.LG

DADiff:基于扩散的跨域策略自适应强化学习

DADiff利用扩散模型生成轨迹差异估计动态不匹配,通过奖励修正或数据选择实现跨域策略自适应,理论证明性能差异有界,实验效果优越。

04:00
arXiv cs.LG

DebrisTracer: Reliable Tracking in Hypervelocity Impact Fast Imaging

04:00
arXiv cs.LG

基于表格基础模型的数据驱动动态安全评估再探讨

表格基础模型通过上下文学习评估动态安全,无需重训练,样本减少两个数量级,新事故10样本即可泛化。

04:00
arXiv cs.LG

基于物理的深度时空超本地雷达即时预报:多变量U-Net用于高分辨率降水预测

提出紧凑雷达临近预报框架,用多变量U-Net预测未来90分钟降水,在孟买验证优于持续性预报,秒级运行。

04:00
arXiv cs.LG

AlphaFold2的神经光谱分析揭示编码的蛋白质构象景观

平滑AlphaFold2权重进行神经光谱分析,揭示其编码的构象景观,扰动下重现实验折叠顺序。

04:00
arXiv cs.LG

约束赫布学习支持结构约束下的高效表征分配

赫布学习在结构约束下降低表征成本,以可比性能实现更低任务信息成本,支持突触资源分配。

04:00
arXiv cs.LG

DELUGE:基于可解释条件化基础模型嵌入的洲际尺度每日雨洪灾害预测

DELUGE多模态框架通过可解释条件化基础模型嵌入,实现洲际每日雨洪损失预测,性能优于传统模型9%-30%。

04:00
arXiv cs.LG

呈现而非机制:废弃感知记忆评估中的呈现混淆

废弃感知记忆评估中呈现是主要混淆,控制后粗失效优于细粒度,细粒度无增益。

04:00
arXiv cs.LG

CLaC@FinMMEval 2026 任务三:基于情感增强的深度强化学习主动交易——Alpha奖励方法

提出情感增强深度强化学习(DDPG/DQL)结合Alpha奖励,在比特币与特斯拉交易中大幅超越买入持有策略。

04:00
arXiv cs.LG

PRISA:面向交叉口安全评估的主动式基础设施激光雷达框架

提出PRISA框架,利用LiDAR和边缘计算实时预测冲突、评估交叉口安全,延迟低至194ms。

04:00
arXiv cs.LG

行为条件化神经过程用于自适应居民短期负荷预测

提出行为条件化神经过程,利用推断行为结构条件化预测居民负荷,提升异构场景精度与不确定性量化。

04:00
arXiv cs.LG

对改进核偏最小二乘法的进一步改进

优化R和Q计算:R直接评估,Q复杂度从O(KM)降至O(M),孤立步骤加速高达百倍,整体2-6倍。

04:00
arXiv cs.LG

诚实法定人数问题:面向智能体基础设施的认知拜占庭容错

发现协议合规的智能体推理错误可导致无效共识,提出EBFT模型以独立量化语义安全与活性退化风险。

04:00
arXiv cs.LG

一种具有改进洛伦兹激活函数的物理信息神经网络,用于动态密度泛函理论中的非局部梯度流方程

改进洛伦兹激活函数的PINN求解DDFT非局部梯度流方程,加速收敛,数值验证了准确性与物理一致性。

04:00
arXiv cs.LG

物理增强强化学习用于动态系统实时最优控制

提出PEARL范式,融合可微动力学与actor-adjoint算法,实现高维动态系统的高效实时最优控制。

04:00
arXiv cs.LG

PagedWeight:基于动态质量感知权重量化的高效MoE大语言模型服务

PagedWeight动态量化MoE权重以平衡精度与缓存,实现FP16精度,节省72%内存,吞吐提升1.94倍,同内存下质量提升39.3%。

04:00
arXiv cs.LG

基于平衡态的可微连续变量热力学计算蓝图

提出平衡态可微热力学计算蓝图,利用物理硬件随机过程实现节能高效概率机器学习。

04:00
arXiv cs.LG

MLLM-DataEngine:闭环多模态指令微调数据生成

提出闭环系统MLLM-DataEngine,自适应采样劣势案例并用GPT-4生成数据,迭代提升模型能力,无需人工干预。

04:00
arXiv cs.LG

重训练寻求稳定信号

存在稳定信号时,正则化重复风险最小化几何收敛至信号方向,模型影响大亦成立,揭示正则化控制表演性新作用。

04:00
arXiv cs.LG

DyneTrion:跨时间尺度蛋白质动力学的时空一致生成模拟器

DyneTrion:三重注意力生成模型,高效模拟蛋白质动力学,保持时空一致性并再现自由能景观。

04:00
arXiv cs.LG

基于熵的特征的影响研究

熵特征能有效提升网络异常检测性能,减少误分类且计算成本低,适合轻量级应用。

04:00
arXiv cs.LG

基于Choquet积分的特征聚合提升网络异常检测

该框架通过自适应加权与增量特征选择,在保证精度前提下,准确率提升7%、数据量缩减77.5%,显著适用于带宽受限的实时入侵检测。

04:00
arXiv cs.LG

急诊科入院患者的主动住院床位请求

通过预测主动请求床位,平均住院时间减少30-70%,急诊停留减少6-15%,新闻供应商启发式效果最佳。

04:00
arXiv cs.LG

线性与逻辑回归中的仅预测蒸馏

仅用无标签数据蒸馏,混合教师与学生预测可降低岭回归风险,最优权重由小校准集估计。

04:00
arXiv cs.LG

针对突发干扰信道的闭环贝叶斯强盗编码器与GRAND接收机

自适应切换编码模式,结合GRAND接收机学习噪声模型,误块率降低一个数量级,学习瞬态仅数毫秒。

04:00
arXiv cs.LG

托勒密的等分点通过机器学习等同于通用动力学钟

利用机器学习构建通用动力学钟,将任意振荡等价为均匀旋转,揭示集体振荡等新规律。

04:00
arXiv cs.LG

通过扰动保持记忆压缩的快速可扩展卡普托分数梯度下降

提出两种记忆压缩机制降低Caputo分数梯度下降计算成本,保证单调下降与线性收敛。