11852 条条目 · 106 个活跃源
2026年7月20日
04:00
arXiv cs.LG

MLLM-DataEngine:闭环多模态指令微调数据生成

提出闭环系统MLLM-DataEngine,自适应采样劣势案例并用GPT-4生成数据,迭代提升模型能力,无需人工干预。

04:00
arXiv cs.LG

重训练寻求稳定信号

存在稳定信号时,正则化重复风险最小化几何收敛至信号方向,模型影响大亦成立,揭示正则化控制表演性新作用。

04:00
arXiv cs.LG

DyneTrion:跨时间尺度蛋白质动力学的时空一致生成模拟器

DyneTrion:三重注意力生成模型,高效模拟蛋白质动力学,保持时空一致性并再现自由能景观。

04:00
arXiv cs.LG

基于熵的特征的影响研究

熵特征能有效提升网络异常检测性能,减少误分类且计算成本低,适合轻量级应用。

04:00
arXiv cs.LG

基于Choquet积分的特征聚合提升网络异常检测

该框架通过自适应加权与增量特征选择,在保证精度前提下,准确率提升7%、数据量缩减77.5%,显著适用于带宽受限的实时入侵检测。

04:00
arXiv cs.LG

急诊科入院患者的主动住院床位请求

通过预测主动请求床位,平均住院时间减少30-70%,急诊停留减少6-15%,新闻供应商启发式效果最佳。

04:00
arXiv cs.LG

线性与逻辑回归中的仅预测蒸馏

仅用无标签数据蒸馏,混合教师与学生预测可降低岭回归风险,最优权重由小校准集估计。

04:00
arXiv cs.LG

针对突发干扰信道的闭环贝叶斯强盗编码器与GRAND接收机

自适应切换编码模式,结合GRAND接收机学习噪声模型,误块率降低一个数量级,学习瞬态仅数毫秒。

04:00
arXiv cs.LG

托勒密的等分点通过机器学习等同于通用动力学钟

利用机器学习构建通用动力学钟,将任意振荡等价为均匀旋转,揭示集体振荡等新规律。

04:00
arXiv cs.LG

通过扰动保持记忆压缩的快速可扩展卡普托分数梯度下降

提出两种记忆压缩机制降低Caputo分数梯度下降计算成本,保证单调下降与线性收敛。

04:00
arXiv cs.LG

语音识别模型上的自然后门攻击

利用日常自然声作为触发器,仅需5%投毒样本即可高成功率攻击语音识别模型,隐蔽性强且不影响正常性能。

04:00
arXiv cs.LG

可交换性下的统计证据聚合

研究可交换性下统计证据聚合,通过置换校准提升检验功效,支持序列与自适应聚合。

04:00
arXiv cs.LG

非线性多尺度物理信息学习的统计公式差距

证明了非线性多尺度物理信息学习存在有限样本公式差距,强残差复杂度下界与εN相关,变分能量复杂度上界与ε无关。

04:00
arXiv cs.LG

有界区分器下的分布检验

用有界区分器类测试分布,连接可测试学习、学习算法验证和结构分布测试,获得新结果。

04:00
arXiv cs.LG

SpeechGuard:针对语音识别模型后门攻击的在线防御

提出SpeechGuard在线防御管道,通过自适应扰动注入和时频掩码净化,有效过滤和抑制后门攻击。

04:00
arXiv cs.LG

动力学感知元模仿:泛化至未见机器人操作

DAMI框架融合元学习与动力学感知,从演示学习任务逻辑,实现未知任务泛化,实验优于基线。

04:00
arXiv cs.LG

哪些超参数至关重要?基于博弈论的可解释超参数敏感性分析框架

提出博弈论框架,用Shapley效应与帕累托前沿分析超参数敏感性,提供可解释洞察以指导优化与早期评估。

04:00
arXiv cs.LG

单次系统辨识的零一律

单次辨识存在零一律:要么无法由任何输入唯一确定系数,要么几乎所有随机输入均可,并提供了后验认证。

04:00
arXiv cs.LG

使用强化学习学习趋避任务:向量化仿真与基准

首次建立真实复杂场景下的机器人臂趋避任务基准,经并行化仿真实现高成功率,但表明DRL在真实场景性能下降,仍需进一步研究。

04:00
arXiv cs.LG

代码投毒属性推断攻击

提出首个代码级属性推断攻击(CPPIA),实现100%攻击准确率且不降低模型精度,计算轻量。

04:00
arXiv cs.LG

异构图神经网络对节点分类真的有效吗?一个因果视角

从因果视角分析,模型架构无因果效应,异构信息通过增强同质性和分布差异提升节点分类性能。

04:00
arXiv cs.LG

基于拉普拉斯最优传输的聚类感知匹配

提出拉普拉斯最优传输正则化实现聚类感知匹配,并引入RSC方法获得一致分区。

04:00
arXiv cs.LG

用于基因调控网络推断的深度与概率模型

本文提出PMF-GRN和GLM-Prior两个框架,结合概率推断与序列先验,实现网络的不确定性建模与跨物种泛化。

04:00
arXiv cs.LG

面向起点到终点飞行问题的MPC策略的Pick-to-Learn校准

本文展示Pick-to-Learn方法校准MPC策略,用于飞机航程问题,从400场景中选出2个,满足概率风险界4.8%。

04:00
arXiv cs.LG

利用黎曼流匹配从LHC数据学习标准模型结构

ShellFlow模型从LHC真实数据中直接学习标准模型结构,复现粒子质量和共振峰。

04:00
arXiv cs.LG

因果森林中的诚实性:何时有益,何时有害

诚实估计减少过拟合但增加欠拟合,异质性大时需多27%数据,应视为正则化而非默认选项。

04:00
arXiv cs.LG

AutoSpec:神经网络规范的自动生成

AutoSpec框架自动生成并评估神经网络规范,树算法划分输入空间,统计认证保证精度,F1分数提升达73%。

04:00
arXiv cs.LG

用可解释神经网络发现图动力学系统的可泛化控制方程

提出GKAN-ODE模型,在分布外图拓扑上精确发现方程,误差低两个数量级。

04:00
arXiv cs.LG

多边缘时间薛定谔桥匹配(基于未配对数据)

提出多边缘时间薛定谔桥匹配,从静态快照高效恢复高维隐藏动力学。

04:00
arXiv cs.LG

重新思考CLIP在无需训练的开词汇语义分割中的全局知识

GCLIP重塑注意力和Value嵌入聚合全局上下文,无需训练提升开词汇语义分割性能。

04:00
arXiv cs.LG

面向能效去中心化联邦学习的时变混合矩阵设计

提出时变混合矩阵设计,最小化每节点最大能耗,平衡收敛速度,实验验证有效。

04:00
arXiv cs.LG

超图半监督学习分析

分析超图半监督学习渐近一致性,提出HOHL多尺度正则化,收敛到p-Laplacian及高阶Sobolev半范数,实验验证有效性。

04:00
arXiv cs.LG

用于下游预测的配置混合

提出CMP与MixConfig模块,自适应加权聚类配置,提升下游预测,尤其低数据场景。

04:00
arXiv cs.LG

SC-JEPA:稳定时间序列异常预测的潜在预测学习

提出SC-JEPA框架,用软码本瓶颈稳定潜在学习,多分辨率建模前兆,实现强早期预警。

04:00
arXiv cs.LG

二分扩散策略优化

提出DIPOLE算法,通过二分策略分解实现稳定可控的扩散策略优化,在强化学习和自动驾驶任务中表现优异。

04:00
arXiv cs.LG

中文标题:一种简单得令人尴尬的大规模正交矩阵优化方法

中文摘要:提出POGO算法,仅需5个矩阵乘积,高效优化大规模正交矩阵,性能远超现有方法。

04:00
arXiv cs.LG

越狱需要多少轮?多轮LLM评估中的动态预算分配

DAPRO动态分配预算,无分布假设下提供多轮交互事件时间更紧下界,降低方差。

04:00
arXiv cs.LG

DualKV:共享提示词闪存注意力机制,用于大规模展开和长上下文的高效强化学习训练

DualKV消除共享提示词复制,加速RL训练1.6-3.8倍,MFU从36%提升至76%。

04:00
arXiv cs.LG

因子化神经算子分解动态与持久响应

FaNO分解动态与持久响应,提升可解释性与泛化,在长时程、跨尺度预测中保持一致性。

04:00
arXiv cs.LG

密度信息伪计数用于校准的证据深度学习

揭示标准EDL混淆不确定性导致OOD过自信,DIP-EDL解耦预测与密度,提升校准与鲁棒性。

04:00
arXiv cs.LG

基于轻量级CNN的散裂中子源高压转换器调制器异常检测

轻量级CNN通过优化时序与通道处理顺序及自适应重加权,在高压转换器异常检测中达最优(AUC-PR 0.816, AUC-ROC 0.934)。

04:00
arXiv cs.LG

复杂振荡器网络中的不稳定性:网络度量与机器学习的局限与潜力

网络度量与稳定性关系敏感易变,机器学习预测局限于特定网络集合,无法识别不稳定的结构根源。

04:00
arXiv cs.LG

极小极大和贝叶斯最优的最佳臂识别

提出两阶段自适应实验,实现固定预算下最佳臂识别的小极大和贝叶斯最优,上下界严格匹配。

04:00
arXiv cs.LG

基于时空排列熵的增强型分位数回归神经网络用于复杂系统预测

提出集成了时空排列熵与增强分位数回归的混合预测框架,实现分布式系统长时故障预测,168小时准确率达81.17%。

04:00
arXiv cs.LG

高能物理分析中的预训练事件分类模型

基于图神经网络的预训练模型,在1.2亿事件上学习通用表示,微调后显著提升小样本分类性能,编码器通用而图处理层分化。

04:00
arXiv cs.LG

新兴无线应用中可靠AI的无标签概念漂移评估

本文提出两种无标签概念漂移检测器,利用表示学习与统计检验,在无线定位和链路异常检测中F1达0.88-1.00,优于经典方法。

04:00
arXiv cs.LG

中文标题

强化学习与模型预测控制在住宅暖通空调中的现场部署对比:RL节能20.9%优于MPC的18.1%,但初期影响舒适度,部署工作量少三分之一。

04:00
arXiv cs.LG

基于局部图结构的流形维度估计

提出基于局部PCA回归捕捉图结构的流形维度估计框架,含QE和TLS两种方法,性能优于现有技术。