11852 条条目 · 106 个活跃源
2026年7月1日
04:00
arXiv cs.LG

潜探揭示自动驾驶:内部预测误差与自我规划的联系

通过测试揭示自动驾驶策略中预测与规划的内在关联,指出近碰撞时预测不足,纠正错误预测可提升安全规划。

04:00
arXiv cs.LG

代码大语言模型安全校准的实证研究

研究发现模型对生成代码安全性普遍过度自信,安全校准优于功能校准,但校准引导修复效果有限。

04:00
arXiv cs.LG

在线TT-ALS:带有增量正交化的流式张量分解

提出增量正交化约束的在线TT-ALS算法,实现高效流式张量分解,线性复杂度,高精度,适合实时处理。

04:00
arXiv cs.LG

动态高斯过程与标准SPDE交换

利用等价性构建混合方案,降低高斯过程时空推理的立方成本。

04:00
arXiv cs.LG

分裂共形预测的最优数据划分

提出分裂共形预测中最优数据划分理论,确定最小化预测区间长度的训练-校准比例,实验验证其有效性。

04:00
arXiv cs.LG

MNAR-$k$-均值:一种针对幅度衰减概率非随机缺失数据的$k$-均值聚类方法

针对非随机缺失数据,提出基于插补值大小约束的k-均值聚类,减小中心偏差,改善效果。

04:00
arXiv cs.LG

面向全球的风暴解析大气AI模拟扩展

全球首个风暴解析AI仿真器STRATA,基于4.9km数据训练,实现稳定24小时全球滚动,能效提升50倍。

04:00
arXiv cs.LG

无界区域中偏微分方程的域分解随机神经网络

提出域分解随机神经网络,近远场子网络耦合求解无界区域PDE,线性最小二乘,数值验证精度与灵活性。

04:00
arXiv cs.LG

CSO-LLM:用于LLM训练后后门检测与触发器逆向的类别子空间正交化方法

提出CSO框架,通过类别子空间正交化增强检测灵敏度与特异性,无需显式黑名单,实现LLM后门检测与触发器逆向。

04:00
arXiv cs.LG

通过精确的房间声学模拟改进多通道语音增强

高保真房间声学模拟增强训练数据,使多通道语音增强词错误率降低38%。

04:00
arXiv cs.LG

低秩矩阵优化的方向-幅度分解:更快的收敛与鞍点到鞍点动力学

提出方向-幅度分解框架,过参数化与递归方法使低秩矩阵优化比BM梯度下降指数级更快,实验验证有效。

04:00
arXiv cs.LG

从失败到对齐:面向机器学习系统的需求工程框架

提出REAL框架,融合数据/模型/系统需求,利用失败驱动探索与迭代细化,实现机器学习系统与利益相关者需求对齐。

04:00
arXiv cs.LG

基于机器学习的四旋翼未建模动力学反馈线性化控制

提出基于RBF神经网络在线学习的反馈线性化控制,补偿未建模动力学,提升四旋翼轨迹跟踪精度与收敛速度。

2026年6月30日
04:00
arXiv cs.LG

用张量网络建模儿童的情感记忆

情感效价顺序影响儿童记忆,张量网络建模准确率达77.98%,优于传统模型。

04:00
arXiv cs.LG

S-GAI:面向Sigmoid型MLP的谱几何感知初始化——从数据集几何到网络权重

S-GAI利用SVD提取类谱几何初始化MLP隐层,初始状态更丰富;冻结隐层时性能仍优于随机基线。

04:00
arXiv cs.LG

scKDGM: 基于KAN引导的动态图掩码学习用于单细胞RNA测序聚类

提出scKDGM框架,通过掩码扰动、表达恢复和对比学习优化单细胞RNA-seq聚类,在12个数据集上超越10个基线。

04:00
arXiv cs.LG

部分已知动力学下的分布式估计学习:一种协方差无关的神经卡尔曼一致性滤波器

提出CA-NKCF,结合部分动力学知识与深度学习进行分布式隐状态估计,无需噪声统计,鲁棒性优于传统滤波方法。

04:00
arXiv cs.LG

反事实残差数据增强用于回归

CRDA利用残差不变性生成新训练样本,有效解决回归任务样本少、噪声大问题,使MLP和XGBoost的MSE分别降低22.9%和6.4%。

04:00
arXiv cs.LG

深度单项式网络中的奇异学习与奥卡姆剃刀

深度网络临界点对应子网络,解释隐式偏差促模型收敛到简单函数。

04:00
arXiv cs.LG

设备级能源异常检测与LLM建议的自主AI管道

本管道结合时序预测与LLM推理,实现设备级异常检测与建议,动态检索高效,本地模型通过所有场景。

04:00
arXiv cs.LG

论网状智能对液态基底的必要性

网状智能必须采用液态基底,因需自适应时间尺度和时间间隔依赖,固定权重下两者缺一不可。

04:00
arXiv cs.LG

观点:强化学习研究者需区分解决模拟器与将模拟器作为代理使用

强调区分模拟器两种用法(解决模拟器 vs 作为部署代理),避免误导性结论。

04:00
arXiv cs.LG

AI能否绘制科学图表?一个评估文本到图像和多模态模型生成科学图形能力的基准

新基准SciDraw-Bench用四维协议测试科学图形生成,领域模型胜出,文本保真度仍是挑战。

04:00
arXiv cs.LG

微调反转的引力解释

提出引力解释:后训练回退由指向早期主导流形的方向驱动,抑制该方向可降低有害性且任务代价小。

04:00
arXiv cs.LG

一种可分部分训练的算子学习框架:融合DeepONet与Karhunen-Loeve展开用于大规模应用

提出KL-DNN框架用于地质碳存储,压力相对误差0.04%,饱和度5%,训练仅20分钟/GPU,推理<1分钟,比DeepONet快百倍。

04:00
arXiv cs.LG

当更多采样有害时:测试时缩放的模态天花板与相关性天花板

采样过多反损性能,模态和相关性天花板限制识别正确性,有效采样数揭示截止点,瓶颈在识别而非生成。

04:00
arXiv cs.LG

使用结构化时间融合提升层次时间序列预测的一致性

提出HTF模型,在训练中嵌入一致性损失,确保层次预测一致并提升精度。

04:00
arXiv cs.LG

NIVA:面向可操作地球系统智能的多模态基础模型

NIVA多模态基础模型学习地球系统耦合动力学,准确预测气候指数,为次季节到季节预测奠基。

04:00
arXiv cs.LG

神经网络证明嵌入中选择公理的几何测量

选择公理在证明空间有几何可测相关量,异常分数可预测定理证明器性能。

04:00
arXiv cs.LG

大语言模型所解释的并非其所信:基于模型自身输入信念评估解释充分性

针对LLM解释充分性提出SCSuff度量,发现解释普遍不充分且与模型规模弱相关。

04:00
arXiv cs.LG

多指标模型下经验风险最小化中的副本对称破缺与算法阈值

提出IAMP算法,精确刻画高维渐近下训练与测试误差,性能为多项式时间算法最优。

04:00
arXiv cs.LG

通过绝对扰动的线性赌博机随机探索

ATS和EATS通过绝对扰动实现乐观期望,兼具计算效率与简单分析,达到线性赌博机最优遗憾。

04:00
arXiv cs.LG

利用基于Mamba架构的表示改进纵向数据中的患者亚型分类

提出自监督Mamba模型,从EHR时序数据学习表示,提升患者亚型分类性能,优于基线模型。

04:00
arXiv cs.LG

金融领域的约束表格扩散模型

提出CTDF,在扩散采样中嵌入无训练可行性操作,强制执行硬约束,实现零违规并提升数据效用。

04:00
arXiv cs.LG

面向体制切换扩散模型中线性二次Stackelberg微分博弈的熵正则化强化学习

提出熵正则化强化学习,解决体制切换扩散下的线性二次Stackelberg博弈,有效避免次优均衡。

04:00
arXiv cs.LG

面向高斯过程回归的主动量子核获取

提出基于任务灵敏度的非均匀shot分配方法,实现10–21%测试RMSE提升。

04:00
arXiv cs.LG

世界模型中预测的路径空间公式:从单一行动到预测、规划与不可逆性

提出世界模型预测的路径空间公式,统一预测、规划与不可逆性,发现注意力不对称性反映数据不可逆性并影响长期预测。

04:00
arXiv cs.LG

层次化决策与结构化策略:基于逆优化的原则性设计

采用逆优化构建层次化决策框架,融合高层目标与底层策略,有效提升资源分配和碰撞避免任务的效率与决策质量。

04:00
arXiv cs.LG

HARD-KV:面向解码时KV压缩的头部自适应正则化

HARD-KV通过级联缓存与对数几率校准,解决静态-动态不匹配,实现2倍吞吐量且保持高保真生成。

04:00
arXiv cs.LG

论设计无偏的算法机器学习

探讨在有限总体中,基于抽样设计而非模型假设,实现算法机器学习无偏预测与评估的条件。

04:00
arXiv cs.LG

生成式学习:提升情感身体动作表达感知的工具

生成模型能隐式学习情感身体动作,并用于增强情感识别、提取代表性动作模式及合成情感强度平滑过渡。

04:00
arXiv cs.LG

闭式最速下降方向朝向平坦极小点:减小神经网络损失Hessian特征谱上界

首次提出闭式梯度,沿WS上界最速下降方向更新参数,缩小Hessian特征谱,收敛平坦极小点。

04:00
arXiv cs.LG

熵正则化强化学习在机制转换跳跃扩散过程中的零和随机微分博弈

引入分布控制对抗参数误设与结构突变,建立熵正则化零和随机微分博弈强化学习框架,推导HJBI方程并开发Actor-Critic算法,应用于投资博弈。

04:00
arXiv cs.LG

面向联邦类增量学习的Fisher路由专家混合模型

通过Fisher路由专家混合,自适应选择专家子集,解决联邦类增量学习的容量冲突、遗忘与异质性,理论收敛且性能领先。

04:00
arXiv cs.LG

MALOQ: 量子输运算子的海量加速学习

基于SO(2)-等变架构,MALOQ高效预测DFT哈密顿矩阵,训练时间减少30%,支持大规模材料图推理。

04:00
arXiv cs.LG

ReGuide:从测试时引导到自我改进的扩散策略

ReGuide利用分阶段条件引导生成纠正轨迹并吸收为训练数据,将扩散策略成功率提升1.3-7.7倍。

04:00
arXiv cs.LG

基于弱监督的机器学习驱动LDAP侦察检测

用弱监督ML框架检测LDAP查询,分类器真阳性率65%,签名精确率81.48%,成本低、效率高。

04:00
arXiv cs.LG

面向基于图神经网络的云网络安全异常检测改进

用图神经网络自监督学习分析云日志,动态生成异常分数,将告警量从数千降至约1条/小时。

04:00
arXiv cs.LG

DLR:零推理成本的潜在残差用于低秩预训练

提出DLR插件,零参数提升低秩预训练质量,训练后无损融合,不增加部署成本。

04:00
arXiv cs.LG

多智能体路由作为集值预测:WildChat基准与成本感知评估

提出WildChat多智能体路由基准,评估表明监督路由优于零样本LLM,微调编码器精度最佳,加权路由改善成本-准确率权衡。