11852 条条目 · 106 个活跃源
2026年7月10日
04:00
arXiv cs.LG

选择性左移:将测试时计算和基于难度的策展转化为低资源代码生成的训练数据

提出三阶段流水线,离线合成验证数据并融合SFT与RLVR,在低资源语言上性能显著提升,成本降低三分之二。

04:00
arXiv cs.LG

任意权重两层神经网络的鲁棒性定律

证明了两层神经网络任意权重下鲁棒性定律:拟合n个带噪标签时Lipschitz常数至少为sqrt(n/m)量级,对ReLU等分段线性激活成立。

04:00
arXiv cs.LG

基于专家混合的量子启发策略进行图像分类

提出混合经典-量子框架,多专家联合量子特征提取,分类错误率降低约一半。

04:00
arXiv cs.LG

编码器选择的重要性:一项表格-图像研究

本研究首次评估先进表格模型作为多模态编码器,解决了上下文学习模型的嵌入问题,强调编码器选择的重要性。

04:00
arXiv cs.LG

可扩展且可信的地球观测基础模型

地球观测基础模型需领域自适应,评估应关注模态感知迁移与物理合理性,而非仅基准精度。

04:00
arXiv cs.LG

深度强化学习评估与设计范式的原则性分析

本文分析深度强化学习评估与设计范式,揭示性能排名与数据规模的非单调关系,并指出范式导致错误结论。

04:00
arXiv cs.LG

组合优化视角下的可信机器学习:综述与研究展望

组合优化为可信ML提供全局保证和形式证书,在可解释性、鲁棒性、公平性等方面优于启发式方法,可扩展性仍是挑战。

04:00
arXiv cs.LG

解锁哈密顿视频动力学模型的时间泛化

针对哈密顿生成网络在非保守环境中的时间泛化失效,修复两种失败机制,实现超训练分布的时间分辨率稳定预测。

04:00
arXiv cs.LG

基于图正则化的脑电情绪识别深度学习框架及心理学标签结构

利用情绪拓扑图正则化,提升脑电情绪识别准确率达5.42%,减少不合理误分类39%。

04:00
arXiv cs.LG

小数据约束下的物理信息机器学习:来自磨料水射流铣削的经验教训

小数据下,物理信息机器学习中数据管理、评估设计和物理融合方式至关重要,高斯过程优于树模型。

04:00
arXiv cs.LG

利用卫星衍生的预测因子预测葡萄牙沿海的拟菱形藻有害藻华

基于卫星数据与集成树模型预测葡萄牙沿海拟菱形藻有害藻华,准确率达0.77。

04:00
arXiv cs.LG

path_boost: 一个基于路径梯度提升的可解释图级预测Python包

基于路径梯度提升,自动发现预测性子图路径,生成可解释加性模型,支持回归与分类。

04:00
arXiv cs.LG

中文标题

持续学习并非单一能力,不同环境变化需不同更新方式,决定何时需要内部学习或外部辅助。

04:00
arXiv cs.LG

NFTR:从可证明的模式平均到离线目标条件强化学习中的测地子目标选择

NFTR用归一化流和三角形松弛得分,避免子目标选择的模式坍缩与乐观偏差,实现稳定选择。

04:00
arXiv cs.LG

Explaining Near-Zero Hessian Eigenvalues Through Approximate Symmetries in Neural Networks

04:00
arXiv cs.LG

深度标量线性网络中的最优学习率缩放依赖于数据

最优学习率缩放依赖数据,无关规则失效;数据依赖缩放实现恒定线性收敛。

04:00
arXiv cs.LG

面向OLS回归的数据分区分布式草图法

研究数据分区分布式草图用于OLS回归,分析平均估计量超额损失,显示子集协方差散度小时性能与全局草图相当。

04:00
arXiv cs.LG

跨视觉、语言、视频和音频的多模态遗忘:方法、数据集和基准综述

综述多模态遗忘方法、数据集与基准,实现跨模态选择性移除敏感关联,同时保持模型整体效用。

04:00
arXiv cs.LG

通过潜在人格特质实现语言模型的高效安全对齐

提出LPA方法,用66条人格陈述对抗训练,无需有害数据实现近零攻击,训练快(单GPU数分钟,样本量少75倍)。

04:00
arXiv cs.LG

Collate:面向延迟关键型边缘系统的协作神经网络学习

提出Collate框架,动态调整异构模型架构,在满足延迟约束下平均提升准确率1.96%-3.09%。

04:00
arXiv cs.LG

谁分析分析者?基于宪法性元STPA的LLM自我验证危害分析

提出自验证框架,将STPA应用于自身,导出29条原则并验证其有效性。

04:00
arXiv cs.LG

Evaluating the Generalizability of Foundation Models for Extreme Environmental Events: Case Study of California Wildfire PM2.5

04:00
arXiv cs.LG

线性注意力架构:机制、权衡与跨层路由

论文对比多种线性注意力架构,发现Kimi Delta Attention+Muon损失最低,Gated DeltaNet吞吐量最高,跨层值路由(CLVR)改善性能。

04:00
arXiv cs.LG

KronQ:基于Kronecker分解海森矩阵的大语言模型量化

KronQ引入梯度协方差到量化流程,利用Kronecker分解海森矩阵实现双向不相关处理与混合精度分配,2-bit量化LLaMA-3-70B困惑度仅7.93,显著优于GPTQ。

04:00
arXiv cs.LG

协助游戏中可证明最优的学习算法

首次提出可证明高效的重复协助游戏学习算法,实现(1-1/e)近似遗憾率O~(T^{3/4}),证明最优性界限。

04:00
arXiv cs.LG

PGD-NO:用于百万级三维物理模拟的预计算几何分解神经算子

PGD-NO通过预计算几何分解实现线性内存扩展,支持千万节点网格,兼顾精度与可解释性。

04:00
arXiv cs.LG

精确信息论揭示贝叶斯扩散模型的泛化相变

提出BIRD模型,发现记忆-泛化信息论相变边界,信息限制是规避维度灾难关键。

04:00
arXiv cs.LG

重新思考小型VLM量化:从组件级分析到硬件感知的边缘部署

系统评估小型VLM组件量化,发现结构范式主导敏感性,INT4降低VRAM但增加生成延迟,SigLIP在特定硬件有瓶颈。

04:00
arXiv cs.LG

保留什么,遗忘什么:LLM与Agent中内存紧缩的率失真视角

统一LLM/Agent内存压缩为率失真决策,提出七轴分类与跨层迁移,揭示重复压缩评估空白,给出原则与基准建议

04:00
arXiv cs.LG

强化多模态掩码扩散模型的生成顺序

通过GRPO训练控制模块优化生成顺序,文本-图像对齐提升4.08%,多模态理解提升4.85%。

04:00
arXiv cs.LG

面向高效大语言模型服务:系统感知的KV缓存优化综述

从系统行为视角综述KV缓存优化,分为执行调度、放置迁移、表示保留三维度,为LLM服务提供基础。

04:00
arXiv cs.LG

中文标题:当思考带来困扰:视觉语言模型推理链中的认知信号

中文摘要:研究发现,思考模式下的视觉语言模型中,推理链的熵值比回答熵更能可靠预测不确定性,并在实际测试中将准确率从71%提升至93.8%。

04:00
arXiv cs.LG

胎儿-母体心电图至胎儿多普勒波形的跨模态生成框架

提出跨模态框架,从ECG合成多普勒波形,误差降低51%,揭示电-机械耦合,助力胎儿评估。

04:00
arXiv cs.LG

基于最大熵校准的保持工作负载的差分隐私合成数据用于因果推断

提出因果工作负载与最大熵校准,生成支持因果推断的差分隐私合成数据,无需额外隐私成本。

04:00
arXiv cs.LG

随机顺序学习:一种利用噪声数据进行排名估计的方法

将含噪标签视为随机排序,提出随机顺序学习框架,通过双重损失函数学习嵌入空间,实现鲁棒排名估计。

04:00
arXiv cs.LG

模块化预训练实现访问控制

GRAM方法通过模块化预训练实现AI能力的访问控制,选择性禁用目标能力,抵抗微调恢复,成本远低于数据过滤。

04:00
arXiv cs.LG

带动量的标准SGD在重尾噪声下依然有效:无需梯度裁剪或归一化的收敛分析

首次证明带动量标准SGD在重尾噪声下无需梯度控制即可收敛,但速率劣于裁剪/归一化变体。

04:00
arXiv cs.LG

对比顺序学习:一种通用的序数回归框架

提出对比顺序学习框架ConOrd,融合对比与顺序学习,利用软权重建模序数关系,在年龄估计、质量评估等任务达最优。

04:00
arXiv cs.LG

反射布朗运动平稳分布的深度学习方法

基于基本伴随关系,提出高效学习高维反射布朗运动平稳分布的深度方法,尾部概率预测近乎完美。

04:00
arXiv cs.LG

DeepPySR——一种面向真实世界科学发现的符号回归框架,具有动态剪枝、帕累托选择与层次化组合特性

提出DeepPySR符号回归框架,通过动态剪枝、帕累托选择和层次组合,在体脂等数据集上超越PySR,生成可解释公式。

04:00
arXiv cs.LG

局部可采样图模型下的$\mathsf{AC}^0$学习

提出局部可采样图模型下$\mathsf{AC}^0$的拟多项式时间学习器,绕过多项式增长要求,应用于硬核和伊辛模型。

04:00
arXiv cs.LG

理解模型大小插值中的层修补

系统研究零样本模型大小插值中的层修补,提出优化框架及贪心算法KLPatch。

04:00
arXiv cs.LG

基于多模态大语言模型策略视觉检查的开放式多智能体自动课程学习

VIP方法利用视频语言模型处理策略视频并推荐课程,在SMAC中比文本或标量分数方法更有效。

04:00
arXiv cs.LG

PIT-SUN:面向推荐系统回归的可部署经验边际变换与期望一致恢复框架

提出PIT-SUN框架,通过经验边际变换和乘性SUN恢复解决推荐系统回归的期望一致性问题,提升准确性与校准。

04:00
arXiv cs.LG

针对聚类数据的结构学习

提出可微分图耦合机制,在聚类数据中联合估计全局与局部结构,保证无环性且渐近一致,实验发现新依赖。

04:00
arXiv cs.LG

RhyMix:一种轻量级自适应多节奏网络用于长期时间序列预测

RhyMix轻量自适应网络,双路径+门控,10/12数据集最优,40K参数,延迟<5ms。

04:00
arXiv cs.LG

一种可解释的k-means++的Good-Turing重启准则

提出GTRC准则,基于概率停止重启,自适应数据难度,性能与固定次数相当。

04:00
arXiv cs.LG

CASL-VAE:从非配对数据学习结构化潜变量以实现半监督聚类和配对样本生成

CASL-VAE从非配对数据学习结构化潜变量,分解变异为共同与显著因子,实现半监督聚类和配对样本生成。

04:00
arXiv cs.LG

基于分类器链的病理检验推荐

基于分类器链的病理检验推荐系统准确率达98.83%,SHAP解释符合医学知识,可辅助诊断。

04:00
arXiv cs.LG

利用机器学习预测男性生育能力:基于VISEM数据集的精液参数分析

基于VISEM数据集,用机器学习分类精液参数预测男性生育力,最佳模型准确率达94.2%,可辅助临床决策。