11442 条条目 · 106 个活跃源
2026年9月10日
04:00
arXiv cs.LG

只遗忘该遗忘的:面向鲁棒大语言模型的层选择性遗忘

提出层选择式遗忘框架FOM-UL,按遗忘-保留显著性选层集中更新,兼顾遗忘与效用,量化下更鲁棒。

04:00
arXiv cs.LG

更晚的测试集不是新领域:预训练熟悉度在无污染留出集下依然存在

时间留出集下预训练模型仍7组胜5,胜负与季节性无关而取决于语料熟悉度,最大增益落在其预训练主域维基百科。

04:00
arXiv cs.LG

半群-JEPA:面向零样本物理泛化的潜在动力学一致性

SG-JEPA借动作条件化与自回归潜在展开联合训练,实现零样本物理泛化,误差降2倍、成功率升2.5倍。

04:00
arXiv cs.LG

基于协方差矩阵的学习:主成分分析遇上图学习

提出协方差神经网络理论,将主成分分析与图学习关联,提升稳定性与可迁移性,并用于脑龄差分析。

04:00
arXiv cs.LG

Rockafellar约束规范下极大单调算子之和的非极大性

构造反例推翻Rockafellar和猜想:两极大单调算子满足内部域条件,其和却非极大单调;给出c₀与ℓ¹反例及一般构造定理。

04:00
arXiv cs.LG

量子特征工程用于信用违约预测:IQP电路何时以及为何有助于线性分类器

IQP量子特征令逻辑回归F1提升0.055,超越Kernel PCA,且仅线性模型受益,效果取决于特征选择。

04:00
arXiv cs.LG

激活皆增益:将通用推理器扩展至万亿级开放语言基础模型

Ling 2.0推理基础模型,高稀疏MoE覆盖16B至1T,算效达7倍,Ling-1T刷新精度效率前沿。

04:00
arXiv cs.LG

间隙-熵猜想获肯定性解决

证明固定置信度高斯最佳臂识别的间隙-熵猜想:最优样本数约H(log(1/δ)+Ent(I)),并给出匹配算法。

04:00
arXiv cs.LG

GLOSS:面向高保真参考引导纹理填充的几何局部自相似学习

利用几何自相似与纹理相关性,训练形状特定局部纹理补全模型,以几何感知参考块引导实现可控忠实填充。

04:00
arXiv cs.LG

CAST:用于图上近似 Cholesky 的规范近似舒尔树

CAST以加权随机生成树替代舒尔补稠密团,无偏更新;CAST-1更快,CAST-2视代价可选。

04:00
arXiv cs.LG

非光滑 H∞ 输出反馈策略搜索的算法最优性保证

证明非光滑H∞输出反馈策略搜索中ε-稳定点具O(ε)次优性,并给出ε最优镇定控制器算法。

04:00
arXiv cs.LG

论基于坐标的神经进化的规模化:ES-HyperNEAT 中的四叉树瓶颈

ES-HyperNEAT因各底物不同难种群级并行,四叉树瓶颈为结构性限制,静态多分辨率网格方案可解。

04:00
arXiv cs.LG

学会飞行:基于紧凑目标中心线索与强化学习的稳定视觉引导无人机伺服控制

以紧凑目标中心线索结合低维传感与强化学习,实现无人机长时程稳定视觉伺服。

04:00
arXiv cs.LG

校准与偏移下的成本感知事后延迟决策:一个环境人工智能案例研究

环境AI研究表明:更丰富的风险信号未必胜过校准置信度,检出外推也不代表个案排序可迁移。

04:00
arXiv cs.LG

大规模特征子空间估计的子采样 Davis-Kahan 界

提出伯努利子采样,给出子采样 Davis-Kahan 界,权衡计算与统计误差,实现大规模特征子空间估计。

04:00
arXiv cs.LG

贝叶斯深度学习融合地球物理与钻探数据实现铜矿化三维预测与钻探靶区优选:以鲁德内阿尔泰科戈代勘查区为例

贝叶斯深度学习融合钻探与地球物理数据,三维预测铜品位与电性场并量化不确定性,圈定矿化趋势与钻探靶区。

04:00
arXiv cs.LG

弥合理论与数据:用可解释机器学习校正核质量模型

用KAN-WS4混合模型,将核质量预测均方根误差由0.3 MeV降至0.16 MeV,并发现质子数影响最大,方法可推广至五种模型。

04:00
arXiv cs.LG

稀疏观测引导扩散先验的高分辨率温度降尺度

稀疏观测引导扩散先验实现高分辨率气温降尺度,推理用分数数据同化,1%密度下重构优于ERA5和近邻基线。

04:00
arXiv cs.LG

加密真正重要的部分:选择性同态推理何时高效

仅加密敏感区域,其余明文计算,输出不变;效率取决于加密依赖扩散速度,局部性保持架构可获数量级加速。

04:00
arXiv cs.LG

离散概率分布的张量网络道德图恢复

提出用核范数正则化全连接张量网络,从离散概率分布中恢复因果DAG道德图,并给出精确与近似误差下的恢复保证。

04:00
arXiv cs.LG

面向循环平稳模型的实时自适应异常检测算法

提出实时异常检测框架PeriodicCALM,可忽略周期脉冲、动态再训练自适应,显著降低误报并提升检测精度。

04:00
arXiv cs.LG

“变革”LHCb:重味衰变的自监督映射

自监督变换器绘制LHCb重味衰变图谱,无需标签媲美监督,提升味标记并拓展不可见衰变搜索。

04:00
arXiv cs.LG

X-amine509:预测企业 X.509 证书的实际风险等级

X-amine509 用机器学习快速排序证书风险,仅将高风险项送入确定性分析,精度与跨时稳定性俱佳。

04:00
arXiv cs.LG

基于社区与谱图分析缓解概念漂移以检测网络流量中的网络攻击

提出t-鲁棒性特征稳定性评分,融合图社区与谱指标筛选特征以缓解概念漂移,显著提升网络攻击检测的持续性能。

04:00
arXiv cs.LG

MiNCE:带限函数及其平滑谱的非参数强相合置信包络

提出MiNCE框架,为带限函数及其平滑谱构建非渐近同时置信带,证明强相合性并数值验证。

04:00
arXiv cs.LG

用于低秩量子态层析的块张量列Burer-Monteiro框架

提出块张量列Burer-Monteiro参数化,变量由指数降至线性,结合DMRG实现低秩量子态层析。

04:00
arXiv cs.LG

一致遍历马尔可夫链的多元鞅和的高斯逼近

针对一致遍历马尔可夫链的多元鞅和,建立高阶Wasserstein距离的高斯逼近界,并在平衡增量下取得最优O(n^{-1/2})速率。

04:00
arXiv cs.LG

通过对数比变分实现归一化流玻尔兹曼生成器的模式覆盖

提出对数比变分与KLXX损失,提升归一化流玻尔兹曼生成器模式覆盖和诊断。

04:00
arXiv cs.LG

Inductive Biases in Field-Level Cosmological Inference from Galaxy Catalogs

04:00
arXiv cs.LG

Optimal Value Inference for Reinforcement Learning

04:00
arXiv cs.LG

Oracle Complexity of Stochastic Fixed-Point Equations with Nonexpansive Maps

04:00
arXiv cs.LG

Why Learning Rediscovers the Closed-Form Diagonal Regularizer

04:00
arXiv cs.LG

Differentially Private Average Treatment Effect Estimation by Propensity Score Blocking

04:00
arXiv cs.LG

Geometric organization of olfactory descriptor data in the Poincar\'e disk

04:00
arXiv cs.LG

Distillation of Synthetic Data for Time Series Foundation Models

04:00
arXiv cs.LG

When Does Low-Bit Quantization Preserve the Decisions of Vector Search?

04:00
arXiv cs.LG

Efficient Graph Neural Networks for Multicarrier Wideband Hybrid Beamforming Optimization

04:00
arXiv cs.LG

A Unifying Perspective on Probabilities as Model Predictions

04:00
arXiv cs.LG

TimeCues Studio: A Workspace for Music Annotation and Algorithm Prototyping

04:00
arXiv cs.LG

Dynamical Non-compensatory Multidimensional IRT Model Using Variational Approximation

04:00
arXiv cs.LG

Physics-Informed Multi-Task Surrogate Model for the Martian Nightside Thermosphere

04:00
arXiv cs.LG

Are You Learning Biological Signal or Shortcuts? Auditing and Mitigating Bias in Protein-Protein Interaction Datasets

04:00
arXiv cs.LG

A Sharp Barrier for Consistent Submodular Maximization: Any Improvement over $2-\sqrt{2}$ Entails Exponential Queries or Linear Recourse

04:00
arXiv cs.LG

The Sample Complexity of Quantum Entanglement Allocation

04:00
arXiv cs.LG

Structural Fusion of Bayesian Networks with Limited Treewidth Using Genetic Algorithms

04:00
arXiv cs.LG

Maverick: Private and Verifiable LLM Inference Made Practical via Matrix-Vector Multiplication Delegation

04:00
arXiv cs.LG

Zero-Shot Temporal Localisation of Audio Deepfakes in Multi-Speaker Conversations

04:00
arXiv cs.LG

Orukeet: Multilingual ASR with Frozen Gabor Kernels