11852 条条目 · 106 个活跃源
2026年7月1日
04:00
arXiv cs.LG

TabPATE:无需公共数据的差分隐私表格上下文学习

TabPATE通过教师分区和私密聚合实现表格上下文学习的差分隐私,无需公共数据,有效抵御成员推断。

04:00
arXiv cs.LG

无Slater条件的约束在线凸优化

提出在线原始-对偶框架,用自适应正则化避免Slater条件,实现随机约束下O(√T)遗憾与违反,高概率同样成立。

04:00
arXiv cs.LG

自信分支思考

提出Fork-think方法,依据模型置信度识别推理分支点,采样聚合多路径,降低令牌消耗最多30%,运行时间最多57%,性能持平或优于并行思考。

04:00
arXiv cs.LG

RaBitQCache: 面向长上下文大语言模型推理中KVCache的旋转二值量化

RaBitQCache利用旋转二值量化高效估计注意力权重,实现自适应Top-p检索,加速推理并减少内存I/O。

04:00
arXiv cs.LG

中文标题

提出SAIL-RevKL正则化目标,证明满足PL条件,实现全局收敛,性能优于原始SAIL。

04:00
arXiv cs.LG

超越表达性与可训练性悖论:动态李代数视角下的量子机器学习荒原高原导航

通过动态李代数限制电路代数增长作为结构正则化,避免贫瘠高原,实现可扩展训练。

04:00
arXiv cs.LG

面向生成式机器学习的随机微分方程导论:变分视角

本文以变分视角介绍随机微分方程在生成建模中的应用,推导ELBO,并统一阐述扩散模型、分数匹配与流匹配。

04:00
arXiv cs.LG

Robustness of neural networks to random noise perturbations of their inputs

04:00
arXiv cs.LG

循环Transformer弥合潜在与显式推理的差距

LOTUS循环Transformer并行处理潜在块,在3B规模首次弥合隐式与显式CoT差距,延迟降低2.5-6.9倍,潜在空间可解释。

04:00
arXiv cs.LG

校准而非编译:检测与修复语言模型编写的错误设定概率程序

用贝叶斯工作流检测修复LLM概率程序错误,效果远超单元测试和LLM审查。

04:00
arXiv cs.LG

ECHO:智能体强化学习中的选择性回合记忆剪枝与追溯学习

ECHO框架通过选择性回合记忆与源索引重建,解决长程智能体历史崩溃与可追溯学习问题,在BrowseComp-Plus上达43.4%准确率。

04:00
arXiv cs.LG

通过对抗性蒸馏提升认证鲁棒性

AD-CERT结合对抗蒸馏与IBP,利用鲁棒教师logit信息达到最优认证鲁棒性,logit蒸馏优于特征空间(提升5.4%)。

04:00
arXiv cs.LG

特征排序截断时机:用于子集选择的残差重叠停止规则

提出残差重叠停止规则,依风险校准阈值从特征排序中自适应选子集,高维降维并保持预测性能。

04:00
arXiv cs.LG

非线性感知LoRA:低秩约束下的结构化门控适配

NA-LoRA通过导数掩码和步长缩放适应门控非线性,提升低秩微调性能且无推断开销。

04:00
arXiv cs.LG

责任扩散:生物合理双流网络中的任务相关信用分配

基于严格Dale原则,提出模数误差路由扩展误差扩散,在MNIST/CIFAR-10上达96.7%/61.7%,并集成PPO在强化学习中取得竞争性能。

04:00
arXiv cs.LG

FedXDS:利用模型归因方法对抗联邦学习中的数据异质性

提出FedXDS,利用XAI特征归因指导选择性数据共享,缓解联邦学习数据异质性,结合隐私保护,提升准确率与收敛速度。

04:00
arXiv cs.LG

用竞争性奖励解决大语言模型中的过度拒绝问题

通过竞争性奖励让模型探索有害推理但输出安全答案,缓解过度拒绝并防御推理操纵攻击。

04:00
arXiv cs.LG

策略优化在未知转移的MDP中实现数据依赖的遗憾界

提出基于乐观FTRL的算法,在未知转移下实现数据依赖遗憾界,并达到随机情况下的对数遗憾。

04:00
arXiv cs.LG

径向抑制加速算法泛化:延迟泛化的几何分析

发现隐藏表示径向膨胀导致延迟泛化,惩罚径向膨胀可加速算法泛化高达6倍。

04:00
arXiv cs.LG

RLVR中低秩适应的几何保持正交初始化

针对RLVR中LoRA初始化问题,提出几何保持正交初始化,稳定训练并超越标准LoRA,解释PiSSA和MiLoRA性能下降。

04:00
arXiv cs.LG

基于基础模型的图能源时间序列的关系与序列共形推断

提出STOIC框架,融合图神经网络与基础模型,实现图能源时间序列的可靠共形预测,性能优于现有方法。

04:00
arXiv cs.LG

深度神经网络的低维拓扑

将网络层宽度限制为三维空间,发现ResNet与Transformer在改变拓扑链接数上能力相当,且非单调激活可提升前馈网络至同等水平。

04:00
arXiv cs.LG

面向界面的神经牛顿预条件用于稳健内聚区模型模拟

IA-NNP通过学习状态修正改善CZM困难增量收敛,保持原始响应,优于标准NR方法。

04:00
arXiv cs.LG

从儿童视角理解触觉以进行对比学习

通过编码婴儿触觉事件数据集,预训练模型揭示触觉对视觉学习的贡献。

04:00
arXiv cs.LG

顺序RC-TGAN:基于光谱包络损失的关系时间序列生成

提出Seq.RC-TGAN及光谱包络损失,优化分类与连续时间序列周期结构,新指标评估,性能超越现有系统。

04:00
arXiv cs.LG

通过链式再生放大成员信号

MADreMIA利用链式再生迭代轨迹,无需影子模型训练,在低假阳性率下放大成员信号,提升隐私审计效果。

04:00
arXiv cs.LG

替代忠实度:开放LLM何时能解释封闭模型?

研究发现开放模型预测忠实度高估归因,白盒信号弱预测因果,机制洞察不自动迁移至封闭模型。

04:00
arXiv cs.LG

可解释人工智能用于检测和表征B期心力衰竭

可解释AI辅助B期心衰检测,但现有研究忽视性别/种族亚组、评估不足、缺乏外部验证,制约临床推广。

04:00
arXiv cs.LG

CoMet: 面向多模态不确定性估计的上下文与多样性分解

CoMet将多模态不确定性分解为上下文与多样性两项,轻量后验模块高效估计,优于现有方法。

04:00
arXiv cs.LG

AdaJEPA:自适应潜在世界模型

AdaJEPA通过闭环自适应更新潜在世界模型,有效应对测试时分布偏移,提升规划成功率。

04:00
arXiv cs.LG

TRIAGE:智能体强化学习中的角色类型化信用分配

提出角色类型化信用分配框架,通过语义角色分类纠正结果信用的盲点,提升任务成功率并减少环境交互轮次。

04:00
arXiv cs.LG

FedLAB:面向联邦多模态图基础学习的可追溯语义码本

FedLAB提出可追溯语义码本框架,结合联邦预训练,提升多模态图学习性能7.53%,支持语义追溯。

04:00
arXiv cs.LG

MediEncoder:高维因果中介分析中的非线性表示学习

提出MediEncoder框架,联合学习协变量与中介表示,实现高维非线性因果中介分析,提升估计精度。

04:00
arXiv cs.LG

VAMOS++的七维轨迹重建

VAMOS++磁谱仪采用七维轨迹重建方法,利用深度神经网络克服大束斑或扩展靶限制,提升质量分辨率。

04:00
arXiv cs.LG

使用深度神经网络和部分标记事件分析VAMOS++磁谱仪的原子电荷态和原子序数

深度神经网络仅用少量标记事件,将原子电荷态和原子序数分析时间从数月缩短至数小时,实现标准化、可重复的结果。

04:00
arXiv cs.LG

处于稳定性边缘的SGD:大学习率的随机稳定化

SGD的随机性使动态在稳定边缘与稳定区间交替,但自稳定机制确保大学习率下收敛,实验验证其优势。

04:00
arXiv cs.LG

噪声等变量子神经网络可训练性的相干性定律

噪声下等变电路梯度存活由因果和相干性决定,相干率作为训练定律,读出可见扇区相干性主导可训练性。

04:00
arXiv cs.LG

基于组合重要性评分的临界性约束迭代剪枝用于节能脉冲神经网络

提出CQP方法,融合权重幅度与临界性指标,解决剪枝精度丢失问题,90%稀疏度下准确率95.6%,结合时间截断节能73%。

04:00
arXiv cs.LG

散射网络的分离能力

本文扩展Cover理论,建立了散射网络分离容量的公式,揭示了影响因素,并提供了设计指导。

04:00
arXiv cs.LG

BEST-RQ-2:先语境化再预测——一种两步自监督音频表示方法

BEST-RQ-2提出两步先语境化再预测自监督方案,解耦掩码预测阶段,跨域迁移优于单阶段基线。

04:00
arXiv cs.LG

XY模型的扩散预热采样实现大规模快速热化

训练小尺寸扩散模型生成大尺寸XY样本,结合少量MCMC使热化时间降低一个数量级。

04:00
arXiv cs.LG

基于高级调节控制理论的多智能体AI系统方法:面向过程控制的安全可审计LLM操作员智能体

基于控制理论的多智能体LLM方法,通过轨道器解决冲突,实现安全可审计的过程控制。

04:00
arXiv cs.LG

通过神经网络动态预测交替复发事件

提出神经网络逆概率加权伪观测框架,动态预测交替复发事件,模拟与应用效果良好。

04:00
arXiv cs.LG

结构正则化的可解释性TCR-表位预测

提出结构正则化可解释模型TCR-SRIM,实现残基级TCR-表位预测,性能领先,揭示生成结构导致交互模式不准确。

04:00
arXiv cs.LG

基于神经天气模拟器中罕见事件采样的条件热带气旋生成率

通过非平衡罕见事件采样与神经天气模拟器耦合,高效估算条件热带气旋生成率,计算效率提升高达140倍。

04:00
arXiv cs.LG

ShardNet: 用硬非凸约束训练神经控制器

ShardNet通过可微投影层将硬非凸约束嵌入网络结构,实现安全与性能解耦,安全集扩大3倍以上。

04:00
arXiv cs.LG

面向不可信AI智能体的认证推测执行

CGPA通过验证与保形校准实现零违规、遗憾降低三个数量级、2.96倍加速的认证推测执行。

04:00
arXiv cs.LG

探针选择改变金丝雀记忆判定:文本主导LoRA调优自回归测试平台中的三个事后分歧案例

固定窗口探针与全跨度秘密NLL及精确召回存在分歧,报告三个案例,建议全跨度NLL、局部分解、k>=4召回及诱饵探针。

04:00
arXiv cs.LG

ElemeNet:跨周期表的多尺度分子机器学习与不确定性量化

ElemeNet是统一分子ML软件包,支持1-100号元素、多尺度模型与不确定性量化,有机/无机/生物数据集达SOTA。

04:00
arXiv cs.LG

层次聚类:观测因果推断中多重共线性的创新解法

提出层次聚类缓解多重共线性,保留原始因果关系,市场营销案例验证有效。