11702 条条目 · 106 个活跃源
2026年7月29日
04:00
arXiv cs.LG

ScoreShield:相似度评分的差分隐私发布

提出ScoreShield,用扰动后投影机制实现差分隐私相似度评分发布,降低失真并提升效用。

04:00
arXiv cs.LG

合成控制中的谱截断

谱截断合成控制法在多种场景下均劣于原始路径法,但预处理可消除差距。

04:00
arXiv cs.LG

基于嵌入归一化流与矩约束下隐含经验概率的模拟参数估计

结合嵌入归一化流与矩约束经验似然,提出两步模拟参数估计框架,实现端到端参数更新与替代模型。

04:00
arXiv cs.LG

设备温度对射频指纹识别精度影响的表征与缓解

提出温度感知射频指纹框架,融入温度信息,显著提升分类精度,尤其在未知温度条件下。

04:00
arXiv cs.LG

通过隐式接触微分实现残差MPC的轨迹优化分摊

隐式微分避免展开自动微分,内存消耗低;优化器蒸馏将全水平iLQR摊销为策略,显著提升残差MPC成功率。

04:00
arXiv cs.LG

SearchArt:利用可扩展合成与验证任务训练长时搜索智能体

SearchArt通过可扩展合成与验证任务训练长时搜索智能体,27B参数在多个基准上匹配或超越前沿闭源智能体。

04:00
arXiv cs.LG

GraphRareBench:一个用于表型驱动罕见病诊断的可审计图证据基准

2365案例的可审计图证据基准,揭示模型在硬混杂区分和证据覆盖上的互补行为。

04:00
arXiv cs.LG

快速、准确且可微分:面向NRSur7dq4进动双黑洞波形的神经网络替代模型

提出NRSur7dq4进动双黑洞波形的神经网络替代模型,中位频域失配<2e-4,GPU端到端快10倍,完全可微分支持梯度推断。

04:00
arXiv cs.LG

黎曼视角下的活跃子空间

活跃子空间从欧氏空间推广至黎曼流形,揭示局部测地球内特征值与特征空间的二阶近似性质,并应用于球面形状分析。

04:00
arXiv cs.LG

Lloyd的K均值聚类算法是Frank-Wolfe的变相

揭示Lloyd算法实为Frank-Wolfe特例,推导出非渐近O(1/t)收敛率。

04:00
arXiv cs.LG

Laplace-PSN-IRT: 大语言模型基准测试的神经项目反应理论模型的不确定性量化

提出Laplace-PSN-IRT,通过拉普拉斯近似实现LLM基准测试中模型能力和项目难度的贝叶斯不确定性量化,使模型比较更可靠、Fisher信息更稳定。

04:00
arXiv cs.LG

记忆层:在模型内部训练缓存用于推荐模型

记忆层是与模型共同训练的内模型缓存,消除训练与服务表示差异,提升覆盖率至100%,嵌入新鲜度至20秒,降低计算成本30%。

04:00
arXiv cs.LG

MOSAIC-FL:一种基于微服务的隐私保护框架及其在基因组学中的应用

提出基于微服务和CKKS同态加密的联邦学习框架,实现隐私保护与安全聚合,在图像和基因组分类中有效。

04:00
arXiv cs.LG

从5.36万次真实开发者对AI生成代码的编辑中学习

提出DECODE数据集,含5.36万真实编辑,发现AI代码编辑规律并提升3B模型预测能力。

04:00
arXiv cs.LG

决策层劫持:通过比特翻转攻击向大语言模型注入认知偏见

通过极小比特翻转实现大语言模型认知操控,达成隐蔽、低成本的决策层劫持。

04:00
arXiv cs.LG

网络划分聚类的基础视角

理论揭示硬软分配模型最优中心位置差异:SSC/FCM可位于边,PMP/PDC偏好顶点。

04:00
arXiv cs.LG

SecDrift: 度量AI生成代码中行业条件引发的安全漂移

SecDrift基准测试发现,行业提示对AI代码安全影响不显著,模型选择才是关键安全杠杆。

04:00
arXiv cs.LG

从不可见中学习:含隐藏动作的离线强化学习

提出LURE估计器,利用下一状态代理处理隐藏动作,实现多重鲁棒与渐近正态推断。

2026年7月28日
04:00
arXiv cs.LG

DomainPilot:领域级损失引导的两阶段数据混合优化用于高效语言模型微调

通过领域级损失信号两阶段优化数据混合,无需额外成本,提升微调性能。

04:00
arXiv cs.LG

CORVUS:通过底层同步对LLM编码代理进行上下文优化与缩减

提出CORVUS架构,解耦文件读取与观察,减少冗余和过时快照,实现轻量级轨迹,降低Token消耗且性能不变。

04:00
arXiv cs.LG

Semalith v1.4: 仅184M参数的校准安全分类器,以44倍参数缩减实现最先进的提示注入检测

184M参数分类器单次前向传播检测提示注入、通用危害与金融合规,参数比Llama-Guard少44倍,在22项基准测试中多数领先。

04:00
arXiv cs.LG

CausalGate:面向Transformer模块剪枝的因果重要性蒸馏

CausalGate通过干预引导测量语义损伤,将结构重要性蒸馏为静态门控,实现Transformer高效推理,显著优于动态路由方法。

04:00
arXiv cs.LG

面向长周期智能体任务的进度条件组策略优化

提出ProGPO,通过首次访问新状态分配优势,解决组策略优化在长周期任务中的信用陷阱,显著提升困难任务性能。

04:00
arXiv cs.LG

QFedPolyp:一种通信和推理高效的息肉分割联邦学习框架

QFedPolyp通过量化感知训练,降低通信开销并加速推理,实现隐私保护的协作息肉分割。

04:00
arXiv cs.LG

Learning to Access Computation: Accessibility Plasticity as a Principle of Adaptive Intelligence

04:00
arXiv cs.LG

大语言模型中的层级分级

提出分级大语言模型框架,通过凸规划优化分级,训练后融入标准Transformer,推理成本不变。

04:00
arXiv cs.LG

超越Shapley:基于影响力的LLM对齐与评估数据审计管道

提出无需重训练的数据审计管道,高效识别对齐数据中的标签错误与安全风险,净化基准测试。

04:00
arXiv cs.LG

叶片脉管结构全网络基因-环境关联的集成深度学习与统计框架

提出集成深度学习与统计框架,提取叶片脉管全网络图像表型,实现高维基因-环境关联分析,发现三个显著互作。

04:00
arXiv cs.LG

基于查询变换器的多模态表面肌电手部手势识别用于假肢控制

EMG-CrossFormer通过交叉注意力融合多模态信号,利用可学习查询解码,显著提升了假肢控制手势识别准确率。

04:00
arXiv cs.LG

基于物理可验证证据与大语言模型报告的轴承故障诊断方法

提出DENet输出可验证物理证据,频率误差6Hz,AUROC达0.97检测误分类;约束LLM翻译诊断,减少虚假报告至2%。

04:00
arXiv cs.LG

协作元知识增强的痴呆病因诊断

提出COME框架,通过异质性感知嵌入和信任区域约束实现痴呆病因诊断SOTA,平均AUC85.62%,跨中心泛化优。

04:00
arXiv cs.LG

使用EEG信号和CNN预测rTMS抑郁症治疗结果

基于FBSE-ED时频图和轻量CNN预测rTMS疗效,准确率93.60%,优于传统方法,实现早期临床决策支持。

04:00
arXiv cs.LG

CC-AOS:针对有限时域最优停止的代价与视界条件摊销逆向归纳

CC-AOS提出代价与视界条件化摊销逆向归纳,统一处理多代价多视界,在FordA上平均降低15.75%风险与采样成本。

04:00
arXiv cs.LG

LC-SEPLM:远程接触监督适应用于仅序列蛋白质表示学习

提出LC-SEPLM,用远程残基接触监督改进ESM2,八项任务均优于ESM2,远程同源识别F1提升6.47个百分点。

04:00
arXiv cs.LG

优化变压器神经网络实现FPGA上的实时异常值检测

研究优化Transformer在FPGA上用于金融时间序列实时异常检测,提升处理速度与精度。

04:00
arXiv cs.LG

FMOPF:面向交流最优潮流的隐式流匹配与约束感知交互先验

FMOPF框架解耦压缩与生成,实现高效热启动和低尾风险,首个扩展到几百母线系统并保持完全可行性的生成方法。

04:00
arXiv cs.LG

基于注意力机制的双向长短期记忆网络与域对抗训练的多模态域泛化抑郁检测

首次引入域泛化的多模态抑郁检测框架,结合声学文本与域对抗训练,准确率93.2% F1 94.2%超越现有基准。

04:00
arXiv cs.LG

Softmax丢掉了什么:面向证据累积的质量感知注意力

MAA将标准注意力L1归一化推广为Lp族,打破重复不变性,保留证据累积量,无参提升图模型表示信息性与任务性能。

04:00
arXiv cs.LG

LithoFormer: 一种基于Transformer的稳健地层推断框架

提出LithoFormer框架,用Transformer处理多变量测井数据,边界误差减少90%,消除地层顺序违规。

04:00
arXiv cs.LG

OrchNAS:面向个性化联邦边缘智能的协调神经架构搜索服务

提出能量感知框架,服务器端NAS自动设计异构边缘下的个性化模型,通过贪心剪枝与原始-对偶优化满足资源约束。

04:00
arXiv cs.LG

从下降方向学习:单侧Hölder正则性下的自适应梯度下降

基于单侧Hölder曲率估计的自适应梯度下降,非凸情形证明收敛,实验取得更低目标值和梯度范数。

04:00
arXiv cs.LG

地理分布式无服务器云中考虑SLA约束的碳感知路由

提出SLA约束碳感知路由策略,实测碳减排高达46.8%,平均27.4%,无SLA违反,扩展至12区域可达47.5%。

04:00
arXiv cs.LG

通过Logit Bias实现语言模型的极其简单的黑盒适配

无需调参或梯度,通过学习固定的logit偏差向量即可黑盒适配语言模型,提升推理性能。

04:00
arXiv cs.LG

MEMENTO:记忆引导的模因代码即策略进化

MEMENTO提出记忆引导的单精英模因进化框架,优化代码即策略,在长程具身任务中超越基线,并成功实现仿真到真实迁移。

04:00
arXiv cs.LG

从混合机理-数据驱动建模到神经符号AI:是什么、为什么和怎么做

H2N框架桥接混合建模与神经符号AI,导出SVR和BD两指标量化机理部分认知不确定性,案例验证有效。

04:00
arXiv cs.LG

相同预测,不同原因:量化对模型解释的影响

量化保留精度但改变模型推理,架构选择决定可解释性稳定性,DenseNet161最优。

04:00
arXiv cs.LG

基于图注意力网络的土壤微塑料和有机质空间预测

图注意力网络预测土壤微塑料与有机质,RMSE分别为625.06和0.43,表现优异但泛化受限,需增加样本密度。

04:00
arXiv cs.LG

截断布尔乘积分布的高效学习:影响力的关键作用

通过影响力分析截断集合几何,将参数估计样本复杂度降至对数阶,匹配无截断最优速率。

04:00
arXiv cs.LG

超越有向无环图:因果零和因果微分方程

本文提出因果零和因果微分方程,扩展结构因果模型,处理无方向约束和反馈循环,并给出扩展do-calculus。

04:00
arXiv cs.LG

Transformer优化中的隐藏边界运动:仿射权重与偏置更新的函数空间正交化

发现权重更新含类似偏置的边界运动,正交优化器提升Transformer验证准确率从81.68%至85.81%。