11722 条条目 · 106 个活跃源
2026年7月27日
04:00
arXiv cs.LG

DCS:一种用于跨模态版权侵权的统一条件敏感性检测框架

提出DCS框架,通过反事实条件分布偏移和双分支条件敏感性检测跨模态版权侵权。

04:00
arXiv cs.LG

CEL:全面反事实解释库与基准

首个统一的反事实解释库与基准,覆盖18个数据集与14种方法,实现公平可重复的定量评估。

04:00
arXiv cs.LG

无泄漏堆叠集成多类分类方法

提出LFS-FRAME框架,融合KAN与XGBoost,通过严格隔离训练验证数据防止泄漏,多类分类准确率达89.85%和81.74%。

04:00
arXiv cs.LG

使用患者感知采样预训练电子健康记录基础模型

提出患者采样预训练方法,控制训练信号分布,在MIMIC-IV上提升AUROC和AUPRC。

04:00
arXiv cs.LG

TriGlue:一种受生物学启发的生成模型,用于生成分子胶诱导的三元复合物

提出受生物学启发的生成框架TriGlue,将分子胶设计解耦为界面估计与条件生成两阶段,生成有效三元复合物。

04:00
arXiv cs.LG

面向公平自监督学习的无偏开放世界正则化

提出UOWReg,通过条件分布匹配确保表示与目标属性统计独立,有效缓解偏差并防止子群体崩塌。

04:00
arXiv cs.LG

从分数逼近到分布逼近:基于分数的扩散模型

证明分数逼近误差可控制生成分布的KL散度,并给出显式上界,建立理论连接。

04:00
arXiv cs.LG

IFCLoRA: 拓扑感知的秩分配方法用于参数高效微调

IFCLoRA在微调前利用信息流中心性分配秩,在低预算下提升大模型微调性能,优于LoRA等方法。

04:00
arXiv cs.LG

异常检测中不平衡情况下的评估指标见解

研究AUROC等四种指标在不平衡异常检测中的行为,通过指标景观图提供直观解释与比较指导。

04:00
arXiv cs.LG

类别平衡Softmax:基于贝叶斯理论的长尾识别方法

提出CBS方法,基于贝叶斯框架和幂律假设,有效缓解长尾识别中的偏好问题,性能优于现有方法。

04:00
arXiv cs.LG

使用自适应多项式回归引导的伪实验数据优化耗时实验条件

PolyBO通过自适应多项式回归生成高质量伪实验数据,在有限实验下加速贝叶斯优化,合成函数时间减少42%,真实问题减少96%。

04:00
arXiv cs.LG

IQ-JEPA:一种结合厄米视觉变换器的联合嵌入预测架构,用于从超声IQ数据估计声速和衰减

IQ-JEPA利用自监督预训练和厄米变换器,从IQ数据高效估计声速,标签效率提升3-4倍。

04:00
arXiv cs.LG

具有多模态输入的自回归电子健康记录基础模型

提出多模态EHR自回归模型,用潜在压缩和交叉注意力融合ECG、影像和笔记,强调融合架构设计。

04:00
arXiv cs.LG

合成语音,真实信号:通过语音克隆保留副语言特征并实现跨语言增强

语音克隆可保留副语言信号,跨语言增强中克隆数据优于原始迁移,为低资源语言临床语音数据增强提供新方向。

04:00
arXiv cs.LG

基于图粗化和标签传播的高效推荐方法

提出两阶段扩散框架,图粗化后多步标签传播,电信数据上NDCG@5提升24%-50%,平衡可扩展性与推荐质量。

04:00
arXiv cs.LG

基于因子图的进化感知MSA子采样推理

将MSA子采样重构为可控优化问题,用因子图推理替代启发式选择,显著提升结构预测性能。

04:00
arXiv cs.LG

Beyond Binary Rooftop Mapping: A Four-Class Deep Learning Framework for Green Roof Potential Assessment from Open Swiss Geospatial Data

04:00
arXiv cs.LG

基于深度强化学习的最后一公里取件订单调度与路径规划集成

提出耦合路由预言机与调度启发式的集成框架,实验证明在最后一公里取件问题中效果更优。

04:00
arXiv cs.LG

超越负脊端点:通过负偏移梯度下降实现混合符号谱正则化

负偏移梯度下降突破负脊结构限制,实现混合符号谱正则化,在高斯模型中发现势垒并多项式改善风险。

04:00
arXiv cs.LG

索引:开始与终结

通过索引原语揭示,低因果复杂度架构在索引位于末尾时无法常数层内解决任务,而softmax transformer可单层解决,实验验证理论。

04:00
arXiv cs.LG

基于注意力展开的内部可解释性:Transformer中的收缩与传播轮廓

提出内部可解释性,用注意力展开证明小收缩系数时传播轮廓近似秩一矩阵,在代谢年龄预测中收缩随深度增强。

04:00
arXiv cs.LG

LunarFM:月球表面的共享多模态表征

LunarFM融合多仪器数据,学习月球表面通用表征,支持资源映射与地质分类。

04:00
arXiv cs.LG

熵曲率下的图神经网络局部-全局几何洞察

提出全局熵曲率,证明稀疏、强谱扩展与正熵曲率不可共存,统一过度平滑与挤压,导出三种实用机制。

04:00
arXiv cs.LG

关于受控世界模型的可辨识性

控制世界模型的可辨识性取决于策略相关的谱分离与非退化条件动作变化,保障表示与转移的识别,近似优化下给出定量界限。

04:00
arXiv cs.LG

音频基础模型捕捉海洋哺乳动物与鸟类叫声中的系统发育信号:领域特定预训练的有限益处

通用音频模型能从叫声提取进化关系,效果优于领域专用模型,表明进化信息无需领域预训练即可涌现。

04:00
arXiv cs.LG

超球可能不是免费午餐

Hyperball优化器优势源自有效步长演化而非更新方向,学习率调度是性能关键。

04:00
arXiv cs.LG

学习投影梯度下降求解器迭代的复杂度界限与方法

提出k邻域数据收集策略,利用中间迭代增广数据,导出基于Rademacher复杂度的泛化界,提升DDDAS优化效率。

04:00
arXiv cs.LG

实值函数中的序与树的编码

证明从树中提取阈值的新定理,改进边界,解决双重指数界和紧阈值提取的公开问题。

04:00
arXiv cs.LG

κ-LoRA:条件数揭示哪些LoRA矩阵值得更新

κ-LoRA发现条件数大的LoRA矩阵驱动性能提升,仅更新前50%的矩阵即可减半参数、节省16.2%训练时间并保持精度。

04:00
arXiv cs.LG

可解释的脑电图生物标志物:面向低数据场景的时空波形字典方法

提出无监督学习可解释波形字典的bag-of-waves方法,在低数据场景下性能匹敌深度学习,并直接恢复临床波形形态。

04:00
arXiv cs.LG

用于状态条件波动率预测的易感储层架构

提出SUSA储层架构,结合复值储层与状态条件专家,在16个资产上波动率预测优于GARCH,堆叠集成平均QLIKE改进0.0116。

04:00
arXiv cs.LG

基于两阶段PRO-临床堆叠的头颈癌吞咽困难风险分层

提出两阶段PRO-临床堆叠模型,用患者症状与临床变量预测吞咽困难风险,无需影像检查。

04:00
arXiv cs.LG

基于可解释FFT的空间-频率融合深度伪造检测框架

提出MSCA-FFT框架,融合FFT频谱与空间特征,通过交叉注意力检测深度伪造,性能优于DCT方法。

04:00
arXiv cs.LG

基于计算机视觉的神经科脑活动剔除架构与实现

提出基于计算机视觉的ICA脑活动剔除自动标注工具,速度提升7200倍,准确率89.45%,兼容ICLabel和EEGLab。

04:00
arXiv cs.LG

可解释的量子压缩机器学习用于复杂流体流动

提出量子压缩机器学习,将流代理潜传播器从524k参数压缩至8个,实现可解释、稳定的湍流预测且精度不减。

04:00
arXiv cs.LG

先验清洗:具有继承且不可检测的过度自信的学习先验

先验清洗使后验继承档案的过度自信且无法检测,建议区分数据支持与继承信念。

04:00
arXiv cs.LG

提示词作为数据类型:数据库内的大语言模型提示词管理与重写

PromptDB将提示词作为数据库数据类型,利用元数据重写提示词,提升有效性和成本效益。

04:00
arXiv cs.LG

混沌博弈动态中的自然不变测度:在混沌中寻找秩序

通过自然不变测度,在混沌博弈动力学中实现对一般可观测量的长期时间平均的精确统计,揭示有序。

04:00
arXiv cs.LG

基于Rao-Blackwell化E-过程的高效在线LLM水印检测

基于Rao-Blackwell化e-过程构建在线水印检测框架,实现递归更新与任意停止,控制I型错误且渐近一致。

04:00
arXiv cs.LG

面向稀疏和不规则响应轨迹的纵向随机森林

提出纵向随机森林框架,处理稀疏不规则纵向数据,捕捉个体轨迹,兼顾相关性与异质性,实现预测与解释。

04:00
arXiv cs.LG

AI编码代理如何贡献于软件开发?一项关于代理式拉取请求的实证研究

本研究通过分析代理式拉取请求,揭示AI编码代理与人类PR在合并率、任务分布上的差异及时间演化,提供实证视角。

04:00
arXiv cs.LG

结合FDTD验证的可靠性感知贝叶斯优化1310 nm PCSELs

利用FDTD与可靠性感知贝叶斯优化,高效生成波长兼容、窄束、高Q的PCSEL候选,Qeff提升60–108倍。

04:00
arXiv cs.LG

跨平台分析中的政治党派倾向量化

提出基于新闻可信度信号的跨平台党派倾向测量方法,应用于Bluesky和Truth Social,验证其有效性。

04:00
arXiv cs.LG

理论上认证,实践中失效:加密模型认证中的假设缺口

加密模型认证因仅验证固定数据集,攻击者可伪造模型审计合格但部署失效;提出新安全定义与协议模板。

04:00
arXiv cs.LG

基于模拟的经验贝叶斯

提出SBEB方法,利用模拟器和观测数据推断隐式似然的经验贝叶斯先验,迭代优化提高推断精度。

04:00
arXiv cs.LG

数据流网络的松弛激活分析——一种面向机器学习与实时调度的时钟演算

提出Lustre时钟演算的保守扩展,解决训练算法控制模式问题,促进ML模型嵌入反应式应用。

04:00
arXiv cs.LG

分布性行列式点过程用于分布的排斥性聚类

提出dDPP,基于SW核实现分布排斥聚类,应用于单细胞和癫痫数据,生成可解释聚类。

04:00
arXiv cs.LG

MemNMF:基于LPC谱的记忆增强NMF异常声音检测

MemNMF利用LPC谱和记忆增强NMF,提升异常声音检测鲁棒性,有效分离正常与异常。

04:00
arXiv cs.LG

从有限轨迹学习遍历动力系统

从单条有限轨迹学习遍历动力系统,用非线性最小二乘估计最优预测并给出高概率保证,可扩展至Koopman算子学习。

04:00
arXiv cs.LG

一类Zermelo型迭代用于Bradley-Terry模型的收敛性分析

本文分析一族Zermelo型迭代的局部收敛性,发现异步更新下α=0最优,加速源于异步而非参数选择。