11542 条条目 · 106 个活跃源
2026年8月24日
04:00
arXiv cs.LG

面向fMRI疾病诊断的可解释信息分解脑图学习

IID-GCN将rs-fMRI分解为冗余/独特/协同图,捕获互补诊断信息,揭示脑疾病信息组织改变。

04:00
arXiv cs.LG

NeuroStrata:一种面向心理压力动态脑网络分析的脑电连接感知深度表示学习框架

结合TV-PDC动态连接与深度学习,β频段识别心理压力准确率最高97.3%,α频段稳定。

04:00
arXiv cs.LG

如果它走起来像套利:具有可判定结构等价性的协议无关检测

十五条重写规则将交易轨迹化为唯一规范形,判定资金流等价,实现协议无关的套利检测,并经Rocq机械化验证。

04:00
arXiv cs.LG

aiXamine:大语言模型安全、安保与隐私跨维度权衡的统一黑盒评估

aiXamine统一黑盒评估大模型安全/隐私,揭示安全税、隐私正交及蒸馏致鲁棒性崩溃,证明可信赖性需多维考量。

04:00
arXiv cs.LG

自回归随机神经网络模型中的不确定性传播

用Leaky ReLU局部近似传播随机输入/参数不确定性,导出输出分布与矩,并推广至自回归动力系统。

04:00
arXiv cs.LG

真实软件历史中的时间有效性:消除GitHub修复中代码助手记忆的过时事实错误

真实软件历史中,该方法消除过时事实错误,准确率九成一对五成七,过时值提供率从三成八降至近零。

04:00
arXiv cs.LG

带密钥来源水印与格基安全聚合互补的联邦学习框架

提出融合来源水印与格基零知识安全聚合的联邦学习框架,抵御数据泄露、未授权复用及梯度篡改,实现端到端可信。

04:00
arXiv cs.LG

基于去噪正则化的快速MRI重建一致性模型

提出CM-RED将一致性模型融入去噪正则化仅4次评估即高质量重建MRI优于现有方法

04:00
arXiv cs.LG

面向混合类型数据的条件独立正则化分布自编码器

提出条件独立正则化分布自编码器,以条件分布匹配和结构正则化学习混合数据表示,提升类别恢复并保留依赖结构。

04:00
arXiv cs.LG

预测连续时间量子行走模拟中资源高效的哈密顿量分解

用机器学习预测图哈密顿量分解的CX门数,n_Pauli为主特征,MCC达0.593并可迁移至大图。

04:00
arXiv cs.LG

利用空间望远镜数据与生成式AI增强数字巡天的成像能力

生成式AI提升地面星系图像至空间望远镜水平,兼顾巡天通量与空间画质。

04:00
arXiv cs.LG

分数熵离散扩散的极小极大最优性

针对均匀与掩码离散扩散建立分数估计极小极大下界提出匹配的MLE阈值估计器表明SEDD样本复杂度近最优

04:00
arXiv cs.LG

疟疾药物发现中大型语言模型的严谨评估:性能、规模与资源效用的权衡

疟疾药物筛选中,微调开源LLM表现优于经典及专有模型,领域微调不可或缺,化学感知预训练优势明显。

04:00
arXiv cs.LG

优化LLM用于基于实地实验数据的游客轨迹预测

用实地数据微调大模型预测游客轨迹,在日本和歌山城公园验证,准确率达49.1%,雨天等少样本场景依然稳健,支持反事实干预分析。

04:00
arXiv cs.LG

重新思考机器人模仿学习中的演示数据遗忘

提出重训练校准审计,从行为与证据双轴评估演示遗忘,结合保形检验,验证编辑策略与重训练一致性。

04:00
arXiv cs.LG

在深度强化学习与模型预测控制之间共享控制权:应用于多类交通网络

提出深度强化学习与模型预测控制分层框架,上层低频控制,下层高频控制,降低计算时间,增强约束处理,性能更优。

04:00
arXiv cs.LG

CubicSplat:基于误差有界前向松弛的可微分矢量图形

误差有界折线替代贝塞尔求解,梯度良好,重建PSNR提升超2dB,训练快4倍。

04:00
arXiv cs.LG

面向生成式推荐:从静态多级小语义码本到动态单级大语义码本

提出单级大语义码本,动态更新,减少解码成本,提升推荐效果。

04:00
arXiv cs.LG

利用精确房间声学模拟训练DeepFilterNet,提升单通道语音增强

高保真房间声学模拟数据训练DeepFilterNet3,较ISM数据集客观指标略升、ASR词错误率大幅下降,对未知实测环境泛化更好。

04:00
arXiv cs.LG

AudioWorldSim:用于世界模型的真实双耳音频数据集

开源音频数据集平台,基于Meta SoundSpaces 2.0,自动生成随机导航双耳音频,修复连续声音合成,助力世界模型研究。

04:00
arXiv cs.LG

超越模仿:基于离策略Q规划的机器人策略自我改进

提出Q-Planning,用小型离策略Q函数增强大规模行为克隆策略,仅微调Q函数即可在线自改进,无需人类干预,显著提升操作成功率。

04:00
arXiv cs.LG

面向脉冲Transformer零阶微调的事件触发隐式扰动

提出事件触发隐式扰动零阶微调架构,消除显式扰动读写开销,降低随机数硬件需求,精度与软件相当且更节能。

04:00
arXiv cs.LG

使用有界不确定性模型的强化学习智能探索

利用含真实模型的有界模型集约束Q函数引导探索,理论保证收敛;BMDP下凸化易实现,显著加速强化学习。

04:00
arXiv cs.LG

超阈值设计效应:聚类下阈值的有效样本量

聚类数据下,阈值型有效样本量取决于越界计数而非数值相似,现有修正有偏,且无单一有效样本量。

04:00
arXiv cs.LG

高级线性代数及其应用(第一部分):面向PDE、机器学习与数据同化的数值线性代数

硕士课程讲义,阐述数值线性代数在PDE、网络排名、数据同化中的核心应用,涵盖范数、分解、迭代法及预处理。

04:00
arXiv cs.LG

LMC多任务高斯过程模型的精确通用解耦解

提出投影LMC,仅需温和噪声假设即实现精确解耦,复杂度线性,更简单可解释,替代现有多任务高斯过程模型。

04:00
arXiv cs.LG

联邦与差分隐私的KL散度估计

所提方法在差分隐私下无偏估计联邦数据KL散度,敏感度与方差低,精度接近非私有方法,优于本地扰动基线。

04:00
arXiv cs.LG

基于N维朗之万方程与神经常微分方程的预测

结合N维朗之万方程与神经常微分方程建模预测非平稳电价同时捕捉平稳与非平稳特征西班牙市场验证有效

04:00
arXiv cs.LG

牛顿法的原变量加速

提出仅用原变量、每步一次线性求解的加速牛顿法,对黑塞利普希茨凸函数达 O(1/k^3) 全局收敛率。

04:00
arXiv cs.LG

结构即信息:用于部分观测动力系统机器学习的结构可辨识性映射

用结构可辨识性分析关联等价参数并训练分类器,提升部分观测动力系统时间序列泛化,尤其数据有限时。

04:00
arXiv cs.LG

PerturbRx:学习治疗条件下的潜在转移用于患者药物反应预测

数据稀缺与肿瘤异质性限制疗效预测,提出治疗条件潜在转移框架,无需治疗后测量,提升患者药物反应预测。

04:00
arXiv cs.LG

序列预测中的真实校准度量

二值序列预测中,精确真实性与完备性、可靠性不可兼得;但可构造乘性近似真实校准度量,改进已有界。

04:00
arXiv cs.LG

自动化构建极濒危鸟类叫声分类流程:以齿嘴鸠为例的少样本研究

面向无公开分类器的极濒危物种,提出自动化少样本叫声分类流程,仅用三段录音即达1.0召回率与0.95准确率。

04:00
arXiv cs.LG

BIPPO:面向节能联邦学习服务的预算感知独立PPO

提出BIPPO节能多智能体强化学习方案,用于联邦学习客户端选择,在预算受限下提升精度,且预算消耗少、可扩展。

04:00
arXiv cs.LG

Perseus:基于状态记忆的稀疏监督交互式时间序列分割

提出Perseus框架用状态记忆异步编码稀疏交互跨间隙持续引导分割多粒度精度最高提升85%

04:00
arXiv cs.LG

罗生门博士与疯狂宇宙:未观测混杂与罗生门效应下的变量重要性

提出UNIVERSE方法,用Rashomon集合对未观测混杂下VI定界,理论保证,实证有效

04:00
arXiv cs.LG

HIP:无需导数的Hessian原子间势

提出不依赖导数的Hessian原子间势模型直接预测Hessian更快更准可扩展适用多类任务

04:00
arXiv cs.LG

利用细粒度奖励结构与信用分配增强LLM智能体多轮推理

在GRPO/PPO中采用逐轮稠密奖励实现细粒度信用分配,优于稀疏奖励,提升多轮推理训练稳定性与准确性。

04:00
arXiv cs.LG

噪声标签检测方法的基准测试

将噪声标签检测分解为采样策略、不一致度量与聚合方法,提出统一基准与固定工作点指标,发现样本内收集+平均概率聚合+logit边缘最优。

04:00
arXiv cs.LG

神经影像分析中的SPD矩阵学习:视角、方法与挑战

综述神经影像SPD矩阵学习:连接经典几何统计与现代深度学习,保留结构约束,面向脑机接口等应用。

04:00
arXiv cs.LG

AIRL-S:利用对抗逆强化学习统一强化学习与基于搜索的测试时扩展

融合对抗逆强化学习与GRPO,免标注推断稠密奖励,用于训练与搜索验证,性能提升9%媲美GPT-4o。

04:00
arXiv cs.LG

逆强化学习与动态离散选择模型的高效推断

提出半参数去偏框架,将行为策略对数视为伪奖励,识别价值差与奖励,实现灵活模型的根号n一致且高效推断。

04:00
arXiv cs.LG

面向建模与控制的空间感知无字典库普曼特征函数识别

提出无字典空间感知库普曼特征函数识别,利用正则化最小二乘与物理约束,实现非线性系统建模与控制。

04:00
arXiv cs.LG

大规模高效探索

在线RLHF算法结合认知网络与信息定向探索用2万标签匹配20万标签效果预计可提升千倍数据效率

04:00
arXiv cs.LG

AgentOCR:借助光学自压缩重塑智能体历史

该方法将交互历史渲染为图像,辅以光学缓存与压缩感知奖励,保留九成五性能,削减过半令牌,提速二十倍。

04:00
arXiv cs.LG

深度时间序列模型的可解释性需要语义对齐

深度时间序列模型可解释性需语义对齐:用有意义的变量表达预测,且随时间演化保持不变,以支持信任。

04:00
arXiv cs.LG

受控协变量偏移下的泛化度量:一种条件感知基准

新基准揭示:泛化度量有效性高度依赖条件;锐度与输入梯度度量最优,模型选择应按扰动场景评估。

04:00
arXiv cs.LG

面向能量自主鸟类监测:探究目标类别对神经网络可压缩性的影响

提出在微控制器上压缩模型进行鸟类监测,高压缩率下性能损失小,并评估多目标类别影响。

04:00
arXiv cs.LG

有向和无向网络中介数排名的度质量消息传递

提出轻量GNN,用多跳度质量预测介数排名,在有向/无向图上分别提升10.9%/24.6%相关度,参数少56倍。

04:00
arXiv cs.LG

基于最优多路决策树的可解释聚类

提出ICOMT:一维K-means离散化+二元线性优化构建最优多路决策树,精度高且树浅可解释。