11442 条条目 · 106 个活跃源
2026年9月9日
04:00
arXiv cs.LG

胶囊透镜:定位与追踪模型表示中的概念几何

提出胶囊透镜框架,以可解析的胶囊几何匹配概念区域,实现对静态与动态表征中概念几何的定位与追踪。

04:00
arXiv cs.LG

HB-PVI:面向复杂活动识别的分层贝叶斯个性化与信息价值框架

HB-PVI:个性化增益小,标签无价值,故不购标签保留群体模型,标签全减,损失极小,应以信息价值驱动决策。

04:00
arXiv cs.LG

内在好奇心驱动的强化学习内生探索

提出内在好奇心驱动的强化学习框架,发现中等失调度下探索最优;基于LSM实现,在LunarLander和BipedalWalker上媲美PPO/ICM,而Active Inference无此效应。

04:00
arXiv cs.LG

LLM生成的SystemVerilog断言对保语义RTL变换的鲁棒性

保语义RTL变换测试显示,LLM生成断言的点准确率掩盖了9.7%-27.0%的翻转失败,需鲁棒性评估。

04:00
arXiv cs.LG

PAC私有自回归生成:根据集成分歧校准噪声

将PAC隐私扩展至自回归生成,构造重叠世界集成,按分歧校准噪声,在严格隐私保证下保留74%微调收益。

04:00
arXiv cs.LG

GraphNOSE:嗅觉中的图Transformer

开源图变换器从分子结构预测气味,参数少六倍,AUROC平均提升4.52%,对未知化合物达84%,并具有可解释性。

04:00
arXiv cs.LG

混合线性回归中分数匹配、最大似然与期望最大化的联系

研究混合线性回归的方差保持扩散,建立分数匹配与似然、EM的联系,证明估计器收敛及误差高斯极限,数值实验验证。

04:00
arXiv cs.LG

AhaBench:智能体能否从先前经验中学习?——一个面向长时程持续学习的基准

新基准评测智能体能否从先前经验中学习:含三个任务,用初始、经验后和学习提升三项分数,揭示模型表现各异。

04:00
arXiv cs.LG

SAFEGuard:通过有害语义分析与流畅度测量检测基于优化的越狱攻击

提出SAFEGuard框架,融合流畅度与有害语义分析,有效检测优化型越狱攻击,准确率超越现有方法。

04:00
arXiv cs.LG

度假租赁替代房源推荐中的候选生成:一种多源集成方法

协同过滤+图神经网络集成提升度假租赁替代房源候选召回14.8%,并利于下游排序。

04:00
arXiv cs.LG

非线性椭圆均匀化与参数化深度Ritz方法

用参数化Deep Ritz求解非线性均匀化胞元问题,神经网络表示多状态解,连续可微,加速宏观计算。

04:00
arXiv cs.LG

Data Scout:面向特定领域预训练语料的定向网络爬取

数据侦察兵:大模型扩主题、子域筛,定向爬取替代过滤。数学高质量率升七十倍,六成三为通用档案缺,预训练相当。

04:00
arXiv cs.LG

有限反馈下的LLM专家在线学习

研究有限反馈下提示到LLM专家的在线自适应路由,提出低遗憾算法,实验可高效学习高质量路由策略。

04:00
arXiv cs.LG

RAPTOR:混合专家模型中的角色感知私有训练

提出角色感知私有训练:针对混合专家共享层与专家角色差异,用专属裁剪与噪声,使并行组合不增隐私预算,效果更优。

04:00
arXiv cs.LG

通过自适应特征与样本缩减扩展最优分类树规模

提出联合特征与样本缩减:加权合并重复样本实现百倍加速,自适应精化候选集与特征保留支持更深树,性能相当或更优。

04:00
arXiv cs.LG

基于神经网络的呼吸性窦性心律不齐分析

提出深度学习直接从ECG估计呼吸率,利用RSA现象,三种网络自动提取特征,无需预处理,适用于非侵入呼吸监测。

04:00
arXiv cs.LG

生成建模的牛顿匹配:微调与采样的统一框架

提出牛顿匹配框架,统一生成模型的微调和采样,证明牛顿方向为负Fisher-Rao梯度,保障收敛。

04:00
arXiv cs.LG

基于域随机化强化学习的HVAC控制泛化

采用物理信息归一化流的自适应域随机化,训练跨建筑空调控制,优于传统PID与非随机强化学习,接近模型预测控制。

04:00
arXiv cs.LG

重新审视多智能体系统效率方法的评估

现有评估高估了多智能体系统提效方法,效果常依赖特定设定或随机剪枝,需在受控诊断基准下验证。

04:00
arXiv cs.LG

动态网络的预算约束任务感知获取

提出Scout轻量框架,学习节点查询的任务价值,预算内动态获取图信息。21个基准中19个最优;任务效用监督优于结构变化监督,证明观测价值取决于下游任务。

04:00
arXiv cs.LG

超越任意几何:神经PDE算子中的拓扑泛化

神经算子兼容任意几何,但域拓扑变化仍致性能下降;拓扑是独立于几何的泛化轴,影响遍及霍奇谱而非仅调和核。

04:00
arXiv cs.LG

基于恢复证据图的P&ID推理:以证据图约束视觉语言模型实现忠实可靠

恢复证据图并用只读查询约束模型,使拓扑问答准确率由约40%升至75%左右。

04:00
arXiv cs.LG

CALM:面向去中心化联邦学习的类别级一致性感知与标签门控分歧调制

CALM通过类别级一致性加权教师、按分歧缩放蒸馏、标签门控调节,无需额外通信与数据,优于异构联邦蒸馏方法。

04:00
arXiv cs.LG

机器学习原子间势训练集选择中覆盖法与响应法的预算依赖交叉

覆盖法在低预算更优,响应法在高预算(20%)反超,力误差降0.46-5.89%,预算决定取舍。

04:00
arXiv cs.LG

面向前向校正分类的选择性后验边际正则化

SPMR:保留前向校正,用后验边际冲突做分级更新,避免错标记忆,完整训练提升2.5-7个百分点。

04:00
arXiv cs.LG

一种学习率并不够:LoRA微调中的自适应各向异性学习率

提出自适应各向异性学习率方法:为LoRA各秩一分量在线调学习率,无额外参数,提升微调性能且更好利用秩容量。

04:00
arXiv cs.LG

基于滤波与最优传输的图字典学习框架

提出基于滤波和最优传输的图字典学习,以sfGOT距离度量重构误差并端到端优化,聚类分类性能优越。

04:00
arXiv cs.LG

具有常数遗憾的在线资源分配一阶学习算法

提出在线资源分配的一阶原始算法:每期对动作坐标做一次梯度上升,无需解LP,遗憾O(1)且不依赖非退化假设。

04:00
arXiv cs.LG

基于多目标学习的可解释且公平的广义加性神经网络

提出多目标神经基础模型框架,同时优化准确性、可解释性与公平性,揭示其复杂关系及权衡,并验证有效性。

04:00
arXiv cs.LG

QGB-W$k$NN:面向鲁棒分类的量子粒球学习

提出量子粒球加权近邻法,结合纯度感知与分层搜索,实现高效鲁棒分类。

04:00
arXiv cs.LG

LoGIC:利用表格基础模型进行节点级图上下文学习的预算化上下文构建

LoGIC以标签与光环预算构建上下文,保持全量性能,降低内存,支持百万级节点图。

04:00
arXiv cs.LG

最小化前向-前向算法中睡眠剥夺的影响

针对前向-前向算法睡眠剥夺致学习效能下降,改进激活、损失、阈值并引入咖啡因刺激,精度提升2%-62%。

04:00
arXiv cs.LG

DART:面向算法学习的分布对抗循环训练

提出DART框架,用局部目标分布和对抗目标替代单点监督,提升循环推理模型的稳定性与鲁棒性。

04:00
arXiv cs.LG

深度时间序列模型中的记忆

将深度时间序列模型按记忆机制统一分类,区分内部与外部记忆,综述外部记忆方法,指出开放问题。

04:00
arXiv cs.LG

粒球量子聚类:面向资源高效与鲁棒学习

提出粒球量子聚类框架,压缩数据减少80%量子核计算,通过量子内聚过滤噪声,在多种数据集上精度与鲁棒性优于现有方法。

04:00
arXiv cs.LG

IXPLORE:有界理想点估计与基于网格的不确定性量化

有界理想点估计:融合预测拟合与稀疏感知似然,重建/插补误差低,尤其适合稀疏用户,网格化不确定性量化。

04:00
arXiv cs.LG

机器学习用于培养前ESBL风险分层以指导经验性抗生素选择:一项12家医院肠杆菌科培养研究

培养前机器学习预测ESBL,12医院13万份培养,敏感90%时NPV95.8%,可指导减用碳青霉烯。

04:00
arXiv cs.LG

ERASE:无需显式反学习的即时遗忘

提出ERASE推理时遗忘方法:类条件输入扰动,不改权重、无需重训,在抑制指定子类影响下保留其他预测。

04:00
arXiv cs.LG

基于大语言模型的数据质量规则生成

针对数据质量规则难维护,提出基于大语言模型的自动生成方法,过滤冗余并验证有效性。

04:00
arXiv cs.LG

FANS:面向异构设备的联邦自适应网络搜索学习

提出FANS超网络框架与FPS算法,学习共享架构空间,并行自蒸馏训练子网络,扩展候选池,改善精度-效率权衡。

04:00
arXiv cs.LG

日历-SPCA:面向多周期电力消费曲线的可解释表示学习

日历稀疏主成分法将多周期结构融入表示学习,产生稀疏连贯负荷模式,保留主要方差并提升可解释性。

04:00
arXiv cs.LG

ACE:MoE大语言模型参数高效微调中的跨专家适配器整合

ACE将冗余专家分组,用组共享高秩LoRA替代专家专用LoRA,分组执行,提升精度并加速训练1.31-1.48倍。

04:00
arXiv cs.LG

超越免重训MoE压缩:压缩后调整的成本归一化研究

免重训的MoE压缩需配合小规模调整:用3000样本微调即可恢复37.3%的性能损失,且优于知识蒸馏。

04:00
arXiv cs.LG

情境化删失需求下的定价库存学习

提出情境化删失需求下定价库存框架,采用基函数线性模型,获最优遗憾界,实验验证有效。

04:00
arXiv cs.LG

FedSubMuon:基于结构化子空间Muon的通信高效联邦大语言模型微调

在共享结构化子空间优化紧凑系数矩阵,降低联邦微调通信;扩展版以投影梯度提精度,多数任务最佳且节省通信。

04:00
arXiv cs.LG

从连接组到功能:面向储层计算的条件生成潜在表征

条件生成潜在框架可编码连接组并重建生成图,用于储层计算,功能预测R²达0.87,揭示任务依赖的结构机制。

04:00
arXiv cs.LG

PhenoBench:揭示深度表型人类队列能告诉我们的信息

构建基于深度表型队列的可执行基准,定义临床任务,评估表格与语言模型,发现预测增益有限,支持版本化审计。

04:00
arXiv cs.LG

VERPO:验证证据正则化策略优化

提出VERPO,以证据修正策略并保留结果目标,在科学推理和工具任务上超越最强基线,平均分提升显著。

04:00
arXiv cs.LG

数字孪生分析中的12小时港口洪水预警:稀疏事件聚类学习

将港口洪水预警建模为事件聚类问题,用稀疏弹性网与顶k截断,实现12小时预警,F2达0.696。

04:00
arXiv cs.LG

决策感知的业务流程后缀预测与推理

将决策挖掘融入后缀预测,提出神经符号框架,提升短前缀及稀有变体预测,兼具可解释性。