11502 条条目 · 106 个活跃源
2026年8月31日
04:00
arXiv cs.LG

基于增长自组织映射和合成回放的无监督持续学习

提出基于增长自组织映射与合成回放的无监督持续学习框架,无需存储原始数据,性能媲美监督方法。

04:00
arXiv cs.LG

当Muon遇上任务干扰:持续学习与模型合并的谱视角

持续学习与模型合并同属任务干扰,优化器谱范数是关键。Muon能抑制该因子,显著提升两者性能。

04:00
arXiv cs.LG

语言模型中的量化触发后门:跨量化器可迁移性与验证-部署鸿沟

量化后门利用验证-部署鸿沟,INT8/4位压缩触发恶意行为,跨量化器可迁移,源精度审计不足,部署配置须认证。

04:00
arXiv cs.LG

边际覆盖信用减少并行状态熵优化中的冗余探索

提出边际覆盖信用方法,按留一策略覆盖度分配奖励,减少冗余探索,提升并行策略互补覆盖。

04:00
arXiv cs.LG

用于关联证据归因的自解释多标签图神经网络

提出SEMGNN,联合预测与边掩码解释,利用标签相关性增强多标签分类与解释的忠实性。

04:00
arXiv cs.LG

块稀疏特征化器的深度分析

块稀疏特征化器以子空间块为单元,仍有特征分裂/组合等缺陷;提出锦标赛Top-K选择缓解分裂,并扩展到交叉编码器。

04:00
arXiv cs.LG

曲率感知半径收缩的自适应最近邻分类

通过局部曲率自适应调整邻域半径,提升最近邻分类精度,在多个数据集上显著优于传统k近邻。

04:00
arXiv cs.LG

蒲公英:用于行星动力学神经模拟的球面花朵

提出球形蒲公英求解器,无卷积,仅用球坐标变换实现空间混合,在球面PDE基准上表现最佳或次佳。

04:00
arXiv cs.LG

更多数据无法打破对称性:设计保障的可识别性

无监督对齐受几何自同构限制,密集采样致诊断失效;设计时选择非对称刺激,可将对齐失败从75%降至2%。

04:00
arXiv cs.LG

DAMP:衰减感知混合精度循环状态量化

DAMP衰减感知混合精度量化循环状态,9.9比特下精度接近FP32,存储降69.1%,解码提速10.9%。

04:00
arXiv cs.LG

快速权重注意力用于持续学习

研究循环快速权重记忆在自回归前缀预测下的在线学习规则,提出归一化一阶更新及Falcon系列变体,在语言建模和长度外推上表现优异。

04:00
arXiv cs.LG

SegBench-GC:测试多步离线目标条件强化学习的分割不变性

提出分割不变性基准,揭示人为切分轨迹会严重损害多步离线GCRL,延续引导可缓解。

04:00
arXiv cs.LG

RiskBlend:机器学习回归测试中测试输入优先级排序的多信号框架

提出RiskBlend框架,融合历史失败、预测/边界/邻域变化四种信号,在80种组合中平均APFD最高。

04:00
arXiv cs.LG

超越非独立同分布:联邦学习中的学习者-客户端分布不匹配

现有联邦学习忽视客户端与学习者数据分布错位,提出基于代理数据的影响力感知动态客户端选择,用留一法评估,提升收敛速度与精度。

04:00
arXiv cs.LG

利用基础模型进行基于脑电图的阿尔茨海默病诊断

利用脑电预训练大模型与随机森林,仅用8秒脑电片段,AUC达89.36%,优于传统频谱法,并捕获临床验证的α/θ节律退化生物标志物。

04:00
arXiv cs.LG

SafeStep:面向行人安全监测的语义通信交互演示

开发交互式演示平台,实时监测行人安全,采用新型语义通信方案,任务损失降低92.1%,支持多用户并发。

04:00
arXiv cs.LG

DART-FL:边缘动态推理需求下的突发感知多任务联邦学习

提出突发感知多任务联邦学习,动态切分推理训练资源,按需求调权,突发期提升高频任务精度,保持性能。

04:00
arXiv cs.LG

来自模型内部的调用:探究基于探针的大语言模型工具调用错误检测

线性探针可有效检测LLM工具调用错误,能泛化至新型错误,效果受模型大小、探针层与训练方式影响。

04:00
arXiv cs.LG

超越搜索模仿:面向无搜索国际象棋的先验引导探索

用前向KL替代反向KL,使无搜索自博弈探索贴近先验,提升战术准确率但棋力不随之提升,二者解耦。

04:00
arXiv cs.LG

面向高效天气集合预报的扩散蒸馏

提出监督能量距离蒸馏,将多步扩散教师压成单步学生,保持极端事件技巧,用于天气预报,一次评估达或超教师。

04:00
arXiv cs.LG

SOMTab:高效表格上下文学习的集合序Mamba方法

SOMTab用Mamba构建表示、注意力做预测,实现高效表格上下文学习,推理更快、内存更低。

04:00
arXiv cs.LG

初始化至关重要:通过模型初始化推进负荷异构下的联邦短期负荷预测

针对联邦短期负荷预测中的负荷异构问题提出全局预训练与局部顺序初始化策略减少客户端漂移提升精度

04:00
arXiv cs.LG

动态图上时序记忆感知的在线测试时适应

提出动态图在线测试时适应新方法,含时序增强、记忆感知与一致性引导,显著提升多种分布偏移下的泛化。

04:00
arXiv cs.LG

中文标题:可操作CBFI:面向表格机器学习的结构分解与因果反事实干预整合框架

中文摘要:提出A-CBFI框架,基于结构因果模型定位因果瓶颈并精准干预,减少主动干预负担76.9%,同时保持因果有效性与全局干预成本。

04:00
arXiv cs.LG

TACIT-Switch:基于删失监督的LLM智能体成本感知模型升级

提出TACIT-Switch,用区间删失观测学习永久切换策略,在相似成本下成功率提升7.4-11.1个百分点。

04:00
arXiv cs.LG

超越成对图:用于参数化PDE的超图自适应小波算子

提出超图自适应小波算子HALO,以线性稀疏成本学习谱域特征,在多类基准上达最优精度,并稳定扩展至工业级网格。

04:00
arXiv cs.LG

FedEHR-Agents:用于自动化EHR建模的联邦智能体优化

提出以经验为中心的联邦智能体优化框架,聚合多医院临床建模经验,优于多种基线。

04:00
arXiv cs.LG

面向神经性能预测的节点级特征编码

提出节点级特征编码的预测器,融合计算量、参数、内存代理,预测延迟与能耗,新数据集上达最优,并普遍提升现有模型。

04:00
arXiv cs.LG

去而复返:用于多模态翻译的双向扩散桥

提出双向图像文本扩散桥,支持正反向生成,源感知路径提升采样灵活性,性能优于基线。

04:00
arXiv cs.LG

TI²PS:一种面向随机多细胞模式形成的拓扑信息逆向设计框架

提出贝蒂向量+逆代理建模,从目标模式估计ABM参数,优于PointNet++,仅用10%数据。

04:00
arXiv cs.LG

条件流匹配何时能替代逐点负对数似然?

线性高斯路径下精确分解端点负对数似然,指出普通流匹配并非逐点似然估计,加权可消内部残差,在线对齐仍有偏差,为似然法适配流匹配提供理论依据。

04:00
arXiv cs.LG

PhyMamba:物理调制Mamba实现稳健电池健康预测

提出物理调制Mamba框架,融合电化学老化,多数据集误差降31.8%,兼顾精度与效率,稳健预测电池健康。

04:00
arXiv cs.LG

学习差分:面向时间序列预测的自适应可逆差分法(AdaRDiff)

提出自适应可逆差分法:可学习加权差分简化序列,闭合式重构加速,两阶段训练提升精度,达最优且即插即用。

04:00
arXiv cs.LG

蒙特卡洛树搜索就是每次访问蒙特卡洛控制吗?

蒙特卡洛树搜索与每次访问蒙特卡洛控制本质相同,四阶段归结为轨迹采样与每次访问更新。

04:00
arXiv cs.LG

一种在质量退化约束下以性能最大化为目标的LLM量化层位宽分配方法

提出Gemma-3-1B层位宽分配法,在质量退化约束下最大化性能,11%延迟降低且损失可忽略。

04:00
arXiv cs.LG

线性回归中加权数据选择的精确风险比

证明三个精确风险比值:F_w(d,2d-1)=1+1/d、F_w(3,4)=5/3、F_w(4,5)=2;给出一般下界并猜想全域成立。

04:00
arXiv cs.LG

高能物理碰撞数据回归中经典与量子机器学习的比较

经典与量子模型比较:量子模型以极少参数达相近精度,QCNN用4量子比特媲美深度CNN,具参数效率优势。

04:00
arXiv cs.LG

面向可靠医疗AI的可解释不确定性估计

提出egRUE方法,统一不确定性量化与特征级解释,提升医疗AI可靠性及医生校准信任,增强安全关键决策支持。

04:00
arXiv cs.LG

广义吉布斯系综加权用于预测组合

提出广义吉布斯系综加权框架,经多项基准测试,性能有竞争力但非普遍最优。

04:00
arXiv cs.LG

VICT:面向长程LLM智能体强化学习的验证器插桩信用追踪

VICT利用验证器内部原子结构追踪依赖边,将优势沿证据边重分配,改进长程LLM智能体稀疏奖励下的信用分配。

04:00
arXiv cs.LG

频谱特征主导BCG呼吸事件检测:睡眠呼吸暂停患者特征组的大规模患者独立比较

BCG监测睡眠呼吸暂停,155例患者比较10类特征,频域特征主导(占30.3%),时频联合贡献67%,AUC达0.97。

04:00
arXiv cs.LG

促进多层感知机顿悟的生物启发机制

生物启发机制促进顿悟,稳态作用最强,结构稀疏次之,均经调节神经元利用与有效连接改善泛化。

04:00
arXiv cs.LG

执行性隐私:当差分隐私最大化效用

当数据泄露与参与反馈足够强时,有限差分隐私预算长期效用优于非私有,证明差分隐私可最大化长期效用。