11352 条条目 · 106 个活跃源
2026年9月23日
04:00
arXiv cs.LG

EMGBlend:面向手势与力解码的异构感知自监督预训练

EMGBlend以几何注意力、频带受限目标和源平衡融合多源异构肌电数据,自监督预训练提升手势与力解码。

04:00
arXiv cs.LG

重连还是门控?指令微调如何塑造大语言模型中的知识冲突回路

指令微调门控相同晚期注意力头,非重造冲突回路;更信参数记忆,抗简短注入有限,基座可解释工具可迁移。

04:00
arXiv cs.LG

自教师应看到什么?面向同策略自蒸馏的特权上下文设计

同策略自蒸馏中,特权上下文并非越多越好;适度抽象优于完整参考解,更省提示且性能更佳。

04:00
arXiv cs.LG

狄利克雷平滑马尔可夫估计下的边际对数似然增量

狄氏平滑马尔可夫中,边际对数似然增量呈KL散度加权缩减;批目标非子模/超模,个体排序不必要不充分。

04:00
arXiv cs.LG

从专家到子专家:面向MoE大语言模型的细粒度参数高效微调

提出NSFT,将MoE专家细分为子专家,结合路由重要性与内部激活显著性稀疏微调,性能更优且参数更少。

04:00
arXiv cs.LG

基于贝叶斯Bandit Gittins指数的成本感知高效LLM评估

提出GittinsEval,将LLM配置选择建模为成本感知贝叶斯Bandit,用Gittins指数与LCB随时推荐,仅1%–2%成本即近零遗憾。

04:00
arXiv cs.LG

当黎曼流遇上Wasserstein:流形上概率分布的生成建模

提出RWEFM框架,在黎曼流形Wasserstein空间上生成概率分布,可生成单细胞与蛋白质构象。

04:00
arXiv cs.LG

对Grokking转变的探索性副本重叠探测

训练64网络探测Grokking转变的副本重叠;因对齐缺陷结果无效,事后仅标准差比约5.6有检验力。

04:00
arXiv cs.LG

AI辅助生物多样性调查的定向复核:主动连续评分占据模型

提出ACORN,将机器学习预测融入占据模型,定向复核高信息量样本,显著减少专家工作量。

04:00
arXiv cs.LG

一种面向图小样本类增量学习的轻量级可塑记忆框架

面向图小样本类增量学习,提出轻量级可塑记忆框架,结合演化微聚类与元学习平衡稳定与适应。

04:00
arXiv cs.LG

图域自适应不止于表示学习

提出EviGDA,以图感知和无图局部专家互补,独立优化、推理时混合,10数据集16任务超越SOTA。

04:00
arXiv cs.LG

完全抗拜占庭攻击的多智能体强化学习

提出FRAC-MARL,以两跳消息冗余识别可靠信息,在拜占庭边攻击下时变图中收敛至无攻击极限点。

04:00
arXiv cs.LG

符号图预训练与提示学习

提出首个符号图拓扑引导预训练与提示学习框架TopoSIGN,融合磁符号拉普拉斯编码器与持续同调分支,实验验证其有效性。

04:00
arXiv cs.LG

缓慢衰减与沉默表达:语言模型谱系中的迭代式阈下特质迁移

语言模型谱系中阈下特质可迭代十代传递但衰减;第十代可内部存特质却不表达,移除系统提示后表达消失。

04:00
arXiv cs.LG

模块化范数 RandOpt:通过架构感知扰动实现种群高效集成

提出模块化范数RandOpt,以模块级自然范数校准扰动,候选数减少3–12倍以上,多任务准确率超越RandOpt。

04:00
arXiv cs.LG

部分可观测条件下用于模仿的最小循环行为记忆

论文刻画部分可观测下模仿所需最小循环行为记忆,给出兼容关系与熵最小化,并验证学习码率接近零/二比特。

04:00
arXiv cs.LG

超越类别边缘分布:不冻结类别共现而界定回放间隔

提出RPR回放调度,界定回放间隔上界并保持类别均衡,ER-ACE准确率提升0.72–1.67个百分点。

04:00
arXiv cs.LG

基于Frank-Wolfe的带约束自监督组合优化

提出基于Frank-Wolfe的框架,将网络输出分解为可行解稀疏凸组合,构造可微自监督损失并自动取整。

04:00
arXiv cs.LG

基于自适应谱分解解耦异构交通动态的多步交通预测

提出ADNet,用可学习自适应谱分解解耦交通动态,双分支时空建模融合,显著提升多步交通预测。

04:00
arXiv cs.LG

基于函数复合的神经逼近:刚性与双指数收敛

函数复合神经逼近:分段线性生成器具刚性,光滑生成器迭代实现双指数收敛和深度分配误差界。

04:00
arXiv cs.LG

评估零样本时间序列基础模型的准确性与概率可靠性

评测六个时间序列基础模型发现:精度优于基线,但存在点精度与概率校准权衡,长短期校准表现因架构而异。

04:00
arXiv cs.LG

跨视图敏感信息差异引导的多视图公平聚类

提出跨视图敏感信息差异引导的多视图公平聚类,借助偏置排序非对称对齐与公平正则,平衡聚类质量与群体公平。

04:00
arXiv cs.LG

你只需三分之二的所选专家:细粒度MoE大语言模型中动态专家剪枝的实证研究

研究12个细粒度MoE模型发现,保留约2/3的所选专家可维持98.8%性能,动态分配仅在激进剪枝时有增益。

04:00
arXiv cs.LG

跨文本片段审计基于代理的验证

评估分数常以廉价代理标签验证,但同片段共享表面证据会造成虚高一致;应跨片段重读代理、报告构念一致性并公开生成文本。

04:00
arXiv cs.LG

CacheDyG:解耦时序传播以实现高效动态图学习

解耦时序传播与参数更新,用缓存存储节点-时间表示,仅训练轻量精化器,大幅减少参数与耗时,性能优于基线。

04:00
arXiv cs.LG

最近精确匹配注意力(LEMA)

提出LEMA:二值化查询键,查询仅关注最近精确匹配键;可与word-RAM互相模拟;训练用直通估计与退火软注意力;长程召回优于GDN。

04:00
arXiv cs.LG

先定协议,再谈进步:AIS 轨迹预测的泄漏感知评估

泄漏感知评估显示,AIS轨迹预测增益多源于评估协议而非架构,区域不相交划分可致误差剧增。

04:00
arXiv cs.LG

上下文引导:通过数值基础模型学习任务间协同以实现少样本多任务优化

提出ICG-MTO框架,用冻结数值基础模型经上下文学习推断任务耦合引导,缓解少样本多任务优化负迁移并验证有效性。

04:00
arXiv cs.LG

高斯流匹配调度:对采样与训练的影响

高斯流匹配调度可分解为方差路径与因子化,分别决定概率流与回归方差;据此优化采样与训练。

04:00
arXiv cs.LG

超越标量敏感度:激活感知的混合精度LLM量化与跨层细化

提出CASA两阶段法,以激活感知度量替代标量代理,并用跨层局部搜索,显著降低超低位宽量化的困惑度。

04:00
arXiv cs.LG

评估 SechKAN 在一维数据上的有效性

SechKAN以双曲正割为基函数,在一维分类任务上与MLP、CNN等对比表现具竞争力,Crop尤佳。

04:00
arXiv cs.LG

AURA:面向复值神经网络训练的角更新率自适应

AURA为复值神经网络提出逐参数步长自适应,按相邻复数更新一致性增减步长,可叠加于任意一阶优化器提速收敛。

04:00
arXiv cs.LG

GeoPair:面向免训练 Transformer 压缩的几何保持跨层因子分解。

免训练GeoPair优化跨层权重配对与共享字典分解,保持各层几何,结合结构化稀疏实现高效模型压缩。

04:00
arXiv cs.LG

将边缘分布交织为多变量样本路径:面向概率时间序列基础模型的免训练依赖构建

免训练耦合冻结TSFM边缘分布为多元样本路径;历史时序与通道关系提升依赖诊断,依赖重建可作独立后处理。

04:00
arXiv cs.LG

探索神经网络验证的求解器级热启动

神经网络验证的求解器级热启动:利用历史解,在多数场景显著缩短验证时间,并可解出从零开始超时的实例。

04:00
arXiv cs.LG

BOBA:基于贝叶斯主动推理的动态贝叶斯优化

提出基于主动推理的BOBA采集函数,降低动态环境未来不确定性,提升移动最优追踪,查询受限下降低遗憾。

04:00
arXiv cs.LG

拟正则神经学习的动力学

神经网络可部分习得例外,继而回归主导规律、最终恢复;例外稀少时过度正则化更强。

04:00
arXiv cs.LG

群胚等变神经网络理论:一种有界域上的可操控 CNN 方法

提出群胚等变网络与双截面等变核定理,用于有界域可操控CNN;对称不可全局群作用时精度提升至少一个数量级。

04:00
arXiv cs.LG

针对哪个 Oracle 认证?执行标签决定 Text-to-SQL 共形弃权所报告的风险

共形弃权风险取决于校准基准;换严套件暴露风险低估,专家标签名义0.1实达17–20点,须双基准并审计

04:00
arXiv cs.LG

MICRO:面向严重错误发现的多保真主动搜索

提出MICRO多保真主动搜索框架,用低成本评分辅助高成本标注,经聚类与推演最大化严重错误发现。

04:00
arXiv cs.LG

xWhyL:因果交互学习

提出xWhyL框架,将解释转为因果学习信号,证明可拒绝错误解释,并用CIL支持因果发现。

04:00
arXiv cs.LG

面向自适应联邦图聚类:一种基于全局社区感知对比学习的方法

提出AdaFGC,用全局社区锚点与对比学习实现自适应联邦图聚类,应对子图异构和簇数未知。

04:00
arXiv cs.LG

后训练下块级权重空间结构持续存在:跨LLM家族的实证研究

后训练逐张量改变权重却保留块级几何;独立特化模型偏离,据此LinkerLLM共享块省显存18–48%。

04:00
arXiv cs.LG

fp8 中的快速矩阵乘法:可认证的系数优化与实测误差

面向fp8优化Strassen型算法的系数泛函,证明全局最优并实测降低大模型NLL。

04:00
arXiv cs.LG

FuncCode:在函数空间用硬件感知量化压缩柯尔莫哥洛夫–阿诺德网络

FuncCode在函数空间构建共享码本并量化压缩KAN,最高31.6倍、精度损失小,且降低FPGA内存。

04:00
arXiv cs.LG

跨预算鲁棒性评估的间隔下降坐标

浅层评估的间隔下降坐标可预测深层鲁棒性崩溃,漂移排序显著优于生存率。

04:00
arXiv cs.LG

可认证的机制可解释性:将单输入发现提升至有界邻域

提出基于约束多项式zonotope传播的框架,将单输入机制解释发现提升为有界扰动邻域内的认证结论。

04:00
arXiv cs.LG

从风险评分到风险分配:面向多智能体系统多样性监控的密度驱动框架

多智能体监控有“羊群”冗余,提出密度驱动风险分配框架,用QUBO权衡风险与多样性,并可迁移至量子硬件。

04:00
arXiv cs.LG

CoEvo:面向多步因果推理的预言机锚定单模型自进化

CoEvo用可查询预言机校验单步,让单模型交替提议与求解并协同自进化,8B多步因果推理路径正确率达82.1%。

04:00
arXiv cs.LG

脉冲神经网络的激活能量剪枝:基于脉冲计数显著性的无监督个性化

激活能量剪枝用于脉冲神经网络:梯度剪枝在高稀疏下近乎失效,而该法在高稀疏度反超原模型。