11332 条条目 · 106 个活跃源
2026年9月25日
04:00
arXiv cs.LG

双时间尺度演员-评论家算法的集中界

推导长期平均奖励下双时间尺度演员-评论家算法的一致集中界,证明演员误差高概率收敛并随更新减小。

04:00
arXiv cs.LG

用于解释时间序列分类器的可学习时频掩码

提出XACT,在可逆时频变换系数上学习稀疏归因掩码,解释时序分类器,精准且少虚假特征。

04:00
arXiv cs.LG

资源受限设备上的边缘AI:动态环境中的二值睡眠—觉醒分类

ESP32-S3惯性+视觉多模态边缘AI,实现运动检测96.5%、姿态分类89%的睡眠-觉醒判别。

04:00
arXiv cs.LG

并非每个词元都值得蒸馏:面向 Direct-OPD 的选择性监督

Direct-OPD 对每个状态都施加监督,但低 JSD 状态下该信号近乎无效;S²D-OPD 按 JSD 排序,每条回答仅保留前 10% 状态,八项设置中七项提升。

04:00
arXiv cs.LG

面向联合发射预编码与STAR-RIS系数优化的粒子群辅助梯度元学习算法

提出粒子群辅助梯度元学习算法,联合优化预编码与反射/透射系数以最大化加权和速率,性能优于交替优化。

04:00
arXiv cs.LG

延迟且被修订结果下的下行受控在线预测组合

延迟修订结果下,在线组合冻结预测器与校正器,仅用成熟损失控下行:最差劣化0.15%,收益11.5%。

04:00
arXiv cs.LG

BridgeMem:用于时序知识图谱预测的因果成对转移残差

BridgeMem通过为冻结预测器加入查询实体与候选间成对历史转移的因果残差校正,在五个基准上一致提升MRR和Hits指标。

04:00
arXiv cs.LG

FB-GDM:基于无监督变分推断的高维线性逆问题全贝叶斯引导扩散模型

FB-GDM用无监督变分推断实现全贝叶斯引导扩散,免调参,仅需观测和算子,高维线性逆问题中优于ΠGDM且更稳健。

04:00
arXiv cs.LG

语言特异性与领域多样性:面向孟加拉语医学命名实体识别的Transformer基准评测

孟加拉语医学NER基准:XLM-RoBERTa微调最优(F1 0.5959),多语模型优于语言专用模型,提示法远逊。

04:00
arXiv cs.LG

超越特征可靠性:重复感知的多重分形曲线回归用于脑龄预测

提出重复感知多重分形曲线回归RMCR,联合建模曲线结构与重复扫描变异,兼顾脑龄预测精度与个体内一致性。

04:00
arXiv cs.LG

通过自组织的在线任务适应

元学习神经细胞自动机实现无梯度在线适应:固定慢参数,仅靠局部误差驱动快速记忆更新即可提升新任务表现。

04:00
arXiv cs.LG

论脉冲神经网络的二阶优化

提出二阶优化器SpiKFAX,以Kronecker分解近似Fisher矩阵,提升SNN精度与稳定性。

04:00
arXiv cs.LG

TinyCardioUNet:基于图编码轴间依赖与张量分解参数压缩的IMU到ECG转换

轻量UNet联合六轴IMU,经图神经网络编码轴间依赖、张量分解压缩参数,仅3.6万参数实现高精度ECG重建。

04:00
arXiv cs.LG

面向时间序列分类与预测的神经化多小波分解

提出神经化多小波分解框架m-WCN,联合提取时频特征,构建TFBC分类与FTB预测模型,实验平均提升约20%。

04:00
arXiv cs.LG

FlowAtom:面向多标签网站指纹识别的基于原子的证据聚合

无需标签构建原子原型,跨流聚合证据识别混合加密流量中的监控网站集合,最高F1达97.82%。

04:00
arXiv cs.LG

神经传输嵌套采样

融合嵌套采样与神经流,估计分子配分函数;55粒子团簇误差降一个数量级,单次输出温度分辨配分函数。

04:00
arXiv cs.LG

MORE-PLR:用于部分标签排序的多输出回归

用多输出回归解决部分标签排序:编码器将带并列排序转为回归目标,推理后处理层生成桶序,实验有竞争力。

04:00
arXiv cs.LG

ICE:面向多模态图基础模型的任务对齐 Clifford 潜在场

提出ICE多模态图基础模型,用Clifford潜场建模高阶交互,30项任务均第一。

04:00
arXiv cs.LG

基于确定性基础模型的轻量级概率降尺度

改进U-Net构建轻量级概率降尺度模型,确定性预训练加概率微调,RMSE超越最优,兼顾效率与分布拟合。

04:00
arXiv cs.LG

直接消息近似(DMA):基于一致性的因子图可处理近似推断框架

DMA直接近似因子到变量消息,基于一致性,避免内循环与负精度,用于贝叶斯神经网络推断。

04:00
arXiv cs.LG

裁剪随机梯度下降的精确收敛速度

重新分析裁剪梯度下降,在(L0,L1)光滑下给出更紧收敛界,放宽步长至η<1/β,并降低最终损失。

04:00
arXiv cs.LG

噪声评分下面向隐私与稳定的列表推荐解耦学习与选择

将列表推荐解耦为随机评分学习与确定性选择,界定隐私范围,并给出噪声评分下排序稳定的边际证书。

04:00
arXiv cs.LG

SPADE-DFL:通过无导数线性化ADMM实现通信高效的去中心化联邦学习

提出SPADE-DFL,以无导数线性化ADMM降低去中心化联邦学习通信,兼顾收敛与差分隐私,实验精度更优。

04:00
arXiv cs.LG

BLADE:用于校准知识图谱补全的蒸馏大语言模型正则化

BLADE将离线大语言模型判断蒸馏为冻结教师正则,推理无需LLM,提升知识图谱补全校准,仅限声明候选分布。

04:00
arXiv cs.LG

布朗核阶梯的公共协方差几何与认证

引入最小迹公共协方差,支配布朗核阶梯经验并集,统一核适应、高斯几何与可认证计算。

04:00
arXiv cs.LG

CataOPD:面向大语言模型推理的催化式同策略蒸馏

提出CataOPD,让教师充当催化剂而非目标,经自助路由、催化引导自解与障碍加权内化,把学生自产轨迹固化为无催化策略,提升推理与泛化。

04:00
arXiv cs.LG

任务感知谱剪枝:面向高效大模型推理的混合掩码框架

提出TASP框架,按任务校准路由谱剪枝掩码,减43%算力仍保97.7%性能,解码提速1.44倍。

04:00
arXiv cs.LG

面向多任务学习的样本加权端到端迹范数几何

提出样本加权端到端迹范数几何,精确推导经验拉德马赫复杂度,实验证明加权联合核正则提升多任务泛化。

04:00
arXiv cs.LG

谱引导扩散:通过静态谱层调度加速推理

提出谱集中率结合Frobenius范数离线调度残差缓存,免路由校准,保持质量并加速2.8–3.0倍。

04:00
arXiv cs.LG

图工程、循环工程与执行支架工程:面向零信任智能体数据工程与分析处理

提出两套零信任框架,用图、循环与执行支架保障智能体数据工程及OLAP,凭证据验证完成、恢复与生产上线。

04:00
arXiv cs.LG

当相同行不一致:从基准可识别性到复制稳健的异常检测

重复行给表格基准带来隐藏偏差;SCOUT分解支持与计数证据,实现复制稳健且校准的异常检测。

04:00
arXiv cs.LG

从纵向文本数据建模组织级语义身份的计算框架

提出统一计算框架,融合语义表示学习、图建模与语义指纹,从纵向文本推断可解释、可验证的组织语义身份。

04:00
arXiv cs.LG

融合不确定性感知与异构复杂度的联邦轨迹预测主动客户端选择

提出融合不确定性与复杂度的主动客户端选择方法,加速联邦轨迹预测收敛并提升性能。

04:00
arXiv cs.LG

广义图变分自编码器:有界散度控制后验坍缩

GGVA用有界Tsallis散度(q<1)替代KL正则,保留更多后验信息、延缓坍缩,但不提升链接预测精度。

04:00
arXiv cs.LG

基于排序原型的流形感知主题建模方法

免训练流形感知主题建模,按排序原型选K个真实文档,性能优、更快且连贯多样。

04:00
arXiv cs.LG

时间序列验证的不可能三角:训练充分性、测试覆盖性与时间因果性之间的守恒定律

时间序列验证三者不可兼得;越界需未来数据,危害取决于距离。纯噪声下乱序5折信息系数虚高至0.32。

04:00
arXiv cs.LG

公共教育预测基准的结构可靠性有限:对七个数据集的四维审计

七套教育预测数据集四维审计仅三套全过;跨群体脆弱性使随机划分高估信号,复杂度难补救,审计为最低门槛。

04:00
arXiv cs.LG

强化学习中成本感知语言模型引导的经认证预测性建议价值门控

建议获取为成本感知元推理,仅当预测价值下界超成本才查询;BabyAI上提升回报且减少97%调用,但未证明逐状态优势。

04:00
arXiv cs.LG

半监督安卓恶意软件家族归因中伪标签收益的分类器依赖性

伪标签增益依分类器而异:SVM最大+4.4%,随机森林低标签率受损,约10%标注近最优。

04:00
arXiv cs.LG

分布偏移下,科学代理模型重验证优于有状态路由

分布偏移下,科学代理模型每批重新验证选模优于有状态自适应;旧证据常无益。

04:00
arXiv cs.LG

一种在 Fat-Shattering 维数下近线性规模的平方损失不可知样本压缩方案

构造平方损失不可知样本压缩方案,规模近线性于 Fat-Shattering 维数,消除对偶因子并解决开放问题。

04:00
arXiv cs.LG

基于碰撞时间与过街区域上下文的城市交叉口安全导向行人轨迹预测

融合碰撞时间与过街区域上下文,安全导向训练降低城市交叉口行人轨迹预测误差及大误差频次。

04:00
arXiv cs.LG

Bandit多类PAC学习:修正的下界、精确族与置信度直和现象

修正bandit多类PAC下界,提出aBDS;上界去除K;仿射复用类揭示置信度直和,维数不足以刻画。

04:00
arXiv cs.LG

解耦知识与隐私:面向大语言模型持续学习的任务后自蒸馏回放

SPARK先冻结任务后分布,再以自蒸馏回放和隐私校正抑制PII,同时保持持续学习效用。

04:00
arXiv cs.LG

并非所有合成数据都生而平等:面向自动驾驶系统不平衡碰撞伤害严重度预测的专家委员会审核筛选

ECAS框架以真实数据专家委员会审核合成样本,提升自动驾驶碰撞伤害严重度不平衡预测的可信度与性能。

04:00
arXiv cs.LG

经典测验理论误导LLM评判者的三种方式

经典测验理论三项指标在LLM评判中含义错位,不能单独归因于评判者,需规范报告。

04:00
arXiv cs.LG

持续学习的顺序代价

证明持续学习的顺序代价可分解为联合训练损失与额外代价;同质任务下总损失翻倍,EWC可削减之。

04:00
arXiv cs.LG

使用新型过采样方法预测大学生的动机缺失与快感缺失症状

针对SMOTE局限,提出用预测模型生成名义变量的新过采样法,提升大学生动机与快感缺失预测。

04:00
arXiv cs.LG

GBFRVFL:基于粒球计算的模糊随机向量函数链接网络

提出基于粒球计算的模糊RVFL网络,设计自适应隶属方案,提升噪声与不平衡场景的鲁棒性和精度。

04:00
arXiv cs.LG

WeatherDiagFlow:基于证据的雷达临近预报与诊断流细化

将其形式化为证据驱动的预报—公报—审计任务,多智能体生成可审计公报,提升强回波预报技巧。