11392 条条目 · 106 个活跃源
2026年9月17日
04:00
arXiv cs.LG

EdgeReMIND:面向时序多关系链接预测的可扩展、排名第一的记忆化基线

EdgeReMIND以线性记忆化模型在TGB 2.0六项数据集上MRR居首,是唯一全覆盖的关系感知方法,突破大规模时序链路预测的扩展瓶颈。

04:00
arXiv cs.LG

脑电基础模型微调中跨深度聚合与软路由专家的数据集依赖效应

CBraMod加跨深度注意力残差与软路由专家,四个脑电数据集增益各异、正负不一,计算开销增至2–3倍。

04:00
arXiv cs.LG

基于状态空间模型的长上下文示例选择

提出基于状态空间模型蒸馏的长上下文示例选择方法,计算量降14.2倍,准确率升6.48%。

04:00
arXiv cs.LG

行走于分数流形:学习数据流形上的连续时间生成动力学

以预训练分数模型为几何先验,学习向量场沿插值路径连续演化数据,实现任意时刻生成与时间超分辨。

04:00
arXiv cs.LG

TabPFN-3.5:技术报告

发布旗舰表格基础模型TabPFN-3.5,性能领先,扩展非i.i.d.、多模态与宽表,并推出快速、增强、思考版。

04:00
arXiv cs.LG

面向分子性质预测的程序化预训练

提出程序化预训练、SMILES预训练与微调三阶段;程序化预训练可提升分子性质预测,数据稀缺时更有效,收益非单调,最佳在中期。

04:00
arXiv cs.LG

基于算子推断、重叠 Schwarz 交替法与强化学习的自适应混合耦合

强化学习在线自适应FOM/ROM耦合:DQN离线训练,部署无需参考解,动态分配高保真子域追踪移动波前。

04:00
arXiv cs.LG

NObSP:基于斜子空间投影的神经网络功能分解

NObSP用斜子空间投影将预测分解为逐特征贡献与交互残差,减少重叠子空间重复计算,兼顾局部与全局解释。

04:00
arXiv cs.LG

数值信息神经网络与重叠Schwarz交替法的混合耦合

重叠施瓦茨交替法耦合预训练数值信息神经网络与全阶模型,用于高佩克莱特对流扩散方程,两种训练精度相当。

04:00
arXiv cs.LG

定位隐藏失败使长时程智能体更可靠

发布Traverse基准,揭示长时程智能体隐藏失败;训练4B验证器Scout定位失败并筛选候选,提升任务成功率。

04:00
arXiv cs.LG

基于因果充分性与必要性的区域解释

提出SNRE框架,学习输入输出区域对,使输入隶属对输出落入该区域既充分又必要,构造可微PNS估计。

04:00
arXiv cs.LG

无流形的对称性:轨道上的内在维度

内在维度估计器在有限等距轨道上失效,神经缩放呈隐藏宽度指数律,速率由正则化器主导。

04:00
arXiv cs.LG

超越上一层:稀疏MoE路由中的残差预测结构

稀疏MoE路由中,除最近层外,更早专家选择仍能预测下一路由,存在残差预测结构。

04:00
arXiv cs.LG

ASPIRE:面向长上下文LLM推理的异步批量自推测解码

ASPIRE以混合前向、在线调度与草稿内刷新实现异步批量自推测解码,吞吐提升1.70–4.58倍。

04:00
arXiv cs.LG

线性参数模型下混合序数与指数族因果有向无环图的可识别性

线性参数模型中,序数节点至少三类、指数族节点至少三支撑点时,混合因果有向无环图的边方向可由联合分布识别。

04:00
arXiv cs.LG

超图中的最大强独立集:归约、界与贪心证书

研究超图最大强独立集,给出归约、上界与贪心证书,并用于LSH-MinHash去重。

04:00
arXiv cs.LG

内在的注意力:选择性状态空间模型中的共识动力学

选择性状态空间模型的递归如同注意力,驱动token收敛至共识,输出门调控其程度。

04:00
arXiv cs.LG

QuanText:保护文本数据共享中的数据集级秘密

提出免训练、模型无关的QuanText,扰动分布保护文本数据集级秘密并保持效用,隐私-效用权衡优于基线。

04:00
arXiv cs.LG

隐藏智能体下的结构推断

以结构无关初始化加结构引导迭代精炼,联合恢复隐藏智能体轨迹与交互结构,在多系统与遮挡实验中验证有效。

04:00
arXiv cs.LG

FoundAna:一种GNN辅助的图异常检测基础模型

首个跨图异常检测基础模型,融合GNN与Transformer,以重构误差为异常分,九个数据集上超越现有方法。

04:00
arXiv cs.LG

FedPGT:面向时变信道下车载联邦学习的渐进式梯度传输

FedPGT随瞬时信道渐进传输大梯度分量,用李雅普诺夫在线调度,图像分类与轨迹预测性能显著提升。

04:00
arXiv cs.LG

超越嵌入迁移:Grokking 迁移与稳定性中的组件作用

跨算子迁移中,注意力/MLP与嵌入/读出加速泛化;冻结载体、门控抑制复发回撤,非阿贝尔群无确认增益。

04:00
arXiv cs.LG

Agora: Git as Shared Memory for Collective AutoResearch

04:00
arXiv cs.LG

Colla-Q:通过极小极大精度平衡实现MoE量化中的专家协同

提出基于激活熵的比特分配框架Colla-Q,平衡各专家精度以促进协同,提升MoE性能并降低对校准数据的依赖。

04:00
arXiv cs.LG

iMINDBench:iEEG多机构神经解码基准

提出iMINDBench:跨三数据集十五项任务的iEEG多机构解码基准,统一预处理与评估,预训练模型仅微弱优于强频谱基线。

04:00
arXiv cs.LG

从单条轨迹学习分数阶动力学

从单条轨迹辨识分数阶线性系统,提出FO-GS两阶段估计,误差O(t^{-1/2}),优于基线。

04:00
arXiv cs.LG

重新思考如何评估医疗人工智能的方法学进展

重实现12种EHR算法,发现算法比较可跨任务与数据集迁移;新方法未必更优,梯度提升树仍具竞争力。

04:00
arXiv cs.LG

无需搜索即可触达每个位置:超立方体上的旋转稀疏连接作为注意力替代

超立方体维度逐层旋转固定稀疏连接,以2n链路在log₂n层覆盖全部位置;语言建模中优于注意力,更省参数、更快,学习率窗口更宽。

04:00
arXiv cs.LG

LIGE-GR:大语言模型时代从排序到生成式推荐的平滑跃迁

提出LIGE-GR,将排序升级为列表生成与评估推荐,兼容系统,停留时长提升1.14%/0.72%。

04:00
arXiv cs.LG

APGEM:面向真实世界CVRP案例研究的量子强化学习自适应策略引导误差缓解

APGEM在线自适应选择ZNE、PEC、CDR、REM,将真实CVRP高噪声下近似比提升至0.92–0.94。

04:00
arXiv cs.LG

超越二次损失:Adam 的稳定性相图

(β1,β2)相图显示,Adam损失尖峰源于动量时间尺度失配与有限尺度超二次损失几何。

04:00
arXiv cs.LG

MoRE:复用专家混合模型

提出MoRE,相邻层共享专家池、各层独立路由并加深度嵌入,同预算下优于标准MoE与权重共享模型。

04:00
arXiv cs.LG

总账数据中的异常检测:一种混合方法的结果

研究将审计日记账分录测试与机器学习混合,用专门模型降低误报、提升总账异常检测效率。

04:00
arXiv cs.LG

轻量级CNN集成紧凑卷积Transformer用于多尺度特征学习并降低乳腺癌钼靶图像检测与分类的计算复杂度

提出CNN集成紧凑卷积Transformer的轻量模型,仅25万参数,3个乳腺癌钼靶数据集准确率达99%-100%,并可解释。

04:00
arXiv cs.LG

神经表征中的变换法则:结构、可实现性与构造

研究神经表征变换的相容作用与可实现性,以颜色发现低次谐波结构,并构造旋转接口,对未见形状零样本读色相误差3.4°。

04:00
arXiv cs.LG

网页浏览中的行为指纹识别与导航预测

短会话可识别用户,长期结构与近期行为可预测下一步导航,重复交互模式主导,LLM语义增益有限。

04:00
arXiv cs.LG

基于GAN的鲁棒DDoS攻击检测框架

提出融合WGAN-GP对抗增强与机器学习模型的DDoS检测框架,用合成对抗流量显著提升检测精度与鲁棒性。

04:00
arXiv cs.LG

多智能体网络中的偏见放大:有偏智能体如何塑造观点与修辞

少数有偏智能体即可显著改变LLM网络中多数智能体的观点,修辞趋同先于数值趋同,且比FJ模型更快。

04:00
arXiv cs.LG

F-DACE:面向安全弃权的对话式零售决策支持的模糊分歧感知因果证据融合

F-DACE:模糊融合因果证据并硬否决;模拟67.2%决策、17.2%误荐,零售全弃权,代理准确抗扰

04:00
arXiv cs.LG

基于标签保持聚合重组与预测一致性的多电器非侵入式负荷监测

利用标签保持的聚合重组与预测一致性约束,提升跨用户NILM精度且不增加推理开销。

04:00
arXiv cs.LG

TERN:一种面向流行病预测、带季节参考与在线自适应的Delta规则记忆模型

TERN以带门控的delta规则记忆结合季节参考与在线自适应,在流感预测中优于图模型与通用预测器。

04:00
arXiv cs.LG

可解释的基于图块的深度学习:从集合模拟预测野火蔓延

以万级2米分辨率模拟训练深度学习模型预测野火蔓延,仅地表可燃物载量有效,卷积模型主要依赖距火线距离。

04:00
arXiv cs.LG

轨迹可学习性:面向不完美教师的离线同策略蒸馏

用教师成功样本训练的似然变化衡量轨迹可学习性并加权离线同策略蒸馏,无需额外生成,提升效果且更省算力。

04:00
arXiv cs.LG

每个固定指标都有盲点:一个为预报真实性打分的可学习大气评判器

训练判别器区分预报与真实天气,用其输出构造可自适应失败模式的真实性评分,在合成损坏上优于固定指标。

04:00
arXiv cs.LG

可靠虚拟感知:传感器故障下鲁棒性的多领域基准

首个多领域基准MuViS-C显示:十种传感器故障下所有虚拟感知模型均显著退化,梯度提升树最稳健。

04:00
arXiv cs.LG

带潜在混杂因素的结构方程模型:可证明保证与高效学习

提出带潜在混杂的线性结构方程模型学习法,稀疏加低秩恢复精度矩阵,迭代重建因果图,并给出样本复杂度保证

04:00
arXiv cs.LG

空间自适应噪声注入

提出SANI,按像素自适应注入噪声,仅在需校正处加噪,提升FID。

04:00
arXiv cs.LG

谱结构化预测的可证明保证

研究带边翻转噪声符号图的二值节点标签恢复,为谱方法提供首个可证明保证。

04:00
arXiv cs.LG

重新审视回声室检测的目标函数

首次形式化回声室检测目标函数,提出可扩展半定松弛算法,实验表明其优于竞争方法。

04:00
arXiv cs.LG

基于递归张量草图的少随机比特精确迹估计

针对隐式矩阵迹估计,提出递归张量草图估计器,仅需O(p(d+m)log m)随机比特,无偏且方差随p多项式增长。