11452 条条目 · 106 个活跃源
2026年9月9日
04:00
arXiv cs.LG

迈向统一多模态图基础模型:基于桥-路由器-适配器的方法

提出桥-路由器-适配器模型,按范围解耦上下文并动态路由模态,多图预训练后适配,提升节点分类、链接预测和图文生成。

04:00
arXiv cs.LG

LATS:莱维自适应树采样,实现反馈驱动的多样化目标发现

提出LATS,用重尾探索和树回溯,高效发现低概率高价值目标。

04:00
arXiv cs.LG

当保留约束冲突时:缓解表格数据中的遗忘-保留干扰

提出冲突感知遗忘(CAU),针对表格数据模式导致的重叠,减少遗忘-保留干扰,接近重训练效果。

04:00
arXiv cs.LG

面向上下文学习的数据高效样本选择

提出新框架,将上下文示例选择视为子集排序,用间隙索引与非线性替代模型,少样本下准确率提升8-15.9%。

04:00
arXiv cs.LG

DrugReason:面向药物重定位的知识图谱与语言证据动态多视角推理

DrugReason融合知识图谱推理与语言证据,动态路由多专家,提升药物重定位准确率。

04:00
arXiv cs.LG

追踪动态前沿:长短期优势估计器

提出LSTAE,用历史经验做长短时优势估计,仅需一次采样;在智能体与数学推理基准上性能不降且大幅降低成本。

04:00
arXiv cs.LG

基于时间序列基础模型的协变量感知电网负荷预测评估

时间序列基础模型经微调后短期负荷预测强劲,但零样本精度不及专用模型,误差随预测步长快速增大。

04:00
arXiv cs.LG

巧训练而非苦练:主动学习中切换信号引导的训练

提出混合主动学习法,依稳定信号由重训练切换至微调,省时近半,性能不降,校准更优。

04:00
arXiv cs.LG

神经网络中的特征叠加:从理论到实践

综述特征叠加的几何、学习与计算,比较特征恢复方法,指出激活重构不足以证明特征身份与因果作用。

04:00
arXiv cs.LG

离线强化学习中扩散策略的噪声空间策略梯度

提出噪声空间Q函数与策略梯度NSPG,无需去噪反传,在D4RL与OGBench上有效训练离线扩散策略。

04:00
arXiv cs.LG

PPIM:用于热源条件化三维生物传热仿真的Pennes物理信息Mamba

提出PPIM,融合热源条件与Pennes感知SSM衰减初始化,用于三维生物传热仿真;对比PINN等,其误差最低。

04:00
arXiv cs.LG

从合成先验到模型行为:表格基础模型中的结构覆盖

通过结构覆盖度量四种表格基础模型的合成预训练先验,发现覆盖越广越密,下游相对性能越好。

04:00
arXiv cs.LG

Delta 注意力中的精确记录遗忘:传输判据、代价与重放证书

Delta注意力中,传输凭证无法精确删除记录;从记录前检查点重放后缀可精确遗忘,代价随后缀长度增长。

04:00
arXiv cs.LG

面向异构负载均衡的自适应SED学习

未知服务率异构双服务器负载均衡,提出在线学习算法,平衡SED路由与强制探索,收敛至SED且遗憾有限

04:00
arXiv cs.LG

约束值含噪声的约束在线学习

研究噪声约束值与梯度下的约束在线凸优化,证明硬违约下界,提出LEDGER,权衡遗憾与预算违约。

04:00
arXiv cs.LG

拒绝的几何:为何事后安全训练脆弱,而预训练期安全训练持久

事后安全训练只遮蔽能力、易被微调恢复;预训练全程安全协同训练可持久抗攻击。

04:00
arXiv cs.LG

从分阶段几何视角看流匹配与无分类器引导的粒子动力学

构建流匹配与无分类器引导的分阶段几何理论:粒子渐次趋向均值邻域、凸包和局部簇,引导重塑局部几何。

04:00
arXiv cs.LG

PCSDiff:面向实际业务化中期降水预报的基于扩散的偏差校正与超分辨率

提出PCSDiff级联扩散框架,校正10天降水偏差并超分,较ECMWF显著降误差提精度,支持业务低延迟预报。

2026年9月7日
04:00
arXiv cs.LG

量子变分原型循环单元

提出轻量量子原型循环单元,参数远少于经典与量子RNN,预测性能持平,兼具可扩展性优势。

04:00
arXiv cs.LG

面向JEPA风格世界模型的频谱目标物理潜在结构化

提出傅里叶辅助头,对潜在空间施加物理结构化监督,解决物理表征惰性,提升动态环境规划成功率与数据效率。

04:00
arXiv cs.LG

评估大语言模型在强制停电风险预测中的表现:优势与机器学习对比

研究零样本LLM预测天气致停电风险,精度不及监督模型,但推理与扩展性互补,建议两者结合。

04:00
arXiv cs.LG

ProToMEx:通过结构化表示实现快速、可解释的解释

提出ProToMEx,用概率主题模型挖掘潜在原因,提供全局与局部解释,保真度比肩SHAP/LIME,速度快30-40倍。

04:00
arXiv cs.LG

量子辅助的Wi-Fi人体活动识别参数密集训练内存优化方法

提出量子辅助内存高效训练框架,减少90%-95%可训练参数,剪枝实现75%-85%稀疏度,精度损失小于2%。

04:00
arXiv cs.LG

BER-PEF:基于贝叶斯错误率估计的统一人类移动性可预测性评估

提出BER-PEF框架,将贝叶斯错误率转化为可预测性估计,无需真实标签即可统一评估异构移动数据上的预测性能。

04:00
arXiv cs.LG

模块化深度递归神经网络:四旋翼应用

提出模块化深度RNN,新增前馈层间连接,提升高阶动力学学习能力,缓解梯度消失/爆炸,四旋翼案例验证优于现有方法。

04:00
arXiv cs.LG

SharedSAE:跨语言模型的统一特征字典

共享字典替代各模型专用SAE,保留96.6%解释方差,跨模型潜变量可迁移,新模型可高效适配复用。

04:00
arXiv cs.LG

基于函数分析的数据驱动未知非线性微分方程学习

提出可解释ML法:仅凭单条轨迹,基于函数空间积分距离,增量在线学习未知非线性ODE向量场与外力。

04:00
arXiv cs.LG

一种利用风洞实验观测校准航空航天代理模型的数据融合框架

利用风洞压力测量数据训练修正网络学习计算流体仿真与实验的系统偏差不重训即提升表面压力预测超过直接插值

04:00
arXiv cs.LG

哈肯:预测未来发现,填补今日知识空白

哈肯系统预测科学概念间未记载关系,经生物学验证,发现TP53-BAMBI等新交互,助力药物研发。

04:00
arXiv cs.LG

当负载均衡过度时:过分散混合专家模型中的专家剪枝

过分散路由下困惑度无法预示精度,新方法按领域赋分,最小化最差领域退化。

04:00
arXiv cs.LG

从众性破坏共形预测

从众破坏共形预测:同侪一致错误时校准覆盖率跌破预期,低置信子群近乎减半,标准校准修正无效。

04:00
arXiv cs.LG

使用五种大语言模型对英文歌词文化分析的重复测量研究

评估五个大语言模型对英文歌词四种社会构念的重复标注,显示可靠性不一,自尊最强,需先报告稳定性与一致性。

04:00
arXiv cs.LG

深度算子学习中的注意力解耦:数据驱动与物理信息架构的受控研究

系统对比五种DeepONet注意力变体:逐传感器交叉注意力最可靠,误差降低2.4–32.3倍;分支自注意力仅对复杂高维输入有益。

04:00
arXiv cs.LG

t-SNE能量函数临界点的丰富性研究

本文研究t-SNE能量景观,针对连续对称密度,构造无穷多临界点族,解释拓扑破坏与伪聚类等现象。

04:00
arXiv cs.LG

个性化医疗概念表示的预算文本图上的LLM精炼框架

提出REFINE框架,用强化学习预算KG扩展并融合GNN与LLM,实现患者个性化医疗概念编码,在MIMIC数据集上提升EHR预测性能。

04:00
arXiv cs.LG

机载机器学习用于成像光谱数据中的痕量气体检测

2026东京野外试验,机载边缘机器学习处理成像光谱数据,首次实现甲烷点源排放的机上检测,避免下行瓶颈。

04:00
arXiv cs.LG

对称正定流形学习的嵌套归纳偏置框架

提出嵌套归纳偏置框架,将非欧几何拉回对称正定流形,构建曲率对齐分类器;并提出有理共形度量增强鲁棒性。

04:00
arXiv cs.LG

超越通用预测选择器:基于需求模式与预测期限的条件化模型选择

无通用预测选择器;其适用性依需求模式、数据量与期限变化;对平滑/间歇等形态各具优势,应情境化选择。

04:00
arXiv cs.LG

蒸馏连续扩散语言模型可在少步或单步内编写代码

提出PlaidQ模型,将连续扩散蒸馏为少步乃至单步代码生成,性能媲美离散扩散模型,验证连续扩散可加速语言生成。

04:00
arXiv cs.LG

SMILE:桥接连续优化与离散符号恢复

提出混合框架,统合连续优化与离散符号恢复,高噪声下符号解率最高,恢复更简表达式且速度快。

04:00
arXiv cs.LG

Mitra-v2 技术报告

基于合成数据训练的表格基础模型,仅77M参数媲美1.6B参数模型,超越TabPFN-3,已开源。

04:00
arXiv cs.LG

参数化神经算子对可兴奋与振荡FitzHugh-Nagumo动力学的快速代理建模

参数化FNO快速替代FHN模型:振荡区误差<0.1%、提速近千倍,兴奋区再现激发阈值与传导律。

04:00
arXiv cs.LG

细粒度混合专家模型中无需训练的激活专家减半方法

无需训练即可让细粒度专家模型激活专家减半:采用参考归一化,性能几乎无损,且专家身份比权重更重要。

04:00
arXiv cs.LG

有限域求逆中的表示冗余与结构复杂性

有限域求逆中,同轨道有序基逆映射相同,冗余n对1;公式复杂性与学习难度一致,冗余泛化收益有限。

04:00
arXiv cs.LG

用于磁化动力学的基于能量的守恒-耗散潜神经演化算子

提出潜神经常微分方程-卷积自编码器的磁化降阶模型,能量梯度分为守恒与耗散流,无需物理标签即高效预测轨迹。

04:00
arXiv cs.LG

量子退火机上的带时间窗容量车辆路径问题:GNN引导的图粗化与自适应QUBO惩罚

提出GNN引导图粗化与自适应QUBO惩罚,改善量子退火求解带时间窗车辆路径问题,可行性显著提升,硬件样本合格率0.02%→39%。

04:00
arXiv cs.LG

过于罕见而学不会:预设气旋路径削弱孟加拉湾海洋模拟器

预设气旋路径会损害孟加拉湾海洋模拟器,因气旋出现过少,模型对罕见信号给出错误预测。

04:00
arXiv cs.LG

优化器记忆调度:在过度训练轴上实现更优扩展

训练周期改变优化器排名;动量调度法ADANA随过度训练增加而优于AdamW并迫近SOAP。

04:00
arXiv cs.LG

图灵机的可解释性

研究证明可解释性技术“敏感性”能识别图灵机的算法结构,其对称性反映在敏感性矩阵中,DFA实验证实可用PCA和聚类恢复算法特征。

04:00
arXiv cs.LG

动态异构图表示学习:综述

首个系统综述动态异构图表示学习,提出统一定义与算法分类,总结应用与未来方向。