11852 条条目 · 106 个活跃源
2026年6月23日
04:00
arXiv cs.LG

通过内化学习

研究神经网络将显式计算内化为权重,从链式思维到直接计算,提供首个可证明内化分析。

04:00
arXiv cs.LG

物理引导的双流异构图神经网络预测加筋板全场结构响应

提出DS-HGNN,物理引导双流异构图网络,预测加筋板全场应力位移,降低训练样本需求,捕捉屈服后特征。

04:00
arXiv cs.LG

一种基于几何自适应方形分区的高效大规模交通预测架构

提出SqLinear,用几何自适应方形分区和层级线性交互,实现高效预测,MAE降2.30%,训练时间减13.27%-30.84%。

04:00
arXiv cs.LG

我们的基准测试足够吗?多模态大语言模型持续学习分析

揭示MLLM持续学习基准的局限:任务高度可分离且顺序固定,导致路由无需复杂模型、共享专家无益,需设计新基准。

04:00
arXiv cs.LG

形式化零样本泛化的任务空间复杂度

提出有符号散度度量任务不相似度,定义任务空间复杂度,贪心策略保证ε覆盖,实验验证有效性。

04:00
arXiv cs.LG

基于半监督学习的射频数据卫星检测

采用NMFk与专家解释的半监督方法,从稀疏射频数据中检测卫星,减少标注需求。

04:00
arXiv cs.LG

正确的知识,错误的答案:开放权重语言模型中时间性事实冲突的测试时引导

提出TAS方法,通过推理时引导隐状态选择性覆盖过时知识,解决参数时间冲突,非冲突查询准确率保持85-99%。

04:00
arXiv cs.LG

连续时间概率校正器,用于不确定感知的基于物理的航天器轨迹预测

提出连续时间概率校正器,增强物理确定性传播器,提升长时域轨迹预测精度与不确定性校准,在真实数据上验证有效。

04:00
arXiv cs.LG

物理引导的全卷积时空学习面向数字孪生驱动的微观结构演化预测

将物理方程融入全卷积时空学习,提升微观结构演化预测精度与长期稳定性,为数字孪生提供可靠高效代理模型。

04:00
arXiv cs.LG

面向动态稀疏OD需求预测的结构感知图多任务学习

提出SAGMTL框架,联合学习结构状态与流量强度,提升动态稀疏OD预测鲁棒性,在三个城市数据集表现最优。

04:00
arXiv cs.LG

揭秘LLM推理中的数值不稳定性:HEAL实现关键任务可靠推理

HEAL通过INT16量化和误差补偿,在保持FP32精度的同时将性能开销降低7.1倍。

04:00
arXiv cs.LG

门控图神经网络方法用于快速收敛的动态平均估计

提出基于GGNN的分布式快速收敛动态平均估计,速度快、精度高,优于传统方法。

04:00
arXiv cs.LG

BASIL:用于科学迭代与学习的贝叶斯应用

BASIL是一款贝叶斯桌面应用,通过图形界面和预设模型优化过程,支持单/多目标。

04:00
arXiv cs.LG

Rejections Based on Predictive Uncertainty Enable Reliable Routine Soil Spectroscopy

04:00
arXiv cs.LG

Sim2O:基于联合动作组合的高效离线到在线多智能体强化学习

Sim2O将离线到在线MARL视为动作组合过程,动态混合提议,无需额外目标,高效并显著优于基线。

04:00
arXiv cs.LG

通过经验贝叶斯方法增强差分隐私机制

提出经验贝叶斯去噪法改进高斯机制,降低均方误差,在直方图、PCA、线性回归中优于现有算法。

04:00
arXiv cs.LG

SLeDGe:基于图结构学习的数据流半监督学习

SLeDGe联合学习预测模型与自适应图结构,在数据流中高效传播标签,0.1%标签下平均准确率提升31.7%。

04:00
arXiv cs.LG

Chem2Gen-Bench:扰动响应空间中化学-遗传转换的基准测试

提出Chem2Gen-Bench基准,评估化学与遗传扰动的对应关系,发现转换保真度可测量但异质,背景调整影响检索。

04:00
arXiv cs.LG

准确性与梯度余弦所忽略的:通过尺度稳定性、参考有效性和深度效用评估反馈对齐

标准准确率与余弦评估存在两种无声失败,新诊断协议(三检查+逐层余弦)可有效识别,防止无效信用分配。

04:00
arXiv cs.LG

基于价值拼接的自适应视野离线策略学习

VAST通过递归自适应价值组合与动态视野选择,提升长程复杂任务离线策略学习性能。

04:00
arXiv cs.LG

死方向签名:一种廉价的奇异复杂性谱解读

DDS用谱代数代替SGLD,廉价读取网络秩亏,追踪死方向,灵敏度远超LLC。

04:00
arXiv cs.LG

逆向贝尔曼方程:从 Q 值到世界模型

提出P-learning方法,证明基于价值函数可逆推出世界模型,实现隐式编码。

04:00
arXiv cs.LG

DCD-PFN:一种解耦感知的因果发现基础模型

提出DCD-PFN解耦感知基础模型,预训练学习解耦权重,并行重建全局因果图,实现鲁棒零样本泛化。

04:00
arXiv cs.LG

TF-SNO: 时频门控谱神经算子用于学习非平稳偏微分方程

提出TF-SNO,利用状态自适应时频门控隐式学习时变,显著提升非平稳偏微分方程长期预测精度与稳定性。

04:00
arXiv cs.LG

Sakana Fugu 技术报告

Sakana Fugu模型通过动态设计智能体框架整合多个LLM专长,在多项基准测试中达到最先进性能。

04:00
arXiv cs.LG

用于绕线转子同步电机性能预测的机器学习与深度学习模型比较评估

比较8种ML/DL模型预测WRSM性能,FT-Transformer最优,R²=0.9928,速度远超FEA。

04:00
arXiv cs.LG

重建随机掩蔽光谱助力深度神经网络识别判别波数

TeaNet通过重建随机掩蔽光谱增强数据,端到端训练,提升判别波数识别能力,优于CNN,适用于少样本学习。

04:00
arXiv cs.LG

RoPE是否阻止或削弱检索头?跨模型家族的机制分析

RoPE频率而非θ值影响检索头功能,高频抑制回忆效果呈剂量依赖性,五种模型验证一致。

04:00
arXiv cs.LG

OpenPangu模型在昇腾NPU上的量化实证研究

实证OpenPangu在昇腾NPU量化:8bit无损,4bit仅7B可行,极低精度失效。

04:00
arXiv cs.LG

无梯度热启动库恢复:摊销遗憾分离

无梯度热启动库恢复在循环流中实现摊销成本分离,识别成本与维度无关,估计成本与维度相关,并证明紧界。

04:00
arXiv cs.LG

通过占用覆盖最大化进行强化学习的无奖励预训练

提出ROVER方法,最大化状态空间覆盖以预训练探索策略,实现稀疏奖励下游任务的快速适应。

04:00
arXiv cs.LG

量子纯态流形上的内蕴流匹配与相位对齐输运

提出内蕴流匹配(IFM),在复射影空间上利用Pancharatnam相位对齐路径学习切向速度场,实现确定性输运,改善高维与相干敏感任务。

04:00
arXiv cs.LG

拓扑神经动力学:一种神经元级序列建模框架

提出拓扑神经动力学,通过神经元级动态和图拓扑交互,大幅提升序列建模性能。

04:00
arXiv cs.LG

NASDAQ:归一化观测空间动力学增强Q学习

提出在线强化学习归一化方法,平衡低维观测损失梯度,实现归一化观测空间动力学增强Q学习,性能优异且训练时间显著减少。

04:00
arXiv cs.LG

城市电网拓扑与层级结构的开放数据识别方法

提出基于开放数据的城市电网拓扑识别框架,融合多源数据,实现从高压到建筑终端的完整重构。

04:00
arXiv cs.LG

MedTS-TTT:面向医学时间序列分类的测试时训练方法

提出MedTS-TTT框架,实现单步快速自适应,在EEG/ECG分类上取得11/12的top-1结果。

04:00
arXiv cs.LG

任务区分的原子技能扩展与路由:面向高度异构任务的持续学习

针对高度异构持续学习,TASER框架动态扩展原子技能并正交路由,提升可塑性减少遗忘。

04:00
arXiv cs.LG

DataClaw0: 从原始流中智能裁剪多模态数据

提出智能数据精炼范式,训练模型主动结构化原始多模态数据,提升下游任务高效适应能力。

04:00
arXiv cs.LG

目标-行为对齐:多目标强化学习策略选择的诊断方法

提出诊断方法自动揭示多目标强化学习策略中目标值未体现的行为变化,提供量化与可视化工具,经验证有效。

04:00
arXiv cs.LG

具有非负电阻曲率的拉马努金图重连

利用拉马努金图重连缓解GNN过挤压,保证非负电阻曲率,提升信息流动,实验优于九种方法。

04:00
arXiv cs.LG

时间行为树的奖励-佩特里网解释

将时间行为树转换为奖励-佩特里网,自动分配奖励,提升强化学习在复杂分层时序任务中的样本效率与灵活性。

04:00
arXiv cs.LG

区分不可区分的吸引子:基于储层计算的无监督异常检测

用储层计算机输出权重的KS检验实现无监督异常检测:区分不可区分吸引子,检测微弱参数漂移噪声,识别临床心室扑动。

04:00
arXiv cs.LG

通用编码器用于模块化关系深度学习

提出模块化关系深度学习,解耦行编码与图传递;通用行编码器整合元数据,实现跨数据库迁移,提升收敛与内存效率。

04:00
arXiv cs.LG

无妥协的无监督解缠:函数正交性如何保证可识别性

函数正交性约束实现无监督解缠可识别性,无需统计独立假设,实验验证理论。

04:00
arXiv cs.LG

SOHET:基于自监督预训练的异质事件序列Transformer

提出SOHET架构,自监督预训练在欺诈检测任务上优于现有模型5.8%,EBES基准中6/8任务达最优。

04:00
arXiv cs.LG

使用多头注意力Transformer和在线学习的预测性维修管理

基于多头注意力与在线学习预测维修时间,整合特征、加权损失,准确率达78%。

04:00
arXiv cs.LG

通过受TRIZ启发的文本到CAD框架提升3D生成式设计的创造力

提出TRIZ启发的文本到CAD框架,利用LLM生成创新CAD变体,案例显示减重4%-15%且结构完整。

04:00
arXiv cs.LG

VLA-FAIL:面向微调视觉-语言-动作模型的高效任务失败检测

VLA-FAIL结合LLMD和ACC,无需失败数据,高效检测任务失败。

04:00
arXiv cs.LG

原子语言模型理解并生成材料

原子语言模型(ALM)通过多模态统一,实现从自然语言生成和优化晶体结构,性能达最优。

04:00
arXiv cs.LG

一种方法并不适合所有情况:无监督域适应的异构潜在空间对齐

ADualVUOT框架整合VAE、连续归一化流、不平衡最优传输和对抗增强,在医学图像分割中显著提升域适应性能。