11852 条条目 · 106 个活跃源
2026年7月7日
04:00
arXiv cs.LG

基于同质-异质拆分的合成图像生成后策展

提出无需再训练的生成后选图方法,通过保真度-多样性标准筛除冗余同质样本,用少40%数据达到真实数据性能。

04:00
arXiv cs.LG

LiNO:基于提升的多分辨率神经算子

提出基于提升变换的多分辨率神经算子LiNO,实现自适应、可逆的多尺度学习,在多个物理基准中表现优越。

04:00
arXiv cs.LG

电动汽车赛车动力总成中实验室到赛道热传递的加权共形预测

共形预测在真实偏移下覆盖率从95%降至70%,加权后仅提升至72.42%,问题仍未完全解决。

04:00
arXiv cs.LG

通过误设定降低的非平稳线性老虎机动态遗憾

提出统一误设定降低视角,重启动算法,实现非平稳线性老虎机最优动态遗憾界。

04:00
arXiv cs.LG

基于拉格朗日奖励增强的安全推理时对齐

提出LARA框架,将安全约束优化简化为一维凸问题,提升推理时对齐的有用性-无害性权衡。

04:00
arXiv cs.LG

归纳头插值N-gram

归纳头通过软上下文匹配和伪计数平滑实现N-gram插值,学习正则化上下文估计。

04:00
arXiv cs.LG

无标签数据的元学习:利用预训练模型和未标注数据的高效任务生成

提出无标签元学习新方法,利用预训练模型和未标注数据生成任务,加权机制提升少样本分类精度8.4%-36.4%,速度提升104倍。

04:00
arXiv cs.LG

训练具有部分双向性的混合块扩散语言模型

提出部分双向混合块扩散模型,限制反向扫描至去噪块实现精确缓存,长文本吞吐量提升19.7倍。

04:00
arXiv cs.LG

更少令牌,更优预测:面向高效天气预报的稀疏残差路由

提出Sparse-Reslim,仅路由25%令牌通过残差更新,提升精度,训练加速2.5倍,内存降低2.2倍。

04:00
arXiv cs.LG

离散扩散在线自适应分子优化的设计空间

离散扩散在线自适应中,采集、奖励塑形、去偏、重放与有效性控制互补,优于离线微调与推理搜索。

04:00
arXiv cs.LG

交易信心:算法交易中的全面不确定性估计

提出整合多种不确定性估计的强化学习框架,在美股指数交易中优于传统模型,提升收益与风险管理。

04:00
arXiv cs.LG

动态知识图谱中关系间依赖的泊松-伽马建模

提出PGRE模型,利用泊松-伽马公式与潜变量捕捉动态知识图谱的关系依赖与时间演化,在稀疏链接预测中表现优异。

04:00
arXiv cs.LG

RLVR中的奖励粒度:小语言模型数学推理中过程与结果奖励结构比较

过程奖励在小模型数学推理中优于结果奖励,准确率提升近10%,混合奖励存在信号冲突,奖励粒度是关键设计决策。

04:00
arXiv cs.LG

高维Ising模型中的迁移学习

提出Trans-Ising迁移学习方法,通过源筛选和两阶段估计避免负迁移,理论保证误差界和一致性,实验误差更低。

04:00
arXiv cs.LG

CoFEND:一种面向冷启动药物相互作用预测的跨模态融合端到端网络

提出跨模态融合端到端网络,利用多模态信息与两阶段可解释性,显著提升冷启动药物相互作用预测精度与机理可解释性。

04:00
arXiv cs.LG

跨度内学习:利用模型自身预测自适应调整降阶模型

发现利用模型自身预测,通过增量SVD与遗忘机制重新加权基,提升降阶模型吸收外部修正能力,验证于多种动力学。

04:00
arXiv cs.LG

引导流映射树采样实现在线反馈驱动搜索

BFMT框架通过单次函数评估构建完整树路径,动态分配采样预算,实现从全局探索到局部优化的平滑过渡,显著优于基线方法。

04:00
arXiv cs.LG

权重稀疏Transformer中的个体参数似乎可解释

稀疏Transformer中12%-31%的权重可被单一描述解释,且可解释性高于密集模型。

04:00
arXiv cs.LG

可变位宽量化:为“更大但更小”的语言模型学习每组精度

VBQ让每组64权重学习自身位宽,69%组仅需1位,实现更大但更小模型,质量每字节比FP16高效3.9-8.4倍。

04:00
arXiv cs.LG

先例引导的副作用感知药物重新设计协同科学家系统

通过知识图谱与LLM协调,在人类监督下修改药物以减轻副作用并保持疗效的AI工作流。

04:00
arXiv cs.LG

稀疏分布式存储的秩序N选M编码:区分当代神经形态架构中噪声鲁棒性的表示与学习效应

秩序N-of-M编码提升SDM鲁棒性,主要源自与MAX-Hebbian学习的交互,编码自身增益有限。

04:00
arXiv cs.LG

缺失即信号:面向临床时间序列预测的通道独立频谱图学习

CISM框架将缺失视为信号,用通道独立频谱图预测临床时间序列,在MIMIC-IV上取得最优性能,表明观察模式是重要预测信号。

04:00
arXiv cs.LG

MABLE:面向嵌入和图度量学习的带双Lipschitz解码的掩码自编码

MABLE自监督框架,通过掩码重建与余弦相似度对齐,双Lipschitz解码学习节点和图嵌入,在矿产勘探中生成互补信号,无需判别器或硬负样本。

04:00
arXiv cs.LG

心电图基础模型对罕见心脏病的迁移能力:来自Brugada综合征检测的证据

基础模型预训练仅提供优化稳定性,未带来可迁移的临床知识,效果未显著优于监督基线。

04:00
arXiv cs.LG

回归基础:通过SMILES-图翻译提升大型语言模型的分子理解

提出MolBasic框架,通过SMILES-图双向转换增强结构理解,使用渐进学习与思维链,显著提升分子推理与下游任务性能。

04:00
arXiv cs.LG

STELLA:面向设备端人类活动识别的高效传感器到LLM转换

STELLA用轻量级分词器压缩传感器token,使冻结LLM实现设备端HAR,达新SOTA且支持实时个性化与隐私保护。

04:00
arXiv cs.LG

模型合并能否改进DiLoCo中的聚合

利用模型合并改进分布式训练聚合,Iso-C与IsoLoCo显著提升DiLoCo性能。

04:00
arXiv cs.LG

动态伊辛模型中的分布外神经推理

神经网络在伊辛模型中分布外性能被架构先验主导,而非真正物理规则学习。

04:00
arXiv cs.LG

OmniFocus:面向全模态大语言模型的查询引导模态平衡令牌压缩

OmniFocus无需训练,以查询引导、模态平衡方式压缩音视频令牌,低保留率下保持强性能并加速推理。

04:00
arXiv cs.LG

LACE-SVD:面向大语言模型压缩的损失感知奇异值分解与累积误差修正

提出LACE-SVD,通过损失感知秩分配与累积误差修正,显著提升LLM压缩性能,如LLaMA-7B在0.6压缩比下PPL从46.18降至32.57。

04:00
arXiv cs.LG

SHiPPO:带有传输多项式投影的循环记忆

SHiPPO将HiPPO系数记忆传输至移动通道框架,引入右作用传输,恢复已写记忆的顺序敏感信号。

04:00
arXiv cs.LG

用于探索、纯化和模型融合的谱重连

SAR通过保留谱核心、移除正交分量,以约0.58%参数维持99%后训练性能,提升推理与跨域融合。

04:00
arXiv cs.LG

鲁棒性与不确定性:用于鲁棒选择性分类的证据对抗训练

提出EV-AT方法,利用证据损失与对齐损失,改善对抗训练中鲁棒性与不确定性排序的权衡。

04:00
arXiv cs.LG

基于角色感知聚类的异构图压缩

提出HGC-RC框架,利用角色感知聚类高效压缩异构图,加速训练并保持性能。

04:00
arXiv cs.LG

时间网络上的去中心化联邦学习:异质性的作用

去中心化联邦学习受时间和结构异质性显著减慢收敛,类似惰性随机游走,忽略异质性会高估速度。

04:00
arXiv cs.LG

堆叠式LoRA用于运动想象解码中的受试者自适应脑电图基础模型

提出堆叠式LoRA框架,结合全局与受试者特定适配器,有效缓解脑电图个体差异,提升运动想象解码准确率。

04:00
arXiv cs.LG

物理信息神经网络在单自由度直升机系统安全强化学习中的集成

将可微物理模型嵌入PPO损失函数,模拟未来轨迹惩罚违规,在直升机测试中减少约束违反并保持跟踪。

04:00
arXiv cs.LG

ACPO:基于细粒度代理熵的自适应信用策略优化

ACPO通过细粒度代理熵实现token级信用分配,非对称调节策略更新,提升LLM推理与代码生成性能。

04:00
arXiv cs.LG

预期强化学习用于轨迹跟踪

预期RL通过目标速度与未来视野降低跟踪误差,但物理迁移显示简单前瞻即可达到最佳性能。

04:00
arXiv cs.LG

依赖可观测量与位置编码的神经网络权重对称性读出

权重级对称性读出依赖于位置编码和可观测量,而非真实对称群。

04:00
arXiv cs.LG

CuBAS:基于信息几何曲率的监督分类自适应采样方法

CuBAS利用Potts模型计算数据流形曲率,从高低曲率区选样,构建紧凑高效训练集,优于随机和不确定基线。

04:00
arXiv cs.LG

面向能量感知强化学习的样本高效帕累托前沿建模——基于贝叶斯优化

采用多目标贝叶斯优化自动选择奖励权重,样本高效发现帕累托前沿,在能量感知控制中优于均匀网格搜索。

04:00
arXiv cs.LG

重新审视神经非线性:门控机制

激活函数本质上可由输入条件阈值门控替代,所有标准激活均为其实例,软max亦可转换,且能提升压缩与性能并统一硬件实现。

04:00
arXiv cs.LG

降阶模型:世界模型之母

世界模型的功能结构源于几十年前的模型降阶与控制理论,其核心挑战不是预测精度而是可验证性。

04:00
arXiv cs.LG

地球系统基础模型的协调数据集

WorldTensor协调全球环境与社会经济数据,支持地球系统基础模型训练。

04:00
arXiv cs.LG

评估生成式人口综合中场景兼容性的贝叶斯框架

提出集成贝叶斯更新框架量化场景兼容性,用有效样本量评估结构不确定性压缩。

04:00
arXiv cs.LG

通过逆强化学习理解电力消费行为

逆强化学习揭示电力消费行为异质性,政策需关注消费时间及冲击响应持续性。

04:00
arXiv cs.LG

中文标题:分布式机器学习模型中上游径流的联合分布决定了下游河流流量预测的不确定性

中文摘要:分布式概率水文预测需联合采样上游径流,独立采样会低估不确定性,分位数匹配可恢复离散度。

04:00
arXiv cs.LG

OpFlow:学习机会条件选择潜力以实现鲁棒的OD流预测

OpFlow通过分离需求与分配,学习可转移的选择机制,提升分布偏移下OD流预测的鲁棒性。

04:00
arXiv cs.LG

面向含噪偏好的大语言模型无偏对齐

提出无偏奖励模型和无偏直接偏好优化,理论证明噪声容忍,实验优于基线。