11852 条条目 · 106 个活跃源
2026年7月10日
04:00
arXiv cs.LG

Write-Protected Discrete Bottlenecks for Language-Grounded World Models: A Structural Limitation and Sufficient Fix

04:00
arXiv cs.LG

ArtMine:发现并形式化艺术创作过程

ArtMine从异构历史证据中推理艺术创作步骤,生成优化结构图,实现可解释的艺术过程建模。

04:00
arXiv cs.LG

车联网中基于强化学习与人类反馈的自适应异常检测

提出强化学习与人工回训结合的在线异常检测框架,在车联网测试中F1达0.69,更新后恢复至0.65,避免灾难性遗忘。

04:00
arXiv cs.LG

AutoAnchor:基于交叉注意力流形替换的稳定扩散遗忘

AutoAnchor用交叉注意力自动合成流形邻近锚点,实现稳定无偏的扩散模型遗忘,显著提升概念移除与效用。

04:00
arXiv cs.LG

对决Q学习的谱分析

本文通过谱分析揭示对决Q学习中价值与优势更新的不同增益机制,并建立未正则化情况的收敛保证。

04:00
arXiv cs.LG

认证干预保真度:机制可解释性中因果主张的随时有效、自适应评估

CIF为机制可解释性提供随时有效的置信序列,自适应评估保真度,降低认证成本10-30倍。

04:00
arXiv cs.LG

Eigenvalue Calibration for Semantic Embeddings of Large Language Models

04:00
arXiv cs.LG

大步长梯度下降在平坦最小值流形附近的动力学

本文推广大步长梯度下降理论至向量输出和平坦最小值流形,并应用于深度矩阵分解,得到新结构结果。

04:00
arXiv cs.LG

超越反向传播:蒙特卡洛方法可训练深度神经网络

蒙特卡洛随机突变法实现无梯度训练深度网络,无需正则化技巧,适用离散权重等多场景。

04:00
arXiv cs.LG

频域多模态交通建模

提出频域多模态建模FreMo,通过频谱过滤与频率引导协同集成,实现自适应跨模态融合,预测性能领先。

04:00
arXiv cs.LG

MatBind:用于多模态材料表征的共享嵌入空间

提出MatBind对比学习框架,将晶体结构等四种材料模态对齐至统一嵌入空间,实现零样本跨模态检索。

04:00
arXiv cs.LG

中文标题:基于偏依赖的可解释约束引导神经网络训练

中文摘要:提出基于偏依赖的可解释约束引导训练,使模型响应符合领域知识,提升性能与数据效率,且解释一致。

04:00
arXiv cs.LG

停止猜测何时停止测试:用恰到好处的数据进行高效模型评估

提出自适应评估框架,用序列测试平衡效率与可靠性,如在模型评估中减少80%计算成本。

04:00
arXiv cs.LG

跨异构架构的学习率调度策略的系统性评估

系统性评估30种架构25种调度,发现调度选择依赖架构,CosineAnnealingWarmRestarts和CyclicLR优于基本衰减,最佳准确率86.45%。

04:00
arXiv cs.LG

CAAD:基于多尺度对齐和结构因果一致性的因果感知多变量时间序列异常检测

CAAD通过格兰杰因果一致性验证,利用多尺度对齐和梯度矩阵监控因果断裂,实现高精度异常检测。

04:00
arXiv cs.LG

反变理论:困难任务最小解中的强对齐

困难任务最小解中弱对齐保证强对齐,沿层级传播形成特权轴,趋同进化不可避免。

04:00
arXiv cs.LG

基于伪逆的极限学习机的谱稳定性

研究揭示伪逆ELM稳定性由隐层矩阵奇异值结构决定,SVD法比迭代法更可靠。

04:00
arXiv cs.LG

对抗不确定性下的稳健贝叶斯决策

提出对抗稳健贝叶斯实验设计,以决策稳定性为目标,实验证明更可靠。

04:00
arXiv cs.LG

面向隐私保护的心血管疾病风险预测的联邦深度学习

联邦深度学习在异构队列间提升心血管疾病风险预测性能,保护患者数据隐私。

04:00
arXiv cs.LG

大语言模型中的超级权重与选择性训练的失败

研究发现超级权重并非普遍重要,单独训练其导致随机猜测,而基于层的低秩分解(如LoRA)更有效。

04:00
arXiv cs.LG

多模态、多环境机器教学实现鲁棒奖励学习

提出跨多环境多模态机器教学算法,选择信息丰富环境并低成本查询,显著提升奖励函数鲁棒性与泛化能力。

04:00
arXiv cs.LG

BiSCo-LLM:面向极端低位大语言模型压缩的无查找二进制球面编码

提出无码本二进制球面编码框架,通过球面二值化、残差编码和蒸馏实现极端低位LLM压缩。

04:00
arXiv cs.LG

无训练松弛推测解码的实用研究

实用研究统一框架与基准测试,发现松弛需能力评估且依赖好语言模型草稿器,不适用轻量专用草稿器。

04:00
arXiv cs.LG

通过Gossip和虚拟投票的安全去中心化联邦学习

提出gspDAG-FL,利用Gossip共识与虚拟投票实现安全去中心化联邦学习,抵抗拜占庭攻击,减少协调瓶颈。

04:00
arXiv cs.LG

重采样还是重路由?大语言模型的预算感知测试时模型选择

提出预算感知测试时模型选择,在重采样与重路由间分配预算以最大化正确率。RoR策略在异构基准上取得最优成本-质量帕累托前沿。

04:00
arXiv cs.LG

Deep Learning for Joint Narrowband Interference Cancellation and Soft Demodulation in OFDM Systems

04:00
arXiv cs.LG

EdgeRefine:基于Jaccard采样的边差分隐私图隐私与效用平衡方法

EdgeRefine通过Jaccard相似度与隐私预算自适应边采样,在强隐私下保持高精度,有效防御图重构攻击。

04:00
arXiv cs.LG

潜在记忆宫殿:作为自回归变分推断的控制推理

提出潜在记忆宫殿法,将控制推理视为自回归变分推断,优化潜空间策略,实现自适应推理并提升下游性能。

04:00
arXiv cs.LG

MPFlow:基于深度图强化学习的闪电网络预算最大流优化

提出MPFlow,用深度图强化学习求解闪电网络预算最大流,部署后执行4640次通道开放,分配267.3 BTC。

04:00
arXiv cs.LG

面向主动型企业智能体的上下文图

提出上下文图实现主动智能体,实时监测状态变化并评分推送,将响应时间从47分钟降至30秒以内。

04:00
arXiv cs.LG

随机观测下的统计逆学习问题

综述随机观测下统计逆问题的正则化方法及收敛率,并应用于药物浓度预测。

04:00
arXiv cs.LG

降维遇见网络科学:基于UMAP的k近邻图的数据理解

UMAP内部kNN图可被图算法挖掘,增强高维数据理解,效果媲美专用方法。

04:00
arXiv cs.LG

一种用于少量标注水声数据探索的自监督方法

自监督方法通过MAE预训练和聚类,用少量标注高效探索水声数据,发现已知和未知模式。

04:00
arXiv cs.LG

正则化参数:稀疏精度矩阵估计

提出闭式矩阵正则化参数,避免交叉验证,实现高维数据估计的精度与速度兼得。

04:00
arXiv cs.LG

SLORR:简单高效的训练中低秩正则化

SLORR基于Hoyer度量和核范数,在训练中无状态正则化,高效诱导模型压缩且开销低。

04:00
arXiv cs.LG

直通式承保中的自主人工智能与检索增强模型

提出多智能体RAG框架用于直通式承保,较单LLM和简单RAG更优,尤其擅长多步和缺失信息场景。

04:00
arXiv cs.LG

GradInf:梯度估计作为概率推断

将梯度估计转化为概率推断问题,通过耦合与分解及类型系统,GradInf实现高效自动化梯度估计并超越现有方法。

04:00
arXiv cs.LG

偏移与漂移:面向泛化性和鲁棒性的自动驾驶运动规划零样本基准

提出双轨基准测试,发现模仿学习在语义偏移下易失败,强化学习更鲁棒。

04:00
arXiv cs.LG

基于正半定核密度估计的分布保真插补

从缺失观测中估计分布,实现单次和多次插补,具有统计一致性,性能优于常见基线。

04:00
arXiv cs.LG

基于相位nSCR特征的单元无关低速率腕部GSR处理用于压力检测

提出低速率腕部GSR处理流程,提取相位nSCR/min特征,在TSST任务中实现0.82-0.87平衡准确率,证明可穿戴压力检测可行。

04:00
arXiv cs.LG

CTA-流水线:一种面向延迟的多GPU系统空间扩展方法

提出CTA流水线,利用共享内存多GPU系统实现CTA级并发,MLP操作延迟降低31.8%,可与TP结合进一步优化。

04:00
arXiv cs.LG

基于任务向量的功能安全代码生成

提出SecVecCoder,利用任务向量同时提升代码功能与安全性,无需后处理,显著提高可靠代码生成率。

04:00
arXiv cs.LG

反馈操纵正则化:实现离线智能体对齐的模仿学习

提出FMR,利用评估反馈纠正模仿学习对齐,在Safety Gymnasium上失调减少98%,数据稀缺仍鲁棒。

04:00
arXiv cs.LG

人格图谱:在权重空间中描绘语言模型人格特质

将人格视为行为特质空间位置,通过低秩适配器实现单调可加调控,影响安全行为,提供可控映射方法。

04:00
arXiv cs.LG

DeepSWE:在原创、长周期工程任务上评估前沿编码智能体

DeepSWE基准含113个原创长周期任务,避免模型记忆和测试偏差,手写验证器评估更准确、区分度更高。

04:00
arXiv cs.LG

扩散策略学习中的表达性与统计权衡

扩散策略表达性受漂移Lipschitz预算K支配,K增大提高近似但增加统计复杂度,样本依赖权衡指导K与网络架构选择。

04:00
arXiv cs.LG

谁打破了系统?基于LLM的多智能体系统中的故障定位

提出AgentLocate框架,精准定位故障智能体及最早失误步骤,性能优于现有方法且高效。

04:00
arXiv cs.LG

基于血氧饱和度预测器引导的低质量双波长PPG逐步时频重构方法

提出SpO2预测器引导的逐步时频重构,联合时频损失,提升低质量PPG血氧估计精度。

04:00
arXiv cs.LG

一种用于混沌预测的量子储备池架构及其高维性是否有效的检验

量子储备池混沌预测方案及高维性诊断,规模增长时量子误差稳定优于经典。

04:00
arXiv cs.LG

劝说攻击可能降低链式思考监控的有效性

对抗劝说下链式思考监控反增有害行为批准,模型多样的事实核查可降低批准率达45%。