11482 条条目 · 106 个活跃源
2026年9月2日
04:00
arXiv cs.LG

DISTAL:用于结构无关材料性能预测的蒸馏与自监督预训练

提出DISTAL框架,结合自监督成分预训练与结构知识蒸馏,实现结构无关材料性能预测,在37/39任务上优于基准。

04:00
arXiv cs.LG

基于证据权重的特征重要性解释对齐性与稳定性评估

以证据权重假设检验评估特征重要性解释,量化对齐性与稳定性,关联归因方差,实证于LIME/SHAP。

04:00
arXiv cs.LG

注意力敏感性不足:微调中区分注意力级与行为级上下文学习

优化注意力敏感度不能保证行为级上下文学习,需行为指标验证;否则出现Goodhart式解耦,性能下降。

04:00
arXiv cs.LG

含簇结构向量的随机复杂度

提出归一化最大似然模型常数递推公式,使含簇结构向量的最短码长计算由多项式降至线性时间。

04:00
arXiv cs.LG

RW-LoRA:基于随机游走的通信高效去中心化LoRA微调

提出随机游走低秩适配微调法,单模型令牌顺序遍历网络更新,免全局同步与聚合误差,降通信计算开销,收敛且性能相当。

04:00
arXiv cs.LG

电力价格预测与电池套利的基础模型:能否取代市场专用预测模型?

基础模型零样本预测难全面超越专用模型,仅TabPFN统计占优,经济收益视风险而定。

04:00
arXiv cs.LG

基于AOC-偏序集的关系概念分析中的收敛性问题

关系概念分析在AOC-偏序集上不保证收敛,本文分析原因,给出保障条件及数据变换方法,并提出保留结构的收敛变体。

04:00
arXiv cs.LG

复杂域中PDE的几何感知潜自回归生成模型

提出几何感知潜自回归模型:图双编码器捕捉复杂几何,流匹配潜空间自回归预测PDE,全程低误差稳定。

04:00
arXiv cs.LG

不平衡时间序列分类的局部参考几何残差增强

提出局部参考几何残差增强法,诊断并修复不平衡分类中局部几何失效,提升时间序列分类性能。

04:00
arXiv cs.LG

Safin-1:通过记忆原生状态演化实现内在安全

提出记忆路由状态演化,使安全成为模型内在原生能力,免外部护栏与微调,经测试时适配提升安全及长程任务表现。

04:00
arXiv cs.LG

比闪电更快:利用注意力稀疏性实现高效长上下文解码

提出Faster Flash Decoding框架,融合选择与计算、低比特量化及top-delta稀疏策略,免训练即插即用,实现11.6倍内核加速与2.37倍端到端吞吐提升,支持256K上下文。

04:00
arXiv cs.LG

生成式人工智能用于可靠的腐蚀机理推理

提出领域自适应RAG框架,微调三模型并混合检索,提升镁合金腐蚀知识合成可靠性,引入Reason Map检测因果推理缺陷。

04:00
arXiv cs.LG

好记忆应具备 ECC:超越准确率评估视觉语言模型的记忆能力

提出ECC基准,从效率、压缩、校准三轴评估视觉语言模型记忆:能压缩文本而非视频,校准不佳;非Transformer架构权衡更优。

04:00
arXiv cs.LG

基于精英加权的监督微调用于目标导向分子优化

提出EW-SFT方法,用奖励挑选高评分分子并以原生损失微调,统一适用于多种分子生成器,提升目标导向优化性能。

04:00
arXiv cs.LG

天生有缺,进化完美

AI模型因环境漂移而性能下降。研究发现,对模型系数施加故意突变可提升动态环境表现,以个体性能换群体收益,经定理证明和实验验证有效。

04:00
arXiv cs.LG

WHALE:联合优化执行代码与权重的简单方法

提出WHALE交替法,交替更新模型权重与搜索最优执行代码,避免单侧瓶颈,显著超越仅权重或仅代码等基线。

04:00
arXiv cs.LG

QTEA:基于稀疏残差显著权重和逐列优化的三值大语言模型

亚2比特量化法,三值权重+稀疏残差显著权重,逐列优化,达1.7比特/权重,精度高、速度快。

04:00
arXiv cs.LG

HBQ:面向高效大模型推理的硬件感知分层缩放块量化

提出HBQ分层块量化,用大块加有效缩放补偿精度,W4A5达W4A16精度,硬件更省,能效与速度优于现有方法。

04:00
arXiv cs.LG

反事实脆弱性证书:揭示结构化证据失效下的高置信脆弱性

提出CFC证书,用证据失效轨迹审计暴露高置信脆弱预测,AUROC达0.915,20%预算下捕获88.9%。

04:00
arXiv cs.LG

大语言模型了解你的社区吗?——社区级出行预测与结构对齐中的先验审计

社区级出行预测中,大语言模型零样本准确率不及监督模型,且其先验存在偏差,需审计对齐后方可采用。

04:00
arXiv cs.LG

无需梯度的自适应:仿射统计迁移及其证书能揭示什么

提出无梯度仿射统计迁移方法,适配冻结模型;以残差-间隔证书门控,避免有害迁移,平均负效果转为正向增益。

04:00
arXiv cs.LG

多分支特征融合的健康错误信息检测与传播方法

提出融合心理学与修辞线索的多分支框架,结合认知理论检测健康虚假信息并评估传播风险,多数据集上表现优异。

04:00
arXiv cs.LG

时间相关性如何塑造线性递归神经网络的记忆

在线性递归网络中,输入时间相关性给记忆附加代价,重塑学习轨迹,使最终记忆减少,并在特定阈值关闭记忆。

04:00
arXiv cs.LG

分组自适应裁剪策略优化

提出分组自适应裁剪优化,按优势调整裁剪边界,增强低成功率样本信号,提升数学与代码推理性能。

04:00
arXiv cs.LG

算子学习的神经均值与核修正

用神经均值加马特恩核修正残差与特征,在结构力学和OCO-2基准上达到/超越最佳基线,并给出机理证明。

04:00
arXiv cs.LG

CRAD:面向去中心化异构联邦学习的类别级可靠性感知蒸馏

去中心化异构联邦学习,按类别过滤不一致教师、按可靠性加权蒸馏,性能优于现有方法。

04:00
arXiv cs.LG

跨GPU内核的确定性大语言模型推理:2的幂INT8量化尺度与基于容差的一致性测试的局限

容差测试测不出量化矩阵乘尾端故障;二的幂尺度使内核逐位一致且词元相同;困惑度暴涨实为权重尺度失配。

04:00
arXiv cs.LG

高频降水临近预报生成算子网络

新架构GenONet结合算子学习与对抗训练,生成清晰且物理一致的3小时降水预报,在高强度事件和长时效上表现更优。

04:00
arXiv cs.LG

关系型基础模型中的上下文窗口失效

关系模型遇高基数数据截断行,预测收入时R²仅0.18;简单时间预聚合即升至0.65,质疑其实战能力。

04:00
arXiv cs.LG

深度学习中的高阶结构

介绍高阶张量运算对深度学习的重要性,实证研究高阶现象,提出多层感知器超图推广,探讨与进化算法联系,展望未来。

04:00
arXiv cs.LG

AdaptNTK:面向神经网络势的自适应不确定性量化与主动学习

AdaptNTK以NTK空间正则化马氏距离量化不确定性,递归更新免重训,主动学习媲美集成且高效。

04:00
arXiv cs.LG

一种用于学习路径规划的量子-经典混合神经网络

混合量子-经典网络学习路由:小型量子网络替换编码器前馈模块,参数减少,中小规模接近经典,无量子优势,仅压缩策略。

04:00
arXiv cs.LG

大语言模型能否使用关系Transformer嵌入?

将关系Transformer嵌入注入大语言模型的混合模型,并未胜过单独模型,且常低于随机、不稳定,需更强对齐与模式感知。

04:00
arXiv cs.LG

为何多层消息传递有效:图神经网络原子间势的完备性理论

证明稀疏截断图上的多层消息传递等价于全L跳邻域,故三体超图网络可普遍逼近势能面。

04:00
arXiv cs.LG

DeSyR:一种PINN引导结构搜索与物理信息系数精化的解耦符号恢复框架

DeSyR解耦符号恢复框架,用PINN搜索拓扑,仅依据物理方程精化系数,避免教师误差,15个问题中误差达1e-14以下。

04:00
arXiv cs.LG

通过功能感知掩码学习任务特异性的抗体表示

用功能先验指导掩码位置,专项提升结构与互补决定区任务,混合策略平衡多目标,无需参数注入归纳偏置。

04:00
arXiv cs.LG

VATO:用于翼型非定常分离流动的涡力感知Transformer算子

提出涡力感知Transformer算子VATO,融合涡力映射与几何感知神经算子,显著提升翼型非定常分离流场预测,涡量误差降低31.2%。

04:00
arXiv cs.LG

流形感知的通用编码计算:面向掉队者弹性分布式计算

现有编码计算忽视数据内在结构,本文利用数据自然流形设计编码,提出流形感知通用编码,显著降低掉队场景下的恢复误差。

04:00
arXiv cs.LG

HarmoCore:振荡波场稀疏重建的函数潜空间扩散

提出HarmoCore函数潜扩散方法,在核空间采样后验,高效重建复值振荡波场,低传感率下显著提升性能且可扩展至三维。

04:00
arXiv cs.LG

EEG-VID:面向脑电解码与辅助目标选择的任务引导潜在预测预训练

任务引导潜在预测预训练框架用于脑电解码,跨会话/被试精度大幅提升,辅助目标选择准确率超随机。

04:00
arXiv cs.LG

拓扑引导

提出拓扑引导框架,利用激活空间的拓扑表示(持续图)实现更稳健的大模型行为控制,跨多种模型有效。

04:00
arXiv cs.LG

坦白你所知:大语言模型遗忘学习中的遗忘集与模型知识错位

大模型遗忘错位造成泄漏或损伤;提出用模型自述知识构建对齐遗忘集,平衡遗忘与效用。

04:00
arXiv cs.LG

GeoPAR:面向大规模多智能体组合优化的几何引导并行自回归学习

几何引导并行自回归,用投影稀疏几何和缓存冲突感知,提升大规模多智能体优化的零样本泛化及推理效率。

04:00
arXiv cs.LG

打破结构同一性:秩异构下的个性化联邦LoRA微调

针对秩异构联邦,提出新方法,以奇异值分解解耦共享方向与个性化权重,实现细粒度微调,性能更优。

04:00
arXiv cs.LG

EEG-AS:基于行为重建的脑电基础模型实例级选择

提出EEG-AS实例级选择框架,重建模型行为以选择最优脑电基础模型,显著缩小与理想上界的差距。

04:00
arXiv cs.LG

DK-GBMKKM:动态核空间粒球多核k均值聚类

提出动态核空间粒球多核k均值聚类,通过交替优化核权与隶属度生成融合核空间粒球,构建尺寸加权粒球核,性能优异。

04:00
arXiv cs.LG

CRAFT:面向AI原生6G无线接入网的事前可解释性微调

CRAFT用带推理链的验证三元组微调小模型,破解冷启动,F1达94.6%,能耗比GRPO低59%。

04:00
arXiv cs.LG

预测编码网络中隐藏状态优化顺序的研究

研究发现边界优先分块推断可显著提升预测编码网络的精度与特征学习。

04:00
arXiv cs.LG

MUGEN:为多学习任务生成不可学习图示例的框架

首个多任务统一生成不可学习图示例的框架,通过TASO与TAP保护节点分类、图分类和链接预测,且跨骨干网络可迁移。

04:00
arXiv cs.LG

参考集重采样下OOD评分的判定不稳定性

提出判定不稳定性,度量参考集重采样引发的OOD分数波动,闭式解为类内离散度除以参考数平方根;错误符号弃权比随机更差。