11852 条条目 · 106 个活跃源
2026年6月25日
04:00
arXiv cs.LG

不确定性感知的化学语言模型强化学习

将不确定性引入强化学习,提升分子设计鲁棒性,真实命中率提高0.25,总命中数近翻倍。

04:00
arXiv cs.LG

低成本高阶奇异值分解用于稀疏传感器测量的张量重构:城市流动与空气质量应用

首次提出lcHOSVD张量框架,仅用1-4%传感器数据重构城市流场,误差低于矩阵方法且抗传感器分布不均。

04:00
arXiv cs.LG

数据内部重复对语言模型的危害

重复数据破坏语言模型,存在最坏重复次数,计算等效损失可达33%。

04:00
arXiv cs.LG

地球嵌入的奥秘:位置编码器的可解释性分析

通过分解位置嵌入,揭示地理INR中可解释的森林、沙漠和城市结构。

04:00
arXiv cs.LG

多流时序融合用于金融欺诈检测

MSFT独立编码多流事件,时间感知位置编码AUROC达0.996,门控融合精度0.989,多流优于单流18点。

04:00
arXiv cs.LG

零阶深度学习法求解未知系数完全非线性抛物型偏微分方程

提出零阶深度学习方法,通过模拟器数据驱动求解未知系数非线性PDE,利用零阶导数估计无模型学习梯度与Hessian,理论分析误差界。

04:00
arXiv cs.LG

地质-地层-RL:从可验证任务中学习地质事件推理

使用可验证奖励强化学习,训练视觉语言模型从地层图推理地质历史,并成功迁移至合成地震数据。

04:00
arXiv cs.LG

被抹除却未消失:输出遗忘并非真正遗忘

当前机器遗忘评估高估成功,输出遗忘掩盖了与重训练不一致的结构性残差。

04:00
arXiv cs.LG

TRACER:用于交通事故重建的无训练闭环结构化推理

无训练框架,通过闭环结构化推理迭代优化运动假设,提高几何与碰撞精度。

04:00
arXiv cs.LG

面向物联网降雨预测的联邦拆分学习中自适应联合压缩与同步

提出联合压缩与同步的FSL框架,降低通信开销87%和54%,精度几乎不变。

04:00
arXiv cs.LG

基于内存高效等变变换器的可扩展肽设计

提出MEET等变变换器,实现线性内存缩放与生成质量提升,支持可扩展肽设计。

04:00
arXiv cs.LG

方向锐度驱动的机器学习模型认证

提出方向性锐度指标,高效可靠指示泛化能力,优于现有指标,支持零知识证明。

04:00
arXiv cs.LG

零温度下的推测解码:基于48,072样本扩展的限域安全不变性筛查

零温度推测解码经TAIS测试,27项中25项等效,最大Cohen's h仅0.024,未发现安全偏差。

04:00
arXiv cs.LG

Emergent Capabilities Arise Randomly from Learning Sparse Attention Patterns

04:00
arXiv cs.LG

神经缩放普适性:若指数固定,当理解系数

神经缩放指数由通用机制固定,系数决定最优模型,理解系数是近期性能提升关键。

04:00
arXiv cs.LG

偏差控制的原对偶自然演员-评论家:约束多目标平均奖励强化学习的最优速率

提出MLMC原对偶自然AC算法,控制偏差,实现约束多目标平均奖励RL全局最优收敛和约束违反率O(1/√T),无需混合时间信息。

04:00
arXiv cs.LG

前沿混合专家模型有多模块化?一项预注册因果测试表明,表面专家模块化大多消失

仅阿拉伯语系列呈干净选择性模块,其余均依赖测量,消融结论不安全。

04:00
arXiv cs.LG

遗忘以改进:预算策管内存下的设备端LLM代理持续学习

提出净价值每字节评分机制,管控设备端代理经验内存,减少资源消耗,消除注入攻击,提升准确率,遗忘即是改进。

04:00
arXiv cs.LG

基于张量t-SVD的有向超图信号处理框架

提出有向超图信号处理框架,利用t-SVD建模高阶不对称关系,去噪性能优于现有方法。

04:00
arXiv cs.LG

ATMA:通过极坐标注意力和门控增量压缩记忆的长度不变语言建模

ATMA结合极坐标注意力和门控增量记忆,实现长度不变语言建模,64K token检索准确率超90%,困惑度单调下降。

04:00
arXiv cs.LG

FDN:基于未来分解网络的可解释时空预测

提出FDN模型,通过分类实现可解释预测,以低内存成本达到SOTA精度。

04:00
arXiv cs.LG

物理信息神经网络中的隐性失效:参数中毒与基于损失验证的局限性

参数中毒使物理信息神经网络低损失却输出错误解,证明低损失不能保证物理准确性。

04:00
arXiv cs.LG

温和崩塌:持续学习的分布度量

提出六种连续度量替代准确率,揭示遗忘内部结构,在CIFAR-100上通过损失加权与趋势采样分别减少1.3%和超过6%遗忘。

04:00
arXiv cs.LG

基于迭代能量的多模态Transformer:从Sentinel-1和Sentinel-2时间序列联合反演小麦土壤水分、叶面积指数和株高

提出迭代能量多模态Transformer联合反演土壤水分等参数,R²达0.85,能量函数可诊断反演质量。

04:00
arXiv cs.LG

EveLoad:基于事件型眼动的认知负荷识别

首个事件眼动数据集EveLoad,含六等级认知负荷标注,提出时空编码框架,识别准确率超96%。

04:00
arXiv cs.LG

基于神经算子的数字孪生建模阿尔茨海默病中β-淀粉样蛋白和tau蛋白传播及治疗优化

提出数据驱动框架,学习Aβ和tau蛋白传播动力学,预测准确率87%和81%,并实现个性化治疗优化。

04:00
arXiv cs.LG

多模态回归的高效解析不确定性量化

将变分贝叶斯推断扩展至分位数回归和分类恢复,实现高效不确定性量化,性能优且支持主动学习。

04:00
arXiv cs.LG

利用预训练信念表示的高效自适应数据获取

POLAR利用预训练模型作为信念编码器,解耦表示与策略学习,在多种任务中性能更优且训练样本更少。

04:00
arXiv cs.LG

简洁乃推理效率之本:通过数据策展促使视觉语言模型精炼输出

数据策展训练简洁VLM,每正确回答FLOPs降低35倍,精度仅降约1%,且简洁模型能答对冗长推理模型错题。

04:00
arXiv cs.LG

通过熵传输下降的变分推断

ETD利用熵正则化最优传输实现全局粒子协调,避免高维方差坍塌和多模态模式崩溃,无需评分函数,性能优于现有方法。

04:00
arXiv cs.LG

有序瓶颈中的语义分配:面向视觉表征学习的预测残差推断

PRIOR框架用对数尺度级别与级别预测器聚焦残差,解决掩码排序压力缺点,提升有序表征学习性能。

04:00
arXiv cs.LG

逆强化学习用于帕金森病可解释击键生物标志物

IRL从击键数据恢复速度偏好权重,与PD严重度显著相关(r=-0.607),增量R²从0.194到0.338。

04:00
arXiv cs.LG

僵化神经元:理解多智能体强化学习价值分解方法中的可塑性损失

针对价值分解方法中僵化神经元导致的可塑性损失,提出KNIFE方法,以三组件组合单元替换神经元,有效恢复学习能力。

04:00
arXiv cs.LG

Transformer的终生上下文学习需要参数化注意力

参数化注意力用在线网络替代键值缓存,实现固定内存下的终生学习,但面临容量和更新挑战。

04:00
arXiv cs.LG

基于几何锚定的传输框架用于无样本类增量学习

提出几何锚定传输框架,以训练内生约束替代事后解耦,联合解析几何锚和拓扑感知演化,缓解表示漂移。

04:00
arXiv cs.LG

FactorLibrary:通过递归子目标从多项式到电路

引入FactorLibrary将多项式最小电路问题转化为强化学习,PPO+MCTS自上而下方法找到复杂度≤8最优电路成功率91.8%。

04:00
arXiv cs.LG

DFMU:数据节俭的机器遗忘

提出DFMU方法,单次传播计算重要性,知识保留剪枝加速,仅用13%数据提升40%保留精度,遗忘快88%。

04:00
arXiv cs.LG

Beyond One-Size-Fits-All: Diagnosis-Driven Online Reinforcement Learning with Offline Priors

04:00
arXiv cs.LG

节食式蒸馏:通过可学习数据剪枝实现高效知识蒸馏

提出IF-Beta框架,用影响函数与Beta分布可学习采样策略剪枝,实现高效蒸馏,性能超越全数据集训练。

04:00
arXiv cs.LG

TL++:面向分布式智能系统的准确性与隐私保护的遍历学习

TL++通过虚拟批次和秘密共享,在分布式系统中同时保证准确率和隐私,通信降低13倍,准确率超基线12%。

04:00
arXiv cs.LG

中文标题:TopoCast:基于Transformer的时间序列预测的拓扑保真度评估框架

中文摘要:提出TopoCast拓扑框架,利用持久同调评估时间序列预测的结构保真度,克服传统点误差指标忽略动态结构的缺陷。

04:00
arXiv cs.LG

合作多智能体强化学习中基于独立智能体和顺序更新的低方差信任区域优化

提出裁剪目标控制顺序更新中优势函数波动,实现低方差估计与稳定收敛,在多个基准测试中优于基线。

04:00
arXiv cs.LG

泄露电路秘密:图神经网络上的梯度泄露攻击

首次评估GNN在电路设计中的梯度泄露攻击,揭示可泄露门类型与硬件木马信息,注意机制加剧风险,现有防御效果有限。

04:00
arXiv cs.LG

基于黎曼自注意力的鲁棒脑电解码方法

提出基于Bures-Wasserstein度量的黎曼自注意力网络(GBWAtt),克服SPD学习局限,在三个EEG数据集上验证鲁棒性。

04:00
arXiv cs.LG

基于低秩适应的强化学习内存高效策略库

LoRA微调相比全微调节省90-95%存储,成功率无显著差异,实现内存高效策略库。

04:00
arXiv cs.LG

基于梯度的极紫外掩模逆向光刻:波导方法与物理信息神经算子

提出基于梯度的EUV掩模逆向光刻,利用可微波导和物理信息神经算子,自动微分实现所需晶圆场。

04:00
arXiv cs.LG

移动蜂窝预测:数据何去何从?

提出用人口动态数据改进蜂窝负载预测,高速公路场景预测精度提升60%。

04:00
arXiv cs.LG

混合专家模型实现子集共享不变性,路由机制组合不变成分,提升域泛化鲁棒性。

提出子集共享不变性,采用混合专家架构学习路由条件不变性,提升域泛化对异构域的鲁棒性。

04:00
arXiv cs.LG

黑箱辅助回归:相变与极小极大最优性

黑箱辅助回归中目标接近固定预测器时存在相变,安全残差估计器通过修正与回退避免负迁移,达到极小极大最优。

04:00
arXiv cs.LG

桥接球形黑盒优化器

统一ES、CBO、OVI等方法框架,揭示适应度聚合与共识范围两差异,引入混合优化器,在性能与鲁棒性间取得平衡并超越原算法。