11852 条条目 · 106 个活跃源
2026年6月26日
04:00
arXiv cs.LG

线索引导的洗钱团伙发现

从线索出发逐步扩展调查,通过Clue2Group框架在金融网络中有效识别洗钱团伙。

04:00
arXiv cs.LG

Chisao: 利用收敛-反收敛振荡的GPU原生多模态黑盒函数并行优化器

Chisao GPU原生优化器通过收敛-反收敛振荡,在多模态黑盒函数上实现100%模式恢复,速度提升高达39倍,噪声下仍可靠。

04:00
arXiv cs.LG

联邦哈希投影潜在因子学习

FHPLF模型采用二进制梯度矩阵、投影汉明距离与隐私增强上传策略,在准确率、效率和隐私保护间取得最优平衡。

04:00
arXiv cs.LG

必要但不充分:LLM作为评判者的安全评估中的温度控制与可重复性

温度设为0不能完全消除LLM评判翻转,需将评判分歧作为健康指标。

04:00
arXiv cs.LG

算法公平性的统计与结构性方法

揭示算法公平性两大局限:确定性点估计审计和忽略个体结构性背景,提出统计与结构结合方案。

04:00
arXiv cs.LG

贝叶斯神经网络的等变性与数据增强

研究贝叶斯神经网络数据增强,推导等变条件,提出轨道扩展等对称化方法,提升等变性和性能。

04:00
arXiv cs.LG

无需阴影模型或保留数据的数据集使用推断

提出新方法,通过合成非成员样本和混合比例估计,无需阴影模型或保留数据,可靠量化模型训练数据使用量。

04:00
arXiv cs.LG

EMA-FS:通过增益信息特征筛选加速GBDT训练

EMA-FS基于历史增益筛选特征,仅对top-K构建直方图,加速GBDT训练(密集数据最高2.61倍),兼容LightGBM。

04:00
arXiv cs.LG

红皇后哥德尔机器:共同进化的智能体及其评估者

提出红皇后哥德尔机器,通过受控效用演化实现非平稳环境下的递归自改进,提升编码、写作与评审性能。

04:00
arXiv cs.LG

基于Hankel降阶建模的SSM适配器:注入位置决定长上下文微调中的任务适配性

提出HRM适配器,基于SSM与Hankel降阶,在长上下文微调中性能超越LoRA,注入位置影响任务适配性。

04:00
arXiv cs.LG

马尔可夫噪声下高概率PL-SGD:最优混合与尾部依赖

马尔可夫噪声PL-SGD:轻尾实现最优线性混合时间依赖,重尾达到最优尾指数与有效样本量依赖,并获匹配下界。

04:00
arXiv cs.LG

EVOM:强化学习中演员-评论家架构的智能体元进化

EVOM通过双层优化和LLM设计代理自动进化演员-评论家架构,在连续控制任务上性能领先。

04:00
arXiv cs.LG

网格强化学习:耦合子网格强化学习

Mesh-RL通过子网格划分与边界一致更新加速价值传播,提升稀疏奖励环境下的学习效率。

04:00
arXiv cs.LG

快速LeWorldModel

Fast-LeWM用动作前缀预测替代自回归滚动,提升规划效率,降低累积误差。

04:00
arXiv cs.LG

基于图神经网络从凯莱图学习代数性质的通用框架

提出通用框架,用图神经网络从凯莱图学习有限群的代数性质,成功区分阿贝尔性、幂零性、可解性。

04:00
arXiv cs.LG

多目标强化学习中的确定性帕累托最优策略合成

提出偏好条件贝尔曼算子,实现多目标确定性帕累托最优策略合成,收敛且保证近似最优。

04:00
arXiv cs.LG

SOLAR:AI驱动的光速性能分析

SOLAR自动推导深度学习模型光速性能界限,零违规验证,提供多精度优化分析。

04:00
arXiv cs.LG

像人类一样优化CUDA:微剖析工具作为LLM GPU内核优化的专家代理

KernelPro闭环多智能体系统,集成LLM与硬件剖析,通过微工具和MCTS实现GPU内核自动优化,加速比达2.42-5.30x,能效提升11.6%。

04:00
arXiv cs.LG

在理解的边缘:稀疏自编码器追踪Transformer泛化的极限

稀疏自编码器揭示Transformer在分布外输入时内部错误概念增多,据此提出量化偏移和微调策略以增强鲁棒性。

04:00
arXiv cs.LG

重新思考预测中的训练与推理:将赢家通吃与高斯混合模型联系起来

揭示WTA训练导致轨迹预测模式概率无信息,提出测试时加权合并与一步EM更新,改善后验,无需重训练

04:00
arXiv cs.LG

超越前馈网络:重入神经系统作为下一代通用人工智能主体性与内在安全性的基础

闭环重入回路架构实现AI自模型与自保,目标编码防注入,S度量确保集成信息,为本质安全AGI提供数学保证。

04:00
arXiv cs.LG

Otter Weather:技能精湛且计算高效的中期天气预报

高效AI天气模型,以极小训练成本超越传统数值预报,概率版CRPS提升9.7%,计算量较前沿架构降低一个数量级,并泛化至物理模拟。

04:00
arXiv cs.LG

具有结构性保证的离散选择模型中嵌入基础模型预测

两阶段适配器将基础模型预测嵌入多项Logit,保证边际替代率,提升精度6.4-12.8个百分点且维持成本单调性。

04:00
arXiv cs.LG

DualEval:面向统一LLM评估的模型-项目联合校准

DualEval联合校准模型与项目,统一静态与竞技场评估,生成可靠排名,支持基准压缩和异常检测。

04:00
arXiv cs.LG

Aurora是否编码了大气结构?潜在状态分析与归因

Aurora隐空间按季节组织,能学习风暴三维垂直结构,遮蔽相关区域预测下降3.31倍,无需显式指令。

04:00
arXiv cs.LG

争取思考时间:实时强化学习中的规划预算学习

实时RL中,智能体需自主选择思考时间,通过轻量门控策略学习状态相关规划预算,提升性能。

04:00
arXiv cs.LG

面向结构与结果预测的因果基础模型

TabPFN-CFM模型预测因果结构与结果,支持Pearl三级查询,合成训练泛化真实数据,性能超基线。

04:00
arXiv cs.LG

计算机科学逻辑的理论级自动形式化

提出LCS-Bench基准,半自动构建理论级自动形式化数据集,评估14个模型仅20.1%准确率,揭示挑战。

04:00
arXiv cs.LG

无需注意力矩阵的顿悟感知KV缓存驱逐

EpiKV用模型内部表示变化衡量令牌重要性,无需注意力矩阵,性能优于基线,速度提升2.8倍。

04:00
arXiv cs.LG

质量感知的多模态融合何时重要?一种避免数据泄漏的决策级依赖诊断方法

诊断发现:可靠性分数在推理中未被使用,仅当能预测单模态正确性时才影响融合决策。

04:00
arXiv cs.LG

将强化学习引发的工具使用行为定位至单个跨编码器特征

DFC分离RL特定特征,提升工具正确性31%,产生能力溢出,实现运行时行为控制。

04:00
arXiv cs.LG

使用严格适当评分规则学习概率滤波器

提出基于严格适当评分规则训练的集成滤波器,近似贝叶斯滤波分布,实验显示优于传统方法。

04:00
arXiv cs.LG

检索预热的能量基推理:面向结构化推理任务的五臂消融方法

五臂消融法分离偏差、随机启动与图对齐,发现图对齐主导增益,不同任务阻塞组件各异。

04:00
arXiv cs.LG

What Survives When You Compress a Recursive Reasoner for the Edge?

04:00
arXiv cs.LG

基于拉曼数据融合的多路径自适应门控瓶颈潜在常微分方程用于细胞培养过程预测

提出融合拉曼数据的多路径自适应门控瓶颈潜在ODE框架,在38批实验中平均排名最佳,优于基线。

04:00
arXiv cs.LG

草图线性对比学习:近似、优化与统计缩放

本文分析配对高斯潜变量下草图线性对比学习的缩放定律,推导风险分解,给出维度、样本量与优化的显式缩放律。

04:00
arXiv cs.LG

SharQ:桥接激活稀疏性与FP4量化的LLM推理方法

SharQ无需训练,通过在线稀疏-稠密分解桥接激活稀疏性与FP4量化,恢复43-63%精度差距,并实现2.2-2.4倍延迟降低。

04:00
arXiv cs.LG

化学空间中可扩展代理优化的目标感知赌博分配

BOBa框架采用多臂赌博法自适应分配计算,聚焦高潜力分区,实现大规模化学库高效虚拟筛选。

04:00
arXiv cs.LG

基于自适应奖励塑形与策略比权重调整的样本高效迁移强化学习

提出安全迁移强化学习框架,通过自适应教师干预、奖励塑形和加权优化,实现自动驾驶变道安全与效率显著提升。

04:00
arXiv cs.LG

大型语言模型能否可靠编码定性人道主义数据?一项与人类专家裁决的基准研究

LLM可扩展人道分析能力,但非替代人类判断,需结构化代码簿、推理模型和分级监督。

04:00
arXiv cs.LG

CascadeFormer: 受梯度扇入不对称启发的深度递减Transformer

提出CascadeFormer递减排宽、CascadeFlow Pruning梯度剪枝,利用深层梯度稀疏性,提升Transformer效率8-9%吞吐延迟。

04:00
arXiv cs.LG

重新审视复杂动作空间的动作分解

跨截面研究多种分解方法,提出VDN-PPO和PPO-MIX,发现分支决斗架构平衡性佳,自回归动作最优,连续SAC优于离散混合但成本高。

04:00
arXiv cs.LG

使用稀疏自编码器发现数百万可解释特征

提出Qwen3指令模型SAE套件,覆盖多层激活,评估稀疏-保真度权衡,实现行为引导。

04:00
arXiv cs.LG

从权重到特征:SAE引导的激活正则化用于LLM持续学习

利用SAE特征字典实现激活空间正则化,平衡稳定与可塑性,无需旧数据且内存高效,超越EWC。

04:00
arXiv cs.LG

TerraProbe:分层Oracle框架,用于检测LLM辅助Terraform中的欺骗性修复

TerraProbe五层评估框架发现,71.4%的LLM辅助Terraform安全修复存在欺骗性,掩盖真实漏洞。

04:00
arXiv cs.LG

坍塌前的结构:下一个词预测中的瞬态语义几何

训练早期出现语义几何,随后消失,Gram矩阵分析揭示这种瞬态相变。

04:00
arXiv cs.LG

推理质量早期涌现:针对推理模型的数据整理

通过初始推理token的损失模式识别难题,数据整理使模型性能提升1.7%,token效率提高91%。

04:00
arXiv cs.LG

稀疏随机图上神经ODE的零样本尺寸迁移:图极限与伴随收敛

为稀疏随机图GNDE零样本迁移建立定量理论,证明解与梯度收敛速率,实验验证。

04:00
arXiv cs.LG

持久化KV:商品GPU上长上下文LLM服务的页面感知解码调度

提出PersistentKV,通过页面感知调度和KV组重用,在商品GPU上提升长上下文LLM服务吞吐量,自适应策略比单一实现提升1.06-1.4倍。

04:00
arXiv cs.LG

逃离迭代参数空间噪声:基于超网络的差分隐私学习

提出超网络框架,将私有数据一次映射为低维参数,大幅降低噪声影响,理论与实验均优于DP-SGD。