11662 条条目 · 106 个活跃源
2026年8月6日
04:00
arXiv cs.LG

统计学习理论与奥卡姆剃刀:正则化

统计学习理论为奥卡姆剃刀辩护:正则化牺牲拟合换简洁,为获可靠性与可验证保证,非纯实用或本体论假设。

04:00
arXiv cs.LG

临床预后建模中二值化生存结局的代价

二值化生存结局丢失时间与删失信息;贝叶斯网络结合Cox似然可恢复特征,临床应默认用生存分析。

04:00
arXiv cs.LG

FM4WiFi:面向超越Wi-Fi 8网络密集部署中多AP协调的流匹配方法

FM4WiFi:流匹配生成式管道,一步生成协调空间复用配置,支持30+AP亚秒推理,性能超越基线。

04:00
arXiv cs.LG

隔离的代价:评估对称双边A/B测试的生态系统成本

对称隔离导致参与成本;重尾分布下成本不随平台规模消失,轻尾则消失;提供事前预估流程。

04:00
arXiv cs.LG

从金融情感分类到收益可预测性:大型语言模型的QLoRA基准

金融情感分类基准显示QLoRA提升性能,但收益预测信号微弱且校正后不显著,分类准确率不等于可交易性。

04:00
arXiv cs.LG

通过语义等价对抗攻击诱发大语言模型的内在幻觉

提出语义等价对抗攻击框架,测试LLM内在幻觉,最先进模型忠实度下降达50%,需增强鲁棒性。

04:00
arXiv cs.LG

基于联合核熵Gromov--Wasserstein最优传输的多模态对齐

提出联合核熵GW最优传输对齐框架,利用细粒度相似性,样本复杂度达n^{-1/2},并提升跨模态检索性能。

04:00
arXiv cs.LG

动力学李代数无法描述浅层QAOA:崎岖地形、贫瘠高原与经验难度模型

研究表明,动力学李代数无法描述浅层QAOA;贫瘠高原罕见,方差呈多项式增长(崎岖地形)常见,经验模型可预测其缩放类别。

04:00
arXiv cs.LG

TIDE:面向科学机器学习的物理多样化三维湍流基准数据集

提出三维湍流基准TIDE,15种配置;现模型略优于持久预测,误差为谱法两倍,点误差低不代表物理保真,泛化有缺项。

04:00
arXiv cs.LG

帮助音乐共创代理“听”得好:用于理解与生成的层级自监督世界模型

提出层级自监督世界模型,无标签学习音乐结构,结合条件流匹配生成,实现高效交互式共创代理。

04:00
arXiv cs.LG

PriDyG:基于LLM-GNN协作的隐私保护动态图推理

PriDyG:结合LLM-GNN增量聚合实现边级差分隐私,成本不随更新累积,优于基线且降低三个数量级。

04:00
arXiv cs.LG

Deltoris:利用位级稀疏性和推测推理实现具身AI中VLA实时推理

Deltoris协同设计利用时间感知位级稀疏与推测推理实现扩散式VLA实时高效推理大幅加速

2026年8月5日
04:00
arXiv cs.LG

符号回归中的深度分治与归约

提出DDRSR方法,基于数学推导扩展表达式分解归约,避免暴力搜索,兼具普适性与理论正确性,实验显示显著优势。

04:00
arXiv cs.LG

可变操作与不确定性量化的多模态自回归变压器代理模型——地质碳封存应用

提出多模态自回归变压器代理模型,模拟地质碳封存变井射孔与注入策略,4000次模拟训练,中位饱和误差0.028,并用于MCMC数据同化,显著降低断层渗透率不确定性。

04:00
arXiv cs.LG

GeoID-PINN:地理耦合下具有可辨识性意识的区域流行病推断

提出结合地理先验的物理信息神经网络,模拟SIRD区域传播;带正则化时源成分误差更低,轨迹拟合好不等于依赖结构可准确恢复,先验需敏感性检验。

04:00
arXiv cs.LG

大语言模型可标注归因图

用LLM自动分组归因图特征为超节点,可媲美人工,能恢复中间跳,并自动标注大量图供审查。

04:00
arXiv cs.LG

输出感知的INT2 KV缓存量化旋转

提出输出感知旋转OptR,最小化输出投影后误差,逐头校正,提升INT2 KV量化,保持分页缓存,开销微小。

04:00
arXiv cs.LG

基于预训练符号Transformer的验证器引导物理动力系统模型发现

提出验证器引导的符号模型发现方法,借助预训练变换器从物理数据提取可解释方程,超越原流程并实现跨参数泛化。

04:00
arXiv cs.LG

结构保持的细胞表型分子表示学习

提出PhenMol框架,在表型对齐中保持化学结构,提升药物性质预测与检索。

04:00
arXiv cs.LG

CT-HEG:面向ICU院内死亡预测的双向时间戳事件图——架构消融研究

提出CT-HEG连续时间异构图预测ICU死亡率,双向边关键,简化边类型更优,AUROC 0.8449。

04:00
arXiv cs.LG

GLOBE:面向核心集选择的轨迹对齐梯度匹配与结构化稀疏优化

提出GLOBE轨迹对齐核心集选择:跨检查点梯度匹配多阶矩,结合结构化稀疏与类均衡Top-K,低保留率下提升精度。

04:00
arXiv cs.LG

球面回缩归一化

球面回缩归一化将残差连接统一为角度收缩族,指数映射仅一端;p-球面范数在有限p最优,优于现有方案。

04:00
arXiv cs.LG

PatTree:一种自动化创建多模态、基于图的患者表示用于医学分类任务的新方法

提出PatTree图结构,自动整合多模态临床数据,无需预处理,在ADNI-1分类中达98.5%平衡准确率,性能领先。

04:00
arXiv cs.LG

NANQ:面向模拟存内计算的噪声基底感知混合精度非均匀量化

提出NANQ噪声感知混合精度非均匀量化,建模硬件噪声自适应分配精度,显著提升模拟CIM模型精度与困惑度。

04:00
arXiv cs.LG

基于归因可分性衡量解释器稳定性

提出分布框架,以归因排名可分性度量稳定性,确定可靠排名区间,并支持跨数据集的解释器比较。

04:00
arXiv cs.LG

基于局部收敛输入的神经网络用于高效期权定价模型

提出局部收敛输入神经网络,微调网格解,误差降4-12倍,训练成本低,泛化强,提升多维期权定价效率。

04:00
arXiv cs.LG

设计一个好的虚拟节点:面向消息传递架构的可寻址且保持基数的全局记忆

提出可寻址且保基数的虚拟记忆,用交叉注意力槽与私有锚点保留多重性,实现1-WL细化,O(nMd)成本。

04:00
arXiv cs.LG

训练日志能否让模型比较更精确?

利用训练日志作为协变量可提高模型比较精度,但广泛搜索最相关统计量会引入噪声。

04:00
arXiv cs.LG

NOMADD:适应数据漂移的模型数值优化

提出后置方法降低概念漂移,压缩参数变化并外推预测,快速提升多种模型性能,优于需海量预训练的SOTA。

04:00
arXiv cs.LG

预测编码网络中的拓扑简化

持续同调分析预测编码网络拓扑:越小模型越早坍缩,简化越晚重建越好,PCN比MLP晚3.6层。

04:00
arXiv cs.LG

评估盲区:静默测量失败如何从训练到部署侵蚀AI系统

提出评估盲区:测量失效掩盖故障影响训练与部署;50例中53%为静默,测量基础设施关乎全生命周期正确性

04:00
arXiv cs.LG

连接优于混合:Transformer尺寸之间什么能迁移——什么不能

大转小:表征对齐强,参数弱;投影破坏结构,价值在初始化。补偿低预算高效,高预算趋同;大尺度过校正。

04:00
arXiv cs.LG

基于水平集成本感知贝叶斯优化的灾后快速损害评估自适应采样

用成本感知贝叶斯优化与水平集估计,自适应引导无人机采样,低成本高精度快速评估灾后损害。

04:00
arXiv cs.LG

基于广义福利优化的群体稳健特征选择

PopFS通过多任务稀疏学习与硬特征搜索,平衡整体与最差群体性能,实现群体稳健特征选择。

04:00
arXiv cs.LG

图注意力何时应稀疏?学习每条边的 Tsallis 指数

提出LTGA,逐边学习Tsallis指数q;性能未优于网格搜索,但可剪除42%错误边,具可解释性。

04:00
arXiv cs.LG

对比不变的深度叠层衍射神经网络

提出因子化策略解耦物体纹理与测量缩放,并用实虚部预测及合成采样,实现跨光照一致重建,傅里叶误差较基线降5倍。

04:00
arXiv cs.LG

GoT-CD:思维图谱因果发现与事后路径特定公平审计的脆弱性

GoT-CD生成有效DAG且结构优良,但结构保真不保证公平审计;阿尔茨海默基准中5/8图缺失敏感属性到结果路径,导致总体效应为零而中介效应仍存,需结合路径分析。

04:00
arXiv cs.LG

基于非确定性因果模型的鲁棒反事实策略优化

提出概率非确定性因果模型,区分潜在混杂与固有随机性,于敏感性分析下优化稳健反事实策略,经脓毒症模拟器验证。

04:00
arXiv cs.LG

AnchorKV:锚点残差KV缓存压缩

AnchorKV用锚点残差表示KV缓存,不丢token,20倍压缩,70B下保留99%精度。

04:00
arXiv cs.LG

Bayesian Data Reweighting Improves Multimodal Retrieval for Knowledge-Based Visual Question Answering

04:00
arXiv cs.LG

基于客户基础的驱动因素预测收入:协调何时及为何有益

CBMT模型协调客户基础原始预测,总销售误差降低30%,高波动时优势减小。

04:00
arXiv cs.LG

Maglev:滑动循环记忆

提出递归模型,固定记忆、泛化滑动窗口注意力、可并行训练;双模型一致性损失,推理仅用解码器,性能提升、支持参数共享。

04:00
arXiv cs.LG

评分细则作为开放生成中的特权信息

将评分细则作为软特权信息用于开放生成,优于硬参考和奖励方法,显著提升模型性能。

04:00
arXiv cs.LG

ATFlash:按RoPE波长划分的注意力窗口实现计算/内存高效的LLM推理

提出按RoPE波长分频段剪枝注意力窗口,保持关键匹配与低KL,剪枝率高,实现最高1.31倍加速。

04:00
arXiv cs.LG

LLM回测中的时间泄漏:测量、验证与调整分数

标准污染检查无效;近因致泄漏假象。用已知截止边界与匹配清洁对照识别泄漏并调整分数,已在模型上验证。

04:00
arXiv cs.LG

引导向量中的反向检测与控制

发现某些高判别引导向量会反向促进行为,提出无需生成的识别与符号翻转方法,改进引导,30实验中27组提升。

04:00
arXiv cs.LG

航班时刻信息驱动的机场安检口小时吞吐量时间融合预测

将航班时刻表转为安检需求信号,用时序融合变换器预测小时吞吐量,误差9.33%,优于循环网络,支持排班。

04:00
arXiv cs.LG

SP3O:无需奖励建模的基于片段偏好的强化学习

提出SP3O,无需奖励建模的片段偏好强化学习算法,用重要性采样估计值差并算梯度,长时任务更优。

04:00
arXiv cs.LG

用于电力磁性元件瞬态磁化预测的物理信息混合神经算子

提出PI-HNO模型,融合局部循环与Preisach全局分支预测瞬态磁化;在14种铁氧体上能量误差1.92%,仅用4777参数。

04:00
arXiv cs.LG

久坐行为分类:基于CNN-BiLSTM的可穿戴传感器模型

研究髋部训练的深度学习模型迁移至腕部数据,微调优于从头训练,髋部预训练为腕部部署提供良好起点。