11852 条条目 · 106 个活跃源
2026年7月1日
04:00
arXiv cs.LG

加速度计衍生的心血管代谢风险数字生物标志物:一个具有不确定性量化的代表性人群表格基准

使用NHANES数据构建加速度计心血管代谢基准,TabPFN v2最优,并应用共形预测量化不确定性,但甘油三酯预测差且亚组覆盖不均。

04:00
arXiv cs.LG

关注残差差距:现实世界偏差下的概率降尺度

ReMatch通过最优传输对齐残差分布,弥合训练与测试的残差差距,解决概率降尺度偏差和欠扩散,改善校准。

04:00
arXiv cs.LG

从搜索到综合:训练大语言模型为零样本工作流生成器

MetaFlow以元学习训练LLM生成稳健可复用工作流,两阶段训练后实现零样本泛化,性能媲美先进基线。

04:00
arXiv cs.LG

分层全局注意力(HGA)

HGA作为密集因果注意力的替代,通过分层路由实现长上下文,在32GB显卡上支撑64K令牌,注意力差异极小。

04:00
arXiv cs.LG

通过进程侧车实现可撤销的习得状态

提出双系数编辑族,利用进程侧车实现安全训练后的记忆撤销,证明其近似第二阶精确性,优于朴素任务算术。

04:00
arXiv cs.LG

少步文本潜变量为何失败而图像潜变量有效?尖锐分类读出中的非承诺性

少步文本生成失败源于几何非承诺:平滑确定性映射无法在尖锐读出前解决离散分支,随机或自回归可逃逸。

04:00
arXiv cs.LG

梯度平滑:耦合逐层更新以改进优化

提出深度梯度增强框架,通过窗口平滑算子平滑逐层梯度,在多种任务中一致提升优化与泛化性能。

04:00
arXiv cs.LG

可预测的GRPO:训练动力学的闭式模型

提出GRPO训练动力学的闭式模型,揭示指数饱和与慢启动,预测组大小不变性与稳定性阈值

04:00
arXiv cs.LG

双边市场中供给增量效应的估计:一种因果机器学习方法

用因果机器学习与层次贝叶斯框架,以Airbnb为例估计额外供给对交易的增量效应。

04:00
arXiv cs.LG

流体控制的离线强化学习:基于数据的多观测策略提取

提出离线RL框架,采用传感器位置条件化架构,通过数据驱动提取策略,实现多传感器自适应,降低计算成本。

04:00
arXiv cs.LG

随机森林集成大小选择中基于三元组平台搜索的平稳分布理论

将随机森林树个数调参建模为生灭马尔可夫链,推导平稳分布及尺度规律,揭示其随机过程本质。

04:00
arXiv cs.LG

分区引导的距离显著性:在多目标优化中连接决策空间与目标空间

PGDS框架通过分区引导距离显著性,自动识别高维多目标优化的关键变量,提升可解释性。

04:00
arXiv cs.LG

扩散Transformer的质量感知调制

QRM模块学习质量感知表征,调整DiT自适应LayerNorm调制,提升图像质量。

04:00
arXiv cs.LG

多阶段延迟树实现混合可解释性:若初不成,再树一次

多阶段延迟树用稀疏树序列处理多数样本,仅延迟少数至后续树或黑箱,在保持高准确性的同时提升可解释性。

04:00
arXiv cs.LG

一种可迁移的习得时间先验用于真实疫情标签中的传播重建与决策相关不确定性

习得时间先验可迁移,优于基线,不确定传播边改变干预优先级。

04:00
arXiv cs.LG

行为克隆并非万能:噪声专家反馈下在线策略蒸馏的最优性

噪声专家场景下,离线学习样本需求指数增长,在线策略蒸馏仅需多项式样本,解释其优于SFT的理论原因。

04:00
arXiv cs.LG

基于物理信息的条件归一化流用于仅角度地月轨道确定

利用条件归一化流对地月空间仅角度观测进行轨道确定,生成物理信息状态假设,为经典算法提供热启动。

04:00
arXiv cs.LG

Personalizing Marketplace Policies with Competing Objectives and Constrained Experiments: Evidence from a Job Marketplace

04:00
arXiv cs.LG

FORA:能力保持微调中从权重空间到函数空间的保护

FORA通过激活子空间投影实现函数空间保护,在微调中更好保留原有能力,优于权重空间方法。

04:00
arXiv cs.LG

PPT-Eval:针对PowerPoint任务的计算机使用智能体基准测试

PPT-Eval含120个PowerPoint任务,设计部分评分框架,与人类判断高度一致(τ-b=0.77),前沿智能体成功率仅45%。

04:00
arXiv cs.LG

OTCache:面向扩散模型中几何感知缓存的最优传输方法

OTCache用最优传输建模缓存调度平滑演化,通过三阶段预测策略实现扩散模型3.6-4.7倍加速,并提升生成质量。

04:00
arXiv cs.LG

用统计力学解释机器学习与记忆

用统计力学研究神经网络的学习与记忆,聚焦对抗攻击和低维学习,分析DAM和RBM模型。

04:00
arXiv cs.LG

中文标题:表格上下文学习器能否泛化到生物分子性质预测?

中文摘要:研究发现表格上下文学习器在生物分子预测中表现强劲,但性能强烈依赖于分子表示的选择。

04:00
arXiv cs.LG

一种基于贝叶斯滤波的含噪测量拉格朗日动力学学习方法

提出贝叶斯滤波方法,用神经网络参数化能量,联合学习参数与状态,实现含噪测量下拉格朗日动力学建模。

04:00
arXiv cs.LG

通过信息多视角投影可视化高维图嵌入

提出高维图嵌入与可微边交叉代理,搜索信息2D视角优化美学指标,实验优于标准布局,交互系统揭示隐藏模式。

04:00
arXiv cs.LG

Warp RL:重塑基础策略分布以适应动力学变化

Warp RL用可逆变换重塑策略分布,优于残差修正,在仿真和真实机器人任务中表现更佳。

04:00
arXiv cs.LG

Teaching LLMs to Recommend and Defer in Underrepresented Epilepsy Care

04:00
arXiv cs.LG

从大型推理模型到紧凑学生模型的知识蒸馏:以John O'Bryan数学竞赛为例

蒸馏DeepSeek-R1至Qwen2.5-7B,竞赛准确率提升4.76%,验证响应长度关键影响。

04:00
arXiv cs.LG

探索表格上下文学习中的记忆效应

LTMs在特定微调条件下存在参数记忆,但现实训练中信号消失,需保护敏感数据。

04:00
arXiv cs.LG

AETDICE:非线性多目标强化学习的统一框架与离线优化

提出AET框架统一非线性MORL两范式,基于DICE密度比估计实现离线优化,解决长期难题。

04:00
arXiv cs.LG

顺序稀疏高斯过程分位数回归

利用拉普拉斯近似和自适应机制,高效处理计算挑战并提升预测不确定性量化。

04:00
arXiv cs.LG

合规门:面向受监管行业的分类器门控多层次LLM路由推理

提出推理前分类路由架构,实现合规与低成本,延迟降39%,成本省33-52%,分类准确率99.2%。

04:00
arXiv cs.LG

从无混合的格劳伯轨迹学习高斯图模型

提出从单条格劳伯轨迹学习高斯图模型的多项式算法,无需混合时间,通过局部边测试和稳健估计保证准确性。

04:00
arXiv cs.LG

TDGT: 支持自适应GPU加速贝叶斯混合模型、扩散模型和潜在空间生成建模的表格数据生成工具包

TDGT是集自适应贝叶斯混合、VAE混合及GPU加速于一体的web工具,通过多维度评估实现高保真合成与隐私保护。

04:00
arXiv cs.LG

AI辅助研究中的校准转向:证据许可主张的概念与方法框架

AI辅助研究需校准证据,提出五算子框架,核心原则:无许可不主张、验证不决定主张级别、自动化加剧校准需求。

04:00
arXiv cs.LG

Transformer作为贝叶斯上下文实验者:平滑自适应的高效ATE估计

提出贝叶斯上下文实验者,用Transformer模仿后验分配,实现平滑自适应的高效ATE估计。

04:00
arXiv cs.LG

ISM:面向持续数学推理的自我改进策略记忆

ISM通过自进化策略记忆库,不更新参数即提升持续数学推理,效果显著优于基线。

04:00
arXiv cs.LG

重新审视体积假说

研究显示,训练数据增大时,梯度学习泛化优势减弱,解决了体积假说的实验矛盾。

04:00
arXiv cs.LG

基于流匹配的概率反演

将AI流匹配技术用于地震概率反演,通过简单模型和OpenFWI数据集验证其有效性。

04:00
arXiv cs.LG

中文标题:基于平滑安全结构化策略组合的安全在线学习

中文摘要:AutoSafe通过结构化安全监控实现平滑风险依赖的安全行为过渡,在连续控制中兼顾安全与学习平滑性,并获物理实验验证。

04:00
arXiv cs.LG

Patch-PODiff-ViT:基于分块POD的结构化潜在扩散用于超分辨率与不确定性量化

提出Patch-PODiff-ViT,用分块POD构建结构化潜在扩散,实现高效超分辨率与可解释不确定性量化,参数少、重建强、不确定性校准好。

04:00
arXiv cs.LG

垂直联邦学习中基于期望增益的升级策略

提出期望增益评分机制,在VFL双轮推理中选择性升级样本,优化通信-准确率权衡,无需额外路由网络。

04:00
arXiv cs.LG

Dualformer:面向复值盲通信信号分析的高效特征提取器

提出参数共享双通道网络Dualformer,降低泛化误差保留表达能力,在多种盲信号分析任务上表现优异。

04:00
arXiv cs.LG

基于深度强化学习的航天器大气再入姿态控制

深度强化学习结合传统控制,实现航天器再入姿态精准跟踪,混合控制器鲁棒性更强,通过动态随机化提升泛化能力。

04:00
arXiv cs.LG

解决AI中的叠加问题以实现患者神经元图像的可解释性和跨模态对齐

稀疏自编码器解析叠加恢复几何保真,GW-map对齐图像与scRNA-seq数据重建病理通路。

04:00
arXiv cs.LG

校准评估器:概率校准能否缓解LLM智能体反馈循环中的偏好耦合?

首个研究证实概率校准可缓解LLM评估器偏好耦合,降低耦合系数20-49%、JS散度45-67%。

04:00
arXiv cs.LG

有限自适应性的上下文GLM面板赌博机

提出有限自适应上下文GLM面板赌博机算法,regret界为O(Nd√T)且独立于非线性参数κ,性能优越。

04:00
arXiv cs.LG

混合控制:面向Transformer模型的状态感知微调

MoC轻量微调框架通过稀疏混合专家机制集成局部和全局控制信号,高效跨块通信,性能优于现有方法。

04:00
arXiv cs.LG

利用现成生成模型的目标检测器零样本量化

提出GoodQ框架,通过信息密集提示、分布选择与噪声抑制,实现低比特目标检测量化,达最优性能。

04:00
arXiv cs.LG

邪恶频谱:优化器如何放大或抑制涌现性失调

优化器选择对涌现性失调影响最大,Muon通过隐式频谱正则化保持对齐,频谱正则化可缓解其影响。