11692 条条目 · 106 个活跃源
2026年7月29日
04:00
arXiv cs.LG

LLM作为预测规划器:面向时间序列基础模型的无训练文本条件化

提出无训练框架,融合TSFM与LLM,通过MCTS实现文本条件化预测,显著提升性能。

04:00
arXiv cs.LG

归一化残差网络中宽度缩放的机制:有效对齐维度

提出有效对齐维度,刻画残差网络宽度缩放机制,给出误对齐概率上界,实验验证更宽模型对齐更优。

04:00
arXiv cs.LG

符合人类偏好的表格相似性

现有表格嵌入侧重预测,忽视人类偏好对齐的相似性评估,需引入人类偏好对齐的评价方法。

04:00
arXiv cs.LG

FinAbstain:面向选择性金融预测的不确定性校准多模态RAG

提出FinAbstain框架,利用校准不确定性进行选择性预测,权衡覆盖率降低错误与回撤,通过模拟验证假设。

04:00
arXiv cs.LG

GAUGE:无标准答案的智能体金融模型评分方法

提出GAUGE基准,以分析师实际做法评估智能体模型,发现构建优于判断,最佳得分低于高级分析师。

04:00
arXiv cs.LG

行为驱动可解释性

提出BDX方法,利用行为驱动开发的结构化场景推导解释,并在RISC-V处理器异常案例中验证。

04:00
arXiv cs.LG

基于后验单纯形几何的无标签多类分类

利用后验单纯形几何,仅凭混合身份即可训练多类分类器并恢复潜在类别结构,无需标签。

04:00
arXiv cs.LG

逆向强化学习通过模仿人类帮助对齐AI

PARED从演示中提取隐式奖励,无需偏好标注即可优化策略对齐AI,并支持上下文对齐。

04:00
arXiv cs.LG

消除传播延迟:基于注意力的时空融合图卷积网络用于交通流预测

提出A-STFGCN,消除传播延迟误差,融合多头注意力捕获时空特征,五个真实数据集上整体性能最优。

04:00
arXiv cs.LG

基于分数的时变问题稳定化

提出基于分数的PDE数值稳定框架,通过得分模型校正迭代,增强鲁棒性并抑制非物理不稳定性。

04:00
arXiv cs.LG

生成式分布鲁棒优化

提出GDRO框架,通过采样器与Sinkhorn散度配对实现分布鲁棒优化,无需似然,显著降低库存遗憾60%和导航碰撞50%。

04:00
arXiv cs.LG

Vilya-2实现化学多样性分子界面的精确结构建模

Vilya-2扩散变换器精确建模肽-蛋白等多样分子界面,在肽、小分子、大环建模上远超现有方法,可微调用于药物发现。

04:00
arXiv cs.LG

校准的部分重置:防止持续强化学习中的策略崩溃

提出校准部分重置(CPR)优化器,按效用缩放低效神经元,避免策略崩溃,优于先前重置方法。

04:00
arXiv cs.LG

端点回放:压缩深度强化学习中的近期缓冲区

提出端点回放法,通过存储n步序列端点压缩缓冲区,减少存储量但保持性能。

04:00
arXiv cs.LG

共形级联:多层级LLM推理的无分布精度保证

提出共形级联框架,基于预测集大小延迟决策,提供无分布有限样本精度保证,无需训练,优于现有启发式方法

04:00
arXiv cs.LG

通过稀疏自编码器实现可解释的GOHR智能体

使用稀疏自编码器分析游戏智能体内部表征,发现其能恢复隐藏规则并对应可解释策略。

04:00
arXiv cs.LG

语义空间搜索轨迹网络

提出语义空间搜索轨迹网络,离散语义向量构建网络,揭示训练动态差异,用于分析比较学习动态。

04:00
arXiv cs.LG

Lantern: Conflict-Aware Gradient Blending for Physics-Guided Diffusion Models in Calorimeter Simulation

04:00
arXiv cs.LG

基于物理信息的CNN-LSTM用于街道尺度城市洪水预测:协调总体准确性与街道级别合理性

物理约束CNN-LSTM在街道尺度洪水预测中实现近乎零重力违规与最高街道召回,地形感知损失调和了总体精度与物理合理性。

04:00
arXiv cs.LG

CondPSE: 一种带条件调制的多项式滤波结构编码器

CondPSE用多项式滤波器组与条件调制增强图结构区分,合成任务上大幅超越GPSE,但真实分子预测中优势有限。

04:00
arXiv cs.LG

重新思考对比解码:关于对比解码在缓解多模态大语言模型物体幻觉中无效性的可重复性研究与扩展

本研究复现并扩展发现,对比解码缓解物体幻觉的改进是虚假的,无法真正增强视觉基础。

04:00
arXiv cs.LG

AMRD:自适应多教师关系蒸馏轻量级语音情感识别

针对多教师蒸馏中教师可靠性波动及忽视样本间关系的问题,提出自适应加权与关系蒸馏方法,在多个数据集上优于单教师基线。

04:00
arXiv cs.LG

常数深度与对数深度神经网络的算法分离

首次证明常数深度与对数深度网络间的算法分离:对数网络能高效学习分层谱布尔函数,而常数网络存在常数逼近误差。

04:00
arXiv cs.LG

Neurai-VN基准:多模态数字表型心理健康分类的标准化机器学习模型

基于Neurai-VN数据集构建多模态数字表型心理健康分类基准,四任务F1达0.56-0.71,提供可重复基线。

04:00
arXiv cs.LG

转移动态偏移下表格型MDP的混合强化学习统一算法框架

针对转移偏移的混合强化学习,提出统-算法框架(MIN-UCB-VI与MAX-LCB-VI),提供最优策略学习及理论保证。

04:00
arXiv cs.LG

超越单回合优化:面向长期广告效果的滑窗感知生成式自动出价

提出SWAG-Bid滑窗感知生成式自动出价框架,解决跨日耦合,兼顾约束与价值获取。

04:00
arXiv cs.LG

桥接计算最优与数据最优的预训练

提出CD缩放定律,用token有效性函数量化派生数据价值,发现其随模型和参数比变化并饱和,挑战经典计算最优分配。

04:00
arXiv cs.LG

HeAD-CP: 面向图神经网络的异构感知扩散共形预测集

针对图异质性,提出HeAD-CP扩散变体,通过无标签局部同质性估计调整系数,显著优化异质图共形预测性能。

04:00
arXiv cs.LG

深度表示学习何时有助于单细胞聚类?针对生物医学AI管道的敏感性感知诊断基准

深度学习在小规模或多批次数据中更优,经典PCA仍有效,调优超参数是关键。

04:00
arXiv cs.LG

利用优化器导出几何引导后验探索

提出利用优化器导出的几何作为预条件采样,消除燃烧阶段,提升稳定性与不确定性量化,且无额外开销。

04:00
arXiv cs.LG

Stiefel流形上的无收缩优化及其在LoRA微调中的应用

提出无收缩无惩罚参数的Stiefel流形优化算法,用于LoRA微调,加速训练并提升下游性能。

04:00
arXiv cs.LG

打破周期性假设:基于图谱低秩学习的鲁棒张量多视图聚类

揭示现有张量多视图聚类对样本排序的周期假设依赖性,提出图谱低秩学习框架消除依赖,实现鲁棒聚类。

04:00
arXiv cs.LG

知风:仅利用局地稀疏观测实现实时轮毂高度风场重建

提出Zhinv框架,利用局地稀疏观测实时重建精细风场,误差较克里金法降低约66%,高效准确评估风资源。

04:00
arXiv cs.LG

使用模拟联邦学习的慢性肾脏病预测的可解释AI

本研究采用联邦学习与可解释AI,通过投票分类器和网格搜索优化模型,全局准确率99%,助力慢性肾脏病早期诊断。

04:00
arXiv cs.LG

Raven:基于稀疏记忆路由的高召回序列建模

Raven通过稀疏记忆路由仅更新选中子集,平衡密集写入干扰与固定窗口硬驱逐,实现高效长上下文高召回。

04:00
arXiv cs.LG

重新思考似然分布:学生t似然提升贝叶斯神经网络性能

学生t似然显著提升BNN预测性能,不依赖数据与架构,训练更快且易实现。

04:00
arXiv cs.LG

SPARC:基于仿射回归与反事实从分割到预测

用反事实解释替代SMOTE生成合成数据,结合分段仿射分类,B2B交易倾向预测精确率达93.1%。

04:00
arXiv cs.LG

TWICE:在线广告中长周期转化预测的双时钟双窗口学习

双时钟互补监督,分解转化率与延迟分布,有效提升广告收入与转化率。

04:00
arXiv cs.LG

学得的、依赖的还是必要的?——分离层图神经网络中的检查点依赖与任务级价值

本文区分检查点依赖与任务价值,证明层GNN学到的限制映射多为可替代的拟合,并非必要边缘几何,验证需结合重训练。

04:00
arXiv cs.LG

比特与记忆:量化大模型中逐字提取的测量

量化选择性遗忘训练数据,但不足以防御隐私;模型越大,保留的逐字记忆越多。

04:00
arXiv cs.LG

PIcsC: 分区引起的协变量偏移校正

提出PIcsC框架,用Fisher信息正则化校正分区偏移,在40+数据集上性能提升,联邦学习超越FedAvg等基线3-5百分点。

04:00
arXiv cs.LG

约束在线凸优化的数据依赖遗憾与Polyak校正

通过保留梯度积累和Polyak校正获得更紧凑遗憾界,自适应方法AdaOGD-PFS将遗憾改进38-43%。

04:00
arXiv cs.LG

基于累计熵的反后门核心集选择

利用累计熵选择良性核心集,高效防御后门攻击,且几乎不影响自然性能。

04:00
arXiv cs.LG

随机波动下的潜在状态涌现计算

随机波动下模型涌现两阶段潜在状态计算,Transformer中可解码性出现于特定阶段,退化源于读取错位。

04:00
arXiv cs.LG

重尾噪声下随机优化的量子加速

提出了重尾噪声下低维量子均值估计器及量子SGD方法,在低维区域查询复杂度优于经典最优下界。

04:00
arXiv cs.LG

AMPBench-MT:面向抗菌肽效力、谱系及安全性预测的同源性控制基准

AMPBench-MT基准揭示识别性能不反映实验指标,呼吁端点感知评估。

04:00
arXiv cs.LG

发展学习框架下用于持续、可理解视觉识别的多尺度结构特征

本文通过多尺度结构特征提升无梯度发展学习框架的视觉识别准确率,实现持续学习且保留可解释性。

04:00
arXiv cs.LG

OrthKD:从异构教师中提取泛化临床知识以支持轻量部署

OrthKD框架从强CNN完整监督、弱ViT特征蒸馏,正交投影促互补,提升轻量DR筛查模型泛化性与鲁棒性。

04:00
arXiv cs.LG

留意缺失分裂:用随机森林解决群智学习中的特征异质性

针对群智学习随机森林的特征异质性,提出多种推断策略解决缺失分裂,性能超越基线。

04:00
arXiv cs.LG

工具不是孤岛:通过查询条件超边预测实现LLM代理的集合级工具检索

提出HYSET方法,将工具检索视为超图条件超边预测,捕获集合级联合效用,显著提升检索与任务成功率。