11282 条条目 · 106 个活跃源
2026年9月30日
04:00
arXiv cs.LG

超越流形假设:面向流匹配的混合谱参数化

提出混合谱参数化,自适应时间与数据协方差方向,跨架构稳健、加速优化且几乎不增训练成本。

04:00
arXiv cs.LG

PolyStepOR:无需最优决策即可学习决策

PolyStepOR 无需最优参考决策与梯度,借扰动评估和最优传输直接优化实际决策成本,支持约束预测并具理论保证。

04:00
arXiv cs.LG

TimeES:基于演化谱的概率性与确定性时间序列预测

TimeES借演化谱理论,将非平稳序列建模为随机变量调制的演化谱表示,高效实现概率与确定性预测领先。

04:00
arXiv cs.LG

利用机器学习探究空腹血糖的预测因素:昼夜节律时机与年龄交互作用的洞见

基于NHANES数据,可解释机器学习预测空腹血糖,糖化血红蛋白主导,昼夜节律与年龄交互作用弱但值得研究。

04:00
arXiv cs.LG

HoTS:用于图神经网络校准的同配性感知温度缩放

提出同配性感知温度缩放HoTS,用局部同配性和logit熵为节点分配温度,提升GNN节点分类校准。

04:00
arXiv cs.LG

并行扫描下的长度无关状态跟踪

提出NFSM:非仿射可并行扫描RNN,有限精度下实现长度无关状态跟踪,突破仿射模型限制。

04:00
arXiv cs.LG

面向参数恢复的神经似然符号蒸馏

面向参数恢复,将神经似然蒸馏为可解释符号表达式,扩散决策模型上加速超百倍且保精度,可用于贝叶斯层次推断。

04:00
arXiv cs.LG

重新思考大语言模型强化学习中的训练-推理不匹配:根源与纠正

针对大语言模型RLVR训练-推理概率不匹配,提出校准重要性采样CIS,以置信感知截断校正,实验更优。

04:00
arXiv cs.LG

回写Δ:以全新表示重访同一词元

ReFlux回写层间深度增量Δ重访同一词元,动态组合反馈路径,降低困惑度并提升推理准确率。

04:00
arXiv cs.LG

将非平稳多输出高斯过程适配于贝叶斯优化

提出MOLRN-BO,将非平稳多输出高斯过程适配于多目标贝叶斯优化,在12个基准上提升性能与稳健性。

04:00
arXiv cs.LG

潜在预测车辆表征保留了什么?测量状态、几何与局部响应

提出协议分测潜预测车辆表征的保留、预测与局部响应;其保留状态,但命令响应偏离模拟器。

04:00
arXiv cs.LG

Bison:面向未见化合物扰动预测的跨数据集学习

提出跨数据集联合训练模型Bison,利用药物对比监督预测未见化合物扰动,药物差异相关性提升27.4%。

04:00
arXiv cs.LG

论言语化置信度先验在大型推理模型校准中的陷阱

LRM置信先验集中于少数高值,抑制RL校准;CalibSFT先塑造校准先验,降低校准误差并提升判别力。

04:00
arXiv cs.LG

SoFT:面向可泛化大语言模型微调的软目标

提出SoFT软目标微调,通过最小KL改动平衡演示学习与基座能力,提升分布内与分布外泛化。

04:00
arXiv cs.LG

联邦LoRA应共享什么?基于输入感知子空间对齐的FedSAIL

FedSAIL以输入二阶矩构建动作矩阵,其右奇异主子空间跨客户端对齐,据此正则本地训练并保留客户端系数,提升性能、降低通信。

04:00
arXiv cs.LG

神经动力学即量化单元的组合

提出"量子"抽象:训练是按需求与条件复杂度有序获取可复用计算单元,可解释宏观损失与缩放律。

04:00
arXiv cs.LG

Rondo:无监督发现重复性时间结构

Rondo 无监督发现连续时间流中层级的重复结构,动态扩展单元词表,在少数据与持续流中优于基线。

04:00
arXiv cs.LG

大型强子对撞机上快速精确的基于学习的带电粒子轨迹回归

提出双向门控线性循环编码器,带电粒子轨迹回归达经典拟合全精度,GPU推理加速,降低LHC计算成本。

04:00
arXiv cs.LG

面向一次训练、多预算导出的弹性选择性谱混合模型

ESSH融合选择性谱混合与滑窗注意力,联合训练多容量,一次训练多预算导出,质量近同级且解码加速。

04:00
arXiv cs.LG

Kolmogorov-Arnold网络与多层感知机中的Fisher简单性

KAN与MLP的Fisher简单性:死ReLU一致,KAN系数大小不能作剪枝准则,多层需有效路径。

04:00
arXiv cs.LG

随机策略基线缺失下,程序化生成泛化差距究竟衡量了什么?动作规则、收敛性与缺失的随机下限

强化学习泛化差距常缺参照,应报告同关卡随机策略下限;动作规则与收敛口径会显著改变结论。

04:00
arXiv cs.LG

激活流:为引导而制造激活

ActFlow无需微调,仅凭k个正确标签合成激活,将沙袋式锁定模型的准确率从0.05提升至0.85。

04:00
arXiv cs.LG

共享自回归上下文可能扭曲合成数据中的变量关系

大模型批量生成使前序答案成上下文,扭曲合成数据变量关系并夸大相关性,请求构造影响数据效度。

04:00
arXiv cs.LG

Transolver 真的需要 Transformer 吗?

该模型无需 Transformer,切片/反切片全局混合才是关键,并提出高效实现。

04:00
arXiv cs.LG

CAESAR:通过自主嵌入空间凝聚式重组进行聚类

无需预设簇数K,CAESAR重组预训练嵌入空间,拉近互近邻、推开非近邻,文本与图像聚类均超越强基线。

04:00
arXiv cs.LG

优先进行重复式LLM评估以发现隐藏故障

预算约束下先浅评,再依据失败倾向优先深查零失败提示,显著提升隐藏故障发现。

04:00
arXiv cs.LG

被困于自身的采样轨迹:理解联邦在线策略蒸馏中的聚合—采样反馈

联邦在线蒸馏受聚合延迟拖累,学习率敏感掩盖协作收益;提出FedTOPS自适应更新,六项推理基准提升4.56–14.57个百分点。

04:00
arXiv cs.LG

组合式目标:在结构中学习结构

提出组合目标,测量图像部件与交互;观察者所见比关系标记更关键,谱多样性、可预测性、下游效用各自独立。

04:00
arXiv cs.LG

学习年龄:预测误差的时间持续性作为学习信号

提出“学习年龄”,度量预测错误的持续时间,区分持续欠学习与短暂失误,用于离线与流式训练的样本重加权。

04:00
arXiv cs.LG

DimPO:基于偏好优化的注意力降维

DimPO以偏好优化加top-k交叉熵离线学习Q/K投影,降注意力维度;实验表明保留关键注意力排序与集中度比复现完整分布更重要。

04:00
arXiv cs.LG

时间步加权:实现有效基于ELBO的流匹配强化学习的隐藏关键

研究ELBO流匹配强化学习的时间步加权,发现其有效权重取决于奖励与学习阶段,并提出更优加权策略。

04:00
arXiv cs.LG

直觉向量

冻结视觉模型嵌入的潜在向量算术可支持跨领域隐式规则推理,无需微调或生成模型。

04:00
arXiv cs.LG

并非每一项都增添新结构:面向符号回归的 Sobolev 新颖性

提出项级Sobolev新颖性度量与无调参阈值,识别结构冗余,揭示符号回归差距,并可插件提升性能。

04:00
arXiv cs.LG

联合学习图结构与节点嵌入:面向异配节点分类的分类器无关重连

亲和度引导重连,联合估计图与嵌入,输出分类器无关的重连图与节点嵌入,异配分类平均提升5.8点

04:00
arXiv cs.LG

AnchorRep:通过表征排斥防御大语言模型跨模型对抗迁移

AnchorRep以表征排斥,让有害提示内部表征远离锚模型,跨模型迁移攻击成功率降至1.1%以下。

04:00
arXiv cs.LG

稳定动态低秩训练

提出SDLRT,通过补偿被忽略的奇异方向并稳定秩,解决动态低秩训练高压缩崩溃问题。

04:00
arXiv cs.LG

面向最大公共边子图的等变神经原始-对偶分配

提出ENPDA,学习共享等变原始-对偶匹配策略,无需重训即可求解最大公共边子图,速度快约千倍且精度提升。

04:00
arXiv cs.LG

基于约束经验权重分布的量化感知预训练

提出无超参无内存开销的CEWT,约束权重经验分布为零均值高斯,抑制量化预训练振荡噪声,降低困惑度。

04:00
arXiv cs.LG

基于随机算子草图的极快紧凑二值图表示

超快二值图哈希:随机列采样近似高阶结构并标签安全传播;十数据集精度超无特征基线,亚秒生成适配脉冲网络

04:00
arXiv cs.LG

Distance-KV:利用相对距离实现高效长上下文推理

Distance-KV按层、注意力头和相对距离学习静态KV保留模式,免在线打分,128K下内存降65.4%、解码提速1.66倍,性能领先。

04:00
arXiv cs.LG

复用还是重学?地球观测基础模型的谱视角

谱诊断显示:地球观测模型微调时更新更大、保留预训练结构更少;预训练子空间保留处,少量参数微调即可媲美全量微调。

04:00
arXiv cs.LG

SIFT:通过语义不变性与结构保真度微调增强时间序列基础模型

提出SIFT,用语义不变对抗增强与组件结构保真微调,缓解过拟合和均值陷阱,显著提升TSFM性能。

04:00
arXiv cs.LG

STAMP:无需目标数据预测分布外泛化能力

STAMP无需目标数据,仅用源域图像估计OOD性能:胸片相关性0.85,ImageNet上0.98。

04:00
arXiv cs.LG

同家族同策略蒸馏的缩放特性

研究同家族同策略蒸馏的缩放规律:弱到强迁移中学生峰值可超教师,峰值与迁移斜率服从幂律。

04:00
arXiv cs.LG

GUI 并非状态:诊断 GUI 世界模型中的状态混叠

GUI 世界模型仅凭可见界面会导致状态混叠;提出诊断基准与轻量状态恢复,可提升预测与下游性能。

04:00
arXiv cs.LG

BiasReducer:面向奖励模型的自适应偏差缓解

BiasReducer 轻量编辑奖励模型线性头,自适应选择并消减表面属性偏差,提升鲁棒性,减少冗长与迎合。

04:00
arXiv cs.LG

预测AI相关主要半导体企业供应链风险的财务影响:一种异构图补丁Transformer方法

提出异构图补丁Transformer,融合基本面与贸易、事件信号,预测116家AI半导体企业未来1-2季度财务变化,误差最低。

04:00
arXiv cs.LG

大规模脑电基础模型基准评测:来自两万次评估的经验

EEG-Arena 基准显示,脑电基础模型多数任务优于监督基线,扩大预训练数据是持续提升的关键方向。

04:00
arXiv cs.LG

结合情景记忆与在线策略学习的自演化时间序列预测智能体

提出自演化智能体FASE,以情景记忆和在线策略学习将反馈转为经验,无需更新LLM参数,MAE降9.1%。

04:00
arXiv cs.LG

弱通信下的分布鲁棒平均奖励强化学习:有限样本保证

研究弱通信下分布鲁棒平均奖励强化学习,给出有限样本保证与近优策略样本复杂度,覆盖多种不确定性集。