超越流形假设:面向流匹配的混合谱参数化
提出混合谱参数化,自适应时间与数据协方差方向,跨架构稳健、加速优化且几乎不增训练成本。
PolyStepOR:无需最优决策即可学习决策
PolyStepOR 无需最优参考决策与梯度,借扰动评估和最优传输直接优化实际决策成本,支持约束预测并具理论保证。
TimeES:基于演化谱的概率性与确定性时间序列预测
TimeES借演化谱理论,将非平稳序列建模为随机变量调制的演化谱表示,高效实现概率与确定性预测领先。
利用机器学习探究空腹血糖的预测因素:昼夜节律时机与年龄交互作用的洞见
基于NHANES数据,可解释机器学习预测空腹血糖,糖化血红蛋白主导,昼夜节律与年龄交互作用弱但值得研究。
HoTS:用于图神经网络校准的同配性感知温度缩放
提出同配性感知温度缩放HoTS,用局部同配性和logit熵为节点分配温度,提升GNN节点分类校准。
并行扫描下的长度无关状态跟踪
提出NFSM:非仿射可并行扫描RNN,有限精度下实现长度无关状态跟踪,突破仿射模型限制。
面向参数恢复的神经似然符号蒸馏
面向参数恢复,将神经似然蒸馏为可解释符号表达式,扩散决策模型上加速超百倍且保精度,可用于贝叶斯层次推断。
重新思考大语言模型强化学习中的训练-推理不匹配:根源与纠正
针对大语言模型RLVR训练-推理概率不匹配,提出校准重要性采样CIS,以置信感知截断校正,实验更优。
回写Δ:以全新表示重访同一词元
ReFlux回写层间深度增量Δ重访同一词元,动态组合反馈路径,降低困惑度并提升推理准确率。
将非平稳多输出高斯过程适配于贝叶斯优化
提出MOLRN-BO,将非平稳多输出高斯过程适配于多目标贝叶斯优化,在12个基准上提升性能与稳健性。
潜在预测车辆表征保留了什么?测量状态、几何与局部响应
提出协议分测潜预测车辆表征的保留、预测与局部响应;其保留状态,但命令响应偏离模拟器。
Bison:面向未见化合物扰动预测的跨数据集学习
提出跨数据集联合训练模型Bison,利用药物对比监督预测未见化合物扰动,药物差异相关性提升27.4%。
论言语化置信度先验在大型推理模型校准中的陷阱
LRM置信先验集中于少数高值,抑制RL校准;CalibSFT先塑造校准先验,降低校准误差并提升判别力。
SoFT:面向可泛化大语言模型微调的软目标
提出SoFT软目标微调,通过最小KL改动平衡演示学习与基座能力,提升分布内与分布外泛化。
联邦LoRA应共享什么?基于输入感知子空间对齐的FedSAIL
FedSAIL以输入二阶矩构建动作矩阵,其右奇异主子空间跨客户端对齐,据此正则本地训练并保留客户端系数,提升性能、降低通信。
神经动力学即量化单元的组合
提出"量子"抽象:训练是按需求与条件复杂度有序获取可复用计算单元,可解释宏观损失与缩放律。
Rondo:无监督发现重复性时间结构
Rondo 无监督发现连续时间流中层级的重复结构,动态扩展单元词表,在少数据与持续流中优于基线。
大型强子对撞机上快速精确的基于学习的带电粒子轨迹回归
提出双向门控线性循环编码器,带电粒子轨迹回归达经典拟合全精度,GPU推理加速,降低LHC计算成本。
面向一次训练、多预算导出的弹性选择性谱混合模型
ESSH融合选择性谱混合与滑窗注意力,联合训练多容量,一次训练多预算导出,质量近同级且解码加速。
Kolmogorov-Arnold网络与多层感知机中的Fisher简单性
KAN与MLP的Fisher简单性:死ReLU一致,KAN系数大小不能作剪枝准则,多层需有效路径。
随机策略基线缺失下,程序化生成泛化差距究竟衡量了什么?动作规则、收敛性与缺失的随机下限
强化学习泛化差距常缺参照,应报告同关卡随机策略下限;动作规则与收敛口径会显著改变结论。
激活流:为引导而制造激活
ActFlow无需微调,仅凭k个正确标签合成激活,将沙袋式锁定模型的准确率从0.05提升至0.85。
共享自回归上下文可能扭曲合成数据中的变量关系
大模型批量生成使前序答案成上下文,扭曲合成数据变量关系并夸大相关性,请求构造影响数据效度。
Transolver 真的需要 Transformer 吗?
该模型无需 Transformer,切片/反切片全局混合才是关键,并提出高效实现。
CAESAR:通过自主嵌入空间凝聚式重组进行聚类
无需预设簇数K,CAESAR重组预训练嵌入空间,拉近互近邻、推开非近邻,文本与图像聚类均超越强基线。
优先进行重复式LLM评估以发现隐藏故障
预算约束下先浅评,再依据失败倾向优先深查零失败提示,显著提升隐藏故障发现。
被困于自身的采样轨迹:理解联邦在线策略蒸馏中的聚合—采样反馈
联邦在线蒸馏受聚合延迟拖累,学习率敏感掩盖协作收益;提出FedTOPS自适应更新,六项推理基准提升4.56–14.57个百分点。
组合式目标:在结构中学习结构
提出组合目标,测量图像部件与交互;观察者所见比关系标记更关键,谱多样性、可预测性、下游效用各自独立。
学习年龄:预测误差的时间持续性作为学习信号
提出“学习年龄”,度量预测错误的持续时间,区分持续欠学习与短暂失误,用于离线与流式训练的样本重加权。
DimPO:基于偏好优化的注意力降维
DimPO以偏好优化加top-k交叉熵离线学习Q/K投影,降注意力维度;实验表明保留关键注意力排序与集中度比复现完整分布更重要。
时间步加权:实现有效基于ELBO的流匹配强化学习的隐藏关键
研究ELBO流匹配强化学习的时间步加权,发现其有效权重取决于奖励与学习阶段,并提出更优加权策略。
直觉向量
冻结视觉模型嵌入的潜在向量算术可支持跨领域隐式规则推理,无需微调或生成模型。
并非每一项都增添新结构:面向符号回归的 Sobolev 新颖性
提出项级Sobolev新颖性度量与无调参阈值,识别结构冗余,揭示符号回归差距,并可插件提升性能。
联合学习图结构与节点嵌入:面向异配节点分类的分类器无关重连
亲和度引导重连,联合估计图与嵌入,输出分类器无关的重连图与节点嵌入,异配分类平均提升5.8点
AnchorRep:通过表征排斥防御大语言模型跨模型对抗迁移
AnchorRep以表征排斥,让有害提示内部表征远离锚模型,跨模型迁移攻击成功率降至1.1%以下。
稳定动态低秩训练
提出SDLRT,通过补偿被忽略的奇异方向并稳定秩,解决动态低秩训练高压缩崩溃问题。
面向最大公共边子图的等变神经原始-对偶分配
提出ENPDA,学习共享等变原始-对偶匹配策略,无需重训即可求解最大公共边子图,速度快约千倍且精度提升。
基于约束经验权重分布的量化感知预训练
提出无超参无内存开销的CEWT,约束权重经验分布为零均值高斯,抑制量化预训练振荡噪声,降低困惑度。
基于随机算子草图的极快紧凑二值图表示
超快二值图哈希:随机列采样近似高阶结构并标签安全传播;十数据集精度超无特征基线,亚秒生成适配脉冲网络
Distance-KV:利用相对距离实现高效长上下文推理
Distance-KV按层、注意力头和相对距离学习静态KV保留模式,免在线打分,128K下内存降65.4%、解码提速1.66倍,性能领先。
复用还是重学?地球观测基础模型的谱视角
谱诊断显示:地球观测模型微调时更新更大、保留预训练结构更少;预训练子空间保留处,少量参数微调即可媲美全量微调。
SIFT:通过语义不变性与结构保真度微调增强时间序列基础模型
提出SIFT,用语义不变对抗增强与组件结构保真微调,缓解过拟合和均值陷阱,显著提升TSFM性能。
STAMP:无需目标数据预测分布外泛化能力
STAMP无需目标数据,仅用源域图像估计OOD性能:胸片相关性0.85,ImageNet上0.98。
同家族同策略蒸馏的缩放特性
研究同家族同策略蒸馏的缩放规律:弱到强迁移中学生峰值可超教师,峰值与迁移斜率服从幂律。
GUI 并非状态:诊断 GUI 世界模型中的状态混叠
GUI 世界模型仅凭可见界面会导致状态混叠;提出诊断基准与轻量状态恢复,可提升预测与下游性能。
BiasReducer:面向奖励模型的自适应偏差缓解
BiasReducer 轻量编辑奖励模型线性头,自适应选择并消减表面属性偏差,提升鲁棒性,减少冗长与迎合。
预测AI相关主要半导体企业供应链风险的财务影响:一种异构图补丁Transformer方法
提出异构图补丁Transformer,融合基本面与贸易、事件信号,预测116家AI半导体企业未来1-2季度财务变化,误差最低。
大规模脑电基础模型基准评测:来自两万次评估的经验
EEG-Arena 基准显示,脑电基础模型多数任务优于监督基线,扩大预训练数据是持续提升的关键方向。
结合情景记忆与在线策略学习的自演化时间序列预测智能体
提出自演化智能体FASE,以情景记忆和在线策略学习将反馈转为经验,无需更新LLM参数,MAE降9.1%。
弱通信下的分布鲁棒平均奖励强化学习:有限样本保证
研究弱通信下分布鲁棒平均奖励强化学习,给出有限样本保证与近优策略样本复杂度,覆盖多种不确定性集。