从下降方向学习:单侧Hölder正则性下的自适应梯度下降
基于单侧Hölder曲率估计的自适应梯度下降,非凸情形证明收敛,实验取得更低目标值和梯度范数。
地理分布式无服务器云中考虑SLA约束的碳感知路由
提出SLA约束碳感知路由策略,实测碳减排高达46.8%,平均27.4%,无SLA违反,扩展至12区域可达47.5%。
通过Logit Bias实现语言模型的极其简单的黑盒适配
无需调参或梯度,通过学习固定的logit偏差向量即可黑盒适配语言模型,提升推理性能。
MEMENTO:记忆引导的模因代码即策略进化
MEMENTO提出记忆引导的单精英模因进化框架,优化代码即策略,在长程具身任务中超越基线,并成功实现仿真到真实迁移。
从混合机理-数据驱动建模到神经符号AI:是什么、为什么和怎么做
H2N框架桥接混合建模与神经符号AI,导出SVR和BD两指标量化机理部分认知不确定性,案例验证有效。
相同预测,不同原因:量化对模型解释的影响
量化保留精度但改变模型推理,架构选择决定可解释性稳定性,DenseNet161最优。
基于图注意力网络的土壤微塑料和有机质空间预测
图注意力网络预测土壤微塑料与有机质,RMSE分别为625.06和0.43,表现优异但泛化受限,需增加样本密度。
截断布尔乘积分布的高效学习:影响力的关键作用
通过影响力分析截断集合几何,将参数估计样本复杂度降至对数阶,匹配无截断最优速率。
超越有向无环图:因果零和因果微分方程
本文提出因果零和因果微分方程,扩展结构因果模型,处理无方向约束和反馈循环,并给出扩展do-calculus。
Transformer优化中的隐藏边界运动:仿射权重与偏置更新的函数空间正交化
发现权重更新含类似偏置的边界运动,正交优化器提升Transformer验证准确率从81.68%至85.81%。
基于对抗逆强化学习的无标签工业故障检测:用于运行至失效预测的系统
提出AIRL框架,从状态转移中恢复健康奖励,无需标签,在多个基准上唯一实现非饱和后检测一致性。
面向长尾分布的频谱感知分析类增量学习
提出几何频谱矫正(GSR),通过各向异性频谱滤波解决长尾类增量学习中尾部类频谱坍塌,实现稳定与高效。
面向开放权重安全的分布特定曲率控制与有限样本保证
提出HarmAlign,通过功能保持谱变形局部化曲率控制,在有限样本下阻止有害微调并保持良性适应。
带静态与时变曝光下限的差异舍入公平赌博机
差异舍入法处理曝光下限,遗憾受非强制预算R控制达Θ(√KR)最优,并解决重叠组约束。
语言化粒子后验:自然语言假设上的贝叶斯推断
将语言化学习视为贝叶斯推断,用粒子代表自然语言假设,以MH或SMC更新,贝叶斯平均预测,提升性能并消除单次失败,后验可解读。
运动想象脑电跨被试分类中的贝叶斯完全池化
贝叶斯完全池化在跨被试脑电分类中可靠性无实际提升,计算成本高,部分池化更优。
Lean 4 grind中的学习型干预
在grind策略失败后触发学习干预,避免破坏已有证明,提升求解效率与速度。
有限时域马尔可夫决策过程中自然策略梯度的有限时间分析
首次证明有限时域MDP中NPG算法的有限时间收敛性:常数步长下子线性,递增步长下线性收敛。
中文标题:组合优化问题中动态规划计算过程的重用:一种储层计算方法
中文摘要:基于储层计算重用动态规划过程,实现组合优化问题间的计算共享,提升精度并缩短时间。
动态UBSR风险度量下马尔可夫决策过程的在线策略评估
提出UBSR-TD算法,实现动态UBSR风险下MDP的在线策略评估,具有收敛保证与线性函数逼近,实验验证有效。
通过指数倾斜的扩散引导搜索(DiffTilt):在安全关键系统证伪中的应用
DiffTilt通过指数倾斜扩散模型联合分布,以重要性采样放大失效概率,高效发现罕见故障。
合而为一:生成建模作为平均场博弈设计
通过MFG统一十二种生成模型,提出DI-Flow与MFGLab库,实验验证其有效性。
小批量噪声通过主导子空间波动降低锐度
本文揭示小批量SGD的梯度波动在主导子空间产生锐度修正项,加入该修正项使梯度下降法的锐度演化接近SGD。
联邦学习中的多智能体隐私博弈:一种统一平均场视角
本文提出平均场隐私博弈,统一加噪声与多智能体方法,实现个性化隐私保障与指数衰减隐私保证。
MixQuant: Adaptive Mixed-Precision Quantization for Large Language Models
Through the Bottleneck: How Multi-head Latent Attention Separates Content from Position in Language Models
Transformer的熵界:静态秩为何失效,注意力原生秩如何恢复
Transformer熵界:线性注意固有秩为最小容量下界,真实注意需注意力原生秩恢复,并界定可预测边界。
利用噪声学生在线策略自蒸馏的自增强视觉语言模型
提出NOPD自蒸馏方法,利用干净与受损输入预测差异自监督,无需外部模型,显著提升视觉语言模型性能。
基础模型与微调:迈向新一代时间序列预测模型
基础模型通过大规模预训练实现零样本时间序列预测,微调可进一步提升准确性。
StageGuard: 生理约束下的睡眠分期
提出生理约束的睡眠分期框架,减少异常转换56-62%,睡眠架构指标误差降低59-79%。
中文标题:面向信息物理系统异常检测的域先验正则化图建模
中文摘要:提出DPR-GM,利用大模型提取物理耦合作为图先验,结合数据相关性,在数据稀少的CPS中实现高效异常检测。
隐式策略梯度视角下的上下文学习
研究表明,分数条件化上下文学习等价于隐式策略梯度,自注意力机制可实现奖励加权聚合,且注意力权重与分数强相关。
XGRVFL-MV: 具有灵活守护损失的残差耦合图嵌入多视图随机向量函数链接网络
提出XGRVFL-MV模型,融合图嵌入与灵活守护损失,通过残差耦合增强多视图一致性,实现高效分类。
错误设计意图比没有更糟糕:CAD程序完成中头部条件设置的失序控制诊断
错误设计意图比无意图更糟,主动误导生成,伤害源于学习到的映射,独立指标揭示度量循环问题。
ParasGB:用于AMS电路寄生参数估计的图基准测试套件
首个开源图基准ParasGB,用于AMS电路预布局寄生参数预测,提供大规模RC网络与统一评估,助力可重复研究。
方差保持正交选择(VPOS):在PCA载荷空间中通过正交收缩进行贪心特征选择
VPOS在PCA载荷空间通过正交收缩贪心选择特征,重构误差最低且速度比图方法快10-140倍。
面向可信洪水预测的上下文感知概念蒸馏
提出CACD框架,将LSTM蒸馏为可解释水文概念模型,在5203个流域验证,平衡了准确性与透明度。
从分数学习到离散采样:扩散模型的端到端泛化分析
本文建立扩散模型端到端泛化分析,将生成误差分解为截断、离散化、泛化和优化四项,量化了样本量、网格和优化精度的影响。
FILLER: 通过潜在位置探索与检索的特征填补
提出FILLER方法,搜索生成模型潜在空间填补缺失值,证明收敛,实验结果优于现有方法。
方向性影响函数:在有约束学习中估计训练数据的影响
提出方向性影响函数(DIF),利用变分不等式约束,精准估计训练数据对模型影响,优于传统方法。
AlloBench:衡量LLM代理的在线工具分配能力
AlloBench基准显示,LLM在抽象分配中近乎最优,但无法迁移至脚本编写,表明在线工具分配是当前模型的能力边界。
基于异构轨迹的神经算子发现
无需显式标签,从异构轨迹联合学习神经算子与低维潜在表示,实现零样本外推与长期稳定预测。
单层自注意力模型中的(交换)遗憾损失训练:概率单纯形上的案例研究
遗憾损失训练单层自注意力模型实现无遗憾博弈均衡,新交换遗憾损失导出关联均衡。
图压缩能保持信号传播吗?
图压缩中,稀疏化保留信号多样性但轨迹偏离原图,粗化保持传播却导致平滑与秩坍缩,两种目标冲突。
SPRKD:通过鞍点区域近似实现深度神经网络的有效知识蒸馏
SPRKD将知识蒸馏从复制重构为利用鞍点区域进行学生重探索,在多个基准上超越基线,收敛至更宽极值点。
探索玻尔兹曼机在多数规则下应用于社会系统的生成能力
研究玻尔兹曼机生成能力,训练不同配置DBN,在多数规则下恢复临界系统,重构保持临界态。
论使用结果奖励时无偏且长度不变的策略优化的不可能性
证明在结果奖励+GRPO框架下,无法同时实现梯度无偏和长度不变,两者存在根本性权衡。
中文标题:基于市场状态感知的多模态融合社交情绪与技术特征的比特币价格方向预测
中文摘要:提出RAML模型,动态检测市场状态并自适应融合情绪与价格特征,在小时级比特币数据上提升预测性能,关键组件不可或缺。
深度何时能取代精度?量化神经计算的资源理论
深度替代精度需依库、时域、语义、路由而定,存在结构下限,误差率受时间依赖影响。
扩展傅里叶神经算子用于参数化与耦合PDE建模
通过超网络调制和系统架构探索,在基准PDE上误差降低55-72%。