基于KL散度的轨迹正则化随机最优控制
提出轨迹正则化随机最优控制,将轨迹KL散度转化为二次漂移惩罚,保持动态规划结构,导出HJB方程,LQ有闭式解,参数平衡性能与参考。
剩余使用寿命与故障模式预测的通用价值函数
提出基于向量GVF与TD(n,λ)的预测方法,优于传统监督法,尤其适用于标签稀缺场景。
用于多主体时空数据分析的变分低秩张量分解
提出ST-VTD框架,融合LL1低秩空间与LSTM时间先验,经摊销变分推断与组ICA预热,有效提升多主体fMRI因子恢复。
Hopformer:面向时间序列预测的同质性追求Transformer
提出两阶段框架:SPA提取共同趋势,LoRA微调Transformer建模残差,理论保证且MASE平均提升6.56%。
利用异方差神经网络学习双向因果交互
提出SEM-DNN方法,通过条件协方差对角化识别双向因果,无需外部工具,有效恢复结构效应。
QC-PHAST搜索:有限池稀有区域发现的经典-量子查询基准
QC-PHAST是一种证据门控的查询核算协议,用于判断有限池中经典或量子搜索的适用性。
通用BCI个性化:面向冻结EEG骨干和基础模型的单一API
提出骨干无关的EEG个性化API,低成本适配多种冻结骨干,效果接近微调。
通过极分解的奇异值软阈值方法
通过极分解计算奇异值软阈值,GPU显著加速,但仅适合低精度应用。
PinEqualizer:Pinterest全漏斗内容探索与去偏系统
提出全漏斗内容探索去偏方案,减少现有内容偏好,提升新鲜内容探索与用户参与度。
异构不平衡临床数据上的联邦学习策略死亡预测基准比较
FedProx在AUC-ROC和AUC-PR上最优,但集中式模型仍略优;需关注客户端异质性。
基于需求学习与履约成本的在线定价与分配
提出OCSAA算法联合定价与库存,实现√T遗憾界,整合统计学习与运筹优化。
空间增强的时间融合变换器:面向时变输入参数动力系统的可解释多输出预测
提出SE-TFT扩展TFT实现多输出预测,可解释注意力权重揭示时空相关性。
把握时机:面向联邦学习关键学习期的基于合同的激励机制
提出R3T框架,针对联邦学习关键学习期设计合同激励,减轻信息不对称,提升云效用,训练速度提升2-3倍。
说话人相关的嗓音疲劳模型的元学习方法
将说话人自适应重构为元学习问题,三种方法均优于传统模型,Transformer性能最强。
基于图的相关系数矩阵生成:一种凸优化方法
提出凸优化框架生成图结构稀疏相关矩阵,可调控非对角均值,用于图形模型推断基准测试。
Reflector:面向样本作曲的编排感知和声检索
Reflector用间隔类预言机和学习嵌入实现编排感知和声检索,实时跟踪和声变化,三维空间揭示结构性关系,嵌入保留预言机判断并覆盖全库。
HD3C:面向边缘设备的高效医疗数据分类
HD3C轻量分类框架用于边缘设备,节能350倍且准确率损失<1%,鲁棒性强。
Eluder维度:局部化它!
提出广义线性模型eluder维下界,引入局部化方法获得一阶遗憾界,改进伯努利bandit与强化学习结果。
LiMuon:面向大模型的轻量快速Muon优化器
提出LiMuon优化器,基于动量方差减少和随机SVD,降低内存与样本复杂度,理论证明O(ε⁻³)收敛,实验验证有效。
安全的上下文强化学习
首次提出SCARED方法,在无参数更新下实现安全上下文强化学习,确保累计代价不超预算,并自适应安全预算。
利用模型曲率关联DP-SGD的跨迭代噪声
提出NoiseCurve,利用模型曲率优化跨迭代噪声关联,显著提升DP-SGD精度。
Transformer中的数值脆弱性:一种用于风险估计和选择性稳定的逐层理论
提出逐层分解输出失配,推导风险估计与BGSS控制器,实验验证有效控制低精度执行误差。
AdamNX:一种基于新型二阶矩估计指数衰减机制的Adam改进算法
提出AdamNX,使用时变二阶矩衰减率,使训练平台期更新趋近动量SGD,在图像分类、目标检测、语义分割上验证。
gp2Scale:一类紧支撑非平稳核函数与分布式计算,实现千万数据点上的精确高斯过程
提出gp2Scale,利用紧支撑非平稳核识别稀疏结构,实现千万数据点精确高斯过程,无需近似且可定制。
使用强化学习将天气和气候模型中的可调参数替换为状态依赖函数
用强化学习在线学习状态依赖参数化替代固定参数,在理想化测试中提升模型精度且物理合理。
多模态CoLRAG-TF:面向复杂PDF的三重过滤检索
提出四轴融合架构,通过三重过滤与贝叶斯优化,在复杂PDF上实现高效多跳推理,召回率达0.9909,答案相似度提升71.6%。
CLOE:基于Christoffel损失的异常检测自动编码器
CLOE结合自编码器与Christoffel函数,通过新损失函数引导表征学习,实现高效高维异常检测。
利用大语言模型扩展闭环特征通道配置
扩展采样后精度线性提升,参数效率显著优化,发现了非幂2通道及结构化分配规律。
循环Transformer中的自适应深度:诊断学习型暂停门与轨迹读出
研究发现,固定先验深度监督优于联合训练门控,后验置信读出更有效,失败源于轨迹形成而非门表达能力。
主动SAE特征平面是否携带更多Holonomy?Gemma中的预注册反转
主动特征平面Holonomy低于混合特征控制,调整后对数对比-0.294,预测被证伪。
生成式贝叶斯滤波用于状态估计
GBF框架用条件变分自编码器替代线性观测模型,通过贝叶斯更新与分数采样提升状态估计精度与鲁棒性。
PhantomFill:当表单要求答案时,语言模型会编造一个
表单必填字段导致模型普遍编造答案,多数无视“证据不足”选项,指令也被覆盖,仅前沿模型能正确拒绝。
多LLM系统中基于结构化专家判断的不确定性感知信任估计
提出Cooke加权信任估计,处理多LLM异质性与污染,实现聚合准确性与可靠性平衡。
DataPrep-Bench:大语言模型训练数据准备能力基准测试
首个统一评估LLM数据构建与质量评估的基准,新方法在多个领域显著领先。
Muon优化器“顿悟”的关键成分
Muon快速顿悟源于正交化(Newton-Schulz迭代),非谱范数;减少迭代可加速但降低稳定性。
Codec-Gauge:学习压缩友好的Transformer KV缓存度量
介绍后训练缓存坐标层Codec-Gauge,通过学习正交变换优化KV缓存压缩,平均降低44%的KL散度。
观点:停止被动修补模型,开启主动测试驱动AI开发
主张主动测试驱动AI开发,构建测试空间,数学证明其长期扩展更优、迭代更少。
当RLVR缩小推理边界:诊断Pass@k反转
RLVR提升单样本准确率但导致Pass@k反转,根源是丢失基础模型稀有正确轨迹,PBA方法可缓解。
ReliableTableQA:可靠性标注需要多少监督?
提出ReliableTableQA框架,表明仅需少量示例即可高效标注表格QA可靠性,GRPO仅在SFT不足时有益。
利用生物动力学知识先验实现数据稀缺的生物过程建模
数据稀缺下,将ODE知识以数据级预训练或架构级嵌入注入神经网络,两者性能相当且可替代,模拟预训练提供简单高效方案。
从原子到熵:凸域中扩散训练的最优噪声分配
发现扩散训练最优噪声调度集中于有限水平,解耦时采样密度正比于熵率平方根,显著提升效率。
通过决策感知机器学习改善基本药物获取
提出决策感知机器学习框架,在塞拉利昂全国部署,使基本药物消费增加19%,惠及约200万妇女儿童。
HypNO:双曲守恒律的图基物理信息神经算子
HypNO是图基神经算子,用物理信息消息传递处理激波,准确预测交通流模型解。
投资者观点落地:Black-Litterman模型中的神经谓词
神经谓词将金融数据映射为BL模型参数,以数据驱动替代主观不确定性,实现可解释与端到端学习。
一种面向零样本数字孪生的图神经网络方法
提出零样本数字孪生框架,结合热力学图神经网络与闭环数据同化,实现几何无关的实时物理模拟。
SenCos-GEM: SENet校准与余弦定律约束的几何增强分子表征用于性质预测
提出SenCos-GEM,融合余弦定律几何约束和SENet动态调制,在分子性质预测中实现SOTA,回归任务误差降低8%-13%。
自动编码器辅助下的地理空间与人口普查代理联合降尺度方法(JUGAAD)——以印度社会经济指标为例
JuGAAD框架融合人口普查与地理空间数据,经自编码器降维和回归映射,实现印度村级社会经济指标高精度预测。
SOAP、Muon及超越:推动大语言模型预训练规模扩展
改进了SOAP和Muon优化器,通过稳定化策略和分布式实现,在数十亿参数模型上超越AdamW,代码已开源。
SevDiff: 严重性条件扩散模型用于长尾冲突轨迹生成
SevDiff模型根据目标碰撞时间(TTC)生成轨迹,短TTC时命中率100%,长TTC时优雅退化,物理合理,精度高。
基于多智能体强化学习的退化监视下空中走廊冲突解决
基于DQN多智能体强化学习解决退化监视下空中走廊冲突,异构飞行器冲突1秒内解决,安全与容量权衡。