面向智能服务的漂移稳定量子联邦学习
针对异构数据与噪声量子优化导致的客户端漂移与不公平问题,提出DUQFL-Prox框架,利用深度展开优化与近端项提升稳定性、泛化性和公平性。
元强化学习的拟蒙特卡洛初始化
QMC初始化在相似任务上加速训练,正交初始化在异质任务上更优。
依赖差距的测量:诊断表格生成模型中的列间保真度
提出依赖感知诊断,发现标准指标遗漏列间依赖差距,源于缺乏直接监督,且廉价干预无效。
调整速度作为非平稳强化学习的安全约束
通过预测适应需求并主动干预,该框架在非平稳环境中显著减少安全违规。
云原生评估即服务:具有共形保证的可扩展AI监控的微服务架构
提出云原生微服务架构EaaS,实现共形预测、漂移检测等可扩展AI评估,验证了理论保证与低延迟性能。
面向目标无关的偏微分方程联合嵌入预测控制
基于JEPA的目标无关PDE控制框架,用动能探针规划优于潜L2规划,显著提升Navier-Stokes精度。
逻辑门网络的深度可扩展性
提出输入锚定逻辑门网络,解决优化崩溃与拓扑限制,实现超100层深度稳定提升。
多时域一致性作为几何:潜在动力学何时收缩,何时不收缩
提高多步一致性权重λ使被动视频潜在动态收缩(扩张降80%、误差减半),但仅限特定任务,领域受限。
Molt: 一个可扩展的原生PyTorch智能体强化学习训练框架
Molt是轻量级开源PyTorch框架,性能媲美Megatron,便于算法全链路修改。
神经特征治理:扩展神经原子普适性
NAP框架通过贝叶斯方法实现节点级稀疏化(节点减至8%),同时保持准确性、可解释性与不确定性量化。
基于精确线性代数的浅层ReLU网络表示
证明n≤10时最大值可用两层ReLU精确表示,更大n时深度上界为log5(n)+1.5694,d≤9的连续分段线性函数也有两层表示。
面向O-RAN SLA风险预测的物理约束联邦加性模型
Monotone FedNAM用单调样条约束KPI物理方向,消除违规,形状一致性达1.00,上行流量减65%。
自适应OOD检测的自毒化阈值理论与可认证无标签校准
证明自适应OOD检测存在自毒化阈值,提出可认证校准,并揭示无标签时漂移与污染不可区分。
面向桥梁诊断代理的隐形因果编码:使用QLoRA的三重引导检索增强微调
提出损坏原因编码器,结合知识三元组与检索增强,QLoRA微调实现87%准确率,内存降低72%。
CARNet:周期条件核心聚合与再分配框架
CARNet以线性复杂度集成全局周期信息,高效建模跨变量依赖,多元时间预测性能领先。
为二次模型辩护
二次模型能预测LLM长达10%训练窗口的优化动态,Hessian谱与稳定性分析揭示其结构。
学习关键信息:用因果证据集监督稀疏注意力路由
注意力不等于因果依赖,用因果证据集训练稀疏注意力路由无需标注即可达教师精度。
贝叶斯与频率学派基于机器学习的模拟推断导论
概述贝叶斯与频率学派框架,介绍机器学习SBI方法用于参数估计、经验贝叶斯应用及验证局限。
通过反事实正确性界定机器学习辅助决策的因果影响
提出部分识别方法,利用反事实正确性等单调性假设,从先前RCT数据界定新模型的因果效应。
基于压缩内容选择的无参数自适应稀疏注意力
用gzip压缩比实现无参数自适应稀疏注意力,性能超越密集与固定稀疏模式,收敛快3.3倍。
RED-PIM:使用存内计算减少Transformer的数据移动
RED-PIM将注意力数据移动从O(N²)降至O(N),矩阵缩至d×d,推理延迟降幅最高达99.99%,长文档性能提升99.60%。
智能预测后稳健优化
提出鲁棒预测后优化方法应对特征扰动,理论证明误差指数衰减与Fisher一致性,实验显著优于标准方法。
生理信号作为说话人脸深度伪造检测的法医模态
利用rPPG生理信号检测说话人脸深度伪造,AUC达0.806,检测难度因生成方法而异。
基于图的异构道路网络交通信号控制接口
提出基于图神经网络的交通信号控制接口,通过共享打分与确定性矩阵转换相位,PPO实验验证其异构网络可行性。
使用固定深度符号回归搜索前馈神经网络权重更新规则空间
符号回归发现权重更新规则,30个基准中25个优于标准优化器,MSE平均降低44.47%。
LeAct:从专家行动中学习推理
提出LeAct方法,从专家行动中恢复隐含推理链,显著提升模型推理性能。
数据偏心性、高斯RBF再生核希尔伯特空间渐近性与核PCA
高斯RBF核在大带宽下渐近等距于欧氏空间,其PCA收敛于线性PCA,数据偏心性ρ可预测收敛行为。
表格数据上经典机器学习的缩放规律:一项基准研究
大规模课堂验证幂律缩放规律,树模型占优,模型族内指数近似共享,但实现存在差异。
静态与时变网络上的方差缩减Q学习
提出VRDQ分布式Q学习算法,通过共识实现线性加速,通信成本极低。
通过自适应互补增强补救异质性下基于粗化的GNN训练
ACE方法通过重建特征和各向异性正则化,结合自适应加权,提升异质图训练性能。
从扰动校正到几何感知采样:面向长尾学习中均衡平坦极小值的锐度引导均衡采样
提出锐度引导均衡采样(SGS),动态调整采样概率优化损失景观平坦性,显著提升长尾学习尾部类精度,训练时间仅增2%。
MissHyper:缺失性引导超图预测中的临床同步性恢复
通过恢复共时间戳上下文与缺失性引导门控,提升临床不规则时间序列多步预测效果。
RIS-Kernel:一种通过稀疏注意力实现长上下文大语言模型推理的模型无关架构
RIS稀疏注意力引擎降低复杂度至O(N log N),无需GPU即可在长上下文任务中超越密集基线。
LatentFlow:分子图神经网络潜在空间可视分析
LatentFlow通过追踪聚类变化,帮助科学家理解分子GNN潜在空间演化与化学模式。
MA-DAR:面向持续时序知识图谱推理的流形对齐动态自适应路由
提出MA-DAR框架,通过流形对齐与动态自适应路由缓解表示冲突,提升持续TKG推理性能。
多智能体辩论与视觉信息提取助力SeePhys Pro:ICML 2026 AI4Math第三赛道挑战赛一等奖技术报告
提出视觉信息提取与多智能体辩论两阶段框架,弥合图文模态差距,将公共集准确率从0.643提升至0.802,荣获第一名。
关于随机低秩自适应的收敛性分析
LoRA收敛分析:确定性需O(ε⁻⁴)次梯度,随机LoRA-NSGDM需O(ε⁻⁸)次,LoRA-STORM改进至O(ε⁻⁶)次。
上下文赌博机的跨域离线策略评估与学习
针对现有方法在少样本、确定性日志策略及新动作等难题,提出跨域设置,利用多源数据显著提升评估与学习效果。
潜变量PDE映射:在有限数据下跨几何的高效物理信息学习
提出潜PDE映射,通过变形梯度实现稀疏几何训练下的物理信息学习,在心电PDE中误差降低4-6倍,计算成本低。
能量流形自然梯度下降:神经PDE求解器的黎曼优化
提出EMNGD框架,在黎曼流形上优化神经PDE求解器,约束可行切向方向与回缩,实现高精度快速收敛。
DCS:一种用于跨模态版权侵权的统一条件敏感性检测框架
提出DCS框架,通过反事实条件分布偏移和双分支条件敏感性检测跨模态版权侵权。
CEL:全面反事实解释库与基准
首个统一的反事实解释库与基准,覆盖18个数据集与14种方法,实现公平可重复的定量评估。
无泄漏堆叠集成多类分类方法
提出LFS-FRAME框架,融合KAN与XGBoost,通过严格隔离训练验证数据防止泄漏,多类分类准确率达89.85%和81.74%。
使用患者感知采样预训练电子健康记录基础模型
提出患者采样预训练方法,控制训练信号分布,在MIMIC-IV上提升AUROC和AUPRC。
TriGlue:一种受生物学启发的生成模型,用于生成分子胶诱导的三元复合物
提出受生物学启发的生成框架TriGlue,将分子胶设计解耦为界面估计与条件生成两阶段,生成有效三元复合物。
面向公平自监督学习的无偏开放世界正则化
提出UOWReg,通过条件分布匹配确保表示与目标属性统计独立,有效缓解偏差并防止子群体崩塌。
从分数逼近到分布逼近:基于分数的扩散模型
证明分数逼近误差可控制生成分布的KL散度,并给出显式上界,建立理论连接。
IFCLoRA: 拓扑感知的秩分配方法用于参数高效微调
IFCLoRA在微调前利用信息流中心性分配秩,在低预算下提升大模型微调性能,优于LoRA等方法。
异常检测中不平衡情况下的评估指标见解
研究AUROC等四种指标在不平衡异常检测中的行为,通过指标景观图提供直观解释与比较指导。
类别平衡Softmax:基于贝叶斯理论的长尾识别方法
提出CBS方法,基于贝叶斯框架和幂律假设,有效缓解长尾识别中的偏好问题,性能优于现有方法。