延迟优化器状态传输塑造短视界训练决策
优化器状态延迟传输影响短视界训练决策:比即时导数更优,且依赖近未来数据顺序。
数据泄漏夸大了停电预测模型的泛化能力
停电预测评估受数据泄漏影响,随机分割性能虚高,时空留出法下预测精度大幅下降甚至不如基线,地理AI嵌入改进有限,需更现实评估与数据。
用于肿瘤学纵向患者表征与可扩展洞察生成的多模态基础模型
oFM多模态基础模型融合临床与分子病理数据,预测生存AUC达0.774,治疗获益评估效能提升三倍。
拟阵约束下的赌博机子模最大化:学习压缩交换策略
引入平衡分数交换,获一般拟阵约束下对抗性赌博机子模最大化的首个次线性遗憾算法
利用不变性导向预训练驯服基础模型,实现跨信号级、脑状态与脑健康任务的广谱脑电分析
提出面向不变性的脑电基础模型,用11000小时未标注脑电数据预训练,广谱评测领先,证明不变性学习是关键。
用于时间序列预测与异常检测的单状态更新预测编码训练
提出生成式与编码式预测编码网络并行训练,无需顺序传播,用于时间序列异常检测,实现稳定连续的在线学习。
固定计算预算下EEG基础模型的参数高效自监督适配
仅更新9%参数即可对齐目标任务,AUCPR提升20倍,仅用20-50%未标注数据,性能取决于窗口多样性。
流式数据的约束超参数优化
针对流式数据超参数优化,提出四种边界约束处理策略,实验证明优于传统边界策略。
MDTE:时间边事件上的少数类感知扩散用于类别不平衡节点分类
提出MDTE:条件扩散去噪重建时间边事件,选择性传播与多视角判别融合,显著提升少数类节点分类。
训练网络中对称性的参数级归因:基于逐参数函数敏感性
用参数敏感性判定函数对称可否提升到参数空间:需轨道切空间在其像内;最小二乘得两方向,但仅局部有效。
增强贝叶斯优化与主动学习的核多样性方法
提出KENDO框架,用核集成替代超参数采样,结合分歧感知采集策略,在优化和主动学习中性能更优,速度提升最高27倍。
在线学习与博弈中的最优交替遗憾
解决OLO/OCO交替遗憾最优界:单纯形上O(log d)常数,一般凸集O(d log(1+T/d)),并证匹配下界。
$(\text{DNN})^2$:深度神经网络的双重非负松弛
提出特征值最大化方案,为双重非负松弛网络验证提供全局最优证书,边界更紧,常达精确解。
超越均匀局部等距与拓扑:用于解耦表示的FactoMap
现有解耦方法忽略因子空间卷曲、坍缩、位置依赖几何;提出因子空间拓扑图在格上拓扑学习,保持连续并解耦。
LION:一种用于多模态属性图学习的克利福德神经范式
提出基于克利福德代数的LION范式,通过几何高阶传播对齐模态,并用自适应全息聚合完成融合,超越SOTA。
工具使用智能体何时停止?面向大语言模型的证据携带终止机制
证据携带终止机制用证书绑定证据与重放验证,在受控故障下实现零不安全终止,较基线大幅降低过早终止,且不损害有效完成率。
利用局部增强偏好与表示解耦改进跨问题车辆路径规划
提出局部增强偏好优化与渐进分层解耦编码,改进多任务车辆路径求解,平均差距降低21.3%,提升跨问题泛化。
基于符号分类的LHC限制在线BSM全局拟合
利用符号回归近似LHC限制,将ATLAS电弱ino搜索约束纳入pMSSM全局拟合,实现参数扫描中直接分类允许或排除区域。
有效学习率主导语言模型预训练中的损失动态
有效学习率决定预训练损失动态:匹配则损失轨迹重合,并解释延迟加速,统一学习率调度与范数控制。
控制中几何监督潜在世界模型的有限样本度量非坍缩
为非线性确定性系统建立有限样本学习控制理论,证明近似经验最小化可同时保证度量保真、动力学共轭与可靠规划。
InfoDPP-PAC:全切片图像分析的原则性斑块选择
提出原则性补丁选择框架,融合高斯过程与多样性优化,自适应减少83.7%补丁并保留97.9%质量。
鲁棒公平性审计的几何理论
提出几何框架分析邻域公平审计对扰动的稳健性,给出邻域不变条件并引入审计波动性度量。
BioKERN:面向组织学-转录组学邻域检索的生物核正则化方法
提出新框架,用转录组相似性与空间邻近构建生物学核,作为可学习偏置正则化嵌入,提升生物邻域检索,优于现有方法。
离线强化学习中边缘化重要性加权的保序贝尔曼校准
提出保序贝尔曼校准:对边缘化重要性加权估计做一维后处理,减少占用平衡违规,具有有限样本保证。
StateTune:将LLM辅助EDA流程调优转变为有状态闭环过程
将大模型辅助EDA调优转为有状态闭环,用持久内存与EHVI策略,在六个基准上取得最优超体积,内存贡献最大。
加速住宅太阳能系统采用:基于动态结构模型的政策分析
构建动态结构模型分析住宅光伏采用,发现限时补贴比长期补贴更能促进采用和减排,阶梯降价优于多次微调。
输电系统故障检测与分类的混合两阶段机器学习流程
提出混合两阶段机器学习流程,分离检测与分类,显著提升输电故障精度,零序特征解决相间与接地模糊。
可复现的共形预测
共享随机种子和粗网格取整使独立校准得到相同分类器并保持覆盖保证,代价是增大集合与数据量,且能防重校准挑选。
流水线原生Transformer:协同设计模型架构与CPU推理以实现带宽高效的自回归解码
协同设计模型架构与CPU推理,流水线原生Transformer降带宽2倍,解码超llama.cpp。
等待中行动:推理延迟下通用机器人策略的强化学习微调
提出延迟感知框架ARLI,利用中间信息与状态增强恢复马尔可夫性,使标准RL失效场景下仍能有效微调通用策略。
S矩阵指导的神经网络用于振幅分析
提出S矩阵指导神经网络,直接从数据学习振幅并筛选一致实验,用于ππ散射,获得可复用振幅与不确定性量化。
差分学习用于含能材料热稳定性的稳健预测
用差分学习预测分子对间相对热稳定性,抗实验误差,排序准确率超85%,发现键解离焓是关键因素。
股票收益预测中良性过拟合的(误)解
股票收益预测中存在良性过拟合,但高参数化模型与最优岭回归均未超越历史均值,表明标准预测因子无真实预测力。
交替任务下可塑性的无量纲控制:从进化生物学到持续学习
交替任务下可塑性由r和ηT两个无量纲参数控制,最优ηT∝r^-1.18。
用于视觉-语言-动作模型数据高效适配的层次化技能检索
提出层次化技能检索(HSR)框架,通过任务分解与混合检索实现VLA数据高效适配,成功率显著提升。
RetrievalFormer:面向高效近似最近邻检索与冷物品推荐的双编码器Transformer
提出双编码器Transformer用于高效近邻检索与冷物品推荐,冷启动召回率达专用方法1.4倍,但全量精确训练仍待解。
NeuronGuard:通过感知剪除的安全信号重分配实现大模型稳健安全对齐
针对越狱与神经元剪除攻击,NeuronGuard在微调阶段重分配安全信号至更广神经元,动态识别关键单元并强制拒答,近零攻击成功率且保持任务性能。
RAGSentinel:面向鲁棒检索增强生成的可证明几何共识
可证明的几何共识防御,无训练无标签,黑盒适用,过滤毒文档,诚实多数下恢复干净上下文,抵御自适应攻击。
qshap:梯度提升树的R²快速Shapley分解
提出qshap,将R²分解为特征贡献,支持主流GBDT库,含高效C++及对称树加速。
非言语发声合成的偏好优化
系统研究非言语发声TTS的偏好优化,提出NV-CER指标,实验验证标准DPO有效。
量子机器学习中的有限噪声最优与泛化理论
提出噪声理论:噪声降低复杂度缩小泛化差距,但增大偏差,二者竞争产生有限噪声最优,效应可预测可调控。
惰性高维机制下训练的扩散模型的泛化、记忆与过拟合
研究惰性高维机制下扩散模型的泛化与过拟合,揭示谱估计泛化、纯噪声插值、经验贝叶斯记忆。
面向可解释机器学习的异构专家混合框架
提出异构专家混合框架,融合树、线性SVM与QDA,经校准和EM优化,实现可解释且性能优异的专家分配。
HRV Studio验证:一款透明且质量可控的心率变异性分析平台
HRV Studio开源平台验证:与NeuroKit2等高度一致,频谱指标误差小,合成与心律失常压力测试数值稳定,提供透明可重复的HRV分析。
延迟观测下的厄尔尼诺可预测性
延迟观测能显著提升6个月内厄尔尼诺预报,但模型复杂度无增益,简单SINDy模型更优。
NeuralParker:面向不规则停车环境的强化学习规划器
提出强化学习混合规划器,用目标相对全局表征与终端集成,在复杂停车场景中提升规划成功率与轨迹质量,并成功迁移至实车。
相依数据下的序列算子学习
推导Hilbert空间含噪随机过程的时间一致自归一化集中界,得到依赖数据下线性/非线性算子回归误差保证,无需独立性假设。
Maia 200:面向大规模AI加速的软件定义数据流系统
Maia 200采用软件定义数据流架构,以数据移动为中心,高性能低功耗,支持大规模AI推理,节省成本。
SatDL:面向卫星分布式学习的联合优化数据重分配与训练
SatDL联合优化数据重分配与训练,最小化卫星学习总时间。实验显示总时间降18.6%,能耗降12.23%-88%,精度仅略降。
MoRF-AST:变工况下结构监测的校准概率虚拟传感
提出MoRF-AST,在变工况下校准概率虚拟传感,覆盖误差降55.9%且保持精度。