预测信道观测的量子高斯过程
将QGP推广至信道回归,证明收敛并给出核;用可学习尺度参数克服指数抑制,64比特仿真噪声硬件验证有效。
Sm掺杂BiFeO3中成分驱动相演化的潜场重建原子分辨STEM研究
提出潜场重建法解析原子分辨STEM,揭示Sm掺杂BiFeO3从铁电相到Pnma相的演化及畴结构重组。
SCAPE:场景条件下的仿真增强策略评估
提出SCAPE框架,校正仿真偏差,预测场景条件性能,在驾驶和四足任务上验证,提升准确性与样本效率。
基于离线质量-多样性强化学习的层级技能策略学习
提出QDOS,用优势加权质量-多样性预训练提取高价值技能,复用双数据集,提升离线到在线学习性能。
Microlensify:基于Transformer的微引力透镜事件机器学习分类器(在TESS光变曲线上训练)
基于TESS光变曲线,用Transformer模型分类微引力透镜事件,识别假阳性、预测时长,适用于不同巡天。
学习确定性与随机受迫哈密顿系统
提出几何框架和GFHNN网络学习受迫哈密顿系统,证明普适逼近;实验显示长期稳定性与精度优于非几何网络,且需更少数据。
CacheRoute:面向大规模LLM服务的规划式前缀亲和路由
CacheRoute利用周期路由计划平衡前缀亲和与负载,命中率升至93%,吞吐达基线2.3倍;亲和收益不足时需影子回放验证。
skchange:快速且灵活的变点检测算法
skchange开源Python库,用于时间序列变点检测,含快速近似和高维算法,自动校准罚项,遵循scikit-learn约定、Numba加速。
实验室环境下循环老化数据电池SoH建模的重复测量方法
提出重复测量模型分析实验室电池老化数据,含两类方差,正则化迭代广义最小二乘辨识,SoH预测误差±0.191%。
将世界模型与现实对齐的不可约量子优势
经典世界模型无法完美对齐真实世界,增加记忆仍失效;单qutrit量子模型可精确复现。
分段光滑动力系统的学习
提出分段光滑动力系统识别框架:估计切换超平面,用几何约束神经网络分区学习动力学,用于干摩擦振荡器和冰期模型。
特征工程与优化框架对海洋水色机器学习的影响
研究特征工程对海洋水色机器学习的影响,提出七级优化框架,使叶绿素a和透明度估算精度显著提升。
并集界去哪了?最佳臂识别与强FWER控制
最佳臂识别中的并集界等价于强FWER控制:多重性未消失,只是随假设定向在不同位置出现。
基于极坐标MKAN的射频指纹可解释特征学习
提出极坐标MKAN,用幅度/相位分离的单调编码实现可解释射频指纹特征,解纠缠57.2%,远超基线。
非线性动力系统中基于脉冲的置信传播
提出集成脉冲动力学与概率推理的贝叶斯控制框架,在非线性山车问题中实现实时状态更新与目标导向规划。
从噪声到信号:利用端点特定日志提升基于大语言模型的安全日志异常检测
本研究用指令微调LLM检测异常认证行为,Meta Llama 3.1准确率89.3%,远超Wazuh和OpenSearch,并检出80%边界案例。
基于深度ReLU网络的非参数回归迁移学习
多组非参数回归迁移学习框架,两阶段偏移学习共享结构与组特异项,深度ReLU网络显式收敛,克服维度灾难
面向大字母表的分层单纯形架构
提出极简贝叶斯估计器:均匀单纯形样本逐坐标相乘并归一化,深度可平均;遗憾显式可算,媲美经典方法。
你看不到的才是你学到的:限制证据可见性有利于共享基因组语言模型社会的组合泛化
仅限制注意力可见范围,共享基因组语言模型社会的组合泛化在9/10配对中显著提升,但中位准确率未达预注册阈值。
基于嵌套序贯蒙特卡洛的离散扩散推理时控制
提出嵌套序贯蒙特卡洛方法,修正偏差,在毒性及流畅性控制上优于最佳n采样与引导SMC。
利用机器学习生成的替代波形的引力波参数估计
提出两阶段条件自编码器生成引力波替代波形,误差低至1e-6,参数估计偏差可校正,适用于低信噪比场景。
Table2Image:基于生成代理表示与可靠性诊断的轻量级表格学习
提出Table2Image,用生成代理表示兼顾性能与紧凑性,在多种不完善学习信号下保持鲁棒平衡。
城市时空预测中多图卷积网络的多模态图交互
提出多模态交互机制,分组GCN融合图结构,多线性关系GCN提升泛化,在网约车预测中精度与鲁棒性更优。
关于随机最短路径问题中乐观策略迭代的收敛性
证明随机最短路径问题中乐观策略迭代收敛性,含蒙特卡洛与TD(λ)评估,在终止状态几乎必然到达条件下。
LLM缓存应采用哪种逐出策略?跨工作负载、容量与编码器的系统研究
评测十八种场景,LFU最佳;其他策略提升极小,FIFO等落后明显;多数缓存命中不可替换。
基于专家混合模型融合的高效帕累托集近似
提出基于专家混合模型融合的帕累托集近似方法,仅需数百参数,高效逼近大模型帕累托前沿,内存低且可扩展。
基于学习的仅用加速度计惯性传感的速度估计
提出CarSpeedNet模型,仅用手机加速度计估计车速;4秒窗口误差1.8米/秒,优于1秒。
ReAugment:模型库引导的强化学习用于少样本时间序列增强与预测
提出新方法,用强化学习识别易过拟合样本并自适应增强,解决少样本时间序列预测难题。
$TCP_\alpha$:面向可靠音乐信息检索的边际控制置信度估计
提出$TCP_\alpha$置信度目标,用边际控制惩罚分离正确与错误预测,提升音乐检索失败预测可靠性。
轨迹信息:鞅与随机时间
非负鞅轨迹信息流导出变分恒等式,统一恢复Ville至PAC-Bayes不等式,量化其舍弃量,并揭示随机时间的偷看惩罚。
虚拟传感实现对不可达位置及不可测参数的实时监测
提出神经算子虚拟传感,从稀疏边界测量实时重建不可达内部场,误差<5%,性能提升72-84%。
CarBench:高保真三维汽车空气动力学神经替代模型的综合基准
首个汽车空气动力学神经替代模型基准,评估11种架构于8000余个高保真模拟,含跨类别测试与不确定性分析。
最大似然强化学习
提出最大似然强化学习,插值期望奖励与最大似然,一行改动,优于现有方法,测试时缩放效率较GRPO提升20倍。
单位分割神经网络:具有显式类别区域的可解释分类
提出单位分割神经网络,用连续函数代替特征函数,无需Softmax即可保证概率和为1,具备可解释门控迹与通用逼近性,实验验证有效。
ProteinZero:基于在线强化学习的蛋白质自我改进生成模型
ProteinZero用在线强化学习让蛋白质生成模型从自身输出持续进化,无需标注数据,成功率超90%,失败率降低36-48%。
DeepConvContext:人类活动识别中时间序列分类的多尺度方法
提出多尺度框架,建模窗口内外时序,六个基准F1提升5%,mAP提升达18。
为什么我看不到我的簇?一种用于降维验证的精确率-召回率方法
提出精确率与召回率指标评估降维关系阶段,指导超参调优并揭示投影伪影,使降维更快速可靠。
现在合并,日后后悔:模型合并的隐藏代价是对抗可迁移性
模型合并无法可靠防御迁移攻击,迁移率超百分之八十;更强合并方法与缓解表示偏差增加脆弱性,权重平均例外。
迈向形式化强化学习理论:Robbins-Siegmund方法
用Lean4基于Robbins-Siegmund定理形式化验证了Q学习与线性TD学习的几乎必然收敛。
Rényi锐度:一种与泛化强相关的新型锐度度量
提出Rényi锐度,用Hessian谱的Rényi熵衡量其平均散布,与泛化强相关,并据此提出RSAM。
GraphPFN:先验数据拟合的图基础模型
提出GraphPFN,基于先验数据拟合合成图预训练,在图节点任务上达最优。
跨境电力价格预测中的深度学习:一项比较研究
可复现框架下比较六种深度学习模型预测跨境电价,N-HiTS和NBEATSx在低数据场景更优。
基于SURE调参岭回归的等方差线性高斯DAG因果发现
SURE-Ridge闭式估计器:并行节点回归+SURE调参+阈值提DAG,小样本误差最低且最快。
SCENARIODIFF:面向多模态时间序列预测的情景级引导框架(扩展版)
提出SCENARIODIFF:三级情景推理从弱对齐文档提取信号,生成情景与锚点,引导扩散模型,提升事件驱动预测。
OraclePhys:面向结构力学的LLM微调系统化框架
本研究揭示:微调所学由标签形式决定,排序目标习得前向模型,标量部分有效,布尔无效,优势加权仅提升奖励。
基于人群健康的机器学习揭示社会心理因素与慢性肾病的关联
用机器学习分析大规模健康数据,识别慢性肾病关键预测因子(体检、年龄、血压、心理压力),模型准确率72.56-76.12%,为风险分层提供可解释框架。
解锁新能力:切换LoRA适配器作为工具(SLAaaT)
将LoRA适配器切换作为工具,让智能体在任务中自主切换,解决灾难性遗忘,提升能力并大幅降低能力损耗。
可认证且隐私保护:面向神经网络保证的可扩展零知识证明
PANDA用零知识证明在不泄露参数前提下证明神经网络鲁棒性和公平性,支持290万参数网络,5分钟生成证明,10秒验证,规模远超现有方法。
以代数方式回溯时间
针对线性时序逻辑,提出代数泛化可微语义引擎,含多种代数,实现为PyTorch库telos。
强化学习即(离散)位势理论
综述概率与位势论联系,固定策略下用位势论优化强化学习表示与算法,提升样本效率,扩展至非线性。