11552 条条目 · 106 个活跃源
2026年8月21日
04:00
arXiv cs.LG

预测信道观测的量子高斯过程

将QGP推广至信道回归,证明收敛并给出核;用可学习尺度参数克服指数抑制,64比特仿真噪声硬件验证有效。

04:00
arXiv cs.LG

Sm掺杂BiFeO3中成分驱动相演化的潜场重建原子分辨STEM研究

提出潜场重建法解析原子分辨STEM,揭示Sm掺杂BiFeO3从铁电相到Pnma相的演化及畴结构重组。

04:00
arXiv cs.LG

SCAPE:场景条件下的仿真增强策略评估

提出SCAPE框架,校正仿真偏差,预测场景条件性能,在驾驶和四足任务上验证,提升准确性与样本效率。

04:00
arXiv cs.LG

基于离线质量-多样性强化学习的层级技能策略学习

提出QDOS,用优势加权质量-多样性预训练提取高价值技能,复用双数据集,提升离线到在线学习性能。

04:00
arXiv cs.LG

Microlensify:基于Transformer的微引力透镜事件机器学习分类器(在TESS光变曲线上训练)

基于TESS光变曲线,用Transformer模型分类微引力透镜事件,识别假阳性、预测时长,适用于不同巡天。

04:00
arXiv cs.LG

学习确定性与随机受迫哈密顿系统

提出几何框架和GFHNN网络学习受迫哈密顿系统,证明普适逼近;实验显示长期稳定性与精度优于非几何网络,且需更少数据。

04:00
arXiv cs.LG

CacheRoute:面向大规模LLM服务的规划式前缀亲和路由

CacheRoute利用周期路由计划平衡前缀亲和与负载,命中率升至93%,吞吐达基线2.3倍;亲和收益不足时需影子回放验证。

04:00
arXiv cs.LG

skchange:快速且灵活的变点检测算法

skchange开源Python库,用于时间序列变点检测,含快速近似和高维算法,自动校准罚项,遵循scikit-learn约定、Numba加速。

04:00
arXiv cs.LG

实验室环境下循环老化数据电池SoH建模的重复测量方法

提出重复测量模型分析实验室电池老化数据,含两类方差,正则化迭代广义最小二乘辨识,SoH预测误差±0.191%。

04:00
arXiv cs.LG

将世界模型与现实对齐的不可约量子优势

经典世界模型无法完美对齐真实世界,增加记忆仍失效;单qutrit量子模型可精确复现。

04:00
arXiv cs.LG

分段光滑动力系统的学习

提出分段光滑动力系统识别框架:估计切换超平面,用几何约束神经网络分区学习动力学,用于干摩擦振荡器和冰期模型。

04:00
arXiv cs.LG

特征工程与优化框架对海洋水色机器学习的影响

研究特征工程对海洋水色机器学习的影响,提出七级优化框架,使叶绿素a和透明度估算精度显著提升。

04:00
arXiv cs.LG

并集界去哪了?最佳臂识别与强FWER控制

最佳臂识别中的并集界等价于强FWER控制:多重性未消失,只是随假设定向在不同位置出现。

04:00
arXiv cs.LG

基于极坐标MKAN的射频指纹可解释特征学习

提出极坐标MKAN,用幅度/相位分离的单调编码实现可解释射频指纹特征,解纠缠57.2%,远超基线。

04:00
arXiv cs.LG

非线性动力系统中基于脉冲的置信传播

提出集成脉冲动力学与概率推理的贝叶斯控制框架,在非线性山车问题中实现实时状态更新与目标导向规划。

04:00
arXiv cs.LG

从噪声到信号:利用端点特定日志提升基于大语言模型的安全日志异常检测

本研究用指令微调LLM检测异常认证行为,Meta Llama 3.1准确率89.3%,远超Wazuh和OpenSearch,并检出80%边界案例。

04:00
arXiv cs.LG

基于深度ReLU网络的非参数回归迁移学习

多组非参数回归迁移学习框架,两阶段偏移学习共享结构与组特异项,深度ReLU网络显式收敛,克服维度灾难

04:00
arXiv cs.LG

面向大字母表的分层单纯形架构

提出极简贝叶斯估计器:均匀单纯形样本逐坐标相乘并归一化,深度可平均;遗憾显式可算,媲美经典方法。

04:00
arXiv cs.LG

你看不到的才是你学到的:限制证据可见性有利于共享基因组语言模型社会的组合泛化

仅限制注意力可见范围,共享基因组语言模型社会的组合泛化在9/10配对中显著提升,但中位准确率未达预注册阈值。

04:00
arXiv cs.LG

基于嵌套序贯蒙特卡洛的离散扩散推理时控制

提出嵌套序贯蒙特卡洛方法,修正偏差,在毒性及流畅性控制上优于最佳n采样与引导SMC。

04:00
arXiv cs.LG

利用机器学习生成的替代波形的引力波参数估计

提出两阶段条件自编码器生成引力波替代波形,误差低至1e-6,参数估计偏差可校正,适用于低信噪比场景。

04:00
arXiv cs.LG

Table2Image:基于生成代理表示与可靠性诊断的轻量级表格学习

提出Table2Image,用生成代理表示兼顾性能与紧凑性,在多种不完善学习信号下保持鲁棒平衡。

04:00
arXiv cs.LG

城市时空预测中多图卷积网络的多模态图交互

提出多模态交互机制,分组GCN融合图结构,多线性关系GCN提升泛化,在网约车预测中精度与鲁棒性更优。

04:00
arXiv cs.LG

关于随机最短路径问题中乐观策略迭代的收敛性

证明随机最短路径问题中乐观策略迭代收敛性,含蒙特卡洛与TD(λ)评估,在终止状态几乎必然到达条件下。

04:00
arXiv cs.LG

LLM缓存应采用哪种逐出策略?跨工作负载、容量与编码器的系统研究

评测十八种场景,LFU最佳;其他策略提升极小,FIFO等落后明显;多数缓存命中不可替换。

04:00
arXiv cs.LG

基于专家混合模型融合的高效帕累托集近似

提出基于专家混合模型融合的帕累托集近似方法,仅需数百参数,高效逼近大模型帕累托前沿,内存低且可扩展。

04:00
arXiv cs.LG

基于学习的仅用加速度计惯性传感的速度估计

提出CarSpeedNet模型,仅用手机加速度计估计车速;4秒窗口误差1.8米/秒,优于1秒。

04:00
arXiv cs.LG

ReAugment:模型库引导的强化学习用于少样本时间序列增强与预测

提出新方法,用强化学习识别易过拟合样本并自适应增强,解决少样本时间序列预测难题。

04:00
arXiv cs.LG

$TCP_\alpha$:面向可靠音乐信息检索的边际控制置信度估计

提出$TCP_\alpha$置信度目标,用边际控制惩罚分离正确与错误预测,提升音乐检索失败预测可靠性。

04:00
arXiv cs.LG

轨迹信息:鞅与随机时间

非负鞅轨迹信息流导出变分恒等式,统一恢复Ville至PAC-Bayes不等式,量化其舍弃量,并揭示随机时间的偷看惩罚。

04:00
arXiv cs.LG

虚拟传感实现对不可达位置及不可测参数的实时监测

提出神经算子虚拟传感,从稀疏边界测量实时重建不可达内部场,误差<5%,性能提升72-84%。

04:00
arXiv cs.LG

CarBench:高保真三维汽车空气动力学神经替代模型的综合基准

首个汽车空气动力学神经替代模型基准,评估11种架构于8000余个高保真模拟,含跨类别测试与不确定性分析。

04:00
arXiv cs.LG

最大似然强化学习

提出最大似然强化学习,插值期望奖励与最大似然,一行改动,优于现有方法,测试时缩放效率较GRPO提升20倍。

04:00
arXiv cs.LG

单位分割神经网络:具有显式类别区域的可解释分类

提出单位分割神经网络,用连续函数代替特征函数,无需Softmax即可保证概率和为1,具备可解释门控迹与通用逼近性,实验验证有效。

04:00
arXiv cs.LG

ProteinZero:基于在线强化学习的蛋白质自我改进生成模型

ProteinZero用在线强化学习让蛋白质生成模型从自身输出持续进化,无需标注数据,成功率超90%,失败率降低36-48%。

04:00
arXiv cs.LG

DeepConvContext:人类活动识别中时间序列分类的多尺度方法

提出多尺度框架,建模窗口内外时序,六个基准F1提升5%,mAP提升达18。

04:00
arXiv cs.LG

为什么我看不到我的簇?一种用于降维验证的精确率-召回率方法

提出精确率与召回率指标评估降维关系阶段,指导超参调优并揭示投影伪影,使降维更快速可靠。

04:00
arXiv cs.LG

现在合并,日后后悔:模型合并的隐藏代价是对抗可迁移性

模型合并无法可靠防御迁移攻击,迁移率超百分之八十;更强合并方法与缓解表示偏差增加脆弱性,权重平均例外。

04:00
arXiv cs.LG

迈向形式化强化学习理论:Robbins-Siegmund方法

用Lean4基于Robbins-Siegmund定理形式化验证了Q学习与线性TD学习的几乎必然收敛。

04:00
arXiv cs.LG

Rényi锐度:一种与泛化强相关的新型锐度度量

提出Rényi锐度,用Hessian谱的Rényi熵衡量其平均散布,与泛化强相关,并据此提出RSAM。

04:00
arXiv cs.LG

GraphPFN:先验数据拟合的图基础模型

提出GraphPFN,基于先验数据拟合合成图预训练,在图节点任务上达最优。

2026年8月20日
04:00
arXiv cs.LG

跨境电力价格预测中的深度学习:一项比较研究

可复现框架下比较六种深度学习模型预测跨境电价,N-HiTS和NBEATSx在低数据场景更优。

04:00
arXiv cs.LG

基于SURE调参岭回归的等方差线性高斯DAG因果发现

SURE-Ridge闭式估计器:并行节点回归+SURE调参+阈值提DAG,小样本误差最低且最快。

04:00
arXiv cs.LG

SCENARIODIFF:面向多模态时间序列预测的情景级引导框架(扩展版)

提出SCENARIODIFF:三级情景推理从弱对齐文档提取信号,生成情景与锚点,引导扩散模型,提升事件驱动预测。

04:00
arXiv cs.LG

OraclePhys:面向结构力学的LLM微调系统化框架

本研究揭示:微调所学由标签形式决定,排序目标习得前向模型,标量部分有效,布尔无效,优势加权仅提升奖励。

04:00
arXiv cs.LG

基于人群健康的机器学习揭示社会心理因素与慢性肾病的关联

用机器学习分析大规模健康数据,识别慢性肾病关键预测因子(体检、年龄、血压、心理压力),模型准确率72.56-76.12%,为风险分层提供可解释框架。

04:00
arXiv cs.LG

解锁新能力:切换LoRA适配器作为工具(SLAaaT)

将LoRA适配器切换作为工具,让智能体在任务中自主切换,解决灾难性遗忘,提升能力并大幅降低能力损耗。

04:00
arXiv cs.LG

可认证且隐私保护:面向神经网络保证的可扩展零知识证明

PANDA用零知识证明在不泄露参数前提下证明神经网络鲁棒性和公平性,支持290万参数网络,5分钟生成证明,10秒验证,规模远超现有方法。

04:00
arXiv cs.LG

以代数方式回溯时间

针对线性时序逻辑,提出代数泛化可微语义引擎,含多种代数,实现为PyTorch库telos。

04:00
arXiv cs.LG

强化学习即(离散)位势理论

综述概率与位势论联系,固定策略下用位势论优化强化学习表示与算法,提升样本效率,扩展至非线性。