潜探揭示自动驾驶:内部预测误差与自我规划的联系
通过测试揭示自动驾驶策略中预测与规划的内在关联,指出近碰撞时预测不足,纠正错误预测可提升安全规划。
代码大语言模型安全校准的实证研究
研究发现模型对生成代码安全性普遍过度自信,安全校准优于功能校准,但校准引导修复效果有限。
在线TT-ALS:带有增量正交化的流式张量分解
提出增量正交化约束的在线TT-ALS算法,实现高效流式张量分解,线性复杂度,高精度,适合实时处理。
动态高斯过程与标准SPDE交换
利用等价性构建混合方案,降低高斯过程时空推理的立方成本。
分裂共形预测的最优数据划分
提出分裂共形预测中最优数据划分理论,确定最小化预测区间长度的训练-校准比例,实验验证其有效性。
MNAR-$k$-均值:一种针对幅度衰减概率非随机缺失数据的$k$-均值聚类方法
针对非随机缺失数据,提出基于插补值大小约束的k-均值聚类,减小中心偏差,改善效果。
面向全球的风暴解析大气AI模拟扩展
全球首个风暴解析AI仿真器STRATA,基于4.9km数据训练,实现稳定24小时全球滚动,能效提升50倍。
无界区域中偏微分方程的域分解随机神经网络
提出域分解随机神经网络,近远场子网络耦合求解无界区域PDE,线性最小二乘,数值验证精度与灵活性。
CSO-LLM:用于LLM训练后后门检测与触发器逆向的类别子空间正交化方法
提出CSO框架,通过类别子空间正交化增强检测灵敏度与特异性,无需显式黑名单,实现LLM后门检测与触发器逆向。
通过精确的房间声学模拟改进多通道语音增强
高保真房间声学模拟增强训练数据,使多通道语音增强词错误率降低38%。
低秩矩阵优化的方向-幅度分解:更快的收敛与鞍点到鞍点动力学
提出方向-幅度分解框架,过参数化与递归方法使低秩矩阵优化比BM梯度下降指数级更快,实验验证有效。
从失败到对齐:面向机器学习系统的需求工程框架
提出REAL框架,融合数据/模型/系统需求,利用失败驱动探索与迭代细化,实现机器学习系统与利益相关者需求对齐。
基于机器学习的四旋翼未建模动力学反馈线性化控制
提出基于RBF神经网络在线学习的反馈线性化控制,补偿未建模动力学,提升四旋翼轨迹跟踪精度与收敛速度。
用张量网络建模儿童的情感记忆
情感效价顺序影响儿童记忆,张量网络建模准确率达77.98%,优于传统模型。
S-GAI:面向Sigmoid型MLP的谱几何感知初始化——从数据集几何到网络权重
S-GAI利用SVD提取类谱几何初始化MLP隐层,初始状态更丰富;冻结隐层时性能仍优于随机基线。
scKDGM: 基于KAN引导的动态图掩码学习用于单细胞RNA测序聚类
提出scKDGM框架,通过掩码扰动、表达恢复和对比学习优化单细胞RNA-seq聚类,在12个数据集上超越10个基线。
部分已知动力学下的分布式估计学习:一种协方差无关的神经卡尔曼一致性滤波器
提出CA-NKCF,结合部分动力学知识与深度学习进行分布式隐状态估计,无需噪声统计,鲁棒性优于传统滤波方法。
反事实残差数据增强用于回归
CRDA利用残差不变性生成新训练样本,有效解决回归任务样本少、噪声大问题,使MLP和XGBoost的MSE分别降低22.9%和6.4%。
深度单项式网络中的奇异学习与奥卡姆剃刀
深度网络临界点对应子网络,解释隐式偏差促模型收敛到简单函数。
设备级能源异常检测与LLM建议的自主AI管道
本管道结合时序预测与LLM推理,实现设备级异常检测与建议,动态检索高效,本地模型通过所有场景。
论网状智能对液态基底的必要性
网状智能必须采用液态基底,因需自适应时间尺度和时间间隔依赖,固定权重下两者缺一不可。
观点:强化学习研究者需区分解决模拟器与将模拟器作为代理使用
强调区分模拟器两种用法(解决模拟器 vs 作为部署代理),避免误导性结论。
AI能否绘制科学图表?一个评估文本到图像和多模态模型生成科学图形能力的基准
新基准SciDraw-Bench用四维协议测试科学图形生成,领域模型胜出,文本保真度仍是挑战。
微调反转的引力解释
提出引力解释:后训练回退由指向早期主导流形的方向驱动,抑制该方向可降低有害性且任务代价小。
一种可分部分训练的算子学习框架:融合DeepONet与Karhunen-Loeve展开用于大规模应用
提出KL-DNN框架用于地质碳存储,压力相对误差0.04%,饱和度5%,训练仅20分钟/GPU,推理<1分钟,比DeepONet快百倍。
当更多采样有害时:测试时缩放的模态天花板与相关性天花板
采样过多反损性能,模态和相关性天花板限制识别正确性,有效采样数揭示截止点,瓶颈在识别而非生成。
使用结构化时间融合提升层次时间序列预测的一致性
提出HTF模型,在训练中嵌入一致性损失,确保层次预测一致并提升精度。
NIVA:面向可操作地球系统智能的多模态基础模型
NIVA多模态基础模型学习地球系统耦合动力学,准确预测气候指数,为次季节到季节预测奠基。
神经网络证明嵌入中选择公理的几何测量
选择公理在证明空间有几何可测相关量,异常分数可预测定理证明器性能。
大语言模型所解释的并非其所信:基于模型自身输入信念评估解释充分性
针对LLM解释充分性提出SCSuff度量,发现解释普遍不充分且与模型规模弱相关。
多指标模型下经验风险最小化中的副本对称破缺与算法阈值
提出IAMP算法,精确刻画高维渐近下训练与测试误差,性能为多项式时间算法最优。
通过绝对扰动的线性赌博机随机探索
ATS和EATS通过绝对扰动实现乐观期望,兼具计算效率与简单分析,达到线性赌博机最优遗憾。
利用基于Mamba架构的表示改进纵向数据中的患者亚型分类
提出自监督Mamba模型,从EHR时序数据学习表示,提升患者亚型分类性能,优于基线模型。
金融领域的约束表格扩散模型
提出CTDF,在扩散采样中嵌入无训练可行性操作,强制执行硬约束,实现零违规并提升数据效用。
面向体制切换扩散模型中线性二次Stackelberg微分博弈的熵正则化强化学习
提出熵正则化强化学习,解决体制切换扩散下的线性二次Stackelberg博弈,有效避免次优均衡。
面向高斯过程回归的主动量子核获取
提出基于任务灵敏度的非均匀shot分配方法,实现10–21%测试RMSE提升。
世界模型中预测的路径空间公式:从单一行动到预测、规划与不可逆性
提出世界模型预测的路径空间公式,统一预测、规划与不可逆性,发现注意力不对称性反映数据不可逆性并影响长期预测。
层次化决策与结构化策略:基于逆优化的原则性设计
采用逆优化构建层次化决策框架,融合高层目标与底层策略,有效提升资源分配和碰撞避免任务的效率与决策质量。
HARD-KV:面向解码时KV压缩的头部自适应正则化
HARD-KV通过级联缓存与对数几率校准,解决静态-动态不匹配,实现2倍吞吐量且保持高保真生成。
论设计无偏的算法机器学习
探讨在有限总体中,基于抽样设计而非模型假设,实现算法机器学习无偏预测与评估的条件。
生成式学习:提升情感身体动作表达感知的工具
生成模型能隐式学习情感身体动作,并用于增强情感识别、提取代表性动作模式及合成情感强度平滑过渡。
闭式最速下降方向朝向平坦极小点:减小神经网络损失Hessian特征谱上界
首次提出闭式梯度,沿WS上界最速下降方向更新参数,缩小Hessian特征谱,收敛平坦极小点。
熵正则化强化学习在机制转换跳跃扩散过程中的零和随机微分博弈
引入分布控制对抗参数误设与结构突变,建立熵正则化零和随机微分博弈强化学习框架,推导HJBI方程并开发Actor-Critic算法,应用于投资博弈。
面向联邦类增量学习的Fisher路由专家混合模型
通过Fisher路由专家混合,自适应选择专家子集,解决联邦类增量学习的容量冲突、遗忘与异质性,理论收敛且性能领先。
MALOQ: 量子输运算子的海量加速学习
基于SO(2)-等变架构,MALOQ高效预测DFT哈密顿矩阵,训练时间减少30%,支持大规模材料图推理。
ReGuide:从测试时引导到自我改进的扩散策略
ReGuide利用分阶段条件引导生成纠正轨迹并吸收为训练数据,将扩散策略成功率提升1.3-7.7倍。
基于弱监督的机器学习驱动LDAP侦察检测
用弱监督ML框架检测LDAP查询,分类器真阳性率65%,签名精确率81.48%,成本低、效率高。
面向基于图神经网络的云网络安全异常检测改进
用图神经网络自监督学习分析云日志,动态生成异常分数,将告警量从数千降至约1条/小时。
DLR:零推理成本的潜在残差用于低秩预训练
提出DLR插件,零参数提升低秩预训练质量,训练后无损融合,不增加部署成本。
多智能体路由作为集值预测:WildChat基准与成本感知评估
提出WildChat多智能体路由基准,评估表明监督路由优于零样本LLM,微调编码器精度最佳,加权路由改善成本-准确率权衡。