EMAgnet:大规模游戏中策略梯度自对弈的参数空间EMA正则化
EMAgnet用EMA正则化自对弈策略梯度,在含严格占优策略的大规模游戏中降低可利用性。
触发学习:大型强子对撞机中的强化学习
强化学习动态调整LHC触发阈值,在模拟和真实数据上提升信号效率并控制背景率,首次在真实碰撞数据上实现。
快速与慢速变分持续学习
提出CoVON优化器,通过合并后验实现慢适应与快权重更新,显著提升持续学习性能。
中文标题:你不需要运行每个评估
中文摘要:发现模型在133个基准上的分数主要由两个因素决定;设计BenchPress方法,用5个基准即可高精度预测其余,误差约4分。
基于信息论的自适应计划优化的无分类器引导
提出信息论框架优化引导计划,通过清洁端点参考平衡一致性与覆盖率,避免密度估计,取得更优权衡。
面向RoPE的KV缓存量化中比特分配
Block-GTQ通过感知RoPE的块级比特分配,显著降低量化误差,提升长上下文性能,实现高效压缩。
当Top-1失效时:为掩码扩散语言模型校准LoRA监控器
Top-1浓度无法预警LoRA训练崩溃,改用最大梯度范数精度达0.68、F1=0.79;建议弃用Top-1并逐模型家族校准梯度阈值。
使用自编码器的快速FinFET建模
利用自编码器压缩I-V曲线,显式加入VDS特征,实现快速精确的FinFET建模与参数提取。
RAVEN:一种面向金融时间序列预测的机制感知可变上下文专家网络
RAVEN框架自适应确定时间上下文,采用嵌套窗口和累积重要性阈值,在金融和交通任务上实现SOTA。
基于块策略漂移门控的在线策略蒸馏
提出块级策略漂移门控,聚合标记块上的概率偏移重加权损失,提升长程推理蒸馏的解决率。
NeuroSonic:用于脑电图到语音重建的条件流匹配
提出条件流匹配框架,学习确定性速度场重建语音,在基准上感知质量提升26.3%,对伪影段稳健。
FedUP:通过质心引导插件滤波器实现一次性联邦遗忘
FedUP用可插拔滤波器实现一次性联邦遗忘,避免多轮通信,秒级完成,保护隐私,有效减少非目标知识损失。
面向离散流匹配的时间重参数化累积强度外推采样器
通过时间重参数化与累积强度外推,提升有限函数评估次数下离散流匹配的采样质量。
基于大语言模型的两阶段Transformer框架用于有限数据跨域轴承故障诊断
提出知识引导的两阶段迁移框架,仅用10%标注数据达92.61%准确率,超越现有方法17.24%。
基于多目标强化学习的LLM预训练整体数据调度器
HDS用多目标强化学习调度预训练数据,融合质量、域影响和权重范数奖励,减少44%迭代并提升MMLU 7.2%。
面向设备端故障检测的轻量级Transformer模型:资源受限部署的基准研究
轻量Transformer性能与传统ML相当但模型大延迟高,INT8量化及自适应推理可优化部署,极端不平衡数据仍难以处理。
AsyncOPD:在策略蒸馏可以有多陈旧?
首次系统研究异步策略蒸馏陈旧数据:前向KL鲁棒,反向KL脆弱;提出多样本MC估计及AsyncOPD框架,吞吐量提升1.6-3.8倍。
Ariadne项目:面向合成规划的提示条件路线生成
Ariadne提示条件路线生成器,整合目标约束,深度约束Solv-0提高13.7,必要叶子约束提高31.2,速度快于DESP,质量媲美DMS Explorer XL。
大语言模型中用于隐私与数据审计的自然标识符
自然标识符(NIDs)可实现无需重新训练的事后差分隐私审计与数据集推断。
无电池物联网中未知工作负载的任务执行管理:一种硬件无关的评估
提出两种硬件无关调度策略(RL和AP),AP轻量近最优吞吐,RL平衡生存执行,大缓冲设备可用简单策略。
并行流形引导:通过残差能量塑形实现大型关联记忆的高效适配
H-Res通过残差能量塑形调制Transformer能量景观,避免干扰和开销,高效适配任务,检索性能提升26%。
数据增强:傅里叶分析视角
部分数据增强(随机子集)即可达到完全增强的统计效益,近似对称性已足够,但精确不变性仍需全群平均。
对图基础模型在节点属性预测任务上的公平评估
公平重评9个图基础模型,仅最新基于Prior-data Fitted Networks的模型优于调优GNN,但推理成本更高。
QC-SMOTE:用于不平衡分类的质量控制SMOTE
QC-SMOTE通过质量评估与几何自适应合成样本,在不平衡分类中显著优于现有方法,尤其在中重度不平衡下表现突出。
推理作为吸引子动力学:通过吉布斯加权能量最小化进行潜在记忆检索
LLM推理是吸引子动力学,正确链对应平坦极小值;吉布斯加权能量最小化检索提升数学推理5.38%。
Grad Detect:基于梯度的LLM幻觉检测
Grad Detect通过分析推理中逐层梯度模式预测幻觉,优于基准方法,最后五层集中97%以上判别信号。
FlowPipe:基于LLM增强的条件生成流网络用于数据准备管道构建
FlowPipe利用LLM增强条件生成流网络,通过语义调制和失败感知,准确率提升12%,收敛速度提升12.5倍。
实谱与复谱基在神经算子中的对比:格林函数对齐的作用
HNO与FNO比较:椭圆算子适用实Hartley基,含相位算子适用复FFT基,选择依据格林函数对称性
EnerInfer:能量感知的设备端大语言模型推理
EnerInfer通过动态调频和在线反馈,在保证用户体验质量下,提升设备端大语言模型推理能效最高65%。
Zero-Shot Neural Priors for Generalizable Cross-Subject and Cross-Task EEG Decoding
基于波束可调天线的WiFi人数统计:测试床研究
利用WiFi信号和波束可调天线,通过CSI实现人数统计与个体识别,支持智能感知应用。
可查询坐标的神经场重建用于脑电图空间超分辨率及未见电极生成
提出坐标查询神经场方法,实现脑电图超分辨率与未见电极信号生成,性能显著提升。
基于视觉Transformer的粘弹性液滴撞击动力学预测
利用ViViT仅用初始部分模拟数据预测粘弹性液滴撞击全过程,节省90%计算成本,准确捕捉铺展与弹跳,可融合实验数据。
使用核PCA对Max-Cut问题的QAOA参数空间进行降维
核PCA降维QAOA参数空间,深电路下近似比超0.86,优于PCA,减少93%以上评估。
面向机器人安全性的可验证基础模型
提出FEARL框架,将策略分解为控制器与可验证安全模块,在保持任务能力的同时实现形式化安全验证。
激光粉末床熔融中熔池预测的混合量子-经典方法
混合量子-经典模型:先聚类减少量子计算,再量子编码提取特征,经经典神经网络精准预测熔池,硬件验证优于纯经典网络。
计算参考并非实验:机器学习钠阴极电压的预注册验证
机器学习筛选电池材料依赖计算参考电压,但参考本身有误差;案例验证失败,误差主要来自参考。
JEDEL:面向早期药物发现的零样本DNA编码文库设计
JEDEL零样本从药效团直接生成可合成DNA文库,无需重训,提升亲和力与药效团恢复。
Flow-Corrected Thompson Sampling for Non-Stationary Contextual Bandits
机器学习与深度学习在JWST和即将到来的Ariel任务中的系外行星探测与大气表征应用
ML/DL在JWST和Ariel任务中加速系外行星探测与大气表征,性能超越传统,推理时间从CPU小时降至秒级,但面临可解释性等挑战。
Hessian增强的Hamilton-Jacobi-Bellman偏微分方程监督学习
利用庞特里亚金原理生成Hessian增强数据,大幅降低HJB方程学习样本需求,提升逼近精度。
结构化问题的约束变量投影
提出约束变量投影框架用于结构化问题,推导精确梯度与条件梯度算法,有收敛保证,实验证明提升计算和数据效率。
RE4: 利用操作模式进行物体交互的变换感知模仿
提出RE4框架,通过模式感知检索与变换,在基准上兼顾性能与可解释性,低数据下仍鲁棒。
PROTECT-90:电力系统保护故障数据集
PROTECT-90数据集包含9022个EMT模拟的90kV线路故障事件,提供同步波形和元数据,支持保护算法可重复评估。
中文标题:光合宜居性的不可知机器学习模型
中文摘要:新模型基于热力学和氧化还原化学,预测光合宜居带远超传统估计,M矮星行星可维持近红外驱动氧光合作用。
CrossPool: 通过KV缓存与权重分离实现冷MoE模型的高效多LLM服务
CrossPool分离权重与KV缓存池,优化冷MoE模型服务,降低P99 TBT达10.4倍。
慢时变图中的低秩更新用于时空信号插值
针对慢时变图,将图变化建模为低秩更新,联合插值信号与估计图,用快速OMP算法,展开为轻量网络,提升插值效果。
鲁棒状态空间射电干涉成像的随机期望最大化算法
提出基于SAEM的鲁棒状态空间成像方法,利用吉布斯采样处理重尾噪声,显著提升RFI干扰下的重构质量与鲁棒性。
高维谱范数球中的均匀采样
证明高维谱范数球均匀采样矩阵的奇异值几乎必然收敛到1,为大语言模型矩阵采样提供理论依据。
深度数值格式求解遍历倒向随机微分方程系统及其在制度切换前向效用中的应用
提出两种神经网络数值方案求解遍历倒向随机微分方程系统,用于制度切换前向效用模型中的最优策略近似。