基于傅里叶增强特征的物理信息神经网络交替Levenberg-Marquardt训练
提出傅里叶增强交替LM物理信息网络,解耦表示学习与系数拟合,高频非线性PDE误差降两个量级。
不确定性的统一风险视角:面向解耦与超越代理评估的后验风险
将不确定性定义为逐点后验风险,用半合成数据直接评估认知与偶然不确定性,发现准确预测不等于可靠解耦。
基于观察锚定的自预测强化学习用于视觉连续控制
提出OG-SPR,融合潜在自预测与观察预测,提升视觉连续控制样本效率,28个任务上超越SOTA,尤其困难域。
潜在上下文是否有用?北极航运逆强化学习的受控评估
北极航运逆强化学习评估显示,非线性奖励较线性提升50.9%,添加潜在上下文反降16.5%;行为差异可由观测特征解释,单一指标不足以评价奖励。
ProDVI:用于价值网络初始化的程序化动力学先验
用大模型生成程序化动力学先验,预训练价值网络,提升强化学习样本效率。
自我预训练是否真的有助于改善医学时间序列的诊断?
自我预训练可提升医学时间序列分类准确率0-6%,对深层模型效果更佳,无需改变架构即可增强数据有限场景下的鲁棒性。
基于拓扑路由混合曲率专家的动态图提示
提出拓扑路由混合曲率专家动态图提示框架,自适应拓扑演化几何,提升少样本链接预测。
LLM推理在突发负载分布下的优化:改进WAIT算法
提出轻量级WAIT扩展,在线估计请求强度,适应时变到达率,仿真显示吞吐优于Sarathi-Serve等,延迟相当。
Kastor:面向PDE模拟生成式仿真的高效微调策略
提出Kastor微调策略:两阶段推理+均值正则化+梯度匹配,提升PDE模拟生成仿真的精度与效率。
BioKD:基于可靠性门控的选择性生理-视频知识蒸馏用于情绪识别
BioKD:用可靠性门控实现生理到视频的知识蒸馏,在DEAP/AMIGOS上提升情绪识别且无额外推理开销。
SkillTFM:表格基础模型免训练自适应的门控技能演化
SkillTFM 免训练适配表格基础模型,以门控技能演化提升 AUC 0.128~0.142。
混合自适应线程调优以缓解高性能强化学习推理中的仿真执行瓶颈
结合神经算子与排队模型调优线程,提速18.4%,吞吐1.7倍,耗时降低83.8%
基于阈值的二值激活神经网络累加提前停止
二值激活网络累加可提前预测符号,据此训练后提前停止,无需重训练。节省25%运算,精度仅降1.36点。
面向全球天气预报的时间步条件Transformer
GEM-3模型:单套权重可配置时间步推理,混合时间步训练提升稳定性,实现全球中期预报。
面向AI治理的后训练适应技术六维分类法
提出后训练适应技术的六维分类法,梳理术语与关系,支撑AI治理与技术跟踪。
RxnCLF:面向改进反应性预测的对比变换感知反应基础模型
提出RxnCLF反应对比学习框架,基于凝聚反应图,预训练170万反应,在多个产率预测基准上超越现有模型。
Continual Learning in Transition
SAGA:面向低资源北欧语言模型的分数加权自适应生成对齐
提出SAGA,用解析器监督替代人工偏好,提升丹麦语、冰岛语、挪威语语法质量,无需人工标注。
MetaboLLM:一种面向代谢组学的专用大语言模型,用于生化知识整合与预测性代谢物图构建
代谢组学专用大语言模型MetaboLLM整合生化知识构建预测性代谢物图,两个预测任务中均优于基线且具可解释性。
使用条件查询的假设检验:可学习性与交互的价值
若能通过有限查询区分分布类,则自适应与固定查询差异至多平方级;交互无指数优势。
Surv-IPTB:一种基于注意力机制的生存数据个体治疗获益概率估计模型
提出Surv-IPTB注意力框架,将个体治疗获益概率转为二分类,处理右删失,优于元学习基线。
非凸情形下的驯化次梯度未调整朗之万算法
提出驯化次梯度未调整朗之万算法,用于非光滑、超线性增长、非凸采样,给出 Wasserstein-2 非渐近界,并在 LLM 预训练验证。
BaKron:基于Kronecker分解Hessian的高效量化
BaKron用Kronecker分解Hessian加速量化,复杂度从m²n²降至mn(m+n),媲美GPTQ且利用更丰富曲率。
RRC:基于排序的奖励构建释放大语言模型强化学习中生成式奖励模型的潜力
提出基于排序的奖励构建,用相对偏好生成奖励信号,解决生成式奖励模型与标量评分失配,提升强化学习训练效果。
CLARA:通过结果分析澄清自然语言癌症基因组学查询中的语言歧义
该框架通过类型化查询和结果分析区分关键歧义;基准测试中识别全部敏感对比,准确率89.2%,敏感度100%。
CalibForge:对抗性求解器校准以扩展可学习终端任务
CalibForge通过对抗性求解器校准构建可学习终端任务,显著提升Terminal-Bench等多个基准的表现。
优雅地失败:减轻不可避免的机器人故障的影响
提出安全评估法,综合故障交互概率与后果严重度,并开发故障基准仿真框架,助力家庭机器人安全部署。
无需监督的在线策略自蒸馏
提出U-OPSD,仅用模型自生成与多数投票实现无监督自蒸馏,超越基线,媲美有监督方法。
一个量子比特胜过一比特:后训练量化的量子优势
提出量子随机存取量化(QRAQ),用上下文匹配的泡利测量恢复符号,在最优符号不兼容时显著降低理想重建风险。
人工智能与数字化转型时代的音乐教育挑战
音乐教育面临AI与数字转型的深刻挑战:音乐本质、受众、创作方式剧变,需重新思考教与学。
统一因果推断框架用于获益-风险评估中结局排名理想度范式
提出统一协变量校正因果推断框架估计DOOR概率,模拟比较多种估计方法,CVTMLE-SL表现最优,并用耐药菌数据验证。
最优不可知PAC算法
对有限VC维类构造最优不可知PAC算法,达到统计最优风险界,解决样本复杂度并匹配下界。
面向可靠数据驱动时间使用优化的质量多样性
引入不确定性量化的质量多样性框架,平衡健康收益与模型置信度,产出低不确定性高可靠时间使用建议。
无方程周期感知预报误差收缩:从短轨迹集合估计负最大李雅普诺夫指数
提出周期感知预报误差收缩法,无需方程从短轨迹估计负最大李雅普诺夫指数,经映射验证精度高。
基于谱图理论的物理分子指纹提供高效且几何感知的化学相似性度量
基于谱图理论的物理分子指纹,以低成本编码三维结构,区分二维指纹无法区分的异构体,高效度量化学相似性。
考虑速度与市场状态的日内期权操纵检测及可解释归因
操纵留痕于状态速度的泵-崩形态,可跨市场迁移;精确率上限源于标签不全而非检测失效。
基于正则性粗化的计算高效协作通信
存在短高效协议即可高效通信:多项式时间构造近优协议,通信量仅指数于最短协议,指数依赖最优;采用加强弱正则引理。
开放权重LLM能否生成内核验证的Coq证明?初步研究
初步研究表明,六个开放权重LLM在100个定理中仅验证21个证明,成功率3.5%。
文本中恶意指令的鲁棒上下文感知检测
提出上下文与查询感知的恶意指令检测,并用对抗训练增强鲁棒性,优于现有基准。
离散能量:有限元替代模型的精确无标签训练目标
本文证明离散势能可作为无参考解的精确训练目标,其最小化等价于刚度范数下的监督回归。
使用噪声波动和连接重缩放对任务训练的循环神经网络进行有效剪枝
噪声剪枝在任务训练循环网络中保持性能,优于幅度剪枝,采样与重缩放关键。
一种带自适应动量的惯性块近端线性化方法,用于非凸非光滑优化
提出惯性块近端线性化自适应动量方法,双相位动量与双外推点加速非凸非光滑优化,保证收敛并优于现有方法。
基于EDM2的生成模型:从开放数据集合成高分辨率胎儿超声图像
基于EDM2的胎儿超声合成,六类512x512图像,FID更低,分类达93.36%,临床评分2.67/5
Behavioral Residualization for Unsupervised Intrusion Detection in Automotive CAN Networks
增强科研网络异常韧性:面向动态安全基线的大规模预测基准
提出高保真流量预测框架,评估六类模型,TiDE误差降30-42%,显著提升异常区分。
LC-Implicit-QAOA:有界QUBO光锥上训练的活动工作区上限精确目标与梯度评估
提出LC-Implicit-QAOA,在有界QUBO光锥上精确求目标与梯度,按活动工作区预算分配;内存不超限,梯度误差1.56e-13。
RASP-QAOA:面向精确QAOA模拟的资源感知逐实例选择
资源感知逐实例选择,过滤后排序;31请求全成功,top-2 31/31,PAR10降至0.0396倍。
仿变形虫自主行走机器人利用人工本体感觉实现地面状态的非视觉分类
采用多模态传感与储备池计算,仿变形虫步行机器人能高精度非视觉区分平坦与粗糙地面,并据此切换步态。
可证明高效的自校准量子容错
利用纠错综合征信号实现自校准,证明对控制误差高效收敛,且速率与码距无关。
用于非侵入性压力监测的低功耗可穿戴呼吸传感器
低功耗可穿戴呼吸传感器,通过腹部力敏电阻采集,区分压力与放松,准确率88%。