多重分布漂移下面向可靠经济预测区间的动态机制感知共形校准
提出动态机制感知共形校准法,在多重分布漂移下覆盖最接近名义水平,可靠性最优但效率略低。
结构化损失函数下数据驱动多超参数调优的紧界
针对数据驱动多超参数调优,用实代数几何细化上界,提出多机制下界框架,证明紧界,并推广至双层验证损失调优。
时空交通预测中的通用语义知识注入
通过通用知识图谱构建语义子图并生成嵌入,与传感器图融合,为GNN提供语义上下文,提高交通预测精度。
CORAM:模型合并的相干正交旋转
CORAM通过SVD分片合并专家模型,用放大系数修正收缩,性能优于OrthoMerge,匹配或超越最强基线。
增材制造中的物理信息与混合机器学习:熔丝制造应用
融合物理约束与仿真数据,三种策略改进深度学习预测FFF部件结合质量与孔隙率,有限数据下提升精度。
Abra:扩展扩散图像训练规模
扩散模型缩放规律与语言模型相似,但最优计算需每参数约200图像token,是Chinchilla十倍;对过度训练稳健,应重数据轻模型规模,曲线呈普适形式。
悲观元归纳及其限度:频率主义统计学与机器学习理论的启示
反驳悲观元归纳:削弱其归纳步骤,用频率主义与机器学习论证枚举归纳处处收敛,而元归纳及任何方法几乎处处不收敛。
重复作为强化:通过即时回合重复提升强化学习中的样本效率
提出即时回合重复机制,交互中重复成功回合动作序列,提升样本效率,优于回放与自模仿基线。
GUPO:面向大语言模型后训练的不确定性感知梯度策略优化
针对GRPO中组梯度方向冲突损害策略更新,提出贝叶斯建模组梯度并估计分布,用狄利克雷分布量化不确定性来校准聚合,多基准实验验证有效。
病理传输:临床数据的最优传输解释,以及热图(未能)定位疾病之时
用最优传输生成临床解释,但热力图在真实病灶定位上失效,合成到真实存在鸿沟。
Agentic ESOpt:以极低GPU需求微调长程LLM智能体
提出Agentic ESOpt,用进化策略全参数微调长程LLM智能体,仅需推理级显存,性能优于基线。
评估RL可解释性方法对修复智能体缺陷的帮助程度
提出EvalXRL基准,用LLM智能体通过XRL方法诊断修复RL故障,以奖励信号评分,闭环比较各方法。
基于记忆库修正的无训练人在回路异常检测
无训练人在回路:专家编辑记忆库修正检测器。十样本加修正效果接近全训练,显著改善12/15类且无损害。
基于分数生成先验的并行贝叶斯成像:皮卡德近端蒙特卡洛
提出PiX-MC并行贝叶斯采样框架,结合近端Langevin与Picard迭代,多块退火,保证收敛,CT成像提速50倍。
消除几何
提出消除几何框架,研究局部最优对象由共享规则实现的条件,区分架构阻碍与模型误差,指导修复与验证。
标签偏移下分子属性的共形预测
针对标签偏移,用共形预测加权分数,无需重训给出严格区间,稳健量化分子属性不确定性。
因果局部状态:动力系统的可扩展同时因果网络推断与预测
提出因果局部状态框架,为每节点独立选最小邻域,同时推断因果网络并预测,重构精度高,预测与已知网络相当。
MAGPIE-Net:基于多时相FY-4A AGRI观测预测站点邻域短时强降雨事件
提出MAGPIE-Net,直接由卫星观测映射站点事件,优于网格降水预报,显著提升短时强降雨预警命中率与提前量。
跨视图对应是一种测量干预:智能体评估与信用分配的双向验证
跨视图对应是测量干预,需双向验证避免敏感性/不变性错误;提出效度理论与审计,实证显示最优回溯有分歧。
高风险环境下基于EEG的机器学习分布外检测
引入EEG分布外检测基准,评估多种方法及下游临床任务,区分检测与不确定性估计,组合互补方法形成安全网。
rl-triton:用于强化学习信用分配的高性能Triton GPU内核
提出rl-triton,以统一关联扫描实现7种RL算法,速度提升1.6-5.7倍。
分割联邦学习的高效资源优化
提出分割联邦学习联合优化框架,实现模型分割与资源分配全局最优及近似解,高效平衡能耗与延迟。
循环网络中的动态压缩
动态压缩让循环网络可回顾历史并修正固定大小状态,降低存储需求,提升多函数复用效率。
被遗漏的模式即罕见规则:连续代码世界模型中的采样验证危险定律
采样验证的危险:N次门控全部漏掉稀有事件的概率为(1-r)^N;接受只证明样本一致,不保证模式完整。
Rademacher和的四阶矩几何
确定拉德马赫和的高阶矩对四阶质量依赖,证明p≥4高斯稳定性不等式、p≥5欣钦常数猜想及p=3二次稳定性估计。
SIGMA:SHAP引导的隐式轨迹生成用于无元数据LLM自动特征工程
提出SIGMA,用SHAP引导特征生成,免元数据,常量上下文;隐式轨迹降重复率至6.8%,均用5.4特征达SOTA。
利用知识编辑中的关联上下文检索构建针对大型语言模型的白盒攻击
提出基于知识编辑的白盒攻击,利用关联上下文检索将约束移除扩展至整个类别,攻击有效且不损通用性能。
面向开源IC设计轻量级预布线延迟估计的混合机器学习
混合决策树与线性回归,预布线延迟误差降八成,模型小三百倍、快两倍,可解释性强。
辩论训练减少RLAIF中的奖励黑客行为
辩论对抗训练可减少奖励黑客,弱裁判下性能提升45%,但需平衡博弈防止批评者攻击裁判。
MoRAX:基于移动性的地理空间基础模型表示增强
MoRAX基于移动性增强地理空间表示,捕捉城市功能结构,支持零样本部署,超越强基线。
MotoSafety:基于学习时间重要性的边缘AI,用于时间压力下两轮车碰撞风险评估
提出基于学习时间重要性的边缘AI框架,用于时间压力下两轮车碰撞风险评估,准确率94.97%,适合低成本部署。
过于自信反而不安全:面向可靠日志异常检测的模型校准
日志异常检测中模型过度自信导致错误,提出LoRD后验校准方法,基于重构距离提升置信可靠性,不牺牲检测性能。
再循环
推理时架构增强再循环,利用模型自身引导修改,免训练,困惑度降23%,GSM8k准确率升21%。
基于LLM反馈的策略不变奖励塑形:混合强化学习智能体框架
将LLM进度分数作为有界势函数进行奖励塑形,可保持最优策略不变,即使分数不准确,实验验证。
理解表格基础模型令人惊讶的泛化特性
单个真实表格预训练即可强迁移,且与任务无关;特征数比实例数更关键;提出任务中心与检索式泛化视角。
组合流匹配能量与已知物理:偏微分方程场上的生成、分布外检测与反演
流匹配模型给出显式能量,可校正生成、分布外检测,并与物理能量组合用于反演后验采样。
极端干旱期间作物产量预测方法的评估与改进
干旱使预测模型失效,样本加权和特征选择可提升传统机器学习模型,但深度学习模型VITA表现稳定且最优。
Why GPT式模型不直接迁移至符号音乐?压缩在错误的坐标系中进行
GPT式模型不直接迁移至符号音乐,因压缩需在正确坐标系中进行;分词应构建预测有效且关系无损的坐标系统,保留上下文自由。
集中博弈:贝叶斯更新、遗憾与信息
提出二人零和重复博弈,统一贝叶斯更新与指数权重遗憾,将集中不等式归结为比较器变分形式与信息预算约束。
TabNSM:面向表格回归的神经稀疏混合器
提出TabNSM,以自适应稀疏交互、多阶段回归头与难例采样,在九项基准上实现高效高维表格回归。
重新审视WEASEL 2.0:复现、敏感性与自适应集成规模规则
复现WEASEL2.0于114个UCR,精度吻合;集成规模规则过配,自适应规则省内存时间,精度基本不变。
网络去噪再探:受里奇流启发的图扩散方法
提出基于曲率引导的里奇扩散法,利用里奇流思想调节图几何,实现稳定去噪并提升结构恢复效果。
有效场论视角下扩散模型中的信息传播
用有效场论描述卷积扩散模型去噪,预测并验证两点互信息按布朗运动增长。
通过健康信息学中的多层级公平推进健康公平
评估多层级公平技术的健康公平效果,揭示实施与报告差距,提出提升透明度和优先健康公平的建议。
中文标题
冻结视觉语言模型写控制代码,闭环内每K步重写,无微调。成功率从3.5%提升至35.1%,提升十倍。
哪些CS1学生会不及格?——利用加权学业动量与交互日志,从计算机系统与架构的学习分析中识别数字标记
基于加权学业动量、人口学与LMS活动的数字标记,第五周以87%召回率识别挂科生,AUC0.800,可部署预警。
动态混合专家服务的常数竞争比算法
证明动态混合专家服务随机原问题竞争比为常数Θ(1),给出常数竞争算法并经Lean 4机器验证。
变分量子自然语言推理的SPSA超参数调优
SPSA超参调优后QNLI准确率55%,仍低于参数位移基线;Bures预处理放大噪声。
MITRE-SAGE:一种多智能体网络安全问答模型
提出MITRE-SAGE多智能体框架,融合语义与结构知识,优于现有方法,并构建3000问答对基准。
异构数据集的对角多组学整合
研究异构数据集的对角多组学整合,分析生物异质性,提出基于最大最小点差的新异质性特征。