数据驱动的火区划分用于改进短期野火预测
用流域检测与K均值聚类划分火区取代均匀网格交并比提升3至6个百分点计算轻量
沉浸边界软体游动体运动的神经算子
开发神经算子代理模型预测软体游动者流场,全局误差约3.5-5.6%,但压力精度与物理一致性待提升。
PhysAttNet:通过物理信息注意力提升工业与天体物理时间序列的预测性能
提出物理信息注意力框架,通过物理约束提升工业与天体物理时间序列预测的准确性、泛化性与可解释性。
CODS:可复用离线强化学习的迭代贝尔曼残差数据选择
CODS用评价器迭代选取高残差转移,10%预算保留96.6%性能,优于各子集基线。
平均奖励强化学习的有限常数前沿与可审计遗憾证书
引入常数感知比较协议,导出有限下界证书,遗憾系数由0.015升至0.0291,并给出可审计上界规则。
从token概率到校准置信度:数学问答的实证研究
研究大模型在数学问答中的置信度估计,发现序列级概率聚合优于单token,多遍验证法可校准,事后校准降误差但迁移有限。
CommitKV:面向多轮智能体的基于提交转换的生命周期感知KV缓存压缩
利用提交转换区分休眠与完成信息,压缩键值缓存,降低内存,加速推理,提升准确率。
μ-重置策略学习的样本复杂度
μ-重置策略学习复杂度:全覆盖集中率下界exp(Ω(H)),前推集中率紧确exp(Θ(√H)),解决可实现性问题。
CONFER:多模态情感识别中机制校准弱监督的冲突感知证据协商
提出图式冲突感知协商框架CONFER,解决弱监督多模态情感识别中自我报告不可靠与跨模态冲突,多个数据集上性能领先。
V-Simba:释放视觉连续控制中强化学习的架构潜力
V-Simba基于SAC加数据增强,用归一化层和点卷积改进视觉RL架构,在多个基准匹配或超越SOTA,且比DrQ-v2更高效。
轻量微调下的路由器敏感性识别混合专家模型中的可剪枝专家
轻量微调中,路由器敏感度可识别可剪枝专家;LoRA仅0.002%参数剪半专家更优,内存降49%,延迟降37%。
自适应KappaSharp:面向偏好贝叶斯优化的条件数整形
提出自适应KappaSharp,通过Hessian条件数整形改进偏好贝叶斯优化,性能优于基线。
形态变化的专家压缩:LorExperts 与 BTExperts
提出LorExperts:按共激活聚类专家,每簇保留主专家,其余用低秩修正;不重训路由器,压缩50%时多数任务优于基线。
从基准性能到实际部署:人机协同异常检测
评估19种模型在工业数据上性能不稳,提出人机协同框架弥合部署差距。
TEMPER:表达性残差路由的张量化高效流形约束参数化
针对残差路由中稠密生成器参数随流数快速增长,提出用张量网络参数化生成器,保持流形约束,性能更优。
轨迹驱动评估何时误导 MoE 专家缓存?重放语义、工作负载污染与运行区间
轨迹驱动评估易误导MoE缓存:重放语义、负载污染、运行区间皆影响结论;离线最优差距大,轻量因果预测仅恢复少量。
SPECTRA:谱变换编码推动KV缓存突破2比特悬崖
SPECTRA用谱变换重编码KV缓存集中比特于重要通道实现4倍近无损12倍压缩突破2比特悬崖
跨批次边界的信息路由:Lipschitz 老虎机中的记忆-批次权衡
在利普希茨老虎机中刻画跨批次信息路由权衡:状态宽度与更新深度不可互换,新惩罚项给出极小极大遗憾界。
基于LLM的程序分析与优化嵌入
结合源码与IR嵌入的LLMCompiler程序分析优化,算法分类错误率1.54%,优于现有最佳12%
同策略自蒸馏的自适应监督锚定
针对同策略自蒸馏中轨迹偏移削弱监督,提出分离轨迹条件匹配与规范监督、按对齐度自适应锚定的框架,提升任务获取与稳定性。
频谱离群值揭示Transformer注意力中的主导学习结构
用MP随机矩阵理论分离注意力权重,消除谱离群值使性能接近随机,表明其编码主导学习结构,Q投影离群最多。
从不确定性到失败归因:分布偏移下的自诊断模型
提出自诊断模型,在分布偏移下不仅检测OOD样本,还区分协变量偏移、语义偏移、噪声和对抗扰动四类失败原因,实现从标量不确定性到失败识别的突破。
二阶漂移模型
提出二阶漂移模型,引入速度变量加速密度扰动,缓解频谱刚性,保持单步推理,表现优于一阶基线。
工具增强LLM系统中的持久语义实体
工具增强LLM存在跨会话持久语义实体,名称绑定致污染普遍,偏好与指令污染持续,自验证可降36.5%。
EasyBalance:分布式MoE推理中的跨层负载均衡
提出EasyBalance跨层负载均衡,不改专家映射,联合执行跨层任务,GPU空闲降低超40%。
ZeroLock:模块化更新解耦实现并发内存高效的大语言模型训练
零反向传播,模块化解耦更新,内存降26.5%,吞吐升4.9%,收敛接近BP。
质量-多样性压力测试过程奖励模型:存档覆盖能证明什么,不能证明什么
用MAP-Elites对过程奖励模型做压力测试,发现覆盖界有限,残差由拟合误差和Lipschitz半径决定,无法仅凭覆盖分数保证最坏情况。
准确集成,脆弱叙事:多尺度堆叠与信用风险大模型生成解释的保真度审计
多尺度堆叠集成仅小幅提升预测;大模型解释保真度差,归因符号不稳,提示工程不足,须生成后核验。
所有大语言模型都知道自己何时在输出有害内容吗?跨模型家族潜在空间安全探针的可复现性研究
复现轻量级探针检测有害提示实验,验证其可跨模型家族泛化,并发现推理随机性不影响潜在向量与F1分数。
时间序列基础模型强化学习后训练的真值邻域正则化
针对强化学习后训练导致次优崩溃,提出真值邻域正则化,引导模型概率向真值邻域移动,提升性能。
奖励破解下的评估器集成:协方差几何与有限搜索保证
协方差几何表明:评估器共同模式误差不可识别,分歧度不可靠;有限搜索后悔界呈√logK标度并渐近紧。
动力系统辨识中的自适应对称性发现
研究未知对称群下从单条轨迹辨识动力系统提出自适应发现对称性的方法实现与已知对称性相同的短轨迹最优长度
支持选择超越平滑DAG精确性:补全几何、得分边际与选择性证书
证明DAG边界上最小环补全生成单项式理想,导出选择时间标度律,并用实验及新统计量验证;有限样本下置信族和强制对立查询可认证骨架与碰撞标签,分离可行性、选择与因果识别。
TSDS工具箱:时间序列数据集相似性度量工具箱
提出TSDS工具箱,统一比较时间序列相似性方法,支持扩展与集成评估,实验验证有效。
CLAM:基于因果空间分解从粗粒度数据推断局部效应
CLAM结合因果机制与空间分解,利用高分辨率协变量从粗数据推断局部因果效应,支持反事实推理,用于卫生环境政策。
中文标题
提出混合嵌套搜索框架,外层LLM生成结构草图,内层数值优化器调参,解耦结构与参数,在多个领域优于纯LLM或纯数值优化。
从环境反馈中学习:面向智能体强化学习的多时间尺度信用分配
提出EFCA,利用环境反馈的多时间尺度信用分配,补充长短程信号,提升长程智能体RL任务成功率与质量。
基于潜神经微分方程从发病后稀疏测量预测血栓生长
用潜神经微分方程从稀疏测量推断参数并预测血栓增长,SNODE最佳,有望用于个性化血栓建模。
基于生物学信息的表示学习实现MALDI-TOF质谱稳健跨中心泛化
提出DALMA框架,融合生物学监督与域重建学习可迁移表征,实现跨中心零样本微生物鉴定与耐药预测,性能领先。
DoGMA:中心法则引导的肿瘤多组学对齐与多任务学习基础模型
该模型以中心法则指导方向注意力,结合重建预训练,促进跨组学交互,在癌症多任务中表现优异,验证领域归纳偏置价值。
FreSH:面向多变量时间序列分类的频率分段层次化多专家框架
频率分段层次多专家框架FreSH,自适应融合多尺度特征,在30个UEA基准和振动数据超越SOTA。
控制多样化强化微调:解耦强化学习后训练中的共享控制瓶颈
提出控制多样化强化微调,解耦共享控制瓶颈,提升数学代码逻辑多任务能力,且控制解耦可迁移
SAGE:面向生产RAG系统的SLO感知自适应检索
SAGE:学习型SLO感知自适应检索,动态选k,提升SLO合规率,降低延迟和成本,质量损失小。
超越聚合校准:分解自动化信用违约预测中收入条件召回率差异
高收入违约者更易被误标噪声,召回率差16.86个百分点;剔除收入利率,差距由贷款、房产等代理变量维持。
重放差距:LLM智能体模型切换的静态评估评错了世界
重放评估假设切换模型不影响智能体后续轨迹,但分支实验显示大幅偏离,评分与真实世界不符。
有状态CARS:策略约束LLM智能体的精确跨历史复用
提出有状态CARS,通过状态-延续模式精确采样并跨历史复用无效证书,理论证明完备,但无系统优势。
面向序数回归的促进单峰性正则化学习
针对序数回归,提出规避尺度偏差的促单峰正则化方法,提升预测性能,小样本更优。
机会不等于可实现性:多LLM路由的选择有效诊断
Oracle机会大多不可实现:选择有效区间显示最强路由器仅恢复7.5-14.4%,最优策略下限为零。
基于机器学习的铁路车轮缺陷被动超声检测诊断框架
利用被动超声与机器学习实现铁路车轮多类缺陷识别,随机森林分类准确率约0.66,验证了非接触检测可行性。
神经劳动分工:受生物启发的模块化架构用于稳健的神经形态计算
受生物神经系统模块化启发,提出可分解脉冲神经网络(D-SNN),分离分类路径,参数少、能耗低,抗灾难性遗忘,决策透明,适用于边缘环境。