联邦聚合在模型投毒与后门攻击下的分析:跨数据集与跨架构基准重构
重构500格基准,评估5种聚合方法;Trimmed Mean干净准确率最高,Krum抗攻击最优;排名稳定;指标审计揭示触发目标标签率;结果仅为描述性比较。
带背包约束的上下文老虎机再优化算法
针对带背包约束的上下文老虎机,提出UCB再优化算法,将平均遗憾降至O((lnT)^3/T),优于文献中O(1/√T)。
生成引擎的机制设计:从利用走向共赢
生成引擎引用竞争损害内容质量,提出可验证内容奖励机制VCR,实现平台与创作者共赢。
基于扩散的数据驱动型选品优化
提出引导离散扩散的选品优化,奖励引导平衡探索利用,模型误设下稳健,生成多样高质方案。
Click2Poly:面向建筑与墙体矢量制图的视觉语言模型
Click2Poly是人机协同AI助手,扩展Florence-2模型,点击即可编辑建筑/墙体矢量层,作为QGIS插件加速人工修正。
AutoGrable:什么样的图对表才是好图?
无需训练图神经网络,用行划分对齐标签选择列构图;可低成本搜索候选图,也能在无益时拒绝建图。
让它煮:在序列决策中学习等待
训练等待策略,减少感知决策但不牺牲任务表现,采用字典序强化学习,实验可等待过半时长。
基于模型重编程的图神经网络模型提取防御
提出图重编程保护框架,以结构感知门控构建动态防火墙,保持正常性能并显著削弱模型窃取攻击。
用于噪声标签聚合的对偶-原始图变分自编码器
提出对偶-原始图变分自编码器,以图注意力聚合噪声标签,潜变量为真值,无监督达最优,可扩展辅助信息。
XGBoost“就是一切”:区域供热系统传输热能预测案例
比较XGBoost与LSTM预测区域供热热能,XGBoost更优且计算成本低、碳足迹小。
通过广义Lipschitz光滑性保证神经网络梯度下降的收敛性
证明一般前馈神经网络梯度下降收敛:仅需激活函数利普希茨光滑有界,最小梯度范数以O(1/T^{1/L})速率趋于零。
物理感知潜空间代理模型的变分参数校准
提出物理感知潜空间代理框架,实现降阶建模与变分参数校准,观测监督提升潜变量质量,对噪声和部分观测鲁棒。
HyperFix:任务向量合并的组合非线性校正
HyperFix用轻量超网络预测子集条件的非线性校正,泛化至更大子集,免逐子集调参,性能超越现有方法。
RelShap:关系一致性Shapley解释
提出RelShap,将关系约束与数据血缘纳入Shapley值计算,仅评估合法配置,兼容现有估计器,利用函数依赖加速,解释更忠实于数据。
超越参数空间的PAC-Bayes:行为等价性、Z信息与精确复杂度分解
经典PAC-Bayes复杂度可精确分解为行为选择项与实现级项,后者对应Z信息,且行为项有最优代表,预测行为是复杂度核心。
RECAST:粗网格偏微分方程求解器的机器学习校正与超分辨率框架
RECAST机器学习框架校正并超分辨率重建粗网格PDE解,误差降50%-92%,精度兼备提速。
基于非对称RoBoSS损失函数的稀疏鲁棒几何孪生支持向量机
提出基于非对称RoBoSS损失的几何孪生SVM,结合l1范数实现特征选择并抑制噪声,实验验证优越性。
当离线评估误导时:延迟反馈上下文老虎机中奖励与策略选择的诊断协议
提出延迟反馈上下文老虎机诊断协议,筛对齐与可学习性;发现静态指标会错排奖励,个性化溢价易高估。
Dion3:全栈正交更新
Dion3改进Muon优化器,用格拉姆牛顿-舒尔茨、CuteDSL内核、兆批处理及行选择更新,降开销提速达6倍且不损精度。
FM-LLM:频率增强的混合专家框架,用于将LLM适配时间序列预测
提出FM-LLM:无提示词频率感知混合专家适配LLM,11基准达SOTA,MSE/MAE显著提升
多维随机场条件分布重建的局部Sinkhorn框架
提出局部Sinkhorn散度框架重建多维随机场条件分布,高效训练随机神经网络,平衡几何保真与计算效率。
FLARE++:动态路由的低秩注意力
FLARE++提出动态路由低秩注意力,用输入条件查询替代固定查询,保持线性复杂度,提升PDE代理与LRA精度。
数字孪生车联网中的分层联邦迁移学习
针对数字孪生车联网数据异构稀疏问题,提出分层联邦迁移学习,结合车辆聚类与质量评分提升全局模型精度。
基于模型-特征空间一致性的鲁棒模糊检测(RAD)
提出RAD框架,利用模型与特征空间一致性量化预测模糊性,可视化并用于弃权预测。
认证客户返回时间预测中何者有效:条件信号的筛选-确认检验,及为何衰减近乎足够
提出筛选-确认检验认证信号有效性,证实连续时间衰减近乎足够,额外条件信号冗余或有害。
基于多传感器数据与稀疏野外校准的可迁移地上生物量估算模型
提出多传感器数据与稀疏野外校准的可迁移AGB估算模型,全局CNN训练后局部校准,R²达0.82,RMSE约15 Mg/ha。
低交互秩学习:统一乘性双编码器头
提出低交互秩理论统一乘性双编码器架构,解析逼近误差与样本复杂度,证明归一化为规范固定,白化可识别交互模式。
GCPO:诊断并约束大语言模型 rollout 强化学习中的子空间几何
提出GCPO方法,用正交投影约束更新子空间,防止性能退化,在推理、代码等任务上优于GRPO,并消除长度膨胀。
FunnelCausalNet:面向多层级优惠券分配的漏斗感知转化-收入联合提升模型
提出FunnelCausalNet,耦合转化与条件价值实现GMV分解,经RCT验证与消融实验,在零膨胀场景显著降低GMV误差,并优化多层级优惠券分配的ROI。
评分标准随机丢弃:缓解以评分标准为奖励的强化学习中奖励黑客的简单方法
提出标准丢弃法:训练时随机丢弃部分评分标准,缓解奖励黑客,提升分布外金标准分数,优于重加权。
LEMUR:基于视觉锚定推理重定向的潜熵感知多模态遗忘
RL训练推理模型的推理链会泄露敏感信息;LEMUR以熵动态引导重定向,免训练抑制泄漏并保效用。
正式定义智能体记忆:基础、张成空间、最优性及序列记忆问题
将记忆定义为基,知识为张成空间,可回答性为覆盖问题,最优记忆为容量约束下期望覆盖最大化,并形式化连续智能体记忆问题。
漂移与依赖:基于回放的持续学习的逐层信息论界
提出逐层信息论框架,将回放式持续学习的泛化差距分解为表示漂移和优化依赖项,并给出在线诊断工具。
每智能体策略组合安全吗?重新思考协作多智能体强化学习中的后继特征迁移
独立组合策略可能劣于库中所有策略,提出MA-USFA双层方法兼顾安全与灵活。
面向EEG-语言基础模型的连续潜在预测与语义对齐建模
提出BLPM,用连续潜在预测与语义对齐建模EEG-语言,统一异质解码任务,实现跨任务泛化。
REOPD:面向在线策略蒸馏的可靠性自适应奖励外推
提出REOPD,用token级可靠性自适应系数进行奖励外推,无需额外模型,在多数场景超越G-OPD。
方向而非幅度:合并语言模型中任务向量干扰的因果结构
任务向量干扰由方向而非幅度决定;沿因果方向擦除可消除干扰,幅度仅为粗略相关。
整合器:跨上下文边界学习持久路由记忆
整合器将路由短期记忆转化为长期记忆,清除缓存后仍影响路由,使更新映射召回率从44%升至87%
面向分布外泛化的外延复杂度引导数据选择与生成
以外延复杂度为训练信号指导数据选择与合成生成,复杂度越高,零样本/微调下游性能越好。
TradingMoE:在不断变化的市场中路由正确的专家
针对LLM交易中专家路由失效问题,提出TradingMoE,用轻量残差专家、查询-键路由及稀疏更新机制,在股票和加密货币市场收益分别提升30.89%和30.7%。
思维链展示通向树的路径:实现分支复杂度
两层硬注意力解码器实现深搜与迪杰斯特拉,复用在线性步内算树斯特拉勒数和宽度,免层归一化与位置编码。
鲁棒且高效的噪声标签时间序列分类:基于动态时间规整的粒球计算方法
提出DTW-GBC,用粒球组织相似样本,在粒级分类,抗标签噪声且减少推理计算量,兼顾鲁棒性与效率。
MOON:多目标正交归一化更新用于多任务学习
提出MOON,利用谱-核范数几何进行正交归一化多目标更新,提升多任务学习优化与性能。
基于学习变量交互的高维多目标贝叶斯优化
提出ViaMOBO,用变量交互分析划分高维决策空间,局部贝叶斯优化,高效逼近Pareto前沿,优于现有方法。
自动驾驶中渐进式GNSS欺骗检测的高阶液态证据编码
提出高阶液态证据编码,结合物理残差与高阶变化分层检测渐进式欺骗,F1最高0.9777。
基于LSTM和注意力机制的空气质量站点模拟
提出SATADL模型(LSTM+注意力),模拟故障站PM10浓度至48小时,多数据集上优于基准,可作虚拟代理站。
JAPE:多变量时间序列中的联合异常预测与内在解释
提出JAPE框架,建模演化依赖结构预测多元时间序列异常,原生变量级解释,性能显著提升。
可扩展多输出高斯过程回归的因子图方法
因子图实现可扩展多输出高斯过程回归:最近邻链排序使消息传递精确且线性,支持缺失数据,低维逼近精确核法。
从测试时扩展的视角理解在线策略蒸馏
在线策略蒸馏看似扩展能力,实则主要提升采样效率,是一种“幻觉式蒸馏”。
多输入多输出算子学习的核方法
提出多输入多输出算子学习的核方法框架,闭式训练推理,收敛率受限于最难子问题,高效且精度高。