体育活动赋能可扩展基础模型实现广谱健康预测
提出仅用步数数据的StepFM模型,高效隐私,在20多种健康预测任务中表现优异。
重新审视多模态时间序列预测的评估
新基准TimesX解决数据泛化差、文本类型少、评估泄漏问题,发现简单集成方法利用文本上下文可超越强基线。
现实世界客户端流失下的鲁棒联邦学习
FeLiX框架通过流式感知可用性等机制,实现现实场景下2.37倍加速与1.30倍带宽节省。
UP:无界正非对称优化——打破探索-稳定性困境
提出无界正非对称优化(UP),通过不对称设计同时实现充分探索与稳定性,通用即插即用,显著提升多种RL算法推理精度。
物理引导的时空神经模型用于燃料密度预测
物理引导模型结合质量守恒约束,提升燃料密度预测准确性与稳定性,优于纯数据驱动方法,支持火灾管理。
通过有限自动机高效推理的扩散语言模型约束解码
提出基于有限自动机的扩散语言模型约束解码算法,保证约束满足、支持并行解码,在函数调用等任务中显著提升精度且开销低。
在线数据选择即隐式对齐
在线数据选择通过改变训练数据隐式调整模型行为偏好,无需额外偏好优化即可引发对齐漂移。
基于厄米块Krylov子空间的有向图规范不变可学习谱位置编码
提出基于厄米块Krylov子空间的规范不变可学习谱位置编码,高效计算,泛化优于传统方法。
一种混合量子-经典扩散模型用于图像生成
融合自编码器与量子扩散模型,在潜空间高效生成图像,简化反向动力学,在MNIST上验证可行性。
神经网络优化中的信息分配动力学
提出信息分配动力学,揭示优化器隐式偏差源于权重与偏置参数路径间的训练信号相对分配,并可通过连续指数调整。
基于大语言模型标注的知识增强高风险驾驶场景数据集(用于自动驾驶)
K-Risk数据集整合全球轨迹数据,提取3.1万高风险及千余极端事件,融合风险标注与语义推理,为自动驾驶安全提供标准化基准。
ORCAID:基于斜规则的深度强化学习策略连续动作解释
ORCAID通过斜决策树从连续动作深度RL提取可解释规则策略,三分段搜索与叶子合并,性能强且参数少。
语言模型中的分布式稀疏干预
提出分布式稀疏干预(DSI),通过干预仅0.01%的神经元即可激活任务行为,实现精细控制。
分形KV缓存档案:面向长上下文LLM推理的无损符号存储与原地检索
提出无损KV缓存档案格式,支持线性时间随机访问和追加,结合残差量化压缩36-54倍,困惑度损失11-15%,同时可作搜索索引。
先验匹配的运行中地球观测分类器评估:一种三数字报告方法,以Sentinel-1内波检测为例
针对类别平衡训练与运行先验失配导致精度虚高,提出三数字报告法,在Sentinel-1内波检测中验证,真实精度仅0.192。
几何-非几何优化器微积分:一种可达梯度方法的模块化语言
提出模块化语言审计梯度方法,证明严格下降方向可表达性,定义方向残差与轨迹复杂性。
HPG-Diff: 基于层次物理引导的扩散与可微连通性约束的拓扑优化
HPG-Diff通过层次物理引导和可微连通性约束,实现拓扑优化误差低于5.3%,浮材比低于2.9%,并可轻量微调适应新域。
完整性约束下的关系深度学习结构对抗攻击
研究在完整性约束下对关系深度学习的结构对抗攻击,梯度攻击优于随机基线,但分类任务提升有限。
非线性赌博机
提出EHM算法,处理重尾噪声下广义线性赌博机,达近最优遗憾界,并推广至非线性情境,无需已知参数。
神经网络的机制可解释性:电路、稀疏特征与符号推理
综述机制可解释性,通过电路分析、稀疏特征与符号推理,逆向工程神经网络内部算法以保障安全与可审计。
稀疏Delta记忆:通过稀疏性扩展线性RNN的状态
SDM通过稀疏寻址大幅提升线性RNN的隐状态容量,在相同参数下显著改善长上下文检索与推理性能。
多智能体AI控制:分布式攻击阻碍每个实例的监控
研究发现多智能体协调攻击时,单实例监控更难捕获攻击者,规划器加剧此效应。
延迟感知的运营可行性投标接受:一个带有后见上限的公开基准
提出货运投标基准FreightBidBench,含两个后见上界,级联策略以低延迟恢复约98%利润。
使用模型预测控制思想的强化学习安全方法
结合深度强化学习与模型预测控制的形式安全保证,通过安全滤波器实现安全探索,并在物理平台上验证。
BubbleSH:可变形界面的上升气泡数据集
BubbleSH数据集提供高保真模拟的气泡轨迹、速度与形状演化,用于可变形多相流数据驱动建模与基准评估。
通用视觉-语言模型用于快速射电暴检测:与专用检测器的零样本基准测试
零样本通用VLM检测FRB准确率93.65%,匹敌专用模型,误报率更低,纯噪声无误报。
TimEE:通过上下文学习进行端到端时间序列分类
TimEE是4.5M参数的端到端时间序列分类模型,通过上下文学习直接输出分类,无需训练,在UCR基准上ROC AUC排名第一。
The Optimal Sample Complexity of Learning Autoregressive Chain-of-Thought
面向智能体强化学习的单次推演异步优化
提出单次推演异步优化(SAO),用单次采样替代分组采样,减少离策略影响,提升训练稳定性与效果,在编码推理基准超越GRPO。
通过数据增强图正则化实现半监督学习的快速速率
利用数据增强图正则化,实现半监督学习O(1/n_L)快速收敛率,误差受对齐误差约束。
基于黎曼法坐标的列文伯格-马夸尔特方法的高阶几何更新
RNC-LM方法通过高阶几何更新消除参数效应曲率,提升收敛与鲁棒性,在PINN中误差降至1e-3,大规模拟合加速34倍。
无梯度黎曼朗之万采样器
提出GRiLS无梯度黎曼朗之万采样器,利用黎曼度量促进跨模式转换,无需梯度,混合效率高。
使用朗之万动力学训练时规避不安全集
研究强凸损失下轨迹落入失效区域的概率界,发现强凸性决定松弛速度,不安全集形状影响轨迹是否穿过。
多分类与多标签BERT用于CVE到CWE映射:分类体系结构如何影响错误
对比多分类与多标签BERT映射CVE到CWE,发现错误结构由分类体系驱动,而非模型选择,放宽层次评价后F1显著提升。
非对称焦点损失改进图神经网络预测药物-药物相互作用
非对称焦点损失使药物相互作用预测准确率升至89.2%,F1达89.4%,假阴性率降至9.1%
一种基于后验误差估计的神经网络架构自适应最优控制方法
提出后验误差估计引导的神经网络深度自适应方法,在误差最大处插层并推导可计算上界,性能优于现有方法。
神经算子驱动的拓扑感知进化策略用于PDE约束优化
NOTES融合DeepONet与CMA-ES,将设计维度从256降至25,效率超95%,实现高效迁移逆设计。
使用可靠性加权磁拉普拉斯(rwMagLap)恢复无节律垂体激素基因的候选昼夜节律调控因子
rwMagLap通过相位感知与可靠性加权,从无节律垂体基因中恢复昼夜节律调控候选,富集比7.95倍。
ECGLight:面向纸质心电图数字化和心肌梗死筛查的轻量计算框架
轻量端到端框架,手机拍照纸质心电图即可数字化并筛查心梗,CPU上30秒内完成,准确率达95.5%。
走向线性化的关键:分析驱动的Transformer线性化
分析驱动线性化,证明softmax依赖正交投影,引入结构干预减少误差,在32B参数模型上匹配长上下文检索性能。
不精确概率下的信息价值:信度集上的决策规则特定值与固定测度包络
提出不精确概率下信息价值的两种公式,分析完全、部分和样本信息期望值的性质与计算方法。
面向离体脑片记录的细胞类型分类的伪标记工作流
提出无监督伪标记工作流,将人脑片MEA记录尖峰分为锥体细胞和中间神经元,降维聚类评估,严格筛选提高分离度。
PeTeR:概率电路的训练后鲁棒化
提出无数据后训练框架PeTeR,鲁棒化预训练概率电路,无需重训,有效应对分布偏移。
数据如何塑造RoPE频率使用:从位置尺度匹配到长度泛化
数据决定RoPE频率选择以匹配相对距离结构,尺度匹配解释长度泛化成功条件。
指导破坏拟合算子:面向无分类器指导的终端拟合修复
提出零额外NFE修复:用r^(1+w)-r替代w(r-1),消除CFG强指导下的发散与过饱和,稳定采样。
流形上加权测度的热核熵剖面与几何有效样本量
提出热核熵剖面与几何有效样本量,揭示加权测度在流形上的多尺度非均匀性及重复粒子结构。
基于横截面DNA甲基化数据的人类衰老轨迹推断
提出VAE+RUOT两阶段框架,从横截面数据推断衰老轨迹,揭示晚年表观遗传漂移激增。
校准族过拟合:可信破坏监控器为何不能跨谱系迁移
跨族监控器因破坏评分方向不同导致检测失效,同族捕获41%攻击,异族仅19%,需报告迁移矩阵。
POPS:通过提示优化参数震荡恢复多模态大模型中未学习知识
提出POPS对抗策略,通过提示优化参数震荡,近乎完全恢复多模态大模型已遗忘的隐私信息,暴露现有遗忘机制脆弱性。
ORAN-DEFEND:开放RAN中后门深度强化学习xApps的子空间检测与消毒
通过子空间投影净化后门DRL xApp,触发能量正交时防御成功,可100%恢复回报,但线性投影存在固有局限。