渐进式编码的希尔伯特算子(HOPE):用于解构深度网络中学习到的表示的数学框架
HOPE将网络压缩转化为希尔伯特空间低秩投影,实现无数据、无超参数的渐进式解构。
基于迁移学习的视频游戏状态异构预测的多任务学习
多任务学习用于游戏状态异构预测,能提升泛化并降低训练推理成本,实验验证优于单任务与迁移学习。
适配器能写入多少比特?衡量参数高效微调的容量与记忆化
低秩适配器容量取决于参数位置而非数量,MLP容量约为注意力的两倍,监督学习会记录机密而强化学习不会。
梯度集中而非权重显著性解释了表示层面的类别遗忘
遗忘梯度集中在最后网络层(约92%),显著性掩码缺乏特异性,表示层面遗忘由梯度集中和表示几何主导。
零流双样本检验
提出基于零流准则的双样本检验,通过学习局部错位方向检测分布差异,兼具强检验力与校准误差控制。
无信号交叉口自动驾驶车辆的紧凑潜在协调
提出MAPS分层架构,通过紧凑潜在协调实现无信号交叉口无碰撞导航,零样本泛化成功率94%。
从注意力到频率:视觉Transformer与FFT-ReLU融合实现增强的图像去模糊
提出ViT与频域FFT-ReLU双域架构,桥接空间注意力和频域稀疏性,有效抑制模糊伪影,性能领先。
超越充分性:基于反事实必要性的时间序列解释
TimePNS通过反事实干预识别时间序列中决策关键子序列,实现充分性与必要性平衡。
X³-OPD:通过在线策略对齐将推理能力蒸馏至大型音频-语言模型
提出X³-OPD框架,在线策略蒸馏文本推理至音频模型,三类语料显著提升音频推理质量。
循环肽系综上的图学习:分子系综建模探究
预训练系综编码模型提升环肽性质预测,混合BERT后R²达0.538。
扩张流映射
提出扩张生成流与扩张流映射,实现变尺寸生成,将输出大小作为可学习的自由度。
高召回候选生成的有限样本审计:认证与学习理论设计
揭示排除池审计对遗漏质量认证的标签复杂度,证明其极小化极大最优性,开发有限样本认证工具包。
野外去模糊:基于智能手机高速视频的真实世界图像去模糊数据集
构建最大真实世界去模糊数据集,含42,000对高分辨率模糊清晰图像,场景多样,成新基准挑战现有模型。
基于错误定位的测试时扩展
提出TTEL算法,通过令牌级错误定位与轨迹截断重用有效前缀,在编程和数学任务上以近半令牌数超越基线。
SPECTRA:面向概率性能源预测的状态空间外生上下文与时频分辨率架构
提出分离趋势周期与高频残差的架构,在18个设置中14个取得最佳CRPS,平均降低5.74%。
密度矩阵嵌入框架下用于量子选择组态相互作用的机器学习紧凑子空间生成
提出RBM辅助量子选择组态相互作用法,仅用4%子空间达化学精度,优于标准方法。
专家混合视觉-语言-动作模型中的涌现组合技能
MoE训练VLA能涌现将任务分解为可重用原语,路由器隐式排序,专家作为组合模块,性能相当且实现专门化。
面向序列决策与社会认识论的算法方法
用算法工具研究序列决策与社会认识论,涵盖多臂老虎机改进、悲观陷阱与毅力影响的理论建模及干预。
基于联合对比与分类学习的光网络跨域泛化
提出联合对比与分类学习,实现光网络跨域泛化,在传输质量估计中表现优异且适应快。
基于缠绕的聚合物链接机器学习分类
利用缠绕密度矩阵训练前馈神经网络,对前六个素链接分类准确率达97%,为复杂链接快速分类提供新方法。
自监督生物启发式机器人避障轨迹规划
提出自监督生物启发框架,利用前向反向模型进行机器人避障轨迹规划,并针对学习信号利用问题提出缓解策略。
泄漏的语言模型:通过逐令牌时序窃取架构与推理优化信息
提出LeakyLMs攻击,仅凭令牌生成时序即可窃取LLM架构、推理优化和部署细节,准确率达90%以上。
流水线梯度编码
流水线梯度编码将梯度评估分段,每步只处理一个数据分区,减少训练时间并加速收敛。
HERMES:基于异质边关系多头嵌入SSM注意力的信号交叉口交通冲突预测方法
提出HERMES异构图神经网络,用SSM注意力预测交叉口冲突,AUC-ROC达0.9898,优于Transformer,支持可迁移安全监测。
在线推荐的概率残差学习
提出因果贝叶斯残差模型,针对性改进现有推荐系统,兼容各类深度学习模型并提升性能。
基于语音的多模态大语言模型实现可泛化的认知障碍检测
提出多模态框架融合语音与文本,用LLM实现92.4%的认知障碍检测准确率,并具备跨数据集泛化能力。
RadioTrace: 发射器感知扩散模型实现无需部署微调的无线电地图估计
RadioTrace融合发射器感知与扩散先验,无需部署微调,通过坐标迭代优化和传播引导初始化实现鲁棒无线电地图估计。
一种基于分析训练的变分代理方法,用于NISQ硬件上的量子相位估计
提出分析训练的变分代理,无需电路模拟实现量子相位估计,在NISQ硬件上达化学精度。
平滑加性模型中的自动节点选择
提出基于自适应样条的GAM节点选择技术,性能与P样条相当,但使用更少基函数。
隔离双量子点电荷态表征的机器学习
两个小型CNN实现隔离双量子点电荷态自动表征,准确率超94%,电子占据判断93.8%,模型仅6.5MB、处理<60ms。
基于近端策略优化的近似量子态制备
利用近端策略优化智能体搜索量子电路,以最少门数高精度近似制备量子态,误差达10^{-14}。
基于Transformer的扩散模型用于水文时间序列概率插补与预测
提出Transformer扩散模型有效模拟水文时间序列,实现缺失数据插补与预测,在法国流域验证优于传统方法。
Climate-resilient electric vehicle charging infrastructure for sustainable cities: An interpretable causal-ensemble framework for preventive maintenance and low-carbon mobility
深度参数化量子电路的谨慎乐观
深度参数化量子电路规模增大时呈双下降,未见数据性能提升,带来谨慎乐观。
用于模型选择的贝叶斯风洞
提出贝叶斯风洞进行模型选择,变压器实现精确贝叶斯最优,发现算术统计需整数令牌,符号失败且缩放后边界持续。
用于二维中子通量估计的神经算子代理模型
将一维研究扩展至二维,用FNO与UNO代理模型估计算子通量,比较直接映射与加入单次扫描输入,并评估对数训练效果。
基于输入依赖长卷积的原生多维次二次算子
HyenaND通过输入依赖长卷积实现多维数据的次二次全局建模,加速并匹配或超越注意力基线。
空气质量竞技场:大规模多区域空气质量预测数据集与基准
提出AQA数据集与基准,覆盖6种污染物、7国4大洲,评估时间序列基础模型,零样本预测优于经典基线。
时间序列预测中持续学习的可解释性挑战
可解释性分析揭示非平稳预测中持续学习的行为演变与采样策略挑战。
CruiseBench:与真实飞行对齐的N-CMAPSS发动机RUL预测基准
CruiseBench提出巡航阶段RUL基准,通过CPM-N-CMAPSS掩码提取巡航段,固定协议实现可重复比较,TSMixer最优。
SUM:面向联邦类增量学习的时空自适应向量的统一几何手术
提出SUM框架,通过几何手术同时缓解客户端和任务间干扰,无需客户端额外开销,性能提升达22%。
STN-TGAT: 基于可学习软阈值稀疏化的先验引导图注意力Top-K投资组合构建
提出STN-TGAT模型,融合时序与图注意力,通过软阈值稀疏化增强结构鲁棒性,实现优于基准的Top-K投资组合。
构建快,评估慢:流水线选择主导自动可解释性得分方差
实验表明自动可解释性评分受评估流程影响远超架构差异,跨论文比较不可靠,并提出稳定性检查方法。
基于分箱频谱损失的非结构化网格上混沌动力学的尺度感知学习
针对非结构化网格混沌动力学,提出图拉普拉斯频带分箱频谱损失及可扩展近似,提升长期预测保真度与统计不变量。
记忆合并DQN:基于敏感性加权的目标更新实现稳定值学习
记忆合并DQN通过Q值敏感性加权合并历史参数替代硬拷贝更新,在Atari环境中取得最佳性能。
When Does Consensus Beat Voting? A Critical Analysis of Statistical Label Fusion in Medical Image Segmentation
跨被试语义解码与共享空间对齐的通用神经表征学习
跨被试语义解码框架用共享空间对齐将神经响应映射到共享潜空间,训练解码器预测语义嵌入,有效提升跨被试泛化。
LAARA:面向参数高效微调的层感知自适应秩分配
本文提出LAARA框架,利用Fisher估计动态分配秩,用更少参数匹配或超越SOTA方法。
从轨迹到前缀:通过重放前缀和在线延续重用教师轨迹
Prefix-GRPO分解教师轨迹为重放前缀和在线延续,统一优化学习,使小模型智能体优于蒸馏和RL基线。
利用离线监督实现大规模视觉-语言-动作模型中高效且可泛化的强化学习
混合离线-在线RL借助离线监督保持强OOD能力,训练效率提升近一半。