基于消息传递的双时间尺度贝叶斯学习用于联合信道与记忆硬件损伤跟踪
提出消息传递双时间尺度贝叶斯学习框架,联合跟踪快变信道与慢变硬件损伤,仿真显示误差更低。
UniWind:通过物理信息状态路由实现统一日前风电功率预测
UniWind通过物理先验与状态路由分离物理和运行状态,提升日前风电预测精度和鲁棒性。
SCAPE:利用极端稀疏通信实现精确高效的大语言模型训练
SCAPE利用一阶矩实现99%稀疏通信,保持训练质量,端到端加速达43.3%。
频移物理信息极限学习机求解高频偏微分方程
提出频移物理信息极限学习机,通过加性初始化克服谱偏差,高效求解高频偏微分方程。
扩散模型的数学导引
从采样视角,以证明为导向介绍扩散模型,涵盖经典动力学到现代采样器、误差分析与推理时控制。
模型合并:微调参数空间中的概率推断
提出产品专家概率推断框架,用能量模型定义单任务解,柯西专家处理重尾残差,显著提升多任务性能。
基于单调交替样条的高效时间点过程
提出单调交替样条框架建模时间点过程的累积条件强度函数,解决单调神经网络瓶颈,提升效率与泛化性能。
预测潜在世界模型的闭环性能:LunarLander中非马尔可夫奖励下MPC和基于模型强化学习的离线检查点选择
提出CROF指标离线选择世界模型检查点,在LunarLander上显著提升模型基强化学习与MPC性能。
循环表示的有穷延迟算子几何
提出有穷延迟算子几何,基于源-后继对导出运输张量与环流,证明协变性与稳定性。
中文标题:角色感知的神经凸散度头用于非对称表示学习
中文摘要:提出角色感知凸散度头,通过源/目标角色投影实现非对称评分,在语义与本体任务中提升方向准确率且保持零负散度。
更密≠更好:持续后训练中在线自蒸馏的局限性
在线自蒸馏加速领域特化但泛化差,持续训练中导致遗忘和崩溃,稠密信号放大参数漂移与格式伪影。
EHHN:面向对象中心的下一个活动预测的事件驱动异构超图网络
提出EHHN模型,用事件驱动异构超图及双流架构预测下一活动,精度最优,显存降低24倍。
Set Diffusion: Interpolating Token Orderings Between Autoregression and Diffusion for Fast and Flexible Decoding
基于单通道脑电图的在线学习认知负荷评估:一种混合深度学习方法
使用单通道EEG与混合深度学习模型评估在线学习认知负荷,准确率达78.5%,但样本少,需主体无关评估。
高斯定位模型中的正则化变分和谱对数密度比估计
对比岭正则化对数密度比估计的变分与谱方法:多观测时变分法风险低,少观测时谱法方差小。
EPnG: 面向参数高效MoE微调的自适应专家剪枝与增长
EPnG自适应剪枝冗余专家、增长重要专家,仅更新0.55%-0.72%参数即达全微调性能,参数节省140-180倍。
众声归一:面向LLM评判与奖励建模的多角色准则生成
提出多角色准则生成框架(MRRG),通过多视角评估标准提升LLM奖励信号,优于单角色基线。
扩展稀疏自编码器:面向机制可解释性的参数高效字典
提出Expander SAE,用扩展器掩码减少参数,在Qwen2.5-3B上以293倍参数压缩保留84%性能。
操纵共识:众包事实核查中的协同操纵
研究发现协同用户可通过策略投票伪造共识,最高10.7%的低质量笔记可被操纵,已部署缓解措施。
大型语言模型在分子领域真的具有泛化能力吗?基于扰动分析
LLMs在分子结构上泛化脆弱,单次编辑即显著降性能,上下文调优可部分提升鲁棒性。
Decomposer:学习将符号音乐反编译为程序
提出Decomposer框架,通过合成语料微调与强化学习,从MIDI恢复可编辑音乐程序,兼顾重建忠实度与代码可读性。
面向时间序列康复数据的自适应分组反事实解释
提出自适应分组反事实解释框架,实现组级稀疏,生成符合临床推理的简洁纠偏指导。
Learning the Supports for Categorical Critic in Reinforcement Learning
通过离线评估方法进行A/B测试实现更准确的算法比较
发现A/B测试选择错误率可能高于离线评估,提出诱导正相关的估计器,仅用一半数据达到同等效果。
面向可解释涡轮风扇退化建模的液态潜状态动力学
液态潜状态动力学解耦退化和工况,提升传感器预测并形成可解释退化轴,但剩余寿命回归效果不及基线。
条件共消融:恢复Transformer电路中的自修复备份
提出条件共消融(CoAx),通过移除主组件后测量剩余组件消融效应增长,揭示二阶交互,有效恢复自修复备份,提升归因和剪枝。
Rank-Then-Act: Reward-Free Control from Frame-Order Progress
SABER:基于多尺度超图的语义对齐脑网络分析框架
提出语义对齐脑网络框架,融合LLM语义与多尺度超图,决策级语义对齐引导预测,提升小样本下脑疾病诊断稳定性与可解释性。
基于种群的多目标判别器训练用于半监督生成对抗网络
提出基于种群进化的多目标判别器训练,通过帕累托排序权衡分类与真假判别,提升半监督GAN的鲁棒性和准确率。
Zeus:迈向免调参的时间序列基础模型
Zeus是免调参时间序列基础模型,采用多尺度Transformer和统一掩码策略,无需微调即可在多种任务中取得优异性能。
用于情感分析的混合量子-经典神经网络
混合量子-经典模型在情感分析中准确率与经典模型相当,迁移学习后垃圾短信分类准确率提升15个百分点,展现更强泛化能力。
基于时间序列基础模型的概率性低压峰值负荷预测:以面向应用指标评估
本研究评估200个实际低压馈线,发现时间序列基础模型(尤其Chronos-2)性能优越,新指标关联峰值预测与电网规划成本风险权衡。
更轻量的新型CNN在资源约束下是否表现更好?对架构、初始化、训练预算和效率的受控跨代研究
新轻量CNN并非全面优于旧版,EfficientNet-B0在效率与精度间平衡最佳,MobileNetV3-Small反超其后续版本。
Probing Chemical Language Models: Effects of Pre-training and Fine-tuning
Fast and Accurate Anomaly Detection in Time Series
超越性能幻觉:面向空间相关域的结构感知分层划分与课程分布鲁棒优化
提出结构感知分层划分与课程分布鲁棒优化,解决空间相关数据中的性能幻觉,提升泛化与可靠性。
一种用于线性动态系统在线学习的内存高效统一算法
针对低不稳定性复杂度系统,提出内存自适应动态复杂度的在线预测算法,参数复杂度为O(k),实现次线性遗憾。
用于瑞利-贝纳尔对流的傅里叶神经算子
改进傅里叶神经算子预测时间增量,模型紧凑快速,精度提升,但受限于训练数据分辨率。
SA-HGNN:样本自适应双曲图神经网络用于脑电抑郁识别
SA-HGNN通过样本自适应图构建、双曲卷积和注意力池化,精确提取抑郁症脑网络层次结构,在EEG数据上性能优异。
Predictive Conformal Slip Monitoring: An Empirical Evaluation of Rolling Split Conformal Prediction for Pre-Incident Traction Loss Detection
kNNGuard:将LLM隐藏激活转化为无需训练的可配置护栏
kNNGuard利用LLM隐藏激活实现无需训练的多层kNN护栏,F1媲美微调,速度提升2.7-10倍,域适应仅需10秒。
提出正确的比较:基于偏差感知的贝叶斯主动Top-k排序与LLM评委
提出偏差感知贝叶斯主动Top-k排序,纠正LLM评委的冗长、位置等偏差,高效准确识别前k项。
扩散采样的ART:连续时间控制与Actor-Critic学习
ART-RL将扩散采样时间步分配转化为连续时间强化学习,用Actor-Critic优化,提升样本质量且泛化性强。
高效时间序列预测的自门控注意力
提出自门控注意力(SGA),以线性复杂度替代标准二次复杂度,兼顾预测性能与推理效率。
隐私保护且可验证的近似分布式编码计算
提出模型无关的对抗鲁棒分布式学习框架,融合编码计算与防御机制,联合应对隐私泄露和恶意攻击。
物理信息神经网络良态训练的优化框架
提出DSGNAR二阶优化框架,克服PINN训练的病态性,实现极高精度(相对误差低至3e-16)和速度,在多个问题上大幅领先现有方法。
自解释算子学习:发现函数数据中的空间模式
提出自解释算子学习框架,通过分解积分方程揭示输入区域贡献,在流体力学中验证,解释性嵌入算子结构。
连续随机消耗下的在线资源分配:退化情形下的遗憾
连续随机消耗在线资源分配中,遗憾由价值-大小比近阈值的请求加权质量决定,p>1时下界Ω(T^{1/2-1/(2p)}),p=1时O((logT)^2)。
离线强化学习中的泛化:结构比悲观程度更重要
离线RL泛化关键在悲观结构是否尊重最优解对称性,而非悲观程度;数据增强应在策略提取时用一致性损失。
通过分布级奖励优化视觉生成模型
通过分布级奖励微调生成模型,避免奖励黑客和模式崩溃,子集替换策略及模型合并优化,显著提升FID和样本质量。