NeuroRule:通过规则集进化使黑盒神经网络可解释
提出NeuroRule框架,通过规则集进化,将黑盒神经网络蒸馏为简洁可解释逻辑规则,无需原始训练数据。
使用Clifford变分自编码器学习全息缩减表示
提出Clifford-VAE,将数据投影到Clifford环面,在VSA绑定/解绑等基准上优于高斯和超球面VAE。
解耦射频感知频谱图中的几何与速度
提出物理可解释RF感知框架,用自编码器从频谱图解耦并估计反射体速度与几何,无需真实数据,性能优越。
最小范数单变量两层ReLU分类:精确解与带跳跃连接的全局最优性
研究单变量两层ReLU分类的最小范数解:给出最优分类器几何刻画,并证明跳跃连接使KKT点全局最优。
感知对齐感受野的计算价值取决于神经元表达能力
与任务感官坐标对齐的感受野提升准确率,但神经元表达能力越强该优势越小;稀疏性无法完全替代结构化先验。
用于重建对流场的PINNs改进周期激活函数
提出复指数生成正余弦对的周期激活,改进PINNs对流重建,用稀疏速度数据高质量重建温度且计算成本低。
安全助推:面向用户的实时AI风险意识干预
浏览器工具在聊天中实时提示AI风险,45人两周试验表明提升风险意识但未必改变行为。
直推式学习的更紧界及其应用
提出STLC局部复杂度法,为无放回采样的直推式学习给出更紧超额风险界,达到归纳速率并改进核学习。
顺序模型训练中的滚动共形预测
提出滚动共形预测,面向顺序模型训练,无需数据划分,保证边际覆盖并具训练条件有效性。
“作为一个语言模型……”:聊天模板切换大语言模型的自我指涉口吻,激活引导可复现该效应
聊天模板切换LLM免责与体验口吻,激活方向可调控;模型自述受部署格式影响,非真实自我。
熵可流动,亦可引导。成为熵。LEDFlow:将熵引导的生成顺序引入均匀离散流
LEDFlow按局部熵自适应排序吸收,以熵引导均匀离散流生成顺序,免训练,提升推理、文生图与多模态理解且成本相近。
大型语言模型的概率结构
概率视角统一大语言模型:自回归条件分布、最大似然训练、序贯模拟生成,并论KL不对称、幻觉与扩散生成。
Sheaf SyncMap:稳定的无监督持续分块
径向层束正则化稳定SyncMap分块动态,在多数CGCP图上NMI最优,且适应分布变化、避免负迁移。
联邦化量子与经典计算:一种隐私保护的混合方法
联邦学习助量子-经典混合模型无需集中原始数据隐私协作,SMPP准确率达0.8757且参数更少。
揭示深度不平衡回归评估中的盲点
揭示深度不平衡回归评估三大盲点:基准偏图像、指标不完备、尾部稳定性未验证,并提出新基准与指标。
面向最大独立集的双GNN多级粗化
提出学习型欧氏TSP图边稀疏化GES,剪边超95%、大规模超99%,解间隙不足1%。
缓解扩散模型数据点遗忘中的顺序性重现
扩散数据点遗忘存在顺序重现失效模式,本文提出目标级评估协议,发现复现目标去噪损失几何更尖锐。
面向通用持续学习的脑启发层次模块化
受果蝇启发,提出层次模块化持续学习,轻量适配预训练模型,在线数据流显著提升,具身操作增益超50点。
基于增广拉格朗日学习数据驱动系统的神经反馈线性化
提出数据驱动反馈线性化框架,将相对度条件融入学习,以神经李导数替代控制器,并验证闭环稳定性与直流电机效果。
多期傅里叶图神经网络结合样本关系学习用于增强剩余使用寿命预测
提出MTFGN-SRL,傅里叶图神经网络频域建模,多期窗口与样本关系学习提升剩余寿命预测精度和鲁棒性。
优先经验回放中的组内自选择偏差校正
优先回放会扭曲同状态-动作组内的结果分布,提出SAMPLE等组内校正法,恢复经验频率并提升学习效率。
训练了却没学到:面向作为前线部署工程师的 LLM 智能体的后训练交付基准
提出后训练交付基准,考察LLM智能体作为前线部署工程师的可信交付,揭示“训而不学”静默失败,并对比四个前沿智能体与人类FDE。
基于无定向算子的拓扑信号处理
提出无定向拓扑信号处理,以无向关联矩阵替代有向边界算子,引入交互阶分解及阶感知正则化,重建效果更优。
神经 CAE 代理模型的预测不确定性
比较高斯过程、蒙特卡洛丢弃与深度集成在神经CAE代理中的不确定性;优劣随数据集和指标而变,宜按下游决策选择。
时空克罗内克协方差神经网络
提出KVNN,用克罗内克积解耦时空协方差,具备严格谱分析且抗噪,在五个真实数据集上预测优、参数少。
因果视角下的概念漂移
从因果视角提出基于结构因果模型的概念漂移分类与数据流生成方法,揭示不同漂移来源影响并支持因果感知评估。
基于物品兼容图的一维装箱深度强化学习
提出物品兼容图上的图强化学习框架求解一维装箱,可零样本泛化,BPPLIB上平均最优差距降至2.31%。
MT-ProtBERT:数据稀缺下内在无序蛋白分类的多任务学习ProtBERT
MT-ProtBERT以动态掩码、多尺度卷积和多任务学习,数据稀缺下提升无序蛋白分类,优于PARROT。
扩展 FunctionGemma 以实现实用的端侧移动函数调用。
构建约9500条安卓控制数据并微调,端侧函数调用准确率升至76.5%,推动低延迟隐私保护助手。
轻量级排序头:加速生产级推荐系统中的多任务实验
提出轻量级排序头框架,动态注入新任务,免重训主干、隔离冲突,将多任务实验周期从数周缩至数天。
均值速度匹配:重新思考扩散模型中的生成动力学
提出均值速度匹配,实现单场参数化随机反向动力学,统一随机与确定性采样,生成质量有竞争力。
半监督联邦ASR的实用方案:在线伪标签与服务器更新稳定化
半监督联邦ASR中,在线伪标签需服务器标注数据更新稳定训练;两轴耦合,稳定化决定收敛并缩小与全监督差距。
DefaultGNN:基于买卖双方交易网络预测企业违约的双视角图神经网络框架
提出双视角GNN框架DefaultGNN,从买卖交易网络预测企业违约,优于基线,审批率提升7-11个百分点。
PermuFormer:代数组合学中排列表示的多任务预训练
提出PermuFormer以28亿词元多任务预训练,为代数组合学排列任务提供微调起点,并分析内部机制
终端收缩平均揭示LLM预训练中的调度-估计器交互
提出终端收缩平均TSA,插值末次迭代与近期检查点,揭示其与学习率调度交互,提升验证质量、加速训练。
针对智能电表隐私的多样化推理攻击学习防御策略
提出代理引导分层强化学习,用电池负载塑形防御未知NILM攻击,跨模型/电器泛化,RMSE显著提升、F1显著下降。
p 进模型的连续优化
提出首个 p 进模型连续梯度下降法,用 Berkovich 仿射线支持优化与反传,可学模运算。
用于测试时扩展的爬山采样:重复采样、进化和训练的一种简单且更优的替代方案
提出爬山采样:反复以当前最优程序为条件采样编辑,简单测试时扩展,优于重复采样、进化和测试时训练。
面向表格基础模型的 JEPA 配方
提出 JEPA 表格基础模型训练配方,使潜变量项稳定收敛,但在147个数据集上仍逊于仅值目标且更慢。
SambaGraph:用于足球战术响应建模的动作-反应时空图
基于2022世界杯数据构建足球战术响应建模时空图数据集与基准。
EMGBlend:面向手势与力解码的异构感知自监督预训练
EMGBlend以几何注意力、频带受限目标和源平衡融合多源异构肌电数据,自监督预训练提升手势与力解码。
重连还是门控?指令微调如何塑造大语言模型中的知识冲突回路
指令微调门控相同晚期注意力头,非重造冲突回路;更信参数记忆,抗简短注入有限,基座可解释工具可迁移。
自教师应看到什么?面向同策略自蒸馏的特权上下文设计
同策略自蒸馏中,特权上下文并非越多越好;适度抽象优于完整参考解,更省提示且性能更佳。
狄利克雷平滑马尔可夫估计下的边际对数似然增量
狄氏平滑马尔可夫中,边际对数似然增量呈KL散度加权缩减;批目标非子模/超模,个体排序不必要不充分。
从专家到子专家:面向MoE大语言模型的细粒度参数高效微调
提出NSFT,将MoE专家细分为子专家,结合路由重要性与内部激活显著性稀疏微调,性能更优且参数更少。
基于贝叶斯Bandit Gittins指数的成本感知高效LLM评估
提出GittinsEval,将LLM配置选择建模为成本感知贝叶斯Bandit,用Gittins指数与LCB随时推荐,仅1%–2%成本即近零遗憾。
当黎曼流遇上Wasserstein:流形上概率分布的生成建模
提出RWEFM框架,在黎曼流形Wasserstein空间上生成概率分布,可生成单细胞与蛋白质构象。
对Grokking转变的探索性副本重叠探测
训练64网络探测Grokking转变的副本重叠;因对齐缺陷结果无效,事后仅标准差比约5.6有检验力。
AI辅助生物多样性调查的定向复核:主动连续评分占据模型
提出ACORN,将机器学习预测融入占据模型,定向复核高信息量样本,显著减少专家工作量。
一种面向图小样本类增量学习的轻量级可塑记忆框架
面向图小样本类增量学习,提出轻量级可塑记忆框架,结合演化微聚类与元学习平衡稳定与适应。