绕过Krum:联邦学习中的选择感知后门攻击
提出Krum-Proxy攻击,两阶段优化生成贴近良性分布的恶意更新,绕过Krum等距离聚合,高成功率且不损清洁精度。
用于预测异构设备稀有故障的可迁移自逻辑模型
提出可迁移概率模型,学习异构设备共享故障模式并自适应目标设备,输出校准的故障概率以支持维护规划。
EpiFlow:提升废水信号在疾病预测中效用的框架
提出EpiFlow框架,利用废水信号预测疾病,在弗吉尼亚新冠住院预测中覆盖率提升20个百分点。
决斗世界模型:优势式动作通道用于共模干扰抑制
通过减去动作平均效应,分离自身动作通道,无需奖励或重建即可消除共模干扰。
基于混合解析-机器学习预测器的大语言模型推理延迟与能耗多级建模
混合三层级模型结合解析与机器学习预测LLM延迟能耗,支持多架构,误差<5%,无需硬件探索设计空间。
求解器引导的混合均衡策略推理
提出MDT方法,用求解器输出替代人类数据引导LLM推理,将混合策略均衡距离降低52.6%。
图机器:探索边机制作为归纳偏置
提出带显式边机制的图机器架构,在数独推理中超越Transformer,验证边机制作为归纳偏置的有效性。
ArchEGraph:面向几何-拓扑-物理对齐的建筑能耗建模的大规模图数据集
提出大型建筑图数据集ArchEGraph,含5481栋建筑及热负荷数据,支持图重建与拓扑感知负荷预测两任务,助力建筑能耗建模。
KReF:面向长期时间序列预测与预测不确定性的免训练检索
免训练检索框架KReF,以检索历史未来构建经验预测分布,CRPS全面最优,点预测不逊于基线。
基于近似最近邻的次二次双模拟度量:覆盖增强保证与可计算双侧证书
提出基于近似最近邻的次二次双模拟度量,给出覆盖增强保证与可计算双侧证书,显著降低计算复杂度。
CubicQuant:采用1-8比特权重的参数化非均匀码本实现高吞吐量LLM推理
提出CubicQuant参数化非均匀量化,用三次曲线映射码字,1-8比特下重建误差更低,且可直接GPU执行。
通过微分与积分几何理解可微嵌入
所有嵌入诊断源于同一几何对象;微分视图管局部,积分视图揭示路径依赖且不可约;实验验证曲率信任与路径依赖检测。
隐藏规范控制ReLU网络中的特征特化
隐藏规范控制ReLU网络特征特化:初始预测不变,仅缩放规范即决定重复神经元特征归属,并加速特化、剪除冗余。
更快的查询-键学习使自注意力模型的注意力更集中
分析自注意力中查询-键与输出-值电路的参数化,发现因子分解改变学习率;查询-键学习更快时注意力更集中,性能相当。
基于正确示范的多尺度奖励对冲
提出连续奖励类首个无回合数界:多尺度投票对冲,总隐藏差距受熵积分控制;熵多项式时总差距对数级、统计率快,证下界。
弱监督学习的最新进展:新的监督范式、假设放宽与实际解决方案
综述弱监督学习新进展,包括置信度差异分类、互补标签学习、部分标签学习等,提出放宽假设和实用方法。
人工神经网络中符号模式涌现的数学原理与实验发现
证明神经网络推理逻辑可重构为稀疏符号交互,满足两个数学准则即涌现该模式,实验验证其可迁移性与泛化解释力
分子生成模型如何组织分子身份
生成模型固定分区:逐段常数、粗细边界;组织依赖表示、身份约定、解码随机性与度量,训练中局部稳身份数变。
SkillAligner:在执行时将检索到的技能视为可调整的草稿
技能对齐器在执行时将检索技能视为可调草稿,无训练联合适配以消除技能与执行失配,提升性能、降低推理成本。
步行可达性对谁而言?利用多模态深度学习捕捉步行性感知中的主观差异
研究提出首个用户条件多模态深度学习框架,融合 sidewalk 图像与个人属性,感知评分一致性提升65%,强调步行性评估应体现个体差异。
通过Nyström方法弥合超维计算与核方法之间的差距
提出NysHD方法,基于Nyström近似将任意核函数转化为超维计算映射,在图和字符串任务上准确率提升。
MiCoPro:基于硬件感知代理模型的端到端混合精度软硬件协同设计
提出MiCoPro框架,用硬件感知代理模型优化混合精度量化,在多种硬件上延迟降低40%,精度损失小于3%。
ELMZip:基于极限学习机的星上图像压缩实现高效下行传输
ELMZip借助极限学习机进行星上图像压缩,只传输出权重,兼顾高保真与高效下行。
PRISM:薛定谔桥模型的原理性参考识别
参考设计理论:可解参考需协方差交换;精确解下参考无关后验;有限步最优噪声谱∝传感器破坏谱;图像失效。
不可知直接和的速率分离
单实例学习速率不能决定直接和速率;两个具有相同 n^{-1/2} 曲线的类,其直接和速率可不同。
基于决策树剪枝的可解释强化学习
提出决策树剪枝法简化强化学习策略,保持性能且可审计,提升可解释性。
基于元素分类连接子图的密度感知层次聚类
提出密度感知层次聚类方法,融合密度与图连通性,基于元素分类连接子图度量簇间相似性,性能优于基线。
超越基础模型:面向小数据表示模型的维度感知神经架构搜索用于低温冷却器寿命预测
提出小数据表示模型范式,结合维度感知NAS,在低温冷却器寿命预测中达到竞争性能,无需大规模预训练。
用于链接预测和拓扑重建的双曲图嵌入器
统一比较13种无监督双曲图嵌入法,无算法全面占优;性能取决于嵌入范式而非学科来源,并给出选型建议。
面向小企业短历史多KPI预测的会计图Transformer
提出会计图变换器,用关系图与近期路径联合预测13个KPI,MAE 0.699,优于LightGBM。
超越孤立:解锁强化学习组件协同以实现样本高效连续控制
强化学习组件间存在协同或干扰,简单堆叠SOTA技术常引发非平稳性等挑战。提出ROSER框架协调表征、优化稳定性和经验回放,性能提升17.60%。
每个缓存条目各得其所:KV缓存压缩中分辨率与覆盖度的全局分配
提出全局分配法,将键值缓存压缩视为资源分配,平衡分辨率与覆盖,无需训练,32项中24项最优。
模块化测试时训练:将测试时训练重构为可组合模块
提出模块化TTT框架,将内部学习器表示为有向无环图,系统消融各组件,发现小学习率初始化、权重衰减和单层非线性有效,深层网络和归一化有害。
面向边缘点云分类的合成LiDAR数据生成与确定性降采样
合成激光雷达数据与确定性降采样,在树莓派上实现约50FPS和88.36%准确率的边缘点云分类。
超越反馈的在线共形预测
提出无需反馈的在线共形预测法,通过查询标签代替评价预测集,实现O(T^(2/3))遗憾、覆盖率β-O(T^(-1/3)),仅需T^(-1/3)轮查询。
Momba:网络现代化提升多目标强化学习
将网络现代化(归一化、分布回报建模)融入多目标强化学习,显著提升解集质量,不改算法。
部分可观测下,学习比策略类受损更严重:一项闭式分析
部分可观测下,学习比策略类更易失败:即使策略和价值函数足够,学习仍败于评论家偏差;调整前瞻步数解决,记忆无用。
自适应子模型联邦学习中的容量混杂与覆盖保证
更新估异构受容量混杂干扰;自适应分配因未覆盖参数失效,覆盖保证可修复;随机分配不差,收益源于覆盖而非自适应。
面向动态图学习的时间Forman-Ricci曲率边稀疏化方法
提出TRicci方法,用时间曲率稀疏化动态图,压缩80%边,提速55.94%,性能几乎不降。
基于机器学习的超高分辨率PET成像晶体间散射恢复
用神经网络恢复晶体间散射事件,灵敏度提升70%-106%,保持亚毫米分辨率,减少扫描时间和辐射剂量。
Fluid-DiT:用于流体流动模拟学习的无图扩散Transformer
提出无图扩散Transformer(Fluid-DiT),以注意力去噪替代图传递,捕获全局相关,提升流体模拟分布精度与泛化能力。
MAUPITI:智能红外传感器上的设备端原型学习
提出基于原型的NCM分类器,在智能红外传感器上实现端侧学习与持续适应,精度相当且开销极低。
随机自回归学习
提出二元随机自回归PAC学习;三种监督下样本复杂度无普适比较,但给出尺度化紧界。
面向视觉令牌剪枝的AI4AI框架
提出AutoPrune,用LLM自动设计视觉令牌剪枝,基于残差搜索,剪94.4%令牌仍保99%性能。
缺失模态下的共形融合
提出模态调节共形融合,结合证据头与证据融合,经共形校准在模态缺失下保证覆盖与校准,且无精度损失。
FUSE:面向混合类型表格流匹配的特征级统一专化与跨列交换
提出FUSE,分别建模数值和类别特征,用注意力跨列交换信息,显著提升混合表格数据的生成质量。
从最优动作到世界模型:折扣MDP中转移核的可辨识性
仅从最优动作无法唯一恢复转移核;存在矩阵变换给出等价核,奖励形式决定可辨识性。
FedDOSE:分解站点效应的联邦学习框架用于大脑动态功能连接建模
提出FedDOSE框架,分解站点差异,用模块化Tucker分解编码动态功能连接,结合最优传输与Procrustes对齐,多站点fMRI诊断优于现有方法。
当GNN失效:量化与克服时间序列中的时间相关波动
提出TCV度量时间序列相关波动,揭示GNN在动态场景失效,并设计GLIDE层提升至45.6%。
SwiGLU的开放正尾部是否必要?来自MemGLU闭合尾门控的证据
实验表明,在9M/30M规模下,MemGLU与SwiGLU性能相近,开放正尾部并非必需。