PuzzleKV:面向KV缓存压缩的页级低秩分解
PuzzleKV逐页低秩分解KV缓存,免训练校准,60%存储保持96%,量化用18.7%保持93%。
FlowNeg:GFlowNet引导的知识图谱嵌入多样困难负采样
FlowNeg用层次生成流网络采样,负样本多样且困难,在KGE基准上平均MRR优于EMU和IF-NS。
启示控制
选择价格干预仅揭示影响决策的隐藏状态,区分信息价值与生产复用,提出决策充分启示与深度,并证明仅凭停止翻转风险无法保证正效用。
每层都关键:ReLU网络的指数级L2深度层级
证得每增一层可指数节省神经元:深度ℓ宽多项式即可,浅一层需指数宽,否则L2误差≥1/24。
UHI-Bench:跨多种气候区城市双源热岛建模基准
提出UHI-Bench首个双源热岛基准,评估20余模型;无统一最优,跨城迁移取决于热岛模式重叠。
去噪分数匹配的损失下限:来自薛定谔桥的Fisher几何
去噪分数匹配的额外损失为条件方差,等于Fisher度量迹沿轨迹积分,由薛定谔桥导出,影响模型排名。
GATNextHop:一种用于跨拓扑泛化的最短路径路由的图注意力网络
提出GATNextHop模型,以图注意力网络近似最短路径,跨拓扑泛化,合成图训练,真实ISP网络测试,并与Dijkstra对比。
MnemoDyn:从4万条fMRI序列学习静息态动态
提出基于动力系统的rs-fMRI模型,用约4万序列训练,多分辨率建模,计算高效,重建优于Transformer,适用下游任务与小样本研究。
XP-JEPA:面向可预测潜动力学的交叉预测物理锚定
XP-JEPA用物理轨迹锚定潜动力学,训练后仅需视觉,将漂移从0.361降至0.104,控制成功率提升至78.2%。
CoDrift:离线强化学习的组合漂移方法
CoDrift融合条件、边际、价值三个运动场生成动作,在离线及离线转在线场景的73个任务中平均排名最佳。
圆上部分最优传输:面向所有传输质量的O(N log N)算法
PAWC:圆上部分最优传输,O(N log N)时间、O(N)内存,返回全部成本与计划,推广至球面。
单语义性的逆袭:特化神经元提升多层感知机的数据效率
聚类回归中,多层感知机自然形成与局部特征对齐的特化神经元,用局部低维表示提升数据效率。
面向实时边缘可部署虚拟传感的、蒸馏辅助的低延迟激活正则化稀疏神经算子
提出稀疏激活层,无需代理梯度,兼容事件计算,延迟-误差-能耗指标提升五倍,蒸馏再降两倍,助力边缘实时虚拟传感。
ChorusTIC:基于 Chorus 上下文学习的免训练多元时间序列分类
提出免训练的多元时间序列上下文分类基础模型,仅用合成片段预训练,在两大公开基准上表现优异。
PinSieve:面向企业内容质量分诊的生产级选择性VLM服务与受管控记忆飞轮
选择性VLM服务与记忆飞轮用于内容质量分诊,过滤量2.05倍,生产力+25.7%,成本-16.2%。
基于高斯泼溅表示的物理集成算子学习
提出高斯泼溅连续表示,将物理算子无损失地集成进神经算子,长时预测误差降低1.5-2.2倍。
从梯度提升树到深度推荐器:生产客户支持推荐器迁移的实践经验
生产推荐系统从梯度提升树迁移至深度成对二元模型,采用负采样、噪声注入和注意力池化技术,后期性能超越原模型。
ALPHABET:一种带分组指数传输的拉普拉斯极点历史聚合器
ALPHABET以数千参数压缩历史为极点模态,仅用模态能量与滞后矩,性能媲美大模型且推理训练快数倍。
特征主序码本:在单块消费级GPU上将MEDLINE图谱扩展至105万神经元的内存高效稀疏二值自组织映射
特征主序码本提速BMU搜索4.5-8.5倍;72秒训练2990万篇文献,H200达105万神经元。
面向可控数据生成的机制电路识别
提出机制电路框架,结合数据评估与可解释性,以电路为接口生成靶向数据,提升下游性能。
均匀稳定性的尖锐尾部
构造γ-均匀稳定学习问题,其尾部概率下界匹配无对数上界,确定了均匀稳定性最优高概率与矩依赖至常数。
PhysicsBench:工程设计与仿真中生成与预测模型的统一排行榜
PhysicsBench统一评测生成与预测模型,覆盖7任务66模型,揭示数据规模影响排名,为模型选择提供公开依据。
网格无关多分辨率深度能量法及其脆性断裂相场建模
提出网格无关多分辨率深度能量法,用神经网络表示位移和相场,最小化增量能量训练,在六类断裂问题中载荷-位移曲线与有限元参考吻合,峰值载荷误差约1%至8%。
面向基于LLM的时间序列异常检测的结构化频域证据
提出零样本异常检测框架,在去季节化数据上增加全局与局部FFT频域证据,提升LLM检测性能。
知道何时求助:分层大语言模型智能体中的贝叶斯自我升级
将推理中委派建模为贝叶斯最优停止,导出时变阈值策略,证明遗憾以1/√n衰减,并在代码任务中验证。
低方差在线策略评估的鲁棒数据收集策略学习
提出双环梯度算法学习鲁棒行为策略,应对转移不确定性,降低评估方差,保证全局收敛。
从松弛可指标性到精确可指标性:部分可观测游荡匪帮的$t$步方法
提出$t$步前瞻阈值策略,逼近Whittle指数,误差$O(\beta^t)$,并验证可指标性。数值显示精度大幅提升,逼近最优。
PRQ-KMeans:用于语义ID令牌化的投影残差量化
PRQ-KMeans:去全局均值、Top-k相似更新、投影残差,改进语义ID令牌化,效果最优。
推理时通过读出反馈引导循环推理模型
通过读出概率生成成对耦合力引导潜变量动态,无需重训提升循环推理模型,在数独和迷宫六对任务中获四对增益。
等变协方差张量:保证SPD的张量值几何学习不确定性
提出E(3)等变协方差框架,经矩阵指数映射保证SPD,以对数欧氏等变目标实现张量预测不确定性量化,鲁棒且对称。
对比分支策略优化
提出对比分支策略优化,解耦预算与信用分配,用前缀分支对比评估决策,提升工具集成智能体的多步推理性能。
基于L1范数Rademacher复杂度的数据依赖早停规则
提出基于L1范数Rademacher复杂度的早停时刻估计框架,无需训练且不依赖概率假设,可用于线性回归与非线性网络。
时间序列基础模型的因果分析
提出因果分析框架,通过干预合成时间序列检验基础模型,发现趋势与谐波安全,但存在持续性高估等偏差。
自监督预训练何时对表格模型有益?标签稀缺与缺失数据研究
自监督预训练在标签稀缺时增益不稳定,对高缺失数据常有害,但测试期缺失下平均略有提升。
用于T2DM可解释疾病轨迹的结构化FHMM模型
提出结构化FHMM,将潜伏健康状态分解为多组件,识别临床轨迹与异质进展,提供T2DM可解释洞察。
联合分布对齐用于通用域自适应
提出JAUA算法,以卡方散度对齐联合分布,给出泛化误差上界,并用渐进式伪标签法处理通用域适应,实验表现优越。
欺诈基准:金融风险评估中协议敏感的对抗鲁棒性基准测试
提出欺诈基准,金融风控对抗鲁棒性评估对协议敏感,须联合报告预测退化与攻击可行性,将领域约束融入攻击生成。
可穿戴设备数据深度多变量插补模型评估
提出真实缺失评估与匹配训练,使深度插补模型严重缺失误差降43%,并发现模型排名取决于评估设计。
超越静态可解释性:从预SFT参数预测后SFT机制以实现更好调优
提出前向定位框架,仅用预SFT参数与目标数据预测后SFT机制,避免回顾性偏差,指导微调,性能稳健且可扩展。
WarpSAC:重思探索与利用,迈向可扩展离策略强化学习的顶峰
新算法按数据规模调节稳定器,提升离策略RL学习效率与性能
熵的测量位置很重要:有界连续控制PPO中的策略几何
连续控制中,熵测量位置影响PPO几何:潜在熵致动作贴界,执行熵使均值内移;但收益无法单独刻画有界策略几何。
视情况而定:纳入高维输出空间联合偶然与认知不确定性的相关性
提出低秩加对角协方差结构,联合建模高维输出的偶然与认知不确定性,实现高效稳健的不确定性量化。
持续交叉熵
提出持续交叉熵,用诱导概率桥接持久图事件空间,证明稳定性,用于区分同熵图、识别因果方向、作为拓扑损失。
监督式UQ集成何时能改进LLM幻觉检测?一项鲁棒性研究
监督集成在30/32设置中优于最佳评分器,100个标注样本即可;黑盒采样近等效,白盒增益有限。
从偏微分方程数值模拟器到神经仿真器,再回到数值模拟器
论证神经仿真器与数值求解器同构,用傅里叶分析统一误差与归纳偏置,提出基准,研究未收敛求解器影响并分析优越性。
SeisMamba:面向空间分布式地震早期预警的低延迟单台震级估计
提出轻量级Mamba模型SeisMamba,利用单台三分量波形快速估计震级,延迟仅0.55毫秒,精度优于基线,且跨区域泛化良好。
基于可验证奖励的在策略蒸馏
提出OPDVR,无需超参数融合可验证奖励与在策略蒸馏,用ReLU门控对齐轨迹正确性,超越标准蒸馏。
以渐进式增长穿越损失景观
研究渐进式增长:逐步解锁子空间、冻结正交方向,证明其以体积效应偏向宽盆地;但平坦性不总提升测试性能。
条件图GAN联邦:在联邦生成对抗网络中优化图结构分子生成
提出cGraphGANFed,引入评论网络引导生成分子优化用户指标,较原模型在有效性、LogP及QED上显著提升,并增强抗模式崩塌与非独立同分布数据能力。
IAPO:面向多轮服务智能体信用分配的影响感知策略优化
提出IAPO,用影响依赖图重分配轨迹优势,解决多轮交互信用分配问题,在三项服务基准上超越现有强化学习方法。