不相交表格数据迁移学习中跨注意力的广义上下文
提出广义上下文学习,无需共享特征,利用跨域注意力迁移,性能优于九种基线。
HARTS:任意展开树上混合注意力模型的高效智能体强化学习
HARTS在展开树上执行混合注意力智能体RL,压缩前缀并联合规划微批与数据并行,实现近五倍加速。
面向预测过程监控的高效在线持续基础模型微调
提出一种框架在线持续微调基础模型用于预测过程监控自适应检测漂移维护统一知识子空间性能优于现有方法。
D-TAIA:面向多任务预测性流程监控的领域感知大语言模型适配
提出D-TAIA框架,用领域感知三元组损失与FAISS检索微调小LLM,联合预测下一活动和剩余时间,达SOTA效果
超越扁平网表:面向时序电路可扩展分析的层次化图表示学习
DeepSeq3层次化框架,双GNN建模两级表示,状态中心预训练,BMC求解时间减18%。
面向节能驾驶的条件扩散模型
提出条件扩散模型生成电动汽车电池电流曲线,较直接注入条件大幅提升精度,支持能耗感知车队规划。
Softmax 注意力的近似秩:精确几何定律与稳健交互维度
证明注意力近似秩的几何定律:支撑集决定最坏缩放,交互维度控制每头复杂度,并给出鲁棒SVD维度。
解析器状态已知:面向结构化生成的结构条件KV持久化
利用解析器状态信号优化KV压缩,在0.33预算下平均提升17.39个百分点,吞吐量最高2.2倍,显存降低47%。
跨模式迁移学习:迈向统一的城市出行预测
提出统一框架TransMod,跨出行模式迁移知识,对齐空间表征,缓解数据稀缺,预测更优。
残差引导的随机神经网络
提出残差引导贪心构建隐藏层的方法,以闭式残差减少准则选候选单元,实验在71个数据集上优于基线。
SinkSLOT:基于稀疏提升最优传输的Sinkhorn方法
提出SinkSLOT,以稀疏提升最优传输稀疏化Sinkhorn核,迭代成本O(LN),所得散度无需去偏,速度大幅提升。
VISTA:基于验证器信息的学生到教师自适应用于同策略自蒸馏
基于验证器的师生自适应方法,用结果验证的轨迹调整教师分布,使同策略自蒸馏在推理评测中提升。
Colombo差分幂行列式猜想的一个代数证明
证明了Colombo猜想:偶n且坐标互异时,所有d≥n−1的差分幂矩阵非奇异,秩为min{n,d+1}。
推导OpenEuroLLM模型的缩放定律:学习率、批量大小与损失
研究预训练大模型学习率与批量的缩放行为,建模其演变,验证损失缩放形式,为开源欧欧模型建立基线并开源。
欧几里得傅里叶神经算子
针对傅里叶神经算子依赖周期域的问题,提出将谱核参数化为物理波矢的连续函数,实现跨不同形状和尺寸周期域的泛化。
用于大语言模型预训练的曲率条件多尺度动量与球面约束
提出曲率条件多尺度动量法及球面约束,加速大模型预训练,相比Muon显著提升效率。
SymboLLM-FE:LLM加速的符号回归用于表格数据自动特征工程
结合符号回归与大语言模型先提取强相关表达式再精炼兼顾性能与可解释性迭代少优于现有自动特征工程
推进交互敏感的特征选择:新型Relief算法、扩展比较及生物医学数据挖掘建议
比较多种Relief算法,新算法MultiSWRFDB等兼顾主效应与交互,运行速度提升10-35倍。
神经网络优化器综述(2025-2026)
2025-26年优化器设计已超越Adam变体,涵盖矩阵方法、时间策略与系统表示。矩阵感知方法进步真实,但AdamW仍不可替代,排名随规模、批大小等变化。
Destroy Me:组织病理学图像的自动伪影生成
提出Destroy Me混合框架合成逼真伪影增强病理数据,在肺癌分类上F1提升10.5%、Kappa提升15%,验证稳健性提升。
多尺度基于社区的带符号功能网络指纹识别
提出多尺度社区指纹框架,利用正负脑活动识别个体,经HCP验证,可靠可解释,助力精准神经影像。
QGPINNs:量子图非局部微分方程的物理信息神经网络框架
提出QGPINNs,物理信息神经网络求解量子图非局部微分方程,支持分数阶模型、统一边界顶点条件,可反演参数。
REPLICANT:学习规避和加固恶意软件检测器的策略
提出深度强化学习框架,在仅标签黑盒下高效规避恶意软件检测,成功率78.8%,并用于加固检测器。
网络比较的最优传输:综述与机器学习应用
本文综述最优传输在网络比较中的应用,介绍三种距离及其传输计划,并用于聚类与异常检测。
封闭模式是一种规范选择:认证代码世界模型中相对于可达范围的拓扑
采样门认证的模型只在可达查询集精确,不可达处可任意错;危险是拓扑相对可达,修复需内部证据,缓解需维度匹配。
恰当评分规则如何塑造语言模型预测
比较五种恰当评分规则作为训练目标:语言模型总体精度相近,但校准、偏差和误差结构不同,规则不可互换。
DARTS:通过外科手术实现模型合并的解码器感知表示调优
提出DARTS,用熵加权损失和逐位置偏置修正解码器表示偏差,几乎不增参数,显著提升模型合并的多任务性能。
面向联邦冷启动推荐的个性化多视图表示
提出PMFRec,用个性化生成器与多视图编码器解决联邦冷启动推荐,提升效果、公平性与鲁棒性。
面向大规模基质演化的张量加速即时多分辨率网格
EMR-HyperNEAT:预计算所有分辨率,并行过滤高方差,GPU加速12-34倍
CARDINAL:从非增强心脏CT预测心血管风险
CARDINAL用非增强心脏CT深度学习预测心血管风险,十年AUC达0.866,优于传统方法。
量子SEDONet:面向偏微分方程的光谱嵌入量子深度算子网络
量子SEDONet按边界条件嵌入谱基,无需额外量子资源,使四种基准测试相对L2误差降低36%至54%。
经验均值最大熵方法的计算与统计效率
经验MEM收敛率达n^-1/2,优于n^-1/4;对偶化为期望风险最小化,可用随机梯度,统计计算高效。
走向叠加的数学理论
用框架论和压缩感知建立神经网络叠加数学理论,证明随机与最坏情形下的支持恢复定理,并给出等角紧框架的精确阈值。
超越Procrustes距离:捕捉手性的多重线性Gromov-Wasserstein距离
提出捕捉手性的多重线性G-W距离,具鲁棒性,并给出高效算法。
面向科学基础模型的大规模异构数据组织:核聚变案例研究
针对核聚变数据异构稀疏特点,分析超20种传感器与多模态结构,为科学基础模型提供数据组织模板。
基于机器学习电子结构的MoS2/氧化物器件界面的从头算建模
新从头算法结合机器学习与量子输运,速度提升万倍,可模拟逾2万原子器件,揭示界面欠配位金属原子显著影响电流。
共振超声谱反问题的物理信息学习
基于物理信息的学习框架,通过降维变量和解析重构,高效求解共振超声谱弹性常数反问题
面向失效感知的首发命中批量逆向设计的锚定场景覆盖
提出ARC-SC批量采集法,以锚定场景覆盖提升失效环境中首次命中设计的发现效率。
集体觅食中涌现的聚集行为
仅凭觅食奖励优化个体行为,随视野增大,聚集作为副产物自发涌现,无需直接社交驱动。
非为破坏,而为证明:面向隐私保护的大语言模型验证的对抗探针
提出零知识证明审计框架,对抗探针检测模型篡改;黑盒令牌探针灵敏度最高,证明开销小。
利用浅循环解码器实现MHD液态金属流实时监测
SHRED+PCA降阶模型由稀疏温度测量重建液态金属包层状态,磁场变化下误差约5%,可实时监测。
线性上下文学习中淬火临界性的朗道理论
把线性上下文学习中的双下降奇点表述为淬火无序系统的临界现象,构造朗道势,得到临界指数并获数值验证。
基于优化确定性等价风险控制的保形风险规避决策
研究基于优化确定性等价度量的风险规避决策,刻画最优策略,提出数据驱动校准方法,并在无线波束成形中验证。
CheXtriev:以解剖为中心的胸部X光片案例检索表示
提出解剖感知图检索框架,捕捉解剖位置与病灶关联,检索精度较现有方法高18%-26%。
I-FLOP:从干预数据中快速学习变量顺序和父节点
将FLOP推广至干预数据,采用干预BIC评分,恢复干预马尔可夫等价类DAG,性能与速度俱佳。
GPU平台上大语言模型推理工作负载的请求与令牌能耗成本表征
大语言模型推理按令牌计费但按窗口耗能,令牌能耗下降可能伴随请求能耗上升;需联合优化两者。
广义样条与高斯过程
将高斯线性逆问题中MMSE估计与正则化最小二乘的等价性推广到无限维,建立广义样条与广义高斯过程的广泛对应。
定位全局差异:边际贡献与上下文异常检测
提出边际贡献框架定位异常观测,提升估计效率,并揭示上下文可携带额外类别信息。
让流说话:用GFlowNets解决图组合优化问题
用GFlowNets为组合优化设计MDP,训练条件模型采样解空间,高效寻找高质量解并开源。
基于Bures–Uhlmann几何的异构噪声客户端量子联邦学习
面向异构噪声客户端,以混合态几何张量的实部预条件、虚部加权聚合,有收敛保障,优于联邦平均。