先看后升:拓扑深度学习的可视化与定量诊断
提出拓扑探索器,用增广哈斯图可视化提升数据,其指标与下游性能相关,促使流程变为提升-审视-设计-训练。
高效鲁棒加密流量分类后训练框架PERO
提出PERO框架,用轻量代理估计风险并优选高风险样本,实现加密流量模型高效鲁棒后训练,兼顾性能与低开销。
神经训练动态中的结构化可预测性度量:跨机制研究
用三类探针度量短程可预测性,发现训练动态中辅助参数较简单,批量参数呈局部时变斑块,受架构与训练方案调控。
并非所有注意力都同等重要:EEI权衡的量化综述
以EEI框架比较21种注意力方法,蒙特卡洛分析显示仅支持粗粒度分层比较。
面向机器遗忘的谱显著性
提出SSU,阈值化弱奇异分量,仅更新置信遗忘信号方向,在图像分类器、扩散模型和LLM上有效。
UniFed-VLM:多异质性视觉-语言模型的联邦指令微调
提出UniFed-VLM,通过子空间聚合与协同蒸馏解决任务、模态、架构异质性,提升多任务性能。
QSMP:通过Quick Shift+矩阵轮廓发现代表性时间序列子序列
QSMP结合快速移位与矩阵轮廓,密度聚类子序列,高效提取长序列代表性波形,优于现有方法。
基于低秩三次密度投影的高维非参数变点检测
提出基于低秩三次密度投影的非参数变点检测,无需密度估计即可捕捉三阶变化,实现高维精确恢复与最优定位。
利用立体视网膜照片的定量形态表型分析近交人群的种群结构
基于立体眼底照片重建视神经头形态,深度学习提取特征聚类,分析近交人群结构,助力青光眼遗传研究。
有保证的自适应模态获取:当策略选择其自身的校准组时
针对策略自选校准组的自适应模态获取,提出路由认证法有限样本保证,临床心电图任务风险控制有效。
网络化信息聚合的最优下界
解决开放问题:均方误差下界为Ω(1/√D),匹配上界;并推广至满足强凸等正则条件的凸损失,如逻辑损失。
动态图异常检测的摊销事后解释与精确保留
提出X-StrGNN,为冻结的StrGNN添加事后解释层,输出结构与时间双重归因,零检测损失,单边开销0.66毫秒,稳定性高且成本低。
用于组合概念泛化的多阶段训练量子模型
多阶段量子训练模型利用张量与变分电路分解组合概念,显著提升跨模态关系泛化,参数少且性能优。
SchurQuant:面向逐层LLM量化的分组离散优化
提出基于舒尔补曲率的分组离散优化逐层量化,无反向传播,2比特零样本精度提升9.65个百分点。
电力系统攻击检测中量子机器学习的基准测试:评估选择先于模型决定结果
基准测试:评估选择先于模型决定结论;数据划分使宏F1从0.905降至0.594。
GraniKV:面向长共享前缀多智能体系统的非对称粒度KV缓存分页
GraniKV:非对称粒度KV缓存,共享前缀连续HOT池,后缀令牌级COLD池,吞吐最高2.16倍。
为OCTA辩护:OCT到OCTA合成中的重建-效用差距
OCT合成OCTA重建指标虽高,但细毛细血管分割大幅退化,重建保真不等同临床效用,应评估下游任务保真度。
电商产品媒体排序中的序列多模态证据优化
提出SMEO框架序列优化媒体排序,转化率提升5.5%,滑动次数减少15%。
稀疏原型编码是跨模态分类与预测的基础
发现跨模态分类的通用表示几何:分类相关变异集中于类质心坐标,稀疏原型代码可精确预测准确率。
基于因果抽象的广义可迁移性
借助因果抽象,将迁移性推广到模型层:既无精确映射时,仍给出可认证区间,覆盖不可迁移及无目标数据情形。
FluxBin:算法-内核协同的基于查找表的灵活超低位大模型推理
FluxBin算法内核协同超低位大模型推理:5.92x加速,10.19x节能,内存降4倍,单卡70B
SubZero+:通过大学习率实现高效零阶大语言模型微调
提出SubZero+,以低秩子空间多查询估计、子空间Adam及符号校正提升零阶微调稳定性,扩大学习率范围,缩小与一阶方法差距。
大型发现模型:基于实证的模型驱动开放式搜索
LDM耦合生成模型与贝叶斯代理模型,不确定性感知开放式搜索,显著提升三领域优化性能。
CrevasseSeg:标签高效的无人机冰裂隙分割框架
提出标签高效无人机冰裂隙分割框架,自监督预训练,仅24张标注即超基线。
可审计分类器模型学习:源不相交树集成
提出残差树集成:三阶段学习,特征预算、源不相交,独立系数估计,预测为无重叠规则之和,性能媲美强基线。
PL-Guard:面向大语言模型护栏的概率逻辑推理
PL-Guard分离语义与概率推理ProbLog显式推理不安全合规率降至0.5%但过度拒答14.4%
FirstDiff:基于初始噪声预测的多变量时间序列单步扩散异常检测
提出FirstDiff,通过初始噪声预测实现多变量时间序列单步扩散异常检测,无需完整反向,性能最优且推理成本低。
TinyCast:基于计算周期性的概率零样本预测
提出名为TinyCast的预测器,仅用十四万六千参数,通过计算周期性而非学习,实现零样本概率预测,达精度前沿。
路由分歧不是同权重MoE自蒸馏中行为影响的证据
同权重MoE自蒸馏中,路由分歧对输出影响甚微,不是行为影响的证据,应先测暴露再干预。
基于重心对抗逆强化学习的股票交易策略学习
基于重心对抗逆强化学习框架,融合专家演示预训练,经强化学习微调,用控制屏障防回撤,四大股市表现更优且风险更稳。
面向欺诈检测的时序图原型条件保形预测
提出时序图欺诈检测的保形预测框架ProtoCP,聚焦欺诈子图上下文,稳定非一致性分数,四个基准上以更小预测集达目标覆盖。
L-FNO:洛伦兹傅里叶神经算子用于随机事件动态
提出L-FNO,结合洛伦兹谱核与似然训练,提升事件似然及罕见事件检测,优于回归与似然基线。
不要声称面向基准的优化能提升通用编程能力——多样化评估必不可少
针对少数基准的优化不代表通用编码能力,跨任务迁移差,需多样化评测与持续基准维护。
EEG-PRISM:基于生理学基础的EEG基础模型预测可解释性
EEG-PRISM将预测归因映射至频域与源域,频谱恢复近完美,癫痫定位50%准确,自闭症标志物定位准确。
稳健XGBoosting回归
研究XGBoost回归稳健性,受离群点影响,提出MM-XGBoost两阶段法,采用M/S/τ损失,平衡稳健与精度。
Hard Cases, Bad Labels: Testing Error Exposure and Error Location in Uncertainty Sampling Under Bounded Label Noise
不确定性采样在干净数据上提升学习曲线1.09-1.77个百分点;其鲁棒性因数据集、噪声和评估指标而异,错误位置无普遍额外惩罚。
通过激活引导剪枝实现跨模型规模的无训练知识迁移
提出激活引导剪枝(APM),无需显式语义对齐,将大模型功能模块注入小模型,在16项基准上平均准确率从55.5%提升至60.6%。
鲁棒双模型协作随机向量功能链接网络
提出核风险敏感均值p次方RVFL模型,抗噪声离群,协作学习增强鲁棒性,基准测试优于基线。
对撞机实验中可解释异常检测的对比学习
ORCA框架利用对比学习嵌入与自编码器进行对撞机异常检测,提升灵敏度,并通过模板拟合实现可解释性与信号量化。
查询知道该遗忘什么:线性注意力的第二擦除方向
线性注意长上下文状态干扰损害检索。提出查询导出的第二擦除方向,与键正交,抵消沿查询的旧状态,提升检索,可用上下文约翻倍。
从BERT到前沿智能体:语言模型八年进步、能力-成本曲线崩塌与任务定向模型的兴起
八年从简单模型到智能体,编码能力年增六倍,成本骤降;专用模型分领域领先;高级采样与置信排序显著提升任务效果。
推理中数据选择的能力依赖性效应
推理微调中,高似然数据利于小模型快速提升,低似然数据利于大模型长期训练,选择需视模型容量与算力而定。
整数不在场证明:INT8量化LLM推理中跨内核分歧的定位
INT8内核互换导致输出分歧,源于缩放与舍入而非精确累加器;探针干预可恢复逐位一致。
基于深度学习药物-靶标结合亲和力预测的最新进展
综述深度学习预测药物-靶标结合亲和力方法,分析基准数据集与评估指标,指出数据偏差、冷启动等局限,提出改进方向。
联邦提示学习:统一框架、实证分析与未来方向
综述联邦提示学习:整合联邦学习与大语言模型,解析其动机、特性、权衡、安全隐私挑战及防御机制,并展望未来方向。
SAGE:注意力引导熵驱动的脉冲Transformer代理梯度自适应
提出SAGE,用注意力熵估计不确定性,训练时自适应调整代理梯度斜率,不改变推理,准确率提升1-2%。
CutClean:面向隐私保护推理的神经网络剪枝
提出一种隐私感知剪枝法,减少隐私信息流动并提升稀疏度,同时保持目标任务精度。
用于鲁棒分子过渡路径采样的随机控制策略
提出随机策略FS-TPS与LaS-TPS,稳定生成分子稀有转变路径,提高成功率与路径质量。
HI-MeshGraphNets:基于层次多尺度图神经网络的高效精确网格物理学习
提出层次多尺度图网络HI-MGN,粗化网格传递消息,精度提升,训练时间和内存降低。
带在线请求的动态多车场车辆路径问题:事件驱动Transformer-深度强化学习与滚动时域基准测试
提出事件驱动学习框架,处理动态多车场车辆路径在线请求;学习策略毫秒级决策,但最近可行启发式综合最优。