基于拉东定理的部分概念类的VC维数
通过拉东定理,得到L_p空间中扩张球类部分概念类的VC维数上界与维数无关,仅依赖边缘和半径。
回答还是放弃:通过弃权感知强化学习减轻搜索代理的幻觉
提出弃权感知强化学习(AWA-RL),动态调整弃权奖励,减轻搜索幻觉,精确率提升10.3%,RA-F1提升2.9%。
策略驱动的CT智能体:为临床一致的CT推理建模相位感知诊断控制
提出PD-CTAgent,通过相位感知表示和知识引导控制,动态选择CT成像相位,减少辐射并适应临床协议。
加权调整梯度揭示大语言模型中的参数重要性与失效模式
提出WAG方法,通过权重与梯度交互发现LLMs关键参数及性能崩溃模式,优于现有指标。
分层贝叶斯求积
提出自适应树分区贝叶斯求积,处理非平稳积分,无需MCMC,非平稳问题显著优于标准方法,平稳问题性能相当。
LSTrans:面向轻量级自动心电图分类的高效知识迁移
LSTrans结合1D卷积与Transformer,通过低秩适配和知识蒸馏,实现轻量高效ECG分类,显著降低内存与延迟。
分布偏移何时破坏图神经网络的校准?
首次理论表征图神经网络在分布偏移下的校准,揭示关键控制因素,提出无源无标签校准方法STAC。
针对约束在线凸优化(COCO)的OGD+投影算法的累积约束违反下界
本文给出OGD+投影算法在约束在线凸优化中累积约束违反的下界Ω(T^{(d-1)/(2d)}),为首个下界结果。
历时样本整合:基于生成模型的稳健尾部风险估计
通过集成训练检查点样本平均尾部波动,在不修改生成目标下降低尾部估计误差。
WSqD:一种适用于大模型训练的无视野学习率调度策略
用逆平方根基线替代WSD恒定阶段,实现视野无关,在凸优化中达最优收敛,实验匹配或超越精心调参的WSD。
Infrared Organization and Critical Cognitive Field Formation in Transformer Dynamics
基于图神经网络的RFID空间几何推理方法在空间AI系统中的应用
提出图神经网络框架,利用RFID观测推断室内空间几何关系,预测轨迹与区域模式。
大语言模型强化学习中的预测性散度掩码
提出预测性散度掩码,通过闭式预测散度变化方向替代PPO比率准则,提升LLM强化学习训练。
量化大型语言模型的可靠性缩放定律
量化LLM的可靠性缩放非线性,4位模型达最佳可靠性-效率权衡,且增强鲁棒性。
潜在处理效应的谱结构
通过投影到共享代理子空间,两处理组商算子之差的对角本征值即为潜在效应,并给出高概率扰动界。
奇点空间:一种用于信号表示的生成扩散框架
提出奇点空间框架,用复平面奇点表示信号,避免网格模糊,实现无分辨率重建,在激波测试中误差降低4.2倍。
具有极小极大最优遗憾的强盗主成分分析
提出强盗PCA的极小极大最优算法,实现r√dT阶遗憾并匹配下界。
中文标题:两层神经网络中的奇异摄动与层次化学习
中文摘要:证明奇异摄动控制训练速度下,两层网络按预测时间尺度恢复单索引模型低阶分量,并发现二次分量学习中的神经元奇异重排。
粘性跳跃扩散:掩码、连续与混合扩散的统一视角
提出粘性跳跃扩散统一三类扩散,通过去噪危险匹配训练,其反转解释了各扩散家族的特征。
一种通过分组属性补全和置信度感知对比学习的新型图欺诈检测器
提出GFD-GC框架,用分组补全属性和置信度对比学习解决图欺诈中属性缺失与类别不平衡,性能领先。
面向零维降阶模型规划的多智能体框架
提出Z-COPA多智能体框架,将0D流网络规划转化为图结构优化,在航空发动机等系统中实现高效全局最优设计。
使用截断二次损失增强异构数据的拜占庭鲁棒联邦学习
提出截断二次损失聚合规则,解决现有方法偏差,实现异构数据下最优拜占庭鲁棒学习。
TabPFN超越表格数据:多模态嵌入上的校准与准确性
TabPFN作为零梯度分类头,在多模态少样本分类中校准和精度均优于现有方法。
基于联合汤普森采样的链路自适应
利用有序成功概率的联合汤普森采样算法,在链路自适应中性能稳健且吞吐量高。
AeroMELD:用于诊断和潜在动力学的气溶胶群体线性嵌入
提出AeroMELD框架,构建保留气溶胶群体结构的线性潜在变量,实现诊断重建与混合ML-物理建模基础。
基于物理信息传播路径的多维训练优先级加权:物理信息神经网络的统一残差加权框架
提出统一多维优先级框架,用负指数权重将物理传播顺序转为训练优先级,提升PINN收敛与精度。
在闭环DEX模拟器中动态费用下的执行强化学习
构建闭环模拟器,DQN在动态费用环境下显著降低交易实现缺口,优于基准策略。
高效的在线比例采样及其在平滑在线学习中的应用
针对σ-平滑对手的高维在线比例采样,设计数据结构避免指数增长,证明深度上界,应用于在线学习获次线性遗憾。
测试时邻域融合的证据神经网络自适应改进分子性质预测
提出PG-EVIKAL方法,测试时邻域融合改进分子性质预测,RMSE中位数降低19.4%,无需重新训练。
使用适度非结构化稀疏权重矩阵加速大型语言模型的GPU推理
提出三层矩阵存储格式,利用稀疏张量核与CUDA核协同,在中度稀疏下实现LLM推理加速,性能首次超越密集矩阵乘法。
一种通过交互解释大语言模型知识蒸馏的统一方法
发现知识蒸馏机制是交互稀疏化,复杂交互稀疏度越高性能越好,提出CIP损失函数提升效果。
iLENS:可解释的大语言模型引导的混合专家模型用于神经影像生存分析
提出iLENS框架,利用LLM引导混合专家模型实现AD转化生存预测,兼具高性能、可解释性与患者分型能力。
低位整数的有符号对称量化
提出有符号对称量化,通过符号选择将额外值分配给异常尾,保留对称量化效率,理论条件最优并验证性能提升。
粘性路由:训练MoE模型以实现内存高效推理
StickyMoE通过路由一致性损失减少专家切换60%,困惑度仅降4%,实现内存高效推理。
奖励传输:通过噪声空间对齐实现流匹配中的属性控制
利用最优传输耦合对齐噪声与分子奖励,训练时嵌入可控结构,推理时调节标量坐标单调控制属性,无需额外模型或梯度引导。
LieBN:李群上的批归一化
提出LieBN框架,利用李群左右不变度量实现黎曼批归一化,在九种几何上验证有效性。
Director:通过在线主动专家放置加速分布式MoE服务
Director利用预测驱动在线专家放置,实现近零停机迁移,端到端延迟降低11%-55%。
DaDaDa:面向数据市场的数据定价数据集
首个数据产品定价数据集DaDaDa,含16147个产品元数据,支持定价、分类与检索。
HERO:面向联邦持续学习的异质性感知基准库
HERO基准库解耦三因素,控制数据倾斜与任务顺序不匹配,评估发现方法行为随异质性改变,平均准确率掩盖弱客户端。
处理缺失数据的模式感知图神经网络
提出模式感知图神经网络编码缺失模式,在7个数据集上平均提升17%平衡准确率,区分缺失模式比任务优化更重要。
训练、阅读与编辑可读Transformer
提出方差下限惩罚使Transformer算子清晰可读,可编辑性提升50-184倍,质量与基线持平。
自适应贝叶斯精确追踪内禀时间上的信息
贝叶斯更新满足精确信息核算,遗憾分解为即时支付与信息距离减少,内禀时间由累积支付定义。
SafeExplorer: 一种用于带有恢复干预的强化学习的无偏策略梯度方法
SafeExplorer提出无偏梯度估计,消除恢复策略偏差,大幅减少训练跌倒次数,并保持或提升最终奖励。
面向相互依赖的电力-通信网络中组件关键性排序的机器学习替代模型
基于梯度提升的代理模型实现组件关键性排序,Spearman达0.85,接近模拟上限,优于拓扑中心性。
BlockServe:面向高吞吐扩散LLM服务的块粒度连续批处理
BlockServe通过块粒度调度与混合状态执行,解决扩散LLM收敛异质性,实现1.9-10.6倍吞吐提升。
TSRouter:面向时间序列推理的动态模态-模型选择
提出基于图的动态路由框架TSRouter,协同文本与视觉模型优势,根据性能成本偏好选择最优模态,性能提升16%-46%,支持零样本泛化。
提示驱动的探索
利用VLM诊断回放视频并重写提示,实现全局探索,让RL从零奖励开始学习成功策略。
中文标题:针对安全表示的优化:激活引导的对抗后缀与拒绝的几何结构
中文摘要:激活引导攻击揭示安全表示分布式,Soft-GCG加速33倍,大模型更抗攻击。
线性表示如何习得?抽象动力学的精确解
获得抽象动力学的精确解,揭示数据与目标几何、网络深度及初始化尺度的影响,并发现非线性衰减律。
面向晶体性质预测的模型无关图提示学习
提出图提示学习框架,捕获缺失特征,提升GNN性能3%-15%,支持跨性质知识迁移。