OOD-RL-Bench:强化学习分布外检测基准框架
提出OOD-RL-Bench,首个考虑RL轨迹时序结构的分布外检测基准,评估显示观测延迟与动作条件动态检测最困难。
中文标题:一种针对KV缓存的JoLT方法:通过联合Tucker和JL残差分配实现大语言模型几乎无损的KV缓存压缩
中文摘要:提出JoLT方法,联合Tucker分解与JL旋转残差,对KV缓存实现近无损2-3倍压缩,性能与基线相当。
轻量级多尺度异常检测:面向资源受限的边缘设备
提出轻量级多尺度自编码器LMSAE,用小波变换提取特征,参数少、模型小于500KB,在边缘设备上延迟降低9倍、功耗降低2倍。
基于证据的验证式智能推理:通过工具认证内核证明消除LLM经验推理幻觉
EG-VAR用Lean内核验证工具调用与推理链,确保输出完全基于证据,实现100%准确率,彻底消除幻觉。
基于学习的概率负荷预测:事后与模型内不确定性
比较事后与模型内不确定性方案,TFT集成分位数学习最佳,MAPE 2.2-3.6%,区间更窄。
约束感知的联邦强化学习聚合方法用于微电网能量协调
提出基于惩罚的聚合规则,在联邦强化学习中平衡奖励与安全,显著降低违规。
使表示先验有效的原因?特征族、无标签不变性与“顿悟”关键窗口
先验有效需特征族对齐,无标签交换对加速可靠,早期短窗口即达最优。
中文标题:记忆的几何学:有限时间谱灵敏度作为流匹配模型的诊断工具
中文摘要:提出FTSS指标,通过谱坍塌检测流匹配模型过拟合记忆,无需外部查询。
学习李群上的受迫多体动力学
仅用位置数据,基于李群离散欧拉-拉格朗日方程学习动力学,保持几何结构,适用于多体系统。
AdaPCLA:针对长尾纵向电子健康记录生成的自适应先验校准Logit调整
AdaPCLA通过模拟退火内化知识,自适应生成长尾EHR并支持零样本控制,在MIMIC上显著提升尾部事件性能。
视频扩散模型中的序列性差距
视频扩散模型在因果链延长时性能下降,即使增加去噪步数也无效,根源在于缺乏可扩展的序列计算能力。
AVQ注意力:自适应向量量化注意力
提出自适应向量量化注意力,根据注意力重要性动态分配码本容量,在保持O(MN)复杂度下改进精度效率。
加速掩码扩散大语言模型:高效推理技术综述
综述掩码扩散大语言模型加速推理技术,提出延迟分解框架,归类算法、架构系统及推理扩展优化,并提供基准指南。
集群张拉整体结构的基于能量物理信息形找方法
提出基于能量学习框架,通过势能最小化和本构关系,同时预测平衡构型和内力,提升鲁棒性。
对比折叠损失:实现灵活几何最优嵌入与更快收敛
CoCo损失促进类内折叠类间对比,实现几何最优嵌入,加速收敛并提升聚类效果。
基于验证器的推理模型强化微调用于热能存储控制
基于DP可验证奖励的强化微调推理模型,30条提示训练下,建筑储能排放接近DP最优,推理时间作用显著。
具有$O(T^{2/3-\epsilon})$误差界的高效顺序校准
提出高效随机预测器,结合SPR-Calibration与校正层,突破经典$T^{2/3}$界,实现$O(T^{2/3-\varepsilon})$校准误差。
TerraZero:面向大规模零示范自对弈的程序化驾驶模拟
TerraZero通过自对弈训练,首个无人类示范的策略在InterPlan长尾基准测试中领先,安全评分最高。
频谱不足:何时上下文有助于时间序列预测
揭示频谱指数无法衡量上下文价值,提出覆盖亏缺诊断指标,实验验证其有效性。
你记得吗?迈向以记忆为中心的多模态AI
本文提出记忆中心架构,发现LLM记忆缺失,通过局部EMA更新实现高效压缩,并统一信息论框架解释幻觉本质。
美国高空晴空湍流预测建模:一种机器学习方法
采用XGBoost模型,利用PIREPs、ERA5和BADA数据预测美国高空晴空湍流,AUC达0.904,地理坐标和湍流指数是关键特征,集成空气动力学特征提升检测,冬季频发。
等离子体诊断模型中传感器鲁棒性的基准测试:基于TokaMark的系统评估
临近传感器故障严重降低序列模型性能,统计模型稳定;均值填充恢复报警;等离子电流最关键。
高斯索伯列夫算子的近最优学习
提出Hermite-PCA近似算法,以近最优样本复杂度高效学习高斯索伯列夫算子,具有谱收敛性。
中文标题:学习对称性的图论本质
中文摘要:构建覆盖几乎所有≤767阶群的13万+Cayley图数据集,揭示群性质与图统计关系,提出新序列与猜想,比较GNN预测能力。
我们真的修复了吗?对时间序列异常检测中点调整后评估指标的独立对抗性压力测试
独立测试显示:ROC型指标和affiliation-F1易被无技能检测器攻破,PR型及PA%K抗性较好,ROC优于PR方向一致。
VQCSim:编译一次的状态向量模拟何时胜过通用量子框架?
VQCSim编译一次模拟,推理加速4.49倍,训练加速26.78倍,自动微分贡献27.6倍。
可移除缺陷:刻意缺陷的经济学与局限性
缺陷可经济保留,致命时按需移除,需优势条件和检测器区分;观察缺陷与能力缺陷区别在于部署分布。
AAAI-26双重投稿:新挑战
双重投稿问题加剧,AAAI-26用相似度检测拒稿141篇,建议加强政策与检测工具。
基于V-JEPA与深度时空学习的视频框架
无需传感器,从单目视频估计五个波浪参数,在有限数据下达到0.451-0.832相关性,验证可行性。
分析图像编码器选择与图同质性在GCN框架下对乳腺超声分类的影响
系统评估五种图像编码器,高容量编码器提升图同质性与分类性能,图同质性与准确率呈强线性相关。
当方向准确率说谎时:一个基于真实基线的LoRA微调TimesFM股票预测基准
LoRA微调TimesFM方向准确率受市场基率误导,真实基准显示无方向性技能,仅点误差略微降低。
动态在线处理器原生状态估计推断
提出处理器原生不确定性追踪的贝叶斯滤波,实现确定性分层重要性重组,平均加速805倍,精度-延迟权衡优于粒子滤波。
用深度生成模型生成物理上合理的降落伞动力学
提出SPar-GAN生成模型,从数据学习降落伞动力学,复现准确俯仰偏航动态,减少物理测试量。
通过强化学习和机械设计中的先验知识实现鲁棒的手内操作
通过全局抓取质量和指尖曲率两个物理先验,提升手内滚动操作的旋转效率、稳定性和抗干扰能力。
FlashDiff:面向扩散模型服务的高效区域执行与调度
FlashDiff通过自适应区域执行和调度,选择性更新非均匀扩散区域,降低延迟30-97%,提升吞吐1.2-2.2倍。
TraceSynth: 使用约束引导扩散模型生成生产级内核跟踪
TraceSynth基于约束扩散生成合成内核跟踪,在计算密集型负载下F1达87.2%,仅比真实低2.6%,上下文长度是关键。
去中心化梯度下降:瓶颈体制与预算复杂度
提出瓶颈中心框架,引入梯度多样性-网络连通比与梯度-通信噪声比,推导预算复杂度界限,揭示关键权衡。
用异常事件证伪因果关系图
利用异常传播原理,通过统计检验证伪候选因果图,仅需单个异常样本即可操作。
基于上下文白化的电力流代理模型无梯度拓扑自适应
提出ICW方法,通过重估白化统计量实现无梯度拓扑自适应,误差降低6-28倍,适应速度提升21-34倍。
SlimPer:打造精简而智能的个性化模型
SlimPer通过迭代精炼紧凑知识库实现高效排序,解耦模型深度与历史长度,显著提升用户参与度。
MESH: 通过异构内容统一实现检索规模化扩展
MESH通过模块化架构与门控偏差校正缓解异构检索扩展偏差,使稀疏内容缩放指数提升14倍,吞吐量提升2.87倍,新鲜内容重钉率+5.5%。
低轨卫星系统中通感一体化的鲁棒设计
针对低轨卫星通感一体化,提出鲁棒波束成形算法,在信道不确定下最小化功率并保证感知与通信性能。
用于湍流减阻的无梯度闭环壁面控制器学习
进化策略首次直接优化大湍流通道闭环控制器,减阻26%,超越梯度法和反对称控制。
关注差距:LeWorldModel中层级规划的承诺与陷阱
层级规划不自动提升LeWorldModel性能,高层子目标生成是瓶颈;约束搜索与低级控制器兼容可显著改善长程任务(最高+14.7%)。
Environment Parameter Gradient Theorem for Policy-Environment Co-Design in Reinforcement Learning
多尺度问题的基于深度学习的LOD方法代理建模
提出LOD-MSNO混合方法,融合LOD先验与数据驱动,高效高精度求解多尺度问题。
汤普森采样在错误次数上达到2倍竞争比
汤普森采样期望错误数不超过其他策略两倍,证实2014年猜想且因子2最优。
LLMs Can See the Smoke but not the Fire: Evaluating Abductive Reasoning with Elenchos
物理一致参数推断:高能物理与宇宙学中的透明机器学习模拟
利用XGBoost仿真高能物理与宇宙学的复杂似然函数,结合SHAP保障物理可解释性与一致性。
安全强化学习中用于高效探索的方向性约束
提出ATACOM-DC方向性约束,仅在必要时激活,提升安全-性能平衡。