基于路段流量传播引导的强化学习在线动态OD矩阵估计
提出LFPG-RL,将路段流量传播引导集成PPO,单次前向在线OD估计,墨尔本路网中精度优于现有方法。
超越分类器的模式连通性:生成与对比模型的证据
首次在DDPM与NanoCLIP中发现模式连通,提出架构感知算法,拓展损失景观几何研究。
粗粒度组成足矣:多活性抗菌肽谱的表格上下文学习
简单序列描述符加表格上下文模型即可超越昂贵结构深度模型,多活性预测性能大幅提升,且无需结构信息。
用于心电图Transformer的心跳同步标记化
提出心跳同步标记化用于心电图变换模型,保留心搏形态,在两项任务上性能不逊于固定分块且序列更短。
超参数完全控制下的 RMSprop 优化器收敛速率
RMSprop凸优化误差常数随超参数一致有界;目标期望上界为初始化衰减、随机逼近余项与记忆误差之和。
RSLM:面向近似最近邻搜索的无训练向量量化
RSLM无训练向量量化:1-4比特/维压缩嵌入,降内存带宽,利用残差编码及L2范数校正维持召回。
DASC:用于混合线性注意力服务的衰减感知状态压缩
提出衰减感知状态压缩(DASC),基于保留视野压缩状态检查点,提升缓存效率,降低TTFT并提高吞吐。
基于增长自组织映射和合成回放的无监督持续学习
提出基于增长自组织映射与合成回放的无监督持续学习框架,无需存储原始数据,性能媲美监督方法。
当Muon遇上任务干扰:持续学习与模型合并的谱视角
持续学习与模型合并同属任务干扰,优化器谱范数是关键。Muon能抑制该因子,显著提升两者性能。
语言模型中的量化触发后门:跨量化器可迁移性与验证-部署鸿沟
量化后门利用验证-部署鸿沟,INT8/4位压缩触发恶意行为,跨量化器可迁移,源精度审计不足,部署配置须认证。
边际覆盖信用减少并行状态熵优化中的冗余探索
提出边际覆盖信用方法,按留一策略覆盖度分配奖励,减少冗余探索,提升并行策略互补覆盖。
用于关联证据归因的自解释多标签图神经网络
提出SEMGNN,联合预测与边掩码解释,利用标签相关性增强多标签分类与解释的忠实性。
块稀疏特征化器的深度分析
块稀疏特征化器以子空间块为单元,仍有特征分裂/组合等缺陷;提出锦标赛Top-K选择缓解分裂,并扩展到交叉编码器。
曲率感知半径收缩的自适应最近邻分类
通过局部曲率自适应调整邻域半径,提升最近邻分类精度,在多个数据集上显著优于传统k近邻。
蒲公英:用于行星动力学神经模拟的球面花朵
提出球形蒲公英求解器,无卷积,仅用球坐标变换实现空间混合,在球面PDE基准上表现最佳或次佳。
更多数据无法打破对称性:设计保障的可识别性
无监督对齐受几何自同构限制,密集采样致诊断失效;设计时选择非对称刺激,可将对齐失败从75%降至2%。
DAMP:衰减感知混合精度循环状态量化
DAMP衰减感知混合精度量化循环状态,9.9比特下精度接近FP32,存储降69.1%,解码提速10.9%。
快速权重注意力用于持续学习
研究循环快速权重记忆在自回归前缀预测下的在线学习规则,提出归一化一阶更新及Falcon系列变体,在语言建模和长度外推上表现优异。
SegBench-GC:测试多步离线目标条件强化学习的分割不变性
提出分割不变性基准,揭示人为切分轨迹会严重损害多步离线GCRL,延续引导可缓解。
RiskBlend:机器学习回归测试中测试输入优先级排序的多信号框架
提出RiskBlend框架,融合历史失败、预测/边界/邻域变化四种信号,在80种组合中平均APFD最高。
超越非独立同分布:联邦学习中的学习者-客户端分布不匹配
现有联邦学习忽视客户端与学习者数据分布错位,提出基于代理数据的影响力感知动态客户端选择,用留一法评估,提升收敛速度与精度。
利用基础模型进行基于脑电图的阿尔茨海默病诊断
利用脑电预训练大模型与随机森林,仅用8秒脑电片段,AUC达89.36%,优于传统频谱法,并捕获临床验证的α/θ节律退化生物标志物。
SafeStep:面向行人安全监测的语义通信交互演示
开发交互式演示平台,实时监测行人安全,采用新型语义通信方案,任务损失降低92.1%,支持多用户并发。
DART-FL:边缘动态推理需求下的突发感知多任务联邦学习
提出突发感知多任务联邦学习,动态切分推理训练资源,按需求调权,突发期提升高频任务精度,保持性能。
来自模型内部的调用:探究基于探针的大语言模型工具调用错误检测
线性探针可有效检测LLM工具调用错误,能泛化至新型错误,效果受模型大小、探针层与训练方式影响。
超越搜索模仿:面向无搜索国际象棋的先验引导探索
用前向KL替代反向KL,使无搜索自博弈探索贴近先验,提升战术准确率但棋力不随之提升,二者解耦。
面向高效天气集合预报的扩散蒸馏
提出监督能量距离蒸馏,将多步扩散教师压成单步学生,保持极端事件技巧,用于天气预报,一次评估达或超教师。
SOMTab:高效表格上下文学习的集合序Mamba方法
SOMTab用Mamba构建表示、注意力做预测,实现高效表格上下文学习,推理更快、内存更低。
初始化至关重要:通过模型初始化推进负荷异构下的联邦短期负荷预测
针对联邦短期负荷预测中的负荷异构问题提出全局预训练与局部顺序初始化策略减少客户端漂移提升精度
动态图上时序记忆感知的在线测试时适应
提出动态图在线测试时适应新方法,含时序增强、记忆感知与一致性引导,显著提升多种分布偏移下的泛化。
中文标题:可操作CBFI:面向表格机器学习的结构分解与因果反事实干预整合框架
中文摘要:提出A-CBFI框架,基于结构因果模型定位因果瓶颈并精准干预,减少主动干预负担76.9%,同时保持因果有效性与全局干预成本。
TACIT-Switch:基于删失监督的LLM智能体成本感知模型升级
提出TACIT-Switch,用区间删失观测学习永久切换策略,在相似成本下成功率提升7.4-11.1个百分点。
超越成对图:用于参数化PDE的超图自适应小波算子
提出超图自适应小波算子HALO,以线性稀疏成本学习谱域特征,在多类基准上达最优精度,并稳定扩展至工业级网格。
FedEHR-Agents:用于自动化EHR建模的联邦智能体优化
提出以经验为中心的联邦智能体优化框架,聚合多医院临床建模经验,优于多种基线。
面向神经性能预测的节点级特征编码
提出节点级特征编码的预测器,融合计算量、参数、内存代理,预测延迟与能耗,新数据集上达最优,并普遍提升现有模型。
去而复返:用于多模态翻译的双向扩散桥
提出双向图像文本扩散桥,支持正反向生成,源感知路径提升采样灵活性,性能优于基线。
TI²PS:一种面向随机多细胞模式形成的拓扑信息逆向设计框架
提出贝蒂向量+逆代理建模,从目标模式估计ABM参数,优于PointNet++,仅用10%数据。
条件流匹配何时能替代逐点负对数似然?
线性高斯路径下精确分解端点负对数似然,指出普通流匹配并非逐点似然估计,加权可消内部残差,在线对齐仍有偏差,为似然法适配流匹配提供理论依据。
PhyMamba:物理调制Mamba实现稳健电池健康预测
提出物理调制Mamba框架,融合电化学老化,多数据集误差降31.8%,兼顾精度与效率,稳健预测电池健康。
学习差分:面向时间序列预测的自适应可逆差分法(AdaRDiff)
提出自适应可逆差分法:可学习加权差分简化序列,闭合式重构加速,两阶段训练提升精度,达最优且即插即用。
蒙特卡洛树搜索就是每次访问蒙特卡洛控制吗?
蒙特卡洛树搜索与每次访问蒙特卡洛控制本质相同,四阶段归结为轨迹采样与每次访问更新。
一种在质量退化约束下以性能最大化为目标的LLM量化层位宽分配方法
提出Gemma-3-1B层位宽分配法,在质量退化约束下最大化性能,11%延迟降低且损失可忽略。
线性回归中加权数据选择的精确风险比
证明三个精确风险比值:F_w(d,2d-1)=1+1/d、F_w(3,4)=5/3、F_w(4,5)=2;给出一般下界并猜想全域成立。
高能物理碰撞数据回归中经典与量子机器学习的比较
经典与量子模型比较:量子模型以极少参数达相近精度,QCNN用4量子比特媲美深度CNN,具参数效率优势。
面向可靠医疗AI的可解释不确定性估计
提出egRUE方法,统一不确定性量化与特征级解释,提升医疗AI可靠性及医生校准信任,增强安全关键决策支持。
广义吉布斯系综加权用于预测组合
提出广义吉布斯系综加权框架,经多项基准测试,性能有竞争力但非普遍最优。
VICT:面向长程LLM智能体强化学习的验证器插桩信用追踪
VICT利用验证器内部原子结构追踪依赖边,将优势沿证据边重分配,改进长程LLM智能体稀疏奖励下的信用分配。
频谱特征主导BCG呼吸事件检测:睡眠呼吸暂停患者特征组的大规模患者独立比较
BCG监测睡眠呼吸暂停,155例患者比较10类特征,频域特征主导(占30.3%),时频联合贡献67%,AUC达0.97。
促进多层感知机顿悟的生物启发机制
生物启发机制促进顿悟,稳态作用最强,结构稀疏次之,均经调节神经元利用与有效连接改善泛化。
执行性隐私:当差分隐私最大化效用
当数据泄露与参与反馈足够强时,有限差分隐私预算长期效用优于非私有,证明差分隐私可最大化长期效用。