FlashLoop:通过惰性更新实现快速且内存高效循环Transformer
免训练框架FlashLoop借循环冗余,用词元稀疏更新与KV残差量化,无损加速1.64倍、KV缓存降6倍。
辅助学习的解析理论
基于师生框架推导在线SGD动力学方程,揭示辅助任务通过平衡优化驱动力与梯度噪声提升泛化能力。
SwitchPFN:面向冻结式上下文时间序列分类的共享切换动力学
提出SwitchPFN,学习共享投影与码本,使时序动态特征跨样本可比,平均准确率相对提升4.47%。
TopU-LBVS:面向基于配体虚拟筛选的真实多靶点基准
提出TopU-LBVS多靶点硬负样本基准,覆盖93靶标,揭示随机诱饵会高估LBVS性能。
MF-SCBO:多保真可扩展约束贝叶斯优化
提出MF-SCBO,将可扩展约束贝叶斯优化拓展至多保真,支持高维、黑箱约束与非嵌套采样,收敛更优。
从图到馈线:约束引导的规则合规馈线生成
提出PG-DiGress,以约束引导扩散生成合规馈线,严格通过率从13.7%升至96.8%。
面向多年AADT估计的图上时空互补特征传播
提出时空互补特征传播框架,融合稀疏传感器与宏观交通模型,实现全网多年AADT估计,误差低于10%。
当时间扰动类似传感器偏置:可穿戴活动识别器的无标签审计
无标签审计可穿戴 HAR:重放相位随机扰动,27 个模型准确率降 2.87–40.83 点,直流扰动破坏更大。
利用测试时增强提升黑盒放射学AI的校准
DualTTA:模型无关测试时增强框架,改善黑盒放射AI校准,肺栓塞与颅内出血误差降54%和43%。
残差相关性作为GP共区域化联合不确定性增益的诊断指标
共区域化主要提升联合不确定性而非点预测;残差相关性可预测该增益,据此提出诊断量与残差ICM方法。
皮层-小脑环路中误差与预测驱动的运动学习
提出小脑启发框架,融合多路预测与内部反馈,编码运动学与误差信号,实现延迟下在线校正并使适应提速十倍。
追踪状态还是追踪陪集?学习到的状态追踪的代数解释
模型学群元素乘积时追踪陪集而非精确状态;部分精度由陪集大小决定,子群陪集结构揭示学习阶段与内部计算。
超越平均安全:机会约束的大语言模型微调
提出机会约束微调框架,限制安全样本退化比例,采用可微违规率替代与约束感知梯度下降,实验验证优于基线。
让训练引导选择:基于真实锚定效用的在线合成数据过滤
FROST以真实数据梯度反馈衡量合成数据效用,在线过滤约两至三成合成样本,在图像分类、文本转SQL与工业广告重排中均显著提升真实任务性能。
多样几何、冻结权重:基于因果专家集成的稳健异质性处理效应估计
提出几何多样、权重冻结的GeoACE因果专家集成,提升异质性处理效应估计稳健性,但非普遍最优。
Canopy:利用分段平滑树先验的多保真度赌博机
CANOPY用随机路径探测在线检测平滑违背,引导多保真树赌博机的昂贵评估,提升LLM推理优化表现。
以近为靶,可达远方:你的冻结世界模型比你想的更会规划
冻结视觉世界模型直接以目标图评分会限制控制;用检索到的中间目标做锚定规划,无需训练即可提升长程规划。
带自举的随机算子收缩框架:在时序差分学习中的应用
提出随机算子收缩框架分析带自举迭代,无需梯度结构,允许采样误差随迭代增长,获均方几何收敛界并用于TD
基于可达性的含节点和边特征的图神经网络形式化验证
提出GNNV,将NNV扩展至图结构,用GraphStar集建模节点和边特征不确定性,验证GCN/GINE,在电力与图分类任务上提供更紧且首个边感知鲁棒性保证。
面向大规模铁路网络管理的图推理与拓扑感知多智能体强化学习
提出图推理与拓扑感知多智能体强化学习框架,建模铁路维护环境,零样本迁移至大规模网络,性能优于基线。
论对数凹分布的平方和可认证性
证明各向同性对数凹分布的多项式为平方和,去除庞加莱常数依赖,恢复最优矩界,并得到高效无维误差算法。
AT-SKM-Net:面向动态图线性硬约束可行性的加速可训练采样Kaczmarz-Motzkin框架
提出AT-SKM-Net,以拓扑感知GNN混合采样和Cholesky更新,加速动态图线性硬约束可行性求解,迭代最多降85%且零违规。
语言模型的最小侵入式引导
提出MISVO,用局部KL几何约束引导向量,不改模型参数;多任务奖励领先,多样性与连贯性近Best-of-N。
学习动力学中的内在—外在耦合
提出内在—外在耦合,用延续条件价值与可执行状态几何识别匹配交互;耦合不一定带来正向协同。
利用超图表示学习重建短寿命粒子
对撞机中提出HyPER,用超图表示学习重建短寿命母粒子,参数高效且通用。
从预测到可解释的提供方行为画像:面向欺诈、浪费与滥用审查
将FWA审查从预测转向可解释画像:收入分解为规模与项目构成,描述优于预测,语义词典显著提升召回。
RADAR: Readiness for AI Discovery and Agentic Reach
超越压缩:为神经代理求解器中的稳定长时程推演训练潜表示
长时程不稳定非潜表示本身,而是仅重构训练所致;Koopman、噪声与多步微调使误差降约40%,精度媲美全分辨率,算力降两个数量级。
具身强化学习中用于私有轨迹重建的时序梯度反演
提出TRACE时序梯度反演攻击,从策略梯度自回归重建具身强化学习私有轨迹,快且准,防御需序列感知。
Signal2Symbol:面向可解释生理时间序列异常检测的神经符号时序推理
提出神经符号框架,将ECG/EEG符号化,结合稀有项集、Allen区间代数与FCA,生成可解释的时序异常检测结果。
PR-Smoother:面向数据同化的保持模拟器非高斯平滑方法
提出PR-Smoother:保留模拟器,仅学未来修正,实现非高斯平滑与状态参数偏差联合推断。
漂移契约:面向深度鲁棒局部学习的谱更新
将Muon式谱更新用于局部学习,增强深度鲁棒性;提出漂移契约学习率,并发现归一化时优势转向全局。
什么让 Terminal-Bench 任务变难?在经裁定的智能体语料上区分真实难度与虚假难度
2.8万次试验中125个全失败任务仅78个确认真未解,其余源于预言机损坏、基建故障或验证绕过。
HARN:面向事件驱动多时间周期预测的层次化联想共振网络
提出HARN分层联想共振网络,事件驱动更新多时间周期持久表示,价格预测具竞争力。
面向早期术中急性肾损伤预测的泄漏感知多模态评估框架
提出波形时序模型及多模态扩展,在防泄漏框架下用术中前60分钟数据预测急性肾损伤,堆叠集成最优。
LWCal:面向含噪校准标签表格分类器的损失加权校准
LWCal无需干净校准标签,按预测矛盾降权噪声样本,门控版更稳健,降低含噪表格分类校准误差。
COPE:稀疏用户反馈下基于用户嵌入与自我评估的大语言模型持续个性化
提出COPE框架,利用用户嵌入与自我评估生成代理奖励,在稀疏反馈下实现LLM持续个性化优化。
边际正确的工具缓存可能逆转组归一化策略更新
工具缓存边际正确时,组内共享随机结果仍可逆转组归一化策略更新;中心化不缩放可保方向。
QUARTET:四分支交叉注意力与随机游走轨迹,增强关系图上的Transformer
QUARTET结合因果随机游走采样与四分支交叉注意力,增强关系图Transformer,分类领先。
面向机器学习聚合物性质预测的开放基准
发布PolyBench26开放数据集,涵盖近25万条、八种性质的聚合物数据,支持四类评测任务;结果显示图模型预测误差最低,且在不同训练规模与重复单元复杂度下均保持稳健。
论多目标强化学习中事后重标记引发的偏好覆盖坍缩
多目标强化学习按实际达成偏好做事后重标记会致偏好覆盖坍缩,损害多数设置;her_mix 单参数凸组合可将多数恢复至基线。
后处理公平性约束何时有益、何时有害:来自八项跨域评估的证据
FAPE跨八领域评估:后处理公平约束在高基线差异时多改善、近公平时反恶化;单次审计不可靠,需持续监控。
CORE-STACK+:面向深度堆叠泛化的元学习
CORE-STACK+缓解异构视觉堆叠的共线性与校准崩溃,多基准提升且降模型量与算力。
CRISP:面向不平衡表格学习的可扩展重要性分层核心集
线性时间核心集法:按代理分数分层分配负类预算并逆倾向加权,生产数据减95%负类仍保99.7%精度。
TinyUDE:在微控制器上通过李-泰勒射流匹配实现无求解器通用微分方程
提出无求解器李-泰勒射流匹配,可在微控制器上实时低内存训练通用微分方程,精度媲美或超过求解器基线。
GeoRVQ:生理信号残差 token 预测中的解码器感知几何
GeoRVQ以解码器感知几何软目标改进生理信号残差量化掩码建模,提升解码保真度与R峰检测。
资源高效的分布式递推高斯过程
提出两种分布式递推高斯过程算法,分析收敛性并优化参数,实测显著降低通信量且精度相当。
WTF?!基于Wasserstein倾斜流映射的无仿真强化学习
提出WTF框架,用Wasserstein倾斜流映射实现无仿真强化学习微调,少步推理即保持高奖励,训练算力最多省280倍。
限电导致数据稀缺下的太阳能光伏发电预测:基于共形化分位数回归的迁移学习
迁移学习结合共形分位数回归,限电致数据稀缺下光伏预测RMSE降23.7%,经验覆盖率达94.3%。
线性表示假设需要一个群作用
线性表示假设实为按表示等价性区分的一族命题,可用群作用形式化表示对象、生成过程与断言性质。