11352 条条目 · 106 个活跃源
2026年9月22日
04:00
arXiv cs.LG

用于反应产率预测的角色感知Morgan指纹

提出MFP:角色感知Morgan指纹构建固定长度描述符,前馈回归预测产率,精度高且训练快一个量级。

04:00
arXiv cs.LG

基于聚类的物联网系统集体异常检测:一种图神经网络方法

提出无监督图集体异常检测框架UGCAD,以变分图自编码器增强聚类,无需组标签,在物联网数据集上效果更优。

04:00
arXiv cs.LG

StepKV:面向LLM智能体的步骤感知KV缓存压缩

StepKV将推理步骤作为缓存保留单元,结合步骤效用与token显著性剪枝,低KV预算下精度显著优于token级方法。

04:00
arXiv cs.LG

对比世界模型

以互信息下界替代像素重建,学习潜在动力学,去除像素解码器,在视觉干扰下更稳健、训练更高效。

04:00
arXiv cs.LG

工业运动学轨迹模型(IKTM):坐标无关的自回归生成器

提出坐标无关工业轨迹生成器IKTM,用速度/航向自回归建模,单站训练零样本跨三站,优于马尔可夫模型。

04:00
arXiv cs.LG

面向半导体制造的不确定性与业务感知剩余使用寿命估计

提出深度学习与同步分位数回归结合的预测性维护框架,实现不确定性感知的剩余寿命估计,显著降低维护成本。

04:00
arXiv cs.LG

TARGet:基于图神经网络的拓扑感知融合式射频电路功能建模

TARGet:拓扑感知融合GNN射频电路建模,误差低于1%,训练数据减少35.5倍,支持零样本迁移。

04:00
arXiv cs.LG

PAGE:分区感知的门控 KV 缓存淘汰

PAGE按输入门控KV缓存淘汰:用预填充注意力头一致性降幅无标签判定,降幅大才淘汰,否则保留全缓存,容量受限损害降29倍。

04:00
arXiv cs.LG

OpenBlock:面向自适应三消游戏的可构造且可验证的内容生成

双轨内容生成平台,验证门保证可放置;RL揭示后期失败源于棋盘退化,线上次日留存+1.8pp、时长+7%

04:00
arXiv cs.LG

EvoRank:LLM 引导的多目标学习排序流水线进化

LLM引导进化自动搜索多目标排序流水线,50轮即超越调优LambdaMART;并提出可预判收益的余量门槛与失效审计工具。

04:00
arXiv cs.LG

超越任务完成:训练有能力且安全的计算机使用智能体

SCOPE联合后训练智能体的任务能力与安全决策,结合数据生成与强化学习,实现能力安全双优。

04:00
arXiv cs.LG

用于基于时空深度学习的雪水当量预测的高斯过程去相关

用高斯过程去相关时空数据,训练LSTM预测雪水当量,保形预测量化不确定性,优于基线。

04:00
arXiv cs.LG

面向布拉修斯边界层问题的自适应物理信息神经网络

提出自适应PINN求解布拉修斯边界层,结合梯度加权、残差配点与Adam-L-BFGS,壁面剪应力误差1.9e-5,较先前降约21.5倍。

04:00
arXiv cs.LG

用于空间转录组生成的相关性引导流匹配与退火掩码

提出CorrFlow,以退火掩码流匹配和基因图正则建模基因依赖,在12个数据集上PCC与HPCC最优,生成更生物学一致的空间转录组。

04:00
arXiv cs.LG

SegTSim:一种大数据驱动的异构多变量系统分段时序仿真框架

SegTSim分段时序仿真框架,融合弹性建模与自适应门控,基于美日汽车贸易数据验证,扰动下结果稳定。

04:00
arXiv cs.LG

WildfireSpreadBench:在野火蔓延预测中,指标决定模型选择

在野火蔓延预测中,AP与F1/IoU排名不一致;高AP模型常严重过预测,AP不足以指导业务选型。

04:00
arXiv cs.LG

一撮 SFT,一撮 RL:强化学习何时能助力长时程广告智能体

用教师支持与奖励余量诊断路由 SFT 与 RL,定向训练在广告技能上更优,泄漏与算力更低。

04:00
arXiv cs.LG

CleanScore:带阴性对照与敏感性边界的黑盒基准审计

CleanScore仅用评分输出审计基准污染,区分技能与预暴露;实测无暴露优势,阳性控制揭示改写审计会漏检泄露。

04:00
arXiv cs.LG

DPTM-DT:用于药物-靶点预测的双预训练Transformer多任务表征学习

DPTM-DT融合分子图、蛋白语言模型与跨模态注意力,在Davis/KIBA多任务预测中性能最佳。

04:00
arXiv cs.LG

通过在Transformer各层间共享神经专家提升参数利用率

CS-MoE跨层共享全局专家池,仅激活55%参数即优于同规模稠密模型,性能随激活专家数单调提升,可灵活权衡算力与容量。

04:00
arXiv cs.LG

剖析分层推理模型:一项机制研究

机制分析显示,HRM通过约束感知的迭代精修谜题解状态,各层级贡献随任务阶段变化,且不依赖紧凑因果特征。

04:00
arXiv cs.LG

基于储备池计算的跳动四分之一车模型非线性振荡预测

采用回声状态网络对跳动四分之一车模型进行数据驱动预测,成功重建分岔图、相空间吸引子及周期与混沌轨迹。

04:00
arXiv cs.LG

Toollery:将 LLM 智能体扩展至数千种技能与工具

Toollery 免训练压缩候选:为海量技能/工具建索引,先召回紧凑候选集再交 LLM 决策,降低成本并提升召回。

04:00
arXiv cs.LG

量化对临床基准的影响:跨模型族的准确性与安全性

量化对临床基准影响:INT8普遍安全,INT4退化因模型与任务而异,准确性与安全鲁棒性相互独立。

04:00
arXiv cs.LG

列表计数失败并非单一现象

指令模型列表计数错误模式各异,非单一输入瓶颈;线性探针可恢复真实计数,后期MLP修复难跨模型迁移。

04:00
arXiv cs.LG

UniGIO:面向时空不完整观测的统一生成式全球站点天气建模

UniGIO直接从时空不完整的全球站点观测生成式建模天气,统一预报、插补与生成,性能领先。

04:00
arXiv cs.LG

编码智能体能否复现官方统计数据?受控Eurostat基准中的元数据、重试预算与执行反馈的局限

元数据与重试预算比执行反馈更关键,输出契约与评测设计可主导智能体误差。

04:00
arXiv cs.LG

用于预测性维护的合成多变量冰箱时间序列数据集

含27台冰箱多变量时间序列,涵盖六种渐进退化类型,共706万行,支持故障预测与退化分析。

04:00
arXiv cs.LG

度量检验器:面向GPU内核基准判定器的变异分析

以变异分析度量GPU内核基准判定器:官方漏检16.9%故障(精度类78.6%),据此优化测试套件。

04:00
arXiv cs.LG

CAMFT:面向大语言模型的冲突感知可合并微调

提出CAMFT,在微调中塑造可合并性,引导任务更新低冲突的稀疏坐标,提升多任务合并效果。

04:00
arXiv cs.LG

CNA:一种面向AI的健康状态综合归一化评估及其在强化学习优化RRT策略中的应用。

提出面向AI的健康状态综合归一化评估CNA,结合离线强化学习优化RRT策略,死亡率降低62.24%,住院时间缩短18.93%。

04:00
arXiv cs.LG

并非所有秩都生而平等:跨任务的预算感知 LoRA 合并

提出Net Utility免数据指标,按SVD奇异方向的任务效用与干扰全局分配秩预算,合并性能提升。

04:00
arXiv cs.LG

SCALE:面向能源材料的仿真校准摊销学习(连接确定性建模、真实世界数据与 Transformer 规模推理以加速能源材料发现的混合架构)

SCALE融合仿真校准、真实数据与Transformer推理,加速能源材料发现,储氢筛选成本降约10^7–10^8倍。

04:00
arXiv cs.LG

面向结构化神经网络剪枝的任务感知混合QUBO优化

提出任务感知混合QUBO框架,融合敏感度与滤波器交互,QUBO-张量列车精修,提升结构化剪枝去噪性能。

04:00
arXiv cs.LG

面向分布式天空覆盖与基于人工智能的行星际路由的通用天文台图

提出通用天文台图框架:将太阳系L2点天文台建模为加权图,评估六站天空覆盖,用Q学习求解行星际通信路由。

04:00
arXiv cs.LG

对抗训练的统计推断:基于最优传输的中心极限定理

论文基于最优传输证明对抗训练分类模型的两类中心极限定理,并给出鞍点稳定性与泛化误差界。

04:00
arXiv cs.LG

CHART:面向框架鲁棒搜索智能体的框架轮换课程

CHART通过轮换课程训练搜索代理,在多个运行框架下稳定学会并行搜索,并提升跨框架与跨任务迁移。

04:00
arXiv cs.LG

CALM:面向基于活动的出行者仿真的校准型LLM选择网络框架

提出可复现混合框架CALM,融合LLM规划与校准选择,纽约数据验证可降分布误差,支持消融与压力测试。

04:00
arXiv cs.LG

预测器与编排器:智能体AI框架中面向多时间尺度岩溶含水层预报的简约机器学习

基于79年数据比较五类模型,XGBoost多时间尺度岩溶含水层预报最稳健,并集成五智能体自动化框架。

04:00
arXiv cs.LG

面向电潜泵预测性维护的对比孪生表示学习

提出孪生对比表示学习与先验校正KNN的电潜泵故障诊断框架,可应对类不平衡,留一泵验证性能稳健。

04:00
arXiv cs.LG

COREM:余弦关系动量重塑与有状态写回

COREM借余弦关系重塑动量并写回状态,提升中后期训练,最终性能更优或相当且计算更省。

04:00
arXiv cs.LG

面向自动化LLM微调的策略积累与引导执行

提出SAGE两阶段框架,积累微调策略经验并引导新任务,平均相对提升由3.2%升至15.6%。

04:00
arXiv cs.LG

教师应提前思考:面向可靠同策略蒸馏的自适应续写

提出AC-OPD,通过方差-偏差权衡自适应选择教师续写范围,提升同策略蒸馏可靠性。

04:00
arXiv cs.LG

RS-Claw-Evolution:面向长时程任务的轻量级遥感智能体环境反馈驱动进化

提出环境反馈驱动三阶段进化框架,经交互、经验与决策进化提升轻量遥感智能体长时程任务表现。

04:00
arXiv cs.LG

复值相位相干Transformer

复值模型需L2归一化Q/K并保持一阶尺度余弦注意力;PCT多任务超实值基线,首次纯复值解Path-X

04:00
arXiv cs.LG

共因,而非交叉注意力:阻断音视频生成中的视觉捷径

音视频生成器易学视觉捷径,从外观而非因果事件预测声音;共享潜变量无效,需干预干扰并保证反事实不变性。

04:00
arXiv cs.LG

通过专家共激活实现高效混合专家投机解码

提升专家共激活可缓解显存传输瓶颈;结合负载均衡、共享专家与一致性损失等设计,吞吐量提升21%。

04:00
arXiv cs.LG

抵制、更新、拒绝:偏好优化植入依赖先验的可靠性开关

偏好优化通过可靠性标注数据,给模型装上依赖先验的开关:按来源声明的可靠性决定是否改答。

04:00
arXiv cs.LG

连接内容检索器:稠密图边特征驱动 LinkedIn 预排序

LinkedIn 提出 CC Retriever 预排序系统,用 GPU 低延迟运行全深度排序模型,参数扩大 50 倍,内容停留时长提升 2.5%。

04:00
arXiv cs.LG

TWIG:面向不规则图上自回归预测的时间因果小波算子

TWIG为图原生神经算子,以因果多尺度小波特征在图小波块上传播,实现不规则图上稳定自回归预测。