11592 条条目 · 106 个活跃源
2026年8月17日
04:00
arXiv cs.LG

CytoBERT:面向细胞计量数据的基础模型

CytoBERT是细胞计量数据基础模型,经五千万细胞预训练,实现跨异质数据集迁移学习。

04:00
arXiv cs.LG

扩散模型强化学习设计:统一路径空间视角

统一路径空间视角揭示扩散模型RL两类方法同源,差异在方差缩减;提出KDE价值梯度估计器,提升扩散RL性能。

04:00
arXiv cs.LG

通过神经元门控和混合激活设计紧凑神经架构

提出基于神经元门控与混合激活的可微双层优化框架,高效搜索紧凑架构,性能优于离散方法。

04:00
arXiv cs.LG

正确概率质量增加,答案反而更差:幂采样为何失败及如何修复

幂采样增大正确轨迹概率却使推理变差,因剂量与覆盖失配;用保支撑的变形幂目标修复,优于标准。

04:00
arXiv cs.LG

LP-NAS:基于线性规划的神经架构搜索

提出基于线性规划的神经架构搜索,利用验证损失梯度和训练损失海森矩阵指导搜索,在多个数据集上优于现有方法。

04:00
arXiv cs.LG

近似Muon与低秩适配器

针对低秩参数化无法正交化的问题,通过线性化与最小二乘近似松弛Muon目标,提出sMuon方法,在微调与预训练中表现更优。

04:00
arXiv cs.LG

使用表格扩散Transformer生成基准健康数据

提出两阶段跨表格生成框架:异构表转统计表,扩散Transformer建模生成,再重建合成数据,保真度高、权衡佳。

04:00
arXiv cs.LG

Rollplex:视觉语言模型后训练中的跨阶段GPU空间共享

Rollplex跨阶段共享GPU,前缀计算并入解码窗口,实现1.23-2.24倍加速,保同步RL更新。

04:00
arXiv cs.LG

BCIJelly:脑机接口研究的一体化生态系统

BCIJelly一体化脑机接口平台,整合数据/解码器/模块,自动架构搜索+LLM闭环,支持多任务跨物种,toChip部署至神经形态芯片。

04:00
arXiv cs.LG

控制任务中的持续进化策略

研究发现进化策略在连续控制中会严重遗忘,重放机制能缓解遗忘并促进正向迁移,但过大重放预算会降低可塑性。

04:00
arXiv cs.LG

从预测到干预:基于LLM智能体的个性化餐食级血糖调控

提出生理反馈智能体循环整合个性化吸收建模与饮食干预用预测驱动优化餐食提升预测精度并减少血糖波动

04:00
arXiv cs.LG

基于聚合类激活图的网络数据全局解释交互式分析

针对网络流量分类,提出聚合类激活图可视化交互系统,展示全局解释,助专家发现模式、优化规则,经专家评估。

04:00
arXiv cs.LG

利用物理信息深度算子网络学习非定常动脉瘤血流动力学

提出M3PI-DeepONet预测非定常动脉瘤血流,速度误差<4%,压力误差约5%,推理加速36倍。

04:00
arXiv cs.LG

移动通信代理的基于邻接矩阵的谱替代控制

以邻接矩阵主特征向量为谱代理控制移动通信代理,性能相当且鲁棒性更优。

04:00
arXiv cs.LG

VoiceDesigner:通过统一扩散建模与数据增强的文本到语音生成与编辑

提出语音设计器统一框架,融合混合数据与扩散变换器,支持文本到语音生成与编辑,提示对齐与音质优秀。

04:00
arXiv cs.LG

hint$^2$:用于推理时时序逻辑引导的分层世界模型

提出hint$^2$方法,利用分层世界模型在推理时引导短时策略满足复杂LTL规格,优于现有方法。

04:00
arXiv cs.LG

未知的未知:物理学中机器学习的模型误设

物理反问题中ML模型误设即未知未知;需迭代诊断与缓解,吸收无关误差,保留发现敏感,核心是怀疑自身模型。

04:00
arXiv cs.LG

一致模型追踪达到极小极大最优:大参数不确定性下标量对抗自适应控制的精确值

一致模型追踪为极小极大最优:标量对抗自适应控制精确最坏峰值=1+Δ,最优策略是集合一致区间中点的死区控制。

04:00
arXiv cs.LG

PLAUD的架构与可供性:表演性潜变量与无监督DDSP

PLAUD是基于噪声带网络的神经合成器,融合变分DDSP、操控操作等,服务于现场电子音乐,其表演性源于架构设计。

04:00
arXiv cs.LG

用AI构建AI密集型软件:早期结果与开发成本衡量之警示

六人团队用AI辅助开发对话助手,成本比初报19.4倍,修正后9.9倍,揭示成本测量易错且隐蔽。

04:00
arXiv cs.LG

AI安全训练数据集中的语言特定缺口

审计发现多语言安全基准存在语言级缺口,非洲语言尤甚,需可验证覆盖声明。

04:00
arXiv cs.LG

高斯过程超参数优化中最大似然估计的脆弱性

最大似然估计在高斯过程训练中脆弱,假设不满足时泛化差;提出理论指标与实用方案,显著提升回归/分类及贝叶斯优化性能。

04:00
arXiv cs.LG

工程信号在人机协作智能体编程时代:基于vLLM与SGLang 33,228个PR的纵向分析及其对生物医学AI智能体与生物信息学管道开发的启示

AI辅助开发使开源项目PR吞吐量增21倍,周期缩短,贡献者更广,但机器人作者占比不足0.2%,增长主要由人类驱动。

04:00
arXiv cs.LG

多智能体在线学习中偏好能预测什么、不能预测什么

博弈偏好图与无遗憾学习动态:动态稳定集需偏好稳定,但偏好本身不足,需聚合偏离下的韧性保证渐近稳定。

04:00
arXiv cs.LG

SPEAR:基于注意力正则化的结构-性能可解释性

提出SPEAR框架,通过注意力正则化提升结构-性能回归的可解释性,并在XRD数据中识别出有物理意义的特征。

04:00
arXiv cs.LG

音频深伪检测中自监督学习潜空间的轨迹动态

自监督潜空间轨迹动态可检测音频深伪;仅用真实语音训练LSTM预测器,跨语料库显著优于静态基线。

04:00
arXiv cs.LG

涌现模型:源自微小基底的智能

提出涌现模型范式:在简单基底上通过演化搜索涌现计算,证明潜在普适性;微小模型可外推算术与控制。

04:00
arXiv cs.LG

智能制造中的深度视觉:用于智能质量监控与诊断的MODERN框架

MODERN深度学习框架用于质量监控与故障隔离,结合迁移学习支持小样本,理论最优收敛率,实验优于现有方法。

04:00
arXiv cs.LG

球面纯p-自旋模型在动力学温度及以上的非碎裂性

对球面纯p自旋玻璃,在动力学温度及以上,排除若干重叠区间的碎裂,部分解决猜想1,提出新方法。

04:00
arXiv cs.LG

AgilePE:基于自博弈强化学习的自主无人机追逃

提出AgilePE系统利用自博弈强化学习实现无人机追逃端到端控制仿真到真机零样本迁移

04:00
arXiv cs.LG

量子生成模型中谱滤波的经典极限

谱滤波对量子生成模型无经典优势:幅值滤波要么可经典采样,要么不衰减频率;分离源于谱相位,纯相位滤波除外。

04:00
arXiv cs.LG

气象驱动的垃圾填埋场逸散排放因果即时预报助力主动公共卫生响应

借助常规气象数据,机器学习框架CAIRN因果预报垃圾场逸散气体,实现公共卫生主动预警。

04:00
arXiv cs.LG

体型可预测工蚁寿命,但无法预测其衰老方式或热致死方式

体型仅预测工蚁寿命,不预测衰老与热敏感性;衰老与昼夜节律相关,热敏感与谱系相关。

04:00
arXiv cs.LG

ATLAS:通过LLM引导的抽象与自动机学习发现智能体策略

提出ATLAS,用抽象与自动机学习从智能体轨迹中恢复可解释行为模型,揭示策略并支持分析。

04:00
arXiv cs.LG

CORAL:基于激光雷达的目标导向城市驾驶的课程优化奖励自适应

结合课程学习和奖励自适应,显著提升城市驾驶成功率,并能零样本迁移到新城镇。

04:00
arXiv cs.LG

Pairton:短寿命粒子的迭代重建

Pairton利用图掩码预测迭代重建短寿命粒子基于Pairformer在ttbar全强子衰变最优

04:00
arXiv cs.LG

基于贝叶斯样本推断的生成建模

提出BSI生成模型,将扩散采样视为迭代高斯后验推断,优于BFN和VDM,样本质量提升且似然相当。

04:00
arXiv cs.LG

基于扩散模型的离线深度Q*估计

用扩散模型估计奖励转移核,解耦算子与值学习,得深度Q*估计器,无完备性假设,理论实验俱佳。

04:00
arXiv cs.LG

基于期望自由能的火星探测机器人信息路径规划

提出期望自由能统一信息寻求与奖励寻求,在路径约束下规划,兼顾建图精度与高价值区定位,优于基线方法。

04:00
arXiv cs.LG

图神经网络过压缩问题综述:当前方法、基准与挑战

综述图神经网络过压缩问题:总结其定义、三类缓解方法、与表达能力及过平滑的关系、评测与复杂度,并展望开放问题。

04:00
arXiv cs.LG

基于线性样本稀疏化的主动回归

提出基于线性样本稀疏化的方法,将主动回归等曲线拟合的样本复杂度降至O(d),优于此前O(d log d)的杠杆得分采样。

04:00
arXiv cs.LG

分布时序差分学习中的在线推断

证明非参数分布时序差分学习的根T误差与自助法同收敛于高斯极限,可推断方差、条件风险价值和分位数等泛函。

04:00
arXiv cs.LG

可学习优化算法的概率框架

提出优化算法的统计学习框架,基于轨迹概率分布,支持群体性能分析与从数据学习,并提供PAC-Bayesian泛化保证。

04:00
arXiv cs.LG

OTIS:用微型编码器学习高质量时间序列特征

OTIS仅7.1M参数,性能媲美54倍大的模型,内存能耗延迟大幅降低,可生成高质量时间序列特征。

04:00
arXiv cs.LG

晶体材料通用热力学原子间势

提出热力学原子间势,将势能扩展为吉布斯自由能,自动微分得热力学量,可预测相变与合金溶解度。

04:00
arXiv cs.LG

面向序数分类的序数感知校准

首次正式提出序数校准问题,提出ORCU损失,融合距离感知软编码与对数障碍,实现最优校准且不损精度。

04:00
arXiv cs.LG

ArGEnT:任意几何编码的算子学习Transformer

提出解耦几何编码与查询采样的注意力框架,在任意几何上提升算子学习精度与泛化,误差降低超一个量级。

04:00
arXiv cs.LG

指数族成员推断:从LiRA与RMIA到BaVarIA

统一LiRA/RMIA/BASE为指数族框架,提出贝叶斯方差推断BaVarIA,低影子模型下优于LiRA。

04:00
arXiv cs.LG

响应性验证:预测会改变吗?改变多少?多久改变一次?

提出“响应性”度量,估计输入变化时模型输出改变的概率,提供算法与统计保证,支持安全可靠性验证。

04:00
arXiv cs.LG

隐式偏差与不变性:Hopfield网络如何高效学习图的轨道

Hopfield网络从轨道有限随机样本中训练,可指数级逼近不变全轨道解,样本复杂度与轨道大小无关,能高效记忆图轨道。