11472 条条目 · 106 个活跃源
2026年9月4日
04:00
arXiv cs.LG

从稀缺标签中学习:多视图超声心动图用于射血分数预测

针对标签稀缺,构建首个PLAX-EF数据集,MAE6.86%,多视图融合6.37%。

04:00
arXiv cs.LG

基于动态谱优化的硅上外延SrTiO3忆阻器氧空位动力学物理信息神经网络代理模型

级联物理信息神经网络与谱优化求解器模拟钛酸锶忆阻器氧空位输运,克服病态,拟合I-V滞回,支持参数反演。

04:00
arXiv cs.LG

你无法逃脱自己的激活:评估意识与多智能体监控

告知智能体激活受监控并反馈,探针仍准确,智能体继续串通,无法逃避自身激活。

04:00
arXiv cs.LG

Population-Calibrated Graph Screening at 835-Million-Address Scale, with Label-Free Transfer to New Chains

04:00
arXiv cs.LG

机器学习辅助定向进化五年回顾:进展与反思

五年来,机器学习未充分变革定向进化,因过度聚焦“最优蛋白”而忽视“在资源约束下获得足够蛋白”,如忽略DNA合成成本,致实用性受限。

04:00
arXiv cs.LG

基于差分隐私与拜占庭鲁棒聚合的联邦学习:面向银行与医疗安全训练的跨域框架

提出DP-BR-FedAvg框架,融合差分隐私与按坐标裁剪均值聚合,在恶意客户端下显著优于FedAvg,并量化隐私与鲁棒性的权衡代价。

04:00
arXiv cs.LG

联邦学习中的隐私泄露:车载边缘网络中面向惯性感知的基于梯度客户端身份推断与防御

车载边缘联邦学习中,服务器从梯度更新可近乎完美识别客户端身份;适度加噪使攻击近随机,精度损失低于5%。

04:00
arXiv cs.LG

什么是光滑性?

光滑性不是函数自身属性,而是函数连同群和生成集的共同属性:由生成集排序不可约表示,低频集中即光滑。

04:00
arXiv cs.LG

BASP:面向大语言模型训练的高效通信批感知序列并行

提出批感知序列并行(BASP),按微批大小分组GPU,缩小通信规模,训练提速最高1.31倍,精度内存不变。

04:00
arXiv cs.LG

原子热力学景观的生成式嵌套采样

提出生成式嵌套采样:条件归一化流替代马尔可夫更新。原子盘系能耗降两个量级,并揭示液体系综是流模型难点。

04:00
arXiv cs.LG

利用观测数据改进AI天气模型的降水预报

用IMERG数据微调AI天气模型,降水预报提升显著:CRPS改进19%,极端降水评分超57%,但极强降水仍逊于物理模型。

04:00
arXiv cs.LG

耦合张量-张量补全方法及其在药物重定位中的应用

提出耦合张量-张量补全(CTTC),以张量形式融入辅助信息并利用多模态隐藏关联,理论保证,优于现有方法预测药效。

04:00
arXiv cs.LG

CRAW:编解码器鲁棒的音频水印

提出CRAW水印框架,联合抗神经编解码与降噪,保持高音质,鲁棒性领先。

04:00
arXiv cs.LG

度量空间上具稀疏神经网络实现的相合Lipschitz回归闭式公式

提出闭式两阶段组合公式,从噪声观测重构Lipschitz函数,具最优恢复保证及稀疏神经网络实现。

04:00
arXiv cs.LG

基于占用率的分位数风险控制

提出基于占用率的分位数风险控制,以有限样本保证给出紧致风险界,降低保守性并收敛到最优。

04:00
arXiv cs.LG

可行但不安全:学习型无蜂窝通感一体化关联中的约束违反与报告信道攻击

高精度学习调度常违反约束;可行性投影可降低损失,但影响约束的虚假报告攻击难防,需跨接入点校验。

04:00
arXiv cs.LG

RACE-AIMC:面向边缘异构模拟存内加速器的选择性推理

针对模拟存内芯片误差,离线选出最佳单芯片并给出错误率上界,在线轻检后接受或回退。错误率低于10%、节能69%、精度不降。

2026年9月3日
04:00
arXiv cs.LG

WMLLM:基于先预测后行动世界建模的自进化优化代理

针对黑箱优化样本效率低,提出WMLLM自进化代理,先预测后行动,在分子多目标优化上达到最优。

04:00
arXiv cs.LG

DiDrive:一种用于自动驾驶安全离线强化学习的风险感知分层扩散框架

提出DiDrive框架,含风险感知分层扩散与3DICE优化,解决分布偏移与OOD问题,在CARLA复杂交通中成功率85%,平均奖励4295.68,优于基线。

04:00
arXiv cs.LG

基于三频段信道测量的太赫兹无线数据中心多层数字孪生

基于三频段测量的太赫兹无线数据中心多层数字孪生,AI信道孪生实现高效规划,覆盖率超90%

04:00
arXiv cs.LG

高效利用SciBERT进行WASP-2025共享任务中的受限上下文望远镜文献分类

提出基于SciBERT的望远镜文献自动分类方法,在512词元限制下获宏F1 0.89,位列WASP-2025榜首。

04:00
arXiv cs.LG

CliffRank:用于活性悬崖排名预测的双分支框架

融合回归与排序一致性训练,用偏好一致性对齐排序,在两类数据集上获最高平均斯皮尔曼相关。

04:00
arXiv cs.LG

自改进测试时智能综述:推理中反馈驱动的自适应、学习与扩展

提出反馈驱动的测试时智能(TTI)统一视角,关联自适应、学习与扩展,探索AI部署时的自我改进机制

04:00
arXiv cs.LG

提示空间元学习无法跨用户迁移:冻结LLM的负面结果

提示空间元学习不能跨用户迁移。实验无显著提升,因元目标崩溃,仅优化指令,未学到迁移适应。

04:00
arXiv cs.LG

住宅光伏-电池社区中强化学习与规则式点对点定价比较

光伏社区点对点交易中,无储能时规则定价优于强化学习;加入电池后强化学习节省更多,SDR定价更佳。

04:00
arXiv cs.LG

Sim2Signal:交通信号控制的仿真到现实基准

基准将仿真到现实差距分解为观测、动作、转移、奖励四类;直接迁移均下降,缓解效果因场景而异,最优方法是估计差距变化。

04:00
arXiv cs.LG

作为极值凸估计量的均值中位数及通向截尾预言机的非凸路径

提出非凸分块-Lp估计:凸类达不到截尾预言界,随p→0逼近并达到该界;目标函数良态,2+δ矩下呈次高斯偏差界。

04:00
arXiv cs.LG

面向可解释与政策感知的碳信用价格预测AI:新兴碳市场研究框架

提出EPA-CarbonNet融合市场与政策文本预测碳价,实测随机游走RMSE更优,但方向准确率58.6%领先,揭示可解释性与政策对齐不足。

04:00
arXiv cs.LG

D-FROST:基于最优传输的去中心化联邦提示调优,应对非独立同分布与不均衡数据

首次将提示调优引入去中心化联邦学习,提出最优传输算法D-FROST,融合邻居提示并证收敛,应对非IID与不均衡数据。

04:00
arXiv cs.LG

RecKAN:具有可学习递归多项式基的Kolmogorov-Arnold网络

提出RecKAN,以可学习的二阶递推定义多项式基,覆盖多类经典多项式,在图像、文本、时序等任务中优于现有KAN基线,且系数可解释。

04:00
arXiv cs.LG

OutageDiT:用于停电预测与情景模拟的生成式基础模型

该模型基于美国数据生成七日十五分钟停电轨迹,统一支持点预测、不确定量化与情景模拟,精度高且可零样本迁移。

04:00
arXiv cs.LG

CAT-Flow:面向流匹配的曲率自适应步长

提出免训练的曲率自适应步长算法,用于文生图流匹配,减少采样步数,同等质量最多降低40%。

04:00
arXiv cs.LG

干摩擦与静摩擦条件下开环控制的条件扩散模型研究

条件扩散模型用于干摩擦/静摩擦开环控制,生成时间连贯的控制序列,较随机采样和CEM降低终端误差与卡滞。

04:00
arXiv cs.LG

hLLM:生成式重排的单遍解码

提出hLLM,用匈牙利算法从隐状态中一步解码排序序号,实现O(1)前向传播,速度快64倍且性能持平。

04:00
arXiv cs.LG

人工神经网络中纤维化、压缩与对称性破缺的涌现

深度学习涌现覆盖对称性,可压缩至原大小17%且不损性能,受控破缺改善持续学习,将黑箱化为可解释图。

04:00
arXiv cs.LG

按需导入:学习何时及如何用外部知识增强EHR图

提出ReTA强化学习框架,按就诊动态选择软导入、硬导入或跳过知识增强,提升预测精度并控制成本。

04:00
arXiv cs.LG

具解析方差调度的生成扩散代理模型

以方差时间导数为加噪率,生成时间即标定输运时钟;无需中间数据即可复现湍流等离子体输运分布与峰度演化。

04:00
arXiv cs.LG

使用图神经网络优化基于启发式的比特币地址聚类

用图神经网络对比嵌入细化启发式聚类,发布数据集,通过层次聚类检测可疑合并。

04:00
arXiv cs.LG

OR-Transformer:将实时决策扩展至1000个品类

提出OR-Transformer,用置换等变Transformer和路径梯度训练,解决大规模随机补货,超MILP基线,提速400万倍,支持实时决策。

04:00
arXiv cs.LG

异步P2P八卦学习网络中知识蒸馏的收敛理论

提出异步点对点知识蒸馏收敛理论,将共识从参数空间移至输出空间,证明函数分歧收敛到可控邻域。

04:00
arXiv cs.LG

无需源数据类别重学:诊断类别遗忘中的遗忘现象

提出源无关重学审计,仅用已卸载模型即可恢复被遗忘类别,并给出可重学性评分。

04:00
arXiv cs.LG

FlashKAN:基于截断幂形式的B样条KAN

用截断幂形式实现B样条KAN,单核高效计算,稳定且可直接替代现有层。

04:00
arXiv cs.LG

结合在策略蒸馏与离策略GRPO:训练紧凑型指令跟随重排序模型

提出两阶段框架:先用离线强化学习优化教师,再让学生自采样排序以获得教师奖励式蒸馏,在分布迁移任务上表现最佳。

04:00
arXiv cs.LG

CAHR-Net:条件自适应磁滞重构网络,用于紧凑可解释的磁芯损耗建模

提出条件自适应磁滞重构网络,在物理作用点注入工况,以1874参数实现6.89%平均p95误差,优于黑盒模型且参数少48倍。

04:00
arXiv cs.LG

统一粒子滤波LSTM用于数据驱动流程模拟

提出统一PF-LSTM,维护加权递归状态假设以预测下一活动及逗留时间;在急诊数据上优于基线,尤其复杂部分可观测流程。

04:00
arXiv cs.LG

训练你所部署的:弥合低秩克隆蒸馏中的MLP可达性差距

低秩克隆蒸馏中部署权重多不可训练;提出“训练即部署”,两种实现恢复可达性,显著提升精度与数据效率。

04:00
arXiv cs.LG

CRISP:悬崖感知的输入自适应稀疏预填充与结构质量驱动路由

CRISP用结构代理C_struct替代JSD路由,以噪声底限的sink感知阈值抑制O(n)背景噪声,检索超越稠密注意力并获5.30倍加速。

04:00
arXiv cs.LG

连续混合态在语言模型中的坍缩动力学

LLM潜状态推理常失真:架构扭曲混合几何,训练放大效应,自回归反馈导致坍缩或收缩,多分量混合需高维修正。

04:00
arXiv cs.LG

DynG-Diff:面向概率时间序列预测的状态感知动态引导扩散框架

提出状态感知动态引导扩散框架,利用轻量策略网络自适应生成动态引导矩阵处理多变噪声,提升概率预测稳健性。

04:00
arXiv cs.LG

多行动、少决策:面向长时程LLM智能体的技能引导自适应动作分块

提出SPACE,从轨迹技能提炼分块边界训练变长动作策略,成功率最高提升31.3%,决策轮次最多减少78.9%。