11412 条条目 · 106 个活跃源
2026年9月15日
04:00
arXiv cs.LG

语义纤维与交叉格拉姆干扰:过完备表示中的安全漂移演算

跨语言安全漂移可由交叉格拉姆线性刻画;校准暴露区分三类可修复性,预测相关达0.964。

04:00
arXiv cs.LG

利用无冲突梯度解决 PINNs 与 PIKANs 的失效模式

提出 Norm-PCGrad 缓解域分解梯度冲突,结合 SPINN 降低计算成本,提升 2D/3D 及 PIKAN 精度。

04:00
arXiv cs.LG

AgentKV:面向智能体LLM的阶段感知KV驱逐

AgentKV按阶段维护查询缓冲,对缓存键统一打分驱逐,任务分平均提升5.5,吞吐最高1.80倍。

04:00
arXiv cs.LG

插值并非不变性:变换审计中配对数量并不等同于覆盖度

配对计数会高估变换审计覆盖;需用有效秩、图谱间隙等评估,并提出留一轨道更新与部署门控。

04:00
arXiv cs.LG

SeqMaestro:通过可解释机器学习从核苷酸序列走向生物学假设

SeqMaestro 连接核苷酸序列与可解释模型,支持无代码分析,从序列中提出生物学假设。

04:00
arXiv cs.LG

基于图注意力驱动的分层强化学习的云工作流调度

用图注意力与分层强化学习调度云工作流,任务-容器智能体交替训练,提升容器利用率并降低能耗。

04:00
arXiv cs.LG

面向统计数据集融合的深度玻尔兹曼机跨块条件化

提出观测块多预测,使深度玻尔兹曼机可用于数据融合;增益主要来自跨块条件化,生成预训练贡献甚微且不衰减。

04:00
arXiv cs.LG

马尔可夫α-势博弈中分散式学习的高概率纳什遗憾:分幕式与全在线异步算法及其在马尔可夫拥塞博弈中的应用

提出KL投影自然策略梯度,实现马尔可夫α-势博弈分幕式与全在线异步分散学习的高概率纳什遗憾界,用于拥塞博弈。

2026年9月14日
04:00
arXiv cs.LG

三思而后行:面向大语言模型智能体的行动前验证

LLM智能体行动前做廉价确定性校验,可将静默失败转为可恢复,拒答优于猜测,两基准验证。

04:00
arXiv cs.LG

用于鲁棒且公平的临床联邦学习的拓扑帕累托控制Fed-Equilibrium框架

提出Fed-Equilibrium,以余弦相似度滤波加拓扑帕累托控制,破解临床联邦学习的知识支配,兼顾鲁棒与公平。

04:00
arXiv cs.LG

物理信息保形预测:将PDE一致性嵌入神经算子的无分布不确定性量化

将PDE残差嵌入保形预测,实现无分布覆盖保证与空间自适应区间;揭示FNO平移等变性局限。

04:00
arXiv cs.LG

空间作为干预不变量:面向分层城市与具身空间智能的跨模态预测几何

将空间定义为干预不变量,提出跨模态预测几何,统一空间认知、分层城市与具身智能。

04:00
arXiv cs.LG

通过组分相互作用的计算建模解码混合物感知

构建仿生深度学习框架,融合多受体与多分子响应曲线,实现混合物气味识别,准确率达92.2%。

04:00
arXiv cs.LG

FINESSE:基于智能体的多模态金融事件序列模拟器与基准数据集

提出基于智能体的多模态金融事件序列模拟器及基准数据集,支持余额、欺诈、漏付和下一事件预测。

04:00
arXiv cs.LG

使用量化分析工具实现高效的AI模型部署

基于ONNX的量化分析工具提供逐层敏感度分析与分布可视化,指导精度取舍,提升量化精度与部署效率。

04:00
arXiv cs.LG

面向隐私保护的端侧语言模型压力预测:移动健康场景下的多模态评估

评估端侧语言模型的多模态压力预测:轻量模型低延迟、资源可预测,传感器特征略优于自评,兼具潜力与局限。

04:00
arXiv cs.LG

网络化系统中基于扰动时间序列的物理信息结构推断的基本动力学单元

提出基本动力学单元:符号三元交互模式压缩交互假设空间、指导干预,借物理信息神经常微分方程联合推断结构与轨迹。

04:00
arXiv cs.LG

性能、效率与崩溃——代码大语言模型离线后训练的优势与挑战

代码大模型离线RL后训练无需在线采样,数小时提升零样本代码生成,0.5B–7B均增益但幅度因家族异。

04:00
arXiv cs.LG

DCRA:面向鲁棒时间序列学习的扩散条件表示对齐

DCRA将扩散前向过程用作结构化噪声调度,通过特征级一致性对齐跨噪声层表示,提升脑电癫痫检测等任务的鲁棒性。

04:00
arXiv cs.LG

基于LLM引导概念集成的移动传感数据可解释预测

提出概念集成Transformer,借大模型生成概念异常监督,实现小样本移动感知的精准可解释预测。

04:00
arXiv cs.LG

我们能信任LLM评委吗:能力相关偏差与用于偏差校准的多评委集成研究

研究LLM绝对评分中的能力相关偏差,提出无标签校准加权多数投票,集成多评委纠正宽松并提升可靠性。

04:00
arXiv cs.LG

可扩展的离散到连续信道模拟:面向压缩与隐私

固定样本数的离散到连续信道模拟,权衡压缩率与样本数,用于VQ-VAE压缩与差分隐私均值估计。

04:00
arXiv cs.LG

固定状态,长程延伸:恒定大小缓存为大规模块扩散带来什么

块扩散用O(1)状态空间缓存:256k上下文下较注意力延迟低4.3倍、内存省11倍,吞吐与长度外推显著更优。

04:00
arXiv cs.LG

QTrans:一种用于情感分类的量子Transformer

QTrans以参数化量子电路构建QKV与量子测量注意力,实现量子-经典混合情感分类,三数据集超越经典基线。

04:00
arXiv cs.LG

反演自触发控制:面向稀疏拒绝服务攻击的对抗强化学习

反演自触发控制,以对抗强化学习学习最稀疏DoS攻击,实验可100%使各防御者失稳并优于基线。

04:00
arXiv cs.LG

面向可靠铁路转向架响应预测的多保真TDNN与物理信息残差学习

融合多保真仿真与滚振台实测,用时延神经网络和物理信息残差学习校正转向架响应,385 km/h工况平均决定系数达0.8197。

04:00
arXiv cs.LG

认证式安全策展:安全离线强化学习的无分布保证

认证式过滤-克隆流程:用片段比较价值筛选整条轨迹,校准阈值给出无分布安全保证,再行为克隆,11/15个DSRL任务满足成本预算。

04:00
arXiv cs.LG

强化学习用于综合征提取

以强化学习与重要性采样搜索综合征提取方案,逻辑错误率较前沿方法平均降低26%~72%,最高达97.8%。

04:00
arXiv cs.LG

带裁剪与加性噪声的随机梯度方法的几乎必然收敛性分析

证明带裁剪与加性高斯噪声的SGD在标准步长下几乎必然收敛,并推广至动量变体,涵盖凸与非凸情形。

04:00
arXiv cs.LG

文本到图像扩散模型中的概念遗忘认证

提出概念遗忘认证框架,为扩散模型残余泄漏提供统计保证,揭示现有攻击评估低估风险。

04:00
arXiv cs.LG

PLSP(事前阈限空间画像):从检测转向预测的OOD——面向机器学习模型可靠性的前瞻性方法

提出事前OOD预测框架PLSP,含数据集无关的CREDS指标、可信度曲线与热图,提升模型鲁棒性。

04:00
arXiv cs.LG

面向算法追索的解释驱动主动特征获取

提出解释驱动的主动特征获取,按单位成本解释价值选特征,以更少特征实现可靠算法追索。

04:00
arXiv cs.LG

通过控制Radon-Nikodym导数实现基于分数的离群点生成

提出基于对数似然分布的测度论离群点定义,通过控制Radon-Nikodym导数重加权扩散得分,无需重训生成可控低似然样本。

04:00
arXiv cs.LG

基于GIS衍生建成环境特征估算行人流量:一个机器学习框架

利用GIS建成环境特征,机器学习预测101个路口晚高峰行人流量,RMSE较GLM降12-19%。

04:00
arXiv cs.LG

用GRACE预测碰撞截面积:基于早期融合的几何残差加合物条件化

GRACE以早期融合将加合物条件注入预训练几何编码器并引入残差学习,在多种数据划分上误差最低,优于物理方法。

04:00
arXiv cs.LG

患者报告调查数据提升阿片类药物使用障碍预测

在26.7万阿片暴露人群中,问卷数据结合电子病历可提升阿片使用障碍预测,PR-AUC最高提高0.05。

04:00
arXiv cs.LG

GUIDE:生成式效用推断与决策引擎

提出GUIDE架构,融合贝叶斯自适应采样与符号学习推断多维用户偏好,提升冷启动推荐表现。

04:00
arXiv cs.LG

各向同性曲率下联合切空间优化的秩高效LoRA

揭示LoRA有效秩受优化器影响,提出ISO-LoRA以切空间谱下降联合优化因子,提升秩利用与性能。

04:00
arXiv cs.LG

CRFCAN:一种用于亚太赫兹OFDM系统信道与相位噪声联合估计的复值跨域残差网络

提出复值跨域残差注意力网络,端到端联合估计亚太赫兹OFDM信道与相位噪声,性能优越且泛化性强。

04:00
arXiv cs.LG

ParaRecover:面向并行工具调用智能体的过程级错误定位与恢复基准

提出ParaRecover过程级基准,含14类错误与SDE评分,揭示大模型并行工具调用恢复缺陷

04:00
arXiv cs.LG

面向基于模型强化学习的摊销低秩适应

摊销超网络测试时生成LoRA适配器,少量交互即可适配世界模型,优于梯度适应与上下文学习。

04:00
arXiv cs.LG

任务所需的秩:群复合任务上训练的矩阵记忆的因果秩定律

矩阵记忆在群复合任务中自发采用任务所需的秩,大小等于群最小忠实表示维度,并提供因果证据。

04:00
arXiv cs.LG

EHR基础模型中面向临床推理的患者轨迹强化学习

提出患者轨迹强化学习微调框架,以时间感知奖励提升EHR基础模型临床推理,优于基线并促进小模型与跨任务迁移。

04:00
arXiv cs.LG

肿瘤异质性下基于强化学习的自适应化疗控制

异质性肿瘤DRL化疗:TD3减瘤更优,DQN剂量更一致,存在疗效-一致性权衡,需部分可观测扩展。

04:00
arXiv cs.LG

基于决策流的采样:免训练提取大语言模型中更优的潜在推理路径

免训练免数据的决策流采样通过构建推理树并全局回溯评估,挖掘基座模型潜在推理路径,效果超越GRPO。

04:00
arXiv cs.LG

模拟不投入学习的学生以评估基于大语言模型的辅导系统

提出DAS2框架,模拟五种学习投入状态,用于大模型辅导系统部署前评估;绝对表现因状态而异,排名稳定。

04:00
arXiv cs.LG

一次性幅度剪枝与计算自适应提前退出的理论保证

证明一次性幅度剪枝集中性定理,提前退出误差随计算差距幂律衰减,并刻画深度网络中剪枝失真的累积与精度权衡。

04:00
arXiv cs.LG

FRIST:fMRI表征信息引导的共享空间训练提升仅EEG的单指脑机接口解码

提出FRIST,以fMRI空间信息引导EEG训练,仅用EEG即可提升单指脑机接口解码。

04:00
arXiv cs.LG

中文标题:当相连不意味着相似:刻画 SNAP-KG 在流式实体集成中的同质性边界

中文摘要:SNAP-KG 需至少一个同质性视图;在异质图上聚类质量骤降,多视图融合亦失效,表明同质性假设为整类方法共有前提。

04:00
arXiv cs.LG

基于GRF多类步态障碍分类的三维数字孪生可视化

融合GRF与COP信号分类步态障碍,准确率99%/90%,以ε-LRP与3D可视化增强可解释性。