11482 条条目 · 106 个活跃源
2026年9月3日
04:00
arXiv cs.LG

基于后验平均的源分布估计

用期望最大化迭代训练后验并平均拟合源分布,优于固定代理模型,在洛特卡-沃尔泰拉任务中显著提升。

04:00
arXiv cs.LG

神谕,我何时能学会?——链接预测模型间的预测收敛与互补性研究

不同链接预测模型捕获互补知识,组合可提升性能,但互补性会随模型增多饱和,部分查询仍无法解决。

04:00
arXiv cs.LG

可微电力市场出清用于梯度规划

将市场出清作为可微层,反向传播梯度优化数据中心负荷分配,基本复现最优,误差小;离散站点启停松弛导致决策滞后。

04:00
arXiv cs.LG

H3DNAS:硬件感知的ONNX原生3D点云模型压缩

无需源码,直接基于计算图做硬件感知剪枝与结构变异,压缩点云模型;在基准上实现大幅减参和推理加速,精度损失小。

04:00
arXiv cs.LG

UE5M3 FP4块缩放:实现稳定的语言模型预训练

采用配对E5M3的块缩放,无需RHT与BF16末层,简化FP4预训练,降低损失并提速。

04:00
arXiv cs.LG

悬崖:从第一个错误中学习过程奖励

提出悬崖法:用通用大模型定位推理首个错误,将轨迹分为正确前缀和错误后缀,赋正负优势,提升可验证奖励强化学习。

04:00
arXiv cs.LG

展开利奇晶格:面向2比特大语言模型权重的融合多壳解码与显存布局

提出利奇晶格多壳解码与显存布局,2比特权重的4B模型达87 token每秒,质量代价随规模减小。

04:00
arXiv cs.LG

私有计算空间:农业领域可信多集群联邦学习的实践经验

面向农业数据隐私,构建私有计算空间,融合联邦学习、差分隐私与可信执行环境,在保护隐私的同时提升模型精度。

04:00
arXiv cs.LG

边际期望收入:电商搜索广告中拍卖与固定价格列表的联合排序

将拍卖与一口价商品统一排序,提出边际eCPM目标,兼顾收入与用户体验,经A/B测试验证并已上线。

04:00
arXiv cs.LG

语音脑机接口的通用通信度量

提出OVMI作为语音BCI通用度量,跨条件比较系统,避免传统指标高估性能,优化词汇选择。

04:00
arXiv cs.LG

Multi-Agent Retrieval-Augmented Generation for Efficient Cloud Knowledge Base Search in Telecom SNOC Environment

04:00
arXiv cs.LG

图机器:以边实现更优预训练

图机器用边做稀疏动态路由,替换大量变换层预训练,每层仅检索几个键值,损失近似或有改善。

04:00
arXiv cs.LG

PRISM:面向自主交通系统主动安全的智能体多模型架构

PRISM将碰撞规避转为主动持续风险管理,免重训练跨数据集验证,动态识别轨迹与行人风险。

04:00
arXiv cs.LG

当文献数据误导材料发现中的人工智能

文献数据中的图文不符、单位混乱等噪声会误导人工智能,致百倍误差,需可追溯整理与验证。

04:00
arXiv cs.LG

Omega-N:可解释的结构节点描述符及其适用范围

十个可解释图特征,无需训练嵌入;节点分类多能打平或胜出,药物靶点预测优于中心性,但与嵌入法结合无增益。

04:00
arXiv cs.LG

无需越狱的上下文推断攻击

研究发现智能体在防泄露控制下仍可被推断隐藏上下文;无需越狱,跨已知/未知/检索上下文及灰/黑盒攻击均有效。

04:00
arXiv cs.LG

SocialBuddy:面向社交场景量身定制的搜索智能体

SocialBuddy:首个社交场景智能体搜索框架,构建大规模模拟环境,引入混合粒度优化,35B模型超越更大前沿模型。

04:00
arXiv cs.LG

感知正则化的图像超分辨率扩散模型

提出感知正则化扩散超分框架,引入感知损失提升训练收敛与图像细节恢复,改善感知质量。

04:00
arXiv cs.LG

延迟老虎机中的池化与漂移

延迟反馈下,若结果仅取决于状态,则代价由状态数而非动作数决定;所提算法利用状态聚合,遗憾显著低于动作级方法。

04:00
arXiv cs.LG

激发态化学的隐空间统一光滑哈密顿量

提出神经网络隐式哈密顿模型,统一描述基态与激发态,再现锥形交叉与贝里相位,在胸腺嘧啶和偶氮苯上验证准确。

04:00
arXiv cs.LG

推进面向私有平均聚合的多秘密密钥同态加密

提出轻量级多秘密密钥协议,无需集体公钥,消除大噪声,支持私有平均聚合,显著降低通信和在线成本。

04:00
arXiv cs.LG

聆听低语:针对微调TTS模型的黑盒成员推断攻击

首个针对微调语音合成模型的黑盒成员推断框架,实现说话人与录音两级攻击,暴露严重隐私泄露,最强场景接近完美。

04:00
arXiv cs.LG

选择优化器的强化学习

用强化学习把优化器选择建模为序贯决策,由策略决定所用优化器与时长;在未见问题上优于各单一优化器。

04:00
arXiv cs.LG

储层计算中动力学记忆的吸引盆几何与可靠回忆

记忆吸引盆呈章鱼状,触须区不可预测;提示驱动广义同步进入稳定头部,实现可靠回忆,有量化关系。

04:00
arXiv cs.LG

后验退火解释了线性和广义线性汤普森采样中的方差膨胀

提出基于分数后验的α-TS解释方差膨胀,得到遗憾界O(d^(3/2)√T log T)及依赖αd的下界。

04:00
arXiv cs.LG

无线接入点上的网络感知预测

AP上运行预测模型会挤占网络资源,实测比树莓派慢6.1-19.1倍,网络饱和下时延增76%、吞吐降7%。

04:00
arXiv cs.LG

随机森林引导的元胞自动机用于大规模野火蔓延建模

结合随机森林概率与元胞自动机局部蔓延,可提升大规模野火模拟精度。

04:00
arXiv cs.LG

原型引导的稀疏文献知识迁移用于电解液添加剂发现

提出原型引导分子智能ProtoMI,利用稀疏文献知识筛选电解液添加剂,显著提升高温锂电池循环性能。

04:00
arXiv cs.LG

HyperMC:随机梯度MCMC的多保真超参数调优

提出结合多臂老虎机与核斯坦因离差的调参框架,含稳健改进,理论保障,实验更优。

04:00
arXiv cs.LG

WeaveMark: 基于编码载荷扩展的鲁棒可扩展多比特LLM水印

基于编码载荷扩展的多比特水印,实现高精度、大容量与高质量,抗编辑攻击,长消息尤佳。

04:00
arXiv cs.LG

加密流量分类标签来源的系统化审计:基准测试中的标签溯源问题

审计14个加密流量基准,发现标签粗继承或过度过滤;严格特征下准确率上限0.56-0.76;丢弃连接反使准确率由0.44升至0.65。

04:00
arXiv cs.LG

量子MeanFlow:NISQ硬件上的单次生成采样

量子MeanFlow学习平均速度场,单步电路评估即可生成样本。图像质量虽低于多步量子流匹配,但优于单步法,且最佳N采样可降噪。

04:00
arXiv cs.LG

GenCAR:基于风险控制选择的生成式反事实对齐,用于分布外推荐

新方法以生成反事实对齐与风险控制选择,在分布外推荐中控制代理标签错误发现率,提升候选恢复。

04:00
arXiv cs.LG

从拓扑学习到图生成:统一视角

提出统一框架,将图拓扑学习与图生成视为同一生成过程的逆问题,综述方法,展望融合方向。

04:00
arXiv cs.LG

面向资源受限空间机器人的硬件加速实例分割与关键性分析

针对资源受限月球机器人,提出硬件加速分割与关键性分析,AVIS恢复近七成量化损失,关键性降31.7%。

04:00
arXiv cs.LG

PGM索引上的投毒攻击

提出针对PGM索引的投毒攻击,仅注入10%的键即可使段数增至120倍,并推导理论上界,揭示其优化目标的固有脆弱性。

04:00
arXiv cs.LG

基于习得可停止性价值的人形机器人安全停止

提出Safe-Stop框架:学习停止策略与互补可停性估计,二者均判定可行才停止,否则阻尼摔倒,任务无关免重训。

04:00
arXiv cs.LG

将ESG偏好融入强化学习投资组合优化

用多目标强化学习整合三家ESG评级,结合高斯过程偏好elicitation和LLM模拟,揭示区域背景显著影响投资权衡。

04:00
arXiv cs.LG

彩色高斯图模型最大似然阈值的计算方法

提出计算彩色高斯图模型最大似然阈值的方法,结合几何框架与拓扑数据分析,突破格罗布纳基计算瓶颈。

04:00
arXiv cs.LG

基于学习的坐标混淆点云重建攻击

点云选择性坐标加密易受学习重建攻击:加密全部X难重建,加密间隔X则被准确重建,安全性取决于粒度。

04:00
arXiv cs.LG

受限独立性下维度依赖的相关性间隙界

证明n=4成对独立相关性间隙为紧的4/3;最坏情形渐近达到e/(e-1),成对独立与相互独立一样严格。

04:00
arXiv cs.LG

推荐系统评估中的训练种子与模型选择稳定性

单随机种子会显著影响推荐系统评估稳定性;种子应视为评估协议一部分。

04:00
arXiv cs.LG

神经算子逼近强连续凸单调半群

用神经算子学习一步算符来逼近强连续凸单调半群,获得普适逼近与定量误差率,用于偏微分方程、随机控制等问题。

04:00
arXiv cs.LG

SPADE:网联车视角下的信号相位与配时攻击检测

介绍SPADE数据集,专为深度学习入侵检测设计,融合SPaT消息、车载摄像头及V2V数据,覆盖六类攻击,共约189万条带标签记录,支持C-V2X安全研究。

04:00
arXiv cs.LG

压缩感知中可调线性生成先验的全模型最优性

无噪声高斯压缩感知中,全维线性先验在可调线性族中期望重构误差最小,调低复杂度无益;可调优势源于非线性。

04:00
arXiv cs.LG

CodePoisonRAG:针对检索增强代码生成的知识投毒攻击

提出针对检索增强代码生成的定向知识投毒方法:构造含指定漏洞的代码并伪称安全,黑盒下攻击成功率超八成。

04:00
arXiv cs.LG

大批量训练中的动量:Polyak扩大临界批量,Nesterov提升数据效率

Polyak动量扩大临界批量,Nesterov动量通过抑制噪声提升大批量数据效率。