11612 条条目 · 106 个活跃源
2026年8月13日
04:00
arXiv cs.LG

通用机器人策略的最小数据适配

研究仅需一次演示加自主交互即可适配新任务,提出MiDAS方法,显著优于基线并泛化,首次实现单演示可靠策略适配。

04:00
arXiv cs.LG

面向入侵检测的决斗深度Q学习

提出奖励驱动的决斗Q学习模型进行入侵检测,在CIC-IDS2018上平均准确率达99.68%,并融合SHAP提升可解释性。

04:00
arXiv cs.LG

非均匀潜在几何下的谱图聚类

提出DBSPEC算法,从谱的深层特征向量恢复社区,支持非均匀潜在几何,对特征值分离不佳鲁棒。

04:00
arXiv cs.LG

跨语料库评估物联网固件中可泛化漏洞检测

提出IoTVulBench基准,跨语料库评估固件漏洞检测,分阶段课程学习与集成将MCC提升至0.73,显著优于现有方法。

04:00
arXiv cs.LG

Hamilton-Jacobi可达性分析中的前向轨迹引导

提出S2R求解器,基于物理信息神经网络,用前向轨迹引导采样,无需复杂训练,性能达或超现有方法。

04:00
arXiv cs.LG

CookVoice:风格可控的多模态人声生成统一框架

提出CookVoice统一框架,解构人声为内容、韵律、风格,支持多任务,质量相当,参数少且推理高效。

04:00
arXiv cs.LG

统一物理反向传播

基于伴随方法统一物理系统原位梯度计算条件,区分线性与非线性机制,并拓展至非互易系统。

04:00
arXiv cs.LG

群体结构健康监测中同步识别与去除EOV的潜变量模型

提出状态空间高斯过程潜变量模型,同步识别去除群体SHM中的未测EOV,提升损伤检测。

04:00
arXiv cs.LG

针对“凭空生成”的量子/经典示例预言机分离

在PAC学习中,相对预言机,存在量子样本能高效生成而经典样本不能的分布,支持量子样本优势。

04:00
arXiv cs.LG

智能港口中基于物联网的自主海上导航:课程引导的共享策略学习框架

针对物联网自主船舶在部分可观测密集交通下导航,提出课程引导共享策略强化学习,提升可靠性避碰,实现可扩展部署。

04:00
arXiv cs.LG

超越局部功率:面向受试者无关学习风格识别的功能连接分析

基于PLV功能连接EEG识别学习风格:VV维度70%,AR维度仅55.56%,需自适应特征变换应对个体差异。

04:00
arXiv cs.LG

Sinkhorn-Knopp算法的紧非渐近局部收敛性

首次给出SK非渐近局部收敛分析,匹配渐近界;证明连通条件下多项式时间,提出加速变体,稠密矩阵复杂度改进为O(n^{9/4}/√ε)。

04:00
arXiv cs.LG

采用稳定Barzilai-Borwein步长的自适应Bregman近端随机梯度

提出免线搜索的自适应布雷格曼近端随机梯度法,用稳定BB步长配合方差缩减,证明凸/非凸收敛,对初始步长不敏感。

04:00
arXiv cs.LG

确定性测度输运的平流Fisher-Rao几何

提出平流Fisher-Rao度量,用于测度路径优化,给出最优下降方向,三视角导出,实验验证密度拟合。

04:00
arXiv cs.LG

无需方差缩减和正则化的随机求根直接加速

提出双锚机制,无需方差缩减或正则化,恒定批量即可实现随机求根三次方反比复杂度;强单调情形近最优。

2026年8月12日
04:00
arXiv cs.LG

不确定性感知的集成深度随机神经网络分类方法

提出直觉模糊dRVFL与edRVFL框架,利用隶属度和非隶属度加权样本,区分干净、噪声与异常数据,提升鲁棒性。

04:00
arXiv cs.LG

Transformer几何观测站TGO-IV:发展拓扑观测台

TGO-IV用持续同调分析Transformer表示点云跨层演化,通过多种持久性拓扑工具揭示原始输入何时及如何变为任务相关特征。

04:00
arXiv cs.LG

CurveFP:用于语言模型的具有闭合乘积的有理基数对数数据类型

提出CurveFP闭合乘积对数类型:有理基数调范围,乘积化为符号与整数更新;7位推理优于FP8,精度近原生且路径更简。

04:00
arXiv cs.LG

基于层状联邦表示学习

提出层状联邦表示学习框架,用可学习限制映射对齐异构潜空间,无需共享全局空间,提升异构联邦分类精度与鲁棒性。

04:00
arXiv cs.LG

DOCSCHISEL:面向LLM智能体的自适应工具文档优化框架

提出自适应工具文档优化框架,通过分析失败轨迹增删改字段,显著提升智能体任务成功率。

04:00
arXiv cs.LG

FlowScout:从执行反馈到可靠的工具使用智能体工作流

提出FlowScout,从历史记录自动生成工具集成智能体工作流,以执行反馈调优,提升工具调用正确性和执行质量。

04:00
arXiv cs.LG

从垃圾信息中寻找信号:成对比较中联合学习奖励与工人可靠性

提出EM算法联合学习奖励与工人可靠性,利用Polya-Gamma变量简化优化,理论有保证,实验验证抗垃圾和对抗工人。

04:00
arXiv cs.LG

预测与健康管理中的物理信息机器学习:系统文献综述

212项研究综述:物理信息机器学习分四类,性能更优但偏重电池轴承,未来需通用与在线部署。

04:00
arXiv cs.LG

UserToolBench:工具使用大语言模型中用户画像隐藏的个性化决策基准

用户画像隐藏基准测试模型推断偏好、判断澄清、生成个性化工具调用;瓶颈仍为多工具协调、缺失约束推断与长期一致性。

04:00
arXiv cs.LG

检测机器学习工程岗位简历中的软技能

300份简历LLM验证13假设:软技能叙事披露为关键词3倍;资历提升领导力;软件工程师领导力仅同级一半。

04:00
arXiv cs.LG

安全强化学习的边界搜索策略梯度

提出边界搜索策略梯度法,无需对偶变量,沿边界提升奖励并收敛至约束边界,在安全导航任务中奖励更高。

04:00
arXiv cs.LG

程序性公平失败:RLHF中的偏好平均问题

RLHF偏好聚合导致少数群体被系统性忽视,PA-RLHF分离偏好模式,使对齐准确率从46.9%升至67.9%,公平差距从15.9降至9.6个百分点。

04:00
arXiv cs.LG

基于多动作会计日志的中小企业财务指导观测策略排序

提出CAR-PL方法,从多动作会计日志中为中小企业财务指导排序;实验显示不同KPI各有最优策略,结果稳健。

04:00
arXiv cs.LG

ChronoSSM:自回归状态空间模型中时间感知表征的训练

ChronoSSM联合建模事件与时间戳,使表征更含时间信息,且不损害内容生成质量。

04:00
arXiv cs.LG

评估协议决定结果:在TwoRoom上对LeWorldModel的独立复现

复现显示评估协议决定结果;四项未公开设置影响成败,预测精度不预示长程规划,批归一化虚增损失。

04:00
arXiv cs.LG

REATS:基于LLM推理的自适应时间序列预测集成学习

提出REATS,用LLM推理生成可解释集成权重,融合文本与数值特征,优于基线。

04:00
arXiv cs.LG

SeFoRA:具有异构客户端秩的草图聚合联邦低秩自适应

提出SeFoRA:草图聚合联邦低秩更新,解决异构秩与双线性失配,O(1/T)收敛,超越现有方法。

04:00
arXiv cs.LG

内在结构:机制可解释性的谱可辨识性

将字典学习置于可辨识性基础,用库普曼谱证得可从M个样本以M^{-1/2}速率恢复。谱是模型内在指纹,但非可读分解。

04:00
arXiv cs.LG

从预测到增量效应:大规模定向与推荐中的因果优化

提出因果优化框架:因果网络、贝叶斯波段与线性规划协同,LinkedIn测试长期价值提升7.2%

04:00
arXiv cs.LG

ELMER:探索与精炼的进化语言模型

提出进化语言模型,以自然语言描述策略并编译执行,通过变异强度条件微调提升搜索效率与行为校准。

04:00
arXiv cs.LG

Fisher8:通过输出层Fisher几何稳定神经异方差回归

提出Fisher8梯度修正,利用Fisher几何替代欧氏几何稳定异方差回归,无需额外超参数,提升似然-误差权衡与不确定性校准。

04:00
arXiv cs.LG

幂律图注意力:缩放点积注意力的精确推广及推理时的经验坍缩

提出PLGA精确推广缩放点积注意力;证明推理坍缩为常数算子广义SDPA,实测涨落低于1e-6。

04:00
arXiv cs.LG

STCAD:可扩展的AIS海量轨迹聚类与异常检测框架

针对TB级AIS数据,用BERT编码轨迹并聚类,基于重建损失检测异常,在数十亿条消息中实现正常与异常行为分离。

04:00
arXiv cs.LG

哈密顿神经网络在摆和开普勒动力学上的匹配积分器评估

匹配积分器评估显示:哈密顿神经网络在摆和开普勒系统中,能量漂移与轨迹误差远低于基线,长期物理一致性更好。

04:00
arXiv cs.LG

利用张量特征训练网络加速高维函数学习

利用张量特征训练网络加速高维函数学习:引入可更新特征层,结合随机张量分解将存储成本降低至少8个数量级,实现5-40维高效训练。

04:00
arXiv cs.LG

迈向大语言模型的人权基准测评:一项试点方法论

开发首个专家验证的场景化基准,评估大语言模型的人权法推理。试点显示模型分数差异大,证明基准有效。

04:00
arXiv cs.LG

CRHT:基于在线聚类采样的连续回归混合Transformer用于船舶轨迹预测

提出CRHT,采用在线聚类采样与CNN注意力混合架构,缓解地理偏差,1小时预测最优,兼顾精度与机动跟踪。

04:00
arXiv cs.LG

长视界工具使用智能体任务的高效强化学习

提出SINKFLEX-RL系统,结合环境接口、RL数据流与注意力设计,提升奖励并降低显存。

04:00
arXiv cs.LG

MERA:面向大规模智能体系统的模型进化与技能自适应路由

多周期适配:回放失败调用、技能蒸馏加微调,进化小模型,配合验证路由,模型通过率升至49.7%

04:00
arXiv cs.LG

可逆Logits变换:用于保精度的事后不确定性校准

提出可逆Logits变换:逐元素单调MLP校准,参数不随类别数增加,保持预测类别,校准更优。

04:00
arXiv cs.LG

Dreamer-SAC:潜在世界模型中的离策略学习实现样本高效自动驾驶

Dreamer-SAC融合潜在世界模型与离策略SAC,利用短轨迹与n步目标,在自动驾驶中超越基线且交互更少,短轨迹最佳,n步优于一步。

04:00
arXiv cs.LG

生成器引导的莱维驱动生成模型逆采样

提出基于马尔可夫生成器的莱维驱动生成模型逆采样法,分解扩散与小/大跳,神经网络仅估计大跳速率,高效可解释。

04:00
arXiv cs.LG

TideRL:基于就绪感知调度提升智能体强化学习有效吞吐

TideRL用就绪感知弹性调度,分三策略提升多轮智能体RL训练吞吐,最高提升5.6倍,减等待77.6%。

04:00
arXiv cs.LG

ELVAE:基于证据学习的变分自编码器,用于不确定性感知生成

ELVAE以证据学习建模隐变量不确定性,生成时利用不确定性区分锚点可靠性与扰动失效。

04:00
arXiv cs.LG

连续敏感属性下公平表示的联合分布途径

用联合分布差异评估公平表示独立性,HSIC实例闭式估计且等价于条件MMD积分,训练更快。