11852 条条目 · 106 个活跃源
2026年6月30日
04:00
arXiv cs.LG

随机动态系统中Adam算法的分析

针对时变非平稳系统,建立Adam算法理论,推导误差界并指导超参数选择。

04:00
arXiv cs.LG

传染张量:多智能体大语言模型中输出-分布耦合的测量框架及审计其主张

提出传染张量及耦合放大因子CAF,通过仿真和实验验证图像条件超线性效应,提供可迁移消融协议。

04:00
arXiv cs.LG

中文标题

集成机器学习和层次方差分解的学生成绩预测与元认知校准管线

04:00
arXiv cs.LG

可机器学习集合

定义基于布尔自编码器的可学习集,实验展示罗夏图案与野生集的可学习性及演化方法。

04:00
arXiv cs.LG

基于最优面的定价运动:非平稳对抗MDP的法扇形几何

提出法扇形几何,定义面穿越价格,将动态遗憾分解为有代价运动与选择误差,区分无害与有害非平稳性。

04:00
arXiv cs.LG

基于图神经网络的增材制造短纤维热塑性塑料静态响应代理建模

提出GNN-LSTM代理模型,精准预测短纤维热塑性塑料力学行为,计算成本降低两个数量级以上。

04:00
arXiv cs.LG

锐度与复杂性共同解释泛化的能力有多强?

通过帕累托分析发现,函数空间定义的锐度与复杂性扩大了解释范围,但仍未构成完整泛化理论。

04:00
arXiv cs.LG

MOSAIC:通过层次语义对齐编排协作知识追踪

提出MOSAIC框架,利用LLM生成动态嵌入与层次预测提示,引入跨粒度一致性目标,在多个数据集上实现AUC提升3.4%、准确率提升2.5%的SOTA结果。

04:00
arXiv cs.LG

考虑修改的价值学习:缓解强化学习中的奖励黑客行为

MCVL通过预测并过滤过渡,在保证安全的同时缓解奖励黑客,持续优化目标。

04:00
arXiv cs.LG

基于核Fisher判别分析的树集成分类器:KFDA森林

提出KFDA森林集成分类器,通过bootstrap和随机子集划分,利用核Fisher判别提升非线性分类精度。

04:00
arXiv cs.LG

统计上不可区分,操作上截然不同:表格基础模型的正式障碍

表格基础模型无法推理规则约束的数据;仅靠值统计的分类器准确率仅0.5,需操作规则才能突破可识别性障碍。

04:00
arXiv cs.LG

RGLD:表格异常检测的随机全局-局部密度估计法

RGLD结合全局随机特征密度与局部邻居分支,AUROC第一,速度快50-580倍。

04:00
arXiv cs.LG

保形风险控制何时能为LLM输出提供认证?界限、不可能性与结构化生成的自适应

证明保形风险控制认证LLM结构化输出的界限与不可行性,提出三步部署:检查可行性、选界限、缓解漂移。

04:00
arXiv cs.LG

DiLaServe:面向扩散语言模型的高SLO达成服务

DiLaServe通过置信度阈值与动态重配置,提升SLO达成率56.6%,降低延迟46%,准确率损失小于1%。

04:00
arXiv cs.LG

一种新型潜在类别攻击及其通过类子空间正交化的检测方法

提出潜在类别攻击,将未知类样本误标为已知类,并基于类子空间正交化实现无需训练集的检测与可视化。

04:00
arXiv cs.LG

基于可扩展似然流映射的少步玻尔兹曼生成器

SCALLOP通过无Hutchinson的似然蒸馏,实现快速低方差玻尔兹曼生成,推理速度比基线快10倍。

04:00
arXiv cs.LG

BaRA:面向参数高效微调的贝叶斯自适应秩分配

BaRA通过贝叶斯自适应秩分配动态激活稀疏因子,实现数据驱动容量控制,提升性能与校准。

04:00
arXiv cs.LG

Token影响如何随距离衰减:训练语言模型的格林函数视角

自回归Transformer中token影响随距离呈幂律衰减(指数约0.8-0.9),为训练后特性。

04:00
arXiv cs.LG

关于大语言模型训练中学习率缩放的非线性研究

最优学习率在大规模下出现上凸曲率,改用有效学习率和数据外推可消除,非线性源于权重范数收敛慢。

04:00
arXiv cs.LG

GLACIER:将质谱预测重新构想为目标检测问题

GLACIER用单阶段Transformer检测分子图碎片,速度提升8倍,Top-1准确率从64%升至70%。

04:00
arXiv cs.LG

语言模型潜轨迹中的不变推理方向

发现潜轨迹中不变推理方向,提出TILR方法,利用低秩子空间提升推理一致性与稳定性。

04:00
arXiv cs.LG

Symbolic Mechanistic Data Attribution: Tracing Training Influence to Learned Behavioral Policies

04:00
arXiv cs.LG

死方向调节器:深度网络的规范等变预条件

DDC使优化器保持规范等变,防止对称漂移,提升模型泛化与可测量性。

04:00
arXiv cs.LG

KrishokChat:面向孟加拉语农业咨询的基于引用的数据集与基准

首个孟加拉语农业指令微调数据集,含14.5万问答对,构建于290知识节点,评估表明适合检索增强生成。

04:00
arXiv cs.LG

BrainRiem: 基于黎曼原型学习的无源跨站点脑网络诊断

提出无源域适应框架BrainRiem,利用黎曼原型学习,在脑网络诊断中超越现有方法,原型具有生物可解释性。

04:00
arXiv cs.LG

评估意识的表征深度随模型规模在开源语言模型中转移

开源语言模型中,评估意识的可恢复层随规模从后层移至前层,白盒探针信号强于黑盒行为表达。

04:00
arXiv cs.LG

带弃权的贝叶斯最优臂识别:从多项式到指数的相变

弃权使贝叶斯最优臂识别错误概率从多项式衰减转为指数衰减,提出最优算法PGWS。

04:00
arXiv cs.LG

Blackknife:针对异构图神经网络的硬标签查询受限黑盒攻击

提出Blackknife框架,仅用局部结构和少量硬标签查询实现高效黑盒攻击,揭示HGNN脆弱性。

04:00
arXiv cs.LG

面向LLM解码的深度探索

DEX算法通过并行探索多个候选深度,在保证无损解码同时降低每步计算成本,性能优于现有方法。

04:00
arXiv cs.LG

多块扩散语言模型

提出多块扩散语言模型MBD-LMs,通过多块教师强制与块缓冲机制,实现并行解码,显著提升解码速度与准确率。

04:00
arXiv cs.LG

评估表格基础模型的数据先验

构建统一接口比较不同数据先验,发现其影响下游性能但数据相似性解释有限。

04:00
arXiv cs.LG

分组相对策略优化的策略梯度基础:信用分配、梯度稀疏性与秩坍缩

GRPO用分组均值奖励作基线,导致每个token优势相同,梯度有效秩约2,存在信用分配瓶颈。

04:00
arXiv cs.LG

一种面向在线多人多机器人团队协作的线性匹配赌博机方法

提出LinMatch算法,将乐观匹配转化为线性规划,获紧致最优遗憾界$\tilde{\Theta}(d\sqrt{MKT})$。

04:00
arXiv cs.LG

科学发现的样本复杂度:组合函数树的PAC可学习性

证明组合函数树的Rademacher复杂度受深度和Lipschitz常数控制,风险界为O(L^d/√n),实验验证泛化差距与复杂度项正相关。

04:00
arXiv cs.LG

自适应块扩散:解决扩散语言模型中的训练-推理不匹配

提出自适应块扩散方法,通过优化配置分布解决训练-推理不匹配,保证任意推理策略最优。

04:00
arXiv cs.LG

超越轨迹匹配:边缘分布对齐的重流方法

针对重流蒸馏轨迹匹配局限性,提出边缘分布对齐正则化器,提升少步生成质量。

04:00
arXiv cs.LG

高风险AI的确定性决策:兼具RAG可部署性与机器学习准确性的零退出流水线

零样本大语言模型存在干预偏差导致高误报率,监督策略学习消除偏差,实现近零校准误差与高效决策。

04:00
arXiv cs.LG

SP-CACW: 面向自私个性化学习的收敛感知客户端加权

提出SP-CACW框架,通过收敛感知加权最小化目标客户端风险,有效避免负迁移,在多个数据集上表现优异。

04:00
arXiv cs.LG

带预算约束的歧视性拍卖出价学习

提出基于DAG最短路径的算法,在预算约束下实现次线性遗憾,时空复杂度与上下文数无关。

04:00
arXiv cs.LG

从低轨卫星互联网延迟测量中解读区域级特征

基于Starlink RTT数据提出层次分析框架,识别区域延迟特征,最小RTT为关键指标,短期准确率83%,长期泛化不足。

04:00
arXiv cs.LG

非线性混合模型驱动的子空间聚类

从非线性混合模型泰勒展开推导出线性子空间聚类模型,揭示了平滑阶与子空间维度等关系并验证了界限估计。

04:00
arXiv cs.LG

一周价格翻倍:进口孤立市场农产品波动预测

利用供应链与季节特征的机器学习模型,精准预测进口孤立市场农产品价格波动,为极端市场波动提供早期预警。

04:00
arXiv cs.LG

PCGD:物理引导的条件图扩散用于TCAD器件模拟

PCGD物理引导图扩散框架,迭代施加物理约束,场误差0.835%,PDE残差降三个数量级,支持高效迁移。

04:00
arXiv cs.LG

多类分类中的结构化适当损失几何:理论与受控实证评估

研究三种多类目标函数,推导理论边界,实验显示在噪声标签下略有提升但无普遍优势。

04:00
arXiv cs.LG

AMR:面向多模态多语言说话人识别的自适应模态路由

提出自适应模态路由动态融合音频与面部特征,采用模态感知训练,在POLY-SIM 2026上平均准确率99.07%,超基线32.73%。

04:00
arXiv cs.LG

自适应金融Transformer与机制门控注意力用于股票收益预测

提出AFT模型,利用市场机制和门控网络动态调整注意力,降低复杂度15.2%,提升参数效率。

04:00
arXiv cs.LG

不透明科学模型事后解释的可靠性、忠实性及其局限

事后解释的可靠性和忠实性无法保证模型揭示现象的真实结构,仅能支持候选假设,需外部佐证。

04:00
arXiv cs.LG

肌电图在石头剪刀布游戏中的有意识与自发手势时间性识别

研究发现,肌电图可在手势可见前800ms检测,有意识手势识别准确率63.4%,对手EMG识别达65%。

04:00
arXiv cs.LG

干预流匹配:基于速度场雅可比正则化的前瞻性剂量-响应预测

IFM通过雅可比正则化实现前瞻性剂量-响应预测,平衡观测精度与生理正确干预响应。

04:00
arXiv cs.LG

基于大语言模型代理的可解释逆设计金属有机框架

LLM4MOF利用语言模型代理自主迭代,提出可解释设计假设并在模拟中验证,400次评估内聚焦高性能MOF并生成新结构,成本低,优于随机搜索和遗传算法。