11852 条条目 · 106 个活跃源
2026年7月17日
04:00
arXiv cs.LG

回合制随机博弈中具有可达性目标的PAC学习:基于期望条件距离的去中心化隐私方法

首次实现回合制随机博弈中可达性目标的去中心化隐私PAC学习,引入期望条件距离,证得多项式样本复杂度。

04:00
arXiv cs.LG

Grad2Fair:一种无需人口统计信息的梯度驱动图公平性方法

提出Grad2Fair方法,利用梯度分布隐含人口信息直接去偏,无需人口统计,实现稳定公平。

04:00
arXiv cs.LG

MESHA:机制强制的序贯减半算法用于战略性线性老虎机

MESHA算法通过均匀采样和格里姆触发器条件,在战略性线性老虎机中有效识别最佳臂,优于现有方法。

04:00
arXiv cs.LG

特征加权聚类中的反事实解释

VoICE框架通过加权Voronoi投影为特征加权聚类生成有效且低成本的行动反事实解释。

04:00
arXiv cs.LG

ChronoQG:面向时间表达能力强且跳数受限的时间知识图谱问题生成基准

提出ChronoQG框架,构建时间知识图谱问题生成基准,含16,011个问题,揭示现有方法难以保持时间约束。

04:00
arXiv cs.LG

GAttNHP:面向时序知识图谱外推推理的组注意力神经霍克斯过程

提出GAttNHP,用自注意力、语义分组和分位数回归解决TKG预测的长期依赖、链间互作用与重尾分布问题。

04:00
arXiv cs.LG

评估认知不确定性:超越分布外检测与主动学习

以遗憾评估认知不确定性,证明最优选择器为不确定性凸组合,揭示代理任务排名与实际效用偏差。

04:00
arXiv cs.LG

非对称峰值感知损失:面向峰值关键时间序列预测

提出非对称峰值感知损失(APAL),加重低估惩罚并强化峰值区域训练权重,提升时间序列峰值预测精度。

04:00
arXiv cs.LG

上下文赌博机中离线策略评估的核加权重要性采样

提出核加权重要性采样,渐近一致,在行为策略误设等复杂条件下优于强基线。

04:00
arXiv cs.LG

一个用于动力系统零样本重建的最小可解释架构

提出最小两参数模型DynaBase,实现动力系统零样本重建,简单高效,可解析优化,揭示最小机制并调和文献分歧。

04:00
arXiv cs.LG

看似无害的数据,潜藏的意识形态:微调大语言模型中的意识形态泛化

微调看似无害数据会引发大模型跨领域意识形态偏移,并可放大至极端输出。

04:00
arXiv cs.LG

基于分类器诱导训练集划分的二分类器最优组合分析

本文通过真值表划分数据,给出二分类器线性组合凸风险最小点存在条件及损失函数解析权重公式,并引入φ-前沿评估稳定性。

04:00
arXiv cs.LG

随机对数几率缩放:防御黑盒分数型对抗样本攻击的深度神经网络

提出随机对数几率缩放(RLS)防御,通过伪造分数迷惑攻击者,显著降低黑盒攻击成功率且保持模型精度。

04:00
arXiv cs.LG

干扰和潜在混杂下的序列因果推断

研究干扰和潜在混杂下顺序观测的因果推断,提出MPLE方法,理论证明一致性,实验验证疫苗对COVID-19死亡率效果。

04:00
arXiv cs.LG

LongStraw:固定GPU预算下超越200万tokens的长上下文强化学习

LongStraw在固定GPU预算下实现百万token强化学习后训练,通过无梯度共享提示与分支重放,8个GPU达2.1M位置,峰值内存仅增0.21GB。

04:00
arXiv cs.LG

多轴Max@K强化学习实现文本到图像生成中的代表性多样性

提出多轴max@K强化学习目标,通过分组取最大值提高文本到图像生成的模式覆盖,公平性提升0.23-0.36。

04:00
arXiv cs.LG

多模态语义感知对比学习用于3D医学成像中的假阴性缓解

提出MseaCL框架,利用报告语义相似性缓解假阴性,预训练提升3D医学图像下游任务性能,脑肿瘤分类AUC提升22.6%。

04:00
arXiv cs.LG

广义神经分布回归

提出GNDR框架,深度融合神经网络与概率分布,两步估计提取Fisher信息,实现不确定性量化。

04:00
arXiv cs.LG

长期时间视野马尔可夫决策过程中的协变量平衡评估

探讨离线强化学习中的协变量平衡诊断,发现现有研究存在偏倚风险或指标不足,需改进方法。

04:00
arXiv cs.LG

工程应用中非线性动力学稀疏辨识导论

SINDy方法通过稀疏回归从少量数据恢复可解释控制方程,克服神经网络需大数据且难解释的局限,适用于工程系统辨识。

04:00
arXiv cs.LG

RTS平滑器引导的物理神经微分模型学习

用RTS平滑器引导混合神经物理模型,从部分观测中学习缺失微分方程,提升状态重建与长期预测。

04:00
arXiv cs.LG

无穷小非组合性草图学习

提出LINCS框架,以切提升修复非组合性,将机器学习形式化为INC煤代数不动点搜索。

04:00
arXiv cs.LG

BadWAM:当世界-动作模型想象正确但行动错误

BadWAM框架揭示世界-动作模型易受视觉扰动攻击,想象正确但行动错误,显著降低任务成功率。

04:00
arXiv cs.LG

可变低秩草图:无需重训练的推荐方法

提出KP-tree可变草图,在线更新嵌入,无需重训练,RMSE优于ALS,新用户毫秒级推荐。

04:00
arXiv cs.LG

数据驱动的成批替换调度

提出数据驱动算法学习最优成批替换间隔,实现对数遗憾并匹配下界,分析了寿命分布未知下的策略结构。

04:00
arXiv cs.LG

从区块链活动解读市场情绪:一种数据驱动的情绪分类器

结合链上与社交数据,用XGBoost实现情绪分类(F1≈0.84),并以SHAP解释特征贡献。

04:00
arXiv cs.LG

中文标题:ITGPT:一种基于Transformer的架构,用于生成《Dance Dance Revolution》和《In the Groove》谱面

中文摘要:提出ITGPT Transformer架构自动生成节奏游戏谱面,显著提升生成准确率并降低计算成本。

04:00
arXiv cs.LG

Human AI Construction of Bayesian Networks for Operational Decision Support -- A Virtual Survey Approach

04:00
arXiv cs.LG

验证通过的世界模型为何仍会失败:LLM合成代码世界模型中游戏适当性与预测准确性之较量

LLM合成世界模型因遗漏关键规则致游戏失败,即使预测准确率高,存在验证与正确性差距。

04:00
arXiv cs.LG

深度学习因果检索优化:Pinterest 高效电商分发

Pinterest 用深度因果学习减少85%电商触发器,同时提升会话和保存指标,实现高效检索。

04:00
arXiv cs.LG

通过知识图谱接地增强小语言模型推理能力

知识图谱接地可提升小模型推理性能,但受提取瓶颈与顺序推理错误累积限制。

04:00
arXiv cs.LG

基于空间基因图谱的单细胞生物学视觉基础模型

scVision将细胞转为连续图像,用最优输运布局基因,零样本准确注释细胞类型并恢复基因程序,保留表达量与基因关系。

04:00
arXiv cs.LG

迈向可靠的AI辅助模拟设计:用于SAR ADC生成的模板约束LLM代理

ATLAS框架利用专家知识约束LLM,生成通过仿真验证的SAR ADC,实现可靠模拟设计。

04:00
arXiv cs.LG

基于因果模型与层次聚类的公立学校教育绩效分析

通过层次聚类识别学校类型,再因果分析特征与绩效关系,发现不同类型学校绩效差异显著。

04:00
arXiv cs.LG

托马斯正回路猜想的平面情形

本文利用动力系统工具和平面分析,给出了平面系统中托马斯正回路猜想成立的条件。

04:00
arXiv cs.LG

量化有自信?代码生成中量化的实证研究

研究六种量化方法对代码模型的影响,发现AQLM性能最佳,QuIP#退化最大,提示复杂度影响鲁棒性。

04:00
arXiv cs.LG

调控预算:例子胜过旋钮

例子能触及旋钮无法达到的调控范围,预算由训练数据决定,通过示例集实现全部调控。

04:00
arXiv cs.LG

随机参数噪声并未使精确ReLU验证变得容易

随机参数噪声下精确ReLU验证仍无多项式期望时间完备验证器。

04:00
arXiv cs.LG

DiMaS:用于引导视觉-语言-动作模型的分布匹配

提出DiMaS分布匹配引导策略,解决VLA模型线性引导失效问题,实现有效行为控制。

04:00
arXiv cs.LG

面向复杂亥姆霍兹波场的算子信息高斯过程:从合成基准到在体脑弹性成像

将算子信息高斯过程扩展至复亥姆霍兹问题,多尺度先验重建脑弹性成像旋度场相关性0.77,但后验不确定性未校准。

04:00
arXiv cs.LG

力从不嫌迟:通过反应式力注入加速VLA后训练

LIFT框架通过反应式力注入与在线校正,加速VLA后训练,在接触任务上超越纯视觉方法。

04:00
arXiv cs.LG

基于卷积神经网络的超导量子比特电荷跳变实时检测

提出基于DCCNN的实时电荷跳变检测器,部署FPGA延迟6.19μs,检测效率0.843,无需调参,支持量子纠错与粒子探测。

04:00
arXiv cs.LG

NexForge:通过需求优先合成扩展可执行智能体任务

NexForge需求优先框架,自动生成多样化可执行任务,大幅提升智能体模型性能,开源SOTA。

04:00
arXiv cs.LG

NeuralChaos:平方可积可料过程的最优适应逼近

NeuralChaos以神经算子高效逼近平方可积可料过程,兼具稠密性与最优逼近率,优于有限维神经SDE模型。

04:00
arXiv cs.LG

稀疏高维随机几何图中的谱集中与恢复

证明了稀疏高维随机几何图的谱集中界,实现潜在几何恢复,并首次获得高斯混合块模型的精确恢复。

04:00
arXiv cs.LG

决策需要不确定性量化【讲义】

不确定性表示必须匹配决策目标与知识,并保证实际效用。

04:00
arXiv cs.LG

CatalogAgent:监督中介自学习系统,赋能GenAI模型上下文工程

CatalogAgent通过监督代理调解冲突与记忆总结,实现生成器和评估器自我改进,性能分别提升15.24%和13.98%。

04:00
arXiv cs.LG

ConFlow:基于流匹配的约束引导运动生成

ConFlow将约束直接融入训练,用条件高斯过程替代标准分布,利用负监督降低碰撞率,提升轨迹质量。

04:00
arXiv cs.LG

基于自组织神经细胞自动机的无序超材料单次生成式设计

提出单模板训练的神经细胞自动机框架,生成多样无序微结构,实现多尺度机械隐身设计,数据高效且泛化。

04:00
arXiv cs.LG

ExaGEMM:基于关联寄存器内计算的低比特GEMM的CPU驱动ML推理探索框架

ExaGEMM框架通过寄存器内计算和协同设计,高效支持低比特GEMM,延迟提升13倍,适用于混合精度LLM。