11602 条条目 · 106 个活跃源
2026年8月14日
04:00
arXiv cs.LG

干预感知的临床世界模型用于心脏病学术后结果预测

提出干预感知临床世界模型,利用非规则术后事件预测房颤消融复发,AUROC达0.756,无需随访MRI。

04:00
arXiv cs.LG

DARTree:采用自回归草稿树的投机扩散解码

无需训练将自回归校正头从链扩展至树批量构建候选树并剪枝取得最高接受长度实现9.73倍无损加速

04:00
arXiv cs.LG

稀疏正交回归技术:用于方程发现、逼近与积分的谱框架

提出SORT谱框架,用L1正则回归从噪声稀疏数据学正交基展开,用于方程发现、逼近与积分,鲁棒性优于库方法。

04:00
arXiv cs.LG

掩码扩散的数据几何:通过去掩码增长复杂度实现认证最优调度

提出去掩码增长复杂度刻画掩码扩散数据几何,控制KL误差,实现认证最优调度及维度相关加速。

04:00
arXiv cs.LG

Intern-S2-Preview:科学智能体基础模型

科学智能体基础模型,支持多模态理解、推理与长时程任务,在科学基准上表现领先。

04:00
arXiv cs.LG

RoutePack:面向MoE强化学习的专家放置与注意力感知数据打包

RoutePack协同专家重路由与数据打包,优化MoE强化学习负载均衡,吞吐量提升8.85%和14.89%。

04:00
arXiv cs.LG

基于规则的推理是可学习的过程

将推理定义为可学习的规则过程,解决定义模糊,确保评估有效性与可验证性,推动可信自主推理。

04:00
arXiv cs.LG

在线概率预测的防御性提升

提出防御性提升算法,同时获得在线梯度提升与弱到强提升的预测保证,仅需一个弱学习器,高效且具强自适应性。

04:00
arXiv cs.LG

部分可观测条件下循环与脉冲智能体的预测性稳态组织

循环/脉冲智能体在能量受限觅食任务中形成预测性稳态组织,内部状态可解码低能量并预测行为成败。

04:00
arXiv cs.LG

多标签Jaccard度量的指数凸校准维数

Jaccard多标签校准维数为指数级:精确凸代理需指数维,固定遗憾容差只需多项式维。

04:00
arXiv cs.LG

大型语言模型是可靠的审阅者吗?金融文档错误检测基准

首个金融错误检测基准FinED-Bench覆盖900余份2025年文档,测试显示现有LLM仍难胜任,监督微调可显著提升弱模型表现。

04:00
arXiv cs.LG

EU-ETS under attack? 欧盟碳交易体系受冲击?碳价抑制对电力行业脱碳的影响

研究表明,部分抑制碳价信号短期降成本,但长期推高排放、削弱绿电投资,最终成本仍由消费者承担。

04:00
arXiv cs.LG

监管批准不足:FDA批准医疗器械的可信AI报告存在缺口

分析FDA 2021-2025年AI器械报告,发现可信AI报告不均,可解释性与可追溯性缺口大,需标准化报告支撑独立评估。

04:00
arXiv cs.LG

谱裁剪能否在低秩适配中实现更好的学习与更少的遗忘?

提出谱裁剪低秩适配法,聚焦必要更新,抑制奇异值增长,减少遗忘,提升性能并保留预训练知识。

04:00
arXiv cs.LG

尼泊尔语自动语音识别中多语言预训练模型的比较分析

六种多语言预训练模型对比尼泊尔语音识别:最优两模型词错率相当,CTC快近三十倍,大规模提升鲁棒性。

04:00
arXiv cs.LG

大型语言模型复杂图推理的统一多维基准

提出五阶段半自动框架构建复杂图推理基准,含202项任务,揭示多维度模型推理局限。

04:00
arXiv cs.LG

皮层朝向选择性的贝叶斯-马尔可夫神经形态模型:计算重实现与定量模拟研究

重实现贝叶斯-马尔可夫朝向选择性模型,模拟验证其锐利朝向选择性及抗噪鲁棒性,并实现脉冲神经元版本。

04:00
arXiv cs.LG

CAS:一种用于局部和全局可解释人工智能的因果归因分数

提出因果归因分数CAS,用因果夏普利分配干预效应,区分预测与因果异质性,优于传统SHAP。

04:00
arXiv cs.LG

跨不同特征集的黑盒知识迁移

提出黑盒到异构特征空间的知识迁移方法,分解可迁移与不可迁移成分,用两步神经网络估计,降低预测风险。

04:00
arXiv cs.LG

评估分辨率混淆早期视觉皮层模型-脑RSA中的学习规则比较

评估分辨率影响学习规则比较:低分辨率下未训练网络媲美反向传播;升高后差距扩大,源于图像细节而非池化。

04:00
arXiv cs.LG

AI驱动的多场景利率预测:银行资产管理的概念验证

结合计量与人工智能实现多视角利率预测,已在欧洲大行验证,助力资产负债管理与风险决策。

04:00
arXiv cs.LG

自动化安全决策的非退化风险认证:一种决策契约理论及ATT&CK对齐告警分流的实例验证

决策契约理论用错误守恒、容量诊断与非退化认证排除全弃权;LLM告警分流九成配置达标,正确自动化八成三。

04:00
arXiv cs.LG

自闭症社交适应运动特征分析:面向高效人本系统

通过舞蹈模仿运动数据,发现社交情境调节变异指数可区分自闭症与常人,准确率79.2%,为医学与人机系统提供生物标志物。

04:00
arXiv cs.LG

半正定矩阵的快速长度平方采样

提出半正定矩阵长度平方采样的拒绝采样算法,期望O(n)时间最优,无需列范数假设;可用于F范数估计与鲁棒低秩近似。

04:00
arXiv cs.LG

SSPO:面向神经组合优化的结构感知相似度加权偏好优化

提出结构感知相似度加权偏好优化(SSPO),用相异度加权基线解决梯度极化与基线冗余,超越现有方法,已部署京东。

04:00
arXiv cs.LG

设计面向决策就绪的ITSM智能的AI管道

提出社会技术AI管道,结合LLM标准化与聚类生成多层主题,评估显示四项决策支持指标均超4.0,强调ITSM分析是信息系统问题。

04:00
arXiv cs.LG

DYSANOS:生成式动态平滑无套利非参数期权曲面

提出首个无静态套利的生成式期权曲面模型,生成未来多年价格路径,用AR(1)基线并在S&P数据上验证。

04:00
arXiv cs.LG

DiG基准:游戏中的发现

发布DiG-bench,含70个未知规则的游戏,分七档难度,考验AI通过实验发现新知识的能力,最高档挑战顶尖模型。

04:00
arXiv cs.LG

死文本还是约束条款?衡量并恢复黑盒LLM对话中的约束影响

对话中撤销的约束仍会复发;通过账本、探针与修复梯,实现逐条测量、提前预测和预算内修复。

04:00
arXiv cs.LG

驾驶即音乐:车载情境感知生成式音频

基于行车影像与遥测数据,实时生成与驾驶场景匹配的音乐,兼顾安全与低延迟,实现个性化车载音频体验。

04:00
arXiv cs.LG

何为同行?私募市场中的估值锚定相似性

提出估值锚定相似度学习(梯度提升树)用于私募市场,以叶子共现衡量公司相似性,提升估值任务且可解释。

04:00
arXiv cs.LG

评估AlphaEarth基础嵌入在野火易发性制图中的表现

AEF嵌入可高精度重建野火变量,模型ROC-AUC超0.92,近邻区域迁移性优于传统物理变量,为野火制图提供可扩展方案。

04:00
arXiv cs.LG

额外可分性:干扰受控的残差流探测用于基准污染检测

残差流探针过量可分性检测基准污染:层级匹配安慰剂与置换零分布控制假阳性;真实模型需校正,四个数据臂均无污染。

04:00
arXiv cs.LG

SteerBench-Work:行动边界处的智能体决策基准

提出行动边界基准,含106个职场场景。模型误拦率28.1%,误放率1.0%,证据已清除风险的最难。

04:00
arXiv cs.LG

非凸等式约束优化的一种局部线性收敛算法

非凸等式约束下,梯度-特征步算法在强二阶驻点附近局部线性收敛,用于渐进采样可降低样本复杂度。

2026年8月13日
04:00
arXiv cs.LG

FarSky:面向生成式小时级太阳预报的任务感知潜空间耦合

提出FarSky生成式框架,用潜空间耦合学习任务感知天空图像表征,概率预报优于现有方法,技能提升11个百分点,爬坡事件F1超60%。

04:00
arXiv cs.LG

为何AI检测在学术诚信中失效

AI检测无法区分编辑与全文生成,诚实编辑误判率高,规避工具使检出率低于4%,故不能作为单一证据。

04:00
arXiv cs.LG

Basin:Rust 中高效且可扩展的数值优化库

Basin 是 Rust 数值优化库,提供统一的问题定义与求解接口,内置丰富求解器并原生支持约束。

04:00
arXiv cs.LG

用于分布式CNC刀具磨损预测的联邦学习

联邦学习可在不共享数据下协作训练,实现分布式数控机床刀具磨损预测,性能接近集中式且优于本地模型。

04:00
arXiv cs.LG

终端对称性作为决策资源:面向随时验证构建的状态级精化

提出终端对称性决策框架,以传输-精化-验证分解,状态级刷新提升随时验证构建性能并降低验证成本。

04:00
arXiv cs.LG

市场信息感知的门控LoRA基础模型用于可迁移的日前电价预测

提出基于Chronos-2的门控LoRA框架,利用多源市场信息接口实现跨市场迁移,在四个省级市场MAE/RMSE分别降低6.24%/7.99%,为数据稀缺市场提供有效路径。

04:00
arXiv cs.LG

基于Forma的完整财务报表长期预测

提出Forma模型,以元组读取报表,预测未来1-20季度78科目,优于现有方法,满足会计恒等式,支持情景分析。

04:00
arXiv cs.LG

无权重微调:通过对数空间传输实现大模型个性化

提出免训练解码方法WFT,用对数空间修正模拟监督微调,无需改权重,平均性能最优,计算量不足7%。

04:00
arXiv cs.LG

热带商业建筑暖通空调控制的情境质量-多样性进化强化学习

提出情境质量-多样性进化强化学习控制器,用于热带商业建筑暖通控制,优于ASHRAE指南36基准。

04:00
arXiv cs.LG

现实世界强化学习中离线超参数选择的动力学模型

首次在工业水处理厂用校准模型离线选超参数,生成真实滚动预测,揭示敏感趋势,证明现实世界RL部署可行。

04:00
arXiv cs.LG

三个Token迫使非负核注意力特征秩指数增长

三词元时,非负核注意力头需2^{Ω(m)}维特征,而稠密softmax仅需m维,差距指数级。

04:00
arXiv cs.LG

生命周期最优分词:词表大小作为随部署场景变化的基础设施参数

词表最优大小随部署场景变化:B=1时32k,B≥64时524k;质量差异<2%,生命周期最优可比训练最优大16倍。

04:00
arXiv cs.LG

PAIR:RLVR中面向自适应展开分配的成对感知包含重加权

PAIR以成对感知包含重加权校正自适应采样偏差,在RLVR中约省一半计算量并提升准确率(+1.2/+1.4)。

04:00
arXiv cs.LG

Unmasking Toxic Mimicry in Medical Offline Reinforcement Learning for ICU Sepsis Management via Counterfactual Clinical Audits

04:00
arXiv cs.LG

面向区域供热系统数据的多元离群值检测方法探究

测试多种多元离群值检测法,结合环境温度,最终采用PCA、孤立森林与霍特林三者一致的集成方法。