11272 条条目 · 106 个活跃源
2026年10月2日
04:00
arXiv cs.LG

逆向项目反应理论:碎片化癌症药物反应矩阵中的稀疏稳健排序

提出逆向项目反应理论,将癌症类型与药物建模为耐药被试与项目,碎片化数据中比简单平均更稳健恢复排序。

04:00
arXiv cs.LG

Adam 距离自然梯度下降有多远?

Adam与自然梯度的几何偏离随场景变化,病态下显著,但凭动量平滑仍能有效优化。

04:00
arXiv cs.LG

FourierQK:滤波器形状、可容许性与泄漏-覆盖定律

QK注意力消融:抑制直流/奈奎斯特,段落尺度带宽最优,可容许滤波器更优;泄漏随覆盖增,适用双向注意力

04:00
arXiv cs.LG

在多实例强化学习系统中整合公平性与可解释性

研究融合RL-MIL、对抗去偏与偏好超网络的学生风险预测,发现偏好调节失效、模式坍塌,需梯度平衡与目标分离。

04:00
arXiv cs.LG

面向大语言模型的快速多项式超越函数

用3–4次BF16多项式替代sigmoid、tanh、SiLU,训练吞吐最多提升8%,损失几乎不变。

04:00
arXiv cs.LG

面向快速 FP4 预训练的格式感知融合

格式感知融合协同设计FP4量化布局,Llama-3 8B预训练达37.9K tokens/s/GPU。

04:00
arXiv cs.LG

“非常可能”等于“不确定”?大语言模型在语言不确定性量化上如何与人类分道扬镳

大语言模型为“可能”“很可能”等词赋予的不确定性概率与人类差异显著,新算法从输出中学习标记映射,揭示二者置信语义的系统性偏差。

04:00
arXiv cs.LG

SW-KAN:采用 Stieltjes-Wigert q-正交多项式的 Kolmogorov-Arnold 网络

提出SW-KAN,用Stieltjes-Wigert q-正交多项式与tanh指数映射解决域不匹配,提升资源受限下的逼近与分类效率。

04:00
arXiv cs.LG

单一掌握阈值并不适用于所有知识追踪模型

同一掌握阈值不适合所有知识追踪模型;六模型四数据集表明最佳阈值随模型和情境变化,需重校准与综合评估。

04:00
arXiv cs.LG

Nous:在源校准之前学习并认证记忆决策

学习与认证记忆决策可比源校准少用平方级数据,且证书在MiniGrid中验证有效。

04:00
arXiv cs.LG

分类器的四种生长方式,以及为何其中一种无法学习

四种生长方式中,最自然的分裂叶子加深深度之法因梯度恒为零而无法学习;小随机扰动即可修复。

04:00
arXiv cs.LG

面向多专家区间目标的不确定性感知学习

保留多专家区间,分离标签内不精确与专家间差异,匹配预测不确定性;海冰浓度MAE降31%

04:00
arXiv cs.LG

需要多少类别才够?少样本异常阈值的无分布认证极限

少样本异常阈值认证需大量独立类别,分布无关95%置信下界至少14–59类,证据不足只能失败关闭。

04:00
arXiv cs.LG

广义生物医学发现

提出广义生物医学发现基准与SCAN方法,通过预测抑制、惊异显著性和互补适应,提升新概念发现并保留已知知识。

04:00
arXiv cs.LG

99% 准确率的隐藏代价:电信客户流失基准的可信度审计

基准99%准确率暗藏四类缺陷:SMOTE泄漏虚高F1、冗余特征扭曲SHAP、校准失效、成本阈值被忽视。

04:00
arXiv cs.LG

基于关联规则算法的乳腺癌分类

乳腺癌高发,本文提出基于关联规则的加权分类算法,含规则生成、剪枝和预测,并在测试样本上验证。

04:00
arXiv cs.LG

对谁有用?样本价值仅相对于学习器而定义

固定子集、只换学习器:样本相对价值与选择边界随宽度、步幅和架构而变,故须按目标学习器评估选择策略。

04:00
arXiv cs.LG

不确定性感知的强化学习控制自适应三维建图

提出语义熵、曲率与纹理驱动的自适应体素细分,并以强化学习在内存预算下平衡精度与内存,优于基线。

04:00
arXiv cs.LG

恒定内存回忆:固定矩阵状态中的学习关联

固定循环矩阵状态记忆32对键值,准确率99.95%,填充至1798词元仍近乎完美,基线接近随机。

04:00
arXiv cs.LG

面向能源时间序列插补的裁剪感知目标条件化差分隐私扩散模型

面向能源时序缺失插补,提出裁剪感知目标条件化差分隐私扩散模型,以v预测和动态加权缓解梯度裁剪并提升效用。

04:00
arXiv cs.LG

基于正例-未标注数据的部分AUC最大化

提出无需负例、仅用正例和未标注数据最大化部分AUC,推导估计器训练分类器,十个真实数据集验证有效。

04:00
arXiv cs.LG

大语言贝叶斯不具重参数化不变性

LLB的证据下界加权依赖模型写法:重参数化不变性失效,权重差可达31.9倍并反转贝叶斯因子;需验证自生成重参数化。

04:00
arXiv cs.LG

无投影在线凸优化中的精确预言机-遗憾权衡

研究仅用线性优化预言机的无投影在线凸优化,给出维度无关的极小极大遗憾紧界、匹配算法及预算/光滑推广。

04:00
arXiv cs.LG

验证脉冲与逃离错误共识的代价

固定验证预算的时机与对象影响异步二元系统逃离错误共识;给出临界预算窗口,并用语言模型实验检验重置调度。

04:00
arXiv cs.LG

注意力流形:通过编辑学习到的B样条曲面引导或阻断语言模型

提出注意力流形:以可编辑B样条曲面调制注意力值,仅增0.3%参数,降困惑度、纠错并支持安全阻断。

04:00
arXiv cs.LG

多模态开放世界图学习验证与扩展

提出MOVE框架,联合多模态信息识别未知节点并验证候选类,选择性扩展类别空间,平均提升11.87%。

04:00
arXiv cs.LG

联邦多模态图基础模型中的感知与推理耦合

提出FedCORE,通过共享低维潜在状态联合优化编码器与GNN,将配对差距降低80.7%。

04:00
arXiv cs.LG

源自预设结构与学习物理的稳定且反事实鲁棒的物理世界模型

预设通用结构、学习特定物理,约九千参数实现百倍外推稳定与反事实鲁棒。

04:00
arXiv cs.LG

零假设才是难点:生成模型记忆化的精确检验

记忆化审计缺乏零假设,易致假阳性;提出置换与匹配对照的精确检验,可校准误报并准确认定复制图像。

04:00
arXiv cs.LG

金融AI的应急敞口路由:宕机风险与不可分决策的代价

提出金融AI故障条件路由,分析不可分决策风险;压力测试显示交换法降险,但错误对齐等限制分散。

04:00
arXiv cs.LG

铁路系统异常检测的深度学习:结构化综述

系统综述铁路异常检测的深度学习方法,提出统一分类体系与决策框架,涵盖数据挑战、评估与边缘部署。

04:00
arXiv cs.LG

网络流量分类中 Jev 的初步考察:准确率、处理时间与成本

Jev凭前10包数据分类QUIC应用,40示例将准确率提至28.4%,逊于树模型,但比GPT快且便宜。

04:00
arXiv cs.LG

超越对角状态空间模型:精确非阿贝尔群追踪、可解性障碍与几何物理流形

提出非交换状态空间模型,将状态转移提升至紧李群,实现精确非阿贝尔群追踪与几何流形保持,优于对角基线。

04:00
arXiv cs.LG

最弱一环:用最坏情况约束强化学习蒸馏大语言模型推理

提出最坏情况约束强化学习蒸馏大语言模型推理,约束教师对数似然每个前缀,兼顾准确与保真,提升严格推理成功率。

04:00
arXiv cs.LG

MoRA:基于路由器偏置学习与专家近似的MoE剪枝

提出MoRA框架:学习路由器偏置并加路由多样性正则以识别关键专家,再用专家近似补偿,剪枝后性能超越现有方法。

04:00
arXiv cs.LG

面向自动化决策门控:System One 决策模型与训练分类器及语言模型的基准对比

在匹配条件下,基准测试 System One 决策模型、分类器与语言模型用于自动决策门控,优劣取决于标签、任务与风险条件。

04:00
arXiv cs.LG

M²Weather:联合多站点与多变量天气预报基准

提出M²Weather基准,覆盖三级2809站点5个耦合变量,统一协议与即插即用适配器,证明联合建模站点-变量关系可提升预报精度。

04:00
arXiv cs.LG

面向高效生成模型对齐的流形约束初始噪声优化

提出ZeNOVA:流形约束超球Langevin、退火软值引导与MH跳变无梯度优化初始噪声对齐黑箱奖励。

04:00
arXiv cs.LG

面向MDP中稀疏策略部署的贝尔曼认证舍入

有限MDP中连续策略稀疏二值舍入:2d+2次贝尔曼求解构建包络,候选界与局部积分提升认证、收紧损失界

04:00
arXiv cs.LG

注意力头消融何时能支持因果主张?投影级混杂、地板效应与匹配对照

单头消融易受投影位置、地板效应与对照不当影响;需连续指标和匹配对照,修正排名才稳定,但因果结论仍须审慎。

04:00
arXiv cs.LG

FAER:面向语言模型后训练的可审计效用对齐轨迹回放

FAER提出可审计全轨迹回放框架,以学习者感知选择器对齐下游效用,在GSM8K上显著提升质量。

04:00
arXiv cs.LG

STCFormer:面向站点天气预测的动态聚类Transformer自适应时空建模

提出STCFormer,按时间片动态聚类站点,融合簇内局部与全局注意力,在八项天气预测任务中领先。

04:00
arXiv cs.LG

基于方差缩减序贯蒙特卡洛的特异性感知扩散引导

提出特异性感知扩散引导:以重叠目标设计分布,用方差缩减序贯蒙特卡洛采样,抑制负区域、减少模式偏移并稳定采样。

04:00
arXiv cs.LG

EvoGen-Harness:学习在何处以及如何演化图像生成外围框架

通过失败归因引导多职责协同演化,在冻结T2I生成器外围自适应,显著超越单维度方法。

04:00
arXiv cs.LG

MatrixReward:面向开放式生成的基于评分标准矩阵的奖励

提出MatrixReward,用rollout×rubric胜率矩阵构建奖励,以列离散度与相关性加权,借正负理想画像距离评分,四基准均分63.02,超基线约2.0%。

04:00
arXiv cs.LG

用于预测rTMS抑郁症治疗结局的时频图像融合技术

融合EEG时频图像并用轻量CNN预测rTMS抑郁疗效;严格受试者不交叉验证下性能崩溃。

04:00
arXiv cs.LG

OmniMed-Jev:通过 System One 校准 LVLM 置信度,实现可信的医学多模态决策。

OmniMed-Jev以候选集概率分布建模医学决策,替代生成式文本输出,显著降低校准与可靠性误差。

04:00
arXiv cs.LG

T2SPO:面向智能体强化学习的轨迹到步骤策略优化

T2SPO用成功轨迹估计剩余距离,生成步骤级辅助信用,在ALFWorld与WebShop上超越GRPO。

04:00
arXiv cs.LG

分叉:重放下的突然过拟合

重放导致分叉式突然过拟合:过编码n-gram令训练/验证损失在轮次边界骤分,低频上下文贡献最大。

04:00
arXiv cs.LG

基于模糊认知图的临床决策支持可解释合成医疗表格数据生成

提出模糊认知图框架生成可解释、保护隐私的合成医疗表格数据,保留因果依赖,CPU上性能与隐私优于基线。

← 往后1 / 226往前 →