逆向项目反应理论:碎片化癌症药物反应矩阵中的稀疏稳健排序
提出逆向项目反应理论,将癌症类型与药物建模为耐药被试与项目,碎片化数据中比简单平均更稳健恢复排序。
Adam 距离自然梯度下降有多远?
Adam与自然梯度的几何偏离随场景变化,病态下显著,但凭动量平滑仍能有效优化。
FourierQK:滤波器形状、可容许性与泄漏-覆盖定律
QK注意力消融:抑制直流/奈奎斯特,段落尺度带宽最优,可容许滤波器更优;泄漏随覆盖增,适用双向注意力
在多实例强化学习系统中整合公平性与可解释性
研究融合RL-MIL、对抗去偏与偏好超网络的学生风险预测,发现偏好调节失效、模式坍塌,需梯度平衡与目标分离。
面向大语言模型的快速多项式超越函数
用3–4次BF16多项式替代sigmoid、tanh、SiLU,训练吞吐最多提升8%,损失几乎不变。
面向快速 FP4 预训练的格式感知融合
格式感知融合协同设计FP4量化布局,Llama-3 8B预训练达37.9K tokens/s/GPU。
“非常可能”等于“不确定”?大语言模型在语言不确定性量化上如何与人类分道扬镳
大语言模型为“可能”“很可能”等词赋予的不确定性概率与人类差异显著,新算法从输出中学习标记映射,揭示二者置信语义的系统性偏差。
SW-KAN:采用 Stieltjes-Wigert q-正交多项式的 Kolmogorov-Arnold 网络
提出SW-KAN,用Stieltjes-Wigert q-正交多项式与tanh指数映射解决域不匹配,提升资源受限下的逼近与分类效率。
单一掌握阈值并不适用于所有知识追踪模型
同一掌握阈值不适合所有知识追踪模型;六模型四数据集表明最佳阈值随模型和情境变化,需重校准与综合评估。
Nous:在源校准之前学习并认证记忆决策
学习与认证记忆决策可比源校准少用平方级数据,且证书在MiniGrid中验证有效。
分类器的四种生长方式,以及为何其中一种无法学习
四种生长方式中,最自然的分裂叶子加深深度之法因梯度恒为零而无法学习;小随机扰动即可修复。
面向多专家区间目标的不确定性感知学习
保留多专家区间,分离标签内不精确与专家间差异,匹配预测不确定性;海冰浓度MAE降31%
需要多少类别才够?少样本异常阈值的无分布认证极限
少样本异常阈值认证需大量独立类别,分布无关95%置信下界至少14–59类,证据不足只能失败关闭。
广义生物医学发现
提出广义生物医学发现基准与SCAN方法,通过预测抑制、惊异显著性和互补适应,提升新概念发现并保留已知知识。
99% 准确率的隐藏代价:电信客户流失基准的可信度审计
基准99%准确率暗藏四类缺陷:SMOTE泄漏虚高F1、冗余特征扭曲SHAP、校准失效、成本阈值被忽视。
基于关联规则算法的乳腺癌分类
乳腺癌高发,本文提出基于关联规则的加权分类算法,含规则生成、剪枝和预测,并在测试样本上验证。
对谁有用?样本价值仅相对于学习器而定义
固定子集、只换学习器:样本相对价值与选择边界随宽度、步幅和架构而变,故须按目标学习器评估选择策略。
不确定性感知的强化学习控制自适应三维建图
提出语义熵、曲率与纹理驱动的自适应体素细分,并以强化学习在内存预算下平衡精度与内存,优于基线。
恒定内存回忆:固定矩阵状态中的学习关联
固定循环矩阵状态记忆32对键值,准确率99.95%,填充至1798词元仍近乎完美,基线接近随机。
面向能源时间序列插补的裁剪感知目标条件化差分隐私扩散模型
面向能源时序缺失插补,提出裁剪感知目标条件化差分隐私扩散模型,以v预测和动态加权缓解梯度裁剪并提升效用。
基于正例-未标注数据的部分AUC最大化
提出无需负例、仅用正例和未标注数据最大化部分AUC,推导估计器训练分类器,十个真实数据集验证有效。
大语言贝叶斯不具重参数化不变性
LLB的证据下界加权依赖模型写法:重参数化不变性失效,权重差可达31.9倍并反转贝叶斯因子;需验证自生成重参数化。
无投影在线凸优化中的精确预言机-遗憾权衡
研究仅用线性优化预言机的无投影在线凸优化,给出维度无关的极小极大遗憾紧界、匹配算法及预算/光滑推广。
验证脉冲与逃离错误共识的代价
固定验证预算的时机与对象影响异步二元系统逃离错误共识;给出临界预算窗口,并用语言模型实验检验重置调度。
注意力流形:通过编辑学习到的B样条曲面引导或阻断语言模型
提出注意力流形:以可编辑B样条曲面调制注意力值,仅增0.3%参数,降困惑度、纠错并支持安全阻断。
多模态开放世界图学习验证与扩展
提出MOVE框架,联合多模态信息识别未知节点并验证候选类,选择性扩展类别空间,平均提升11.87%。
联邦多模态图基础模型中的感知与推理耦合
提出FedCORE,通过共享低维潜在状态联合优化编码器与GNN,将配对差距降低80.7%。
源自预设结构与学习物理的稳定且反事实鲁棒的物理世界模型
预设通用结构、学习特定物理,约九千参数实现百倍外推稳定与反事实鲁棒。
零假设才是难点:生成模型记忆化的精确检验
记忆化审计缺乏零假设,易致假阳性;提出置换与匹配对照的精确检验,可校准误报并准确认定复制图像。
金融AI的应急敞口路由:宕机风险与不可分决策的代价
提出金融AI故障条件路由,分析不可分决策风险;压力测试显示交换法降险,但错误对齐等限制分散。
铁路系统异常检测的深度学习:结构化综述
系统综述铁路异常检测的深度学习方法,提出统一分类体系与决策框架,涵盖数据挑战、评估与边缘部署。
网络流量分类中 Jev 的初步考察:准确率、处理时间与成本
Jev凭前10包数据分类QUIC应用,40示例将准确率提至28.4%,逊于树模型,但比GPT快且便宜。
超越对角状态空间模型:精确非阿贝尔群追踪、可解性障碍与几何物理流形
提出非交换状态空间模型,将状态转移提升至紧李群,实现精确非阿贝尔群追踪与几何流形保持,优于对角基线。
最弱一环:用最坏情况约束强化学习蒸馏大语言模型推理
提出最坏情况约束强化学习蒸馏大语言模型推理,约束教师对数似然每个前缀,兼顾准确与保真,提升严格推理成功率。
MoRA:基于路由器偏置学习与专家近似的MoE剪枝
提出MoRA框架:学习路由器偏置并加路由多样性正则以识别关键专家,再用专家近似补偿,剪枝后性能超越现有方法。
面向自动化决策门控:System One 决策模型与训练分类器及语言模型的基准对比
在匹配条件下,基准测试 System One 决策模型、分类器与语言模型用于自动决策门控,优劣取决于标签、任务与风险条件。
M²Weather:联合多站点与多变量天气预报基准
提出M²Weather基准,覆盖三级2809站点5个耦合变量,统一协议与即插即用适配器,证明联合建模站点-变量关系可提升预报精度。
面向高效生成模型对齐的流形约束初始噪声优化
提出ZeNOVA:流形约束超球Langevin、退火软值引导与MH跳变无梯度优化初始噪声对齐黑箱奖励。
面向MDP中稀疏策略部署的贝尔曼认证舍入
有限MDP中连续策略稀疏二值舍入:2d+2次贝尔曼求解构建包络,候选界与局部积分提升认证、收紧损失界
注意力头消融何时能支持因果主张?投影级混杂、地板效应与匹配对照
单头消融易受投影位置、地板效应与对照不当影响;需连续指标和匹配对照,修正排名才稳定,但因果结论仍须审慎。
FAER:面向语言模型后训练的可审计效用对齐轨迹回放
FAER提出可审计全轨迹回放框架,以学习者感知选择器对齐下游效用,在GSM8K上显著提升质量。
STCFormer:面向站点天气预测的动态聚类Transformer自适应时空建模
提出STCFormer,按时间片动态聚类站点,融合簇内局部与全局注意力,在八项天气预测任务中领先。
基于方差缩减序贯蒙特卡洛的特异性感知扩散引导
提出特异性感知扩散引导:以重叠目标设计分布,用方差缩减序贯蒙特卡洛采样,抑制负区域、减少模式偏移并稳定采样。
EvoGen-Harness:学习在何处以及如何演化图像生成外围框架
通过失败归因引导多职责协同演化,在冻结T2I生成器外围自适应,显著超越单维度方法。
MatrixReward:面向开放式生成的基于评分标准矩阵的奖励
提出MatrixReward,用rollout×rubric胜率矩阵构建奖励,以列离散度与相关性加权,借正负理想画像距离评分,四基准均分63.02,超基线约2.0%。
用于预测rTMS抑郁症治疗结局的时频图像融合技术
融合EEG时频图像并用轻量CNN预测rTMS抑郁疗效;严格受试者不交叉验证下性能崩溃。
OmniMed-Jev:通过 System One 校准 LVLM 置信度,实现可信的医学多模态决策。
OmniMed-Jev以候选集概率分布建模医学决策,替代生成式文本输出,显著降低校准与可靠性误差。
T2SPO:面向智能体强化学习的轨迹到步骤策略优化
T2SPO用成功轨迹估计剩余距离,生成步骤级辅助信用,在ALFWorld与WebShop上超越GRPO。
分叉:重放下的突然过拟合
重放导致分叉式突然过拟合:过编码n-gram令训练/验证损失在轮次边界骤分,低频上下文贡献最大。
基于模糊认知图的临床决策支持可解释合成医疗表格数据生成
提出模糊认知图框架生成可解释、保护隐私的合成医疗表格数据,保留因果依赖,CPU上性能与隐私优于基线。