11542 条条目 · 106 个活跃源
2026年8月24日
04:00
arXiv cs.LG

存储于优化器状态,由后续训练赋予价值:潜意识特质迁移的因果解释

优化器状态传播源扰动,后续训练决定其行为价值,构成潜意识特质迁移的两阶段机制。

04:00
arXiv cs.LG

共享物理响应恢复神经算子库中的隐藏排名

利用共享物理响应,无需真值即可排序神经算子库,恢复绝大多数偏好与最优检查点,且优于最佳候选。

04:00
arXiv cs.LG

BF1:面向高效长上下文Transformer的因果二进稀疏注意力改造

BF1稀疏注意力:局部+全局+对数块,32K加速10.91倍,改造Qwen3,困惑度最优

04:00
arXiv cs.LG

客户目标定位中特征选择的互信息与敏感性分析:比较研究

比较互信息与数据敏感性分析在银行电话营销特征选择中的效果:低误报率时敏感性分析更优,高误报率时互信息略优且降低成本,两者均有效。

04:00
arXiv cs.LG

牛奶中红外光谱的元聚类识别出与泌乳早期负能量平衡相关的奶牛群体

对40.7万条奶牛中红外光谱进行元聚类,得到五个与泌乳早期负能量平衡严重程度相关的奶牛群体。

04:00
arXiv cs.LG

当Graph-JEPA学错对象:诊断与修复类别条件坍缩

图JEPA在指标健康时学到无用表征:方差分配失衡。修复后指标饱和,但目标可约简,评估需谨慎。

04:00
arXiv cs.LG

当干净数据有害:二元分类之外的单调损坏学习

研究表明单调对抗可使多类及部分二元类不可学习;自适应添加数为o(n)时仍可学习,且下界紧。

04:00
arXiv cs.LG

Metag:构建智能体元审稿能力的数据集

Metag数据集:比对审稿前后论文差异,对齐评审意见与修改,辅助元审稿人快速核查作者回应。

04:00
arXiv cs.LG

Bern2Edge:一种通过伯恩斯坦多项式网络实现边缘部署的神经符号编译器

提出端到端框架,用知识蒸馏将教师网络转为伯恩斯坦多项式表示,支持LUT与符号规则双路径,精度提升且大幅降低延迟与资源消耗。

04:00
arXiv cs.LG

利用F2线性代数学习精确NVIDIA SASS编码器

提出F2Asm,用F2线性代数学习128位SASS精确编码,首个支持Rubin SM107的开源汇编器,往返测试完全匹配。

04:00
arXiv cs.LG

Adam在一维二次函数上的可证明边缘稳定性

研究无修正Adam在一维二次函数上的动力学,证明其普遍向冻结稳定阈值2(1+β1)/[η(1−β1)]回归,并指出亚临界周期轨道等机制失效的情形。

04:00
arXiv cs.LG

缺陷加固:通过GPU降电压增强CNN对抗鲁棒性

训练时GPU降电压引入随机扰动,增强CNN对抗鲁棒性并降低能耗,无需改变算法。

04:00
arXiv cs.LG

AgentDecarbonizer:面向AI代理的碳感知执行

针对AI代理,利用期限灵活性与跨网迁移做碳感知调度,兼顾不确定时长与缓存重算,最高减排57.9%。

04:00
arXiv cs.LG

标题未变,模型已换:CellFill——面向量化LLM的比特一致、可撤销更新的有界单元内学习

在冻结4位量化间隙内写入知识,重量化后比特级一致,可完全撤销,漂移有界;约束稠密路径与无约束参考性能几乎持平。

04:00
arXiv cs.LG

不确定性之隐轴:带贝叶斯输出层的图神经网络中的潜-后验对齐

图神经网络贝叶斯输出层中,不确定性降低源于潜变量与后验方向对齐,而非后验收缩;据此提出对齐引导学习,提升校准并保持精度。

04:00
arXiv cs.LG

C-Score:超越准确率,在半监督学习开放世界未标注污染下的鲁棒性评估

伪标签半监督学习在开放世界含外分布数据时,干净准确率可能稳定但内部退化。C-Score通过预测、表征和优化三个空间诊断隐藏崩溃,比单看准确率更可靠。

04:00
arXiv cs.LG

基于高斯特征桥的长尾半监督学习几何正则化

提出高斯桥一致性框架,动态原型库与特征桥插值,抑制噪声伪标签,提升长尾半监督性能。

04:00
arXiv cs.LG

RiskTraf:面向多变量交通流预测的风险外推残差学习

提出PEMSB-3V基准与RiskTraf模型无关风险外推残差插件,缓解交通状态捷径,提升多变量流量预测。

04:00
arXiv cs.LG

Fuzzy-MoE:面向非平稳多元时间序列预测的可解释状态条件专家路由

提出模糊专家路由模型,以双视角模糊规则识别潜在时序状态并路由专家,提升非平稳预测精度与可解释性。

04:00
arXiv cs.LG

连续时间跳跃马氏决策过程的强化学习及其在网络动态定价中的应用

针对离散状态空间的连续时间跳跃马氏决策,提出熵正则Q学习理论与无模型算法,网络动态定价优于基准。

04:00
arXiv cs.LG

基于超球面流形学习的轻量自适应ReduNet

提出LA-ReduNet,利用超球面流形学习与自适应步长,使ReduNet稳定所需层数减少一个量级,参数存储约降至1/29,精度相当。

04:00
arXiv cs.LG

无限维空间上分辨率一致的贪心神经逼近

无限维输入浅层神经模型:误差分解为截断与贪心宽度项,统计复杂度不依赖分辨率与输出维数。

04:00
arXiv cs.LG

面向扩散Transformer的Muon扩展

提出周期性行式Muon,生成质量优于AdamW 13-19%,优化器时间减半,通信量降67%。

04:00
arXiv cs.LG

基于自适应LLM提议的不良妊娠结局因果建模

提出神经符号因果发现框架,以LLM为自适应提议器,结合数据评分迭代优化,用于不良妊娠结局,复现专家路径并识别新因果。

04:00
arXiv cs.LG

离线强化学习中的解耦策略提取

提出解耦策略提取范式:行动器仅建模行为分布,推理时用评估器重排候选动作,避免过估计,优于传统方法。

04:00
arXiv cs.LG

训练、学习与推理:神经系统的统一动力学

提出原子生成事实构建生成事实图,建立基于图递归科学过程;用nanoGPT统一训练-学习动力学,推断为冻结投影;实验验证跨模型有效性。

04:00
arXiv cs.LG

基于雅可比引导的噪声注入提升大语言模型的量化鲁棒性

针对softmax敏感性,提出基于雅可比范数的噪声注入训练,提升低比特量化鲁棒性,显著改善精度与困惑度。

04:00
arXiv cs.LG

时空预测基准数据集与基线的批判性审计

经典时间序列方法审计时空基准数据集:线性模型更强,一阶差分有结构偏差,应减少依赖、严格统计评估。

04:00
arXiv cs.LG

面向药物发现智能体AI,通过人类对齐设计稳健的LLM评估系统

提出经人类对齐验证的LLM评判框架,优化后一致率达0.86,发现改写问题可提升评估质量。

04:00
arXiv cs.LG

RODE:径向-正交解耦优化引擎

提出径向-正交解耦优化法,范数与方向独立更新,降低损失与范数,性能优于对比优化器。

04:00
arXiv cs.LG

基于自由概率核的储层计算零仿真超参数选择

提出自由概率核确定性代理,无需仿真即可选择储层超参数;性能接近穷举搜索,节省大量仿真成本。

04:00
arXiv cs.LG

TracingFlow:基于二阶动力学的无模拟轨迹推断框架

二阶动力学的无模拟轨迹推断,回归加速度场求解最优输运,捕捉高曲率非线性演化,精准重建单细胞轨迹。

04:00
arXiv cs.LG

特洛伊化对齐:针对图基础模型的隐蔽后门攻击

针对图基础模型文本-图对齐,提出隐蔽后门攻击STAG,图触发与文本软提示协同,触发表示趋向目标类,文本结构隐蔽。

04:00
arXiv cs.LG

Thermo-FL:面向边缘AI的大语言模型热感知鲁棒联邦微调

以温度调控联邦微调与稀疏传输,提出鲁棒聚合抵御拜占庭攻击,仿真及物理实验验证稳健高效。

04:00
arXiv cs.LG

ConceptTS:大语言模型引导的概念瓶颈实现可解释多变量时间序列预测

提出可解释多变量时序预测框架,用大语言模型生成概念和规则,经三种瓶颈组合预测,精度媲美黑盒模型。

04:00
arXiv cs.LG

FlatLand:利用定制洛伦兹空间的个性化图联邦学习

为图联邦学习提出新方法,用洛伦兹空间处理异质性,参数解耦实现个性化聚合,性能优越。

04:00
arXiv cs.LG

COEC:面向大语言模型结构化剪枝的校准正交等价补偿

无需训练,用交替正交旋转和奇异值重标定补偿结构化剪枝误差,提升困惑度与零样本准确率,尤在高稀疏度下效果显著。

04:00
arXiv cs.LG

BackDFL:去中心化联邦学习中后门攻击与防御的统一基准

统一基准BackDFL揭示去中心化联邦学习鲁棒性被高估,15%恶意率即可击破现有防御。

04:00
arXiv cs.LG

Tydra:一种高效的表格数据混合模型

提出混合Transformer-SSM模型Tydra,推理时间较TabPFN降30%,性能接近,且优于大10倍的Hydra。

04:00
arXiv cs.LG

从临床叙述构建规划领域模型的神经符号方法

提出神经符号框架NSPIN,从临床叙事提取事件序列并诱导PPDDL规划模型,经专家评审验证有效。

04:00
arXiv cs.LG

TRACE-C:面向多流运行遥测的秩校准关系异常检测

多流遥测联合异常而单流正常,TRACE-C用秩校准检测,区分事件类型,揭示2019年风暴等事件排名差异。

04:00
arXiv cs.LG

通过相位等变自监督学习捕捉心脏周期性

提出相位等变自监督目标与Winder架构,用固定闭式算子编码心动周期,约1M参数取得先进诊断精度。

04:00
arXiv cs.LG

课程感知的先插补后细化:现实缺失下的学习型生理时间序列插补

提出课程感知插补框架CAIR,先粗插后细化,在现实缺失下准确率最优,非随机缺失优势达19%。

04:00
arXiv cs.LG

自精炼流水线中的非对称容量分配

生成器与修订器越大越好,修订器过小有害;批评器大小影响弱,但小批评器也优于无。建议非对称分配容量。

04:00
arXiv cs.LG

蛋白-配体柔性对接的谐波扭转扩散

提出谐波扭转扩散框架,以圆上谐波势导数参数化扭转分数场,显式处理周期性,提升柔性对接精度与物理有效性。

04:00
arXiv cs.LG

从微观动力学中稳健发现粗粒化连续介质方程

用方程发现方法研究相分离系统:数据量决定精度,多数据抑制伪项,库增大会降效;对伊辛模型可恢复A类方程。

04:00
arXiv cs.LG

面向慢阻肺急性加重的时序感知Transformer预测模型

针对家用呼吸机数据,提出时序感知Transformer模型,捕获症状时间演变,提升慢阻肺急性加重预测准确性。

04:00
arXiv cs.LG

SPARCL:谱分区解析式持续学习

谱干扰导致解析式持续学习漂移;SPARCL冻结核心子空间仅更新残差,实现旧类不变性,缩短性能差距。

04:00
arXiv cs.LG

短期定价面板中的跨设计不确定性:来自模拟价格轨迹的证据

研究发现,跨设计不确定性占估计误差方差97.6%,面板内重抽样无法识别;需独立定价单位以提升覆盖。

04:00
arXiv cs.LG

重新思考测试时训练中的表达力与效率

闭式转移复现逐token更新,实现并行分块训练,兼顾表达与效率,8倍外推准确率超90%。