11852 条条目 · 106 个活跃源
2026年7月15日
04:00
arXiv cs.LG

基于学习的场景模型预测控制加速

提出学习加速ADMM算法,利用并行计算与Moreau包络学习加速场景MPC求解,微电网案例显著快于IPOPT/MadNLP,控制性能可靠。

04:00
arXiv cs.LG

ANGLE:基于Engression的角度神经生成式学习

ANGLE框架采用圆形能量分数损失,学习角度条件分布的非参数回归,理论性质优良且应用效果显著。

04:00
arXiv cs.LG

标题:形式而非内容?对冻结小代码模型中基于提示与权重的学习型错误条件自我修复的预注册、安慰剂对照评估

中文摘要:PoPE方法评估错误内容对代码修复的作用,提示和权重通道均未证实内容优势,测试被条件化替代。

04:00
arXiv cs.LG

Reproducible Reservoir Computing with Thermally Driven Superparamagnets: Controlling Temperature Sensitivity

04:00
arXiv cs.LG

Deep4ge:用于故障检测与诊断的DNN训练轨迹

基于14227次训练运行的Deep4ge基准数据集,支持故障检测、诊断与早期预测。

04:00
arXiv cs.LG

面向Transformer注意力头中偏见的定位与修复

提出ROBIN白盒子方法,通过推理时定位并移除注意力头中的偏见子空间,有效降低偏见差距且保持模型质量。

04:00
arXiv cs.LG

随机化哈密顿蒙特卡洛的加速混合时间

对于对数凹分布,RHMC混合时间加速:强对数凹时总积分时间O(α^{-1/2} log(1/ε));一般对数凹时O(ε^{-1/2})。

04:00
arXiv cs.LG

NWP预报误差下光伏功率预测深度学习模型的鲁棒性:一种时空与物理可解释性分析

基于物理约束框架评估六种模型在NWP误差下的鲁棒性,序列模型更稳健,特征分配向历史观测偏移。

04:00
arXiv cs.LG

LatentFlow:一种用于条件化随机过程的通用框架

无需训练,将过程条件化转化为潜在推理,通过反向SDE实现秒级精确采样,适用于多种模型。

2026年7月14日
04:00
arXiv cs.LG

科学机器学习野外指南:结构先验何时有益何时有害的诊断性研究

结构先验不匹配数据时反而有害,弱约束模型更优。

04:00
arXiv cs.LG

知识图谱与图神经网络:全面综述

提出基于KG流水线和GNN视角的两层分类法,综述各类模型,总结优势与挑战。

04:00
arXiv cs.LG

低自相关二进制序列问题中的搜索空间区域优先级排序

提出混合搜索框架,结合Thompson采样与并行自回避游走,自适应分配资源,改进35个序列长度最优结果,实现最长序列优值因子超8.0。

04:00
arXiv cs.LG

MawForge: 内存受限的本地混合专家推理专家物化机制

MawForge在受限统一内存机器上通过按需物化专家实现本地MoE推理,作为有界执行机制有效,但非缓存最大化策略,性能取决于专家重用与驻留的平衡。

04:00
arXiv cs.LG

立场:每个真实标注都是人为构建,而非客观真理

真实标注非客观中立,而是人为构建;承认其情境依赖性可提升模型可靠性与透明度。

04:00
arXiv cs.LG

AuditWeave:面向AI辅助与数据转换工作流的防篡改、可审计证据层

轻量Python库,通过追加式哈希链账本记录AI及数据工作流,可追溯、防篡改,验证开销微秒级。

04:00
arXiv cs.LG

深度熵引导的无训练LLM推理采样

DEGS利用层熵崩溃信号,免训练测试时提升推理,低开销并在域外困难任务超越RL模型。

04:00
arXiv cs.LG

KV缓存压缩的消融、统计推断与验证

比较两种压缩方法,发现特征基方法在重尾数据失败,结构化场景有效,有效维度依赖校准预算。

04:00
arXiv cs.LG

编码智能体实际需要什么上下文来行动?

编码智能体编辑代码时,真正需要的仅是编辑代码本身,周围上下文几乎无用;压缩上下文节省大量token,且存在约9%的API随机噪声。

04:00
arXiv cs.LG

基于参考的大语言模型蒸馏检测

提出基于参考成员推理的蒸馏检测方法,通过偏好比较识别教师模型,单教师场景准确率近乎完美。

04:00
arXiv cs.LG

低秩注意力残差

提出低秩注意力残差(LR-AttnRes),用低维键进行深度路由,解耦路由与残差内容,提升性能并降低计算量。

04:00
arXiv cs.LG

无元数据元加权直接偏好优化(噪声标签下)

提出无元数据元加权DPO,通过双层优化与元学习处理噪声偏好,结合LoRA降低计算成本,提升对齐性能。

04:00
arXiv cs.LG

FedCausal-Dyn:一种应对动态特征漂移的联邦学习因果动态范式

提出因果动态范式FedCausal-Dyn,分离因果特征并聚合可靠原型,解决动态漂移,准确率最高。

04:00
arXiv cs.LG

安全响应至关重要:输出感知安全护栏减轻多模态大语言模型的过度拒绝

提出输出感知安全护栏,通过隐藏状态预测有害输出,大幅减少过度拒绝,保持安全与效用。

04:00
arXiv cs.LG

缓解CTR模型训练初期的性能崩溃

通过去除高稀疏特征和聚合低频值,可稳定CTR模型早期训练,显著提升离线与在线性能。

04:00
arXiv cs.LG

EvoClawBench:智能体能否从自身运行中学习可复用技能?

EvoClawBench基准测试表明,从自身运行中学习可复用技能并非自动获益,而是有选择性和成本敏感的。

04:00
arXiv cs.LG

量子启发的上下文学习用于动态交易图的稀疏环欺诈检测

探索性基准采用量子启发CML检测动态图稀疏环欺诈,混合图特征与拓扑摘要效果最佳,拓扑作为上下文层提升检测。

04:00
arXiv cs.LG

流形约束的表格深度神经网络

HDE-Net通过双曲空间分层决策建模,解决表格DNN几何不匹配问题,在30个数据集上取得最佳平均排名。

04:00
arXiv cs.LG

ERP数据供给财务控制测试

提出SEQ-FCT框架,融合掩码与合成数据实现安全财务控制测试,F1达0.93,泄露风险仅0.018。

04:00
arXiv cs.LG

符号分支重复惩罚中的规范依赖性与结构化输出损坏:跨模型、推理栈及替代重复控制的测量

符号分支重复惩罚因logit零点任意定义不良,常规下改变多数令牌并严重损坏结构化输出,归一化log概率可修复。

04:00
arXiv cs.LG

发现受迫物理系统中的潜在响应规律

FLARE通过潜在自编码器从高维测量中学习受迫系统的稀疏动力学,实现长时程高维响应预测。

04:00
arXiv cs.LG

从方向到幅度:多模态指令调优如何重塑Transformer隐藏状态中身份指定提示的几何编码

多模态指令调优使身份编码从方向性变为幅度性,且仅在该模式下出现,其他调优方式无此重组。

04:00
arXiv cs.LG

自回归生成中自我修正盲区的谱起源

提出SPARC理论,证明自回归模型自我修正盲区源于误差传播算子谱半径≥1,推导校正阈值与收敛条件。

04:00
arXiv cs.LG

基于面板数据的马尔可夫链选择模型的估计、预测与品类优化

提出MC选择模型框架,EM算法估计参数,优于传统方法,并分析计算复杂性。

04:00
arXiv cs.LG

RUBRIC:面向不平衡分类的实境效用平衡排序

RUBRIC通过实境-效用平衡筛选合成样本,减少分布偏移,提升不平衡分类的F1和召回率。

04:00
arXiv cs.LG

面向决策的分布鲁棒优化中的预测性模糊集学习

提出学习预测性模糊集,自适应半径提升分布鲁棒优化性能,在组合优化中实现高收益低风险。

04:00
arXiv cs.LG

用于AI原生6G的JEPA:预测表示与开放挑战

JEPA通过潜在空间预测表示,实现6G自监督学习,提升标签效率与鲁棒性,面临多时间尺度等挑战。

04:00
arXiv cs.LG

无声冻结:预测低精度训练何时停止学习

低精度训练中权重更新低于ULP半单位时冻结,可提前预测,无需低精度数据。

04:00
arXiv cs.LG

配额市场:通过动态定价实现机器学习训练资源的高效分配

针对需求异质,配额市场通过动态定价实现帕累托有效和最大最小公平分配,已部署于谷歌。

04:00
arXiv cs.LG

一个强大的平衡Softmax分类器再训练基线用于长尾识别

BS-cRT通过微调分类器,在多个长尾数据集上显著提升小样本准确率,增益达5-10个百分点。

04:00
arXiv cs.LG

SMETA-ZSL:面向零样本威胁分类的语义元对齐

SMETA-ZSL通过对比学习、元学习和知识蒸馏对齐语义原型与行为特征,在7个基准上平均提升10.8个百分点。

04:00
arXiv cs.LG

合作博弈的非线性公理归因方法

针对Shapley值线性导致空空间大的缺陷,提出保留必要公理的非线性归因方法,通过最小化优化近似效用函数,提升排序可靠性。

04:00
arXiv cs.LG

基于数据并行吉布斯采样的非参数贝叶斯逆强化学习

提出狄利克雷过程先验的非参数贝叶斯逆强化学习,自动推断多专家奖励类型,在ObjectWorld网格中准确识别簇数,并行加速达4.79倍。

04:00
arXiv cs.LG

Vilya-1:全原子基础模型,用于大环结构预测与设计

Vilya-1模型能预测任意化学结构的大环构象和膜渗透性,显著优于现有方法,并支持新型大环设计。

04:00
arXiv cs.LG

优化ARDL模型以进行零售销售预测与公平定价

提出嵌入公平约束的ARDL零售预测模型,用线性规划和模拟退火求解,实现以CPI为上限的公平定价。

04:00
arXiv cs.LG

金融应用中的多模态事件序列基础模型

预训练多模态事件序列基础模型,统一异构数据,学习通用表示并提升下游任务,已部署于大型银行改善业务指标。

04:00
arXiv cs.LG

用于可解释、鲁棒和可审计的临床预测的多模态路由

显式多模态路由框架通过离散路线与推理时掩码,实现可解释、鲁棒且可审计的临床预测。

04:00
arXiv cs.LG

弯曲权重空间中的学习:指数-线性权重重参数化促进优化改进

提出指数-线性权重重参数化,弯曲参数空间加速优化,Transformer训练步数减至1.32-1.49倍。

04:00
arXiv cs.LG

服务长尾:面向度假租赁市场的免训练大语言模型候选生成

提出免训练LLM管道,利用静态元数据生成候选,与IBKNN融合,覆盖长尾房源且不降低性能,缩小模型差距。

04:00
arXiv cs.LG

记住不同项目,而非词元:一个介于状态空间模型与注意力之间的可学习狄利克雷过程缓存

提出可学习稀疏缓存,仅存储不同项目,以低内存匹配注意力性能。

04:00
arXiv cs.LG

FlashTrie:一种用于生成式检索的GPU加速约束束搜索

FlashTrie通过GPU加速约束束搜索,实现毫秒级延迟和24倍加速,显著提升检索性能与收入。