11822 条条目 · 106 个活跃源
2026年7月22日
04:00
arXiv cs.LG

物理引导的掩码多任务网络:面向随机碎片化充电曲线的边缘友好电池健康诊断

提出RoSIP-Batt贝叶斯多任务框架,用同方差加权平衡SOH与RUL预测,注入物理先验,显著降低误差,适合嵌入式部署。

04:00
arXiv cs.LG

动态损失平衡的旋转SOH注入先验电池Transformer用于锂离子电池SOH与RUL联合预测

提出RoSIP-Batt,动态平衡联合预测损失,注入SOH先验,显著降低SOH和RUL预测误差。

04:00
arXiv cs.LG

ChemHyperMag:基于物理信息的磁超图学习提升分子ADMET预测

提出ChemHyperMag,用功能团超图和磁拉普拉斯编码非对称流,少样本下多任务ADMET预测优于现有方法。

04:00
arXiv cs.LG

联邦轻量级微调

FLITE通过低秩分解和增量微调,通信量降低8718倍至5KB/轮,精度74.67%,接近全权重FedAvg。

04:00
arXiv cs.LG

MambaLSTM:一种用于增强交通事故风险预测的时空框架

提出MambaLSTM框架,融合时空特征并捕捉全局语义与长短时依赖,提升事故风险预测精度。

04:00
arXiv cs.LG

AHEAD: 通过可解释的跨标注者建模推进多类别标签聚合

AHEAD提出跨标注者学习与高置信度指导,将平均准确率从68.75%提升至73.23%。

04:00
arXiv cs.LG

商参数空间上的PAC-贝叶斯界:几何诱导的隐式偏差先验

通过商空间消除参数化冗余,构造几何诱导隐式偏差先验,降低KL散度与PAC-贝叶斯界。

04:00
arXiv cs.LG

物理自监督学习:无需人工标注的IMU感知

提出物理自监督学习框架,无需标注,通过物理解码器和混合编码器实现IMU感知,误差降低高达5倍。

04:00
arXiv cs.LG

受控研究:仅注意力机制的Transformer

删前馈层代价大,但将预算重新分配至注意力深度后,仅注意力Transformer与标准Transformer几乎无差别(0.006 nats),差距源于参数记忆。

04:00
arXiv cs.LG

可扩展且高效的联合脉冲嵌入预测架构用于大规模动态图

提出SG-JEPA,沿时间划分节点,用脉冲编码预测嵌入,避免复杂机制,高效扩展至千万边动态图。

04:00
arXiv cs.LG

CANDOR:冻结基础编码器中的机会校准不一致性

CANDOR通过对称银行固定机会水平,揭示冻结编码器并非盲但弱,可在训练任何头前检测其支持不佳的发现。

04:00
arXiv cs.LG

可学习新奇性中的智能

提出可学习新奇性,其闭式估计器无监督实现复杂度分类、孤立子生成、图像聚类及探索驱动,统一了智能的多面性。

04:00
arXiv cs.LG

多层MIMO中继作为深度物理神经网络:功率放大器作为激活函数

利用多跳MIMO中继与功率放大器非线性作为激活函数,构建可端到端训练的深度物理神经网络,实现低能耗空中推理。

04:00
arXiv cs.LG

使用恰当评估的语言模型罕见事件估计

提出GA-AMLS和SPB损失,在激活空间估计语言模型罕见事件,消除零估计崩溃,支持不对称惩罚,揭示偏差方差权衡。

04:00
arXiv cs.LG

面向网络异常检测的混合潜在-结构融合(HLSF)

提出HLSF框架,融合CP-APR结构异常与归一化流潜在密度,在真实网络入侵数据上提升异常检测性能。

04:00
arXiv cs.LG

熔融沉积成型翘曲检测案例中的自动化数据工程与特征选择

提出强化学习与SHAP可解释AI结合的自动化数据处理框架,优化FDM翘曲检测模型-特征组合,AUC从0.9248提升至0.9731。

04:00
arXiv cs.LG

Operational Proto-Introspection in Looped Language Models: Process-Quality Taps, Executable Branching, and the Readout-Control Boundary

04:00
arXiv cs.LG

自适应两阶段在线学习用于移动核心网络中影响业务的故障检测

提出两阶段在线学习框架,建模正常流量并分析残差,实现低开销连续自适应故障检测,性能最优。

04:00
arXiv cs.LG

有符号整流流:面向负性控制的生成

提出有符号整流流,通过有符号测度控制生成过程,在图像生成中提升保真度-多样性,抑制记忆与有害内容。

04:00
arXiv cs.LG

面向供应链规划的供应商提前期通用估计:考虑删失的上下文学习

LT-ICL模型结合transformer与归一化流,预训练于合成删失数据,无需参数更新即可适应新数据集,在24个供应链数据集上取得最佳平均排名。

04:00
arXiv cs.LG

现在我们知道了吗?——TerraMind与THOR的系统比较

系统比较发现,架构设计(补丁大小、解码器)比模型本身更能解释性能差异,两者各有优势,无单一胜者。

04:00
arXiv cs.LG

吸引子几何决定系统发现的可辨识性极限

吸引子最小特征值设定系统发现上限,混沌可提升但放大噪声,算法选择非首要。

04:00
arXiv cs.LG

决策制定中的弱到强学习

提出弱到强学习框架,用有限标记数据训练弱模型,再生成分布指导强模型并通过理论界和实验验证改进决策效果。

04:00
arXiv cs.LG

RRPO: 基于分层条件采样的参考相对策略优化

通过分层条件采样构建对比锚点,无需验证器即可进行强化学习,在推理与生成任务中表现出色。

04:00
arXiv cs.LG

基于全局锚点一致性的噪声监督下鲁棒多视图分类

通过全局锚点审计与自适应标签纠正,有效抵抗噪声标签的负面影响。

04:00
arXiv cs.LG

基于活动与误差几何的条件化直接反馈对齐

提出活动与误差条件化方法改善DFA各向异性失败模式,提升分类准确率达7.5个百分点。

04:00
arXiv cs.LG

面条架构师:一种抗污染、构造即标注的多语言代码数据集生成工具

Spaghetti Architect通过反优化转译生成构造正确、抗污染、多语言代码数据集,并沿难度轴标注,保证质量与可控性。

04:00
arXiv cs.LG

AMICA-Python:带有安德森加速的自适应混合独立成分分析

AMICA-Python:实现自适应混合独立成分分析,引入安德森加速,精度高,速度快。

04:00
arXiv cs.LG

关于深度线性Transformer中出现的多样化动态行为

通过粒子系统视角,揭示二维深度线性Transformer的动力学可化为广义仓本模型,展现聚类、振荡等行为并推至高维。

04:00
arXiv cs.LG

基于关系隐藏状态的强化学习中涌现的规划行为

关系隐藏状态网络通过学习环境转移结构涌现规划机制,解释模型无关强化学习中的规划现象。

04:00
arXiv cs.LG

BRIDGE:面向协同基因调控恢复的瓶颈感知调控因子集推断与诊断

提出BRIDGE框架和TRACE诊断套件,通过残差高阶集评分显著提升协同基因调控因子集恢复的Jaccard相似度和召回率。

04:00
arXiv cs.LG

中文标题:基于图神经网络的旅行商问题算法选择:不同预算机制下成本与排序损失的系统研究

中文摘要:提出GNNAS-TSP框架,基于图神经网络学习TSP实例表示,通过成本预测与排序任务进行算法选择,在固定预算下优于单一最优求解器。

04:00
arXiv cs.LG

连续动作空间合作任务的自我进化默认动作

SAFE框架通过自进化默认动作构建反事实基线,实现无偏策略梯度与收敛保障,在连续动作空间合作车辆任务中超越现有模型。

04:00
arXiv cs.LG

收缩规范预条件用于量化矩阵乘法

研究低精度矩阵乘法,提出收缩规范预条件降低乘积误差,达两位数百分比改进。

04:00
arXiv cs.LG

PertReason:一个基于知识的基准和框架,用于细胞状态条件下的扰动效应机制推理

PertReason基准评估模型在扰动效应机制推理中的准确性,揭示预测与推理的系统性差距。

04:00
arXiv cs.LG

逆流倍增网络:一种受肾脏启发的具有可证明有界不动点动力学的迭代算子

受肾脏逆流倍增机制启发的可微序列算子,具备可证明有界不动点动力学,可作为残差迭代细化的替代方案。

04:00
arXiv cs.LG

QScheduler:针对INT8 NPU上零阶设备端训练的自适应梯度采样

QScheduler自适应调整梯度采样数,在INT8 NPU上实现零阶设备端训练,无需超参数搜索,效果媲美调优固定配置。

04:00
arXiv cs.LG

基于曝光度的强化学习排序方法

提出基于曝光度的强化学习排序方法,利用方差缩减、基线校正和自动微分,实现更快收敛和更高性能。

04:00
arXiv cs.LG

免反向传播的引导:通过优化潜在后验调控模型行为

提出后验前缀调优(PPT),无需反向传播,一次采样即可优化潜在后验以引导模型行为,服务多种效用。

04:00
arXiv cs.LG

ConceptCF:基于概念的反事实解释用于时间序列可解释性

提出ConceptCF,通过时间序列分解构建概念,用遗传算法生成反事实,在有效性、置信度等五指标上达到顶级性能。

04:00
arXiv cs.LG

Decafs:解缠条件对抗流

提出基于李群的解缠条件对抗流,实现可解释生成,在图像和分子任务表现优异。

04:00
arXiv cs.LG

基于QUBO的机器学习公式级自动调优:跨多个量子启发式退火器的案例研究

提出Optuna框架自动调优SVM的QUBO参数,在多种量子退火器上提升分类精度约0.8-2.1个百分点。

04:00
arXiv cs.LG

相对位置泛化,绝对位置记忆:注意力中长度泛化的隐式偏差解释

相对位置编码通过隐式偏差实现长度泛化,绝对位置编码则记忆固定位置,导致无法外推。

04:00
arXiv cs.LG

从轨迹到指令:语言条件元强化学习

提出LA-MAML,用语言指令替代内循环轨迹与梯度更新,显著降低训练时间,性能媲美基线。

04:00
arXiv cs.LG

动态环境下基于配送无人机的参与式感知强化学习方法

提出两时间尺度强化学习框架,解决动态环境下配送无人机感知的扩展性与多时间尺度决策问题,系统利润提升20%-46%。

04:00
arXiv cs.LG

ABOPD: 基于在线策略蒸馏的抗体CDR设计

提出在线策略蒸馏框架,用天然几何监督模型去噪轨迹,显著提升CDR-H3结构恢复,RMSD降低0.42Å。

04:00
arXiv cs.LG

物理信息指导的大气数据超分辨率

提出物理信息超分辨率(PISR)方法,基于原始方程增强物理一致性与极端事件检测能力。

04:00
arXiv cs.LG

基于热-机械信号的状态感知物理引导锂离子电池热失控早期预警

提出热-机械信号融合框架,提前15.6秒预警热失控,F1=0.89,误报率2.7%,力信号是关键。

04:00
arXiv cs.LG

RAMP:通过摊销消息传递的识别参数化方法

RAMP用非线性摊销消息传递隐式定义潜在结构,高效恢复复杂高维数据的潜在变量分布。

04:00
arXiv cs.LG

KALE: 基于损失均衡的核对齐方法,用于在大规模网络数据上稳定对齐CLIP与DINOv2

KALE通过损失均衡控制器自适应调整对齐权重,使CLIP-DINOv2对齐在大规模网络数据上稳定有效,零样本提升2.00。