11392 条条目 · 106 个活跃源
2026年9月16日
04:00
arXiv cs.LG

AsyncCouple-Flow:面向时空预测的异步跨模态耦合与流匹配

提出异步跨模态耦合与流匹配框架,用令牌稀疏化、耦合图和流匹配头,解决采样异步、模态缺失与误差累积。

04:00
arXiv cs.LG

TAME:面向涌现性失准的词元归因与掩码

TAME通过词元归因与掩码定位微调致涌现性失准的信号,掩码高归因词元可将失准降低23至36倍。

04:00
arXiv cs.LG

KV缓存淘汰下的分歧时机与累积不一致

KV缓存淘汰下,首次分歧时机与后续曝光主导累积不一致;分歧后曝光贡献85–90%,晚窗TV更高。

04:00
arXiv cs.LG

一种适应所学多变量结构的加权核逼近方法

提出总敏感度核,以加权方差分析核学习输入权重,自适应多变量结构,提升黑箱函数逼近精度。

04:00
arXiv cs.LG

构造即稳定:面向长时程偏微分方程预测的变分潜马尔可夫算子

提出变分潜马尔可夫算子VAMO,以潜分布概率演化建模PDE,缓解长时程预测误差累积并提升稳定性。

04:00
arXiv cs.LG

方向正确,步长有误:循环 Transformer 中有限步失效的几何分析

循环 Transformer 局部有效更新因步长过大导致有限步失效,缩小步长可恢复多数失败增益。

04:00
arXiv cs.LG

连续时间机器学习:统一的数学视角

综述以底层数学形式统一梳理连续时间机器学习各分支,比较建模、训练、复杂度与基准,并展望未来挑战。

04:00
arXiv cs.LG

GrowMTP:强化学习能自己培育出草稿头吗?

RL训练自身提供窄分布与验证监督,GrowMTP在RL循环内从零训练草稿头,提速最高2.13倍。

04:00
arXiv cs.LG

电网故障检测与线路识别的机器学习方法系统评估

评估机器学习模型在10毫秒内检测电网故障并识别故障线路,最佳F1达0.991,耗时0.342毫秒。

04:00
arXiv cs.LG

ImpossibleRubrics:对作为奖励信号的生成式评分标准进行压力测试

提出含169个不可能任务的基准,检验生成式评分标准能否抵抗对抗利用,发现其常被攻破。

04:00
arXiv cs.LG

学习动态的几何:优化脊上的梯度下降与自然梯度

基于信息几何分析学习轨迹:优化脊的极端曲率令梯度下降振荡失稳,自然梯度沿测地路径更快收敛且泛化更优。

04:00
arXiv cs.LG

LCAP:面向光子神经网络、基于少量输出探针的群体信息潜在芯片自适应

用80个历史芯片学共享校正,32个无标签探针推断新芯片潜在校正,免目标优化,精度升至93.36%。

04:00
arXiv cs.LG

用文本优化显式表达阈下学习效应

SALVE通过文本优化将阈下学习效应显式化为可读提示,可靠恢复教师特征并可检测多种污染场景。

04:00
arXiv cs.LG

高容量核联想记忆中稳定性边缘的信息几何自组织

KLR网络优化脊位于秩1谱坍缩相边界,学习动力学由稳定性边缘驱动,在曲率极限处自组织出高容量记忆。

04:00
arXiv cs.LG

深度学习能否实现跨物理映射?

提出跨物理映射框架,用神经算子连接扩散与波场;波到扩散更稳,扩散到波更难,精度受方向信息限制。

04:00
arXiv cs.LG

HyCoSeq:基因组序列的上下文双曲表示学习

提出HyCoSeq双曲表示学习框架,融合洛伦兹残差聚合与双向LSTM学习基因组序列上下文,性能优于现有基线。

04:00
arXiv cs.LG

重访Noise2Noise:训练样本对分布主导自监督去噪中的损失函数选择

N2N中L1优势非源于稀疏性,而靠优化动态;真实噪声下增益由训练样本对分布决定,损失选择并非关键。

04:00
arXiv cs.LG

SOTER:面向可穿戴人体生理信号的生成式时间序列基础模型

SOTER融合跨通道耦合、频谱专家与连续时间建模,预训练2260亿点,预测、分类与填补领先且抗噪。

04:00
arXiv cs.LG

适应去中心化异构多臂老虎机中的决策相关非平稳性

去中心化异构老虎机中,DRFC以全局新样本仅在最优臂变化时切换,忽略无关局部变化,动态遗憾不依赖局部变化数。

04:00
arXiv cs.LG

神经场集成用于气动表面预测:ONERA CRM 壁面分布 2025 挑战赛获胜方案

提出条件神经场集成预测气动壁面量,结合傅里叶编码与交叉验证,ONERA挑战赛夺冠,参数量少三个数量级。

04:00
arXiv cs.LG

分布式JEPA:一种面向能源预测的自监督框架

提出分布式JEPA自监督框架,预测掩码片段隐表征并正则化防坍缩,在能耗与光伏预测中优于Transformer,更抗缺失数据。

04:00
arXiv cs.LG

基于适配器库的组合运动控制选项学习

共享循环核心加适配器库,涌现低秩扰动;冻结网络训练高层策略组合适配器生成新运动,泛化误差降一个数量级。

04:00
arXiv cs.LG

CLARE:基于稀疏性框架的可扩展类增量持续学习

两阶段稀疏框架CLARE:先找任务关键参数掩码,再掩码约束微调;共享适配器减轻干扰,提升类增量学习可扩展性。

04:00
arXiv cs.LG

将统一拓扑签名重新用于图表示学习

将统一拓扑签名融入GNN训练,以增强、正则和池化突破1-WL表达瓶颈,提升图分类并诊断过平滑。

04:00
arXiv cs.LG

基于随机动态模态分解与深度学习的高保真数字孪生数据模型及其在流体动力学中的应用

融合随机动态模态分解与深度学习,非侵入式构建高保真数字孪生数据模型,降低复杂度与算力,并用于激波模拟。

04:00
arXiv cs.LG

复用深度限价订单簿预测模型进行场景条件下的市场冲击建模

提出模型无关框架,注入反事实订单簿消息,比较预测分布,建模短时冲击;Transformer预测器排序相关0.99、方向一致97.2%,可免重训复用。

04:00
arXiv cs.LG

当置信信号不一致:自回归语言模型中的局部与全局置信度

自回归语言模型中局部与全局置信度弱相关,全局更关联正确性,二者分歧可诊断采样不稳定,置信度应明确定义。

04:00
arXiv cs.LG

联邦图神经网络中的结构性负迁移:诊断、因果探究与散度感知缓解的局限

图联邦客户端结构差异致负迁移,异常客户端精度损失过半;仅度散度部分可复现,散度感知缓解匹配对照下失效。

04:00
arXiv cs.LG

超越 Token 局部模仿:面向同策略蒸馏的奖励兼容时序信用分配

针对同策略蒸馏的稳定性与信用分配权衡,提出γOPD,用折扣时序信用分配和奖励兼容有界混合提升推理。

04:00
arXiv cs.LG

基于自适应导数阶随机解释的全局与局部可解释性统一框架

提出ADORE统一框架,融合全局局部与一二阶导数,高效可扩展,多模态上优于LIME和SHAP。

04:00
arXiv cs.LG

医学人工智能中的记忆偏差

医学AI会记忆训练中的患者历史数据,导致其未来诊断出现不对称记忆偏差,需改进训练与部署。

04:00
arXiv cs.LG

IRENE:面向意大利雷达降水临近预报的卷积GRU集合模型

多尺度ConvGRU集合模型实现意大利1 km/5 min雷达降水概率临近预报,评分与校准优于STEPS和DGMR。

04:00
arXiv cs.LG

通过全局知识蒸馏与本地头部适配的个性化联邦学习

提出pFedKDH:仅聚合共享主干,保留客户端专属头,用重校准全局头作教师蒸馏,多数设定下精度最优。

04:00
arXiv cs.LG

MyoFlow:面向跨会话与跨被试高密度表面肌电手势识别的锚定矫正流

提出MyoFlow,首个跨会话/被试HD-sEMG判别式流匹配框架;以锚定矫正流替代独立分类头,实现零样本识别并显著提升精度。

04:00
arXiv cs.LG

易抓骗子,难证清白:语言模型凭验证记录诊断损坏的奖励通道

凭验证记录,语言模型几乎总能识破撒谎者,却常把诚实报告者误判为撒谎,即使环境未变。

04:00
arXiv cs.LG

同流异径:流匹配中的方差缩减

研究流匹配路径选择对SGD方差与收敛的影响;发现相同目标下路径可改变收敛率,提出约束方差最小化PathOpt及可估计形式。

04:00
arXiv cs.LG

大语言模型在上下文中形成信念状态几何结构

LLM在HMM提示下,残差流激活可线性解码信念状态,干预验证其功能,表明上下文学习近似贝叶斯预测。

04:00
arXiv cs.LG

用于多元回归与高维数据重建的混合变分量子电路

提出混合变分量子电路,融合经典仿射层实现向量值回归,性能媲美高斯过程回归、超越XGBoost。

04:00
arXiv cs.LG

弥合置信度差距:用于校准测试时提示调优的温度缩放

提出CoTS/E-CoTS,用温度缩放弥合适配与零样本置信差距,降低校准误差且不损精度。

04:00
arXiv cs.LG

OPEN-1B:完全可审计的训练运行

提出完全可审计训练,可在异构硬件上逐步位级复现并集体验证,发布Open-1B及全套审计材料。

04:00
arXiv cs.LG

大规模动态动作空间中的学习引导规划:面向一对多移动充电的预算受限树搜索

提出LP-BTS:图提议策略聚焦候选,价值评论评估叶节点,预算PUCT比较短未来;在动态大规模充电动作空间中泛化强,生存率领先。

04:00
arXiv cs.LG

过程模拟模型的降维多保真度贝叶斯优化

降维多保真贝叶斯优化框架,融合全局敏感性分析与保真度增强高斯过程,显著减少高保真仿真评估次数。

04:00
arXiv cs.LG

知识即轨道:有限集合作为精确周期性潜在生成器的相位

有限知识可存为精确周期性潜在生成器的相位轨道,共享解码器提供内容,代数保证精确循环。

04:00
arXiv cs.LG

以多维洛伦兹带体衡量AI危害

多维洛伦兹带体与基尼指数评估AI危害,MIT数据显示环境、基础设施、财产、身体、民主类危害最集中。

04:00
arXiv cs.LG

ENCP:用于视觉语言导航的回合归一化共形预测

ENCP按回合归一化并校准最大非一致性分数,为视觉语言导航提供逐步覆盖保证和模型无关不确定性估计。

04:00
arXiv cs.LG

FreqSpaNet:面向物理层硬件完整性检测的SFPF频率与空间学习

提出FreqSpaNet学习SFPF频空表征,用于开放集硬件异常检测,AUROC达96.31%。

04:00
arXiv cs.LG

耦合校准与学习:在无目标域奖励反馈下缓解大语言模型蒸馏中的教师偏差

提出CCL,仅用源问题奖励反馈耦合教师校准与学生更新,无需目标域奖励反馈,克服教师偏差并收敛至最优。

04:00
arXiv cs.LG

基于正交化动量的非光滑优化

研究正交化动量在非光滑优化中的失效机制,提出自适应动量与MAGD,恢复收敛并具理论速率和实验优势。

04:00
arXiv cs.LG

面向生物医学数据聚类表示的 Copula 适配有向无环图

提出CopDAG,融合Copula与DAG因果发现构建聚类表示,无需标签,在16个生物医学数据集上聚类精度居首。

04:00
arXiv cs.LG

分子表示塑造基于流的聚合物生成中目标保真度与探索的平衡

提出PolyLatentFlow与LlamaUni,揭示分子表示决定聚合物生成目标保真与探索的平衡。