11532 条条目 · 106 个活跃源
2026年8月25日
04:00
arXiv cs.LG

稳定性边缘的变分结构

边缘耦合推广至动量法,临界点刻画不动点与二周期轨道,海森阵判稳,等同维莱特作用,连接稳定边缘与离散力学。

04:00
arXiv cs.LG

读取、写入、松弛:为何神经PDE代理模型需要全局与局部处理

神经PDE代理需全局与局部处理;新方法RWR交错两者,降低全谱误差,精度高、数据高效、可扩展。

04:00
arXiv cs.LG

TinyML系统的功耗与性能表征

系统评估单片机TinyML应用,分析抽象层开销并建模降耗,助力边缘设备神经网络搜索与CNN优化。

04:00
arXiv cs.LG

架构与训练如何影响TPC表示跨实验的复用

评估TPC数据表示跨实验与探测器复用性,发现架构是任务相关结构的主要来源,随机初始化PointNet表示已具高信息量。

04:00
arXiv cs.LG

MSM-Mem:面向医疗AI代理的通用医学结构化多模态记忆框架

提出医学结构化多模态记忆框架,将临床经验组织为语义、情景和视觉记忆,使医疗AI代理持续改进推理。

04:00
arXiv cs.LG

用于降维保真度的固定半径距离带基准

用固定半径距离带斯皮尔曼相关评估降维保真度,按绝对半径分带,能揭示排名指标忽略的簇内压缩和异常点问题。

04:00
arXiv cs.LG

更多专家,更差动态:混合专家状态空间模型中的逆缩放与谱偏差

混合专家状态空间模型在分机制预测中不如单专家,专家增多反降,完美路由无效;低误差源于平滑,破坏吸引子几何。

04:00
arXiv cs.LG

对良性事实的强化学习加剧了已记忆私有数据的泄露

对良性事实做RL会放大已记忆PII的提取,数据不含隐私也如此;模型越大泄露越严重,攻击者可借无关微调窃取。

04:00
arXiv cs.LG

自适应多级扭曲序列蒙特卡洛用于语言模型罕见事件估计

提出自适应多级扭曲SMC,通过渐进中间事件学习扭曲,提升大语言模型极端罕见不安全行为的概率估计精度。

04:00
arXiv cs.LG

深度神经网络的宽度无关可压缩性

证明深度MLP可压缩至与原始宽度无关的窄网络,压缩宽度仅与误差及有效输入维数相关。

04:00
arXiv cs.LG

拓扑事件序列的弹性并发因果发现

提出弹性并发因果发现方法RCCD,用超边因果注意力与掩码优化,提升拓扑事件序列因果图鲁棒性,优于现有方法。

04:00
arXiv cs.LG

基于物理信息神经网络的薄截锥壳屈曲载荷稳健预测与可靠性设计

提出物理信息神经网络预测薄截锥壳屈曲载荷,结合可靠性设计,精度与物理一致性优于传统神经网络。

04:00
arXiv cs.LG

线性逆问题中扩散模型的后验信息动力学

扩散模型逆问题后验信息:似然力能量与熵耗散满足信息均方误差恒等式,高噪声二次衰减,并依赖算子先验对齐

04:00
arXiv cs.LG

ChainPrune:评估并减少长链思维推理中的冗余

ChainPrune以树结构择优和DPO精简CoT冗余,减少步数与开销,保持甚至提升准确性。

04:00
arXiv cs.LG

门控解耦组合式老虎机:带监督校准动作缩放与执行前门控的上下文老虎机统一理论

提出门控解耦组合老虎机理论,用监督校准缩放与执行前门控,证明方差缩减与等价性,统一六类工业系统。

04:00
arXiv cs.LG

CD-LoRA:一致性驱动的低秩适配实现多任务微调

揭示路由机制训练推理不一致,提出无路由的CD-LoRA,用一致性对齐共享低秩空间,更简稳且性能领先。

04:00
arXiv cs.LG

超越固定方向:大语言模型中推理与记忆的自适应表示分析

单方向可解码推理与记忆,但GRPO后方向重组,几何改变而信息保留。

04:00
arXiv cs.LG

上下文自适应传感器融合中的频谱预滤波:面向高风险决策系统的四角色FFT-GDCB集成

提出四角色FFT预滤波,低成本消除周期污染,集成GDCB,兼具白噪、清洁、频谱特征与去季节化,六域验证。

04:00
arXiv cs.LG

BioMed-Agent-RL:面向生物医学应用的元学习全能智能体

融合元学习与强化学习的医学智能体,通过自适应优化策略,临床推理准确率约73%,超越GPT-5。

04:00
arXiv cs.LG

DySCo:气候预测中极端事件动态一致的数据驱动降尺度

提出DySCo,实现气候极端事件降尺度,保持与GCM动态一致,性能媲美最优模型。

04:00
arXiv cs.LG

方差驱动探索:高随机环境下纯探索的可证明高效方法

提出方差驱动探索方法,基于最小化最终决策不确定性分配采样,用于纯探索,有理论保证且实验优越。

04:00
arXiv cs.LG

Transformer的通信图谱

从权重绘制Transformer全部通信通道,发现多数头对耦合非随机,可复现归纳电路并定位破坏归纳能力的二维子空间。

04:00
arXiv cs.LG

Bi-EZP:大语言模型引导的双层程序演化用于集成零成本代理发现

提出Bi-EZP双层框架:上层用大语言模型生成代理程序,下层优化参数,用相关性评估选择,提升搜索性能。

04:00
arXiv cs.LG

TANGO:用于自然语言与形式语言建模的令牌聚合非线性门控算子

提出TANGO与WANGO模型,用跨令牌门控残差更新替代Transformer子层,在多种任务上取得更优或相当的验证损失,WANGO实现线性复杂度。

04:00
arXiv cs.LG

ReMAP:自监督学习揭示大脑表征与脆弱性

基于无标签双额电极脑电的自监督学习,解码麻醉轨迹几何,精准预测深度并揭示认知与死亡风险。

04:00
arXiv cs.LG

ARCHER:冷冻电镜的摊销式跨样本姿态估计

提出可泛化的冷冻电镜姿态估计法,零样本跨结构,精度与专用方法相当,并保留构象信号。

04:00
arXiv cs.LG

个性化与志向导向的职业路径推荐

提出数据驱动方法,结合职业路径相似性与志向相似性,推荐个性化职业路径,无监督表示学习优于领域知识法。

04:00
arXiv cs.LG

超越全新开始:对话式语音代理中流式ASR的状态化推理

针对流式语音识别受长静音和反馈词影响,提出跨语句状态管理策略,降低起始错误,相对WER降15-21%。

04:00
arXiv cs.LG

利用机器学习和搜索算法优化柴油发电机负载,提升石油平台能源效率

采用机器学习和搜索算法优化海上平台柴油发电机负载,实现日均省油27%,约2.4万升。

04:00
arXiv cs.LG

反事实商模型:学习行为改变什么,而非世界做什么

强化学习模型常预测完整未来,但动作选择只依赖动作间的差异。反事实商模型直接学习动作依赖效应,消除共同随机成分,保持决策充分性,提升动作排序性能。

04:00
arXiv cs.LG

实际运行的内容:苹果神经引擎上语言模型放置与解码速度的测量研究

测量显示:LLM在ANE上的放置取决于表达方式而非计算内容,权重编码决定加速,解码按token流字节计费,三元模型最小最快。

04:00
arXiv cs.LG

CST:面向通信高效多模态边缘推理的协同选择性传输

提出协同选择性传输,仅传互补辅助特征,避免冗余,保持性能并降低通信开销,最高提速4.27倍。

04:00
arXiv cs.LG

符号神经常微分方程:从时间序列数据学习可解释模型

提出多步预测框架,从时序数据辨识稀疏可解释动力学模型,增强稳定性与泛化,可恢复稳定、周期及混沌系统。

04:00
arXiv cs.LG

谁来当老师?文本属性图上少样本节点分类的置信感知双教师学习

提出置信感知双教师学习框架,动态为各节点选更可靠教师,降低大语言模型成本并提升少样本节点分类性能。

04:00
arXiv cs.LG

论世界模型策略学习与模仿的世界-动作模型之间的能力区分

世界动作模仿与直接行为克隆等效;真正差异在于动作条件世界模型,观测数据无法识别动作效应,需干预。

04:00
arXiv cs.LG

使用潜增强神经微分方程学习含奇异性的降阶动力学

提出LA-NODEs框架,通过潜增强神经ODE处理降阶系统自交轨迹,提升预测精度与建模保真度。

04:00
arXiv cs.LG

混合贝叶斯-联结主义模型实现更准确的行为预测

提出贝叶斯蒸馏+行为微调方法,融合两种范式优势,在人类概念学习中预测更准,兼顾先验与启发式偏差。

04:00
arXiv cs.LG

导致Adam停滞的损失景观特征:定义、估计器与预条件Hessian视角

预条件Hessian指标区分轴对齐与交叉耦合病态,解释Adam停滞,FINER案例验证。

04:00
arXiv cs.LG

为什么鲁棒性会减少叠加?

对抗训练放弃非鲁棒特征,使需表示的特征减少,从而降低叠加。

04:00
arXiv cs.LG

揭示大语言模型拆分联邦微调中的深度-性能困境

拆分联邦微调中,深度分区提升吞吐与隐私却使微调质量崩溃,现有聚合方法失效,源于Transformer近等距拓扑引发注意力崩溃。

04:00
arXiv cs.LG

解耦物理建模与执行以提升物理推理

提出显式物理建模框架,两阶段后训练提升物理推理,平均提高约3%。

04:00
arXiv cs.LG

基于递归子求解器的分块稳定自适应三次正则化

提出分块自适应三次正则化优化器,小块精确、大块Krylov子求解,保持最优收敛率,在9100万参数INR上远超Adam。

04:00
arXiv cs.LG

Top-K臂识别中去中心化的代价

共享奖励识别最优至对数因子;去中心化代价为样本复杂度乘ρ²,完全非对称时为四倍。

04:00
arXiv cs.LG

现代手写热身是否有助于历史阿拉伯语OCR?在Muharaf和KHATT上的可复现、计算匹配评估

四次运行效果从-17.64到+14.52 CER点,符号反转;干净运行无效应,计算匹配实验显示小负面效应,非普遍结果。

04:00
arXiv cs.LG

测试时自适应何时有帮助、有害或失效:CIFAR-10-C上的条件级研究

在CIFAR-10-C上比较三种测试时自适应方法,平均精度提升,但低严重度损坏下失效,EATA近似BN-Adapt。

04:00
arXiv cs.LG

DAW:面向混沌系统深度学习预测的动力学感知加权

针对混沌系统预测中均匀损失导致瞬态高维状态被低估的问题,提出DAW按局部维度重加权损失,显著降低长期自回归误差。

04:00
arXiv cs.LG

面向瞬态二维孔隙尺度流动预测与生成式设计的查询时框架

提出查询时框架CT-PoreFlow,基于7606结构基准,实现瞬态流动预测与逆向设计筛选,精度高。

04:00
arXiv cs.LG

基于变分推断的联合因果结构与聚类发现

提出基于变分推断的联合聚类与因果结构发现方法,利用类别和伯努利分布近似后验,在合成与真实数据上验证有效

04:00
arXiv cs.LG

FreKoo++:面向时序域泛化的连续频谱动力学学习

提出FreKoo++连续频谱动力学框架,融合模态分解与自适应频谱解缠,应对多尺度漂移和不规则采样,达最优性能。

04:00
arXiv cs.LG

风险敏感强化学习中的平滑分位数目标

提出UCB-BQRL算法,用下缓冲分位数平滑目标实现风险敏感强化学习,给出遗憾界与硬度结果。