11652 条条目 · 106 个活跃源
2026年8月6日
04:00
arXiv cs.LG

面向铁路入侵检测与碰撞预测的6G通感一体化框架

基于6G通感一体化与CSI,3D CNN结合BiLSTM检测铁路入侵,准确率99.57%,预测位置、速度与碰撞时间误差0.424。

04:00
arXiv cs.LG

基于Sentinel-1时间序列的近海风电基础设施密集事件分类深度学习模型基准测试

十种深度学习模型对比,监督BiLSTM最佳,AUC升至0.8509,集成提升标签,分析全球部署时长。

04:00
arXiv cs.LG

注意力,异常!处理无监督联邦异常检测中的注意力层

提出引导式聚合解决联邦学习中记忆增强自编码器聚合缺失,提升非IID数据上异常检测鲁棒性,利于浅层模型。

04:00
arXiv cs.LG

基于地理空间基础模型的地上生物量估算

地理空间基础模型用于地上生物量估算:预计算嵌入优于冻结编码器,AEF嵌入训练模型超越监督SOTA。

04:00
arXiv cs.LG

观测校准自蒸馏的智能体强化学习

提出观测校准自蒸馏,用完整与去观测回放视图对比,分离未来观测专属信号,校准高不确定令牌更新,多任务超越基线。

04:00
arXiv cs.LG

MGSB:分布偏移下两相管道流动的流形门控签名分支压力域基线架构

提出MGSB架构,结合流形门控、粗糙路径编码与一致性正则,显著提升两相管道泄漏检测在分布偏移下的鲁棒性,OOD F1达0.783。

04:00
arXiv cs.LG

参数化偏微分方程的持续学习物理信息神经网络

提出持续学习物理信息网络顺序学习多参数偏微分方程任务结合贝叶斯选参与稀疏重放免观测数据提升泛化与精度

04:00
arXiv cs.LG

平稳模糊下的鲁棒控制

提出平稳模糊模拟训练,使隐状态滤波平稳、模糊不衰减,策略保持对潜在因子的鲁棒性,在真实市场数据对冲中表现优异。

04:00
arXiv cs.LG

结构化数据感知器学习的变分界限

针对高斯混合连续自旋感知器,用插值法和对数凹性推导变分上下界,两界仅优化顺序不同,匹配时得解。

04:00
arXiv cs.LG

SVI-DAG:一种面向贝叶斯因果发现的结构化变分推断方法

提出SVI-DAG,用结构化变分推断和归一化流建模边依赖,以斯坦变分梯度下降提升模态覆盖,不确定性量化优于现有方法。

04:00
arXiv cs.LG

渐进适应中的最优训练时间缩放

渐进适应中,最优每任务训练时间与任务数成反比,总训练时间恒定;过短或过长都进展甚微。

04:00
arXiv cs.LG

循环视觉Transformer的训练交叉点:循环、神经ODE与深度监督

固定循环ViT:算力受限选标准,参数受限选循环;高阶ODE求解器是架构偏差;深度监督增鲁棒不增精度。

04:00
arXiv cs.LG

自监督跨表征学习中的一致性驱动协同进化

提出一种一致性驱动的协同进化方法,用于图表、表格和代码的跨表征学习,无需标注,训练与测试时均可优化。

04:00
arXiv cs.LG

规范联合能量模型在CIFAR-10上的研究:失效模式与预测-校正和SGLD采样器的实际不可区分性

复现规范联合能量模型,发现两种失效模式;预测-校正采样器相比SGLD无优势,差异不显著,实际不可区分。

04:00
arXiv cs.LG

MALT:轻量级曲率感知的Muon优化器,采用对角预条件

提出MALT,用轻量对角预条件降低Muon对曲率各向异性的敏感性,并扩展MALTER;在GPT-2预训练中优于Muon,且内存和耗时相近。

04:00
arXiv cs.LG

EvolveNet:智能体自我改进的协同式框架进化

将经验提取移至数据端,共享框架广播至本地进化,仅聚合适应性修改,实现多智能体协同自我改进。

04:00
arXiv cs.LG

CheMLFlow:面向化学信息学与材料信息学应用的开源平台

CheMLFlow构建端到端可复现工作流,用于化学材料信息学,支持机器学习、基准测试与智能体交互。

04:00
arXiv cs.LG

优化策略学习来源:可恢复性感知的展开干预学习

提出可恢复性感知干预学习(RAIL),自适应生成更有效的展开数据,在有限预算下提升模型性能。

04:00
arXiv cs.LG

MultiPathFormer:面向多径无线传播的基础模型

提出以多径传播为预训练对象,自回归预测路径token,并引入环境检索增强与首路径码本,跨场景迁移优于SOTA基础模型。

04:00
arXiv cs.LG

基于广义分层抽样的随机仿真用于结构性能化风险优化

提出广义分层抽样与随机多项式混沌展开结合,准确估计响应尾部分布,减少非线性分析,用于结构性能化风险优化。

04:00
arXiv cs.LG

学习何时停止:用于连续控制的前缀最优动态扩散策略

提出POGP,学习前缀值函数,减少约2.7倍去噪步数,保持性能并提升最终任务性能约3.5%。

04:00
arXiv cs.LG

SpecRoll:面向推测式强化学习rollout的快慢验证器反馈自适应

提出快慢双路径自适应引擎,保持目标分布,生成提速最高2.15倍,端到端最高2.04倍,优于对比方法。

04:00
arXiv cs.LG

能力门控规划:目标代价发现与短视实验选择的局限

自动科学发现中,构建能力的行动虽无即时信息但开启未来路径,短视规划必败;提出CG-Plan以能力感知代价启发式求解。

04:00
arXiv cs.LG

SSTQ:基于子采样随机TurboQuant的隐私保护向量量化

提出SSTQ框架,结合过完备等范数紧框架与子采样,实现本地差分隐私下最优均方误差,通信仅需少量比特,在联邦学习中优于基线。

04:00
arXiv cs.LG

病理生存模型中考虑删失的共形下预测边界的多队列验证

多队列验证删失感知共形下界:drcosarc性能因队列而异,半合成场景覆盖率为0.91。

04:00
arXiv cs.LG

利用机器学习洞察量子热力学熵

用机器学习分析单粒子量子发动机,发现其机制与经典不同,插隔板成本关键。

04:00
arXiv cs.LG

当更多反而更少:语言模型中与位置相关的重复效应

完形探测表明,重复词效应取决于读出位置:紧邻重复使概率饱和,错位则呈倒U型,跨模型语言稳定。

04:00
arXiv cs.LG

损失不区分基底,Adam 区分

因子模型上梯度下降隐含低秩偏置,Adam因非规范等变而失去;共享标量预条件可恢复,坐标级方法破坏。

04:00
arXiv cs.LG

BnBERT-iPET:基于彩票剪枝的孟加拉语稀疏少样本语言建模

提出BnBERT-iPET,仅保留10%边即达90%稀疏度,少样本学习性能媲美大型模型,适用于资源受限的孟加拉语。

04:00
arXiv cs.LG

多模态时空大气数据同化与潜在流匹配

提出基于潜视频流匹配的统一大气数据同化方法,利用再分析先验和观测后验采样,实现滤波平滑及直接集合预报,性能媲美前沿模型。

04:00
arXiv cs.LG

从季风肆虐到市场浪潮:预测斯里兰卡渔业的韧性

连接气候与扰动,预测斯里兰卡渔业产量和价格,发现海洋与内陆差异及互补,支持决策。

04:00
arXiv cs.LG

DASyR-LLM:借助大语言模型进行领域感知的符号回归以实现动力学模型发现

提出LLM引导的符号回归框架,用于化学动力学模型发现,减少41.7-79.3%迭代,预测性能相当,R²>0.98,能有效注入领域知识。

04:00
arXiv cs.LG

奖励结构塑造强化学习中情景探索与神经记忆之间的交互

部分可观测强化学习,探索奖励与记忆的交互取决于奖励结构:同一信号可放大差异、拉平上限或无效;二者互补而非替代。

04:00
arXiv cs.LG

SiMDex:挖掘相似第一人称视频用于跨具身灵巧操作

SiMDex从3200万第一人称视频中挖掘约149万相似样本,助灵巧操作成功率升至61.1%,证明选择性数据优于随机混合。

04:00
arXiv cs.LG

通过相对熵最小变化原理统一量子测量构造

基于相对熵最小变化原理,给出量子测量最优解的闭式刻画,并发现软最小热测量族。

04:00
arXiv cs.LG

学习用多智能体视角偏好优化检测性别歧视

多数投票忽略标注分歧。提出MAP-PO框架,按标注行为聚类并微调多个大模型代理,结合个体与团队奖励,在EXIST数据集上更好保持不同视角。

04:00
arXiv cs.LG

当模态无法共舞:多模态对比学习中的保形后门检测

针对多模态对比学习后门检测,提出保形预测级联框架,两阶段非一致性分数识别中毒样本,高召回低误报。

04:00
arXiv cs.LG

邻域感知的双重生物医学实体链接

提出PILOT框架,融合邻域感知检索与双重重排序,在五个基准上达到最优且高效。

04:00
arXiv cs.LG

通过混合正则化,在多人一般和博弈中首次实现次对数交换遗憾O(nm²√(log m log T))。

提出混合正则化方法,在多人一般和博弈中首次实现次对数交换遗憾O(nm²√(log m log T))。

04:00
arXiv cs.LG

当心输出上限:预算机制改变测得的多语言推理差距

输出上限是隐藏变量,改变预算使推理差距摆动57点,归一化可扭转策略排序;应跨预算报告准确率,而非单点。

04:00
arXiv cs.LG

统计学习理论与奥卡姆剃刀:正则化

统计学习理论为奥卡姆剃刀辩护:正则化牺牲拟合换简洁,为获可靠性与可验证保证,非纯实用或本体论假设。

04:00
arXiv cs.LG

临床预后建模中二值化生存结局的代价

二值化生存结局丢失时间与删失信息;贝叶斯网络结合Cox似然可恢复特征,临床应默认用生存分析。

04:00
arXiv cs.LG

FM4WiFi:面向超越Wi-Fi 8网络密集部署中多AP协调的流匹配方法

FM4WiFi:流匹配生成式管道,一步生成协调空间复用配置,支持30+AP亚秒推理,性能超越基线。

04:00
arXiv cs.LG

隔离的代价:评估对称双边A/B测试的生态系统成本

对称隔离导致参与成本;重尾分布下成本不随平台规模消失,轻尾则消失;提供事前预估流程。

04:00
arXiv cs.LG

从金融情感分类到收益可预测性:大型语言模型的QLoRA基准

金融情感分类基准显示QLoRA提升性能,但收益预测信号微弱且校正后不显著,分类准确率不等于可交易性。

04:00
arXiv cs.LG

通过语义等价对抗攻击诱发大语言模型的内在幻觉

提出语义等价对抗攻击框架,测试LLM内在幻觉,最先进模型忠实度下降达50%,需增强鲁棒性。

04:00
arXiv cs.LG

基于联合核熵Gromov--Wasserstein最优传输的多模态对齐

提出联合核熵GW最优传输对齐框架,利用细粒度相似性,样本复杂度达n^{-1/2},并提升跨模态检索性能。

04:00
arXiv cs.LG

动力学李代数无法描述浅层QAOA:崎岖地形、贫瘠高原与经验难度模型

研究表明,动力学李代数无法描述浅层QAOA;贫瘠高原罕见,方差呈多项式增长(崎岖地形)常见,经验模型可预测其缩放类别。

04:00
arXiv cs.LG

TIDE:面向科学机器学习的物理多样化三维湍流基准数据集

提出三维湍流基准TIDE,15种配置;现模型略优于持久预测,误差为谱法两倍,点误差低不代表物理保真,泛化有缺项。

04:00
arXiv cs.LG

帮助音乐共创代理“听”得好:用于理解与生成的层级自监督世界模型

提出层级自监督世界模型,无标签学习音乐结构,结合条件流匹配生成,实现高效交互式共创代理。