11312 条条目 · 106 个活跃源
2026年9月28日
04:00
arXiv cs.LG

WorldTS:面向多模态协变量感知时间序列预测的世界建模

WorldTS以两阶段世界建模将多模态协变量融入潜在状态动态,在21个真实数据集上验证有效。

04:00
arXiv cs.LG

用于多维时间序列异常检测的融合物理信息预测先验的贝叶斯张量自编码器

提出融合物理信息预测先验的贝叶斯张量自编码器,利用张量结构与低秩分解提升多维时序异常检测。

04:00
arXiv cs.LG

非典型听觉下的音频情感识别

探索非典型听觉下的音频情绪识别,聚焦自闭症听觉过敏,以LoRA微调CLAP大模型,借效价—唤醒数据实现小样本情感泛化。

04:00
arXiv cs.LG

自监督表示学习:从光谱基础模型到极光发射光谱

用22.3万条无标注极光光谱预训练一维ViT,少量标注即恢复谱线强度比并超越监督分类。

04:00
arXiv cs.LG

我行动故我在:JEPA的动作条件何时足以学习因果机制?

探究JEPA何时能从观测中恢复潜在因果状态,提出条件似然与熵最大化的信息论目标及可识别性条件。

04:00
arXiv cs.LG

ALF:面向科学发现的主动学习框架

ALF是模块化主动学习框架,通过五个组件覆盖完整数据获取闭环,同时支持离线基准测试与在线真实部署。

04:00
arXiv cs.LG

面向冻结口袋条件分子扩散的预算化商残差引导

提出预算化商残差引导(QRG),无需重训,按采样步长在推理时注入距离、接触等商目标,提升冻结分子扩散生成编辑质量。

04:00
arXiv cs.LG

面向表格基础模型的注意力机制基准测试

构建可复现基准,评测多种注意力后端在表格行/列注意力上的吞吐表现,发现最优后端随硬件与维度变化。

04:00
arXiv cs.LG

动态张量重计算中的确定性机制切换与可行性反转

DTR模拟器中,内存预算微变即可致确定性性能骤变(开销差7.3倍)和OOM可行性反转。

04:00
arXiv cs.LG

面向输出头量化的 Softmax 重参数化

提出 Softmax 重参数化,量化前选取等效输出头,显著降低 W4/W2 量化 KL 且几乎不增推理开销。

04:00
arXiv cs.LG

渐进式记忆Transformer:面向时间序列的记忆感知注意力

以可写窗口记忆为Transformer暴露多尺度表征,用局部、中程、全局三级目标监督,低标签分类与预测表现优异。

04:00
arXiv cs.LG

不同损坏,不同信号:联邦数据质量中的不确定性与损失

联邦学习中,标签翻转靠预测损失,图像噪声靠熵不确定性;信号应与损坏类型匹配。

04:00
arXiv cs.LG

差分注意力解锁用于情感识别的脑电与语音互补融合

差分注意力抑制脑电噪声,实现脑电与语音互补融合,情感识别最高提升12.9%。

04:00
arXiv cs.LG

LUCID:混杂环境下时间序列的推断与发现学习

LUCID提出谱路由自适应去混杂层,可包裹现有因果发现算法,基准图F1达0.60,超最佳基线0.19。

04:00
arXiv cs.LG

更多传感器,只需一个场:重新思考持续时空预测

提出STFO,以共享场演化算子统一建模,借观测与查询接口适应传感器扩展,持续时空预测性能领先。

04:00
arXiv cs.LG

跨训练的可解码上下文状态与模型输出

追踪跨训练探针与输出:探针准确率随预训练上升,引导收益增大;信息论反例:错误可解码≠输出信息被弃。

04:00
arXiv cs.LG

评估KV缓存复用技术的准确性

现有KV缓存复用评估未准确衡量精度损失,数据集也缺乏复用动态;提出评估方法与Boxoffice工具。

04:00
arXiv cs.LG

桥接身体与大脑:基因驱动的形态—控制协同设计

受基因启发,以紧凑潜蓝图桥接身体与大脑,协同探索形态与控制,收敛更快、性能更高。

04:00
arXiv cs.LG

Brenier 邂逅对抗训练:鲁棒学习的最优传输几何

把惩罚型DRO化为传输映射优化,证明最优映射循环单调,据此提出两种对抗训练方法,鲁棒性优于基线。

04:00
arXiv cs.LG

迈向理解基于大语言模型的日志异常检测:性能、效率与鲁棒性的实证研究

基于三个日志数据集,实证分析LLM日志异常检测中适配策略、规模、量化与噪声对性能、效率和鲁棒性的影响。

04:00
arXiv cs.LG

Scaffold:基于支撑图理论的图神经网络稀疏化

提出Scaffold框架,基于支撑图理论联合控制扩张与拥塞,仅用10%–50%的边即可接近全图GNN性能,并降低内存与训练时间。

04:00
arXiv cs.LG

HySTAR:面向协作多智能体强化学习稳定信用分配的锚定超图

HySTAR锚定超图框架固定高阶价值分解基,分离自适应表征,缓解结构目标漂移,提升协作多智能体信用分配性能。

04:00
arXiv cs.LG

OPTQ 的泛化行为与正则化的作用

研究 OPTQ 与随机 OPTQ 的泛化误差界,揭示正则化 λ 的关键作用,并提出实验更优的 λ 选择。

04:00
arXiv cs.LG

NEXT:物理信息神经谱指数时间差分架构

NEXT融合神经谱表示与高阶指数积分器,线性刚性项精确积分、非线性项神经网络建模,对刚性正反PDE稳定精确。

04:00
arXiv cs.LG

新LoRA技能应只读不写

READ将LoRA适配器平衡规范化、单向耦合:新技能只读旧技能不写入,组合无推理开销,多基准超基线。

04:00
arXiv cs.LG

基于学习到的潜在贝叶斯跟踪的在线学习

AURA通过离线元学习低维潜状态空间,以扩展卡尔曼滤波实现高效精准的在线自适应。

04:00
arXiv cs.LG

BeatGraph:面向家庭环境婴儿心电图表征的自监督心跳图

提出以心跳为单元的心电图表征模型BeatGraph,自监督预训练,支持多任务,并发布首个公开家庭婴儿ECG语料库。

04:00
arXiv cs.LG

信任引导的决策Transformer

用下一状态预测误差与共形校准筛选可信上下文,再由冻结评论家选动作,缓解长程漂移并提升回报。

04:00
arXiv cs.LG

直接反馈对齐中的共模坍缩与恢复

DFA训练中误差共模致tanh单元饱和与学习停滞,减去批均值或校准读出层可抑制坍缩、加速学习。

04:00
arXiv cs.LG

权重对编码:在神经网络权重中诱导更小的文法

WeightPE将Re-Pair压缩器嵌入直通估计器,微调int8权重生成更小文法;ViT上文法缩至QAT的0.43/0.38倍,精度仅降1.9/1.1点,首次以文法大小为训练目标。

2026年9月26日
04:00
arXiv cs.LG

Stochastic Inertial Krasnosel'skii-Mann Iteration Achieves Near-Optimal Sample Complexity

04:00
arXiv cs.LG

Sequential Confidence Sets for Coverage-Constrained Conformal Model Selection

04:00
arXiv cs.LG

An Exposition of GPT Astra's Proof of Lower Bound on DP Continual Counting

04:00
arXiv cs.LG

Algebraic Expressivity Certificates for Shallow Polynomial Neural Networks

04:00
arXiv cs.LG

BRFID: Toward Byzantine-Robust Federated Intrusion Detection

04:00
arXiv cs.LG

An Order-Theoretic Characterization of Consistent Inductive Inference

04:00
arXiv cs.LG

Don't Read the Log: Execution Traces Contaminate Verifiers in Video-Generation Agents

04:00
arXiv cs.LG

Matrix Aggregation Operators

04:00
arXiv cs.LG

Exact Bayes Regret and Asymptotic Optimality in High-Dimensional Gaussian Bandits

04:00
arXiv cs.LG

HClimRep-Ocean: A Global Ocean Emulator on an Unstructured Mesh

04:00
arXiv cs.LG

When Fancy Eviction Fails: Rethinking Cache Replacement For LLM Prefix Reuse

04:00
arXiv cs.LG

CrossSafe: Towards Cross-Embodiment Latent Safety Filters

04:00
arXiv cs.LG

Unmasking Shortcut Learning in IoT Intrusion Detection: A Forensic, Multi-Paradigm Evaluation of Feature Dependence and Data Leakage

04:00
arXiv cs.LG

Selective Inference for Deep Clustering in Latent Spaces

04:00
arXiv cs.LG

Uncertainty-Gated Exploration Noise Suppresses Task Collapse in Online RL Fine-Tuning of a Flow-Matching Vision-Language-Action Policy

04:00
arXiv cs.LG

Physics-Guided Multi-Objective Deep Learning for Ultrasound RF Data Interpolation in Resource-Constrained Imaging

04:00
arXiv cs.LG

Automatic Harness Evolution for Hardware Design Verification: Can LLMs Consolidate Gains Across Discovered Harnesses?

04:00
arXiv cs.LG

GeoDose-CP: Graph-Local Conformal Inference for Continuous-Treatment Earth Observation

04:00
arXiv cs.LG

Why Does Misinformation Propagate Faster? An Algorithmic Perspective on X

04:00
arXiv cs.LG

Same Bit Width, Different Outcomes: Post-Training Quantization of Text-to-Speech Across Architectures