11852 条条目 · 106 个活跃源
2026年7月2日
04:00
arXiv cs.LG

中文标题:熵正则化概率门用于数据稀缺联邦学习中的稀疏模型发现

中文摘要:熵正则化门分布防止过早确定稀疏结构,在数据稀缺联邦学习中提升稀疏模型性能与泛化。

04:00
arXiv cs.LG

前沿大语言模型在平行物理世界中的物理素养测试

三世界测试显示,前沿LLM通过率低,存在定性定量不对称、法官不跨框架、自评弱等缺陷。

04:00
arXiv cs.LG

在Actor-Critic强化学习中评估、测量与控制评论员复杂性

通过谱有效秩熵衡量评论员复杂性,发现其与训练行为相关且可受控制,但回报效果因任务而异。

04:00
arXiv cs.LG

K-Inverse-RFM: 面向数据损坏数学任务、弥合与神经网络差距的改进RFM

提出标签变换方法,使RFM在噪声、不平衡数据中性能接近甚至超越神经网络。

04:00
arXiv cs.LG

EPC:用于测量LLM智能体系统中评估者偏好动态的标准化协议

本文提出EPC标准化协议,测量评估者偏好耦合现象,附带参考快照与开源代码,支持第三方复现与比较。

04:00
arXiv cs.LG

专有数据集保护的水印技术

水印技术提升生成模型训练成员测试可行性,高子集暴露下检测性能媲美传统方法。

04:00
arXiv cs.LG

评估前沿映射:跨十一个评估器-智能体条件的偏差-可靠性权衡实证调查

实验证实LLM评估存在偏差-可靠性权衡:低耦合度噪声高,高耦合度抑制多样性,GPT-4o版本漂移导致异常,无同时低耦合低噪声条件。

04:00
arXiv cs.LG

基于函数流匹配的量子分布生成建模

提出量子流匹配模型,利用自旋Wigner函数和函数流匹配学习多量子比特量子分布,准确捕捉物理性质。

04:00
arXiv cs.LG

SAOT: 具有结构感知最优传输的自监督持续图学习

通过最优传输和知识蒸馏保持全局关系结构,在持续图学习任务中准确率提升达15%。

04:00
arXiv cs.LG

PRISM:基于半监督域适应的优先通道重要性方法用于跨被试脑电情绪识别

PRISM通过通道权重分配与置信伪标签半监督域适应,解决冗余和个体差异,实现跨被试高效泛化。

04:00
arXiv cs.LG

TimeSynth:健康信号数字孪生的时间保真度框架

TimeSynth框架评估数字孪生保真度,揭示点态指标盲点,架构选择决定性能。

04:00
arXiv cs.LG

数据高效无监督RL学习可泛化技能策略

GenDa通过技能重标记和互补信息瓶颈,显著提升无监督RL的数据效率和泛化能力。

04:00
arXiv cs.LG

要有多早才算早?订阅流失预测中依赖设计的观察窗口充分性

早期行为提升流失预测,但窗口充分性依赖设计(45-90天拐点),声明需明确队列、目标与特征。

04:00
arXiv cs.LG

可解释编码器与学习型编码器在高基数欺诈检测中的对比

高基数欺诈检测中,实体嵌入AUC-ROC最高,与CatBoost相当;AUC-PR CatBoost领先,TabNet不及树模型。

04:00
arXiv cs.LG

群等变庞加莱卷积网络

提出群等变庞加莱ResNet,结合双曲几何与离散对称群,加速收敛并保持边界约束。

04:00
arXiv cs.LG

内核中的幽灵:通过领域泛化实现高效Transformer的上下文学习

线性Transformer通过领域泛化实现上下文学习,得到维度无关收敛率,指导激活与损失设计。

04:00
arXiv cs.LG

PAPA:在线个性化主动偏好对齐

PAPA无需参数化奖励模型,通过实时用户反馈直接优化扩散模型,实现高效个性化偏好对齐。

04:00
arXiv cs.LG

原型语言模型

PRISM原型语言模型通过稀疏非负混合原型,性能接近密集基线,实现快速数据归因与可解释修正。

04:00
arXiv cs.LG

Active-GRPO:面向分子优化的自适应模仿与自我改进推理

提出Active-GRPO方法,通过自适应模仿与强化学习切换及参考动态升级,提升分子优化性能。

04:00
arXiv cs.LG

从结构方程模型到双重机器学习:基于调查研究的鲁棒性分析

提出SEM-OLS-DML鲁棒性分析框架,检验调查研究中关系稳定性,附可复现模板。

04:00
arXiv cs.LG

MolSafeEval:用于揭示AI生成分子安全风险的基准

MolSafeEval整合毒性数据库与危害规则,通过知识图谱和大模型推理检测AI生成分子的安全隐患,覆盖四类生成任务,暴露安全漏洞。

04:00
arXiv cs.LG

Flow-Map GRPO:基于锚定随机组合的少步流图生成器强化学习方法

针对确定性少步流图生成器难以进行RL后训练的问题,提出Flow-Map GRPO,通过锚定随机组合引入随机性,有效提升模型性能。

04:00
arXiv cs.LG

基于标签影响传播的多标签节点分类

提出标签影响传播模型,通过构建标签影响图调整学习,超越现有方法。

04:00
arXiv cs.LG

决策导向的稀疏切线投资组合优化

提出端到端决策聚焦框架,用光滑top-k算子实现精确基数约束,直接优化夏普比率,在四个市场表现更优。

04:00
arXiv cs.LG

测量死方向:分解与分类规范对齐外的奇异结构

提出无降阶无对齐的死方向测量,从Fisher率恢复阶数并分类,验证于多种网络。

04:00
arXiv cs.LG

AdaBoosting文本提示用于视觉-语言模型

提出TPB框架,基于AdaBoost将文本提示分类器聚合为强集成,聚焦误分类样本,提升精度并跨模型迁移。

04:00
arXiv cs.LG

Loss Smoothing for Stable Adaptation Under Distribution Shift

04:00
arXiv cs.LG

带有限抽样违规的分布式在线强盗子模最大化

提出分布式在线子模最大化算法,实现次线性遗憾,并设计有界抽样违规方案保证累计违规次线性。

04:00
arXiv cs.LG

LLM引导的常微分方程发现与小队列聚合数据参数推断

AgentODE从群体汇总统计中联合发现ODE结构并推断参数分布,并在稀疏噪声数据中实现机制性结构发现。

04:00
arXiv cs.LG

检测不可检测:通过主动学习增强无监督时间序列异常检测

提出主动学习框架,以掩码重构和极小极大策略增强无监督异常检测,AUC提升12.39%。

04:00
arXiv cs.LG

MosaicKV:利用动态二维KV缓存压缩服务长上下文大语言模型

MosaicKV通过动态二维压缩实现长上下文LLM服务,达16倍加速和3倍内存节省,精度损失仅1.76%。

04:00
arXiv cs.LG

低预算黑盒优化的生成式精化方法

SPARROW算法解耦生成先验与奖励,利用固定采样器排名引导,低预算下有效优化复杂几何与不可靠奖励问题。

04:00
arXiv cs.LG

生成式元学习中的人机协作:模型与算法

提出人机协作生成式元学习框架GMHF,利用人类反馈引导数据合成,理论证明对齐人类信念可降低泛化风险,实验验证有效。

04:00
arXiv cs.LG

基于事件相关电位的脑机接口中,哪个指标反映拼写准确率?

研究发现Brier分数、MCC、ROC AUC等指标最能反映ERP-BCI拼写性能,建议采用。

04:00
arXiv cs.LG

采用时间并行采样加速离散扩散模型

通过并行化τ-跳跃算法,将离散扩散采样时间复杂度降至对数级,实验取得7-9倍加速。

04:00
arXiv cs.LG

面向视觉强化学习泛化的任务相关表示解耦

提出自监督任务相关表示解耦算法,通过三个组件实现SOTA泛化性能和样本效率。

04:00
arXiv cs.LG

从像素到时间相关性:为强化学习预训练学习信息丰富的表示

提出多尺度时间对比学习,建模时间相关性平衡像素注意力,生成信息丰富表示,提升强化学习预训练效率与性能。

04:00
arXiv cs.LG

局部运动至关重要:一种用于强化学习视频预训练的解构-重组范式

提出解构-重组范式,通过学习局部运动表示实现跨域迁移,显著提升机器人控制任务的样本效率与性能。

04:00
arXiv cs.LG

基于多信息源的约束贝叶斯优化

提出多源框架扩展约束贝叶斯优化,利用弱相关辅助数据高效探索可行域,实验优于现有方法。

04:00
arXiv cs.LG

基于机器学习回归的光谱分析定量始成土与氧化土碳氮含量:预处理、验证方法及特征重要性比较

利用NIR光谱和机器学习回归,通过SG滤波及堆叠集成模型,快速定量土壤碳氮(RPD>2.0),助力可持续农业。

04:00
arXiv cs.LG

Beyond Activation Alignment:The Alignment-Diversity Tradeoff in Task-Aware LLM Quantization

04:00
arXiv cs.LG

Valdi:价值扩散世界模型

Valdi结合端到端在线MPC训练与潜在扩散动力学模型,在CarRacing中单步扩散匹配MLP基线,发现多模态与控制的权衡。

04:00
arXiv cs.LG

海马:时空事件建模的统一基准框架

SEAHORSE框架统一基准测试时空事件建模,实现公平比较与诊断,合成测试揭示模型归纳偏差。

04:00
arXiv cs.LG

微分同胚优化

提出微分同胚优化方法,在数据流形上实现黎曼梯度下降,显著提升蛋白质设计性能。

04:00
arXiv cs.LG

面向癌症药物反应预测的可解释AI:超越单变量特征归因

提出ILLUME+可扩展事后解释框架,超越单基因评估,生成稳定基因重要性评分,恢复已知药物-基因关联并发现新分子信号。

04:00
arXiv cs.LG

模型生物彩票:模型生物可解释性强烈依赖于训练方法

模型生物可解释性强烈依赖训练方法,集成训练常降低可解释性,质疑其作为代理的有效性。

04:00
arXiv cs.LG

量子核赌博机优化中表现力与可学习性的平衡

提出投影与近似量子核,降低维度平衡表现力与可学习性,提升样本效率并减少计算开销。

04:00
arXiv cs.LG

GSRQ:面向亚1比特KV缓存的增益-形状残差量化

提出增益-形状残差量化GSRQ,解决质心收缩提升方向保真,1比特KV缓存量化准确率从11.34提升至33.54。

04:00
arXiv cs.LG

Aionoscope:调试时间序列表示中的潜在状态可访问性

Aionoscope揭示时间序列表示中粗细粒度可访问性不匹配:组件存在易恢复,但密度过程状态难提取。

04:00
arXiv cs.LG

LeNEPA:无增强的下一潜在预测用于时间序列表示学习

LeNEPA 提出无增强的下一潜在预测,在时间序列自监督学习中实现高效稳定表示学习,收敛快且跨数据集表现优异。