中文标题:熵正则化概率门用于数据稀缺联邦学习中的稀疏模型发现
中文摘要:熵正则化门分布防止过早确定稀疏结构,在数据稀缺联邦学习中提升稀疏模型性能与泛化。
前沿大语言模型在平行物理世界中的物理素养测试
三世界测试显示,前沿LLM通过率低,存在定性定量不对称、法官不跨框架、自评弱等缺陷。
在Actor-Critic强化学习中评估、测量与控制评论员复杂性
通过谱有效秩熵衡量评论员复杂性,发现其与训练行为相关且可受控制,但回报效果因任务而异。
K-Inverse-RFM: 面向数据损坏数学任务、弥合与神经网络差距的改进RFM
提出标签变换方法,使RFM在噪声、不平衡数据中性能接近甚至超越神经网络。
EPC:用于测量LLM智能体系统中评估者偏好动态的标准化协议
本文提出EPC标准化协议,测量评估者偏好耦合现象,附带参考快照与开源代码,支持第三方复现与比较。
专有数据集保护的水印技术
水印技术提升生成模型训练成员测试可行性,高子集暴露下检测性能媲美传统方法。
评估前沿映射:跨十一个评估器-智能体条件的偏差-可靠性权衡实证调查
实验证实LLM评估存在偏差-可靠性权衡:低耦合度噪声高,高耦合度抑制多样性,GPT-4o版本漂移导致异常,无同时低耦合低噪声条件。
基于函数流匹配的量子分布生成建模
提出量子流匹配模型,利用自旋Wigner函数和函数流匹配学习多量子比特量子分布,准确捕捉物理性质。
SAOT: 具有结构感知最优传输的自监督持续图学习
通过最优传输和知识蒸馏保持全局关系结构,在持续图学习任务中准确率提升达15%。
PRISM:基于半监督域适应的优先通道重要性方法用于跨被试脑电情绪识别
PRISM通过通道权重分配与置信伪标签半监督域适应,解决冗余和个体差异,实现跨被试高效泛化。
TimeSynth:健康信号数字孪生的时间保真度框架
TimeSynth框架评估数字孪生保真度,揭示点态指标盲点,架构选择决定性能。
数据高效无监督RL学习可泛化技能策略
GenDa通过技能重标记和互补信息瓶颈,显著提升无监督RL的数据效率和泛化能力。
要有多早才算早?订阅流失预测中依赖设计的观察窗口充分性
早期行为提升流失预测,但窗口充分性依赖设计(45-90天拐点),声明需明确队列、目标与特征。
可解释编码器与学习型编码器在高基数欺诈检测中的对比
高基数欺诈检测中,实体嵌入AUC-ROC最高,与CatBoost相当;AUC-PR CatBoost领先,TabNet不及树模型。
群等变庞加莱卷积网络
提出群等变庞加莱ResNet,结合双曲几何与离散对称群,加速收敛并保持边界约束。
内核中的幽灵:通过领域泛化实现高效Transformer的上下文学习
线性Transformer通过领域泛化实现上下文学习,得到维度无关收敛率,指导激活与损失设计。
PAPA:在线个性化主动偏好对齐
PAPA无需参数化奖励模型,通过实时用户反馈直接优化扩散模型,实现高效个性化偏好对齐。
原型语言模型
PRISM原型语言模型通过稀疏非负混合原型,性能接近密集基线,实现快速数据归因与可解释修正。
Active-GRPO:面向分子优化的自适应模仿与自我改进推理
提出Active-GRPO方法,通过自适应模仿与强化学习切换及参考动态升级,提升分子优化性能。
从结构方程模型到双重机器学习:基于调查研究的鲁棒性分析
提出SEM-OLS-DML鲁棒性分析框架,检验调查研究中关系稳定性,附可复现模板。
MolSafeEval:用于揭示AI生成分子安全风险的基准
MolSafeEval整合毒性数据库与危害规则,通过知识图谱和大模型推理检测AI生成分子的安全隐患,覆盖四类生成任务,暴露安全漏洞。
Flow-Map GRPO:基于锚定随机组合的少步流图生成器强化学习方法
针对确定性少步流图生成器难以进行RL后训练的问题,提出Flow-Map GRPO,通过锚定随机组合引入随机性,有效提升模型性能。
基于标签影响传播的多标签节点分类
提出标签影响传播模型,通过构建标签影响图调整学习,超越现有方法。
决策导向的稀疏切线投资组合优化
提出端到端决策聚焦框架,用光滑top-k算子实现精确基数约束,直接优化夏普比率,在四个市场表现更优。
测量死方向:分解与分类规范对齐外的奇异结构
提出无降阶无对齐的死方向测量,从Fisher率恢复阶数并分类,验证于多种网络。
AdaBoosting文本提示用于视觉-语言模型
提出TPB框架,基于AdaBoost将文本提示分类器聚合为强集成,聚焦误分类样本,提升精度并跨模型迁移。
Loss Smoothing for Stable Adaptation Under Distribution Shift
带有限抽样违规的分布式在线强盗子模最大化
提出分布式在线子模最大化算法,实现次线性遗憾,并设计有界抽样违规方案保证累计违规次线性。
LLM引导的常微分方程发现与小队列聚合数据参数推断
AgentODE从群体汇总统计中联合发现ODE结构并推断参数分布,并在稀疏噪声数据中实现机制性结构发现。
检测不可检测:通过主动学习增强无监督时间序列异常检测
提出主动学习框架,以掩码重构和极小极大策略增强无监督异常检测,AUC提升12.39%。
MosaicKV:利用动态二维KV缓存压缩服务长上下文大语言模型
MosaicKV通过动态二维压缩实现长上下文LLM服务,达16倍加速和3倍内存节省,精度损失仅1.76%。
低预算黑盒优化的生成式精化方法
SPARROW算法解耦生成先验与奖励,利用固定采样器排名引导,低预算下有效优化复杂几何与不可靠奖励问题。
生成式元学习中的人机协作:模型与算法
提出人机协作生成式元学习框架GMHF,利用人类反馈引导数据合成,理论证明对齐人类信念可降低泛化风险,实验验证有效。
基于事件相关电位的脑机接口中,哪个指标反映拼写准确率?
研究发现Brier分数、MCC、ROC AUC等指标最能反映ERP-BCI拼写性能,建议采用。
采用时间并行采样加速离散扩散模型
通过并行化τ-跳跃算法,将离散扩散采样时间复杂度降至对数级,实验取得7-9倍加速。
面向视觉强化学习泛化的任务相关表示解耦
提出自监督任务相关表示解耦算法,通过三个组件实现SOTA泛化性能和样本效率。
从像素到时间相关性:为强化学习预训练学习信息丰富的表示
提出多尺度时间对比学习,建模时间相关性平衡像素注意力,生成信息丰富表示,提升强化学习预训练效率与性能。
局部运动至关重要:一种用于强化学习视频预训练的解构-重组范式
提出解构-重组范式,通过学习局部运动表示实现跨域迁移,显著提升机器人控制任务的样本效率与性能。
基于多信息源的约束贝叶斯优化
提出多源框架扩展约束贝叶斯优化,利用弱相关辅助数据高效探索可行域,实验优于现有方法。
基于机器学习回归的光谱分析定量始成土与氧化土碳氮含量:预处理、验证方法及特征重要性比较
利用NIR光谱和机器学习回归,通过SG滤波及堆叠集成模型,快速定量土壤碳氮(RPD>2.0),助力可持续农业。
Beyond Activation Alignment:The Alignment-Diversity Tradeoff in Task-Aware LLM Quantization
Valdi:价值扩散世界模型
Valdi结合端到端在线MPC训练与潜在扩散动力学模型,在CarRacing中单步扩散匹配MLP基线,发现多模态与控制的权衡。
海马:时空事件建模的统一基准框架
SEAHORSE框架统一基准测试时空事件建模,实现公平比较与诊断,合成测试揭示模型归纳偏差。
微分同胚优化
提出微分同胚优化方法,在数据流形上实现黎曼梯度下降,显著提升蛋白质设计性能。
面向癌症药物反应预测的可解释AI:超越单变量特征归因
提出ILLUME+可扩展事后解释框架,超越单基因评估,生成稳定基因重要性评分,恢复已知药物-基因关联并发现新分子信号。
模型生物彩票:模型生物可解释性强烈依赖于训练方法
模型生物可解释性强烈依赖训练方法,集成训练常降低可解释性,质疑其作为代理的有效性。
量子核赌博机优化中表现力与可学习性的平衡
提出投影与近似量子核,降低维度平衡表现力与可学习性,提升样本效率并减少计算开销。
GSRQ:面向亚1比特KV缓存的增益-形状残差量化
提出增益-形状残差量化GSRQ,解决质心收缩提升方向保真,1比特KV缓存量化准确率从11.34提升至33.54。
Aionoscope:调试时间序列表示中的潜在状态可访问性
Aionoscope揭示时间序列表示中粗细粒度可访问性不匹配:组件存在易恢复,但密度过程状态难提取。
LeNEPA:无增强的下一潜在预测用于时间序列表示学习
LeNEPA 提出无增强的下一潜在预测,在时间序列自监督学习中实现高效稳定表示学习,收敛快且跨数据集表现优异。