MLLM-DataEngine:闭环多模态指令微调数据生成
提出闭环系统MLLM-DataEngine,自适应采样劣势案例并用GPT-4生成数据,迭代提升模型能力,无需人工干预。
重训练寻求稳定信号
存在稳定信号时,正则化重复风险最小化几何收敛至信号方向,模型影响大亦成立,揭示正则化控制表演性新作用。
DyneTrion:跨时间尺度蛋白质动力学的时空一致生成模拟器
DyneTrion:三重注意力生成模型,高效模拟蛋白质动力学,保持时空一致性并再现自由能景观。
基于熵的特征的影响研究
熵特征能有效提升网络异常检测性能,减少误分类且计算成本低,适合轻量级应用。
基于Choquet积分的特征聚合提升网络异常检测
该框架通过自适应加权与增量特征选择,在保证精度前提下,准确率提升7%、数据量缩减77.5%,显著适用于带宽受限的实时入侵检测。
急诊科入院患者的主动住院床位请求
通过预测主动请求床位,平均住院时间减少30-70%,急诊停留减少6-15%,新闻供应商启发式效果最佳。
线性与逻辑回归中的仅预测蒸馏
仅用无标签数据蒸馏,混合教师与学生预测可降低岭回归风险,最优权重由小校准集估计。
针对突发干扰信道的闭环贝叶斯强盗编码器与GRAND接收机
自适应切换编码模式,结合GRAND接收机学习噪声模型,误块率降低一个数量级,学习瞬态仅数毫秒。
托勒密的等分点通过机器学习等同于通用动力学钟
利用机器学习构建通用动力学钟,将任意振荡等价为均匀旋转,揭示集体振荡等新规律。
通过扰动保持记忆压缩的快速可扩展卡普托分数梯度下降
提出两种记忆压缩机制降低Caputo分数梯度下降计算成本,保证单调下降与线性收敛。
语音识别模型上的自然后门攻击
利用日常自然声作为触发器,仅需5%投毒样本即可高成功率攻击语音识别模型,隐蔽性强且不影响正常性能。
可交换性下的统计证据聚合
研究可交换性下统计证据聚合,通过置换校准提升检验功效,支持序列与自适应聚合。
非线性多尺度物理信息学习的统计公式差距
证明了非线性多尺度物理信息学习存在有限样本公式差距,强残差复杂度下界与εN相关,变分能量复杂度上界与ε无关。
有界区分器下的分布检验
用有界区分器类测试分布,连接可测试学习、学习算法验证和结构分布测试,获得新结果。
SpeechGuard:针对语音识别模型后门攻击的在线防御
提出SpeechGuard在线防御管道,通过自适应扰动注入和时频掩码净化,有效过滤和抑制后门攻击。
动力学感知元模仿:泛化至未见机器人操作
DAMI框架融合元学习与动力学感知,从演示学习任务逻辑,实现未知任务泛化,实验优于基线。
哪些超参数至关重要?基于博弈论的可解释超参数敏感性分析框架
提出博弈论框架,用Shapley效应与帕累托前沿分析超参数敏感性,提供可解释洞察以指导优化与早期评估。
单次系统辨识的零一律
单次辨识存在零一律:要么无法由任何输入唯一确定系数,要么几乎所有随机输入均可,并提供了后验认证。
使用强化学习学习趋避任务:向量化仿真与基准
首次建立真实复杂场景下的机器人臂趋避任务基准,经并行化仿真实现高成功率,但表明DRL在真实场景性能下降,仍需进一步研究。
代码投毒属性推断攻击
提出首个代码级属性推断攻击(CPPIA),实现100%攻击准确率且不降低模型精度,计算轻量。
异构图神经网络对节点分类真的有效吗?一个因果视角
从因果视角分析,模型架构无因果效应,异构信息通过增强同质性和分布差异提升节点分类性能。
基于拉普拉斯最优传输的聚类感知匹配
提出拉普拉斯最优传输正则化实现聚类感知匹配,并引入RSC方法获得一致分区。
用于基因调控网络推断的深度与概率模型
本文提出PMF-GRN和GLM-Prior两个框架,结合概率推断与序列先验,实现网络的不确定性建模与跨物种泛化。
面向起点到终点飞行问题的MPC策略的Pick-to-Learn校准
本文展示Pick-to-Learn方法校准MPC策略,用于飞机航程问题,从400场景中选出2个,满足概率风险界4.8%。
利用黎曼流匹配从LHC数据学习标准模型结构
ShellFlow模型从LHC真实数据中直接学习标准模型结构,复现粒子质量和共振峰。
因果森林中的诚实性:何时有益,何时有害
诚实估计减少过拟合但增加欠拟合,异质性大时需多27%数据,应视为正则化而非默认选项。
AutoSpec:神经网络规范的自动生成
AutoSpec框架自动生成并评估神经网络规范,树算法划分输入空间,统计认证保证精度,F1分数提升达73%。
用可解释神经网络发现图动力学系统的可泛化控制方程
提出GKAN-ODE模型,在分布外图拓扑上精确发现方程,误差低两个数量级。
多边缘时间薛定谔桥匹配(基于未配对数据)
提出多边缘时间薛定谔桥匹配,从静态快照高效恢复高维隐藏动力学。
重新思考CLIP在无需训练的开词汇语义分割中的全局知识
GCLIP重塑注意力和Value嵌入聚合全局上下文,无需训练提升开词汇语义分割性能。
面向能效去中心化联邦学习的时变混合矩阵设计
提出时变混合矩阵设计,最小化每节点最大能耗,平衡收敛速度,实验验证有效。
超图半监督学习分析
分析超图半监督学习渐近一致性,提出HOHL多尺度正则化,收敛到p-Laplacian及高阶Sobolev半范数,实验验证有效性。
用于下游预测的配置混合
提出CMP与MixConfig模块,自适应加权聚类配置,提升下游预测,尤其低数据场景。
SC-JEPA:稳定时间序列异常预测的潜在预测学习
提出SC-JEPA框架,用软码本瓶颈稳定潜在学习,多分辨率建模前兆,实现强早期预警。
二分扩散策略优化
提出DIPOLE算法,通过二分策略分解实现稳定可控的扩散策略优化,在强化学习和自动驾驶任务中表现优异。
中文标题:一种简单得令人尴尬的大规模正交矩阵优化方法
中文摘要:提出POGO算法,仅需5个矩阵乘积,高效优化大规模正交矩阵,性能远超现有方法。
越狱需要多少轮?多轮LLM评估中的动态预算分配
DAPRO动态分配预算,无分布假设下提供多轮交互事件时间更紧下界,降低方差。
DualKV:共享提示词闪存注意力机制,用于大规模展开和长上下文的高效强化学习训练
DualKV消除共享提示词复制,加速RL训练1.6-3.8倍,MFU从36%提升至76%。
因子化神经算子分解动态与持久响应
FaNO分解动态与持久响应,提升可解释性与泛化,在长时程、跨尺度预测中保持一致性。
密度信息伪计数用于校准的证据深度学习
揭示标准EDL混淆不确定性导致OOD过自信,DIP-EDL解耦预测与密度,提升校准与鲁棒性。
基于轻量级CNN的散裂中子源高压转换器调制器异常检测
轻量级CNN通过优化时序与通道处理顺序及自适应重加权,在高压转换器异常检测中达最优(AUC-PR 0.816, AUC-ROC 0.934)。
复杂振荡器网络中的不稳定性:网络度量与机器学习的局限与潜力
网络度量与稳定性关系敏感易变,机器学习预测局限于特定网络集合,无法识别不稳定的结构根源。
极小极大和贝叶斯最优的最佳臂识别
提出两阶段自适应实验,实现固定预算下最佳臂识别的小极大和贝叶斯最优,上下界严格匹配。
基于时空排列熵的增强型分位数回归神经网络用于复杂系统预测
提出集成了时空排列熵与增强分位数回归的混合预测框架,实现分布式系统长时故障预测,168小时准确率达81.17%。
高能物理分析中的预训练事件分类模型
基于图神经网络的预训练模型,在1.2亿事件上学习通用表示,微调后显著提升小样本分类性能,编码器通用而图处理层分化。
新兴无线应用中可靠AI的无标签概念漂移评估
本文提出两种无标签概念漂移检测器,利用表示学习与统计检验,在无线定位和链路异常检测中F1达0.88-1.00,优于经典方法。
中文标题
强化学习与模型预测控制在住宅暖通空调中的现场部署对比:RL节能20.9%优于MPC的18.1%,但初期影响舒适度,部署工作量少三分之一。
基于局部图结构的流形维度估计
提出基于局部PCA回归捕捉图结构的流形维度估计框架,含QE和TLS两种方法,性能优于现有技术。