流行病预测中如何(不)混合神经模型与机理模型
提出多尺度分解与受控神经ODE混合模型,应对非平稳动态,五数据集RMSE降21-63%,峰值检测最优。
量化基因组语言模型中的记忆化与隐私风险
提出多向量评估框架,量化基因组语言模型的记忆化与隐私风险,发现不同架构风险各异,需多角度审计。
TiMi:用多模态混合专家赋能时间序列Transformer
提出TiMi,利用LLM生成因果推断,经多模态混合专家模块融合文本与时序,免显式对齐,在十六个基准上达到最优。
ImplicitTerrainV2:小波引导的空间自适应神经地形表示
提出小波引导的空间自适应神经地形表示,高精度、低存储,训练快,支持连续查询与导数计算。
如何充分利用你的掩码语言模型进行蛋白质工程
针对掩码语言模型提出随机束搜索采样法以优化蛋白质性质,体外实验表明采样方法影响大。
概率程序合成中的似然作弊
强化学习训练语言模型编写概率程序时,可用未归一化分布虚增似然奖励;语法约束可预防,安全子语言有效抑制。
多类与列表学习的最优样本复杂度
证明多类假设类超图密度不超过DS维,解决长期猜想,确定多类与列表学习关于DS维的最优样本复杂度。
异步分类分布时序差分学习的有限迭代理论
研究异步分类分布TD的有限迭代,涵盖标量/多变量及折扣/固定视野,给出非渐近保证。
隐序老虎机
提出隐序老虎机,仅需动作偏好偏序,允许同状态奖励不同;给出UCB与后验采样法,优于全先验潜老虎机。
治心护脑:2.5D U-Net用于实时气体微栓子检测的可行性
2.5D U-Net实时检测心脏手术中气体微栓子,精度92.55%,召回率80.54%,推理0.12秒
分岔处学习的中心流形约化:循环神经网络中的干扰与丰富学习
分岔处学习几何呈低秩算子主导,神经正切核与费雪信息低维放大,解释损失突变与任务干扰。
迈向可逆遗忘:管理持续企业AI代理中的过时知识
提出可逆遗忘框架,设活跃、休眠、退役三态及再激活,减少过时知识影响而不永久删除。
利用批量推测雅可比轨迹加速视觉在线策略蒸馏
批量推测雅可比轨迹加速视觉在线策略蒸馏,仅替换学生轨迹生成后端,训练提速且生成质量不变。
物理中的安全域适应:克服干扰、标签偏移与模拟先验
针对物理模拟失配,提出自适应域适应,重加权模拟事件聚焦物理失配,并给出无标签模型选择规则,避免对齐到模拟先验。
SingularClip:防止谱坍缩以保持持续学习与强化学习中的可塑性
发现权重矩阵奇异值各向异性导致可塑性丧失,提出SingularClip定期裁剪奇异值,在持续学习与强化学习中效果优异。
在三人多数投票模型中用深度信念网络和双向GRU分类临界点附近的定向轨迹
DBN编码静态快照,Bi-GRU分类四种轨迹类型,实现接近完美分离,并实时感知动力学状态。
循环语言模型中循环计算的分配
提出MixerLoop方法:只重复混合器,FFN执行一次,计算量减少约46%,性能收益保留。
ChiroEcho:将蝙蝠叫声自动分类扩展到所学分类法之外
结合属级预测与地理分布,可识别未学蝙蝠物种,覆盖欧洲蝙蝠达四十一种(85%)。
ClosureBench:组合图推理的构造性基准
提出构造性基准ClosureBench,按需生成实例防止数据污染;前沿模型随图规模与查询深度下降,而程序合成方法保持高精度。
重新思考在线策略自蒸馏中的特权信息
研究发现,在线策略自蒸馏的性能提升并非来自参考信息,而是模型固有推理行为的恢复,参考信息无一致优势。
SIGMA:对称感知、智能几何多目标自适应控制,用于稳健可靠交通管理
提出SIGMA框架,结合大语言模型自适应调优与旋转不变学习,多目标控制信号灯,降低等待时间、提升吞吐量,并保证统计可靠性。
语言模型的交叉熵风险估计:不一致性必然稠密,留出法也不例外
语言模型的逐词元交叉熵风险无法一致估计,留出法亦不例外;稠密不一致性导致无估计量一致,两种出路各有代价。
KOALA:基于WiFi预测性人体运动的Koopman算子学习
KOALA利用Koopman算子将WiFi CSI噪声姿态映射到线性潜空间,实现无误差累积的多步预测,超越所有基线。
层很重要:持续学习正则化为何应逐层自适应
持续学习正则化应逐层自适应:遗忘分解为各层顶特征值加权和,对角费希尔权重无法体现,宜强保护浅层、放宽深层。
面向股票交易中稳定强化学习的自监督辅助任务发现
提出自监督框架自动发现辅助任务,利用广义值函数改进状态表示,并通过元梯度优化,提升股票交易的稳定性和绩效。
遗忘的几何:持续学习中的表征通量
提出表征通量度量表征位移并预警遗忘;据此提出FlowLess-R稳定表征,提升准确率、减少遗忘。
TransfHAR:面向按需活动识别的自监督腕部表示
自监督腕部预训练可迁移至细粒度活动识别,无需标签,性能超越全监督基线。
基于表格和序列出行属性的可行且新颖的合成人口生成
提出正则化两阶段生成框架,兼顾表格与序列出行属性,提升合成人口的可行性、多样性与新颖性。
逐坐标Adam中的二阶矩记忆
Adam的二阶矩记忆会抑制收敛:即使梯度噪声方差有限,长记忆也会在光滑凸问题上导致O(M_2^{-1/2})的平稳性下界。
在具备多物理场能力的AI助手MOOSEnger中部署前沿智能体技术
MOOSEnger部署智能体管道,大幅提升成功率:GPT版90%、Gemma版76.5%,远超基线。
跨有限同构符号域的操作级因果迁移的预指定构建-确认检验
千问2.5-7B上,预指定候选后继→前驱通过构建-确认检验及NNsight复现,仅限单一路径。
隐藏学习态动力学的纤维指纹
纤维指纹揭示:当前行为相同但未来学习响应可不同,故当前行为并非未来学习的充分统计量。
ReliaGate:低风险可穿戴压力预测的可靠性路由
研究可穿戴压力系统何时应显示预测而非改动。提出固定标签可靠性路由,用置信度、信号质量、异常度等线索门控输出。四数据集评估显示多数情况优于基线,提供不修改标签的操作框架。
消息传递的信息几何
自然梯度消息传递:变分推断平稳点处,边参数等于两端投影消息之和,保留可表示部分,优化不确定性校准。
先胜过计数器:时序图异常检测器的基线
提出无参数单特征基线,半数数据集上匹敌或优于SLADE,速度快23-133倍,全超IsoForest;复杂模型收益依数据集而定。
双编码器中绑定的局限
双编码器绑定失败源于激励与编码结构限制,而非维度或平滑度;可解析深度仅随维度对数增长。
面向对抗式多臂老虎机的二阶路径长度最优保证
证明Bubeck等算法在对抗性K臂老虎机中达到二阶路径长度最优遗憾,匹配下界至对数因子,并自适应去除参数已知需求。
非扩张映射的马尔可夫Halpern迭代的Banach空间理论
提出马尔可夫PAGE-Halpern方差缩减法,在Hilbert与有限维Banach空间中均达O(ε^{-3})样本复杂度。
检索引导的孪生融合与相似度感知对比用于分子-文本对齐
提出检索引导的孪生融合与相似度感知对比方法,增强分子文本对齐,性能优于基线。
多任务深度学习的算子理论泛化界
在向量值再生核空间用库普曼算子导出多任务深度学习的拉德马赫复杂度界,并分析布朗情形与跨任务算子学习。
打破压缩壁垒:通过反向再生的跨架构压缩边界学习
提出BRIDGE反向再生框架,先极度稀疏再选择性恢复关键结构,突破压缩极限,跨架构有效。
群体ICA 2.0:用Copula连接群体ICA弥合个体与群体潜分解差距
新算法CoLiG-ICA统一估计模板关联、群体特有和个体特有脑网络,提升个体成分独立性与临床异质性捕捉能力。
统一图神经网络:通过公共层方程
提出图神经网络公共层方程,以七组件统一200余种架构,分解信息传递与更新,揭示过平滑、异质性与表达能力等理论联系。
AdROD:基于超网络的自动驾驶对抗鲁棒目标检测
提出基于低秩超网络的对抗鲁棒检测方案,生成多样检测器并融合功能多样性,提升自动驾驶安全性。
NICE:通过噪声破坏实现图神经网络解释的尺度稳定扰动
提出NICE框架,用噪声破坏替代元素掩码,避免尺度漂移,提升图神经网络解释的可靠性与忠实性。
RagGAD:基于理由感知的条件高斯混合归一化流的无监督图异常检测
提出RagGAD,用条件高斯混合流分离稳定理由,将异常视为低密度区域,性能超越现有方法。
学习尚未掌握的,而非已经精通的:面向多奖励策略优化的饱和感知优势重加权
饱和感知优势重加权:按饱和程度动态调整各奖励权重,聚焦未优化目标,在数学、推理、代码任务上提升性能且保持已满足。
OceanLight:基于几何自适应非结构化网格表示的高效全球海洋预报
该框架采用几何自适应非结构化网格与图神经网络,实现高效全球海洋预报,精度超模型,显存降62%、算力降70%
基于化学反馈的红外光谱分子结构合理解析
针对红外光谱结构解析中候选结构不合理问题,提出FIRMPO,以分子式匹配和谱图一致性为化学反馈优化偏好,显著提升预测准确率。
行为是推理发展的不完整度量:跨表面前到达可及性与循环深度推理器发展推断的局限
行为阈值无法标识推理能力发展;行为达标前隐藏状态已可读出未来答案,行为、内部可及性与训练发展是三种不同观测。