BattVAE-GP:长时程电池退化的生成建模与不确定性量化
提出BattVAE-GP,混合物理与概率学习,高效生成电池退化轨迹并量化不确定性。
面向MU-MISO系统中直接导频到波束赋形器设计的自进化上下文学习
提出无需重训练的自进化上下文学习框架,通过课程学习与失配感知扩展,提升多信道波束赋形性能。
面向稀缺神经数据的尺度感知注意力机制:基于睡眠-EDF脑电图的RG-Flow Transformer
RG-Flow Transformer在稀缺脑电数据上准确率与基线相当(77.3%),但能恢复频谱指数β,具备可解释性优势。
奖励何时教会状态?隐藏自动机工具与群语言边界
用隐藏自动机分离测量奖励与状态学习,发现高奖励不代表理解任务,状态恢复可先验预测。
构建的现实,有争议的先验:自由能原理下的解耦与认知复发架构
学习与接受解耦,混合训练后系统默认行为回退基线,表明认知复发是结构性失效而非学习速度问题。
可扩展的最优传输网络对齐算法
FastAlign框架通过稀疏感知最优传输实现高效网络对齐,保持精度,CPU加速3.9-9.5倍,GPU加速2.2-32.5倍。
加权k近邻回归与软标签预测的精确且经认证的数据夏普利值
首次提出加权KNN回归数据夏普利值的伪多项式精确算法与认证FPTAS,并给出复杂度下界与开源实现。
LIDAR-AD:面向自动驾驶的无解码器潜在交互梦境器与动作残差链
LIDAR-AD通过无解码器潜在对齐和残差动作序列对比学习,提升自动驾驶的风险感知与长时域决策性能,在仿真及真实场景中均超越基线方法。
图约束策略学习用于极端临床代码预测
图约束策略将极端临床代码预测转化为层次子集决策,在MIMIC-IV上优于扁平、级联和强化学习方法。
评估机器学习模型在早期慢性肾病预测中的可靠性:关于数据泄露与预测稳定性的系统综述
系统综述揭示数据泄露导致模型准确率虚增15.28%,超80%预测指标缺乏可靠性。
超越坐标规范:一种经审计的协议,用于检测神经坍缩后供体特异性功能指纹
通过仿射对齐和泄漏审计,发现神经坍缩后供体特异性功能指纹可被检测,20个配对全部正确识别(p=0.0083)。
信号引导的机器遗忘优化
GSUO框架通过细粒度引导信号优化机器遗忘,解决过度与不足遗忘问题,高效且效果优越。
PFAdapter:面向个性化联邦多模态大语言模型的分层LoRA分解
PFAdapter分层LoRA分离全局与本地参数,通信成本降50%,准确率提升2.4%-4.8%。
缓解具有层次与可靠结构的数据中的类别不平衡问题
提出层次感知RoBERTa框架,通过父类嵌入保持分类层次一致性,无需数据增强即达0.76 F1,优于过采样方法。
LiteTopK: 利用维度灾难实现长上下文稀疏注意力中的融合索引器-TopK内核
LiteTopK通过采样估计分数范围并在线分桶,降低I/O和内存,保持精确Top-K,加速稀疏注意力1.2倍。
基于基因表达信息的联合控制生成模型用于精准分子设计
提出JoPMol,融合基因表达、分子结构与化学性质,联合控制生成优化,性能领先,通用性强。
Transformer前馈网络神经元的稀疏层间依赖关系
FFN神经元激活可由少量前置神经元和注意力输出高保真保留,层间依赖稀疏且结构化。
学会离散化:基于扩散的自适应网格与频谱引导
扩散模型可学习根据物理和谱约束自适应生成网格,替代固定规则,提升偏微分方程求解性能。
使用动态图节点亲和度的机构股权持仓预测
提出NAVIS模型,在13F时序二分图上预测机构持仓权重,NDCG达0.9127,优于所有基线,揭示持仓强平滑性。
我们合并的模型对吗?专家训练时长对LLM模型合并的影响
专家训练时长与合并方法需联合选择:简单平均易过拟合,稀疏化方法在超最优步长后最佳,类似随机森林的偏差-方差权衡。
用于可解释分布外检测的稀疏自编码器
利用稀疏自编码器从中间层提取可解释特征,基于余弦相似度区分分布内与分布外数据,实现高性能且可解释的检测。
饱和使量化误差可加:一种带证明的覆盖模型
覆盖模型验证逐层效应解释了85-93%的损失方差,预测准确且分配性能优于其他方法。
面向联邦多模态大模型微调的弹性正则化与合成重放持续学习
提出FedCMM框架,通过模态感知弹性权重巩固、本地合成重放和任务相似性梯度聚合,三级防御灾难性遗忘,性能超越基线。
用于自动神经算子发现的代理型AI科学社区
提出代理型AI社区自动发现神经算子,在PDE问题中实现高精度低参数,99.8%混合化,LLM保障多样性。
从几何恢复到因果验证:稀疏自编码器特征的可重复审计——从叠加几何到因果惰性
复现发现,高达77%高余弦相似度的SAE特征实际因果惰性,提出因果审计工具并分解惰性类型。
遗忘注意力:具有可证选择与精确遗忘的可训练支持向量记忆
提出支持向量注意力,通过最大间隔记忆实现可证输出不变删除与精确遗忘,性能优于基准。
记忆增强推测:LLM智能体的无损加速
三种在线记忆增强推测器,动作预测准确率提升19-39%,观察预测提升2.5倍,实现无损零耗时加速。
邻近特征:Airbnb的隐私合规冷启动个性化
利用地理邻近聚类聚合用户信号,实现隐私合规的冷启动个性化,显著提升预订量。
通过交互感知的混合专家模型理解结构化健康数据
研究交互感知混合专家模型预测脑卒中后僵硬,发现视图间重要性差异显著,视图构建是可解释性的关键。
从繁多到精要:基于特征引导的零样本慢性肾病筛查——使用大型语言模型
大型语言模型利用少量临床特征即可进行零样本慢性肾病早期筛查,性能稳定且无需训练。
聚类加权EDMD
CW-EDMD通过软聚类和局部Koopman模型,显著提升预测精度,中位一步误差降低最高57倍。
ReDiTT:面向异步时间序列的检索增强条件扩散Transformer
提出ReDiTT模型,用检索增强条件扩散Transformer预测异步时间序列,稳定长时预测并提升多样性。
无穷小初始化下对角线性网络的梯度流动力学与隐式偏差
无穷小初始化下,对角线性网络梯度流等价于算法1,收敛到修改l1范数解,隐式偏差为修改l1范数。
非均匀地下地热换热器模拟的混合解析-物理信息神经网络模型
混合解析-PINN模型通过温度分解移除奇异点,学习校正项模拟非均匀土壤地热换热器,数值验证有效。
通过口袋条件扩散和性质感知优化生成具有可开发性的3D分子
提出conDitar-dev框架,结合口袋条件扩散与性质优化,生成兼具强结合与良好ADMET性质的配体,实验验证有效。
减少信息依赖性不会导致训练数据隐私。对抗性非鲁棒特征才会
揭示训练数据泄露源于对抗性非鲁棒特征,而非信息依赖;提出AT-AT方法实现更优防御与精度。
SinAE:面向跨域原子系统的单架构流匹配自编码器
SinAE以单一Transformer架构实现小分子、晶体、蛋白质的近乎无损重建与生成,验证跨域迁移。
相同损失,相同噪声,相反调度:噪声结构与优化器归一化共同决定学习率冷却是否有效
WSD冷却是否有效取决于梯度噪声结构与优化器归一化:SGD在乘法噪声下自衰减无需冷却,归一化方法产生噪声基底需冷却降学习率。
可微克隆结构因果图用于从图像序列端到端学习认知地图
提出可微CSCG模块,结合VQ-VAE,端到端从图像序列学习认知地图并鲁棒恢复拓扑结构。
量子端口-哈密顿神经网络:通过测量诱导非线性学习保守与耗散动力学
提出量子端口-哈密顿神经网络,利用测量诱导非线性实现结构保持的动力学学习,实验显示低能量漂移和高精度阻尼识别。
追踪、排序、攻克:认知工作记忆扩展语言智能体的多跳推理
SLEUTH用结构化认知工作记忆显式维护推理状态,解决上下文稀释,在多跳推理中优势随难度增加(最高+11),且推理组织方式比模型能力更关键。
探索多变量时间序列异常检测的零样本基础模型
零样本基础模型在多变量时间序列异常检测中效果不佳,但可用于变点检测。
基于PINN的带捆绑带降落伞悬挂绳展开力学分析
用PINN预测降落伞悬挂绳展开张力,效率精度优于传统方法,并分析捆绑带参数影响。
从原像搜索到基于源的特征反演
提出源基特征反演,利用局部网络几何修复反向信号,无需优化即可可视化特征,揭示模型内部层次。
PolarBM:用于在极坐标和对数极坐标中建模音频信号的复值玻尔兹曼机
提出PolarBM及LogPolarBM,显式建模复值信号幅度-相位依赖,音频建模精度超越传统模型。
Fisher秩膨胀:标签噪声下记忆化的谱特征
发现标签噪声训练中梯度有效秩先膨胀后收缩,峰值处噪声样本富集,可预警测试退化。
基于显著性时间编辑的在线手写对抗攻击
提出时间编辑攻击,通过插入/删除关键点保持手写形状,增强黑盒迁移性。
样本高效的分子设计生成优化
SEGO框架结合贝叶斯优化与生成模型,用极少的评估次数实现了高效的分子优化,性能领先。
优良性衡量的是什么?前向-前向学习的似然比解释
平方优良度为似然比检验充分统计量,可推广至各向异性与重尾;层间归一化需去长度保能量,白化优度消除膨胀。
大型语言模型置信度的计算基础
答案logits满足统计决策置信度特征,可作为潜在决策变量读出,但复杂推理中不完全,为置信度提供计算基础。