利用R包autovi与Shiny应用autovi.web实现残差图自动评估
提出R包autovi,用计算机视觉自动评估残差图并预测视觉信号强度,辅助模型诊断。
EERLoss:一种用于训练深度生物特征模型的新型损失函数——以击键动力学为例
提出可微近似EER的损失函数,在击键动力学基准上相对EER降低30%,收敛更快。
面向自进化就绪的工作流框架:专家LLM流水线的可逆迁移路径与可转换分类法
提出可逆迁移路径与三层次可转换分类法,将静态专家工作流重构为自适应阶段,实现反馈驱动的执行调整。
利用纵向BMI模式对慢性疾病患者进行亚型分类
基于BMI轨迹的机器学习方法对慢性病患者进行亚型分类,重新确认肥胖与多种疾病的关系并发现新特征簇。
扩展拟谱物理信息神经网络用于相场模型
ESPINN从瞬态快照数据反演相场模型,同时恢复体化学势与梯度系数,数据高效且物理一致。
使用适当评分规则对时间序列数据集进行模型选择
时间序列模型选择中,分数分布偏态致均值、中位数、均值排名冲突;大测试集下标准趋同,短测试集仅均值有效。
物理信息融合的傅里叶-小波变换器用于多尺度计算流体动力学代理建模
提出物理信息融合傅里叶-小波变换器,在多尺度CFD代理建模中实现最优精度。
Context-Aware Prediction of Student Quiz Performance with Multimodal Textbook Features
对于演化问题的非线性参数化解的带有惯性的Dirac-Frenkel动力学
提出带惯性的Dirac-Frenkel动力学,在弱信息方向保留历史速度,增强参数动力学适定性与鲁棒性,数值实验验证。
随机次梯度方法最终迭代的新界
凸Lipschitz目标下,最终迭代在i.i.d.噪声时误差O(1/√n),否则O(log n/√n),否定了相关猜想。
InSight:可引导VLA驱动的自主技能习得
InSight使VLA在原始动作层可引导,自动分解演示并获取缺失技能,无需人类示教即可实现持续技能学习。
XConv:用于卷积层的低内存随机反向传播
XConv以压缩激活和随机迹估计近似梯度,内存减半以上,无架构限制,精度接近精确梯度。
变分模型合并用于多任务微调中的帕累托前沿估计
提出变分模型合并贝叶斯方法,用灵活后验估计帕累托前沿,理论证明更优,实验验证效果。
图对齐用于图神经网络基准测试与位置编码学习
提出基于图对齐的图神经网络基准测试方法,生成难度递增数据集,用于模型排名与自监督预训练位置编码。
分布变化下的连续时间动态图的不变图表示
CIR框架基于ICCM模型,用NWGM近似干预,联合学习不变结构和时序,优于现有OOD方法。
任务向量基:一种统一且可扩展的压缩任务算术框架
提出任务向量基框架,将任务向量压缩为少量基向量,保持算术功能,降低存储计算,实验优于基线。
SEAL:搜索可扩展架构以实现增量学习
SEAL框架通过容量估计仅必要时扩展模型,结合NAS搜索结构与扩展策略,减少遗忘、提升精度。
最优模型树的实验研究
构建全局最优模型树(线性SVM叶节点),实验表明小树精度高,优于贪婪树,并探讨多变量分裂的影响。
通过逐层特征压缩与辨别理解深度表示学习
研究深度线性网络逐层特征压缩与辨别,揭示特征演化的定量模式,并适用于非线性网络与迁移学习。
Evaluation Metrics as Averaged Outcomes of Fair Gambles
基于偏差校正动量的加速随机极小极大优化
提出偏差校正动量算法,实现非凸强凹/PL极小极大优化$\mathcal{O}(\varepsilon^{-3})$复杂度,实验验证有效。
不耐烦的强盗:无需延迟即可优化长期目标
融合短期信号的贝叶斯预测模型与强盗算法,无延迟优化长期目标,A/B测试验证播客推荐显著优于对比方法。
ParallelBench:理解扩散大语言模型中并行解码的权衡
提出ParallelBench基准,揭示并行解码在强依赖场景下质量严重退化,需创新方法打破速度-质量折衷。
面向可控目标条件决策的混合序列建模与强化验证
提出混合序列建模与强化验证框架,并行生成候选动作并验证选择,提升目标回报对齐与可控性。
桥接机制可解释性与提示工程:梯度上升实现可解释的角色控制
提出RESGA/SAEGA,用梯度上升优化提示,实现LLM奉承等行为的可解释控制,准确率从79.24%提至49.90%
任何可子采样输入的二阶矩矩阵的私有近似
针对可子采样输入,提出差分隐私二阶矩估计算法,满足zCDP且递归保持高精度,抗离群值。
使用文本正则化和信号聚合稳定黑盒提示优化
提出TRAS框架,利用成功预测文本正则化和蒙特卡洛信号聚合稳定黑盒提示优化,在APO和APM中优于基线。
FISHER:多模态工业信号综合表示的基础模型
FISHER是首个多模态工业信号基础模型,采用子带建模和自蒸馏预训练,在19数据集上优于24个SOTA模型(小16倍),已开源。
FAIRVAR:通过方差正则化实现公平联邦学习
提出梯度方差正则化方法(FairGrad/FairGrad*),在异构数据下提升联邦学习公平性,保持甚至提高平均性能。
HyMaTE:一种用于电子健康记录表示学习的混合Mamba与Transformer模型
HyMaTE融合Mamba与Transformer,线性时间高效建模长序列EHR,捕获精细表示,实现可解释预测。
FuseSampleAgg: 预算约束下知识图谱刷新与验证的单遍邻域估计
提出FuseSampleAgg算子,单遍估计邻域均值,避免显式子图构建,加速2.24-3.48倍,节省GPU内存160倍,保证排序质量。
ATHENA:用于分层进化数值算法的智能体团队
ATHENA框架模拟科学研究,自主推导解析解、构建数值求解器,性能媲美专家。
面向缺失模态的多模态生存预测的证据融合网络
提出EMMS模型,基于Dempster-Shafer理论融合多模态,无需生成缺失数据,实现高效生存预测与校准不确定性。
迈向CSI原生基础模型:面向6G的信道自适应路线图
提出信道自适应路线图构建CSI原生基础模型,实现零样本泛化、尺度外推与高效推理,系统级评估显示导频效率与频谱效率显著提升。
冷球蛋白血症综合征的机器学习分类:一项综合比较研究
采用多种机器学习模型分类冷球蛋白血症综合征,随机森林与梯度提升树集成最优,冷球蛋白交互特征提升性能。
NeuroShield:一种设备无关的脑电图身份认证基础模型
NeuroShield采用双阶段Transformer从变通道长度EEG学习身份嵌入,跨数据集预训练微调降低等错误率0.44-8.06%,支持异构设备并开源。
CIExplainer++:为图神经网络生成因果可解释性解释
提出CIExplainer识别GNN因果子图,G2TeXplainer将其转为自然语言解释,增强可解释性。
巨量激活的架构鲁棒性:可控的暂存/提交残差流测试
残差流拆分后巨量激活仍在解码通道重建,证实其架构鲁棒性与功能性。
B[FM]²:基于流匹配与SplitUNet的脑基础模型
提出流匹配直接预训练原始脑电信号,SplitUNet解决时空不对称,用极少量数据达7/9任务最优,合成脑电图逼真。
ELADO:用于算子学习的椭圆偏微分方程评估数据集
ELADO套件揭示椭圆PDE算子学习中的重尾、谱偏移与输入敏感性等失败模式,导致预测精度下降。
CELEUS:基于E过程的可认证且高效的大语言模型评估
Celeus利用E过程构建任意有效置信区间,结合不确定性采样与代理近似,样本量减少54-62%仍保证覆盖有效性。
深度强化学习中发展性奖励计划的进化发现
提出进化框架发现动态奖励计划,在稀疏奖励任务中优于基线,但进化最优模式与生物发育顺序不同。
分组查询专家:GQA自注意力上的混合专家
GQE在分组查询注意力中引入混合专家,每token仅激活一半查询头,保持准确率并降低计算成本。
带学习可靠性信号的时序因果先验数据拟合网络
提出TCPFN模型,实现零样本时序因果发现并输出可靠性信号,在19个基准数据集上表现优异。
理解用于表格数据合成的潜在流模型:目标、路径和采样
研究发现速度/后验匹配效用高、分数/噪声匹配风险低,中点改进保真度,OT路径允许早停,提供实用配置建议。
Ω:基于算子的混合集成生成同化
提出Ω框架,融合条件高斯代理与无监督评分学习,无需真实样本即可高效重构非高斯后验。
MMGNN:多级多色图神经网络用于分子性质预测
MMGNN将分子图分解为原子对子图,融合拓扑与几何信息,显著提升分子性质预测性能。
使用混合Transformer-XGBoost框架结合天气、日历和COVID-19指标的新英格兰短期电力需求预测
混合模型预测新英格兰电力需求,发现COVID-19特征在疫情后成为噪声,加剧过拟合。
NNGPT自动机器学习流水线中的稳健训练:损失-优化器配对选择研究
NNGPT中无通用最优配对,交叉熵+Adam/AdamW最稳健,NGL仅适配自适应优化器,Adagrad/Adadelta需调参。
层状神经网络的分层池化
提出HiSP,基于局部谱粗化的层状感知池化框架,实现层级表示并分析粗化近似损失。