MANCE:流形感知的概念擦除
提出流形约束假说,基于此设计MANCE方法,通过投影到数据流形实现更优的概念擦除,在文本和视觉119项设置中取得最优效果。
基于顺序的多阶段过程因果发现
提出OCDM方法,结合过程知识推断因果顺序,利用随机门控剪枝,高效发现多阶段过程因果结构。
知道何时停止:预测文本到SQL中的执行一致性收敛
提出轻量模型预测收敛点,动态决定停止时机,在基准和真实数据集上表现稳定可靠。
分类性能评估的统一代数框架
提出统一代数框架,涵盖多类分类设置,基于指示矩阵与聚合算子自动扩展二分类度量,并建立理论结果。
渐近保持的后验分析:扩散与流匹配采样器
确定了扩散与流匹配采样器中固定步长采样器的渐近保持性,揭示了噪声而非几何决定对数项,时钟决定稳定性。
奖励门控在线策略蒸馏
用奖励信号门控蒸馏过程,过滤教师误导,提升学生模型在推理和编码任务上的性能。
OmniOpt:现代优化器的分类、几何结构与基准测试
提出优化器统一分类与基准框架,通过五阶段元流水线和双维度分类法,系统分析权衡,指导选择与未来发展。
小数据何时奏效?朝觐和副朝人群状态分类中表格基础模型与传统方法的准确性与效率权衡
标签极少时表格基础模型更优,标签增多时调优传统模型反超;效率与准确率权衡取决于预算。
目标感知交互引导的强化学习用于图神经网络黑盒节点注入攻击
提出TIRBA方法,联合优化节点特征与边生成,利用目标感知和类中心引导,显著提升黑盒注入攻击效果。
FedSPM: 基于半参数混合的双重异质性下路由使能联邦学习
FedSPM提出半参数混合框架,建模客户端内子群异质性,通过经验似然提升联邦学习路由与预测性能。
针对因果和掩码语言模型的上下文学习统一框架
统一框架分析因果与掩码LM的上下文学习,得相同误差上界,实验验证掩码模型可比因果模型。
DynaVieW:模式引导的世界建模用于理解层次化视觉动态
提出DynaVieW模型,通过模式引导与混合专家架构学习状态-转换序列,联合预测与模拟,提升视觉动态理解与下游任务性能。
字典,而非达尔文:集合级选择在科学方程发现中胜过LLM进化
LLM进化循环无效,等价随机采样;PTB-Search一次采样+集合级选择,用1/10调用达73-77%准确率,远超基线49%。
多模态铁路道口安全分析
提出融合图像与事故报告的多模态AI系统,评估铁路道口安全,F1达0.757,与专家及官方评分一致。
高维空间中基于网格的近似最近邻搜索的缩放定律
研究网格ANN搜索的缩放定律,发现其在维度上保持恒定扩展指数,索引成本低,可指导Transformer成本分析。
基于领域知识的时空图卷积网络用于心电图识别
利用PRQST关键点的时空图卷积网络实现心电识别,F1达88.1%,罕见类别76.3%,优于现有模型。
从逼近到涌现:深度学习理论
从经典逼近到涌现机制,统一阐述深度学习理论的演进与核心问题。
IonSense-QKG: 面向锂离子电池数据集发现的量子就绪元数据框架
IonSense-QKG框架通过量子元数据与评分,助力锂离子电池数据集发现与筛选。
一种基于DNA甲基化的中枢神经系统肿瘤分类的新型机器学习方法
提出稀疏随机投影与多项逻辑回归的甲基化分类法,准确率达96%,较现有最优提升4-5个百分点,改善肿瘤分类可靠性。
受限API访问下LLM架构属性的黑盒推断
提出NightVision方法,利用通用提示和谱分析从受限API中推断LLM隐藏维度、深度和参数数量,表明现有API仍泄露架构信息。
I²RiMA:融合频谱黎曼表示与时序注意力的脑电心理压力检测
提出I²RiMA,通过频点协方差映射、频率聚类和切片注意力,提升EEG压力检测,准确率达82.78%。
多层Q矩阵嵌入神经网络用于认知诊断(M-QCDNet):结构感知的深度学习架构增强心理测量可解释性
M-QCDNet将Q矩阵嵌入神经网络,融合认知诊断可解释性,平衡预测与结构对齐,支持早期学习困难检测和掌握干预。
通过示例编程中的固定集鲁棒性:示例破坏与语义分区恢复
研究对抗性示例破坏,VPA防御仅在清洁语义投票余量时有效,低余量任务脆弱
如何分配你的令牌?训练步数与批次大小的缩放定律
提出包含模型大小、训练步数和批次大小的三项缩放定律,能用更少训练运行稳健拟合并恢复最优批次大小。
变压器模型应如何编码电子健康记录中的数值?
混合token方法(分箱投影)在稳健性与适用性上最优,临床获益取决于任务。
用于特征选择的条件推理树与条件推理森林
条件推理森林可有效用于特征排序,在基准测试中排名靠前,但计算开销较大。
NeuroBridge:桥接多任务MRI知识用于神经退行性疾病诊断
NeuroBridge利用多任务MRI学习框架,在阿尔茨海默病和轻度认知障碍诊断中达到高准确率,并具备强跨队列泛化能力。
自旋加权球谐函数实现完整且可扩展的E(3)等变网络
SpinGTP利用自旋加权球谐函数恢复反对称路径,实现完整可扩展的E(3)等变网络,在手性任务中表现优越。
编码智能体强化学习中的部署基础设施税
四种执行底座对比:冷启动延迟差110倍,工时差1.8倍,应优化底座作为训练系统部分。
几何感知的R结构科尔莫戈罗夫-阿诺德网络
融合R函数与KAN的几何感知网络,编码几何约束,测试RMSE降低67%,提升可解释性。
中文标题:论生物医学领域中剪枝混合专家模型的效用与事实可靠性
中文摘要:适度剪枝可保持领域内效用与可靠性,极端剪枝增加幻觉风险,跨领域时两者快速下降。
令牌几何
提出Ember优化器,利用令牌梯度几何特性,以O(V+D)显存替代Adam,提升预训练/微调/RL效果,并发现令牌优化轨迹为简单1D射线。
联邦学习中应对类别不平衡的类别分组归一化动量与加速超参数探索方法
FedCGNM通过分组归一化动量平衡梯度并降噪,联合XAB超参数探索,提升小规模联邦长尾分类性能。
面向两人零和不完美信息博弈中的策略表示学习
提出创建策略数据集、学习表示及下游任务评估方法,在扑克游戏中验证了有用行为表示的存在。
基于学习机载风估计的小型四旋翼飞行器风感知强化学习控制(模拟大气湍流)
两阶段学习管道:先风估计后RL控制,使四旋翼轨迹误差降低48%,强风中优雅退化。
别让收益衰减:剖析强化学习中的策略梯度权重
提出FADE方法,自适应优势函数加速训练并平衡准确性与多样性,优于静态基线。
揭示拜占庭鲁棒性下隐私对泛化的非单调效应
隐私对拜占庭鲁棒分布式学习泛化误差影响非单调:强隐私降低误差,弱隐私则增加。
KV缓存压缩的风险
揭示缓存压缩的极小风险与内在可压缩性关系,提供理论指导设计原则,实现最优风险。
多头递归记忆智能体
提出多头分区记忆框架MHM-LRU,解决长上下文递归记忆的覆盖瓶颈,显著提升保留率与精度。
推理的几何特征:任务难度的谱视角
提出有效维度d_rho衡量CoT轨迹复杂度,平坦谱对应更难任务;运动特征可早停预测正确性。
认证世界模型用作感知时钟:主动感知中的漂移感知截止期限
将模型有效期限转化为漂移感知时钟,在部署中减少异常违规,优于传统调度。
结构化数据的进化特征工程
EFE利用LLM进化自动发现结构数据预处理变换,提升时间序列和表格预测精度与可解释性。
X-LogSMask:面向图结构数据的扩展Transformer
X-LogSMask提出可解释对数结构掩码,直接注入图拓扑,实现多跳传播,在13个数据集上达SOTA。
重新审视带压缩通信的分布式在线凸优化
首次提出两种FTRL算法用于带压缩通信的分布式在线凸优化,全信息匹配现有界,赌博机设置显著改善。
CALM:从非配对数据中发现生物标志物的可解释跨模态对齐
CALM框架通过线性投影对齐非配对脑影像与遗传数据,发现可解释的脑区-通路关联,在自闭症中揭示免疫代谢通路与皮层区域联系。
WARP:通过权重空间分析恢复训练数据组合
WARP从微调模型权重恢复训练数据混合比例,通过权重插值与几何特征映射,误差低于成员推断方法。
SINA:基于人工智能的电路原理图图像到网表全自动生成器
提出SINA全自动管线,整合深度学习、OCR与视觉语言模型,实现电路图转网表,准确率96.67%,较现有方法提升2.72倍。
BOUNDARY_SYNC:多智能体LLM系统中通信引起的表征耦合测量
多智能体LLM通信导致表征同质化(CAF<1),组大小调节方向,耦合可被提示控制。
MKGR:面向冷启动蛋白质-蛋白质相互作用预测的多模态知识图谱表示学习
提出MKGR框架,融合蛋白质序列与四种生物知识图谱,利用桥接重建和门控模块,在冷启动PPI预测中取得最优。
DeadPool:零开销检查点热替换实现弹性LLM训练
DeadPool通过零开销内存检查点与热替换机制,实现无故障零开销、故障时40秒内快速恢复。