人工智能的性演化:多代模型种群的群体遗传学框架
将多代AI模型视作种群,借群体遗传学解析有性/无性繁殖、模型崩溃与生殖隔离,框架可移植自生物学。
CoRe-MARL:未知动态下基于循环多智能体强化学习的协作再分配
提出协作多智能体强化学习框架,在未知动态下再分配应急物资,缩小区域服务差距并改善最差地区服务。
无标签引导:将测试时强化学习压缩进仅偏置子空间
冻结主干,仅优化约十万偏置,多数投票作奖励,MATH-500达76.67%,参数少7.6万倍。
跨配电网聚合层级的峰值感知短期负荷预测
研究配电网多聚合层级峰值感知短期负荷预测,Chronos-2高需求期表现最优且可实用部署。
ReDIL-GNN:面向电路图神经网络的再综合域增量学习
提出ReDIL-GNN与再综合适应指数RAI,实现电路图神经网络跨综合风格的域增量学习与部署控制。
基于蒙特卡洛规划的在线鲁棒强化学习
提出鲁棒MCTS,缓解转移动态与奖励分布不确定性,保证节点收敛,并在高不确定规划中表现稳健。
结构化马尔可夫决策过程中决策边界的几何理论
提出结构化马尔可夫决策过程的决策边界几何理论,以边界几何刻画策略重构的最小表示及复杂度,并给出统计保证。
弱化神经元:Transformer中具有超常影响力的输入—输出功能
GLU神经元输入输出余弦为负即弱化神经元,多现后期层,数量少却常激活、影响大,负门值时尤显。
模型选择需要多少标签?选择性预测的证书与预算
量化AUGRC模型选择标签预算:预标签下界与≤K−1证书,实测常需56–57%,预训练达68–91%。
当编辑流即是编辑跳跃:复现 Edit Flows 与 EvoFlows
Edit Flows 与 EvoFlows 实为同一编辑跳跃过程;作者开源通用抗体编辑器 EditJumps,并揭示隐藏的速率缩放参数与评测指标的敏感性。
重新审视分布式基于符号的方差缩减
针对分布式符号方法在异构数据下的偏差,提出服务器端无偏压缩跟踪全局梯度,取得非凸随机与有限和优化最优收敛率。
重新审视PPO中的评论家学习:理解与缓解价值扁平化
PPO评论家存在价值扁平化失效模式,源于隐式方差惩罚与冗余更新;对少数状态稀疏监督可缓解并提升策略。
WaveTLM:通过任务编译实现可靠的时间序列语言建模
WaveTLM将请求编译为类型化任务状态,契约有效覆盖率达99.40%,远超基线37.83%。
NeuroECG:基于ECGFounder的深度心电表征,用于心脏骤停后无需脑电的神经预后预测
微调心电基础模型提取床旁心电深度特征,融合临床变量,实现无脑电的心脏骤停后神经预后预测。
深度V学习的收敛性框架:误差传播与紧致的动作间隙界
建立深度V学习收敛框架,分解六类误差,在集中性下控制策略损失,给出动作间隙紧界与统计误差分配。
学习为机器学习编程自适应非局域可观测量
提出QFWP-ANO,用经典超网络按输入动态编程量子线路参数与非局域可观测量,预测与强化学习均超基线。
可解释多示例学习实现急性髓系白血病常规流式细胞术对关键分子改变的早期预测
可解释多示例学习模型利用常规流式细胞术,数小时内即可预测AML关键分子突变,且预测可溯源至细胞表型。
防止模型崩溃:Fisher-Rao视角下的合成数据训练动力学
基于Fisher-Rao几何分析合成与真实数据混合训练,给出防止模型崩溃所需人类数据比例的新下界。
跨LPBF离焦工况的IN718晶体织构强度:基于物理的预测、不确定性量化与决策
两阶段物理模型结合残差学习、适用性门控与保形区间,实现IN718 LPBF织构可迁移预测与决策。
专家混合语言模型中专家的高阶剪枝
HOPE二阶专家剪枝,建模专家间协同,50%剪枝率下优于REAP,复杂智能体任务增益达6.1%。
底层自动机:加性输入通路是 Householder 线性 RNN 中状态跟踪的寄生吸引子
删除加性输入项后,Householder 线性 RNN 能精确学会自动机并长度泛化;该通路实为寄生吸引子,会破坏并掩盖正确解。
StableEval Arena:面向稳定币价格稳定性预测的成本感知智能体基准
提出成本感知智能体基准StableEval Arena,评测稳定币脱锚风险预测,发现智能体结构化输出可靠却漏判多数严重脱锚案例。
变点感知世界模型:检测动力学突变并通过遗忘陈旧回放实现恢复的基于模型强化学习
变点感知世界模型检测动力学突变,遗忘陈旧回放并保留表征,突变后恢复远快于被动重训。
TwinMark:一种在特征与Logit蒸馏下可证明存活的统一水印
TwinMark统一水印用协方差投影和Fisher-logit双读出共享密钥,可证明抗特征与Logit蒸馏并经多任务验证。
FedGuide:面向异构联邦强化学习的扩散先验对齐与价值基线引导
FedGuide以扩散先验、OT-MoE聚合及DICE价值基线引导,显著提升异构联邦强化学习性能。
一个维度,没有刹车:自我知识限制大语言模型对有害同伴从众的过滤
多智能体大模型中,过滤有害同伴修正如判断原答案对错,受自我知识上限限制;应修正前补信息,而非事后过滤。
能力涌现可预测:逐种子、提前,具校准区间、经认证虚警与盲测预注册门控
grokking与小型语言模型中,能力涌现可逐种子提前预测;前序头形成时点预测归纳头,盲测虚警受控。
CompileRover:以三角色LLM驱动框架革新虚拟机编译器优化
提出三角色LLM驱动框架CompileRover,优化虚拟机编译器,显著提升性能并超越现有方法。
表格深度学习与经典机器学习在城市土地覆盖分类中的对比
对比经典机器学习与表格深度学习用于城市土地覆盖分类,树集成强,表格深度学习在非线性与不平衡下可更优。
GroupKV:面向长上下文扩散大语言模型推理的层次化KV缓存管理
GroupKV采用分组层次化KV缓存管理与预测预取,长上下文长度提升48倍,推理提速3.73倍。
LightSleepX:一种基于Inception的轻量级双模态睡眠分期网络
提出轻量双模态睡眠分期框架LightSleepX,融合Inception与Mamba,仅0.049M参数,EDF-20准确率85.9%。
RLLBC-Lib:面向强化学习与基于学习的控制的教学代码库
面向强化学习初学者,构建涵盖表格型与深度强化学习的教学代码库,并提供作业自动评分支持。
双下降是最小作用量原理
统计力学解释双下降:参数增多降低温度,能量均分使固定损失解偏向小范数,等效增强正则。
基于实验证据的自主实验室智能体配方开发
Andromeda 2智能体基于实验证据设计自乳化给药系统,紫杉醇配方命中率50%,中位AUC达70.1。
面向差异化按需配送的自动化仓储运营与最后一公里运输集成优化
AGV仓储与多式联运集成优化,强化学习调度使配送时间降29%~53%、距离降46%、准时率100%。
概率线性解释
提出统一概率解释框架,以稀疏锚定线性模型解释分类与回归,并给出MIP与IHT算法,性能优于LIME。
面向AI安全的数学:致数学家的邀请函
AI恐失控,需新数学构建可理解、可控、与人协作的AI;按数学分支梳理,各附入门开放问题。
历史依赖型日志记录下离策略评估的指数级困难性
历史依赖日志下,即使覆盖与揭示条件充分,离策略评估仍需随视界指数增长的回合数,该问题仍难解。
模型增长、递归与边界算子如何影响缩放指数
架构干预可改变缩放指数;递归、增长与边界算子提效,7.4B以约20倍少算力媲美GPT-3 13B。
面向可扩展材料设计与性质预测的鲁棒高效AI框架
融合图学习、多模态与生成模型,构建统一AI框架,实现数据高效的性质预测与可控晶体生成,降低计算成本
普惠临床肿瘤全基因组测序:万亿参数大模型本地部署于消费级硬件实现18小时端到端分析
单台消费级笔记本本地部署万亿参数大模型,18小时完成肿瘤全基因组分析,变异检测F1达99.62%。
信息论极限下的高效鲁棒学习
解决Blanc开放问题,给出多项式时间鲁棒学习算法,利用无遗憾学习器达到η+ε最优误差,并首次高效鲁棒学习高斯边际半空间。
利用可解释机器学习解析脂质纳米颗粒的肝外靶向
基于476种配方构建可解释机器学习模型预测肝外递送,揭示离子化脂质等关键设计规则。
FAME:一种基于FPGA的近似乘法器评估平台,采用模式引导的DNN重训练
FAME硬件实现近似乘法器,加速DNN评估,模式引导重训练恢复精度,最高加速3.47倍。
级联衰变中稳健共振质量回归的自监督学习
用VICReg自监督预训练Transformer,提升级联衰变共振质量回归的稳健性与峰锐度。
移动目标下Langevin动力学的Rényi跟踪界
LSI下给出移动目标Langevin动力学与LMC的非渐近Rényi散度跟踪界,并应用于连续Moreau包络的非光滑采样。
基于机器学习的中国西南自由簧乐器葫芦丝音色分析
用机器学习分析葫芦丝音色,发现分形相关维数最适于音高聚类,高音区混沌性最低。
特征零下导数Bézout反演与多点求值间的泛型等价
特征零下,典范Bézout对计算与任意节点多点求值/插值泛型等价(相差O(M)),并得Ω(m log m)下界;特征p失效。
样条KAN中的稳定性约束逼近:精确层平衡与预算相容饱和
研究样条KAN在逐层利普希茨预算下的稳定性逼近,给出精确层平衡、预算相容饱和及误差累积非假象。