几何约束的Kolmogorov-Arnold网络:通过Banach对偶学习边几何
提出几何约束KAN,逐边学习Banach对偶指数p,在符号回归中匹配或超越固定基,且抗噪性强。
泛化之前的通道化:以顿悟作为动力学探针
顿悟平台期权重衰减脉冲表明:强度排序先于可见泛化形成,决定泛化时间;测试损失壁垒消失,即功能选择的通道化。
VINCENT:跨药物疗效解释的验证交互网络
提出VINCENT框架,通过扰动验证药物分子对协同作用的解释,提升化学合理性与稳定性,优于现有方法。
利用预报时效与分辨率查询学习连续区域温度场
提出CSTF,以提前时间和分辨率为查询,灵活预测任意提前时间/分辨率温度场,偏差降低17%。
基于多尺度时间建模与稀疏混合专家的漂移感知多模态用户表示学习
提出漂移感知多模态框架,结合多尺度时间建模与稀疏混合专家,解耦多兴趣,三阶段训练,在社交数据上优于现有方法。
边缘稳定性如何阻碍联邦优化中的SCAFFOLD
联邦优化中边缘稳定性使SCAFFOLD对全局梯度估计严重退化,致其实际性能逊于FedAvg。
面向大核CNN移动高效逐点卷积的组共享低秩近似
提出组共享低秩近似,压缩大核卷积神经网络中的逐点卷积参数与存储,大幅降低内存占用,实现边缘设备高效部署。
当剪枝遇上可解释性:保持大语言模型中稀疏自编码器的鲁棒性
剪枝扰动破坏稀疏自编码器,中部层最敏感;激活感知剪枝更稳健,分层分配稀疏可降低困惑度。
DualOPSD:面向同策略自蒸馏的自适应特权教师
提出双策略交替更新框架,教师适应学生分布,提升推理准确率并减少截断。
频谱分配:Muon优于Adam的原因及改进
用频谱分配解释Muon优势,提出SAMuon以谱先验放大主体步长,优于Adam和Muon。
迈向时间序列解释的统一信息瓶颈框架
提出统一信息瓶颈框架,融合归因与反事实解释,生成忠实归因和稳定反事实,优于现有方法。
量子启发的驾驶行为建模
量子启发驾驶行为建模:密度矩阵统一表征不确定性时序情境,无监督识别自由流过渡拥堵三态,复现宏观现象支持预测
利用SCROLL预测多个可观测变量:随机动力学的评分训练不确定性
提出SCROLL:组合多可观测量的似然,借随机动力学可算真值,异方差系统上NLL最优且校准,成本低。
鲁棒曲线MoE:通过模式连接实现混合专家模型的多范数对抗防御
提出鲁棒曲线MoE,以低损耗路径连接范数专用模型,选择性专家化与部分更新,提升联合精度。
通用分子基础模型跨多种嗅觉任务迁移
单一嗅觉任务微调的分子基础模型,可迁移多种嗅觉任务,媲美或超越专用模型,3D表示区分对映体。
可扩展自监督学习用于含拓扑重构的配电网多相AC-OPF
提出Penalty+SLFS自监督框架,无需标签,快速求解配电网多相最优潮流,适应拓扑变化,误差小、速度快三个数量级。
TraceML:机器学习开发中人类与智能体规划的实证分析
TraceML实证显示:智能体规划狭隘,人类灵活调整;规划提示可缩小差距,但未能完全消除。
面向小区边缘功率控制的智能体自动研究:彻底重塑研究者的角色
智能体自动设计无线功率控制算法,81次实验达基准99.5%,推理成本降600倍,恢复可证明结构。
斯里兰卡茶叶市场目录的天气驱动价格动态预测
天气显著影响斯里兰卡茶叶价格;低地茶对降水日照敏感;分目录模型优于统一,LightGBM最佳。
基于证据的多模态人类感知心理跨诊断维度映射
提出临床在环基准,评估LLM从多模态证据生成B-HiTOP画像;两阶段预测改善自报证据,但被动感知下更保守,语义抽象成瓶颈。
能量形式全共形区域的共同中心几何与认证径向重建
研究能量形式共形预测区域几何:在对称及下界条件下,区域含公共中心且星形;对幂距离给出有界认证径向包络,适用于低维输出。
HCC+:认证注意力检索的双曲守护
提出HCC+框架,利用庞加莱球性质,为双曲空间注意力检索提供确定性保证,存储减少6.1倍。
EncoTESS:基于原始TESS光变的年龄敏感编码
提出EncoTESS时间序列基础模型,从TESS光变曲线提取年龄敏感编码,优于传统指标,用于恒星年龄推断。
超越词元:探究学习到的蛋白质表示中的高阶上位效应
新框架分离交互存在、可及性与功能恢复:交互感知编码提升二阶可及性,但无高阶优势;深度提升高阶恢复。
无海森高分辨率蒙特卡洛采样的改进分析
为非凸势建立HFHR动力学显式收缩率,改进ULD;算法总变差距离非渐近界与迭代复杂度均优于现有。
混合通道专家:静态稀疏支持与输入自适应混合用于逐点投影
MoCE以稀疏通道选择替代密集投影,成本降至k/C,性能不降且减少16.7%计算量。
面向可扩展局部生成建模的重整化群流匹配
提出重整化群流匹配按尺度生成数据以局部场近似全局结构计算量近线性且保持长程关联
用于分子电子结构的等变细胞层:桥接层上同调与E(3)-等变哈密顿量学习
提出等变细胞层框架,将哈密顿量映射为层拉普拉斯,用上同调刻画非键轨道与环离域,推广等变消息传递网络。
从因果合理性到因果可靠性:评估LLM作为校准的直接因果边分类器
LLM因果判断趋向过密且过度自信,一致性比传统置信度更可靠。
数据可预测性塑造Transformer训练中的威布尔权重尺度增长
训练前算双元熵D,可预测模型权重尺度增长:λ²-λ₀²=C₀+C₁(H_r-D)^0.59,相对误差5.7%。
核范数最小化IRLS的紧致支配与收敛速率
针对约束核范数最小化,证明调和平均权重为最优二次控制,给出IRLS全局线性和局部线性收敛速率。
临界深度均衡模型的响应重正化
提出响应重正化方法,控制临界深度均衡模型中的近奇异伴随放大,提升训练可靠性且保留梯度信息。
用于预测性人类建模的解耦技能表征
提出SAIL,将技能建模为可解释多维表征,经反事实交换解耦,提升行为预测及AI辅导。
GAP-Prompt:高效持续学习的门控自适应提示
提出门控自适应提示法实例级动态融合与共享蒸馏抗遗忘多基准最优CUB-200达87.29%
保校准剪枝:压缩即可靠性契约
提出保校准剪枝,用非一致性梯度显著性,分离划分保持覆盖并缩小预测集,DBpedia效果显著。
利用几何不变稀疏自编码器发现大语言模型中的跨语言推理不变性
用几何不变稀疏自编码器探究大语言模型跨语言推理不变性,发现特征共享因模型而异,几何相似不等于功能可互换。
紧致黎曼流形上生成扩散模型的分化理论
提出紧致黎曼流形上扩散模型物种形成理论:以密度临界点分岔刻画,证明一般分岔为折叠型,揭示拓扑约束与分岔时间。
学习高效评分:基于Bandit的提示选择框架实现低成本大语言模型作文评分
提出多臂老虎机框架自适应选择提示策略,精度相当,LLM调用减少78.4%,首绘成本-可靠性曲线。
使用图可解释解释生成干预假设:G2I两阶段贪心框架
提出G2I两阶段贪心框架,将反事实解释转为可操作干预规则,并用DNF覆盖选择网络级干预,高效可解释。
AQLoRA:快速量化LoRA微调的零搜索方案
该方法CPU一次遍历,按量化误差保留顶层为半精度,免搜索免校准。比量化LoRA提速约一成,精度相当,内存略增。
PuzzleKV:面向KV缓存压缩的页级低秩分解
PuzzleKV逐页低秩分解KV缓存,免训练校准,60%存储保持96%,量化用18.7%保持93%。
FlowNeg:GFlowNet引导的知识图谱嵌入多样困难负采样
FlowNeg用层次生成流网络采样,负样本多样且困难,在KGE基准上平均MRR优于EMU和IF-NS。
启示控制
选择价格干预仅揭示影响决策的隐藏状态,区分信息价值与生产复用,提出决策充分启示与深度,并证明仅凭停止翻转风险无法保证正效用。
每层都关键:ReLU网络的指数级L2深度层级
证得每增一层可指数节省神经元:深度ℓ宽多项式即可,浅一层需指数宽,否则L2误差≥1/24。
UHI-Bench:跨多种气候区城市双源热岛建模基准
提出UHI-Bench首个双源热岛基准,评估20余模型;无统一最优,跨城迁移取决于热岛模式重叠。
去噪分数匹配的损失下限:来自薛定谔桥的Fisher几何
去噪分数匹配的额外损失为条件方差,等于Fisher度量迹沿轨迹积分,由薛定谔桥导出,影响模型排名。
GATNextHop:一种用于跨拓扑泛化的最短路径路由的图注意力网络
提出GATNextHop模型,以图注意力网络近似最短路径,跨拓扑泛化,合成图训练,真实ISP网络测试,并与Dijkstra对比。
MnemoDyn:从4万条fMRI序列学习静息态动态
提出基于动力系统的rs-fMRI模型,用约4万序列训练,多分辨率建模,计算高效,重建优于Transformer,适用下游任务与小样本研究。
XP-JEPA:面向可预测潜动力学的交叉预测物理锚定
XP-JEPA用物理轨迹锚定潜动力学,训练后仅需视觉,将漂移从0.361降至0.104,控制成功率提升至78.2%。
CoDrift:离线强化学习的组合漂移方法
CoDrift融合条件、边际、价值三个运动场生成动作,在离线及离线转在线场景的73个任务中平均排名最佳。