HybridInfer:面向端侧、边缘与云端大模型推理的热感知强化学习分层路由
以手机热余量和查询复杂度为状态,用离线Q学习在三层大模型间路由,实测质量优于手工启发式且成本最低。
离线策略评估作为设计自适应实验的决策支持工具
结合离线策略评估与热启动模拟,用A/B测试数据判断自适应策略何时优于固定分配并指导策略选择。
ENAS:面向资源受限微控制器上TinyML的高效硬件感知神经架构搜索框架
提出无GPU硬件感知NAS框架ENAS,专注微控制器TinyML,搜索更快、精度相当、峰值RAM更低
余弦相似度不是证据:测量量化下可解释性迁移的噪声底限
缺噪声底限,余弦相似度等尺度不变指标不构成证据;实测INT4方向旋转超噪声,INT8未检出变化。
平流感知图临近预报何时有效?——基于自监督云运动估计器的分布式太阳能爬坡预测受控研究
平流图未必胜静态/学习邻接GNN;运动矢量作输入贡献近半收益,仅位移vH在网内时有效。自监督云运动估计缩小约60%理想CMV差距。
为何裁剪在 AdaGrad 中至关重要?迈向广义光滑性下的高概率理论
广义光滑重尾噪声下,未裁剪AdaGrad会各向异性失准;裁剪可修复并保证高概率收敛和O~(ε⁻²)复杂度。
无需固定扩散的不动点:用于收敛测试时计算的隐式神经层
提出SheafDEQ,以自适应神经层实现唯一不动点,增强表达力并保证收敛测试时计算。
神经理想与神经编码:神经网络分类与特征解释的代数框架
提出神经理想与神经编码代数框架,解析分类特征,识别隐藏层神经元功能,MNIST验证并开源可视化工具。
面向中子监测器时间序列预测的季节性与量子启发模型
在LMKS中子监测器序列上,量子启发QiKAN多步预测误差最低,季节朴素基线仍极具竞争力,表明强周期先验可媲美复杂深度模型。
当预条件指数转为负值时:学习率耦合与跨环境泛化
预条件指数与学习率耦合:最优指数随对数学习率近似线性下降;负指数提升跨环境鲁棒性,源验证偏好正指数。
参数 vs. 上下文:面向鲁棒检索增强生成的 TRACE 微调
提出TRACE框架,用多智能体辩论轨迹与答案完整性正则,缓解知识冲突,提升RAG鲁棒性与答案质量。
基于图网络学习粗步长动力学与内部力学响应
提出Newmark-β-DGN图网络框架,从粗步长轨迹推断未观测力学响应并支持长期预测。
DanLing NestedTensor:面向深度学习的可组合多重不规则张量
提出 DanLing NestedTensor 张量抽象,使多轴不规则结构成为张量属性,免填充,兼容自动微分与编译,显著加速并降低显存。
分阶段深度训练:面向物理信息神经网络(PINNs)的表征课程
提出分阶段深度训练SDT:先训练浅层前缀并冻结,再加深度渐进精炼表征,多数基准误差明显降低。
NeuralCert:极值数学构造的认证式计算发现
提出发现到认证框架,用神经网络学习变分函数并精确认证,在三个极值问题上实现严格数学发现与证明。
Qwen3.5-0.8B 中关机响应的受防护梯度激活引导:最小步数策略
受门控的梯度激活引导可将部分关机回避改为接受,且不改变非关机决策,但效果小且高度选择性。
PALM:面向金融语言模型的时点适配
金融回测模型有前视偏差,无需逐年重训;PALM以低秩适配器拟合决策日前文本,冻结权重补充新时段知识。
基于对决反馈的成本感知最佳LLM识别
面向异构查询成本,提出对决反馈下成本感知最佳LLM识别算法,证明渐近最优成本,实验优于成本无关方法。
GAUDI:用于校准空气质量时间序列插补的几何感知扩散模型
块状缺失下采用几何感知条件扩散插补,在ItalyAir上RMSE达0.340,优于CSDI基线。
策略性自洽
不诚信提供商可利用自洽性策略重排额外推理路径,使多数投票看似必要,在多领域基准中超额收费并规避审计。
从弱数据到强策略:Q-目标实现可证明的上下文强化学习
提出QTPT,以Bellman式Q目标替代行为克隆,提升弱数据下上下文强化学习的鲁棒性并具理论保证。
基于地理空间人工智能(GeoAI)的电动汽车充电站选址
融合VAE与GCN的GeoAI框架预测充电站选址,F1达0.87,识别27个候选点并评估两种政策情景。
基于因果激活引导的大语言模型自适应多值控制
AIMES以中间层词表读数为在线观测,逐解码步自适应调节多价值激活干预强度,无需额外训练估计器。
导师式解码:更快推理遇上 Boosting
提出导师式解码,连接有损推测解码与Boosting,证明可加速推理且提升质量。
假新闻理论:借助学科洞见进行计算建模、检测与解释
融合多学科理论,将假新闻说服传播机制转化为可测量特征,实现可解释检测,多特征组合通常更优。
审计 System-1 模型在生物安全相关基准上的表现:非生成式模型的校准、选择性预测与排列不稳定性
审计商用System-1模型的生物安全基准校准与选择性预测:准确率依赖任务,选项顺序致37.4%答案翻转。
RAZOR:修剪大语言模型中的可替换专家
RAZOR:免训练专家剪枝,用共识残差评估可替换性,多模型多预算下性能领先。
面向鲁棒多模态情感分析的可靠性感知跨样本增强
提出RCE框架,利用不确定性建模与跨样本高置信校准,提升噪声和缺失模态下多模态情感分析鲁棒性。
利用基于深度学习的形态学图谱改进分子-形态对比预训练
深度学习细胞图像编码提取更丰富形态图谱,改进MoCoP对比预训练,提升QSAR、毒性和ADME预测。
矩引导的边采样
提出基于谱矩的矩引导边采样框架,高效量化局部边编辑对全局结构的影响,并可解释、改善图学习。
学习偏置:机器学习增强的粒子滤波
将学习到的提议分布融入粒子滤波,提出神经最优粒子滤波NOPF,提升样本效率与分布精度。
PolicyAttention:Softmax 注意力实现闭环控制的策略镜像下降
构建因果Softmax注意力闭环协议,迭代实现策略镜像下降,并用Transformer实证验证。
熵正则化:面向已验证示范的交叉熵免费修正
交叉熵与验证器风险失配;熵正则化约束策略支撑,ER-CE 提升数学和代码验证准确率。
联邦目标最大似然估计
提出首个联邦目标最大似然估计算法,含梯度聚合与本地更新两框架,通信误差可忽略,隐私非自动保障。
在储备池计算框架下对秀丽隐杆线虫连接组进行基准测试
用储备池计算基准测试秀丽隐杆线虫连接组,发现生物连接与仿生配置未必更优,随机对照常更优,且受配置与来源影响。
生产规模下的自动研究:失效模式与多智能体框架
生产级AutoResearch揭示五类失效模式,提出“预防-持久-重定向”框架,召回率提升1.82倍。
在线凸优化中带指示切换成本的动态遗憾
提出元学习算法,在指示切换成本下实现动态遗憾近最优界,无需预知比较器切换数或路径长度。
GyroNovo:面向从头肽测序的误差引导片段插补与质量感知注意力
GyroNovo利用解码误差引导缺失片段插补,并以旋转嵌入编码峰间质量差,显著提升从头肽测序精度。
对称正定流形上函数型数据的几何特征学习
提出MatFAE,从对称正定流形函数轨迹中学习动态表征,兼具可解释性,并用于fMRI分析。
求解下层非凸的双层优化,需要二阶平稳性
提出二阶平稳替代及PROBE算法,解决下层非凸双层优化,逃离鞍点且有限时间收敛,实验优于SOTA。
OpenHail:面向电动网约车车队控制的事件驱动 Gymnasium 环境
开源Gymnasium环境OpenHail,支持电动网约车车队的订单分配、调度与充电联合控制。
PixSim:分析师容量约束下即时支付欺诈、追回与拦截的校准开源模拟器
开源校准的Pix模拟器,在分析师容量约束下模拟即时支付欺诈、追回与拦截,并评估策略。
面向虚拟传感的神经算子节能运行
神经算子复用空间计算降低虚拟传感更新能耗,高频下省约20%,固定功耗下最高省22.5%。
QSV:用于球面格上耦合四元数注意力的四元数球面视觉
QSV以每token单位四元数替代QKV,在球面kNN图上耦合注意力与特征传输;消融显示传输关键,几何增益不明显。
小型语言模型网状网络中的通信强化学习
小型语言模型网状网络学习通信,置信度提示与修正、去中心化投票,提升推理准确率并抗合谋。
面向基于深度强化学习的入侵检测系统的可解释概率鲁棒性驱动通用对抗扰动
提出概率鲁棒性驱动的通用对抗扰动,用可解释性约束生成PX-UAP攻击DRL入侵检测,优于现有方法。
无需中心极限定理的稳定初始化
提出正弦激活网络的均匀相位初始化,摆脱中心极限定理、解耦各层;在图像/音频拟合任务上超越SOTA,支持μP宽度缩放。
浅层 ReLU 网络中的总体损失:偏置与临界点族
给出含偏置浅层ReLU网络总体损失公式(Owen T函数),证明伪极小值族扩展且损失严格下降。
交互式智能体中的因果保持:接口分解与选择性适应
因果保持要求冻结状态响应独立机制探测;接口分解与选择性适应可提升机制变化下的因果识别,而非仅任务充分。
语言模型中的上下文内绑定容量
语言模型上下文绑定容量随规模幂律增长,受预训练配方影响;干扰降低容量,任务训练超零样本外推但标准不同。