可证明安全的仿真到现实迁移
提出奖励无关安全强化学习框架,利用仿真器信息减少真实交互,同时保证安全探索与近似最优可行策略。
CATeye:面向优惠券滥用检测的耦合属性-拓扑不变性学习
提出CATeye,用双选择器应对属性-拓扑耦合偏移,学习不变表示,优惠券滥用检测F1提升8.61%
扩散作为无时间步迭代推理的训练课程
去时间步、加隐状态后,扩散可无限深迭代,数独与迷宫近乎全解;推理无需退火,扩散本质是训练课程而非采样。
通过Transformer变分自编码器学习稀疏决策树
提出一种方法,利用变换器变分自编码器将决策树映射至连续空间,联合优化预测性能与结构稀疏性。
利用幂律熵搜索高效估计最优超参数缩放定律
提出幂律熵搜索(PLES),按单位算力削减缩放定律不确定性,用不到十分之一预算即可估计最优超参缩放定律。
边围长:面向图神经网络的结构性边特征
以边围长(最短环长及条数)作结构特征注入GNN,ZINC-12k误差降三倍;恒定时仍限于1-WL。
分流框架:面向高效执行的三级路由与智能体引导
提出“轨迹即技能”的分流框架,按直接复用、技能替换、完整推理三档分流,零成本复用历史,令牌节省六成以上,越用越高效。
基于量子稀疏自编码器的认知诊断Q矩阵估计
首个将量子机器学习用于认知诊断的QSAE模型,稳定性优于经典自编码器,真实数据上9个数据集6个领先,主要优势是稳健性而非普遍精度提升。
NashDreamer:零和不完美信息博弈的基于模型强化学习框架
提出NashDreamer,用集中式MARSSM建模二人零和不完美信息博弈,显著提升早期样本效率,并具备纳什均衡收敛保证。
可复用神经基底的网络压缩数学理论
提出可复用神经基底架构,用共享基底线性组合表示网络块,实现高压缩和稳定训练,同参数下可建更宽深网络。
反思离线数据驱动优化中的可学习性
提出算法依赖可学习性,证明其充分性,并设计UGTL轨迹学习框架,在五个基准任务上取得最佳平均排名。
去中心化联邦学习中的拜占庭节点放置优化
提出拜占庭节点放置影响度量,优化其布局,揭示节点位置决定去中心化联邦学习攻击效果的关键作用。
已检索但未排序:从数学到智能体轨迹中结构检索的表层形式偏差
嵌入检索按字面不按结构:数学与轨迹任务中结构匹配检索近乎失败;重排器作用因领域而异,部分提升源于记忆。
ES-AHD:面向自动启发式设计的进化策略框架
将进化策略引入LLM自动启发式设计,用语义重组与温度采样实现定向搜索,高效生成优质算法。
LatentPress:超越文本与视觉的上下文压缩
提出LatentPress,将上下文压成连续记忆令牌,冻结解码器直接读取(免重建);4-16倍压缩仅训练适配器,精度优于文本摘要/OCR,且读写更快。
大语言模型中量化损伤的结构:为何下一个比特应花在全局粒度上
量化损伤呈分散分布,全局细粒度比局部修复关键层更有效,需因果干预判断精度恢复位置。
梯度-更新失配:重新思考物理信息神经网络的无冲突训练
提出GUA对齐更新至无冲突锥,解决优化器破坏问题。冲突率高达86.3%,L2误差最多降98.2%。
稠密弱隐藏:个体光滑性下非凸与PL有限和优化复杂度差距的闭合
个体光滑性下,证明非凸有限和优化随机IFO算法匹配下界,重启PAGE达最优;用稠密弱隐藏闭合复杂度差距。
AgentProv:通过工具使用策略探针审计智能体LLM API提供方
提出基于工具调用分布指纹的动作侧审计,100%检测模型替换,系统提示注入下误报率仅7%。
隐含波动率曲面生成模型的潜空间无套利几何
在潜空间刻画隐含波动率曲面生成模型的无套利容许集及边界,用于识别和修正违规潜码。
迈向智能体云工程:零信任智能体框架下的图工程与循环工程
提出智能体云工作流工程框架,分离图、循环与零信任执行,实现可验证部署或可审计失败。
基于去噪扩散的精确全局MCMC
扩散模型可作高维目标密度的全局MCMC提议,经MH校正精确采样,结合局部MALA构成DDMC,接受率高。
CompanionSim:用于评估人机关系中拟人化的合成数据
推出CompanionSim模拟2240场人机对话,发现陪伴行为反而降低聊天机器人的讨喜度、拟人度和信任感,女性和老年群体影响更大。
具有线性函数逼近与对数通信成本的可证明高效联邦强化学习
提出首个可证明高效的联邦线性函数逼近强化学习算法,达到最优遗憾界,且通信成本仅为对数级。
基于物理侧信道的工作负载识别用于AI治理
利用GPU功耗物理侧信道识别工作负载,区分训练、推理与非AI准确率97%,初步检测对抗逃避。
WiSDoM:基于混合专家的无线稀疏决策变换器用于多任务移动网络优化
稀疏决策变换器与专家混合的多任务无线优化,体验质量提升55%,仅用三分之一参数,能少样本适应新场景。
脑卒中运动想象解码中的脑电基础模型轻量化适配:域偏移与受试者级鲁棒性
低秩适配脑电基础模型可提升卒中运动想象解码;健康模型零样本迁移近随机,目标域需适应,且个体差异显著。
ERR+:顺序熵解析实现高效且果断的大模型推理
提出ERR+两阶段强化学习框架,利用推理中熵降奖励与长度效率优化,提升准确性和简洁性。
停止向量:将因果引导干预内化以实现高效推理
将因果可解释的“停止向量”内化到模型权重中,在保持精度的前提下剪除约四分之一冗余思考,且无需强化学习。
平滑Transformer前馈网络的曲率密码分析
利用黑盒二阶Hessian信息,少量查询即可恢复平滑Transformer前馈网络隐藏结构,并实现功能替身提取。
RankShift:数据库内类别漂移的检测与解释
数据库内检测类别活跃度变化,无需训练即可解释并告警,性能匹敌自编码器,可识别计数不变的稀有类别漂移。
保守混合图网络用于工艺系统的学习路由
CHGN学习路由、状态与移除率,嵌入固定输运方程保证质量平衡,零样本迁移至更大网络,优于GNN基线。
基于超球面测地线匹配的无监督潜空间对齐
提出超球面高斯对齐,仅依据潜空间几何匹配即可无监督对齐,无需配对数据,在模型拼接与多语词嵌入中达到监督性能。
语义ID推荐系统的离线策略评估:模型自身的代码层级有用吗?
语义ID推荐器的离线策略评估中,将物品粗化为代码前缀簇可降低误差,SID树便于实现,深度控制偏差界。
等变层束神经网络:学习图上的几何传输
提出等变层束神经网络(ESNN),通过边上的矩阵输运保持等变性,在多任务中优于现有方法,无需高阶表示。
通用编码计算的学习理论基础:掉队场景
提出通用编码计算(GCC),在RKHS中最小化端到端均方误差;掉队时最坏误差O(S^3N^-3),随机O(log^3N N^-3)。
SemKV:面向长上下文大语言模型推理、由质量悬崖引导的语义混合精度KV缓存量化
质量悬崖在2-2.322;SemKV按内部分数分配两种崖上精度,压缩6倍无统计差异,优化后7.9倍。
从损失景观到神经网络中的多样特征学习
本论文阐明并利用损失景观中的模式连接结构,推动神经网络的多样特征学习。
用于文本与多媒体数据的有效图及排序上下文嵌入
提出一种无监督框架,基于图和排序生成可解释嵌入,在文本与图像的检索、分类和聚类中优于基线方法。
混合语义上下文增强的集成学习用于风电爬坡事件预测与不确定性感知评估
将风机数据转为语义文本嵌入增强集成模型,预测爬坡事件;统计显著但增益小,外部数据验证有效,事件期间预测区间变弱。
Flow-JEPA:JEPA世界模型中用于鲁棒潜在动力学的流匹配
提出Flow-JEPA,用条件流匹配生成未来潜状态,替代确定性自回归,提升清洁和噪声环境下的任务成功率。
重新审视DP-SGD的可证明与可审计隐私差距
以经验隐私下界为优化目标,提出轻量防御框架,显著提升DP-SGD经验隐私且不损失理论隐私。
无连续性假设的 CVaR-UCBVI 近极小极大首阶遗憾
证明 CVaR-UCBVI 无需连续性,任意收益分布下达到 τ^{-1/2} 首阶极小极大最优遗憾。
V2TATC:面向空中交通管制员态势感知的语音-轨迹联合嵌入框架与数据集
提出语音轨迹联合嵌入框架,将管制指令与航迹映射至统一空间,支持双向查询,并发布配对数据集,助力空管态势感知。
NVE:一种感知可分离性与覆盖率的双聚类内部验证指标
提出NVE指标,用超双聚类归一化评估可分离性与冗余;变体惩罚小覆盖低错误解。实验表明其可补充一致性指标。
稀疏库普曼自编码器识别多盆地系统的局部动力学模态
稀疏库普曼自编码器通过稀疏隐变量识别多盆地系统局部动力学模态,无需标签,预测性能优于密集模型。
面向检索与图卷积网络分类的上下文感知可解释表示
提出无监督框架融合流形学习和可解释图嵌入,生成上下文感知稀疏自解释表示,降维并增强检索与GCN分类。
温度自适应的变换教师匹配
提出TTM的样本级逆温度自适应更新,通过最小化KL散度并利用曲率信息,提升蒸馏性能。
PokaiTrainer:扩展信念状态搜索至竞技宝可梦VGC
扩展信念状态搜索至宝可梦VGC,自研引擎应对复杂对战,胜率59%,Elo约1350-1400,峰值前500。
Titans-QFWP:一种面向投资组合优化的制度感知混合量子快速权重编程器
提出Titans-QFWP混合强化学习架构,结合量子快速权重编程与泰坦记忆,在S&P 500股票上表现优异,量子门控重塑记忆角色。