训练好的GNN中的局部证据与几何读出修复
线性规划分离GNN误差来源,重加权与平移修复可提升准确率,平移贡献更大;局部证据难选,放宽约束更有效。
大型推理模型推理阶段的能力与效率扩展
评估推理模型发现:规模扩大带来能力收益递减,推理效率几乎无提升。
学习对未观测混杂因素稳健的风险评分
提出未观测混杂下稳健风险评分学习法,以逆倾向加权为基础,融合敏感性分析与分布鲁棒优化,提升校准。
面向耗散系统的数据驱动离散时间深度循环神经网络建模
提出离散时间耗散循环神经网络DissipNet,通过结构约束和训练算法显式保证耗散性与稳定性,优于RNN和PINN。
面向共形椭球的尾部感知几何学习
提出尾部感知共形椭球几何学习,解耦尾部敏感与覆盖保证,用CVaR约束学习并共形校准,权衡体积与尾部严重度。
ZO-COSMO:面向去中心化零阶优化的无索引单跳混合
ZO-COSMO提出无索引单跳混合,用两查询估计与保均值掩码共识实现去中心化零阶优化,在Qwen LoRA等任务提升精度。
序列推荐系统中时间归因可解释方法的系统性基准评测
提出双模型掩码指标,基准评测十种可解释方法;梯度法归因最忠实稳健,原始注意力不可靠。
基于电阻曲率的可扩展子图采样
提出ERC-LG电阻曲率近似法指导子图采样,在七个节点分类数据集上六个精度最优。
ChipMEM:面向 EDA 智能体的验证锚定记忆
ChipMEM为EDA智能体提供验证锚定记忆,融合跨任务技能与贝叶斯指导,仅存验证通过技能,提升RTL并迁移未见任务。
fMRI 基础模型的规模缩放研究
万级GPU时实验显示,fMRI基础模型缩放需协同数据、模型与训练时长,算力本身不足以决定性能。
面向稀缺数据的谱连通性先验图学习
提出SCoGL,以拉普拉斯谱连通先验增强GLASSO,在稀缺数据下改进图恢复与图信号去噪。
发现、证伪、修正:审计智能体发现细胞模型中从源代码到预测贡献的输入使用主张
提出CELLAUDIT审计输入使用:高预测性能未必依赖扰动,证伪修正可恢复贡献。
面向在线自适应的贝叶斯神经网络全协方差平滑
提出全协方差贝叶斯神经网络平滑法,突破对角协方差限制,实现在线自适应且更准确。
将预训练大语言模型改造为高保真连续文本自编码器
提出LLMAE,借预训练LLM内部激活构建定长连续潜瓶颈,实现近完美文本重建,并可支撑潜空间扩散图像描述。
NGN:将神经网络规模作为可微计数来学习
NGN用可微边界为每组有序组件选激活前缀,边界随训练增长、部署时截断,将结构容量作为计数直接优化。
柏拉图表征假说中什么在收敛?结构胜于几何
校准后,关系结构在局部与全局均稳健收敛;度量几何收敛明显更弱,并在黎曼度量与视频文本中复现。
直播助手:学习在真实世界直播社交流中是否、何时以及向谁提供协助
提出直播助手,将是否、何时、对谁、说什么建模为决策;可选沉默、记忆或回应,建基准训练,效果领先。
SR-Fraud:面向非平稳支付欺诈检测的结果监督反思式LLM智能体框架
SR-Fraud以结果监督反思LLM解耦实时决策与离线适应,在支付欺诈基准提升检测并识别突发欺诈。
KITE:面向高效智能体 LLM 规模化的 KV 不变 Transformer 扩展
KITE 新增参数不影响注意力 KV,小模型扩为大模型,省训练与推理成本;SST 优于基线并降本。
生物多样性监测中的主动学习:从标签效率到可靠的生态推断
综述生物多样性监测中的主动学习研究,指出现有评估忽视验证标签需求,提出兼顾训练与可靠生态推断的路线图。
基于AUC界的无异常自优化
以AUC界为可微、无异常目标,直接优化异常检测系统连续参数,显著优于传统模型选择且对伪异常构造不敏感。
从保留-遗忘损失景观交互视角看量化鲁棒的遗忘
基于保留-遗忘损失景观分析,提出敏感度引导噪声正则化与遗忘关键层优化,提升量化下的遗忘鲁棒性并保持效用。
基于演化变分自回归网络的离散扩散模型
提出以演化变分自回归网络参数化归一化分布的离散扩散模型,扩展至高维伊辛系统并精确计算热力学量。
预测工作流基准:评估语言模型在预算受限预测工具下的决策
FWBench以1251个电力与单车调度案例,评估语言模型在预算约束下选择预测并决策的能力。
当标签稀缺时:用于振动诊断的振荡状态空间模型
提出紧凑振荡状态空间模型DualRes,融合双谱视图,仅3.9万参数,标签稀缺下振动诊断性能领先,更省算力与存储。
反事实约束条件化同策略蒸馏用于多约束指令遵循
CC-OPD通过逐一消融教师约束条件、以逐词概率差作奖励塑形,无需外部验证器,多约束指令遵循性能居首。
基于任务条件化潜在对齐的脑机接口跨会话稳定神经解码
提出TCLA,按任务条件对齐源域与目标域潜在分布,在多数据集上提升跨会话/跨被试解码鲁棒性。
学习看向何处:一种用于时间序列预测与PPG到生命体征重建的共享相对对齐模块
提出ROOSTER,学习目标-条件偏移的周期梳偏置,共享于PPG生命体征重建与时间序列预测,多项基准领先。
用于量子云编排成本与延迟权衡的量子强化学习
提出QRLQ,用参数化量子电路与D3QN调度量子云,兼顾成本与延迟,降本降延且参数少72%。
TNLearn:面向任务型神经元的开源 Python 包
TNLearn 是开源 Python 包,可自动构建任务型神经元与网络并顺畅训练,已纳入 PyTorch 生态。
基于聚类感知草图的高效线性赌博机
提出聚类草图线性赌博机CS-LB,簇内保留全协方差信息以确保次线性遗憾,每轮更新降至O(l²d),效率与遗憾兼得。
DCRL:通过策略-奖励流形对齐的解耦与耦合强化学习
提出DCRL框架,以逻辑提示演化与策略-奖励联合更新对齐流形,缓解奖励攻击,显著提升大模型推理性能。
VCMM:面向多模态学习的方差校准动量
提出方差校准动量VCMM,依各模态梯度噪声与漂移相对强度自适应调整动量,免额外前向,四大基准稳定提升。
PhyMo:面向多模态 AI4Physics 的物理场模态
提出物理场模态PhyMo,以PDE算子组织异构测量,三阶段学习,在多物理数据集上达最优。
能力流形与机器学习缩放定律
提出能力流形多维框架,将下游能力映射至预训练、后训练与测试时资源,统一现有缩放定律。
Step Law 是否适用于小规模语言模型?低于 59M 参数的实证重校准
低于59M参数重校准Step Law:幂律形式成立但系数不同,直接迁移会高估最优学习率约4倍。
ProCredit:从结果奖励到智能体强化学习中的进展信用
ProCredit在每回合后重跑验收检查,把可验证进展转化为逐步信用,提升长程智能体任务完成率。
隐藏而非删除:网络如何抑制纠缠特征
线性擦除会毁掉密集叠加中的纠缠特征;网络以镜像/影子解抑制非删除,标量补丁可恢复,解释LLM遗忘复现。
EBRL:基于多粒度资源管理的异步具身强化学习
EBRL是异步具身强化学习训练系统,通过异步流水线调度与细粒度CPU/GPU资源管理,吞吐提升1.3-3.47倍,收敛加速2.5倍。
面向大规模交通预测的局部异质性与跨区域上下文学习
提出LoReST,双粒度建模节点邻域与路网区域,融合局部异质性与跨区域上下文,预测精度显著提升。
后门留下结构痕迹:FedMAST用于联邦学习中的后门检测与遏制
提出FedMAST,利用结构、谱与历史痕迹检测并遏制联邦学习后门,平均ASR 1.51%,主任务准确率94.84%。
Pheno-GS:表型景观尺度的测地 Sinkhorn
提出Pheno-GS,融合图正则、非平衡最优传输与批量计算,高效计算大规模噪声数据的测地传输距离,500个分布提速超200倍。
带降噪与偏差校正的隐私保护去中心化优化
提出PRDO,以同批梯度差递归降噪,用精确扩散纠偏;非凸收敛不依赖均匀异构,查询灵敏度更低,实验精度提升。
FLEET:从 Logits 熵到文本生成中的增强轨迹
FLEET为LLM引入记忆,以稀疏轨迹调整logits,同精度提速3倍并提升复杂编码准确率。
基于风险敏感与评论家一致性正则化的鲁棒对抗强化学习
提出RACER框架,以风险敏感视角改进对抗强化学习,自适应调节扰动并正则化评论家一致性,提升鲁棒性与稳定性。
NS-ATTENTION:视觉Transformer中注意力输出的牛顿-舒尔茨变换
提出NS-Attn,无参变换视觉Transformer注意力输出,降低谱集中度并提升有效秩,多个模型和数据集上平均提升0.25-0.83个百分点。
MENO:内存高效的神经算子
MENO是基于流形函数编码器的PDE求解器,内存与分辨率无关,支持任意几何离散,泛化强、精度高。
极限核 Q(λ):弥合短视界与长视界
提出极限核Q(λ)离策略价值估计器,融合n步截断与极限核长视界近似,复杂度同n步,长视界任务优于基线。
表格基础模型在上下文中计算什么?通过注意力门控更新实现原位表征精炼
提出原位表征精炼:支持标签引导注意力门控更新并迁移至查询,表格基准超TabPFN-3。
全局树预测器在层级聚合上崩溃:基于五个面板的失效刻画
全局树模型预测层级汇总崩溃,最多低估496倍;按序列缩放、加权聚合行或季节差分可防。