StocBench:随机动力学生成建模的基准
基准测试随机流体生成:流匹配高预算最优,DPM-2低NFE最优,蒸馏法随机任务佳但控制任务差。
时间观测协议的反事实评估
未部署协议价值无法仅由无限数据确定;价值特定识别理论用有限校准数据控制选择遗憾,指导成本约束观测设计。
迈向语言模型头的第一性原理更新几何
将语言模型头与softmax导出更新几何:最大变化H倍行直径;约束直径最大化最小行距,得近似等距问题
基于高斯过程学习与流图细化的动力系统参数估计
提出两阶段框架:高斯过程学习获取先验,流图细化全局优化,稀疏噪声下参数估计更准确。
面向真实场景可穿戴与智能手机情感识别的自监督图表示学习
提出自监督图掩码增强与子图采样训练用于可穿戴/手机情感识别,少量标签即提升唤醒/效价准确率。
功能兼容性:持久神经学习的决定因素
功能兼容性因果决定持久学习,并可控泛化;应转向甄别可安全固化的新学习成分而非防止遗忘。
Dual-Scale State-Space Modeling with Speaker-Wise Dynamic CRF for Speech Emotion Recognition in Conversation
汽车发动机罩内板性能条件生成设计:基于代理性能估计的两阶段检索-生成流程
提出两阶段流程:先选可达拓扑族,再用条件变分自编码器生成点云,代理模型评估性能;但代理误差与区分信号相当,限制单件设计可信度。
图上的几何结构:基于和乐的曲率离散化
提出基于和乐的图上曲率离散框架,用三角回路的和乐对数构造曲率观测,并通过对称响应与协变散度聚合,保持正定性和规范等变性。
MASH-Bench:诊断大规模枪击风险分类中的跨源故障
四项美国数据库构建统一基准,发现特征缺失致跨源泛化失败,领域自适应仅部分提升召回率。
超越密集Adam状态:面向内存高效优化器的自适应对数空间量化
提出自适应对数空间量化,按块适配非负状态,存储降低74.7%,语言模型上优于基线,支持状态与拓扑感知。
追踪无标注风暴:拉格朗日大气JEPA框架中的跨变量迁移
用连续代理变量预训练JEPA,无需降水标签,迁移至降水预测,优于直接训练,达到集合预报水平。
SANE:用于稳定极端上下文Delta规则模型的状态异常中和
SANE用自适应tanh压缩防止Delta规则模型状态范数爆炸,超长序列仍推理,揭示容量稳定性权衡。
从对称性到不变性:学习有限域中的伽罗瓦等价表示
有限域乘法学习可跨基迁移。利用伽罗瓦作用划分轨道,预测该作用构造规范代表,在未见基上精确匹配实现迁移。
量子启发混合神经网络用于神经解码:可学习量子侧车集成的受控消融研究
量子侧车集成于ResNet-50用于31类神经解码,受控消融显示浅层结构最有效,骨干梯度训练略提准确率并改变表征。
从有害到有益:基于动态影响力的估值与编辑
DIVE在批次级动态估值,反转有害样本梯度化害为益,提升分类、数据效率和稳定性,适用大模型微调。
拓扑优化中的对抗性智能体:理解对抗扰动下基于深度学习与基于物理的设计模型的脆弱性与鲁棒性
深度学习代理模型对初始扰动脆弱,可致灾难性失效;物理梯度增强非鲁棒;物理在环恢复近基线,宜作验证初始化器。
遗忘算法的压力测试
提出WMDP++基准,针对现有遗忘评估缺陷,增加强制提取测试和边界问题评估,更严格地评估LLM遗忘效果。
临床图JEPA:用于认知决策支持的预测性患者状态知识图谱
提出结合多智能体关系提案、本体归一化、确定性证据评分和JEPA潜在细化的临床知识图谱框架,将图谱视为预测性患者状态表示,注入了出院记录的实体可提升31%的MRR。
BLADE:面向大语言模型遗忘的双层低秩增广拉格朗日擦除法
BLADE:双层低秩增广拉格朗日擦除框架,钳制熵与不对称拉格朗日实现稳健遗忘,三大基准提升6-9%,支持4倍扩展与连续遗忘。
GCA:联邦学习中的全局质心对齐
GCA仅交换潜在编码与质心,避免传输自编码器参数,通信成本最高降99.15%,抵御数据提取攻击,并提升准确率。
面向非表格任务的表格基础模型
表格基础模型TabPFN v3无需微调,仅以表格形式处理图像和文本分类,在MNIST、语言识别和Tiny ImageNet上有时媲美专用模型。
思维方差:策略方差、关键分叉与局部信用分配
策略方差决定信用分配与采样成本,受基尼离散度约束;bootstrap可降成本,支持对数价值参数化。
LpWM:世界模型中稀疏表示的理由
提出LpWM,用稀疏表示替代密集表示,降低预测器复杂度,提升规划性能并揭示可解释结构。
AstroPT对星系的认知,及其对大型语言模型的启示
天文图像模型显示:星系属性按已知难度顺序涌现,线性探针恢复物理结构,为语言模型解释提供受控测试场。
缓解金融欺诈检测系统中的解释泄露
提出新架构,仅对事后解释向量施加客户端级差分隐私,抵御成员推理攻击,平衡解释保真度与模型性能。
KMGen:一种基于技能的合成个体患者数据生成方法
提出KMGen框架,自动提取生存曲线并生成合成患者不良事件数据,准确且开源。
学习终端代理的可泛化行为
RL塑造高层决策而非新技能,验证器质量比环境数量更重要;River以少量环境提升多基准性能。
Mol-JEPA:一种用于分子的多模态联合嵌入预测架构
Mol-JEPA:利用模态掩码融合多源药物数据,学习分子世界模型,基准性能优异。
最大距离非负矩阵分解用于高混合粒度分布数据解混:AnalySize的推广
针对高度混合的粒度分布数据,提出最大距离非负矩阵分解,使端元尽可能不同,推广了AnalySize,有效解混。
基于稳定无限维线性函数逼近的Q学习
提出稳定无限维线性函数逼近的Q学习框架,通过压缩算子保证潜空间贝尔曼收缩,随机逼近算法收敛率达O~(n^{-1/2})。
脉冲神经网络用于连续控制:常规计算下的神经形态强化学习
提出脉冲actor的SAC变体SANSAC,在常规硬件上性能接近传统SAC,验证SNN在连续控制中的可行性。
MOSH-WM:掩码接地软哈密顿动力学的对象中心世界模型
提出掩码接地软哈密顿世界模型,状态由掩码支撑决定,视频预测精度在两项基准上显著提升。
自适应带宽学习:对数评分下的核密度估计
提出基于对数评分的摊销带宽选择框架,经截断重归一化与仿射标准化,在多样本任务中显著优于经典方法,尤其小样本异构场景,可直接用于未知密度。
近似同态与转换器中的收敛表示
证明线性与预测转换器在扰动下具有近似同态稳定性,误差随扰动线性;无结构限制则收敛失效。
从热偏好预测到自适应热干预:基于生理与环境感知的强化学习方法
提出融合生理与环境感知的强化学习两阶段个性化热舒适方法,克服传统HVAC静态设定局限。
基于混合重采样和堆叠集成技术及可解释人工智能的破产预测
提出混合重采样与堆叠集成框架,SMOTE-ENN提升少数类识别,GRU模型最优,SHAP解释风险因素。
机器学习与ARIMA模型平均在自适应公共卫生预测中的应用:比较评估与安大略省COVID-19案例研究
比较ARIMA、随机森林和XGBoost,提出MLAMA集成模型,多数情况下最优,建议依条件选模型。
神经PDE算子中的错误物理后门
提出跨参数重连数据投毒,制造物理合理但参数错误的“错误物理后门”,暴露验证漏洞。
食用油脂拉曼光谱的决策树与K-Means分析:一种物理信息人工智能方法
基于拉曼光谱的物理信息AI,决策树以4个变量实现食用油纯油100%识别,并高效解析复杂基质。
存储于优化器状态,由后续训练赋予价值:潜意识特质迁移的因果解释
优化器状态传播源扰动,后续训练决定其行为价值,构成潜意识特质迁移的两阶段机制。
共享物理响应恢复神经算子库中的隐藏排名
利用共享物理响应,无需真值即可排序神经算子库,恢复绝大多数偏好与最优检查点,且优于最佳候选。
BF1:面向高效长上下文Transformer的因果二进稀疏注意力改造
BF1稀疏注意力:局部+全局+对数块,32K加速10.91倍,改造Qwen3,困惑度最优
客户目标定位中特征选择的互信息与敏感性分析:比较研究
比较互信息与数据敏感性分析在银行电话营销特征选择中的效果:低误报率时敏感性分析更优,高误报率时互信息略优且降低成本,两者均有效。
牛奶中红外光谱的元聚类识别出与泌乳早期负能量平衡相关的奶牛群体
对40.7万条奶牛中红外光谱进行元聚类,得到五个与泌乳早期负能量平衡严重程度相关的奶牛群体。
当Graph-JEPA学错对象:诊断与修复类别条件坍缩
图JEPA在指标健康时学到无用表征:方差分配失衡。修复后指标饱和,但目标可约简,评估需谨慎。
当干净数据有害:二元分类之外的单调损坏学习
研究表明单调对抗可使多类及部分二元类不可学习;自适应添加数为o(n)时仍可学习,且下界紧。
Metag:构建智能体元审稿能力的数据集
Metag数据集:比对审稿前后论文差异,对齐评审意见与修改,辅助元审稿人快速核查作者回应。
Bern2Edge:一种通过伯恩斯坦多项式网络实现边缘部署的神经符号编译器
提出端到端框架,用知识蒸馏将教师网络转为伯恩斯坦多项式表示,支持LUT与符号规则双路径,精度提升且大幅降低延迟与资源消耗。
利用F2线性代数学习精确NVIDIA SASS编码器
提出F2Asm,用F2线性代数学习128位SASS精确编码,首个支持Rubin SM107的开源汇编器,往返测试完全匹配。