随机神经算子用于参数化PDE:快速训练与共形不确定性量化
提出PCA-RaNN,结合PCA降维与固定随机特征线性回归,训练快1-3数量级,精度相当,支持共形不确定性
基于原型潜在世界模型回放的类增量学习
提出无记忆原型潜在世界模型回放,通过采样旧类分布状态和对比学习,显著提升增量学习性能。
使用物理一致性约束的科研仪器自监督校准
提出物理约束自监督框架,从原始数据联合学习校准与预测,实现仪器自校准与自监控。
Not All Objectives Are Born Equal: Priority-Constrained Descent for Hierarchical Multi-Objective Optimization
CRAFT:基于免费兄弟轨迹的反事实信用分配用于自蒸馏智能体强化学习
CRAFT通过反事实令牌重要性、非对称控制器和极化KL惩罚,实现高效符号化信用分配。
基于数学优化的专家知情贝叶斯最佳子集选择
提出EBBS方法,通过MAP框架将领域专家概率评估整合到最佳子集问题中,实现专家知情的最优稀疏解。
Reinforcement Learning in Super Mario Bros: Curriculum, Pedagogy, and Optimal Level Design in World 1-1
LLM报告的信心更反映承诺而非正确性
LLM言语置信度预测承诺决策远优于正确性,与对数概率分离,不能视为可靠性指标。
反坍缩动力学与循环神经网络中多时间尺度学习的涌现
反坍缩动力学使循环神经网络从指数遗忘转为幂律遗忘,重尾波动维持长程学习,时间尺度由β指数控制。
模型会读取它们写下的内容吗?草稿推理中的因果寄存器
测试模型是否因果使用草稿状态,编辑内部状态后,状态写入模型80%-91%预测正确,表明因果使用中间状态是监督关键。
VISTA-DZ:面向个性化困境区域预测的视觉语义轨迹自适应
VISTA-DZ通过视觉语义轨迹编码,实现个性化停走决策预测,模拟准确率93.26%,可迁移至真实场景。
优化训练策略的迷思:单调推理策略才是LLM强化学习的真正目标
指出训练-推理不匹配致目标错位,提出单调推理策略改进MIPI及MIPU框架,提升推理性能与训练稳定性。
优化器记忆使打乱顺序成为微调噪声的一阶来源
固定时钟优化器使打乱顺序产生一阶噪声,可翻转A/B比较,并推导出无拟合噪声测量方法。
对大型语言模型进行模糊测试以引出隐藏行为
向模型权重或激活注入噪声可更有效触发后门行为,用代理任务选超参数可提升效果。
角色专业化对混合专家模型中解释忠实度重要吗?
角色分解未必保证解释忠实度,去相关正则化可提升忠实度且不损性能。
神经架构搜索的双层优化
双层优化用于神经架构搜索,分为采样和理论两类;理论法通过辅助数学规划同步更新架构与参数,更准确高效。
基于机制的语言模型潜在行为诱发
提出无监督CPE方法,高效发现语言模型隐藏行为,消除对齐伪装,提升安全性。
STEMGym:自主电子显微镜中剂量预算下序列决策的基准测试
STEMGym基准测试表明,感知管道(CNN分析师)是提升自主电镜剂量效率的关键,而导航策略影响甚微。
人物角色训练的蒙特卡洛:限价订单簿中群体神经策略机器人估计市场结果分布
提出人物训练蒙特卡洛法,模拟限价订单簿中人格条件机器人交互,估计市场统计分布,融合多学科理论并设计验证框架。
量化和采样温度对LLM安全对齐的联合效应:一项因子分析
标准量化对安全影响中性,高温采样增加决策不稳定,但二者无复合效应。
t-STEP:一种用于总电子含量预测和不规则性估计的可解释模型
提出t-STEP模型,30秒分辨率预测TEC,精度91%,误差4.38 TECU,可估计不规则性,优于IRI-2020。
AI如何解决了最古老SGD算法的复杂度问题
1937年Kaczmarz算法是最早SGD,现AI模型联手发现其最坏复杂度。
推测性预定位:将状态会话解码至下一个决策点,脱离关键路径
推测预定位利用空闲提前解码,使首令牌延迟从39ms降至约1ms,代价仅能量与有限错误。
利用整数线性规划求解器和机器学习优化护理出租车调度
提出新问题“护理出租车调度”,结合整数线性规划与Transformer学习,平衡违规率、效率和质量,运营时间最多降低8%。
I-BBS:利用随机距离矩阵理论进行无坐标的潜在子流形推断
I-BBS方法仅从距离矩阵识别低维流形,利用整数稳定签名在噪声下恢复几何,无需坐标。
CAREBench:面向语言模型的儿童安全风险基准
CAREBench评估语言模型在12类儿童安全上游风险中的表现,7个模型失败率2%-58%,为开发者检测安全策略漏洞。
学习作为可观测矩阵动力学:扩散弛豫与相变
OMD框架通过距离矩阵谱分析诊断表示演化,区分扩散弛豫与相变,揭示隐藏几何状态。
通过基于方程的合成异常重新定义海上异常检测
提出基于方程的异常分类法,定义三种类型,设计合成标注流程及基准评估,为海上异常检测提供系统基础。
重采样的隐藏成本:不平衡校正如何降低树集成模型中的概率校准
SMOTE校准损失小,欠采样损害大,后处理校准可有效修复。
使用低秩混合模型简化流匹配变换
提出MPPCA作为潜密度,匹配数据分布,简化流变换,加速收敛并提升生成质量。
ScaleAware-JEPA: 多尺度物理场中发现的潜在表示
ScaleAware-JEPA通过约束扩散分解构建尺度感知潜在坐标,实现多尺度物理场的无监督结构发现。
IG-Lens:通过望远镜式积分梯度实现Transformer层间精确可加概率归因
IG-Lens利用望远镜式积分梯度,精确归因每层对预测概率的贡献,总和等于概率变化,消除离散误差且无需反向传播。
自适应LLM代理中评估者驱动偏好动态的诊断框架与多评估者审计
GPT-4o版本漂移导致结论反转,自评估崩溃,EPC框架揭示评估偏好动态的脆弱性。
正确进行RANSAC评分
提出无需内点尺度参数的RANSAC评分方法,共轭逆伽马先验边缘化尺度,性能优于现有方法。
隐私约束下的公平性度量生产化
提出PPRE方法,结合隐私技术,从两个数据源实现美国会员种族/民族公平性度量。
OverFlowLight:城市交叉口实时防堵与交通信号优化
提出实时防堵框架OverFlowLight,利用多模态感知检测溢出并动态插入信号相位,减少60.4%溢出事件,提升18.2%网络吞吐量。
统一零样本时间序列预测:Darts基础
Darts库集成Chronos-2等基础模型,统一接口实现零样本与微调预测、不确定性估计和回测。
PairSAE:从蛋白质共折叠中的配对表示进行机制可解释性
提出PairSAE方法,用N-mode SVD和稀疏自编码器提取配对表示的可解释特征,关联结构基础模型潜空间与生物学概念。
非可观测状态与约束决策时刻下的马尔可夫匪徒学习
针对非可观测状态马尔可夫匪徒,提出自退化模型及UCB-NOM算法,实现近乎对数遗憾,且先验知识可获更优界。
Prism Transformer:渐进式头部调度实现层级化注意力处理
Prism Transformer通过逐层递增注意力头数,构建局部到全局的层级表征,在不增参数和计算下提升多规模模型性能。
周期域上三次非线性薛定谔方程的算子学习
提出几何条件傅里叶神经算子,学习不同纵横比下的解动力学,捕捉共振结构与索伯列夫范数差异,含ω^2提升精度。
地质碳存储中井底压力和CO2羽流预测的边界条件保真度
对比十种边界处理,发现角点孔隙体积守恒最关键,带校正的渐进修正器使BHP误差<3.7%,羽流IoU>0.97。
多重中介者的诅咒:激活补丁中隐藏的交互效应
激活修补中的间接效应包含隐藏交互效应,导致归因偏差,但可作诊断工具。
PEBS:针对RLHF奖励模型校准的逐评分者经验贝叶斯压缩
PEBS无需重新训练奖励模型,通过逐评分者经验贝叶斯压缩校正标注偏差,使RMSE降低8.58%。
量子生成扩散模型用于真实世界时间序列
首个量子扩散模型QDiffusion-TS用于时间序列,参数减少千倍,分布误差降低44%,预测提升71%。
HIA-GAT:用于高速公路帧级交通冲突风险预测的异构交互感知图注意力网络
提出HIA-GAT双流异构图网络,处理纵向与横向交互,在NGSIM数据集上AUC达0.867,实现可解释的冲突类型归因。
基于$K$阶马尔可夫近似的多元时间序列预测模型全局解释
提出KARMA方法,通过K阶马尔可夫近似生成全局解释,捕获时序依赖,优于TimeSHAP。
面向小型语言模型序列个性化学习的持续学习:稳定性监测分析
提出检查点协议监测SLM序列个性化中的遗忘与漂移,轻量参考集诊断可揭示隐藏的不稳定模式。
追溯优势修正:面向延迟感知RLHF的闭式V-Trace偏差修正
提出RAC方法处理RLHF中的延迟奖励,证明无偏性,策略偏差降低最高47.9倍。