通过非梯度向量流学习流映射
SGFlow通过非梯度向量流学习流映射,无需可逆约束和反向传播,在CIFAR上10步采样FID最优,具有固定点保证。
DHRCL:使用密集分层奖励与课程学习训练代码大语言模型
DHRCL通过密集分层奖励和三阶段课程学习训练代码大模型,自动调整阶段时长,显著提升性能。
通过迭代优化从隐式交互流中学习动态用户画像
IRIS从隐式交互学习动态用户画像,无需显式反馈,决策预测准确率达61.0%
面向交通预测的神经架构搜索:方法、挑战与未来方向综述
综述NAS在交通预测的应用,按搜索策略分类,分析空间设计与成本权衡,探讨可扩展性等挑战与未来方向。
带损坏观测的共形变点定位与根因分析
针对损坏观测,提出加权共形变点定位与根因分析,降权可疑数据缩小置信集,维持目标覆盖概率。
从概念水文模型到概念可解释神经网络:一个雪水质量守恒感知机框架用于发现流域尺度降水-存储-径流表征
MCP将概念水文模型转为可解释神经网络,多状态网络在513流域验证,两状态后增益递减,MCP与LSTM精度相当但参数更少。
SCOUT:面向稀疏奖励强化学习的逐上下文重置课程
SCOUT为每个上下文独立重置课程,仅凭成功信号动态移除/恢复辅助,解决学习速率差异,优于全局调度。
存在场扩散模型用于可变基数空间点过程
提出存在场扩散模型,通过存在变量统一建模位置与基数,无需离散转换,提升可变基数空间点过程生成能力。
图神经网络消息传递在回归场景中的效能研究
本文发现深度卷积GNN在回归任务中优于注意力GNN,经典理论GNN仍具竞争力。
用于大语言模型端到端强化学习后训练的HiFloat4格式
首次FP4端到端RL后训练,Rollout-ResQ与HiF4格式将精度差距从4.9%降至1.1%。
协作加权与悲观评论家:缓解离策略强化学习中的过估计
提出CWAC框架,通过分布性评论家与协作加权机制抑制噪声更新,结合悲观价值估计缓解过估计,显著提升离策略RL性能。
从无监督子群到假设状态干预策略:观察性健康数据中选定子群方法的评估
观察性数据中无监督子群用于政策评估,各方法效用无显著差异,但个体分配有别,属决策支持。
AgentGFM:具有节点代理信息流控制的图基础模型
AgentGFM将节点视为智能体,通过预测-行动-观察-纠正实现自适应信息流控制,适配多样图拓扑。
从令牌到瓦时:现代GPU上LLM推理的分析性能量估计
提出无需直接测量的分析性能耗估计法,分解LLM推理预填充/解码能耗,适用于模型比较与绿色编码。
不遗忘的艺术:一种面向持续学习的局部学习架构
CMP架构结合稀疏表示、局部学习与持久内存,有效降低灾难性遗忘,优于Transformer+EWC,但单域精度较低。
FedWeave:重新思考异构联邦MoE-LoRA中的专门化单元
FedWeave通过非对称聚合分离专家与路由器优化,利用原型发现实现专家纯度与路由器对比,稀疏推理保持性能。
评估ConvLSTM在印度四城市次日降雨场预测中的表现
ConvLSTM在次日降雨场预测中不优于简单模型,FC-LSTM和持久性方法表现更好。
在线共形预测中同时保证覆盖率和效率
提出统一在线学习框架,同时控制绝对覆盖误差与预测集效率,无需分布假设,实现动态基准下的最优保证。
不确定性引导的LLM语义增强用于异质性处理效应估计
提出CURL方法,利用不确定性分配LLM语义能力,分离双通道表示,提升CATE估计精度。
CalTwin:通过Fisher信息正则化实现校准且对偏移鲁棒的医学世界模型
CalTwin结合Fisher信息偏移惩罚与置信度错配惩罚,提升医学世界模型在协变量偏移下的预测精度和校准度,降低MSE 9.1%。
RAG-HAR+:面向边缘部署的基于LLM的成本高效人类活动识别
提出RAG-HAR+,通过检索优先和成本优化,保持性能的同时减少LLM使用,实现边缘部署。
理解小表格数据集上TabPFN的上下文采样
TabPFN中,大上下文提升准确性与稳定性;多样性是关键;随机采样因覆盖特征空间而有效,昂贵方法无优势。
AIGen:通过混合MLOps集成实现AI物料清单的自动生成
AIGen基于MLflow,结合启发式与大语言模型,自动生成符合SPDX 3.0标准的AI物料清单,支持插件扩展,助力AI供应链合规。
面向风险感知自动强化学习的高效异方差贝叶斯优化
提出ERAHBO,建模均值和方差,实现风险规避超参数优化,通过自适应重采样提升样本效率。
带随机特征的图神经网络的普适性与逼近率
证明带部分随机节点特征的置换等变神经网络可逼近图函数,并给出光滑函数的逼近率上界。
PowerAtlas:面向电力系统电算协同调度
提出PowerAtlas框架,集成领域知识与物理约束,实现电算协同调度,确保电网规则与任务SLA,实验验证有效。
基于IMU传感器的手写轨迹重建的混合专家方法
提出混合专家模型(触摸与悬停专家),重建手写轨迹,引入新基准数据集,性能显著优于竞争者。
面向IMU传感器手写轨迹重建的域适应
针对儿童与成人手写信号差异,采用域适应方法统一特征表示,提升轨迹重建性能。
通过同质训练-测试分割方法增强自动化机器学习
提出Optimised-Distribution方法优化训练测试集相似性,平均MMD相似性89.0%,提升AutoML评估稳定性。
在黒盒多轮交互中预测轨迹级安全风险
提出Recast框架,实现轨迹级风险预测,提前2.41轮预警88.3%故障,虚警率12.3%。
SkillRise:跨任务技能演化的智能体强化学习
SkillRise用单一策略在渐进任务序列中交替求解与整理技能,实现跨任务重用,性能提升2.3-8.5%。
FedTopo:面向模型异构联邦学习的关系级拓扑共享
FedTopo通过关系拓扑编码全局知识,可靠性感知聚合,提升异构联邦学习性能。
Journey Operators for Structured Multi-Axis Composition
通过成本校准的前沿效用实现预算感知的大语言模型发现
CostAda用成本校准效用引导搜索,半预算即达最强基线质量,提升发现效率。
Kairos:基于Cholesky分解的LinUCB实现项目冷启动下数值鲁棒的新闻推荐
用Cholesky秩1更新替代求逆,结合MRL解决新闻冷启动,效率提升4.85倍且排序精度几乎无损。
视觉生成中的摊销矩匹配
提出摊销矩匹配(AMFD),用网络动态学习条件矩,单步生成超越FD基线,文本图像生成超越多步教师模型。
AdaBoost的紧致泛化界
给出AdaBoost泛化误差上界Θ((d ln(nγ²/d))/(nγ²)+ln(1/δ)/n),与已知下界匹配,其中γ为弱学习器优势。
TREA-Net:一种面向登革热发病率预测的可迁移残差流行病学自适应网络
提出TREA-Net,从数据丰富区迁移轻量残差校正至稀缺区,提升登革热预测精度,在9/10设置中显著改进基线。
不确定性下的思考:语言模型中的证据利用与信息寻求
思考提升模型基于证据的行动表现但未转向信息寻求,其长度与置信度变化反映元认知过程。
时间中心化SIGReg改进多任务Le世界模型学习:从分析到方法
针对多任务世界模型表示混叠,提出时间中心化残差SIGReg,成功率从53.2%升至73.6%。
两次调用胜过五个智能体:评估多智能体管道与自优化在本地语言模型上的表现
本地7B模型上,简单自优化(两次调用)在GSM8K上达到86.2%准确率,优于多智能体管道,且HumanEval需任务感知门控。
行为有后果:使用干预测试检测结果表现性
提出OPAB方法,通过干预分组结果分布差异检测结果表现性,验证可行,指出样本不足时存在不可区分区域。
彩票票并非部署票
稀疏模型虽准确率匹配,但行为不同,替换后下游决策变更7%-10%,产生再验证负担。
Surrogate assisted diversity estimation in neural ensemble search
面向人脸呈现攻击检测的基础模型:一个统一的线性探测基准
评估显示基础模型预训练表示含PAD信息,域内有效但跨域迁移差,需显式适应域偏移。
潜在世界模型能学到什么?多模态预测表示中物理参数的可辨识性
预测目标决定潜在模型获取的物理参数,输入限制可知性,数据仅提升已获取参数。
TreeCCA:基于梯度提升树的典型相关分析
TreeCCA首次将梯度提升树用于CCA,兼得非线性准确性与可解释性,性能匹配深度CCA且成本更低。
BayesAME:贝叶斯主动模型评估
BayesAME用贝叶斯框架自动确定评估子集大小,迭代估计模型性能,优于现有方法。
ReCo: 针对分布集中的GRPO重加权方法
针对GRPO导致模型响应分布集中的问题,提出ReCo重加权方法,通过平衡响应贡献与基于方差的比率,提升大k值下的Pass@k性能。
CoCaRS:基于相关校准的冗余抑制用于异构知识蒸馏
CoCaRS通过相关校准抑制冗余,保留结构信息并自适应调节系数,提升异构知识蒸馏性能。