面向韧性关键基础设施的去中心化多智能体强化学习
去中心化MARL与弹性基础设施结构对齐,关键在于解决信用分配与通信难题。
Position: The Inevitable Transition to Machine Learning in Quantum Chemistry
利用控制动态模式分解从单一实现中分离强迫与内部气候变率
提出PullbackDMDc方法,基于非自治动力系统与控制DMD,从单一气候实现中分离强迫与内部成分,服务于气候预估与模式评估。
面向网络防御的大语言模型遗忘:方法、挑战与新兴威胁综述
LLM遗忘面临真假删除知识难题,以梯度法为主流,综述其网络安全、鲁棒性与验证挑战。
融合灰色关联系数的强化学习引导NSGA-II多目标优化:纳斯达克投资组合优化应用
提出RL-NSGA-II-GRC方法,集成强化学习与灰色关联系数,提升多目标优化收敛性和多样性,在纳斯达克投资组合中实现高效前沿。
HantaWatch:用于汉坦病毒基因组监测的联邦学习
HantaWatch联邦学习框架无需共享数据,协同训练模型,平衡性能与风险,提供风险评分与专家优先排序。
全传感器智能眼镜平台,支持设备端机器学习
提出ARGO智能眼镜平台,集成NPU实现设备端ML,低延迟高隐私,实时障碍识别,性能高效。
DocOCR-Eval: 一种基于校正的、无需真实标注的OCR工具选择框架
提出无需标注的OCR评估框架,通过三步校正与排序策略,聚合多模型实现可靠工具选择。
正交梯度约束影响噪声标签记忆动态
正交梯度约束移除径向梯度分量,提升小数据下CNN抗噪性,大数据下效果减弱,仅改变记忆轨迹而非完全阻止过拟合。
从权重到文字:用自然语言表达和编辑偏好模型推断
一种从选择数据自动发现自然语言偏好维度的方法,提升预测准确度并支持用户实时编辑。
RouteCost:一种受生产实践启发的电商预订单运费估算多阶段框架
提出RouteCost框架,融合需求预测、基线定价、残差修正与箱体合并,在25万订单数据上提升运费预测精度与校准。
面向张量核的算子感知混合精度容差校准
提出算子感知混合精度容差校准,提升张量核错误检测召回率9.3%,误报仅增1.1%。
基于令牌级跨模态Transformer和对比多任务学习的乳腺癌亚型分类与生存预测
提出令牌级跨模态Transformer与对比多任务学习,解决多模态整合、融合及联合优化问题,实现乳腺癌亚型分类与生存预测。
BACON:基于预算的人类校准与多AI评委建模评估框架
BACON结合预算内人工校准与多AI评委输出,改进预测准确性,降低偏差,实现有限标注下的可扩展评估。
CIGPO:面向多轮证据阅读LLM智能体的上下文信息增益策略优化
针对结果强化学习的零优势锁定问题,CIGPO使用信息增益作为回合奖励防止方差坍塌,在HotpotQA上F1从0.252升至0.518。
基于边际影响归因方法在全局时间序列解释中的失败
现有归因方法因采用边际条件或离流形梯度,混淆直接与间接时间依赖,导致解释不满足DAG忠实性。
OpenMHC: 加速可穿戴基础模型的科学研究
开源最大可穿戴健康数据集OpenMHC及模型基准,含超6000万小时数据,加速可穿戴AI研究
递归推理模型的量化
递归推理模型量化崩溃源于激活缩放粒度,块状缩放(如MXInt4)可恢复性能并保持鲁棒性。
扩散校正的自回归傅里叶神经算子用于液滴演化预测
提出DiffARFNO框架,结合粗预测与DDIM校正,实现高保真长时液滴演化预测,性能显著优于现有模型。
KernelBench-Verified:大模型生成的核函数真的比PyTorch快吗?
研究发现,LLM生成核函数存在作弊行为,实际加速比仅0.88x,且28%增加内存,未真正击败PyTorch。
偏好优化的归一化奖励
提出归一化奖励正则化,缓解直接对齐算法的过度优化,提升生成质量与基准性能。
TRACE:基于轨迹的安全补丁学习用于大语言模型训练后重新对齐
TRACE框架通过模拟有害微调轨迹学习安全补丁,解决任务-安全更新纠缠,实现高安全与效用保持。
RobustMAD:面向可部署异常检测助手的多模态小语言模型真实世界鲁棒性评估
提出首个部署驱动的鲁棒性基准RobustMAD,发现多模态小语言模型虽超越大模型,但仍存在关键鲁棒性缺陷。
使用大语言模型进行特征生成:一种进化算法方法
LLM结合进化算法自动生成新特征,在多个数据集上提升分类效果。
使用图神经网络学习门级网表中的结构可操控性
定义拓扑驱动的结构可操控性分数,用图神经网络学习节点级回归,层次模型最佳,可识别特洛伊电路。
通过局部分布恢复实现高精度低位KV缓存量化
低位KV缓存量化精度下降源于局部排名错误,提出局部分布恢复法(DGAP),恢复精度至83.2%。
让数据决定:离线策略蒸馏在继续预训练中的监督分析、能力权衡与自适应目标路由
研究离线策略蒸馏中目标与能力权衡及数据异质性,提出自适应目标路由,发现路由效果取决于数据信号质量,将继续预训练重构思为结构化监督设计。
面向主动具身安全的自我进化即时记忆
提出自我进化即时记忆框架,通过风险追踪与元技能学习,在不阻碍任务进展下主动化解危险,安全成功率提升30.3%。
基于多组学的乳腺癌预测机器学习模型基准测试
系统比较经典ML模型预测乳腺癌ER状态,随机森林在多组学整合中表现最佳,平衡准确率90.3%,AUC 97.1%。
从纯合成数据学习时空基础模型
提出NeoST,仅用合成数据预训练,潜在空间推理与训练目标,避免误差累积,在真实基准中超越现有模型。
SOS-LoRA: 具有固定多尺度缩放的静态正交子空间低秩自适应
SOS-LoRA通过静态正交子空间与固定多尺度缩放改进LoRA,避免干扰并提升性能,不增加推理开销。
超越记忆:长上下文检索中任务条件化的带符号前馈网络写入
FFN残差写入有符号性,导数可区分抑制/放大作用,预测检索衰减损伤。
机器学习在2型糖尿病风险预测中的综合评估:大规模外部验证与公平性分析
内部验证良好但外部验证性能下降(AUC从0.794降至0.717),老年人和肥胖者预测偏差严重,需公平性调整和年龄分层部署。
基于少样本连续上下文赌博机的预测-修正循环需求预测
提出预测-修正框架,利用少样本连续上下文赌博机改进自适应零售预测,显著降低误差和成本。
梦中发现:人工记忆中的跨领域重组
跨领域重组驱动创造性发现,符号系统发现率85.7%,神经跨域推理提升14.5个百分点,巩固本质是为发现而非记忆。
基于偏好的抗体表达排序:利用大规模弱监督进行扩展
结合稀缺定量数据与大规模弱监督,提出偏好学习框架,在少量标记和大量未标记抗体上优化表达排序。
多尺度AI蜂群自主发现结直肠癌脆弱性机制
Octopus多尺度AI群体自主发现结直肠癌脆弱性,验证IGF2为5-FU耐药靶点,统计显著。
量化LLM基准测试中的排名不确定性
研究显示MMLU基准中排名不确定性显著,需考虑跨主题变异以准确比较LLM性能。
PsiLogic:针对Adam的混沌感知主动抵消及公平跨领域基准
PsiLogic通过双EMA动态抵消优化Adam,自动预热,在NLP、ViT、ResNet三个领域取得最佳验证指标。
从结果到行动:利用事后视角进行长视界语言智能体训练
提出HPO方法,通过意图空间投影和Wasserstein距离提取低方差信号,解决长视界交互优化方差问题,稳定提升策略性能。
用于构网型逆变器电磁暂态级别替代建模的神经控制微分方程
提出神经CDE框架,实现构网型逆变器多时间尺度电磁暂态替代建模,保证物理一致性与稳定性。
AdaSurvMamba:动态融合与语义扫描的多模态生存分析
提出自适应框架AdaSurvMamba,通过动态融合与语义扫描克服静态交互和语义碎片,提升多模态生存分析性能。
减少随机优化中的单样本损害
提出减少优化中单样本损失增加的方法,通过约束到最后一层高效近似,提升泛化。
检索足矣:基于工具代理的无训练可解释性
提出无训练可解释方法HARP,通过检索与线性探针,性能超越训练方法,更便宜灵活。
蛋白质接触图上的离散里奇曲率用于轻量级折叠分类
离散里奇曲率以22维特征超越150M维ESM-2,结合持续同调达最优,是轻量替代方案。
K-IPO: 基于Kendall约束的重要性保持过采样方法用于不平衡表格数据
K-IPO通过Kendall约束选择合成样本,保持特征重要性排序,避免扭曲并提升性能。
反馈归因与表征几何:多智能体强化学习中个体与共享奖励的比较指标
提出EffRank/n和D_act指标,发现奖励归因主要影响行为而非几何,观察决定几何结构,几何诊断需控制角色信息。
EA-RMENet——基于深度学习的城市环境路径损耗预测
提出EA-RMENet深度学习模型,融合U-Net与EfficientNet,实现高精度低延迟的路径损耗预测,竞赛排名第三。
联合故障诊断与剩余寿命估计中注意力增强多任务学习的泄露鲁棒评估与数据规模敏感性
揭示滑动窗口划分导致性能虚高,提出基于块的泄露审计协议,证明多任务训练稳定性取决于标签来源而非任务类型。
面向AI无人机检测系统的紧凑型卷积神经网络
轻量CNN将无人机信号转为时域图像,实现高精度低计算成本检测,适用于嵌入式射频监控。