INTENT:基于LSTM的路口车辆意图预测框架及全面消融分析
提出INTENT框架,用LSTM预测路口车辆2秒后直行/左转/右转意图,在InD数据集上达99.71%准确率。
当心你的自动补全:后门代码补全的取证归因
提出CodeTracer框架,通过行为指纹与LLM推理,将后门代码补全精准归因至恶意微调数据。
穿墙雷达人体活动识别的泛化理论
提出穿墙雷达人体活动识别泛化分析框架,推导目标域泛化界,实验验证其应用价值。
MuScriptor:多乐器音乐转录开放模型
通过合成数据预训练与真实音频微调,结合强化学习后训练,发布适用于复杂多乐器场景的开放权重转录模型MuScriptor。
RadioDiff-v2: 生成式角度无线电地图用于多波束选择与定位
RadioDiff-v2用流匹配双分支扩散变换器生成角度无线电地图,零样本下W-1距离0.39dB,波束选择损失2.43dB,定位误差20.6像素。
MLQENABLER:在云计算中实现加密数据库上的安全机器学习查询
提出MLQENABLER方案,通过索引辅助实现加密数据库上的安全机器学习,兼顾安全与性能,仅轻微降低ML效果。
BACH:多兴趣双塔检索中对比头的贝叶斯混合模型
BACH用贝叶斯混合与变分推断实现软路由,缓解头部崩塌,生成用户兴趣权重,显著提升检索效果。
TTHE: Test-Time Harness Evolution
基于数字孪生感知的联邦强化学习保障自动驾驶系统安全
提出SAFE框架,融合数字孪生排练与历史梯度聚合,有效抵御投毒攻击,保障自动驾驶联邦强化学习安全,并提供理论保证与仿真验证。
TriRoute:联合自适应注意力、专家和KV缓存分配的统一学习路由
TriRoute通过联合路由控制注意力、专家和KV缓存,实现计算与内存协同优化,提升效率与鲁棒性。
中文标题:基于深度强化学习的可靠性双目标投资组合优化
中文摘要:提出深度强化学习框架优化投资组合,平衡收益与下行风险,在多种市场环境下降低风险且可扩展。
NEST:通过面向机制的专家混合模型应对数据集级分布偏移
提出NEST,用两阶段MoE建模重组数据集演化结构,实现长期预测最优性能。
LLM引导的任务-语义场分解用于工业过程预测
提出LLM引导TSF,离线构建语义场,在线预测激活语义,MAE降6.4%,参数仅增~2k。
校准虚拟筛选中的无声失败:边缘共形预测低估了少数类,而类条件修复方法可恢复其性能
标准共形预测在不平衡数据上严重遗漏少数类(覆盖仅4.2%),类条件修复可恢复目标覆盖,提供实用方案。
STAGformer:面向微出行需求预测的时空智能体图Transformer
提出STAGformer,采用两阶段注意力机制实现线性复杂度高效全局建模,在纽约和芝加哥数据集上显著提升预测精度。
D2PO:通过动态偏好优化扩散采样器
D2PO框架利用动态偏好优化扩散采样策略,通过自改进对齐感知质量,超越传统回归方法。
WHERE to Generate Matters: Budget-Aware Synthetic Augmentation for Label Skewed Federated Learning
Inertia-1:可穿戴运动基础模型的开放探索
首次开放研究可穿戴运动基础模型全生命周期,提供跨任务通用表示学习的实用方案。
指纹,而非蓝图:位置方案如何设定注意力的默认谱代数
位置方案设定注意力默认谱代数,谱轮廓是功能后形成的指纹,非预先约束。
Open-Ended Scenario Reasoning for Specialist Model Adaptation
At-Grok未收敛:对Grokking表示指标的测量有效性审计
揭示网络在泛化后嵌入持续压缩,常用指标高估收敛值,并提出一套审计方法。
需求响应是否会增加对恶意数据修改网络攻击的脆弱性?
对抗性攻击可侵蚀需求响应利润,但有限扰动下仍保留90%优势;攻击影响取决于扰动方向而非幅度。
当证书失效:嵌入式神经接口模型的统一安全框架
现有鲁棒性证书无法保证操作安全,需用实证审计框架弥补形式验证与任务性能间的鸿沟。
优化实例修改以解释和评估分类器鲁棒性
提出优化框架修改实例解释误分类并评估鲁棒性,引入容忍区域混淆矩阵量化分类器易感性。
跨轨迹嵌合体干预揭示权重幅度与方向在Grokking中的可分离作用
方向转移电路身份,幅度仅调节延迟,通过跨轨迹干预发现两者作用可分离。
UASPL:基于证据神经网络的不确定性感知自步学习
提出UASPL,将不确定性融入自步学习,提升样本选择可靠性与可解释性,性能更优。
几何代数层何时胜过标量化?关于SO(3)-等变向量定律的受控研究
几何代数层在深层组合群操作任务中显著优于标量化,但简单定律无增益,所有模型无法外推不变幅度。
视觉语言模型中的奖励评估:快感缺失背后的因果机制
通过扰动视觉语言模型的奖励预期单元,可诱导类似人类快感缺失的决策行为。
STST-JEPA:面向EEG自监督学习的浅目标时空联合嵌入预测架构
提出STST-JEPA自监督Transformer,EEG年龄预测MAE 3.06年,NeuralBench多项第一,残差与认知效率负相关。
近视贝叶斯主动学习在线性回归中风险的近似比
首次证明贪心算法风险近似比,与最大初始杠杆分数线性相关,并用数值模拟验证。
高效长周期学习用于学习优化
提出ELO算法,高效长周期元训练并引入去耦渐进专家监督,提升学习优化器长期性能,超越AdamW,接近Muon,且训练成本低于7 H100 GPU小时。
秩一角:任务从世界模型需要多少价值等价?
价值等价取决于目标维度,标量奖励仅安装一维投影,提高维度可安装更多预测方向。
扩散赋能的最优传输距离用于图匹配
融合扩散与最优传输的DsrFGW方法,在噪声图匹配中显著优于传统方法,聚类质量大幅提升。
边缘设备上多模态联邦学习的熵引导张量压缩
提出MESH-FL框架,熵引导自适应压缩,在异构边缘设备上实现56.8倍压缩并提升准确率2.01%。
用于心电图分类的个性化联邦学习中的双注意力头
提出FedDualAtt,通过全局与局部注意力头分离,实现个性化联邦学习,在心电图分类任务中优于现有方法。
不确定性下稳健的人机互补性
AI与人类预测错误负相关时,可构建稳健策略保证期望效用提升。
从跳跃到签名:时间点过程的生成方法
提出跳跃到连续路径嵌入框架,扩展签名方法至事件序列;首个基于签名的TPP生成模型sigTPP,采用路径级损失训练并推导分布差异评估,性能最优。
什么预测了文本到SQL的正确性?一项选择性预测研究
基于推理的验证信号预测SQL正确性最佳(AUROC 0.82),微调验证器跨模式泛化不足,需大冻结模型。
通过知识蒸馏增强时间序列分类的深度学习模型
知识蒸馏有效提升三种时间序列分类模型,学生模型参数显著减少,性能接近教师。
LEMUR 2:解锁神经网络多样性以推动人工智能
LEMUR 2 是包含14000+架构和75万条训练记录的大规模框架,支持多模态与部署,为数据驱动AI设计提供基础。
随机图信号的生成扩散模型
本文用U-GNN扩散模型统一处理条件图信号生成,在股票和资源分配中验证。
惊异收敛:进化式自监督图像聚类
提出惊异最大化进化自监督聚类框架,无须梯度目标,实现非参数聚类SOTA。
轻量级游戏智能体强在哪里的金标准研究
用固定规则专家评估,发现信任区域更新、课程对手等技巧提升轻量级智能体,编码器容量非瓶颈,方法可迁移。
论神经网络的显式超表达近似
引入中国剩余定理构造固定架构网络,实现显式参数-误差权衡,参数大小与误差呈对数关系。
基于生成代理的最佳臂识别
提出PROBE算法,利用生成代理和OLS上界证书,在未知相关性下实现样本复杂度改进,随相关性增强节省样本。
基于解析预测推断的高效贝叶斯深度集成方法
提出高效贝叶斯深度集成法,通过低维表示、闭式聚合与独立训练,实现可解释校准不确定性,性能优异且高效。
面向蜂窝流量预测的多模态时空频率融合与峰值增强方法
提出MSPF-Net,融合外部新闻,通过时空频率编码与峰值增强,动态整合多模态信号,提升流量预测性能。
面向边缘系统的延迟约束DNN架构学习(使用零化批归一化)
提出面向延迟的神经网络方法,满足硬延迟约束且精度损失极小,硬件定制预测器一次性训练。
内在噪声巩固:道布屏障条件扩散将模拟器件噪声转化为持续学习资源
将模拟硬件噪声通过道布屏障条件转化为持续学习资源,实验显示噪声非单调提高记忆保留(倒U型),显著改善多任务保持。
插补与聚类相结合:利用潜在子群结构恢复缺失数据
提出CAGI框架,协同优化聚类与插补,利用动态聚类先验指导生成对抗网络,迭代细化子群结构,实现高保真缺失数据恢复。