面向网络攻击分类的降维方法:主成分分析与线性预测编码的比较评估
比较PCA与LPC降维,PCA保持性能,LPC稍降,大幅降维对精度影响小,适合轻量级网络安全分析。
通过闭环记忆优化增强软件工程
提出闭环记忆增强框架,用下游影响驱动优化,提升代理成功率与效率,降低计算成本。
软件工程的终结:AI代理如何从根本上重构软件范式
本文论证AI代理通过LLM动态生成代码,根本重构软件范式,界定代理工程新学科,并展示潜力与路线图。
跨时期自适应展开优化用于RL后训练
提出CERO方法,基于贝叶斯方差自适应分配展开预算,在数学推理任务中优于GRPO,提升样本效率。
Agent编排的自适应RAG:结构化与多跳检索的比较研究
提出Agent编排的自适应RAG,在结构域提升性能,多跳域精度下降;反思提高引用但增加延迟,需选择性应用。
面向长时域任务的具身AI安全:机器人操作的跨层分析
综述长时域机器人操作安全,按规划、策略、执行三阶段分析证据强度,指出差距并提出跨层保障方向。
微技能架构:一种面向AI原生代码生成的模块化技能驱动框架
微技能架构通过模块化技能胶囊和动态路由,使token消耗降低90%以上,提升编译成功率,消除架构违规。
萨格纳克辅助增强型OTDR用于分布式声学传感:标准化基准与工程评估框架
提出萨格纳克增强型OTDR架构与基准框架,双分支融合模型达89.79%准确率,为分布式声学传感提供优化方案。
人工监督与认知超载:AI辅助软件工程中两个隐性高成本负担
AI辅助软件工程带来两个隐蔽负担:持续人工监督AI产物,以及大量建议导致的认知超载。
超越软掩码:面向鲁棒GNN可解释性的硬扰动混合解释器
提出HPME框架,利用图池化与结构替换混合策略,消除无关信息并缓解分布偏移,实现SOTA可解释性。
基于改进CNN-LSTM的物联网网络入侵检测系统
改进CNN-LSTM模型通过时空特征学习,在物联网入侵检测中达97%准确率,有效检测多种攻击。
莱比锡基准评测
49位数学家编制100道数学难题,三阶段评估后仅剩2道未解,LLM数学推理能力惊人。
EEGDancer:基于强化学习的动态情绪潜在空间掩码建模用于脑电连续情绪预测
提出EEGDancer框架,融合向量量化表示、掩码建模与强化学习轨迹优化,实现高效连续EEG情绪预测。
沿Transformer堆叠的一致性训练
提出MLPCT和AttCT两种新一致性训练方法,应用于多种安全威胁,减少失调并实现跨威胁泛化,表明该框架灵活可扩展。
Causal Scaffolding for Physical Reasoning: A Benchmark for Causally-Informed Physical World Understanding in VLMs
提出CausalPhys基准测试,含3000+视频图像问题,用因果图评估VLM推理,CRFT微调显著提升准确性与可解释性。
LLMCodec:适配视频编解码器实现大语言模型高效权重压缩
LLMCodec利用视频编解码器(如VVC)压缩LLM权重,无需微调,在2-bit精度下困惑度降1.5倍,准确率提升21%。
使用深度线性网络理论与条件ReLU简化解析Grokking中的两个训练时钟
将拟合与表示简化分离为两个训练时钟,深度线性网络对数时间降损失、多项式时间简化,ReLU同理。
通过对抗性合成场景学习机器人安全策略
提出智能体博弈框架,红队生成危险情境,蓝队优化安全策略,高效发现高风险边缘情况,为物理AI系统安全提供可扩展方案。
统一世界建模、语言推理与动作合成的世界-语言-动作模型
提出WLA模型,结合世界建模与语言推理,自回归预测状态,实现高成功率多任务学习。
通过元学习从隐式成本-性能偏好中学习路由大语言模型
提出MetaRouter元学习框架,通过少量交互学习用户隐式偏好,实现个性化成本-性能优化,效果优于基线。
AttackPathGNN:使用状态干扰图和合取池的跨函数智能合约漏洞检测
提出AttackPathGNN,通过状态干扰图和合取池实现跨函数漏洞检测,F1达92.3%,每个预测附带修复报告。
当足够好就是最优:量化门控DeltaNet的仅乘法矩阵求逆近似
提出基于矩阵乘法的快速三角矩阵求逆算法,在NPU上实现5倍加速和20%解码开销降低,同时保持精度。
基于Rashomon集合的蜕变测试:机器学习中解释的忠实性
提出蜕变测试框架,利用Rashomon集评估解释忠实性,无需真实标签,通过一致性属性筛选可信模型。
OPRD:在线策略表示蒸馏
OPRD通过对齐师生隐藏状态进行蒸馏,消除采样方差,比输出空间蒸馏快1.44倍、省54%内存,在AIME等测试上缩小师生差距。
正实数n=9的Vasc不等式的一个有限证书
AI辅助证明Vasc不等式n=9正实数情形,生成含36815个系数叶子的有限证书。
ITP-STDP:一种用于片上SNN训练的内定时序2的幂学习引擎
提出ITP-STDP引擎,消除STDP计算开销,能效提升4.5-219.8倍,面积仅为先前1.2%-3.3%。
TAM:用于操作中鲁棒运动传递的扭矩适应模块
TAM模块通过调整扭矩使机器人行为匹配理想模型,零样本迁移至真实机器人,提升动态操作鲁棒性。
CLEAR:端到端自动驾驶中用于自适应路由的认知与潜在评估
CLEAR用单步条件漂移替代多步去噪,结合场景感知隐状态实现高效多模态规划,在NAVSIM上取得93.7 PDMS。
语义与协作鸿沟的桥梁:面向冷启动物品推荐的非对称图架构
提出非对称图架构,利用时序观看历史与内在特征编码,实现冷启动物品与设备推荐隐式补全。
你的GFlowNet悄悄学成了一个最优传输方案
非无环GFlowNet等价于最优传输,其策略编码最优耦合,可求解大规模图OT问题。
设计一个集成大语言模型的可靠死亡率预测接口
提出LLM集成接口,将自然语言转为配置,提升死亡率预测的易用性和统计效力,确保透明度与可重复性。
双重预处理(DoPr):优化测试时性能而非验证损失
提出双重预处理(DoPr)优化方法,结合梯度与激活预处理,提升测试时性能,但验证损失未必改善。
适应扩散语言模型用于无损像素级图像传输
提出DDM-SSCC框架,利用扩散语言模型实现无损像素图像传输,通过双向注意力和改进去噪顺序,在多个数据集上优于基线。
PAMF:面向不完整时间序列数据的先验感知多模态融合
PAMF通过先验感知流匹配区分两种缺失模式,连接插补与分类,在多模态医疗时间序列上取得最优。
学习遗忘什么:通过学习令牌级重要性改进大语言模型遗忘
ATWU框架联合学习令牌权重与模型参数实现遗忘,无需外部监督,达到最优遗忘-保留权衡。
F3-Tokenizer: 驯服音频自编码器潜变量以实现理解与生成
提出F3-Tokenizer,通过噪声正则化瓶颈和表示编码器,统一音频自编码器潜变量,兼顾理解与生成。
免于递归的循环网络预训练
提出SMT方法,将RNN训练转为记忆转换监督学习,实现时间并行训练与稳定梯度,优于BPTT。
重复博弈中自适应对手的遗憾最小化
提出重复策略遗憾度量,研究其最小化条件与算法,可学习子博弈完美均衡并促进合作。
Code2LoRA:针对软件演化场景下代码语言模型的超网络生成适配器
Code2LoRA用超网络生成仓库LoRA适配器,零推理开销注入知识,在静态与演化基准上匹配或超越基线。
HANDOFF:通过蒸馏互补教师实现类人智能体任务空间全身控制
HANDOFF提出紧凑接口,通过多教师蒸馏与门控混合专家实现人形机器人全身控制,匹配SOTA速度跟踪,支持自然语言任务。
迈向AI流行病学:一种用于前瞻性风险检测的测量标准化框架
提出测量标准化框架,压缩专家-AI交互为结构化字段,用于AI系统前瞻性风险检测,支撑可靠性、治理与流行病学三大主张。
大型推理模型中的动态思考令牌选择以实现高效推理
发现推理轨迹仅部分令牌关键,提出动态选择保留其KV缓存,剔除冗余提升效率。
CaMeLs也可以使用计算机:面向计算机使用代理的系统级安全
提出NOVA方法,通过单次规划防御指令注入,但需额外防分支转向攻击,兼顾安全与效用。
学习自适应并行执行以实现高效代码定位
FuseSearch通过自适应并行策略优化代码定位,速度提升93.6%,调用减少67.7%,消除冗余信号提升性能。
CoT-Space:通过强化学习实现内部慢思考的理论框架
CoT-Space框架将推理转化为语义空间优化,揭示CoT长度收敛于欠拟合与过拟合的权衡。
Drive-KD:面向自动驾驶中视觉语言模型的多教师蒸馏
Drive-KD将自动驾驶分解为感知-推理-规划,通过多教师蒸馏与梯度投影,使1B模型性能超越78B模型,规划维度胜GPT-5.1。
From Out-of-Distribution Detection to Hallucination Detection: A Geometric View
企业代理系统中的本体约束神经推理:面向领域接地AI代理的神经符号架构
提出三层本体约束神经符号架构,实验证实显著提升LLM代理准确性和角色一致性,领域知识越弱提升越大。
基于LLM的语义部分接地
SPG-LLM利用LLM分析PDDL文件,启发式排除无关对象与动作,大幅加速接地,计划成本可比或更优。
InfoDensity:奖励信息密集的推理轨迹以实现高效推理
InfoDensity通过熵轨迹奖励信息密集推理,平衡准确率与效率,优于现有方法。