5455 条条目 · 106 个活跃源
2026年6月6日
04:00
arXiv cs.AI

面向网络攻击分类的降维方法:主成分分析与线性预测编码的比较评估

比较PCA与LPC降维,PCA保持性能,LPC稍降,大幅降维对精度影响小,适合轻量级网络安全分析。

04:00
arXiv cs.AI

通过闭环记忆优化增强软件工程

提出闭环记忆增强框架,用下游影响驱动优化,提升代理成功率与效率,降低计算成本。

04:00
arXiv cs.AI

软件工程的终结:AI代理如何从根本上重构软件范式

本文论证AI代理通过LLM动态生成代码,根本重构软件范式,界定代理工程新学科,并展示潜力与路线图。

04:00
arXiv cs.AI

跨时期自适应展开优化用于RL后训练

提出CERO方法,基于贝叶斯方差自适应分配展开预算,在数学推理任务中优于GRPO,提升样本效率。

04:00
arXiv cs.AI

Agent编排的自适应RAG:结构化与多跳检索的比较研究

提出Agent编排的自适应RAG,在结构域提升性能,多跳域精度下降;反思提高引用但增加延迟,需选择性应用。

04:00
arXiv cs.AI

面向长时域任务的具身AI安全:机器人操作的跨层分析

综述长时域机器人操作安全,按规划、策略、执行三阶段分析证据强度,指出差距并提出跨层保障方向。

04:00
arXiv cs.AI

微技能架构:一种面向AI原生代码生成的模块化技能驱动框架

微技能架构通过模块化技能胶囊和动态路由,使token消耗降低90%以上,提升编译成功率,消除架构违规。

04:00
arXiv cs.AI

萨格纳克辅助增强型OTDR用于分布式声学传感:标准化基准与工程评估框架

提出萨格纳克增强型OTDR架构与基准框架,双分支融合模型达89.79%准确率,为分布式声学传感提供优化方案。

04:00
arXiv cs.AI

人工监督与认知超载:AI辅助软件工程中两个隐性高成本负担

AI辅助软件工程带来两个隐蔽负担:持续人工监督AI产物,以及大量建议导致的认知超载。

04:00
arXiv cs.AI

超越软掩码:面向鲁棒GNN可解释性的硬扰动混合解释器

提出HPME框架,利用图池化与结构替换混合策略,消除无关信息并缓解分布偏移,实现SOTA可解释性。

04:00
arXiv cs.AI

基于改进CNN-LSTM的物联网网络入侵检测系统

改进CNN-LSTM模型通过时空特征学习,在物联网入侵检测中达97%准确率,有效检测多种攻击。

04:00
arXiv cs.AI

莱比锡基准评测

49位数学家编制100道数学难题,三阶段评估后仅剩2道未解,LLM数学推理能力惊人。

04:00
arXiv cs.AI

EEGDancer:基于强化学习的动态情绪潜在空间掩码建模用于脑电连续情绪预测

提出EEGDancer框架,融合向量量化表示、掩码建模与强化学习轨迹优化,实现高效连续EEG情绪预测。

04:00
arXiv cs.AI

沿Transformer堆叠的一致性训练

提出MLPCT和AttCT两种新一致性训练方法,应用于多种安全威胁,减少失调并实现跨威胁泛化,表明该框架灵活可扩展。

04:00
arXiv cs.AI

Causal Scaffolding for Physical Reasoning: A Benchmark for Causally-Informed Physical World Understanding in VLMs

提出CausalPhys基准测试,含3000+视频图像问题,用因果图评估VLM推理,CRFT微调显著提升准确性与可解释性。

04:00
arXiv cs.AI

LLMCodec:适配视频编解码器实现大语言模型高效权重压缩

LLMCodec利用视频编解码器(如VVC)压缩LLM权重,无需微调,在2-bit精度下困惑度降1.5倍,准确率提升21%。

04:00
arXiv cs.AI

使用深度线性网络理论与条件ReLU简化解析Grokking中的两个训练时钟

将拟合与表示简化分离为两个训练时钟,深度线性网络对数时间降损失、多项式时间简化,ReLU同理。

04:00
arXiv cs.AI

通过对抗性合成场景学习机器人安全策略

提出智能体博弈框架,红队生成危险情境,蓝队优化安全策略,高效发现高风险边缘情况,为物理AI系统安全提供可扩展方案。

04:00
arXiv cs.AI

统一世界建模、语言推理与动作合成的世界-语言-动作模型

提出WLA模型,结合世界建模与语言推理,自回归预测状态,实现高成功率多任务学习。

04:00
arXiv cs.AI

通过元学习从隐式成本-性能偏好中学习路由大语言模型

提出MetaRouter元学习框架,通过少量交互学习用户隐式偏好,实现个性化成本-性能优化,效果优于基线。

04:00
arXiv cs.AI

AttackPathGNN:使用状态干扰图和合取池的跨函数智能合约漏洞检测

提出AttackPathGNN,通过状态干扰图和合取池实现跨函数漏洞检测,F1达92.3%,每个预测附带修复报告。

04:00
arXiv cs.AI

当足够好就是最优:量化门控DeltaNet的仅乘法矩阵求逆近似

提出基于矩阵乘法的快速三角矩阵求逆算法,在NPU上实现5倍加速和20%解码开销降低,同时保持精度。

04:00
arXiv cs.AI

基于Rashomon集合的蜕变测试:机器学习中解释的忠实性

提出蜕变测试框架,利用Rashomon集评估解释忠实性,无需真实标签,通过一致性属性筛选可信模型。

04:00
arXiv cs.AI

OPRD:在线策略表示蒸馏

OPRD通过对齐师生隐藏状态进行蒸馏,消除采样方差,比输出空间蒸馏快1.44倍、省54%内存,在AIME等测试上缩小师生差距。

04:00
arXiv cs.AI

正实数n=9的Vasc不等式的一个有限证书

AI辅助证明Vasc不等式n=9正实数情形,生成含36815个系数叶子的有限证书。

04:00
arXiv cs.AI

ITP-STDP:一种用于片上SNN训练的内定时序2的幂学习引擎

提出ITP-STDP引擎,消除STDP计算开销,能效提升4.5-219.8倍,面积仅为先前1.2%-3.3%。

04:00
arXiv cs.AI

TAM:用于操作中鲁棒运动传递的扭矩适应模块

TAM模块通过调整扭矩使机器人行为匹配理想模型,零样本迁移至真实机器人,提升动态操作鲁棒性。

04:00
arXiv cs.AI

CLEAR:端到端自动驾驶中用于自适应路由的认知与潜在评估

CLEAR用单步条件漂移替代多步去噪,结合场景感知隐状态实现高效多模态规划,在NAVSIM上取得93.7 PDMS。

04:00
arXiv cs.AI

语义与协作鸿沟的桥梁:面向冷启动物品推荐的非对称图架构

提出非对称图架构,利用时序观看历史与内在特征编码,实现冷启动物品与设备推荐隐式补全。

04:00
arXiv cs.AI

你的GFlowNet悄悄学成了一个最优传输方案

非无环GFlowNet等价于最优传输,其策略编码最优耦合,可求解大规模图OT问题。

04:00
arXiv cs.AI

设计一个集成大语言模型的可靠死亡率预测接口

提出LLM集成接口,将自然语言转为配置,提升死亡率预测的易用性和统计效力,确保透明度与可重复性。

04:00
arXiv cs.AI

双重预处理(DoPr):优化测试时性能而非验证损失

提出双重预处理(DoPr)优化方法,结合梯度与激活预处理,提升测试时性能,但验证损失未必改善。

04:00
arXiv cs.AI

适应扩散语言模型用于无损像素级图像传输

提出DDM-SSCC框架,利用扩散语言模型实现无损像素图像传输,通过双向注意力和改进去噪顺序,在多个数据集上优于基线。

04:00
arXiv cs.AI

PAMF:面向不完整时间序列数据的先验感知多模态融合

PAMF通过先验感知流匹配区分两种缺失模式,连接插补与分类,在多模态医疗时间序列上取得最优。

04:00
arXiv cs.AI

学习遗忘什么:通过学习令牌级重要性改进大语言模型遗忘

ATWU框架联合学习令牌权重与模型参数实现遗忘,无需外部监督,达到最优遗忘-保留权衡。

04:00
arXiv cs.AI

F3-Tokenizer: 驯服音频自编码器潜变量以实现理解与生成

提出F3-Tokenizer,通过噪声正则化瓶颈和表示编码器,统一音频自编码器潜变量,兼顾理解与生成。

04:00
arXiv cs.AI

免于递归的循环网络预训练

提出SMT方法,将RNN训练转为记忆转换监督学习,实现时间并行训练与稳定梯度,优于BPTT。

04:00
arXiv cs.AI

重复博弈中自适应对手的遗憾最小化

提出重复策略遗憾度量,研究其最小化条件与算法,可学习子博弈完美均衡并促进合作。

04:00
arXiv cs.AI

Code2LoRA:针对软件演化场景下代码语言模型的超网络生成适配器

Code2LoRA用超网络生成仓库LoRA适配器,零推理开销注入知识,在静态与演化基准上匹配或超越基线。

04:00
arXiv cs.AI

HANDOFF:通过蒸馏互补教师实现类人智能体任务空间全身控制

HANDOFF提出紧凑接口,通过多教师蒸馏与门控混合专家实现人形机器人全身控制,匹配SOTA速度跟踪,支持自然语言任务。

04:00
arXiv cs.AI

迈向AI流行病学:一种用于前瞻性风险检测的测量标准化框架

提出测量标准化框架,压缩专家-AI交互为结构化字段,用于AI系统前瞻性风险检测,支撑可靠性、治理与流行病学三大主张。

04:00
arXiv cs.AI

大型推理模型中的动态思考令牌选择以实现高效推理

发现推理轨迹仅部分令牌关键,提出动态选择保留其KV缓存,剔除冗余提升效率。

04:00
arXiv cs.AI

CaMeLs也可以使用计算机:面向计算机使用代理的系统级安全

提出NOVA方法,通过单次规划防御指令注入,但需额外防分支转向攻击,兼顾安全与效用。

04:00
arXiv cs.AI

学习自适应并行执行以实现高效代码定位

FuseSearch通过自适应并行策略优化代码定位,速度提升93.6%,调用减少67.7%,消除冗余信号提升性能。

04:00
arXiv cs.AI

CoT-Space:通过强化学习实现内部慢思考的理论框架

CoT-Space框架将推理转化为语义空间优化,揭示CoT长度收敛于欠拟合与过拟合的权衡。

04:00
arXiv cs.AI

Drive-KD:面向自动驾驶中视觉语言模型的多教师蒸馏

Drive-KD将自动驾驶分解为感知-推理-规划,通过多教师蒸馏与梯度投影,使1B模型性能超越78B模型,规划维度胜GPT-5.1。

04:00
arXiv cs.AI

From Out-of-Distribution Detection to Hallucination Detection: A Geometric View

04:00
arXiv cs.AI

企业代理系统中的本体约束神经推理:面向领域接地AI代理的神经符号架构

提出三层本体约束神经符号架构,实验证实显著提升LLM代理准确性和角色一致性,领域知识越弱提升越大。

04:00
arXiv cs.AI

基于LLM的语义部分接地

SPG-LLM利用LLM分析PDDL文件,启发式排除无关对象与动作,大幅加速接地,计划成本可比或更优。

04:00
arXiv cs.AI

InfoDensity:奖励信息密集的推理轨迹以实现高效推理

InfoDensity通过熵轨迹奖励信息密集推理,平衡准确率与效率,优于现有方法。