鲁棒判别器:防御大语言模型在多轮对话中的攻击
提出DCGS框架,通过对话历史推断用户意图,采用值函数和遗憾批评者,提升多轮对话鲁棒性。
多传感器物理危害评估中的大语言模型基准测试
大模型在多传感器接近阈值时缺乏预警,但单传感器判断准确。
SonicSampler:用于大语言模型采样与推测验证的统一分块感知内核
提出SonicSampler,统一分块感知内核融合采样与推测验证,两阶段top-k算法实现10倍加速,异构负载达16倍加速。
VeriSimpl:基于简化验证的自然语言鲁棒优化建模
VeriSimpl框架通过简化验证策略,让LLM局部推理约束与变量,提升优化建模准确率并实现高精度自验证。
Beyond Liars' Bench: The Impact of Lie Typology, Depth, and Sparsity on Deception Detection in LLMs
自回归语言模型的易处理层次控制
本文证明有限LR(k)文法满足可在多项式时间计算,实现高效约束,保证LLM生成语法有效。
魔鬼在频谱中:通过拓扑正则化侧路径缓解大语言模型的表示坍缩
TRSP通过拓扑正则化侧路径实现谱平衡,缓解表示坍缩,8倍训练长度下准确率83%,超越对比方法30-50百分点。
基于注意力的经验回放框架用于持续学习自适应时间序列预测模型
提出注意力经验回放框架,实现时间序列模型持续学习,缓解灾难性遗忘,提升动态环境性能并降低再训练成本。
中文标题:自主拓扑变异:具备能力、状态和影子不变量的多智能体LLM系统安全运行时重构
中文摘要:ATM通过遥测监控与三个安全不变量动态重构多智能体系统,将任务成功率从3.3%提升至61.7%,隐私泄露降至0,延迟<500微秒。
从错误到规则:面向文本分类的迭代提示优化
提出ERGO方法,通过错误驱动迭代优化提示,在边界可学习任务上实现高效可解释分类。
AISE-Bench:面向学术知识图谱信息检索的全周期精心策划基准
首个全周期学术知识图谱信息检索基准,含1133个QA对,评估多步API规划与执行,最强模型仅表现中等。
FlowEdit:面向冲突不适定问题的LLM推理流信息论控制
利用信息论调节LLM推理流,生成冲突问题下的多样响应,准确率提升68%,信息量提升24%。
诱导因子化概率分布的可比性
通过条件均匀扩展将不同变量集上的概率图模型提升至公共可测空间,保留概率语义且投影不变,实现可比性。
MiniCache:利用小模型接口实现高效LLM推理的可重用程序缓存
MiniCache通过小模型接口实现程序缓存复用,降低大模型调用开销,提升推理效率达3.1倍。
SiGMA:面向多模态持续指令微调的符号引导合并与适应
提出SiGMA框架,用符号引导自适应调优与合并减轻负干扰,在多模态持续指令微调中达最优性能。
基于可靠性感知的LLM对齐方法应对不一致人类反馈
提出RGPO框架,通过估计标注者可靠性和动态优化,有效应对不一致人类反馈,提升LLM对齐性能。
注意力退化、功能标记锚定与基于注意力的大语言模型干预的局限性
平均注意力退化是描述性而非因果性的,功能token的作用在于隐藏状态计算而非接收的注意力。
CANN Bench:在真实NPU和算法极限下对AI生成的内核进行基准测试
CANN Bench是华为Ascend NPU上AI生成算子代码的开放基准,覆盖53算子,三维评分评估编译、正确性和性能,对标基线和硬件极限。
使用GPT-5.5 Pro自动反证实数上的和积猜想
GPT-5.5 Pro自动生成七种反证,证明和积猜想在实数上不成立,平均每试13.2万推理令牌。
AppWorld-UL:用于工具使用的多样化代理-用户交互基准测试
AppWorld-UL基准含516个需代理-用户交互的任务,最佳模型成功率仅48.6%,凸显用户交互对工具使用代理成功至关重要。
DynamicMCPBench:基于轨迹与效果评分的LLM智能体实时MCP服务器基准
DynamicMCPBench是可复用框架,通过轨迹效果评分评估LLM智能体,实验显示最强仅解决半数任务,长链任务准确率骤降。
AI驱动的多跳中继选择:通过学习优化图神经网络实现智慧城市NR-V2X网络
提出图神经网络学习优化框架,实时选择多跳中继,性能接近最优且延迟极低。
深度研究是否可靠?误导性知识诱发错误结论
误导知识可致深度研究智能体输出错误结论,聚焦验证与流程证据脱节,现有防御效果有限。
使用轻量级时间卷积网络的高效可解释身体情感识别
轻量级TCN以少79%参数和12.5倍低延迟实现接近图模型的性能,并揭示上身运动是情感识别的关键线索。
拒绝门控解码:在高温度采样下保持拒绝行为
提出拒绝门控解码,高温度下保留模型拒绝行为,保持安全性且低延迟。
审计医疗大语言模型诊断中的证据使用
提出行为审计法,分解证据评估模型,发现多数交互合理,但准确率可能掩盖证据使用失败。
审计LLM智能体动作选择中的来源敏感性
LLM动作选择受不可信证据影响,审计显示5.4%竞争案例有差异,2.4%保留未授权竞争。
面向通过公开测试的代码的代码监控红队测试
公开测试通过后,弱LLM验证器在低误报率下仍漏检大部分隐藏bug,对抗性测试进一步降低其性能。
GuardianAgentBench:智能体失败之处与防护之道
GuardianAgentBench基准测试揭示模型工具调用失败模式,守卫机制以0.5%误报率恢复19.9%失败,提升安全性。
源先验驱动的选择性适应用于高效扩散模型微调
通过识别低影响参数并结构化更新,实现扩散模型微调中适应与保留的更好权衡。
可溯源学术:生成式AI时代人文学探索的页面锚点与阿里阿德涅之线
可溯源学术是AI辅助人文学研究的最低规范,通过页面锚点等技术确保来源可溯,维持研究公开可反驳。
OPOD:在策略全模态蒸馏
OPOD通过路由学生响应至匹配模态教师并平衡指导,在12项基准中达到平均最优,超越联合训练和专家模型。
工作流局部机制学习:结构化智能体技能的归因引导修复与知识重用
WML通过归因识别工作流故障节点并局部修复,在表格和编译任务中高效提升技能成功率并降低成本。
SafeStep:面向虚弱或痴呆老年人的AI出行辅助
SafeStep结合路线规划与预测建模,利用LLM和Anticip8生成干预措施,提升老年人出行成功率,实验证实有效。
EmoAgent-R1:基于强化学习的动态智能体特化实现多模态情感理解
用强化学习动态特化智能体,结合P-GRPO算法,提升多模态情感识别与推理稳定性。
Naju:原生离散状态空间模型,独立保持与写入实现长序列记忆
解耦遗忘门与写入增益,Naju在保持与覆盖间达最优,长程记忆超越Mamba,线性复杂度媲美Transformer。
更快IndexTTS-2:GPU上加速与流式自回归零样本语音合成
利用TensorRT加速IndexTTS-2,GPT提速5倍,端到端提速3.6倍,支持流式合成,质量几乎无损。
AttriMem: 归因引导的智能体记忆学习过程反馈
AttriMem利用归因过程反馈和局部奖励学习记忆策略,在长时对话问答中超越多种基线。
语音到语音LLM助手的安全保障:汽车应用案例研究
语音到语音助手在汽车应用中因高延迟和技术障碍,现有安全措施不足,需应对开放挑战。
BasketEvent:理解篮球视频中谁做了什么以及何时做的
提出以球员为中心的数据集BasketEvent及推理框架PlayNet,精准定位事件责任人与时序证据。
通过归纳逻辑程序设计解释天气预报公报
基于FastLAS2的ILP方法,从气象数据与公报中生成可解释假设,阐明天气预报符号的选择依据。
利用机器学习识别高效单常数乘法SAT编码的优良规则
神经符号框架用图网络预测算子,剪枝无效选择,使编码时间、内存和分支大幅下降,保持近最优质量。
一种新的描述逻辑程序良好支持语义
新语义严格评估本体原子,保持一致性NP完全,避免循环依赖,更接近逻辑编程。
ICAE-Bench:评估编码智能体作为交互式项目构建者
引入ICAE-Bench基准,从模糊需求出发模拟交互式项目构建,通过自动化用户代理和黑盒测试多维评估编码智能体。
连接合理性与可接受性之间的鸿沟:面向动态图系统的约束感知流映射
扩散模型生成动态图轨迹,符号约束提升结构可行性与可接受性,复杂度越高效果越显著。
基于粒球的协同边效应实现忠实图解释
提出SeeExplainer,利用粒球分解捕获边协同效应,生成忠实解释子图,优于现有方法。
MSBraM:用于分层脑电动力学学习的多尺度自监督脑基础模型
提出MSBraM多尺度自监督脑基础模型,分层学习脑电表示,在多个任务上超越现有模型,证明多尺度时间建模之关键。
智能体引导的关系概念发现:迈向可解释的手术切缘评估
提出智能体引导概念发现框架,无需预定义标签,提升手术切缘评估准确性与泛化能力。
检测人机合著文本中LLM生成的词元
提出无需标注的token级检测方法,自适应平滑邻域分数以定位LLM生成内容。
AREX:迈向递归自我改进的深度研究代理
AREX通过内外循环交替与自动上下文压缩实现递归自我改进,在多项基准测试中超越同规模模型。