AI代理的解释绑定工具执行:服务器验证的动作声明,无需依赖模型推理
提出EBTE中介层,将推理内容转为可验证动作声明,冲突拒绝、不确定审查,仅匹配可执行,实验验证可行性。
上下文组装作为被控变量:冻结LLM智能体调控策略的控制理论视角
将上下文组装视为被控变量,通过在线策略优化实现冻结LLM智能体的稳定控制与不确定性校准。
具备网络能力的AI智能体:漏洞、评估隔离与防御响应
综述五类边界漏洞,以2026年HF/OAI事件为例,探讨评估与控制的安全优先事项。
COVENANT: 面向对齐智能体执行的自然语言工作流编译
COVENANT将工作流指令编译为控制流图并解释执行,确保对齐,成功率从50%升至83%,错位失败率降低62.75%。
关键知识路径:面向高效知识密集型多模态问答的稀疏跨模态路由
SKIP稀疏路由架构以3.4-6.8倍更少计算量,在五个KI-MMQA基准上匹配或超越密集基线精度。
从训练到部署:基于灵敏度比的事后因果特征识别
NSR方法通过灵敏度比准确识别因果特征,理论保证且无需修改训练模型,实验验证有效。
智能体技能至关重要:从执行轨迹中推断专有技能
提出SigLeak框架,从执行轨迹中重构专有技能,平均成功率提升6.88%,实现最高语义相似度,证明行为侧信道暴露专有知识。
CoRT: 基于反事实重放的Token级评分引导策略优化
CoRT利用反事实重放实现token级信用分配,无需辅助模型,平均提升4.4个百分点。
通过工具链工程分发安全控制
SHarD工具链嵌入OS沙箱等三类安全控制,单命令分发,效能等同最佳商业代理,实测满分。
通过LLM生成的推荐解释助推可持续选择
LLM生成的助推解释通过框架化或社会规范显著促进可持续选择,单纯披露信息无效。
Cognivia:面向循证心理保健的认知行为疗法辅助系统
提出Cognivia AI治疗师,基于CBT自动识别认知扭曲并生成理性回应,效果优于基线方法。
边推理边推测:通过联合智能体-推测器强化学习教会智能体预测下一次工具调用
提出自推测智能体,用联合强化学习统一任务执行与工具调用预测,在保持成功率同时大幅提升预测准确率。
HiSkill:用层级技能图赋能大语言模型智能体
HiSkill构建层级技能图连接高层技能与可执行动作,提升长时任务效果,减少推理消耗。
基于贝叶斯网络的LLM多智能体系统运行时不确定性监控
提出利用贝叶斯网络将token级log概率校准为任务级置信度的方法,用于LLM多智能体系统的运行时不确定性监控。
不可信的作者,可信的答案:保真度分级翻译的演算
提出保真度分级翻译演算,构建翻译图回答程序问题,实现LLM不可信下的可信答案,经Lean4机械验证和测量。
dtControl2+ε:通过决策树在MDP中权衡最优性与可解释性
dtControl2+ε通过允许不精确度ε构建更小决策树,保证ε最优性同时提升可解释性,树规模大幅减小。
Messier:用于跨基准智能体评估的高分辨率语料库
Messier统一语料库含95.7万记录,覆盖30基准、714智能体,揭示能力进展不均,支持能力标度与基准审计。
CHARM:具有分层上下文建模的多模态图基础模型用于零样本迁移
CHARM通过分层图上下文建模融合多模态信息与图结构,实现多模态图零样本迁移,性能提升。
落后驱动不安全发展:一项理想化AI竞赛实验
实验显示,不安全行为源于落后恐惧和对手行为,而非风险偏好,政策应聚焦减少竞争压力。
桌面Delta基准:计算机操作模型能否理解桌面GUI变化?
新基准DDB评估模型对桌面GUI因果转换的理解,发现排序和动作定位存在显著差距。
解锁大型视听检索模型中的空间定位能力
利用音频查询中间视觉token,轻量池化恢复空间信息,实现弱监督音频-视觉定位SOTA性能。
面向对象编程课程中学习者与AI的交互模式与学业表现
研究显示,学生多将AI用于解释和调试而非代码生成,不同使用模式未导致成绩差异,表明自我导向AI使用无直接学习收益,需教学引导。
无怀疑的验证:将用户侧监督重新定义为日常人机交互中的常规认知治理
信任与验证无关联,用户侧实践(优化、纠正、批准)提升满意度,监督应视为常规认知治理。
检索的三重维度:RAG中文档侧、查询侧与答案侧互补性的因子证据
提出零LLM成本的目录引导页检索,通过因子实验证明三方增强互补性,显著提升答案质量。
从想法到课堂仅需数日:使用“氛围编码”从IDE活动日志创建编程过程可视化工具
快速开发Thonny日志可视化工具,用AI“氛围编码”解析IDE日志,生成编程过程视图,辅助教师教学与学术审查。
DDSNet:面向PCSEL性能预测的双域对称感知网络
DDSNet双域对称感知,融合谱滤波与结构先验,精准可靠预测PCSEL性能。
Automatic Stability and Recovery for Neural Network Training
具身性引发的表格多智能体Q学习中的协调机制
具身约束下,独立学习优于集中式,混合配对效果最差。
基于共识的去中心化多智能体群体用于工业物联网自主电网安全
提出DMAS架构,通过共识验证实现近即时威胁隔离,响应0.85ms,检测率97.3%,零日攻击87%,带宽降89%。
面向边缘AI系统的可扩展可解释性即服务(XaaS)
提出XaaS架构,解耦推理与解释生成,通过缓存、验证与自适应引擎降低38%延迟,保持高质量,适用于大规模异构边缘系统。
预测查询语言:一种用于关系数据库预测建模的领域特定语言
提出SQL风格的预测查询语言(PQL),自动从关系数据库提取训练样本,支持回归、分类、时间序列等多种机器学习任务。
DataFlow-Harness:一个基于实体的代码智能体平台,用于构建可编辑的LLM数据管道
提出DataFlow-Harness平台,以DAG增量修改构建管道,通过率93.3%,成本降72.5%,延迟降49.9%。
DSTFView:双输入时空频率建模的多视角云边工作负载预测
提出双输入时空频域多视角框架,联合建模接近性与周期性依赖,自适应融合捕捉突变,性能优于基线。
SeT-Diff: 面向HPC遥测和时间序列的语义基础模型
提出首个HPC遥测基础模型SeT-Diff,基于扩散与语义解耦,重建MAE 0.047,零样本稳定,单模型支持插补、预测和虚拟感知。
基于概念的扩散模型视觉反事实解释
C-VCE将分类器嵌入扩散模型,通过概念瓶颈层生成微小可控的逼真反事实,提升可解释性与安全性。
QFoldAgent:一种用于蛋白质结构预测的自主量子优化多智能体系统
QFoldAgent闭环多智能体框架通过迭代优化哈密顿惩罚,降低RMSD并提升结构有效性至98.7%。
MIITA:面向小语言模型持续学习的内存引导推理时自适应
MIITA框架通过存储与检索校正方向原型,实现小语言模型在持续学习中的非破坏性知识复用,有效缓解遗忘。
DeepLens诊断代理:智能工作流设计让小型推理模型与前沿LLM竞争
DeepLens通过五阶段工作流(小模型+RAG)使诊断准确率提升36%,成本低于前沿LLM且性能更优。
中文标题:编码评判者:通过程序提炼实现可扩展评估
中文摘要:程序蒸馏替代LLM评判,低成本高透明,性能匹配13B模型,奖励信号更优。
面向工业4.0智能体评估的合成场景生成
提出合成场景生成管道,优化后效率提升8倍,质量稳定,扩展工业智能体基准测试。
TILT: 利用模型内在奖励提升扩散模型的组合生成能力
TILT提出无需训练的内在奖励对齐方法,通过KL约束倾斜分布改进扩散模型组合生成,提升对齐度和图像质量。
SCOPE与SCION:面向文本模式归纳与融合的基准测试与可审计参考流程
提出模式归纳基准SCOPE与可审计流程SCION,SCION-lite在多项指标上达最高F1。
通过内部信息分解保障多模态AI安全
提出FlowGuard,监控跨模态一致性检测有害输入,攻击成功率从>90%降至<15%,效用损失<3%,延迟减少6倍。
拓扑与执行耦合的层次搜索:智能体工作流合成
提出HierFlow免训练层次搜索,反馈调整拓扑与MCTS优化子工作流,智能门控实现高效均衡。
程序性知识并非低秩:LoRA为何无法内化多步骤流程
LoRA在程序性任务中有效秩高达761-1026,远超128,导致其无法匹配全量微调性能。
FrED:基于领域知识图谱的外部数据影响估计
提出黑盒概率框架,融合特征相似性与领域知识图谱,实现高效可解释的训练数据归因与领域锚定检索。
硬决策层:Transformer中承诺推理的证据
发现Transformer硬决策层(HDL),答案排名在此突然稳定,准确率显著提升(最高+0.61),且架构固有、不受微调影响。
VLMs是阅读还是改写?论视觉语言模型转录的忠实性
VLMs易改写不完美文本,短词改写率高达10%,长词则忠实转录。
FBLayout:优化移动GPU上大语言模型高效微调的内存布局
FBLayout通过统一R-Tile布局和激活引导布局选择,在移动GPU上实现2.2-5.7倍加速,提升缓存效率,实现端侧大模型微调。
从用户档案到引导向量:全局稀疏先验与局部语义校准用于个性化文本生成
提出GLASS无训练框架,通过稀疏自编码器提取全局风格先验与局部对比向量,无需检索或微调即实现个性化生成。