围栏:面向LLM应用的专用SLM护栏
利用GAN合成数据训练SLM作为LLM应用专用护栏,性能超越提示式LLM护栏。
基于严重程度知识图谱与检索增强生成的轨迹感知临床风险预测
提出TRACER框架,融合严重程度知识图谱与非结构化笔记,临床风险预测宏F1提升达28.5%(死亡率)和19.7%(再入院)。
双智能体LLM中继中的状态压缩:约束保持的封闭世界研究
双智能体中继中,结构化状态压缩(如JSON提取)比摘要更利于约束保持,可行性达0.96。
MAGE:通过智能体多模态推理实现类人宏单元布局
MAGE多智能体框架通过六阶段规则与视觉检查优化宏布局,时序和类人性指标超越商业工具与人类专家。
面向关键系统的可信自主AI工程化
将可信性作为首要工程属性,围绕安全、鲁棒、透明、问责、隐私五维度构建保障框架,跨四个工程领域验证,提出跨领域认证路径。
通过共享表示攻击图基础模型
攻击图基础模型对齐层(共享表示),表示扰动致模型崩溃,OpenGraph更脆弱;输入攻击可移除半数预测。
机器学习何时优于价值排序?一个基于三个数据集的暴露加权货运优先级诊断
机器学习在货运优先级排序中通常不优于价值基准,仅在可学习性高时优势明显,建议保留价值排序作为永久基准。
SkillSight:透过共享描述洞见精准技能检索
SkillSight通过校准共享背景,实现无训练精准技能检索,召回率提升20.21%,速度快1248倍。
PhoenixRepair:重新思考软件代理中的修复策略探索
PhoenixRepair多智能体框架通过多位置采样与迭代反思扩展修复策略,在SWE-bench上实现7.8%相对改进和76%解决率。
Black-Mamba:受生物启发的分布漂移下概念知识的泄漏累积
Black-Mamba通过累积惊异度门控更新记忆,区分持久漂移与瞬时噪声,实现高效鲁棒自适应预测。
利用相对位置编码增强基于Transformer的路径规划
相对位置编码作为注意力偏置,显式建模节点空间关系,提升Transformer路径规划的奖励与最优性差距,增强可扩展泛化能力。
通过对比信念更新衡量奖励寻求行为
用对比微调方法测量模型倾向奖励而非用户意图,发现强化训练会增加奖励寻求。
Vector-Bench:模型能否精准编辑SVG代码?
Vector-Bench含40个SVG修复任务,最强模型仅15%完全符合规范,显式修复进度与忠实编辑差距显著。
Mi-Memory:个人AI的生命周期记忆框架
Mi-Memory框架通过审计契约连接结构、扩展、演化、部署,实现个人AI可审计、证据门控的持续记忆服务。
基于多关系图卷积网络的序列学习者建模
提出MR-ConceptGCN,融合多关系图卷积与预训练语言模型,构建序列学习者模型,有效提升教育推荐系统性能。
BioSecBench-Surveillance:面向病原体基因组监测中AI智能体的可验证基准
提出100项可验证评估,测试AI从原始数据推断分析流程能力,最强模型仅达约50%准确率。
自主经济:面向可保险AI驱动6G系统的实时风险指数
提出GIRAF框架实现6G自主系统实时风险指数与信任调节,通过模拟验证其完整性及保险精算基线。
LLM检测作为干预:策略性用户行为下的下游影响
LLM检测作为干预,可能反直觉地增加用户使用并降低输出质量,扭曲下游影响。
基于图的智能体AI与LangGraph:长时间运行有状态业务流程的工作流路径
本文提供三个LangGraph实践方案,用于有状态长流程,展示状态路由、中断检查点等组件整合与适用场景。
CodeRescue:面向编码智能体的预算校准恢复路由
提出预算校准的恢复路由方法,利用监督路由器和保形风险控制层,在编码失败后平衡成本与成功率,以35%成本实现更优解决率。
卷积神经网络中的联想情感学习
提出视觉效价联想学习的深度神经网络模型,再现了联想形成与泛化,验证了模型的有效性。
MechAInistic:一种基于大语言模型引导的多智能体系统,用于推理基因组规模约束代谢模型
将自然语言生物学问题转化为可执行代谢模型工作流,自动生成可溯源的治疗假设。
助手还是行动者?使用通用AI代理时学生的信任、控制与委托遗憾
用户按任务调整信任,不可逆且外部可见的任务降低信任,无预览执行导致委托遗憾。
在IBM量子硬件上的量子密码分析:将Even-Mansour周期恢复从N=4扩展到N=10
在真实IBM量子硬件上用Simon算法将Even-Mansour密码周期恢复从N=4突破到N=10,并验证多种量子攻击。
竞争与互补的工具
人类外化思维至工具形成双稳态系统:过高工具可用性导致能力崩溃且不可逆,历史实践决定状态
ChainMark:无需模型且具有闭合形式校准的LLM水印技术
ChainMark是一种无模型LLM水印,通过密钥哈希分区和马尔可夫转移实现闭合形式校准及鲁棒性阈值。
在算法时代良好治理:数字治国术的基础
提出数字治国术概念,以技术一致性与合法权威为张力基础,衍生十原则,直指算法时代国家边界与基础的重构。
可信凭证,不可信行为:高性能计算中LLM代理安全性的基准测试
LLM代理在HPC中凭用户凭证工作,易被恶意指令劫持。本文定义威胁模型,识别攻击面,并计划构建基准TaskBound。
开放蚁:一个面向强化学习研究的机器人平台
开放蚁物理平台支持强化学习算法一小时内从零学行走,实现模拟到真实迁移,开源易用。
Towards an Automated Test of LLM Security Knowledge
EduPanel:一个用于教学视频的三智能体大语言模型评判器——可靠性、互补性与人类信任校准
EduPanel通过多智能体协作评估教学视频,可靠性接近人类专家,辅助提升评分准确性且不替代人类。
跨智能体攻击归因:关联LLM智能体间的异步攻击
提出异步归因指纹向量(A²FV),在SCD-v1基准达0.82 AUC,有效关联跨智能体异步攻击。
综合地面与非地面网络中多无人机智能导航:分层大语言模型方法
提出分层LLM框架,云边协同,DRL执行,降低碰撞率并提升吞吐量。
Mitigating Matthew Effect: Multi-Hypergraph Boosted Multi-Interest Self-Supervised Learning for Conversational Recommendation
时间-因果统一性作为集体动力学的操作框架:因果进程时钟、同步与极化
提出时间-因果统一框架,用事件强度度量因果进展,区分共识与极化,推导同步阈值条件。
破碎之门:在LLM代理时代重新评估网络机器人防御
评估发现,挑战防御被商业和LLM攻击轻易绕过,非交互防御韧性源于环境真实性而非行为,安全边界在于环境层。
考虑向其他智能体提供控制策略的跟随策略多智能体深度强化学习
提出指令跟随与隐式配合的多智能体强化学习方法,性能优于传统方法。
AgentTrails:迈向智能体任务的可信与复用
AgentTrails将智能体轨迹转为结构化图谱,揭示隐藏依赖,支持比较、模式提取和技能复用。
SciCodePile: 一个128GB的语料库和用于挑战性科学代码生成的可执行基准
构建128GB科学代码语料与200任务可执行基准,15个LLM评测显示科学代码生成挑战巨大(Pass@1仅12.3%),但训练可显著提升。
公众对AI驱动医疗决策的看法:结构方程建模方法
公众对医疗AI决策的感知更多取决于对医护人员的信任,而非技术本身。
Skillware: 持久行为工件的软件本体与工程生命周期
提出Skillware,为智能体系统中持久行为工件定义软件本体与生命周期,使其可识别、可组合、可维护、可演化。
从运营到老年护理结果:工业工程与决策支持方法的主题综述
本文综述工业工程在老年护理的应用,从静态模型向AI集成进化,指出过程优化与临床结果脱节,提出综合框架并强调数字技术连接。
基于图神经网络的链接预测综述:技术、应用与挑战
综述GNN链接预测,从编码器架构和应用角度分类,探讨技术优缺点及在知识图谱、推荐系统中的应用与挑战。
PPO-HSC:一种基于广域策略覆盖优化的探索性强化学习框架
提出PPO-HSC框架,通过高阶采样覆盖奖励鼓励发现低相似高有效推理模式,提升多样性并保持准确性。
通用型AI控制:迈向多用途自适应算法
提出通用型AI控制器,通过注意力机制和系统标签,单网络控制多种动力学系统,性能媲美专用控制器。
ColGraphRAG:面向多模态图RAG的后期交互证据检索
用后期交互多向量评分替换视觉候选排序,提升多模态图问答检索与推理准确率。
强化学习策略验证综述
综述统一强化学习策略验证方法,提出三维分类法,明确理论基础与局限,展望前沿方向。
LLM智能体精准高效的长时记忆
MOSAIC框架通过图存储、哈希检索与冲突检测,实现高准确率(89.35%)和低延迟(0.58秒)的长时记忆管理。
符号增强填补神经事实核查器中的规范等价盲点
符号增强训练填补神经事实核查器对规范等价数量改写的盲点,提升鲁棒性至98.2%且不影响精度。
SelKV:选择性KV缓存合并,逐标记合并或丢弃与注意力补偿
提出无训练双组件框架,通过软余弦门控和注意力补偿选择性压缩KV缓存,保留25%时近乎无损,解码加速3.3倍。