面向安全软件供应链、以区块链为锚的资源优化与能耗感知智能体AI框架
提出区块链赋能的资源优化、能耗感知智能体AI框架,保障软件供应链安全,实现可信溯源与部署策略验证。
TW3Cast: A Frozen Router of Lightly Fine-Tuned Foundation Models for Time-Series Forecasting on GIFT-Eval, Selected Entirely on the Training Split
对抗式闭环课程:面向持续进化的角色扮演智能体
提出AdvRole对抗改写框架,让场景池随扮演智能体一同进化,持续生成其薄弱场景,多基准超越基线。
中文标题:渐进式技能发现作为工具型LLM智能体的访问控制:基于角色范围能力交付的结构化治理
提出skilder:能力按角色打包、经MCP按需授予,实现确定性权限管控,实验无越权调用,兼顾灵活与硬约束。
PFArena:蛋白质修饰语言模型基准评测
PFArena基准显示:PLM擅单突变生成,LLM与智能体擅多突变排序;搜索空间和突变深度仍是难题。
面向金融决策的情景检索智能体记忆
提出META多智能体框架,借情景记忆检索历史交易,融合指标信号,提升短周期金融决策准确性与鲁棒性。
多任务模型中学习到的跨任务关系
提出通过成对任务关系近似联合分布来学习跨任务关系的框架,提升迁移学习与信息抽取,并在YouTube推荐系统验证。
人机协同驱动的假设检验:成本感知的选择性AI评分与序贯人工升级
提出SCALE策略,融合选择性AI评分与自适应人工升级,以最低成本实现有效假设检验,逼近信息论下界。
掌控运行框架,即掌控成本:企业级 AI 编程智能体的路由与治理
企业用自建路由器按请求分类调度模型,仅在缓存安全点切换,可削减 14%—21% 的模型开支。
Forecast-Dojo:用于评测与训练 LLM 预测智能体的可回放环境
可回放预测基准,含千余事件与千万新闻,支持LLM预测智能体评测训练;工具提升预测,模型仍逊于市场。
从静态个人价值观到情境化个性化:面向大语言模型的贝叶斯个性化价值对齐
提出BaCVA,以静态价值观为先验,结合情境价值显著性推断后验偏好,实现情境化的个性化价值对齐。
SLCA-GRPO:解决工具调用强化学习中的跨段信用误归因
SLCA-GRPO提出分段锁定信用分配,隔离工具与摘要token优势,消除跨段信用污染,提升准确率。
动作信用何时需要更新?
动作价值变化未必改变决策:提出成对分支敏感度与DSC-Gate,择机复用或迁移历史信用,使新增工具调用减少39.4%。
CRISS:一种辅助癌症登记员的检索增强型AI聊天机器人
CRISS基于检索增强生成,为癌症登记员提供带引文的指南问答,RAG显著提升证据支撑与回答质量。
ASIRF:面向上下文相关敏感信息脱敏的智能体框架
ASIRF推理时按领域检索定义,无需重训练,80组测试中68组召回超越OpenAI隐私过滤器。
A Wrong Turn Does Not Ruin the Journey: Deviation-Guided Skill Self-Evolution for LLM Agents
先定作用域,再谈持久化:防止智能体记忆中的跨任务族干扰
持久记忆智能体应匹配检索与认证范围,按任务族限定检索可防跨族干扰,提升效用且零有害部署。
CounterRoute:基于分层反事实信用分配的自路由推理
CounterRoute无需SFT预热,靠分层反事实信用分配与课程学习联合优化自路由和回答,九基准上兼顾准确率与效率。
面向生成式搜索的论断门控来源风险审计
提出论断门控审计:遗漏须在证据、采纳、重要性与披露齐备时判定,否则保留未决;合成套件验证契约一致性。
面向自主智能系统中BT与FSM的LLM驱动统一转换框架
提出LLM驱动FSM与BT统一转换框架,实现自动语义一致双向转换,缓解状态爆炸并提升可扩展性。
可穿戴心电信号质量评估:一种深度学习与动态情境感知方法
提出基于深度学习的心电质量评估模型,区分清洁与噪声信号,跨数据库表现稳定,并结合情境数据解析复杂噪声。
延迟满足作为长时程大语言模型的多智能体生存微观基准:社会暴露、人格设定与工具使用预算
借鉴棉花糖实验构建多智能体微观基准,以生存分析量化LLM长时程延迟满足与工具使用行为。
RD-JEPA:面向跨反应扩散方程少轨迹迁移的预测性潜变量预训练
提出RD-JEPA,在五个参数化反应扩散系统上自监督预训练,仅需少量轨迹即可高效迁移至新系统,性能优于多个基线。
LLM智能体多轮一致性评估:生存分析与失败理由分类学
通过生存分析与失败理由分类,揭示LLM智能体多轮不一致的时间规律与模型特异失败指纹。
ERRAND:智能体记忆的预算化维护
ERRAND将记忆复核视为有价差事:按动作价值定价,仅在收益超过成本时复核,克制重验优于盲目更新。
HiPACE:稀疏自编码器中特征吸收的分层相界分析与受控评估
提出闭式相界λc(k,α)与HiPACE协议,在SAE中验证特征吸收,并证明家族子空间因果充分性。
跨模态情感理解:一种用于对话情感识别的Transformer-GAT方法
提出Transformer-GAT框架,融合全局语义与模态细粒度关系,跨模态情感识别性能达最优。
PartHackBench:面向部分得分工具智能体评估的认证等进度压力测试
该基准用私有认证器对齐轨迹状态与归因,仅在事后测分数膨胀;进度固定下检验部分得分评估是否被钻空子。
iCoder-27B:递归式AI主导研发的前沿工业级编码模型
AI借专家技能自主迭代训练,产出27B工业编码模型iCoder,RTL等基准超越GPT-5.5。
思考还是不思考:把推理分配到真正有帮助之处
提出CARE方法,用在线采样对比各题长度调整的收益,在GRPO中自适应分配推理长度,准确率最高提升4%且推理长度减少37%。
C3M:面向长时程任务的跨会话多模态记忆维护
C3M以有界索引组织跨会话图文证据,经关系感知更新与预算路由保留来源与时间区分,支撑长时程推理。
基于人工智能的低分辨率远程监测数据心力衰竭恶化检测
提出TRACER模型,可从低分辨率远程监测数据中检测心衰恶化,预测住院时间线准确率达66.7%。
偏见中的黄金:通过验证使AI设计流程成熟
将偏见重构为诊断工具,提出四维验证框架,梳理30类偏见、16种验证法与20项对策,倡导伦理内置设计以构建可信AI。
打破环境壁垒:为递归式自我改进演化LLM智能体环境
提出Env-Rethink,以环境组织、噪声识别与虚拟演化增强智能体,任务通过率提升超15.1%。
面向科学影响力的构思学习
以论文引用影响力为奖励信号,训练奖励模型并用强化学习对齐构思生成器,产出更高影响力的科研想法。
编程教育中生成式AI反馈的风险自适应与证据约束框架
提出风险自适应、证据约束的生成式AI编程反馈框架,校准风险定干预时机,证据约束反馈内容,辅助逐级递进。
合成医院:一个开放、可验证、经医生校验的纵向电子健康记录基准
开源可验证的合成纵向电子病历基准,源于公开医学教育资料,前沿模型表现仍远低于医生水平。
对抗性影响在多智能体系统中如何随规模变化?
欺骗者比例而非数量决定影响:即便欺骗者占少数,大模型智能体仍常倒戈,增加智能体数量不足以防御。
PrivDrift:审计活跃 LLM 对话中话题漂移下的用户秘密泄露
PrivDrift基准:话题漂移后用户秘密仍可被探测恢复,千组对话泄露率38.7%–54.6%,属持续性行为失效。
HEXIS:将智能体技能编译为扩展有限状态机
将智能体技能编译为扩展有限状态机,分离知识与控制流,成功率平均提升16.1个百分点。
SciWalker:基于算子图与执行反馈合成科学编程问题
通过算子图采样与执行反馈合成科学编程题,构建8178题,经强化学习使SciCode子问题准确率提升9.9个百分点。
SAGE:通过拓扑引导缓解长时程推理偏差
SAGE以代数稀疏化和双曲结构引导缓解长时程推理偏差,多基准领先,Andrews-Curtis任务提升达8倍。
电子健康记录信息检索的动态基准
提出可自动生成EHR问答的可持续基准BRIE,经19名临床医生验证,揭示LLM常遗漏关键临床信息。
AD-WM:面向反事实模型预测控制的动作判别式世界模型
AD-WM提出动作判别式世界模型,用动作恢复正则保留动作信息,提升反事实MPC规划与迁移成功率。
具有自适应加权与效率评估的混合变分量子-经典框架
提出Sim-HVQC混合量子-经典网络,以无参SimAM自适应加权保留判别特征,在多类数据集上验证参数效率与可解释性。
CaliPPer:量化、预测并提升AI模型在结合预测中的性能
提出CaliPPer框架,可量化、预测并提升结合预测AI模型性能,提高新抗原与变异体发现率。
框架背后是谁?通过智能体行为对LLM进行指纹识别
LIDAR:利用编码智能体运行时决策与动作行为,黑盒指纹识别模型身份,精度超越四个基线。
持久计费状态:工具调用型LLM智能体中的“钱包拒绝服务”攻击与防御
工具调用LLM智能体可因保留外部工具返回形成持久计费状态,遭钱包耗尽攻击;提出基准与重摄入前四重防御。