6007 条条目 · 106 个活跃源
2026年6月4日
04:00
ArXiv AI

并非所有错误都同等重要:结果感知的推理计算分配

提出结果感知计算分配,通过预测错误成本调度资源,在软件工程任务中降低22-33%成本加权损失。

04:00
ArXiv AI

代理型RAG中的级联幻觉:用于检测与缓解的CHARM框架

提出CHARM框架检测多步RAG级联幻觉,实现89.4%检测率并降低82.1%错误传播,优于现有方法。

04:00
ArXiv AI

AgentJet:一种用于智能体强化学习的灵活蜂群训练框架

AgentJet分布式框架解耦架构支持多模型多任务,上下文跟踪加速训练,自动开展长期RL研究。

04:00
ArXiv AI

超越基于提示的规划:基于MCP原生图规划的生物医学智能体系统

BioManus用结构化能力图替代提示检索,压缩上下文,显著提升生物医学智能体执行准确性和效率。

04:00
ArXiv AI

通过参数化内存扩展自进化智能体

TMEM框架使智能体在线更新LoRA权重,从经验中学习改变行为,优于传统记忆方法。

04:00
ArXiv AI

Neetyabhas: 在理性主体模型中考虑不确定性的公共政策优化框架

提出整合测量与执行不确定性的分层强化学习框架,结合个体行为与多层面干预,有效降低疫情峰值和持续时间。

04:00
ArXiv AI

中文标题:一种基于ASP的合规推理的规范中间表示

中文摘要:提出MONIR用于ASP合规推理,实例化于中国ADAS法规,实验评估提取质量与求解效率。

04:00
ArXiv AI

FALSIFYBENCH:通过规则发现游戏评估大语言模型的归纳推理

提出归纳推理评估框架,测试发现:主动证伪假设是模型成功关键,推理模型优于指令微调模型。

04:00
ArXiv AI

主动推理是何种推理?

主动推理将决策视为推理,预期自由能最小化等价于变分自由能加熵校正,实验表明不同校正项在不同观测下作用各异。

04:00
ArXiv AI

爱之迷雾:在游戏环境中使用基于亲缘的强化学习构建智能体美德行为

基于亲缘强化学习在多智能体游戏中培养美德行为,提升竞争与合作表现,实现可解释性。

04:00
ArXiv AI

BiasGRPO:基于群组相对策略优化在高方差奖励景观中稳定偏差缓解

提出BiasGRPO框架,通过群组相对基线稳定对齐,比DPO和PPO更优,并创建高效偏差奖励模型。

04:00
ArXiv AI

基于树的人类-AI交互中多智能体互补性形式化

提出树形式化框架,证明互补性在回归中可达,但在分类中受限于局部聚合与损失函数条件。

04:00
ArXiv AI

AICompanionBench:以LLM为评判员评估AI伴侣安全性

首个AI伴侣对话安全基准数据集,评估20个LLM检测不安全交互,发现强模型在隐含危害和误报方面仍有局限。

04:00
ArXiv AI

R-APS: 反射对抗帕累托搜索下的组合推理与上下文元学习用于约束设计

R-APS通过推理模式分解与三时间尺度交互,无需微调即可显著提升约束设计的鲁棒性、效率与精度。

04:00
ArXiv AI

Strabo:智能体交互协议的声明式规范与实现

Strabo通过声明式协议建模UCP结账并与Google智能体互操作,展示声明式优势及渐进式引入路径。

04:00
ArXiv AI

机器如何学习?评估AIcon2abs方法

AIcon2abs用WiSARD算法,通过动手活动让各年龄层直观理解机器学习,测试获高度满意。

04:00
ArXiv AI

深度双样本检验的反事实解释

提出反事实解释框架,通过生成样本编辑揭示驱动深度双样本检验中组差异的特征。

04:00
ArXiv AI

诺亚方舟知识指数

KINA基准覆盖261学科,改进评估代表性;证明奖金机制优于固定支付;当前最优模型仅53%,提升空间大。

04:00
ArXiv AI

约束增强的物理搜索:通过相关性匹配

物理搜索效率提升在于匹配约束产生的时空相关性,关键参数是更新噪声与对比度之比。

04:00
ArXiv AI

CodegenBench:LLM能否跨架构生成高效代码?

提出CodegenBench基准,评估LLM跨架构生成高效代码,发现其在专用架构上性能显著下降。

04:00
ArXiv AI

The Variance Brain Foundation Models Forgot: Third-Order Statistics Predict Cognition Where Billion-Parameter Models Fail

04:00
ArXiv AI

需要知道:基于情境完整性的查询重写用于隐私感知的LLM委托

提出基于情境完整性的查询重写框架,用CI引导强化学习训练重写器,在隐私-效用权衡中达最优,平均效用提升10.1。

04:00
ArXiv AI

面向轻量级SensorLLM的引力感知分层路由用于人类活动识别

提出引力感知分层路由头,利用统计线索和软路由结合专家,提升轻量SensorLLM对静态活动的识别性能。

04:00
ArXiv AI

软件4.0的仿生架构

提出软件4.0自创生异质架构,将软件转化为自调节代谢网络,实现深度语义探索。

04:00
ArXiv AI

DetectZoo:跨文本、音频和图像模态的AI生成内容检测统一工具包

首个跨文本、音频、图像模态的AI生成内容检测统一工具包,标准化流程,集成61检测器与22数据集,促进可复现评估。

04:00
ArXiv AI

基于大语言模型的语义约束合成用于自适应轨迹优化

利用LLM将自然语言任务需求转化为轨迹优化代码,航天器交会实验验证高成功率。

04:00
ArXiv AI

激活即捕获:LLM代理凭证泄露的预输出与多轮检测

通过激活探针、蜜令令牌和多轮泄漏追踪,实现凭证泄露的预输出及多轮检测,优于纯文本过滤。

04:00
ArXiv AI

即时折叠:面向可变形物体操作的上下文模仿学习

基于单次人类演示,无需梯度更新即推理执行多种折叠模式,仿真训练零样本迁移至真实场景。

04:00
ArXiv AI

中文标题:上下文中的任播性能

中文摘要:根DNS任播因缓存容忍路径膨胀,CDN任播需主动工程控制延迟,两者优化目标不同。

04:00
ArXiv AI

从不可信输入到可信内存:LLM智能体中内存投毒攻击的系统性研究

系统研究LLM智能体内存投毒,识别四个写入通道与九类漏洞,构建攻击分类与基准,揭示现有防御失效。

04:00
ArXiv AI

LCSHBench:一个多语言、基于共识的美国国会图书馆主题标引基准

LCSHBench多语言共识基准,含15语言22346本书,评估主题标引精确与概念匹配,微调嵌入器提升检索。

04:00
ArXiv AI

基于LLM的分层偏好排序:重新思考销售线索评分

提出HPRO分层偏好排序优化,转化稀疏标签为偏好对,AUC达0.816,排名精度提升39.7%,销量增长9.5%。

04:00
ArXiv AI

如果提示注入从未消失?探究代理系统中的跨会话存储提示注入

跨会话存储提示注入使提示注入从短暂威胁变为嵌入系统状态的长期漏洞,亟需关注与防御。

04:00
ArXiv AI

QuBLAST:一种采用块级压缩与激活缩放的大语言模型量化框架

QuBLAST通过块级混合精度量化与激活缩放,减少模型大小40%-45.2%,困惑度增幅<5%。

04:00
ArXiv AI

ANN搜索:召回真正重要的内容

用1/Ratio@k替代Recall@k评估ANN质量,更准确高效且无需人工参数。

04:00
ArXiv AI

Ekka:大语言模型推理中静默错误的自动诊断

Ekka通过差异调试自动诊断LLM推理中的静默错误,准确率高达80%以上,并成功发现多个新错误。

04:00
ArXiv AI

真实世界MCP服务器中描述与代码的不一致性:测量、检测与安全含义

研究MCP服务器描述与代码不一致问题,提出DCIChecker框架,发现9.93%不一致,揭示安全风险并提出缓解策略。

04:00
ArXiv AI

图引导的广义特征值近似支持向量机中的通用空间学习用于阿尔茨海默病分类

提出图引导的通用空间学习模型,利用MCI数据构建图正则化,在AD分类中达88.07%平均AUC并保持稳定。

04:00
ArXiv AI

使用状态空间模型在连续时间动态图上学习长程时空表示

提出CTDG-SSM框架,通过拓扑感知记忆更新实现长程时空推理,在多项任务中达最优。

04:00
ArXiv AI

VISTA:基于视觉和物理验证的UMI数据适应VLA训练

针对UMI数据训练VLA的鱼眼畸变与轨迹物理不可行问题,提出VISTA框架,含UMI-VQA、物理验证与两阶段训练,显著提升性能。

04:00
ArXiv AI

从提示到流程:支持AI软件开发代理的流程分类法与框架比较评估

提出六维流程分类法,评估六个框架,发现流程深度与可移植性存在权衡,孤立提示不再重要。

04:00
ArXiv AI

风险感知强化学习中具有近似安全保证的场景生成

用VAE近似状态分布,构建上下界屏障证书,采样非鲁棒区域收紧概率安全边界,提供高置信安全保证。

04:00
ArXiv AI

Isabelle/HOL中的溯因证明器

针对证明助手自动化不足,提出溯因证明器,利用溯因推理识别猜想生成证明脚本。

04:00
ArXiv AI

基于人类编写本体的可证明可审计且安全的LLM智能体

提出Agentic Redux架构,通过类型化λ演算保证语义正确并记录于账本,应用于医疗账单与安全漏洞披露,引入本体优先设计方法。

04:00
ArXiv AI

不变梯度对齐用于鲁棒推理蒸馏

提出IGA框架,通过逻辑异构集与梯度冲突掩码实现跨域对齐,OOD泛化提升14.3%,逻辑一致性提高4倍。

04:00
ArXiv AI

从智能体轨迹到信任:大语言模型智能体中的证据追踪与执行溯源

提出证据追踪与执行溯源框架,解决LLM智能体执行过程难验证问题,推动从结果正确性转向过程问责。

04:00
ArXiv AI

通过学会防御性推理对齐深层隐性偏好

提出CDRA方法,利用推理链和生成式奖励模型对齐用户深层隐含偏好,实现防御性推理,实验表现优异。

04:00
ArXiv AI

使用自适应和非自适应粒子群优化的多列RBF神经网络

提出MC-PSO和MC-APSO,并行RBFN结合PSO/APSO,提升准确率和召回率,训练测试更快。

04:00
ArXiv AI

自我反思API:结构优于冗长,助力AI代理恢复

AI代理遇API验证错误时,结构化建议提升任务完成率36.7-40个百分点,效率高1.8-2.2倍(Anthropic模型)。

04:00
ArXiv AI

破坏有害分子:多模态大语言模型能否实现结构级分子解毒?

提出首个分子毒性修复基准ToxiMol及评估框架ToxiEval,测试43个MLLM,发现其展现潜力但挑战仍存。