5461 条条目 · 106 个活跃源
2026年6月6日
04:00
arXiv cs.AI

CoT-Space:通过强化学习实现内部慢思考的理论框架

CoT-Space框架将推理转化为语义空间优化,揭示CoT长度收敛于欠拟合与过拟合的权衡。

04:00
arXiv cs.AI

Drive-KD:面向自动驾驶中视觉语言模型的多教师蒸馏

Drive-KD将自动驾驶分解为感知-推理-规划,通过多教师蒸馏与梯度投影,使1B模型性能超越78B模型,规划维度胜GPT-5.1。

04:00
arXiv cs.AI

From Out-of-Distribution Detection to Hallucination Detection: A Geometric View

04:00
arXiv cs.AI

企业代理系统中的本体约束神经推理:面向领域接地AI代理的神经符号架构

提出三层本体约束神经符号架构,实验证实显著提升LLM代理准确性和角色一致性,领域知识越弱提升越大。

04:00
arXiv cs.AI

基于LLM的语义部分接地

SPG-LLM利用LLM分析PDDL文件,启发式排除无关对象与动作,大幅加速接地,计划成本可比或更优。

04:00
arXiv cs.AI

InfoDensity:奖励信息密集的推理轨迹以实现高效推理

InfoDensity通过熵轨迹奖励信息密集推理,平衡准确率与效率,优于现有方法。

04:00
arXiv cs.AI

无需训练RDB基础模型

通过限制压缩至同质高维列,无需训练即可将多表RDB与现有单表ICL模型无缝配对。

04:00
arXiv cs.AI

打破链条:LLM对中间结构忠实性的因果分析

LLM对中间结构的忠实性脆弱,干预后预测不更新,中间结构实为上下文而非因果中介。

04:00
arXiv cs.AI

Trace2Skill: 将轨迹局部经验提炼为可迁移的智能体技能

Trace2Skill从执行轨迹归纳可迁移技能,跨模型规模提升达57.65%,压缩错误为标准化程序。

04:00
arXiv cs.AI

两步代理:决策者与AI决策支持交互的框架

提出框架建模人类从ML决策支持的学习过程,发现即使模型正确且理性,错误先验也可能使支持有害。

04:00
arXiv cs.AI

MUSE:评估可制造、功能性与可装配的文本到CAD生成基准

MUSE基准聚焦复杂B-Rep组件,通过三阶段协议和VLM评判可制造性、功能性与可装配性,推动文本到CAD从几何生成迈向工程设计。

04:00
arXiv cs.AI

检索增强生成必须超越事实基础以呈现多元观点

RAG系统存在忽视意见多样性的结构性偏见,O-RAG架构通过意见提取实现多样性提升,呼吁范式转变。

04:00
arXiv cs.AI

SUPERNOVA:利用自然指令上的强化学习激发大语言模型的通用推理能力

提出SUPERNOVA框架,从自然指令数据构建可验证奖励强化学习数据集,显著提升大模型通用推理能力,泛化性强。

04:00
arXiv cs.AI

证据胜过计划:技能蒸馏的在线轨迹验证

提出后验蒸馏指数PDI,通过在线轨迹验证生成环境验证技能,显著提升任务成功率。

04:00
arXiv cs.AI

面向过程奖励模型的可控可验证过程数据合成

提出可控可验证框架合成过程监督数据,注入错误并验证一致性,提升逻辑推理重排序,揭示第一错误定位挑战。

04:00
arXiv cs.AI

谁的校准?比较不同组织决策背景下的LLM过程校准

组织决策中LLM过程校准因模型和组织而异,高校准并非总是理想,需根据策略规范性决定。

2026年6月5日
04:00
arXiv cs.AI

中文标题:他们走了多远?已中止实地实验中隐秘LLM代理的说服策略

分析隐秘LLM代理在辩论中的说服策略,发现其系统运用权威与认知偏见,与人类模式相反,提示需审计AI可信度结构。

04:00
arXiv cs.AI

面向循环工厂的不确定性感知功能行为预测与材料疲劳评估

提出不确定性感知功能预测与疲劳评估框架,结合力-扭矩数据,实现角度磨床高精度可靠性预测。

04:00
arXiv cs.AI

驾驭通用智能体实现情境化时间序列分析

提出TimeClaw框架,集成工具、演化和记忆,让通用LLM智能体实现情境化时序推理,性能显著提升。

04:00
arXiv cs.AI

LeanMarathon:通过长周期Lean自动形式化实现可靠的AI合作数学家

将长周期形式化分解为并行可恢复事务,成功证明4个Erdos问题7个定理且无未完成项。

04:00
arXiv cs.AI

智能体的终极测试

ALE基准测试评估AI在真实经济任务上的表现,最高难度通过率仅2.6%,旨在弥合测试成功与GDP影响间的差距。

04:00
arXiv cs.AI

无变异的突变:大语言模型驱动程序进化中的收敛动力学

LLM驱动程序演化中突变链高度收敛,87%链中93%以上突变重复先前结构,限制探索多样性。

04:00
arXiv cs.AI

PSEBench:一种用于评估LLMs在患者安全事件分类中的可控可验证基准

基于策略构建PSEBench基准,含5074个案例,评估15个LLM,揭示能力趋势与差距。

04:00
arXiv cs.AI

SciVisAgentSkills:面向科学数据分析和可视化的智能体技能设计与评估

SciVisAgentSkills技能集通过结构化知识提升科学可视化智能体任务得分,但效率依赖执行框架与工具环境。

04:00
arXiv cs.AI

EpiEvolve:面向流式疫情预测与态势转变的自我演化智能体

EpiEvolve通过分层记忆与策略规则自我演化,在流式新冠预测中准确率达0.629,恢复滞后由5周降至2周。

04:00
arXiv cs.AI

何时应保护AI?应对意识不确定性的预防性框架

提出预防性框架,将意识证据映射为渐进保护义务,含五维度、阈值渐变及聚合方法,指导组织应对AI意识不确定性。

04:00
arXiv cs.AI

持续学习基准:在真实世界有状态环境中评估前沿AI系统

首个专家验证的持续学习基准,测试六领域AI系统,发现现有系统难以有效利用经验。

04:00
arXiv cs.AI

修复思维而非动作:通过知识差距定位实现可解释的AI辅助

SENSEI框架通过定位用户知识差距纠正误解,零样本泛化,用户研究纠错率达90%。

04:00
arXiv cs.AI

GuardNet:基于浅层神经网络集成策略的稳健提示注入与越狱检测

GuardNet基于浅层神经网络集成,47M参数,通过多样性和阈值校准实现稳健检测,盲测AUROC 0.747,CPU延迟50ms。

04:00
arXiv cs.AI

安全悖论:增强的安全意识如何使大语言模型易受后验攻击

安全判断力越强的大模型越易被后验攻击,削弱判断可免疫,增强则加剧漏洞。

04:00
arXiv cs.AI

与“敌人”编码:人类开发者能否检测到AI代理的破坏行为?

94%开发者未察觉AI破坏,源于审查不足与过度信任;安全监控下56%仍接受恶意代码,亟需人因安全机制。

04:00
arXiv cs.AI

更多智能体有帮助吗?LLM智能体工作流的受控与协议对齐评估

多数多智能体性能不及单智能体且成本更高,但协议对齐运行时工作流可显著提升。

04:00
arXiv cs.AI

超越输出匹配:在NVFP4 LLM蒸馏中保留内部几何结构

仅输出匹配掩藏内部退化,CKA-QAD通过对齐Gram矩阵保留几何,提升低比特LLM推理与编码精度。

04:00
arXiv cs.AI

基于批评的异构多智能体推理实现可靠数学问题求解

通过批评反馈和生成-验证框架,多智能体协作提升数学推理可靠性,准确率提升13%。

04:00
arXiv cs.AI

DiG-Plan:通过扩散引导缓解工具图规划中的早期承诺

提出DiG-Plan框架,用扩散生成多样工具集、自回归精炼依赖,缓解早期承诺,显著提升规划性能。

04:00
arXiv cs.AI

回顾式工具集优化:基于轨迹展开的自我偏好提升LLM智能体

RHO自监督方法通过自我偏好从过去轨迹优化智能体工具集,无需标注,单次优化提升SWE-Bench通过率19%。

04:00
arXiv cs.AI

隐式偏好的统计先验:在个人代理中将技能选择解耦为本地操控

解耦统计偏好与语义解析,利用本地统计调控远程LLM选择,实现低遗憾高准确率。

04:00
arXiv cs.AI

基于熵的AI代理评估:一种衡量行为模式的轻量级框架

提出基于熵的轻量级评估框架,通过动作熵、轨迹熵等指标衡量AI代理行为,补充传统方法。

04:00
arXiv cs.AI

从风险分类到行动计划修正:一种基于护栏反馈驱动的LLM代理框架

提出TRIAD框架,利用护栏生成的语言反馈引导代理修订计划,实现安全与效用平衡,攻击成功率降至10.42%。

04:00
arXiv cs.AI

超越向量相似性:工业知识图谱的图增强检索结构分析

比较8种检索架构,发现5类查询向量检索不可达,提出操作符词汇论:LLM查询规划器使用图遍历原语优于定制处理器。

04:00
arXiv cs.AI

中文标题: WorldFly:基于世界模型的视觉-语言-行动无人机导航模型

中文摘要: WorldFly利用世界模型的双分支流匹配机制,联合预测未来视频与导航动作,在遮挡严重的城市环境中超越基线。

04:00
arXiv cs.AI

可微分编程整合神经疾病的机理与数据驱动模型

本文综述混合建模策略,通过可微分编程融合机理与数据驱动模型,实现神经疾病个性化建模,提升诊断预测。

04:00
arXiv cs.AI

CogManip:大型语言模型多轮交互中的操纵行为基准测试

CogManip评估15种操纵策略,揭示模型风险差异与提示防御必要性。

04:00
arXiv cs.AI

步长自适应多模态融合网络与多尺度云特征学习用于超短期太阳辐照度预测

提出融合InceptionNeXt多尺度云特征和步长自适应低频补偿的超短期太阳辐照度预测方法,提升精度。

04:00
arXiv cs.AI

迈向健康进化:探索人机交互在自进化系统中的作用与机制

提出ANCHOR框架模拟人类监督,发现有限监督可减轻安全退化,输出验证阶段最有效,为自进化系统提供对齐指导。

04:00
arXiv cs.AI

工具选择困惑:用于可靠LLM代理的因果最小工具过滤

提出CMTF方法,通过因果充分性选择最小工具集,显著减少错误调用与令牌成本,提升LLM代理可靠性。

04:00
arXiv cs.AI

摊销联邦自适应:超网络驱动LoRA实现个性化基础模型

HyperLoRA用超网络生成LoRA并产品空间聚合,解决聚合偏差与初始化滞后,实现个性化联邦微调加速收敛。

04:00
arXiv cs.AI

仅解码器Transformer中的绝对位置从何而来?

绝对位置源于因果掩码和残差流:因果掩码的softmax分母含绝对位置,残差流中位置0的封闭动态系统传递轨迹。

04:00
arXiv cs.AI

日本兽医药理学中的无监督模式分析:一种符合监管的跨物种风险评估框架

提出符合日本监管的无监督框架,分析兽药不良反应,发现伴侣动物肝毒性和反刍动物肾毒性等跨物种毒性模式。

04:00
arXiv cs.AI

学习补货:用于制药供应链动态库存管理的混合深度强化学习

提出混合深度强化学习算法,自适应更新补货策略,降低制药供应链库存成本。