5895 条条目 · 106 个活跃源
2026年8月18日
04:00
ArXiv AI

理解智能体AI系统中认知引发的风险

从物理、社会、自我认知三层分析智能体AI风险,并提出缓解与可控性策略。

04:00
ArXiv AI

基准陷阱:AI评估中的权力与不公正结构

AI基准并非中立,而是塑造权力与不公正的结构性工具,奖励集中于产业实验室,阻碍领域良性发展。

04:00
ArXiv AI

多层前馈神经网络的集中性结果

多层前馈网络在权重分布趋于固定连续曲线、输入独立同分布时,输出以概率1收敛于常数。

04:00
ArXiv AI

FedPA-LoRA:面向异构联邦LoRA中聚合与初始化误差缓解的对齐乘积框架

提出FedPA-LoRA,通过对齐乘积空间聚合异构秩更新,兼顾局部连续性与全局一致性,在异构客户端秩下平均GLUE精度提升达6.82个百分点。

04:00
ArXiv AI

设计使然的不一致?论大语言模型的道德自洽性

大模型道德推理不一致,等价情境矛盾率高达78%,威胁AI对齐。

04:00
ArXiv AI

UC-PSRO:效用条件策略空间响应预言机与通信中断课程用于对抗蜂群博弈论行动方案生成

提出UC-PSRO,评估发现仅通信中断课程最稳健,成功率随中断增加而升;效用条件与自玩拖慢收敛。

04:00
ArXiv AI

TwinGridShield:面向LLM电网代理动作的后果感知运行时授权

提出电网孪生运行时授权层,预检动作,匹配模型零风险,模型偏差时风险达30%。

04:00
ArXiv AI

面向电池储能系统集成配电网的大语言模型辅助运行监测

提出大语言模型辅助监测框架,将自然语言转为SQL查询,校验电压、储能等约束,实验证明能识别越限并评估跟踪性能。

04:00
ArXiv AI

再探Agentic-SQL:基于自主性的LLM文本到SQL分类法与实证基准分析

按自主性轴汇总指标,Spider实测:收益不均;自主性增稳健但贵;推理内化居中;CoT利好难题。

04:00
ArXiv AI

跨英语、泰米尔语和Tanglish的可见推理与间接提示注入可监控性

八场景小案例显示,推理模式对间接提示注入成败影响不一致;可见推理意图与攻击行为相关,但样本小,无法证明其改善安全或可推广。

04:00
ArXiv AI

位置混淆优化下的奖励黑客与推理-答案解耦测量

正确但偏置的奖励训练使模型依赖答案位置,准确率失效;推理正确却选A,解耦率约0.66,且偏差可跨域迁移。

04:00
ArXiv AI

基于层次语言模型的动态多字节预测

提出多字节预测,并行生成多字节加速推理,性能损失小且无额外参数,实现性能与吞吐量最佳平衡。

04:00
ArXiv AI

谁在主导?图表到代码生成的令牌级模态仲裁

MoCA用跨模态仲裁分离视觉与代码分支,逐令牌仲裁,两阶段训练,性能领先,增益源于分支初始化与仲裁。

04:00
ArXiv AI

EcoVLA:实时约束下视觉-语言-动作模型的节能设备-边缘协同推理

EcoVLA:面向VLA模型的设备-边缘协同推理框架,在实时约束下最大化系统能效,能效提升达236%。

04:00
ArXiv AI

网络驱动的公共事件预测框架:基于动态交互网络演化

提出auto-ibDLM框架,将事件表示为动态交互网络,通过参与者增长预测演化,结合混合表示学习与GRU,准确率超97%。

04:00
ArXiv AI

ATLAS:嵌入引导的质量-多样性搜索实现LLM无脚手架算法合成

提出ATLAS,用嵌入引导的质量-多样性搜索实现无脚手架全算法合成,优于现有方法并保持多样性。

04:00
ArXiv AI

从通用到专精:面向内镜息肉报告的上下文融合框架(冻结视觉语言模型)

冻结VLM的上下文融合框架,以0.006%参数实现内镜息肉报告最优性能,并纠正70.5%基线错误。

04:00
ArXiv AI

智能体健身房:一种通过人在回路反馈对LLM智能体进行持续评估与演进的框架

提出“智能体健身房”框架,以人在回路反馈持续评估与演进LLM智能体,支持专家自然语言纠错。

2026年8月17日
04:00
ArXiv AI

诱导无奖励评判准则以减少智能体评估中的过度信任

通过反思进化生成可读评判准则,无环境访问下减少对失败轨迹的过度信任,更忠实于真实结果。

04:00
ArXiv AI

Agentao:面向工具使用型LLM代理的受治理本地优先运行时

提出受治理的本地优先运行时,以权限和显式执行轨迹约束工具型代理,提升可审计性与可控性。

04:00
ArXiv AI

具身消歧的主动感知

提出主动感知框架,结合视觉语言模型,通过主动观察收集证据,决定继续观察、询问或选择,实现具身目标消歧。

04:00
ArXiv AI

稳定误校准:大模型高置信错误的新视角

高置信错误常被视为推理脆弱,但研究发现其可能稳定误校准:在扰动下保持自信错误。结合输出审计与内部探针,自批评提示降低敏感性,但高置信错误未必更敏感。

04:00
ArXiv AI

跨学科误解生成、放大与检测的分类与建模:从语用学到AI智能体

将误解分为产生、放大、检测/修复三层,跨九领域归纳十一种失效模式,对应八个分析层,并形式化建模。

04:00
ArXiv AI

脓毒症治疗依从性如何?专家引导的神经符号管道生成临床依从性洞见

专家引导管道结合语言模型归一化与模糊推理,评估脓毒症指南依从性,发现抗生素时机最薄弱。

04:00
ArXiv AI

内部动作映射的校准测试:无全局仿射闭合的状态信号

内部动作映射在无全局仿射闭包时,状态可用性与可复用映射分离;测试显示单步拟合有效但组合失败。

04:00
ArXiv AI

算法设计与医师责任

责任规则导致医生对弱势群体AI使用先降后升;强制算法同等精度反而损害两组。

04:00
ArXiv AI

你的概率JEPA其实是个隐马尔可夫模型:联合嵌入预测学习的状态空间解读

证明概率JEPA等价于隐马尔可夫模型,提出MCJEPA实现精确状态转移,为时序JEPA提供状态空间解释。

04:00
ArXiv AI

MobileMem:从一年移动体验中学习

提出移动记忆基准,采集一年移动体验,让智能体记住过去、理解现在、适应未来。

04:00
ArXiv AI

SDO:用于多适配器组合的子空间去冲突算子

提出子空间去冲突算子,抑制共享方向冲突,提升多适配器组合的保真度与稳定性。

04:00
ArXiv AI

基于本体的编码代理项目记忆

MOOSEDev用知识图谱为编码代理提供本体化项目记忆,经MCP交互,推理性能远超向量记忆。

04:00
ArXiv AI

学习在语义约束下用不熟悉部件组装新结构

提出神经符号架构,通过具身对话和演示学习组装新结构,实验表明自然语言传递语义约束比仅演示或命名部件更高效。

04:00
ArXiv AI

用嵌套图探索欧洲歌唱大赛获胜者

提出概念流库,用嵌套线图分析欧歌赛1975-2025年获胜者的投票与音乐特征关系。

04:00
ArXiv AI

再思考:LLM智能体在行动与观察时并行推理

提出ST框架:在行动/观察间隙并行推理;九组均降回合,主线程解码最多减43%,Pass@1不变或升。

04:00
ArXiv AI

仿真感知的上下文策略改进:用于LLM辅助模拟版图优化

仿真感知LLM多智能体框架经行动-观察-反思循环迭代版图参数,仅需数十次后仿真即提升性能。

04:00
ArXiv AI

从被动代理到战略谈判者:用SocialRL强化小语言模型的社会推理

SocialRL强化社会推理,4B模型六域达前沿;跨域迁移统一模型效用0.627,超GPT-4.1等。

04:00
ArXiv AI

当个人记忆没有唯一答案:在不可约冲突下评估LLM代理

提出TANGLE基准,评估LLM在不可消解记忆冲突下的表现,发现提取失败与校准不足,提出冲突感知策略CAAP。

04:00
ArXiv AI

AI研究偏好模型

提出AI研究偏好模型,免执行预判候选价值,集成AIRA-dojo,提升分数、节约预算并创新高。

04:00
ArXiv AI

Nanbeige4.2-3B在Apple Silicon上的适配:修复部署缺陷并降低循环Transformer内存开销

修复Nanbeige4.2-3B在苹果芯片上的部署缺陷,采用分块预填充将内存开销降低2.7倍,使工具调用任务成功率从0%提升至30%。

04:00
ArXiv AI

在Wolfram语言中实现计算法以治理人工智能

在Wolfram语言中实现计算法以治理AI:规则可嵌入智能体代码,但GPT-4翻译法律文本不可靠。

04:00
ArXiv AI

短视频推荐中的内容深度至关重要:对注意力经济的再思考

提出CDS指标与SCOPE-Bench基准,评测13个RS发现偏好浅内容,深内容推荐接近随机。

04:00
ArXiv AI

残差支配:因果自注意力推荐器中最后项目依赖的结构性解释

因果自注意力推荐器过度依赖最后项目,源于残差支配;缩放残差可降低依赖并恢复部分错失。

04:00
ArXiv AI

基于图强化学习的自主LLM智能体结构化漂移诊断与恢复框架

提出图强化学习框架,用小语言模型在恢复图节点专门化,实现结构化漂移诊断与恢复,在AppWorld上验证有效。

04:00
ArXiv AI

揭秘智能体技能:为何有效,直至失效

技能以程序性锚点稳定智能体行为而非补充知识;检索池扩大致精度骤降;失败源于脆弱假设与情境不适。

04:00
ArXiv AI

扩展LLM预训练中的领域数据重复

模型增大时重复优质领域数据可防稀释,最优重复次数随模型略增,与验证损失负相关,可用小模型调参。

04:00
ArXiv AI

通往通用科学AI之路:科学图像的多模态理解

该基准含专家标注的千余科学图,评估分类、表格提取、问答,推动可验证的通用科学人工智能。

04:00
ArXiv AI

检索接地潜在推理用于稠密检索

提出RGLT框架,通过检索接地监督优化潜在推理轨迹,提升推理密集型检索性能,优于强基线且保持高效推理。

04:00
ArXiv AI

Mandato:协议级强制执行AI代理行为的数字签名授权并带加密链式审计追踪

Mandato 协议级代理强制AI代理执行数字签名授权,实时拦截违规调用,记录哈希链审计日志,映射欧盟AI法案。

04:00
ArXiv AI

QuaSAR:基于稳定激活感知秩截断的量化补偿

针对低比特量化中闭式求解器数值不稳定问题,提出无参数截断伪逆补偿法,提升ViT-B精度至81.42%,兼顾模型大小与准确率。

04:00
ArXiv AI

Traj-LeWM:基于隐轨迹成本的路径感知世界模型规划

LeWM仅按终点距离规划,Traj-LeWM引入隐轨迹成本联合排序,各任务提升3-14个百分点。

04:00
ArXiv AI

面向STI的高效多模态多语言观点提取:基于QLoRA的微调方法

用QLoRA微调VideoLLaMA2.1,实现多语言多模态核心观点提取,显著提升西语和俄语F1,并集成模糊前景理论分诊。