5915 条条目 · 106 个活跃源
2026年7月31日
04:00
ArXiv AI

面向人类活动识别持续学习的门控自适应

提出冻结表征上的通道门控自适应,仅训练少量参数,显著降低遗忘并提升精度。

04:00
ArXiv AI

压缩视频聚合器:面向高效微视频推荐的内容驱动模块

CVA轻量级模块,解耦视频信息与偏好学习,大幅降低训练时间和GPU内存,重选关键帧可提升性能。

04:00
ArXiv AI

极值Chowla集及其线性类比:使用Co-Scientist的人机数学研究

引入有限群中Chowla型极值不变量,得到循环群与阿贝尔群精确公式,并证明可分扩张的线性类比C(L/K)=[L:K]-d_max;人机协作验证。

04:00
ArXiv AI

G2VD:基于反事实干预与因果解耦的泛化AI生成视频检测

提出反事实干预与因果解耦的视频检测框架,消除捷径学习,跨域准确率超九成,F1/AUC显著提升,仅用一成训练数据。

04:00
ArXiv AI

自动材料研究:带留出迁移的可审计AI科学家工作流

提出以干预为中心的自研方法,独立搜索特征、模型、表示、数据轴,用外部留出验证决策。在十个基准中九项确认,组合优化提升至26.3%。

04:00
ArXiv AI

计划以神秘的方式运作:评估电子表格智能体的计划模式

研究发现计划模式不影响任务结果,但能减少修改并提升创造力与协作感知。

04:00
ArXiv AI

FilmBench:电影化视频生成的电影级基准

提出电影级基准,基于获奖影片和电影语言,多镜头提示,专业评估,模型排名与人类高度相关。

2026年7月30日
04:00
ArXiv AI

潜在通道真的在通信吗?对潜在多智能体LLM的因果审计

通过消息替换的因果审计发现,潜在通信中接收者依赖示例内容或其他代理,总体准确率无法揭示真实影响。

04:00
ArXiv AI

Setoka:面向异构数据的个性化智能体层次化用户理解基准

Setoka基准评估智能体理解用户,发现深层理解(行为模式、人格特质)远逊于事实检索,需跨源整合与长期抽象。

04:00
ArXiv AI

马尔可夫决策过程的属性驱动因果抽象

提出属性驱动因果抽象,基于因果谓词保留MDP特征,获得小抽象并计算近优策略,可泛化到大规模模型。

04:00
ArXiv AI

临时团队协作中任务无关适应的伙伴能力估计

提出CE-CM贝叶斯方法,在线推断伙伴隐藏能力并考虑行为多样性,实现任务无关适应。

04:00
ArXiv AI

检测AI Agent需要什么?浏览器自动化下行为检测的最小特征集

提出三分类框架,二元分类器误判AI agent严重;两个行为特征即可实现100%召回率,信号冗余鲁棒。

04:00
ArXiv AI

围棋中基于信念引导与不确定性门控的决策

提出信念引导架构,用信念头建模不确定性并门控过滤过自信策略,实现无搜索下专业级对弈,减少幻觉。

04:00
ArXiv AI

AgentMap:本体匹配中的等价与包含关系联合发现

提出混合本体匹配任务HOM及多智能体框架AgentMap,实现等价与包含关系联合发现,性能优异。

04:00
ArXiv AI

On-Policy Distillation for LLM Safety: A Routing Approach to Template-Robust Realignment

04:00
ArXiv AI

LLM辅助语言使用中的语言单一文化

LLM辅助写作导致语言趋同,共享模型减少多样性,个人化可保留差异,但个体理性引发过度趋同和负外部性。

04:00
ArXiv AI

OmegaUse-OfficeVal:基于经济基准的长时间跨度办公套件任务上的LLM代理评估

提出OmegaUse-OfficeVal基准,含100个办公任务(均需2.32小时人工),结合经济信号对比人机成本,发现LLM更快更便宜但质量未达人类水平。

04:00
ArXiv AI

原型还是能力?聚类建模学生数学能力

研究用聚类分析119034名学生数据,发现整体能力主导,而非离散技能集;模型准确率78%,表明能力水平是预测关键,个性化改进空间有限。

04:00
ArXiv AI

AI智能体能否进行开放式AI研究?两项案例研究的早期证据

通过影子评估测试前沿AI智能体,发现其能完成工程但无法解答开放研究问题,存在五个关键失败模式。

04:00
ArXiv AI

易陷误区:为什么大语言模型低估误解驱动的难度

大语言模型低估误解驱动的难度,导致评估系统性偏差,即“易陷误区”。

04:00
ArXiv AI

人类效用因子:一种可计算的福利度量,将AI治理重构成约束优化问题

HUF将AI治理转化为约束优化问题,揭示缺乏再分配约束会导致高自动化均衡损害福利目标。

04:00
ArXiv AI

AI安全优先事项:全领域议程

专家基于跨领域研讨,提出AI安全四大优先领域:战略框架、公私协作、技术保障及代理AI治理,旨在推动协调行动。

04:00
ArXiv AI

训练前预测:粒子物理基础模型的缩放定律

用小模型拟合缩放定律,可预测大模型损失和下游性能,实现训练前预算规划。

04:00
ArXiv AI

检测大型语言模型无声推理失败的无参考评分

提出RAFS评分,无需参考答案,诊断数学推理的局部可信性与答案一致性,以识别无声推理失败。

04:00
ArXiv AI

(EC)2:基于多智能体大语言模型的事件中心化网络安全可解释性方法

提出多智能体框架(EC)2,通过假设驱动调查生成可验证解释,提升网络安全事件分析精度与操作性。

04:00
ArXiv AI

成本受限四足机器人硬件上的强化学习

利用前向延迟模型与时间感知神经网络,在低成本四足机器人上实现鲁棒运动,并自发形成抗延迟的中央模式生成器。

04:00
ArXiv AI

多智能体辩论策略:综述、分类与挑战

综述141项研究,提出三维分类法,揭示领域隐式收敛于狭窄设计模式,呼吁规范化基准测试。

04:00
ArXiv AI

基于模型的需求配置与三值不确定性评分

利用三值不确定性评分消除LLM生成需求的结构不一致,量化决策不确定性,实现形式化需求工程的安全部署。

04:00
ArXiv AI

情境化反言论比通用反言论更具说服力

情境化反言论结合对话上下文和用户历史,比通用策略更有效,但需避免过度个性化降低质量。

04:00
ArXiv AI

StealthBench:衡量自主进攻性安全代理的操作隐蔽性

StealthBench基准评估自主安全代理的六维隐蔽性,发现模型安全成功率不足54%,揭示系统性操作安全缺陷。

04:00
ArXiv AI

带有竞争边际的合谋:价格水平审计从构造上注定盲目

传统价格审计无法检测通过联合分布耦合的合谋,因为单个代理的价格仍保持竞争分布,检测力等于假阳性率。

04:00
ArXiv AI

基于音频锚定的多比率DiT重建残差融合用于跨域音频深度伪造检测

DiT重建残差经音频锚定融合,跨域检测性能提升,ASVspoof5上EER 6.54%,ITW上13.84%。

04:00
ArXiv AI

PUDA:自动驾驶实验室的AI原生硬件接口

PUDA为自主实验室提供AI原生硬件接口,通过命令行环境实现智能体决策与硬件确定性执行的分离与溯源。

04:00
ArXiv AI

基于物理信息的化工过程PID整定框架:利用大语言模型智能体

提出LLM辅助PID整定框架,大模型成功率75-89%,小模型经物理信息优化达94%,提升首次整定可靠性。

04:00
ArXiv AI

恢复、解码、再防护:针对编码视觉语言模型越狱的防护无关防御增强

非迭代恢复防御存在安全-效用天花板,防护增强器仅部分弥补差距,无配置兼具低攻击成功率与低误拒率。

04:00
ArXiv AI

一次运行不等于一个想法:自动化研究中的实现抽签

单次运行得分误作想法证据,实现方差远超重跑方差,赢家反转率超25%,需多实现评估可靠性。

04:00
ArXiv AI

图即验证器:面向跨过程漏洞检测的智能体强化学习

提出VulAgentRL,利用代码属性图作为验证者,提供基于证据的精确奖励,显著提升跨过程漏洞检测。

04:00
ArXiv AI

WhisperRec:高效基础推荐模型的潜在推理

WhisperRec通过压缩思维链为潜在令牌,避免冗长理由,提升推荐效率与推理吞吐量。

04:00
ArXiv AI

FARI: 面向扩散模型水印的鲁棒一步反演

提出FARI一步反演框架,结合轻量对抗LoRA微调,以20分钟微调超越50步DDIM反演的鲁棒性,大幅提速。

04:00
ArXiv AI

无需再训练的无交叉概率K线预测

提出KQSP方法,无需再训练即可消除量子和K线交叉,保持预测精度。

04:00
ArXiv AI

基于模型对比联邦学习的对齐检查后门攻击防御

FedDAB结合局部对比正则化与对齐检查,增强良性更新一致性并排除异常模式,有效防御后门攻击。

04:00
ArXiv AI

人类多样性推动集体创造力,大型语言模型无法模拟或维持

人类多样性驱动集体创造力,AI无法模拟或长期维持;AI创意生成会削弱多样性,但AI精炼可保留,模拟效果均不及人类。

04:00
ArXiv AI

思考精简,巧妙延迟,行动并重复:面向边缘LLM代理的校准推理与不确定性感知的延迟策略

TSDS框架通过收敛探测与困惑度延迟,减少边缘LLM代理43%-73%推理计算,并保证奖励与云调用率。

04:00
ArXiv AI

MemSecBench:追踪代理记忆投毒从持久性到后果与修复

MemSecBench基准测试评估代理记忆系统安全,发现恶意记忆持久性达84.2%,完整攻击成功50.3%,选择性修复56.1%。

04:00
ArXiv AI

BioVLN:生物医学实验室视觉语言导航仿真平台

面向生物医学实验室的视觉语言导航仿真平台,采用三区域仪器模型,操作区采样使成功率提升至83.3-92.5%。

04:00
ArXiv AI

CT基础模型的解剖上下文适应

ACA轻量框架通过解剖上下文适应冻结CT基础模型,实现解剖级对齐与全局增强,零样本分类优异且训练不到1小时。

04:00
ArXiv AI

利用相关意图生成提升电商搜索中的商品发现能力

提出可扩展的发现增强搜索,通过意图条件化召回扩展和两阶段混合架构,将发现覆盖率从60%提升至80%,推理成本约教师模型30%。

04:00
ArXiv AI

AI队友的社会成本:人工智能队友如何重塑小型团队决策中的人际沟通

AI队友最健谈但信息量低,削弱人类队友间的响应性与归属感,社会成本即时显现。