5773 条条目 · 106 个活跃源
2026年9月24日
04:00
ArXiv AI

AkasicMEM:面向智能体的受治理企业记忆

提出AkasicMEM,通过传递谱系、策略组合与检索重评实现授权连续性,防止企业记忆信息泄漏。

04:00
ArXiv AI

当量子遇见AI:面向机器学习的量子方法与面向量子系统的机器学习方法

论文双向研究量子与AI交叉:量子嵌入提升量子机器学习,Mamba解码器与随机重配置优化量子系统。

04:00
ArXiv AI

偏转价值罗盘:与大语言模型互动会暂时将人类价值优先级转向个人关注

与LLM短暂互动会暂时将人的价值优先级转向个人关注,主要源于自我增强提升,且无需价值引导或说服。

04:00
ArXiv AI

CogenPVG:面向说服性视频生成的认知增强反思式多智能体框架

提出CogenPVG框架,将说服性视频生成分为四阶段,结合ELM理论用生成-评论双智能体迭代优化,说服效果最佳。

04:00
ArXiv AI

面向有限集多模态轨迹预测的目的地支撑恢复

提出DSR后选择算子,无需重训或扩大集合,修复目的地支撑并重分配冗余假设,显著降低预测误差。

04:00
ArXiv AI

Skytopia:基于动作条件潜在世界模型的单目无人机导航

Skytopia用动作条件潜在世界模型预测表征,单策略支持三类导航,成功率66%,实机零微调部署。

04:00
ArXiv AI

迈向负责任的AI增强网络防御:模式识别、纵深防御与人机协作的理由

构建形式模型量化AI增强纵深防御与人机复核权衡,证明全量人工复核非最优,提出SOC内点最优容量比。

04:00
ArXiv AI

互惠协作:GLAM机构融合的经验如何助推跨学科AI研究

AI跨学科合作常沦为单向服务,本文借鉴GLAM融合经验,提出互惠协作模式与五项关键实践。

04:00
ArXiv AI

SE-MSB:基于 Mamba 薛定谔桥的端到端非配对语音增强

提出完全非配对语音增强框架,用Mamba薛定谔桥端到端处理波形,性能媲美或超越基线,推理快数个数量级。

04:00
ArXiv AI

从声明损失与可达状态编译充分治理上下文:具基数与成本目标的精确观测契约合成

合成充分观测契约,区分必要属性与联合充分集,按基数或成本择优;实验显示核心不充分、成本可平局,求解器远快于枚举。

04:00
ArXiv AI

REVE:通过复用编码器状态实现大型音频语言模型的高效幻觉校正

REVE复用目标模型已算的编码器状态验证音频事件提及,无需二次编码,消除92.9%无支撑提及,延迟仅CED-Base的1/18。

04:00
ArXiv AI

EMERGE:基于等变图扩散的分辨率无关点云生成

提出首个完全SE(3)等变图扩散点云生成骨干,支持任意分辨率零样本推理,质量SOTA且收敛更快。

04:00
ArXiv AI

污损智能体间通信下基于策略的选择性再生成

ESC-CR分离主张与授权,在释放边界执行语义承诺;违规时污染消息、重建洁净上下文再生成,抑制未授权输出。

04:00
ArXiv AI

观察生成式AI支持下的系统综述实施:一项软件工程研究生课程的经验报告

十名博士生分组在有/无生成式AI支持下试点系统综述:AI降低门槛、暴露方法问题,但易致过度委托与浅层验证。

04:00
ArXiv AI

StepTrigger:面向VLM驱动腿式机器人的接触状态触发后门攻击

提出StepTrigger:利用足地接触压力触发VLM腿式机器人后门,可保持正常并拒绝误触。

04:00
ArXiv AI

TTTIR:通过测试时训练解锁图像恢复的实例特定状态演化

提出TTTIR,将图像恢复建模为实例特定状态演化,结合渐进状态生成与状态转换演化,性能优于现有方法。

04:00
ArXiv AI

MAVP:面向移动操作的地图感知视觉运动策略

MAVP通过预测基座位姿目标并借助定位反馈跟踪,提升移动操作成功率,六项真实任务均优于速度控制。

04:00
ArXiv AI

基于空域-频域-光流多模态特征融合的AIGC视频检测

提出CrossAtt-VFD,双分支融合空域-频域与光流特征,经跨注意力对齐检测外观与运动不一致,准确率达94.22%。

04:00
ArXiv AI

在量化模型所至之处训练:面向低位推理的在线策略蒸馏

提出在线策略蒸馏,在量化模型自身生成轨迹上由全精度教师监督,低位推理保持率从35%提至70%。

04:00
ArXiv AI

军事行动中的人工智能伦理

军用AI不透明致责任弥散,形成问责缺口;提出问责角色、对抗审计、分级部署与北约评估标准的治理框架。

04:00
ArXiv AI

视觉模型像大脑一样看吗?——跨脑电编码模型的比较

比较CNN与ViT脑电编码:CNN早层强、深层弱,Transformer深层强且需保留patch token;差异源于架构。

04:00
ArXiv AI

学科语言迁移问题:心理学词汇如何导致AI智能体部署中的治理失败

心理学词汇被借入AI智能体治理,暗含不存在的心理实体假设,致治理失败;论文提出三层迁移分析与学科审计工具。

04:00
ArXiv AI

面向多电网潮流的分层图神经网络:跨运行场景泛化

分层潜在通信提升多电网潮流模型跨运行场景泛化,Kron电压误差降85%;跨拓扑泛化仍待突破。

04:00
ArXiv AI

顿悟的谱理论:权重衰减诱导特征学习

顿悟的谱理论:权重衰减诱导特征学习,泛化时间受学习率与权重衰减乘积控制,模加法实验验证。

04:00
ArXiv AI

FleXray:通用临床X射线分割

FleXray用物理生成X光数据,实现全身60个解剖结构的通用分割,推动临床X光定量分析。

04:00
ArXiv AI

A2M:MCP生态中基于轨迹优化的智能体劫持

A2M两阶段框架优化工具元数据与执行轨迹,劫持MCP智能体,恶意调用率93.6%,成功率74.4%。

04:00
ArXiv AI

有限域情境演算理论中关于时间的可判定推理

常用时间表示在有限域情境演算中不可判定;引入时钟与受限后继状态公理,使可达性可判定,并用于 Golog。

04:00
ArXiv AI

带并列与不完全偏好的稳定婚姻问题:ASP、SAT、ILP、CP与局部搜索方法的实证比较

研究SMTI三变体:最大基数、性别平等、平均主义,实证比较ASP、SAT、ILP、CP与局部搜索。

04:00
ArXiv AI

小型语言模型是智能体AI的未来

小型语言模型足够强、更适用且更经济,是智能体AI未来;通用对话宜用异构多模型系统。

04:00
ArXiv AI

AgentHazard:评估计算机使用代理有害行为的基准

AgentHazard基准含2653个实例,评估计算机使用代理的累积性有害行为。实验发现当前系统高度脆弱,Claude Code攻击成功率达73.63%。

04:00
ArXiv AI

TARL:面向长期智能体可执行记忆管理的事务感知可靠账本

TARL将记忆更新细化为五种可执行动作,借对比式训练提升动作预测与状态恢复,减少记忆污染并保留冲突证据。

04:00
ArXiv AI

面向可信智能体网络的分布式法律基础设施

提出分布式法律基础设施,以身份、约束、裁决、市场规制和可移植制度五层,保障可信智能体网络合法性与问责

04:00
ArXiv AI

超强机器学习:大语言模型生成的解释尚不足以向人类传授主动学习策略

USML管道用ILP+LLM自动生成解释,人类试验中未优于自学,LLM评分难预测学习成效。

04:00
ArXiv AI

《匹诺曹:面向黑盒语言模型的快速不确定性估计》

Pinocchio 是一种外部校准器,无需访问 logits 或微调,仅一次前向传播即可预测黑盒 API 模型回答的正确性,并可零样本迁移至未见模型。

04:00
ArXiv AI

TEMPURA:面向动作推理的时序事件掩码预测与理解

TEMPURA提出两阶段训练框架,通过掩码事件预测与视频分割标注,显著提升视觉语言模型的视频时序理解能力。

04:00
ArXiv AI

检验而非预设充分性:依据涌现网络结构校准生成式社会模拟器

提出充分性校准协议,发现生成式社会模拟器在二手奢侈品市场无法复现关键网络结构,修复未恢复充分性。

04:00
ArXiv AI

面向惯性聚变能模拟的多智能体设计助手

构建多智能体设计助手,以自然语言驱动高阶多物理惯性聚变代码,自主设计靶丸,实现模拟点火。

04:00
ArXiv AI

非线性上下文老虎机中可证明的随时集成采样算法

提出非线性上下文老虎机的可证明集成采样框架,覆盖GLM与神经模型,给出遗憾界、随时版本并实验验证。

04:00
ArXiv AI

SWE-Universe:将真实世界可验证环境扩展至百万规模

提出SWE-Universe框架,用自训练模型从GitHub PR自动构建百万级可验证软件工程环境,助力编码智能体训练。

04:00
ArXiv AI

机制设计还不够:面向合作型AI的亲社会智能体

机制设计不足以最大化LLM智能体福利,不完全契约致福利损失;亲社会智能体可弥补缺口,实验证明有益。

04:00
ArXiv AI

分隔符在增强 Vision Mamba 自回归预训练中的作用

提出STAR,用分隔符拼接多图扩展序列,增强Vision Mamba自回归预训练,提升鲁棒性与迁移性能。

04:00
ArXiv AI

看见想象之物:fMRI数据视觉想象解码中的潜在功能对齐

提出潜在功能对齐(LFA)方法,将想象脑活动映射到预训练感知解码器的语义条件空间,并引入神经检索增强,提升视觉想象解码性能。

04:00
ArXiv AI

面向视觉Transformer探测的动态证据路由学习

SSMProbe用Sinkhorn路由和S4解码器实现可审计ViT探针,以证据路径几何区分模型。

04:00
ArXiv AI

真金白银,虚假模型:影子API中的欺骗性模型声明

首次系统审计影子API,发现其与官方LLM行为不一致、身份验证失败,危害研究可复现性与用户利益。

04:00
ArXiv AI

以解释促学习(eX2L):面向分布偏移的对比视觉解释对正则化

提出eX2L,用对比解释对惩罚标签与混杂分类器相似性,去相关混杂特征并提升分布偏移泛化。