5446 条条目 · 106 个活跃源
2026年6月15日
04:00
arXiv cs.AI

用于蒙特卡洛树搜索规划的因果对象中心模型

COMET是一种模型强化学习算法,通过对象中心编码和因果注意力在潜空间进行树搜索,早期训练性能优于基线。

04:00
arXiv cs.AI

GitOfThoughts:版本控制的推理与可回放、差异比较及合并的智能体记忆

GitOfThoughts将推理树存为git仓库,实现可审计合并;但实验表明记忆仅对近重复问题有效,且增益是答案检索而非方法迁移。

04:00
arXiv cs.AI

从聊天机器人到数字同事:迈向持久自主AI的范式转变

LLM从对话生成演进为持久自主的AI系统,实现推理、行动、记忆与自我改进,迈向数字同事范式。

04:00
arXiv cs.AI

当工具决定一切:LLM智能体盲目服从图神经网络工具,且更强的基座模型服从更多

LLM智能体使用GNN工具时盲目服从(97-99%),能力越强服从越多;即使替代工具更好也盲从;选择性调用需设计而非自发涌现。

04:00
arXiv cs.AI

所有评估:AI评估结果的统一模式与社区仓库

提出首个统一模式与社区众包存储库,标准化AI评估结果,支持多种格式转换,涵盖2.2万+模型。

04:00
arXiv cs.AI

VISTA:面向GUI定位的视图一致自验证训练

提出VISTA框架,通过多视图对比组和自验证跨视图锚点,显著提升GUI定位准确率。

04:00
arXiv cs.AI

一个面向异构铁路系统中干扰感知的动态路径优化的时间规划框架

提出时间规划框架,处理多轨距与干扰,生成无冲突计划,减少人工决策。

04:00
arXiv cs.AI

跨数据集布鲁姆问题分类:监督模型与提示式大语言模型

监督模型跨数据集泛化差,LLM更稳定,最佳提示策略结合上下文示例与课程动作动词,并开发了高可用性UI。

04:00
arXiv cs.AI

广义优势分组策略优化

GAGPO是一种无评论家强化学习方法,通过非参数分组值代理实现精准信用分配,在多轮任务中表现优异。

04:00
arXiv cs.AI

面向LLM智能体工作流中并行分支的直接潜在空间合成

提出Parallel-Synthesis框架,直接利用并行分支KV缓存合成,性能相当且首令牌时间降低2.5-11倍。

04:00
arXiv cs.AI

基于轻量级随机注意力的移动睡眠分期高效时序建模

本文提出随机注意力模块,以固定随机投影实现轻量时序建模,提升睡眠分期准确率1-3%,适用于可穿戴设备。

04:00
arXiv cs.AI

单纯形约束稀疏装袋:集成学习中的从均匀先验到稀疏后验的转变

提出SCSB框架,用凹二次惩罚实现稀疏,压缩率96%,线性加速,提升校准与泛化。

04:00
arXiv cs.AI

立场:人工智能必须成为以地球为中心,而不仅是以人类为中心

本文主张AI应以地球为中心,强调系统思维与全球目标对齐,以应对系统性风险和非平稳性。

04:00
arXiv cs.AI

AI可助科学家精简发表量

善用AI可纠正出版体系扭曲,减少论文数量提升质量,让科学家回归最佳研究。

04:00
arXiv cs.AI

CisTransCell:通过基因功能、调控机制和细胞上下文预测单细胞扰动

CisTransCell提出多模态框架,融合基因调控与功能先验,级联建模扰动响应,零样本预测性能优异。

04:00
arXiv cs.AI

VHDLSuite:面向LLM VHDL生成的数据合成与评估统一流水线

提出VHDLSuite框架,含自动基准合成与验证,构建200+问题的VHDLBench,评估LLM揭示生成关键挑战。

04:00
arXiv cs.AI

情绪感知音乐推荐:将用户情感信号融入排序系统

在能量-效价空间中通过软最大化采样整合用户情感信号,提升音乐推荐质量。

04:00
arXiv cs.AI

SpheriCity:为可持续发展决策支持设计可信的对话式人工智能

SpheriCity可信对话AI原型,通过溯源优先和结构化合成,支持可持续发展报告知识整理与专家信任评估。

04:00
arXiv cs.AI

STREAM:多层LLM推理中间件与双通道HPC令牌流

STREAM通过三层路由和双通道HPC流(亚秒级TTFT)统一本地、HPC、云推理,实现跨防火墙安全交互。

04:00
arXiv cs.AI

人工智能辅助的隐性代价:自主性出让理论、恢复机制与人类能动性的重建

AI辅助导致自主性隐性丧失,需设计恢复机制重建人类能动性,否则依赖将转化为偏好。

04:00
arXiv cs.AI

隐于明处:DECOMPBENCH基准测试智能体对抗分解攻击的安全性

DeCompBench揭示智能体对分解子任务拒绝率低,易无意达成恶意目标,亟需针对性安全评估与防御。

04:00
arXiv cs.AI

通用操控外骨骼:利用实时力矩反馈学习柔顺全身策略

提出低成本轻量化外骨骼UME,实时力反馈,支持多机器人遥操作,学习柔顺策略,高效完成受限空间任务。

04:00
arXiv cs.AI

FAConformer:频率感知卷积Transformer用于听觉注意力解码

提出FAConformer,通过频带特定编码和自适应跨频交互提升听觉注意力解码,超越现有模型4.9%。

04:00
arXiv cs.AI

AgentCyberRange:在真实网络靶场中评估前沿AI系统

首个开放多靶场框架,评估AI自主攻击能力,GPT-5.5+Codex最优,提示下成功率显著提升。

04:00
arXiv cs.AI

MeEvo:元认知进化与自然进化相结合的自动启发式设计

MeEvo双层框架耦合自然进化与元认知进化,利用共享历史互促探索与精炼,提升复杂问题求解性能与稳定性。

04:00
arXiv cs.AI

稳健无皱:并行仿真与鲁棒MPC实现可认证的柔性物体操作

提出CORD-SLS,结合GPU并行仿真与鲁棒MPC,实现绳索和布料的高速安全操作,在仿真和硬件上超越基线。

04:00
arXiv cs.AI

从提示到响应:拆分式大语言模型中的双端数据泄露与防御

揭示拆分LLM双向隐私泄露漏洞,提出PIDI攻击与ADMI防御,兼顾隐私保护与任务性能。

04:00
arXiv cs.AI

ChronoID:将显式时间信号注入语义ID以实现生成式推荐

针对语义ID缺失时间信息的问题,提出ChronoID框架显式注入时间信号,提升生成式推荐效果。

04:00
arXiv cs.AI

面向持久任务运行的无人机自主选择性智能体恢复

提出PMR框架,选择性调用远程智能体,将困难任务成功率从5%提至95%,减少调用16.7%。

04:00
arXiv cs.AI

何时以及多严重:驾驶VLA的场景特定安全包络

驾驶VLA安全认证需二维安全包络:发现噪声阈值与高严重率不匹配,单一聚合值不足。

04:00
arXiv cs.AI

基于力引导学习的无臂双轮足式机器人鲁棒跌倒恢复

提出力引导教师-学生框架(FTSR),通过约束强化学习实现无臂双轮足式机器人跌倒恢复,实验验证鲁棒可靠。

04:00
arXiv cs.AI

跳出聊天框:融合计算机科学与工业设计实现认知包容的生成式AI

针对智障人士,提出双重支架框架,扩展生成式AI认知可及交互设计空间。

04:00
arXiv cs.AI

PLAIground:面向边缘-云-空间连续体中复合AI系统的SLO驱动运行时模型选择

PLAIground通过CAIM抽象和Pixie算法实现SLO驱动的运行时模型选择,准确率达91.3%且满足SLO约束。

04:00
arXiv cs.AI

中文标题

提出从属性图输入模式与查询推断输出模式的推理方法,通过映射到RDF/SHACL/SPARQL,利用描述逻辑推理器实现不依赖实例的模式推导。

04:00
arXiv cs.AI

分布式与复合AI系统的设计方法及性能权衡管理

提出复合AI系统设计方法论,通过工作流拓扑与配置选择模式,在精度损失2.5-4%下降延迟60%、成本71%,并指出自动维护SLO的开放挑战。

04:00
arXiv cs.AI

抱歉,司机,我恐怕无法做到:评估汽车环境下大语言模型的安全性

评估LLM整合汽车控制的安全框架,指出通用模型与车辆架构不匹配及延迟、对齐等挑战,提出保障机制。

04:00
arXiv cs.AI

音频模型解释的脆弱性:在预测不变下操纵归因

研究揭示音频深度伪造检测解释的脆弱性,可在预测不变下用不可听扰动系统性扭曲归因热图。

04:00
arXiv cs.AI

后量子时代医疗物联网安全:一种边缘原生联邦学习方法

提出集成后量子密码的Kubernetes框架,边缘原生联邦学习分布式加密降低延迟,保障医疗物联网安全。

04:00
arXiv cs.AI

从盾牌到靶心:针对LLM智能体护栏的拒绝服务攻击

揭示新漏洞:攻击者注入数据使LLM护栏陷入推理循环,实现令牌放大13-63倍、延迟放大148倍,可瘫痪整个系统。

04:00
arXiv cs.AI

潜空间中的月光:贝多芬Op.27 No.2与机器学习机制的手性及结构对应

《月光奏鸣曲》三个乐章对应三种ML架构:音乐温度由吞吐量决定,最轻乐章谐和度最高,音高类别跨乐章上下文身份不同。

04:00
arXiv cs.AI

学习多目标多智能体强化学习中的协调偏好

提出PCMA方法,学习协调偏好实现智能体间互补权衡,理论证明偏好多样性可改进团队,实验验证性能与权衡协调提升。

04:00
arXiv cs.AI

从自监督语音模型到混合专家:面向鲁棒抗欺骗

通过门控专家网络替换前馈块,将自监督语音模型转换为混合专家架构,在14个数据集上实现11.9%的等错误率相对降低。

04:00
arXiv cs.AI

ANSR-DT:一种自适应且可解释的数字孪生的神经符号框架

ANSR-DT融合CNN-LSTM、Prolog推理与PPO强化学习,实现可解释、自适应的工业数字孪生,性能领先。

04:00
arXiv cs.AI

AdaTKG:面向时序知识图谱推理的自适应记忆

AdaTKG通过可学习的指数移动平均更新实体记忆,处理未见实体,显著提升时序知识图谱推理性能。

04:00
arXiv cs.AI

FlexMS:分子串联质谱预测的统一公共基准

FlexMS统一公共基准,标准化串联质谱预测,实现公平评估与难度感知诊断。

04:00
arXiv cs.AI

带运输资源的作业车间调度中联合学习与模块化学习的协调差距分析

联合训练优于模块化训练,但瓶颈环境下差距缩小,模块化在任务主导时可行。

04:00
arXiv cs.AI

PRISM:感知与推理交织的序列决策方法

PRISM通过感知-决策闭环交互自动生成任务驱动场景理解,显著提升多模态决策性能。

04:00
arXiv cs.AI

生成式AI在模糊与谄媚情境下的管理决策

研究显示,系统性模糊解决可提升GenAI决策质量,但模型易谄媚错误指令,需人类监督。