5455 条条目 · 106 个活跃源
2026年6月8日
04:00
arXiv cs.AI

基于自然语言需求的AI驱动测试用例生成:技术与研究空白综述

综述发现现有AI测试生成方法无法兼顾自动化、歧义处理等六维度,并提出了研究指南。

04:00
arXiv cs.AI

Queen-Bee智能体:一种以BeeSpec为中心的企业MCP编排管控架构

提出Queen-Bee受控多智能体架构,以BeeSpec为中心,实现企业MCP编排,任务成功率0.964且零治理失败。

04:00
arXiv cs.AI

基于视觉基础模型的注意力一致纵向医学视觉问答

结合配准和DINO掩码,通过辅助损失优化,在胸部X光纵向问答中取得优异效果。

04:00
arXiv cs.AI

DxPTA:面向光子Transformer加速器软硬件协同设计的光流引导架构设计空间探索策略

提出DxPTA,基于光流引导探索光子Transformer加速器架构,满足约束且搜索速度比穷举法快15.2倍。

04:00
arXiv cs.AI

面向三维框架系统自动结构分析的代理式大语言模型

提出代理式大语言模型框架自动分析3D框架,多智能体流水线实现90%准确率。

04:00
arXiv cs.AI

几何二阶特征相关性学习用于自监督语音情感识别

提出二阶相关性层,以协方差描述子建模特征相关性并保留黎曼几何,有效聚合自监督特征,提升语音情感识别性能。

04:00
arXiv cs.AI

IRAF:面向噪声鲁棒端到端全双工语音对话系统的抗干扰自适应融合

提出IRAF模块,帧级自适应融合用户与代理音频,提升干扰环境下端到端全双工语音对话的响应质量。

04:00
arXiv cs.AI

深度神经网络梯度下降方法的泛化最优速率

针对深度ReLU网络,首次证明GD和SGD可达到极小化最优泛化速率,与核方法相当。

04:00
arXiv cs.AI

MalTree:从嵌入中大规模追踪恶意软件进化

MalTree基于生物信息学方法自动建模恶意软件进化,时间一致性达87%,揭示家族差异,支持主动防御。

04:00
arXiv cs.AI

NTILC:通过学习压缩实现神经工具调用

NTILC框架利用潜在检索和签名感知损失,减少上下文消耗95%以上,推理延迟降低74%,提升工具选择效率。

04:00
arXiv cs.AI

ChronoForest:用于高效桥梁搜索和路径合成的闭环多树扩散规划

ChronoForest通过闭环多树扩散规划高效搜索桥梁并合成路径,显著提升长距离导航成功率与路径质量。

04:00
arXiv cs.AI

多语言多说话人单元声码器:离散语音表征的系统性分析

集群大小提升可懂度,显式说话人条件避免身份崩溃,语言监督仅在低集群大小时有益。

04:00
arXiv cs.AI

HybridCodec:快速双流语义增强神经音频编解码器

HybridCodec采用语义与声学分离双流结构,蒸馏SSL语义信息,无需SSL模型推理,实现3倍加速。

04:00
arXiv cs.AI

中文标题: 弥合鸿沟:利用大语言模型打通多垂直推荐中的行为孤岛

中文摘要: 利用LLM和RAG从数据丰富垂直领域迁移知识,生成特征缓解冷启动,显著提升新兴垂直的个性化与参与度。

04:00
arXiv cs.AI

探索强化学习在临床心理健康护理与日常健康支持间流畅过渡的应用

用强化学习动态选择临床与健康干预,发现干预后效果显现,需平衡步退期与强度防倦怠。

04:00
arXiv cs.AI

你的发帖揭示了什么:社交媒体用户隐私泄露的基准与智能体框架

提出SopriBench基准和PES指标,以及Argus框架,跨帖隐私泄露检测提升25%。

04:00
arXiv cs.AI

DataEvolver:通过多层次自我进化的大语言模型自动数据准备

DataEvolver通过多层次自我进化自动构建数据准备流水线,提升LLM性能平均10%。

04:00
arXiv cs.AI

DIFFRACT:通过可微编程实现无线网络的神经化效用最大化

提出DIFFRACT框架,融合深度学习与优化,将干扰管理映射为可微网络,实现分布式端到端学习,支持实时适应。

04:00
arXiv cs.AI

REMEDI:多标签临床疾病推断中的保留与遗忘评估基准

REMEDI是针对多标签临床疾病推断的机器遗忘基准,利用MIMIC-III数据,揭示效用与遗忘的权衡。

04:00
arXiv cs.AI

从隐私到工作流完整性:自主智能体互操作性中的通信图元数据

智能体通信图泄露威胁工作流完整性,提出属性抑制被动元数据恢复任务。

04:00
arXiv cs.AI

dots.tts 技术报告

dots.tts是20亿参数连续自回归TTS模型,通过三创新实现开源SOTA,支持低延迟推理。

04:00
arXiv cs.AI

中文标题:Wasserstein空间中平滑变化分布的时空极小极大速率

中文摘要:研究Wasserstein空间中曲线未来值估计的极小极大下界,揭示时间外推与空间估计的权衡,数值实验验证。

04:00
arXiv cs.AI

SleepExplain:基于EEG信号的可解释性非快速眼动与快速眼动睡眠阶段分类

用集成模型分类NREM/REM睡眠阶段,最高准确率94.30%,结合SHAP解释预测。

04:00
arXiv cs.AI

中文标题

利用多模态生理信号监督,无需高质量预训练数据,提升PPG基础模型鲁棒性与泛化性。

04:00
arXiv cs.AI

低数据场景下合成病灶MR图像对自动局灶性皮层发育不良检测的影响

生成合成FCD-MRI减少标注需求约20%,保持灵敏度;同等真实数据更有效。

04:00
arXiv cs.AI

超越航点:面向视觉语言导航的以轨迹为中心的航点范式

提出轨迹航点范式,用TSDF引导扩散策略生成可执行轨迹,确保可达性与规划执行一致,在VLN-CE上超越基线。

04:00
arXiv cs.AI

中文标题

针对自动驾驶车辆,提出可转移性和可预测性两个可量化维度,扩展可控性概念,增强ISO 26262功能安全标准的适用性。

04:00
arXiv cs.AI

Socratic-SWE:通过轨迹衍生的智能体技能实现自我进化的编码智能体

提出闭环自我进化框架,利用历史求解轨迹提炼智能体技能,生成可验证修复任务,在多个基准上持续提升性能。

04:00
arXiv cs.AI

中文标题

提出COMPACT-VA框架,通过规划对齐的条件VQ-VAE压缩长上下文,成功率提升6%以上,实现3.3倍加速与2.7倍内存缩减。

04:00
arXiv cs.AI

PaperFlow:每日论文流中的画像、推荐与自适应

PaperFlow提出画像-推荐-自适应三阶段框架及纵向基准,实验在排名、行为对齐和人工评估中全面最优。

04:00
arXiv cs.AI

图神经网络利用高阶类标签连接性处理异质图

提出LCC分类器,通过四种游走生成标签上下文嵌入,与GNN自适应集成,提升异质有向图节点分类性能。

04:00
arXiv cs.AI

设计AI驱动的高性能计算工作流的十二条快速提示

本文提出12条实用技巧,帮助设计高效、可扩展的AI驱动HPC工作流,解决容器化、I/O优化等关键瓶颈。

04:00
arXiv cs.AI

ChemQuests:从ChemRxiv论文中提取的精选化学问答数据库

从ChemRxiv论文构建952个化学问答对,覆盖17个子领域,支持化学NLP研究与工具开发。

04:00
arXiv cs.AI

EVA:针对GUI代理环境注入攻击的进化式语义对抗红队方法

EVA发现语义欺骗是攻击关键,仅需1.18-1.71次迭代即可达85%成功率,揭示对齐训练导致代理易受权威语义欺骗的悖论。

04:00
arXiv cs.AI

从模型缩放视角理解基于语义ID的生成式推荐

基于语义ID的生成式推荐存在缩放瓶颈,而直接使用大语言模型作为推荐器具有更优缩放性,性能可提升20%。

04:00
arXiv cs.AI

探索Flow-Lenia宇宙:好奇心驱动的人工智能科学家发现多样生态系统动态

提出好奇心驱动AI方法,在Flow-Lenia中发现多样生态系统动态与自组织行为,支持迭代实验。

04:00
arXiv cs.AI

MHA-RAG:通过将示例编码为软提示提升效率、准确性与一致性

MHA-RAG将示例编码为软提示,以多头注意力控制生成,性能提升20%、推理成本降低10倍,且不受示例顺序影响。

04:00
arXiv cs.AI

调用与否:评估与优化大语言模型工具调用的框架

提出评估LLM工具调用决策的框架,发现模型感知与真实需求常错位,训练估计器改善决策提升性能。

04:00
arXiv cs.AI

一次设计,大规模部署:面向大模型生态的模板驱动ML开发

标准模型模板(SMT)降低技术传播复杂度,提升性能0.63%,减少92%工程时间,挑战多样化模型设计观念。

04:00
arXiv cs.AI

LuMamba: 面向电极拓扑不变性与高效脑电图建模的潜在统一Mamba

LuMamba结合拓扑不变编码与线性复杂度SSM,预训练2.1万小时EEG,以4.6M参数实现SOTA,计算量减少377倍,序列长度扩展12倍。

04:00
arXiv cs.AI

D5P4:面向并行离散扩散解码多样性的分区行列式点过程

提出D5P4束搜索解码,用分区行列式点过程平衡质量与多样性,无需外部验证器即可提升文本生成多样性与覆盖度。

04:00
arXiv cs.AI

潜在空间:基础、演化、机制、能力与展望

综述潜在空间在语言模型中的基础、演化、机制、能力与展望,揭示其作为下一代智能计算范式的潜力。

04:00
arXiv cs.AI

别让大语言模型读图:让图自己思考

显式信念图集成方式决定价值:作为上下文仅弱模型受益,作为排序列表则必要;存在“规划者违抗”;全游戏证实智能体约定最优;图深度收益递减。

2026年6月6日
04:00
arXiv cs.AI

模式选择性并非任务因果结构

跨架构实验表明,同一任务在不同模型中由不同注意力模式实现,模式选择性不能直接等同因果结构。

04:00
arXiv cs.AI

面向车辆网络的X波段无人机集成感知与通信系统

研究X波段无人机集成感知与通信系统在车联网中的最优时间分配,权衡感知精度与通信性能,受信道条件和目标距离影响。

04:00
arXiv cs.AI

基于智能体的蒙特卡洛:模拟黑箱智能体的强化学习

AMC通过序贯蒙特卡洛采样黑箱LLM智能体最优策略,无需训练即可显著提升测试时推理性能。

04:00
arXiv cs.AI

面向统一且数据高效的预测与健康管理:基于表格基础模型

利用表格基础模型通过上下文学习,实现工业PHM任务的统一、数据高效处理,在诊断与预测中取得最优性能。

04:00
arXiv cs.AI

使用自引导分词实现图像压缩与生成的平衡

SelfBootTok通过自引导学习分解信息为全局与局部token,生成器仅用全局token减少40%计算,以64 token实现gFID 1.56新纪录。

04:00
arXiv cs.AI

探索大语言模型在南亚音乐理解与生成中的应用

首次评估LLM在南亚古典音乐能力,前沿模型准确率85-90%,但风格忠实生成仅40%,揭示结构有效性与风格忠实性为不同目标。

04:00
arXiv cs.AI

超越波形鲁棒性:面向自动语音识别的鲁棒特征-声码器对抗攻击

提出基于自监督特征与声码器的黑盒攻击方法,有效提升迁移性与绕过防御能力,WER提升显著。