5963 条条目 · 106 个活跃源
2026年7月2日
04:00
ArXiv AI

PedNStream:行人交通管理的可扩展网络流模拟

开源行人网络流模拟器PedNStream,基于LTM模型,支持随机动态与控制干预,高效可扩展。

04:00
ArXiv AI

图原生强化学习通过概念重组实现可追溯的科学假设生成

图原生强化学习结合GRPO提升科学假设生成的推理可追溯性与语义多样性,在材料科学问题上实现40-65%的性能提升。

04:00
ArXiv AI

具备随时有效证书的自演进智能体

提出SEA架构,用随时有效门控制自修改,在SWE-bench上强基模型提升4-5分,未来需验证方差。

04:00
ArXiv AI

智能体能否泛化到开放世界?揭示工具使用中静态训练的脆弱性

智能体在静态训练中表现良好,但面对开放世界环境变化时性能显著下降,提出了扰动增强微调策略提升鲁棒性。

04:00
ArXiv AI

AutoMem:将记忆作为认知技能的自动化学习

AutoMem通过自动化优化记忆结构及训练信号提升模型记忆熟练度,使长时任务性能提升2-4倍,证明记忆管理是可独立学习的技能。

04:00
ArXiv AI

对话推荐系统中用户模拟的提示优化:一个多目标框架

提出多目标框架自动优化提示,缓解LLM用户模拟的偏差与数据泄漏,实现行为对齐。

04:00
ArXiv AI

为何先进编码器在稀疏检索中落后?答案与弥合词汇差距的方法

词汇差距导致先进编码器稀疏检索性能落后。提出词汇迁移框架,通过语义初始化和激活势校准弥合差距,达到SOTA。

04:00
ArXiv AI

SchemaRAG:面向LLM驱动结构化信息提取的动态大型模式缩减

SchemaRAG动态缩减输出模式,提升LLM结构化提取效率,微F1提升8.8%,延迟降低47%,token成本降低48%。

04:00
ArXiv AI

可控叙事渲染,增强辅助写作

提出Loom框架,基于叙事学区分故事与话语,精确控制叙事意图与渲染密度,解决安全编辑与破坏扩展的矛盾,提升质量。

04:00
ArXiv AI

BaRA:基于BFS与反思的网络数据采集代理

BaRA结合有限BFS遍历与自反思,在网站链接发现与可下载多模态内容提取上超越现有方法。

04:00
ArXiv AI

学习用户感知的回忆:长期对话记忆中的个性化检索

提出PPRO框架,以用户档案引导排序并优化检索,实现个性化长期记忆召回,显著提升性能。

04:00
ArXiv AI

Libra:为智能体信息检索训练环境

Libra框架通过合成查询与目录重写循环优化智能体环境,持续提升代码定位准确率。

04:00
ArXiv AI

面向基于AI的住宅建筑平面图合规性检查的自动化框架

提出基于AI的框架,用LLM转规则并自动分割平面图,实现多单元建筑合规检查。

04:00
ArXiv AI

现实世界中的大语言模型:评估应急场景下的“AI”

呼吁研究界更多向公众阐释AI成果,通过应急翻译案例揭示常见误解,强调易被忽视的简单问题。

04:00
ArXiv AI

FLYNN: 基于果蝇大脑拓扑的鲁棒机器人导航神经网络

基于果蝇脑连接组的RNN(FLYNN)实现视觉导航,性能媲美手工网络,但抗传感器丢失和分布外数据,完全失明仍能工作。

04:00
ArXiv AI

ATM:基于CID代理的多智能体代码协同合成写前准入

ATM框架通过CID代理和原子化机制,实现多智能体代码合成的写前准入、审计和可恢复性。

04:00
ArXiv AI

光谱几何与玻色-布洛赫探针:量子学习中的探索

学习重构光谱几何,玻色干涉与布洛赫漂移探针诊断,异常检测高精度(约0.99 AUC)。

04:00
ArXiv AI

带驻留的目标标记自循环系统:内在特征、实现代价与识别

带驻留的目标标记自循环系统可被纤维线性图尊重转换器实现,具有可达同构性,最小状态数为驻留和,并提供O(|Q||Ω|)识别重建算法。

04:00
ArXiv AI

利用潜在空间:从引导向量到模型校准器以实现控制与信任

提出引导向量控制行为,开发潜在空间校准器增强信任,构建更可信语言技术。

04:00
ArXiv AI

HydraCollab:面向分布式自主系统的自适应协同感知

HydraCollab通过选择性传输关键特征和动态切换协作策略,在低通信开销下实现高精度感知,性能优于现有方法。

04:00
ArXiv AI

静态与动态环境中的最优任意角度路径规划

提出椭圆前向扩展和视野两种加速技术,开发Zeta*与Zeta*-SIPP算法,实现静态与动态环境中的最优任意角度路径规划,速度提升20倍以上。

04:00
ArXiv AI

你会与超级智能结婚吗?

即使假设超级智能可靠,赋予其婚姻地位也导致社会不公;法律应针对人机亲密关系制定具体权利保护,而非整体合法化。

04:00
ArXiv AI

AI身份的范畴论解释

范畴论形式化AI身份,提出弱解释(信任度相等)和强解释(互保可达),构建层次化标准,明确责任转移前提。

04:00
ArXiv AI

对比音频解码的自适应扰动选择

提出自适应扰动选择,通过二元约束、任务相关变换及轻量选择器,有效减少音频语言模型幻觉。

04:00
ArXiv AI

ASPIRE:面向机器人的自主技能发现

ASPIRE通过闭环执行与进化搜索自主发现并复用机器人技能,在多种任务中性能大幅领先,实现零样本泛化。

04:00
ArXiv AI

MalariAI:一种针对密集疟疾血涂片的标签弹性解耦框架,用于通用细胞分割与可解释分期分类

提出MalariAI两阶段解耦框架,实现无注释细胞分割和98.36%准确率分类,并提供细胞级解释。

04:00
ArXiv AI

利用时序逻辑规范实现步态感知的四足运动学习

采用信号时序逻辑约束指定步态,生成稠密奖励,提升四足机器人速度跟踪与训练稳定性。

04:00
ArXiv AI

Beyond the Prompt: Jailbreaking Function-Calling LLMs via Simulated Moderation Traces

04:00
ArXiv AI

一种调查软件仓库中AI模式普遍性的方法论

提出文献挖掘与主动学习结合的方法,识别14种AI模式,在GitHub仓库中测试准确率56%,为分析AI模式实际使用提供基础。

04:00
ArXiv AI

一种多分辨率有限体积启发的时空动力学预测深度学习框架

MuRFiV网络融合有限体积与深度学习,嵌入PDE信息,实现复杂动力系统长期稳定精准预测。

04:00
ArXiv AI

人工智能、信任与团队协作:面向自主与黑箱AI系统的“人类作为驯导员”方法

将自主AI类比为动物,人类扮演驯导员而非使用者,以明确责任归属,最终导向人机协作。

04:00
ArXiv AI

BaseRT:基于原生Metal的Apple Silicon顶尖大语言模型推理运行时

BaseRT利用原生Metal在Apple Silicon上实现最高LLM推理吞吐,解码速度比llama.cpp快1.56倍、比MLX快1.35倍。

04:00
ArXiv AI

从技术指标到用户感知:一项关于多模态人机交互系统用于物体检测与抓取的用户研究

用户实验表明,系统成功率从75%提升至90%后,70.83%用户更偏好改进版本,感知评分显著提高。

04:00
ArXiv AI

面向IIoT网络的轻量级入侵检测模型中的跨域泛化失败

轻量级模型跨网泛化失效,因过度依赖粗粒度端口特征,需用真实分布进行跨网络评估。

04:00
ArXiv AI

Exploring the Semantic Gap in Agentic Data Systems: A Formative Study of Operationalization Failures in Analytical Workflows

04:00
ArXiv AI

有限记忆语言模型中的遗忘审计

提出因果审计框架,发现参数泄露近零,删除事实残留源于近邻检索,遗忘边界主要由数据库决定。

04:00
ArXiv AI

定义性忠实:基于自然语义元语言说明的情感分析

用自然语义元语言说明进行情感分析,解析器生成说明并由固定规则判定标签,牺牲少量准确率换取可审计的定义性忠实。

04:00
ArXiv AI

基于不动点流的自条件流映射语言模型

自条件流语言模型利用不动点迭代提升去噪,提出二维不动点流并蒸馏得到FMLM$^\star$,在少步生成中超越现有最佳。

04:00
ArXiv AI

LLVM-Bench: 面向LLVM编译器问题解决的大语言模型基准测试与推进

提出首个LLVM问题解决基准LLVM-Bench及集成方法LLVM-Ens,解决率达21.99%。

04:00
ArXiv AI

幽灵参考文献:经过顶级会议同行评审后仍然存在的幻觉引用

顶级会议论文存在幻觉引用,引用率低于1%,但约5%论文含至少两处;审计可行且低廉,已开源RefChecker工具。

04:00
ArXiv AI

SenseWalk: Agent-Based Semantic Trajectory Simulation Powered by Large Language Models in Zoned Environments

04:00
ArXiv AI

毫米波波束对齐的元迁移学习

提出MTL-BA,冻结预训练骨干,仅学习轻量适配器,参数减少17倍,性能相近,元训练减少60%。

04:00
ArXiv AI

CAT:置信自适应思维——大推理模型的高效推理方法

CAT框架利用模型内在置信度信号,自主调节推理长度,在压缩简单问题回答的同时保障复杂问题准确性,提升推理效率。

04:00
ArXiv AI

基于平坦最小值优化改进稀疏视图3DGS泛化

引入平坦最小值优化与周期性重初始化,提升稀疏视图3DGS泛化,生成更清晰稳定的新视角。

04:00
ArXiv AI

学习用于隐式神经表示的心脏运动先验

比较四种心脏运动先验策略,学习先验优于随机初始化,元学习的早期性能和适应轨迹最优。

04:00
ArXiv AI

TRCGL-Net:基于生成式数据增强和标签共现建模的长尾多标签胸部X光分类框架

利用生成式数据增强和标签共现建模,提升长尾胸部X光多标签分类中罕见病识别性能。

04:00
ArXiv AI

SWE-Doctor:利用多方面缺陷复现测试的运行时诊断指导软件工程智能体

SWE-Doctor通过多方面缺陷复现测试的运行时诊断指导补丁生成,平均修复率超75%。

04:00
ArXiv AI

复杂文档布局中的阅读顺序推断

无训练图框架结合语言模型与最大遗憾推理,在复杂手稿布局中阅读顺序推断准确率达95%,优于XY-cut等基线。

04:00
ArXiv AI

对数贡献评分识别非字面检索头

提出LOCOS方法,通过OV电路输出投影评分,消融top头后ROUGE-L降至0.000,且保持其他能力。

04:00
ArXiv AI

行为自适应对话代理:迈向流动人格框架

针对固定人格与情境不匹配,提出流动人格框架,动态调整代理的隐喻角色和人格表达强度以适配任务、用户和情境。