5947 条条目 · 106 个活跃源
2026年7月8日
04:00
ArXiv AI

Uncovering Latent Depression Severity for Binary Depression Detection via Advantage-weighting Ranking

04:00
ArXiv AI

PCBWorld:基于引擎的PCB设计自动化基准环境

PCBWorld是基于KiCad引擎的PCB布线基准环境,支持RL/LLM代理交互布线,RL策略零样本迁移到真实板表现优异。

04:00
ArXiv AI

审视下的自动DSM:基于LLM的DSM生成的黑盒评估框架

提出黑盒评估框架,系统评估LLM生成DSM能力,综合指标揭示潜力与局限。

04:00
ArXiv AI

AgoraSim:一个混合智能体建模框架

AgoraSim混合建模框架,支持多种智能体,实现场景化社会反应分析与对比验证。

04:00
ArXiv AI

前沿大语言模型智能体经济中的信息极限与吸引子动力学:一项预注册实验

实验验证LLM经济中信息决定增长,但未发现平均场模型预测的分散稳态。

04:00
ArXiv AI

From Application-Layer Simulation to Native Meta-Architecture: Structural Tension as an Endogenous Driver for Heterogeneous AI Evolution

04:00
ArXiv AI

中文标题:一种用于双材料系统中弹性动力学波传播的物理信息神经网络框架

中文摘要:提出物理信息神经网络框架,准确模拟双材料弹性波传播,提供高效代理模型。

04:00
ArXiv AI

任务分解引导的自适应智能体技能检索重排序

提出SkillReranker框架,通过任务与技能语义分解及执行图构建,优化技能选择,显著提升任务性能并降低交互与令牌开销。

04:00
ArXiv AI

DT-Guard:面向免推理大语言模型安全护栏的意图驱动推理主动训练

DT-Guard采用推理主动训练而推理时免推理,将推理内化为低延迟安全判别,4B模型性能超8B基线。

04:00
ArXiv AI

从开始就注定失败:基于召回控制探针级联的LLM智能体回合早期中止

通过探测LLM内部状态提前预测失败,设计召回控制级联门控,在保证高召回率下节省大量推理算力。

04:00
ArXiv AI

奶牛场多目标电池管理的多智能体深度强化学习

基于差分进化与多智能体深度强化学习的奶牛场电池双层管理,能源套利利润提升18%并符合电网规范。

04:00
ArXiv AI

RMISC:面向时间序列基础模型的大规模真实世界多变量语料库

构建大规模真实多变量时间序列语料库,证实真实数据显著提升基础模型零样本泛化能力。

04:00
ArXiv AI

FootsiesGym:用于双人零和不完全信息格斗游戏的基准测试环境

提出FootsiesGym,开源格斗游戏基准环境,用于双人零和信息不完全博弈,支持RL算法评估与策略分析。

04:00
ArXiv AI

通过视觉动作结果推理对齐连接物理推理与任务泛化

VAORA通过双重奖励对齐视觉与动作结果,抑制幻觉推理,减少推理与行为差距,提升物理推理泛化能力。

04:00
ArXiv AI

参差不齐的全球经济:前沿AI不均衡地暴露各国经济

前沿AI对高收入国家劳动力影响更大,男女暴露程度有差异,低收入国家受间接影响,政策需因地制宜。

04:00
ArXiv AI

执行证明:受管AI代理行为的运行时验证

将AI代理执行形式化为执行证明,验证授权、历史完整性与可重放性,开销小且安全。

04:00
ArXiv AI

人工智能为何为STEM教育开启新可能?——趋势与未来议程的文献计量分析

AI通过智能支架降低知识门槛,驱动STEM教育从知识传授转向能力发展。

04:00
ArXiv AI

通过Vibe Coding为K-12教师创建AI驱动学习技术的指导框架

提出GAIDE框架,指导教师通过Vibe Coding开发AI学习技术,提升AI素养,促进专业发展。

04:00
ArXiv AI

观点:防止AI生成儿童性虐待材料需要AI安全新方法

AI生成儿童性虐待材料带来新风险,现有安全方法受伦理法律限制,需新方法及15个开放问题。

04:00
ArXiv AI

使用基于模式的知识组件自动推荐编程学习内容

基于模式的知识组件自动识别并推荐相似编程学习资源,优于基线,支持大规模概念导向指导。

04:00
ArXiv AI

PORTS:大语言模型工具选择的偏好优化检索器

PORTS通过偏好优化训练检索器,提升工具选择准确性,低计算需求且泛化性强。

04:00
ArXiv AI

查理:用于法医学证据推理的本地多智能体检索增强生成系统

Charlie是本地多智能体检索增强生成系统,用于数字取证的结构化证据处理,确保数据主权与可审计性。

04:00
ArXiv AI

结合压缩的对比预测编码用于增强无线网络中的信道状态反馈

提出集成对比预测编码的3GPP CSI统一压缩-预测框架,预测潜在表示并联合优化重构与时序一致性,降低计算开销且精度超90%。

04:00
ArXiv AI

模态相关性不等于模态效用:面向成本感知的多模态RAG的事后选择性模态升级

先廉价文本回答,再验证缺失模态,确保精度同时减少视觉调用,实现成本感知的多模态RAG。

04:00
ArXiv AI

大规模科学代码搜索:多领域数据集与基准测试

提出涵盖NASA五领域的高质量仓库语料库和两个检索基准,公开支持科研工具发现。

04:00
ArXiv AI

当AI进行分类:什么算作公共行政?

AI分类揭示公共行政研究表征差异显著且无重叠,算法具解释性,需结合人类判断。

04:00
ArXiv AI

学习4D几何先验以构建推理高效的世界动作模型

MECo-WAM通过多专家协同训练注入4D几何先验,推理时移除辅助组件,提升操作性能且不增成本。

04:00
ArXiv AI

Plainbook: 用通俗语言进行数据科学

Plainbook以自然语言为中心,自动生成代码,采用线性执行与验证机制,让不懂代码者也能参与数据科学。

04:00
ArXiv AI

EvalLoop:一种以评估为导向的迭代改进业务AI系统的方法论

EvalLoop通过维度诊断与结构化迭代,将评估从静态选择转向引导修复,显著提升AI系统性能。

04:00
ArXiv AI

超越准确性:人类如何评估机器给出的合法但有争议的法律建议

AI法律建议被感知更客观但不够全面,提供推理显著提升合理性,公众反应取决于平衡竞争性规范期望。

04:00
ArXiv AI

187k ChatGPT历史记录中的抑郁症状与关系模式

基于187k对话,高抑郁症状用户更倾向用ChatGPT寻求支持,语言模式独特,但不可作临床筛查。

04:00
ArXiv AI

模型上下文协议中Unicode TAG块隐藏工具元数据载荷:三种服务器实现的批准视图保真度差异

Unicode TAG块编码可隐藏载荷并原样注入模型上下文,三种MCP服务器实现均使批准视图失效。

04:00
ArXiv AI

SCOReD:面向推荐蒸馏的学生感知思维链优化

SCOReD通过学生感知的思维链优化,修剪冗余、适配分布,提升推荐蒸馏性能并缩短推理长度27.3%。

04:00
ArXiv AI

预算子模最大化的数据依赖评估

提出带背包约束子模最大化的数据依赖上界,可准确评估解与最优解的接近程度。

04:00
ArXiv AI

基于MCP的智能体AI实现IPoDWDM网络自主生命周期自动化

MCP智能体AI架构实现厂商无关IPoDWDM网络生命周期自动化和闭环控制,真实测试验证。

04:00
ArXiv AI

从织体对位到特征编码:融合电子声学分析的海顿《云雀》多维度机器表征研究

提出事件时间戳与角色感知编码,融合古典对位与电声分析,突破多声部角色感知缺失,为人机协作范式奠基。

04:00
ArXiv AI

设计可维护的混合生成系统:一种受量子启发的自动音乐和声生成方法

提出量子启发混合生成系统,结合候选探索与规则优化,自动生成旋律和声,保持调性结构并允许多样实现,无需训练语料。

04:00
ArXiv AI

利用代码智能体进行自动软件验证

代码智能体在验证框架下自动证明全部目标引理,实现全自动、全覆盖的软件验证,无需专家干预。

04:00
ArXiv AI

使用北美行业分类系统(NAICS)对GitHub仓库进行行业分类

提出NAICS-GH数据集,含6,588个标注仓库,精度96.98%,RoBERTa-large F1达86.45%。

04:00
ArXiv AI

面向AI标准化:多级自主移动中的人-AI三元协作框架

提出三元人-AI协作框架(顾问、副驾驶、守护者),动态适应需求,推动多级自主移动标准化。

04:00
ArXiv AI

自路由:从隐藏状态实现无参数专家路由

Self-Routing直接利用隐藏状态子空间作为专家logits,无需路由器参数,性能持平且专家利用率更平衡。

04:00
ArXiv AI

EVA-Net:基于视频运动先验的跨被试脑电解码

利用动作视频作为语义先验,跨模态对齐与知识蒸馏实现跨被试EEG解码,精度提升8.66%。

04:00
ArXiv AI

FADE:通过降低语言先验主导性缓解大型视觉-语言模型的幻觉

发现FFN模块是关键语言先验源,提出FADE衰减其输出以减少主导,有效缓解幻觉并保持效率。

04:00
ArXiv AI

利用元记忆代理增强大型语言模型的无数据代码生成

元记忆代理引导LLM回忆评估知识,无需示例即可提升无数据代码生成质量。

04:00
ArXiv AI

通用算法隐式学习

提出TAIL模型,基于Transformer实现跨领域、模态、标签的元学习,少样本SOTA,泛化至未见模态,计算效率高。

04:00
ArXiv AI

OpenGround:基于规划的在线感知实现开放世界三维视觉定位

OpenGround零样本框架,通过任务链规划与上下文引导感知,实现开放世界3D视觉定位,性能领先。

04:00
ArXiv AI

在Connectome 2.0扫描仪上用于量化人类灰质微结构的简化NEXI协议

利用XAI优化NEXI协议,扫描时间由27分钟减至14分钟,验证其最优性与鲁棒性。

04:00
ArXiv AI

从全局到粒度:通过相关曲面揭示IQA模型性能

提出粒度调制相关(GMC),通过相关曲面揭示模型在局部质量谱上的性能差异,提供更精细的分析范式。

04:00
ArXiv AI

StepShield:何时干预异常代理,而非是否干预

StepShield基准首次衡量检测及时性,发现基于规则的监控干预时机近乎随机,实时监控仍待解决。