5286 条条目 · 106 个活跃源
2026年9月18日
04:00
arXiv cs.AI

面向文本宽度与无障碍启发式配置的稳定点要素标注:约束安全的图上下文评分

提出LABELSENSE-Pilot:图上下文评分选标注,显示率85.62%、闪烁2.09%、零碰撞。

04:00
arXiv cs.AI

TRACE:面向数字档案来源发现的可问责智能体检索

免训练智能体检索框架TRACE面向OCR退化的历史档案,R@10达0.856超越各类基线,单问成本约0.02美元。

04:00
arXiv cs.AI

大型语言模型中的跨语言地缘政治分歧

大模型回答乌克兰战争时,不同语言产生不同地缘政治倾向,并与全球政治分歧吻合。

04:00
arXiv cs.AI

MaSCoD:结构上下文引导的候选因果图生成多智能体框架

提出MaSCoD多智能体框架,先组织候选第三变量与局部结构再判定直接边,以控制因果遗漏;实验显示效果随数据与模型而异。

04:00
arXiv cs.AI

面向网络化低空无人机的神经符号智能体AI

提出神经符号智能体AI框架,融合神经感知、符号推理与闭环交互,提升网络化低空无人机自主决策可靠性。

04:00
arXiv cs.AI

超越深度截断:递归语言模型中深度利用的可控评估

提出DCP,用正负控制与训练干预,分离深度截断中递归次数、独立计算与读出偏移,可控评估模型深度利用。

04:00
arXiv cs.AI

可定制且联合优化的路线规划:一种支持可微最短路径搜索的深度架构

提出端到端可微深度架构,联合优化代价函数与路径排序,支持可定制路线规划,实验显著优于现有方法。

04:00
arXiv cs.AI

数据归因能过滤掉潜意识学习吗?并不可靠

三种梯度归因法可部分过滤潜意识学习,但效果不及散度词元,且跨设置不稳定。

04:00
arXiv cs.AI

MAGMA-GEN:通过反事实重执行从模糊失败中获取经验证的恢复监督

MAGMA-GEN 通过特权教练诊断与反事实重执行验证,把模糊失败轨迹转为恢复监督数据,提升长程操作成功率与恢复能力。

04:00
arXiv cs.AI

DART:面向少步视频扩散模型免训练LoRA复用的蒸馏感知重参数化

免训练DART结合低秩坐标传输与目标调度校准,提升少步视频扩散LoRA复用的质量与功能保留。

04:00
arXiv cs.AI

面向多模态乳腺癌诊断的FCA引导反事实解释:一种实现完美有效性与涌现稀疏性的框架

以形式概念分析格约束反事实搜索,使多模态乳腺癌诊断达100%有效、最稀疏且邻近性高。

04:00
arXiv cs.AI

FedeRICo:面向交通流预测的联邦区域影响耦合

FedeRICo以梯度协作与边界残差通信平衡全局与客户端私有信息,四个交通流基准上超越现有联邦方法。

04:00
arXiv cs.AI

为你量身定制:语言模型个性化的纵向效应

992人五天实验显示,人机互动变化多由重复使用驱动,但个性化会改变用户的自我披露与信息共享态度。

04:00
arXiv cs.AI

一种支持巴西武装部队多域决策的智能体AI架构提案

提出支持巴西三军多域决策的智能体架构,可自主规划、访问数据、调用工具并安全行动,并讨论应用与权限。

04:00
arXiv cs.AI

AgentPProf:面向长时程AI智能体的语义剖析器

将智能体轨迹聚合为pprof兼容画像,以语义操作栈实现任务级分层归因,高效定位问题并优化token成本。

04:00
arXiv cs.AI

PaGNet:面向多目标企业避税代理预测的面板感知GBDT-神经网络

PaGNet融合GBDT与面板神经网络双分支,预测多目标企业避税代理并提供分支依赖诊断。

04:00
arXiv cs.AI

序列情境契合度可预测跨领域的人类行为与神经动态

基于嵌入的序列情境契合度(SCF)指标,在语言、音乐、决策等多个领域预测加工时长、行为转变与神经状态变化。

04:00
arXiv cs.AI

JointMatch:面向大规模拼车匹配的统一异构图神经网络求解器

JointMatch用稀疏异构图统一求解拼车配对与派车,单次前向评分,纽约上超两阶段基线且快20倍。

04:00
arXiv cs.AI

JEPA-WAM:通过JEPA潜表示将生成式视觉指令连接到世界动作模型

生成视觉指令经冻结V-JEPA编码为紧凑目标token,跨注意力条件化视频与动作专家,提升机器人指令跟随能力。

04:00
arXiv cs.AI

智能城市NR-V2X网络中基于学习优化图神经网络的AI驱动实时中继优化

提出基于图神经网络的学习优化框架,用于NR-V2X实时多跳中继选择,连接增益达11.3%,较MILP提速最高100倍。

04:00
arXiv cs.AI

当 AI 智能体提交时:跨数据、证据、策略与权限的认知可串行化

AI智能体提交需在数据、证据、策略与权限变化下实现认知可串行化;TCT保障零错误提交,平均开销仅3.22ms。

04:00
arXiv cs.AI

NeuSOGA3D:面向可解释三维几何重建的神经符号框架

神经符号框架将点云投影至正交平面,构建隐式样条,经CSG融合与截面分解,得CAD兼容、可解释三维几何。

04:00
arXiv cs.AI

通过稳定扩散-对抗模型从二维图像生成非均质三维地质微观结构

提出稳定扩散-对抗模型,从二维图像生成三维非均质地质微观结构,无需三维真值,训练稳定、伪影少且结构描述吻合。

04:00
arXiv cs.AI

SkillAA:归因引导的技能图更新与定向验证和回滚

用统一技能图支持技能选择、归因修复与局部验证,双重门控筛选更新,三大基准均达最优。

04:00
arXiv cs.AI

推理的组织:信息、资源约束与AI生产

AI推理价值取决于容量与任务信息分布;实验显示规划劣势随资源增加缩小15个百分点,信息获取与工作流结构决定生产价值。

04:00
arXiv cs.AI

结构化四阶段法律翻译:从自然语言交通规则到PROLOG

提出S4L框架,将交通规则直接译为可执行Prolog,准确率75%,优于基线,能捕捉因果、道义与例外结构。

04:00
arXiv cs.AI

智能体框架如何创造价值?有状态LLM智能体中的规划信息与放行控制

任务专属规划提升成功率7.17个百分点,复杂任务收益更大;只读验证器低成本拦截错误,高责任时更关键。

04:00
arXiv cs.AI

一种用于路径与支撑推理的定性模型

面向Camelot Jr.桥接积木游戏,提出融合质心稳定性的混合定性模型,推理路径与支撑,助力可解释游戏智能体。

04:00
arXiv cs.AI

面向部分监督分割中特征对齐的最优传输度量学习

两阶段框架结合器官原型与三元组损失对齐特征分布,缓解部分标注与域偏移,提升多器官分割。

04:00
arXiv cs.AI

语言模型群体在重演人类推理任务审议时夸大共识

LLM重演人类推理审议时高估共识,共识率超人类34–44个百分点,且不反映集体准确性。

04:00
arXiv cs.AI

拒绝、分解、刷新:面向闭环AI评估的论断安全协议

提出“拒绝—分解—刷新”的论断安全协议,防止闭环AI评估可复现却支持错误结论。

04:00
arXiv cs.AI

PAA:概率艾伦代数——艾伦区间关系的一种生成式完备概率扩展

提出概率艾伦代数,由高斯边界分布生成13种区间关系概率,容差下构成完备划分,可退化为经典艾伦代数。

04:00
arXiv cs.AI

扩散模型中置信度的局限

离散扩散按置信度选位写入,但位置常依赖,逐位置分布无法匹配联合分布;合成任务偏差达噪声底线29倍,单样本指标仍1.0

04:00
arXiv cs.AI

代码即审计员:通过法规到代码实现可执行的合规推理

将法规转为可执行代码与清单,动态生成正反问题引导证据推理,实现可溯源、准确的自动化合规审查。

04:00
arXiv cs.AI

REACT:面向实时事件驱动时间感知的全脉冲状态空间模型

REACT为全脉冲状态空间模型,逐事件处理原始事件流,无需时间累积,TTC估计延迟仅4.6毫秒且精度领先。

04:00
arXiv cs.AI

并非所有节点都生而平等:面向稳定GNN评估的同质性感知分层

提出同质性感知分层法,以节点同质性为主、类别为辅划分数据,显著提升GNN评估稳定性。

04:00
arXiv cs.AI

面向无数据预测与稀疏数据同化的物理信息血流动力学建模

物理信息血流动力学建模:双视角造影重建3D冠脉血流,压力降误差2.02%,FFR诊断准确率93.8%。

04:00
arXiv cs.AI

TacSushi:面向灵巧寿司操作、以触觉为基础的世界-动作建模

提出TacSushi触觉世界-动作策略,门控融合指尖触觉,训练时用失败后果监督,成功率达68.3%。

04:00
arXiv cs.AI

高效链接非结构化数据以支持多步推理

DASE查询引擎联合过滤、多向量检索与连接,推理检索快6–46倍,并提升下游LLM精度、降低成本。

04:00
arXiv cs.AI

CoreSense:面向可审计机器人决策的可追溯故障召回与冲突感知信念门控

融合可追溯失败召回与冲突感知信念门控,实现可审计机器人决策,不安全继续执行降至0%,但非认证安全。

04:00
arXiv cs.AI

AURORA:一种自然语言驱动的智能体框架,用于理解、推理和编排可靠的空地协同仿真

AURORA以自然语言智能体编排可靠空地协同仿真,用AGSG中间表示支持规划、校验与修复,并揭示仅可执行不等于满足交互。

04:00
arXiv cs.AI

利用LLM调优指令复制检测并行软件中的软错误

PaRID:编译期软错误检测框架,融合并行感知变换与LLM调优建模,开销降至59.84%,提速5倍。

04:00
arXiv cs.AI

网络安全博弈的高效纳什均衡计算

提出遗憾加权收益采样,仅模拟均衡敏感格并用代理填充;在网络安全博弈中更省预算并降低可利用性。

04:00
arXiv cs.AI

从回合执行到场景重置:面向自主长时程操作评测的图基框架

HALTER用场景图与LLM规划原子重置技能,自动评测并重置长时程操作,成功率76%,省72%人力。

04:00
arXiv cs.AI

自演化搜索索引

提出SELF-INDEX,使索引自主诊断缺陷、修订索引键并模拟查询需求,持续提升检索与下游智能体表现。

04:00
arXiv cs.AI

《MIP* = RE 背后核心定理的长时程自动形式化》

FormalFlow 协调 AI 智能体,63 天完成 MIP* = RE 核心定理的 Lean 4 机器验证证明。

04:00
arXiv cs.AI

复现透明可审查推荐:通过自然语言用户画像探索开放权重模型

复现自然语言用户画像推荐的可解释性,发现画像扰动仅整体改变评分而不影响排序,系评分回归目标所致。

04:00
arXiv cs.AI

信任,但须验证工具本身:在自建安全回归代理集上审计AI生成的RTL验证计划

AI生成RTL验证计划通过schema却在生产语义校验中失败,1860次调用仅9次通过,故按工具验证事故上报。

04:00
arXiv cs.AI

CoRELoop:面向音频深度伪造检测的参数高效可控循环精炼

仅训练轻量循环精炼与低秩适配器,冻结原检测器,14域EER由4.85%降至3.74%。