面向文本宽度与无障碍启发式配置的稳定点要素标注:约束安全的图上下文评分
提出LABELSENSE-Pilot:图上下文评分选标注,显示率85.62%、闪烁2.09%、零碰撞。
TRACE:面向数字档案来源发现的可问责智能体检索
免训练智能体检索框架TRACE面向OCR退化的历史档案,R@10达0.856超越各类基线,单问成本约0.02美元。
大型语言模型中的跨语言地缘政治分歧
大模型回答乌克兰战争时,不同语言产生不同地缘政治倾向,并与全球政治分歧吻合。
MaSCoD:结构上下文引导的候选因果图生成多智能体框架
提出MaSCoD多智能体框架,先组织候选第三变量与局部结构再判定直接边,以控制因果遗漏;实验显示效果随数据与模型而异。
面向网络化低空无人机的神经符号智能体AI
提出神经符号智能体AI框架,融合神经感知、符号推理与闭环交互,提升网络化低空无人机自主决策可靠性。
超越深度截断:递归语言模型中深度利用的可控评估
提出DCP,用正负控制与训练干预,分离深度截断中递归次数、独立计算与读出偏移,可控评估模型深度利用。
可定制且联合优化的路线规划:一种支持可微最短路径搜索的深度架构
提出端到端可微深度架构,联合优化代价函数与路径排序,支持可定制路线规划,实验显著优于现有方法。
数据归因能过滤掉潜意识学习吗?并不可靠
三种梯度归因法可部分过滤潜意识学习,但效果不及散度词元,且跨设置不稳定。
MAGMA-GEN:通过反事实重执行从模糊失败中获取经验证的恢复监督
MAGMA-GEN 通过特权教练诊断与反事实重执行验证,把模糊失败轨迹转为恢复监督数据,提升长程操作成功率与恢复能力。
DART:面向少步视频扩散模型免训练LoRA复用的蒸馏感知重参数化
免训练DART结合低秩坐标传输与目标调度校准,提升少步视频扩散LoRA复用的质量与功能保留。
面向多模态乳腺癌诊断的FCA引导反事实解释:一种实现完美有效性与涌现稀疏性的框架
以形式概念分析格约束反事实搜索,使多模态乳腺癌诊断达100%有效、最稀疏且邻近性高。
FedeRICo:面向交通流预测的联邦区域影响耦合
FedeRICo以梯度协作与边界残差通信平衡全局与客户端私有信息,四个交通流基准上超越现有联邦方法。
为你量身定制:语言模型个性化的纵向效应
992人五天实验显示,人机互动变化多由重复使用驱动,但个性化会改变用户的自我披露与信息共享态度。
一种支持巴西武装部队多域决策的智能体AI架构提案
提出支持巴西三军多域决策的智能体架构,可自主规划、访问数据、调用工具并安全行动,并讨论应用与权限。
AgentPProf:面向长时程AI智能体的语义剖析器
将智能体轨迹聚合为pprof兼容画像,以语义操作栈实现任务级分层归因,高效定位问题并优化token成本。
PaGNet:面向多目标企业避税代理预测的面板感知GBDT-神经网络
PaGNet融合GBDT与面板神经网络双分支,预测多目标企业避税代理并提供分支依赖诊断。
序列情境契合度可预测跨领域的人类行为与神经动态
基于嵌入的序列情境契合度(SCF)指标,在语言、音乐、决策等多个领域预测加工时长、行为转变与神经状态变化。
JointMatch:面向大规模拼车匹配的统一异构图神经网络求解器
JointMatch用稀疏异构图统一求解拼车配对与派车,单次前向评分,纽约上超两阶段基线且快20倍。
JEPA-WAM:通过JEPA潜表示将生成式视觉指令连接到世界动作模型
生成视觉指令经冻结V-JEPA编码为紧凑目标token,跨注意力条件化视频与动作专家,提升机器人指令跟随能力。
智能城市NR-V2X网络中基于学习优化图神经网络的AI驱动实时中继优化
提出基于图神经网络的学习优化框架,用于NR-V2X实时多跳中继选择,连接增益达11.3%,较MILP提速最高100倍。
当 AI 智能体提交时:跨数据、证据、策略与权限的认知可串行化
AI智能体提交需在数据、证据、策略与权限变化下实现认知可串行化;TCT保障零错误提交,平均开销仅3.22ms。
NeuSOGA3D:面向可解释三维几何重建的神经符号框架
神经符号框架将点云投影至正交平面,构建隐式样条,经CSG融合与截面分解,得CAD兼容、可解释三维几何。
通过稳定扩散-对抗模型从二维图像生成非均质三维地质微观结构
提出稳定扩散-对抗模型,从二维图像生成三维非均质地质微观结构,无需三维真值,训练稳定、伪影少且结构描述吻合。
SkillAA:归因引导的技能图更新与定向验证和回滚
用统一技能图支持技能选择、归因修复与局部验证,双重门控筛选更新,三大基准均达最优。
推理的组织:信息、资源约束与AI生产
AI推理价值取决于容量与任务信息分布;实验显示规划劣势随资源增加缩小15个百分点,信息获取与工作流结构决定生产价值。
结构化四阶段法律翻译:从自然语言交通规则到PROLOG
提出S4L框架,将交通规则直接译为可执行Prolog,准确率75%,优于基线,能捕捉因果、道义与例外结构。
智能体框架如何创造价值?有状态LLM智能体中的规划信息与放行控制
任务专属规划提升成功率7.17个百分点,复杂任务收益更大;只读验证器低成本拦截错误,高责任时更关键。
一种用于路径与支撑推理的定性模型
面向Camelot Jr.桥接积木游戏,提出融合质心稳定性的混合定性模型,推理路径与支撑,助力可解释游戏智能体。
面向部分监督分割中特征对齐的最优传输度量学习
两阶段框架结合器官原型与三元组损失对齐特征分布,缓解部分标注与域偏移,提升多器官分割。
语言模型群体在重演人类推理任务审议时夸大共识
LLM重演人类推理审议时高估共识,共识率超人类34–44个百分点,且不反映集体准确性。
拒绝、分解、刷新:面向闭环AI评估的论断安全协议
提出“拒绝—分解—刷新”的论断安全协议,防止闭环AI评估可复现却支持错误结论。
PAA:概率艾伦代数——艾伦区间关系的一种生成式完备概率扩展
提出概率艾伦代数,由高斯边界分布生成13种区间关系概率,容差下构成完备划分,可退化为经典艾伦代数。
扩散模型中置信度的局限
离散扩散按置信度选位写入,但位置常依赖,逐位置分布无法匹配联合分布;合成任务偏差达噪声底线29倍,单样本指标仍1.0
代码即审计员:通过法规到代码实现可执行的合规推理
将法规转为可执行代码与清单,动态生成正反问题引导证据推理,实现可溯源、准确的自动化合规审查。
REACT:面向实时事件驱动时间感知的全脉冲状态空间模型
REACT为全脉冲状态空间模型,逐事件处理原始事件流,无需时间累积,TTC估计延迟仅4.6毫秒且精度领先。
并非所有节点都生而平等:面向稳定GNN评估的同质性感知分层
提出同质性感知分层法,以节点同质性为主、类别为辅划分数据,显著提升GNN评估稳定性。
面向无数据预测与稀疏数据同化的物理信息血流动力学建模
物理信息血流动力学建模:双视角造影重建3D冠脉血流,压力降误差2.02%,FFR诊断准确率93.8%。
TacSushi:面向灵巧寿司操作、以触觉为基础的世界-动作建模
提出TacSushi触觉世界-动作策略,门控融合指尖触觉,训练时用失败后果监督,成功率达68.3%。
高效链接非结构化数据以支持多步推理
DASE查询引擎联合过滤、多向量检索与连接,推理检索快6–46倍,并提升下游LLM精度、降低成本。
CoreSense:面向可审计机器人决策的可追溯故障召回与冲突感知信念门控
融合可追溯失败召回与冲突感知信念门控,实现可审计机器人决策,不安全继续执行降至0%,但非认证安全。
AURORA:一种自然语言驱动的智能体框架,用于理解、推理和编排可靠的空地协同仿真
AURORA以自然语言智能体编排可靠空地协同仿真,用AGSG中间表示支持规划、校验与修复,并揭示仅可执行不等于满足交互。
利用LLM调优指令复制检测并行软件中的软错误
PaRID:编译期软错误检测框架,融合并行感知变换与LLM调优建模,开销降至59.84%,提速5倍。
网络安全博弈的高效纳什均衡计算
提出遗憾加权收益采样,仅模拟均衡敏感格并用代理填充;在网络安全博弈中更省预算并降低可利用性。
从回合执行到场景重置:面向自主长时程操作评测的图基框架
HALTER用场景图与LLM规划原子重置技能,自动评测并重置长时程操作,成功率76%,省72%人力。
自演化搜索索引
提出SELF-INDEX,使索引自主诊断缺陷、修订索引键并模拟查询需求,持续提升检索与下游智能体表现。
《MIP* = RE 背后核心定理的长时程自动形式化》
FormalFlow 协调 AI 智能体,63 天完成 MIP* = RE 核心定理的 Lean 4 机器验证证明。
复现透明可审查推荐:通过自然语言用户画像探索开放权重模型
复现自然语言用户画像推荐的可解释性,发现画像扰动仅整体改变评分而不影响排序,系评分回归目标所致。
信任,但须验证工具本身:在自建安全回归代理集上审计AI生成的RTL验证计划
AI生成RTL验证计划通过schema却在生产语义校验中失败,1860次调用仅9次通过,故按工具验证事故上报。
CoRELoop:面向音频深度伪造检测的参数高效可控循环精炼
仅训练轻量循环精炼与低秩适配器,冻结原检测器,14域EER由4.85%降至3.74%。