CrashDiffuser:面向细粒度安全关键交通场景生成的VLM引导碰撞意图推理
VLM引导扩散框架生成指定接触区域的碰撞场景,单次碰撞率50.33%,三次67.98%
迈向可信自主机器人:基于可解释AI的决策框架
自主机器人深度学习难审计,TRACE框架用四层可审计机制,实现98%以上证据可追溯与决策可重构,满足欧盟AI法案透明要求。
When Can Large Reasoning Models Save Thinking? Mechanistic Analysis of Behavioral Divergence in Reasoning
AI副驾驶中用户偏好的建模与优化:综合综述与分类法
综述AI副驾驶用户偏好建模与反馈优化,提出交互三阶段分类法,为个性化助手设计提供统一基础。
隔离作为LLM-Agent系统安全的第一性原则:概念、分类、挑战与未来方向
将隔离视为LLM-Agent系统安全第一性原则,提出五边界分类法,分析跨边界失效路径,规划先验隔离研究议程。
逐步思考-批判:单一大语言模型中的交错推理与自我批判
提出STC框架,让单一LLM逐步推理并同步自我批判,经强化学习联合优化,数学推理Pass@1提升7.2%,优于外部验证模型。
超越对话时间:面向个性化LLM代理的时间语义记忆
提出时间语义记忆框架,解决时间不准确与碎片化,支持持续性记忆,准确率最高提升12.2%
从高维空间到可验证的ODD覆盖:面向安全关键的AI系统
提出离散化、约束过滤和关键性降维结合的运行设计域覆盖验证法,满足EASA完整性要求,实现高维空间验证。
自适应图岛演化:基于大语言模型的自动特征工程
提出TOPOFE框架,用图结构多岛演化搜索自动特征工程,动态学习迁移拓扑,在29个数据集上优于多数现有方法,特征冗余低、覆盖高。
PIE-APT: 基于增量推理的时序动态知识图谱上的溯因规划
提出PIE框架,在时序动态知识图谱上通过增量推理实现溯因规划,规避可判定性难题,性能优于经典规划。
基于深度去噪自编码器的动静脉瘘无创血流检测
用深度去噪自编码器学习动静脉瘘听诊特征,隐表示识别准确率达0.93,泛化性好,可扩展。
基于熵的选择性智能体引导:从不完美VLM教师学习自主策略
熵引导选择性咨询:仅在不确定时请教教师,用环境优势加权其建议,蒸馏成轻量策略。测试无需教师,优于无引导。
我们为何需要AI韧性社会——大型语言模型侧写
侧写显示大语言模型流畅虚构、强化偏见、侵蚀能力,故提出认知主权等四大支柱构建AI韧性社会。
预测误差不足:评估因果估计中的干扰函数预测
模拟表明预测误差不直接反映因果估计质量;XGBoost点估计最优,DML置信区间覆盖更佳。
大语言模型中的长程状态跟踪:经由深度依赖的工具调用序列执行MD5
让大模型经196次依赖工具调用算MD5,证明可跨调用精确保持状态;成败在于保留推理与投票纠错。
针对老年人金融诈骗的渐进式增量风险评估:基于指令微调小型语言模型
提出逐轮累积风险评估框架,微调小型语言模型,动态监测多轮老人金融诈骗,支持资源受限的终端部署。
AI发病与死亡:临床AI失败审查框架
提出AI M&M无责框架,系统回顾临床AI失败案例,分四维分类并追踪整改,将个体错误转为机构学习。
非对称性:自发欺骗与指令欺骗
研究发现大模型自发欺骗与指令欺骗共享部分方向,但检测与干预存在跨场景不对称。
IMPACT:注意力即交互图,实现可扩展的交互感知世界模型训练
提出利用注意力先验与局部误差构造交互图,重加权去噪监督,无需外部标注,提升交互真实性与物理合理性。
不同表征学习目标从同一心理测量数据中恢复出不同的潜在结构
不同表征目标从相同数据恢复不同潜在结构:对比增强师生匹配,减弱表型;多任务折中。
LLM驱动的自动驾驶车辆在行人让行中继承人类驾驶员偏见:新基准的结果与启示
提出两种模型偏见测试法,发现让行决策受行人性别、族裔、宗教、残疾等影响,质疑常识模型范式。
ReDeck:文档转幻灯片的步骤级渲染反馈精炼方法
提出ReDeck,将幻灯片修订拆为原子编辑并逐步获取渲染反馈,多粒度纠错,显著优于现有生成代理。
人机共同诠释以促进可信AI:一种诠释学视角
指出大模型输出常被误当作确定意义,缺乏诠释框架与溯源;基于哲学诠释学,提出人机协同诠释的设计原则,以保障问责与可辩护性。
答案并非论证
正确答案能提升结论一致性检查,而非独立验证推理;正确结论不代表推理健全。
面向持续个性化的假设引导自我蒸馏
提出假设引导自我蒸馏框架,从异构信号推断不确定感知的偏好假设并修正,实现持续个性化,优于基线。
市场目录的自动研究:从传统表单到AI原生匹配
面向双边市场,以LLM推断意图,自动生成供应商分类法,迭代评估,部署132个职业,实现AI原生匹配。
不可逆性预算:智能体操作系统的机群级风险核算与准入控制
提出不可逆性预算,按机群累计残余风险并拒绝超支,优于逐效应门控;核心难题是保守依赖感知定价。
SlideBank:用于一致全切片推理的持久分层证据库
免训练将全切片转为持久分层证据库,问题路由与跨级共识推理,精度提升且复用证据降成本。
mimeo:将公开专家语料编译成智能体技能并测试迁移效果
mimeo将专家公开语料编译成智能体文件,知识访问强、幻觉少;但判断迁移未证实。
RestoreBench:AI智能体能否恢复潮流收敛?
提出基准,评估不同大语言模型在聊天、单智能体和多智能体架构下恢复潮流收敛的能力,覆盖两电网各46案例。
一种用于量子联邦学习的稳定聚合方法
针对量子联邦学习的不稳定问题,提出自洽中点聚合法,融合QoS加权与环形参数聚合,提升稳定性并保持精度。
SpecMind:基于多智能体混合检索增强生成的频谱智能
提出多智能体混合检索增强生成系统协同处理频谱异构数据性能超传统基线胜率达八成以上
SAGE:基于状态、具有弃权意识的任务型对话智能体评估
以状态为据且可弃权:将差异转为原子准则,符号与神经验证器级联裁定;核心版零成本决策多数,优于大模型裁判。
Conversation Coach:一种支持语音的AI系统,用于练习棘手的职场对话
提出语音AI系统Conversation Coach,助管理者演练棘手职场对话。端到端延迟低但级联推理更优,后者已部署,四万余管理者使用半年。
Wave Function Backpropagation with Explicit Temporal-Interval Dynamics
检索增强生成中基于文档关系图的反馈辅助信任传播
提出基于文档关系图的信任传播方法,以少量人工反馈为锚,多跳估算文档可信度,提升检索质量和答案准确率。
REVISE:智能体工作流中在线修订的有效性引导恢复
Revise通过依赖传播识别受影响工作,仅重算受影响区域,在保证无陈旧输出的同时减少模型调用40%以上。
无对齐的一致性:对项目敏感的语言模型与随机不可区分
项目敏感性不足以证明任务能力:21个组合均敏感,但8个与随机无异,5个更差,相关仅0.30,即无对齐一致性。
苏格拉底走向核安全:基于脑感知比较学习情境中的AI交互策略
比较三类AI交互后发现:无限制聊天学习收益最高,但脑电投入低,其成功或源于即时后测而非深层学习。
同一请求,不同边界:对话情境下的网络安全协助评估
3R-Bench显示,相同网络安全请求因对话情境而异:拒绝历史后遵从率62%,接受后85.1%,对话分解后骤降。
自我报告并非验证:演化搜索中LLM操作者的环境锚定审计
环境审计显示,LLM自我报告高估成功率4.8至9.3倍,校准与理由传递均无效,应视为待环境验证的声明。
SciTrue:NTCIR SciClaimEval任务中基于前沿与开源语言模型的可靠科学声明验证
SciTrue在NTCIR SciClaimEval中集成11种模型,用配对先验大幅提升准确率,获三项第一。
逃离冗余推理:面向推理时大模型的结构感知搜索
提出BASIN方法,按结构分组推理状态并惩罚重复策略,在固定算力下提升搜索多样性,超过思维树法,并引入冗余间隙解释其优势。
智能体实证资产定价:方法论基础
提出LLM智能体自主发现因子的资产定价新范式,构建架构、评估标准及回测方法,实证发现无单一指标可全面评价系统。
ChatDev 2.0:一个开发万物的无代码多智能体平台
无代码平台DevAll,支持异构智能体动态循环交互,可视化构建执行,复现SOTA性能,通用且易用。
基于本体扩展与检索的越南历史教科书自动树知识图谱构建
提出端到端流水线;在越南历史教科书构建750节点树知识图谱,Top-Down检索NDCG@10超基线4.7%。
采用闭环评估压缩驾驶策略的能力损失与恢复
提出分阶段闭环评估法,发现结构化剪枝先致能力损失,蒸馏可改善但受限,整数量化影响停车再启动,未剪枝模型则保留全部五项课程。
S³martCirc:自监督智能电路发现
S³martCirc提出自监督联合框架,同时发现电路并解释功能,用定量指标应对两者相互依赖性问题,优于现有方法。
ContextPipe:受数据库启发的长程智能体上下文组装
受数据库执行启发,该方法以五阶段流水线组装上下文,可审计可回放。相比追加式,词元减31%、调用减23%、延迟降9%。
可靠且实用的评估流水线构建
提出端到端评估流水线,结合清单生成与学习聚合,提升法官一致性及与人类判断的准确率,并支持自洽性、解释与不确定性。