AI 智能体能否检测并修复网络实验中的制品漂移?
新基准显示,AI智能体修复网络实验记录不一致平均通过率65.3%,但跨制品隐式关系修复不足30%。
用美善品,你会丧失烹饪能力:生成式AI教育应用的厨房机器类比
以美善品厨机类比生成式AI教育应用,借ICAP与SAMR框架指出:关键不在是否用AI,而在如何用。
差分隐私合成文本的子群成员推断审计
合成文本仍泄露子群成员,现有审计低估风险;差分隐私降平均泄露,但剩余风险集中、保护不均,记录风险取决于发布机制。
FlowCPO:流模型偏好对齐的统一散度视角
提出FlowCPO,以统一散度框架实现流模型离线偏好对齐,无需在线采样,域内指标优于FlowDPO。
超越训练:推理时AI治理的可行性分类体系
提出20种推理时AI治理机制的分类与成熟度评估;多数有商用基础,但高能力国家级部署方仍无法有效监管。
AI 智能体能否跨权限边界交付可验证的网络级结果?
EvidenceNet 运行时保障层收集并校验跨权限证据,判定智能体协同是否达成网络级意图,可拒绝错误、替换或过期证据。
面向大语言模型架构建模输出的上下文操作及其在系统工程设计中的使用评估标准
提出LLM工程设计上下文组装形式化操作框架及建模即代码输出评估法,评估输出是否契合意图,支撑系统架构建模。
急诊科复诊质量审查筛查:探索人类决策与人工智能支持
急诊1-14天复诊诊断对:GPT-4比医生更易提示随访;LLM知识图谱筛查预测值达83%-100%。
RelayS2S: A Dual-Path Speculative Generation for Real-Time Dialogue
FrogNano: Training a 4B Coding Agent via Online Task Synthesis
RevalExo: A Functional Daily-Activity Benchmark for Inertial and Visual Locomotion Mode Recognition in Older Adults and Clinical Cohorts
Equity Promotion in Online Resource Allocation
Predicting Estimated Times of Restoration for Electrical Outages Using Longitudinal Tabular Transformers
超越对错:评估大语言模型中的二阶社会推理
现有AI对齐只教一阶规范,忽视二阶元规范。新框架评估情绪与行为,发布NormReact数据集,发现大模型高估惩罚、低估宽容。
基于成本评估的工具型LLM代理长期记忆效用研究
提出MERIT基准衡量工具代理记忆边际效用:记忆提升任务成功率至0.55-1.00,但更新事实检索不稳定,混合存储弱于单独事实存储,全文重放不经济。
可靠性感知的样本对重要性蒸馏
提出RAPID方法,通过可靠性门控与自适应对提议优化关系蒸馏,在文本分类中超越交叉熵基线,验证目标可靠性与评估优先级可分离设计。
AutoFyn技术报告:面向长程智能体的非参数专家迭代
AutoFyn用非参数专家迭代,以持久状态与验证奖励更新策略,于IMO、数据科学、网络安全成效显著。
PGP-Clinical-TimeKAN:先验引导的临床轨迹联合概率预测
提出先验引导的临床轨迹联合概率预测框架,均方根误差最低,但轨迹风险评分弱于专用分类器。
将VGDL编译为因果模型
提出将游戏描述语言编译为动态结构因果模型,保证因果保真度。
CriticGen:将生成感知评估转化为可操作反馈
提出细粒度生成感知评估框架,动态生成实例特有标准,用于评分、理由、可执行建议及答案改进,提升评估相关性并有效改善答案质量。
SCAFFOLD:通过递归参数化技能抽象实现自改进的Web智能体
提出SCAFFOLD框架:通过递归参数化技能抽象与MDL压缩构建技能层级并蒸馏回模型,视觉网络智能体成功率提升11-17个百分点。
教什么与何时教:面向Web代理的预算感知在线适应
提出预算感知的在线教学框架,决定何时教和教什么,在保持性能的同时减少教师调用和训练开销。
汇聚型实验室:当AI推理、自主实验、高性能与量子计算重塑化学
AI、自主实验、高性能与量子计算汇合,正推动化学科学变革,处于颠覆性突破的临界点。
CUSP:多智能体多模态推理的可分解集体不确定性
提出CUSP,无需训练即可将多VLM推理的集体不确定性分解为个体语义熵与JSD冲突,高效检测预测错误与系统级失效。
LLM交易智能体在生产环境中实际做什么:来自两个代理集群为期六个月的全量记录
六个月两系统全量记录显示:交易代理行为由操作层主导,杠杆无视波动,几乎不赚取浮盈,且无方向性优势。
从语言模型嵌入中恢复时间与地理信号
用投影法仅凭嵌入提取时间地理信号,黑盒免训练,实证有效,可用于检索。
人工智能开发中的偏差常态化
人工智能开发存在组织级偏差常态化风险,历史灾难案例表明合规流程仍可能致灾难性后果。
AI指数化增长的终结:AI泡沫内外的飘摇
AI指数增长遇数据、算力、估值等瓶颈而走向终结,引发泡沫内外的波动:内部算力竞赛与投机,外部就业、治理及地缘冲击。
多元LLM对齐的溢出感知多值引导
提出溢出感知多值引导,用Gram矩阵解耦方向纠缠,零成本修正提升净效果至14%,无需微调
超越模仿审稿人:评估大语言模型在投稿前同行评审中的应用
大模型预审可覆盖多数评审意见,但压缩报告损失大;去重补充覆盖率高,瓶颈在于代表性选择与匹配敏感度。
部分可观测下具身推理的反事实世界模型学习
提出反事实潜世界模型,用对比目标缓解反事实坍缩,提升部分可观测规划成功率,并给出可分离性指标。
基于像素-提示联合优化的视觉语言模型多模态资源耗尽攻击
首个联合像素与提示优化的资源耗尽攻击,使延迟能耗放大数倍至数十倍,揭示多模态服务防御盲区。
CWF:面向个性化且可靠科普写作的协作框架
提出个性化可靠科普写作任务,构建数据集与基准PSCB,用DA-MoE解耦受众与知识,多智能体事实核查保真,达最优性能。
PDDL规划中的实例生成器生成
提出用大语言模型自动生成PDDL实例生成器,内置合法性检查,高效生成多样合法实例。
SAP:状态引导与参数溯源的多轮工具使用数据合成
提出状态引导与参数溯源的数据合成法SAP,生成高质量多轮工具调用轨迹,构建的SAP-4B媲美更大模型。
LayerRoute:用于视觉-语言-动作策略的动作条件层混合路由
提出动作条件层混合路由与状态重读,自适应调用模型分层表征,提升视觉语言动作策略性能,参数增加极微。
高风险AI系统决策的因果归因:估计量、耦合与可追溯性规范
提出代理决策因果归因框架,发现现有估计量失效,推导耦合方法,并给出满足欧盟法规的可追溯性规范。
中文标题:SCIRIGOR:超越最终分数的开放式科学分析评估
中文摘要:科研智能体生成的结论常缺乏充分证据支撑。新框架SciRIGOR通过构建证据图,沿“数据到结论”全链路验证支持关系,发现系统内部一致性不代表科学正确性。
AutoKD:自主知识发现
数据驱动科研受限于人力,AutoKD用多智能体循环发现,将验证结果存入知识图并指导后续探索,覆盖已知且补充人类发现。
IIns-VAE+:面向无线感知环境识别的鲁棒迁移学习框架
提出融合IIns-VAE与极小极大风险分类器的IIns-VAE+,在多种无线感知迁移场景下优于基线,提升6G环境识别鲁棒性。
构建面向社会公益的可信图智能体RAG:架构、故障传播与构造式保障
社会公益的图智能体检索增强生成系统需以五类接口契约实现可追溯可授权可恢复并制定全流程评估
统一策略架构(UPA):企业AI操作系统的治理内核
提出统一策略架构(UPA),为自主AI代理与企业资源提供统一治理,扩展至运行时义务、审批、审计等,奠定安全可问责的企业AI系统基础。
目标导向情感理论的计算实现
首个高保真计算实现目标导向情感理论,情感源于差异检测与行动选择的交互,模拟揭示预期抬升与失败崩落自然涌现,建立可测试的仿真-实证循环框架。
MARBO:社交推理游戏中大语言模型智能体的关系信念锚定
该文提出基于关系信念的偏好优化,使语言模型智能体在社交推理游戏中言行一致,优于现有基线。
AI安全评估的转化性评注
自动化红队评估仅覆盖预设危害,存在威胁模型覆盖缺口;需不同部署情境的评估者弥补。
我们造了一面镜子,却误以为它有心智:因果责任与人工智能意识谬误
指出把人工智能输出误认为意识主体的谬误,提出因果责任理论,区分因果载体与意识归属,实验证明二者可分离。
神经形态系统中结构吸引子的形成
本文提出不变结构学习理论,将概念形成视为超图空间向结构吸引子的收敛,而非损失最小化。数学证明收敛性与吸引子存在性,计算验证无需反向传播的小样本图像识别,并给出树突实现的神经生物学假说。
NormViz:一个用于将多模态推理锚定于全球文化的基准与框架
提出视觉规范理解基准与训练集,覆盖多国对比图像。最强VLM仅26.6%准确率,微调后可提升125%,开辟多模态AI新前沿。
在《Legends of Code and Magic》中利用策略与价值网络的非健全搜索
在LoCM中用策略和价值网络的非健全搜索以51.35%胜率击败冠军ByteRL,无搜索仅26.8%,证明其有效且更鲁棒。
利用面向临床医生的社交媒体进行医学图像识别的视觉大语言基础模型
构建ThoughtMed-1M医学VQA数据集,训练FOLTMed模型,在42个基准上准确率85.4%,超越SOTA 3-5%。