5898 条条目 · 106 个活跃源
2026年8月14日
04:00
ArXiv AI

论智能的定义

以实体保真度为通用智能标准:对某概念,若判定器无法以超出容差ε区分生成与原始实体,即为智能。

04:00
ArXiv AI

NetlistBench:评估大语言模型在SPICE网表识别与操作中的可靠性

提出结构验证的网表基准,评估大语言模型的网表识别与操作可靠性:复杂操作准确率低,是电路设计自动化瓶颈。

04:00
ArXiv AI

具有跨学科泛化能力的数值智能基础模型

提出UNICON基础模型,从数值上下文推断预测关系,跨学科泛化,结合语言模型超越专家。

04:00
ArXiv AI

开放权重大语言模型在组合优化中的行为与表示:从特征提取到算法选择

开放权重LLM的隐藏层表示可媲美传统特征提取,虽显式提取有限,但隐式编码支持组合优化的算法选择。

04:00
ArXiv AI

工具即连续流:演化式智能体推理

提出FlowAgent,将工具链重构为语义空间连续轨迹生成,引入计划级闭环基准,实现鲁棒泛化与误差衰减。

04:00
ArXiv AI

通过可执行行为表示迈向人体运动世界模型

提出可执行行为表示法,编译为奖励模型实现零样本策略推理,在动作分割与异常检测中优于任务特定模型。

04:00
ArXiv AI

深度活动模型:人类移动模式合成的生成方法

提出生成式Transformer模型,利用人口家庭属性合成日常活动链与轨迹,可迁移至多地区,交通模拟效果与SCAG ABM相当。

04:00
ArXiv AI

支持与反对票下的比例委员会选举

探讨允许反对票的比例代表性,提出两种负票解释及公理,分析Phragmén、PAV和等分法变体的满足性。

04:00
ArXiv AI

HexEval:证据驱动的六维学者评估框架

提出证据驱动六维框架HexEval,融合内在质量与外部行为证据,实现可解释可审计的学者评估,实验验证有效。

04:00
ArXiv AI

基于LSTM网络的自适应在线学习用于能源价格预测

提出融合MAE、JSD和平滑惩罚的LSTM模型,结合自适应在线学习,误差降低23%,提升电力价格预测精度。

04:00
ArXiv AI

中文标题

提出CoRe框架,将微调从权重空间转向表示空间的低秩子空间,显式控制表示漂移,兼顾旧任务稳定与新任务可塑性,参数高效且性能领先。

04:00
ArXiv AI

小数据解读——小数据方法在日常生活中的影响

综述AI如何助力小数据场景,涵盖社会包容、辅助健康技术,并跨学科梳理数据分析方法,提出应用与研究议程。

04:00
ArXiv AI

概率近似正确的最大后验推断

将MAP视为最佳臂识别,提出PAC算法,在固定置信度与预算下提供最优解,兼具理论保证与实证优势。

04:00
ArXiv AI

BrowseSafe:理解与防范AI浏览器代理中的提示注入

针对浏览器智能代理的提示注入攻击,构建现实基准评估防御,提出多层防护策略。

04:00
ArXiv AI

A-3PO:利用陈旧性感知的近端策略近似加速异步LLM训练

A-3PO通过插值近似近端策略,消除额外前向计算开销,实现1.8倍加速且性能相当。

04:00
ArXiv AI

基于策略梯度的后训练:最优性与基座模型屏障

研究带奖励的后训练:策略梯度可达最优查询复杂度,但受基座模型支持限制;过程奖励可避免维度灾难。

04:00
ArXiv AI

资源受限设备上皮肤病变分类的量化感知神经形态架构

提出量化感知神经形态架构QANA,稳定SNN转换,皮肤病变分类精度F1显著提升,低延迟低能耗。

04:00
ArXiv AI

赋能儿童创建AI驱动的增强现实体验

提出Capybara,AR+AI视觉编程环境,让儿童创作编程3D角色,实现虚实交互体验。

04:00
ArXiv AI

基于偏振编码量子比特的腔增强集体量子处理

提出腔增强集体量子架构,偏振编码量子比特,厘米级腔可实现普适门,参数要求可行。

04:00
ArXiv AI

设计基于智能体AI的投资组合筛选

智能体AI筛选投资:LLM分析基本面与新闻生成信号,高维协方差优化权重,提高夏普比率。

04:00
ArXiv AI

增强本地LLM代理的Linux权限提升攻击能力

技术组合将本地小型LLM提权成功率从8%提升至67%,匹敌GPT-4o;反思贡献最大,漏洞发现是瓶颈。

04:00
ArXiv AI

使高斯Kolmogorov-Arnold网络可靠且准确

高斯KAN的尺度参数需选在1/(G-1)到2/(G-1)的稳定区间,实验证实其可靠准确。

04:00
ArXiv AI

在原生FP4硬件上用MXFP4预训练大语言模型

FP4训练发散主因是权重梯度量化,确定性哈达玛旋转可稳定优化,原生MXFP4在AMD MI355X上验证。

04:00
ArXiv AI

排序 vs. 匹配:多视角目标关联中的度量错配

多视角目标关联常用排序指标评估,但与匹配目标不符。理论证明AP等指标可能失真,Sinkhorn归一化可改善,但排序最优仍可能匹配错误。

04:00
ArXiv AI

AI辅助验证中的认知迁移:框架与评估协议

提出认知迁移概念及评估协议,用ETE和TRC度量AI辅助验证对后续独立判断的影响,区分能力提升与工具依赖。

04:00
ArXiv AI

持久递归世界实现自主软件演化

以持久递归世界取代持久代理,低成本完成编译器构建与模块重写,实现长时程自主软件演化。

04:00
ArXiv AI

利用自主LLM研究循环优化专家设计的晶体图网络以预测带隙

自主LLM代理在带隙基准上超越17个专家模型,用已知方法实现最优预测,并探究其局限。

04:00
ArXiv AI

推断能力不决定法律范围

欧盟人工智能法与GDPR对推断界定不同;推断能力不决定法律范围,缺失亦不豁免。提出组合效应测试。

2026年8月13日
04:00
ArXiv AI

多LLM智能体系统的动态治理:实现协作式对话结果

针对无共同目标的LLM智能体对话崩溃问题,治理层EO结合上下文臂、PID和POMDP,使高意向联系率提升32个百分点。

04:00
ArXiv AI

穷人的智能体建模:在笔记本电脑上模拟大型LLM智能体社会

以低参数模型拟合每个智能体,在笔记本上模拟大群体,用交互序与记忆分类预测误差趋势。

04:00
ArXiv AI

Conway 99-图问题的强制结构约简与可验证界限

证明循环图约束满足上限68%,归约为84顶点12正则图,最佳验证69.43%,提示存在性边界。

04:00
ArXiv AI

检测路由翻转比判断是否修复更容易:量化混合专家中的因果路由中介损伤

量化MoE中约31%损伤由路由翻转中介;检测翻转可行(AUC 0.772)但无法区分利弊,构成选择性修复的检测障碍。

04:00
ArXiv AI

从单体到模块化:段级自动提示优化

SAPO将提示分解为角色、上下文、任务和输出格式,基于优劣例段级优化,多个基准上取得最佳平均分。

04:00
ArXiv AI

LLMs在工艺流程图工程中的应用:从最优PFD到验证性P&ID

提出P&ID Pilot管道,混合遗传算法与LLM生成最优PFD,并用LLM代理转化为合规P&ID,实现全流程自动化。

04:00
ArXiv AI

MaSRead:复制潜在存储的内容寻址读取

内容寻址读取复制潜在存储,用标签和注意力掩码隔离干扰,图遍历支持多跳查询,解码只依赖片段长度。

04:00
ArXiv AI

利用智能体记忆为材料科学家构建终身AI伙伴

提出以持久记忆为核心的自进化记忆框架,将科学经验存为事实与技能,显著提升任务成功率并减少错误与开销。

04:00
ArXiv AI

面向长时程PDE预测的几何感知增量神经算子

提出几何感知增量神经算子,用低秩投影调控频谱耦合,均值波动解耦重建以稳定长时程PDE预测并保谱

04:00
ArXiv AI

用强化学习削减AI数据中心能耗:从单GPU到集群的大模型训练实测功率控制

强化学习控制大模型训练功率,实测违规减89.8%、能耗降26.2%,72B有效,16-GPU集群可行,可超订约2倍。

04:00
ArXiv AI

从外部视角看身份:AI人格克隆的概念框架与研究议程

AI人格克隆身份观:以不可分辨性为核心,分忠实度/类人性/个体性,长期看气候保真而非轨迹一致。

04:00
ArXiv AI

预测激活引导的副作用

构建67种行为交叉矩阵,发现激活引导副作用常见且结构化,幅度取决于目标行为,方向可从模型表示预测,实现主动安全审计。

04:00
ArXiv AI

VQ-bench:一个可组合的向量量化框架

向量量化近来成为AI基础设施核心,本文提出统一框架,用7个基础原语组合出25种量化器,并开源VQ-bench基准。

04:00
ArXiv AI

通过查询覆盖与声明可验证性实现查询无关的RAG评估

提出Q-CARE框架,无需参考答案,基于查询覆盖与声明可验证性细粒度评估RAG,相关性优于现有指标。

04:00
ArXiv AI

面向在线教育的可持续学习:一种强化学习方法

提出强化学习模型AI-Tutor,平衡新知与复习并维持动力,基于33700名学习者2300万条记录,优于基线。

04:00
ArXiv AI

支撑外障碍:为何语义安全约束不是学习问题不变量,以及这对先验设计、收容与验证的启示

语义安全约束是分布外对象,非学习不变量;应置于外部硬约束,形式验证可局部证成,自指场景仍难。

04:00
ArXiv AI

大型语言模型中的从众缓解措施位于单一“抵抗-接受”边界上

研究发现大模型从众缓解措施均落在单一抵抗-接受边界,除推理外,增强抵抗必损接受,唯有推理能同时提升两者。

04:00
ArXiv AI

AgonAlpha:通过提示经济与可扩展智能体搜索实现自主Alpha发现

AgonAlpha自主Alpha发现,融合工件搜索、对抗审查与预算分配,在BRAIN上表现优异。

04:00
ArXiv AI

EvoGraph-Mem:面向长期语言代理的故障感知可编辑图记忆

提出故障感知的可编辑图记忆框架,跟踪证据与激活状态,动态更新记忆图,提升长期语言代理性能。