多少思考才算够?量化与理解大语言模型推理中的冗余
发现LLM推理步骤冗余高达61%-93%,证明这是长度无关奖励的结构性结果,非模型缺陷。
探索开放性的要素:用大型视觉语言模型复现Picbreeder
用视觉语言模型复现Picbreeder,发现与人类驱动的差异,并探究噪声、多样性、记忆等因素的影响。
实现重构权威:自主智能体系统中的运行时构建、依赖解析与执行门控
提出运行时执行模型,通过动态依赖解析与恢复循环确保智能体仅在权威可构造时执行,保障安全与条件活性。
当正确信念崩溃:临床压力下LLMs的认知韧性
LLMs在临床压力下会放弃正确诊断,知识与鲁棒性分离;R-FT训练几乎消除信念变化。
BoxLitE:基于凸优化的忠实知识库嵌入
BoxLitE模型将知识库嵌入转化为凸优化问题,为DL-Lite^H提供弱忠实嵌入,保证可满足性。
通过自适应张量并行加速同步RLHF训练中的长尾生成
提出自适应TP方法PAT,动态重配置TP,预测引导与轻量重配置结合,减少生成延迟34.6%。
模糊、中智与不确定图论:性质与应用
本书系统综述不确定性图论,以不确定图框架统一模糊、中智等模型,涵盖扩展与应用。
残差漂移主导多轮约束推理中的矛盾
多轮推理错误主因是可满足漂移而非矛盾,修复后矛盾几乎消失但遗忘致漂移占98-100%。
LLM中介的普适系统中的权威反转:当模型信任用户而非传感器
LLM因格式依赖而信任用户语言胜于传感器数值(权威反转),几何校准可纠正,需显式审计。
DRIVE:持续学习下Web智能体的推理与交互技能建模
DRIVE将经验分离为推理与交互技能,通过场景感知协调和技能级反思,在WebArena上提升成功率7.3个百分点至52.8%。
MEMOR-E:面向阿尔茨海默病辅助机器人的上下文与微调大语言模型个性化
MEMOR-E机器人通过微调LLM和上下文学习生成阶段感知认知摘要,实现个性化辅助交互。
需求下的时空形成:情境实现与形式依赖概率
量子概率是固定时空投影下,由有限表示等需求驱动的时空形成,表现为非对易性和干涉。
Right-Sizing Communication and Recommendation Set Size in AI-Assisted Search
基于变换和语义等价的认知过程动力学框架
提出基于变换和语义等价的认知动力学,通过迭代反馈和不动点实现稳定语义解释,融合动力学、范畴论与认知建模。
超越预定义学习对象:一种面向自主机器人持续学习的思考-学习交互模型
提出思考-学习交互模型,使机器人自适应发现特征、扩展类别、更新模型与重构动作,显著提升性能。
智能体技能的形式化验证方法:迈向可机械检查的能力包含证明的三层架构
本文提出三层组合方法(静态分析、类型系统、模型检查),实现技能能力包含的形式化验证,开源可用。
低成本标签,可靠选择:面向作业车间调度的滚动校准超启发式
提出门控超启发式,利用后悔归一化滚动标签与不确定性估计,实现低成本标签下的可靠调度决策。
机器心理测量学:人工智能的数学心理学
提出机器心理测量学,通过测量层规避心智盲视与投射,用多维心智印记和信任协议评估非人类智能。
从准确性到可审计性:金融AI系统中的确定性综述
综述金融AI中三类模型的机械非确定性,量化可重复性漏洞,提出分层审计评估框架。
LGMT:基于逻辑的蜕变测试用于评估大语言模型推理可靠性
提出LGMT框架,利用逻辑等价性检测大模型推理缺陷,发现模型对符号变化敏感,评估须关注鲁棒性。
为什么AGI需要世界模型:大语言模型的失败之处以及世界模型如何超越
大语言模型因果推理与状态跟踪受限,含世界模型智能体胜率79%远超LLM的11%,表明序列预测难支持动态推理。
方程发现中的饱和缩放定律:三个玩具基底与两个真实世界复现中的增长动力学现象学
方程发现生长动力学呈基底条件性饱和幂律,短程近似纯幂律,架构敏感且跨基底不迁移。
向可信赖的自主AI迈进:安全性、鲁棒性、隐私与系统安全全面综述
聚焦自主AI系统的安全、鲁棒性、隐私与系统安全风险及缓解策略,提供评估指标与基准,指出开放挑战。
推理-想象-行动:基于世界模型的自动驾驶闭环大语言模型决策
RIA框架耦合LLM推理与动作条件世界模型在线安全验证,CARLA中路径完成率80.05%,碰撞率0.20%。
LC-ERD:通过一致性调节奖励分解挖掘潜在逻辑实现自我进化推理
LC-ERD框架通过潜在逻辑共识去噪和多智能体价值分解,解决自对齐三大挑战,实现鲁棒自我进化推理。
Palette:一种模块化、可控且高效的大语言模型按需授权安全对齐放松框架
Palette通过模块化轻量适配,按需放松专业领域安全限制,精准控制且不牺牲通用性。
多智能体强化学习何时能提升LLM工作流?工作流、规模与策略共享的权衡
多智能体RL提升LLM工作流依赖工作流、任务和规模;策略共享不保证稳定,而是改变失败模式,需根据场景权衡。
EPPC-OASIS:面向安全消息中电子医患沟通挖掘的本体感知适应与结构化推理优化
通过本体感知适应与结构化推理优化,在安全消息中提升医患沟通行为挖掘的预测F1分数,但需外部验证。
超越最终答案:多智能体工业工作流程中的轨迹级幻觉审计
提出Trajel框架及五类幻觉分类法,审计多智能体轨迹级幻觉,发现现有基准遗漏常见失败模式。
How Well Do Models Follow Their Constitutions?
走向生成认知的人工智能
提倡将生成认知融入AI,强调感知是主动、具身互动过程,强化学习有共鸣但不足,建议广泛融合。
中文标题:合成专利数据何时有用?低资源多标签分类中的数量-保真度权衡
中文摘要:低资源专利分类中,合成数据增益主要来自数量而非质量,最优混合比20-30%真实数据,保真度影响随规模反转。
中文标题:开放权重AI模型伦理使用约束的治理视界
中文摘要:开放权重AI模型的伦理约束披露治理在派生谱系中迅速衰减,7代后80%后代证据不足,需通过派生本身传播治理信号。
JT-SAFE-V2:具有世界背景数据的安全设计基础模型
JT-Safe-V2通过世界知识预训练与安全后训练实现通用智能与安全设计的联合优化,其Safe-MoMA框架降低推理成本超30%,性能领先。
Distilling Game Code World Model Generation into Lightweight Large Language Models
通过上下文学习推进图少样本学习
提出VISION模型,利用无监督任务生成和图上下文学习,实现无需微调的高效图少样本推断。
模型并非产品:本地优先心理辅导的双支柱架构
Psych LM通过本地模型与自动记忆库实现持久上下文,采用主动学习和检索增强架构,在移动端可靠实现心理辅导。
推理作为攻击面:针对大语言模型的自适应进化思维链越狱攻击
针对大型推理模型CoT安全风险,提出自适应进化框架AE-CoT,通过片段交叉变异和自适应突变率控制,有效生成有害输出,超越现有方法。
多智能体LLM决策系统中动态信用分配的市场状态委员会
MRC用Shapley值在线加权与贝叶斯自适应混合实现动态信用分配,在加密资产上获1.51夏普比率和440.1%回报,显著优于基线。
儿童与语言模型中的假设生成与归纳推理
通过盒子任务比较儿童与LLM的因果推断,发现两者行为相似但信息寻求成本不同。
DemoEvolve:利用演示克服智能体框架演化中的稀疏反馈
DemoEvolve通过人类演示引导框架演化,解决稀疏反馈问题,提升长时域随机环境下的性能和稳定性。
超声心动图特征与AI-ECG心衰预测的关联
研究分析8147例患者数据,发现AI-ECG预测心衰风险与整体纵向应变等收缩功能指标高度相关,并能捕捉保留射血分数患者的舒张异常。
HeartBeatAI:一种可解释且鲁棒的用于多标签心电图心律失常检测的深度学习框架
通过域泛化与多尺度特征聚合实现高F1分数,但跨机构罕见异常检测仍存挑战。
基于数学形态学的深度学习格论与代数模型
基于格论和数学形态学建立深度卷积网络代数框架,揭示标准CNN非幂等性,提出三种幂等开运算层。
用A*后训练学习高效推理
通过A*搜索指导大语言模型推理,采用监督微调和强化学习后训练,使小模型在准确率与效率间取得平衡,性能超越大模型。
Hera:为设备-云协作LLM智能体学习长期协调
Hera通过两阶段训练实现步骤级设备-云协调,在46.3%云步骤下达到92.5%云独享成功率,性能与成本均衡。
智能体作为同伴汇报者:一种基于视角精炼的定性分析多智能体框架
多智能体同伴汇报框架,通过三种分析视角精炼编码,使LLM定性分析结果更接近人类标注。
When Mean CE Fails: Median CE Can Better Track Language Model Quality
测量大语言模型推理质量:一个多维度行为框架
提出六维度行为框架评估LLM推理质量,揭示正确性之外的逻辑连贯性等独立信号,避免单一指标误导。
大语言模型中的情商在感知、认知和交互方面呈现碎片化
大模型情商非单一能力,分为认知、交互主导等三型,隐藏情绪识别是瓶颈,RLHF导致随机共情。