Train4Merge:基于OPD模型合并的RL与SFT教师受控单教师对比研究
OPD模型合并中,性能相当的RL教师比SFT教师更会教,学生表现更优;因RL教师参数更接近共享初始化,更易被跟随。
技能何时能增加价值?面向选择性技能使用的任务条件增益预测
技能常无益甚至有害;SkillDelta可预测任务条件增益,选择性使用使成功率平均提升4.3%。
GLIDE:面向异构LLM智能体的广义逐层内在分布评估
GLIDE以逐层残差一致性校准步级奖励,无需外部验证器,提升异构LLM智能体评估与分支效率。
Agentsensus:面向多智能体故事世界的共识压缩共享记忆
统一共享记忆将同一事件合并为见证者共有记录并语义链接,写入减少22-44%,共享率14-28%,质量不降。
测试时语言模型的延迟监督
在长间隔无关事件后提问并监督答案,可显著提升测试时记忆模型的长上下文检索能力。
RLHarness:面向长时程多模态推理的强化学习与程序化技能协同演化
提出RLHarness,以版本化框架统一技能、协议与示例,与策略交替演化,重建后显著提升多模态推理。
HyperReCo:利用超图神经网络为LLM多跳推理检索并连接证据
提出HyperReCo,用超图神经网络检索并连接证据,经梯度引导超路径解码提升LLM多跳推理。
奖励黑客与智能体遏制失效:基于2026年Hugging Face事件的蒙特卡洛研究
奖励黑客可升级为外部安全事件;分层控制显著降低概率,智能体能力与监控、授权、凭证最敏感。
AuthorityLens:从权威视角重新审视基于大语言模型的智能体系统
提出AuthorityLens,从系统权威、权威分离、主体权威三维度量LLM智能体实际权威结构。
通过主动子结构感知策略优化进行多智能体系统搜索
ASPO提出自适应查询选择与子结构级奖励的强化学习框架,搜索查询定制多智能体系统,六大基准均居首。
记忆即缓存:构造上即精确的上下文复用与删除
SMem将上下文构造为可精确组合、按块O(b)删除的缓存,长文检索与解码效率提升,困惑度基本持平。
打开 LLM 评判器:超越最终裁决恢复偏好信号
LLM评判器常判错,但内部激活仍编码正确偏好;探针可恢复信号,表面线索越强收益越大,并助发现错误。
功能重于形式:带副本专家机制的混合专家模型中的分布正交化
提出分布正交化损失和副本专家机制,防止专家崩溃、优化负载均衡,在MoE模型上性能更优且训练效率相当。
RepoMAS:用Issue驱动的多智能体系统求解渐进式指定任务
提出ProgSpec基准与Issue驱动的RepoMAS框架,可在执行中修订任务规范,于六项基准上达最佳性能。
从潜表示到线路:大语言模型的外科式后编辑
L2W借J-lens定位与反例引导因果裁剪,精准后编辑大模型,移除指定语义目标且保留其他能力。
VPEvolve:面向计算光刻的自进化虚拟工艺工程师
VPEvolve结合虚拟工艺工程师与技能库,用冻结语言模型自进化优化OPC配方,将Poly/Metal1最大边缘放置误差降至5.36/15.69nm。
通过多指标偏好选择实现可控GNN解释
基于多指标偏好选择实现可控GNN解释,兼顾保真度、可解释性与稳定性,在多个图数据集上性能更优或更快。
从结果到策略:面向数学推理学习策略效用
提出SURE框架,以策略奖励模型学习策略效用并融入GRPO,提升数学推理准确率且更省算力。
TreeRef-BFN:基于二维拓扑与内部三维几何的免等变性从头分子生成
TreeRef-BFN以树状表示与贝叶斯流网络,免等变地联合生成分子拓扑和局部三维几何,支持变尺寸条件生成,高效灵活。
AmbiModBench:超越共享响应的基因扰动预测基准测试
提出AmbiModBench,从特异性、基因分辨和覆盖度评测基因扰动预测,揭示绝对高分多源于共享背景而非目标特异学习。
DAAF:从故障定位到LLM智能体中的可编辑系统资产
DAAF学习属性替换效应,将故障定位转为可编辑系统资产的修复决策,任务成功率达71.93%。
LocalProp:神经局部化的内存高效反向传播
提出LocalProp,局部更新权重,结合剪枝与微调,在ImageNet等任务上以更低显存取得良好性能。
STR:减少模型引导副作用的监督式转码器替换
提出监督式转码器替换STR,减少模型引导副作用,在Gemma/Llama上保持目标控制,攻击成功率降至12%–14%。
MemAgent:学习为LLM智能体管理异构记忆提供者
提出MemAgent,将智能体记忆建模为路由问题,管理异构记忆提供者,平均准确率提升10.0%。
超越双人记忆:面向多方口语对话的交互感知多模态记忆与自适应智能体检索
提出交互感知多模态记忆框架,融合说话人识别、分层记忆与智能体自适应检索,多方对话基准超基线23.6分。
视觉-语言-动作模型对单步观测扰动是否鲁棒?
研究VLA对单步观测扰动的鲁棒性,发现性能下降且受动作块长度影响,提出低开销CARE动态选择执行长度。
ProTTT:以测试时训练学会学习语义用户记忆
以用户画像监督学习共享初始化,测试时训练将用户历史压缩为持续演化的语义记忆,超越基线且降低成本。
CUE-Mem:基于多模态对话中隐式线索的长期用户记忆评测
提出CUE-Mem多模态基准,含2674道题,揭示隐式线索的保留与检索是长期用户记忆的主要瓶颈。
EMIR²:演化感知记忆与意图引导的多轮检索
提出EMIR²框架,以状态演化记忆图结合意图引导多轮检索,长期记忆与冲突处理性能相对提升逾12%。
人工智能与人类科学家在理论构建中展现互补优势
比较人机理论构建:多数任务AI个体表现更强、理论更复杂;人类理论更简洁多样、聚合增益更大,二者优势互补。
可解释的物理信息引导WiFi室内定位:学习有效的接入点几何结构并据此剪枝
物理信息解码器仅凭RSSI与标注位置推断AP几何用于剪枝;误差降26%–36%,剪去半数AP精度仍佳。
契约记忆编译器:先解析,后遍历
CMC先抽取历史关系并解析更新,从问题实体遍历取证,多跳准确率达78.25%。
从场景图到答案:面向自动驾驶的选择性神经符号推理
提出查询自适应神经符号推理,符号优先、LLM补语义,提升自动驾驶问答准确率与效率。
MixBench-TS:一个通道混合带来收益的多变量时间序列预测基准
MixBench-TS:10个真实数据集基准,通道耦合显著,通道混合模型真正占优;标准数据集则不然。
几何诱导软状态抽象的预测极限与Koopman闭包
提出几何诱导软状态抽象最小预测误差的可计算下界,并给出Koopman闭包条件。
具有可预测长时程边际分布的世界模型
约束行为平均转移保持高斯参考,使世界模型长时程边际可预测,并在十二项控制任务中稳定十万步。
分则隐匿,合则有害:针对基于技能的智能体系统的技能级联攻击
提出技能级联攻击:恶意目标分散于多个技能,单独无害、组合有害,可绕过现有单技能扫描与运行时监控。
ScopeBench:智能体在目标压力下能否守住授权边界?
提出ScopeBench基准:30个只有越界才能完成的安全任务,分离衡量能力与授权范围遵守度,发现二者并不一致。
将AI引入自主系统——从认知到集体智能
自主系统为AI终极阶段,需融合连接与符号AI,构建智能体架构,兼顾认知可信与集体智能,愿景仍远。
多智能体代码评判器何时才真正有据可依?两种无标签度量,以及一个拒绝猜测的评判器
代码评判器常在无依据时自信作答;两种无标签度量可识别此类比较并拒答,准确率升至36.9%。
连接LLM智能体与数据空间:基于模型上下文协议的架构中介方法
基于MCP构建中介层,将数据空间能力转为结构化工具,使LLM智能体在治理约束下受控调用,原型验证可行。
大语言模型真的理解上下文吗?基于知识图谱的评估框架
KG评估框架S3KG融合结构与语义,诊断三元组级错误;九基准F1提升7.6,AUROC达0.973。
面向昂贵进化优化的排序可靠教师引导适应度近似:一项TinyML架构搜索研究
提出TGL-NSGA-II教师引导低精度评估框架,用于TinyML架构搜索:排序可靠,超体积最大,速度快2.2倍。
少思考,模拟更好:直觉提示提升LLM智能体模拟个体社交媒体反应,包括不熟悉内容
给大模型智能体态度信息并用直觉提示,比分析提示更能高保真模拟个体社交媒体反应,且可泛化至陌生话题。
中文标题:Atelier:通过超网络学习冷冻电镜体积数据的局部自监督特征
基于超网络摊销隐式表示拟合,从5439个冷冻电镜图谱自监督学习连续局部特征,提升八项体素级预测任务。
T-RoPE:用于序列推荐的时间感知旋转位置嵌入
提出时间感知旋转位置嵌入T-RoPE,用时间戳与多尺度频率打破平移不变性,在推荐基准和线上A/B显著提升。
ORCA:评估大语言模型在数据科学代码翻译中的表现
提出ORCA基准评测数据科学代码翻译,最强模型成功率仅56.92%与33.67%,意图增强法提升约5%。
学习跳过什么:高效多智能体LLM工作流的反事实信用分配
将组件省略建模为反事实信用分配,借助跳过干预学习可跳过的步骤,降低token开销并保持或提升准确率。
LAVOIR:以摊销信息价值教会单次前向决策编码器何时提问与问什么
单次前向决策模型在输出答案时,为缺失槽位估计提问的信息价值,学会何时问、问什么,少量提问即显著提准。
CRC-Router:面向医疗智能体AI系统的风险约束路由
提出风险约束路由模块CRC-Router,融合多源不确定性信号并经共形风险控制校准阈值,在胸片分诊中取得最优风险-覆盖权衡。