对齐的错觉:协作对话中隐藏分歧的检测
协作对话中“对齐错觉”指表面一致实则隐藏分歧。所训探针达51.8% F1,并提升多智能体协作表现。
FemWear:面向女性健康的专用可穿戴基础模型
FemWear用低秩适配器微调可穿戴模型,仅训练1.11%参数,提升经期预测8.15%,降低 cramps等症状误差,但未证明全面优势或临床有效性。
SuperLocalMemory 4.0:面向AI代理的受治理记忆操作系统
提出本地优先的AI代理记忆操作系统,融合多类检索与治理,支持权限控制、审计擦除与可靠写入,性能开销低。
通过结构化记忆缓解大语言模型中的过度个性化
按域划分记忆呈现,缓解大模型跨域泄漏和谄媚,不改变模型,保持效用,平均泄漏降8.8%。
通过轨迹投毒对自进化技能的仅查询后门攻击
提出轨迹后门攻击,仅靠查询诱导轨迹生成带后门技能,保持正常性能,揭示自进化系统的关键漏洞。
TRACE-Memory:面向个性化生成的条件化检索与效用感知证据准入
提出两阶段选择性个性化框架,仅当记忆超越公共响应效用时使用,经渐进训练,优于多种基线并支持按需个性化。
StructReward:高效结构化过程奖励用于多模态推理自纠正
提出结构化过程奖励框架,步骤级对齐生成密集信号,回收策略轨迹实现自纠正,无需额外验证器,高效提升多模态推理。
CAP:用于评估跨站点浏览器智能体复杂操作与感知能力的可扩展基准
提出CAP基准,含420个跨站任务,评估复杂UI交互与视觉感知;顶尖智能体成功率低,感知是主要瓶颈。
再花一个Token不值:高效深度研究智能体的边际价值估计
深度研究智能体中,剪枝位置比评分规则更重要;早期剪枝可省73%Token,质量损失小。
今时与往昔:大语言模型时间演化文档理解基准测试
提出TIDE基准,含3050问答对、644份孟加拉国海关文件,评估9个LLM,最佳68.5%;版本解析59.7%,拒绝无效版本仅26.7%。
智能体技能为何难以复用?来自138K个SKILL.md文件的证据
分析138K个技能文件,91.8%存在缺陷,路由元数据弱,复用受阻。
MCP中的LLM至关重要:衡量LLM导致的低效资源利用
研究表明LLM常忽略MCP指令内嵌数据,搜索工具存在时尤甚;需宿主机制调整推理优先级。
分层自我改进:面向任务特定可演化智能体外壳的框架
提出分层自我改进框架,让冻结大模型通过进化任务外壳提升中等难度任务表现,但受反馈保真度和模型能力限制。
HoloAegis:冻结表示与拓扑推理——零样本LLM护栏的最小参数安全流形
提出全息护盾框架,基于冻结表征与拓扑推理,零样本守护大模型,无需训练且延迟极低,精度领先。
Aero Realtime:面向低延迟流式多模态生成的完全对齐输入输出流
提出双工流式多模态模型,80ms槽完全对齐视音文,复用KV缓存,中位延迟84ms,实现低延迟交互。
利用质量多样性优化发现多模态具身代理的多样化规划策略
提出质量多样性框架,生成多样化规划策略,离线存档、在线回滚,提升多模态具身代理任务成功率与交互效率。
SDDBMs:软去噪扩散桥模型
提出软去噪扩散桥模型(SDDBMs),通过非退化高斯终端约束正则化扩散桥,避免端点奇异性,提升图像恢复稳定性与质量。
无法问责的委托与技能衰退:职场AI代理风险图谱
构建职场AI代理风险分类法,经大量任务验证,发现增强模式致技能衰退,错误行为风险最大,安全靠人机协作。
TaskSense:聚焦世界模型中的关键信息
TaskSense通过随机空间注意力和逆动力学目标,只重建任务相关区域,提升视觉干扰下的控制鲁棒性。
基于LLM符号化结构化过程的可解释无监督社区检测
提出LUCID方法,利用LLM将隐含知识转为显式规则,经四阶段流程实现免训练、可解释的无监督社区检测,性能领先现有基线。
ADIAS:交互式智能体系统的自动化设计
ADIAS提出以问题为中心的智能体自动化设计,用持久问题状态引导迭代修复,平均性能提升25.2%,移除机制后下降40.7%。
多模态大语言模型能否解码创意飞跃?引入跨概念理解基准C4
提出C4框架,用成语跨概念任务评估多模态大模型,最强准确率约五成,暴露创意解码不足。
TRACE:漂移与故障下人类-AI控制器协同的多层基准
构建多层协同漂移基准,包含近两千条五层轨迹,标注来源与时间,协议防泄漏,漂移可定位归因。
用于聚合物自动粗粒化分子动力学的多智能体框架
多智能体框架CGMas借助大语言模型自动完成聚合物粗粒化模拟,完成27项任务,22项密度误差低于5%,耗时降至1分钟。
门控BEPO:面向大语言模型智能体的置信门控贝尔曼信用分配
提出Gated-BEPO,用经验图与贝尔曼不动点估计步骤级信用,置信门控自适应融合,提升智能体性能。
基于大语言模型与潜力感知实例生成的并行算法组合进化
针对LLM自动构建算法组合泛化差的问题,提出潜力感知协同进化框架,无需参考解即可评估实例增益,用LLM生成多样变异器,显著提升TSP和CVRP性能。
从点到边:面向物理敏感PDE学习的边条件谱算子
提出边条件谱算子ESO,利用局部边变化调制谱混合,并引入物理感知重加权,在九个PDE基准上达最优。
ReGraph:从食物图像中学习生成食谱图
提出食谱图数据集与两阶段框架,提升多模态模型从食物图生成结构化流程,但成分状态捕捉仍难。
或许成交:情感在多智能体谈判中的作用
多智能体谈判中,愤怒买家几乎不成交,快乐买家成交率最高但价格更差,情感影响因角色而异。
中文标题:大语言模型中的评论界赞誉导向:来自电影偏好诱导的证据
中文摘要:大模型普遍偏好影评界赞誉但商业冷门的电影,且随模型规模增强;调整可见度和大众接受度后偏好反转,提示评价导向存在于部署中。
ReQuant:后训练量化的固定网格离散优化
ReQuant无需反向传播,在固定网格上迭代优化离散权重,通用提升各类PTQ精度,尤其低比特。
模态迁移:自主GIS智能体的先决条件
研究检验大语言多模态模型在图像与文本间传递空间信息的能力,发现现有模型(如OpenAI)在简单彩色网格再生任务中仍存在明显短板,凸显多模态对齐是关键瓶颈。
将分诊决策拆分给多个智能体,是掩盖偏见还是有助于发现偏见?审计容量约束下基于LLM的资源分配多智能体模拟研究
多智能体分诊未减少偏见发生,但审计容量决定偏见能否被发现:过载时漏检率升,按风险排序可缓解。
使用分块SVD寻找可用的权重机制
提出列分块SVD从线性位点提取机制基座(触发/写入/强度),在Gemma-2-2B上182/182验证通过。
CAi Copilot:通过意图驱动的智能体工作流降低分子设计中的操作负担
CAi Copilot将分子设计意图转化为可追踪工作流,45项任务得分84.59,领先18.07,降低操作负担。
FedLBW:无线网络非独立同分布数据联邦学习的基于损失的加权策略
提出FedLBW,用验证损失倒数加权客户端更新,提升非IID数据下联邦学习的精度、收敛速度和抗掉线鲁棒性。
MemOPD:基于记忆状态对齐的长时程智能体在线策略蒸馏
提出MemOPD,通过记忆状态对齐解决长时程智能体蒸馏偏差,F1提升416.2%,加速1.63倍。
并非所有问题都最适合建模为MILP:以DSL为中心的灵活准确优化建模框架
提出OptiDSL,用LLM将自然语言映射为DSL,解耦建模与求解;在44类组合优化上准确率提升51.66%,耗时降低91.71%,现有基准提升23.09%。
BONSAI:可进化性引导的技能树搜索
BONSAI用可进化性引导技能树搜索,超越基线和现有方法,显著提升冻结智能体准确率。
ZIPBrain:脑电基础模型能否更快、可本地部署且保持准确?
提出ZIPBrain,利用低信噪比合并冗余令牌,免训练即插即用,提速32.7%,精度提升1.3%-10.5%
DiDPO:面向代码智能体训练的Diff-in-Diff策略优化
提出DiDPO,基于代码差异结构的无评论家RL方法,实现细粒度信用分配,性能显著超越基线。
端到端智能体审计引擎
提出端到端智能体审计引擎A²E,基于ATP协议与多维指标系统评估智能体框架能力,揭示模型-框架组合性能差异。
TEPA:撤销过时记忆,赋予语言智能体冲突鲁棒性
TEPA提出可撤销记忆机制,将有效性设为显式状态,冲突时撤销过时记忆,显著提升鲁棒性。
QFCQT:面向波动时间序列预测的混沌门控Quantformer框架
提出QFCQT框架,融合量化编码器、振荡激活与混沌门控,有效提升波动时间序列预测精度。
人不仅由其国家定义:解析欧洲大语言模型价值对齐的社会决定因素
大语言模型对不同社会人口群体价值对齐不均,国家因素单独解释力与全部社会人口因素相当,且两者互补。
一图胜千言:视觉语言模型如何削减AI能耗并提升精度
视觉语言模型将时序数据编码为二维图,输入token减少3.6-10.4倍,推理能耗降1.8-2.5倍,精度反超文本模型与基线,为数值时序分析提供节能高精度方案。
CoBa:基于计算均衡路由的经济高效测试时扩展
CoBa均衡路由分配测试时算力——广泛廉价验证、重算高价值候选,以近半计算量达到同等或更高推理精度。
Muon训练Transformer中表示-读出接口处的Grokking后崩塌
Muon在模113加法grok后崩塌,根在表示-读出接口;冻结接口可避免,任务族完美却被对抗余项否决。
通过多阶段后训练渐进对齐推荐基础模型
提出LP-FFT-RFT三阶段渐进后训练框架,先适配任务再对齐业务指标,离线优于单阶段,线上A/B测试提升推荐质量。