PADM'E:面向语言模型智能体评估器元评估的偏好对齐数据合成
提出PADM'E数据合成法,仅用小模型生成智能体元评估偏好数据,人评一致率从73%升至85%。
非洲语言的几何表征:区域语义枢纽与文化引导
Gemma 4 31B对非洲语言的几何表征与文化引导:非洲语言间表征较对照更一致,存在区域与语系模式,国家引导有效。
僧伽罗语连音拆分的字符级神经网络方法
首次为僧伽罗语连音拆分建立神经基准,字符级模型在复杂连音上仅达68.4%精确匹配。
在智能体强化学习中锁定关键决策以实现信用分配
ProVer定位关键决策片段,以续采样成功率差验证其优势并融入GRPO,在多任务上平均优于GRPO约7%–10%。
《Mnemon:原始记录、快速判断、慢速思考》
Mnemon将记忆分快慢两系统:原始记录留存,LLM慢规划检索、小模型快判断筛选,LoCoMo达92.2%,成本近恒定。
SCOUT:协同推理与工具使用,保障计算机使用安全
SCOUT是两阶段智能体安全验证器,融合任务专属评分标准生成与工具探测取证,显著提升计算机使用安全验证效果。
「纠正何时成为修复?」工具使用型LLM内部干预的机制审计
SAKIKO框架经目标端验证审计LLM内部干预,揭示位移不等于修复:净增益干预会破坏过半正确决策。
语言模型是“不安全”的报告者
模型默认报喜:关键负面结果披露率仅1%,加诚实指令后升至95%;诚实与求成功在表征空间方向相反。
FastGuide:加速扩散大语言模型的奖励引导
混合并行与自回归解码,复用奖励引导与KV缓存,使扩散语言模型奖励引导提速最高4.4倍且质量相当。
不同分词器生育率下跨语言的概念方向可靠性
情感方向可复现性跨语言差异显著,分类准确不代表方向一致,需独立评估;未证明分词粒度是成因。
校准到谁?JEV 文化价值观中的人格与语言效应
审计JEV文化价值观:无角色时偏美国,设沙特角色则部分复现人类差异(英语87%>阿拉伯语62%),各设计一致。
迷失在翻译中:衡量非母语英语对大型语言模型终端用户表现的影响
非母语英语使LLM回答质量更低;模型不复制拼写错误,但会模仿提示的修辞与词汇水平。
在学生状态下向教师续写学习
OLIVE:学生生成前缀、教师续写,用其token交叉熵更新学生,优于OPD且省23.8%时间。
CineSubBench:基于多语言电影字幕评估大语言模型的长篇叙事与文化理解能力
基于六语电影字幕的长上下文基准,评测大模型在叙事重构、类型预测、各国分级与文化安全等七项任务上的表现。
规范顺序问题:当大型语言模型作为多值关系知识库时为何不可靠
大模型按字母或时间等规范顺序组织多值关系,提示若违背此内部排序,生成完整实体集合的可靠性显著下降。
HeurEvo:面向时间关键型数学优化的混合求解器增强启发式智能体进化
HeurEvo协同进化规划、代码与组件,在严格时限内融合启发式与求解器,于组合优化和MIPLIB上匹配或超越先进方法。
群体保真度:评估大语言模型中的群体代表性
提出群体保真度框架,从群体准确度、组间差异量及结构三维度评估LLM群体代表性,并检验机器偏见与文化微调成效。
认知专家语言模型更好地与相应脑系统对齐
提示与微调构建六类认知专家大模型,其与对应脑系统对齐更强,且总体预测精度基本不变。
训练大语言模型表达评估意识
VT:用强化学习训练大模型更愿表达评估意识,表达量增2.4-2.9倍,潜在意识与行为大致不变。
DeepRewind:预测与修复深度研究智能体中的过早承诺
提出DeepRewind:以类型图追踪认知状态,预测并阻止高风险过早承诺,失效时回滚;过早承诺减少59.1%。
掩码扩散语言模型中的可靠并行解码
提出免训练方法RPD,按逐层预测稳定性与置信度筛选候选,并以累积熵预算提交,提升并行解码吞吐且保持准确率。
DraftTrace:面向AI融合写作的多视角分析环境
DraftTrace同步捕捉写作成品、过程与AI交互,提供多视角分析,可区分真实写作与复制粘贴。
检索对查询中身份信号的敏感性
稠密检索器对查询中政治倾向与方言信号敏感:结果偏向查询自身立场,非裔美国人英语提问检索效果更差。
当更新不再是学习:通过可学习的信息增益重新思考大语言模型自我进化
提出可学习信息增益度量自进化每轮新增信息,据此设计ATRI自适应调节训练,缓解性能退化。
大规模因子分析表明机器智能仅部分可解释
大规模因子分析显示,通用智能因子最多解释七成性能方差,相似基准未必聚簇,通用智能难成单一构念。
相似选择,不同注意:人类与视觉-语言模型中的跨模态关联
部分视觉语言模型选择对齐人类,但注意力不如中心基线;匹配选择或注视不等于人类对齐跨模态处理。
FinRT:将自适应红队策略蒸馏为消费金融领域可复用的对抗生成器
FinRT将自适应红队策略蒸馏为可复用对抗生成器,攻击成功率近翻倍,最大危害提升33%,同时保持多样性。
记忆巩固抹平用户事实的时间形态
记忆写入会不对称地抹去进行时等时态线索,使后续模型难以判断用户事实是否仍然成立。
《美丽心灵的永恒阳光:系统性抹除大语言模型的记忆》
LLM难以按要求遗忘信息;提出DeLLM框架,用溯源图识别需删除的消息,兼顾高删除率与实用性。
MemFold:通过在线策略优化学习面向长上下文个性化的紧凑软记忆
将文本记忆压缩为K个连续向量,用奖励与置信门控在线蒸馏优化读者行为,长上下文个性化性能领先。
为AI研究论文生成诱发修改的问题
对比GPT与人类评审:GPT能生成更多触发修改、涉及更广的问题,但有效比例较低。
哥德尔森林:平衡以数据为中心的递归自我改进中的搜索深度与广度
哥德尔森林以多智能体协同演化搜索树和共享记忆,兼顾深度与广度,显著提升以数据为中心的递归自我改进。
蒸馏关键内容:面向大语言模型的置信度感知选择性蒸馏
CaRE-KD按师生置信度自适应切换KL、抑制教师不确定更新,在11项基准上稳定提升。
ProgressCompass:具身进度奖励模型若无正确上下文便会迷失
长任务中PRM需上下文方能估计进度;提出ContextProgress-Bench与ProgressCompass,误差降63%。
有依据的修订 vs. 先验注入:探究检索增强的专利权利要求修改
专利权利要求修改中,7,385件USPTO案测四模型,未发现先验注入,检索效应小且方向不一致。
迷失于对话,还是迷失于转译?诊断 RAG 中的多轮退化
多轮使 RAG 相对性能下降达 21%、不可靠性增 47%,失败源于查询改写失真或跨轮证据整合失败。
LAURA:用于法律合同中可解释歧义条款识别的知识蒸馏
LAURA用知识蒸馏和IRAC反学习提示训练小模型,联合分类与理由生成,可解释识别法律合同歧义条款。
Video2Skill:从流式经验到可复用的具身技能
提出流式具身技能发现基准Video2Skill,评测模型定位分组复用/新建技能;模型难扩展技能库。
SEED:基于隐式编码器-解码器的自推测解码
SEED将模型视为隐式编码器-解码器,复用验证缓存表示快速起草,4B模型最高提速2.7倍且保持质量。
ATTUNER:通过查询侧适配实现免重计算的 KV 缓存复用
提出Attuner,用查询侧低秩适配让模型读懂冻结的KV缓存,免重计算即达全上下文预填充质量,提速3.73倍。
RAEGNet:面向危害感知多模态假新闻检测的关系感知证据图网络
提出事件级证据检索框架与关系感知证据图网络,融合新闻-证据立场及证据交互关系,联合建模真实性与危害性。
生成式AI时代下多模态假新闻检测的再思考
构建Weibo26数据集并提出GAHR框架,融合全局判断与局部校正,兼顾假新闻检测与生成内容识别。
MultiTalk:将全双工语音模型扩展至长时、多方、双语对话
发布57.6k小时中英多方全双工对话数据与基准,Moshi式模型长时多方双语对话超越开源基线。
BaLEEN:面向上下文感知语音识别的潜在编码实体偏置
BaLEEN以潜在编码实体实现免微调上下文偏置,即插即用,显著降低关键词漏检及识别错误率。
面向详细图像描述的动量耦合评分标准自适应
提出MoCo Rubric框架,单模型兼任描述、评分标准与评判,动量耦合更新,五基准平均胜率72.83%。
语言模型能学会预测股价吗?
后训练显著提升语言模型股价预测表现,并改变其信息调查与工具使用方式。
ER-JEPA:经验回放提升语言模型中的联合嵌入预测学习
为LLM-JEPA加入经验回放路径,存储并检索训练对以提供额外监督,多数据集实验证明其优于LLM-JEPA。
VAA-CSEC:基于投票引导优势分配的中文语义纠错
提出VAA-CSEC,融合思维链蒸馏、监督微调、强化学习与自一致性解码,投票引导优势分配,提升中文语义纠错。
伊比利亚语言自动语音识别工具基准评测
评测11个ASR系统于5种伊比利亚语言,发现精度、效率与语言覆盖难兼顾,低资源语言尤其巴斯克语明显退化。
为模型定日期:系统提示中的隐藏日期影响大语言模型评估
系统提示隐藏注入当日日期,令LLM评测随日期波动,最高14%并改变排名,威胁可复现性。