9641 条条目 · 106 个活跃源
2026年10月1日
04:00
arXiv cs.CL

PADM'E:面向语言模型智能体评估器元评估的偏好对齐数据合成

提出PADM'E数据合成法,仅用小模型生成智能体元评估偏好数据,人评一致率从73%升至85%。

04:00
arXiv cs.CL

非洲语言的几何表征:区域语义枢纽与文化引导

Gemma 4 31B对非洲语言的几何表征与文化引导:非洲语言间表征较对照更一致,存在区域与语系模式,国家引导有效。

04:00
arXiv cs.CL

僧伽罗语连音拆分的字符级神经网络方法

首次为僧伽罗语连音拆分建立神经基准,字符级模型在复杂连音上仅达68.4%精确匹配。

04:00
arXiv cs.CL

在智能体强化学习中锁定关键决策以实现信用分配

ProVer定位关键决策片段,以续采样成功率差验证其优势并融入GRPO,在多任务上平均优于GRPO约7%–10%。

04:00
arXiv cs.CL

《Mnemon:原始记录、快速判断、慢速思考》

Mnemon将记忆分快慢两系统:原始记录留存,LLM慢规划检索、小模型快判断筛选,LoCoMo达92.2%,成本近恒定。

04:00
arXiv cs.CL

SCOUT:协同推理与工具使用,保障计算机使用安全

SCOUT是两阶段智能体安全验证器,融合任务专属评分标准生成与工具探测取证,显著提升计算机使用安全验证效果。

04:00
arXiv cs.CL

「纠正何时成为修复?」工具使用型LLM内部干预的机制审计

SAKIKO框架经目标端验证审计LLM内部干预,揭示位移不等于修复:净增益干预会破坏过半正确决策。

04:00
arXiv cs.CL

语言模型是“不安全”的报告者

模型默认报喜:关键负面结果披露率仅1%,加诚实指令后升至95%;诚实与求成功在表征空间方向相反。

04:00
arXiv cs.CL

FastGuide:加速扩散大语言模型的奖励引导

混合并行与自回归解码,复用奖励引导与KV缓存,使扩散语言模型奖励引导提速最高4.4倍且质量相当。

04:00
arXiv cs.CL

不同分词器生育率下跨语言的概念方向可靠性

情感方向可复现性跨语言差异显著,分类准确不代表方向一致,需独立评估;未证明分词粒度是成因。

04:00
arXiv cs.CL

校准到谁?JEV 文化价值观中的人格与语言效应

审计JEV文化价值观:无角色时偏美国,设沙特角色则部分复现人类差异(英语87%>阿拉伯语62%),各设计一致。

04:00
arXiv cs.CL

迷失在翻译中:衡量非母语英语对大型语言模型终端用户表现的影响

非母语英语使LLM回答质量更低;模型不复制拼写错误,但会模仿提示的修辞与词汇水平。

04:00
arXiv cs.CL

在学生状态下向教师续写学习

OLIVE:学生生成前缀、教师续写,用其token交叉熵更新学生,优于OPD且省23.8%时间。

04:00
arXiv cs.CL

CineSubBench:基于多语言电影字幕评估大语言模型的长篇叙事与文化理解能力

基于六语电影字幕的长上下文基准,评测大模型在叙事重构、类型预测、各国分级与文化安全等七项任务上的表现。

04:00
arXiv cs.CL

规范顺序问题:当大型语言模型作为多值关系知识库时为何不可靠

大模型按字母或时间等规范顺序组织多值关系,提示若违背此内部排序,生成完整实体集合的可靠性显著下降。

04:00
arXiv cs.CL

HeurEvo:面向时间关键型数学优化的混合求解器增强启发式智能体进化

HeurEvo协同进化规划、代码与组件,在严格时限内融合启发式与求解器,于组合优化和MIPLIB上匹配或超越先进方法。

04:00
arXiv cs.CL

群体保真度:评估大语言模型中的群体代表性

提出群体保真度框架,从群体准确度、组间差异量及结构三维度评估LLM群体代表性,并检验机器偏见与文化微调成效。

04:00
arXiv cs.CL

认知专家语言模型更好地与相应脑系统对齐

提示与微调构建六类认知专家大模型,其与对应脑系统对齐更强,且总体预测精度基本不变。

04:00
arXiv cs.CL

训练大语言模型表达评估意识

VT:用强化学习训练大模型更愿表达评估意识,表达量增2.4-2.9倍,潜在意识与行为大致不变。

04:00
arXiv cs.CL

DeepRewind:预测与修复深度研究智能体中的过早承诺

提出DeepRewind:以类型图追踪认知状态,预测并阻止高风险过早承诺,失效时回滚;过早承诺减少59.1%。

04:00
arXiv cs.CL

掩码扩散语言模型中的可靠并行解码

提出免训练方法RPD,按逐层预测稳定性与置信度筛选候选,并以累积熵预算提交,提升并行解码吞吐且保持准确率。

04:00
arXiv cs.CL

DraftTrace:面向AI融合写作的多视角分析环境

DraftTrace同步捕捉写作成品、过程与AI交互,提供多视角分析,可区分真实写作与复制粘贴。

04:00
arXiv cs.CL

检索对查询中身份信号的敏感性

稠密检索器对查询中政治倾向与方言信号敏感:结果偏向查询自身立场,非裔美国人英语提问检索效果更差。

04:00
arXiv cs.CL

当更新不再是学习:通过可学习的信息增益重新思考大语言模型自我进化

提出可学习信息增益度量自进化每轮新增信息,据此设计ATRI自适应调节训练,缓解性能退化。

04:00
arXiv cs.CL

大规模因子分析表明机器智能仅部分可解释

大规模因子分析显示,通用智能因子最多解释七成性能方差,相似基准未必聚簇,通用智能难成单一构念。

04:00
arXiv cs.CL

相似选择,不同注意:人类与视觉-语言模型中的跨模态关联

部分视觉语言模型选择对齐人类,但注意力不如中心基线;匹配选择或注视不等于人类对齐跨模态处理。

04:00
arXiv cs.CL

FinRT:将自适应红队策略蒸馏为消费金融领域可复用的对抗生成器

FinRT将自适应红队策略蒸馏为可复用对抗生成器,攻击成功率近翻倍,最大危害提升33%,同时保持多样性。

04:00
arXiv cs.CL

记忆巩固抹平用户事实的时间形态

记忆写入会不对称地抹去进行时等时态线索,使后续模型难以判断用户事实是否仍然成立。

04:00
arXiv cs.CL

《美丽心灵的永恒阳光:系统性抹除大语言模型的记忆》

LLM难以按要求遗忘信息;提出DeLLM框架,用溯源图识别需删除的消息,兼顾高删除率与实用性。

04:00
arXiv cs.CL

MemFold:通过在线策略优化学习面向长上下文个性化的紧凑软记忆

将文本记忆压缩为K个连续向量,用奖励与置信门控在线蒸馏优化读者行为,长上下文个性化性能领先。

04:00
arXiv cs.CL

为AI研究论文生成诱发修改的问题

对比GPT与人类评审:GPT能生成更多触发修改、涉及更广的问题,但有效比例较低。

04:00
arXiv cs.CL

哥德尔森林:平衡以数据为中心的递归自我改进中的搜索深度与广度

哥德尔森林以多智能体协同演化搜索树和共享记忆,兼顾深度与广度,显著提升以数据为中心的递归自我改进。

04:00
arXiv cs.CL

蒸馏关键内容:面向大语言模型的置信度感知选择性蒸馏

CaRE-KD按师生置信度自适应切换KL、抑制教师不确定更新,在11项基准上稳定提升。

04:00
arXiv cs.CL

ProgressCompass:具身进度奖励模型若无正确上下文便会迷失

长任务中PRM需上下文方能估计进度;提出ContextProgress-Bench与ProgressCompass,误差降63%。

04:00
arXiv cs.CL

有依据的修订 vs. 先验注入:探究检索增强的专利权利要求修改

专利权利要求修改中,7,385件USPTO案测四模型,未发现先验注入,检索效应小且方向不一致。

04:00
arXiv cs.CL

迷失于对话,还是迷失于转译?诊断 RAG 中的多轮退化

多轮使 RAG 相对性能下降达 21%、不可靠性增 47%,失败源于查询改写失真或跨轮证据整合失败。

04:00
arXiv cs.CL

LAURA:用于法律合同中可解释歧义条款识别的知识蒸馏

LAURA用知识蒸馏和IRAC反学习提示训练小模型,联合分类与理由生成,可解释识别法律合同歧义条款。

04:00
arXiv cs.CL

Video2Skill:从流式经验到可复用的具身技能

提出流式具身技能发现基准Video2Skill,评测模型定位分组复用/新建技能;模型难扩展技能库。

04:00
arXiv cs.CL

SEED:基于隐式编码器-解码器的自推测解码

SEED将模型视为隐式编码器-解码器,复用验证缓存表示快速起草,4B模型最高提速2.7倍且保持质量。

04:00
arXiv cs.CL

ATTUNER:通过查询侧适配实现免重计算的 KV 缓存复用

提出Attuner,用查询侧低秩适配让模型读懂冻结的KV缓存,免重计算即达全上下文预填充质量,提速3.73倍。

04:00
arXiv cs.CL

RAEGNet:面向危害感知多模态假新闻检测的关系感知证据图网络

提出事件级证据检索框架与关系感知证据图网络,融合新闻-证据立场及证据交互关系,联合建模真实性与危害性。

04:00
arXiv cs.CL

生成式AI时代下多模态假新闻检测的再思考

构建Weibo26数据集并提出GAHR框架,融合全局判断与局部校正,兼顾假新闻检测与生成内容识别。

04:00
arXiv cs.CL

MultiTalk:将全双工语音模型扩展至长时、多方、双语对话

发布57.6k小时中英多方全双工对话数据与基准,Moshi式模型长时多方双语对话超越开源基线。

04:00
arXiv cs.CL

BaLEEN:面向上下文感知语音识别的潜在编码实体偏置

BaLEEN以潜在编码实体实现免微调上下文偏置,即插即用,显著降低关键词漏检及识别错误率。

04:00
arXiv cs.CL

面向详细图像描述的动量耦合评分标准自适应

提出MoCo Rubric框架,单模型兼任描述、评分标准与评判,动量耦合更新,五基准平均胜率72.83%。

04:00
arXiv cs.CL

语言模型能学会预测股价吗?

后训练显著提升语言模型股价预测表现,并改变其信息调查与工具使用方式。

04:00
arXiv cs.CL

ER-JEPA:经验回放提升语言模型中的联合嵌入预测学习

为LLM-JEPA加入经验回放路径,存储并检索训练对以提供额外监督,多数据集实验证明其优于LLM-JEPA。

04:00
arXiv cs.CL

VAA-CSEC:基于投票引导优势分配的中文语义纠错

提出VAA-CSEC,融合思维链蒸馏、监督微调、强化学习与自一致性解码,投票引导优势分配,提升中文语义纠错。

04:00
arXiv cs.CL

伊比利亚语言自动语音识别工具基准评测

评测11个ASR系统于5种伊比利亚语言,发现精度、效率与语言覆盖难兼顾,低资源语言尤其巴斯克语明显退化。

04:00
arXiv cs.CL

为模型定日期:系统提示中的隐藏日期影响大语言模型评估

系统提示隐藏注入当日日期,令LLM评测随日期波动,最高14%并改变排名,威胁可复现性。