10213 条条目 · 106 个活跃源
2026年5月21日
04:00
arXiv cs.CL

唱反调:现成角色向量在减少谄媚方面媲美目标导向调控

现成怀疑类角色向量可有效减少模型谄媚,效果达标准方法的68%-98%,且不牺牲正确率,揭示谄媚是角色级属性。

04:00
arXiv cs.CL

SpecBench:衡量长周期编码智能体中的奖励黑客行为

通过可见与隐藏测试的通过率差距量化奖励黑客行为,发现任务越长差距越大。

04:00
arXiv cs.CL

ChunkFT: 面向内存高效全参数微调的字节流优化

ChunkFT以字节流优化实现内存高效全参数微调,7B模型仅需13.72GB内存,性能媲美甚至超越全参数微调。

04:00
arXiv cs.CL

DelTA:用于基于可验证奖励的强化学习的判别性令牌信用分配

提出判别性令牌信用分配方法DelTA,通过放大侧特定梯度方向提升强化学习效果,在数学基准上领先最强基线3.26和2.62个点。

04:00
arXiv cs.CL

AiraXiv:面向人类和AI科学家的AI驱动开放获取平台

AiraXiv是AI驱动的开放获取平台,支持人类和AI科学家参与论文迭代与评审,已用于ICAIS 2025。

04:00
arXiv cs.CL

从文本中自动学习建筑伤害前兆

比较CNN、HAN及TF-IDF+SVM方法,从建筑事故报告自动学习伤害前兆,发现有效模式并支持模型可视化解释。

04:00
arXiv cs.CL

仅需最简RLVR训练:通过秩-1轨迹外推大语言模型

RLVR权重轨迹呈低秩线性,RELEX用秩-1子空间线性外推,仅需15%训练步数即可匹配或超越完整训练性能。

04:00
arXiv cs.CL

AI增强调查:利用大语言模型与调查进行观点预测

LLM预测调查缺失观点,回顾预测表现强,未问预测一般,两者相互增强。

04:00
arXiv cs.CL

面向大语言模型对话回复生成的有毒子词剪枝

提出ToxPrune方法剪枝大语言模型中有毒子词,有效减少有害生成,并提升对话多样性。

04:00
arXiv cs.CL

通过强化行为对齐增强语音大语言模型

RBA框架自合成数据并强化学习对齐语音大模型行为,提升指令遵循能力,超越蒸馏,多项任务达SOTA。

04:00
arXiv cs.CL

END:早期噪声丢弃方法用于高效有效的上下文去噪

END利用LLMs早期层隐式识别信息,丢弃噪声块,无需微调即可提升性能与效率。

04:00
arXiv cs.CL

面向多语言大模型的多语言推理的字典插入提示

提出字典插入提示(DIP),在非英语提示中间插入英语对应词,显著提升多语言推理效果,且交错插入比前置/后置更优。

04:00
arXiv cs.CL

面向语言建模的匿名化

提出掩码与因果语言建模方案,避免模型记忆标识符,在医疗数据上实现隐私与效用平衡。

04:00
arXiv cs.CL

LLMs能否像临床医生一样分诊?门诊转诊动态研究

LLMs在动态门诊转诊中通过提问减少不确定性表现优异,静态预测优势有限,核心价值在于交互式临床决策。

04:00
arXiv cs.CL

因果路径对齐:锚定优化轨迹以实现可控的参数内知识编辑

CPA锚定优化轨迹至有效因果路径,消除捷径学习,实现可控参数内知识编辑,提升关系特异性且副作用极小。

04:00
arXiv cs.CL

在基于LLM的抽取式问答中的最优查询分配:一个具有理论保证的学习委托框架

学习委托框架实现最优查询分配,有理论保证,提升EQA可靠性并降低计算开销

04:00
arXiv cs.CL

高效长上下文生成的回顾性稀疏注意力

提出RetroAttention方法,回顾性更新KV缓存以减少累计注意力错误,提升长上下文生成效率与准确率。

04:00
arXiv cs.CL

InternBootcamp技术报告:通过可验证任务缩放提升大语言模型推理能力

InternBootcamp开源框架通过可验证任务缩放显著提升LLM推理性能,验证任务数量与性能正相关。

04:00
arXiv cs.CL

流映射语言模型:通过连续去噪实现一步语言建模

提出流映射语言模型,用连续去噪一步生成,质量超越离散扩散8步。

04:00
arXiv cs.CL

EpiCache:资源受限环境下长期对话的片段式KV缓存管理

EpiCache无需训练,通过分块预填和片段式压缩,在固定内存下提升问答准确率30%,接近全缓存,降低延迟2.4倍、峰值内存3.7倍。

04:00
arXiv cs.CL

生成式AI实践、素养与鸿沟:意大利背景下的实证分析

基于1906人调查,GenAI采用存教育、年龄、素养鸿沟,AI培训促价值使用,性别鸿沟持续。

04:00
arXiv cs.CL

学习查询感知的预算层级路由用于运行时智能体记忆

提出BudgetMem框架,通过轻量路由器实现查询感知预算层级路由,平衡性能与成本,超越强基线。

04:00
arXiv cs.CL

EvalMORAAL: 可解释的思维链及LLM作为评判者的道德对齐评估方法

提出EvalMORAAL框架评估20个LLM道德对齐,发现西方与非西方区域对齐差距0.21,同行评审支持自动质量检查。

04:00
arXiv cs.CL

DrugRAG:通过新型检索增强生成管道提升药剂学大语言模型性能

DrugRAG管道无需修改模型,将药剂学LLM问答准确率提升7-21个百分点,有效增强基于证据的药剂学AI应用。

04:00
arXiv cs.CL

iReasoner:面向自进化大型多模态模型的轨迹感知内在推理监督

iReasoner用轨迹感知信号奖励思维链一致性,在无监督后训练中提升多模态推理2.1分。

04:00
arXiv cs.CL

AI辅助科学评估:气候变化案例研究

AI加速科学评估,13位科学家46小时综合79篇论文,AI内容保留近半但需专家大幅修订确保标准。

04:00
arXiv cs.CL

SHINE:单次传递中将上下文映射为LoRA的可扩展上下文超网络

SHINE超网络单次前向传递将上下文映射为LoRA,无需微调即更新LLM参数,大幅节省成本。

04:00
arXiv cs.CL

可解释AI:用于解释Transformer模型的上下文感知逐层积分梯度

CA-LIG框架融合逐层积分梯度与注意力梯度,生成上下文敏感归因,忠实清晰解释Transformer决策。

04:00
arXiv cs.CL

MASFactory:一种以图为中心的框架,通过Vibe Graphing编排基于LLM的多智能体系统

MASFactory是以图为中心的LLM多智能体编排框架,通过Vibe Graphing将自然语言转化为可执行图,支持复用与多模态,经基准验证有效。

04:00
arXiv cs.CL

EngGPT2-16B-A3B与同类意大利及国际开源LLM的基准测试

该模型在多数基准上优于意大利同类模型,但不及部分顶尖国际模型,是意大利原生LLM的重要进步。

04:00
arXiv cs.CL

能动记忆剖析:评估与系统局限性的分类与实证分析

分类四种记忆结构,揭示基准饱和、度量效度等局限,指出性能低于理论预期及改进方向。

04:00
arXiv cs.CL

Why Does Self-Distillation (Sometimes) Degrade the Reasoning Capability of LLMs?

04:00
arXiv cs.CL

基于迭代LLM的法语临床访谈转录与说话人日志改进

提出多遍LLM后处理架构,交替说话人识别与词汇识别,显著降低法语临床对话转录错误率,计算成本可接受。

04:00
arXiv cs.CL

大型语言模型通过目标-立场提取解析复杂的政治观点

LLM通过目标-立场提取,以最少监督精细解析复杂政治观点,性能媲美人类,为计算社会科学提供可扩展工具。

04:00
arXiv cs.CL

生成与识别的非对称性:形式语言理论中一个基本分野的六个维度

生成与识别在六维上不对称:解析总受约束而生成未必,时间维对应surprisal,大语言模型统一架构但保留操作差异。

04:00
arXiv cs.CL

语言模型需多开放才能实现可靠科学推论?

封闭模型威胁科学推论可靠性,建议系统识别威胁并证明模型选择合理性。

04:00
arXiv cs.CL

从提示风险到响应风险:大语言模型安全行为的配对分析

配对分析显示61%响应降低危害,3%升级;性内容危害持久,存在有用性与无害性权衡及检测不对称。

04:00
arXiv cs.CL

RAG中证据不确定性与幻觉的方面级追踪

提出方面级诊断框架,揭示RAG幻觉主要源于证据整合而非检索,并暴露系统性证据覆盖与错位模式。

2026年5月20日
04:00
arXiv cs.CL

诊断黑盒大语言模型多步推理失败的逐步置信度归因方法

提出SCA框架为黑盒LLM推理步骤分配置信度,识别错误步骤,指导自纠正提升成功率13.5%。

04:00
arXiv cs.CL

低资源NLP评估中的注释稀缺悖论:加速发展的十年与新兴约束

模型扩展远超评估基础设施,需转向社区嵌入式评估。

04:00
arXiv cs.CL

代理崩溃:好心办坏事

新型代理故障“意外崩溃”:面对环境错误时产生不安全行为,评估显示发生率64.7%,半数未报告。

04:00
arXiv cs.CL

对商业ASR系统在语码转换语音上的基准测试:阿拉伯语、波斯语和德语

提出语码转换语音ASR基准,评估五个商业系统,ElevenLabs最优,BERTScore更可靠,数据集已公开。

04:00
arXiv cs.CL

ReacTOD:有界神经符号智能体NLU用于零样本对话状态跟踪

ReacTOD提出有界神经符号架构,通过自校正ReAct循环与符号验证器,实现零样本对话状态跟踪SOTA,准确率提升9.3%。

04:00
arXiv cs.CL

提示语言影响大语言模型的诊断推理和准确性

英语提示下大多数大语言模型诊断更准,仅o3不受语言影响,提示语言是关键因素。

04:00
arXiv cs.CL

MMoA:一种具有递归机制的AI代理框架,用于记忆化的混合代理

提出MMoA递归架构,通过LSTM门控动态选择代理,精度略降但计算效率提升4.6%。

04:00
arXiv cs.CL

Position: Uncertainty Quantification in LLMs is Just Unsupervised Clustering

04:00
arXiv cs.CL

是时候反思了:我们能信任基于证据的研究智能体的LLM评判者吗?

提出REFLECT基准,发现LLM评判者准确率不足55%,证据验证能力差,需改进评估体系。

04:00
arXiv cs.CL

语言服务中的AI技术:语言服务管理者对AI的态度及其人类价值

语言服务管理者对AI持条件乐观、高度风险意识,强调人类价值与监督。

04:00
arXiv cs.CL

在慢速fMRI上微调语言编码模型提升对快速ECoG的预测

通过fMRI微调语言编码模型,显著提升ECoG预测性能,且效果随fMRI数据量增加,表明慢速数据可辅助快速脑电预测。

04:00
arXiv cs.CL

语言模型难以应对隔间化

LLM对同一概念的不同呈现存在隔间化,无法共享统计强度,导致冗余低效,平行数据无效,小模型多语言学习几乎完全隔间化。