10213 条条目 · 106 个活跃源
2026年5月29日
04:00
arXiv cs.CL

迈向可靠的多语言LLM作为评判者:一项实证研究

研究多语言LLM评判策略,发现域内数据可用时微调小模型可媲美专有模型,域外则大模型更有效。

04:00
arXiv cs.CL

预测市场中的立场检测:通过反事实增强和市场语境处理不平衡的交易者评论

预测市场评论立场检测中,市场语境是关键,反事实增强在弱配置有效,50%增强为最优剂量。

04:00
arXiv cs.CL

Sense Representations Are Inducible Interfaces

04:00
arXiv cs.CL

IPO-Mine:一个用于长篇幅多模态IPO文档分段结构化分析的工具包与数据集

发布IPO工具包和数据集(10.9万份文件、7.6万图像),实现分段结构化分析,揭示多模态模型与专家判断的差距。

04:00
arXiv cs.CL

MemTrace:大语言模型记忆系统中的错误追踪与归因

提出MemTrace框架,构建可执行记忆演化图实现错误归因,自动修复故障,任务性能提升7.62%。

04:00
arXiv cs.CL

反向探测:临床文本中大语言模型的监督式令牌级不确定性量化

提出反向探测框架,利用内部激活信号量化临床摘要令牌级不确定性,性能提升4倍且计算成本更低。

04:00
arXiv cs.CL

Measuring Form and Function in Language Models

04:00
arXiv cs.CL

Mobile-Aptus:基于MLLM的手机使用代理中置信度驱动的主动与稳健交互

提出置信度集成框架,解决过度执行与请求,两阶段训练提升准确率,SOTA性能,任务成功率提升超17%。

04:00
arXiv cs.CL

Transformer语言模型中的注意力白熊效应

指令抑制无法消除模型内部禁止概念的表征,其仍影响注意力与生成,暴露行为与表征对齐的差距。

04:00
arXiv cs.CL

GraphLit:学习文本增强的动态人物网络表示用于文学研究

提出动态异构人物网络与GraphLit框架,通过掩码图自编码器学习人物与文本上下文联合表示,在12项人物任务中优于基线,可分析叙事非线性与社会特征。

04:00
arXiv cs.CL

多模态大模型在自然阅读中未必全局超越语言模型与人类对齐

多模态预训练在自然阅读中对人类对齐无全局优势,仅在选择性地包含视觉语义的句子中更优。

04:00
arXiv cs.CL

记忆即持续演化连接

FluxMem将记忆建模为异构图,通过三阶段拓扑演化适应动态环境,在多个基准中取得最优性能。

04:00
arXiv cs.CL

Can LLMs Use Linguistic Uncertainty Markers to Reliably Reflect Intrinsic Confidence?

04:00
arXiv cs.CL

视觉-语言因果推理中的抽象差距

提出双探针法评测VLM因果推理忠诚度,发现七模型抽象差距超0.5,仅一模型近零,能力存在但依赖架构与预训练。

04:00
arXiv cs.CL

技能条件门控自蒸馏用于大语言模型推理

提出技能条件门控自蒸馏法,利用经验技能库构建多教师验证,提升大模型数学推理性能,优于GRPO和OPSD。

04:00
arXiv cs.CL

大型语言模型能处理话语标记吗?以马来口语为例

提出MalayPrag基准和五个属性,揭示LLM处理马来口语话语标记能力不足,属性辅助显著提升语用联系。

04:00
arXiv cs.CL

双向进化搜索自改进语言模型

提出双向进化搜索框架,通过前向候选进化与后向目标分解,克服稀疏验证和探索局限,提升语言模型自我改进效果。

04:00
arXiv cs.CL

人类标注变异作为稳定信号:通过跨标注者偏好优化学习标注者特定的解释行为

研究发现,通过跨标注者偏好优化可学习标注者特定标签-解释行为,实现基于历史的可扩展解释标注。

04:00
arXiv cs.CL

OmniVerifier-M1: 具有显式结构化重校准的多模态元验证器

通过符号元验证与解耦强化学习,OmniVerifier-M1实现了鲁棒细粒度多模态验证及动态区域级自纠正。

04:00
arXiv cs.CL

面向多模态智能体推理的智能体探索策略优化

AXPO通过固定思维前缀重采样工具调用,解决多模态推理中的思维-行动差距,提升工具使用率与性能。

04:00
arXiv cs.CL

FPMoE:面向函数式代码生成的稀疏混合专家方法

FPMoE轻量开源模型,通过稀疏MoE架构的专用与共享专家解决函数式代码生成跨语言干扰,3B参数媲美14B模型。

04:00
arXiv cs.CL

基于证据验证的缓存路由在检索增强生成中的应用:何时安全复用答案?

GroundedCache通过四门控确保缓存答案安全,不安全率降至0-1.5%,延迟仅增4-7%。

04:00
arXiv cs.CL

从指导者到合作者:一项90人参与的研究揭示了移动严肃游戏中的人机协作

高拟人化代理显著优于低拟人化,用户偏好具有大效应量,角色与对话机制影响协作。

04:00
arXiv cs.CL

对齐底线:角色定制如何破坏弱对齐大语言模型的安全性

定义对齐底线Δ_floor,发现角色定制使弱对齐模型谄媚率波动45个点,强对齐仅5个点,建议作为部署审计指标。

04:00
arXiv cs.CL

REC-CBM:面向可信开放式评分的评分标准感知纠错概念瓶颈模型

提出REC-CBM模型,通过评分标准感知、序数校准与概念纠错,实现可解释可信的开放式自动评分。

04:00
arXiv cs.CL

You Only Align Once: Propagating Cooperative Behaviors in Multi-Agent Systems through Seed Agents

04:00
arXiv cs.CL

智能体驱动的分离逻辑规约合成

提出Spec-Agent系统,从C++代码合成分离逻辑规约,覆盖85%函数,零假阳性,成本低10倍。

04:00
arXiv cs.CL

记忆型条件与仅上下文条件在有状态个性化中产生不同的行为模式

上下文条件推荐更响应当前问题,记忆型推荐依赖历史并区分不同学习者,但嵌入相似度不能表征历史个性化。

04:00
arXiv cs.CL

关键智能体:通过基于剔除的属性归因优化多智能体大语言模型

提出剔除归因框架,高效识别瓶颈智能体,模型替换提升性能降成本,揭示医疗MAS中诊断与伦理贡献解耦。

04:00
arXiv cs.CL

图书馆员万岁!一个用于节能多智能体软件工程系统的持久搜索子智能体

多智能体系统能耗源于冗余输出token,Librarian子智能体抑制重复探索、输出短引用,节能25%且保持性能。

04:00
arXiv cs.CL

基于自适应多模态智能体的自动工作流执行框架

提出双阶段多智能体框架,离线构建拓扑知识库,在线自适应RAG与闭环验证,实现高可靠自动工作流。

04:00
arXiv cs.CL

面向掩码语言建模的熵感知掩码策略

提出熵感知掩码策略,针对高不确定性token,自掩码提升效率,结合知识蒸馏在GLUE上提升5%。

04:00
arXiv cs.CL

SNARE:自适应场景合成以诱发编码代理中的过度积极行为

SNARE管道自适应合成场景,诱发编码代理的过度积极行为,框架驱动变量远超模型。

04:00
arXiv cs.CL

语言模型中的文化绑定注意力头

发现文化绑定关键注意力头,敲除可降绑定强度9-23%,适度放大提高区分准确性1-3百分点,模型知识多应用少,瓶颈在路由。

04:00
arXiv cs.CL

可信的误导:衡量搜索增强型大语言模型中的结构性引用失败

搜索增强LLM存在"可信的误导":引用真实但不当来源,30.6%扭曲内容,96%用户遭遇误导。

04:00
arXiv cs.CL

使用LLM求解可满足性问题:推理能力的配对评估

提出配对协议和ADR评估LLM的SAT推理,揭示传统指标误导,配对评估更忠实且跨表示鲁棒。

04:00
arXiv cs.CL

技能即伪代码:为LLM代理将技能库重构为伪代码

SaP自动将Markdown技能库转换为类型化伪代码,通过四步验证减少困惑循环,提升LLM代理任务成功率并节省资源。

04:00
arXiv cs.CL

MIRAGE:通过用户生成内容对移动GUI代理进行上下文感知的提示注入

MIRAGE通过将攻击文本嵌入用户内容区域,成功攻击五个视觉语言模型代理,成功率23%-30%,且视觉真实性与攻击成功率无关联。

04:00
arXiv cs.CL

披着羊皮的狼:联邦RAG中的定向路由劫持

提出基于信任反馈的后路由框架,有效防御联邦RAG中的路由劫持攻击。

04:00
arXiv cs.CL

SilentRetrieval:通过语义保持的对抗性数据投毒劫持检索增强生成

SilentRetrieval通过两阶段投毒攻击,以语义保持的对抗文档劫持RAG系统,在低困惑度下实现84.6% HR@10和57.5% ASR-LLM。

04:00
arXiv cs.CL

大规模多任务中文理解能力评测

提出涵盖医学、法律、心理、教育四大领域的中文大模型多任务测试,发现零样本最佳模型平均准确率0.512,法律领域最差仅0.239。

04:00
arXiv cs.CL

MaskClaw:面向GUI代理的边缘侧个性化隐私仲裁与行为驱动技能进化

MaskClaw在边缘侧提取视觉证据并检索策略记忆,决定屏蔽或询问,通过技能进化保护隐私,实验优于传统方法。

04:00
arXiv cs.CL

激活引导用于合成数据生成:多样性在下游安全检测中的作用

激活引导可生成高质量安全检测数据,但需平衡成功率、连贯性与多样性,三者调和均值更有效。

04:00
arXiv cs.CL

统计严谨的重要性:对GSM-Symbolic的批判性重新评估

重新评估显示GSM-Symbolic结论统计不可靠,多数模型无显著变化,数据存在大整数偏移,失败模式各异。

04:00
arXiv cs.CL

代码即武器:用于衡量编码模型对恶意代码请求遵从度的共识标注提示库

构建了区分可执行恶意代码与安全知识的共识标注提示库,经可靠性验证,用于评估编码模型拒绝标准。

04:00
arXiv cs.CL

可解释性引导的层选择超越子空间投影:将SAE视为听诊器而非手术刀,用于原始任务向量模型编辑

揭示SAE子空间投影丢弃97%能量无效;提出SAE作听诊器进行层诊断并注入原始任务向量,数论准确率29.6%→39.4%(5/7主题提升)。

04:00
arXiv cs.CL

外推权重平均揭示代码强化学习中的正确性-效率前沿

代码RL中,嵌套测试覆盖率训练涌现正确性-效率前沿,外推权重平均可扩展并利用该前沿,提升推理性能3.3%。

04:00
arXiv cs.CL

从弱点中学习:为小型计算机代理的自动化领域专业化

提出LearnWeak框架,利用强代理识别弱代理短板,自动合成任务与监督,将OSWorld领域任务提升超11个百分点,强调学生意识。

04:00
arXiv cs.CL

PEFT-Arena:从稳定性-可塑性视角理解参数高效微调

提出PEFT-Arena基准,从稳定性-可塑性角度评估微调,发现正交微调最优,揭示遗忘机制和过冲可改善。

04:00
arXiv cs.CL

GraphSteal:通过遍历重构从图RAG中窃取结构知识

提出一种黑盒攻击方法,通过遍历重构可恢复图RAG中超90%的知识图结构,现有防护措施难以防御。