9876 条条目 · 106 个活跃源
2026年8月27日
04:00
arXiv cs.CL

Groundhog比特翻转攻击:通过比特翻转在混合专家大语言模型中引发无限生成循环

提出GBFA比特翻转攻击,翻转路由层比特让不足4个专家失效,输出膨胀5912%,形成针对MoE LLM的拒绝钱包攻击。

04:00
arXiv cs.CL

MTDiag:面向临床有意义的大语言模型评估的多轮诊断数据集

构建MTDiag多轮诊断数据集,融合多源临床数据并标准化至医学本体,新增临床知识指标评估LLM诊断能力。

04:00
arXiv cs.CL

信念级联驱动LLM智能体网络中的说服

多智能体说服受拓扑、竞争、主题和先验影响;直接暴露预测立场变化,中继传递影响,仅看文本会漏掉实际变化。

04:00
arXiv cs.CL

从记忆到吸收:面向持续知识注入的混合策略强化学习

提出GRIN框架,用混合策略强化学习进行持续知识注入,超越监督微调的复杂推理,基础召回持平。

04:00
arXiv cs.CL

BanglaMamba:探索状态空间模型用于孟加拉语假新闻检测

Mamba状态空间模型用于孟加拉语假新闻检测,性能接近BERT,吞吐量提升2.2倍,显存降低49%,适合资源受限场景。

04:00
arXiv cs.CL

语法的几何变迁:Transformer层间的维度与邻域重组

研究深度模型中词性如何塑造表示几何:封闭类词更早扩张和坍缩,几何特征可还原词性。

04:00
arXiv cs.CL

利用言语行为进行低数据和跨域对话偏离预测

用言语行为作辅助信号,提升低数据与跨域对话偏离预测性能。

04:00
arXiv cs.CL

路由图交接:多智能体大语言模型委派的自适应格式选择

路由图交接:轻量路由器自适应选择图或自然语言,压缩数倍且性能不降,消除纯图回退。

04:00
arXiv cs.CL

GUIDE:基于音视觉共享ID编码的生成式无监督中文查询纠错

提出无监督中文查询纠错框架GUIDE,用共享ID编码音视觉混淆字并重构查询,结合时间衰减频率目标,在真实数据上优于基线。

04:00
arXiv cs.CL

短视界与稀疏概念:J-lens读出的数学视角

将J-lens视为一阶因果传递算子,揭示其能量稀疏性,分解为短视界与稀疏概念预测,并提出改进策略以增强概念读出。

04:00
arXiv cs.CL

先溯源后行文:声明锁定式报告

声明锁定式报告:先固定证据源、数值、方向,再生成散文;可重复性提升37.4和20.5点,成本更低。

04:00
arXiv cs.CL

VietAIDetector:用于越南语AI生成文本的开源零样本检测器

开源零样本检测工具VietAIDetector专用于越南语AI文本,支持长文本和扫描件,性能优于现有方法,可下载报告。

04:00
arXiv cs.CL

OmniPhys:来自中文教育语料的多模态物理理解与生成统一基准

提出OmniPhys,含1.5万题和1.9万图的物理多模态基准,评估理解与图表生成,揭示现有模型不足。

04:00
arXiv cs.CL

MathAdv:定理证明者所识、所推、所化、所泛

新基准MathAdv覆盖13个数学领域,揭示形式化瓶颈、领域差异、语言辅助影响及等价改写暴露的鲁棒性缺陷。

04:00
arXiv cs.CL

LLM 推理中偏差校正的自适应触发

针对思维链偏见,提出基于累积和的自适应触发校正,白盒黑盒信号减少干预并提升准确率。

04:00
arXiv cs.CL

DCGC:草稿条件化的掩码扩散模型复杂推理全局修正

DCGC基于草稿条件的掩码扩散模型全局修正,动态双CFG无需验证器提升低共识输出多领域推理准确率。

04:00
arXiv cs.CL

生成式与编码器大语言模型在ASR评估中的比较研究

比较编码器与生成式LLM在ASR评估中的表现,两者均有效,生成式提升可解释性。

04:00
arXiv cs.CL

EgoArgus:将VLM作为基于模态的用户支持的情境助手的基准测试

提出EgoArgus基准,评估VLM在五类场景中的助手能力,发现模态冲突时难辨可信,需提升干预决策。

04:00
arXiv cs.CL

跨数据集的专家知情技能提示与微调在中国隐喻识别中的稳定性

专家技能提示比微调更稳,外部数据表现接近,但微调在原生数据上最优。

04:00
arXiv cs.CL

TOPAS:面向多智能体LLM服务的工作流感知前缀状态调度

提出TOPAS调度器,权衡前缀缓存与批处理,联合决策缓存和调度,缩短任务完成时间,较最优基线降低最高39.8%平均JCT。

04:00
arXiv cs.CL

JIT-Agent:以即时工具链演化扩展工具链智能

提出JIT-Agent,首个即时生成、修复、自进化任务自适应工具链的模型,让工具链智能可训练、可迁移、可累积,显著提升多种模型性能。

04:00
arXiv cs.CL

ReliableRAG:通过可靠性引导推理链对抗检索增强生成中的错误信息

提出ReliableRAG,细粒度评估三元组可靠性,构建稳健推理链,过滤误导信息,提升多跳问答事实可靠性。

04:00
arXiv cs.CL

基于潜向量操控的可控情感生成

对比激活添加提取情感方向,注入潜向量实现不更新权重的强度可控,提升情感显著性并保持语义。

04:00
arXiv cs.CL

GRIP:面向高效推理的细粒度奖励引导参数插值

提出奖励引导参数插值,仅训练插值比例,兼顾推理准确性和效率。

04:00
arXiv cs.CL

ClueWeaver:面向文学长叙事的紧凑型大语言模型的奖励引导双智能体证据推理

奖励引导双智能体,分别定位线索和推理作答,提升紧凑本地模型在长篇叙事问答中的证据覆盖与可解释性。

04:00
arXiv cs.CL

Virgil:基于Transformer的语言模型可解释性导航

Virgil交互系统在统一界面中发现和比较Transformer可解释性工具,应对工具生态碎片化挑战。

04:00
arXiv cs.CL

SHROOM-Visions 2026概述:大型视觉语言模型幻觉检测共享任务

2026年第四届SHROOM视觉语言模型幻觉检测任务,基于SHEEP数据集,覆盖4语言,27队提交600+系统,最优超基线30-40分。

04:00
arXiv cs.CL

束搜索、自洽性与小型语言模型中语法约束文本转SQL的推理时扩展极限

探索语法约束下模型规模与推理计算的权衡:增大模型优于增加推理计算,束搜索优于采样投票,与无约束情形相反。

04:00
arXiv cs.CL

思考-探测-回应:提升大语言模型评判研究想法新颖性的能力

提出TPR方法,探测隐藏状态中的新颖性判断以校准回应,缓解“中等新颖”偏见,提升评判性能22.30%。

04:00
arXiv cs.CL

使用QLoRA学习新事实:习得-保持边界

低秩QLoRA保能力但学事实少,高秩提升事实泛化却损害无关性能,全微调为保守基线。

04:00
arXiv cs.CL

RAG未能消除地理偏差:上市公司事实问答中的地域偏见

RAG虽提升准确率,却未消除LLM对不同地域公司的知识差距,误导上下文易致错误复制,模型增大亦难解结构性偏差。

04:00
arXiv cs.CL

AutoVerifier:残差引导的非参数优化用于基于参考的答案验证

AutoVerifier:残差引导非参数优化,从重复错误学习偏差记入规则卡,验证后升级,提升验证效果。

04:00
arXiv cs.CL

未匹配不等于错误:不完整参考集可逆转开放端心智理论追踪中的校准排名

不完整参考集将未匹配输出误标为假,可逆转模型校准排名与置信度评分。

04:00
arXiv cs.CL

重构正确片段:评估超越长上下文交错对话记忆

提出SCALE-QA基准测试交错对话记忆,TSIM方法准确率最高,较基线提升5.6-17.6点。

04:00
arXiv cs.CL

从专精到泛化:指令微调的大语言模型用于稳健有害内容缓解

指令微调统一36个仇恨言论数据集,域内达SOTA,跨域跨语言泛化显著提升。

04:00
arXiv cs.CL

AWM:面向长文档视觉问答智能体的可作答工作记忆

提出记忆可作答性诊断,将终态工作记忆视为可作答证据并融入GRPO奖励,提升长文档VQA准确率。

04:00
arXiv cs.CL

关键点分析需要结构恢复:任务定义、数据集诊断与结构感知基准

作者指出KPA实为结构化预测,现有基准有缺陷,提出结构感知新基准提升分组、覆盖与流行度估计。

04:00
arXiv cs.CL

将科学论文展开为多轮生成轨迹以继续预训练

将论文按写作过程重构为多轮生成轨迹,构建继续预训练语料,提升学术写作能力,保持推理并改善长文阅读。

04:00
arXiv cs.CL

面向LLM评判的先定位后决策保证

提出先定位后决策框架:定位候选短名单,再按校准置信度选择或弃权,恢复置信度与风险单调性,提供高概率一致保证。

04:00
arXiv cs.CL

技能问题:LLM中的技能是否具有语言不变性?

通过多语言自博弈发现,同一模型在不同语言下技能表现不一致,语言影响决策过程,换推理语言可恢复部分性能。

04:00
arXiv cs.CL

MoganBert-TR:从零训练、采用CLM至MLM课程的土耳其语编码器基础模型

提出从零训练的土耳其语编码器,采用因果至掩码建模课程,优于纯掩码,土耳其语基准最佳,嵌入模型土语评测居首。

04:00
arXiv cs.CL

面向神经抽象式摘要的基于损失的主动学习

LOBSTER主动学习框架优先选高损失相似样本,性能达最优,查询提速665倍。

04:00
arXiv cs.CL

从被动响应到主动纠正:增强大语言模型对输入事实扰动的鲁棒性

提出DEDUCE三阶段框架,检测并纠正输入事实错误,显著提升大模型鲁棒性与纠错能力。

04:00
arXiv cs.CL

SAMpLE:面向虚拟样机的SystemC-AMS机器学习框架

介绍开源框架SAMpLE,将ML模型作为TDF组件集成到SystemC-AMS仿真,支持原生与离线后端,提升复用性与可复现性。

04:00
arXiv cs.CL

LLM即法官系统中的锚定偏差:先验分数损害评估独立性

LLM评审中先前分数会引发锚定偏差,显著影响数值评分和分类判断,需上下文工程而非默认公正。

04:00
arXiv cs.CL

一种形式统摄所有迁移:超越原生书写系统的多语言模型预训练

多语言预训练中,罗马化输入跨语言迁移最强,随规模扩大优势增加;IPA次之。罗马化应作为核心设计,而非事后补救。

04:00
arXiv cs.CL

概念与指称干扰在人类阅读和大语言模型处理中的不同动态

人类阅读中概念干扰产生强而短暂的加工代价,指称干扰弱而持久;语言模型预测与表示也呈现类似差异化动态。

04:00
arXiv cs.CL

自然语言输入、语义轨迹表示与大模型推理:让海上信息交换模型切实可行

自然语言输入经大模型转为语义断言记录,构建知识图谱后二次推理,免除本体学习,令海上信息交换模型即时可用。

04:00
arXiv cs.CL

VISA:面向多模态指令跟随的智能体自进化数据合成

VISA:智能体自进化数据合成,利用验证反馈与目标模型错误迭代优化多模态指令数据,提升指令跟随能力

04:00
arXiv cs.CL

揭示无训练大语言模型文本检测中的频谱机制

频谱分析捕捉人类写作的“生成活力”,在长文本连续生成下检测最有效,短文本等需结合其他指标。