9717 条条目 · 106 个活跃源
2026年9月22日
04:00
arXiv cs.CL

论大型推理模型中的效率与安全困境

首次揭示:效率优化看似降低越狱成功率,实为推理能力下降致攻击失败,非真对齐;量化加剪枝为最优平衡。

04:00
arXiv cs.CL

知道何时信任图像:可靠性感知的多模态实体对齐

提出RA-MMEA框架,评估视觉可靠性并自适应修正不可靠图像表示,实现鲁棒的多模态实体对齐。

04:00
arXiv cs.CL

机器可解释信息:将文档编译为可搜索、可读取的协议状态

提出MII协议,把文档编译为56 token状态,可跨模型翻译,统一检索、推理与重建,7%算力下超越全文上下文。

04:00
arXiv cs.CL

BabelArena:面向LLM智能体的大规模多语言基准

提出多语言智能体基准BabelArena,覆盖23种语言、16146个任务,揭示跨语言性能差距与低资源语言特有的执行失败模式。

04:00
arXiv cs.CL

提出、验证、提交:面向长程多参与者对话的循证记忆

长程多参与者记忆化为可搜索状态机,分离消息证据与活动状态,以提出-验证-提交写入、自适应导航读取,显著优于基线。

04:00
arXiv cs.CL

困惑度预测保护:在联邦参数高效微调中为最差客户端公平性选择预训练骨干

低困惑度预训练骨干能更好保护联邦LoRA中数据贫乏客户端,个性化补救有限。

04:00
arXiv cs.CL

ARID:面向工业维护工单结构化信息提取的可部署边缘AI系统

ARID以4比特推理和语法约束解码,在Jetson上从工单抽取结构化JSON,token-F1达84.8%。

04:00
arXiv cs.CL

RPMem:为LLM智能体学习跨会话的长期循环参数化记忆

RPMem以两阶段架构将各会话编译为模型无关潜在记忆,经循环门整合后映射为LoRA参数,实现可跨骨干迁移的长期跨会话记忆。

04:00
arXiv cs.CL

段落边界并非空白:压缩深度是层级结构的标志

真实段落结构的可复现标志是跨段注意力压缩深度,而非压缩位置;随机标签仅浅层压缩。

04:00
arXiv cs.CL

面向自动作文评分的错误监督合成学习者写作

面向自动作文评分,引入错误监督生成合成作文,数据较多时优于传统合成基线,错误分布更接近真实学习者作文。

2026年9月21日
04:00
arXiv cs.CL

小型语言模型知道自己不知道什么吗?

小模型token熵失效;语义熵可路由大模型,准确率最高提升50个百分点,实现智能算力分配。

04:00
arXiv cs.CL

HERMES:基于临床笔记的对比感知知识图谱推理用于患者结局预测

HERMES仅用临床笔记构建个性化知识图谱,以对比逻辑建模和图注意力网络预测结局,性能优于纯文本基线。

04:00
arXiv cs.CL

从出院记录到患者理解:基于人格设定的LLM出院教育者开放式模拟

提出基于人格设定的出院教育模拟基准,评估大模型多轮宣教中患者理解与覆盖差异。

04:00
arXiv cs.CL

传音面向 MLC-SLM 2026 挑战赛的说话人归属多语言 ASR 系统

提出级联式说话人归属多语言ASR系统,tcpMER 15.41%,MLC-SLM 2026获亚军。

04:00
arXiv cs.CL

超越WER:带口音对话式ASR中的实体与不流畅词召回

三阶段流水线使口音对话ASR实体召回达80-85%、填充词召回76-86%,WER仅6-10%,优于Whisper。

04:00
arXiv cs.CL

SAGE:面向资助评审的模式引导大语言模型

SAGE将资助评审标准转化为结构化检查并关联申请证据,生成可审计的评审草稿供专家修正,辅助评审一致性提升至0.58。

04:00
arXiv cs.CL

Reviser:通过自回归光标动作实现可修订的文本生成

Reviser以自回归光标动作在画布上生成文本,支持插入与回退等非单调修订,效果优于扩散基线且更省算力。

04:00
arXiv cs.CL

递归语言模型能泛化到域外

CoT域内可模拟递归,域外却依赖捷径;递归模型隔离上下文避免此失效,揭示真正推理需克服简单性偏置。

04:00
arXiv cs.CL

TALON:一种面向放射学报告生成的时间感知纵向框架

TALON以双通道时序融合自适应整合可变长病史,提升纵向放射报告生成并超越现有最优。

04:00
arXiv cs.CL

TatBLiMP:面向塔塔尔语的语言学最小对立对基准

首个塔塔尔语最小对立对基准,1248对句覆盖16种形态句法现象,单语素扰动经母语者验证,无需文本生成。

04:00
arXiv cs.CL

面向视觉语音识别中音素到文本重建的基于课程的噪声适应

PECT课程学习框架,用合成扰动与伪标签逐步适配NLLB音素到文本重建模型,提升鲁棒性、降低词错误率。

04:00
arXiv cs.CL

奖励高效推理可提升推理模型在信息不足任务上的弃答能力

针对欠定任务,提出GRPO奖励鼓励高效推理,微调4B模型后弃答提升12.8%,思维链缩短44%。

04:00
arXiv cs.CL

伏尼契手稿背后的生成语法:拼凑假说——来自大语言模型的证据

多学科与大模型分析表明,伏尼契手稿遵循生成式语法,系对自然语言与中世纪药草书的拼凑式模仿。

04:00
arXiv cs.CL

迈向安全的云原生计算:借助大语言模型揭示Kubernetes错误配置

探索大语言模型检测Kubernetes错误配置,构建分类体系,评估工具并分析风险。

04:00
arXiv cs.CL

PhysioBench:面向生理信号问答的统一基准

提出PhysioBench基准,整合22个数据集为30项任务、6140万问答,评测21个模型均难跨模态稳定领先。

04:00
arXiv cs.CL

VISPATH:面向多模态知识图谱问答的视觉意图引导路径推理

提出VISPATH框架,以视觉意图动态引导多模态知识图谱多跳推理,并构建VISPATH-Bench基准,显著超越强基线。

04:00
arXiv cs.CL

COAL-SQL:面向Text-to-SQL后训练的覆盖引导增强与失败驱动学习

COAL-SQL框架融合覆盖引导增强与失败驱动学习,仅1.26万样本在BIRD达64.9%执行准确率。

04:00
arXiv cs.CL

用自生成的深度研究轨迹提升深度研究与长上下文能力

复用深度研究轨迹生成长上下文QA,提出DLD-RL训练,深度研究提升7.3%、长上下文提升13.5%。

04:00
arXiv cs.CL

从生成到检测:基于话语驱动场景的大语言模型生成假新闻研究

研究大模型在四类话语场景下生成与检测假新闻,构建1.4万篇语料;生成策略影响可检测性,提示优化无益。

04:00
arXiv cs.CL

写作时少读:流式多模态解码器的闭式带宽旋钮

提出ZENDAYA,以单一γ闭式调度统一离线/流式多模态解码;少读源反而提质,低延迟增益显著。

04:00
arXiv cs.CL

读焦虑还是读标签?比较微调模型与前沿模型在社交媒体焦虑检测中的表现

对比六种焦虑检测方案发现,语料中关键词构成混淆,微调模型最依赖关键词匹配,已发布成绩因此虚高。

04:00
arXiv cs.CL

MME-Safety:面向多模态大模型安全评估的细粒度基准

MME-Safety细粒度基准:四维标注、分层评估,评测17个MLLM,揭示跨模态输入与思维链推理安全隐患。

04:00
arXiv cs.CL

CoLearn:在人类—AI 协同学习循环中学习其学习者的智能体导师

CoLearn 以持续记忆建模学习者掌握度与误解,动态生成个性化问题,盲测中68-69%优于非个性化。

04:00
arXiv cs.CL

与真实经历对齐:心理健康支持生成中微调的异质性收益

微调可提升心理健康支持对齐,但收益因社区与策略而异,且更偏问题聚焦。

04:00
arXiv cs.CL

μ²-Bench:多语言机器遗忘基准

提出多语言机器遗忘基准μ²-Bench,覆盖多语言及留出语言,评估跨语言知识遗忘,强调需多语言特性方法。

04:00
arXiv cs.CL

通过语义摘要预测增强音频推理

提出SPARE,以对齐结论的注册token预注入语义目标,提升音频推理且无额外推理开销。

04:00
arXiv cs.CL

生成式人工智能聊天机器人用于动机性访谈:从系统设计到干预结局的范围综述

范围综述纳48项研究:生成式AI动机性访谈互动质量与用户评价良好,但持续行为改变证据有限。

04:00
arXiv cs.CL

从任务成功到高效成功:以质量与成本评估人机协作

提出以产出质量与交互成本之比衡量人机协作生产力;质量相同会话成本可差70倍,且用户主观评分不可靠。

04:00
arXiv cs.CL

将强制对齐扩展至终端用户设备

用线性内存对齐与受限随机游走剪枝两项优化,大幅降低内存和耗时,使强制对齐可扩展至终端设备。

04:00
arXiv cs.CL

价值观的几何:面向语言模型伦理偏好对齐的任务向量组合

构建1.2万跨语言道德困境数据集,揭示模型价值偏好偏差;提出任务向量正交化,可分离并反转伦理偏好。

04:00
arXiv cs.CL

并非所有不规则都相同:因果隔离日语形态屈折中的一种稀有失败模式

日语过去时屈折中,不足1%的/e/词干促音化子类占30–43%错误,单独剔除其增益超全部不规则动词。

04:00
arXiv cs.CL

Hallucination-R1:面向事实一致性的鲁棒性导向改写生成

提出两阶段优化的改写生成框架,生成语义等价但具鲁棒性挑战的改写,暴露问答模型事实不一致并提升鲁棒准确率。

04:00
arXiv cs.CL

从记忆到行为:面向社交媒体网红的行文感知角色扮演框架

提出情境-状态-行为角色法,融入情境化行为策略并设计评测协议,社交媒体回复生成效果优于ICL基线,亦适用于虚构角色。

04:00
arXiv cs.CL

中文标题:当更好的单轮表现未能造就更好的智能体:诊断下一轮指标与工作流成功之间的鸿沟

单轮指标提升无法迁移到自主工作流执行,成功率最高仅10.4%,需分开评估各环节。

04:00
arXiv cs.CL

超越原子化词元:面向语言模型预训练的音节分解

提出音位分词器,将汉越语音节分解为声母、韵母、声调,词表小、效率高,预训练模型表现优异。

04:00
arXiv cs.CL

一个评委小组相当于多少人类评审?

有效人类数取决于匹配目标:同一32评委评审组的谱等效为4.24–6.50,分布恢复等效仅2.30–3.75,二者不可互换。

04:00
arXiv cs.CL

推理何时有助于机器翻译?对大型推理模型推理轨迹的层次化分析

LRM翻译推理:最佳语言因模型而异,长度与质量非单调;HMS揭示理解规划、翻译起草、精炼验证,模型/长度感知控制。

04:00
arXiv cs.CL

超越基于参考的评估:用于语法纠错元评估的奖励模型

提出无需参考答案的奖励模型RM-EVAL,可像人类一样评估并改进语法纠错。

04:00
arXiv cs.CL

ArenaFlow:从轨迹排序到开放式智能体强化学习的分层信用传播

ArenaFlow用锦标赛排名生成轨迹奖励,分层传播信用至关键步骤与可复用技能,提升开放式智能体RL。

04:00
arXiv cs.CL

深度循环语言模型中的预测动态

深度循环模型经重复潜在更新预测;分数变化分解为平移、方向与竞争者配对,解释中间答案与终点一致但分数变。