10213 条条目 · 106 个活跃源
2026年6月10日
04:00
arXiv cs.CL

T1-Bench:现实世界领域多场景智能体基准测试

T1-Bench是评估多领域真实场景智能体的高保真基准,涵盖25个领域,结合自动与人工评估,并开源。

04:00
arXiv cs.CL

混合大语言模型中的注意力遗忘:CoT微调破坏长程回忆的机理与修复

CoT微调降低混合线性注意力模型长程回忆,QK-Restore无训练恢复长上下文并保持推理性能。

04:00
arXiv cs.CL

建模复杂行为:视觉-语言模型中的多人格组合与动态切换

多模态大模型人格诱导提升图像描述但损害VQA;多人格组合与切换存在平衡和残留效应;现有提示方法迁移性有限。

04:00
arXiv cs.CL

密度场状态空间模型:Mamba-2中的1位蒸馏、高效推理与知识组织

提出DF-SSM框架,将Mamba-2压缩至1位,9.7倍缩小,21.4倍加速,发现知识组织的三阶段。

04:00
arXiv cs.CL

推理能力是否保留对齐?——论大型推理模型的可信度

推理模型提升性能时,常牺牲对齐行为,导致安全、偏见、隐私等可信度问题,需同步评估。

04:00
arXiv cs.CL

仅需追踪所需:面向长文档问答的结构感知按需超图记忆

DocTrace多智能体RAG框架,按需构建超图记忆,利用结构感知与经验复用,三数据集最优,计算成本降53%。

04:00
arXiv cs.CL

谁把复活节彩蛋带到了开斋节?跨语言地区数学应用题的文化翻译审计

模型改编数学题时文化翻译不一致,导致多样性压缩、表面标记优先、区域误配和跨文化污染。

04:00
arXiv cs.CL

测量社交媒体文本中的人类价值观表达:校准的LLM标注与编码器迁移

通过校准LLM标注与编码器迁移测量社交文本价值观,理论指导减少误判,保留不确定性。

04:00
arXiv cs.CL

τ-Rec:面向代理式推荐系统的可验证基准

提出τ-Rec可验证基准,用结构化谓词评估对话推荐系统,最优模型通过率仅57%,凸显可靠性缺口。

04:00
arXiv cs.CL

示播列效应:大语言模型跨语言分布偏斜的审计

研究揭示LLM跨语言偏差因模型而异,非普遍属性,发现链式思维锚定与多语言对齐两种缓冲机制。

04:00
arXiv cs.CL

SpeechJBB: 探究大型音频语言模型在语码转换语音下的安全对齐与理解能力

提出SpeechJBB数据集,发现语码转换有害音频越狱成功率极高,伪词插入可绕过安全策略。

04:00
arXiv cs.CL

PhantomBench:语言模型非存在性威胁的基准测试

PhantomBench含6万+不存在概念,测试21模型,平均幻觉率86.7%,前沿模型也难避免。

04:00
arXiv cs.CL

合成后训练数据策展中的来源锚定门控与自适应恢复

来源锚定提升信实门控,幻觉与奖励门控互补,自适应恢复优于重采样,质量主依生成器规模。

04:00
arXiv cs.CL

全双工语音模型的多维交互对齐

通过强化学习全面优化全双工对话模型的暂停、轮换、反馈和打断行为,提升交互性。

04:00
arXiv cs.CL

CANVAS:用叙事视觉-音频AI系统为艺术配文

自动生成多感官艺术描述和同步音频,成本低于0.05美元,20秒内完成,显著提升词汇多样性与叙事细节,改善博物馆无障碍性。

04:00
arXiv cs.CL

基于LLM的代码文档生成与多评委评估

利用8种大语言模型自动生成代码文档,通过多评委评估框架提升质量,实验显示模型间性能差距达42%。

04:00
arXiv cs.CL

利用恶化技巧将重写规则编译为有限状态转换器

提出基于"恶化技巧"的紧凑编译方案,生成并过滤重写候选,支持多种上下文与模式,实现与foma一致。

04:00
arXiv cs.CL

插入式语言模型的连续时间马尔可夫链框架

提出ILM的连续时间马尔可夫链去噪框架,优于左到右生成及掩码扩散模型,采样更灵活。

04:00
arXiv cs.CL

当指标不一致时:知识图谱补全模型基准测试的元分析

通过元分析将KGC评估重构为多准则决策,Z-score聚合器最平衡,解决指标冲突问题。

04:00
arXiv cs.CL

评估与探索大语言模型在攻击调查中的能力

提出AuditBench基准,评估五款LLM在50余种安全场景下的日志调查性能,分析设计选择与错误特征。

04:00
arXiv cs.CL

面向证据驱动的缪子对撞机分析的智能混合RAG

提出智能混合RAG框架,结合混合检索与智能推理,用于缪子对撞机证据驱动的问答,构建基准测试并超越基线。

04:00
arXiv cs.CL

并行因果关联场:用于长上下文语言建模的门控稀疏记忆

提出PCAF,用哈希桶和门控混合实现稀疏长上下文访问,在WikiText-103和PG-19上超越密集Transformer,困惑度更低,吞吐量更高。

04:00
arXiv cs.CL

选择而非显著性:社交高亮中个性化定制的形态与边界

个性化主要在文档选择层体现主题偏好(+0.13),在句子显著性层无增益,建议聚合个体而非强化个性化。

04:00
arXiv cs.CL

利用专家混合和动态下采样增强多语言大语言模型语音识别

结合专家混合架构与动态下采样机制,显著提升多语言语音识别的泛化性与准确性。

04:00
arXiv cs.CL

ERAlign:文本属性图上基于能量的GNN与LLM表示对齐

ERAlign框架基于能量模型对齐GNN与LLM表示,实现分布一致性,避免表示漂移,在八个数据集上获得最优性能。

04:00
arXiv cs.CL

利用社交媒体数据进行COVID-19研究

探讨利用社交媒体数据研究COVID-19,包括语言、视觉、情感指标及机器学习等方法。

04:00
arXiv cs.CL

SpenseGPT:实用一次性剪枝方法,支持LLM推理的稀疏与密集GEMM

提出混合稀疏-密集格式的SpenseGPT,在B200 GPU上实现LLM解码1.2倍加速,保持精度,首次验证半结构化稀疏实际加速。

04:00
arXiv cs.CL

From Observation to Intervention: A Causal Audit of Expert Importance in Mixture-of-Experts Models

04:00
arXiv cs.CL

RedAct:为保护程序性技能而编辑智能体能力痕迹

提出RedAct框架,通过重写痕迹和嵌入水印,将技能泄漏降至基线以下,同时保留审计证据,水印检测率达93.6-100%。

04:00
arXiv cs.CL

Pre-AF 13:一种从出院报告中挖掘的可解释房颤风险评分

从出院报告提取13个特征构建Pre-AF 13模型,预测心血管病患者24个月房颤风险AUC达0.725,优于现有临床评分。

04:00
arXiv cs.CL

N-GRPO:嵌入层邻域混合提升策略优化

提出N-GRPO方法,通过语义邻居混合在嵌入层注入多样性,显著提升数学推理和泛化能力。

04:00
arXiv cs.CL

在无监督术语发现中恢复齐夫分布

图聚类比中心聚类更能恢复齐夫分布,在词汇发现中表现更优。

04:00
arXiv cs.CL

推动经验隐私审计的最新进展

通过高温采样生成合成canary提升隐私审计,并引入合成数据审计,探究模型容量与熵对记忆的交互影响。

04:00
arXiv cs.CL

将思考与表达分离:基于知识的反事实推理用于弹性多智能体辩论

KG-CFR通过规划-执行解耦,在扰动中维持论证质量,防止95%以上退化,提升至0.822。

04:00
arXiv cs.CL

表示感知的优势估计:你的奖励模型提供的不仅仅是标量输出

利用奖励模型隐藏状态构建图传播进行优势估计,显著提升RLHF样本效率和鲁棒性。

04:00
arXiv cs.CL

因果集成代理:基于LLM引导的专家重加权的分层因果发现

提出因果集成代理(CEA),用LLM动态重加权统计专家,聚合改进因果图,性能最优。

04:00
arXiv cs.CL

推理如何流动?追踪注意力诱导的信息流以进行LLM目标强化学习

FlowTracer通过注意力图追踪推理流,按令牌流量分配细粒度奖励,显著提升LLM推理性能。

04:00
arXiv cs.CL

基于大语言模型的搜索引擎对抗攻击动态分析

将排名操控攻击建模为无限重复囚徒困境,分析合作条件与临界点,揭示防御措施可能适得其反。

04:00
arXiv cs.CL

面向序列推荐的生成式原型驱动的物品表示

提出GenAIR框架,利用大语言模型生成物品原型嵌入,并通过行为校准对齐真实用户行为,显著提升序列推荐性能。

04:00
arXiv cs.CL

K-Forcing:通过前推语言建模实现联合下一K词元解码

K-Forcing通过前推语言建模单步预测多个词元,加速推理2.4-3.5倍,适用于高负载批量服务,质量略有损失。

04:00
arXiv cs.CL

AuRA:以LoRA方式将音频理解内化到大语言模型中

AuRA通过层间蒸馏将语音表征内化为LLM的LoRA适配,实现高效并行推理,优于级联系统。

04:00
arXiv cs.CL

TRACE: 一种面向高效智能体强化学习的统一推演预算分配框架

TRACE通过树形推演预算分配增强奖励对比,提升智能体策略更新效率,在基准上取得性能提升。

04:00
arXiv cs.CL

开放韩语语料库:一份实践报告

本文整理韩语语料库现状,指出资源宣传不足,并提出低资源语言开源数据集构建方向。

04:00
arXiv cs.CL

监督微调的目标分布设计:一个统一视角

将监督微调重新定义为目标分布设计,提出Q-target框架,新方法Target-SFT在推理任务上效果更优。

04:00
arXiv cs.CL

AI生成语言中的标准语言意识形态

AI语言模型强化标准语言意识形态,造成偏见与边缘化,需强化问责与社区主导。

04:00
arXiv cs.CL

通过重力加权直接偏好优化训练LLM执行多级指令层次结构

提出GW-DPO方法训练LLM执行五级指令层次,提升优先级遵循率,降低过度拒绝。

04:00
arXiv cs.CL

EXCEEDS:基于信息片段网格建模的科学领域复杂事件抽取

构建SciEvents数据集,提出EXCEEDS框架,将信息片段编码为网格矩阵,端到端抽取科学事件,性能最优。

04:00
arXiv cs.CL

攻击机器文本检测器仍保留风格指纹

攻击会留下机器文本风格指纹,新型改写可逃避单文档检测,但多文档分析仍能区分人机文本。

04:00
arXiv cs.CL

ASyMOB:代数符号数学运算基准

ASyMOB基准含35,368道符号数学题,通过扰动测试揭示LLM推理脆弱性,并探索LLM与CAS协同潜力。

04:00
arXiv cs.CL

中文标题:重新审视印度语言机器翻译与摘要细粒度评估的度量可靠性

中文摘要:引入ITEM基准,评估29种度量与人类判断的一致性,发现LLM评价器最优,度量在摘要中更擅内容,在翻译中更擅流利。