9966 条条目 · 106 个活跃源
2026年8月11日
04:00
arXiv cs.CL

测量错误之物:内部危害性分数反向排名成功越狱

内部危害分数衡量意图而非越狱结果,包装后攻击成功率上升但评分下降,成功越狱被排到失败之下。

04:00
arXiv cs.CL

Cultivar: A Contrastive and Locale-Oriented Translation Benchmark for Investigating Contamination and Localisation Robustness

04:00
arXiv cs.CL

大型语言模型如何评判社会吸引力?来自多模型与人类基于理论人设评分的证据

研究大型语言模型如何评估社会吸引力:基于理论人设,多模型评分稳定且分级一致,但与人类相比更极端。

04:00
arXiv cs.CL

Se-DPO:用于直接偏好优化的自演化令牌信用

提出自演化令牌信用,动态分配,依据强度与置信度校准,无需外部模型,提升直接偏好优化。

04:00
arXiv cs.CL

英美电影音频描述对比

基于206部电影语料,量化验证英美音频描述在词汇、语法、命名、场景提示及与对白音乐重叠度上的差异。

04:00
arXiv cs.CL

REFRAMED:迈向电影真实音频描述生成

提出描述内容与时机联合决策的音频描述生成任务,构建含2023个视频片段的REFRAMED数据集,现有系统远不及人类专家。

04:00
arXiv cs.CL

KGCaRe:利用知识图谱自动构建与上下文检索的 LLM 可解释复杂条件问答

提出KGCaRe混合方法,结合神经检索与知识图谱符号推理,显著提升复杂条件问答准确性与可解释性。

04:00
arXiv cs.CL

PragMatch:在大规模视觉-语言模型中区分语用不协调与跨模态不匹配

提出PragMatch基准,揭示LVLM依赖表面线索而非真正推理,将语用不协调误作跨模态不匹配。

04:00
arXiv cs.CL

用于音频-发音实时MRI语音分类的结构化音系表征

结构化音系特征可提升实时MRI音频-发音分类,改善音素识别,音频监督可部分迁移至发音轮廓模型。

04:00
arXiv cs.CL

SWE-Bench ProMax:面向大规模多语言代码重构的智能体基准测试

提出多语言代码重构基准SWE-Bench ProMax:170个实例,平均改11.4个文件,最强模型解决率仅41.2%,极具挑战。

04:00
arXiv cs.CL

JaleesBench:AI助手是好的精神伴侣吗?

新基准测试AI作为精神伴侣;通用模型经简短引导可达专家水平,检索层是关键,并可提升现有系统。

04:00
arXiv cs.CL

解码级禁忌:大语言模型鲁棒性的诊断性压力测试

提出解码级禁忌测试,遮蔽高概率词元迫使模型迂回,发现鲁棒性随规模与对齐提升,可用于数据生成和安全审计。

04:00
arXiv cs.CL

大型语言模型中数学泛化的融合训练

研究思考/非思考模式融合训练,发现数据比与调度影响;非思考监督越多,思考模式精度越低,二者存在内在张力。

04:00
arXiv cs.CL

RA-FinBERT:面向低资源金融情感分类的规则感知LoRA适配

提出规则感知FinBERT,融合LoRA与VADER规则特征,仅增1024参数,准确率69.89%、F1 0.634,优于纯FinBERT。

04:00
arXiv cs.CL

EvalConvoLearn:评估辅导对话中基于真实数据的学习者模拟的开源框架

开源框架EvalConvoLearn基于真实对话数据,从学习行为与对话质量两维度衡量模拟学习者。

04:00
arXiv cs.CL

透明度陷阱:AI免责声明如何在高风险决策中引发过度自信

AI免责声明因透明度悖论失效,用户将其视为系统诚实反而增强信任;标准声明难防过度依赖,影响高风险决策。

04:00
arXiv cs.CL

从价值观到基准:面向荷兰政府应用的大语言模型评估

构建荷兰政府大模型评估框架,六维度含事实性、诚实性、偏见、能耗、成本、透明度;质量高环境成本高,偏见独立,事实性非诚实

04:00
arXiv cs.CL

基于任务感知多阶段LLM模拟来访者的动机性访谈咨询师评估

提出任务感知多阶段模拟客户框架,用于戒烟动机性访谈的唤起任务,更好区分咨询质量,减少无依据陈述和过早披露。

04:00
arXiv cs.CL

面向无验证器测试时扩展的共识性

现有置信度法在复杂任务上失效;提出共识性框架,抑制初始高置信、强求最终确定,提升数学与代码生成。

04:00
arXiv cs.CL

中文标题

大型语言模型在医疗中的社交沟通能力评估:现有模型缺乏稳定可靠的社交技能,需调整评估框架以适配AI特性。

04:00
arXiv cs.CL

EvoTrustRAG:面向可靠检索增强生成的演化感知冲突归因与证据处理

提出EvoTrustRAG框架,区分知识演化与恶意冲突,提升RAG可靠性与抗攻击性。

04:00
arXiv cs.CL

法官自知何时可靠:基于LLM的A/B测试预测中的校准弃权

多模态LLM从截图预测A/B测试结果基本无效;高置信子集略好,但人机共识均非真实证据。

04:00
arXiv cs.CL

基于VLM主观评价的人工动物进化模型

提出用VLM主观评价驱动遗传算法进化软体机器人,加速收敛并产生独特形态,揭示主观判断结构。

04:00
arXiv cs.CL

DevIntent:LLM生成代码在多大程度上违背开发者意图?

提出意图违反率(IVR)衡量代码通过可见测试但违背隐含意图的比例。评估两大模型,通过率超92%,但半数以上问题违背意图,显示通过率高估了意图匹配度。

04:00
arXiv cs.CL

CuteTTS:基于连续潜变量自回归建模的高效高质量语音合成

提出一种连续潜变量自回归语音合成方法,结合流匹配与蒸馏,实现低延迟与高质量零样本合成。

04:00
arXiv cs.CL

声纹谬误:为何声音并非独特的生物特征印记

声音并非稳定的唯一生物特征;语音证据应通过考虑可变性和不确定性的概率框架解释。

04:00
arXiv cs.CL

DS@GT ARC在Touch'e:用于检索增强辩论的大语言模型

用六个大语言模型和检索增强完成辩论生成与评价,模型家族内部评价一致,但与官方评价不符,质量准则差距最大。

04:00
arXiv cs.CL

开放权重模型能否在金融文本理解上竞争?

开放权重模型在金融文本理解上表现出色,Kimi K2.6等开源模型排名前列,但信息检索仍是主要瓶颈,且政治过滤器会拒绝合法问题。

04:00
arXiv cs.CL

基于RAG的工业现场总线设备自动配置

RAG+本体图谱自动配置现场总线设备,混合检索重排序高精度,LLM生成配置,弃权门控防错,端到端快且零静默失败。

04:00
arXiv cs.CL

MoRSE:任务导向多智能体系统与角色-子任务专家混合

提出MoRSE,以角色-子任务专家混合和分层策略优化,提升多智能体系统专业性与性能,泛化良好。

04:00
arXiv cs.CL

使用大语言模型自动生成经复杂度验证的决策场景

利用大语言模型自动生成并验证决策场景复杂度;评估4238个场景,信效度良好,可稳定分级为简单、中等、复杂。

04:00
arXiv cs.CL

迈向元认知一次性间接提示注入:通过结果条件反思的策略抽象

提出SAVOR方法,通过结果条件反思离线蒸馏攻击策略,实现一次性高效间接提示注入。

04:00
arXiv cs.CL

AnchorFold:一种通过递归注意力传播实现高效多向量视觉文档检索的先聚焦后折叠框架

免训练聚焦-折叠框架,递归注意力传播选锚聚合,5倍压缩保留98.3% NDCG@5,近无损。

04:00
arXiv cs.CL

人们如何评价AI、专家及同伴风格的财务建议

财务内容相同时,专家建议优于AI;错误标签提升AI评分、削弱专家优势;来源与沟通线索共同塑造评价。

04:00
arXiv cs.CL

理论引导的欺骗检测:基于检索增强生成的人工智能探索

基于欺骗理论的检索增强生成模型与基线准确率相近,但理论强烈影响应答偏差,从偏谎到偏真,当前模型判断不可靠。

04:00
arXiv cs.CL

基于大语言模型的歌曲歌词性内容量化方法探索

提出用大语言模型量化歌词主题内容(含性内容)的可复现方法,并应用于雷鬼乐歌词。

04:00
arXiv cs.CL

守护者爬虫:面向嘈杂网络智能的受限大模型增强的检索优先知识发现

提出检索优先测试台Guardian Crawler,结合BM25与重排序,在合成语料上提升检索精度,但未证实统计优势。

04:00
arXiv cs.CL

超越直接标识符:面向隐私感知的LLM查询委托的概率性隐私风险评估

用概率k匿名估计增强隐私委托,新数据集PUPA-SD训练PAPILLON,平衡隐私与效用,k匿名作辅助指标。

04:00
arXiv cs.CL

PolicyKG:将机构政策转化为SHACL知识图谱的智能体LLM流水线

LLM流水线读政策PDF转成SHACL约束,注册表换域适配,分类86.9%,F1=0.866

2026年8月10日
04:00
arXiv cs.CL

区分决策规则错位与语音语言模型读出覆盖限制

语音模型副语言任务中,状态解码比生成准确率高27.8点,决策规则与读出覆盖均有差距,无标签逻辑修正可提升生成准确率。

04:00
arXiv cs.CL

金融视觉语言模型在图表和文档理解中的置信度估计

评估金融视觉语言模型置信度:训练探针可校准,接地感知探针能识别未基于图表的回答,委派受模型能力限制。

04:00
arXiv cs.CL

ConstructCIE:面向施工事故叙述因果信息提取的数据集

构建事故因果信息数据集ConstructCIE,评估多种模型,揭示精确跨度提取不足,需强化领域知识。

04:00
arXiv cs.CL

从大语言模型失语症图片命名错误特征中反推损伤参数

通过逆映射从错误特征恢复损伤参数,修改比例和噪声可恢复,层索引仅近似,反事实验证81.4%,揭示层间冗余。

04:00
arXiv cs.CL

Do AI Personas Grow? Analyzing and Benchmarking Personality Evolution in LLM Agents After Life Events

04:00
arXiv cs.CL

TEXAS:面向下游混合专家大语言模型适配的任务专家感知监督

对比成败样本的专家激活找出任务专家微调时加权失败样本中激活这些专家的答案令牌提升MoE下游性能

04:00
arXiv cs.CL

GRASP:利用组相对策略优化强化语言模型匿名化器

GRASP用组相对策略优化在线强化本地匿名模型,在保护隐私与效用间取得更优平衡,完全端侧运行,成本极低。

04:00
arXiv cs.CL

衡量跨语言理解差距:证据语言如何影响语言模型的理解

模型在非英语语言上表现平均降约17%,语言资源越少降幅越大;英语中心评估高估低资源用户质量。

04:00
arXiv cs.CL

NTDH:面向全面情感分析的复杂推理

提出NTDH,将情感分析重构为推理,处理数据合成问题,用SFT+GRPO,少量数据即达最佳性能,相关0.86。

04:00
arXiv cs.CL

迷失在插值中:预测反馈为何在扩散语言模型中失效

线性插值遮罩错配超球面嵌入,球面软遮罩用球面插值,MAUVE提2倍,困惑度降16.9-19.6%

04:00
arXiv cs.CL

渐进式内容精炼与衰减奖励联合LinUCB

提出带奖励衰减建模的上下文Bandit算法,用EM估计参数,抑制过度利用,在情感反转和GSM8K上超越基线。