9816 条条目 · 106 个活跃源
2026年9月7日
04:00
arXiv cs.CL

共享电路预测大语言模型在算术推理中的跨格式泛化能力

通过归因修补定位算术推理电路,发现数字与文字形式的重叠度可预测模型跨格式泛化,无需标注数据。

04:00
arXiv cs.CL

Scale-QLoRA:原生4比特微缩放大语言模型的码不变适配器合并

仅训练并合并逐块缩放因子,冻结原生码平面,使合并位精确码不变,免量化重写与直通估计,精度无损且提速。

04:00
arXiv cs.CL

LentEx:基于合成数据与指令调优大语言模型的通用潜在实体提取

提出LentEx框架,用合成数据与指令微调优化小模型,实现潜在实体高效提取,超越现有模型并泛化到新领域。

04:00
arXiv cs.CL

语言产出中的启动模式:语言模型生成中的词汇、语义与结构对齐

语言模型生成中的结构启动受语义连贯增强,相对增幅符合逆频率效应,并与词汇语义重复相互促进。

04:00
arXiv cs.CL

从模式保留视角理解暂停令牌的微调动态

暂停令牌微调从模式保留视角重塑训练动态;掩码边界暂停保留通用能力,提升数学和代码推理,亦可扩展到GRPO。

04:00
arXiv cs.CL

一种用于增强大语言模型置信度估计的校准反射方法

提出校准反射框架,融合结构化推理与距离感知校准,含三项创新,在多个数据集上验证了置信度估计的有效性。

04:00
arXiv cs.CL

PetQA:兽医知识与临床推理基准测试

提出韩语宠物QA基准,含1.9万问答对,评估LLM/LVLM兽医能力;测试显示现有模型临床可靠性不足,需更有效的适配方法。

04:00
arXiv cs.CL

内部探针何时胜过读取答案?语言模型中校准失准的读出与行为掩盖的知识

行为失灵源于判定阈值偏移而非知识缺失;单参数修正令正确率50%→81%,校准解码在8B达94%

04:00
arXiv cs.CL

工作节奏:面向工作场所智能体的人类行为痕迹多尺度解读

行为解释取决于时间粒度;多尺度抽象在近七亿事件上稳定,预测提升两成,不同问题需不同分辨率。

04:00
arXiv cs.CL

CAGE:面向检索增强生成的连贯性感知图编码

CAGE用图编码建模跨块连贯性,提升上下文整体一致性,在多跳问答中优于monoT5,答案更精确。

04:00
arXiv cs.CL

共识基准:基于结果奖励稠密化的LLM推理共识节点评测

提出共识基准,通过共识节点稠密化结果奖励,生成过程信号共识PR,提升长链推理性能。

04:00
arXiv cs.CL

语言模型如何表示并利用语音信息进行语素变体选择?

研究发现语素变体选择由触发词嵌入的线性方向因果驱动,能推广至其他语言,但与显性元语言判断分离。

04:00
arXiv cs.CL

基于大语言模型的对话生成中人设恰当使用的控制与评估

针对人设对话中过度使用人设属性的问题,提出SCONPOS干预内部表示来抑制,并提出PAS指标评估适度性。

04:00
arXiv cs.CL

追踪音频大语言模型中的音频锚定与答案选择

训练使音频主导答案,替换音频性能降;音频早中层塑造表征,训练增强中后期音频作用,权重影响集中特定层带

04:00
arXiv cs.CL

推理时选择合适的语言模式以提升多语言可靠性

英语助理解,双语冗余致干扰。RAAI门控:低资源语言准确率升25-37.7%,校准误差降3-6%。

04:00
arXiv cs.CL

论大型语言模型中的认知多样性

大型语言模型评估不应只看准确性,还应关注认知多样性,即有效答案、解释和推理路径的丰富度。前沿模型常表现认知狭窄,需将其纳入能力评估。

04:00
arXiv cs.CL

拒绝而不拒斥:减少语言模型误拒的安全微调响应结构分析

将安全响应拆为拒绝话术与理由,仅用理由训练可减少误拒且不降安全性

04:00
arXiv cs.CL

知道什么不该回答:视觉语言模型中的选择性不遵从

提出选择性不遵从基准KoNA,评估视觉语言模型;模型常应拒未拒,经微调后改善且不影响正常回答。

04:00
arXiv cs.CL

思维链表象之下:大语言模型中推理操作的机制性解读

发现推理操作在中层表征中可分离,不受词汇位置干扰,依赖上下文,揭示推理表述与内部几何结构对应。

04:00
arXiv cs.CL

古典泰米尔语向量化:诗句-注释对的表示学习

用千余对古典泰米尔诗注语料,测试多种模型:仅解码器模型在112组中95.5%偏好真实词序,未复现注释内容。

04:00
arXiv cs.CL

重复出现并不足够:在Gemma 2和3中对多语言SAE翻译特征进行因果验证

跨语言重复的翻译特征多数无因果效应,仅两个模型各一个特征在多种语言中一致有效,重复性可能夸大迁移。

04:00
arXiv cs.CL

激活引导能否捕捉多维作者风格?

提出无需训练的逐方面激活引导法,捕捉多维作者风格并提升迁移效果。

04:00
arXiv cs.CL

系统比较显示跨语言共享度量分歧源于各向异性,仅ILO与迁移相关ρ=0.90,推荐为主指标

系统比较显示跨语言共享度量分歧源于各向异性,仅ILO与迁移相关(ρ=0.90),推荐为主指标

04:00
arXiv cs.CL

利用强化学习为故事生成建设性反馈

提出强化学习方法生成建设性故事反馈,无需标准反馈,超越现有模型,关键在提供可操作建议。

04:00
arXiv cs.CL

强化学习提升大型语言模型的加泰罗尼亚语文本简化能力

提出融合SARI与惩罚项的奖励函数,用强化学习后训练大模型,提升加泰罗尼亚语文本简化能力,跨语言迁移无效。

04:00
arXiv cs.CL

MABPD:基于结构化辩论的多智能体偏见探测与识别

提出多智能体辩论检测新闻偏见,无监督达83.4%F1,接近监督最优,零样本迁移验证有效。

04:00
arXiv cs.CL

RefactorPlatform:面向仓库级重构代理的受控评估开源平台

开源评估平台,隔离设计变量评测仓库级重构代理;AST感知分块提升25-30%,朴素检索无效,单代理优于多代理,成本不变。

04:00
arXiv cs.CL

面向内存高效MoE推理的缓存感知联合路由适配

提出缓存感知联合路由适配框架,协同调整MoE主干与辅助路由,提升缓存命中率、减少权重传输。

04:00
arXiv cs.CL

CC-Mediation:跨文化冲突调解的大语言模型评估

提出跨文化调解基准与两项文化敏感度指标,发现大模型在干预时机和策略上均有不足。

04:00
arXiv cs.CL

MMTClinic:面向临床领域的多模态、多语言时间序列问答与推理基准

多模态多语言临床时间序列问答基准,含三万问答对,评估大模型,揭示临床推理局限。

04:00
arXiv cs.CL

语篇依存:翻译难度的连续标准

提出语篇依存(DDP)指标,衡量翻译所需的前文指代距离;现有基准偏向低DDP,高DDP下机器翻译不及人工。

04:00
arXiv cs.CL

BIT.UA团队在BioASQ 14B中:基于pg_textsearch与Qdrant的模块化检索及智能体答案生成

阿威罗大学BIT.UA团队改进BioASQ问答系统,采用模块化检索(pg_textsearch+Qdrant)与智能体共识生成答案,多批次获前五成绩。

04:00
arXiv cs.CL

MoirfEolas与CríochScore:开发爱尔兰语形态对齐分词资源及评估

本文为爱尔兰语构建超3.5万词形态数据集MoirfEolas及对齐评估指标CríochScore,发现Unigram模型最符合形态,但存在压缩与词表效率权衡。

04:00
arXiv cs.CL

利用低级符号能力实现幻觉检测中的无监督接地

利用LLM从参考文档构建SQL数据库,以数据库为基进行神经符号推理,无需微调即可检测幻觉,性能堪比SOTA。

04:00
arXiv cs.CL

LLM如何评估感知道德能动性?探究人与人工智能体互动中的道德决策

首个实证比较人类与LLM对道德能动性感知,发现LLM在具体情境中更重危害严重性与紧迫性,而非代理本质。

04:00
arXiv cs.CL

EuroAlpaca: Task-Preserving Localisation of Instruction Data for European Languages

04:00
arXiv cs.CL

A Verifier-Guided Explainable Reasoning Framework with Gold-Anchored QLoRA, Task-Aware Mixture-of-Experts, and Group-Relative RLVR

04:00
arXiv cs.CL

A Structured Debate-Mixture-of-Agents Framework for Complex Clinical Diagnostic Decision Support

04:00
arXiv cs.CL

大规模写作评估中基于人机协同的AI辅助评分框架

提出人机协同AI辅助评分框架,用于大规模考试短文评分。AI与人工评分多数维度一致性较高,结合人工复核可安全提升效率。

04:00
arXiv cs.CL

影响分数与Transformer可解释性:推理时注意力头的有效影响度量

提出影响分数度量注意力头贡献:结合对数几率方向与残差结构,揭示正确与错误预测的不同决策行为。

04:00
arXiv cs.CL

利用整数线性规划改进语码转换话语的语言识别

改进MaskLID:解决过度依赖词级分数,改为整数线性规划,显著提升语码混合识别性能。

04:00
arXiv cs.CL

从视觉到语言:探究多模态决策中的因果信息流

通过因果干预视频-文本注意力,发现视觉信息主要在候选答案处理时整合,名词为锚点,时间推理易受语言偏差影响。

04:00
arXiv cs.CL

大型语言模型能否预测社会政策的行为响应?——中国灵活就业人员养老金参保预测案例

用LLM评估社会政策,构建FlexPension-LLM预测灵活就业人员养老金参保,融合政策线索与蒸馏,F1达0.93,超越多数基线。

04:00
arXiv cs.CL

NS-ST-GraphRAG:面向文学知识处理的神经符号时空图检索增强生成

提出神经符号时空图检索增强框架,融合本体提取与动态子图检索,处理长篇文学问答;红楼梦基准上略优。

04:00
arXiv cs.CL

超越未压缩的压缩:RAG中软上下文压缩的两阶段训练方法

软压缩受蒸馏限制,两阶段训练:蒸馏预热加困难强化学习,实现十六倍压缩和四至二十四倍加速,媲美或超越未压缩基线。

04:00
arXiv cs.CL

GEPARD——面向实时对话的生成式、韵律感知、自回归语音合成模型

GEPARD是流式对话语音合成模型,用LLM骨干联合训练文本音频嵌入,经FSQ神经编解码流式输出,单流提速15倍,256并发下加速204倍。

04:00
arXiv cs.CL

中文标题:WearableQA:面向真实世界可穿戴数据的健康推理基准

中文摘要:WearableQA含4084道健康推理选择题,基于200名用户最长500天的可穿戴数据,评测16类推理能力,现有模型最高准确率仅72.9%。

04:00
arXiv cs.CL

抽象智能体

用大语言模型从自然语言自动构建博弈抽象,无需专用评估器;特征发现兼聚类分桶,降低可利用性并迁移至扑克麻将。

04:00
arXiv cs.CL

语音AI客服中的偏见与安全审计

提出面向语音AI客服的验证门控审计框架,区分架构,保障事实一致并度量负担与结果。

04:00
arXiv cs.CL

用于快速大规模系统发育推断的自监督词汇表示学习

提出全自监督对比学习,从原始IPA词表学习词汇表示,快速推断数千语言的系统发育树,效果接近基准。