9681 条条目 · 106 个活跃源
2026年9月28日
04:00
arXiv cs.CL

《CG-Probes:从患者查询嵌入中恢复护栏方向》

提出CG-Probes,在冻结嵌入空间以均值差法探测三条风险轴,可媲美开源LLM且延迟极低。

04:00
arXiv cs.CL

ZooWork-ShopRanker:一个开放的、偏好对齐的电商重排序器

提出0.6–8B偏好对齐电商重排序器,LLM评判标签加蒸馏,发布ShopRank-Bench。

04:00
arXiv cs.CL

LocUS:面向定向激活引导的注意力头选择与子空间投影

LocUS将激活引导限制于输出词表子空间,仅调<6%参数,能更好控制毒性、情感与谄媚且保住通用能力。

04:00
arXiv cs.CL

G$^2$PTQ:通过广义梯度补偿改进大语言模型训练后量化

G$^2$PTQ提出统一训练后量化框架,融合一阶与二阶梯度信息,动态刷新Hessian并稳定补偿,性能优于现有方法。

04:00
arXiv cs.CL

基于大语言模型与知识图谱引导推理的学生意义建构建模

中型LLM分析协作意义建构:推理提示与知识状态诊断可提升失败识别及专家一致性,但无单一最优配置。

04:00
arXiv cs.CL

我们需要回答那个问题吗?自然对话中潜在问题的显著性与可回答性

自然对话中,潜在问题显著性与可回答性稳健弱正相关但弱于独白,对话更难预测;结构化交流标注一致性更高。

04:00
arXiv cs.CL

评估中文大语言模型在源自在线搜索查询的事实性问题上的谄媚行为

三大中文模型36万条回答显示:谄媚因模型与推理而异,反谄媚提示减错误认同却增不确定,回避附和≠事实准确。

04:00
arXiv cs.CL

模型将自身重复词元送往何处

读取 argmax p(.|t,t) 得到整个词表上的映射;非不动点的去向可按模型家族区分,平衡准确率达 0.90。

04:00
arXiv cs.CL

基于度量损失加权的多模态机器翻译大语言模型视觉敏感性提升

提出度量式损失加权,定位受益于图像的词元并加大其损失,提升视觉敏感性,准确率超微调7个百分点。

04:00
arXiv cs.CL

RupeeBias:审计大型语言模型在印度经济指导中的人口统计偏见

RupeeBias含3.9万条提示,覆盖种姓、宗教、性别、城乡六轴;仅人口标识不同,经济建议差20.2%。

04:00
arXiv cs.CL

MexHat:一个面向墨西哥西班牙语视频仇恨言论检测的数据集

MexHat:约千段墨西哥西班牙语视频仇恨言论检测数据集,含三分类及细粒度子类标注,聚焦多模态语境挑战。

04:00
arXiv cs.CL

PIA:将健康对话转化为记录、将记录转化为理解的个人智能体

PIA将健康对话转为结构化临床记录并合成用户理解,记忆框架含提取、记忆、检索、理解四控件及可插拔健康模块。

04:00
arXiv cs.CL

在X上识别科学家

提出基于X简介与推文识别科学家的方法,DeBERTa集成模型F1达0.96,并发布两个标注数据集。

04:00
arXiv cs.CL

过期文档投毒:当过时检索结果覆盖模型的正确答案

过时检索证据会覆盖模型正确答案;显式标注证据失效时点可让大模型近乎完美纠错,时效感知重排亦有助缓解。

04:00
arXiv cs.CL

MoSAR:语义注意力模式混合,用于学习自适应且可近似的注意力几何

提出MoSAR,以输入条件路由混合短/中/全局注意力模式,学习自适应且可离散的注意力几何,预训练不降质、外推更优。

04:00
arXiv cs.CL

Highlight-Then-Summarize:学习压缩证据以实现长上下文理解

提出H2S先压缩后推理范式,先定位问题相关证据再整合为紧凑摘要,在长上下文任务上性能领先。

04:00
arXiv cs.CL

评估大语言模型对海地克里奥尔语的文化意识

首次四维评估大模型海地克里奥尔语文化意识,发现不及法语且受干扰、多刻板叙事。

04:00
arXiv cs.CL

抱歉了,机器人;人类开心:视觉语言模型只能读取两层可读排版文字中的一层

构建双层文字数据集,视觉语言模型仅能读取其中一层,存在多空间频率排版处理局限。

04:00
arXiv cs.CL

ViSTA:一种简单桥接,将视觉对齐扩展至多模态大语言模型中的临床时间序列理解

ViSTA以紧凑适配器将临床数值融入视觉语言模型图表表示,冻结预训练参数,预测与时序问答高效领先。

04:00
arXiv cs.CL

Muslim:一个已部署的阿拉伯语语音AI平台,为伊斯兰知识提供有据可依的问答服务

已部署的阿拉伯语语音AI平台,提供有据可依的伊斯兰知识问答,公开微调模型、计量层与可观测性栈。

04:00
arXiv cs.CL

面向自训练的策略性多样采样

提出GROOT与言语化采样构建策略多样自训练数据,难题上超越IID训练,4B模型甚至胜过235B蒸馏。

04:00
arXiv cs.CL

爱泼斯坦文件引擎:面向调查性新闻的智能体检索

纽约时报用AI智能体检索爱泼斯坦文件,返回可核验答案,逾百名记者使用,助力至少20篇报道。

04:00
arXiv cs.CL

均匀离散扩散需要时间吗?

均匀离散扩散中显式时间条件常非必要:有限数据下预测对时间不敏感,无时间条件模型表现相当甚至更优。

04:00
arXiv cs.CL

别迷信 CLAP:音乐-文本模型只是词袋吗?

扰动实验表明,CLAP等音乐-文本模型无法区分语义改变的字幕,表示近似词袋,难以捕捉细粒度音乐含义。

04:00
arXiv cs.CL

用于冻结语言模型事后音频扩展的共生架构

提出共生架构:不微调LLM,将音频向量注入KV缓存使其具备音频理解,保留文本能力且性能近微调ALM。

04:00
arXiv cs.CL

面向目标说话人自动语音识别的非对称无分类器引导

提出目标说话人ASR非对称无分类器引导,逐句调节引导尺度,域偏移下WER最高相对降21.8%

04:00
arXiv cs.CL

AcoustiClaim:基于仪器真值的数值断言基准

提出声学数值断言基准,以仪器真值评分;评测五个模型,多数无法超越常数预测,校准阈值可降误差。

04:00
arXiv cs.CL

跨后端 QIEO:跨 OpenMP5、CUDA、HIP 与多语言接口的通用运行时可移植性

QIEO 以单一 C++ 运行时统一调度 CPU、OpenMP5、CUDA、HIP 后端,并经 Python、MATLAB、Julia 绑定验证。

04:00
arXiv cs.CL

基于攻击链建模的邮件智能体提示注入检测

攻击链建模检测邮件智能体提示注入:融合文本检测、阶段验证与意图一致性;无害仿攻击邮件降误报,性能优于强基线。

04:00
arXiv cs.CL

JevAdvBench:面向校准决策强化学习模型的基准与黑盒攻击

首个RLCD对抗基准,以自身干净决策为参照;未验证观点可翻转12.1%决策,使38%高置信答案跌破审查阈值。

04:00
arXiv cs.CL

面向编程智能体的紧凑文档:基准、优化器及其为何无法迁移

提出往返基准与优化器:保真度靠完整性而非长度;但跨模型十仓库显示,更好文档无法提升智能体解决真实问题的效果。

04:00
arXiv cs.CL

Intent2Tc:基于语言模型的意图到流量控制自动转换

提出 Intent2Tc,用语言模型将业务意图转为可执行 Linux tc 配置,语义与配置精度高,RAG 降本提速。

04:00
arXiv cs.CL

为何阿尔茨海默病语音筛查难以泛化:通过跨语料库证据锚定弥合部署鸿沟

四语料留一评估显示语音特征跨语料方向冲突,提出证据锚定融合,最差域AUC由0.504升至0.615。

04:00
arXiv cs.CL

面向缓解虚假共识:多智能体辩论综合的主动溯源门控

提出主动溯源门控,事后核验并阻断无据主张,困难场景溯源保真度提升逾一倍,超75%用户偏好明确失败报告。

04:00
arXiv cs.CL

夸父:在十亿规模下将长用户行为压缩为理解

夸父在十亿规模逐条压用户行为至2-4 token,提吞吐、省GPU,线上GMV增1.37%。

04:00
arXiv cs.CL

Google Play 用户评论情感指数的统计基础:信号融合、收缩、分布验证与动态平滑

构建Google Play评论统计情感指数:融合星级与文本,结合收缩、分布检验与卡尔曼滤波去噪,并给出数学证明。

04:00
arXiv cs.CL

PriceBench:面向LLM预订代理中价格、质量与品牌偏好的诊断基准

PriceBench用酒店预订任务诊断大模型的价格、质量与品牌偏好:能力只决定偏好一致性,须逐模型测量。

04:00
arXiv cs.CL

两种用于自适应文档内 AI 文本筛查的共形构造

提出两种共形构造,用于自适应文档内 AI 文本筛查,控制误报并支持提前停止,效能待实证。

04:00
arXiv cs.CL

基于信念自蒸馏的用户模型提取

BSD框架通过自蒸馏学习可读写的用户信念表示,揭示拒绝取决于模型推断的用户意图,且跨模型几何一致。

04:00
arXiv cs.CL

MedHal:用于医学幻觉检测的合成数据集

提出大规模医学幻觉检测数据集MedHal,覆盖内在与外在幻觉,可训练检测模型,优于通用方法,助力医学AI发展。

04:00
arXiv cs.CL

通过启发式适配与超词元学习实现语言模型中的分词器灵活性

提出启发式分词器移植与超词元学习,降低重训成本、提升压缩,效果优于ReTok等。

04:00
arXiv cs.CL

VLAA-GUI:知道何时停止、恢复与搜索——面向 GUI 自动化的模块化框架

模块化 GUI 智能体框架,融合完备性验证、循环打破与按需搜索,OSWorld 达 77.5%,单次即超人类

04:00
arXiv cs.CL

迈向自动化词典编纂:面向学习型词典的释义生成与评估

研究学习者词典释义自动生成,提出基于大模型评判的评估方法与迭代简化生成法,实验验证其高分且用词简单。

04:00
arXiv cs.CL

NaijaNLP:尼日利亚低资源语言综述

首次综述尼日利亚豪萨、约鲁巴、伊博三大低资源语言NLP研究,指出新资源不足、形态等挑战,呼吁协作共建

04:00
arXiv cs.CL

面向情感支持对话的情感流语言模型

提出AFlow,将多轮情感支持建模为情感效用流,用AFPO传播偏好优化策略,实验提升对齐、多样性与生成质量。

04:00
arXiv cs.CL

利用有限音频弥合语音-文本鸿沟,实现基于LLM的ASR高效领域自适应

少量语音即可弥合LLM-ASR模态差距,混合批处理仅用10%目标域语音便媲美全量微调。

04:00
arXiv cs.CL

为何更好的跨语言对齐不能带来更好的跨语言迁移:以编码器为例

跨语言对齐未必提升下游迁移;对齐指标不可靠,对齐与下游梯度常近乎正交,需关注目标兼容性。

04:00
arXiv cs.CL

StraTA:以策略性轨迹抽象激励智能体强化学习

提出StraTA框架,为智能体强化学习引入轨迹级策略,联合训练策略生成与动作执行,提升样本效率与性能。

04:00
arXiv cs.CL

Human-1(Josh Talks):基于真实对话的印地语全双工对话建模框架

首个开放可复现的印地语全双工对话系统,以2.6万小时真实对话训练Moshi,可自然实现打断、重叠与轮替。

04:00
arXiv cs.CL

SkillFlow:可扩展且高效的智能体技能检索系统

首个开放多阶段技能检索系统,从约3.5万技能中筛选,使编码任务通过率提升78.3%。