9661 条条目 · 106 个活跃源
2026年9月30日
04:00
arXiv cs.CL

多轮大模型污染中的认知策略分歧:一项协议梯度研究

多轮对话中虚假前提可被LLM当作事实采纳;五种污染协议沿权威梯度揭示模型采纳率与恢复能力的显著分化。

04:00
arXiv cs.CL

大语言模型能在多大程度上模拟真实学习者对教育反馈的评价?

LLM模拟真实学习者评价能力仍有限;提供画像与示例可改善分数校准和个体模拟,但难提升群体一致性。

04:00
arXiv cs.CL

从输入到输出:面向稀疏自编码器特征双端解读的灵活智能体

提出DAFI智能体,从输入端与输出端双向采集证据并迭代解读稀疏自编码器特征,兼顾准确率与效率。

04:00
arXiv cs.CL

神经科学中的深度学习方法:从分子机制建模到意识状态分类

综述深度学习在意识状态分类、麻醉脑建模与意识标志物识别中的应用,指出现有模型可解释性与标准化不足。

04:00
arXiv cs.CL

决策而非生成:基于Jev类型化决策的竞争性维度ABSA

冻结Jev以类型化决策完成维度ABSA三任务,无需生成微调;回归RMSE最低,抽取F1超微调大模型。

04:00
arXiv cs.CL

MemoReason:评估参数记忆对大语言模型上下文推理的影响。

提出配对真实与虚构推理的基准,发现大模型存在记忆偏差,性能降达15.7%,但非直接参数捷径。

04:00
arXiv cs.CL

衡量同质面板LLM辩论中的崩溃与纠正

提出可审计协议,追踪同质辩论的崩溃与纠正,揭示防崩溃可能以损失纠正为代价。

04:00
arXiv cs.CL

SCBO:面向基于大语言模型的社会调查的语义连贯批处理与排序

SCBO为免训练框架,用语义批处理、共享参考库与难易排序,降低token消耗与推理时间并提升准确率。

04:00
arXiv cs.CL

评分标准感知的同策略自蒸馏:面向大语言模型个性化

提出GRASP框架,用评分标准感知的同策略自蒸馏将用户偏好转为token级监督,并验证教师质量,在LaMP-QA上达最优。

04:00
arXiv cs.CL

当文字比图像更响亮:理解视觉语言模型中的语言偏见

VLM易受语言偏见,本文基于词补全分四阶段追踪传播,揭示语言先验与跨模态覆盖交互。

04:00
arXiv cs.CL

FactorEngram:面向语言模型的基级门控因子化 N-gram 记忆

提出因子化n-gram记忆:以共享基向量字典检索稀疏系数,并用基级上下文门控逐分量调制,提升语言建模与下游性能。

04:00
arXiv cs.CL

谁在谁的左边?追踪相对位置推理中的空间证据与角色绑定

揭示相对位置推理中空间追踪与角色绑定两组件,干预内部表征可提升模型准确率与配对一致性。

04:00
arXiv cs.CL

少些谄媚,更强拒绝?机制可解释性对AI安全的启示

机制可解释性表明:降低谄媚不保证直接拒绝更强,但能在用户施压下恢复部分拒绝能力。

04:00
arXiv cs.CL

超越词元规模:面向可靠语义特征发现的块级稀疏自编码器

提出块级稀疏自编码器,以分块均值激活学习可靠语义特征,提升检索、推理检测与引导。

04:00
arXiv cs.CL

自发的上下文恢复:语言模型如何从损坏输入中恢复

语言模型可自发从损坏输入恢复;恢复分两阶段,隐藏状态可预测失败,探针AUC约0.78,适度损坏微调增强鲁棒性。

04:00
arXiv cs.CL

ALMIEYAR:面向多方言阿拉伯语语音识别的文化根基型基准

覆盖17种阿拉伯方言、13.7小时录音,评测12个ASR系统,最佳WER仍达35%,首建阿瓦兹方言基准。

04:00
arXiv cs.CL

混合注意力大语言模型中的多语言性

首次研究混合注意力对LLM多语言性的影响:跨语言表示随层序变化,调整层序可使训练提速2.5倍。

04:00
arXiv cs.CL

AwarenessBench:评估语言模型的认知能力

首个语言模型认知能力基准AwarenessBench,含四维度15项功能。18个模型均超随机基线,最佳者总体胜人类均值,但元认知与自我意识仍落后,认知独立于推理进步。

04:00
arXiv cs.CL

AraDynFact:阿拉伯语事实知识的动态评估

提出AraDynFact动态框架,基于阿拉伯语维基百科自动评测大模型事实知识,并与人工基准高度相关。

04:00
arXiv cs.CL

TRACE:面向生成校准的单次解码轨迹风险定位

TRACE将解码时不确定性视为轨迹,记录token意外度与熵,用局部风险算子保留尖峰并转为答案级置信度;TRACE+校准后在四任务上降Brier、升AUROC。

04:00
arXiv cs.CL

基于项目反应理论的评分标准奖励

提出RRT,以项目反应模型聚合评分标准判定,在线EM更新,减少评审请求并优于GRPO。

04:00
arXiv cs.CL

自适应循环 Transformer 提升测试时扩展

提出 TaH2,按需分配循环迭代,提升测试时扩展效率;AIME 上准确率-算力斜率提高 53%,同算力超基线 3.4 分。

04:00
arXiv cs.CL

眼所惧者:以读盲写入解释 Transformer 中的巨量激活

巨量激活源于注意力与FFN的读写不对称:读时无视MA、写时照常,阻断纠错并累积;读盲先于FFN放大且被主动维持。

04:00
arXiv cs.CL

后层注意力层单独即可复制实体词元,但需关注其上下文

Qwen3-8B中,后半部两组注意力层是实体复制必要且充分条件,上下文对实体词元的注意力也不可或缺。

04:00
arXiv cs.CL

QuanReview:面向人类与LLM跨度标注的离线、可审计协调

开源系统对齐人工与LLM标注,自动合并一致项,将冲突交由人工裁决并导出修正标注层。

04:00
arXiv cs.CL

追溯三千年来甲骨文字的演变

提出流形文字演化框架MSEF,将甲骨文至楷书字形建模为流形连续演化,以神经常微分方程学习跨时代转换规则。

04:00
arXiv cs.CL

MS-GLA:多尺度门控线性注意力——以多时间分辨率破解表征瓶颈

MS-GLA让注意力头跨多时间分辨率分工,粗粒度抓长程依赖、细粒度保局部句法,动态融合重组,不增单头状态即扩记忆。

04:00
arXiv cs.CL

执行框架学习实现可泛化的测试时自适应

训练提议模型按执行反馈修正求解器的执行框架,测试时不改参数即可泛化适应新任务。

04:00
arXiv cs.CL

语言模型会依据隐藏效价行事

激活引导显示,语言模型会依据隐藏效价做选择;该效应在DPO后显现,模型还会主动移除强加的负效价。

04:00
arXiv cs.CL

大语言模型能否正确评估证据价值?动态医学诊断中的证据—价值错位

提出动态医学诊断基准,揭示大模型证据价值错位,并设计框架,准确率提升12–51个百分点。

2026年9月29日
04:00
arXiv cs.CL

LLM引导的本体驱动非结构化文本知识图谱构建

以7B–32B开源大模型结合可复用提示,从法文电网事故报告构建OWL本体与知识图谱;模式引导提示可显著提升抽取质量。

04:00
arXiv cs.CL

基于LLM生成的ACSL契约与确定性驱动生成,用CIVL验证PETSc

用LLM生成ACSL契约、确定性驱动,经CIVL验证PETSc三函数,发现MatAYPX的缺陷。

04:00
arXiv cs.CL

什么驱动了方言越狱?表面形式、文化框架与策略库的消融研究

方言表面形式非高攻击成功率必要条件,优化器控制的策略库才是主因,文化中性策略库同样达近满分。

04:00
arXiv cs.CL

ChestPheNoT:可部署、可审计的放射学报告标签-状态-证据抽取

提出0.5–3B模型,从放射报告联合抽取标签、三分类状态和原文证据,可本地部署审计,跨机构表现优。

04:00
arXiv cs.CL

基于共享表示与领域特定头的IMU数字笔年龄自适应手写重建

提出共享表示与领域特定头的跨域网络,提升IMU数字笔跨年龄手写重建,无需用户适配。

04:00
arXiv cs.CL

时间拔河:通过轨迹方差可视化与检测扩散模型中的RAG冲突

提出轨迹方差分数TVS,以多条去噪轨迹答案嵌入的余弦距离检测RAG与参数知识冲突,轻量且跨架构有效。

04:00
arXiv cs.CL

AI支持的循证学习对公共演讲技能发展的评估

AI结合演讲情境提供针对性反馈与示范演讲;学生练习后表现提升,填充词减少,焦虑降低15%–34%。

04:00
arXiv cs.CL

面向消费者投诉评估的情感分布建模与异常检测

将投诉负面情感视为有界连续变量,用贝塔分布建模并结合金额与回复做异常检测。

04:00
arXiv cs.CL

文献引导的描述符组分搜索空间过滤框架

文献引导描述符过滤框架:词嵌入选描述符构建帕累托过滤,平均剔除74%候选组分,最优值误差1.9%。

04:00
arXiv cs.CL

印度政府监管文件检索增强生成中解析器、分块与嵌入的交互作用

印度政府监管文档RAG因子实验显示:无单一检索器占优,解析与分块交互显著,检索差异主要来自排序质量。

04:00
arXiv cs.CL

Ongiini-Eval-OW 基准:面向 Oshindonga 与 Oshikwanyama 机器翻译及大语言模型评测计划的概念论文

发布Ongiini-Eval-OW基准计划:600条英语—Oshindonga/Oshikwanyama数据,填补Oshiwambo语MT评测空白。

04:00
arXiv cs.CL

Transformer MLP 门控阈值是与被携带参考方向的耦合

残差流均值方向是MLP门控阈值参考;阈值由与该方向耦合实现,偏置贡献很小,跨模型验证。

04:00
arXiv cs.CL

不要重复自己:面向覆盖率的自监督微调

DRY-SFT先生成多样解法、再独立微调,无需奖励或验证器,大幅提升pass@100与结构多样性。

04:00
arXiv cs.CL

在轨迹展开结束前:长时程编程智能体的早期终端奖励预测

提出CER,用轨迹前缀提前预测终端奖励,在SWE-bench和RL中提升表现并大幅减少token。

04:00
arXiv cs.CL

IndicFDB:跨印度语言的全双工语音智能体基准测试

IndicFDB 全双工语音基准扩至十种印度语言,含1.2万样本,发现商业API速度与鲁棒性难兼得。

04:00
arXiv cs.CL

Omni-IO 技能:让智能体原生具备全模态能力

即插即用的 Omni-IO Skills 框架,以27项技能和依赖感知编排,让现有智能体不改推理核心即可原生处理多模态任务。

04:00
arXiv cs.CL

从乳腺X线摄影和乳腺超声报告中提取临床发现:专家与人工智能的比较

大模型从乳腺X线和超声报告提取临床发现,Macro F1达0.91,优于人工,可辅助专家核查。

04:00
arXiv cs.CL

在指称游戏中通过提示优化实现冻结大语言模型间的通信

两个冻结大模型在指称游戏中仅靠提示优化通信;优化提示可编码泛化,部分运行成功且协议可审计。

04:00
arXiv cs.CL

智能体可利用基础模型规避AI检测

智能体用基础模型拼接样本生成连贯文本,规避AI检测,使检测率77%降至24%,水印失效,但成本增30倍。

04:00
arXiv cs.CL

迈向基于嵌入的心理测量学:基于情境化分数的测评题目语义结构建模

分析TIMSS数学题情境化分数语义结构,得七组与一般维度;表示优于单因子但未达最优BIC,诊断解释有限。