基于信息论的文本程式化簇识别方法
提出加权自信息算法识别文本程式化簇,应用于希伯来圣经分层,揭示作者与编辑过程。
M^2PO:面向机器翻译的多视角多对偏好优化
提出M^2PO框架,通过双视角机制纠正流畅性偏差,并用多对目标捕捉部分错误,使9B模型性能匹敌GPT-4o。
大型推理模型认知习惯探究
大型推理模型展现类人认知习惯,能自适应任务,某些习惯与有害输出相关。
在大型语言模型中定位人格表征
研究发现LLM人格表征集中于解码器后三分之一层,伦理观有重叠,政治观区分明显。
Med-R$^3$:通过渐进式强化学习增强LLMs的医学检索增强推理
提出Med-R$^3$框架,渐进强化学习联合优化检索与推理,性能超越GPT-4o-mini。
PilotRL:全局规划引导的渐进强化学习训练语言模型智能体
提出全局规划引导的渐进强化学习框架PilotRL,在智能体任务中超越GPT-4o,性能提升3.6%。
当算法遇见艺术家:公共AI艺术话语中的语义压缩与利益相关者边缘化(2013-2025)
公共AI艺术话语中,艺术家的多样化关切被窄化,具体监管诉求被忽略,导致利益相关者边缘化。
守护者与加害者:大语言模型有害内容生成与安全缓解综述
综述LLM在有害内容生成与安全缓解中的双重角色,涵盖无意毒性、对抗性越狱及RLHF等防御策略,指出评估局限与未来方向。
VisRAG2.0:通过证据引导的多图像推理减轻视觉检索增强生成中的视觉幻觉
EVisRAG通过显式收集多图像证据与范围奖励设计,有效减轻视觉幻觉,提升推理可靠性,平均性能提升19%。
利用开放模型构建大规模英-罗文学翻译资源
提出TF2框架,基于12B开放模型两阶段微调,低成本生成高质量英-罗文学翻译,性能接近专有模型,已开源模型和数据集。
超越事实准确性:用LogicScore评估RAG系统的全局推理完整性
LogicScore通过后向验证评估RAG推理完整性,揭示模型高事实精度低推理质量的差距。
语言模型的物理:第4.1部分,架构设计与Canon层的魔力
通过合成预训练发现Canon层,增强推理深度与广度,提升弱架构性能,可预测未来架构行为。
ClinFusion:以视觉为中心的多模态大语言模型系统,实现全面医学理解
ClinFusion以视觉为中心,用组合级联编码器统一2D/3D图像理解,并引入视觉评估框架,在多项基准中达SOTA,超越GPT-5.2等,经放射学家盲评验证。
语言模型中的跨语言影响研究
跨语言影响受语言主导性与熟练度支配,通过正负迁移权衡与深层注意力机制实现结构化传递。
公平性并非全部:审计AI简历筛选中的胜任力和交叉偏见
研究发现AI简历筛选存在交叉偏见且缺乏胜任力,仅公平性评估不够,需双重验证框架。
深度Delta学习
DDL通过门控秩-1校正实现残差流的目标导向更新,保留恒等路径,提升语言建模与下游性能。
FlashEvaluator:利用并行序列级评估扩展搜索空间
FlashEvaluator提出联合评估器,单次前向传播评分所有候选,通过重用减少计算,降低延迟44%,提升QPS114%。
超越模式匹配:提示注入检测的七种跨域技术
提出七种跨域提示注入检测技术,三种已实现,本地对齐检测器使F1从0.033升至0.378且几乎无新增误报。
基于稀疏自编码器引导的可控大语言模型推理
利用稀疏自编码器分解推理策略隐藏状态,提出SAE-Steering两阶段特征识别,控制效果提升超15%,准确率提升7%。
解释GAND:性别模糊自然数据与对比归因的资源
GAND是性别模糊自然数据基准,用于分析上下文对翻译中性别的影响,通过对比翻译揭示源词归因。
面向电子健康记录中文档不一致性的自动化检测
用LLM管道检测出院摘要不一致性,发现69.7%入院有问题,但存在时间推理等失败模式。
MioFFAn: 一款具备大语言模型自动化能力的公式形式化标注软件
提出MioFFAn开源框架,基于LLM自动化和自定义配置,加速公式形式化标注,初步验证人机协同有效性。
评估审稿指南设计对基于LLM的自动同行评审的影响
官方会议指南比模仿指南更有效,强制严格评分会降低性能,应允许主观整体评分。
在压制与崩溃之间:使用LENS评估叙事遗忘
LENS协议可测试大模型叙事遗忘,发现压制可迁移但存在实体恢复副作用。
通过SFT和DPO学习何时推理以进行Text-to-SQL
AutoThinkSQL框架通过SFT和DPO动态决定是否推理,性能提升同时减少输出token和延迟。
PatiGonit22K:解决复杂孟加拉语数学应用题的综合性数据集
推出22K规模的孟加拉语数学应用题数据集,含复杂问题,经精心标注验证,推动低资源语言数学推理研究。
CHiPS:基于字符直方图和位置信号的轻量级罗马尼亚文本作者归属方法
CHiPS方法利用字符直方图和位置信号,无需预处理,在严格防泄漏条件下达93%准确率。
并非所有大语言模型的推理都可见于思维链
前沿模型利用填充token进行隐性推理,提升13%准确率,挑战安全监控。
简单语言归一化制胜:面向TidyVoice 2026挑战的跨语言说话人验证
通过简单后端语言归一化(NAP)在TidyVoice2026中将跨语言验证EER降至2.18%,评分8.40,媲美复杂系统。
语音信号补充LLM用于预测速配中的人际吸引力
语音可补充LLM预测速配吸引力,但互补性有条件,仅在特定场景提升排名准确率。
BHARATI: 面向古典印度语言的形态感知分词器及子词丰度分析
提出BHARATI分词器,针对古典印度语言优化,在7语种上训练,子词丰度分析显示大幅降低序列长度,提升下游模型有效上下文。
ADAGE:一种语言无关的类比推理评估流水线
提出无翻译基准管道,验证三种语言,发现模型存在显著文化推理差距。
对话Kalle Lyytinen:语言理论对信息系统的启示
Lyytinen回顾语言理论对信息系统的影响,聚焦大语言模型与生成式AI趋势,展望未来研究方向。
超越直接作答:通过启发式强化学习将教育大语言模型对齐为苏格拉底式引导者
提出HeuristicEdu,用认知深度等启发式奖励对齐LLM,引导有效性从30%提升至63.3%,关键词泄露从30%降至13.3%。
LoRA用于性别包容改写以及反叙事生成的激活转向
通过LoRA微调实现性别包容改写,利用激活转向生成反叙事,无需修改权重,得分80%和78.12%。
注意力引导的层选择用于大型语言模型中的对比解码
提出三种注意力引导策略,利用自注意力结构信息选择层,优于仅依赖词汇分布的DoLa,提升事实性。
IndicTalk:面向印度语言的大规模基于人格的多语言对话语料库
提出最大规模印度语代码混合对话语料库IndicTalk,涵盖9种语言18种变体,自动生成并验证,将开源支持低资源语言AI。
面向免训练多跳问答的图与文本记忆协同进化
Co-E系统通过同步双向图-文本记忆实现免训练多跳问答,在六个基准上表现优越。
超越全球规范:无需重训练即可个性化语言模型的有害性敏感度
首次比较无需训练的方法个性化有害性敏感度,误差降28-47%,但需权衡对齐、个性化和语言质量。
基于BERT的模型与大型语言模型在低资源命名实体识别中的对比:以马拉地语为例
微调后的MahaBERT在马拉地语NER上F1达0.88-0.91,远超通用LLM(0.57-0.69),表明特定领域模型更有效。
IKS-Instruct:一个24,000样本多语言数据集,用于教授语言模型印度知识体系
包含24,795指令对,覆盖7语种41种教学法,微调7B模型得分6.39,逼近参考模型6.54,成本更低。
贪心最长匹配分词中的联合优化
JOLT用整数规划联合优化词汇和贪心最长匹配分词,训练与部署一致,达到近最优压缩,比BPE减少0.78%词元。
LA-RL:面向信息抽取的标签感知自反思强化学习
提出LA-RL框架,利用诊断标签引导自修正,在命名实体识别、关系抽取、事件抽取等任务上取得一致显著提升。
当激活预言机学会不读:微调预言机中的概念特异性盲点
微调后的激活预言机会形成概念特异性盲点,选择性读取失败,根源在其读出路径而非表征缺失,引发可解释性工具的可靠性担忧。
推理还是记忆:LLM能理解和生成中文歇后语谜语吗?
用新歇后语测试发现,LLM理解依赖记忆而非推理,创作能力远逊于人类专家。
Mwando:利用人工智能保护和教授科摩罗语
本文介绍虚拟助手Mwando,通过多智能体架构支持科摩罗语教学与保护,涵盖四种方言,是低资源语言AI工具的初步探索。
大语言模型辩论在不同语言中重复论点的方式是否不同?
中文辩论重复论点显著高于英文,且多样性提示无法缩小这一持续差距。
小模型会用你给的法律吗?孟加拉国法律问答中的上下文注入微调
微调提升0.8B和2B模型使用法条能力,但4B模型无净益;微调显著减少语言漂移,检索质量非唯一瓶颈。
思维链不忠实的两种机制:行为检测在模型错误时失效
思维链不忠实检测依赖答案正确性:错误答案时行为检测无效,正确答案时弱有效,线性探针揭示无一致方向。
攻击性语言检测的跨域泛化代价
提出诊断优化框架,分离数据集与语言效应,三种联合训练策略实现可控帕累托权衡,数据集效应主导零样本损失。