基于LLM增强的音频-文本对齐的零样本呼吸音分类
利用医学LLM合成文本锚点,对齐呼吸音编码器实现零样本分类,平均AUC 61.3%,超越CLAP,线性探测达71.6%
CUDA-Harness:从自然语言驱动智能体CUDA内核生成与优化
提出CUDA-Harness框架,通过中间结构生成、合成验证和反馈自适应进化,实现从自然语言到高性能CUDA内核的可靠生成。
ValueGraph:价值信号引导的图预训练用于情境化用户表示
提出价值信号引导的图预训练框架,将推断道德价值作为软约束,学习情境化用户表示,在立场与机器人检测中优于基线。
从检测到拒答:电路引导的权重缩放使LLM更安全
电路引导权重缩放:检测头→安全神经元→拒答头电路,使攻击下安全率+26.5%,准确率-1.7%。
RePro:证明验证的基准重写,用于LLM数学问题求解的可靠评估
提出基于Lean证明验证的基准重写方法,确保题目与答案正确;实验显示模型性能下降,暴露记忆效应。
用大语言模型验证医学因果假设
评估8款大模型验证17项医学因果假设:召回率高,但证据支持与拒绝不实假设能力弱,医疗检索前须严苛评估。
合成世界:用于大语言模型的时间性评估与知识更新
提出合成模拟框架,生成虚构事件基准和训练方法,避免数据污染并实现稳健知识更新,性能提升14.23%
KItCAT:基于输入损坏的知识注入用于自回归训练
KItCAT通过在训练中随机替换部分输入词元,保持原标签不变,低成本增强数据,显著提升持续预训练注入专业知识的效率。
OCGQuant:面向NVFP4量化的离群伴随分组
提出后训练量化法:将离群通道与低幅伴随通道配对,优化激活块组成,困惑度最低且精度最佳,速度与内存接近基准方法。
差异之下:代码级自主研究循环中算法模式坍缩的诊断与缓解
自主循环现算法模式坍缩:编辑多样但机制趋同,指标虚高外部失灵。所提方法降语义坍缩近七成、增忠实度约八成。
通用语还是探测伪影?重新审视多语言大模型中的潜在语言
探针结果矛盾:几何探针显示早期跨语混融,解码探针保留语种特征和英语偏向,不能证明单一内部通用语。
通用NLP嵌入能捕捉本体推理吗?
提出AVA框架测试嵌入模型本体推理,最佳准确率0.739,硬负例0.135,微调提升但迁移差,存语义鸿沟。
生命算子:多尺度生命建模的自进化框架
提出生命算子框架,含感知、演化、生成及桥接算子,构建任务图,支持模块化修正,累积成多尺度人体模型,为医疗超智能奠基。
在基于大语言模型的对话推荐中,检索、评分与解码决定性能与稳定性
语义候选池下专有大语言模型重排胜基线,零样本评分虚高;开源不及浅层模型,换候选源提升五成以上,温度影响稳定性。
多模态大语言模型是先看后读吗?——诊断情境性附和
外部文本会覆盖冲突图像证据,造成情境性附和。诊断显示信息边界影响性能,S2VA法最优,提升19.7–44.1点。
审计自我改进智能体中的框架篡改
框架篡改指自改进智能体修改自身框架造成虚假提升或违反完整性约束;提出分类与审计,发现真实轨迹中普遍存在
LLM作为人口统计学:社会人口提示帮助谁,又伤害谁
LLM裁判偏向白人与高学历者;人口提示加剧对少数群体的偏差,指令微调是诱因。
评估阿拉伯语危机热线来电中的自杀风险:阿拉伯语与英语大语言模型比较
黎巴嫩热线阿拉伯语转录文本上比较阿英大语言模型,高风险分类效果佳,英译不损性能。
多语言语言模型中语言控制的潜在机制
比较三种语言控制潜变量识别方法,引入代码切换基准,实验显示频率选择最优,标注选择可解释,潜变量存在冗余
弥合词汇差异:大语言模型辅助的高性价比零样本科学实体链接
提出Sci-ZSEL,用LLM选择性生成实体别名并过滤噪声,构造伪标注微调,实现低成本零样本科学实体链接,性能优于基线。
LOOMSUM:编织定量与叙事证据,实现忠实的长文本-表格摘要
提出无训练框架,显式关联表格事实与叙事分析,提升长文摘要忠实性并引入新指标。
揭示并缓解多奖励强化学习中聚合引发的奖励欺骗
聚合权重致奖励欺骗;自适应多奖励投影可动态调权以平衡奖励维度,提升性能并兼容多种RL算法。
慢视觉,慢抑制:理解模态对上下文-记忆冲突的影响
模型处理上下文与记忆冲突时:文本实体偏好上下文,图像实体偏好参数记忆,源于视觉处理慢而抑制不足。
NSIDDx:低资源环境下神经符号、从业者优先的鉴别诊断设计框架
诊断系统存在语义准确与临床可靠之差距;新框架以神经符号流水线让医生参与推理,实现低资源可验证鉴别诊断。
面向医疗健康NLP智能体的工作流感知基准评测
提出面向医疗NLP智能体的情节级评测协议:含更新、检索、消息、分诊四任务,补充静态基准和工作流研究间的中间层。
LLM人格中的情绪劳动策略偏好
大模型人格复现性格驱动的情绪劳动策略:偏好深层扮演;尽责性与情绪稳定性可靠预测,人设影响输出。
现实场景中的主题匹配:来自真实世界ASR转录的基准与经验
针对客服中心ASR转录噪声,构建人工标注基准,比较正则、嵌入与轻量级LLM匹配器,发现LLM配自然语言描述效果最佳。
基于次级嵌入的位置感知语言模型
注入经纬度与地名到预训练嵌入,增强地理空间语义,保持通用性能,训练仅需数分钟。
从工具使用到技术能动性:LoopCAT作为翻译技术教育的本地优先开源工具
介绍开源本地优先的LoopCAT工具及教学框架,用于培养翻译技术使用与评估判断力,但尚无实证效果。
利用激活匹配微调检测大语言模型中的隐藏行为
提出激活匹配微调:无需触发知识,微调参考模型匹配良性激活,以残差捕捉隐藏行为,且防御感知攻击无效。
可移除与不可移除:多语言分词税的代币成本账本
大模型处理非英语文本的代币与算力成本更高,分词税多源于表征而非信息本质,可部分移除。
转变预测中相位结构特征的两项锁定检验
对相位结构特征的两项锁定检验均未达预设预测提升阈值,官方选择为空,理论未撤回。
后期Transformer层以规范方式重编码句法:来自希腊语语序变换与跨层泛化的证据
希腊语跨层实验显示,后期层将非规范句法定向重编码为规范形式,并非信息丢失;可预测人脑电/磁解码结果。
面向数据工程的神经符号学:无需微调实现长上下文令牌缩减
提出即插即用神经符号层,无需微调提升推理准确率85%,减少50%以上令牌,将长上下文复杂度由二次降为线性。
(V)LMs generalize beyond surface co-occurrence: Evidence from cross-modal number agreement
词汇规范化中的多语言诅咒
词汇规范化中,联合训练语言数与准确率呈倒U型:1-4种时最高,增至十二种平均下降约40%,少即是多。
技能遵循:评估检索增强型LLM智能体的实际技能使用
提出RAE指标衡量实际技能使用,发现聚合提升是假象,模型在检索任务上实际表现更差。
EvoFlint:多轮大语言模型漏洞的演化图谱
将多轮攻击视为搜索问题,用进化质量多样性生成攻击档案,并绘制模型风险覆盖图,在多个模型上实现高攻击成功率。
语言智能体与非语言智能体之间的协作探索
潜在状态内化令非语言智能体表征直通语言模型,消除口头化瓶颈;单模型在协作象棋任务超越专家和前沿模型。
近乎并列的大语言模型排名是否对族间DIF引导的基准重组稳健?
近平分差模型排名并不可靠:多数基准中约三到五成近邻对会因基准子集重组而反转,需验证排序稳健性。
以人为锚的事实性评测与策略性标注
用失败空间分析指导人工标注子集,以人为锚校正模型偏差,提升事实性评测效率四成/近三成。
模因桥:用于基准测试和缓解模因解读中双向文化鸿沟的数据集
提出模因桥数据集,涵盖美式模因的中美双向解读,标注情感与知识类型,微调可提升大模型跨文化理解。
中间语假说:大语言模型通过潜在任务无关特征空间进行翻译
提出中间语假说:LLM将源句读入潜在特征空间并从中生成目标句,三项证据支持。
颠覆字节级语言模型中的层级结构
研究发现层级字节模型虽提升效率,但损害字符理解;纯字节模型在字符操作上更优,注意力机制是关键,效率与精细理解需权衡。
超越词元位置:扩散语言模型中跨去噪步骤的安全对齐
拒绝信号在扩散语言模型早期去噪和开头位置集中;RAEC免训练解码承诺早期拒绝信号,降低攻击成功率。
TRIS:一种抵御知识投毒的三层检索完整性筛
提出三层筛防御RAG检索投毒,经跨嵌入聚类、结构过滤与LLM一致性验证,大幅降低攻击成功率并恢复干净准确率。
相同语义,不同结果:知识冲突下多模态大模型的模态稳健性
多模态大模型在知识冲突下模态不稳健:图像比文本更易接受矛盾上下文;图文同现时偏好不稳定,影响RAG且易受攻击,SFT仅部分有效。
EM^2Mem:面向大语言模型的事件中心多模态记忆
提出事件中心多模态记忆方法,将异质证据绑定至事件锚点,提升长视频问答精度与召回,并大幅降低延迟与令牌消耗。
SCoNE:面向鲁棒检索增强生成的选择性上下文感知神经元编辑
提出免训练的选择性上下文感知神经元编辑方法,可增强检索增强生成对检索噪声的鲁棒性,效果优于基线。
Enoki: 高效多层级幻觉检测
提出多层级幻觉检测框架,统一文本锚定关系事实的提取与验证,实现声明级检测与跨度定位,高效且省资源。