62339 条条目 · 106 个活跃源
2026年9月23日
04:00
arXiv cs.AI

模拟社会的局限:后训练与调查微调如何抹除跨文化差异

后训练使LLM模拟社会出现"共识坍塌",压缩群体意见离散度,以多样性换共识,点准确率不足为评判标准。

04:00
arXiv cs.LG

重连还是门控?指令微调如何塑造大语言模型中的知识冲突回路

指令微调门控相同晚期注意力头,非重造冲突回路;更信参数记忆,抗简短注入有限,基座可解释工具可迁移。

04:00
arXiv cs.CL

一个领域,多种语言:无需配对数据,为跨语言遥感MLLM组合领域与语言LoRA

MODL让英文遥感MLLM无配对数据跨语言:领域与语言LoRA逐层正交,答对率56-71%,文本不降

04:00
arXiv cs.CV

AlignMorph:基于显式语义传输的免调优扩散图像变形

提出免调优扩散图像变形框架AlignMorph,显式解耦几何对齐与去噪,结合语义传输和坐标对齐,消除重影并提升结构一致性。

04:00
arXiv cs.AI

部分可观测性下的神经符号动作模型学习

提出NeSyAM神经符号建模范式,实现部分可观测下的动作模型学习,并在六个视觉规划域验证其有效。

04:00
arXiv cs.CL

可信AI的真相:将表达性怀疑、来源溯源与信念修正作为可工程化的立场

在固定模型上叠加行为层,实现怀疑表达、溯源与信念修正;测试显示审计保证成立,但表达保真与溯源指标未达标。

04:00
ArXiv AI

灵兰:基于多模态数据的中医诊断进阶大语言模型

提出UFMD框架统一舌脉多模态数据,构建中医大模型LingLan-14B,诊断准确率相对提升103.5%。

04:00
arXiv cs.LG

自教师应看到什么?面向同策略自蒸馏的特权上下文设计

同策略自蒸馏中,特权上下文并非越多越好;适度抽象优于完整参考解,更省提示且性能更佳。

04:00
arXiv cs.LG

狄利克雷平滑马尔可夫估计下的边际对数似然增量

狄氏平滑马尔可夫中,边际对数似然增量呈KL散度加权缩减;批目标非子模/超模,个体排序不必要不充分。

04:00
arXiv cs.CL

可微分模糊推理层:面向大语言模型的单调、可组合序数推理头

提出可微模糊推理层,用双路径预测头让大模型获得序数推理的单调性与t-范数组合能力,无需组合训练数据。

04:00
arXiv cs.CL

领域自适应预训练增强水处理语义表征,助力大规模结构化文献挖掘

提出领域自适应模型WaterBERT,经大规模水处理语料持续预训练,在下游任务表现最优,并支撑知识图谱构建与大规模文献挖掘。

04:00
arXiv cs.CL

CoVeR:智能体检索中基于覆盖率的验证器调用路由

用冻结句向量的覆盖率阈值门控,仅在证据模糊时调用验证器,减少62–68%调用且精度几乎无损。

04:00
arXiv cs.CV

DeCo:面向多任务视觉定位的高效解耦到耦合学习

DeCo通过任务感知解耦与混合先验耦合,解决定位分割冲突,实现轻量高效多任务视觉定位并达SOTA。

04:00
arXiv cs.CV

LiAuto-MindViT:一种具有自适应双向 Mamba 的混合视觉骨干网络

提出混合视觉骨干,核心为自适应双向Mamba与重参数化模块,分类、检测、分割达SOTA且推理高效。

04:00
arXiv cs.LG

从专家到子专家:面向MoE大语言模型的细粒度参数高效微调

提出NSFT,将MoE专家细分为子专家,结合路由重要性与内部激活显著性稀疏微调,性能更优且参数更少。

04:00
arXiv cs.CV

AnalogDepth:模拟视频传输下FPV无人机的多视图几何

模拟图传噪声使DA3深度退化;AnalogDepth用LoRA蒸馏与真实噪声库提升FPV几何。

04:00
arXiv cs.LG

基于贝叶斯Bandit Gittins指数的成本感知高效LLM评估

提出GittinsEval,将LLM配置选择建模为成本感知贝叶斯Bandit,用Gittins指数与LCB随时推荐,仅1%–2%成本即近零遗憾。

04:00
arXiv cs.AI

迈向全维度GUI智能体导航:掩码轨迹预测

提出MaP框架,以掩码轨迹预测与角色感知适配器统一多任务GUI导航,显著优于直接混合训练。

04:00
arXiv cs.CV

拓扑训练使因果回路集中,却不提升神经元单义性

TopoLoss训练ViT使拓扑聚类因果充分性提升2.79倍,但神经元单义性不变,说明其作用于回路层面。

04:00
arXiv cs.LG

当黎曼流遇上Wasserstein:流形上概率分布的生成建模

提出RWEFM框架,在黎曼流形Wasserstein空间上生成概率分布,可生成单细胞与蛋白质构象。

04:00
arXiv cs.CL

优化扩散大语言模型中的去噪轨迹:一种轻量级进化启发式方法

提出仅393参数的CMA-ES进化启发式调度器,融合特征,在扩散语言模型多基准上超越SOTA。

04:00
arXiv cs.CV

剖析代理式取证:分诊、提示与证据仲裁在开放世界虚假图像检测中的作用

开放世界假图像检测中,分诊与提示可过滤不可靠证据,但推理质量最关键;核心挑战是校准信任与仲裁冲突证据。

04:00
arXiv cs.CV

TReViS:面向自监督重复动作计数的时序重复结构感知视频合成

TReViS利用时序自相似矩阵推断视频重复结构,合成伪标签训练序列,实现免标注自监督重复动作计数。

04:00
arXiv cs.LG

对Grokking转变的探索性副本重叠探测

训练64网络探测Grokking转变的副本重叠;因对齐缺陷结果无效,事后仅标准差比约5.6有检验力。

04:00
arXiv cs.CV

NeuIDO:用于物理信息4D世界模型的神经内禀动力学算子

提出NeuIDO,将世界建模为神经算子,从视觉观测学习统一内禀动力学,支持零样本推理与少样本适配。

04:00
arXiv cs.CV

脉冲神经网络能玩弹球吗?面向目标跟踪的神经形态运动检测器

全脉冲神经形态感知—动作管道实时玩弹球,命中率56.1%,反应21.7毫秒,功耗约148微瓦。

04:00
arXiv cs.LG

AI辅助生物多样性调查的定向复核:主动连续评分占据模型

提出ACORN,将机器学习预测融入占据模型,定向复核高信息量样本,显著减少专家工作量。

04:00
arXiv cs.CV

面向手绘几何图形实时识别的轻量级卷积神经网络

轻量CNN实时识别圆、方、矩形、三角形手绘图形,自建数据集验证准确率96.01%,并公开应用与代码。

04:00
arXiv cs.AI

聚合智能体轨迹何时可诊断?流量支配的解释与校准弃权

研究聚合智能体轨迹的可诊断性:以参考与运行时双重门控确立暴露,再评分,无法支撑时弃权。

04:00
arXiv cs.AI

VideoX-Qwen:以数据为中心的指令驱动视频编辑

构建超120万条视频编辑数据,提出统一Qwen-Wan编辑器,11项指标中9项最优。

04:00
ArXiv AI

优化了分数,却迷失了任务:跨权重、选择与提示的奖励作弊

高分未必模型更优:优化会利用评估器缺陷,在权重、选择、提示三类载体上出现奖励作弊,需独立验证任务质量。

04:00
arXiv cs.CL

超越静态图表:语言与视觉语言模型能否生成交互式数据可视化界面?

提出VIS-GEN基准,评测LLM/VLM生成交互式可视化界面,并设计多阶段框架提升15.9%。

04:00
arXiv cs.LG

一种面向图小样本类增量学习的轻量级可塑记忆框架

面向图小样本类增量学习,提出轻量级可塑记忆框架,结合演化微聚类与元学习平衡稳定与适应。

04:00
arXiv cs.LG

图域自适应不止于表示学习

提出EviGDA,以图感知和无图局部专家互补,独立优化、推理时混合,10数据集16任务超越SOTA。

04:00
arXiv cs.CL

损伤预测恢复:压缩金融大语言模型时校准数据何时重要?

压缩损伤决定校准数据是否重要:量化损伤小则影响小,剪枝损伤大时金融任务混合校准可挽回大部分损失。

04:00
arXiv cs.AI

CausalLoss-Fin:将金融智能体的损失归因于决策与基础设施故障

只归因智能体动作会漏判基础设施故障,损失被全额记到决策上;本文对决策与故障双重干预,精确三分解损失。

04:00
ArXiv AI

预测并非检测:评估纵向临床人工智能中的识别前主张

事件式评估易将识别介导信号当捷径,虚增表现与提前量;须定义识别前转变、独立参照标准使主张可检验。

04:00
arXiv cs.LG

完全抗拜占庭攻击的多智能体强化学习

提出FRAC-MARL,以两跳消息冗余识别可靠信息,在拜占庭边攻击下时变图中收敛至无攻击极限点。

04:00
arXiv cs.LG

符号图预训练与提示学习

提出首个符号图拓扑引导预训练与提示学习框架TopoSIGN,融合磁符号拉普拉斯编码器与持续同调分支,实验验证其有效性。

04:00
arXiv cs.CL

同一图表,不同叙事:视觉语言模型图表解读中的偏见

首个图表解读偏见基准ChartBias:覆盖六类社会属性,揭示叙事偏移、群体幻觉与偏好极性,并提出缓解框架。

04:00
arXiv cs.LG

缓慢衰减与沉默表达:语言模型谱系中的迭代式阈下特质迁移

语言模型谱系中阈下特质可迭代十代传递但衰减;第十代可内部存特质却不表达,移除系统提示后表达消失。

04:00
ArXiv AI

AgenticSizing:基于大语言模型的多智能体模拟电路尺寸优化框架

提出大语言模型多智能体模拟电路尺寸优化框架,拓扑分解与知识复用协同搜索,8电路验证,LDO成功率60%。

04:00
arXiv cs.CL

设计与分析论辩挖掘流水线:迈向全面评估

系统评述论辩挖掘端到端流水线,从语言学、计算与领域三视角提出任务级分析框架。

04:00
arXiv cs.CL

CHiME-9 ECHI:为应对听力障碍而增强对话的机器学习挑战

CHiME-9挑战在嘈杂餐厅四人对谈中,从智能眼镜与助听器多通道录音提取语音,提升可懂度与质量;七队参赛,最佳系统优于基线。

04:00
arXiv cs.CL

面向GROBID的版面引导掩码:大规模科学PDF摄取中的轻量级结构增益

为GROBID加轻量CPU版面掩码定位图表与页眉页脚,提升科学PDF结构解析,成本远低于GPU方案。

04:00
ArXiv AI

对抗性行动方案生成:面向COA匹配与COA生成的博弈论多智能体算法

发布COA-Bench离线基准,以自博弈比较行动方案生成策略,用蓝红优势与纳什差距评分,并修复基准设计缺陷。

04:00
ArXiv AI

CQ4OE:评估LLM辅助从能力问题生成本体的基准

提出CQ4OE基准,系统评估LLM从能力问题生成本体;含溯源与两项任务,实验显示术语恢复优于本体构建。

04:00
arXiv cs.CV

CMambaDepth:基于通道Mamba与混合注意力的自监督单目深度估计

提出CMambaDepth自监督框架,以双向/单向通道Mamba实现多尺度融合,混合注意力兼顾局部与全局建模。

04:00
arXiv cs.LG

模块化范数 RandOpt:通过架构感知扰动实现种群高效集成

提出模块化范数RandOpt,以模块级自然范数校准扰动,候选数减少3–12倍以上,多任务准确率超越RandOpt。

04:00
ArXiv AI

FIRE:面向可靠语言模型智能体的故障知情运行时工程

在失败前状态施加指令与动作拒绝,不改权重即显著提升智能体重复成功率与交付可靠性。