62256 条条目 · 106 个活跃源
2026年9月25日
04:00
arXiv cs.CL

什么、何时与如何:音频描述作为受约束的全局优化

将音频描述形式化为受约束全局优化,联合决定内容、时机与表述;大模型提议并用整数规划调度,提升叙事与时间指标。

04:00
arXiv cs.LG

半监督安卓恶意软件家族归因中伪标签收益的分类器依赖性

伪标签增益依分类器而异:SVM最大+4.4%,随机森林低标签率受损,约10%标注近最优。

04:00
arXiv cs.LG

分布偏移下,科学代理模型重验证优于有状态路由

分布偏移下,科学代理模型每批重新验证选模优于有状态自适应;旧证据常无益。

04:00
ArXiv AI

编程教育中生成式AI反馈的风险自适应与证据约束框架

提出风险自适应、证据约束的生成式AI编程反馈框架,校准风险定干预时机,证据约束反馈内容,辅助逐级递进。

04:00
arXiv cs.AI

《PUBG Ally:作为AI队友的对话式具身智能体》

提出具身AI队友PUBG Ally,融合大模型推理与实时游戏控制,经3.9万局实战数据训练,玩家推荐正向反馈高出25.1个百分点。

04:00
arXiv cs.AI

推进 AgentX 中的模型研究:面向工业推荐系统的长时程自主性

AgentX-Model 以双智能体实现工业推荐长时程自主研究,多轮实验闭环,线上 A/B 显著提升。

04:00
arXiv cs.CV

注意间隙:网格引导的断裂血管修复

提出网格引导后处理修复nnU-Net断裂血管,Dice几乎不变,ccDice与连通性大幅提升。

04:00
arXiv cs.CV

OREO:通过即时渲染-编辑优化实现3D生成中的保真度对齐

提出OREO,利用2D扩散先验,以强化编辑动态优化渲染视图作监督,提升3D生成保真度。

04:00
arXiv cs.CL

面向无监督野外语音挑战赛多语言语音表征的BiMamba2掩码离散单元预测

BiMamba2掩码离散单元预测多语言语音表征,在67语种无标注数据训练;说话人聚类ARI达0.735超越四基线,但LID与CER仍逊于有监督。

04:00
arXiv cs.AI

Qwen-Planner-Agent:面向真实世界移动规划智能体的闭环 AI-for-AI 框架

提出 AI-for-AI 闭环框架,贯通数据、训练与模型-框架协同演化,移动规划智能体整体性能最佳。

04:00
arXiv cs.LG

一种在 Fat-Shattering 维数下近线性规模的平方损失不可知样本压缩方案

构造平方损失不可知样本压缩方案,规模近线性于 Fat-Shattering 维数,消除对偶因子并解决开放问题。

04:00
arXiv cs.LG

基于碰撞时间与过街区域上下文的城市交叉口安全导向行人轨迹预测

融合碰撞时间与过街区域上下文,安全导向训练降低城市交叉口行人轨迹预测误差及大误差频次。

04:00
arXiv cs.AI

长时程智能体何时可以遗忘其推理?ICLR:面向长时程智能体上下文压缩

提出免训练在线方法ICLR压缩智能体推理历史,提升奖励并大幅降低token消耗,发现推理可外化后更易遗忘。

04:00
arXiv cs.CL

ARGUS:面向美国就业歧视投诉的角色感知事件知识图谱

ARGUS结合5W1H模式、法律领域模型与LLM,从投诉文本构建文档级事件知识图谱,提升诉求分类与法律问答,检索后证据组织效果最佳。

04:00
arXiv cs.CV

基于轻量级视觉Transformer的U-Net用于MRI脑肿瘤分割

提出轻量ViT-UNet分割MRI脑肿瘤,仅260万参数,Dice达0.8446,优于UNet。

04:00
arXiv cs.AI

本体中介的多利益相关方神经符号约束获取

以OWL本体统一LLM软偏好与硬件硬约束,用描述逻辑检测冲突并生成解释供再协商,余者按优先级松弛。

04:00
arXiv cs.CV

S2Planner:面向端到端自动驾驶的多尺度语义规划器

多尺度语义轨迹规划器,融合三相机与自车运动,粗到细迭代优化路径点,NAVSIM达88.03 PDMS。

04:00
arXiv cs.LG

Bandit多类PAC学习:修正的下界、精确族与置信度直和现象

修正bandit多类PAC下界,提出aBDS;上界去除K;仿射复用类揭示置信度直和,维数不足以刻画。

04:00
arXiv cs.CL

面向自动语音识别的词元级转写歧义容忍训练准则

提出词元级容错训练,将通配路径细化至词元并融合词级路径;多语言均优于CTC,WER降9.45%。

04:00
arXiv cs.CV

AV-GRPO:面向联合音视频生成的模态锚定解耦扩散强化学习

提出模态锚定在线扩散强化学习框架AV-GRPO,解耦多模态奖励,提升音视频生成质量、对齐与同步。

04:00
arXiv cs.CL

SemMSA:面向不完整数据的潜在语义辅助鲁棒多模态情感分析

提出SemMSA,用LLM构建情感语义,经跨模态语义精炼与谱对齐融合多模态,在不完整数据下达最优。

04:00
arXiv cs.LG

解耦知识与隐私:面向大语言模型持续学习的任务后自蒸馏回放

SPARK先冻结任务后分布,再以自蒸馏回放和隐私校正抑制PII,同时保持持续学习效用。

04:00
arXiv cs.CL

音频语言模型对听与读的区别性特征表征是否一致?

音频语言模型听读区别性特征表征多不一致;仅Qwen2.5-Omni浊音超随机基线,模型家族比规模更关键。

04:00
arXiv cs.LG

并非所有合成数据都生而平等:面向自动驾驶系统不平衡碰撞伤害严重度预测的专家委员会审核筛选

ECAS框架以真实数据专家委员会审核合成样本,提升自动驾驶碰撞伤害严重度不平衡预测的可信度与性能。

04:00
arXiv cs.CL

JevOut:自然语境即可颠覆决策模型

简短自然语境即可将决策模型的正确判断翻转为高置信度错误选择,翻转率达六至七成。

04:00
arXiv cs.CV

面向稀疏短轴电影MRI心肌重建的解剖对齐表面场学习

提出解剖对齐表面场学习框架,于共享UV域重建稀疏短轴电影MRI心肌,精度与功能保持优于现有方法。

04:00
arXiv cs.CL

网络阴谋论的智能体检测

提出智能体框架,借助社交语境工具推断发言意图,在希伯来语推文上显著优于纯文本分类。

04:00
arXiv cs.LG

经典测验理论误导LLM评判者的三种方式

经典测验理论三项指标在LLM评判中含义错位,不能单独归因于评判者,需规范报告。

04:00
arXiv cs.AI

面向工业配置的神经符号人工智能

大模型难满足工业配置约束;本文梳理神经符号AI三种融合策略,落地配置助手并探讨可信部署与规模化挑战。

04:00
arXiv cs.CV

有限目标分辨率监督下的高效连续DEM重建

SCOPE从低分辨率配对学习连续地形表示,跨尺度高效重建;未见尺度误差较双三次降约12%,算力仅增约2%。

04:00
arXiv cs.AI

ENDOPROMPT:面向效用退化的受害者侧伪参考

白盒ENDOPROMPT从无标签指令学降效用前缀,四模型七基准平均效用降26.8个百分点。

04:00
arXiv cs.LG

持续学习的顺序代价

证明持续学习的顺序代价可分解为联合训练损失与额外代价;同质任务下总损失翻倍,EWC可削减之。

04:00
arXiv cs.CL

中文标题:查询同盟:学习检索动作

中文摘要:轨迹微调使小模型胜任检索问答的动作控制器,动作预测宏F1由0.17升至0.65,端到端精确匹配提升至0.79。

04:00
arXiv cs.AI

谁执笔?应由规范而非智能体签核

智能体自评完成不可靠;SpecHarness将规范编译为义务,以版本化状态治理执行与完成,由规范而非智能体签核。

04:00
arXiv cs.LG

使用新型过采样方法预测大学生的动机缺失与快感缺失症状

针对SMOTE局限,提出用预测模型生成名义变量的新过采样法,提升大学生动机与快感缺失预测。

04:00
arXiv cs.LG

GBFRVFL:基于粒球计算的模糊随机向量函数链接网络

提出基于粒球计算的模糊RVFL网络,设计自适应隶属方案,提升噪声与不平衡场景的鲁棒性和精度。

04:00
arXiv cs.CV

检索即定位:桥接大语言模型与 LiDAR 几何实现空间定位

利用LLM语言先验与LiDAR几何,候选检索加局部细化直接预测坐标,构建空间QA数据集,坐标预测优于基线。

04:00
arXiv cs.AI

Augur:预演产品与政策变更反应的合成决策实验室

Augur离线预演产品政策变更反应并生成决策备忘录;发现前沿与开源模型差距多源于评测设定,而非能力。

04:00
arXiv cs.CV

计算神经形态成像中从事件建模动态系统传递函数

分析事件成像中阶跃、线性、指数探针逆滤波,比较MTF及噪声失配,线性/指数探针更稳健。

04:00
arXiv cs.CL

家庭不受保护区:算法治理与对话式AI中施害者话语的再生产

六款AI:四款拒答率<1%,亲密框架令漏答放大4–11倍,新会话96%以上复发,即“家庭不受保护区”。

04:00
arXiv cs.CL

Spooftral:Voxtral 音频-语言模型能否检测语音欺骗?

Voxtral检测语音欺骗,DoRA轻量适配提出Spooftral,ASVspoof5上EER 4.25%。

04:00
arXiv cs.CV

SplatLabel:基于4D高斯泼溅的伪标签

SplatLabel基于4D高斯泼溅生成LiDAR分割与语义占用伪标签,无需3D框,超越现有方法。

04:00
arXiv cs.CV

ConPro:对比投影预训练,用于DSA序列中标签高效的血管分割

ConPro以对比投影为自监督目标,提升DSA少标签血管分割,结合半监督达75.4/81.3 Dice。

04:00
arXiv cs.CV

关注推理关键:通过选择性概率质量集中对齐跨模态注意力

提出sPMC框架,仅正则化视觉响应注意力头,强化隐式视觉接地,零样本平均提升3%,最高11.3%。

04:00
arXiv cs.AI

风格而非自我:表层线索解释大语言模型的零样本代码归属

LLM零样本识别自写代码仅近随机水平(49-58%),归因依赖长度、注释等表层风格,去除后消失。

04:00
arXiv cs.LG

WeatherDiagFlow:基于证据的雷达临近预报与诊断流细化

将其形式化为证据驱动的预报—公报—审计任务,多智能体生成可审计公报,提升强回波预报技巧。

04:00
ArXiv AI

合成医院:一个开放、可验证、经医生校验的纵向电子健康记录基准

开源可验证的合成纵向电子病历基准,源于公开医学教育资料,前沿模型表现仍远低于医生水平。

04:00
arXiv cs.AI

EnigmaForge:问题藏在故事里

将唯一解逻辑谜题藏入旧文档,不给出问题,专测模型直觉;25个前沿模型表现差距达22倍。

04:00
ArXiv AI

对抗性影响在多智能体系统中如何随规模变化?

欺骗者比例而非数量决定影响:即便欺骗者占少数,大模型智能体仍常倒戈,增加智能体数量不足以防御。

04:00
arXiv cs.LG

FlashLoop:通过惰性更新实现快速且内存高效循环Transformer

免训练框架FlashLoop借循环冗余,用词元稀疏更新与KV残差量化,无损加速1.64倍、KV缓存降6倍。