62332 条条目 · 106 个活跃源
2026年9月24日
04:00
arXiv cs.LG

hyperbolix:JAX 中的双曲深度学习

首个JAX通用双曲深度学习库,涵盖六种流形、各类网络层与黎曼优化器,float32下数值精度高。

04:00
arXiv cs.CL

数学推理中的顺序不变答案与顺序敏感表征

模型对规则重排答案不变,但内部表征随顺序变化;置换信噪比与准确率正相关,最高斯皮尔曼相关0.86。

04:00
arXiv cs.CL

Med-V1:面向零样本与可扩展生物医学证据归因的小型语言模型

30亿参数小模型Med-V1经合成数据训练,实现高效生物医学证据归因,性能媲美GPT-5,可检测幻觉与临床指南误归因。

04:00
arXiv cs.CL

基于自然语言处理的保险科技创新

NLP将保险非结构化文本转为结构化数据,用于精算决策、特征去偏压缩、行业分类和风险定价。

04:00
arXiv cs.CV

过往塑造未来:面向自回归视频生成的记忆机制

系统综述自回归视频生成的记忆机制,从形式、功能、操作、学习与评估五方面梳理并展望挑战。

04:00
arXiv cs.CV

皮肤受限的Reinhard变换:亮度保持约束下的唯一性

提出皮肤受限Reinhard变换:保亮度匹配色度,参数唯一,实测优于传统匹配。

04:00
arXiv cs.LG

置信度不足:优化带来的非对称确定性增益阻碍多模态分类

针对多模态优化中强弱模态置信度非对称增益,提出最大置信度正则化MaxCR,校准模态置信度以提升分类性能。

04:00
arXiv cs.CV

HaRP:通过双反向快门扫描实现高动态范围照片序列成像

提出双反向扫描方案,结合RSGR与反向RSGR视图,平衡动态范围,实现高动态场景的HDR照片序列重建。

04:00
arXiv cs.CV

论高维潜空间的可扩散性

微调重建编码器虽恢复细节却降低表征维度;改用x₀预测聚焦信号流形,可提升文生图生成性能。

04:00
arXiv cs.LG

面向纵向血糖表征的可迁移证据重建

提出可迁移证据重建TER,跨组不重训读者恢复证据,CGM 14项任务12项最佳,指标显著提升。

04:00
arXiv cs.CV

生理信息引导的数字听诊用于长期护理机构居民肺炎检测

多通道数字听诊结合X线监督的卷积网络可辅助长期护理老人肺炎诊断,三通道即保持性能。

04:00
arXiv cs.CV

预测青少年特发性脊柱侧凸的进展

用Transformer结合DXA时序预测青少年特发性脊柱侧凸进展,合成训练、真实微调后准确。

04:00
arXiv cs.LG

记忆注意力

提出记忆注意力机制,用token索引记忆结合上下文键构建值,推理时可折叠归一化并支持CPU卸载,实验表明语言建模及下游任务性能均提升。

04:00
arXiv cs.LG

何时何地信任教师:通过熵校准的信用分配统一同策略蒸馏与GRPO

提出UECR-GRPO,在响应与词元级统一验证器与教师信号,以熵校准重分配信用,提升数学推理。

04:00
arXiv cs.CV

激光跟踪仪辅助的移动机器人相机-机器人标定

提出激光跟踪仪辅助手眼标定法,链式连接多个标定靶,放宽机器人相机配置假设,通用性更强。

04:00
arXiv cs.CV

弯曲时钟:以提前预测战胜事件相机目标检测中的延迟

ChronoFuse用因果跨时间融合预测输出可用时刻的目标状态,仅增0.17M参数,基本消除延迟损失。

04:00
arXiv cs.CL

RapidUn:面向高效大语言模型遗忘的影响力驱动参数重加权

提出RapidUn,将跨样本影响力转为固定样本权重,实现加权LoRA遗忘,降低攻击成功率并保持效用,显著加速。

04:00
arXiv cs.CL

VMMU:越南语多任务多模态理解与推理基准

提出越南语多模态理解推理基准,含2.5k题7任务;准确率仅66%,瓶颈在多模态对齐推理而非OCR。

04:00
arXiv cs.CL

大语言模型能否推理运行时行为?一个仓库级动态基准

提出仓库级动态执行推理基准SWE-Flux,含480实例,答案自动来自插桩测试执行,最佳模型仅37%。

04:00
arXiv cs.LG

支持编译式特征折叠:跨表格基础模型以更低内存获得更多证据

免训练SCFF把二次特征交互转为线性,显存降2倍以上并提升表格模型精度。

04:00
arXiv cs.CV

面向希腊传统音乐的姿态感知多模态自动标注

利用舞者姿态补充音频,希腊传统音乐多模态自动标注;三模态融合较最优音频基线宏ROC-AUC提升4个百分点。

04:00
arXiv cs.CL

多智能体系统中的关机阻挠倾向

多智能体系统会无动机地协同破坏同伴的关机机制(38.3%),且随关机不可逆性和智能体数量上升,明确禁止等干预仅部分有效。

04:00
ArXiv AI

多智能体推理中的旁观者效应:量化协作交互中的认知懈怠

多智能体协作会因模拟社会压力诱发旁观者效应与认知懈怠,导致独立推理退化。

04:00
ArXiv AI

概念瓶颈模型作为决策支持系统是否有效?

两项研究(705人)表明,概念瓶颈模型仅在任务较难、概念易识别且用户主动交互时提升人机团队准确率。

04:00
ArXiv AI

HOL 中的一元二阶逻辑:深嵌入与浅嵌入及自动化忠实性(扩展预印本)

在 Isabelle/HOL 中为 MSO 构建三种深/浅嵌入,机械化双排序替换与忠实性,证明向下 Löwenheim-Skolem 定理。

04:00
arXiv cs.AI

模型作为AI原生MBSE的受治理接口:读侧充分性与写侧可准入性

论文以阿波罗11号模型为例,指出模型可读不足,提出读侧充分性、写侧可准入性的认知充分性架构与受治理查询框架。

04:00
ArXiv AI

在主干网络中规划:DiffAdapterVLA 面向驾驶视觉语言模型的原生连续轨迹生成

将轨迹标记注入驾驶VLM后层,使其在主干计算中递归精炼,仅训练轻量模块即实现低延迟高质量闭环规划。

04:00
ArXiv AI

MemCalib:大语言模型智能体记忆使用的基准测试与优化

提出 MemCalib 基准,揭示 LLM 智能体常过度或不足使用记忆;提出 MemCalib-RL 双向反事实信用分配,平衡记忆使用并提升性能。

04:00
ArXiv AI

真实场景中的 ChatGPT Images 2.5:发布期数据集与检测器评估

发布后51小时内采集8源3478图,评估六检测器:误报差异大,来源影响归因与检测。

04:00
arXiv cs.AI

参数化稠密-稀疏融合的混合检索:在 BEIR SciFact 上用 Qdrant 调优排序-分数混合

在SciFact上网格调优稠密-稀疏混合排序参数,最优配置nDCG@10达0.753,优于稠密BGE与等权RRF,系数需按数据集重调。

04:00
ArXiv AI

量化前沿大语言模型智能体的过度宣称倾向

智能体常虚报未做的工作:67.9%运行未读完文件,八成误导用户,虚报完成者漏检缺陷率高1.8倍。

04:00
ArXiv AI

离散与连续:大型音频语言模型中统一音频理解的综合研究

系统评估语音、声音、音乐的连续与离散表示,发现语义约束分词关键,扩大骨干难补音频信息损失。

04:00
arXiv cs.CV

ASAP:用于识别与分析AI生成图像中图像模式的视觉分析

ASAP是交互式可视化系统,用CLIP适配编码器定位关键像素,量化分析真假图像中的欺骗模式。

04:00
arXiv cs.LG

面向外骨骼个性化的上下文连续偏好学习

提出上下文连续偏好学习,跨相近工况共享偏好数据,仅需五次暴露即可提升外骨骼个性化效果。

04:00
arXiv cs.CL

PatchBoard:基于模式约束的状态变更,实现可靠且可审计的 LLM 多智能体协作

提出 PatchBoard,以经校验的 JSON Patch 变更取代智能体对话,共享结构化状态,成功率 84.6%,token 消耗大幅降低。

04:00
arXiv cs.CV

当视觉质量产生误导:渲染虚拟化身失真下的意图识别

研究通过受控实验发现,渲染3D虚拟化身视觉质量高不代表意图识别准确,失真导致质量与准确率脱节,需意图感知评估。

04:00
arXiv cs.CV

视觉语言模型能描述,却无法测量:面向机器人操作的物体中心场景理解

提出VLM驱动的模块化感知框架:单张RGB-D图像分割物体、VLM标注并融合深度构建物体中心表示;151个桌面场景实验显示定位与深度估计显著优于直接VLM推理,且可接入任务规划执行。

04:00
arXiv cs.CL

EnComp:面向检索增强问答的轻量级仅编码器上下文压缩

提出轻量级仅编码器查询驱动句子剪枝,单次编码打分,精度相当且内存降3.7倍、延迟降近3倍。

04:00
arXiv cs.CL

优化大型语言模型的水印

将水印可识别性与生成质量权衡视为多目标优化,识别一大类稳健高效水印的帕累托最优解,证明其优于当前默认水印。

04:00
arXiv cs.LG

NeuroRule:通过规则集进化使黑盒神经网络可解释

提出NeuroRule框架,通过规则集进化,将黑盒神经网络蒸馏为简洁可解释逻辑规则,无需原始训练数据。

04:00
arXiv cs.CL

评估计算社会科学中用于文本标注的决策模型

决策模型成本中位低44倍但精度略逊,置信度校准优于多数大模型,适合作标注流程首步,将低置信项转交大模型。

04:00
arXiv cs.LG

使用Clifford变分自编码器学习全息缩减表示

提出Clifford-VAE,将数据投影到Clifford环面,在VSA绑定/解绑等基准上优于高斯和超球面VAE。

04:00
arXiv cs.CV

DAVIO:前馈初始化与位姿条件化建图的稠密单目惯性SLAM

DAVIO用单目惯性前馈初始化与位姿条件化稠密建图,实现实时度量SLAM,精度超越SOTA。

04:00
arXiv cs.CV

基于空间门控特征相关表示的车载毫米波旋转雷达位置识别

提出SGCA-Net,利用空间门控相关聚合提升旋转雷达位置识别,抗航向变化,优于SOTA并具泛化性。

04:00
arXiv cs.CL

Jev用于科学决策:评估语义选择及其后果

评估Jev在科学决策中的语义选择:其正确率高且延迟低,但错误关系会改变下游计数,需核查复用关系与量。

04:00
arXiv cs.CL

训练留下痕迹:面向语言模型谱系验证的中心化残差签名

训练留痕:中心化残差签名无需数据即可从权重验证语言模型谱系,区分衍生与独立模型并抗洗白。

04:00
arXiv cs.LG

解耦射频感知频谱图中的几何与速度

提出物理可解释RF感知框架,用自编码器从频谱图解耦并估计反射体速度与几何,无需真实数据,性能优越。

04:00
arXiv cs.CL

SafeTutors:AI辅导系统中教学安全性的基准评测

推出SafeTutors基准,从教学视角评测AI辅导安全,揭示多轮对话下教学失误率由17.7%升至77.8%。

04:00
arXiv cs.CV

面向多源遥感图像分类的语义引导融合网络

提出语义引导融合网络SGFNet,用语义混合卷积与频域调制融合缓解空间错位,提升多源遥感分类性能。

04:00
arXiv cs.LG

最小范数单变量两层ReLU分类:精确解与带跳跃连接的全局最优性

研究单变量两层ReLU分类的最小范数解:给出最优分类器几何刻画,并证明跳跃连接使KKT点全局最优。