62337 条条目 · 106 个活跃源
2026年9月23日
04:00
ArXiv AI

AI神经科学家:用于神经影像分析的交互式智能体界面

AI神经科学家智能体将大语言模型与神经影像工具结合,支持自然语言查询数据质量、设定分析参数并完成质控、建模与可视化。

04:00
arXiv cs.CL

AIBuildAI-2.5:通过LLM引导的树搜索实现高效自主AI模型开发

提出LLM引导树搜索、资源感知调度与LLM路由,MLE-Bench奖牌率达73.3%。

04:00
arXiv cs.AI

MedGate-Fusion:融合首诊语义叙述与生理生物标志物的前瞻性卒中风险分层

多模态门控模型融合首诊叙事与10项生理标志物,基于CPCSSN十万余患者,实现五年卒中风险分层。

04:00
arXiv cs.AI

X-Planner:面向具身智能的事件结构化任务规划

提出X-Planner规划前端,统一具身推理监督与表示,支持离散事件与潜在思维链,实机执行优于基线。

04:00
arXiv cs.CL

提示广度与推演刷新在在线策略蒸馏中相互作用

在线策略蒸馏中,提示广度与推演刷新交互:刷新时广度提升准确率,冻结时相反,且受推理预算影响。

04:00
arXiv cs.CV

用于活动性沙眼分类的DINOv2比较性能与参数高效适配

DINOv2微调主导活动性沙眼分类,ECA仅5参数即媲美大模型,最高准确率91.66%,其增益依赖训练目标。

04:00
arXiv cs.CV

MotionJEPA:通过在潜在空间中捕捉视觉变化防止时序特征坍缩

MotionJEPA提出DISReg正则化,预测时序差分嵌入以平衡动静特征,防止潜在表征坍缩。

04:00
arXiv cs.CV

重新思考扩散分割:何时依赖其噪声状态,扩散真的重要吗?

审计12种扩散分割法,发现状态依赖取决于监督路径;匹配纯图像基线常不逊色,扩散专有计算未必带来优势。

04:00
arXiv cs.CL

Peerify:同行评审论断验证基准

提出Peerify,基于稿件证据验证评审论断,构建800条真实评审基准;检索与论断分解关键,自动标签与人工共识达90.3%。

04:00
arXiv cs.CV

WebMRIQC:面向资源受限环境的可及性MRI图像质量评估的MRIQC网页版实现

开源网页平台WebMRIQC封装MRIQC引擎,零安装实现DICOM转BIDS与自动质控,13项指标验证与原生MRIQC等效。

04:00
arXiv cs.CV

DFD-Lab:模块化音视频深度伪造检测流水线

提出模块化音视频深伪检测流水线DFD-Lab,整合三种检测器与可配置实验流程;跨数据集检测困难,JPEG增强提升AUROC却降低准确率。

04:00
arXiv cs.CV

Colon3R:基于单目结肠镜视频的跨域三维重建

提出Colon3R跨域半监督框架,将标注体模及仿真数据的几何迁移至无标注在体结肠镜,重建更完整一致。

04:00
arXiv cs.CV

Video-STLayout 预训练

提出利用目标检测框的时空布局特征,通过对比学习对齐视频特征,提升复杂场景下的活动识别效果。

04:00
arXiv cs.CV

评估神经影像基础模型在非洲脑MRI上的泛化能力

非洲脑MRI测试中,四个神经影像基础模型冻结后仅输出多数类,端到端ViT3D最优(53.4%)。

04:00
arXiv cs.CV

InterHier:面向开放词汇目标检测的互联层次语义学习

提出以前置可学习上下文替代固定连接器,构建层次感知提示并对齐视觉文本嵌入,提升开放词汇目标检测性能。

04:00
arXiv cs.CV

U-PEN Mamba:面向高效视网膜血管分割的渐进扩展与选择性状态空间建模

提出U-PEN Mamba,融合渐进扩展与选择性状态空间建模,高效分割视网膜血管,mIoU领先。

04:00
arXiv cs.LG

“作为一个语言模型……”:聊天模板切换大语言模型的自我指涉口吻,激活引导可复现该效应

聊天模板切换LLM免责与体验口吻,激活方向可调控;模型自述受部署格式影响,非真实自我。

04:00
arXiv cs.LG

熵可流动,亦可引导。成为熵。LEDFlow:将熵引导的生成顺序引入均匀离散流

LEDFlow按局部熵自适应排序吸收,以熵引导均匀离散流生成顺序,免训练,提升推理、文生图与多模态理解且成本相近。

04:00
arXiv cs.AI

注意力作为路由图:单次前向传播的实时电路提取

将注意力视为单次前向的路由图,保留通向答案的少量路由;消融这些边比随机消融更伤模型,成本极低。

04:00
ArXiv AI

澄清并非纠正:大语言模型难以放下早期解读

模型在歧义未解时过早固化任务状态,后续澄清仅被当作补充上下文而无法推翻旧状态,编码任务尤甚。

04:00
arXiv cs.CL

ufakzeka-1:从零构建并评估一个1.51亿参数的土耳其语语言模型

从零训练1.51亿参数土耳其语模型,仅耗约286美元,公开构建、评测全过程与三项可迁移发现。

04:00
ArXiv AI

学习型企业数据理解:面向数据智能体的压缩与路由

提出潜在等价学习,分离任务身份与数据实现,以原型匹配与查询路由组织证据,在企业数据智能体基准居首。

04:00
arXiv cs.LG

大型语言模型的概率结构

概率视角统一大语言模型:自回归条件分布、最大似然训练、序贯模拟生成,并论KL不对称、幻觉与扩散生成。

04:00
arXiv cs.LG

Sheaf SyncMap:稳定的无监督持续分块

径向层束正则化稳定SyncMap分块动态,在多数CGCP图上NMI最优,且适应分布变化、避免负迁移。

04:00
arXiv cs.LG

联邦化量子与经典计算:一种隐私保护的混合方法

联邦学习助量子-经典混合模型无需集中原始数据隐私协作,SMPP准确率达0.8757且参数更少。

04:00
arXiv cs.CL

LLM驱动的免训练位置-属性协同融合:面向双源加密POI与LULC制图的闭环范式

提出LLM驱动免训练闭环方法,融合双源加密POI,协同优化位置与属性,实现高精度LULC制图。

04:00
arXiv cs.LG

揭示深度不平衡回归评估中的盲点

揭示深度不平衡回归评估三大盲点:基准偏图像、指标不完备、尾部稳定性未验证,并提出新基准与指标。

04:00
arXiv cs.CL

FrontierMath 埃尔德什

提出FME基准:68个截至2026年8月未解决的埃尔德什猜想,AI需在Lean中证明或证伪;每题预算300美元,GPT-6 Astra得3%,其余0%。

04:00
arXiv cs.LG

面向最大独立集的双GNN多级粗化

提出学习型欧氏TSP图边稀疏化GES,剪边超95%、大规模超99%,解间隙不足1%。

04:00
arXiv cs.AI

ZeroGate:面向受治理 AI 智能体运行时的信任保持快速路径

ZeroGate分离审批与本地准入,用短时通行证和原子nonce实现可审计快速路径,但非净加速。

04:00
arXiv cs.CL

ICDAR2026 多领域文档多模态推理竞赛

竞赛以文档VQA评测八领域文档理解,20份提交显示最强系统依赖结构化证据提取、检索、验证与多组件编排。

04:00
arXiv cs.LG

缓解扩散模型数据点遗忘中的顺序性重现

扩散数据点遗忘存在顺序重现失效模式,本文提出目标级评估协议,发现复现目标去噪损失几何更尖锐。

04:00
arXiv cs.AI

让智能体更一致:技能应为重复任务形成习惯

智能体重复任务不一致;提出技能习惯化:挖掘确定性技能门控复用,提升一致性、省词元,但错误亦稳定复现。

04:00
arXiv cs.CV

正样本对几何结构至关重要:面向视觉表征对比学习的最优传输方法

提出OTCLR框架,用最优传输生成几何一致的正样本,提升表征质量与迁移性能。

04:00
arXiv cs.LG

面向通用持续学习的脑启发层次模块化

受果蝇启发,提出层次模块化持续学习,轻量适配预训练模型,在线数据流显著提升,具身操作增益超50点。

04:00
arXiv cs.CL

自清洁却仍被捕获:智能体向自身写入的存储中错误的一个实测原语,以及分数下降实际衡量什么

智能体自我写入存储的错误受硬上界约束呈双模式,单一无参原语预测漂移;规模不能避免捕获,分数下降衡量可区分性。

04:00
arXiv cs.CV

弥合重建与生成:评估与改进的潜在分布视角

重建与生成潜分布不匹配;提出GAR轨迹诊断,与gFID强相关,并借中间潜变量适配解码器以提升生成质量。

04:00
arXiv cs.AI

使用 Wiki LLM 索引提升机器学习课堂学习效果的潜力

对比同一课程语料,LLM 编译的维基索引在跨单元概念关联上明显优于向量 RAG,且可溯源引用。

04:00
arXiv cs.AI

从装饰性到承重性:任务难度塑造思维链的因果作用

思维链的承重性随任务难度变化:简单任务被绕过,困难任务中错误逐步传播,为思维链监督带来结构性挑战。

04:00
arXiv cs.CL

ChainDoRA:面向参数高效大语言模型微调的张量列分解式权重分解低秩适应

ChainDoRA以张量列链构建方向低秩因子,仅5.35M参数即在七项常识推理任务上达72.30%平均准确率,较DoRA减参90.62%。

04:00
arXiv cs.LG

基于增广拉格朗日学习数据驱动系统的神经反馈线性化

提出数据驱动反馈线性化框架,将相对度条件融入学习,以神经李导数替代控制器,并验证闭环稳定性与直流电机效果。

04:00
arXiv cs.AI

鲁棒失败,保守修复:从跨模型失败中进行文本知识蒸馏

提出RFCR蒸馏法,从跨模型失败中提取规则并收紧适用边界,在BBH上准确率提升2.75个百分点。

04:00
arXiv cs.AI

异构批处理的高效迭代检索

Orthrus在统一推理循环中异构批处理嵌入与生成,吞吐提升1.28–4.52倍,p99延迟降55.8%。

04:00
arXiv cs.CV

A²Safe:面向安全有效视觉问答的反事实证据对齐自适应智能体协作

提出A²Safe,通过反事实证据对齐与自适应智能体协作,实现安全有效的视觉问答。

04:00
arXiv cs.CL

LatentPort:超越 KV 缓存——混合语言模型中循环记忆的跨模型迁移:无需目标前缀重放的 4B 到 9B 混合状态交接

实现4B到9B混合模型无需目标前缀重放的循环状态跨模型交接;加入GDN状态降损,校正后近原生9B。

04:00
arXiv cs.CV

HDND:面向非侵入式脑记录多语言单词/字符检索的分层动态神经解码

提出HDND分层动态解码框架,融合神经表征、语义预测与字符目标,在多语言EEG/MEG词检索中多数优于基线。

04:00
arXiv cs.CL

MoM:记忆的记忆

提出MoM及P-Mem图:写入即提交当前值并保留被替换历史,提升有效性、减少过期答案并可恢复错误。

04:00
arXiv cs.AI

从离线代理到在线决策:对话式AI的分层参与度评估框架

提出分层离线代理框架,可实验前预测对话AI在线参与度;冻结后113组F1达81.1%,原始仅34.3%,无误判。

04:00
arXiv cs.CL

Understanding Reliability in LLM-based Human Behavior Simulation

04:00
arXiv cs.CV

面向零样本脑到图像检索的自适应皮层约束脑电-视觉对齐

提出自适应皮层约束脑电-视觉对齐,以ROI源模式与证据加权监督提升零样本脑-图像检索。