5788 条条目 · 106 个活跃源
2026年9月14日
04:00
ArXiv AI

重新思考面向次二次注意力的异构系统解耦

提出SQD异构解耦,按二次/次二次注意力拆分解码,大幅提升吞吐与能效,吞吐最高3.6倍。

04:00
ArXiv AI

SoulAuth:面向人类与长期存续 AI 行动者的行动者原生身份架构及 Rust 参考实现

提出SoulAuth架构及Rust实现:人类与长期AI行动者为一等身份主体,认证与授权分离;v0.1.0评估仅部分符合。

04:00
ArXiv AI

Who Pays for Open Review? Visible Author Reputation and Its Effect on Ratings

04:00
ArXiv AI

评估临床医生对非机构AI工具的使用情况

44名临床医生中43人使用非机构AI工具,涵盖行政、临床、科研及诊断支持等高风险任务,安全整合亟待研究。

04:00
ArXiv AI

基于神经哈密顿常微分方程持续学习小天体周围的引力场不规则性

以神经哈密顿ODE从跟踪数据持续学习小天体引力场,着陆中位误差4.6米,并可与球谐互补。

04:00
ArXiv AI

面向具身智能的通用世界模型模拟器 Pelican-Sim 1.0

提出通用世界模型模拟器Pelican-Sim 1.0,统一动作表示与稀疏MoE,四步生成提速5.67倍,下游策略成功率由70%升至93%。

04:00
ArXiv AI

现代霍普菲尔德模型中的分层原型涌现

研究多项式激活霍普菲尔德网络的分层记忆,推导各层局部稳定条件;原型重建泛化仅需准多项式信息,Fashion-MNIST呈类似相图。

04:00
ArXiv AI

Neural Multichannel Distant Speaker Diarization with Heavy-tailed Source Separation Model

04:00
ArXiv AI

氧化物半导体晶体管的智能体式TCAD校准工作流

首个底栅In-W-O晶体管的智能体TCAD校准流程:LLM编排、Sentaurus计算,5次更新使目标降14.3倍,并验证跨偏压与尺寸可迁移。

04:00
ArXiv AI

NDT工厂:通过多智能体LLM从语义模型合成经验证的网络数字孪生

多智能体LLM从语义模型按需合成可执行网络数字孪生,CAC案例编译测试全通过,决策一致率99.3%。

04:00
ArXiv AI

面向科学代码理解的检索增强生成

科学代码理解RAG:离线解析与在线问答分离,9B小模型均分0.795超大模型,可本地隐私部署。

04:00
ArXiv AI

RF-VoID:基于窄带射频表征学习的带宽高效外墙瓷砖空鼓检测

直接判别窄带复响应,0.5GHz带宽下准确率达98.61%,较全扫频降低72倍,无需距离像重建。

04:00
ArXiv AI

DriftSE:基于生成式漂移的语音增强

提出DriftSE一步生成语音增强,双潜变量漂移兼顾清晰与保真,支持无配对训练,1步推理达SOTA。

04:00
ArXiv AI

推荐检索器需要验证器:面向序列推荐的通用生成式重排序

提出轻量生成式验证器,无需重训检索器,对top-K候选重排序,提升多种模型Recall@10。

04:00
ArXiv AI

线性指数二次高斯协方差转向

研究连续时间有限时域LEQG协方差转向,解释为风险敏感薛定谔桥,最优控制器无闭式,并证局部解存在唯一。

04:00
ArXiv AI

先参与,后演进:可信企业数字孪生工程愿景

提出“先参与后演进”范式:先用原型快速争取利益相关者认同,再演进至联邦互操作,并与米其林合作验证。

04:00
ArXiv AI

GraphAHA:面向测试时代码生成的基于图的异构动作自适应搜索

以类型有向无环图合并等价程序复用统计,层次汤普森采样自适应选择采样、推理、实现、修复等异构动作。

04:00
ArXiv AI

4D并行解锁用于高保真大气建模的百亿亿级贝叶斯神经网络

首个0.25°全球贝叶斯Swin大气预报模型,以4D并行实现超算级训练,可量化不确定性并精准预报极端天气。

04:00
ArXiv AI

评估本地可部署小型语言模型在网络安全CTF任务中的上下文分割

提出上下文分割框架,隔离复杂CTF子任务;以高token效率解决标准执行失败的18.52%任务。

04:00
ArXiv AI

基于图的方法:将内核级遥测数据映射至 MITRE ATT&CK

提出Trace2ATT&CK:用eBPF采集内核事件构建溯源图,结合LLM与RAG映射ATT&CK,本地推理效果更优。

04:00
ArXiv AI

通过构造实现舒适性:面向学习型驾驶策略的自适应舒适度约束动作空间

提出自适应动作参数化,每步重划网格以覆盖可行控制集,闭式反演横向加加速度约束,舒适违规率低于1%。

04:00
ArXiv AI

SeqMoE:通过预测式与图兼容的 MoE 卸载迈向全载性能

以序列预测专家激活、联合预取调度、预测缓存与图兼容运行时,45%常驻下命中率96.97%、性能达全载80.22%。

04:00
ArXiv AI

Dynin-Robotics:全模态统一扩散视觉-语言-动作模型

以共享轨迹建模统一扩散VLA,融合目标与动态预测,经130万条轨迹预训练,提升指令泛化与真实机器人操控成功率。

04:00
ArXiv AI

保护你的分数:具有差分隐私保证的接触者追踪

针对风险分数泄露引发的隐私攻击,提出具有差分隐私保证的接触者追踪算法,在模拟中感染率降低两至十倍。

04:00
ArXiv AI

技能图谱:面向海量智能体技能的依赖感知结构化检索

GoS离线构建可执行技能图,以依赖感知检索选取有界技能包,降低token成本并提升奖励。

2026年9月12日
04:00
ArXiv AI

Finishing the Task Is Not Enough: Evaluating Agent Resilience and Considerate Participation under Accumulating Challenge

04:00
ArXiv AI

The Agent Incident Registry: Toward Preventing Repeated AI Agent Failures

04:00
ArXiv AI

Decoupling Readiness from Release for Tail-Aware Scheduling of Agentic LLM Workflows

04:00
ArXiv AI

When Validation Stops Learning: Auditing Update Admission for Continual Embodied Agents

04:00
ArXiv AI

Demystifying the Privacy-Utility Trade-off in LLM Interactions

04:00
ArXiv AI

Defining AI Agents: A Compendium of Criteria, Metrics, and Benchmarks

04:00
ArXiv AI

Fork Where the Model Changes Its Mind: Belief-Shift Branching for Tree-Structured Reinforcement Learning

04:00
ArXiv AI

Benchmark Radar: A Living Database and Search Engine for AI Benchmarks and Evaluation

04:00
ArXiv AI

NovGauge: A Fine-Grained Benchmark for Diagnosing LLMs' Capability in Paper Novelty Assessment

04:00
ArXiv AI

Generating a Consistent Enterprise: Synthesis and Reference-Free Evaluation of Multi-System Business Data

04:00
ArXiv AI

Sci-MMR: Benchmarking Multi-Step Evidence-Grounded Scientific Reasoning in Multimodal Agents

04:00
ArXiv AI

Exploring Diffusion Transformers for Cross-Modal Augmentation in Multimodal Brain State Decoding

04:00
ArXiv AI

AI Exposure and AI Resilience: A Two-Dimensional Assessment Framework for Software and Software-Based Business Model

04:00
ArXiv AI

Magenta: Closing the Loop Between Mathematical Reasoning and Lean Verification

04:00
ArXiv AI

Portable Semantics, Private Dialects: Reuse and Negative Transfer in Latent Communication Between Language-Model Cells

04:00
ArXiv AI

RAMamba-Net: A Reliability-Aware and Mamba-Based Multimodal Fusion Network for Auditory Attention Detection

04:00
ArXiv AI

From Queries to Narratives: Cultural Heritage Data Stories for Knowledge Graph Exploration and Quality Assessment

04:00
ArXiv AI

LLMs as Post-hoc Auditors of Physiological Plausibility in Symbolic Regression: A Clinician-Evaluated Case Study

04:00
ArXiv AI

Calibration-Aware Uncertainty Cascades for Efficient Heterogeneous Model Collaboration

04:00
ArXiv AI

Distributed Optimization of Modular Production Systems using Model-based Reinforcement Learning with Inverse Models

04:00
ArXiv AI

The Convention Gap: Towards Measuring Implicit Communication in Cooperative AI Evaluation

04:00
ArXiv AI

Extending SMT Solving with Non-Ground Clause Learning

04:00
ArXiv AI

Prompt Revision as a Source of Cultural Bias in Text-to-Image Systems

04:00
ArXiv AI

Lightweight LiDAR-Based Cone Detection Framework Using Random Forest for Formula Student Driverless

04:00
ArXiv AI

From Document Silos to Process Intelligence: A Multi-Layer Knowledge Graph for CMC Process Development