全部OpenAIHugging FaceArXiv AIGoogle AIVentureBeat AIMarkTechPostPragmatic EngineerThe GradientOne Useful ThingCrunchbase NewsTechCrunchGoogle DeepMindMicrosoft ResearchLlamaIndex BlogarXiv cs.AIarXiv cs.LGarXiv cs.CLarXiv cs.CVNature Machine IntelligenceLilian WengAndrej KarpathySebastian RuderBAIR BlogAgile Lab EngineeringGoogle AI BlogMeta NewsroomMIT Tech Review AITechCrunch AIWiredFull-Stack AI EngineerAgentplexa16zSequoia CapitalY CombinatorElad GilTomasz TunguzNot BoringThe GeneralistSimon WillisonSimon Willison NewsletterLatent SpaceImport AIInterconnectsHamel HusainDAIR.AIEnterprise AI GovernanceStratecherySemiAnalysisBenedict EvansX @OpenAIX @claudeaiX @AnthropicAIX @karpathyX @samaX @demishassabisX @DarioAmodeiX @elonmuskX @miramuratiX @ilyasutX @gdbX @AravSrinivasX @arthurmenschX @ClementDelangueX @alexandr_wangX @mustafasuleymanX @ylecunX @geoffreyhintonX @AndrewYNgX @fcholletX @polynoamialX @_jasonweiX @DrJimFanX @rasbtX @lilianwengX @OriolVinyalsMLX @tri_daoX @percyliangX @ch402X @janleikeX @swyxX @simonwX @jeremyphowardX @OfficialLoganKX @svpinoX @SuhailX @emollickX @_akhaliqX @natolambertX @rowancheungX @bilawalsidhuX @Francis_YAO_X @ShunyuYao14X @tqchenmlX @haozhangmlX @GoogleDeepMindX @huggingfaceX @MistralAIX @perplexity_aiX @NVIDIAAIX @xaiX @victor207755822X @deepseek_aiX @bchernyX @Alibaba_QwenX @Kimi_MoonshotX @dotey
9796 条条目 · 106 个活跃源
2026年9月11日
04:00
arXiv cs.CL
A Voice-Interactive Multi-Agent System for Smart Operating Rooms: Architecture Design and Key Technologies
04:00
arXiv cs.CL
Xiaomi-CocktailASR-1 Technical Report
04:00
arXiv cs.CL
VikingRAG: Accurate and Token-efficient Retrieval-augmented Generation over Structured Documents
04:00
arXiv cs.CL
A Short Survey of Viewing Large Language Models in Legal Aspect
04:00
arXiv cs.CL
SpecGuard: Inference-Time Backdoor Detection For Free
04:00
arXiv cs.CL
RetroThinker: Enabling Retrospective Thinking in Speech LLMs
04:00
arXiv cs.CL
A Unified Per-Token Gating Family for On-Policy Distillation: FKL/RKL Mixing with Multi-Channel and Bias Coefficients
04:00
arXiv cs.CL
Biology-in-the-loop: Amortized Adaptive Hit Discovery in CRISPR Screens
04:00
arXiv cs.CL
MindTopo: Can Foundation Models Reason in Topological Space?
04:00
arXiv cs.CL
SIRF: A Spec-Internalized Risk Foundation Model for Industrial Content Risk Control
04:00
arXiv cs.CL
Whisper-Based Speech Transcription from Videos Across Multiple Languages for Cross-Cultural Understanding
04:00
arXiv cs.CL
Do Vision-Language Models Understand Visual Persuasiveness? A Diagnosis via Visual Persuasive Factors
04:00
arXiv cs.CL
Streaming Translation and Transcription Through Speech-to-Text Causal Alignment
04:00
arXiv cs.CL
"Mirror" Large Language Model Evaluations of Depression are Criterion Contaminated
04:00
arXiv cs.CL
Narrative Consolidation: Formulating a New Task for Unifying Multi-Perspective Accounts
04:00
arXiv cs.CL
Towards Reliable Medical LLMs: Benchmarking and Enhancing Confidence Estimation of Large Language Models in Medical Consultation
04:00
arXiv cs.CL
DeepResearch Bench II: Diagnosing Deep Research Agents via Rubrics from Expert Reports
04:00
arXiv cs.CL
What Language is This? Ask Your Tokenizer
04:00
arXiv cs.CL
CHRONOBERG: Capturing Language Evolution and Temporal Awareness in Foundation Models
04:00
arXiv cs.CL
The PIMMUR Principles: Ensuring Validity in Collective Behavior of LLM Societies
04:00
arXiv cs.CL
Leveraging LLMs for Context-Aware Implicit Textual and Multimodal Hate Speech Detection
04:00
arXiv cs.CL
Evaluating LLM-Simulated Conversations in Modeling Inconsistent and Uncollaborative Behaviors in Human Social Interaction
04:00
arXiv cs.CL
Alignment Reduces Expressed but Not Encoded Gender Bias: A Unified Framework and Study
04:00
arXiv cs.CL
Limitations of Automated Simulatability: LLM Simulators Can Bypass Explanations
04:00
arXiv cs.CL
A Recipe for Long-Context Reasoning in Large Language Models via On-Policy Optimization and Distillation
04:00
arXiv cs.CL
Perturbation: A simple and efficient adversarial tracer for representation learning in language models
04:00
arXiv cs.CL
Analyzing LLM Reasoning to Uncover Mental Health Stigma
04:00
arXiv cs.CL
Predicting Startup Exit from Textual Descriptors - A Computational Linguistics Framework
04:00
arXiv cs.CL
Timing is Everything: Temporal Scaffolding of Semantic Surprise in Humor
04:00
arXiv cs.CL
Continuous Diffusion Scales Competitively with Discrete Diffusion for Language
04:00
arXiv cs.CL
Unadapted Multilingual ASR on a Garrusi Kurdish Evaluation Set: A Common-Reference Staged Normalization Analysis
04:00
arXiv cs.CL
Emergent Risks in Generative Multi-Agent Systems
04:00
arXiv cs.CL
MisEdu-RAG: A Misconception-Aware Dual-Hypergraph RAG for Novice Math Teachers
04:00
arXiv cs.CL
Cognitive Digital Twins: Ethical Risks and Governance for AI Systems That Model the Mind
04:00
arXiv cs.CL
Learning to Think Like a Cartoon Captionist: Incongruity-Resolution Supervision for Multimodal Humor Understanding
04:00
arXiv cs.CL
Formalizing building-up constructions of self-dual codes through isotropic lines in Lean
04:00
arXiv cs.CL
Strategic Type Spaces
04:00
arXiv cs.CL
Beyond Prompting: Efficient and Robust Contextual Biasing for Speech LLMs via Logit-Space Integration (LOGIC)
04:00
arXiv cs.CL
Output Embedding Centering for Stable LLM Pretraining
04:00
arXiv cs.CL
Mapping Seven Decades of Philosophy in Colombia: Dynamic Topic Modelling of Ideas y Valores
04:00
arXiv cs.CL
OpenResearcher: A Fully Open Pipeline for Long-Horizon Deep Research Trajectory Synthesis
04:00
arXiv cs.CL
LLM-Ideoplasticity: Measuring Ideological Plasticity in the Political Behavior of LLMs as a Context-Conditioned Distribution
04:00
arXiv cs.CL
Progressive Agent Skill Generation via Reinforcement Learning
04:00
arXiv cs.CL
A Group-Based Resource Allocation Model for the Fractional Knapsack Problem
2026年9月10日
04:00
arXiv cs.CL
X-CoSD:通信高效的跨词表协作式投机解码
提出跨词表协作投机解码框架X-CoSD,通过混合重采样降低通信,保持无损并加速生成。
04:00
arXiv cs.CL
TEFM:面向结构化数据的词元高效忠实建模
TEFM将结构化观测压缩为行为代码词元,以双保真目标实现忠实推理,临床词元仅需1%。
04:00
arXiv cs.CL
如果LLM不相信输入数据,会犯更多错误吗?
研究发现,LLM对上下文的忠实度受其可信度判断影响很弱,反事实输入仅略降低忠实度。
04:00
arXiv cs.CL
StochBench:面向 Lean 中随机过程的领域专用基准
StochBench:450 道 Lean 4 随机过程研究生题,涵盖马尔可夫链、鞅、布朗运动,证明率仅 34.9%。
04:00
arXiv cs.CL
Osprey:目标无关预训练让投机解码中的草稿模型更强
Osprey以现成小模型做目标无关预训练与轻量适配,显著提升投机解码跨目标接受长度。
04:00
arXiv cs.CL
印度母婴护理的可审计急诊分诊
将分诊拆为LLM症状提取与确定性规则引擎,提升召回和可审计性,已处理逾15万咨询。