62171 条条目 · 106 个活跃源
2026年9月26日
04:00
arXiv cs.CV

ToCo-Mesh: Topology-Consistent Dynamic Mesh Reconstruction via Adaptive Tessellation and Surface-Aligned 2DGS

04:00
arXiv cs.CV

CatSIM: A Categorical Image Similarity Metric

04:00
arXiv cs.CV

BeyondRetarget: Learning Executable Humanoid Motions Directly from Monocular Video

04:00
arXiv cs.LG

Stochastic Inertial Krasnosel'skii-Mann Iteration Achieves Near-Optimal Sample Complexity

04:00
arXiv cs.LG

Sequential Confidence Sets for Coverage-Constrained Conformal Model Selection

04:00
arXiv cs.LG

An Exposition of GPT Astra's Proof of Lower Bound on DP Continual Counting

04:00
arXiv cs.CV

It's the Geometry, Not the Model: Effective Rank and Subspace Alignment in Functional Connectivity Classification

04:00
arXiv cs.CV

M3GD: Multi-Modal Multi-View Geometric Diffusion for Camera--LiDAR Novel View Synthesis

04:00
arXiv cs.LG

Algebraic Expressivity Certificates for Shallow Polynomial Neural Networks

04:00
arXiv cs.CV

Self-Adaptive VLA for Robust Robot Deployment

04:00
arXiv cs.LG

BRFID: Toward Byzantine-Robust Federated Intrusion Detection

04:00
arXiv cs.LG

An Order-Theoretic Characterization of Consistent Inductive Inference

04:00
arXiv cs.CV

Rolling-WAM: World Action Models with Rolling Imagination

04:00
arXiv cs.CV

RAPID: Robot Agentic Programming from Demonstrations

04:00
arXiv cs.LG

Don't Read the Log: Execution Traces Contaminate Verifiers in Video-Generation Agents

04:00
arXiv cs.LG

Matrix Aggregation Operators

04:00
arXiv cs.LG

Exact Bayes Regret and Asymptotic Optimality in High-Dimensional Gaussian Bandits

04:00
arXiv cs.LG

HClimRep-Ocean: A Global Ocean Emulator on an Unstructured Mesh

04:00
arXiv cs.CV

Match4Annotate: Cross-Video Annotation Transfer in Ultrasound via Implicit Feature Flow-Guided Matching

04:00
arXiv cs.CV

Band-Attention Modulation Network for Robust Face Forgery Detection

04:00
arXiv cs.CV

Cross-Task Generalization in Handwriting-Based Alzheimer's Screening via Vision Language Adaptation

04:00
arXiv cs.LG

When Fancy Eviction Fails: Rethinking Cache Replacement For LLM Prefix Reuse

04:00
arXiv cs.LG

CrossSafe: Towards Cross-Embodiment Latent Safety Filters

04:00
arXiv cs.LG

Unmasking Shortcut Learning in IoT Intrusion Detection: A Forensic, Multi-Paradigm Evaluation of Feature Dependence and Data Leakage

04:00
arXiv cs.CV

Interpretable Similarity of Synthetic Image Utility

04:00
arXiv cs.CV

OncoVision: Integrating Mammography and Clinical Data through Attention-Driven Multimodal AI for Enhanced Breast Cancer Diagnosis

04:00
arXiv cs.LG

Selective Inference for Deep Clustering in Latent Spaces

04:00
arXiv cs.LG

Uncertainty-Gated Exploration Noise Suppresses Task Collapse in Online RL Fine-Tuning of a Flow-Matching Vision-Language-Action Policy

04:00
arXiv cs.LG

Physics-Guided Multi-Objective Deep Learning for Ultrasound RF Data Interpolation in Resource-Constrained Imaging

04:00
arXiv cs.CV

Comparing YOLOv11 and YOLOv8 for instance segmentation of occluded and non-occluded immature green fruits in complex orchard environment

04:00
arXiv cs.CV

LeafTrackNet: A Deep Learning Framework for Robust Leaf Tracking in Top-Down Plant Phenotyping

04:00
arXiv cs.CV

MDE-VIO: Enhancing Visual-Inertial Odometry Using Learned Depth Priors

04:00
arXiv cs.LG

Automatic Harness Evolution for Hardware Design Verification: Can LLMs Consolidate Gains Across Discovered Harnesses?

04:00
arXiv cs.LG

GeoDose-CP: Graph-Local Conformal Inference for Continuous-Treatment Earth Observation

04:00
arXiv cs.LG

Why Does Misinformation Propagate Faster? An Algorithmic Perspective on X

04:00
arXiv cs.CV

WaterClear-GS: Optical-Aware Gaussian Splatting for Underwater Reconstruction and Restoration

04:00
arXiv cs.CV

Context-aware Skin Cancer Epithelial Cell Classification with Scalable Graph Transformers

04:00
arXiv cs.LG

Same Bit Width, Different Outcomes: Post-Training Quantization of Text-to-Speech Across Architectures

04:00
arXiv cs.CV

One View Is Enough: In-the-Wild Monocular Pretraining for Novel View Generation

04:00
arXiv cs.CV

GeoBlur: Epipolar Geometry Estimation from a Single Motion-Blurred Image

04:00
arXiv cs.CV

SOV-CAD: Stepwise Orthographic Views Guided CAD Modeling Sequence Reconstruction

04:00
arXiv cs.CV

OptiSAR-Net++: A Large-Scale Benchmark and Transformer-Free Framework for Cross-Domain Remote Sensing Visual Grounding

04:00
arXiv cs.CV

Open-access model for detecting openly dumped dispersed municipal solid waste from crowdsourced UAV imagery in Sub-Saharan Africa

04:00
arXiv cs.CV

Structured 3D Latents Are Surprisingly Powerful: Unleashing Generalizable Style with 2D Diffusion

04:00
arXiv cs.LG

Paging the Experts: A Reproducible Characterization of Flash-Backed MoE Inference on iPhone

04:00
arXiv cs.LG

EvoTreeNAD: Genealogy-Guided Evolution for LLM-Driven Neural Architecture Discovery

04:00
arXiv cs.LG

AFT Neural Function Approximators for 1D Nonlinear Force Laws

04:00
arXiv cs.CV

BARRIER: Bounded Activation Regions for Robust Information Erasure

04:00
arXiv cs.CV

A Multimodal 3D Foundation Model for Light Sheet Fluorescence Microscopy Enables Few-Shot Segmentation, Classification, and Deblurring

04:00
arXiv cs.CV

Breaking Failure Cascades: Step-Aware Reinforcement Learning for Medical Multimodal Reasoning