Instant research discovery
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Towards Hierarchical Structure Understanding of Newspaper Images Cl茅ment Chatelain, Merveilles Agbeti-Messan, Pierrick Tranouez, S茅bastien Cretin Published: 2026-07-16Area: cs.CVCitations: - Tags: ai-safety, cscv, preprint | 2026-07-16 | cs.CV | ai-safety, cscv, preprint | E8 / R8 (90%) | - |
| VideoSEMA: a scalable and efficient Mamba-like attention for video understanding Fanghui Xue, Jack Xin, Jiancheng Lyu, Nhat Thanh Tran Published: 2026-07-16Area: cs.CVCitations: 15 Tags: ai-safety, cscv, preprint | 2026-07-16 | cs.CV | ai-safety, cscv, preprint | E8 / R7 (92%) | 15 |
| VideoSEMA: a scalable and efficient Mamba-like attention for video understanding Fanghui Xue andShuai Zhang, Jack Xin, Jiancheng Lyu, Nhat Thanh Tran Published: 2026-07-16Area: cs.CVCitations: - Tags: ai-safety, cscv, preprint | 2026-07-16 | cs.CV | ai-safety, cscv, preprint | E10 / R9 (95%) | - |
| VTM-Nav: Hierarchical Visual-Topological Memory for Cross-Episode Object-Goal Navigation Changsheng Xu, Tianyu Xue, Xiaoran Xu, Xiaoshan Yang Published: 2026-07-16Area: cs.CVCitations: - Tags: ai-safety, cscv, preprint | 2026-07-16 | cs.CV | ai-safety, cscv, preprint | E11 / R10 (95%) | - |
| Anatomically Faithful but Temporally Blind: Auditing Attribution for Left-Ventricular Ejection-Fraction Estimation from Echocardiography Hyunkyung Han, Min Jung Kim Published: 2026-07-15Area: cs.CVCitations: - Tags: ai-safety, cscv, preprint | 2026-07-15 | cs.CV | ai-safety, cscv, preprint | E13 / R15 (94%) | - |
| Barnamala: Parameter-Efficient Handwritten Devanagari Recognition at Benchmark Saturation Ashish Thapa, Samrat Karki Published: 2026-07-15Area: cs.CVCitations: - Tags: ai-safety, cscv, preprint | 2026-07-15 | cs.CV | ai-safety, cscv, preprint | E9 / R8 (95%) | - |
| Beyond Color Geometry: Evaluating Human-Like Color Representations in Vision Models Ayan Igali, Pakizar Shamoi Published: 2026-07-15Area: cs.CVCitations: - Tags: ai-safety, cscv, preprint | 2026-07-15 | cs.CV | ai-safety, cscv, preprint | E14 / R8 (90%) | - |
| Beyond scalar losses: calibrating segmentation models via gradient vector field surgery Alexander H. Berger, Daniel R眉ckert, Johannes C. Paetzold, Laurin Lux Published: 2026-07-15Area: cs.CVCitations: - Tags: ai-safety, cscv, preprint | 2026-07-15 | cs.CV | ai-safety, cscv, preprint | E8 / R7 (92%) | - |
| GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding Han Fang, Hao Li, Hao Sun, Hongbo Sun Published: 2026-07-15Area: cs.CVCitations: 65 Tags: ai-safety, cscv, preprint | 2026-07-15 | cs.CV | ai-safety, cscv, preprint | E13 / R14 (93%) | 65 |
| GHR-VLM: Making Zero-Shot Transit Video Analytics Realizable with Grounded Hybrid Reasoning Kaicong Huang, Ruimin Ke, Weiheng Oh Published: 2026-07-15Area: cs.CVCitations: - Tags: ai-safety, cscv, preprint | 2026-07-15 | cs.CV | ai-safety, cscv, preprint | E10 / R8 (91%) | - |
| GHR-VLM: Making Zero-Shot Transit Video Analytics Realizable with Grounded Hybrid Reasoning Jack M. Reilly, Kaicong Huang, Ruimin Ke, Thomas Guggisberg Published: 2026-07-15Area: cs.CVCitations: - Tags: ai-safety, cscv, preprint | 2026-07-15 | cs.CV | ai-safety, cscv, preprint | E10 / R8 (93%) | - |
| GMoT: Gated Motion-Aware Tokenization for Fine-Grained Micro-Gesture Video Reasoning with Multimodal LLMs Hui Ma, Jiayu Zhang, Taorui Wang, Wei Xia Published: 2026-07-15Area: cs.CVCitations: 15 Tags: ai-safety, cscv, preprint | 2026-07-15 | cs.CV | ai-safety, cscv, preprint | E9 / R8 (92%) | 15 |
| Groc-PO: Grounded Context Preference Optimization for Truthful Multimodal LLMs Chunxiao Liu, Dongming Zhang, Zhendong Mao, Zheren Fu Published: 2026-07-15Area: cs.CVCitations: - Tags: ai-safety, cscv, preprint | 2026-07-15 | cs.CV | ai-safety, cscv, preprint | E8 / R5 (92%) | - |
| Human4K: A Large-Scale 4K Multi-View Mocap Dataset for Whole-Body 3D Human Reconstruction Ajian Liu, Benjia Zhou, Hugo Jair Escalante, Jun Wan Published: 2026-07-15Area: cs.CVCitations: - Tags: ai-safety, cscv, preprint | 2026-07-15 | cs.CV | ai-safety, cscv, preprint | E10 / R14 (96%) | - |
| Monte Carlo Dropout Uncertainty and Entropy-Thresholded Selective Prediction for Architecture-Agnostic Brain Tumor MRI Triage Medhansh Sharma Published: 2026-07-15Area: cs.CVCitations: - Tags: ai-safety, cscv, preprint | 2026-07-15 | cs.CV | ai-safety, cscv, preprint | E12 / R9 (91%) | - |
| Multi-Expert Routing for Multi-Domain Low-Resource OCR: A Manchu Case Study Chih-wen Kuo, Jiqiao Ma, Zhan Chen Published: 2026-07-15Area: cs.CVCitations: - Tags: ai-safety, cscv, preprint | 2026-07-15 | cs.CV | ai-safety, cscv, preprint | E10 / R9 (93%) | - |
| Multimodal Assessment of Pancreatic Cancer Resectability Using Deep Learning Anas Taha, Beat Mueller, Christian Andreas Nebiker, Christoph Kuemmerli Published: 2026-07-15Area: cs.CVCitations: - Tags: ai-safety, cscv, preprint | 2026-07-15 | cs.CV | ai-safety, cscv, preprint | E7 / R6 (94%) | - |
| Music-to-Dance Generation via Atomic Movements Minghang Zheng, Qingchao Chen, Song-chun Zhu, Xinhao Cai Published: 2026-07-15Area: cs.CVCitations: - Tags: ai-safety, cscv, preprint | 2026-07-15 | cs.CV | ai-safety, cscv, preprint | E9 / R8 (90%) | - |
| OvisOCR2 Technical Report An-Yang Ji, Cheng Qin, En Lin, Haijun Li Published: 2026-07-15Area: cs.CVCitations: 13 Tags: ai-safety, cscv, preprint | 2026-07-15 | cs.CV | ai-safety, cscv, preprint | E10 / R14 (95%) | 13 |
| ScanFocus: A Coarse-to-Fine Framework for Spatio-Temporal Video Grounding Kai Chen, Ming Dai, Wankou Yang, Wenxuan Cheng Published: 2026-07-15Area: cs.CVCitations: - Tags: ai-safety, cscv, preprint | 2026-07-15 | cs.CV | ai-safety, cscv, preprint | E8 / R8 (92%) | - |
| SeeSE3: Emergence of 3D Space in Vision Features Caroline Chen, Fedor Kitashov, Leonidas Guibas, Maks Ovsjanikov Published: 2026-07-15Area: cs.CVCitations: - Tags: ai-safety, cscv, preprint | 2026-07-15 | cs.CV | ai-safety, cscv, preprint | E8 / R6 (91%) | - |
| Symbiosis-Inspired Knowledge Distillation for Incremental Object Detection De Cheng, Huaijie Wang, Mingyue Zeng, Nannan Wang Published: 2026-07-15Area: cs.CVCitations: 15 Tags: ai-safety, cscv, preprint | 2026-07-15 | cs.CV | ai-safety, cscv, preprint | E8 / R8 (91%) | 15 |
| Unleashing Multimodal Large Language Models for Training-free HOI Detection in the Wild Jialin Liu, Ting Lei, Yang Liu, Yuxin Peng Published: 2026-07-15Area: cs.CVCitations: - Tags: ai-safety, cscv, preprint | 2026-07-15 | cs.CV | ai-safety, cscv, preprint | E7 / R7 (94%) | - |
| Accuracy Without Grounding: Diagnosing Visual Dependency Dissociation in Video LLM Benchmarks Jae Joong Lee Published: 2026-07-14Area: cs.CVCitations: - Tags: ai-safety, cscv, preprint | 2026-07-14 | cs.CV | ai-safety, cscv, preprint | E10 / R6 (94%) | - |
| ARDepth: Auto-regressive Monocular Depth Estimation with Progressive Visual Conditioning Guanbin Li, Weikai Chen, Weiming Zhang, Wei Zhang Published: 2026-07-14Area: cs.CVCitations: - Tags: ai-safety, cscv, preprint | 2026-07-14 | cs.CV | ai-safety, cscv, preprint | E7 / R7 (96%) | - |
| Boogu-Image-0.1: Boosting Open Agentic Multimodal Generation via Understanding under a Minimal Budget Binxiao Huang, Bin Zou, Bowen Dong, Bowen Zheng Published: 2026-07-14Area: cs.CVCitations: - Tags: ai-safety, cscv, preprint | 2026-07-14 | cs.CV | ai-safety, cscv, preprint | E8 / R6 (93%) | - |
| Boogu-Image-0.1: Boosting Open-Source Unified Multimodal Understanding and Generation Binxiao Huang, Bin Zou, Bowen Dong, Bowen Zheng Published: 2026-07-14Area: cs.CVCitations: 145 Tags: ai-safety, cscv, preprint | 2026-07-14 | cs.CV | ai-safety, cscv, preprint | E10 / R9 (92%) | 145 |
| Continuously Evolving Deepfake Detection: An Architecture and Public-Benchmark Evaluation of a Dynamic Detection System Dylan Uys, Ken Jon Miyachi Published: 2026-07-14Area: cs.CVCitations: - Tags: ai-safety, cscv, preprint, safety-evaluation | 2026-07-14 | cs.CV | ai-safety, cscv, preprint, safety-evaluation | E14 / R12 (91%) | - |
| DAUPNet: Domain-Aware Uncertainty Modeling for Reliable Prototype Discrimination in Cross-Domain Few-Shot Semantic Segmentation Jingyi Wen, Lei Yuan, Pengxing Yi, Zhongxu Hu Published: 2026-07-14Area: cs.CVCitations: - Tags: ai-safety, cscv, preprint | 2026-07-14 | cs.CV | ai-safety, cscv, preprint | E13 / R13 (90%) | - |
| Demonstration of the common dual-channel feature decoupling characteristic of front-door mediation causal inference methods in whole-slice image classification Dayu Hu, Tianhang Nan, Xiaoyu Cui, Yong Ding Published: 2026-07-14Area: cs.CVCitations: - Tags: ai-safety, cscv, preprint | 2026-07-14 | cs.CV | ai-safety, cscv, preprint | E10 / R7 (92%) | - |