Skip to content
AI Atlas
Research

Papers

Publications linked to models, labs and benchmarks. Authors, venues and abstracts come from arXiv and publisher pages.

191 total

Reset
Papers
TitleAuthorsPublishedCategoriesOrganization / venueQuality
M3-Former: Multimodal Transformer with Mixture-of-Experts for Long-Term Vessel Trajectory PredictionarXiv:2609.10559Wenzhe Jin, Haina Tang11 Sept 2026cs.LG89
RiVaT-Fuse: Reliability-Calibrated Variational Tensor Fusion for Multimodal Prediction under Modality UncertaintyarXiv:2609.10798Yingfan Xu, Tieming Liu, Ye Liang +111 Sept 2026cs.LG89
CoRA-NAS: Coarse Ranking and Anchor-Residual Refinement for Neural Architecture SearcharXiv:2609.11884Yifan Yang, Zhaoyan Wang, Zheng Gao +211 Sept 2026cs.LG89
HuRo: Robotizing Human Videos for Scalable VLA PretrainingarXiv:2609.10706Jinho Jeong, Se June Joo, Jaehyun Kang +211 Sept 2026cs.RO89
Meta-Learning for Data-Efficient Plant Growth Estimation via Vision Transformers and Fuzzy ClusteringarXiv:2609.10749Sheikh Hasan Elahi, Rusith Chamara Hathurusinghe Dewage, Habib Ullah +211 Sept 2026cs.CV89
How Much Velocity Does Off-Ball Space Value Need? A Broadcast-Viewport BenchmarkarXiv:2609.10801Seongjin Choi11 Sept 2026cs.CV89
Scale-Aware 3D Deep Learning for Robust Brain Metastasis Detection in Multimodal MRIarXiv:2609.10825Sylvain Jaume, Hongming Wang, Simon K. Warfield11 Sept 2026eess.IV89
Are We Really Doing Few-Shot Learning? A Critical Examination of Pre-Training AssumptionsarXiv:2609.10851Alejandro Galan-Cuenca, Marcelo Saval-Calvo, Antonio Javier Gallego11 Sept 2026cs.CV89
Symmetry-aware super-resolution of crystal orientation maps via invariant latent-space learningarXiv:2609.10898Umang Garg, Warren Zamudio, McLean P. Echlin +211 Sept 2026cs.CV89
New Evidence, Same Choice: Testing Physical Experiment Selection in Vision Language ModelsarXiv:2609.11022Sourajit Saha, Shubhashis Roy Dipta, Nobin Sarwar +211 Sept 2026cs.CV89
Meta-Learning for Classifier Selection in Image Datasets: A Feature-Driven Framework for Accuracy PredictionarXiv:2609.11041Zahra Nabizadeh_Shahre_Babak, Farzaneh Koohestani, Nader Karimi +211 Sept 2026cs.CV89
TailProp: content-adaptive light- and heavy-tailed propagation for visionarXiv:2609.11081Jiahao Kong, Zihan Li11 Sept 2026cs.CV89
Improving Faint Object Detection for Space Situational Awareness with Variational AutoencodersarXiv:2609.11269Angela Cratere, Luca Ghilardi, Vishnu Reddy +211 Sept 2026cs.CV89
Your Model Already Knows Don't Teach It, Learn to Ask It: Soft Prompting for Few-Shot Adaptation of Vision-Language ModelsarXiv:2609.11310Gautam Rajendrakumar Gare, Siyi Li, Hewei Wang +211 Sept 2026cs.CV89
Hologram Representation via Quadratic Phase Gaussian SplattingarXiv:2609.11434Haolong Wang, Yicheng Zhan, Kaan Ak\c{s}it +111 Sept 2026cs.GR89
Breaking the Central Bias: Spatially Partitioned Experts for Coordinate-Based NeuroevolutionarXiv:2609.11518Romain Claret, Arthur Gygax, Michael O'Neill +211 Sept 2026cs.NE89
Vidu S2: Real-Time Interactive, Editable, and Spatial Video GenerationarXiv:2609.11638Jintao Zhang, Kai Jiang, Jintao Chen +211 Sept 2026cs.CV89
Multimodal Taxonomic Conditioning for Generative Plankton ImageryarXiv:2609.11673Daniela Ivanova, Ozgu Goksu, Nicolas Pugeault11 Sept 2026cs.CV89
Logit Refiner: Improving Visual Autoregressive Models via Intra-Scale Dependency ModelingarXiv:2609.11804Meimingwei Li, Stefan Andreas Baumann, Felix Krause +111 Sept 2026cs.CV89
3D Point Splatting for mmWave Radar Novel View SynthesisarXiv:2609.11894Adnan Armouti, Yixuan Gao, Rajalakshmi Nandakumar11 Sept 2026cs.CV89
Optimizing Three Critical Factors for Practical and Effective OOD Detection Fine-TuningarXiv:2308.01030Hyunjun Choi, JaeHo Chung, Hawook Jeong11 Sept 2026cs.LG89
CertDW: Towards Certified Dataset Ownership Verification via Conformal CalibrationarXiv:2506.13160Ting Qiao, Yiming Li, Jianbin Li +211 Sept 2026cs.LG89
Sublinear Variational Optimization of Gaussian Mixture Models with Millions to Billions of ParametersarXiv:2501.12299Sebastian Salwig, Till Kahlke, Florian Hirschberger +211 Sept 2026stat.ML89
Divergence-Based Similarity Function for Multi-View Contrastive LearningarXiv:2507.06560Jaehyoung Jeon, Cheolsu Lim, Myungjoo Kang11 Sept 2026cs.CV89
Federated Learning for Surgical Vision in Appendicitis Classification: Results of the FedSurg EndoVis 2024 ChallengearXiv:2510.04772Max Kirchner, Hanna Hoffmann, Alexander C. Jenke +211 Sept 2026cs.CV89
Discriminative Span as a Predictor of Synthetic Data Utility via Classifier ReconstructionarXiv:2605.09697Radhika Amar Desai, Modigari Narendra11 Sept 2026cs.CV89
ProsMAE: Multi-Source MAE Pretraining for ISUP Grade ClassificationarXiv:2607.08162Anna Jung, Kyeonghun Kim, Youngung Han +211 Sept 2026cs.CV89
What to Preserve, Where to Adapt: A Depth-Wise Analysis of Forgetting in Continual Gynecological Image SegmentationarXiv:2608.13660Amal Saqib, Tausifa Jan Saleem, Numan Saeed +111 Sept 2026cs.CV89
GameWAM: A World Action Model for Video GamesarXiv:2608.26200Yuncheng Guo, Zhanqiu Zhang, Yiwen Guo +111 Sept 2026cs.AI89
Motus2: A Self-Evolving General World Model for Dexterous ManipulationarXiv:2608.30237Hongzhe Bi, Zihao Zhou, Yihang Tang +211 Sept 2026cs.RO89
Representation learning of human cortical folding to reveal long lasting neurodevelopmental signaturesarXiv:2609.05438Julien Laval, Robin Guiavarch, Antoine Dufournet +211 Sept 2026q-bio.QM89
Reason Through the Latent! Making Latent Visual Reasoning NecessaryarXiv:2609.06746Suhyeong Park, Junha Jung, Jaewoo Kang11 Sept 2026cs.AI89
OmniHallu: Unified Hallucination Detection for Cross-Modal Comprehension and Generation in Multimodal Large Language ModelsarXiv:2609.11244Jianjiang Yang, Peihang Li, Shanqing Xu +211 Sept 2026cs.CL89
MultiHuSE: A Multimodal Dataset for Humour Styles and EmotionsarXiv:2609.11322Mary Ogbuka Kenneth, Foaad Khosmood, Abbas Edalat11 Sept 2026cs.CL89
BodyCam-VQA: Enhanced Body-Worn Camera Video Captioning via Multimodal Reasoning and Probe Question GenerationarXiv:2609.10815Karish Gupta, Matthew Alex, Alex Li +211 Sept 2026cs.CV89
MindTopo: Can Foundation Models Reason in Topological Space?arXiv:2609.11900Yunfei Ge, Anbang Liu, Qineng Wang +211 Sept 2026cs.AI89
Do Vision-Language Models Understand Visual Persuasiveness? A Diagnosis via Visual Persuasive FactorsarXiv:2511.17036Gyuwon Park, Hyounghun Kim11 Sept 2026cs.CL89
Characterizing Text Branch Sensitivity in Medical Vision-Language Segmentation via Evidence DecouplingarXiv:2609.02663Ziquan Liu, Zhewei Zhu, Xuyang Shi11 Sept 2026cs.CV89
AgenticGen: Reward-Guided Agentic Video Generation for AdvertisingarXiv:2609.09187Xingyuan Bu, Chengru Song, Hao Zhou +211 Sept 2026cs.CV89
Reliability-Aware Hybrid-K Ensemble Selection for Cervical Cytology Classification: Integrating Discrimination, Calibration, and Selective PredictionarXiv:2609.09189Nisreen Albzour, Sarah S. Lam11 Sept 2026eess.IV89

Author lists and categories are copied from the paper's own metadata (arXiv, publisher). Each paper page shows the abstract, related models and every source snapshot.