Skip to content
AI Atlas
Research

Papers

Publications linked to models, labs and benchmarks. Authors, venues and abstracts come from arXiv and publisher pages.

510 total

Reset
Papers
TitleAuthorsPublishedCategoriesOrganization / venueQuality
SemVerBench: Benchmarking LLM Comprehension of Version-Constraint Resolution SemanticsarXiv:2609.11180Qibai Chen, Zeming Liu12 Sept 2026cs.AI
Can LLMs Follow Medical Expert Logic? A Benchmark for Hierarchical Logical Consistency in Risk-of-Bias AssessmentarXiv:2609.11185Haihong E, Jiayu Huang, Qianhui Ling +212 Sept 2026cs.AI
Agentic Share-of-Search: A Multi-Agent AI System for Competitive Decision-Making in LLM-Mediated E-CommercearXiv:2609.11190Spandan Ghose Chowdhury12 Sept 2026cs.AI
An AI-Powered Culturally Aware Chatbot for Stress Detection and Wellness Support among Pakistani University Students Using NLP and Machine LearningarXiv:2609.11199Muhammad Afzal, Muhammad Fahad Bashir12 Sept 2026cs.AI
NovGauge: A Fine-Grained Benchmark for Diagnosing LLMs' Capability in Paper Novelty AssessmentarXiv:2609.11234Guoqiang Zhang, Jiayi Chen, Kexin Tan +212 Sept 2026cs.AI
Sci-MMR: Benchmarking Multi-Step Evidence-Grounded Scientific Reasoning in Multimodal AgentsarXiv:2609.11243Bicheng Deng, Dingwei Zhu, Enyu Zhou +212 Sept 2026cs.AI
When Does Text Inform? Benchmarking Information-Theoretic Metrics for Multimodal Time-Series ForecastingarXiv:2609.11282Emma Andrews, Gianmarco Mengaldo12 Sept 2026cs.AI
Generating a Consistent Enterprise: Synthesis and Reference-Free Evaluation of Multi-System Business DataarXiv:2609.11286Assaf Natanzon, Benjamin Gruenbaum, Chen Dinachi +212 Sept 2026cs.AI
Off-Target Effects of Response-Style Alignment in a Korean 27B Language ModelarXiv:2609.11291Hyojung Han12 Sept 2026cs.AI
Memory Compression for High-Fanout Agent SandboxesarXiv:2609.11294Ceyu XU, Haohui Mai, Jiangnan Yu +212 Sept 2026cs.AI
Routing by Reasoning Need: Trajectory-Aware Decoding Control for Diffusion Vision-Language ModelsarXiv:2609.11315Xiaoying Tang, Yixiang Liu, Zhonghua Wang +112 Sept 2026cs.AI
Mr.LHDR: A Benchmark for Multimodal Real-World Long-Horizon Deep Research AgentsarXiv:2609.11318Haihong Hao, Haijun Wu, Haoze Zhao +212 Sept 2026cs.AI
Magenta: Closing the Loop Between Mathematical Reasoning and Lean VerificationarXiv:2609.11319Eleonora Giunchiglia, Erix Xing, Haonan Li +212 Sept 2026cs.AI
AI Exposure and AI Resilience: A Two-Dimensional Assessment Framework for Software and Software-Based Business ModelarXiv:2609.11321Martin H\"ausl (Munich University of Applied Sciences), Paul Darius Mandl (Findustrial GmbH), Peter Mandl (Munich University of Applied Sciences)12 Sept 2026cs.AI
Exploring Diffusion Transformers for Cross-Modal Augmentation in Multimodal Brain State DecodingarXiv:2609.11341Bohan Fang, Dongrui Wu, Hongbin Wang +212 Sept 2026cs.AI
Portable Semantics, Private Dialects: Reuse and Negative Transfer in Latent Communication Between Language-Model CellsarXiv:2609.11365Narcis Marincat12 Sept 2026cs.AI
RAMamba-Net: A Reliability-Aware and Mamba-Based Multimodal Fusion Network for Auditory Attention DetectionarXiv:2609.11372Dongrui Wu, Xingyi He, Ziwei Wang12 Sept 2026cs.AI
Beyond Confidence: Stability-Aware Test-Time Adaptation for LLM ReasoningarXiv:2609.11393Bincheng Gu, Junliang Yu, Min Gao +212 Sept 2026cs.AI
From Queries to Narratives: Cultural Heritage Data Stories for Knowledge Graph Exploration and Quality AssessmentarXiv:2609.11403Etienne Posthumus, Harald Sack, J\"org Waitelonis +212 Sept 2026cs.AI
LLMs as Post-hoc Auditors of Physiological Plausibility in Symbolic Regression: A Clinician-Evaluated Case StudyarXiv:2609.11431Esther Maqueda, J. Ignacio Hidalgo, J. Manuel Velasco +212 Sept 2026cs.AI
Calibration-Aware Uncertainty Cascades for Efficient Heterogeneous Model CollaborationarXiv:2609.11446Cai Xu, Han Jiang, Wei Zhao +212 Sept 2026cs.AI
RouteRepair: Instance-Level Failure Diagnosis and Targeted Repair in LLM-Based Automated Heuristic Design for Routing OptimizationarXiv:2609.11452Binghao Ji, Di Huang, Jiahui Fang +112 Sept 2026cs.AI
Flexible and Interpretable Accent Distance MeasurementsarXiv:2609.11458Charles McGhee, Kate M. Knill, Mark J. F. Gales12 Sept 2026cs.AI
The Convention Gap: Towards Measuring Implicit Communication in Cooperative AI EvaluationarXiv:2609.11489Ehsan Moradi Pari, Hua-Dong Xiong, Makoto Fukushima12 Sept 2026cs.AI
From Document Silos to Process Intelligence: A Multi-Layer Knowledge Graph for CMC Process DevelopmentarXiv:2609.11493Faryad Sahneh, Reza Amirmoshiri, Yasser Jangjou12 Sept 2026cs.AI
ActMap: Single-Pass Uncertainty Quantification from Generation-Time Activation MapsarXiv:2609.11498Jacopo Dardini (University of Bologna), Roberta Calegari (University of Bologna)12 Sept 2026cs.AI
Extending SMT Solving with Non-Ground Clause LearningarXiv:2609.11509Christoph Weidenbach, Yasmine Briefs12 Sept 2026cs.AI
Lightweight LiDAR-Based Cone Detection Framework Using Random Forest for Formula Student DriverlessarXiv:2609.11527Chang Liu, M\'ark Mez\H{o}-Kerekes, P\'eter Praksz12 Sept 2026cs.AI
Prompt Revision as a Source of Cultural Bias in Text-to-Image SystemsarXiv:2609.11532Aleksandra Urman, Ancsa Hannak, Azza Bouleimen +212 Sept 2026cs.AI
Characterizing Job Power Elasticity for Power-Flexible AI TrainingarXiv:2609.11542Ayse Coskun, Charles Dawson, Philip Colangelo +212 Sept 2026cs.AI
Making Alternative Data Work: Context-Augmented LLMs for Financial ForecastingarXiv:2609.11607Alejandro Lopez-Lira, Chanyeol Choi, Daekyung Park +212 Sept 2026cs.AI
MAPLE: Memory-Augmented Planning with Language and EvolutionarXiv:2609.11636Kesheng Chen, Wenjian Luo, Yamin Hu12 Sept 2026cs.AI
Autonomy, Social Norms, and Alignment: Towards a Developmental Framework for Autonomous Artificial AgentsarXiv:2609.11660Ludovica Marinucci, Marica Notte, Vieri Giuliano Santucci12 Sept 2026cs.AI
Geospatial AI, Dataverse Metadata, and the Study of Place-Based GovernmentarXiv:2609.11674Danny EBanks, Devika Jain12 Sept 2026cs.AI
COBRA-Skills: Contextual Bandit-Guided Evolution for Agent Skill OptimizationarXiv:2609.11682Bryan Kian Hsiang Low, Jie Mao, Junfeng Luo +212 Sept 2026cs.AI
When Agents Disagree: Bayesian Backward Reasoning as a Label-Free Anchor for Multi-Agent Collective Decision-MakingarXiv:2609.11709Hansani Weeratunge, Ken Chen, Sachith Seneviratne +212 Sept 2026cs.AI
From Parameters to Answers: How LLMs Retrieve and Use Their Internal KnowledgearXiv:2609.11859Hong Cheng, Renhe Jiang, Wenkang Wei +212 Sept 2026cs.AI
On the Regularization Landscape for the Linear Recommendation ModelsarXiv:2609.11876Bin Ren, Dong Li, Hao Zhou +212 Sept 2026cs.AI
Artificial Id: Drive and Persistent Alignment in Agentic AIarXiv:2609.11911Yakov Pyotr Shkolnikov12 Sept 2026cs.AI
Can Edge-Deployable Vision-Language Models Identify Species?arXiv:2609.11916Mayukha Siripuram, William Zhou, Xiao Yan +212 Sept 2026cs.AI

Author lists and categories are copied from the paper's own metadata (arXiv, publisher). Each paper page shows the abstract, related models and every source snapshot.