| MOSAIC: Query-Aware Exploration Policy Adaptation for GraphRAGarXiv:2609.11065cs.AI | EunKyeong Lee, Hye Woo Lee, Hyeongjun Jang +2 | — | 12 Sept 2026 | — | — | — | — |
| Benchmark Radar: A Living Database and Search Engine for AI Benchmarks and EvaluationarXiv:2609.11115cs.AI | Ergan Shang, Jiayu Wang, Junjie Zhou +2 | — | 12 Sept 2026 | — | — | — | — |
| Autonomous Chemical Mechanistic Discovery through Agentic Reasoning and ValidationarXiv:2609.11147cs.AI | Aijia Zhang, Biqing Qi, Bowen Zhou +2 | — | 12 Sept 2026 | — | — | — | — |
| Breaking Predictions Is Not Enough: Specified-Foil Counterfactuals for Temporal GraphsarXiv:2609.11170cs.AI | Minwoo Yu, Young-guk Ha | — | 12 Sept 2026 | — | — | — | — |
| Debate-to-Skill: Capability-Bound Process Supervision for Industrial Query-to-Agent AnnotationarXiv:2609.11176cs.AI | Huifu Li, Leisheng Cheng, Shiyu Zhang | — | 12 Sept 2026 | — | — | — | — |
| SemVerBench: Benchmarking LLM Comprehension of Version-Constraint Resolution SemanticsarXiv:2609.11180cs.AI | Qibai Chen, Zeming Liu | — | 12 Sept 2026 | — | — | — | — |
| Can LLMs Follow Medical Expert Logic? A Benchmark for Hierarchical Logical Consistency in Risk-of-Bias AssessmentarXiv:2609.11185cs.AI | Haihong E, Jiayu Huang, Qianhui Ling +2 | — | 12 Sept 2026 | — | — | — | — |
| Agentic Share-of-Search: A Multi-Agent AI System for Competitive Decision-Making in LLM-Mediated E-CommercearXiv:2609.11190cs.AI | Spandan Ghose Chowdhury | — | 12 Sept 2026 | — | — | — | — |
| An AI-Powered Culturally Aware Chatbot for Stress Detection and Wellness Support among Pakistani University Students Using NLP and Machine LearningarXiv:2609.11199cs.AI | Muhammad Afzal, Muhammad Fahad Bashir | — | 12 Sept 2026 | — | — | — | — |
| NovGauge: A Fine-Grained Benchmark for Diagnosing LLMs' Capability in Paper Novelty AssessmentarXiv:2609.11234cs.AI | Guoqiang Zhang, Jiayi Chen, Kexin Tan +2 | — | 12 Sept 2026 | — | — | — | — |
| Sci-MMR: Benchmarking Multi-Step Evidence-Grounded Scientific Reasoning in Multimodal AgentsarXiv:2609.11243cs.AI | Bicheng Deng, Dingwei Zhu, Enyu Zhou +2 | — | 12 Sept 2026 | — | — | — | — |
| When Does Text Inform? Benchmarking Information-Theoretic Metrics for Multimodal Time-Series ForecastingarXiv:2609.11282cs.AI | Emma Andrews, Gianmarco Mengaldo | — | 12 Sept 2026 | — | — | — | — |
| Generating a Consistent Enterprise: Synthesis and Reference-Free Evaluation of Multi-System Business DataarXiv:2609.11286cs.AI | Assaf Natanzon, Benjamin Gruenbaum, Chen Dinachi +2 | — | 12 Sept 2026 | — | — | — | — |
| Off-Target Effects of Response-Style Alignment in a Korean 27B Language ModelarXiv:2609.11291cs.AI | Hyojung Han | — | 12 Sept 2026 | — | — | — | — |
| Memory Compression for High-Fanout Agent SandboxesarXiv:2609.11294cs.AI | Ceyu XU, Haohui Mai, Jiangnan Yu +2 | — | 12 Sept 2026 | — | — | — | — |
| Routing by Reasoning Need: Trajectory-Aware Decoding Control for Diffusion Vision-Language ModelsarXiv:2609.11315cs.AI | Xiaoying Tang, Yixiang Liu, Zhonghua Wang +1 | — | 12 Sept 2026 | — | — | — | — |
| Mr.LHDR: A Benchmark for Multimodal Real-World Long-Horizon Deep Research AgentsarXiv:2609.11318cs.AI | Haihong Hao, Haijun Wu, Haoze Zhao +2 | — | 12 Sept 2026 | — | — | — | — |
| Magenta: Closing the Loop Between Mathematical Reasoning and Lean VerificationarXiv:2609.11319cs.AI | Eleonora Giunchiglia, Erix Xing, Haonan Li +2 | — | 12 Sept 2026 | — | — | — | — |
| AI Exposure and AI Resilience: A Two-Dimensional Assessment Framework for Software and Software-Based Business ModelarXiv:2609.11321cs.AI | Martin H\"ausl (Munich University of Applied Sciences), Paul Darius Mandl (Findustrial GmbH), Peter Mandl (Munich University of Applied Sciences) | — | 12 Sept 2026 | — | — | — | — |
| Exploring Diffusion Transformers for Cross-Modal Augmentation in Multimodal Brain State DecodingarXiv:2609.11341cs.AI | Bohan Fang, Dongrui Wu, Hongbin Wang +2 | — | 12 Sept 2026 | — | — | — | — |
| Portable Semantics, Private Dialects: Reuse and Negative Transfer in Latent Communication Between Language-Model CellsarXiv:2609.11365cs.AI | Narcis Marincat | — | 12 Sept 2026 | — | — | — | — |
| RAMamba-Net: A Reliability-Aware and Mamba-Based Multimodal Fusion Network for Auditory Attention DetectionarXiv:2609.11372cs.AI | Dongrui Wu, Xingyi He, Ziwei Wang | — | 12 Sept 2026 | — | — | — | — |
| Beyond Confidence: Stability-Aware Test-Time Adaptation for LLM ReasoningarXiv:2609.11393cs.AI | Bincheng Gu, Junliang Yu, Min Gao +2 | — | 12 Sept 2026 | — | — | — | — |
| From Queries to Narratives: Cultural Heritage Data Stories for Knowledge Graph Exploration and Quality AssessmentarXiv:2609.11403cs.AI | Etienne Posthumus, Harald Sack, J\"org Waitelonis +2 | — | 12 Sept 2026 | — | — | — | — |
| LLMs as Post-hoc Auditors of Physiological Plausibility in Symbolic Regression: A Clinician-Evaluated Case StudyarXiv:2609.11431cs.AI | Esther Maqueda, J. Ignacio Hidalgo, J. Manuel Velasco +2 | — | 12 Sept 2026 | — | — | — | — |