| SemVerBench: Benchmarking LLM Comprehension of Version-Constraint Resolution SemanticsarXiv:2609.11180 | Qibai Chen, Zeming Liu | 12 Sept 2026 | cs.AI | — | |
| Can LLMs Follow Medical Expert Logic? A Benchmark for Hierarchical Logical Consistency in Risk-of-Bias AssessmentarXiv:2609.11185 | Haihong E, Jiayu Huang, Qianhui Ling +2 | 12 Sept 2026 | cs.AI | — | |
| Agentic Share-of-Search: A Multi-Agent AI System for Competitive Decision-Making in LLM-Mediated E-CommercearXiv:2609.11190 | Spandan Ghose Chowdhury | 12 Sept 2026 | cs.AI | — | |
| An AI-Powered Culturally Aware Chatbot for Stress Detection and Wellness Support among Pakistani University Students Using NLP and Machine LearningarXiv:2609.11199 | Muhammad Afzal, Muhammad Fahad Bashir | 12 Sept 2026 | cs.AI | — | |
| NovGauge: A Fine-Grained Benchmark for Diagnosing LLMs' Capability in Paper Novelty AssessmentarXiv:2609.11234 | Guoqiang Zhang, Jiayi Chen, Kexin Tan +2 | 12 Sept 2026 | cs.AI | — | |
| Sci-MMR: Benchmarking Multi-Step Evidence-Grounded Scientific Reasoning in Multimodal AgentsarXiv:2609.11243 | Bicheng Deng, Dingwei Zhu, Enyu Zhou +2 | 12 Sept 2026 | cs.AI | — | |
| When Does Text Inform? Benchmarking Information-Theoretic Metrics for Multimodal Time-Series ForecastingarXiv:2609.11282 | Emma Andrews, Gianmarco Mengaldo | 12 Sept 2026 | cs.AI | — | |
| Generating a Consistent Enterprise: Synthesis and Reference-Free Evaluation of Multi-System Business DataarXiv:2609.11286 | Assaf Natanzon, Benjamin Gruenbaum, Chen Dinachi +2 | 12 Sept 2026 | cs.AI | — | |
| Off-Target Effects of Response-Style Alignment in a Korean 27B Language ModelarXiv:2609.11291 | Hyojung Han | 12 Sept 2026 | cs.AI | — | |
| Memory Compression for High-Fanout Agent SandboxesarXiv:2609.11294 | Ceyu XU, Haohui Mai, Jiangnan Yu +2 | 12 Sept 2026 | cs.AI | — | |
| Routing by Reasoning Need: Trajectory-Aware Decoding Control for Diffusion Vision-Language ModelsarXiv:2609.11315 | Xiaoying Tang, Yixiang Liu, Zhonghua Wang +1 | 12 Sept 2026 | cs.AI | — | |
| Mr.LHDR: A Benchmark for Multimodal Real-World Long-Horizon Deep Research AgentsarXiv:2609.11318 | Haihong Hao, Haijun Wu, Haoze Zhao +2 | 12 Sept 2026 | cs.AI | — | |
| Magenta: Closing the Loop Between Mathematical Reasoning and Lean VerificationarXiv:2609.11319 | Eleonora Giunchiglia, Erix Xing, Haonan Li +2 | 12 Sept 2026 | cs.AI | — | |
| AI Exposure and AI Resilience: A Two-Dimensional Assessment Framework for Software and Software-Based Business ModelarXiv:2609.11321 | Martin H\"ausl (Munich University of Applied Sciences), Paul Darius Mandl (Findustrial GmbH), Peter Mandl (Munich University of Applied Sciences) | 12 Sept 2026 | cs.AI | — | |
| Exploring Diffusion Transformers for Cross-Modal Augmentation in Multimodal Brain State DecodingarXiv:2609.11341 | Bohan Fang, Dongrui Wu, Hongbin Wang +2 | 12 Sept 2026 | cs.AI | — | |
| Portable Semantics, Private Dialects: Reuse and Negative Transfer in Latent Communication Between Language-Model CellsarXiv:2609.11365 | Narcis Marincat | 12 Sept 2026 | cs.AI | — | |
| RAMamba-Net: A Reliability-Aware and Mamba-Based Multimodal Fusion Network for Auditory Attention DetectionarXiv:2609.11372 | Dongrui Wu, Xingyi He, Ziwei Wang | 12 Sept 2026 | cs.AI | — | |
| Beyond Confidence: Stability-Aware Test-Time Adaptation for LLM ReasoningarXiv:2609.11393 | Bincheng Gu, Junliang Yu, Min Gao +2 | 12 Sept 2026 | cs.AI | — | |
| From Queries to Narratives: Cultural Heritage Data Stories for Knowledge Graph Exploration and Quality AssessmentarXiv:2609.11403 | Etienne Posthumus, Harald Sack, J\"org Waitelonis +2 | 12 Sept 2026 | cs.AI | — | |
| LLMs as Post-hoc Auditors of Physiological Plausibility in Symbolic Regression: A Clinician-Evaluated Case StudyarXiv:2609.11431 | Esther Maqueda, J. Ignacio Hidalgo, J. Manuel Velasco +2 | 12 Sept 2026 | cs.AI | — | |
| Calibration-Aware Uncertainty Cascades for Efficient Heterogeneous Model CollaborationarXiv:2609.11446 | Cai Xu, Han Jiang, Wei Zhao +2 | 12 Sept 2026 | cs.AI | — | |
| RouteRepair: Instance-Level Failure Diagnosis and Targeted Repair in LLM-Based Automated Heuristic Design for Routing OptimizationarXiv:2609.11452 | Binghao Ji, Di Huang, Jiahui Fang +1 | 12 Sept 2026 | cs.AI | — | |
| Flexible and Interpretable Accent Distance MeasurementsarXiv:2609.11458 | Charles McGhee, Kate M. Knill, Mark J. F. Gales | 12 Sept 2026 | cs.AI | — | |
| The Convention Gap: Towards Measuring Implicit Communication in Cooperative AI EvaluationarXiv:2609.11489 | Ehsan Moradi Pari, Hua-Dong Xiong, Makoto Fukushima | 12 Sept 2026 | cs.AI | — | |
| From Document Silos to Process Intelligence: A Multi-Layer Knowledge Graph for CMC Process DevelopmentarXiv:2609.11493 | Faryad Sahneh, Reza Amirmoshiri, Yasser Jangjou | 12 Sept 2026 | cs.AI | — | |
| ActMap: Single-Pass Uncertainty Quantification from Generation-Time Activation MapsarXiv:2609.11498 | Jacopo Dardini (University of Bologna), Roberta Calegari (University of Bologna) | 12 Sept 2026 | cs.AI | — | |
| Extending SMT Solving with Non-Ground Clause LearningarXiv:2609.11509 | Christoph Weidenbach, Yasmine Briefs | 12 Sept 2026 | cs.AI | — | |
| Lightweight LiDAR-Based Cone Detection Framework Using Random Forest for Formula Student DriverlessarXiv:2609.11527 | Chang Liu, M\'ark Mez\H{o}-Kerekes, P\'eter Praksz | 12 Sept 2026 | cs.AI | — | |
| Prompt Revision as a Source of Cultural Bias in Text-to-Image SystemsarXiv:2609.11532 | Aleksandra Urman, Ancsa Hannak, Azza Bouleimen +2 | 12 Sept 2026 | cs.AI | — | |
| Characterizing Job Power Elasticity for Power-Flexible AI TrainingarXiv:2609.11542 | Ayse Coskun, Charles Dawson, Philip Colangelo +2 | 12 Sept 2026 | cs.AI | — | |
| Making Alternative Data Work: Context-Augmented LLMs for Financial ForecastingarXiv:2609.11607 | Alejandro Lopez-Lira, Chanyeol Choi, Daekyung Park +2 | 12 Sept 2026 | cs.AI | — | |
| MAPLE: Memory-Augmented Planning with Language and EvolutionarXiv:2609.11636 | Kesheng Chen, Wenjian Luo, Yamin Hu | 12 Sept 2026 | cs.AI | — | |
| Autonomy, Social Norms, and Alignment: Towards a Developmental Framework for Autonomous Artificial AgentsarXiv:2609.11660 | Ludovica Marinucci, Marica Notte, Vieri Giuliano Santucci | 12 Sept 2026 | cs.AI | — | |
| Geospatial AI, Dataverse Metadata, and the Study of Place-Based GovernmentarXiv:2609.11674 | Danny EBanks, Devika Jain | 12 Sept 2026 | cs.AI | — | |
| COBRA-Skills: Contextual Bandit-Guided Evolution for Agent Skill OptimizationarXiv:2609.11682 | Bryan Kian Hsiang Low, Jie Mao, Junfeng Luo +2 | 12 Sept 2026 | cs.AI | — | |
| When Agents Disagree: Bayesian Backward Reasoning as a Label-Free Anchor for Multi-Agent Collective Decision-MakingarXiv:2609.11709 | Hansani Weeratunge, Ken Chen, Sachith Seneviratne +2 | 12 Sept 2026 | cs.AI | — | |
| From Parameters to Answers: How LLMs Retrieve and Use Their Internal KnowledgearXiv:2609.11859 | Hong Cheng, Renhe Jiang, Wenkang Wei +2 | 12 Sept 2026 | cs.AI | — | |
| On the Regularization Landscape for the Linear Recommendation ModelsarXiv:2609.11876 | Bin Ren, Dong Li, Hao Zhou +2 | 12 Sept 2026 | cs.AI | — | |
| Artificial Id: Drive and Persistent Alignment in Agentic AIarXiv:2609.11911 | Yakov Pyotr Shkolnikov | 12 Sept 2026 | cs.AI | — | |
| Can Edge-Deployable Vision-Language Models Identify Species?arXiv:2609.11916 | Mayukha Siripuram, William Zhou, Xiao Yan +2 | 12 Sept 2026 | cs.AI | — | |