Publications on generative methods for perception, prediction and planning. Papers, innovations and research results from nxtAIM, a collaborative project on Generative AI for Autonomous Driving, which is driving the development of automated driving functions.
Overview of publications
1 Royden Wagner, Ömer Şahin Taş, Marvin Klemp, Carlos Fernandez, Christoph Stiller: RedMotion: Motion Prediction via Redundancy Reduction, Transactions on Machine Learning Research, 27.05.2024
2 Kashyap Chitta, Daniel Dauner, Andreas Geiger: SLEDGE: Synthesizing Driving Environments with Generative Models and Rule-Based Traffic, European Conference on Computer Vision (ECCV) 2024 in Milano, Italy, 29.09.2024
3 Daniel Dauner, Marcel Hallgarten, Tianyu Li, Xinshuo Weng, Zhiyu Huang, Zetong Yang, Hongyang Li, Igor Gilitschenski, Boris Ivanovic, Marco Pavone, Andreas Geiger, Kashyap Chitta: NAVSIM: Data-Driven Non-Reactive Autonomous Vehicle Simulation and Benchmarking, Conference on Neural Information Processing Systems (NeurIPS) 2024, in Vancouver, Canada, 09.12.2024
4 Mohamed-Khalil Bouzidi, Bojan Derajic, Daniel Göhring, Jörg Reichardt: Motion Planning under Uncertainty: Integrating Learning-Based Multi-Modal Predictors into Branch Model Predictive Control, IEEE International Conference on Intelligent Transportation Systems, Edmonton, Canada, 24.–27.09.2024
5 Nick Stracke, Stefan Andreas Baumann, Josh Susskind, Miguel Angel Bautista, Björn Ommer: CTRLorALTer: Conditional LoRAdapter for Efficient 0-Shot Control & Altering of T2I Models, ECCV, Milano, Italy, 29.09.–04.10.2024
6 Vincent Tao Hu, Stefan Andreas Baumann, Ming Gui, Olga Grebenkova, Pingchuan Ma, Johannes Fischer, Björn Ommer: ZigMa: A DiT-style Zigzag Mamba Diffusion Model, ECCV, Milano, Italy, 29.09.–04.10.2024
7 Joannes S Fischer, Ming Gui, Pingchuan Ma, Nick Stracke, Stefan Andreas Baumann, Vincent Tao Hu, Björn Ommer: FMBoost: Boosting Latent Diffusion with Flow Matching, ECCV, Milano, Italy, 29.09.–04.10.2024
8 Ömer Şahin Taş, Royden Wagner: Words in Motion: Extracting Interpretable Control Vectors for Motion Transformers, International Conference on Learning Representations (ICLR) 2025, Singapore, Singapore, 24.04.2025
9 Royden Wagner, Ömer Şahin Taş, Marvin Klemp, Carlos Fernandez: JointMotion: Joint Self-Supervision for Joint Motion Prediction, Conference on Robot Learning (CoRL), Munich, Germany, 06.11.2024
10 Kumar Manas, Stefan Zwicklbauer, Adrian Paschke: CoT-TL: Low-Resource Temporal Knowledge Representation of Planning Instructions using Chain-of-Thought Reasoning, IEEE/RSJ International Conference on Intelligent Robots and Systems, Abu Dhabi, 14.10.2024
11 Dmytro Kotovenko, Olga Grebenkova, Nikolaos Sarafianos, Avinash Paliwal, Pingchuan Ma, Omit Poursaeed, Sreyas Mohan, Yuchen Fan, Yilei Li, Rakesh Ranjan, Björn Ommer: WaSt-3D: Wasserstein-2 Distance for Scene-to-Scene Stylization on 3D Gaussians, ECCV, Milano, Italy, 29.09.–04.10.2024
12 Marius Kästingschäfer, Théo Gieruc, Sebastian Bernhard, Dylan Campbell, Eldar Insafutdinov, Eyvaz Najafli, Thomas Brox: SEED4D: A Synthetic Ego–Exo Dynamic 4D Data Generator, Driving Dataset and Benchmark, IEEE/CVF Winter Conference on Applications of Computer Vision (WACV 2025), Tucson, Arizona, USA, 28.02.2025
13 Laurenz Adolph, Barbara Schütt, David Kraus, Eric Sax: Navigating Dimensionality Through State Machines in Automotive System Validation, MODELSWARD 2025, Porto, Portugal, 26.02.2025
14 Natalie Grabowsky, Annika Mütze, Joshua Wendland, Nils Jansen, Matthias Rottmann: Does Knowledge About Perceptual Uncertainty Help an Agent in Automated Driving?, IEEE Intelligent Vehicles Symposium, Cluj-Napoca, Romania, 22.–25.06.2025
15 Franz Andert, Oliver Böttcher, Aditya Mushyam, Philipp Schmälzle: Semantic LiDAR Point Cloud Mapping and Cloud-Based SLAM for Autonomous Driving, IEEE/ION PLANS 2025 Salt Lake Downtown City Creek, UT, USA, 28.04.–01.05.2025
16 Ming Gui, Johannes Schusterbauer, Ulrich Prestel, Pingchuan Ma, Dmytro Kotovenko, Olga Grebenkova, Stefan Andreas Baumann, Vincent Tao Hu, Björn Ommer: DepthFM: Fast Generative Monocular Depth Estimation with Flow Matching, AAAI Conference on Artificial Intelligence, Philadelphia, USA, 27.02.–04.03.2025
17 Pingchuan Ma, Lennart Rietdorf, Dmytro Kotovenko, Vincent Tao Hu, Björn Ommer: Does VLM Classification Benefit from LLM Description Semantics? AAAI Conference on Artificial Intelligence, Philadelphia, USA, 27.02.–04.03.2025
18 Dominik Grundt, Astrid Rakow, Philipp Borchers, Eike Möhlmann: What does AI Need to Know to Drive: Testing Relevance of Knowledge, Science of Computer Programming
19 Katharina Winter, Mark Azer, Fabian Flohr: BEVDriver: Leveraging BEV Maps in LLMs for Robust Closed-Loop Driving, IEEE, 05.05.2025
20 Katharina Winter, Abhishek Vivekanandan, Rupert Polley, Yinzhe Shen, Christian Schlauch, Mohamed-Khalil Bouzidi, Bojan Derajic, Natalie Grabowsky, Annajoyce Mariani, Dennis Rochau, Giovanni Lucente, Harsh Yadav, Firas Mualla, Adam Molin, Sebastian Bernhard, Christian Wirth, Ömer Sahin Tas, Nadja Klein, Fabian Flohr, Hanno Gottschalk: Generative AI for Autonomous Driving: A Review, IEEE, 05.05.2025
21 Shuxiao Ding, Yutong Yang, Julian Wiederer, Markus Braun, Peizheng Li, Juergen Gall, Bin Yang: TQD-Track: Temporal Query Denoising for 3D Multi-Object Tracking, 04.04.2025
22 Sebastian Berger, Katharina Winter, Fabian Flohr: Parameter-Efficient Learning for Visual Grounding and Navigation Under Data and Resource Constraints
23 Kumar Manas, Adrian Paschke: Knowledge Integration Strategies in Autonomous Vehicle Prediction and Planning: A Comprehensive Survey, Forty-Second International Conference on Machine Learning, Vancouver, Canada, 13.–19.07.2025
24 Annika Mütze, Natalie Grabowsky, Edgar Heinert, Matthias Rottmann, Hanno Gottschalk: On the Influence of Shape, Texture and Color for Learning Semantic Segmentation, 28th European Conference on Artificial Intelligence, Bologna, Italy, 25.–30.10.2025
25 Arian Mousakhan, Sudhanshu Mittal, Silvio Galesso, Karim Farid, Thomas Brox: Orbis: Overcoming Challenges of Long-Horizon Prediction in Driving World Models
26 Samed Dogan, Maximilian Hoh, Nico Leuze, Nikolas R.-Pena, Alfred Schöttl: Towards Solar Altitude Guided Scene Illumination
27 Stefan Englmeier , Max A. Büttner , Katharina Winter , and Fabian B. Flohr: Context-based Motion Retrieval using Open Vocabulary Methods for Autonomous Driving
28 Yue Yao, Mohamed-Khalil Bouzidi, Daniel Goehring, Joerg Reichardt: EP-Diffuser: An Efficient Diffusion Model for Traffic Scene Generation and Prediction via Polynomial Representations, IEEE Robotics and Automation Letters Journal, 01.08.2025
29 Kumar Manas, Christian Schlauch Adrian Paschke, Chirstian Wirth, Nadja Klein: Uncertainty-Aware Trajectory Prediction via Rule-Regularized Heteroscedastic Deep Classification, Robotics Science and Systems (RSS) 2025, California, USA, 30.06.2025
30 Bojan Derajić, Mohamed-Khalil Bouzidi, Sebastian Bernhard, Wolfgang Hönig: Learning Maximal Safe Sets Using Hypernetworks for MPC-based Local Trajectory Planning in Unknown Environments, IEEE Robotics and Automation Letters Journal, 14.07.2025
31 Bojan Derajić, Mohamed-Khalil Bouzidi, Sebastian Bernhard, Wolfgang Hönig: Residual Neural Terminal Constraint for MPC-based Collision Avoidance in Dynamic Environments, CoRL 2025, Seoul, South Korea, 27.09.2025
32 Mohamed Parvez Aslam, Bojan Derajić, Mohamed-Khalil Bouzidi, Sebastian Bernhard, Jan Oliver Ringert: Model Predictive Control for Crowd Navigation via Learning-Based Trajectory Prediction, ICINCO 2025, Marbella, Spain, 20.10.2025
33 Mert Keser, Sinan Simsek, Deniz Karacor, Alois Knoll: Subset Selection for Autonomous Driving Datasets via Fine-Tuning Vision Foundation Models, IEEE IV 2025, 22.06.2025
34 Kumar Manas, Mert Keser, Alois Knoll: Integrating Legal and Logical Specifications in Perception, Prediction, and Planning for Automated Driving: A Survey of Methods, IEEE IAVVC 2025, Baden-Baden, Germany, 30.09.2025
35 Mert Keser, Halil Ibrahim Orhan, Niki Amini-Naieni, Gesina Schwalbe, Alois Knoll, Matthias Rottmann: Benchmarking Vision Foundation Models for Input Monitoring in Autonomous Driving, BMVC 2025, Sheffield, UK, 24.–27.09.2025
36 Annajoyce Mariani, Kira Maag, Hanno Gottschalk: VideoGAN-based Trajectory Proposal for Automated Vehicles, ICCART 2026, Marbella, Spain, 05.–07.03.2026
37 Joshua Niemeijer, Jan Ehrhardt, Heinz Handels, Hristina Uzunova: Uncertainty-Aware ControlNet: Bridging Domain Gaps with Synthetic Image Generation, ICCV 2025 IEEE, The 4th Workshop on What is Next in Multimodal Foundation Models, Honolulu, Hawaii, USA, 19.–20.10.2025
38 Kumar Manas, Mert Keser, Alois Knoll: Integrating Legal and Logical Specifications in Perception, Prediction, and Planning for Automated Driving: A Survey of Methods, IEEE IAVVC 2025, Baden-Baden, Germany, 30.09.2025
39 Mohan Ramesh, Mark Azer, Fabian Flohr: HABIT: Human Action Benchmark for Interactive Traffic in CARLA, WACV, Tucson, Arizona, USA, 06.03.2026
40 Arunachalam Thirunavukkarasu, Domenik Helms, Christian Ojeda-Bernal, Sven Mantowsky, Saqib Bukhari, Robert Bücs: Generative AI in Automotive Industry Generative AI in automotive, Advances in Artificial Intelligence and Machine Learning (AAIML)
41 Stefan Andreas Baumann, Nick Stracke, Timy Phan, Björn Ommer: What If: Understanding Motion Through Sparse Interactions, ICCV 2025, Honolulu, Hawaii, USA, 19.–23.10.2025
42 Felix Krause, Timy Phan, Ming Gui, Stefan Andreas Baumann, Vincent Tao Hu, Björn Ommer: TREAD: Token Routing for Efficient Architecture-agnostic Diffusion Training, ICCV 2025, Honolulu, Hawaii, USA, 19.–23.10.2025
43 Nick Stracke, Stefan Andreas Baumann, Kolja Bauer, Frank Fundel, Björn Ommer: CleanDIFT: Diffusion Features without Noise, CVPR 2025, Nashville, USA, 11.–15.06.2025
44 Arpit Jadon, Joshua Niemeijer, Yuki M. Asano: Test-Time Modification: Inverse Domain Transformation for Robust Perception, 15.12.2025
45 Khaled Seyam, Julian Wiederer, Markus Braun, Bin Yang: SVS-GAN for Semantic Synthesis of Traffic Videos for Autonomous Driving, WACV, Tucson, Arizona, 06.03.2026
46 Dominik Scheuble, Andrea Ramazzina, Hanno Holzhüter, Stefano Gasperini, Steven Peters, Federico Tombari, Mario Bijelic, Felix Heide: Transient LASSO: Transient Large-Scale Scene Reconstruction, SIGGRAPH Asia, 2025
47 Wei Cao, Marcel Hallgarten, Tianyu Li, Daniel Dauner, Xunjiang Gu, Caojun Wang, Yakov Miron, Marco Aiello, Hongyang Li, Igor Gilitschenski, Boris Ivanovic, Marco Pavone, Andreas Geiger, Kashyap Chitta: Pseudo-Simulation for Autonomous Driving, CoRL 2025, Seoul, Korea, 27.09.2025
48 Bernhard Jaeger, Daniel Dauner, Jens Beißwenger, Simon Gerstenecker, Kashyap Chitta, Andreas Geiger: CaRL: Learning Scalable Planning Policies with Simple Rewards, CoRL 2025, Seoul, Korea, 27.09.2025
49 Long Nguyen, Micha Fauth, Bernhard Jaeger, Daniel Dauner, Maximilian Igl, Andreas Geiger, Kashyap Chitta: Open X-AV: Unifying End-to-End Autonomous Driving Datasets, CVPR 2025 Workshop on Autonomous Driving, 11.06.2025
50 Théo Gieruc, Marius Kästingschäfer, Sebastian Bernhard, Mathieu Salzmann: 6Img-to-3D: Few-Image Large-Scale Outdoor Novel View Synthesis, IEEE Intelligent Vehicles Symposium (IV), Cluj-Napoca, Romania, 22.06.2025
51 Eyvaz Najafli, Marius Kästingschäfer, Sebastian Bernhard, Thomas Brox, Andreas Geiger: SshELF: Single-Shot Hierarchical Extrapolation of Latent Features for 3D Reconstruction from Sparse-Views, DAGM GCPR, Freiburg, Deutschland, 23.09.2025
52 Changxu Zhang, Zhaoze Wang, Tai Fei, Christopher Grimm, Yi Jin, Claas Tebruegge, Ernst Warsitz, Markus Gardill: Leveraging Transformer Decoder for Automotive Radar Object Detection, IEEE RadarConf 2026, Phoenix, USA, 11.05.2026
53 Zhaoze Wang, Changxu Zhang, Tai Fei, Christopher Grimm, Yi Jin, Claas Tebruegge, Ernst Warsitz, Markus Gardill: Synthetic FMCW Radar Range–Azimuth Maps Augmentation with Generative Diffusion Model, IEEE RadarConf 2026, Phoenix, USA, 11.05.2026
54 Franz Motzkus, Christian Schlauch, Sebastian Bernhard, Ute Schmid: Can I Trust My Trajectory Prediction Model?, TRUST-AI Workshop at ECAI 2025, Bologna, Italy, 25.10.2025
55 Stefan Englmeier, Katharina Winter, Fabian B. Flohr: WorldVLM: Combining World Model Forecasting and Vision-Language Reasoning, arXiv, 2026
56 Yinzhe Shen, Omer Sahin Tas, Kaiwen Wang, Royden Wagner, Christoph Stiller: Divide and Merge: Motion and Semantic Learning in End-to-End Autonomous Driving, TMLR, 2025
57 Joshua Niemeijer, Alaa-Eddine Ben-Zekri, Reza Bahmanyar, Philipp Schmaelzle, Franz Kurz, Houda Chaabouni: GOLD-BEV: GrOund and aeriaL Data for Dense Semantic BEV Mapping of Dynamic Scenes, arXiv, 2026
58 Michele De Vita, Julian Wiederer, Vasileios Belagiannis: Forecasting the Past: Gradient-Based Distribution Shift Detection in Trajectory Prediction, SAIAD Workshop at CVPR 2026, Denver, Colorado, 03.06.2026
59 Samed Dogan, Nico Leuze, Nicolas Rodriguez-Pena, Nikolas Ivvako, Alfred Schöttl: Diffusion-Driven Point Cloud Adaption for Depth-Only 6D Pose Estimation in Cluttered Robotics Bin-Picking, ICECET 2026
60 Ishan Saxena, Dominik Grundt, Eike Möhlmann, Bernd Westphal: Abstract Traffic Scenario Specifications for Improving Safety and Trustworthiness of AI-based Mobility Systems, RExAI 2026, Los Angeles, 04.05.2026
61 Daniel Dauner, Valentin Charraut, Bastian Berle, Tianyu Li, Long Nguyen, Jiabao Wang, Changhui Jing, Maximilian Igl, Holger Caesar, Boris Ivanovic, Yiyi Liao, Andreas Geiger, Kashyap Chitta: 123D: Unifying Multi-Modal Autonomous Driving Data at Scale, arXiv, 2026
62 Christina Ourania Tze, Daniel Dauner, Yiyi Liao, Dzmitry Tsishkou, Andreas Geiger: PrITTI: Primitive-based Generation of Controllable and Editable 3D Semantic Urban Scenes, CVPR 2026, Denver, CO, USA, 03.06.2026