SpotlightTodAI › NeurIPS 2025 Oral
NeurIPS 2025 Oral Papers
NeurIPS Oral 2025
All 77 papers accepted as Oral at NeurIPS 2025 — the top slice of the accepted programme. Every title links to its own page with authors, affiliation and sources.
Other venues
NeurIPS 2025 Spotlight 687
ICLR 2026 Oral 224
ICML 2026 Oral 168
ICML 2026 Spotlight 6
All 77 papers
Generalized Linear Mode Connectivity for Transformers Alexander Theus, Alessandro Cabodi, Sotiris Anagnostidis et al. · ETHZ - ETH Zurich
Deep Compositional Phase Diffusion for Long Motion Sequence Generation Ho Yin Au, Jie Chen, Junkun Jiang et al. · Hong Kong Baptist University
GnnXemplar: Exemplars to Explanations - Natural Language Rules for Global GNN Interpretability Burouj Armgaan, Eshan Jain, Harsh Pandey et al. · Indian Institute of Technology Delhi
RAG4GFM: Bridging Knowledge Gaps in Graph Foundation Models through Graph Retrieval Augmented Generation Xingliang Wang, Zemin Liu, Junxiao Han et al. · Zhejiang University
Agnostic Active Learning Is Always Better Than Passive Learning Steve Hanneke · Purdue University
Learning Linear Attention in Polynomial Time Morris Yau, Ekin Akyürek, Jiayuan Mao et al. · Massachusetts Institute of Technology
Optimal Mistake Bounds for Transductive Online Learning Zachary Chase, Steve Hanneke, Shay Moran et al. · University of California, San Diego
State Entropy Regularization for Robust Reinforcement Learning Yonatan Ashlag, Uri Koren, Mirco Mutti et al. · Technion - Israel Institute of Technology, Technion
On the Closed-Form of Flow Matching: Generalization Does Not Arise from Target Stochasticity Quentin Bertrand, Anne Gagneux, Mathurin Massias et al. · INRIA
Why Diffusion Models Don’t Memorize: The Role of Implicit Dynamical Regularization in Training Tony Bonnaire, Raphaël Urfin, Giulio Biroli et al. · Université Paris-Saclay
Adjoint Schrödinger Bridge Sampler Guan-Horng Liu, Jaemoo Choi, Yongxin Chen et al. · FAIR, Meta AI
Breaking the Performance Ceiling in Reinforcement Learning requires Inference Strategies Felix Chalumeau, Daniel Rajaonarivonivelomanantsoa, Ruan John de Kock et al. · InstaDeep
High-Dimensional Calibration from Swap Regret Maxwell Fishelson, Noah Golowich, Mehryar Mohri et al. · Massachusetts Institute of Technology
In Search of Adam’s Secret Sauce Antonio Orvieto, Robert M. Gower · ELLIS Institute Tübingen, Max Planck Institute for Intelligent Systems, Tübingen AI Center, Tübingen, Germany
An Optimized Franz-Parisi Criterion and its Equivalence with SQ Lower Bounds Siyu Chen, Theodor Misiakiewicz, Ilias Zadik et al. · Yale University
MaxSup: Overcoming Representation Collapse in Label Smoothing Yuxuan Zhou, Heng Li, Zhi-Qi Cheng et al. · Baidu
Memory Mosaics at scale Jianyu Zhang, Leon Bottou · New York University
The emergence of sparse attention: impact of data distribution and benefits of repetition Nicolas Zucchet, Francesco D'Angelo, Andrew Kyle Lampinen et al. · ETHZ - ETH Zurich
ControlFusion: A Controllable Image Fusion Network with Language-Vision Degradation Prompts Linfeng Tang, Yeda Wang, Zhanchuan Cai et al. · Wuhan University
Identifiability of Deep Polynomial Neural Networks Konstantin Usevich, Ricardo Augusto Borsoi, Clara Dérand et al. · CNRS
Understanding and Mitigating Numerical Sources of Nondeterminism in LLM Inference Jiayi Yuan, Hao Li, Xinheng Ding et al. · Rice University
PRIMT: Preference-based Reinforcement Learning with Multimodal Feedback and Trajectory Synthesis from Foundation Models Ruiqi Wang, Dezhong Zhao, Ziqin Yuan et al. · Purdue University
A is for Absorption: Studying Feature Splitting and Absorption in Sparse Autoencoders David Chanin, James Wilken-Smith, Tomáš Dulka et al. · MATS
EvoLM: In Search of Lost Training Dynamics for Language Model Reasoning Zhenting Qi, Fan Nie, Alexandre Alahi et al. · Harvard University
Analog In-memory Training on General Non-ideal Resistive Elements: The Impact of Response Functions Zhaoxian Wu, Quan Xiao, Tayfun Gokmen et al. · Cornell University
Discovering Opinion Intervals from Conflicts in Signed Graphs Peter Blohm, Florian Chen, Aristides Gionis et al. · Technische Universität Wien
A Clean Slate for Offline Reinforcement Learning Matthew Thomas Jackson, Uljad Berdica, Jarek Luca Liesen et al. · Google DeepMind
Spectral Perturbation Bounds for Low-Rank Approximation with Applications to Privacy Phuc Tran, Van Vu, Nisheeth K. Vishnoi · VinUniversity
Improved Regret Bounds for Gaussian Process Upper Confidence Bound in Bayesian Optimization Shogo Iwazaki · MI-6 Ltd.
Auto-Compressing Networks Vaggelis Dorovatas, Georgios Paraskevopoulos, Alexandros Potamianos · National Technical University of Athens
MokA: Multimodal Low-Rank Adaptation for MLLMs Yake Wei, Yu Miao, Dongzhan Zhou et al. · Renmin University of China
Advancing Expert Specialization for Better MoE Hongcan Guo, Haolang Lu, Guoshun Nan et al. · ByteDance Inc.
From Condensation to Rank Collapse: A Two-Stage Analysis of Transformer Training Dynamics Zheng-An Chen, Tao Luo · Shanghai Jiaotong University
Large Language Diffusion Models Shen Nie, Fengqi Zhu, Zebin You et al. · Renmin University of China
Boosting Knowledge Utilization in Multimodal Large Language Models via Adaptive Logits Fusion and Attention Reallocation Wenbin An, Jiahao Nie, Feng Tian et al. · Xi'an Jiaotong University
Interactive Cross-modal Learning for Text-3D Scene Retrieval Yanglin Feng, Yongxiang Li, Yuan Sun et al. · Sichuan University
Rethinking Joint Maximum Mean Discrepancy for Visual Domain Adaptation Wei Wang, Haifeng Xia, Chao Huang et al. · SUN YAT-SEN UNIVERSITY
Pan-LUT: Efficient Pan-sharpening via Learnable Look-Up Tables Zhongnan Cai, Yingying Wang, Hui Zheng et al. · Xiamen University
Dynamical Decoupling of Generalization and Overfitting in Large Two-Layer Networks Andrea Montanari, Pierfrancesco Urbani · Stanford University
1000 Layer Networks for Self-Supervised RL: Scaling Depth Can Enable New Goal-Reaching Capabilities Kevin Wang, Ishaan Javali, Michał Bortkiewicz et al. · Princeton University
Depth-Bounds for Neural Networks via the Braid Arrangement Moritz Leo Grillo, Christoph Hertrich, Georg Loho · Max-Planck Institute
Tighter CMI-Based Generalization Bounds via Stochastic Projection and Quantization Milad Sefidgaran, Kimia Nadjahi, Abdellatif Zaidi · Huawei Paris Research Center
A Snapshot of Influence: A Local Data Attribution Framework for Online Reinforcement Learning Yuzheng Hu, Fan Wu, Haotian Ye et al. · University of Illinois at Urbana-Champaign
High-dimensional neuronal activity from low-dimensional latent dynamics: a solvable model Valentin Schmutz, Ali Haydaroğlu, Shuqi Wang et al. · University College London, University of London
Adaptive Surrogate Gradients for Sequential Reinforcement Learning in Spiking Neural Networks Korneel Van den Berghe, Stein Stroobants, Vijay Janapa Reddi et al. · Delft University of Technology
Class-wise Balancing Data Replay for Federated Class-Incremental Learning Zhuang Qi, Ying-Peng Tang, Lei Meng et al. · Shandong University
Task-Optimized Convolutional Recurrent Networks Align with Tactile Processing in the Rodent Brain Trinity Chung, Yuchen Shen, Nathan Kong et al.
ElasticMM: Efficient Multimodal LLMs Serving with Elastic Multimodal Parallelism Zedong Liu, Shenggan Cheng, Guangming Tan et al. · University of Electronic Science and Technology of China
Dynamical Low-Rank Compression of Neural Networks with Robustness under Adversarial Attacks Steffen Schotthöfer, H. Lexie Yang, Stefan Schnake · Oak Ridge National Laboratory
QoQ-Med: Building Multimodal Clinical Foundation Models with Domain-Aware GRPO Training Wei Dai, Peilin Chen, Chanakya Ekbote et al. · Massachusetts Institute of Technology
Gated Attention for Large Language Models: Non-linearity, Sparsity, and Attention-Sink-Free Zihan Qiu, Zekun Wang, Bo Zheng et al. · Alibaba Group
Learning long range dependencies through time reversal symmetry breaking Guillaume Pourcel, Maxence Ernoult · INRIA
FuXi-Ocean: A Global Ocean Forecasting System with Sub-Daily Resolution Qiusheng Huang, Yuan Niu, Xiaohui Zhong et al. · Fudan University
Superposition Yields Robust Neural Scaling Yizhou Liu, Ziming Liu, Jeff Gore · Massachusetts Institute of Technology
ImageNet-trained CNNs are not biased towards texture: Revisiting feature reliance through controlled suppression Tom Burgert, Oliver Stoll, Paolo Rota et al. · Technische Universität Berlin
On Linear Mode Connectivity of Mixture-of-Experts Architectures Viet-Hoang Tran, Van-Hoan Trinh, Khanh Vinh Bui et al. · National University of Singapore
OpenHOI: Open-World Hand-Object Interaction Synthesis with Multimodal Large Language Model Zhenhao Zhang, Ye Shi, Lingxiao Yang et al.
Representation Entanglement for Generation: Training Diffusion Transformers Is Much Easier Than You Think Ge Wu, Shen Zhang, Ruijing Shi et al. · Nankai University
Dynam3D: Dynamic Layered 3D Tokens Empower VLM for Vision-and-Language Navigation Zihan Wang, Seungjun Lee, Gim Hee Lee · National University of Singapore
Learning (Approximately) Equivariant Networks via Constrained Optimization Andrei Manolache, Luiz F. O. Chamon, Mathias Niepert · Universität Stuttgart
SAGE: A Unified Framework for Generalizable Object State Recognition with State-Action Graph Embedding Yuan Zang, Zitian Tang, Junho Cho et al. · Brown University
Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model? Yang Yue, Zhiqi Chen, Rui Lu et al.
Learning to Learn with Contrastive Meta-Objective Shiguang Wu, Yaqing Wang, Yatao Bian et al. · Tsinghua University, Tsinghua University
KVzip: Query-Agnostic KV Cache Compression with Context Reconstruction Jang-Hyun Kim, Jinuk Kim, Sangwoo Kwon et al. · Apple
HyperET: Efficient Training in Hyperbolic Space for Multi-modal Large Language Models Zelin Peng, Zhengqin Xu, Qingyang Liu et al. · Shanghai Jiaotong University
SAVVY: Spatial Awareness via Audio-Visual LLMs through Seeing and Hearing Mingfei Chen, Zijun Cui, Xiulong Liu et al. · University of Washington
A multiscale analysis of mean-field transformers in the moderate interaction regime Giuseppe Bruno, Federico Pasqualotto, Andrea Agazzi · Universität Bern
Exploring Diffusion Transformer Designs via Grafting Keshigeyan Chandrasegaran, Michael Poli, Daniel Y Fu et al. · Stanford University
Generalized Gradient Norm Clipping & Non-Euclidean $(L_0,L_1)$-Smoothness Thomas Pethick, Wanyun Xie, Mete Erdogan et al. · Swiss Federal Institute of Technology Lausanne
Rethinking Multimodal Learning from the Perspective of Mitigating Classification Ability Disproportion Qing-Yuan Jiang, Longfei Huang, Yang Yang · Nanjing University of Science and Technology
TransferTraj: A Vehicle Trajectory Learning Model for Region and Task Transferability Tonglong Wei, Yan Lin, Zeyu Zhou et al. · Beijing Jiaotong University
PhySense: Sensor Placement Optimization for Accurate Physics Sensing Yuezhou Ma, Haixu Wu, Hang Zhou et al. · Tsinghua University, Tsinghua University
InfinityStar: Unified Spacetime AutoRegressive Modeling for Visual Generation Jinlai Liu, Jian Han, Bin Yan et al. · ByteDance Inc.
Does Stochastic Gradient really succeed for bandits? Dorian Baudry, Emmeran Johnson, Simon Vary et al. · INRIA
Perception Encoder: The best visual embeddings are not at the output of the network Daniel Bolya, Po-Yao Huang, Peize Sun et al. · Meta
PlayerOne: Egocentric World Simulator Yuanpeng Tu, Hao Luo, Xi Chen et al. · The University of Hong Kong
Mean Flows for One-step Generative Modeling Zhengyang Geng, Mingyang Deng, Xingjian Bai et al. · Carnegie Mellon University
← Browse the whole archive