SpotlightTodAI › ICLR 2026 Oral
ICLR 2026 Oral Papers
ICLR Oral 2026
All 224 papers accepted as Oral at ICLR 2026 — the top slice of the accepted programme. Every title links to its own page with authors, affiliation and sources.
Other venues
NeurIPS 2025 Spotlight 687
ICML 2026 Oral 168
NeurIPS 2025 Oral 77
ICML 2026 Spotlight 6
All 224 papers
Common Corpus: The Largest Collection of Ethical Data for LLM Pre-Training Pierre-Carl Langlais, Pavel Chizhov, Catherine Arnett et al. · Pleias
Q-RAG: Long Context Multi‑Step Retrieval via Value‑Based Embedder Training Artyom Sorokin, Nazar Buzun, Aleksandr Anokhin et al. · Applied AI Institute
From movement to cognitive maps: recurrent neural networks reveal how locomotor development shapes hippocampal spatial coding Marco P Abrate, Laurenz Muessig, Joshua P Bassett et al. · University College London, University of London
FIRE: Frobenius-Isometry Reinitialization for Balancing the Stability–Plasticity Tradeoff Isaac Han, Sangyeon Park, Seungwon Oh et al. · Gwangju Institute of Science and Technology
Exchangeability of GNN Representations with Applications to Graph Retrieval Kartik Nair, Indradyumna Roy, Soumen Chakrabarti et al. · Carnegie Mellon University
Enhancing Generative Auto-bidding with Offline Reward Evaluation and Policy Search Zhiyu Mou, Yiqin Lv, Miao Xu et al. · Alibaba Group
Why DPO is a Misspecified Estimator and How to Fix It Aditya Gopalan, Sayak Ray Chowdhury, Debangshu Banerjee · Indian Institute of Science
WebDevJudge: Evaluating (M)LLMs as Critiques for Web Development Quality Chunyang Li, Yilun Zheng, Xinting Huang et al. · Department of Computer Science and Engineering, Hong Kong University of Science and Technology
SafeDPO: A Simple Approach to Direct Preference Optimization with Enhanced Safety Geon-Hyeong Kim, Yu Jin Kim, Byoungjip Kim et al. · LG AI Research
MedAgentGym: A Scalable Agentic Training Environment for Code-Centric Reasoning in Biomedical Data Science Ran Xu, Yuchen Zhuang, Yishan Zhong et al. · Google DeepMind
Optimistic Task Inference for Behavior Foundation Models Thomas Rupf, Marco Bagatella, Marin Vlastelica et al. · ETHZ - ETH Zurich
CounselBench: A Large-Scale Expert Evaluation and Adversarial Benchmarking of Large Language Models in Mental Health Question Answering Yahan Li, Jifan Yao, John Bosco S. Bunyi et al.
AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite Jonathan Bragg, Mike D'Arcy, Nishant Balepur et al. · Allen Institute for Artificial Intelligence
Neon: Negative Extrapolation From Self-Training Improves Image Generation Sina Alemohammad, Zhangyang Wang, Richard Baraniuk · University of Texas at Austin
Compositional Diffusion with Guided search for Long-Horizon Planning Utkarsh Aashu Mishra, David He, Yongxin Chen et al. · Georgia Institute of Technology
Visual symbolic mechanisms: Emergent symbol processing in Vision Language Models Rim Assouel, Declan Iain Campbell, Yoshua Bengio et al.
Addressing divergent representations from causal interventions on neural networks Satchel Grant, Simon Jerome Han, Alexa R. Tartaglini et al. · MATS
Cross-Domain Lossy Compression via Rate- and Classification-Constrained Optimal Transport Nam Nguyen, Thinh Nguyen, Bella Bose · Oregon State University
Latent Fourier Transform Mason Long Wang, Cheng-Zhi Anna Huang · Massachusetts Institute of Technology
GLASS Flows: Efficient Inference for Reward Alignment of Flow and Diffusion Models Peter Holderrieth, Uriel Singer, Tommi Jaakkola et al. · MIT
Latent Speech-Text Transformer Yen-Ju Lu, Yashesh Gaur, Wei Zhou et al. · Johns Hopkins University
LoongRL: Reinforcement Learning for Advanced Reasoning over Long Contexts Siyuan Wang, Gaokai Zhang, Li Lyna Zhang et al. · Shanghai Jiaotong University
Speculative Actions: A Lossless Framework for Faster AI Agents Naimeng Ye, Arnav Ahuja, Georgios Liargkovas et al. · Columbia University
Gaussian certified unlearning in high dimensions: A hypothesis testing approach Aaradhya Pandey, Arnab Auddy, Haolin Zou et al. · Princeton University
RedTeamCUA: Realistic Adversarial Testing of Computer-Use Agents in Hybrid Web-OS Environments Zeyi Liao, Jaylen Jones, Linxi Jiang et al. · Ohio State University, Columbus
Exploratory Causal Inference in SAEnce Tommaso Mencattini, Riccardo Cadei, Francesco Locatello · EPFL - EPF Lausanne
Every Language Model Has a Forgery-Resistant Signature Matthew Finlayson, Xiang Ren, Swabha Swayamdipta · University of Southern California
Pre-training under infinite compute Konwoo Kim, Suhas Kotha, Percy Liang et al.
GEPA: Reflective Prompt Evolution Can Outperform Reinforcement Learning Lakshya A Agrawal, Shangyin Tan, Dilara Soylu et al. · University of California, Berkeley
p-less Sampling: A Robust Hyperparameter-Free Approach for LLM Decoding Runyan Tan, Shuang Wu, Phillip Howard · AI Labs, Thoughtworks
EigenBench: A Comparative Behavioral Measure of Value Alignment Jonathn Chang, Leonhard Piff, Suvadip Sana et al. · Cornell University
A Representer Theorem for Hawkes Processes via Penalized Least Squares Minimization Hideaki Kim, Tomoharu Iwata · NTT
UALM: Unified Audio Language Model for Understanding, Generation and Reasoning Jinchuan Tian, Sang-gil Lee, Zhifeng Kong et al. · CMU, Carnegie Mellon University
Agent Data Protocol: Unifying Datasets for Diverse, Effective Fine-tuning of LLM Agents Yueqi Song, Ketan Ramaneti, Zaid Sheikh et al. · Carnegie Mellon University
OpenApps: Simulating Environment Variations to Measure UI Agent Reliability Karen Ullrich, Jingtong Su, Claudia Shi et al. · Meta AI
Overparametrization bends the landscape: BBP transitions at initialization in simple Neural Networks Brandon Livio Annesi, Dario Bocchi, Chiara Cammarota · University of Roma "La Sapienza"
Softmax Transformers are Turing-Complete Hongjian Jiang, Michael Hahn, Georg Zetzsche et al. · Rheinland-Pfälzische Technische Universität
Steering the Herd: A Framework for LLM-based Control of Social Learning Raghu Arghal, Kevin He, Shirin Saeedi Bidokhti et al. · University of Pennsylvania, University of Pennsylvania
Quantitative Bounds for Length Generalization in Transformers Zachary Izzo, Eshaan Nichani, Jason D. Lee · NEC Labs America
AgentGym-RL: An Open-Source Framework to Train LLM Agents for Long-Horizon Decision Making via Multi-Turn RL Zhiheng Xi, Jixuan Huang, Chenyang Liao et al. · Fudan University
LLM Fingerprinting via Semantically Conditioned Watermarks Thibaud Gloaguen, Robin Staab, Nikola Jovanović et al. · ETH Zurich
Watch your steps: Dormant Adversarial Behaviors that Activate upon LLM Finetuning Thibaud Gloaguen, Mark Vero, Robin Staab et al. · ETH Zurich
Universal Inverse Distillation for Matching Models with Real-Data Supervision (No GANs) Nikita Maksimovich Kornilov, David Li, Tikhon Mavrin et al. · Applied AI Institute
Mixture-of-Experts Can Surpass Dense LLMs Under Strictly Equal Resource Houyi Li, Ka Man Lo, Shijie Xuyang et al. · Fudan University
Pareto-Conditioned Diffusion Models for Offline Multi-Objective Optimization Jatan Shrestha, Santeri Heiskanen, Kari Hepola et al. · Aalto University
The Coverage Principle: How Pre-Training Enables Post-Training Fan Chen, Audrey Huang, Noah Golowich et al. · Massachusetts Institute of Technology
Transformers are Inherently Succinct Pascal Bergsträßer, Ryan Cotterell, Anthony Widjaja Lin · Universität Kaiserslautern
Conformal Robustness Control: A New Strategy for Robust Decision Yang Hu, Jieren Tan, Changliang Zou et al. · Shanghai Jiaotong University
HATSolver: Learning Gröbner Bases with Hierarchical Attention Transformers Mohamed Malhou, Ludovic Perret, Kristin E. Lauter
It's All Just Vectorization: einx, a Universal Notation for Tensor Operations Florian Fervers, Sebastian Bullinger, Christoph Bodensteiner et al. · Fraunhofer IOSB
Fast training of accurate physics-informed neural networks without gradient descent Chinmay Datar, Taniya Kapoor, Abhishek Chandra et al. · Technische Universität München
In-Place Test-Time Training Guhao Feng, Shengjie Luo, Kai Hua et al. · Peking University
RAIN-Merging: A Gradient-Free Method to Enhance Instruction Following in Large Reasoning Models with Preserved Thinking Format Zhehao Huang, Yuhang Liu, Baijiong Lin et al. · Shanghai Jiaotong University
To Infinity and Beyond: Tool-Use Unlocks Length Generalization in State Space Models Eran Malach, Omid Saremi, Sinead Williamson et al. · Apple
TileLang: Bridge Programmability and Performance in Modern Neural Kernels Lei Wang, Yu Cheng, Yining Shi et al. · Peking University
Navigating the Latent Space Dynamics of Neural Models Marco Fumero, Luca Moschella, Emanuele Rodolà et al.
Non-Asymptotic Analysis of (Sticky) Track-and-Stop Riccardo Poiani, Martino Bernasconi, Andrea Celli · Bocconi University
The Shape of Adversarial Influence: Characterizing LLM Latent Spaces with Persistent Homology Aideen Fay, Inés García-Redondo, Qiquan Wang et al. · Imperial College London
Hyperparameter Trajectory Inference with Conditional Lagrangian Optimal Transport Harry Amad, Mihaela van der Schaar · University of Cambridge
Vid-LLM: A Compact Video-based 3D Multimodal LLM with Reconstruction–Reasoning Synergy Haijier Chen, Bo Xu, Shoujian zhang et al. · Wuhan University
From Markov to Laplace: How Mamba In-Context Learns Markov Chains Marco Bondaschi, Nived Rajaraman, Xiuying Wei et al. · EPFL - EPF Lausanne
Huxley-G\"odel Machine: Human-Level Coding Agent Development by an Approximation of the Optimal Self-Improving Machine Wenyi Wang, Piotr Piękos, Li Nanbo et al. · King Abdullah University of Science and Technology
Gaia2: Benchmarking LLM Agents on Dynamic and Asynchronous Environments Romain Froger, Pierre Andrews, Matteo Bettini et al. · Facebook
Fast Escape, Slow Convergence: Learning Dynamics of Phase Retrieval under Power-Law Data Guillaume Braun, Bruno Loureiro, Minh Ha Quang et al. · RIKEN
AutoEP: LLMs-Driven Automation of Hyperparameter Evolution for Metaheuristic Algorithms Zhenxing Xu, Yizhe Zhang, Weidong Bao et al. · National University of Defense Technology
On the Wasserstein Geodesic Principal Component Analysis of probability measures Nina Vesseron, Elsa Cazelles, Alice Le Brigant et al. · Ecole Nationale de la Statistique et de l'Administration Economique
Discount Model Search for Quality Diversity Optimization in High-Dimensional Measure Spaces Bryon Tjanaka, Henry Chen, Matthew Christopher Fontaine et al. · University of Southern California
Decentralized Attention Fails Centralized Signals: Rethinking Transformers for Medical Time Series Guoqi Yu, Juncheng Wang, Chen Yang et al.
Why Low-Precision Transformer Training Fails: An Analysis on Flash Attention Haiquan Qiu, Quanming Yao · Tsinghua University, Tsinghua University
Overcoming Joint Intractability with Lossless Hierarchical Speculative Decoding Yuxuan Zhou, Fei Huang, Heng Li et al. · Baidu
In-the-Flow Agentic System Optimization for Effective Planning and Tool Use Zhuofeng Li, Haoxiang Zhang, Seungju Han et al. · Texas A&M University - College Station
What's In My Human Feedback? Learning Interpretable Descriptions of Preference Data Rajiv Movva, Smitha Milli, Sewon Min et al. · University of California, Berkeley
SimuHome: A Temporal- and Environment-Aware Benchmark for Smart Home LLM Agents Gyuhyeon Seo, Jungwoo Yang, Junseong Pyo et al. · Seoul National University
Reasoning with Sampling: Your Base Model is Smarter Than You Think Aayush Karan, Yilun Du · Harvard University
Learning to Segment for Vehicle Routing Problems Wenbin Ouyang, Sirui Li, Yining Ma et al. · Massachusetts Institute of Technology
WAVE: Learning Unified & Versatile Audio-Visual Embeddings with Multimodal LLM Changli Tang, Qinfan Xiao, Ke Mei et al. · Tsinghua University, Tsinghua University
mCLM: A Modular Chemical Language Model that Generates Functional and Makeable Molecules Carl Edwards, Chi Han, Gawon Lee et al. · Genentech
Seeing Through the Brain: New Insights from Decoding Visual Stimuli with fMRI Zheng Huang, Enpei Zhang, Weikang Qiu et al.
Temporal Sparse Autoencoders: Leveraging the Sequential Nature of Language for Interpretability Usha Bhalla, Alex Oesterling, Claudio Mayrink Verdun et al.
VibeVoice: Expressive Podcast Generation with Next-Token Diffusion Zhiliang Peng, Jianwei Yu, Wenhui Wang et al. · Microsoft
AdAEM: An Adaptively and Automated Extensible Measurement of LLMs' Value Difference Jing Yao, Shitong Duan, Xiaoyuan Yi et al. · Microsoft
Omni-Reward: Towards Generalist Omni-Modal Reward Modeling with Free-Form Preferences Zhuoran Jin, Hongbang Yuan, Kejian Zhu et al. · Institute of Automation, Chinese Academy of Sciences
Spherical Watermark: Encryption-Free, Lossless Watermarking for Diffusion Models Xiaoxiao Hu, Jiaqi Jin, Sheng Li et al. · Fudan University
Rodrigues Network for Learning Robot Actions Jialiang Zhang, Haoran Geng, Yang You et al. · Peking University
CyberGym: Evaluating AI Agents' Real-World Cybersecurity Capabilities at Scale Zhun Wang, Tianneng Shi, Jingxuan He et al.
Energy-Based Transformers are Scalable Learners and Thinkers Alexi Gladstone, Ganesh Nanduru, Md Mofijul Islam et al. · Flapping Airplanes
Global Resolution: Optimal Multi-Draft Speculative Sampling via Convex Optimization Rahul Krishna Thomas, Arka Pal · Columbia University
FALCON: Few-step Accurate Likelihoods for Continuous Flows Danyal Rehman, Tara Akhound-Sadegh, Artem Gazizov et al. · Mila - Quebec Artificial Intelligence Institute
How Reliable is Language Model Micro-Benchmarking? Gregory Yauney, Shahzaib Saqib Warraich, Swabha Swayamdipta · Amazon
EDIT-Bench: Evaluating LLM Abilities to Perform Real-World Instructed Code Edits Wayne Chi, Valerie Chen, Ryan Shar et al. · Carnegie Mellon University
Online Learning and Equilibrium Computation with Ranking Feedback Mingyang Liu, Yongshan Chen, Zhiyuan Fan et al. · Massachusetts Institute of Technology
MC-Search: Evaluating and Enhancing Multimodal Agentic Search with Structured Long Reasoning Chains Xuying Ning, Dongqi Fu, Tianxin Wei et al. · University of Illinois at Urbana-Champaign
True Self-Supervised Novel View Synthesis is Transferable Thomas Mitchel, Hyunwoo Ryu, Vincent Sitzmann
Revela: Dense Retriever Learning via Language Modeling Fengyu Cai, Tong Chen, Xinran Zhao et al. · Technische Universität Darmstadt
LLMs Get Lost In Multi-Turn Conversation Philippe Laban, Hiroaki Hayashi, Yingbo Zhou et al. · Microsoft
TTSDS2: Resources and Benchmark for Evaluating Human-Quality Text to Speech Systems Christoph Minixhofer, Ondrej Klejch, Peter Bell · University of Edinburgh, University of Edinburgh
Mamba-3: Improved Sequence Modeling using State Space Principles Aakash Lahoti, Kevin Li, Berlin Chen et al. · CMU, Carnegie Mellon University
Is it Thinking or Cheating? Detecting Implicit Reward Hacking by Measuring Reasoning Effort Xinpeng Wang, Nitish Joshi, Barbara Plank et al. · Ludwig-Maximilians-Universität München
Causal Structure Learning in Hawkes Processes with Complex Latent Confounder Networks Songyao Jin, Biwei Huang · University of California, San Diego
Mean Flow Policy with Instantaneous Velocity Constraint for One-step Action Generation Guojian Zhan, Letian Tao, Pengcheng Wang et al. · Tsinghua University
Radiometrically Consistent Gaussian Surfels for Inverse Rendering Kyu Beom Han, Jaeyoon Kim, Woo Jae Kim et al. · Korea Advanced Institute of Science & Technology
Hubble: a Model Suite to Advance the Study of LLM Memorization Johnny Wei, Ameya Godbole, Mohammad Aflah Khan et al. · University of Southern California
Differentially Private Domain Discovery Vinod Raman, Travis Dick, Matthew Joseph · Google DeepMind
CauKer: Classification Time Series Foundation Models Can Be Pretrained on Synthetic Data Shifeng Xie, Vasilii Feofanov, Jianfeng Zhang et al. · Télécom Paris
Non-Convex Federated Optimization under Cost-Aware Client Selection Xiaowen Jiang, Anton Rodomanov, Sebastian U Stich · CISPA Helmholtz Center for Information Security
Verifying Chain-of-Thought Reasoning via Its Computational Graph Zheng Zhao, Yeskendir Koishekenov, Xianjun Yang et al. · University of Edinburgh, University of Edinburgh
How Learning Rate Decay Wastes Your Best Data in Curriculum-Based LLM Pretraining Kairong Luo, Zhenbo Sun, Haodong Wen et al. · Tsinghua University
Probabilistic Kernel Function for Fast Angle Testing Kejing Lu, Chuan Xiao, Yoshiharu Ishikawa · Yamanashi University
RefineStat: Efficient Exploration for Probabilistic Program Synthesis Madhav Kanda, Shubham Ugare, Sasa Misailovic · University of Illinois at Urbana-Champaign
Scaling Atomistic Protein Binder Design with Generative Pretraining and Test-Time Compute Kieran Didi, Zuobai Zhang, Guoqing Zhou et al. · NVIDIA
Structured Flow Autoencoders: Learning Structured Probabilistic Representations with Flow Matching Yidan Xu, Yixin Wang, XuanLong Nguyen
Plug-and-Play Compositionality for Boosting Continual Learning with Foundation Models Weiduo Liao, Fei Han, Hisao Ishibuchi et al. · City University of Hong Kong
Generating metamers of human scene understanding Ritik Raina, Abe Leite, Alexandros Graikos et al. · State University of New York at Stony Brook
Efficient Resource-Constrained Training of Transformers via Subspace Optimization Le-Trung Nguyen, Enzo Tartaglione, Van-Tam Nguyen · Télécom Paris
Learning with Dual-level Noisy Correspondence for Multi-modal Entity Alignment Haobin Li, Yijie Lin, Peng Hu et al. · School of Software Engineering, Sichuan University, Sichuan University
Pinet: Optimizing hard-constrained neural networks with orthogonal projection layers Panagiotis D. Grontas, Antonio Terpin, Efe C. Balta et al. · International Business Machines
ParaRNN: Unlocking Parallel Training of Nonlinear RNNs for Large Language Models Federico Danieli, Pau Rodriguez, Miguel Sarabia et al. · Apple
Exploring Synthesizable Chemical Space with Iterative Pathway Refinements Seul Lee, Karsten Kreis, Srimukh Prasad Veccham et al. · Korea Advanced Institute of Science and Technology
On The Surprising Effectiveness of a Single Global Merging in Decentralized Learning Tongtian Zhu, Tianyu Zhang, Mingze Wang et al. · Zhejiang University
Visual Planning: Let's Think Only with Images Yi Xu, Chengzu Li, Han Zhou et al. · Mistral AI
Optimal Sparsity of Mixture-of-Experts Language Models for Reasoning Tasks Taishi Nakamura, Satoki Ishikawa, Masaki Kawamura et al. · Institute of Science Tokyo
Exploratory Diffusion Model for Unsupervised Reinforcement Learning Chengyang Ying, Huayu Chen, Xinning Zhou et al. · Tsinghua University, Tsinghua University
DCFold: Efficient Protein Structure Generation with Single Forward Pass Zhe Zhang, Yuanning Feng, Yuxuan Song et al. · Tsinghua University
Triple-BERT: Do We Really Need MARL for Order Dispatch on Ride-Sharing Platforms? Zijian Zhao, Sen Li · Huawei Technologies Ltd.
InfoNCE Induces Gaussian Distribution Roy Betser, Eyal Gofer, Meir Yossef Levi et al. · Technion - Israel Institute of Technology, Technion
Coupling Experts and Routers in Mixture-of-Experts via an Auxiliary Loss Ang Lv, Jin Ma, Yiyuan Ma et al. · Renmin University of China
P-GenRM: Personalized Generative Reward Model with Test-time User-based Scaling Pinyi Zhang, Ting-En Lin, Yuchuan Wu et al. · East China Normal University
Modality-free Graph In-context Alignment Wei Zhuo, Siqiang Luo · Nanyang Technological University
TRACE: Your Diffusion Model is Secretly an Instance Edge Detector Sanghyun Jo, Ziseok Lee, Wooyeol Lee et al. · OGQ
Scaling Laws and Spectra of Shallow Neural Networks in the Feature Learning Regime Leonardo Defilippis, Yizhou Xu, Julius Girardin et al. · Ecole Normale Supérieure, Ecole Normale Supérieure de Paris
MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent Hongli Yu, Tinghong Chen, Jiangtao Feng et al. · Tsinghua University
TD-JEPA: Latent-predictive Representations for Zero-Shot Reinforcement Learning Marco Bagatella, Matteo Pirotta, Ahmed Touati et al. · Max Planck Institute for Intelligent Systems, Max Planck Institute for Intelligent Systems
NextStep-1: Toward Autoregressive Image Generation with Continuous Tokens at Scale Chunrui Han, Guopeng Li, Jingwei Wu et al. · Stepfun
Differentiable Model Predictive Control on the GPU Emre Adabag, Marcus Greiff, John Subosits et al. · University of Michigan - Ann Arbor
Planner Aware Path Learning in Diffusion Language Models Training Fred Zhangzhi Peng, Zachary Bezemek, Jarrid Rector-Brooks et al. · Duke University
PateGAIL++: Utility Optimized Private Trajectory Generation with Imitation Learning Yingjie Ma, Bijal Bharadva, Xin Zhang et al.
MetaEmbed: Scaling Multimodal Retrieval at Test-Time with Flexible Late Interaction Zilin Xiao, Qi Ma, Mengting Gu et al. · Rice University
Monocular Normal Estimation via Shading Sequence Estimation Zongrui Li, Xinhua Ma, Minghui Hu et al. · Nanyang Technological University
Shoot First, Ask Questions Later? Building Rational Agents that Explore and Act Like People Gabriel Grand, Valerio Pepe, Joshua B. Tenenbaum et al. · Massachusetts Institute of Technology
Intrinsic Entropy of Context Length Scaling in LLMs Jingzhe Shi, Qinwei Ma, Hongyi Liu et al. · Tsinghua University
Latent Particle World Models: Self-supervised Object-centric Stochastic Dynamics Modeling Tal Daniel, Carl Qi, Dan Haramati et al. · Carnegie Mellon University
Beyond Prompt-Induced Lies: Investigating LLM Deception on Benign Prompts Zhaomin Wu, Mingzhe Du, See-Kiong Ng et al. · National University of Singapore
LLM DNA: Tracing Model Evolution via Functional Representations Zhaomin Wu, Haodong Zhao, Ziyang Wang et al. · National University of Singapore
Generative Universal Verifier as Multimodal Meta-Reasoner Xinchen Zhang, Xiaoying Zhang, Youbin Wu et al. · ByteDance Seed
$PhyWorldBench$: A Comprehensive Evaluation of Physical Realism in Text-to-Video Models Jing Gu, Xian Liu, Yu Zeng et al. · xAI
World-In-World: World Models in a Closed-Loop World Jiahan Zhang, Muqing Jiang, Nanru Dai et al.
Multimodal Aligned Semantic Knowledge for Unpaired Image-text Matching Laiguo Yin, Yixin Zhang, YUQING SUN et al. · Shandong University
DiffusionNFT: Online Diffusion Reinforcement with Forward Process Kaiwen Zheng, Huayu Chen, Haotian Ye et al. · Tsinghua University
The Spacetime of Diffusion Models: An Information Geometry Perspective Rafal Karczewski, Markus Heinonen, Alison Pouplin et al. · Aalto University
Reducing Belief Deviation in Reinforcement Learning for Active Reasoning of LLM Agents Deyu Zou, Yongqiang Chen, Jianxiang Wang et al. · Department of Computer Science and Engineering, The Chinese University of Hong Kong
Information Shapes Koopman Representation Xiaoyuan Cheng, Wenxuan Yuan, Yiming Yang et al. · University College London, University of London
Sequences of Logits Reveal the Low Rank Structure of Language Models Noah Golowich, Allen Liu, Abhishek Shetty · Microsoft
BIRD-INTERACT: Re-imagining Text-to-SQL Evaluation via Lens of Dynamic Interactions Nan Huo, Xiaohan Xu, Jinyang Li et al. · the University of Hong Kong, University of Hong Kong
EditVerse: Unifying Image and Video Editing and Generation with In-Context Learning Xuan Ju, Tianyu Wang, Yuqian Zhou et al. · Chinese University of Hong Kong
The Art of Scaling Reinforcement Learning Compute for LLMs Fnu Devvrit, Lovish Madaan, Rishabh Tiwari et al. · , University of Texas at Austin
Partition Generative Modeling: Masked Modeling Without Masks Justin Deschenaux, Lan Tran, Caglar Gulcehre · EPFL - EPF Lausanne
How Do Transformers Learn to Associate Tokens: Gradient Leading Terms Bring Mechanistic Interpretability Shawn Im, Changdae Oh, Zhen Fang et al. · Department of Computer Science, University of Wisconsin - Madison
On the Reasoning Abilities of Masked Diffusion Language Models Anej Svete, Ashish Sabharwal · Department of Computer Science, ETHZ - ETH Zurich
FRABench and UFEval: Unified Fine-grained Evaluation with Task and Aspect Generalization Shibo Hong, Jiahao Ying, Haiyuan Liang et al. · Fudan University
Quotient-Space Diffusion Models Yixian Xu, Yusong Wang, Shengjie Luo et al. · Peking University
SWINGARENA: Adversarial Programming Arena for Long-context GitHub Issue Solving Wendong XU, Jing Xiong, Chenyang Zhao et al. · University of Hong Kong
AnyUp: Universal Feature Upsampling Thomas Wimmer, Prune Truong, Marie-Julie Rakotosaona et al. · Max-Planck Institute
High-dimensional Analysis of Synthetic Data Selection Parham Rezaei, Filip Kovačević, Francesco Locatello et al. · Institute of Science and Technology Austria
Task-free Adaptive Meta Black-box Optimization Chao Wang, Licheng Jiao, Lingling Li et al. · Xidian University
Token-Importance Guided Direct Preference Optimization Ning Yang, Hai Lin, Yibo Liu et al. · Institute of automation, Chinese academy of science, Chinese Academy of Sciences
DTO-KD: Dynamic Trade-off Optimization for Effective Knowledge Distillation Zeeshan Hayder, Ali Cheraghian, Lars Petersson et al. · Google
Distributional Equivalence in Linear Non-Gaussian Latent-Variable Cyclic Causal Models: Characterization and Learning Haoyue Dai, Immanuel Albrecht, Peter Spirtes et al. · Carnegie Mellon University
Reliable Weak-to-Strong Monitoring of LLM Agents Neil Kale, Chen Bo Calvin Zhang, Kevin Zhu et al. · School of Computer Science, Carnegie Mellon University
Multiplayer Nash Preference Optimization Fang Wu, Xu Huang, Weihao Xuan et al.
Multi-Domain Riemannian Graph Gluing for Building Graph Foundation Models Li Sun, Zhenhao Huang, Silei Chen et al. · Beijing University of Post and Telecommunications
TROLL: Trust Regions Improve Reinforcement Learning for Large Language Models Philipp Becker, Niklas Freymuth, Serge Thilges et al. · Facebook
FlashVID: Efficient Video Large Language Models via Training-free Tree-based Spatiotemporal Token Merging Ziyang Fan, Keyu Chen, Ruilong Xing et al. · Harbin Institute of Technology, Shenzhen
WSM: Decay-Free Learning Rate Schedule via Checkpoint Merging for LLM Pre-training Changxin Tian, jiapeng wang, Qian Zhao et al. · Ant Group
MrRoPE: Mixed-radix Rotary Position Embedding Qingyuan Tian, Wenhong Zhu, Xiaoran Liu et al. · Shanghai Jiaotong University
OpenThoughts: Data Recipes for Reasoning Models Etash Kumar Guha, Ryan Marten, Sedrick Keh et al. · RIKEN
Text-to-3D by Stitching a Multi-view Reconstruction Network to a Video Generator Hyojun Go, Dominik Narnhofer, Goutam Bhat et al. · ETHZ - ETH Zurich
A Scalable Distributed Framework for Multimodal GigaVoxel Image Registration Rohit Jena, Vedant Zope, Pratik Chaudhari et al. · University of Pennsylvania
Invisible Safety Threat: Malicious Finetuning for LLM via Steganography Guangnian Wan, Xinyin Ma, Gongfan Fang et al. · National University of Singapore
Temporal superposition and feature geometry of RNNs under memory demands Pratyaksh Sharma, Alexandra Maria Proca, Lucas Prieto et al. · G-Research
InfoTok: Adaptive Discrete Video Tokenizer via Information-Theoretic Compression Haotian Ye, Qiyuan He, Jiaqi Han et al. · Stanford University
Actions Speak Louder than Prompts: A Large-Scale Study of LLMs for Graph Inference Ben Finkelshtein, Silviu Cucerzan, Sujay Kumar Jauhar et al. · University of Oxford
Through the Lens of Contrast: Self-Improving Visual Reasoning in VLMs Zhiyu Pan, Yizheng Wu, Jiashen Hua et al. · Alibaba Group
SAFETY-GUIDED FLOW (SGF): A UNIFIED FRAMEWORK FOR NEGATIVE GUIDANCE IN SAFE GENERATION Mingyu Kim, Young-Heon Kim, Mijung Park · Kookmin University
Depth Anything 3: Recovering the Visual Space from Any Views Haotong Lin, Sili Chen, Jun Hao Liew et al. · Zhejiang University
Taming Momentum: Rethinking Optimizer States Through Low-Rank Approximation Zhengbo Wang, Jian Liang, Ran He et al. · University of Science and Technology of China
Premise Selection for a Lean Hammer Thomas Zhu, Joshua Clune, Jeremy Avigad et al. · ByteDance Inc.
DepthLM: Metric Depth from Vision Language Models Zhipeng Cai, Ching-Feng Yeh, Hu Xu et al. · Meta
Hallucination Begins Where Saliency Drops Xiaofeng Zhang, Yuanchao Zhu, Chaochen Gu et al. · Shanghai Jiao Tong University
Overthinking Reduction with Decoupled Rewards and Curriculum Data Scheduling Shuyang Jiang, Yusheng Liao, Ya Zhang et al. · Fudan University
On the Generalization Capacities of MLLMs for Spatial Intelligence Gongjie Zhang, Wenhao Li, Quanhao Qian et al. · Alibaba Group
The Polar Express: Optimal Matrix Sign Methods and their Application to the Muon Algorithm Noah Amsel, David Persson, Christopher Musco et al. · NYU, New York University
Characterizing the Discrete Geometry of ReLU Networks Blake B. Gaines, Jinbo Bi · University of Connecticut
ThinKV: Thought-Adaptive KV Cache Compression for Efficient Reasoning Models Akshat Ramachandran, Marina Neseem, Charbel Sakr et al. · Georgia Institute of Technology
Difficult Examples Hurt Unsupervised Contrastive Learning: A Theoretical Perspective Yi-Ge Zhang, Jingyi Cui, Qiran Li et al. · Peking University
Let Features Decide Their Own Solvers: Hybrid Feature Caching for Diffusion Transformers Shikang Zheng, Guantao Chen, Qinming Zhou et al.
MotionStream: Real-Time Video Generation with Interactive Motion Controls Joonghyuk Shin, Zhengqi Li, Richard Zhang et al. · Seoul National University
BioX-Bridge: Model Bridging for Unsupervised Cross-Modal Knowledge Transfer across Biosignals Chenqi Li, Yu Liu, Timothy Denison et al. · University of Oxford
Compactness and Consistency: A Conjoint Framework for Deep Graph Clustering Wei Ju, Siyu Yi, Kangjie Zheng et al.
WAFT: Warping-Alone Field Transforms for Optical Flow Yihan Wang, Jia Deng · Princeton University
FlashWorld: High-quality 3D Scene Generation within Seconds Xinyang Li, Tengfei Wang, Zixiao Gu et al. · Xiamen University
TabStruct: Measuring Structural Fidelity of Tabular Data Xiangjian Jiang, Nikola Simidjievski, Mateja Jamnik · University of Cambridge
Uncover Underlying Correspondence for Robust Multi-view Clustering Haochen Zhou, Guofeng Ding, Mouxing Yang et al. · Sichuan University
Instilling an Active Mind in Avatars via Cognitive Simulation Jianwen Jiang, Weihong Zeng, Zerong Zheng et al.
Diffusion Language Model Knows the Answer Before It Decodes Pengxiang Li, Yefan Zhou, Dilxat Muhtar et al. · Hong Kong Polytechnic University
Generative Human Geometry Distribution Xiangjun Tang, Biao Zhang, Peter Wonka · King Abdullah University of Science and Technology
EmotionThinker: Prosody-Aware Reinforcement Learning for Explainable Speech Emotion Reasoning Dingdong WANG, Shujie LIU, Tianhua Zhang et al. · Chinese University of Hong Kong, The Chinese University of Hong Kong
Mastering Sparse CUDA Generation through Pretrained Models and Deep Reinforcement Learning Yaoyu Wang, Hankun Dai, Zhidong Yang et al. · University of Chinese Academy of Sciences
LongWriter-Zero: Mastering Ultra-Long Text Generation via Reinforcement Learning Yuhao Wu, Yushi Bai, Zhiqiang Hu et al. · Singapore University of Technology and Design
RealPDEBench: A Benchmark for Complex Physical Systems with Real-World Data Peiyan Hu, Haodong Feng, Hongyuan Liu et al. · Chinese Academy of Sciences
Improving Diffusion Models for Class-imbalanced Training Data via Capacity Manipulation Feng Hong, Jiangchao Yao, Yifei Shen et al. · Shanghai Jiao Tong University
SANA-Video: Efficient Video Generation with Block Linear Diffusion Transformer Junsong Chen, Yuyang Zhao, Jincheng YU et al. · University of Hong Kong
Stable Video Infinity: Infinite-Length Video Generation with Error Recycling Wuyang Li, Wentao Pan, Po-Chien Luan et al. · EPFL - EPF Lausanne
Extending Sequence Length is Not All You Need: Effective Integration of Multimodal Signals for Gene Expression Prediction Zhao Yang, Yi Duan, Jiwei Zhu et al. · Renmin University of China
MomaGraph: State-Aware Unified Scene Graphs with Vision-Language Models for Embodied Task Planning Yuanchen Ju, Yongyuan Liang, Yen-Jen Wang et al.
Learning to See Before Seeing: Demystifying LLM Visual Priors from Language Pre-training Junlin Han, Shengbang Tong, David Fan et al. · University of Oxford
Benchmarking Empirical Privacy Protection for Adaptations of Large Language Models Bartłomiej Marek, Lorenzo Rossi, Vincent Hanke et al. · CISPA Helmholtz Center for Information Security
ScaleCUA: Scaling Open-Source Computer Use Agents with Cross-Platform Data Zhaoyang Liu, JingJing Xie, Zichen Ding et al. · Hong Kong University of Science and Technology
Train-before-Test Harmonizes Language Model Rankings Guanhua Zhang, Ricardo Dominguez-Olmedo, Moritz Hardt · Max Planck Institute for Intelligent Systems, Max-Planck Institute
One for Two: A Unified Framework for Imbalanced Graph Classification via Dynamic Balanced Prototype Guanjun Wang, Binwu Wang, Jiaming Ma et al. · University of Science and Technology of China
Veritas: Generalizable Deepfake Detection via Pattern-Aware Reasoning Hao Tan, jun lan, Zichang Tan et al. · Institute of automation, Chinese Academy of Sciences
Semi-Supervised Preference Optimization with Limited Feedback Seonggyun Lee, Sungjun Lim, Seojin Park et al. · Yonsei University
Locality-aware Parallel Decoding for Efficient Autoregressive Image Generation Zhuoyang Zhang, Luke J. Huang, Chengyue Wu et al. · Massachusetts Institute of Technology
Reasoning as Representation: Rethinking Visual Reinforcement Learning in Image Quality Assessment Shijie Zhao, Xuanyu Zhang, Weiqi Li et al. · ByteDance Inc.
Half-order Fine-Tuning for Diffusion Model: A Recursive Likelihood Ratio Optimizer Tao Ren, Zishi Zhang, Jinyang Jiang et al. · Peking University
← Browse the whole archive