SpotlightTodAI › NeurIPS 2025 Spotlight
NeurIPS 2025 Spotlight Papers
NeurIPS Spotlight 2025
All 687 papers accepted as Spotlight at NeurIPS 2025 — the top slice of the accepted programme. Every title links to its own page with authors, affiliation and sources.
Other venues
ICLR 2026 Oral 224
ICML 2026 Oral 168
NeurIPS 2025 Oral 77
ICML 2026 Spotlight 6
All 687 papers
MoCha: Towards Movie-Grade Talking Character Generation Cong Wei, Bo Sun, Haoyu Ma et al.
WISA: World simulator assistant for physics-aware text-to-video generation Jing Wang, Ao Ma, Ke Cao et al.
ModHiFi: Identifying High Fidelity predictive components for Model Modification Dhruva Kashyap, Chaitanya Murti, Pranav K Nayak et al.
The Structure of Relation Decoding Linear Operators in Large Language Models Miranda Anna Christ, Adrián Csiszárik, Gergely Becsó et al.
KLASS: KL-Guided Fast Inference in Masked Diffusion Models Seo Hyun Kim, Sunwoo Hong, Hojung Jung et al.
HM3: Hierarchical Multi-Objective Model Merging for Pretrained Models Yu Zhou, Xingyu Wu, Jibin Wu et al.
Structured Sparse Transition Matrices to Enable State Tracking in State-Space Models Aleksandar Terzic, Nicolas Menet, Michael Hersche et al.
Twilight: Adaptive Attention Sparsity with Hierarchical Top-$p$ Pruning Chaofan Lin, Jiaming Tang, Shuo Yang et al.
An Analysis of Causal Effect Estimation using Outcome Invariant Data Augmentation UZAIR AKBAR, Niki Kilbertus, Hao Shen et al.
Deciphering the Extremes: A Novel Approach for Pathological Long-tailed Recognition in Scientific Discovery Zhe Zhao, HaiBin Wen, Xianfu Liu et al.
OpenCUA: Open Foundations for Computer-Use Agents Xinyuan Wang, Bowen Wang, Dunjie Lu et al.
Near-Optimal Experiment Design in Linear non-Gaussian Cyclic Models Ehsan Sharifian, Saber Salehkaleybar, Negar Kiyavash
Escaping saddle points without Lipschitz smoothness: the power of nonlinear preconditioning Alexander Bodard, Panagiotis Patrinos
Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models Zekai Zhao, Qi Liu, Kun Zhou et al.
Direct Fisher Score Estimation for Likelihood Maximization Sherman Khoo, Yakun Wang, Song Liu et al.
Path-Enhanced Contrastive Learning for Recommendation Haoran Sun, Fei Xiong, Yuanzhe Hu et al.
T-REGS: Minimum Spanning Tree Regularization for Self-Supervised Learning Julie Mordacq, David Loiseaux, Vicky Kalogeiton et al.
Generating Informative Samples for Risk-Averse Fine-Tuning of Downstream Tasks Heasung Kim, Taekyun Lee, Hyeji Kim et al.
AceSearcher: Bootstrapping Reasoning and Search for LLMs via Reinforced Self-Play Ran Xu, Yuchen Zhuang, Zihan Dong et al.
DeltaFlow: An Efficient Multi-frame Scene Flow Estimation Method Qingwen Zhang, Xiaomeng Zhu, Yushan Zhang et al.
Web-Shepherd: Advancing PRMs for Reinforcing Web Agents Hyungjoo Chae, Sunghwan Kim, Junhee Cho et al.
How do Transformers Learn Implicit Reasoning? Jiaran Ye, Zijun Yao, Zhidian Huang et al.
On the sample complexity of semi-supervised multi-objective learning Tobias Wegel, Geelon So, Junhyung Park et al.
Diversity-Aware Policy Optimization for Large Language Model Reasoning Jian Yao, Ran Cheng, Xingyu Wu et al.
Fixed-Point RNNs: Interpolating from Diagonal to Dense Sajad Movahedi, Felix Sarnthein, Nicola Muca Cirone et al.
Bridging Theory and Practice in Link Representation with Graph Neural Networks Veronica Lachi, Francesco Ferrini, Antonio Longa et al.
ErrorTrace: A Black-Box Traceability Mechanism Based on Model Family Error Space Chuanchao Zang, Xiangtao Meng, Wenyu Chen et al.
Protein Design with Dynamic Protein Vocabulary Nuowei Liu, Jiahao Kuang, Yanting Liu et al.
Towards Reliable Code-as-Policies: A Neuro-Symbolic Framework for Embodied Task Planning Sanghyun Ahn, Wonje Choi, Junyong Lee et al.
AI-Researcher: Autonomous Scientific Innovation Jiabin Tang, Lianghao Xia, Zhonghang Li et al.
Abstain Mask Retain Core: Time Series Prediction by Adaptive Masking Loss with Representation Consistency Renzhao Liang, Sizhe Xu, Chenggang Xie et al.
DexFlyWheel: A Scalable and Self-improving Data Generation Framework for Dexterous Manipulation Kefei Zhu, Fengshuo Bai, YuanHao Xiang et al.
Learning Robust Vision-Language Models from Natural Latent Spaces Zhangyun Wang, Ni Ding, Aniket Mahanti
Accelerating Diffusion LLMs via Adaptive Parallel Decoding Daniel Mingyi Israel, Guy Van den Broeck, Aditya Grover
Inner Speech as Behavior Guides: Steerable Imitation of Diverse Behaviors for Human-AI coordination Rakshit Trivedi, Kartik Sharma, David C. Parkes
Graph-Based Attention for Differentiable MaxSAT Solving Sota Moriyama, Katsumi Inoue
Pass@K Policy Optimization: Solving Harder Reinforcement Learning Problems Christian Walder, Deep Tejas Karkhanis
LogicTree: Improving Complex Reasoning of LLMs via Instantiated Multi-step Synthetic Logical Data Zehao Wang, Lin Yang, Jie Wang et al.
Multitask Learning with Stochastic Interpolants Hugo Negrel, Florentin Coeurdoux, Michael Samuel Albergo et al.
FUDOKI: Discrete Flow-based Unified Understanding and Generation via Kinetic-Optimal Velocities Jin Wang, Yao Lai, Aoxue Li et al.
Fast MRI for All: Bridging Access Gaps by Training without Raw Data Yasar Utku Alcalar, Merve Gulle, Mehmet Akcakaya
Knowledge Insulating Vision-Language-Action Models: Train Fast, Run Fast, Generalize Better Danny Driess, Jost Tobias Springenberg, brian ichter et al.
Complete Structure Guided Point Cloud Completion via Cluster- and Instance-Level Contrastive Learning Yang Chen, Yirun Zhou, WEIZHONG ZHANG et al.
ARECHO: Autoregressive Evaluation via Chain-Based Hypothesis Optimization for Speech Multi-Metric Estimation Jiatong Shi, Yifan Cheng, Bo-Hao Su et al.
Projective Equivariant Networks via Second-order Fundamental Differential Invariants Yikang Li, Yeqing Qiu, Yuxuan Chen et al.
ZeroS: Zero‑Sum Linear Attention for Efficient Transformers Jiecheng Lu, Xu Han, Yan Sun et al.
Blameless Users in a Clean Room: Defining Copyright Protection for Generative Models Aloni Cohen
Adaptive 3D Reconstruction via Diffusion Priors and Forward Curvature-Matching Likelihood Updates Seunghyeok Shin, Dabin Kim, Hongki Lim
From Shortcut to Induction Head: How Data Diversity Shapes Algorithm Selection in Transformers Ryotaro Kawata, Yujin Song, Alberto Bietti et al.
Learning Interestingness in Automated Mathematical Theory Formation George Tsoukalas, Rahul Saha, Amitayush Thakur et al.
DNA-DetectLLM: Unveiling AI-Generated Text via a DNA-Inspired Mutation-Repair Paradigm Xiaowei Zhu, Yubing Ren, Fang Fang et al.
Signal and Noise: A Framework for Reducing Uncertainty in Language Model Evaluation David Heineman, Valentin Hofmann, Ian Magnusson et al.
Tradeoffs between Mistakes and ERM Oracle Calls in Online and Transductive Online Learning Idan Attias, Steve Hanneke, Arvind Ramaswami
The World Is Bigger! A Computationally-Embedded Perspective on the Big World Hypothesis Alex Lewandowski, Aditya A. Ramesh, Edan Meyer et al.
Multimodal Disease Progression Modeling via Spatiotemporal Disentanglement and Multiscale Alignment Chen Liu, Wenfang Yao, Kejing Yin et al.
On the Hardness of Conditional Independence Testing In Practice Zheng He, Roman Pogodin, Yazhe Li et al.
Emergence and Evolution of Interpretable Concepts in Diffusion Models Berk Tinaz, Zalan Fabian, Mahdi Soltanolkotabi
PCA++: How Uniformity Induces Robustness to Background Noise in Contrastive Learning Mingqi Wu, Qiang Sun, Archer Y. Yang
Optimal Nuisance Function Tuning for Estimating a Doubly Robust Functional under Proportional Asymptotics Sean McGrath, Debarghya Mukherjee, Rajarshi Mukherjee et al.
GeoLLaVA-8K: Scaling Remote-Sensing Multimodal Large Language Models to 8K Resolution Fengxiang Wang, Mingshuo Chen, Yueying Li et al.
Environment Inference for Learning Generalizable Dynamical System Shixuan Liu, Yue He, Haotian Wang et al.
Abstract Rendering: Certified Rendering Under 3D Semantic Uncertainty Chenxi Ji, Yangge Li, Xiangru Zhong et al.
Inference-Time Reward Hacking in Large Language Models Hadi Khalaf, Claudio Mayrink Verdun, Alex Oesterling et al.
High-Performance Arithmetic Circuit Optimization via Differentiable Architecture Search Xilin Xia, Jie Wang, Wanbo Zhang et al.
ROOT: Rethinking Offline Optimization as Distributional Translation via Probabilistic Bridge Manh Cuong Dao, The Hung Tran, Phi Le Nguyen et al.
Go With the Flow: Fast Diffusion for Gaussian Mixture Models George Rapakoulias, Ali Reza Pedram, Fengjiao Liu et al.
SHF: Symmetrical Hierarchical Forest with Pretrained Vision Transformer Encoder for High-Resolution Medical Segmentation Enzhi Zhang, Peng Chen, Rui Zhong et al.
ProxySPEX: Inference-Efficient Interpretability via Sparse Feature Interactions in LLMs Landon Butler, Abhineet Agarwal, Justin Singh Kang et al.
Fair Cooperation in Mixed-Motive Games via Conflict-Aware Gradient Adjustment Woojun Kim, Katia P. Sycara
OpenWorldSAM: Extending SAM2 for Universal Image Segmentation with Language Prompts Shiting Xiao, Rishabh Kabra, Yuhang Li et al.
Broken Tokens? Your Language Model can Secretly Handle Non-Canonical Tokenizations Brian Siyuan Zheng, Alisa Liu, Orevaoghene Ahia et al.
Hybrid-Balance GFlowNet for Solving Vehicle Routing Problems Ni Zhang, Zhiguang Cao
Feedback-Aware MCTS for Goal-Oriented Information Seeking Harshita Chopra, Chirag Shah
Self-Supervised Learning of Motion Concepts by Optimizing Counterfactuals Stefan Stojanov, David Wendt, Seungwoo Kim et al.
Uncertain Knowledge Graph Completion via Semi-Supervised Confidence Distribution Learning Tianxing Wu, Shutong Zhu, Jingting Wang et al.
OCTDiff: Bridged Diffusion Model for Portable OCT Super-Resolution and Enhancement Ye Tian, Angela McCarthy, Gabriel Gomide et al.
Bits Leaked per Query: Information-Theoretic Bounds for Adversarial Attacks on LLMs Masahiro Kaneko, Timothy Baldwin
Characterizing control between interacting subsystems with deep Jacobian estimation Adam Joseph Eisen, Mitchell Ostrow, Sarthak Chandra et al.
Sharper Convergence Rates for Nonconvex Optimisation via Reduction Mappings Evan Markou, Thalaiyasingam Ajanthan, Stephen Gould
Selective Omniprediction and Fair Abstention Sílvia Casacuberta, Varun Kanade
Algorithms and SQ Lower Bounds for Robustly Learning Real-valued Multi-Index Models Ilias Diakonikolas, Giannis Iakovidis, Daniel Kane et al.
A Principled Approach to Randomized Selection under Uncertainty: Applications to Peer Review and Grant Funding Alexander Koujianos Goldberg, Giulia Fanti, Nihar B Shah
Error Forcing in Recurrent Neural Networks A Erdem Sağtekin, Colin Bredenberg, Cristina Savin
Aligning Text-to-Image Diffusion Models to Human Preference by Classification Longquan Dai, Xiaolu Wei, He Wang et al.
Sketched Gaussian Mechanism for Private Federated Learning Qiaobo Li, Zhijie Chen, Arindam Banerjee
Joint‑Embedding vs Reconstruction: Provable Benefits of Latent Space Prediction for Self‑Supervised Learning Hugues Van Assel, Mark Ibrahim, Tommaso Biancalani et al.
Accelerating data-driven algorithm selection for combinatorial partitioning problems Vaggos Chatziafratis, Ishani Karmarkar, Yingxi Li et al.
Purifying Shampoo: Investigating Shampoo's Heuristics by Decomposing its Preconditioner Runa Eschenhagen, Aaron Defazio, Tsung-Hsien Lee et al.
Replicable Distribution Testing Ilias Diakonikolas, Jingyi Gao, Daniel Kane et al.
FAPEX: Fractional Amplitude-Phase Expressor for Robust Cross-Subject Seizure Prediction Ruizhe Zheng, Lingyan Mao, DINGDING HAN et al.
Causality Meets Locality: Provably Generalizable and Scalable Policy Learning for Networked Systems Hao Liang, Shuqing Shi, Yudi Zhang et al.
Conformal Mixed-Integer Constraint Learning with Feasibility Guarantees Daniel Ovalle, Lorenz T. Biegler, Ignacio E Grossmann et al.
Why Do Some Language Models Fake Alignment While Others Don't? Abhay Sheshadri, John Hughes, Julian Michael et al.
When Data Can't Meet: Estimating Correlation Across Privacy Barriers Abhinav Chakraborty, Arnab Auddy, T. Tony Cai
TRIDENT: Tri-Modal Molecular Representation Learning with Taxonomic Annotations and Local Correspondence Feng Jiang, Mangal Prakash, Hehuan Ma et al.
Deep Value Benchmark: Measuring Whether Models Generalize Deep Values or Shallow Preferences Joshua Ashkinaze, Hua Shen, Sai Avula et al.
Return of ChebNet: Understanding and Improving an Overlooked GNN on Long Range Tasks Ali Hariri, Alvaro Arroyo, Alessio Gravina et al.
Preconditioned Langevin Dynamics with Score-based Generative Models for Infinite-Dimensional Linear Bayesian Inverse Problems Lorenzo Baldassari, Josselin Garnier, Knut Solna et al.
Transferring Linear Features Across Language Models With Model Stitching Alan Chen, Jack Merullo, Alessandro Stolfo et al.
Causal Differentiating Concepts: Interpreting LM Behavior via Causal Representation Learning Navita Goyal, Hal Daumé III, Alexandre Drouin et al.
Ambient Proteins - Training Diffusion Models on Noisy Structures Giannis Daras, Jeffrey Ouyang-Zhang, Krithika Ravishankar et al.
On Universality Classes of Equivariant Networks Marco Pacini, Gabriele Santin, Bruno Lepri et al.
Guarantees for Alternating Least Squares in Overparameterized Tensor Decompositions Dionysis Arvanitakis, Vaidehi Srinivas, Aravindan Vijayaraghavan
Checklists Are Better Than Reward Models For Aligning Language Models Vijay Viswanathan, Yanchao Sun, Xiang Kong et al.
Blackbox Model Provenance via Palimpsestic Membership Inference Rohith Kuditipudi, Jing Huang, Sally Zhu et al.
Scaling can lead to compositional generalization Florian Redhardt, Yassir Akram, Simon Schug
Prismatic Synthesis: Gradient-based Data Diversification Boosts Generalization in LLM Reasoning Jaehun Jung, Seungju Han, Ximing Lu et al.
AnaCP: Toward Upper-Bound Continual Learning via Analytic Contrastive Projection Saleh Momeni, Changnan Xiao, Bing Liu
Flow Density Control: Generative Optimization Beyond Entropy-Regularized Fine-Tuning Riccardo De Santi, Marin Vlastelica, Ya-Ping Hsieh et al.
What Expressivity Theory Misses: Message Passing Complexity for GNNs Niklas Kemper, Tom Wollschläger, Stephan Günnemann
Ambient Diffusion Omni: Training Good Models with Bad Data Giannis Daras, Adrian Rodriguez-Munoz, Adam Klivans et al.
UMA: A Family of Universal Models for Atoms Brandon M Wood, Misko Dzamba, Xiang Fu et al.
The Best Instruction-Tuning Data are Those That Fit Dylan Zhang, Qirun Dai, Hao Peng
Forecasting in Offline Reinforcement Learning for Non-stationary Environments Suzan Ece Ada, Georg Martius, Emre Ugur et al.
Purifying Approximate Differential Privacy with Randomized Post-processing Yingyu Lin, Erchi Wang, Yian Ma et al.
Trust Region Constrained Measure Transport in Path Space for Stochastic Optimal Control and Inference Denis Blessing, Julius Berner, Lorenz Richter et al.
How Well Can Differential Privacy Be Audited in One Run? Amit Keinan, Moshe Shenfeld, Katrina Ligett
Counteractive RL: Rethinking Core Principles for Efficient and Scalable Deep Reinforcement Learning Ezgi Korkmaz
Is Noise Conditioning Necessary? A Unified Theory of Unconditional Graph Diffusion Models Jipeng Li, Yanning Shen
An Evidence-Based Post-Hoc Adjustment Framework for Anomaly Detection Under Data Contamination Sukanya Patra, Souhaib Ben Taieb
SHAP values via sparse Fourier representation Ali Gorji, Andisheh Amrollahi, Andreas Krause
Quantum Doubly Stochastic Transformers Jannis Born, Filip Skogh, Kahn Rhrissorrakrai et al.
Reverse Engineering Human Preferences with Reinforcement Learning Lisa Alazraki, Yi-Chern Tan, Jon Ander Campos et al.
Efficient Fairness-Performance Pareto Front Computation Mark Kozdoba, Binyamin Perets, Shie Mannor
Curl Descent : Non-Gradient Learning Dynamics with Sign-Diverse Plasticity Hugo Ninou, Jonathan Kadmon, N Alex Cayco Gajic
ElliCE: Efficient and Provably Robust Algorithmic Recourse via the Rashomon Sets Bohdan Turbal, Iryna Voitsitska, Lesia Semenova
Head Pursuit: Probing Attention Specialization in Multimodal Transformers Lorenzo Basile, Valentino Maiorca, Diego Doimo et al.
Towards a Golden Classifier-Free Guidance Path via Foresight Fixed Point Iterations Kaibo Wang, Jianda Mao, Tong Wu et al.
Credal Prediction based on Relative Likelihood Timo Löhr, Paul Hofman, Felix Mohr et al.
The Power of Iterative Filtering for Supervised Learning with (Heavy) Contamination Adam Klivans, Konstantinos Stavropoulos, Kevin Tian et al.
Light-Weight Diffusion Multiplier and Uncertainty Quantification for Fourier Neural Operators Albert Matveev, Sanmitra Ghosh, Aamal Hussain et al.
Discrete Spatial Diffusion: Intensity-Preserving Diffusion Modeling Javier E. Santos, Agnese Marcato, Roman Colman et al.
CTRL-ALT-DECEIT Sabotage Evaluations for Automated AI R&D Francis Rhys Ward, Teun van der Weij, Hanna Gábor et al.
An Analytical Theory of Spectral Bias in the Learning Dynamics of Diffusion Models Binxu Wang, Cengiz Pehlevan
DeepHalo: A Neural Choice Model with Controllable Context Effects Shuhan Zhang, Zhi Wang, Rui Gao et al.
Multi-Agent Learning under Uncertainty: Recurrence vs. Concentration Kyriakos Lotidis, Panayotis Mertikopoulos, Nicholas Bambos et al.
Quantum speedup of non-linear Monte Carlo problems Jose Blanchet, Yassine Hamoudi, Mario Szegedy et al.
Fine-grained List-wise Alignment for Generative Medication Recommendation Chenxiao Fan, Chongming Gao, Wentao Shi et al.
Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach Jonas Geiping, Sean Michael McLeish, Neel Jain et al.
Diffusion-Based Hierarchical Graph Neural Networks for Simulating Nonlinear Solid Mechanics Tobias Würth, Niklas Freymuth, Gerhard Neumann et al.
Breaking the Batch Barrier (B3) of Contrastive Learning via Smart Batch Mining Raghuveer Thirukovalluru, Rui Meng, Ye Liu et al.
Dynamic Algorithm for Explainable $k$-medians Clustering under $\ell_p$ Norm Konstantin Makarychev, Ilias Papanikolaou, Liren Shan
Utility Engineering: Analyzing and Controlling Emergent Value Systems in AIs Mantas Mazeika, Xuwang Yin, Rishub Tamirisa et al.
Is the acquisition worth the cost? Surrogate losses for Consistent Two-stage Classifiers Florence Regol, Joseph Cotnareanu, Theodore Glavas et al.
SageAttention3: Microscaling FP4 Attention for Inference and An Exploration of 8-Bit Training Jintao Zhang, Jia wei, Haoxu Wang et al.
Eluder dimension: localise it! Alireza Bakhtiari, Alex Ayoub, Samuel McLaughlin Robertson et al.
Communication-Efficient Language Model Training Scales Reliably and Robustly: Scaling Laws for DiLoCo Zachary Charles, Gabriel Teston, Lucio M. Dery et al.
FlashMD: long-stride, universal prediction of molecular dynamics Filippo Bigi, Sanggyu Chong, Agustinus Kristiadi et al.
Not All Data are Good Labels: On the Self-supervised Labeling for Time Series Forecasting Yuxuan Yang, Dalin Zhang, Yuxuan Liang et al.
3D Equivariant Visuomotor Policy Learning via Spherical Projection Boce Hu, Dian Wang, David Klee et al.
Predictable Scale (Part II) --- Farseer: A Refined Scaling Law in LLMs Houyi Li, Wenzhen Zheng, Qiufeng Wang et al.
Adaptive Prediction-Powered AutoEval with Reliability and Efficiency Guarantees Sangwoo Park, Matteo Zecchin, Osvaldo Simeone
Ridge Boosting is Both Robust and Efficient David Bruns-Smith, Zhongming Xie, Avi Feller
A Unifying View of Linear Function Approximation in Off-Policy RL Through Matrix Splitting and Preconditioning Zechen Wu, Amy Greenwald, Ronald Parr
Generalizable Reasoning through Compositional Energy Minimization Alexandru Oarga, Yilun Du
Universal Sequence Preconditioning Annie Marsden, Elad Hazan
Enigmata: Scaling Logical Reasoning in Large Language Models with Synthetic Verifiable Puzzles Jiangjie Chen, Qianyu He, Siyu Yuan et al.
Memory-Enhanced Neural Solvers for Routing Problems Felix Chalumeau, Refiloe Shabe, Noah De Nicola et al.
Uni-MuMER: Unified Multi-Task Fine-Tuning of Vision-Language Model for Handwritten Mathematical Expression Recognition Yu Li, Jin Jiang, Jianhua Zhu et al.
Two Heads are Better than One: Simulating Large Transformers with Small Ones Hantao Yu, Josh Alman
Gaze Beyond the Frame: Forecasting Egocentric 3D Visual Span Heeseung Yun, Joonil Na, Jaeyeon Kim et al.
Unifying Proportional Fairness in Centroid and Non-Centroid Clustering Benjamin Cookson, Nisarg Shah, Ziqi Yu
ARIA: Training Language Agents with Intention-driven Reward Aggregation Ruihan Yang, Yikai Zhang, Aili Chen et al.
Reasoning Planning for Language Models Bao Nguyen, Hieu Trung Nguyen, Ruifeng She et al.
When Less Language is More: Language-Reasoning Disentanglement Makes LLMs Better Multilingual Reasoners Weixiang Zhao, Jiahe Guo, Yang Deng et al.
EF-3DGS: Event-Aided Free-Trajectory 3D Gaussian Splatting Bohao Liao, Wei Zhai, Zengyu Wan et al.
Beyond Scalar Rewards: An Axiomatic Framework for Lexicographic MDPs Mehran Shakerinava, Siamak Ravanbakhsh, Adam Oberman
Compress to Impress: Efficient LLM Adaptation Using a Single Gradient Step on 100 Samples Shiva Sreeram, Alaa Maalouf, Pratyusha Sharma et al.
Understanding Prompt Tuning and In-Context Learning via Meta-Learning Tim Genewein, Li Kevin Wenliang, Jordi Grau-Moya et al.
Error Broadcast and Decorrelation as a Potential Artificial and Natural Learning Mechanism Mete Erdogan, Cengiz Pehlevan, Alper Tunga Erdogan
On the Expressive Power of Mixture-of-Experts for Structured Complex Tasks Mingze Wang, Weinan E
TokenSwap: A Lightweight Method to Disrupt Memorized Sequences in LLMs Parjanya Prajakta Prashant, Kaustubh Ponkshe, Babak Salimi
Streaming Attention Approximation via Discrepancy Theory Ekaterina Kochetkova, Kshiteej Sheth, Insu Han et al.
SegMASt3R: Geometry Grounded Segment Matching Rohit Jayanti, Swayam Agrawal, Vansh Garg et al.
Among Us: A Sandbox for Measuring and Detecting Agentic Deception Satvik Golechha, Adrià Garriga-Alonso
AutoToM: Scaling Model-based Mental Inference via Automated Agent Modeling Zhining Zhang, Chuanyang Jin, Mung Yao Jia et al.
Towards Interpretable and Efficient Attention: Compressing All by Contracting a Few Qishuai Wen, Zhiyuan Huang, Chun-Guang Li
EvoBrain: Dynamic Multi-Channel EEG Graph Modeling for Time-Evolving Brain Networks Rikuto Kotoge, Zheng Chen, Tasuku Kimura et al.
Product Distribution Learning with Imperfect Advice Arnab Bhattacharyya, Davin Choo, Philips George John et al.
RoboScape: Physics-informed Embodied World Model Yu Shang, Xin Zhang, Yinzhou Tang et al.
InstructHOI: Context-Aware Instruction for Multi-Modal Reasoning in Human-Object Interaction Detection Jinguo Luo, Weihong Ren, Quanlong Zheng et al.
ARM: Adaptive Reasoning Model Siye Wu, Jian Xie, Yikai Zhang et al.
Computational Efficiency under Covariate Shift in Kernel Ridge Regression Andrea Della Vecchia, Arnaud Mavakala Watusadisi, Ernesto De Vito et al.
Self-Assembling Graph Perceptrons Jialong Chen, Tong Wang, Bowen Deng et al.
Scaling and context steer LLMs along the same computational path as the human brain Joséphine Raugel, Jérémy Rapin, Stéphane d'Ascoli et al.
InfiFPO: Implicit Model Fusion via Preference Optimization in Large Language Models Yanggan Gu, Yuanyi Wang, Zhaoyi Yan et al.
SViMo: Synchronized Diffusion for Video and Motion Generation in Hand-object Interaction Scenarios Lingwei Dang, Ruizhi Shao, Hongwen Zhang et al.
HyPINO: Multi-Physics Neural Operators via HyperPINNs and the Method of Manufactured Solutions Rafael Bischof, Michal Piovarci, Michael Anton Kraus et al.
RidgeLoRA: Matrix Ridge Enhanced Low-Rank Adaptation of Large Language Models Junda Zhu, Jun Ai, Yujun Li et al.
Think or Not? Exploring Thinking Efficiency in Large Reasoning Models via an Information-Theoretic Lens Xixian Yong, Xiao Zhou, Yingying Zhang et al.
Hyperbolic Fine-Tuning for Large Language Models Menglin Yang, Ram Samarth B B, Aosong Feng et al.
Deep Continuous-Time State-Space Models for Marked Event Sequences Yuxin Chang, Alex James Boyd, Cao Xiao et al.
HBLLM: Wavelet-Enhanced High-Fidelity 1-Bit Quantization for LLMs Ningning CHEN, Weicai Ye, Ying Jiang
Which Algorithms Have Tight Generalization Bounds? Michael Gastpar, Ido Nachum, Jonathan Shafer et al.
Axial Neural Networks for Dimension-Free Foundation Models Hyunsu Kim, Jonggeon Park, Joan Bruna et al.
Horizon Reduction Makes RL Scalable Seohong Park, Kevin Frans, Deepinder Mann et al.
OpenBox: Annotate Any Bounding Boxes in 3D In-Jae Lee, Mungyeom Kim, Kwonyoung Ryu et al.
SGCD: Stain-Guided CycleDiffusion for Unsupervised Domain Adaptation of Histopathology Image Classification Hsi-Ling Chen, Chun-Shien Lu, Pau-Choo Chung
FFN Fusion: Rethinking Sequential Computation in Large Language Models Akhiad Bercovich, Mohammed Dabbah, Omri Puny et al.
Distilling LLM Agent into Small Models with Retrieval and Code Tools Minki Kang, Jongwon Jeong, Seanie Lee et al.
Understanding Parametric and Contextual Knowledge Reconciliation within Large Language Models Jun Zhao, Yongzhuo Yang, Xiang Hu et al.
Differentiable Decision Tree via "ReLU+Argmin" Reformulation Qiangqiang Mao, Jiayang Ren, Yixiu Wang et al.
SafeVLA: Towards Safety Alignment of Vision-Language-Action Model via Constrained Learning Borong Zhang, Yuhao Zhang, Jiaming Ji et al.
3D Interaction Geometric Pre-training for Molecular Relational Learning Namkyeong Lee, Yunhak Oh, Heewoong Noh et al.
Improved Bounds for Swap Multicalibration and Swap Omniprediction Haipeng Luo, Spandan Senapati, Vatsal Sharan
UniteFormer: Unifying Node and Edge Modalities in Transformers for Vehicle Routing Problems Dian Meng, Zhiguang Cao, Jie Gao et al.
Simultaneous Swap Regret Minimization via KL-Calibration Haipeng Luo, Spandan Senapati, Vatsal Sharan
Wide-Horizon Thinking and Simulation-Based Evaluation for Real-World LLM Planning with Multifaceted Constraints Dongjie Yang, Chengqiang Lu, Qimeng Wang et al.
Does Object Binding Naturally Emerge in Large Pretrained Vision Transformers? Yihao Li, Saeed Salehi, Lyle Ungar et al.
Probing Neural Combinatorial Optimization Models Zhiqin Zhang, Yining Ma, Zhiguang Cao et al.
A Principled Path to Fitted Distributional Evaluation Sungee Hong, Jiayi Wang, Zhengling Qi et al.
Improving LLM General Preference Alignment via Optimistic Online Mirror Descent Yuheng Zhang, Dian Yu, Tao Ge et al.
Progressive Inference-Time Annealing of Diffusion Models for Sampling from Boltzmann Densities Tara Akhound-Sadegh, Jungyoon Lee, Joey Bose et al.
Compositional Monte Carlo Tree Diffusion for Extendable Planning Jaesik Yoon, Hyeonseo Cho, Sungjin Ahn
Fast Monte Carlo Tree Diffusion: 100× Speedup via Parallel and Sparse Planning Jaesik Yoon, Hyeonseo Cho, Yoshua Bengio et al.
Zero-shot Denoising via Neural Compression: Theoretical and algorithmic framework Ali Zafari, Xi Chen, Shirin Jalali
Gradient-Variation Online Adaptivity for Accelerated Optimization with Hölder Smoothness Yuheng Zhao, Yu-Hu Yan, Kfir Yehuda Levy et al.
A Smooth Sea Never Made a Skilled SAILOR: Robust Imitation via Learning to Search Arnav Kumar Jain, Vibhakar Mohta, Subin Kim et al.
MAESTRO : Adaptive Sparse Attention and Robust Learning for Multimodal Dynamic Time Series Payal Mohapatra, Yueyuan Sui, Akash Pandey et al.
Ctrl-DNA: Controllable Cell-Type-Specific Regulatory DNA Design via Constrained RL Xingyu Chen, Shihao Ma, Runsheng Lin et al.
On the Universal Near Optimality of Hedge in Combinatorial Settings Zhiyuan Fan, Arnab Maiti, Lillian J. Ratliff et al.
Transfer Faster, Price Smarter: Minimax Dynamic Pricing under Cross-Market Preference Shift Yi Zhang, Elynn Chen, Yujun Yan
Transformer brain encoders explain human high-level visual responses Hossein Adeli, Minni Sun, Nikolaus Kriegeskorte
Fast and Fluent Diffusion Language Models via Convolutional Decoding and Rejective Fine-tuning Yeongbin Seo, Dongha Lee, Jaehyung Kim et al.
MoBA: Mixture of Block Attention for Long-Context LLMs Enzhe Lu, Zhejun Jiang, Jingyuan Liu et al.
DERD-Net: Learning Depth from Event-based Ray Densities Diego de Oliveira Hitzges, Suman Ghosh, Guillermo Gallego
Beyond Expectations: Quantile-Guided Alignment for Risk-Calibrated Language Models Xinran Wang, Jin Du, Azal Ahmad Khan et al.
VPO: Reasoning Preferences Optimization Based on $\mathcal{V}$-Usable Information Zecheng Wang, Chunshan Li, Yupeng Zhang et al.
Stable Minima of ReLU Neural Networks Suffer from the Curse of Dimensionality: The Neural Shattering Phenomenon Tongtong Liang, Dan Qiao, Yu-Xiang Wang et al.
Fisher meets Feynman: score-based variational inference with a product of experts Diana Cai, Robert M. Gower, David Blei et al.
Mitigating the Privacy–Utility Trade-off in Decentralized Federated Learning via f-Differential Privacy Xiang Li, Chendi Wang, Buxin Su et al.
Mitigating Instability in High Residual Adaptive Sampling for PINNs via Langevin Dynamics Minseok Jeong, Giup Seo, Euiseok Hwang
Spectral Estimation with Free Decompression Siavash Ameli, Chris van der Heide, Liam Hodgkinson et al.
CAR-Flow: Condition-Aware Reparameterization Aligns Source and Target for Better Flow Matching Chen Chen, Pengsheng Guo, Liangchen Song et al.
Training-Free Constrained Generation With Stable Diffusion Models Stefano Zampini, Jacob K Christopher, Luca Oneto et al.
Comparator-Adaptive $\Phi$-Regret: Improved Bounds, Simpler Algorithms, and Applications to Games Soumita Hait, Ping Li, Haipeng Luo et al.
X-Field: A Physically Informed Representation for 3D X-ray Reconstruction Feiran Wang, Jiachen Tao, Junyi Wu et al.
Distillation Robustifies Unlearning Bruce W. Lee, Addie Foote, Alex Infanger et al.
SimWorld: An Open-ended Simulator for Agents in Physical and Social Worlds Xiaokang Ye, Jiawei Ren, Yan Zhuang et al.
Two‑Stage Learning of Stabilizing Neural Controllers via Zubov Sampling and Iterative Domain Expansion Haoyu Li, Xiangru Zhong, Bin Hu et al.
The Complexity of Symmetric Equilibria in Min-Max Optimization and Team Zero-Sum Games Ioannis Anagnostides, Ioannis Panageas, Tuomas Sandholm et al.
On Traceability in $\ell_p$ Stochastic Convex Optimization Sasha Voitovych, Mahdi Haghifam, Idan Attias et al.
Improved Representation Steering for Language Models Zhengxuan Wu, Qinan Yu, Aryaman Arora et al.
FlexOLMo: Open Language Models for Flexible Data Use Weijia Shi, Akshita Bhagia, Kevin Farhat et al.
The Fragile Truth of Saliency: Improving LLM Input Attribution via Attention Bias Optimization Yihua Zhang, Changsheng Wang, Yiwei Chen et al.
Enhancing Training Data Attribution with Representational Optimization Weiwei Sun, Haokun Liu, Nikhil Kandpal et al.
DisMo: Disentangled Motion Representations for Open-World Motion Transfer Thomas Ressler-Antal, Frank Fundel, Malek Ben Alaya et al.
Rig3R: Rig-Aware Conditioning and Discovery for 3D Reconstruction Samuel Li, Pujith Kachana, Prajwal Chidananda et al.
Cycle-Sync: Robust Global Camera Pose Estimation through Enhanced Cycle-Consistent Synchronization Shaohan Li, Yunpeng Shi, Gilad Lerman
Dense Associative Memory with Epanechnikov Energy Benjamin Hoover, Zhaoyang Shi, Krishna Balasubramanian et al.
Searching Latent Program Spaces Matthew Macfarlane, Clément Bonnet
Convergence Rates of Constrained Expected Improvement Haowei Wang, Jingyi Wang, Zhongxiang Dai et al.
CoT Information: Improved Sample Complexity under Chain-of-Thought Supervision Awni Altabaa, Omar Montasser, John Lafferty
Unlocking hidden biomolecular conformational landscapes in diffusion models at inference time Daniel D. Richman, Jessica Karaguesian, Carl-Mikael Suomivuori et al.
QSVD: Efficient Low-rank Approximation for Unified Query-Key-Value Weight Compression in Low-Precision Vision-Language Models Yutong Wang, Haiyu Wang, Sai Qian Zhang
Caption This, Reason That: VLMs Caught in the Middle Zihan Weng, Lucas Gomez, Taylor Whittington Webb et al.
Universal Causal Inference in a Topos Sridhar Mahadevan
Can We Infer Confidential Properties of Training Data from LLMs? Pengrun Huang, Chhavi Yadav, Kamalika Chaudhuri et al.
Temperature is All You Need for Generalization in Langevin Dynamics and other Markov Processes Itamar Harel, Yonathan Wolanowsky, Gal Vardi et al.
Learning the Wrong Lessons: Syntactic-Domain Spurious Correlations in Language Models Chantal Shaib, Vinith Menon Suriyakumar, Byron C Wallace et al.
Corporate Needs You to Find the Difference: Revisiting Submodular and Supermodular Ratio Optimization Problems Elfarouk Harb, Yousef Yassin, Chandra Chekuri
Private Set Union with Multiple Contributions Travis Dick, Haim Kaplan, Alex Kulesza et al.
Clustering via Hedonic Games: New Concepts and Algorithms Gergely Csáji, Alexander Gundert, Jörg Rothe et al.
The Graphon Limit Hypothesis: Understanding Neural Network Pruning via Infinite Width Analysis Hoang Pham, The-Anh Ta, Tom Jacobs et al.
Fast Training of Large Kernel Models with Delayed Projections Amirhesam Abedsoltan, Siyuan Ma, Parthe Pandit et al.
d1: Scaling Reasoning in Diffusion Large Language Models via Reinforcement Learning Siyan Zhao, Devaansh Gupta, Qinqing Zheng et al.
Affine-Invariant Global Non-Asymptotic Convergence Analysis of BFGS under Self-Concordance Qiujiang Jin, Aryan Mokhtari
Extrapolation by Association: Length Generalization Transfer In Transformers Ziyang Cai, Nayoung Lee, Avi Schwarzschild et al.
Optimal Neural Compressors for the Rate-Distortion-Perception Tradeoff Eric Lei, Hamed Hassani, Shirin Saeedi Bidokhti
Bridging Symmetry and Robustness: On the Role of Equivariance in Enhancing Adversarial Robustness Longwei Wang, Ifrat Ikhtear Uddin, KC Santosh et al.
Color Conditional Generation with Sliced Wasserstein Guidance Alexander Lobashev, Maria Larchenko, Dmitry Guskov
Private Hyperparameter Tuning with Ex-Post Guarantee Badih Ghazi, Pritish Kamath, Alexander Knop et al.
A Implies B: Circuit Analysis in LLMs for Propositional Logical Reasoning Guan Zhe Hong, Nishanth Dikkala, Enming Luo et al.
Optimal and Provable Calibration in High-Dimensional Binary Classification: Angular Calibration and Platt Scaling Yufan Li, Pragya Sur
Reconstruction and Secrecy under Approximate Distance Queries Shay Moran, Elizaveta Nesterova
Win Fast or Lose Slow: Balancing Speed and Accuracy in Latency-Sensitive Decisions of LLMs Hao Kang, Qingru Zhang, Han Cai et al.
Characterizing the Expressivity of Fixed-Precision Transformer Language Models Jiaoda Li, Ryan Cotterell
Distributional Training Data Attribution: What do Influence Functions Sample? Bruno Kacper Mlodozeniec, Isaac Reid, Samuel Power et al.
Hogwild! Inference: Parallel LLM Generation via Concurrent Attention Gleb Rodionov, Roman Garipov, Alina Shutova et al.
Mind-the-Glitch: Visual Correspondence for Detecting Inconsistencies in Subject-Driven Generation Abdelrahman Eldesokey, Aleksandar Cvejić, Bernard Ghanem et al.
The Non-Linear Representation Dilemma: Is Causal Abstraction Enough for Mechanistic Interpretability? Denis Sutter, Julian Minder, Thomas Hofmann et al.
Gaussian Herding across Pens: An Optimal Transport Perspective on Global Gaussian Reduction for 3DGS Tao Wang, Mengyu Li, Geduo Zeng et al.
Generalized Top-k Mallows Model for Ranked Choices Shahrzad Haddadan, Sara Ahmadian
Improving Bilinear RNN with Closed-loop Control Jiaxi Hu, Yongqi Pan, Jusen Du et al.
Spatial-MLLM: Boosting MLLM Capabilities in Visual-based Spatial Intelligence Diankun Wu, Fangfu Liu, Yi-Hsin Hung et al.
SANSA: Unleashing the Hidden Semantics in SAM2 for Few-Shot Segmentation Claudia Cuttano, Gabriele Trivigno, Giuseppe Averta et al.
Cost-Aware Contrastive Routing for LLMs Reza Shirkavand, Shangqian Gao, Peiran Yu et al.
Is Grokking a Computational Glass Relaxation? Xiaotian Zhang, Yue Shang, Entao Yang et al.
LoRATv2: Enabling Low-Cost Temporal Modeling in One-Stream Trackers Liting Lin, Heng Fan, Zhipeng Zhang et al.
On the necessity of adaptive regularisation: Optimal anytime online learning on $\boldsymbol{\ell_p}$-balls Emmeran Johnson, David Martínez-Rubio, Ciara Pike-Burke et al.
Controlling Thinking Speed in Reasoning Models Zhengkai Lin, Zhihang Fu, Ze Chen et al.
Vector Quantization in the Brain: Grid-like Codes in World Models Xiangyuan Peng, Xingsi Dong, Si Wu
IA-GGAD: Zero-shot Generalist Graph Anomaly Detection via Invariant and Affinity Learning Xiong Zhang, Zhenli He, Changlong Fu et al.
Revisiting Generative Infrared and Visible Image Fusion Based on Human Cognitive Laws Lin Guo, Xiaoqing Luo, Wei Xie et al.
MonoLift: Learning 3D Manipulation Policies from Monocular RGB via Distillation Ziru Wang, Mengmeng Wang, Guang Dai et al.
SoFar: Language-Grounded Orientation Bridges Spatial Reasoning and Object Manipulation Zekun Qi, Wenyao Zhang, Yufei Ding et al.
Conditional Representation Learning for Customized Tasks Honglin Liu, Chao Sun, Peng Hu et al.
Angular Steering: Behavior Control via Rotation in Activation Space Hieu M. Vu, Tan Minh Nguyen
COOPERA: Continual Open-Ended Human-Robot Assistance Chenyang Ma, Kai Lu, Ruta Desai et al.
Joint Hierarchical Representation Learning of Samples and Features via Informed Tree-Wasserstein Distance Ya-Wei Eileen Lin, Ronald R. Coifman, Gal Mishne et al.
Detecting Generated Images by Fitting Natural Image Distributions Yonggang Zhang, Jun Nie, Xinmei Tian et al.
Agnostic Learning under Targeted Poisoning: Optimal Rates and the Role of Randomness Bogdan Chornomaz, Yonatan Koren, Shay Moran et al.
ORIGAMISPACE: Benchmarking Multimodal LLMs in Multi-Step Spatial Reasoning with Mathematical Constraints Rui Xu, Dakuan Lu, Zicheng Zhao et al.
Establishing Linear Surrogate Regret Bounds for Convex Smooth Losses via Convolutional Fenchel–Young Losses Yuzhou Cao, Han Bao, Lei Feng et al.
Co-Reinforcement Learning for Unified Multimodal Understanding and Generation Jingjing Jiang, Chongjie Si, Jun Luo et al.
Structured Linear CDEs: Maximally Expressive and Parallel-in-Time Sequence Models Benjamin Walker, Lingyi Yang, Nicola Muca Cirone et al.
Vgent: Graph-based Retrieval-Reasoning-Augmented Generation For Long Video Understanding Xiaoqian Shen, Wenxuan Zhang, Jun Chen et al.
Privacy amplification by random allocation Moshe Shenfeld, Vitaly Feldman
Tackling Biased Evaluators in Dueling Bandits Ming Tang, Yuxuan Zhou, Chao Huang
Advanced Sign Language Video Generation with Compressed and Quantized Multi-Condition Tokenization Cong Wang, Zexuan Deng, Zhiwei Jiang et al.
Transstratal Adversarial Attack: Compromising Multi-Layered Defenses in Text-to-Image Models Chunlong Xie, Kangjie Chen, Shangwei Guo et al.
SORTeD Rashomon Sets of Sparse Decision Trees: Anytime Enumeration Elif Arslan, Jacobus G. M. van der Linden, Serge Hoogendoorn et al.
TGA: True-to-Geometry Avatar Dynamic Reconstruction Bo Guo, Sijia Wen, Ziwei Wang et al.
Neighbor-aware Contrastive Disambiguation for Cross-Modal Hashing with Redundant Annotations Chao Su, Likang Peng, Yuan Sun et al.
Minimax Adaptive Online Nonparametric Regression over Besov spaces Paul Liautaud, Pierre Gaillard, Olivier Wintenberger
UniSite: The First Cross-Structure Dataset and Learning Framework for End-to-End Ligand Binding Site Detection Jigang Fan, QuanLin Wu, Shengjie Luo et al.
URDF-Anything: Constructing Articulated Objects with 3D Multimodal Language Model Zhe Li, Xiang Bai, Jieyu Zhang et al.
L2DGCN: Learnable Enhancement and Label Selection Dynamic Graph Convolutional Networks for Mitigating Degree Bias jingxiao zhang, Shifei Ding, Jian Zhang et al.
Memo: Training Memory-Efficient Embodied Agents with Reinforcement Learning Gunshi Gupta, Karmesh Yadav, Zsolt Kira et al.
Achilles' Heel of Mamba: Essential difficulties of the Mamba architecture demonstrated by synthetic data Tianyi Chen, Pengxiao Lin, Zhiwei Wang et al.
RepLDM: Reprogramming Pretrained Latent Diffusion Models for High-Quality, High-Efficiency, High-Resolution Image Generation Boyuan Cao, Jiaxin Ye, Yujie Wei et al.
Understanding LLM Behaviors via Compression: Data Generation, Knowledge Acquisition and Scaling Laws Zhixuan Pan, Shaowen Wang, Liao Pengfei et al.
Differentiable Hierarchical Visual Tokenization Marius Aasan, Martine Hjelkrem-Tan, Nico Catalano et al.
Trajectory Graph Learning: Aligning with Long Trajectories in Reinforcement Learning Without Reward Design Yunfan Li, Eric Liu, Lin Yang
Meta CLIP 2: A Worldwide Scaling Recipe Yung-Sung Chuang, Yang Li, Dong Wang et al.
Policy Compatible Skill Incremental Learning via Lazy Learning Interface Daehee Lee, Dongsu Lee, TaeYoon Kwack et al.
Estimating cognitive biases with attention-aware inverse planning Sounak Banerjee, Daphne Cornelisse, Deepak Edakkattil Gopinath et al.
An Efficient Orlicz-Sobolev Approach for Transporting Unbalanced Measures on a Graph Tam Le, Truyen Nguyen, Hideitsu Hino et al.
DeepDiver: Adaptive Web-Search Intensity Scaling via Reinforcement Learning Wenxuan Shi, Haochen Tan, Chuqiao Kuang et al.
MetaGS: A Meta-Learned Gaussian-Phong Model for Out-of-Distribution 3D Scene Relighting Yumeng He, Yunbo Wang
Towards a Pairwise Ranking Model with Orderliness and Monotonicity for Label Enhancement Yunan Lu, Xixi Zhang, Yaojin Lin et al.
Spend Wisely: Maximizing Post-Training Gains in Iterative Synthetic Data Bootstrapping Pu Yang, Yunzhen Feng, Ziyuan Chen et al.
Fast-Slow Thinking GRPO for Large Vision-Language Model Reasoning Wenyi Xiao, Leilei Gan
Exploration via Feature Perturbation in Contextual Bandits Seouh-won Yi, Min-hwan Oh
Instance-Optimality for Private KL Distribution Estimation Jiayuan Ye, Vitaly Feldman, Kunal Talwar
DMWM: Dual-Mind World Model with Long-Term Imagination Lingyi Wang, Rashed Shelim, Walid Saad et al.
TimeWak: Temporal Chained-Hashing Watermark for Time Series Data Zhi Wen Soi, Chaoyi Zhu, Fouad Abiad et al.
UFO: A Unified Approach to Fine-grained Visual Perception via Open-ended Language Interface Hao Tang, Chen-Wei Xie, Haiyang Wang et al.
DenseDPO: Fine-Grained Temporal Preference Optimization for Video Diffusion Models Ziyi Wu, Anil Kag, Ivan Skorokhodov et al.
Precise Asymptotics and Refined Regret of Variance-Aware UCB Yingying Fan, Yuxuan Han, Jinchi Lv et al.
InfMasking: Unleashing Synergistic Information by Contrastive Multimodal Interactions Liangjian Wen, Qun Dai, Jianzhuang Liu et al.
Extracting task-relevant preserved dynamics from contrastive aligned neural recordings Yiqi Jiang, Kaiwen Sheng, Yujia Gao et al.
Orochi: Versatile Biomedical Image Processor Gaole Dai, Chenghao Zhou, Yu Zhou et al.
Conservative classifiers do consistently well with improving agents: characterizing statistical and online learning Dravyansh Sharma, Alec Sun
KORGym: A Dynamic Game Platform for LLM Reasoning Evaluation Jiajun Shi, Jian Yang, Jiaheng Liu et al.
Learnable Sampler Distillation for Discrete Diffusion Models Feiyang Fu, Tongxian Guo, Zhaoqiang Liu
On the Hardness of Approximating Distributions with Tractable Probabilistic Models John Leland, YooJung Choi
MoESD: Unveil Speculative Decoding's Potential for Accelerating Sparse MoE Zongle Huang, Lei Zhu, ZongYuan Zhan et al.
SoTA with Less: MCTS-Guided Sample Selection for Data-Efficient Visual Reasoning Self-Improvement Xiyao Wang, Zhengyuan Yang, Chao Feng et al.
Deno-IF: Unsupervised Noisy Visible and Infrared Image Fusion Method Han Xu, Yuyang Li, Yunfei Deng et al.
ReCon: Region-Controllable Data Augmentation with Rectification and Alignment for Object Detection Haowei Zhu, Tianxiang Pan, Rui Qin et al.
Repurposing Marigold for Zero-Shot Metric Depth Estimation via Defocus Blur Cues Chinmay Talegaonkar, Nikhil Gandudi Suresh, Zachary Novack et al.
PARTONOMY: Large Multimodal Models with Part-Level Visual Understanding Ansel Blume, Jeonghwan Kim, Hyeonjeong Ha et al.
Composite Flow Matching for Reinforcement Learning with Shifted-Dynamics Data Lingkai Kong, Haichuan Wang, Tonghan Wang et al.
Asymmetric Duos: Sidekicks Improve Uncertainty Tim G. Zhou, Evan Shelhamer, Geoff Pleiss
Robust learning of halfspaces under log-concave marginals Jane Lange, Arsen Vasilyan
Implicit Bias of Spectral Descent and Muon on Multiclass Separable Data Chen Fan, Mark Schmidt, Christos Thrampoulidis
Lost in Transmission: When and Why LLMs Fail to Reason Globally Tobias Schnabel, Kiran Tomlinson, Adith Swaminathan et al.
On Transferring Transferability: Towards a Theory for Size Generalization Eitan Levin, Yuxin Ma, Mateo Diaz Diaz et al.
When Worse is Better: Navigating the Compression Generation Trade-off In Visual Tokenization Vivek Ramanujan, Kushal Tirumala, Armen Aghajanyan et al.
FlowFeat: Pixel-Dense Embedding of Motion Profiles Nikita Araslanov, Anna Ribic, Daniel Cremers
The Generative Leap: Tight Sample Complexity for Efficiently Learning Gaussian Multi-Index Models Alex Damian, Jason D. Lee, Joan Bruna
Incremental Sequence Classification with Temporal Consistency Lucas Maystre, Gabriel Barello, Tudor Berariu et al.
LODGE: Level-of-Detail Large-Scale Gaussian Splatting with Efficient Rendering Jonas Kulhanek, Marie-Julie Rakotosaona, Fabian Manhardt et al.
Solving Neural Min-Max Games: The Role of Architecture, Initialization & Dynamics Deep Patel, Emmanouil-Vasileios Vlatakis-Gkaragkounis
Provable Gradient Editing of Deep Neural Networks Zhe Tao, Aditya V. Thakur
Audio Flamingo 3: Advancing Audio Intelligence with Fully Open Large Audio Language Models Sreyan Ghosh, Arushi Goel, Jaehyeon Kim et al.
RGB-Only Supervised Camera Parameter Optimization in Dynamic Scenes Fang Li, Hao Zhang, Narendra Ahuja
Integration Matters for Learning PDEs with Backward SDEs Sungje Park, Stephen Tu
Unleashing Hour-Scale Video Training for Long Video-Language Understanding Jingyang Lin, Jialian Wu, Ximeng Sun et al.
Neural Entropy Akhil Premkumar
Locality in Image Diffusion Models Emerges from Data Statistics Artem Lukoianov, Chenyang Yuan, Justin Solomon et al.
Regularized least squares learning with heavy-tailed noise is minimax optimal Mattes Mollenhauer, Nicole Mücke, Dimitri Meunier et al.
On Feasible Rewards in Multi-Agent Inverse Reinforcement Learning Till Freihaut, Giorgia Ramponi
MonarchAttention: Zero-Shot Conversion to Fast, Hardware-Aware Structured Attention Can Yaras, Alec S Xu, Pierre Abillama et al.
The Hawthorne Effect in Reasoning Models: Evaluating and Steering Test Awareness Sahar Abdelnabi, Ahmed Salem
Measuring and Controlling Solution Degeneracy across Task-Trained Recurrent Neural Networks Ann Huang, Satpreet Harcharan Singh, Flavio Martinelli et al.
Reinforcement Learning with Imperfect Transition Predictions: A Bellman-Jensen Approach Chenbei Lu, Zaiwei Chen, Tongxin Li et al.
AI Research Agents for Machine Learning: Search, Exploration, and Generalization in MLE-bench Edan Toledo, Karen Hambardzumyan, Martin Josifoski et al.
Differentiable Cyclic Causal Discovery Under Unmeasured Confounders Muralikrishnna Guruswamy Sethuraman, Faramarz Fekri
ELECTRA: A Cartesian Network for 3D Charge Density Prediction with Floating Orbitals Jonas Elsborg, Luca Thiede, Alan Aspuru-Guzik et al.
Compositional Neural Network Verification via Assume-Guarantee Reasoning Hai Duong, David Shriver, ThanhVu Nguyen et al.
A machine learning approach that beats Rubik's cubes Alexander Chervov, Kirill Khoruzhii, Nikita Bukhal et al.
ENMA: Tokenwise Autoregression for Continuous Neural PDE Operators Armand Kassaï Koupaï, Lise Le Boudec, Louis Serrano et al.
Critical Batch Size Revisited: A Simple Empirical Approach to Large-Batch Language Model Training William Merrill, Shane Arora, Dirk Groeneveld et al.
Shift Before You Learn: Enabling Low-Rank Representations in Reinforcement Learning Bastien Dubail, Stefan Stojanovic, Alexandre Proutiere
Stochastic Optimization in Semi-Discrete Optimal Transport: Convergence Analysis and Minimax Rate Ferdinand Genans, Antoine Godichon-Baggioni, François-Xavier Vialard et al.
Transferable Black-Box One-Shot Forging of Watermarks via Image Preference Models Tomas Soucek, Sylvestre-Alvise Rebuffi, Pierre Fernandez et al.
Non-Asymptotic Analysis Of Data Augmentation For Precision Matrix Estimation Lucas Morisset, Adrien Hardy, Alain Oliviero Durmus
Improving Perturbation-based Explanations by Understanding the Role of Uncertainty Calibration Thomas Decker, Volker Tresp, Florian Buettner
ConTextTab: A Semantics-Aware Tabular In-Context Learner Marco Spinaci, Marek Polewczyk, Maximilian Schambach et al.
Some Optimizers are More Equal: Understanding the Role of Optimizers in Group Fairness Mojtaba Kolahdouzi, Hatice Gunes, Ali Etemad
Less is More: Improving LLM Alignment via Preference Data Selection Xun Deng, Han Zhong, Rui Ai et al.
Stable Gradients for Stable Learning at Scale in Deep Reinforcement Learning Roger Creus Castanyer, Johan Obando-Ceron, Lu Li et al.
SpecMER: Fast Protein Generation with K-mer Guided Speculative Decoding Thomas Walton, Darin Tsui, Aryan Musharaf et al.
SpecEdge: Scalable Edge-Assisted Serving Framework for Interactive LLMs Jinwoo Park, Seunggeun Cho, Dongsu Han
DEXTER: Diffusion-Guided EXplanations with TExtual Reasoning for Vision Models Simone Carnemolla, Matteo Pennisi, Sarinda Samarasinghe et al.
What One Cannot, Two Can: Two-Layer Transformers Provably Represent Induction Heads on Any-Order Markov Chains Chanakya Ekbote, Ashok Vardhan Makkuva, Marco Bondaschi et al.
Sample-Adaptivity Tradeoff in On-Demand Sampling Nika Haghtalab, Omar Montasser, Mingda Qiao
Online Strategic Classification With Noise and Partial Feedback Tianrun Zhao, Xiaojie Mao, Yong Liang
Partition-Then-Adapt: Combating Prediction Bias for Reliable Multi-Modal Test-Time Adaptation Guowei Wang, Fan Lyu, Changxing Ding
Strategic Hypothesis Testing Yatong Chen, Safwan Hossain, Yiling Chen
Accelerating Optimization via Differentiable Stopping Time Zhonglin Xie, Yiman Fong, Haoran Yuan et al.
Tight Generalization Bounds for Large-Margin Halfspaces Kasper Green Larsen, Natascha Schalburg
Word-Level Emotional Expression Control in Zero-Shot Text-to-Speech Synthesis Tianrui Wang, Haoyu Wang, Meng Ge et al.
UMoE: Unifying Attention and FFN with Shared Experts Yuanhang Yang, Chaozheng Wang, Jing Li
RF-Agent: Automated Reward Function Design via Language Agent Tree Search Ning Gao, Xiuhui Zhang, Xingyu Jiang et al.
GraLoRA: Granular Low-Rank Adaptation for Parameter-Efficient Fine-Tuning Yeonjoon Jung, Daehyun Ahn, Hyungjun Kim et al.
Quantization-Free Autoregressive Action Transformer Ziyad Sheebaelhamd, Michael Tschannen, Michael Muehlebach et al.
LLM-Explorer: A Plug-in Reinforcement Learning Policy Exploration Enhancement Driven by Large Language Models Qianyue Hao, Yiwen Song, Qingmin Liao et al.
BayeSQP: Bayesian Optimization through Sequential Quadratic Programming Paul Brunzema, Sebastian Trimpe
Practical do-Shapley Explanations with Estimand-Agnostic Causal Inference Álvaro Parafita, Tomas Garriga, Axel Brando et al.
AlphaZero Neural Scaling and Zipf's Law: a Tale of Board Games and Power Laws Oren Neumann, Claudius Gros
Set Smoothness Unlocks Clarke Hyper-stationarity in Bilevel Optimization He Chen, Jiajin Li, Anthony Man-Cho So
The Computational Advantage of Depth in Learning High-Dimensional Hierarchical Targets Yatin Dandi, Luca Pesce, Lenka Zdeborova et al.
Thoughts Are All Over the Place: On the Underthinking of Long Reasoning Models Yue Wang, Qiuzhi Liu, Jiahao Xu et al.
OPTFM: A Scalable Multi-View Graph Transformer for Hierarchical Pre-Training in Combinatorial Optimization Hao Yuan, Wenli Ouyang, Changwen Zhang et al.
ESCA: Contextualizing Embodied Agents via Scene-Graph Generation Jiani Huang, Amish Sethi, Matthew Kuo et al.
Regret Bounds for Adversarial Contextual Bandits with General Function Approximation and Delayed Feedback Orin Levy, Liad Erez, Alon Cohen et al.
Towards Multi-Table Learning: A Novel Paradigm for Complementarity Quantification and Integration Junyu Zhang, Lizhong Ding, MinghongZhang et al.
QFFT, Question-Free Fine-Tuning for Adaptive Reasoning Wanlong Liu, Junxiao Xu, Fei Yu et al.
Option-aware Temporally Abstracted Value for Offline Goal-Conditioned Reinforcement Learning Hongjoon Ahn, Heewoong Choi, Jisu Han et al.
Functional Scaling Laws in Kernel Regression: Loss Dynamics and Learning Rate Schedules Binghui Li, Fengling Chen, Zixun Huang et al.
GSRF: Complex-Valued 3D Gaussian Splatting for Efficient Radio-Frequency Data Synthesis Kang Yang, Gaofeng Dong, Sijie Ji et al.
Sharp Gaussian approximations for Decentralized Federated Learning Soham Bonnerjee, Sayar Karmakar, Wei Biao Wu
DAPO : Improving Multi-Step Reasoning Abilities of Large Language Models with Direct Advantage-Based Policy Optimization Jiacai Liu, Chaojie Wang, Chris Yuhao Liu et al.
MGUP: A Momentum-Gradient Alignment Update Policy for Stochastic Optimization Da Chang, Ganzhao Yuan
Unveiling the Power of Multiple Gossip Steps: A Stability-Based Generalization Analysis in Decentralized Training Qinglun Li, Yingqi Liu, Miao Zhang et al.
Enhancing Contrastive Learning with Variable Similarity Haowen Cui, Shuo Chen, Jun Li et al.
Orient Anything V2: Unifying Orientation and Rotation Understanding Zehan Wang, Ziang Zhang, Jiayang Xu et al.
A Closer Look at Graph Transformers: Cross-Aggregation and Beyond Jiaming Zhuo, Ziyi Ma, Yintong Lu et al.
Latent Policy Barrier: Learning Robust Visuomotor Policies by Staying In-Distribution Zhanyi Sun, Shuran Song
Bigram Subnetworks: Mapping to Next Tokens in Transformer Language Models Tyler A. Chang, Ben Bergen
Minimax-Optimal Univariate Function Selection in Sparse Additive Models: Rates, Adaptation, and the Estimation-Selection Gap Shixiang Liu
Continuous Thought Machines Luke Nicholas Darlow, Ciaran Regan, Sebastian Risi et al.
Virus Infection Attack on LLMs: Your Poisoning Can Spread "VIA" Synthetic Data Zi Liang, Qingqing Ye, Xuan Liu et al.
Robust Neural Rendering in the Wild with Asymmetric Dual 3D Gaussian Splatting Chengqi Li, Zhihao Shi, Yangdi Lu et al.
Frame Context Packing and Drift Prevention in Next-Frame-Prediction Video Diffusion Models Lvmin Zhang, Shengqu Cai, Muyang Li et al.
CoLT: The conditional localization test for assessing the accuracy of neural posterior estimates Tianyu Chen, Vansh Bansal, James G. Scott
Predictive Preference Learning from Human Interventions Haoyuan Cai, Zhenghao Peng, Bolei Zhou
Transformers for Mixed-type Event Sequences Felix Draxler, Yang Meng, Kai Nelson et al.
ROGR: Relightable 3D Objects using Generative Relighting Jiapeng Tang, Matthew Jacob Levine, Dor Verbin et al.
Hamiltonian Descent Algorithms for Optimization: Accelerated Rates via Randomized Integration Time Qiang Fu, Andre Wibisono
Cost-aware LLM-based Online Dataset Annotation Eray Can Elumar, Cem Tekin, Osman Yagan
Scaling Unlocks Broader Generation and Deeper Functional Understanding of Proteins Aadyot Bhatnagar, Sarthak Jain, Joel Beazer et al.
STARFlow: Scaling Latent Normalizing Flows for High-resolution Image Synthesis Jiatao Gu, Tianrong Chen, David Berthelot et al.
Flow Equivariant Recurrent Neural Networks T. Anderson Keller
AdaReasoner: Adaptive Reasoning Enables More Flexible Thinking Xiangqi Wang, Yue Huang, Yanbo Wang et al.
LABridge: Text–Image Latent Alignment Framework via Mean-Conditioned OU Process Huiyang Shao, Xin Xia, Yuxi Ren et al.
Achieving $\tilde{\mathcal{O}}(1/N)$ Optimality Gap in Restless Bandits through Gaussian Approximation Chen YAN, Weina Wang, Lei Ying
On the Surprising Effectiveness of Large Learning Rates under Standard Width Scaling Moritz Haas, Sebastian Bordt, Ulrike von Luxburg et al.
Flash Invariant Point Attention Andrew Liu, Axel Elaldi, Nicholas T Franklin et al.
SmallKV: Small Model Assisted Compensation of KV Cache Compression for Efficient LLM Inference Yi Zhao, Yajuan Peng, Nguyen Cam-Tu et al.
CALM-PDE: Continuous and Adaptive Convolutions for Latent Space Modeling of Time-dependent PDEs Jan Hagnberger, Daniel Musekamp, Mathias Niepert
On the Empirical Power of Goodness-of-Fit Tests in Watermark Detection Weiqing He, Xiang Li, Tianqi Shang et al.
Balancing Multimodal Training Through Game-Theoretic Regularization Konstantinos Kontras, Thomas Strypsteen, Christos Chatzichristos et al.
Bipolar Self-attention for Spiking Transformers Shuai Wang, Malu Zhang, Jingya Wang et al.
Online Functional Tensor Decomposition via Continual Learning for Streaming Data Completion Xi Zhang, Yanyi Li, Yisi Luo et al.
TrajMamba: An Efficient and Semantic-rich Vehicle Trajectory Pre-training Model Yichen Liu, Yan Lin, Shengnan Guo et al.
Tensor Product Attention Is All You Need Yifan Zhang, Yifeng Liu, Huizhuo Yuan et al.
TreeSynth: Synthesizing Diverse Data from Scratch via Tree-Guided Subspace Partitioning Sheng Wang, Pengan CHEN, Jingqi Zhou et al.
DeCaFlow: A deconfounding causal generative model Alejandro Almodóvar, Adrián Javaloy, Juan Parras et al.
Transfer Learning for Benign Overfitting in High-Dimensional Linear Regression Yeichan Kim, Ilmun Kim, Seyoung Park
LLM Meeting Decision Trees on Tabular Data Hangting Ye, Jinmeng Li, He Zhao et al.
AgentBreeder: Mitigating the AI Safety Risks of Multi-Agent Scaffolds via Self-Improvement J Rosser, Jakob Nicolaus Foerster
Learnable Burst-Encodable Time-of-Flight Imaging for High-Fidelity Long-Distance Depth Sensing Manchao Bao, Shengjiang Fang, Tao Yue et al.
MigGPT: Harnessing Large Language Models for Automated Migration of Out-of-Tree Linux Kernel Patches Across Versions Pucheng Dang, Di Huang, Dong Li et al.
FP4 All the Way: Fully Quantized Training of Large Language Models Brian Chmiel, Maxim Fishman, Ron Banner et al.
Efficient Knowledge Transfer in Federated Recommendation for Joint Venture Ecosystem Yichen Li, Yijing Shan, YI LIU et al.
VL-Rethinker: Incentivizing Self-Reflection of Vision-Language Models with Reinforcement Learning Haozhe Wang, Chao Qu, Zuming Huang et al.
Spectral Graph Neural Networks are Incomplete on Graphs with a Simple Spectrum Snir Hordan, Maya Bechler-Speicher, Gur Lifshitz et al.
ShapeLLM-Omni: A Native Multimodal LLM for 3D Generation and Understanding Junliang Ye, Zhengyi Wang, Ruowen Zhao et al.
The Implicit Bias of Structured State Space Models Can Be Poisoned With Clean Labels Yonatan Slutzky, Yotam Alexander, Noam Razin et al.
Multiverse: Your Language Models Secretly Decide How to Parallelize and Merge Generation Xinyu Yang, Yuwei An, Hongyi Liu et al.
BevSplat: Resolving Height Ambiguity via Feature-Based Gaussian Primitives for Weakly-Supervised Cross-View Localization Qiwei Wang, Wu Shaoxun, Yujiao Shi
Conflict-Aware Knowledge Editing in the Wild: Semantic-Augmented Graph Representation for Unstructured Text Zhange Zhang, Zhicheng Geng, Yuqing Ma et al.
Vision Transformers with Self-Distilled Registers Zipeng Yan, Yinjie Chen, Chong Zhou et al.
EraseFlow: Learning Concept Erasure Policies via GFlowNet-Driven Alignment Naga Sai Abhiram kusumba, Maitreya Patel, Kyle Min et al.
Boundary-Value PDEs Meet Higher-Order Differential Topology-aware GNNs Yunfeng Liao, Yangxin Wu, Xiucheng Li
4DGT: Learning a 4D Gaussian Transformer Using Real-World Monocular Videos Zhen Xu, Zhengqin Li, Zhao Dong et al.
Co-Evolving LLM Coder and Unit Tester via Reinforcement Learning Yinjie Wang, Ling Yang, Ye Tian et al.
How many measurements are enough? Bayesian recovery in inverse problems with general distributions Ben Adcock, Nick Huang
Diffusion Generative Modeling on Lie Group Representations Marco Bertolini, Tuan Le, Djork-Arné Clevert
EGGS: Exchangeable 2D/3D Gaussian Splatting for Geometry-Appearance Balanced Novel View Synthesis Yancheng Zhang, Guangyu Sun, Chen Chen
CURE: Concept Unlearning via Orthogonal Representation Editing in Diffusion Models Shristi Das Biswas, Arani Roy, Kaushik Roy
Projection-based Lyapunov method for fully heterogeneous weakly-coupled MDPs XiangCheng Zhang, Yige Hong, Weina Wang
Low-degree evidence for computational transition of recovery rate in stochastic block model Jingqiu Ding, Yiding Hua, Lucas Slot et al.
Nonlinear Laplacians: Tunable principal component analysis under directional prior information Yuxin Ma, Dmitriy Kunisky
Chain-of-Zoom: Extreme Super-Resolution via Scale Autoregression and Preference Alignment Bryan Sangwoo Kim, Jeongsol Kim, Jong Chul Ye
Personalized Decision Modeling: Utility Optimization or Textualized-Symbolic Reasoning Yibo Zhao, Yang Zhao, Hongru Du et al.
What are you sinking? A geometric approach on attention sink Valeria Ruscio, Umberto Nanni, Fabrizio Silvestri
KARMA: Leveraging Multi-Agent LLMs for Automated Knowledge Graph Enrichment Yuxing Lu, Wei Wu, Xukai Zhao et al.
MetaMind: Modeling Human Social Thoughts with Metacognitive Multi-Agent Systems Xuanming Zhang, Yuxuan Chen, Samuel Yeh et al.
Enhancing CLIP Robustness via Cross-Modality Alignment Xingyu Zhu, Beier Zhu, Shuo Wang et al.
Rethinking Entropy in Test-Time Adaptation: The Missing Piece from Energy Duality Mincheol Park, Heeji Won, Won Woo Ro et al.
On the Optimal Construction of Unbiased Gradient Estimators for Zeroth-Order Optimization Shaocong Ma, Heng Huang
Gradient Variance Reveals Failure Modes in Flow-Based Generative Models Teodora Reu, Sixtine Dromigny, Michael M. Bronstein et al.
TREND: Unsupervised 3D Representation Learning via Temporal Forecasting for LiDAR Perception Runjian Chen, Hyoungseob Park, Bo Zhang et al.
Boosting Generative Image Modeling via Joint Image-Feature Synthesis Theodoros Kouzelis, Efstathios Karypidis, Ioannis Kakogeorgiou et al.
A Token is Worth over 1,000 Tokens: Efficient Knowledge Distillation through Low-Rank Clone Jitai Hao, Qiang Huang, Hao Liu et al.
SparseMVC: Probing Cross-view Sparsity Variations for Multi-view Clustering Ruimeng Liu, Xin Zou, Chang Tang et al.
Unbiased Prototype Consistency Learning for Multi-Modal and Multi-Task Object Re-Identification Zhongao Zhou, Bin Yang, Wenke Huang et al.
MJ-Video: Benchmarking and Rewarding Video Generation with Fine-Grained Video Preference Haibo Tong, Zhaoyang Wang, Zhaorun Chen et al.
Fast Projection-Free Approach (without Optimization Oracle) for Optimization over Compact Convex Set Chenghao Liu, Enming Liang, Minghua Chen
Wider or Deeper? Scaling LLM Inference-Time Compute with Adaptive Branching Tree Search Yuichi Inoue, Kou Misaki, Yuki Imajuku et al.
RepoMaster: Autonomous Exploration and Understanding of GitHub Repositories for Complex Task Solving Huacan Wang, Ziyi Ni, Shuo Zhang et al.
Hierarchical Shortest-Path Graph Kernel Network Jiaxin Wang, Wenxuan Tu, Jieren Cheng
Differential Privacy on Fully Dynamic Streams Yuan Qiu, Ke Yi
Shortcut Features as Top Eigenfunctions of NTK: A Linear Neural Network Case and More Jinwoo Lim, Suhyun Kim, Soo-Mook Moon
SuffixDecoding: Extreme Speculative Decoding for Emerging AI Applications Gabriele Oliaro, Zhihao Jia, Daniel F Campos et al.
Efficient Prompt Compression with Evaluator Heads for Long-Context Transformer Inference Weizhi Fei, Xueyan Niu, XIE GUOQING et al.
UniRelight: Learning Joint Decomposition and Synthesis for Video Relighting Kai He, Ruofan Liang, Jacob Munkberg et al.
When Thinking Fails: The Pitfalls of Reasoning for Instruction-Following in LLMs Xiaomin Li, Zhou Yu, Zhiwei Zhang et al.
On Agnostic PAC Learning in the Small Error Regime Julian Asilis, Mikael Møller Høgsgaard, Grigoris Velegkas
Wavelet Canonical Coherence for Nonstationary Signals Haibo Wu, Marina I. Knight, Keiland W. Cooper et al.
Language Modeling by Language Models Junyan Cheng, Peter Clark, Kyle Richardson
Plasticity as the Mirror of Empowerment David Abel, Michael Bowling, Andre Barreto et al.
PiKE: Adaptive Data Mixing for Large-Scale Multi-Task Learning Under Low Gradient Conflicts Zeman Li, Yuan Deng, Peilin Zhong et al.
Language Models can Self-Improve at State-Value Estimation for Better Search Ethan Mendes, Alan Ritter
Scalable Cross-View Sample Alignment for Multi-View Clustering with View Structure Similarity Jun Wang, Zhenglai Li, Chang Tang et al.
Multidimensional Bayesian Utility Maximization: Tight Approximations to Welfare Kira Goldner, Taylor Lundy
Decomposing stimulus-specific sensory neural information via diffusion models Steeve Laquitaine, Simone Azeglio, Carlo Paris et al.
Any-stepsize Gradient Descent for Separable Data under Fenchel–Young Losses Han Bao, Shinsaku Sakaue, Yuki Takezawa
Provably Efficient RL under Episode-Wise Safety in Constrained MDPs with Linear Function Approximation Toshinori Kitamura, Arnob Ghosh, Tadashi Kozuno et al.
To Distill or Decide? Understanding the Algorithmic Trade-off in Partially Observable RL Yuda Song, Dhruv Rohatgi, Aarti Singh et al.
A learnability analysis on neuro-symbolic learning Hao-Yuan He, Ming Li
Self-Perturbed Anomaly-Aware Graph Dynamics for Multivariate Time-Series Anomaly Detection Jinyu Cai, Yuan Xie, Glynnis Lim et al.
Restoring Pruned Large Language Models via Lost Component Compensation Zijian Feng, Hanzhang Zhou, Zixiao Zhu et al.
Towards Building Model/Prompt-Transferable Attackers against Large Vision-Language Models Xiaowen Cai, Daizong Liu, Xiaoye Qu et al.
GaussianFusion: Gaussian-Based Multi-Sensor Fusion for End-to-End Autonomous Driving Shuai Liu, Quanmin Liang, Zefeng Li et al.
SIU3R: Simultaneous Scene Understanding and 3D Reconstruction Beyond Feature Alignment Qi Xu, Dongxu Wei, Lingzhe Zhao et al.
HYPERION: Fine-Grained Hypersphere Alignment for Robust Federated Graph Learning Guancheng Wan, Xiaoran Shang, Yuxin Wu et al.
Brain-Inspired fMRI-to-Text Decoding via Incremental and Wrap-Up Language Modeling Wentao Lu, Dong Nie, Pengcheng Xue et al.
Sampling-Efficient Test-Time Scaling: Self-Estimating the Best-of-N Sampling in Early Decoding Yiming Wang, Pei Zhang, Siyuan Huang et al.
PoE-World: Compositional World Modeling with Products of Programmatic Experts Wasu Top Piriyakulkij, Yichao Liang, Hao Tang et al.
Uni-LoRA: One Vector is All You Need Kaiyang Li, Shaobo Han, Qing Su et al.
Reinforcement Learning for Out-of-Distribution Reasoning in LLMs: An Empirical Study on Diagnosis-Related Group Coding Hanyin Wang, Zhenbang Wu, Gururaj J. Kolar et al.
Stochastic Process Learning via Operator Flow Matching Yaozhong Shi, Zachary E Ross, Domniki Asimaki et al.
Strategic Costs of Perceived Bias in Fair Selection L. Elisa Celis, Lingxiao Huang, Milind Sohoni et al.
A Closer Look at Model Collapse: From a Generalization-to-Memorization Perspective Lianghe Shi, Meng Wu, Huijie Zhang et al.
AdaSPEC: Selective Knowledge Distillation for Efficient Speculative Decoders Yuezhou Hu, Jiaxin Guo, Xinyu Feng et al.
Depth-Width Tradeoffs for Transformers on Graph Tasks Gilad Yehudai, Clayton Sanford, Maya Bechler-Speicher et al.
Refinement Methods for Distributed Distribution Estimation under $\ell^p$-Losses Deheng Yuan, Tao Guo, Zhongyi Huang
Measuring and Guiding Monosemanticity Ruben Härle, Felix Friedrich, Manuel Brack et al.
Variational Transdimensional Inference Laurence Davies, Dan MacKinlay, Rafael Oliveira et al.
Scaling Laws For Scalable Oversight Joshua Engels, David D. Baek, Subhash Kantamneni et al.
A Near-Optimal Algorithm for Decentralized Convex-Concave Finite-Sum Minimax Optimization Hongxu Chen, Ke Wei, Haishan Ye et al.
Learning with Calibration: Exploring Test-Time Computing of Spatio-Temporal Forecasting Wei Chen, Yuxuan Liang
FPSAttention: Training-Aware FP8 and Sparsity Co-Design for Fast Video Diffusion Akide Liu, Zeyu Zhang, Zhexin Li et al.
Disentangled Concepts Speak Louder Than Words: Explainable Video Action Recognition Jongseo Lee, Wooil Lee, Gyeong-Moon Park et al.
Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection Shuhai Zhang, ZiHao Lian, Jiahao Yang et al.
Robust Graph Condensation via Classification Complexity Mitigation Jiayi Luo, Qingyun Sun, Beining Yang et al.
CausalPFN: Amortized Causal Effect Estimation via In-Context Learning Vahid Balazadeh, Hamidreza Kamkari, Valentin Thomas et al.
High-order Equivariant Flow Matching for Density Functional Theory Hamiltonian Prediction Seongsu Kim, Nayoung Kim, Dongwoo Kim et al.
🎧MOSPA: Human Motion Generation Driven by Spatial Audio Shuyang Xu, Zhiyang Dou, Mingyi Shi et al.
Absolute Zero: Reinforced Self-play Reasoning with Zero Data Andrew Zhao, Yiran Wu, Yang Yue et al.
Graph–Smoothed Bayesian Black-Box Shift Estimator and Its Information Geometry Masanari Kimura
Vision Transformers Don't Need Trained Registers Nicholas Jiang, Amil Dravid, Alexei A Efros et al.
Object-centric 3D Motion Field for Robot Learning from Human Videos Zhao-Heng Yin, Sherry Yang, Pieter Abbeel
Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation Shuo Yang, Haocheng Xi, Yilong Zhao et al.
Aggregation Hides Out-of-Distribution Generalization Failures from Spurious Correlations Olawale Elijah Salaudeen, Haoran Zhang, Kumail Alhamoud et al.
Mean-Field Sampling for Cooperative Multi-Agent Reinforcement Learning Emile Timothy Anand, Ishani Karmarkar, Guannan Qu
EAG3R: Event-Augmented 3D Geometry Estimation for Dynamic and Extreme-Lighting Scenes Xiaoshan Wu, Yifei Yu, Xiaoyang Lyu et al.
LaViDa: A Large Diffusion Language Model for Multimodal Understanding Shufan Li, Konstantinos Kallidromitis, Hritik Bansal et al.
Theory-Driven Label-Specific Representation for Incomplete Multi-View Multi-Label Learning Quanjiang Li, Tianxiang Xu, Tingjin Luo et al.
Scalable Fingerprinting of Large Language Models Anshul Nasery, Jonathan Hayase, Creston Brooks et al.
Can Knowledge-Graph-based Retrieval Augmented Generation Really Retrieve What You Need? Junchi Yu, Yujie Liu, Jindong Gu et al.
Decomposing Interventional Causality into Synergistic, Redundant, and Unique Components Abel Jansma
Long-Tailed Recognition via Information-Preservable Two-Stage Learning Fudong Lin, Xu Yuan
Mozart: Modularized and Efficient MoE Training on 3.5D Wafer-Scale Chiplet Architectures Shuqing Luo, Ye Han, Pingzhi Li et al.
Data Mixing Can Induce Phase Transitions in Knowledge Acquisition Xinran Gu, Kaifeng Lyu, Jiazheng Li et al.
Shallow Diffuse: Robust and Invisible Watermarking through Low-Dim Subspaces in Diffusion Models Wenda Li, Huijie Zhang, Qing Qu
Offline Guarded Safe Reinforcement Learning for Medical Treatment Optimization Strategies Runze Yan, Xun Shen, Akifumi Wachi et al.
From Counterfactuals to Trees: Competitive Analysis of Model Extraction Attacks Awa Khouna, Julien Ferry, Thibaut Vidal
Repo2Run: Automated Building Executable Environment for Code Repository at Scale Ruida Hu, Chao Peng, XinchenWang et al.
Towards Dynamic 3D Reconstruction of Hand-Instrument Interaction in Ophthalmic Surgery Ming Hu, Zhengdi Yu, Feilong Tang et al.
Unlocking Dataset Distillation with Diffusion Models Brian Bernhard Moser, Federico Raue, Sebastian Palacio et al.
Vision-centric Token Compression in Large Language Model Ling Xing, Alex Jinpeng Wang, Rui Yan et al.
VITA-1.5: Towards GPT-4o Level Real-Time Vision and Speech Interaction Chaoyou Fu, Haojia Lin, Xiong Wang et al.
EDELINE: Enhancing Memory in Diffusion-based World Models via Linear-Time Sequence Modeling Jia-Hua Lee, Bor-Jiun Lin, Wei-Fang Sun et al.
UniTok: a Unified Tokenizer for Visual Generation and Understanding Chuofan Ma, Yi Jiang, Junfeng Wu et al.
NormFit: A Lightweight Solution for Few-Shot Federated Learning with Non-IID Data Azadeh Motamedi, Jae-Mo Kang, Il-Min Kim
Towards Comprehensive Scene Understanding: Integrating First and Third-Person Views for LVLMs Insu Lee, Wooje Park, Jaeyun Jang et al.
Accelerating Visual-Policy Learning through Parallel Differentiable Simulation Haoxiang You, Yilang Liu, Ian Abraham
Online Prediction with Limited Selectivity Licheng Liu, Mingda Qiao
Generative Trajectory Stitching through Diffusion Composition Yunhao Luo, Utkarsh Aashu Mishra, Yilun Du et al.
VLMs have Tunnel Vision: Evaluating Nonlocal Visual Reasoning in Leading VLMs Shmuel Berman, Jia Deng
Neighborhood Self-Dissimilarity Attention for Medical Image Segmentation Chen Junren, Rui Chen, Wang-wei et al.
Learning to Factorize Spatio-Temporal Foundation Models Siru Zhong, Junjie Qiu, Yangyu Wu et al.
Angles Don’t Lie: Unlocking Training‑Efficient RL Through the Model’s Own Signals Qinsi Wang, Jinghan Ke, Hancheng Ye et al.
Generalizable Insights for Graph Transformers in Theory and Practice Timo Stoll, Luis Müller, Christopher Morris
Principled Data Augmentation for Learning to Solve Quadratic Programming Problems Chendi Qian, Christopher Morris
Dual Data Alignment Makes AI-Generated Image Detector Easier Generalizable Ruoxin Chen, Junwei Xi, Zhiyuan Yan et al.
CSBrain: A Cross-scale Spatiotemporal Brain Foundation Model for EEG Decoding Yuchen Zhou, Jiamin Wu, Zichen Ren et al.
Flattening Hierarchies with Policy Bootstrapping John Luoyu Zhou, Jonathan Kao
HopaDIFF: Holistic-Partial Aware Fourier Conditioned Diffusion for Referring Human Action Segmentation in Multi-Person Scenarios Kunyu Peng, Junchao Huang, Xiangsheng Huang et al.
Geometry Meets Incentives: Sample-Efficient Incentivized Exploration with Linear Contexts Benjamin Schiffer, Mark Sellke
GeoRemover: Removing Objects and Their Causal Visual Artifacts Zixin Zhu, Haoxiang Li, Xuelu Feng et al.
The Primacy of Magnitude in Low-Rank Adaptation Zicheng Zhang, Haoran Li, Yifeng Zhang et al.
GeRaF: Neural Geometry Reconstruction from Radio Frequency Signals Jiachen Lu, Hailan Shanbhag, Haitham Al Hassanieh
Spatial Understanding from Videos: Structured Prompts Meet Simulation Data Haoyu Zhang, Meng Liu, Zaijing Li et al.
SATURN: SAT-based Reinforcement Learning to Unleash LLMs Reasoning Huanyu Liu, Ge Li, Jia Li et al.
JavisGPT: A Unified Multi-modal LLM for Sounding-Video Comprehension and Generation Kai Liu, Jungang Li, Yuchong Sun et al.
Dimension-adapted Momentum Outscales SGD Damien Ferbach, Katie Everett, Gauthier Gidel et al.
From Experts to a Generalist: Toward General Whole-Body Control for Humanoid Robots Yuxuan Wang, Ming Yang, Ziluo Ding et al.
LoRAShop: Training-Free Multi-Concept Image Generation and Editing with Rectified Flow Transformers Yusuf Dalva, Hidir Yesiltepe, Pinar Yanardag
GeoSVR: Taming Sparse Voxels for Geometrically Accurate Surface Reconstruction Jiahe Li, Jiawei Zhang, Youmin Zhang et al.
Transformer Copilot: Learning from The Mistake Log in LLM Fine-tuning Jiaru Zou, Yikun Ban, Zihao Li et al.
scMRDR: A scalable and flexible framework for unpaired single-cell multi-omics data integration Jianle Sun, Chaoqi Liang, Ran Wei et al.
Imitation Beyond Expectation Using Pluralistic Stochastic Dominance Ali Farajzadeh, Danyal Saeed, Syed M Abbas et al.
Cloud4D: Estimating Cloud Properties at a High Spatial and Temporal Resolution Jacob Lin, Edward Gryspeerdt, Ronald Clark
CLiFT: Compressive Light-Field Tokens for Compute Efficient and Adaptive Neural Rendering Zhengqing Wang, Yuefan Wu, Jiacheng Chen et al.
Adaptive Neighborhood-Constrained Q Learning for Offline Reinforcement Learning Yixiu Mao, Yun Qu, Cheems Wang et al.
To Think or Not To Think: A Study of Thinking in Rule-Based Visual Reinforcement Fine-Tuning Ming Li, Jike Zhong, Shitian Zhao et al.
DexGarmentLab: Dexterous Garment Manipulation Environment with Generalizable Policy Yuran Wang, Ruihai Wu, Yue Chen et al.
STITCH-OPE: Trajectory Stitching with Guided Diffusion for Off-Policy Evaluation Hossein Goli, Michael Gimelfarb, Nathan Samuel de Lara et al.
Neural Atlas Graphs for Dynamic Scene Decomposition and Editing Jan Philipp Schneider, Pratik Singh Bisht, Ilya Chugunov et al.
LeMiCa: Lexicographic Minimax Path Caching for Efficient Diffusion-Based Video Generation Huanlin Gao, Ping Chen, Fuyuan Shi et al.
Robust SuperAlignment: Weak-to-Strong Robustness Generalization for Vision-Language Models Junhao Dong, Cong Zhang, Xinghua Qu et al.
Thought Communication in Multiagent Collaboration Yujia Zheng, Zhuokai Zhao, Zijian Li et al.
Polyline Path Masked Attention for Vision Transformer Zhongchen Zhao, Chaodong Xiao, Hui LIN et al.
PLMTrajRec: A Scalable and Generalizable Trajectory Recovery Method with Pre-trained Language Models Tonglong Wei, Yan Lin, Youfang Lin et al.
Optimization Inspired Few-Shot Adaptation for Large Language Models Boyan Gao, Xin Wang, Yibo Yang et al.
Scent of Knowledge: Optimizing Search-Enhanced Reasoning with Information Foraging Hongjin Qian, Zheng Liu
Taccel: Scaling Up Vision-based Tactile Robotics via High-performance GPU Simulation Yuyang Li, Wenxin Du, Chang Yu et al.
Toward Relative Positional Encoding in Spiking Transformers Changze Lv, Yansen Wang, Dongqi Han et al.
TransMLA: Migrating GQA Models to MLA with Full DeepSeek Compatibility and Speedup Fanxu Meng, Pingzhi Tang, Zengwei Yao et al.
Towards Understanding the Mechanisms of Classifier-Free Guidance Xiang Li, Rongrong Wang, Qing Qu
PhysX-3D: Physical-Grounded 3D Asset Generation Ziang Cao, Zhaoxi Chen, Liang Pan et al.
Towards Physics-informed Spatial Intelligence with Human Priors: An Autonomous Driving Pilot Study Guanlin Wu, Boyan Su, Yang Zhao et al.
StreamForest: Efficient Online Video Understanding with Persistent Event Memory Xiangyu Zeng, Kefan Qiu, Qingyu Zhang et al.
Vanish into Thin Air: Cross-prompt Universal Adversarial Attacks for SAM2 Ziqi Zhou, Yifan Hu, Yufei Song et al.
Improving Evolutionary Multi-View Classification via Eliminating Individual Fitness Bias Xinyan Liang, ShuaiLi, Qian Guo et al.
Right Question is Already Half the Answer: Fully Unsupervised LLM Reasoning Incentivization Qingyang Zhang, Haitao Wu, Changqing Zhang et al.
MDReID: Modality-Decoupled Learning for Any-to-Any Multi-Modal Object Re-Identification Yingying Feng, Jie Li, Jie Hu et al.
RobustMerge: Parameter-Efficient Model Merging for MLLMs with Direction Robustness Fanhu Zeng, Haiyang Guo, Fei Zhu et al.
Stable Part Diffusion 4D: Multi-View RGB and Kinematic Parts Video Generation Hao Zhang, Chun-Han Yao, Simon Donné et al.
OnlineSplatter: Pose-Free Online 3D Reconstruction for Free-Moving Objects Mark He Huang, Lin Geng Foo, Christian Theobalt et al.
Rectified Point Flow: Generic Point Cloud Pose Estimation TAO SUN, Liyuan Zhu, Shengyu Huang et al.
Cue3D: Quantifying the Role of Image Cues in Single-Image 3D Generation Xiang Li, Zirui Wang, Zixuan Huang et al.
SceneDesigner: Controllable Multi-Object Image Generation with 9-DoF Pose Manipulation Zhenyuan Qin, Xincheng Shuai, Henghui Ding
StelLA: Subspace Learning in Low-rank Adaptation using Stiefel Manifold Zhizhong Li, Sina Sajadmanesh, Jingtao Li et al.
Non-Clairvoyant Scheduling with Progress Bars Ziyad Benomar, Romain Cosson, Alexander Lindermayr et al.
Jacobian-Based Interpretation of Nonlinear Neural Encoding Model Xiaohui Gao, Haoran Yang, Yue Cheng et al.
Mesh-RFT: Enhancing Mesh Generation via Fine-grained Reinforcement Fine-Tuning Jian Liu, Jing Xu, Song Guo et al.
VisualQuality-R1: Reasoning-Induced Image Quality Assessment via Reinforcement Learning to Rank Tianhe Wu, Jian Zou, Jie Liang et al.
GenColor: Generative and Expressive Color Enhancement with Pixel-Perfect Texture Preservation Yi Dong, Yuxi Wang, Xianhui Lin et al.
G-Memory: Tracing Hierarchical Memory for Multi-Agent Systems Guibin Zhang, Muxin Fu, Kun Wang et al.
FutureSightDrive: Thinking Visually with Spatio-Temporal CoT for Autonomous Driving Shuang Zeng, Xinyuan Chang, Mengwei Xie et al.
E2Former: An Efficient and Equivariant Transformer with Linear-Scaling Tensor Products Yunyang Li, Lin Huang, Zhihao Ding et al.
Adaptive Defense against Harmful Fine-Tuning for Large Language Models via Bayesian Data Scheduler Zixuan Hu, Li Shen, Zhenyi Wang et al.
Neptune-X: Active X-to-Maritime Generation for Universal Maritime Object Detection Yu Guo, Shengfeng He, Yuxu Lu et al.
AuroRA: Breaking Low-Rank Bottleneck of LoRA with Nonlinear Mapping Haonan Dong, Wenhao Zhu, Guojie Song et al.
Puppeteer: Rig and Animate Your 3D Models Chaoyue Song, Xiu Li, Fan Yang et al.
Talk2Event: Grounded Understanding of Dynamic Scenes from Event Cameras Lingdong Kong, Dongyue Lu, Alan Liang et al.
DNAEdit: Direct Noise Alignment for Text-Guided Rectified Flow Editing Chenxi Xie, Minghan Li, Shuai Li et al.
Alligat0R: Pre-Training through Covisibility Segmentation for Relative Camera Pose Regression Thibaut Loiseau, Guillaume Bourmaud, Vincent Lepetit
DiCo: Revitalizing ConvNets for Scalable and Efficient Diffusion Modeling Yuang Ai, Qihang Fan, Xuefeng Hu et al.
Enhancing Time Series Forecasting through Selective Representation Spaces: A Patch Perspective Xingjian Wu, Xiangfei Qiu, Hanyin Cheng et al.
Injecting Frame-Event Complementary Fusion into Diffusion for Optical Flow in Challenging Scenes Haonan Wang, Hanyu Zhou, Haoyue Liu et al.
OmniSync: Towards Universal Lip Synchronization via Diffusion Transformers Ziqiao Peng, Jiwen Liu, Haoxian Zhang et al.
MesaTask: Towards Task-Driven Tabletop Scene Generation via 3D Spatial Reasoning Jinkun Hao, Naifu Liang, Zhen Luo et al.
Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion Xun Huang, Zhengqi Li, Guande He et al.
DICEPTION: A Generalist Diffusion Model for Visual Perceptual Tasks Canyu Zhao, Yanlong Sun, Mingyu Liu et al.
Variational Learning Finds Flatter Solutions at the Edge of Stability Avrajit Ghosh, Bai Cong, Rio Yokota et al.
Seeing Sound, Hearing Sight: Uncovering Modality Bias and Conflict of AI models in Sound Localization Yanhao Jia, Ji Xie, S Jivaganesh et al.
ALINE: Joint Amortization for Bayesian Inference and Active Data Acquisition Daolang Huang, Xinyi Wen, Ayush Bharti et al.
Fully Autonomous Neuromorphic Navigation and Dynamic Obstacle Avoidance Xiaochen Shang, Luo Pengwei, Xinning Wang et al.
Enhancing LLM Watermark Resilience Against Both Scrubbing and Spoofing Attacks Huanming Shen, Baizhou Huang, Xiaojun Wan
Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search Huanjin Yao, Jiaxing Huang, Wenhao Wu et al.
ProtInvTree: Deliberate Protein Inverse Folding with Reward-guided Tree Search Mengdi Liu, Xiaoxue Cheng, Zhangyang Gao et al.
On the Value of Cross-Modal Misalignment in Multimodal Representation Learning Yichao Cai, Yuhang Liu, Erdun Gao et al.
A Unified Solution to Video Fusion: From Multi-Frame Learning to Benchmarking Zixiang Zhao, Haowen Bai, Bingxin Ke et al.
Multi-agent Markov Entanglement Shuze Chen, Tianyi Peng
SQS: Enhancing Sparse Perception Models via Query-based Splatting in Autonomous Driving Haiming Zhang, Yiyao Zhu, Wending Zhou et al.
PerceptionLM: Open-Access Data and Models for Detailed Visual Understanding Jang Hyun Cho, Andrea Madotto, Effrosyni Mavroudi et al.
Debate or Vote: Which Yields Better Decisions in Multi-Agent Large Language Models? Hyeong Kyu Choi, Jerry Zhu, Sharon Li
VoxDet: Rethinking 3D Semantic Scene Completion as Dense Object Detection Wuyang Li, Zhu Yu, Alexandre Alahi
Approximate Domain Unlearning for Vision-Language Models Kodai Kawamura, Yuta Goto, Rintaro Yanagi et al.
BioCLIP 2: Emergent Properties from Scaling Hierarchical Contrastive Learning Jianyang Gu, Samuel Stevens, Elizabeth G Campolongo et al.
GraphMaster: Automated Graph Synthesis via LLM Agents in Data-Limited Environments Enjun Du, Xunkai Li, Tian Jin et al.
Q-Insight: Understanding Image Quality via Visual Reinforcement Learning Weiqi Li, Xuanyu Zhang, Shijie Zhao et al.
What Makes a Reward Model a Good Teacher? An Optimization Perspective Noam Razin, Zixuan Wang, Hubert Strauss et al.
$\Psi$-Sampler: Initial Particle Sampling for SMC-Based Inference-Time Reward Alignment in Score Models TaeHoon Yoon, Yunhong Min, Kyeongmin Yeo et al.
Do-PFN: In-Context Learning for Causal Effect Estimation Jake Robertson, Arik Reuter, Siyuan Guo et al.
ReSim: Reliable World Simulation for Autonomous Driving Jiazhi Yang, Kashyap Chitta, Shenyuan Gao et al.
Differentiable Sparsity via $D$-Gating: Simple and Versatile Structured Penalization Chris Kolb, Laetitia Frost, Bernd Bischl et al.
← Browse the whole archive