NeurIPS 2025 Spotlight Papers

NeurIPSSpotlight2025

All 687 papers accepted as Spotlight at NeurIPS 2025 — the top slice of the accepted programme. Every title links to its own page with authors, affiliation and sources.

All 687 papers

  1. MoCha: Towards Movie-Grade Talking Character GenerationCong Wei, Bo Sun, Haoyu Ma et al.
  2. WISA: World simulator assistant for physics-aware text-to-video generationJing Wang, Ao Ma, Ke Cao et al.
  3. ModHiFi: Identifying High Fidelity predictive components for Model ModificationDhruva Kashyap, Chaitanya Murti, Pranav K Nayak et al.
  4. The Structure of Relation Decoding Linear Operators in Large Language ModelsMiranda Anna Christ, Adrián Csiszárik, Gergely Becsó et al.
  5. KLASS: KL-Guided Fast Inference in Masked Diffusion ModelsSeo Hyun Kim, Sunwoo Hong, Hojung Jung et al.
  6. HM3: Hierarchical Multi-Objective Model Merging for Pretrained ModelsYu Zhou, Xingyu Wu, Jibin Wu et al.
  7. Structured Sparse Transition Matrices to Enable State Tracking in State-Space ModelsAleksandar Terzic, Nicolas Menet, Michael Hersche et al.
  8. Twilight: Adaptive Attention Sparsity with Hierarchical Top-$p$ PruningChaofan Lin, Jiaming Tang, Shuo Yang et al.
  9. An Analysis of Causal Effect Estimation using Outcome Invariant Data AugmentationUZAIR AKBAR, Niki Kilbertus, Hao Shen et al.
  10. Deciphering the Extremes: A Novel Approach for Pathological Long-tailed Recognition in Scientific DiscoveryZhe Zhao, HaiBin Wen, Xianfu Liu et al.
  11. OpenCUA: Open Foundations for Computer-Use AgentsXinyuan Wang, Bowen Wang, Dunjie Lu et al.
  12. Near-Optimal Experiment Design in Linear non-Gaussian Cyclic ModelsEhsan Sharifian, Saber Salehkaleybar, Negar Kiyavash
  13. Escaping saddle points without Lipschitz smoothness: the power of nonlinear preconditioningAlexander Bodard, Panagiotis Patrinos
  14. Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language ModelsZekai Zhao, Qi Liu, Kun Zhou et al.
  15. Direct Fisher Score Estimation for Likelihood MaximizationSherman Khoo, Yakun Wang, Song Liu et al.
  16. Path-Enhanced Contrastive Learning for RecommendationHaoran Sun, Fei Xiong, Yuanzhe Hu et al.
  17. T-REGS: Minimum Spanning Tree Regularization for Self-Supervised LearningJulie Mordacq, David Loiseaux, Vicky Kalogeiton et al.
  18. Generating Informative Samples for Risk-Averse Fine-Tuning of Downstream TasksHeasung Kim, Taekyun Lee, Hyeji Kim et al.
  19. AceSearcher: Bootstrapping Reasoning and Search for LLMs via Reinforced Self-PlayRan Xu, Yuchen Zhuang, Zihan Dong et al.
  20. DeltaFlow: An Efficient Multi-frame Scene Flow Estimation MethodQingwen Zhang, Xiaomeng Zhu, Yushan Zhang et al.
  21. Web-Shepherd: Advancing PRMs for Reinforcing Web AgentsHyungjoo Chae, Sunghwan Kim, Junhee Cho et al.
  22. How do Transformers Learn Implicit Reasoning?Jiaran Ye, Zijun Yao, Zhidian Huang et al.
  23. On the sample complexity of semi-supervised multi-objective learningTobias Wegel, Geelon So, Junhyung Park et al.
  24. Diversity-Aware Policy Optimization for Large Language Model ReasoningJian Yao, Ran Cheng, Xingyu Wu et al.
  25. Fixed-Point RNNs: Interpolating from Diagonal to DenseSajad Movahedi, Felix Sarnthein, Nicola Muca Cirone et al.
  26. Bridging Theory and Practice in Link Representation with Graph Neural NetworksVeronica Lachi, Francesco Ferrini, Antonio Longa et al.
  27. ErrorTrace: A Black-Box Traceability Mechanism Based on Model Family Error SpaceChuanchao Zang, Xiangtao Meng, Wenyu Chen et al.
  28. Protein Design with Dynamic Protein VocabularyNuowei Liu, Jiahao Kuang, Yanting Liu et al.
  29. Towards Reliable Code-as-Policies: A Neuro-Symbolic Framework for Embodied Task PlanningSanghyun Ahn, Wonje Choi, Junyong Lee et al.
  30. AI-Researcher: Autonomous Scientific InnovationJiabin Tang, Lianghao Xia, Zhonghang Li et al.
  31. Abstain Mask Retain Core: Time Series Prediction by Adaptive Masking Loss with Representation ConsistencyRenzhao Liang, Sizhe Xu, Chenggang Xie et al.
  32. DexFlyWheel: A Scalable and Self-improving Data Generation Framework for Dexterous ManipulationKefei Zhu, Fengshuo Bai, YuanHao Xiang et al.
  33. Learning Robust Vision-Language Models from Natural Latent SpacesZhangyun Wang, Ni Ding, Aniket Mahanti
  34. Accelerating Diffusion LLMs via Adaptive Parallel DecodingDaniel Mingyi Israel, Guy Van den Broeck, Aditya Grover
  35. Inner Speech as Behavior Guides: Steerable Imitation of Diverse Behaviors for Human-AI coordinationRakshit Trivedi, Kartik Sharma, David C. Parkes
  36. Graph-Based Attention for Differentiable MaxSAT SolvingSota Moriyama, Katsumi Inoue
  37. Pass@K Policy Optimization: Solving Harder Reinforcement Learning ProblemsChristian Walder, Deep Tejas Karkhanis
  38. LogicTree: Improving Complex Reasoning of LLMs via Instantiated Multi-step Synthetic Logical DataZehao Wang, Lin Yang, Jie Wang et al.
  39. Multitask Learning with Stochastic InterpolantsHugo Negrel, Florentin Coeurdoux, Michael Samuel Albergo et al.
  40. FUDOKI: Discrete Flow-based Unified Understanding and Generation via Kinetic-Optimal VelocitiesJin Wang, Yao Lai, Aoxue Li et al.
  41. Fast MRI for All: Bridging Access Gaps by Training without Raw DataYasar Utku Alcalar, Merve Gulle, Mehmet Akcakaya
  42. Knowledge Insulating Vision-Language-Action Models: Train Fast, Run Fast, Generalize BetterDanny Driess, Jost Tobias Springenberg, brian ichter et al.
  43. Complete Structure Guided Point Cloud Completion via Cluster- and Instance-Level Contrastive LearningYang Chen, Yirun Zhou, WEIZHONG ZHANG et al.
  44. ARECHO: Autoregressive Evaluation via Chain-Based Hypothesis Optimization for Speech Multi-Metric EstimationJiatong Shi, Yifan Cheng, Bo-Hao Su et al.
  45. Projective Equivariant Networks via Second-order Fundamental Differential InvariantsYikang Li, Yeqing Qiu, Yuxuan Chen et al.
  46. ZeroS: Zero‑Sum Linear Attention for Efficient TransformersJiecheng Lu, Xu Han, Yan Sun et al.
  47. Blameless Users in a Clean Room: Defining Copyright Protection for Generative ModelsAloni Cohen
  48. Adaptive 3D Reconstruction via Diffusion Priors and Forward Curvature-Matching Likelihood UpdatesSeunghyeok Shin, Dabin Kim, Hongki Lim
  49. From Shortcut to Induction Head: How Data Diversity Shapes Algorithm Selection in TransformersRyotaro Kawata, Yujin Song, Alberto Bietti et al.
  50. Learning Interestingness in Automated Mathematical Theory FormationGeorge Tsoukalas, Rahul Saha, Amitayush Thakur et al.
  51. DNA-DetectLLM: Unveiling AI-Generated Text via a DNA-Inspired Mutation-Repair ParadigmXiaowei Zhu, Yubing Ren, Fang Fang et al.
  52. Signal and Noise: A Framework for Reducing Uncertainty in Language Model EvaluationDavid Heineman, Valentin Hofmann, Ian Magnusson et al.
  53. Tradeoffs between Mistakes and ERM Oracle Calls in Online and Transductive Online LearningIdan Attias, Steve Hanneke, Arvind Ramaswami
  54. The World Is Bigger! A Computationally-Embedded Perspective on the Big World HypothesisAlex Lewandowski, Aditya A. Ramesh, Edan Meyer et al.
  55. Multimodal Disease Progression Modeling via Spatiotemporal Disentanglement and Multiscale AlignmentChen Liu, Wenfang Yao, Kejing Yin et al.
  56. On the Hardness of Conditional Independence Testing In PracticeZheng He, Roman Pogodin, Yazhe Li et al.
  57. Emergence and Evolution of Interpretable Concepts in Diffusion ModelsBerk Tinaz, Zalan Fabian, Mahdi Soltanolkotabi
  58. PCA++: How Uniformity Induces Robustness to Background Noise in Contrastive LearningMingqi Wu, Qiang Sun, Archer Y. Yang
  59. Optimal Nuisance Function Tuning for Estimating a Doubly Robust Functional under Proportional AsymptoticsSean McGrath, Debarghya Mukherjee, Rajarshi Mukherjee et al.
  60. GeoLLaVA-8K: Scaling Remote-Sensing Multimodal Large Language Models to 8K ResolutionFengxiang Wang, Mingshuo Chen, Yueying Li et al.
  61. Environment Inference for Learning Generalizable Dynamical SystemShixuan Liu, Yue He, Haotian Wang et al.
  62. Abstract Rendering: Certified Rendering Under 3D Semantic UncertaintyChenxi Ji, Yangge Li, Xiangru Zhong et al.
  63. Inference-Time Reward Hacking in Large Language ModelsHadi Khalaf, Claudio Mayrink Verdun, Alex Oesterling et al.
  64. High-Performance Arithmetic Circuit Optimization via Differentiable Architecture SearchXilin Xia, Jie Wang, Wanbo Zhang et al.
  65. ROOT: Rethinking Offline Optimization as Distributional Translation via Probabilistic BridgeManh Cuong Dao, The Hung Tran, Phi Le Nguyen et al.
  66. Go With the Flow: Fast Diffusion for Gaussian Mixture ModelsGeorge Rapakoulias, Ali Reza Pedram, Fengjiao Liu et al.
  67. SHF: Symmetrical Hierarchical Forest with Pretrained Vision Transformer Encoder for High-Resolution Medical SegmentationEnzhi Zhang, Peng Chen, Rui Zhong et al.
  68. ProxySPEX: Inference-Efficient Interpretability via Sparse Feature Interactions in LLMsLandon Butler, Abhineet Agarwal, Justin Singh Kang et al.
  69. Fair Cooperation in Mixed-Motive Games via Conflict-Aware Gradient AdjustmentWoojun Kim, Katia P. Sycara
  70. OpenWorldSAM: Extending SAM2 for Universal Image Segmentation with Language PromptsShiting Xiao, Rishabh Kabra, Yuhang Li et al.
  71. Broken Tokens? Your Language Model can Secretly Handle Non-Canonical TokenizationsBrian Siyuan Zheng, Alisa Liu, Orevaoghene Ahia et al.
  72. Hybrid-Balance GFlowNet for Solving Vehicle Routing ProblemsNi Zhang, Zhiguang Cao
  73. Feedback-Aware MCTS for Goal-Oriented Information SeekingHarshita Chopra, Chirag Shah
  74. Self-Supervised Learning of Motion Concepts by Optimizing CounterfactualsStefan Stojanov, David Wendt, Seungwoo Kim et al.
  75. Uncertain Knowledge Graph Completion via Semi-Supervised Confidence Distribution LearningTianxing Wu, Shutong Zhu, Jingting Wang et al.
  76. OCTDiff: Bridged Diffusion Model for Portable OCT Super-Resolution and EnhancementYe Tian, Angela McCarthy, Gabriel Gomide et al.
  77. Bits Leaked per Query: Information-Theoretic Bounds for Adversarial Attacks on LLMsMasahiro Kaneko, Timothy Baldwin
  78. Characterizing control between interacting subsystems with deep Jacobian estimationAdam Joseph Eisen, Mitchell Ostrow, Sarthak Chandra et al.
  79. Sharper Convergence Rates for Nonconvex Optimisation via Reduction MappingsEvan Markou, Thalaiyasingam Ajanthan, Stephen Gould
  80. Selective Omniprediction and Fair AbstentionSílvia Casacuberta, Varun Kanade
  81. Algorithms and SQ Lower Bounds for Robustly Learning Real-valued Multi-Index ModelsIlias Diakonikolas, Giannis Iakovidis, Daniel Kane et al.
  82. A Principled Approach to Randomized Selection under Uncertainty: Applications to Peer Review and Grant FundingAlexander Koujianos Goldberg, Giulia Fanti, Nihar B Shah
  83. Error Forcing in Recurrent Neural NetworksA Erdem Sağtekin, Colin Bredenberg, Cristina Savin
  84. Aligning Text-to-Image Diffusion Models to Human Preference by ClassificationLongquan Dai, Xiaolu Wei, He Wang et al.
  85. Sketched Gaussian Mechanism for Private Federated LearningQiaobo Li, Zhijie Chen, Arindam Banerjee
  86. Joint‑Embedding vs Reconstruction: Provable Benefits of Latent Space Prediction for Self‑Supervised LearningHugues Van Assel, Mark Ibrahim, Tommaso Biancalani et al.
  87. Accelerating data-driven algorithm selection for combinatorial partitioning problemsVaggos Chatziafratis, Ishani Karmarkar, Yingxi Li et al.
  88. Purifying Shampoo: Investigating Shampoo's Heuristics by Decomposing its PreconditionerRuna Eschenhagen, Aaron Defazio, Tsung-Hsien Lee et al.
  89. Replicable Distribution TestingIlias Diakonikolas, Jingyi Gao, Daniel Kane et al.
  90. FAPEX: Fractional Amplitude-Phase Expressor for Robust Cross-Subject Seizure PredictionRuizhe Zheng, Lingyan Mao, DINGDING HAN et al.
  91. Causality Meets Locality: Provably Generalizable and Scalable Policy Learning for Networked SystemsHao Liang, Shuqing Shi, Yudi Zhang et al.
  92. Conformal Mixed-Integer Constraint Learning with Feasibility GuaranteesDaniel Ovalle, Lorenz T. Biegler, Ignacio E Grossmann et al.
  93. Why Do Some Language Models Fake Alignment While Others Don't?Abhay Sheshadri, John Hughes, Julian Michael et al.
  94. ⁠When Data Can't Meet: Estimating Correlation Across Privacy BarriersAbhinav Chakraborty, Arnab Auddy, T. Tony Cai
  95. TRIDENT: Tri-Modal Molecular Representation Learning with Taxonomic Annotations and Local CorrespondenceFeng Jiang, Mangal Prakash, Hehuan Ma et al.
  96. Deep Value Benchmark: Measuring Whether Models Generalize Deep Values or Shallow PreferencesJoshua Ashkinaze, Hua Shen, Sai Avula et al.
  97. Return of ChebNet: Understanding and Improving an Overlooked GNN on Long Range TasksAli Hariri, Alvaro Arroyo, Alessio Gravina et al.
  98. Preconditioned Langevin Dynamics with Score-based Generative Models for Infinite-Dimensional Linear Bayesian Inverse ProblemsLorenzo Baldassari, Josselin Garnier, Knut Solna et al.
  99. Transferring Linear Features Across Language Models With Model StitchingAlan Chen, Jack Merullo, Alessandro Stolfo et al.
  100. Causal Differentiating Concepts: Interpreting LM Behavior via Causal Representation LearningNavita Goyal, Hal Daumé III, Alexandre Drouin et al.
  101. Ambient Proteins - Training Diffusion Models on Noisy StructuresGiannis Daras, Jeffrey Ouyang-Zhang, Krithika Ravishankar et al.
  102. On Universality Classes of Equivariant NetworksMarco Pacini, Gabriele Santin, Bruno Lepri et al.
  103. Guarantees for Alternating Least Squares in Overparameterized Tensor DecompositionsDionysis Arvanitakis, Vaidehi Srinivas, Aravindan Vijayaraghavan
  104. Checklists Are Better Than Reward Models For Aligning Language ModelsVijay Viswanathan, Yanchao Sun, Xiang Kong et al.
  105. Blackbox Model Provenance via Palimpsestic Membership InferenceRohith Kuditipudi, Jing Huang, Sally Zhu et al.
  106. Scaling can lead to compositional generalizationFlorian Redhardt, Yassir Akram, Simon Schug
  107. Prismatic Synthesis: Gradient-based Data Diversification Boosts Generalization in LLM ReasoningJaehun Jung, Seungju Han, Ximing Lu et al.
  108. AnaCP: Toward Upper-Bound Continual Learning via Analytic Contrastive ProjectionSaleh Momeni, Changnan Xiao, Bing Liu
  109. Flow Density Control: Generative Optimization Beyond Entropy-Regularized Fine-TuningRiccardo De Santi, Marin Vlastelica, Ya-Ping Hsieh et al.
  110. What Expressivity Theory Misses: Message Passing Complexity for GNNsNiklas Kemper, Tom Wollschläger, Stephan Günnemann
  111. Ambient Diffusion Omni: Training Good Models with Bad DataGiannis Daras, Adrian Rodriguez-Munoz, Adam Klivans et al.
  112. UMA: A Family of Universal Models for AtomsBrandon M Wood, Misko Dzamba, Xiang Fu et al.
  113. The Best Instruction-Tuning Data are Those That FitDylan Zhang, Qirun Dai, Hao Peng
  114. Forecasting in Offline Reinforcement Learning for Non-stationary EnvironmentsSuzan Ece Ada, Georg Martius, Emre Ugur et al.
  115. Purifying Approximate Differential Privacy with Randomized Post-processingYingyu Lin, Erchi Wang, Yian Ma et al.
  116. Trust Region Constrained Measure Transport in Path Space for Stochastic Optimal Control and InferenceDenis Blessing, Julius Berner, Lorenz Richter et al.
  117. How Well Can Differential Privacy Be Audited in One Run?Amit Keinan, Moshe Shenfeld, Katrina Ligett
  118. Counteractive RL: Rethinking Core Principles for Efficient and Scalable Deep Reinforcement LearningEzgi Korkmaz
  119. Is Noise Conditioning Necessary? A Unified Theory of Unconditional Graph Diffusion ModelsJipeng Li, Yanning Shen
  120. An Evidence-Based Post-Hoc Adjustment Framework for Anomaly Detection Under Data ContaminationSukanya Patra, Souhaib Ben Taieb
  121. SHAP values via sparse Fourier representationAli Gorji, Andisheh Amrollahi, Andreas Krause
  122. Quantum Doubly Stochastic TransformersJannis Born, Filip Skogh, Kahn Rhrissorrakrai et al.
  123. Reverse Engineering Human Preferences with Reinforcement LearningLisa Alazraki, Yi-Chern Tan, Jon Ander Campos et al.
  124. Efficient Fairness-Performance Pareto Front ComputationMark Kozdoba, Binyamin Perets, Shie Mannor
  125. Curl Descent : Non-Gradient Learning Dynamics with Sign-Diverse PlasticityHugo Ninou, Jonathan Kadmon, N Alex Cayco Gajic
  126. ElliCE: Efficient and Provably Robust Algorithmic Recourse via the Rashomon SetsBohdan Turbal, Iryna Voitsitska, Lesia Semenova
  127. Head Pursuit: Probing Attention Specialization in Multimodal TransformersLorenzo Basile, Valentino Maiorca, Diego Doimo et al.
  128. Towards a Golden Classifier-Free Guidance Path via Foresight Fixed Point IterationsKaibo Wang, Jianda Mao, Tong Wu et al.
  129. Credal Prediction based on Relative LikelihoodTimo Löhr, Paul Hofman, Felix Mohr et al.
  130. The Power of Iterative Filtering for Supervised Learning with (Heavy) ContaminationAdam Klivans, Konstantinos Stavropoulos, Kevin Tian et al.
  131. Light-Weight Diffusion Multiplier and Uncertainty Quantification for Fourier Neural OperatorsAlbert Matveev, Sanmitra Ghosh, Aamal Hussain et al.
  132. Discrete Spatial Diffusion: Intensity-Preserving Diffusion ModelingJavier E. Santos, Agnese Marcato, Roman Colman et al.
  133. CTRL-ALT-DECEIT Sabotage Evaluations for Automated AI R&DFrancis Rhys Ward, Teun van der Weij, Hanna Gábor et al.
  134. An Analytical Theory of Spectral Bias in the Learning Dynamics of Diffusion ModelsBinxu Wang, Cengiz Pehlevan
  135. DeepHalo: A Neural Choice Model with Controllable Context EffectsShuhan Zhang, Zhi Wang, Rui Gao et al.
  136. Multi-Agent Learning under Uncertainty: Recurrence vs. ConcentrationKyriakos Lotidis, Panayotis Mertikopoulos, Nicholas Bambos et al.
  137. Quantum speedup of non-linear Monte Carlo problemsJose Blanchet, Yassine Hamoudi, Mario Szegedy et al.
  138. Fine-grained List-wise Alignment for Generative Medication RecommendationChenxiao Fan, Chongming Gao, Wentao Shi et al.
  139. Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth ApproachJonas Geiping, Sean Michael McLeish, Neel Jain et al.
  140. Diffusion-Based Hierarchical Graph Neural Networks for Simulating Nonlinear Solid MechanicsTobias Würth, Niklas Freymuth, Gerhard Neumann et al.
  141. Breaking the Batch Barrier (B3) of Contrastive Learning via Smart Batch MiningRaghuveer Thirukovalluru, Rui Meng, Ye Liu et al.
  142. Dynamic Algorithm for Explainable $k$-medians Clustering under $\ell_p$ NormKonstantin Makarychev, Ilias Papanikolaou, Liren Shan
  143. Utility Engineering: Analyzing and Controlling Emergent Value Systems in AIsMantas Mazeika, Xuwang Yin, Rishub Tamirisa et al.
  144. Is the acquisition worth the cost? Surrogate losses for Consistent Two-stage ClassifiersFlorence Regol, Joseph Cotnareanu, Theodore Glavas et al.
  145. SageAttention3: Microscaling FP4 Attention for Inference and An Exploration of 8-Bit TrainingJintao Zhang, Jia wei, Haoxu Wang et al.
  146. Eluder dimension: localise it!Alireza Bakhtiari, Alex Ayoub, Samuel McLaughlin Robertson et al.
  147. Communication-Efficient Language Model Training Scales Reliably and Robustly: Scaling Laws for DiLoCoZachary Charles, Gabriel Teston, Lucio M. Dery et al.
  148. FlashMD: long-stride, universal prediction of molecular dynamicsFilippo Bigi, Sanggyu Chong, Agustinus Kristiadi et al.
  149. Not All Data are Good Labels: On the Self-supervised Labeling for Time Series ForecastingYuxuan Yang, Dalin Zhang, Yuxuan Liang et al.
  150. 3D Equivariant Visuomotor Policy Learning via Spherical ProjectionBoce Hu, Dian Wang, David Klee et al.
  151. Predictable Scale (Part II) --- Farseer: A Refined Scaling Law in LLMsHouyi Li, Wenzhen Zheng, Qiufeng Wang et al.
  152. Adaptive Prediction-Powered AutoEval with Reliability and Efficiency GuaranteesSangwoo Park, Matteo Zecchin, Osvaldo Simeone
  153. Ridge Boosting is Both Robust and EfficientDavid Bruns-Smith, Zhongming Xie, Avi Feller
  154. A Unifying View of Linear Function Approximation in Off-Policy RL Through Matrix Splitting and PreconditioningZechen Wu, Amy Greenwald, Ronald Parr
  155. Generalizable Reasoning through Compositional Energy MinimizationAlexandru Oarga, Yilun Du
  156. Universal Sequence PreconditioningAnnie Marsden, Elad Hazan
  157. Enigmata: Scaling Logical Reasoning in Large Language Models with Synthetic Verifiable PuzzlesJiangjie Chen, Qianyu He, Siyu Yuan et al.
  158. Memory-Enhanced Neural Solvers for Routing ProblemsFelix Chalumeau, Refiloe Shabe, Noah De Nicola et al.
  159. Uni-MuMER: Unified Multi-Task Fine-Tuning of Vision-Language Model for Handwritten Mathematical Expression RecognitionYu Li, Jin Jiang, Jianhua Zhu et al.
  160. Two Heads are Better than One: Simulating Large Transformers with Small OnesHantao Yu, Josh Alman
  161. Gaze Beyond the Frame: Forecasting Egocentric 3D Visual SpanHeeseung Yun, Joonil Na, Jaeyeon Kim et al.
  162. Unifying Proportional Fairness in Centroid and Non-Centroid ClusteringBenjamin Cookson, Nisarg Shah, Ziqi Yu
  163. ARIA: Training Language Agents with Intention-driven Reward AggregationRuihan Yang, Yikai Zhang, Aili Chen et al.
  164. Reasoning Planning for Language ModelsBao Nguyen, Hieu Trung Nguyen, Ruifeng She et al.
  165. When Less Language is More: Language-Reasoning Disentanglement Makes LLMs Better Multilingual ReasonersWeixiang Zhao, Jiahe Guo, Yang Deng et al.
  166. EF-3DGS: Event-Aided Free-Trajectory 3D Gaussian SplattingBohao Liao, Wei Zhai, Zengyu Wan et al.
  167. Beyond Scalar Rewards: An Axiomatic Framework for Lexicographic MDPsMehran Shakerinava, Siamak Ravanbakhsh, Adam Oberman
  168. Compress to Impress: Efficient LLM Adaptation Using a Single Gradient Step on 100 SamplesShiva Sreeram, Alaa Maalouf, Pratyusha Sharma et al.
  169. Understanding Prompt Tuning and In-Context Learning via Meta-LearningTim Genewein, Li Kevin Wenliang, Jordi Grau-Moya et al.
  170. Error Broadcast and Decorrelation as a Potential Artificial and Natural Learning MechanismMete Erdogan, Cengiz Pehlevan, Alper Tunga Erdogan
  171. On the Expressive Power of Mixture-of-Experts for Structured Complex TasksMingze Wang, Weinan E
  172. TokenSwap: A Lightweight Method to Disrupt Memorized Sequences in LLMsParjanya Prajakta Prashant, Kaustubh Ponkshe, Babak Salimi
  173. Streaming Attention Approximation via Discrepancy TheoryEkaterina Kochetkova, Kshiteej Sheth, Insu Han et al.
  174. SegMASt3R: Geometry Grounded Segment MatchingRohit Jayanti, Swayam Agrawal, Vansh Garg et al.
  175. Among Us: A Sandbox for Measuring and Detecting Agentic DeceptionSatvik Golechha, Adrià Garriga-Alonso
  176. AutoToM: Scaling Model-based Mental Inference via Automated Agent ModelingZhining Zhang, Chuanyang Jin, Mung Yao Jia et al.
  177. Towards Interpretable and Efficient Attention: Compressing All by Contracting a FewQishuai Wen, Zhiyuan Huang, Chun-Guang Li
  178. EvoBrain: Dynamic Multi-Channel EEG Graph Modeling for Time-Evolving Brain NetworksRikuto Kotoge, Zheng Chen, Tasuku Kimura et al.
  179. Product Distribution Learning with Imperfect AdviceArnab Bhattacharyya, Davin Choo, Philips George John et al.
  180. RoboScape: Physics-informed Embodied World ModelYu Shang, Xin Zhang, Yinzhou Tang et al.
  181. InstructHOI: Context-Aware Instruction for Multi-Modal Reasoning in Human-Object Interaction DetectionJinguo Luo, Weihong Ren, Quanlong Zheng et al.
  182. ARM: Adaptive Reasoning ModelSiye Wu, Jian Xie, Yikai Zhang et al.
  183. Computational Efficiency under Covariate Shift in Kernel Ridge RegressionAndrea Della Vecchia, Arnaud Mavakala Watusadisi, Ernesto De Vito et al.
  184. Self-Assembling Graph PerceptronsJialong Chen, Tong Wang, Bowen Deng et al.
  185. Scaling and context steer LLMs along the same computational path as the human brainJoséphine Raugel, Jérémy Rapin, Stéphane d'Ascoli et al.
  186. InfiFPO: Implicit Model Fusion via Preference Optimization in Large Language ModelsYanggan Gu, Yuanyi Wang, Zhaoyi Yan et al.
  187. SViMo: Synchronized Diffusion for Video and Motion Generation in Hand-object Interaction ScenariosLingwei Dang, Ruizhi Shao, Hongwen Zhang et al.
  188. HyPINO: Multi-Physics Neural Operators via HyperPINNs and the Method of Manufactured SolutionsRafael Bischof, Michal Piovarci, Michael Anton Kraus et al.
  189. RidgeLoRA: Matrix Ridge Enhanced Low-Rank Adaptation of Large Language ModelsJunda Zhu, Jun Ai, Yujun Li et al.
  190. Think or Not? Exploring Thinking Efficiency in Large Reasoning Models via an Information-Theoretic LensXixian Yong, Xiao Zhou, Yingying Zhang et al.
  191. Hyperbolic Fine-Tuning for Large Language ModelsMenglin Yang, Ram Samarth B B, Aosong Feng et al.
  192. Deep Continuous-Time State-Space Models for Marked Event SequencesYuxin Chang, Alex James Boyd, Cao Xiao et al.
  193. HBLLM: Wavelet-Enhanced High-Fidelity 1-Bit Quantization for LLMsNingning CHEN, Weicai Ye, Ying Jiang
  194. Which Algorithms Have Tight Generalization Bounds?Michael Gastpar, Ido Nachum, Jonathan Shafer et al.
  195. Axial Neural Networks for Dimension-Free Foundation ModelsHyunsu Kim, Jonggeon Park, Joan Bruna et al.
  196. Horizon Reduction Makes RL ScalableSeohong Park, Kevin Frans, Deepinder Mann et al.
  197. OpenBox: Annotate Any Bounding Boxes in 3DIn-Jae Lee, Mungyeom Kim, Kwonyoung Ryu et al.
  198. SGCD: Stain-Guided CycleDiffusion for Unsupervised Domain Adaptation of Histopathology Image ClassificationHsi-Ling Chen, Chun-Shien Lu, Pau-Choo Chung
  199. FFN Fusion: Rethinking Sequential Computation in Large Language ModelsAkhiad Bercovich, Mohammed Dabbah, Omri Puny et al.
  200. Distilling LLM Agent into Small Models with Retrieval and Code ToolsMinki Kang, Jongwon Jeong, Seanie Lee et al.
  201. Understanding Parametric and Contextual Knowledge Reconciliation within Large Language ModelsJun Zhao, Yongzhuo Yang, Xiang Hu et al.
  202. Differentiable Decision Tree via "ReLU+Argmin" ReformulationQiangqiang Mao, Jiayang Ren, Yixiu Wang et al.
  203. SafeVLA: Towards Safety Alignment of Vision-Language-Action Model via Constrained LearningBorong Zhang, Yuhao Zhang, Jiaming Ji et al.
  204. 3D Interaction Geometric Pre-training for Molecular Relational LearningNamkyeong Lee, Yunhak Oh, Heewoong Noh et al.
  205. Improved Bounds for Swap Multicalibration and Swap OmnipredictionHaipeng Luo, Spandan Senapati, Vatsal Sharan
  206. UniteFormer: Unifying Node and Edge Modalities in Transformers for Vehicle Routing ProblemsDian Meng, Zhiguang Cao, Jie Gao et al.
  207. Simultaneous Swap Regret Minimization via KL-CalibrationHaipeng Luo, Spandan Senapati, Vatsal Sharan
  208. Wide-Horizon Thinking and Simulation-Based Evaluation for Real-World LLM Planning with Multifaceted ConstraintsDongjie Yang, Chengqiang Lu, Qimeng Wang et al.
  209. Does Object Binding Naturally Emerge in Large Pretrained Vision Transformers?Yihao Li, Saeed Salehi, Lyle Ungar et al.
  210. Probing Neural Combinatorial Optimization ModelsZhiqin Zhang, Yining Ma, Zhiguang Cao et al.
  211. A Principled Path to Fitted Distributional EvaluationSungee Hong, Jiayi Wang, Zhengling Qi et al.
  212. Improving LLM General Preference Alignment via Optimistic Online Mirror DescentYuheng Zhang, Dian Yu, Tao Ge et al.
  213. Progressive Inference-Time Annealing of Diffusion Models for Sampling from Boltzmann DensitiesTara Akhound-Sadegh, Jungyoon Lee, Joey Bose et al.
  214. Compositional Monte Carlo Tree Diffusion for Extendable PlanningJaesik Yoon, Hyeonseo Cho, Sungjin Ahn
  215. Fast Monte Carlo Tree Diffusion: 100× Speedup via Parallel and Sparse PlanningJaesik Yoon, Hyeonseo Cho, Yoshua Bengio et al.
  216. Zero-shot Denoising via Neural Compression: Theoretical and algorithmic frameworkAli Zafari, Xi Chen, Shirin Jalali
  217. Gradient-Variation Online Adaptivity for Accelerated Optimization with Hölder SmoothnessYuheng Zhao, Yu-Hu Yan, Kfir Yehuda Levy et al.
  218. A Smooth Sea Never Made a Skilled SAILOR: Robust Imitation via Learning to SearchArnav Kumar Jain, Vibhakar Mohta, Subin Kim et al.
  219. MAESTRO : Adaptive Sparse Attention and Robust Learning for Multimodal Dynamic Time SeriesPayal Mohapatra, Yueyuan Sui, Akash Pandey et al.
  220. Ctrl-DNA: Controllable Cell-Type-Specific Regulatory DNA Design via Constrained RLXingyu Chen, Shihao Ma, Runsheng Lin et al.
  221. On the Universal Near Optimality of Hedge in Combinatorial SettingsZhiyuan Fan, Arnab Maiti, Lillian J. Ratliff et al.
  222. Transfer Faster, Price Smarter: Minimax Dynamic Pricing under Cross-Market Preference ShiftYi Zhang, Elynn Chen, Yujun Yan
  223. Transformer brain encoders explain human high-level visual responsesHossein Adeli, Minni Sun, Nikolaus Kriegeskorte
  224. Fast and Fluent Diffusion Language Models via Convolutional Decoding and Rejective Fine-tuningYeongbin Seo, Dongha Lee, Jaehyung Kim et al.
  225. MoBA: Mixture of Block Attention for Long-Context LLMsEnzhe Lu, Zhejun Jiang, Jingyuan Liu et al.
  226. DERD-Net: Learning Depth from Event-based Ray DensitiesDiego de Oliveira Hitzges, Suman Ghosh, Guillermo Gallego
  227. Beyond Expectations: Quantile-Guided Alignment for Risk-Calibrated Language ModelsXinran Wang, Jin Du, Azal Ahmad Khan et al.
  228. VPO: Reasoning Preferences Optimization Based on $\mathcal{V}$-Usable InformationZecheng Wang, Chunshan Li, Yupeng Zhang et al.
  229. Stable Minima of ReLU Neural Networks Suffer from the Curse of Dimensionality: The Neural Shattering PhenomenonTongtong Liang, Dan Qiao, Yu-Xiang Wang et al.
  230. Fisher meets Feynman: score-based variational inference with a product of expertsDiana Cai, Robert M. Gower, David Blei et al.
  231. Mitigating the Privacy–Utility Trade-off in Decentralized Federated Learning via f-Differential PrivacyXiang Li, Chendi Wang, Buxin Su et al.
  232. Mitigating Instability in High Residual Adaptive Sampling for PINNs via Langevin DynamicsMinseok Jeong, Giup Seo, Euiseok Hwang
  233. Spectral Estimation with Free DecompressionSiavash Ameli, Chris van der Heide, Liam Hodgkinson et al.
  234. CAR-Flow: Condition-Aware Reparameterization Aligns Source and Target for Better Flow MatchingChen Chen, Pengsheng Guo, Liangchen Song et al.
  235. Training-Free Constrained Generation With Stable Diffusion ModelsStefano Zampini, Jacob K Christopher, Luca Oneto et al.
  236. Comparator-Adaptive $\Phi$-Regret: Improved Bounds, Simpler Algorithms, and Applications to GamesSoumita Hait, Ping Li, Haipeng Luo et al.
  237. X-Field: A Physically Informed Representation for 3D X-ray ReconstructionFeiran Wang, Jiachen Tao, Junyi Wu et al.
  238. Distillation Robustifies UnlearningBruce W. Lee, Addie Foote, Alex Infanger et al.
  239. SimWorld: An Open-ended Simulator for Agents in Physical and Social WorldsXiaokang Ye, Jiawei Ren, Yan Zhuang et al.
  240. Two‑Stage Learning of Stabilizing Neural Controllers via Zubov Sampling and Iterative Domain ExpansionHaoyu Li, Xiangru Zhong, Bin Hu et al.
  241. The Complexity of Symmetric Equilibria in Min-Max Optimization and Team Zero-Sum GamesIoannis Anagnostides, Ioannis Panageas, Tuomas Sandholm et al.
  242. On Traceability in $\ell_p$ Stochastic Convex OptimizationSasha Voitovych, Mahdi Haghifam, Idan Attias et al.
  243. Improved Representation Steering for Language ModelsZhengxuan Wu, Qinan Yu, Aryaman Arora et al.
  244. FlexOLMo: Open Language Models for Flexible Data UseWeijia Shi, Akshita Bhagia, Kevin Farhat et al.
  245. The Fragile Truth of Saliency: Improving LLM Input Attribution via Attention Bias OptimizationYihua Zhang, Changsheng Wang, Yiwei Chen et al.
  246. Enhancing Training Data Attribution with Representational OptimizationWeiwei Sun, Haokun Liu, Nikhil Kandpal et al.
  247. DisMo: Disentangled Motion Representations for Open-World Motion TransferThomas Ressler-Antal, Frank Fundel, Malek Ben Alaya et al.
  248. Rig3R: Rig-Aware Conditioning and Discovery for 3D ReconstructionSamuel Li, Pujith Kachana, Prajwal Chidananda et al.
  249. Cycle-Sync: Robust Global Camera Pose Estimation through Enhanced Cycle-Consistent SynchronizationShaohan Li, Yunpeng Shi, Gilad Lerman
  250. Dense Associative Memory with Epanechnikov EnergyBenjamin Hoover, Zhaoyang Shi, Krishna Balasubramanian et al.
  251. Searching Latent Program SpacesMatthew Macfarlane, Clément Bonnet
  252. Convergence Rates of Constrained Expected ImprovementHaowei Wang, Jingyi Wang, Zhongxiang Dai et al.
  253. CoT Information: Improved Sample Complexity under Chain-of-Thought SupervisionAwni Altabaa, Omar Montasser, John Lafferty
  254. Unlocking hidden biomolecular conformational landscapes in diffusion models at inference timeDaniel D. Richman, Jessica Karaguesian, Carl-Mikael Suomivuori et al.
  255. QSVD: Efficient Low-rank Approximation for Unified Query-Key-Value Weight Compression in Low-Precision Vision-Language ModelsYutong Wang, Haiyu Wang, Sai Qian Zhang
  256. Caption This, Reason That: VLMs Caught in the MiddleZihan Weng, Lucas Gomez, Taylor Whittington Webb et al.
  257. Universal Causal Inference in a ToposSridhar Mahadevan
  258. Can We Infer Confidential Properties of Training Data from LLMs?Pengrun Huang, Chhavi Yadav, Kamalika Chaudhuri et al.
  259. Temperature is All You Need for Generalization in Langevin Dynamics and other Markov ProcessesItamar Harel, Yonathan Wolanowsky, Gal Vardi et al.
  260. Learning the Wrong Lessons: Syntactic-Domain Spurious Correlations in Language ModelsChantal Shaib, Vinith Menon Suriyakumar, Byron C Wallace et al.
  261. Corporate Needs You to Find the Difference: Revisiting Submodular and Supermodular Ratio Optimization ProblemsElfarouk Harb, Yousef Yassin, Chandra Chekuri
  262. Private Set Union with Multiple ContributionsTravis Dick, Haim Kaplan, Alex Kulesza et al.
  263. Clustering via Hedonic Games: New Concepts and AlgorithmsGergely Csáji, Alexander Gundert, Jörg Rothe et al.
  264. The Graphon Limit Hypothesis: Understanding Neural Network Pruning via Infinite Width AnalysisHoang Pham, The-Anh Ta, Tom Jacobs et al.
  265. Fast Training of Large Kernel Models with Delayed ProjectionsAmirhesam Abedsoltan, Siyuan Ma, Parthe Pandit et al.
  266. d1: Scaling Reasoning in Diffusion Large Language Models via Reinforcement LearningSiyan Zhao, Devaansh Gupta, Qinqing Zheng et al.
  267. Affine-Invariant Global Non-Asymptotic Convergence Analysis of BFGS under Self-ConcordanceQiujiang Jin, Aryan Mokhtari
  268. Extrapolation by Association: Length Generalization Transfer In TransformersZiyang Cai, Nayoung Lee, Avi Schwarzschild et al.
  269. Optimal Neural Compressors for the Rate-Distortion-Perception TradeoffEric Lei, Hamed Hassani, Shirin Saeedi Bidokhti
  270. Bridging Symmetry and Robustness: On the Role of Equivariance in Enhancing Adversarial RobustnessLongwei Wang, Ifrat Ikhtear Uddin, KC Santosh et al.
  271. Color Conditional Generation with Sliced Wasserstein GuidanceAlexander Lobashev, Maria Larchenko, Dmitry Guskov
  272. Private Hyperparameter Tuning with Ex-Post GuaranteeBadih Ghazi, Pritish Kamath, Alexander Knop et al.
  273. A Implies B: Circuit Analysis in LLMs for Propositional Logical ReasoningGuan Zhe Hong, Nishanth Dikkala, Enming Luo et al.
  274. Optimal and Provable Calibration in High-Dimensional Binary Classification: Angular Calibration and Platt ScalingYufan Li, Pragya Sur
  275. Reconstruction and Secrecy under Approximate Distance QueriesShay Moran, Elizaveta Nesterova
  276. Win Fast or Lose Slow: Balancing Speed and Accuracy in Latency-Sensitive Decisions of LLMsHao Kang, Qingru Zhang, Han Cai et al.
  277. Characterizing the Expressivity of Fixed-Precision Transformer Language ModelsJiaoda Li, Ryan Cotterell
  278. Distributional Training Data Attribution: What do Influence Functions Sample?Bruno Kacper Mlodozeniec, Isaac Reid, Samuel Power et al.
  279. Hogwild! Inference: Parallel LLM Generation via Concurrent AttentionGleb Rodionov, Roman Garipov, Alina Shutova et al.
  280. Mind-the-Glitch: Visual Correspondence for Detecting Inconsistencies in Subject-Driven GenerationAbdelrahman Eldesokey, Aleksandar Cvejić, Bernard Ghanem et al.
  281. The Non-Linear Representation Dilemma: Is Causal Abstraction Enough for Mechanistic Interpretability?Denis Sutter, Julian Minder, Thomas Hofmann et al.
  282. Gaussian Herding across Pens: An Optimal Transport Perspective on Global Gaussian Reduction for 3DGSTao Wang, Mengyu Li, Geduo Zeng et al.
  283. Generalized Top-k Mallows Model for Ranked ChoicesShahrzad Haddadan, Sara Ahmadian
  284. Improving Bilinear RNN with Closed-loop ControlJiaxi Hu, Yongqi Pan, Jusen Du et al.
  285. Spatial-MLLM: Boosting MLLM Capabilities in Visual-based Spatial IntelligenceDiankun Wu, Fangfu Liu, Yi-Hsin Hung et al.
  286. SANSA: Unleashing the Hidden Semantics in SAM2 for Few-Shot SegmentationClaudia Cuttano, Gabriele Trivigno, Giuseppe Averta et al.
  287. Cost-Aware Contrastive Routing for LLMsReza Shirkavand, Shangqian Gao, Peiran Yu et al.
  288. Is Grokking a Computational Glass Relaxation?Xiaotian Zhang, Yue Shang, Entao Yang et al.
  289. LoRATv2: Enabling Low-Cost Temporal Modeling in One-Stream TrackersLiting Lin, Heng Fan, Zhipeng Zhang et al.
  290. On the necessity of adaptive regularisation: Optimal anytime online learning on $\boldsymbol{\ell_p}$-ballsEmmeran Johnson, David Martínez-Rubio, Ciara Pike-Burke et al.
  291. Controlling Thinking Speed in Reasoning ModelsZhengkai Lin, Zhihang Fu, Ze Chen et al.
  292. Vector Quantization in the Brain: Grid-like Codes in World ModelsXiangyuan Peng, Xingsi Dong, Si Wu
  293. IA-GGAD: Zero-shot Generalist Graph Anomaly Detection via Invariant and Affinity LearningXiong Zhang, Zhenli He, Changlong Fu et al.
  294. Revisiting Generative Infrared and Visible Image Fusion Based on Human Cognitive LawsLin Guo, Xiaoqing Luo, Wei Xie et al.
  295. MonoLift: Learning 3D Manipulation Policies from Monocular RGB via DistillationZiru Wang, Mengmeng Wang, Guang Dai et al.
  296. SoFar: Language-Grounded Orientation Bridges Spatial Reasoning and Object ManipulationZekun Qi, Wenyao Zhang, Yufei Ding et al.
  297. Conditional Representation Learning for Customized TasksHonglin Liu, Chao Sun, Peng Hu et al.
  298. Angular Steering: Behavior Control via Rotation in Activation SpaceHieu M. Vu, Tan Minh Nguyen
  299. COOPERA: Continual Open-Ended Human-Robot AssistanceChenyang Ma, Kai Lu, Ruta Desai et al.
  300. Joint Hierarchical Representation Learning of Samples and Features via Informed Tree-Wasserstein DistanceYa-Wei Eileen Lin, Ronald R. Coifman, Gal Mishne et al.
  301. Detecting Generated Images by Fitting Natural Image DistributionsYonggang Zhang, Jun Nie, Xinmei Tian et al.
  302. Agnostic Learning under Targeted Poisoning: Optimal Rates and the Role of RandomnessBogdan Chornomaz, Yonatan Koren, Shay Moran et al.
  303. ORIGAMISPACE: Benchmarking Multimodal LLMs in Multi-Step Spatial Reasoning with Mathematical ConstraintsRui Xu, Dakuan Lu, Zicheng Zhao et al.
  304. Establishing Linear Surrogate Regret Bounds for Convex Smooth Losses via Convolutional Fenchel–Young LossesYuzhou Cao, Han Bao, Lei Feng et al.
  305. Co-Reinforcement Learning for Unified Multimodal Understanding and GenerationJingjing Jiang, Chongjie Si, Jun Luo et al.
  306. Structured Linear CDEs: Maximally Expressive and Parallel-in-Time Sequence ModelsBenjamin Walker, Lingyi Yang, Nicola Muca Cirone et al.
  307. Vgent: Graph-based Retrieval-Reasoning-Augmented Generation For Long Video UnderstandingXiaoqian Shen, Wenxuan Zhang, Jun Chen et al.
  308. Privacy amplification by random allocationMoshe Shenfeld, Vitaly Feldman
  309. Tackling Biased Evaluators in Dueling BanditsMing Tang, Yuxuan Zhou, Chao Huang
  310. Advanced Sign Language Video Generation with Compressed and Quantized Multi-Condition TokenizationCong Wang, Zexuan Deng, Zhiwei Jiang et al.
  311. Transstratal Adversarial Attack: Compromising Multi-Layered Defenses in Text-to-Image ModelsChunlong Xie, Kangjie Chen, Shangwei Guo et al.
  312. SORTeD Rashomon Sets of Sparse Decision Trees: Anytime EnumerationElif Arslan, Jacobus G. M. van der Linden, Serge Hoogendoorn et al.
  313. TGA: True-to-Geometry Avatar Dynamic ReconstructionBo Guo, Sijia Wen, Ziwei Wang et al.
  314. Neighbor-aware Contrastive Disambiguation for Cross-Modal Hashing with Redundant AnnotationsChao Su, Likang Peng, Yuan Sun et al.
  315. Minimax Adaptive Online Nonparametric Regression over Besov spacesPaul Liautaud, Pierre Gaillard, Olivier Wintenberger
  316. UniSite: The First Cross-Structure Dataset and Learning Framework for End-to-End Ligand Binding Site DetectionJigang Fan, QuanLin Wu, Shengjie Luo et al.
  317. URDF-Anything: Constructing Articulated Objects with 3D Multimodal Language ModelZhe Li, Xiang Bai, Jieyu Zhang et al.
  318. L2DGCN: Learnable Enhancement and Label Selection Dynamic Graph Convolutional Networks for Mitigating Degree Biasjingxiao zhang, Shifei Ding, Jian Zhang et al.
  319. Memo: Training Memory-Efficient Embodied Agents with Reinforcement LearningGunshi Gupta, Karmesh Yadav, Zsolt Kira et al.
  320. Achilles' Heel of Mamba: Essential difficulties of the Mamba architecture demonstrated by synthetic dataTianyi Chen, Pengxiao Lin, Zhiwei Wang et al.
  321. RepLDM: Reprogramming Pretrained Latent Diffusion Models for High-Quality, High-Efficiency, High-Resolution Image GenerationBoyuan Cao, Jiaxin Ye, Yujie Wei et al.
  322. Understanding LLM Behaviors via Compression: Data Generation, Knowledge Acquisition and Scaling LawsZhixuan Pan, Shaowen Wang, Liao Pengfei et al.
  323. Differentiable Hierarchical Visual TokenizationMarius Aasan, Martine Hjelkrem-Tan, Nico Catalano et al.
  324. Trajectory Graph Learning: Aligning with Long Trajectories in Reinforcement Learning Without Reward DesignYunfan Li, Eric Liu, Lin Yang
  325. Meta CLIP 2: A Worldwide Scaling RecipeYung-Sung Chuang, Yang Li, Dong Wang et al.
  326. Policy Compatible Skill Incremental Learning via Lazy Learning InterfaceDaehee Lee, Dongsu Lee, TaeYoon Kwack et al.
  327. Estimating cognitive biases with attention-aware inverse planningSounak Banerjee, Daphne Cornelisse, Deepak Edakkattil Gopinath et al.
  328. An Efficient Orlicz-Sobolev Approach for Transporting Unbalanced Measures on a GraphTam Le, Truyen Nguyen, Hideitsu Hino et al.
  329. DeepDiver: Adaptive Web-Search Intensity Scaling via Reinforcement LearningWenxuan Shi, Haochen Tan, Chuqiao Kuang et al.
  330. MetaGS: A Meta-Learned Gaussian-Phong Model for Out-of-Distribution 3D Scene RelightingYumeng He, Yunbo Wang
  331. Towards a Pairwise Ranking Model with Orderliness and Monotonicity for Label EnhancementYunan Lu, Xixi Zhang, Yaojin Lin et al.
  332. Spend Wisely: Maximizing Post-Training Gains in Iterative Synthetic Data BootstrappingPu Yang, Yunzhen Feng, Ziyuan Chen et al.
  333. Fast-Slow Thinking GRPO for Large Vision-Language Model ReasoningWenyi Xiao, Leilei Gan
  334. Exploration via Feature Perturbation in Contextual BanditsSeouh-won Yi, Min-hwan Oh
  335. Instance-Optimality for Private KL Distribution EstimationJiayuan Ye, Vitaly Feldman, Kunal Talwar
  336. DMWM: Dual-Mind World Model with Long-Term ImaginationLingyi Wang, Rashed Shelim, Walid Saad et al.
  337. TimeWak: Temporal Chained-Hashing Watermark for Time Series DataZhi Wen Soi, Chaoyi Zhu, Fouad Abiad et al.
  338. UFO: A Unified Approach to Fine-grained Visual Perception via Open-ended Language InterfaceHao Tang, Chen-Wei Xie, Haiyang Wang et al.
  339. DenseDPO: Fine-Grained Temporal Preference Optimization for Video Diffusion ModelsZiyi Wu, Anil Kag, Ivan Skorokhodov et al.
  340. Precise Asymptotics and Refined Regret of Variance-Aware UCBYingying Fan, Yuxuan Han, Jinchi Lv et al.
  341. InfMasking: Unleashing Synergistic Information by Contrastive Multimodal InteractionsLiangjian Wen, Qun Dai, Jianzhuang Liu et al.
  342. Extracting task-relevant preserved dynamics from contrastive aligned neural recordingsYiqi Jiang, Kaiwen Sheng, Yujia Gao et al.
  343. Orochi: Versatile Biomedical Image ProcessorGaole Dai, Chenghao Zhou, Yu Zhou et al.
  344. Conservative classifiers do consistently well with improving agents: characterizing statistical and online learningDravyansh Sharma, Alec Sun
  345. KORGym: A Dynamic Game Platform for LLM Reasoning EvaluationJiajun Shi, Jian Yang, Jiaheng Liu et al.
  346. Learnable Sampler Distillation for Discrete Diffusion ModelsFeiyang Fu, Tongxian Guo, Zhaoqiang Liu
  347. On the Hardness of Approximating Distributions with Tractable Probabilistic ModelsJohn Leland, YooJung Choi
  348. MoESD: Unveil Speculative Decoding's Potential for Accelerating Sparse MoEZongle Huang, Lei Zhu, ZongYuan Zhan et al.
  349. SoTA with Less: MCTS-Guided Sample Selection for Data-Efficient Visual Reasoning Self-ImprovementXiyao Wang, Zhengyuan Yang, Chao Feng et al.
  350. Deno-IF: Unsupervised Noisy Visible and Infrared Image Fusion MethodHan Xu, Yuyang Li, Yunfei Deng et al.
  351. ReCon: Region-Controllable Data Augmentation with Rectification and Alignment for Object DetectionHaowei Zhu, Tianxiang Pan, Rui Qin et al.
  352. Repurposing Marigold for Zero-Shot Metric Depth Estimation via Defocus Blur CuesChinmay Talegaonkar, Nikhil Gandudi Suresh, Zachary Novack et al.
  353. PARTONOMY: Large Multimodal Models with Part-Level Visual UnderstandingAnsel Blume, Jeonghwan Kim, Hyeonjeong Ha et al.
  354. Composite Flow Matching for Reinforcement Learning with Shifted-Dynamics DataLingkai Kong, Haichuan Wang, Tonghan Wang et al.
  355. Asymmetric Duos: Sidekicks Improve UncertaintyTim G. Zhou, Evan Shelhamer, Geoff Pleiss
  356. Robust learning of halfspaces under log-concave marginalsJane Lange, Arsen Vasilyan
  357. Implicit Bias of Spectral Descent and Muon on Multiclass Separable DataChen Fan, Mark Schmidt, Christos Thrampoulidis
  358. Lost in Transmission: When and Why LLMs Fail to Reason GloballyTobias Schnabel, Kiran Tomlinson, Adith Swaminathan et al.
  359. On Transferring Transferability: Towards a Theory for Size GeneralizationEitan Levin, Yuxin Ma, Mateo Diaz Diaz et al.
  360. When Worse is Better: Navigating the Compression Generation Trade-off In Visual TokenizationVivek Ramanujan, Kushal Tirumala, Armen Aghajanyan et al.
  361. FlowFeat: Pixel-Dense Embedding of Motion ProfilesNikita Araslanov, Anna Ribic, Daniel Cremers
  362. The Generative Leap: Tight Sample Complexity for Efficiently Learning Gaussian Multi-Index ModelsAlex Damian, Jason D. Lee, Joan Bruna
  363. Incremental Sequence Classification with Temporal ConsistencyLucas Maystre, Gabriel Barello, Tudor Berariu et al.
  364. LODGE: Level-of-Detail Large-Scale Gaussian Splatting with Efficient RenderingJonas Kulhanek, Marie-Julie Rakotosaona, Fabian Manhardt et al.
  365. Solving Neural Min-Max Games: The Role of Architecture, Initialization & DynamicsDeep Patel, Emmanouil-Vasileios Vlatakis-Gkaragkounis
  366. Provable Gradient Editing of Deep Neural NetworksZhe Tao, Aditya V. Thakur
  367. Audio Flamingo 3: Advancing Audio Intelligence with Fully Open Large Audio Language ModelsSreyan Ghosh, Arushi Goel, Jaehyeon Kim et al.
  368. RGB-Only Supervised Camera Parameter Optimization in Dynamic ScenesFang Li, Hao Zhang, Narendra Ahuja
  369. Integration Matters for Learning PDEs with Backward SDEsSungje Park, Stephen Tu
  370. Unleashing Hour-Scale Video Training for Long Video-Language UnderstandingJingyang Lin, Jialian Wu, Ximeng Sun et al.
  371. Neural EntropyAkhil Premkumar
  372. Locality in Image Diffusion Models Emerges from Data StatisticsArtem Lukoianov, Chenyang Yuan, Justin Solomon et al.
  373. Regularized least squares learning with heavy-tailed noise is minimax optimalMattes Mollenhauer, Nicole Mücke, Dimitri Meunier et al.
  374. On Feasible Rewards in Multi-Agent Inverse Reinforcement LearningTill Freihaut, Giorgia Ramponi
  375. MonarchAttention: Zero-Shot Conversion to Fast, Hardware-Aware Structured AttentionCan Yaras, Alec S Xu, Pierre Abillama et al.
  376. The Hawthorne Effect in Reasoning Models: Evaluating and Steering Test AwarenessSahar Abdelnabi, Ahmed Salem
  377. Measuring and Controlling Solution Degeneracy across Task-Trained Recurrent Neural NetworksAnn Huang, Satpreet Harcharan Singh, Flavio Martinelli et al.
  378. Reinforcement Learning with Imperfect Transition Predictions: A Bellman-Jensen ApproachChenbei Lu, Zaiwei Chen, Tongxin Li et al.
  379. AI Research Agents for Machine Learning: Search, Exploration, and Generalization in MLE-benchEdan Toledo, Karen Hambardzumyan, Martin Josifoski et al.
  380. Differentiable Cyclic Causal Discovery Under Unmeasured ConfoundersMuralikrishnna Guruswamy Sethuraman, Faramarz Fekri
  381. ELECTRA: A Cartesian Network for 3D Charge Density Prediction with Floating OrbitalsJonas Elsborg, Luca Thiede, Alan Aspuru-Guzik et al.
  382. Compositional Neural Network Verification via Assume-Guarantee ReasoningHai Duong, David Shriver, ThanhVu Nguyen et al.
  383. A machine learning approach that beats Rubik's cubesAlexander Chervov, Kirill Khoruzhii, Nikita Bukhal et al.
  384. ENMA: Tokenwise Autoregression for Continuous Neural PDE OperatorsArmand Kassaï Koupaï, Lise Le Boudec, Louis Serrano et al.
  385. Critical Batch Size Revisited: A Simple Empirical Approach to Large-Batch Language Model TrainingWilliam Merrill, Shane Arora, Dirk Groeneveld et al.
  386. Shift Before You Learn: Enabling Low-Rank Representations in Reinforcement LearningBastien Dubail, Stefan Stojanovic, Alexandre Proutiere
  387. Stochastic Optimization in Semi-Discrete Optimal Transport: Convergence Analysis and Minimax RateFerdinand Genans, Antoine Godichon-Baggioni, François-Xavier Vialard et al.
  388. Transferable Black-Box One-Shot Forging of Watermarks via Image Preference ModelsTomas Soucek, Sylvestre-Alvise Rebuffi, Pierre Fernandez et al.
  389. Non-Asymptotic Analysis Of Data Augmentation For Precision Matrix EstimationLucas Morisset, Adrien Hardy, Alain Oliviero Durmus
  390. Improving Perturbation-based Explanations by Understanding the Role of Uncertainty CalibrationThomas Decker, Volker Tresp, Florian Buettner
  391. ConTextTab: A Semantics-Aware Tabular In-Context LearnerMarco Spinaci, Marek Polewczyk, Maximilian Schambach et al.
  392. Some Optimizers are More Equal: Understanding the Role of Optimizers in Group FairnessMojtaba Kolahdouzi, Hatice Gunes, Ali Etemad
  393. Less is More: Improving LLM Alignment via Preference Data SelectionXun Deng, Han Zhong, Rui Ai et al.
  394. Stable Gradients for Stable Learning at Scale in Deep Reinforcement LearningRoger Creus Castanyer, Johan Obando-Ceron, Lu Li et al.
  395. SpecMER: Fast Protein Generation with K-mer Guided Speculative DecodingThomas Walton, Darin Tsui, Aryan Musharaf et al.
  396. SpecEdge: Scalable Edge-Assisted Serving Framework for Interactive LLMsJinwoo Park, Seunggeun Cho, Dongsu Han
  397. DEXTER: Diffusion-Guided EXplanations with TExtual Reasoning for Vision ModelsSimone Carnemolla, Matteo Pennisi, Sarinda Samarasinghe et al.
  398. What One Cannot, Two Can: Two-Layer Transformers Provably Represent Induction Heads on Any-Order Markov ChainsChanakya Ekbote, Ashok Vardhan Makkuva, Marco Bondaschi et al.
  399. Sample-Adaptivity Tradeoff in On-Demand SamplingNika Haghtalab, Omar Montasser, Mingda Qiao
  400. Online Strategic Classification With Noise and Partial FeedbackTianrun Zhao, Xiaojie Mao, Yong Liang
  401. Partition-Then-Adapt: Combating Prediction Bias for Reliable Multi-Modal Test-Time AdaptationGuowei Wang, Fan Lyu, Changxing Ding
  402. Strategic Hypothesis TestingYatong Chen, Safwan Hossain, Yiling Chen
  403. Accelerating Optimization via Differentiable Stopping TimeZhonglin Xie, Yiman Fong, Haoran Yuan et al.
  404. Tight Generalization Bounds for Large-Margin HalfspacesKasper Green Larsen, Natascha Schalburg
  405. Word-Level Emotional Expression Control in Zero-Shot Text-to-Speech SynthesisTianrui Wang, Haoyu Wang, Meng Ge et al.
  406. UMoE: Unifying Attention and FFN with Shared ExpertsYuanhang Yang, Chaozheng Wang, Jing Li
  407. RF-Agent: Automated Reward Function Design via Language Agent Tree SearchNing Gao, Xiuhui Zhang, Xingyu Jiang et al.
  408. GraLoRA: Granular Low-Rank Adaptation for Parameter-Efficient Fine-TuningYeonjoon Jung, Daehyun Ahn, Hyungjun Kim et al.
  409. Quantization-Free Autoregressive Action TransformerZiyad Sheebaelhamd, Michael Tschannen, Michael Muehlebach et al.
  410. LLM-Explorer: A Plug-in Reinforcement Learning Policy Exploration Enhancement Driven by Large Language ModelsQianyue Hao, Yiwen Song, Qingmin Liao et al.
  411. BayeSQP: Bayesian Optimization through Sequential Quadratic ProgrammingPaul Brunzema, Sebastian Trimpe
  412. Practical do-Shapley Explanations with Estimand-Agnostic Causal InferenceÁlvaro Parafita, Tomas Garriga, Axel Brando et al.
  413. AlphaZero Neural Scaling and Zipf's Law: a Tale of Board Games and Power LawsOren Neumann, Claudius Gros
  414. Set Smoothness Unlocks Clarke Hyper-stationarity in Bilevel OptimizationHe Chen, Jiajin Li, Anthony Man-Cho So
  415. The Computational Advantage of Depth in Learning High-Dimensional Hierarchical TargetsYatin Dandi, Luca Pesce, Lenka Zdeborova et al.
  416. Thoughts Are All Over the Place: On the Underthinking of Long Reasoning ModelsYue Wang, Qiuzhi Liu, Jiahao Xu et al.
  417. OPTFM: A Scalable Multi-View Graph Transformer for Hierarchical Pre-Training in Combinatorial OptimizationHao Yuan, Wenli Ouyang, Changwen Zhang et al.
  418. ESCA: Contextualizing Embodied Agents via Scene-Graph GenerationJiani Huang, Amish Sethi, Matthew Kuo et al.
  419. Regret Bounds for Adversarial Contextual Bandits with General Function Approximation and Delayed FeedbackOrin Levy, Liad Erez, Alon Cohen et al.
  420. Towards Multi-Table Learning: A Novel Paradigm for Complementarity Quantification and IntegrationJunyu Zhang, Lizhong Ding, MinghongZhang et al.
  421. QFFT, Question-Free Fine-Tuning for Adaptive ReasoningWanlong Liu, Junxiao Xu, Fei Yu et al.
  422. Option-aware Temporally Abstracted Value for Offline Goal-Conditioned Reinforcement LearningHongjoon Ahn, Heewoong Choi, Jisu Han et al.
  423. Functional Scaling Laws in Kernel Regression: Loss Dynamics and Learning Rate SchedulesBinghui Li, Fengling Chen, Zixun Huang et al.
  424. GSRF: Complex-Valued 3D Gaussian Splatting for Efficient Radio-Frequency Data SynthesisKang Yang, Gaofeng Dong, Sijie Ji et al.
  425. Sharp Gaussian approximations for Decentralized Federated LearningSoham Bonnerjee, Sayar Karmakar, Wei Biao Wu
  426. DAPO : Improving Multi-Step Reasoning Abilities of Large Language Models with Direct Advantage-Based Policy OptimizationJiacai Liu, Chaojie Wang, Chris Yuhao Liu et al.
  427. MGUP: A Momentum-Gradient Alignment Update Policy for Stochastic OptimizationDa Chang, Ganzhao Yuan
  428. Unveiling the Power of Multiple Gossip Steps: A Stability-Based Generalization Analysis in Decentralized TrainingQinglun Li, Yingqi Liu, Miao Zhang et al.
  429. Enhancing Contrastive Learning with Variable SimilarityHaowen Cui, Shuo Chen, Jun Li et al.
  430. Orient Anything V2: Unifying Orientation and Rotation UnderstandingZehan Wang, Ziang Zhang, Jiayang Xu et al.
  431. A Closer Look at Graph Transformers: Cross-Aggregation and BeyondJiaming Zhuo, Ziyi Ma, Yintong Lu et al.
  432. Latent Policy Barrier: Learning Robust Visuomotor Policies by Staying In-DistributionZhanyi Sun, Shuran Song
  433. Bigram Subnetworks: Mapping to Next Tokens in Transformer Language ModelsTyler A. Chang, Ben Bergen
  434. Minimax-Optimal Univariate Function Selection in Sparse Additive Models: Rates, Adaptation, and the Estimation-Selection GapShixiang Liu
  435. Continuous Thought MachinesLuke Nicholas Darlow, Ciaran Regan, Sebastian Risi et al.
  436. Virus Infection Attack on LLMs: Your Poisoning Can Spread "VIA" Synthetic DataZi Liang, Qingqing Ye, Xuan Liu et al.
  437. Robust Neural Rendering in the Wild with Asymmetric Dual 3D Gaussian SplattingChengqi Li, Zhihao Shi, Yangdi Lu et al.
  438. Frame Context Packing and Drift Prevention in Next-Frame-Prediction Video Diffusion ModelsLvmin Zhang, Shengqu Cai, Muyang Li et al.
  439. CoLT: The conditional localization test for assessing the accuracy of neural posterior estimatesTianyu Chen, Vansh Bansal, James G. Scott
  440. Predictive Preference Learning from Human InterventionsHaoyuan Cai, Zhenghao Peng, Bolei Zhou
  441. Transformers for Mixed-type Event SequencesFelix Draxler, Yang Meng, Kai Nelson et al.
  442. ROGR: Relightable 3D Objects using Generative RelightingJiapeng Tang, Matthew Jacob Levine, Dor Verbin et al.
  443. Hamiltonian Descent Algorithms for Optimization: Accelerated Rates via Randomized Integration TimeQiang Fu, Andre Wibisono
  444. Cost-aware LLM-based Online Dataset AnnotationEray Can Elumar, Cem Tekin, Osman Yagan
  445. Scaling Unlocks Broader Generation and Deeper Functional Understanding of ProteinsAadyot Bhatnagar, Sarthak Jain, Joel Beazer et al.
  446. STARFlow: Scaling Latent Normalizing Flows for High-resolution Image SynthesisJiatao Gu, Tianrong Chen, David Berthelot et al.
  447. Flow Equivariant Recurrent Neural NetworksT. Anderson Keller
  448. AdaReasoner: Adaptive Reasoning Enables More Flexible ThinkingXiangqi Wang, Yue Huang, Yanbo Wang et al.
  449. LABridge: Text–Image Latent Alignment Framework via Mean-Conditioned OU ProcessHuiyang Shao, Xin Xia, Yuxi Ren et al.
  450. Achieving $\tilde{\mathcal{O}}(1/N)$ Optimality Gap in Restless Bandits through Gaussian ApproximationChen YAN, Weina Wang, Lei Ying
  451. On the Surprising Effectiveness of Large Learning Rates under Standard Width ScalingMoritz Haas, Sebastian Bordt, Ulrike von Luxburg et al.
  452. Flash Invariant Point AttentionAndrew Liu, Axel Elaldi, Nicholas T Franklin et al.
  453. SmallKV: Small Model Assisted Compensation of KV Cache Compression for Efficient LLM InferenceYi Zhao, Yajuan Peng, Nguyen Cam-Tu et al.
  454. CALM-PDE: Continuous and Adaptive Convolutions for Latent Space Modeling of Time-dependent PDEsJan Hagnberger, Daniel Musekamp, Mathias Niepert
  455. On the Empirical Power of Goodness-of-Fit Tests in Watermark DetectionWeiqing He, Xiang Li, Tianqi Shang et al.
  456. Balancing Multimodal Training Through Game-Theoretic RegularizationKonstantinos Kontras, Thomas Strypsteen, Christos Chatzichristos et al.
  457. Bipolar Self-attention for Spiking TransformersShuai Wang, Malu Zhang, Jingya Wang et al.
  458. Online Functional Tensor Decomposition via Continual Learning for Streaming Data CompletionXi Zhang, Yanyi Li, Yisi Luo et al.
  459. TrajMamba: An Efficient and Semantic-rich Vehicle Trajectory Pre-training ModelYichen Liu, Yan Lin, Shengnan Guo et al.
  460. Tensor Product Attention Is All You NeedYifan Zhang, Yifeng Liu, Huizhuo Yuan et al.
  461. TreeSynth: Synthesizing Diverse Data from Scratch via Tree-Guided Subspace PartitioningSheng Wang, Pengan CHEN, Jingqi Zhou et al.
  462. DeCaFlow: A deconfounding causal generative modelAlejandro Almodóvar, Adrián Javaloy, Juan Parras et al.
  463. Transfer Learning for Benign Overfitting in High-Dimensional Linear RegressionYeichan Kim, Ilmun Kim, Seyoung Park
  464. LLM Meeting Decision Trees on Tabular DataHangting Ye, Jinmeng Li, He Zhao et al.
  465. AgentBreeder: Mitigating the AI Safety Risks of Multi-Agent Scaffolds via Self-ImprovementJ Rosser, Jakob Nicolaus Foerster
  466. Learnable Burst-Encodable Time-of-Flight Imaging for High-Fidelity Long-Distance Depth SensingManchao Bao, Shengjiang Fang, Tao Yue et al.
  467. MigGPT: Harnessing Large Language Models for Automated Migration of Out-of-Tree Linux Kernel Patches Across VersionsPucheng Dang, Di Huang, Dong Li et al.
  468. FP4 All the Way: Fully Quantized Training of Large Language ModelsBrian Chmiel, Maxim Fishman, Ron Banner et al.
  469. Efficient Knowledge Transfer in Federated Recommendation for Joint Venture EcosystemYichen Li, Yijing Shan, YI LIU et al.
  470. VL-Rethinker: Incentivizing Self-Reflection of Vision-Language Models with Reinforcement LearningHaozhe Wang, Chao Qu, Zuming Huang et al.
  471. Spectral Graph Neural Networks are Incomplete on Graphs with a Simple SpectrumSnir Hordan, Maya Bechler-Speicher, Gur Lifshitz et al.
  472. ShapeLLM-Omni: A Native Multimodal LLM for 3D Generation and UnderstandingJunliang Ye, Zhengyi Wang, Ruowen Zhao et al.
  473. The Implicit Bias of Structured State Space Models Can Be Poisoned With Clean LabelsYonatan Slutzky, Yotam Alexander, Noam Razin et al.
  474. Multiverse: Your Language Models Secretly Decide How to Parallelize and Merge GenerationXinyu Yang, Yuwei An, Hongyi Liu et al.
  475. BevSplat: Resolving Height Ambiguity via Feature-Based Gaussian Primitives for Weakly-Supervised Cross-View LocalizationQiwei Wang, Wu Shaoxun, Yujiao Shi
  476. Conflict-Aware Knowledge Editing in the Wild: Semantic-Augmented Graph Representation for Unstructured TextZhange Zhang, Zhicheng Geng, Yuqing Ma et al.
  477. Vision Transformers with Self-Distilled RegistersZipeng Yan, Yinjie Chen, Chong Zhou et al.
  478. EraseFlow: Learning Concept Erasure Policies via GFlowNet-Driven AlignmentNaga Sai Abhiram kusumba, Maitreya Patel, Kyle Min et al.
  479. Boundary-Value PDEs Meet Higher-Order Differential Topology-aware GNNsYunfeng Liao, Yangxin Wu, Xiucheng Li
  480. 4DGT: Learning a 4D Gaussian Transformer Using Real-World Monocular VideosZhen Xu, Zhengqin Li, Zhao Dong et al.
  481. Co-Evolving LLM Coder and Unit Tester via Reinforcement LearningYinjie Wang, Ling Yang, Ye Tian et al.
  482. How many measurements are enough? Bayesian recovery in inverse problems with general distributionsBen Adcock, Nick Huang
  483. Diffusion Generative Modeling on Lie Group RepresentationsMarco Bertolini, Tuan Le, Djork-Arné Clevert
  484. EGGS: Exchangeable 2D/3D Gaussian Splatting for Geometry-Appearance Balanced Novel View SynthesisYancheng Zhang, Guangyu Sun, Chen Chen
  485. CURE: Concept Unlearning via Orthogonal Representation Editing in Diffusion ModelsShristi Das Biswas, Arani Roy, Kaushik Roy
  486. Projection-based Lyapunov method for fully heterogeneous weakly-coupled MDPsXiangCheng Zhang, Yige Hong, Weina Wang
  487. Low-degree evidence for computational transition of recovery rate in stochastic block modelJingqiu Ding, Yiding Hua, Lucas Slot et al.
  488. Nonlinear Laplacians: Tunable principal component analysis under directional prior informationYuxin Ma, Dmitriy Kunisky
  489. Chain-of-Zoom: Extreme Super-Resolution via Scale Autoregression and Preference AlignmentBryan Sangwoo Kim, Jeongsol Kim, Jong Chul Ye
  490. Personalized Decision Modeling: Utility Optimization or Textualized-Symbolic ReasoningYibo Zhao, Yang Zhao, Hongru Du et al.
  491. What are you sinking? A geometric approach on attention sinkValeria Ruscio, Umberto Nanni, Fabrizio Silvestri
  492. KARMA: Leveraging Multi-Agent LLMs for Automated Knowledge Graph EnrichmentYuxing Lu, Wei Wu, Xukai Zhao et al.
  493. MetaMind: Modeling Human Social Thoughts with Metacognitive Multi-Agent SystemsXuanming Zhang, Yuxuan Chen, Samuel Yeh et al.
  494. Enhancing CLIP Robustness via Cross-Modality AlignmentXingyu Zhu, Beier Zhu, Shuo Wang et al.
  495. Rethinking Entropy in Test-Time Adaptation: The Missing Piece from Energy DualityMincheol Park, Heeji Won, Won Woo Ro et al.
  496. On the Optimal Construction of Unbiased Gradient Estimators for Zeroth-Order OptimizationShaocong Ma, Heng Huang
  497. Gradient Variance Reveals Failure Modes in Flow-Based Generative ModelsTeodora Reu, Sixtine Dromigny, Michael M. Bronstein et al.
  498. TREND: Unsupervised 3D Representation Learning via Temporal Forecasting for LiDAR PerceptionRunjian Chen, Hyoungseob Park, Bo Zhang et al.
  499. Boosting Generative Image Modeling via Joint Image-Feature SynthesisTheodoros Kouzelis, Efstathios Karypidis, Ioannis Kakogeorgiou et al.
  500. A Token is Worth over 1,000 Tokens: Efficient Knowledge Distillation through Low-Rank CloneJitai Hao, Qiang Huang, Hao Liu et al.
  501. SparseMVC: Probing Cross-view Sparsity Variations for Multi-view ClusteringRuimeng Liu, Xin Zou, Chang Tang et al.
  502. Unbiased Prototype Consistency Learning for Multi-Modal and Multi-Task Object Re-IdentificationZhongao Zhou, Bin Yang, Wenke Huang et al.
  503. MJ-Video: Benchmarking and Rewarding Video Generation with Fine-Grained Video PreferenceHaibo Tong, Zhaoyang Wang, Zhaorun Chen et al.
  504. Fast Projection-Free Approach (without Optimization Oracle) for Optimization over Compact Convex SetChenghao Liu, Enming Liang, Minghua Chen
  505. Wider or Deeper? Scaling LLM Inference-Time Compute with Adaptive Branching Tree SearchYuichi Inoue, Kou Misaki, Yuki Imajuku et al.
  506. RepoMaster: Autonomous Exploration and Understanding of GitHub Repositories for Complex Task SolvingHuacan Wang, Ziyi Ni, Shuo Zhang et al.
  507. Hierarchical Shortest-Path Graph Kernel NetworkJiaxin Wang, Wenxuan Tu, Jieren Cheng
  508. Differential Privacy on Fully Dynamic StreamsYuan Qiu, Ke Yi
  509. Shortcut Features as Top Eigenfunctions of NTK: A Linear Neural Network Case and MoreJinwoo Lim, Suhyun Kim, Soo-Mook Moon
  510. SuffixDecoding: Extreme Speculative Decoding for Emerging AI ApplicationsGabriele Oliaro, Zhihao Jia, Daniel F Campos et al.
  511. Efficient Prompt Compression with Evaluator Heads for Long-Context Transformer InferenceWeizhi Fei, Xueyan Niu, XIE GUOQING et al.
  512. UniRelight: Learning Joint Decomposition and Synthesis for Video RelightingKai He, Ruofan Liang, Jacob Munkberg et al.
  513. When Thinking Fails: The Pitfalls of Reasoning for Instruction-Following in LLMsXiaomin Li, Zhou Yu, Zhiwei Zhang et al.
  514. On Agnostic PAC Learning in the Small Error RegimeJulian Asilis, Mikael Møller Høgsgaard, Grigoris Velegkas
  515. Wavelet Canonical Coherence for Nonstationary SignalsHaibo Wu, Marina I. Knight, Keiland W. Cooper et al.
  516. Language Modeling by Language ModelsJunyan Cheng, Peter Clark, Kyle Richardson
  517. Plasticity as the Mirror of EmpowermentDavid Abel, Michael Bowling, Andre Barreto et al.
  518. PiKE: Adaptive Data Mixing for Large-Scale Multi-Task Learning Under Low Gradient ConflictsZeman Li, Yuan Deng, Peilin Zhong et al.
  519. Language Models can Self-Improve at State-Value Estimation for Better SearchEthan Mendes, Alan Ritter
  520. Scalable Cross-View Sample Alignment for Multi-View Clustering with View Structure SimilarityJun Wang, Zhenglai Li, Chang Tang et al.
  521. Multidimensional Bayesian Utility Maximization: Tight Approximations to WelfareKira Goldner, Taylor Lundy
  522. Decomposing stimulus-specific sensory neural information via diffusion modelsSteeve Laquitaine, Simone Azeglio, Carlo Paris et al.
  523. Any-stepsize Gradient Descent for Separable Data under Fenchel–Young LossesHan Bao, Shinsaku Sakaue, Yuki Takezawa
  524. Provably Efficient RL under Episode-Wise Safety in Constrained MDPs with Linear Function ApproximationToshinori Kitamura, Arnob Ghosh, Tadashi Kozuno et al.
  525. To Distill or Decide? Understanding the Algorithmic Trade-off in Partially Observable RLYuda Song, Dhruv Rohatgi, Aarti Singh et al.
  526. A learnability analysis on neuro-symbolic learningHao-Yuan He, Ming Li
  527. Self-Perturbed Anomaly-Aware Graph Dynamics for Multivariate Time-Series Anomaly DetectionJinyu Cai, Yuan Xie, Glynnis Lim et al.
  528. Restoring Pruned Large Language Models via Lost Component CompensationZijian Feng, Hanzhang Zhou, Zixiao Zhu et al.
  529. Towards Building Model/Prompt-Transferable Attackers against Large Vision-Language ModelsXiaowen Cai, Daizong Liu, Xiaoye Qu et al.
  530. GaussianFusion: Gaussian-Based Multi-Sensor Fusion for End-to-End Autonomous DrivingShuai Liu, Quanmin Liang, Zefeng Li et al.
  531. SIU3R: Simultaneous Scene Understanding and 3D Reconstruction Beyond Feature AlignmentQi Xu, Dongxu Wei, Lingzhe Zhao et al.
  532. HYPERION: Fine-Grained Hypersphere Alignment for Robust Federated Graph LearningGuancheng Wan, Xiaoran Shang, Yuxin Wu et al.
  533. Brain-Inspired fMRI-to-Text Decoding via Incremental and Wrap-Up Language ModelingWentao Lu, Dong Nie, Pengcheng Xue et al.
  534. Sampling-Efficient Test-Time Scaling: Self-Estimating the Best-of-N Sampling in Early DecodingYiming Wang, Pei Zhang, Siyuan Huang et al.
  535. PoE-World: Compositional World Modeling with Products of Programmatic ExpertsWasu Top Piriyakulkij, Yichao Liang, Hao Tang et al.
  536. Uni-LoRA: One Vector is All You NeedKaiyang Li, Shaobo Han, Qing Su et al.
  537. Reinforcement Learning for Out-of-Distribution Reasoning in LLMs: An Empirical Study on Diagnosis-Related Group CodingHanyin Wang, Zhenbang Wu, Gururaj J. Kolar et al.
  538. Stochastic Process Learning via Operator Flow MatchingYaozhong Shi, Zachary E Ross, Domniki Asimaki et al.
  539. Strategic Costs of Perceived Bias in Fair SelectionL. Elisa Celis, Lingxiao Huang, Milind Sohoni et al.
  540. A Closer Look at Model Collapse: From a Generalization-to-Memorization PerspectiveLianghe Shi, Meng Wu, Huijie Zhang et al.
  541. AdaSPEC: Selective Knowledge Distillation for Efficient Speculative DecodersYuezhou Hu, Jiaxin Guo, Xinyu Feng et al.
  542. Depth-Width Tradeoffs for Transformers on Graph TasksGilad Yehudai, Clayton Sanford, Maya Bechler-Speicher et al.
  543. Refinement Methods for Distributed Distribution Estimation under $\ell^p$-LossesDeheng Yuan, Tao Guo, Zhongyi Huang
  544. Measuring and Guiding MonosemanticityRuben Härle, Felix Friedrich, Manuel Brack et al.
  545. Variational Transdimensional InferenceLaurence Davies, Dan MacKinlay, Rafael Oliveira et al.
  546. Scaling Laws For Scalable OversightJoshua Engels, David D. Baek, Subhash Kantamneni et al.
  547. A Near-Optimal Algorithm for Decentralized Convex-Concave Finite-Sum Minimax OptimizationHongxu Chen, Ke Wei, Haishan Ye et al.
  548. Learning with Calibration: Exploring Test-Time Computing of Spatio-Temporal ForecastingWei Chen, Yuxuan Liang
  549. FPSAttention: Training-Aware FP8 and Sparsity Co-Design for Fast Video DiffusionAkide Liu, Zeyu Zhang, Zhexin Li et al.
  550. Disentangled Concepts Speak Louder Than Words: Explainable Video Action RecognitionJongseo Lee, Wooil Lee, Gyeong-Moon Park et al.
  551. Physics-Driven Spatiotemporal Modeling for AI-Generated Video DetectionShuhai Zhang, ZiHao Lian, Jiahao Yang et al.
  552. Robust Graph Condensation via Classification Complexity MitigationJiayi Luo, Qingyun Sun, Beining Yang et al.
  553. CausalPFN: Amortized Causal Effect Estimation via In-Context LearningVahid Balazadeh, Hamidreza Kamkari, Valentin Thomas et al.
  554. High-order Equivariant Flow Matching for Density Functional Theory Hamiltonian PredictionSeongsu Kim, Nayoung Kim, Dongwoo Kim et al.
  555. 🎧MOSPA: Human Motion Generation Driven by Spatial AudioShuyang Xu, Zhiyang Dou, Mingyi Shi et al.
  556. Absolute Zero: Reinforced Self-play Reasoning with Zero DataAndrew Zhao, Yiran Wu, Yang Yue et al.
  557. Graph–Smoothed Bayesian Black-Box Shift Estimator and Its Information GeometryMasanari Kimura
  558. Vision Transformers Don't Need Trained RegistersNicholas Jiang, Amil Dravid, Alexei A Efros et al.
  559. Object-centric 3D Motion Field for Robot Learning from Human VideosZhao-Heng Yin, Sherry Yang, Pieter Abbeel
  560. Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware PermutationShuo Yang, Haocheng Xi, Yilong Zhao et al.
  561. Aggregation Hides Out-of-Distribution Generalization Failures from Spurious CorrelationsOlawale Elijah Salaudeen, Haoran Zhang, Kumail Alhamoud et al.
  562. Mean-Field Sampling for Cooperative Multi-Agent Reinforcement LearningEmile Timothy Anand, Ishani Karmarkar, Guannan Qu
  563. EAG3R: Event-Augmented 3D Geometry Estimation for Dynamic and Extreme-Lighting ScenesXiaoshan Wu, Yifei Yu, Xiaoyang Lyu et al.
  564. LaViDa: A Large Diffusion Language Model for Multimodal UnderstandingShufan Li, Konstantinos Kallidromitis, Hritik Bansal et al.
  565. Theory-Driven Label-Specific Representation for Incomplete Multi-View Multi-Label LearningQuanjiang Li, Tianxiang Xu, Tingjin Luo et al.
  566. Scalable Fingerprinting of Large Language ModelsAnshul Nasery, Jonathan Hayase, Creston Brooks et al.
  567. Can Knowledge-Graph-based Retrieval Augmented Generation Really Retrieve What You Need?Junchi Yu, Yujie Liu, Jindong Gu et al.
  568. Decomposing Interventional Causality into Synergistic, Redundant, and Unique ComponentsAbel Jansma
  569. Long-Tailed Recognition via Information-Preservable Two-Stage LearningFudong Lin, Xu Yuan
  570. Mozart: Modularized and Efficient MoE Training on 3.5D Wafer-Scale Chiplet ArchitecturesShuqing Luo, Ye Han, Pingzhi Li et al.
  571. Data Mixing Can Induce Phase Transitions in Knowledge AcquisitionXinran Gu, Kaifeng Lyu, Jiazheng Li et al.
  572. Shallow Diffuse: Robust and Invisible Watermarking through Low-Dim Subspaces in Diffusion ModelsWenda Li, Huijie Zhang, Qing Qu
  573. Offline Guarded Safe Reinforcement Learning for Medical Treatment Optimization StrategiesRunze Yan, Xun Shen, Akifumi Wachi et al.
  574. From Counterfactuals to Trees: Competitive Analysis of Model Extraction AttacksAwa Khouna, Julien Ferry, Thibaut Vidal
  575. Repo2Run: Automated Building Executable Environment for Code Repository at ScaleRuida Hu, Chao Peng, XinchenWang et al.
  576. Towards Dynamic 3D Reconstruction of Hand-Instrument Interaction in Ophthalmic SurgeryMing Hu, Zhengdi Yu, Feilong Tang et al.
  577. Unlocking Dataset Distillation with Diffusion ModelsBrian Bernhard Moser, Federico Raue, Sebastian Palacio et al.
  578. Vision-centric Token Compression in Large Language ModelLing Xing, Alex Jinpeng Wang, Rui Yan et al.
  579. VITA-1.5: Towards GPT-4o Level Real-Time Vision and Speech InteractionChaoyou Fu, Haojia Lin, Xiong Wang et al.
  580. EDELINE: Enhancing Memory in Diffusion-based World Models via Linear-Time Sequence ModelingJia-Hua Lee, Bor-Jiun Lin, Wei-Fang Sun et al.
  581. UniTok: a Unified Tokenizer for Visual Generation and UnderstandingChuofan Ma, Yi Jiang, Junfeng Wu et al.
  582. NormFit: A Lightweight Solution for Few-Shot Federated Learning with Non-IID DataAzadeh Motamedi, Jae-Mo Kang, Il-Min Kim
  583. Towards Comprehensive Scene Understanding: Integrating First and Third-Person Views for LVLMsInsu Lee, Wooje Park, Jaeyun Jang et al.
  584. Accelerating Visual-Policy Learning through Parallel Differentiable SimulationHaoxiang You, Yilang Liu, Ian Abraham
  585. Online Prediction with Limited SelectivityLicheng Liu, Mingda Qiao
  586. Generative Trajectory Stitching through Diffusion CompositionYunhao Luo, Utkarsh Aashu Mishra, Yilun Du et al.
  587. VLMs have Tunnel Vision: Evaluating Nonlocal Visual Reasoning in Leading VLMsShmuel Berman, Jia Deng
  588. Neighborhood Self-Dissimilarity Attention for Medical Image SegmentationChen Junren, Rui Chen, Wang-wei et al.
  589. Learning to Factorize Spatio-Temporal Foundation ModelsSiru Zhong, Junjie Qiu, Yangyu Wu et al.
  590. Angles Don’t Lie: Unlocking Training‑Efficient RL Through the Model’s Own SignalsQinsi Wang, Jinghan Ke, Hancheng Ye et al.
  591. Generalizable Insights for Graph Transformers in Theory and PracticeTimo Stoll, Luis Müller, Christopher Morris
  592. Principled Data Augmentation for Learning to Solve Quadratic Programming ProblemsChendi Qian, Christopher Morris
  593. Dual Data Alignment Makes AI-Generated Image Detector Easier GeneralizableRuoxin Chen, Junwei Xi, Zhiyuan Yan et al.
  594. CSBrain: A Cross-scale Spatiotemporal Brain Foundation Model for EEG DecodingYuchen Zhou, Jiamin Wu, Zichen Ren et al.
  595. Flattening Hierarchies with Policy BootstrappingJohn Luoyu Zhou, Jonathan Kao
  596. HopaDIFF: Holistic-Partial Aware Fourier Conditioned Diffusion for Referring Human Action Segmentation in Multi-Person ScenariosKunyu Peng, Junchao Huang, Xiangsheng Huang et al.
  597. Geometry Meets Incentives: Sample-Efficient Incentivized Exploration with Linear ContextsBenjamin Schiffer, Mark Sellke
  598. GeoRemover: Removing Objects and Their Causal Visual ArtifactsZixin Zhu, Haoxiang Li, Xuelu Feng et al.
  599. The Primacy of Magnitude in Low-Rank AdaptationZicheng Zhang, Haoran Li, Yifeng Zhang et al.
  600. GeRaF: Neural Geometry Reconstruction from Radio Frequency SignalsJiachen Lu, Hailan Shanbhag, Haitham Al Hassanieh
  601. Spatial Understanding from Videos: Structured Prompts Meet Simulation DataHaoyu Zhang, Meng Liu, Zaijing Li et al.
  602. SATURN: SAT-based Reinforcement Learning to Unleash LLMs ReasoningHuanyu Liu, Ge Li, Jia Li et al.
  603. JavisGPT: A Unified Multi-modal LLM for Sounding-Video Comprehension and GenerationKai Liu, Jungang Li, Yuchong Sun et al.
  604. Dimension-adapted Momentum Outscales SGDDamien Ferbach, Katie Everett, Gauthier Gidel et al.
  605. From Experts to a Generalist: Toward General Whole-Body Control for Humanoid RobotsYuxuan Wang, Ming Yang, Ziluo Ding et al.
  606. LoRAShop: Training-Free Multi-Concept Image Generation and Editing with Rectified Flow TransformersYusuf Dalva, Hidir Yesiltepe, Pinar Yanardag
  607. GeoSVR: Taming Sparse Voxels for Geometrically Accurate Surface ReconstructionJiahe Li, Jiawei Zhang, Youmin Zhang et al.
  608. Transformer Copilot: Learning from The Mistake Log in LLM Fine-tuningJiaru Zou, Yikun Ban, Zihao Li et al.
  609. scMRDR: A scalable and flexible framework for unpaired single-cell multi-omics data integrationJianle Sun, Chaoqi Liang, Ran Wei et al.
  610. Imitation Beyond Expectation Using Pluralistic Stochastic DominanceAli Farajzadeh, Danyal Saeed, Syed M Abbas et al.
  611. Cloud4D: Estimating Cloud Properties at a High Spatial and Temporal ResolutionJacob Lin, Edward Gryspeerdt, Ronald Clark
  612. CLiFT: Compressive Light-Field Tokens for Compute Efficient and Adaptive Neural RenderingZhengqing Wang, Yuefan Wu, Jiacheng Chen et al.
  613. Adaptive Neighborhood-Constrained Q Learning for Offline Reinforcement LearningYixiu Mao, Yun Qu, Cheems Wang et al.
  614. To Think or Not To Think: A Study of Thinking in Rule-Based Visual Reinforcement Fine-TuningMing Li, Jike Zhong, Shitian Zhao et al.
  615. DexGarmentLab: Dexterous Garment Manipulation Environment with Generalizable PolicyYuran Wang, Ruihai Wu, Yue Chen et al.
  616. STITCH-OPE: Trajectory Stitching with Guided Diffusion for Off-Policy EvaluationHossein Goli, Michael Gimelfarb, Nathan Samuel de Lara et al.
  617. Neural Atlas Graphs for Dynamic Scene Decomposition and EditingJan Philipp Schneider, Pratik Singh Bisht, Ilya Chugunov et al.
  618. LeMiCa: Lexicographic Minimax Path Caching for Efficient Diffusion-Based Video GenerationHuanlin Gao, Ping Chen, Fuyuan Shi et al.
  619. Robust SuperAlignment: Weak-to-Strong Robustness Generalization for Vision-Language ModelsJunhao Dong, Cong Zhang, Xinghua Qu et al.
  620. Thought Communication in Multiagent CollaborationYujia Zheng, Zhuokai Zhao, Zijian Li et al.
  621. Polyline Path Masked Attention for Vision TransformerZhongchen Zhao, Chaodong Xiao, Hui LIN et al.
  622. PLMTrajRec: A Scalable and Generalizable Trajectory Recovery Method with Pre-trained Language ModelsTonglong Wei, Yan Lin, Youfang Lin et al.
  623. Optimization Inspired Few-Shot Adaptation for Large Language ModelsBoyan Gao, Xin Wang, Yibo Yang et al.
  624. Scent of Knowledge: Optimizing Search-Enhanced Reasoning with Information ForagingHongjin Qian, Zheng Liu
  625. Taccel: Scaling Up Vision-based Tactile Robotics via High-performance GPU SimulationYuyang Li, Wenxin Du, Chang Yu et al.
  626. Toward Relative Positional Encoding in Spiking TransformersChangze Lv, Yansen Wang, Dongqi Han et al.
  627. TransMLA: Migrating GQA Models to MLA with Full DeepSeek Compatibility and SpeedupFanxu Meng, Pingzhi Tang, Zengwei Yao et al.
  628. Towards Understanding the Mechanisms of Classifier-Free GuidanceXiang Li, Rongrong Wang, Qing Qu
  629. PhysX-3D: Physical-Grounded 3D Asset GenerationZiang Cao, Zhaoxi Chen, Liang Pan et al.
  630. Towards Physics-informed Spatial Intelligence with Human Priors: An Autonomous Driving Pilot StudyGuanlin Wu, Boyan Su, Yang Zhao et al.
  631. StreamForest: Efficient Online Video Understanding with Persistent Event MemoryXiangyu Zeng, Kefan Qiu, Qingyu Zhang et al.
  632. Vanish into Thin Air: Cross-prompt Universal Adversarial Attacks for SAM2Ziqi Zhou, Yifan Hu, Yufei Song et al.
  633. Improving Evolutionary Multi-View Classification via Eliminating Individual Fitness BiasXinyan Liang, ShuaiLi, Qian Guo et al.
  634. Right Question is Already Half the Answer: Fully Unsupervised LLM Reasoning IncentivizationQingyang Zhang, Haitao Wu, Changqing Zhang et al.
  635. MDReID: Modality-Decoupled Learning for Any-to-Any Multi-Modal Object Re-IdentificationYingying Feng, Jie Li, Jie Hu et al.
  636. RobustMerge: Parameter-Efficient Model Merging for MLLMs with Direction RobustnessFanhu Zeng, Haiyang Guo, Fei Zhu et al.
  637. Stable Part Diffusion 4D: Multi-View RGB and Kinematic Parts Video GenerationHao Zhang, Chun-Han Yao, Simon Donné et al.
  638. OnlineSplatter: Pose-Free Online 3D Reconstruction for Free-Moving ObjectsMark He Huang, Lin Geng Foo, Christian Theobalt et al.
  639. Rectified Point Flow: Generic Point Cloud Pose EstimationTAO SUN, Liyuan Zhu, Shengyu Huang et al.
  640. Cue3D: Quantifying the Role of Image Cues in Single-Image 3D GenerationXiang Li, Zirui Wang, Zixuan Huang et al.
  641. SceneDesigner: Controllable Multi-Object Image Generation with 9-DoF Pose ManipulationZhenyuan Qin, Xincheng Shuai, Henghui Ding
  642. StelLA: Subspace Learning in Low-rank Adaptation using Stiefel ManifoldZhizhong Li, Sina Sajadmanesh, Jingtao Li et al.
  643. Non-Clairvoyant Scheduling with Progress BarsZiyad Benomar, Romain Cosson, Alexander Lindermayr et al.
  644. Jacobian-Based Interpretation of Nonlinear Neural Encoding ModelXiaohui Gao, Haoran Yang, Yue Cheng et al.
  645. Mesh-RFT: Enhancing Mesh Generation via Fine-grained Reinforcement Fine-TuningJian Liu, Jing Xu, Song Guo et al.
  646. VisualQuality-R1: Reasoning-Induced Image Quality Assessment via Reinforcement Learning to RankTianhe Wu, Jian Zou, Jie Liang et al.
  647. GenColor: Generative and Expressive Color Enhancement with Pixel-Perfect Texture PreservationYi Dong, Yuxi Wang, Xianhui Lin et al.
  648. G-Memory: Tracing Hierarchical Memory for Multi-Agent SystemsGuibin Zhang, Muxin Fu, Kun Wang et al.
  649. FutureSightDrive: Thinking Visually with Spatio-Temporal CoT for Autonomous DrivingShuang Zeng, Xinyuan Chang, Mengwei Xie et al.
  650. E2Former: An Efficient and Equivariant Transformer with Linear-Scaling Tensor ProductsYunyang Li, Lin Huang, Zhihao Ding et al.
  651. Adaptive Defense against Harmful Fine-Tuning for Large Language Models via Bayesian Data SchedulerZixuan Hu, Li Shen, Zhenyi Wang et al.
  652. Neptune-X: Active X-to-Maritime Generation for Universal Maritime Object DetectionYu Guo, Shengfeng He, Yuxu Lu et al.
  653. AuroRA: Breaking Low-Rank Bottleneck of LoRA with Nonlinear MappingHaonan Dong, Wenhao Zhu, Guojie Song et al.
  654. Puppeteer: Rig and Animate Your 3D ModelsChaoyue Song, Xiu Li, Fan Yang et al.
  655. Talk2Event: Grounded Understanding of Dynamic Scenes from Event CamerasLingdong Kong, Dongyue Lu, Alan Liang et al.
  656. DNAEdit: Direct Noise Alignment for Text-Guided Rectified Flow EditingChenxi Xie, Minghan Li, Shuai Li et al.
  657. Alligat0R: Pre-Training through Covisibility Segmentation for Relative Camera Pose RegressionThibaut Loiseau, Guillaume Bourmaud, Vincent Lepetit
  658. DiCo: Revitalizing ConvNets for Scalable and Efficient Diffusion ModelingYuang Ai, Qihang Fan, Xuefeng Hu et al.
  659. Enhancing Time Series Forecasting through Selective Representation Spaces: A Patch PerspectiveXingjian Wu, Xiangfei Qiu, Hanyin Cheng et al.
  660. Injecting Frame-Event Complementary Fusion into Diffusion for Optical Flow in Challenging ScenesHaonan Wang, Hanyu Zhou, Haoyue Liu et al.
  661. OmniSync: Towards Universal Lip Synchronization via Diffusion TransformersZiqiao Peng, Jiwen Liu, Haoxian Zhang et al.
  662. MesaTask: Towards Task-Driven Tabletop Scene Generation via 3D Spatial ReasoningJinkun Hao, Naifu Liang, Zhen Luo et al.
  663. Self Forcing: Bridging the Train-Test Gap in Autoregressive Video DiffusionXun Huang, Zhengqi Li, Guande He et al.
  664. DICEPTION: A Generalist Diffusion Model for Visual Perceptual TasksCanyu Zhao, Yanlong Sun, Mingyu Liu et al.
  665. Variational Learning Finds Flatter Solutions at the Edge of StabilityAvrajit Ghosh, Bai Cong, Rio Yokota et al.
  666. Seeing Sound, Hearing Sight: Uncovering Modality Bias and Conflict of AI models in Sound LocalizationYanhao Jia, Ji Xie, S Jivaganesh et al.
  667. ALINE: Joint Amortization for Bayesian Inference and Active Data AcquisitionDaolang Huang, Xinyi Wen, Ayush Bharti et al.
  668. Fully Autonomous Neuromorphic Navigation and Dynamic Obstacle AvoidanceXiaochen Shang, Luo Pengwei, Xinning Wang et al.
  669. Enhancing LLM Watermark Resilience Against Both Scrubbing and Spoofing AttacksHuanming Shen, Baizhou Huang, Xiaojun Wan
  670. Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree SearchHuanjin Yao, Jiaxing Huang, Wenhao Wu et al.
  671. ProtInvTree: Deliberate Protein Inverse Folding with Reward-guided Tree SearchMengdi Liu, Xiaoxue Cheng, Zhangyang Gao et al.
  672. On the Value of Cross-Modal Misalignment in Multimodal Representation LearningYichao Cai, Yuhang Liu, Erdun Gao et al.
  673. A Unified Solution to Video Fusion: From Multi-Frame Learning to BenchmarkingZixiang Zhao, Haowen Bai, Bingxin Ke et al.
  674. Multi-agent Markov EntanglementShuze Chen, Tianyi Peng
  675. SQS: Enhancing Sparse Perception Models via Query-based Splatting in Autonomous DrivingHaiming Zhang, Yiyao Zhu, Wending Zhou et al.
  676. PerceptionLM: Open-Access Data and Models for Detailed Visual UnderstandingJang Hyun Cho, Andrea Madotto, Effrosyni Mavroudi et al.
  677. Debate or Vote: Which Yields Better Decisions in Multi-Agent Large Language Models?Hyeong Kyu Choi, Jerry Zhu, Sharon Li
  678. VoxDet: Rethinking 3D Semantic Scene Completion as Dense Object DetectionWuyang Li, Zhu Yu, Alexandre Alahi
  679. Approximate Domain Unlearning for Vision-Language ModelsKodai Kawamura, Yuta Goto, Rintaro Yanagi et al.
  680. BioCLIP 2: Emergent Properties from Scaling Hierarchical Contrastive LearningJianyang Gu, Samuel Stevens, Elizabeth G Campolongo et al.
  681. GraphMaster: Automated Graph Synthesis via LLM Agents in Data-Limited EnvironmentsEnjun Du, Xunkai Li, Tian Jin et al.
  682. Q-Insight: Understanding Image Quality via Visual Reinforcement LearningWeiqi Li, Xuanyu Zhang, Shijie Zhao et al.
  683. What Makes a Reward Model a Good Teacher? An Optimization PerspectiveNoam Razin, Zixuan Wang, Hubert Strauss et al.
  684. $\Psi$-Sampler: Initial Particle Sampling for SMC-Based Inference-Time Reward Alignment in Score ModelsTaeHoon Yoon, Yunhong Min, Kyeongmin Yeo et al.
  685. Do-PFN: In-Context Learning for Causal Effect EstimationJake Robertson, Arik Reuter, Siyuan Guo et al.
  686. ReSim: Reliable World Simulation for Autonomous DrivingJiazhi Yang, Kashyap Chitta, Shenyuan Gao et al.
  687. Differentiable Sparsity via $D$-Gating: Simple and Versatile Structured PenalizationChris Kolb, Laetitia Frost, Bernd Bischl et al.

← Browse the whole archive