ICML 2026 Oral Papers

ICMLOral2026

All 168 papers accepted as Oral at ICML 2026 — the top slice of the accepted programme. Every title links to its own page with authors, affiliation and sources.

All 168 papers

  1. Benchmarking at the Edge of ComprehensionSamuele Marro, Jialin Yu, Emanuele La Malfa et al.
  2. Asymmetric Perturbation in Solving Bilinear Saddle-Point OptimizationKenshi Abe, Mitsuki Sakamoto, Kaito Ariu et al.
  3. Position: Don't Just "Fix it in Post'': A Science of AI Must Study Learning DynamicsStella Biderman, Mohammad Aflah Khan, Fatemehsadat Mireshghallah et al.
  4. dnaHNet: A Scalable and Hierarchical Foundation Model for Genomic Sequence LearningArnav Shah, Junzhe Li, Parsa Idehpour et al.
  5. Are VLMs Seeing or Just Saying? Uncovering the Illusion of Visual Re-examinationChufan Shi, Cheng Yang, Yaokang Wu et al.
  6. Do We Need Adam? Surprisingly Strong and Sparse Reinforcement Learning with SGD in LLMsSagnik Mukherjee, Lifan Yuan, Pavan Jayasinha et al.
  7. DiScoFormer: Plug-In Density and Score Estimation with TransformersVasily Ilin, Peter Sushko, Ranjay Krishna
  8. CLEAR: Context-Aware Learning with End-to-End Mask-Free Inference for Adaptive Subtitle RemovalQingdong He, Chaoyi Wang, Peng TANG et al.
  9. A Systematic Study of Behavioral Cloning for Scientific Data AnnotationIshaan Singh Chandok, Core Francisco Park
  10. Mixtures Closest To A Given Measure: A Semidefinite Programming ApproachSrećko Ðurašinović, Jean B Lasserre, Victor Magron
  11. FLIP2: Expanding Protein Fitness Landscape Benchmarks for Real-World Machine Learning ApplicationsKieran Didi, Sarah Alamdari, Alex Lu et al.
  12. daVinci-Dev: Agent-native Mid-training for Software EngineeringJi Zeng, Dayuan Fu, Tiantian Mi et al.
  13. Learning Unmasking Policies for Diffusion Language ModelsMetod Jazbec, Theo X. Olausson, Louis Béthune et al.
  14. LASER: Learning Active Sensing for Continuum Field ReconstructionHuayu Deng, Jinghui Zhong, Xiangming Zhu et al.
  15. Protein Autoregressive Modeling via Multiscale Structure GenerationYanru Qu, Cheng-Yen Hsieh, Zaixiang Zheng et al.
  16. Multimodal Nested Learning for Decoupled and Coordinated OptimizationYanglin Feng, Yang Qin, Dezhong Peng et al.
  17. AI Engram: In Search of Memory Traces in Artificial IntelligenceJea Kwon, Dong-Kyum Kim, Jiwon Kim et al.
  18. On the Convergence Rate of LoRA Gradient DescentSiqiao Mu, Diego Klabjan
  19. Motion Attribution for Video GenerationXindi Wu, Despoina Paschalidou, Jun Gao et al.
  20. Less is Enough: Synthesizing Diverse Data in Feature Space of LLMsZhongzhi Li, Xuansheng Wu, Yijiang Li et al.
  21. Strategic Navigation or Stochastic Search? How Agents and Humans Reason Over Document CollectionsLukasz Borchmann, Jordy Van Landeghem, Michał Turski et al.
  22. Protein Fold Classification at Scale: Benchmarking and PretrainingDexiong Chen, Andrei Manolache, Mathias Niepert et al.
  23. VenusBench-Mobile: A Challenging and User-Centric Benchmark for Mobile GUI Agents with Capability DiagnosticsYichen Gong, Zhuohan Cai, Sunhao Dai et al.
  24. OPUS: Towards Efficient and Principled Data Selection in Large Language Model Pre-training in Every IterationShaobo Wang, Xuan Ouyang, Tianyi Xu et al.
  25. Guaranteed Optimal Compositional Explanations for NeuronsBiagio La Rosa, Leilani Gilpin
  26. Revenue Efficiency of Correlated Equilibria in First Price AuctionsAnders Bo Ipsen, Stratis Skoulakis · Aarhus U
  27. Riemannian Metric Matching for Scalable Geometric Modeling of DistributionsJacob Bamberger, Adam Gosztolai, Pierre Vandergheynst et al.
  28. PhotoAgent: Exploratory Visual Aesthetic Planning with Large Vision ModelsMingde Yao, Zhiyuan You, King-Man Tam et al.
  29. Position: Anthropomorphic Misalignment Research Needs Stronger EvidenceVansh Gupta, Peter Nutter, Samuel Stante et al.
  30. Diffract: Spectral View of LLM Domain AdaptationNikita Borodin, Maria Krylova, Artem Zabolotnyi et al.
  31. Learning Human-Robot Collaboration via Heterogeneous-Agent Lyapunov Policy OptimizationHao Zhang, Yaru Niu, Yikai Wang et al.
  32. From Feasible to Practical: Pareto-Optimal Synthesis PlanningFriedrich Hastedt, Dongda Zhang, Antonio Del rio chanona
  33. Controlled LLM Training on Spectral SphereTian Xie, Haoming Luo, Haoyu Tang et al.
  34. Don't Force the Fit: Bounded Log-Likelihood Loss for Enhanced Reasoning in Large Language ModelsFeng Zhao, Hong Zhang, Yu Yang et al.
  35. Chebyshev Policies and the Mountain Car Problem: Reinforcement Learning for Low-dimensional Control TasksStefan Huber, Hannes Unger, Georg Schäfer et al.
  36. Monitoring MonitorabilityMelody Guan, Miles Wang, Micah Carroll et al.
  37. Optimal and Scalable MAPF via Multi-Marginal Optimal Transport and Schrödinger BridgesUsman A Khan, Joseph Durham
  38. ReViT: Rotational-equivariant Vision Transformers for Neural PDE SolversHao Wei, Björn List, Nils Thuerey
  39. Evaluating Robustness of Reasoning Models on Parameterized Logical ProblemsNaïm Es-sebbani, Esteban Marquer, Yakoub Salhi et al.
  40. Detecting the Semantic Fixed Point: A Geometric Framework for Efficient InferenceJiawei Gu, Ziyue Qiao, Xiao Luo
  41. Maximum Likelihood Reinforcement LearningFahim Tajwar, Guanning Zeng, Yueer Zhou et al.
  42. Foundations of Equivariant Deep Learning: Unifying Graph and Sheaf Neural NetworksYoshihiro Maruyama
  43. Rex: A Family of Reversible Exponential (Stochastic) Runge-Kutta SolversZander Blasingame, Chen Liu
  44. ECHO: Elastic Speculative Decoding with Sparse Gating for High-Concurrency ScenariosXinyi Hu, Yuhao Shen, Zhang Baolin et al.
  45. The Obfuscation Atlas: Mapping Where Honesty Emerges in RLVR with Deception ProbesMohammad Taufeeque, Stefan Heimersheim, Adam Gleave et al.
  46. On Minimum Depth and Width of Floating-Point Neural Networks for Representing Floating-Point FunctionsSejun Park, Yeachan Park, Geonho Hwang
  47. RoboMME: Benchmarking and Understanding Memory for Robotic Generalist PoliciesYinpei Dai, Hongze Fu, Jayjun Lee et al.
  48. Minimax Optimal Strategy for Delayed Observations in Online Reinforcement LearningHarin Lee, Kevin Jamieson
  49. TG-RAG: A Retrieval-Augmented Framework for Reasoning Guidance in Specialized DomainsLiang Su, Mingyang Zhang, Yun Xiong et al.
  50. The Expressivity Limits of TransformersMaxime Meyer, Mario Michelessa, Caroline Chaux et al.
  51. Optimal Decision-Making Based on Prediction SetsTao Wang, Edgar Dobriban · UPenn
  52. Towards Sub-second Biological Foundation Model Infrastructure: A Quantized Consistency Diffusion Framework for Molecular DockingKexin Zhang, Weichen Qin, Yue Teng et al.
  53. Understanding Reasoning Collapse in LLM Agent Reinforcement LearningZihan (Zenus) Wang, Chi Gui, Xing Jin et al.
  54. VALUEFLOW: Toward Pluralistic and Steerable Value-based Alignment in Large Language ModelsWoojin Kim, Sieun Hyeon, Jusang Oh et al.
  55. Unsupervised Partner Design Enables Robust Ad-hoc TeamworkConstantin Ruhdorfer, Matteo Bortoletto, Victor Oei et al.
  56. MuonSSM: Orthogonalizing State Space Models for Sequence ModelingThai Khanh Nguyen, Ngoc Bich Uyen Vo, Thieu Vo et al.
  57. Mitigating Reward Hacking in RLHF via Bayesian Non-negative Reward ModelingZhibin Duan, Guowei Rong, Zhuo Li et al.
  58. Any-Order GPT as Masked Diffusion Model: Decoupling Formulation and ArchitectureShuchen Xue, Tianyu Xie, Tianyang Hu et al.
  59. Position: Irresponsible AI: big tech’s influence on AI research and associated impactsAlex Hernandez-Garcia, Alexandra Volokhova, Ezekiel Williams et al.
  60. Bad Seeing or Bad Thinking? Rewarding Perception for Multimodal ReasoningWANG, Qixin Xu, Changpeng Wang et al.
  61. Position: Stop Automating Peer Review Without Rigorous EvaluationJoachim Baumann, Jiaxin Pei, Sanmi Koyejo et al.
  62. Jailbreak Foundry: From Papers to Runnable Attacks for Reproducible BenchmarkingZhicheng Fang, Jingjie Zheng, Chenxu Fu et al.
  63. Exact Functional ANOVA Decomposition for Categorical InputsBaptiste Ferrere, Nicolas Bousquet, Gamboa Fabrice et al.
  64. Quantifying Frontier LLM Capabilities for Container Sandbox EscapeRahul Marchand, Art Cathain, Jerome Wynne et al.
  65. Joint Learning in the Gaussian Single Index ModelLoucas Pillaud-Vivien, Adrien Schertzer
  66. Position: The AI Imperative: Scaling High-Quality Peer Review in Machine LearningQiyao Wei, Samuel Holt, Jing Yang et al.
  67. DroneDINO: Towards Heterogeneous Routed Mixture of Experts for Drone-based Unified Object DetectionRui Chen, Dongdong Li, Yan Fan et al.
  68. Error Propagation Mechanisms and Compensation Strategies for Quantized Diffusion ModelsSongwei Liu, Chao Zeng, Chenqian Yan et al.
  69. Activation Oracles: Training and Evaluating LLMs as General-Purpose Activation ExplainersAdam Karvonen, James Chua, Clément Dumas et al.
  70. Reinforcement Learning with Evolving Rubrics for Deep ResearchRulin Shao, Akari Asai, Shannon Shen et al.
  71. Simultaneous Speech-to-Speech Translation Without Aligned DataTom Labiausse, Romain Fabre, Yannick Estève et al.
  72. Incentivizing Truthfulness and Collaborative Fairness in Bayesian LearningRachael Hwee Ling Sim, Jue Fan, Xiao Tian et al.
  73. SVRG and Beyond via Posterior CorrectionNico Daheim, Thomas Moellenhoff, James Ming Liang Ang et al. · TU Darmstadt / hessian.AI
  74. Lottery Prior: Randomized Neural Compression for Zero-Shot Inverse ProblemsHaotian Wu, Di You, Pier Luigi Dragotti et al.
  75. Large Language Models Develop Novel Social Biases Through Adaptive ExplorationAddison J. Wu, Ryan Liu, Xuechunzi Bai et al.
  76. High-accuracy and dimension-free sampling with diffusionsKhashayar Gatmiry, Sitan Chen, Adil Salim
  77. Robust Harmful Features Under Jailbreak Attacks: Mechanistic Evidence from Attention Head Specialization in Large Language ModelsYanchen Yin, Dongqi Han, Linghui Li
  78. The Flexibility Trap: Rethinking the Value of Arbitrary Order in Diffusion Language ModelsZanlin Ni, Shenzhi Wang, Yang Yue et al.
  79. Is Your LLM Overcharging You? Tokenization, Transparency, and IncentivesAnder Artola Velasco, Stratis Tsirtsis, Nastaran Okati et al.
  80. Mechanistic Data Attribution: Tracing the Training Origins of Interpretable LLM UnitsJianhui Chen, Yuzhang Luo, Liangming Pan
  81. Video-Based Optimal Transport for Feedback-Efficient Offline Preference-Based Reinforcement LearningMinh-Tung Luu, Hwanhee Kim, Younghwan Lee et al.
  82. Scalable Event Cloud Network for Event-based ClassificationHongwei Ren, Fei Ma, Xiaopeng LIN et al.
  83. Towards Fair Sequential Decision-Making: A Causal Decomposition ApproachJiajun Chen, Jin Tian, Chris Quinn
  84. When the Prompt Becomes Visual: Vision-Centric Jailbreak Attacks for Large Image Editing ModelsJiacheng Hou, Yining Sun, Ruochong Jin et al.
  85. A Recursive Decomposition Framework for Causal Structure Learning in the Presence of Latent VariablesZheng Li, Feng Xie, Shenglan Nie et al.
  86. ConFlux: Multivariate Time Series in Flux, One Unified Forecast in ConfluenceShiyu Wang, Yuchen Fang, Juntong Ni et al.
  87. CAT-Q: Cost-efficient and Accurate Ternary Quantization for LLMsShigeng Wang, Chao Li, Yangyuxuan Kang et al.
  88. CoEvol-NO: State and Coordinate Co-Evolution with an Error-Driven Predictor-Corrector Paradigm for Neural Operator TransformerJianqiao Zeng, Ruocheng Wang, Yanzhi Liu et al.
  89. DPO Unchained: Your Training Algorithm is Secretly Disentangled in Human Choice Theory (and Its Loss' Convexity is Dispensable)Wenxuan Zhou, Shujian Zhang, brice magdalou et al.
  90. Position: The Alignment Community is Unintentionally Building a Censor’s ToolkitSarah Ball, Phil Hackemann
  91. From Abstraction to Instantiation: Learning Behavioral Representation for Vision-Language-Action ModelBing Hu, Zaijing Li, Rui Shao et al.
  92. Information Flow Reveals When to Trust Language ModelsRui Xu, Yi Chen, Jiujiu Chen et al.
  93. From Text to Forecasts: Bridging Modality Gap with Temporal Evolution Semantic SpaceLehui Li, Yuyao Wang, Jisheng Yan et al.
  94. High-accuracy sampling for diffusion models and log-concave distributionsFan Chen, Sinho Chewi, Constantinos Daskalakis et al.
  95. From Pixels to Tokens: A Systematic Study of Latent Action Supervision for Vision-Language-Action ModelsYihan Lin, Haoyang Li, Yang Li et al.
  96. POET-X: Memory-efficient LLM Training by Scaling Orthogonal TransformationZeju Qiu, Lixin LIU, Adrian Weller et al.
  97. DISCO: Mitigating Bias in Deep Learning with Conditional Distance CorrelationEmre Kavak, Tom Nuno Wolf, Christian Wachinger
  98. Geometric Flow Grounding: A Unified Manifold Decoupling Framework for Dynamics Discovery and VerificationChang Yu, Yuxuan Luo, Yixuan Du et al.
  99. Pretrained Vision-Language-Action Models are Surprisingly Resistant to Forgetting in Continual LearningHuihan Liu, Changyeon Kim, Bo Liu et al.
  100. Solving Time-Dependent Differential Equations with Physical Dynamical SystemsChuan Liu, Yijie Chen, Ruibing Song et al.
  101. Modeling Hierarchical Thinking in Large Reasoning ModelsG M Shahariar, Erfan Shayegani, Ali Nazari et al.
  102. Rational TransductorsMehryar Mohri
  103. Markov Chain Monte Carlo without Evaluating the Target: an Auxiliary Variable ApproachWei Yuan, Guanyang Wang
  104. Disentangling Latent Risk Pathways via Bayesian Hypergraph InferenceShengxian Ding, Haonan Gao, Pangpang Liu et al.
  105. ReQAT: Achieving Full-Precision Reasoning Accuracy with 4-bit Floating-Point Quantization-Aware TrainingJanghwan Lee, Sihwa Lee, Jinseok Kim et al.
  106. Path-dependent Discrete Amortized InferenceTiago Silva, Esmeralda S. Whitammer, Salem Lahlou
  107. To Grok Grokking: Provable Grokking in Ridge RegressionMingyue Xu, Gal Vardi, Itay Safran
  108. Training-Free Bayesian Filtering with Generative EmulatorsThomas Savary, François Rozet, Gilles Louppe
  109. XR-1: Towards Versatile Vision-Language-Action Models via Learning Unified Vision-Motion RepresentationsShichao Fan, Kun Wu, Zhengping Che et al.
  110. Skip a Layer or Loop It? Learning Program-of-Layers in LLMsZiyue Li, Yang Li, Tianyi Zhou
  111. On the Identifiability of Poisson Branching Structural Causal Model Under Latent ConfoundingJie Qiao, Zihuai Zeng, Ruichu Cai et al.
  112. Reward-free Alignment for Conflicting ObjectivesPeter Chen, Xiaopeng Li, Xi Chen et al.
  113. Mind Your Margin and Boundary: Are Your Distilled Datasets Truly Robust?Muquan Li, Yingyi Ma, Yihong Huang et al.
  114. Position: There are futures that benchmark-driven AI cannot seeSobhan Lotfi, Ava Iranmanesh, Lachin Naghashyar et al.
  115. FlatLand: Personalized Graph Federated Learning via Tailored Lorentz SpaceJiahong Liu, Ram Samarth B B, Xinyu Fu et al.
  116. Necessary Conditions for Compositional Generalization of Embedding ModelsArnas Uselis, Andrea Dittadi, Seong Joon Oh
  117. 3ViewSense: Spatial and Mental Perspective Reasoning from Orthographic Views in Vision-Language ModelsShaoxiong Zhan, Yanlin Lai, Zheng Liu et al.
  118. Midtraining Bridges Pretraining and Posttraining DistributionsEmmy Liu, Graham Neubig, Chenyan Xiong
  119. Distributional Inverse Reinforcement LearningFeiyang Wu, Ye Zhao, Anqi Wu
  120. ThreadWeaver: Adaptive Threading for Efficient Parallel Reasoning in Language ModelsLong (Tony) Lian, Sida Wang, Felix Juefei-Xu et al.
  121. On the Difficulty of Learning a Meta-network for Training Data SelectionZilin Du, Junqi Zhao, Albert Boyang Li
  122. On Computation and Reinforcement LearningRaj Ghugare, Michał Bortkiewicz, Alicja Ziarko et al.
  123. Non-Euclidean Gradient Descent Operates at the Edge of StabilityRustem Islamov, Michael Crawshaw, Jeremy Cohen et al.
  124. CausalGame: Benchmarking Causal Thinking of LLM Agents in GamesZhenhao Chen, Yongqiang Chen, Chenxi Liu et al.
  125. MV-FGAD: Towards Efficient and Effective Federated Graph Anomaly Detection via Multi-view LearningJunyi Yan, KE LIANG, Hao Yu et al.
  126. Agent0-VL: Exploring Self-Evolving Agent for Tool-Integrated Vision-Language ReasoningJiaqi Liu, Kaiwen Xiong, Peng Xia et al.
  127. PRISM: Gauge-Invariant Tangent-Space Differentially Private LoRAShihao Wang, Xueru Zhang
  128. TokSuite: Measuring the Impact of Tokenizer Choice on Language Model BehaviorGül Sena Altıntaş, Malikeh Ehghaghi, Brian Lester et al.
  129. The Signal is in the Steps: Local Scoring for Reasoning Data SelectionHoang Anh Just, Myeongseob Ko, Ruoxi Jia
  130. Second-Order Smooth Planning with Optimal-Transport Bellman SmoothingTuan Dam
  131. Characterizing, Evaluating, and Optimizing Complex ReasoningHaoran Zhang, Yafu Li, Zhi Wang et al.
  132. PhenoBrain: Phenotype-Conditioned Long-Range Communication for Multi-Modal Brain Network AnalysisLingyuan Meng, KE LIANG, Hao Li et al.
  133. Holi-Spatial: Evolving Video Streams into Holistic 3D Spatial IntelligenceYuanyuan Gao, Hao Li, Yifei Liu et al.
  134. Robust Contextual Optimization with Missing CovariatesQingyuan Xu, Ruiwei Jiang
  135. Towards Hierarchy–Uniformity Equilibrium: Recovering Semantic Depth in Hypergraph Contrastive LearningRuiting Zhao, Ming Li, Lixin Cui et al.
  136. Transforming Weather Data from Pixel to Latent SpaceSijie Zhao, Feng Liu, Xueliang Zhang et al.
  137. SpatioLM: Towards General Physical Spatial Intelligence in Vision-Language Modelsjing wu, Jianhua Wu, Jiayi Guan et al.
  138. Stabilizing the Q-Gradient Field for Policy Smoothness in Actor-Critic MethodsJeong Woon Lee, Kyoleen Kwak, Daeho Kim et al.
  139. Rare Event Analysis of Large Language ModelsJake McAllister Dorman, Edward Gillman, Dominic C Rose et al.
  140. WeDLM: Reconciling Diffusion Language Models with Standard Causal Attention for Fast InferenceAiwei Liu, Minghua He, Shaoxun Zeng et al.
  141. A Random Matrix Perspective on the Consistency of Diffusion ModelsBinxu Wang, Jacob A Zavatone-Veth, Cengiz Pehlevan
  142. Expressivity-Efficiency Tradeoffs for Hybrid Sequence ModelsJohn Cooper, Mingchen Ma, Ilias Diakonikolas et al.
  143. $\tau^2$-Bench: Evaluating Conversational Agents in a Dual-Control EnvironmentVictor Barres, Honghua Dong, Soham Ray et al.
  144. DOUBT: Decoupled Object-level Understanding and Bridging via vMF-based Trustworthiness for Hallucination Detection in MLLMsKaiqi Chen, Yang Qin, Changhao He et al.
  145. Faster Activation Functions at the Edge for Post-Training SpeedupsAnton Lydike, Jun Bi, Jackson Woodruff
  146. Position: AI Should Facilitate Democratic Deliberation at ScaleJosé Ramón Enríquez, Jiaxin Pei, Alex Pentland
  147. Position: AI/ML Deepfake Research is Misaligned with AI Generated Non-Consensual Intimate Imagery (AIG-NCII)Qiwei Li, Wells Lucas Santo, Sarita Schoenebeck et al.
  148. Equilibrium Pricing in Oligopolistic Data MarketsBhaskar Ray Chaudhury, Jugal Garg, Eklavya Sharma et al.
  149. FlashSinkhorn: IO-Aware Entropic Optimal Transport on GPUFelix X.-F. Ye, Xingjie Li, An Yu et al.
  150. Characterizing Agents in ProductionMelissa Pan, Negar Arabzadeh, Riccardo Cogo et al.
  151. Learning to Theorize the World from ObservationDoojin Baek, Gyubin Lee, Junyeob Baek et al.
  152. How much can language models memorize?John Morris, Chawin Sitawarin, Narine Kokhlikyan et al.
  153. Equivalence of Context and Parameter Updates in Modern Transformer BlocksAdrian Goldwaser, Michael Munn, Xavi Gonzalvo et al.
  154. GoodDiffusion: Proactive Copyright Protection for Diffusion Generative Models via Learnable Sample-specific SignaturesShixi Qin, zhiyong yang, Shilong Bao et al.
  155. Focus and Dilution: The Multi-stage Learning Process of AttentionZheng-An Chen, Pengxiao Lin, Zhi-Qin John Xu et al.
  156. FlashSketch: Sketch-Kernel Co-Design for Fast Sparse Sketching on GPUsRajat Vadiraj Dwaraknath, Sungyoon Kim, Mert Pilanci
  157. Nash Equilibria in Games with Playerwise Concave Coupling Constraints: Existence and ComputationPhilip Jordan, Maryam Kamgarpour
  158. CVE-Factory: Scaling Expert-Level Agentic Tasks for Code Security VulnerabilityXianzhen Luo, Jingyuan Zhang, Shiqi Zhou et al.
  159. Orthogonal Concept Erasure for Diffusion ModelsYuhao Sun, Lingyun Yu, Hao-Xiang Xu et al.
  160. Prescriptive Scaling Reveals the Evolution of Language Model CapabilitiesHanlin Zhang, Jikai Jin, Vasilis Syrgkanis et al.
  161. On the Limits of LLM Adaptability: Impact of LLM Pre-Training on Annotation Task PerformanceEtienne Casanova, Rafal Kocielnik, R. Michael Alvarez
  162. Privacy-Aware Video Anomaly Detection: Guided Orthogonal Projection and a Comprehensive Evaluation FrameworkWenxiang Diao, Lei Wang, Andrew Busch et al.
  163. Procedural Pretraining: Warming Up Language Models with Abstract DataLiangze Jiang, Zachary Shinnick, Anton Hengel et al.
  164. Towards Long-Horizon Interpretability: Efficient and Faithful Multi-Token Attribution for Reasoning LLMsWenbo Pan, Zhichao Liu, Xianlong Wang et al.
  165. Which Algorithms Can Graph Neural Networks Learn?Solveig Wittig, Antonis Vasileiou, Robert R. Nerem et al.
  166. What Preferences Can—and Cannot—Predict in Multi-Agent Online LearningOmar Abbadi, Rida Laraki, Panayotis Mertikopoulos
  167. OMAC: A Holistic Optimization Framework for LLM-Based Multi-Agent CollaborationShijun Li, Hilaf Hasson, Joydeep Ghosh
  168. SoftJAX & SoftTorch: Empowering Automatic Differentiation Libraries with Informative GradientsAnselm Paulus, Andreas René Geist, Vit Musil et al.

← Browse the whole archive