ICML2026 Notes TODO¶
Total: 1847 | Completed: 1847 | Pending: 0
- "I've Seen How This Goes": Characterizing LLM vs. Human Writing Diversity using Progressive Conditional Surprisal | arXiv: 2606.01811
- \(\mathbb{R}^{2k}\) is Theoretically Large Enough for Embedding-based Top-\(k\) Retrieval | arXiv: 2601.20844
- \(f\)-Divergence Regularized RLHF: Two Tales of Sampling and Unified Analyses | arXiv: 2605.06977
- \(f\)-Trajectory Balance: A Loss Family for Tuning GFlowNets, Generative Models, and LLMs with Off- and On-Policy Data | arXiv: 2605.15417
- \(α\)-PFN: Fast Entropy Search via In-Context Learning | arXiv: 2606.07134
- (HB-ARFM) History-Bootstrapped Flow Matching for Inverse Boiling Reconstruction | arXiv: 2606.00349
- (Sparse) Attention to the Details: Preserving Spectral Fidelity in ML-based Weather Forecasting Models | arXiv: 2604.16429
- 3D-RFT: Reinforcement Fine-Tuning for Video-based 3D Scene Understanding | arXiv: 2603.04976
- 3ViewSense: Spatial and Mental Perspective Reasoning from Orthographic Views in Vision-Language Models | arXiv: 2603.07751
- 4DPC\(^2\)hat: Towards Dynamic Point Cloud Understanding with Failure-Aware Bootstrapping | arXiv: 2602.03890
- A Behavioural and Representational Evaluation of Goal-Directedness in Language Model Agents | arXiv: 2602.08964
- A Benchmark and Framework for Evaluating Next Action Predictions in Spreadsheets | arXiv: 2606.13802
- A Call to Lagrangian Action: Learning Population Mechanics from Temporal Snapshots | arXiv: 2605.08550
- A Deep Learning Model of Mental Rotation Informed by Interactive VR Experiments | arXiv: 2512.13517
- A Diffusive Classification Loss for Learning Energy-based Generative Models | arXiv: 2601.21025
- A Formal Comparison Between Chain of Thought and Latent Thought | arXiv: 2509.25239
- A Fully First-Order Layer for Differentiable Optimization | arXiv: 2512.02494
- A General Framework for Dynamic Consistent Submodular Maximization | arXiv: 2606.04946
- A Geometric Relation of the Error Introduced by Sampling a Language Model's Output Distribution to its Internal State | arXiv: 2605.04899
- A Hypertoroidal Covering for Perfect Color Equivariance | arXiv: 2603.04256
- A Kinetic Energy Perspective of Flow Matching | arXiv: 2602.07928
- A Language-Guided Bayesian Optimization for Efficient LoRA Hyperparameter Search | arXiv: 2602.11171
- A Machine-Learned Comorbidity Index | arXiv: 2606.17450
- A Minimal Agent for Automated Theorem Proving | arXiv: 2602.24273
- A Paired Testing Protocol for Batch-Conditioned Refusal Robustness in LLM Serving | arXiv: 2605.27763
- A Perturbation Approach to Unconstrained Linear Bandits | arXiv: 2603.28201
- A Queueing-Theoretic Framework for Stability Analysis of LLM Inference with KV Cache Memory Constraints | arXiv: 2605.04595
- A Refined Generalization Analysis for Extreme Multi-class Supervised Contrastive Representation Learning | arXiv: 2605.07596
- A Risk Decomposition Framework for Pre-Hoc Fine-Tuning Prediction | arXiv: 2606.17649
- A Semantically Consistent Dataset for Data-Efficient Query-Based Universal Sound Separation | arXiv: 2601.22599
- A Systematic Investigation of RL-Jailbreaking in LLMs | arXiv: 2605.07032
- A Systematic Study of Behavioral Cloning for Scientific Data Annotation | arXiv: 2606.07568
- A Unified Definition of Hallucination: It's The World Model, Stupid! | arXiv: 2512.21577
- A Unified Framework for Diffusion Model Unlearning with f-Divergence | arXiv: 2509.21167
- A2SG: Adaptive and Asymmetric Surrogate Gradients for Training Deep Spiking Neural Networks | arXiv: 2606.11236
- AAD-1: Asymmetric Adversarial Distillation for One-Step Autoregressive Video Generation | arXiv: 2606.03972
- ABC-Bench: An Agentic Bio-Capabilities Benchmark for Biosecurity | arXiv: 2606.11150
- AC-ODM: Actor–Critic Online Data Mixing for Sample-Efficient LLM Pretraining | arXiv: 2505.23878
- Accelerated Multiple Wasserstein Gradient Flows for Multi-objective Distributional Optimization | arXiv: 2601.19220
- Accurate Evaluation of Quickest Changepoint Detectors via Non-parametric Survival Analysis | arXiv: 2605.18798
- ACON: Optimizing Context Compression for Long-horizon LLM Agents | arXiv: 2510.00615
- ACTG-ARL: Differentially Private Conditional Text Generation with RL-Boosted Control | arXiv: 2510.18232
- Activation-Free Backbones for Image Recognition: Polynomial Alternatives within MetaFormer-Style Vision Models | arXiv: 2605.20839
- Active Budget Allocation for Efficient Scaling Law Estimation via Surrogate-Guided Pruning | arXiv: 2605.17234
- Active Continual Learning with Metaplastic Binary Bayesian Neural Networks | arXiv: 2605.30198
- Active Exploring like a Pigeon: Reinforcing Spatial Reasoning via Agentic Vision-Language Models | arXiv: 2606.02459
- Active Learning with Foundation Model Priors: Efficient Learning under Class Imbalance | arXiv: 2606.07630
- Active Learning with Low-Rank Structure for Data Selection | arXiv: 2606.16045
- Active Tabular Augmentation via Policy-Guided Diffusion Inpainting | arXiv: 2605.10315
- Active Timepoint Selection for Learning Measure-Valued Trajectories | arXiv: 2605.30625
- ACTIVE-o3: Empowering MLLMs with Active Perception via Pure Reinforcement Learning | arXiv: 2505.21457
- AdaEraser: Training-Free Object Removal via Adaptive Attention Suppression | arXiv: 2605.15921
- AdaGC: Enhancing LLM Pretraining Stability via Adaptive Gradient Clipping | arXiv: 2502.11034
- AdaMEM: Test-Time Adaptive Memory for Language Agents | arXiv: 2606.05684
- Adapting Noise to Data: Generative Flows from Learned 1D Processes | arXiv: 2510.12636
- Adaptive Bandit Algorithms for Contextual Matching Markets | arXiv: 2605.28290
- Adaptive Estimation and Inference in Semi-parametric Heterogeneous Clustered Multitask Learning via Neyman Orthogonality | arXiv: 2605.01907
- Adaptive Multi-Round Allocation with Stochastic Arrivals | arXiv: 2605.12111
- Adaptive Preconditioners Trigger Loss Spikes in Adam | arXiv: 2506.04805
- Adaptive Probe-based Steering for Robust LLM Jailbreaking | arXiv: 2605.20286
- Adaptive Querying with AI Persona Priors | arXiv: 2605.00696
- Adaptive Residual-Update Steering for Low-Overhead Hallucination Mitigation in Large Vision Language Models | arXiv: 2511.10292
- Adaptive Sharpness-Aware Minimization with a Polyak-type Step size: A Theory-Grounded Scheduler | arXiv: 2606.01827
- Adaptive Time Series Reasoning via Segment Selection | arXiv: 2602.18645
- Adaptive Volumetric Mechanical Property Fields Invariant to Resolution | arXiv: 2606.18231
- Advancing Ligand-based Virtual Screening and Molecular Generation with Pretrained Molecular Embedding Distance | arXiv: 2604.24474
- Advantage Collapse in Group Relative Policy Optimization: Diagnosis and Mitigation | arXiv: 2605.21125
- Advantages of Non-Smooth Components in Vision Transformer Fine-Tuning | arXiv: 2602.06883
- Adversarial Flow Models | arXiv: 2511.22475
- Adversarially Robust Approximate Furthest Neighbor | arXiv: 2605.16618
- AesFormer: Transform Everyday Photos into Beautiful Memories | arXiv: 2605.22126
- AG-REPA: Causal Layer Selection for Representation Alignment in Audio Flow Matching | arXiv: 2603.01006
- Agent JIT Compilation for Latency-Optimizing Web Agent Planning and Scheduling | arXiv: 2605.21470
- Agent Learning via Early Experience | arXiv: 2510.08558
- Agent World Model: Infinity Synthetic Environments for Agentic Reinforcement Learning | arXiv: 2602.10090
- Agent-Omit: Adaptive Context Omission for Efficient LLM Agents | arXiv: 2602.04284
- AgentHijack: Benchmarking Computer Use Agent Robustness to Common Environment Corruptions | arXiv: 2605.25707
- Agentic Monte Carlo: Simulating Reinforcement Learning for Black-Box Agents | arXiv: 2606.05296
- AgentXRay: White-Boxing Agentic Systems via Workflow Reconstruction | arXiv: 2602.05353
- AGZO: Activation-Guided Zeroth-Order Optimization for LLM Fine-Tuning | arXiv: 2601.17261
- AI Cap-and-Trade: Efficiency Incentives for Accessibility and Sustainability | arXiv: 2601.19886
- AI Engram: In Search of Memory Traces in Artificial Intelligence | arXiv: 2606.14997
- AI4SLT: Empirical Processes in Lean 4 for Formal Statistical Learning Theory | arXiv: 2602.02285
- Aitchison Embeddings for Learning Compositional Graph Representations | arXiv: 2605.00716
- Alethia: A Foundational Encoder for Voice Deepfakes | arXiv: 2605.00251
- Algorithmic Recourse of In-Context Learning for Tabular Data | arXiv: 2605.31272
- AlgoVeri: An Aligned Benchmark for Verified Code Generation on Classical Algorithms | arXiv: 2602.09464
- Aligning Tree-Search Policies with Fixed Token Budgets in Test-Time Scaling of LLMs | arXiv: 2602.09574
- Alignment Risks from Capability-Seeking RL Training | arXiv: 2602.12124
- Alignment Tampering: How Reinforcement Learning from Human Feedback Is Exploited to Optimize Misaligned Biases | arXiv: 2605.27355
- Alignment-Aware Decoding | arXiv: 2509.26169
- Alignment-Guided Score Matching for Text-to-Image Alignment in Diffusion Models | arXiv: 2605.30038
- AliMark: Enhancing Robustness of Sentence-Level Watermarking Against Text Paraphrasing | arXiv: 2605.29434
- All Circuits Lead to Rome: Rethinking Functional Anisotropy in Circuit and Sheaf Discovery for LLMs | arXiv: 2605.12671
- ALSO: Adversarial Online Strategy Optimization for Social Agents | arXiv: 2605.15768
- Alterbute: Editing Intrinsic Attributes of Objects in Images | arXiv: 2601.10714
- AMDP: Asynchronous Multi-Directional Pipeline Parallelism for Large-Scale Models Training | arXiv: 2605.29664
- Amortized Simulation-Based Inference in Generalized Bayes via Neural Posterior Estimation | arXiv: 2601.22367
- An Algebraic View of the Expressivity of Recurrent Language Models | arXiv: 2606.01765
- An Approximation Algorithm for Graph Label Selection | arXiv: 2605.18623
- An Exterior Method for Nonnegative Matrix Factorization | arXiv: 2605.19325
- An Information-Theoretic Criterion for Efficient Data Synthesis | arXiv: 2605.16379
- An Odd Estimator for Shapley Values | arXiv: 2602.01399
- Analytic Bijections for Smooth and Interpretable Normalizing Flows | arXiv: 2601.10774
- Anchor-guided Hypergraph Condensation with Dual-level Discrimination | arXiv: 2605.10001
- ANCHOR: Abductive Network Construction with Hierarchical Orchestration for Reliable Probability Inference in Large Language Models | arXiv: 2605.10328
- Anchored Decoding: Provably Reducing Copyright Risk for Any Language Model | arXiv: 2602.07120
- Angel or Demon: Investigating the Plasticity Interventions' Impact on Backdoor Threats in Deep Reinforcement Learning | arXiv: 2605.14587
- Annotations Mitigate Post-Training Mode Collapse | arXiv: 2605.09995
- Anomaly-Preference Image Generation (APO) | arXiv: 2605.02439
- AnomSeer: Reinforcing Multimodal LLMs to Reason for Time-Series Anomaly Detection | arXiv: 2602.08868
- Answer Only as Precisely as Justified: Calibrated Claim-Level Specificity Control for Agentic Systems | arXiv: 2604.17487
- ANTIC: Adaptive Neural Temporal In-situ Compressor | arXiv: 2604.09543
- Antidistillation Fingerprinting | arXiv: 2602.03812
- Any2Any: Unified Arbitrary Modality Translation for Remote Sensing | arXiv: 2603.04114
- Any3D-VLA: Enhancing VLA Robustness via Diverse Point Clouds | arXiv: 2602.00807
- AnyEdit++: Adaptive Long-Form Knowledge Editing via Bayesian Surprise | arXiv: 2606.01053
- AnyMod-LLVE: Low-Light Video Enhancement with Modality-Agnostic Inference | arXiv: 2606.11186
- AOEPT: Breaking the Implicit Modality-Reduction Bottleneck in Modality-Missing Prompt Tuning | arXiv: 2605.24816
- APEIRIA: Distilling Neuro-Symbolic Programs into 3D Multi-modal LLMs | arXiv: 2606.01215
- ArcVQ-VAE: A Spherical Vector Quantization Framework with ArcCosine Additive Margin | arXiv: 2605.13517
- Are Common Substructures Transferable? Riemannian Graph Foundation Model with Neural Vector Bundles | arXiv: 2606.03270
- Are Large Reasoning Models Interruptible? | arXiv: 2510.11713
- Are Tools Always Beneficial? Learning to Invoke Tools Adaptively for Dual-Mode Multimodal LLM Reasoning | arXiv: 2605.19852
- Are VLMs Seeing or Just Saying? Uncovering the Illusion of Visual Re-examination | arXiv: 2605.15864
- Are We Overconfident in Models and Results for Semi-Supervised 3D Medical Image Segmentation? | arXiv: 2605.25561
- AREA: Attribute Extraction and Aggregation for CLIP-Based Class-Incremental Learning | arXiv: 2605.28809
- ASAP: Exploiting the Satisficing Generalization Edge in Neural Combinatorial Optimization | arXiv: 2501.17377
- Asymmetric Perturbation in Solving Bilinear Saddle-Point Optimization | arXiv: 2506.05747
- Asymptotic Optimality of the High-Dimensional Gaussian Mechanism and Improved Low-Dimensional Mechanisms for Differential Privacy | arXiv: 2606.08681
- AtelierEval: Agentic Evaluation of Humans & LLMs as Text-to-Image Prompters | arXiv: 2605.22645
- ATHA: Improving CLIP Adaptation on Source-Free Cross-Domain Few-Shot Learning by Breaking Tail Alignment | arXiv: 2605.29776
- Attend to Anything: Foundation Model for Unified Human Attention Modeling | arXiv: 2606.03540
- Attention Illuminates LLM Reasoning: The Preplan-and-Anchor Rhythm Enables Fine-Grained Policy Optimization | arXiv: 2510.13554
- Attention Sparsity is Input-Stable: Training-Free Sparse Attention for Video Generation via Offline Sparsity Profiling and Online QK Co-Clustering | arXiv: 2603.18636
- Auditing and Fixing Economic Validity in Tabular Foundation Models for Discrete Choice | arXiv: 2605.26559
- Auditing Sybil: Explaining Deep Lung Cancer Risk Prediction Through Generative Interventional Attributions | arXiv: 2602.02560
- Authority, Truth, and Citation Bias: A Large-Scale Multi-Domain Benchmark for Studying Epistemic Susceptibility in Large Language Models | arXiv: 2606.13104
- AutoBaxBuilder: Bootstrapping Code Security Benchmarking | arXiv: 2512.21132
- Automated Formal Proofs of Combinatorial Identities via Wilf–Zeilberger Guidance and LLMs | arXiv: 2605.04472
- Automatic Layer Selection for Hallucination Detection | arXiv: 2605.26366
- Automatic Unsupervised Ensemble Outlier Model Selection–Extended Version | arXiv: 2605.16567
- AutoNumerics-Zero: Automated Discovery of State-of-the-Art Mathematical Functions | arXiv: 2312.08472
- Autoregressive Direct Preference Optimization | arXiv: 2602.09533
- AutoRPA: Efficient GUI Automation through LLM-Driven Code Synthesis from Interactions | arXiv: 2605.21082
- AvAtar: Learning to Align via Active Optimal Transport | arXiv: 2605.24395
- AVI-Bench: Toward Human-like Audio-Visual Intelligence of Omni-MLLMs | arXiv: 2606.07643
- AVTrack: Audio-Visual Tracking in Human-centric Complex Scenes | arXiv: 2606.02724
- Bad Seeing or Bad Thinking? Rewarding Perception for Vision-Language Reasoning | arXiv: 2605.14054
- Balanced LoRA: Removing Parameter Invariance to Accelerate Convergence | arXiv: 2605.31484
- Balancing Fidelity and Diversity in Diffusion Models via Symmetric Attention Decomposition: Hopfield Perspective | arXiv: 2605.27476
- Balancing Learning Rates Across Layers: Exact Two-Step Dynamics and Optimal Scaling in Linear Neural Networks | arXiv: 2606.00340
- BALLAST: Bayesian Active Learning with Look-ahead Amendment for Sea-drifter Trajectories under Spatio-Temporal Vector Fields | arXiv: 2509.26005
- Bandit Social Learning with Exploration Episodes | arXiv: 2602.05835
- Barriers to Counterfactual Credit Attribution for Autoregressive Models | arXiv: 2605.01425
- Bayesian Gated Non-Negative Contrastive Learning | arXiv: 2605.28441
- Bayesian Tensor Decomposition with Diffusion Model Prior | arXiv: 2606.03212
- BEAR: Dissecting Embodied Abilities in Multimodal Language Models through Skill-level Evaluation and Diagnosis | arXiv: 2510.08759
- Benchmarking and Enhancing VLM for Compressed Image Understanding | arXiv: 2512.20901
- Benchmarks for Vision-Language Models in Urban Perception Should Be Reliability-Aware and Negotiated | arXiv: 2606.00871
- BESPOKE: Benchmark for Search-Augmented Large Language Model Personalization via Diagnostic Feedback | arXiv: 2509.21106
- Beyond Additive Decompositions: Interpretability Through Separability | arXiv: 2605.31200
- Beyond Classification: A Cough Regression Benchmark for Respiratory Acoustic Foundation Models | arXiv: 2606.15436
- Beyond Detection: A Structure-Aware Framework for Scene Text Tracking | arXiv: 2605.17270
- Beyond Distribution Estimation: Simplex Anchored Structural Inference Towards Universal Semi-Supervised Learning | arXiv: 2605.07557
- Beyond Extrapolation: Knowledge Utilization Paradigm with Bidirectional Inspiration for Time Series Forecasting | arXiv: 2605.19249
- Beyond Generative Priors: Minority Sampling with JEPA-Guided Diffusion | arXiv: 2605.24631
- Beyond Log Likelihood: Probability-Based Objectives for Supervised Fine-Tuning across the Model Capability Continuum | arXiv: 2510.00526
- Beyond Majority Voting: LLM Aggregation by Leveraging Higher-Order Information | arXiv: 2510.01499
- Beyond Model Base Retrieval: Weaving Knowledge to Master Fine-grained Neural Network Design | arXiv: 2507.15336
- Beyond Model Readiness: Institutional Readiness for AI Deployment in Public Systems | arXiv: 2605.17203
- Beyond Procedure: Substantive Fairness in Conformal Prediction | arXiv: 2602.16794
- Beyond Scalar Rewards: Dense Feedback for LLM Policy Synthesis in Sequential Social Dilemmas | arXiv: 2603.19453
- Beyond Structural Symmetries: Linear Mode Connectivity via Neuron Identifiability | arXiv: 2606.04754
- Beyond Sunk Costs: Boosting LLM Pre-training Efficiency via Orthogonal Growth of Mixture-of-Experts | arXiv: 2510.08008
- Beyond Temperature: Hyperfitting as a Late-Stage Geometric Expansion | arXiv: 2605.22579
- Beyond Test-Time Memory: State-Space Optimal Control for LLM Reasoning | arXiv: 2603.09221
- Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training | arXiv: 2505.20110
- Beyond Tokens: Enhancing RTL Quality Estimation via Structural Graph Learning | arXiv: 2508.18730
- Beyond Trajectory-Level Attribution: Graph-Based Credit Assignment for Agentic Reinforcement Learning | arXiv: 2605.26684
- Beyond Two-Stage Training: Cooperative SFT and RL for LLM Reasoning | arXiv: 2509.06948
- Beyond VLM-Based Rewards: Diffusion-Native Latent Reward Modeling | arXiv: 2602.11146
- Biases in the Blind Spot: Detecting What LLMs Fail to Mention | arXiv: 2602.10117
- Bilevel Optimization over Saddle Points of Zero-Sum Markov Games | arXiv: 2605.26654
- BioAgent Bench: An AI Agent Evaluation Suite for Bioinformatics | arXiv: 2601.21800
- BioArc: Discovering Optimal Neural Architectures for Biological Foundation Models | arXiv: 2512.00283
- Black-Box Detection of LLM-Generated Text Using Generalized Jensen-Shannon Divergence | arXiv: 2510.07500
- Blending Supervised and Reinforcement Fine-Tuning with Prefix Sampling | arXiv: 2507.01679
- BlitzRank: Principled Zero-shot Ranking Agents with Tournament Graphs | arXiv: 2602.05448
- BLOCK-EM: Preventing Emergent Misalignment via Latent Blocking | arXiv: 2602.00767
- BoostAPR: Boosting Automated Program Repair via Execution-Grounded Reinforcement Learning with Dual Reward Models | arXiv: 2605.09134
- Boosting Direct Preference Optimization with Penalization | arXiv: 2606.12505
- Bootstrap Your Generator: Unpaired Visual Editing with Flow Matching | arXiv: 2606.03911
- Bounded Hyperbolic Tangent: A Stable and Efficient Alternative to Pre-Layer Normalization in Large Language Models | arXiv: 2601.09719
- Break the Block: Dynamic-size Reasoning Blocks for Diffusion Large Language Models via Monotonic Entropy Descent with Reinforcement Learning | arXiv: 2605.02263
- Breaking Dual Bottlenecks: Evolving Unified Multimodal Models into Self-Adaptive Interleaved Visual Reasoners | arXiv: 2605.14709
- Breaking the Lock-in: Diversifying Text-to-Image Generation via Representation Modulation | arXiv: 2606.06813
- Breaking the MoE LLM Trilemma: Dynamic Expert Clustering with Structured Compression | arXiv: 2510.02345
- Breaking the Simplification Bottleneck in Amortized Neural Symbolic Regression | arXiv: 2602.08885
- Bregman meets Lévy: Stochastic Mirror Descent with Heavy-Tailed Noise in Continuous and Discrete Time | arXiv: 2606.03769
- Bridging Creative Intent and Visual Quality: Creator-Driven Recurrent Video Generation with Agentic Feedback Loops | arXiv: 2606.18591
- Bridging Functional Correctness and Runtime Efficiency Gaps in LLM-Based Code Translation | arXiv: 2606.17683
- Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions | arXiv: 2509.23782
- Budget-Constrained Step-Level Diffusion Caching | arXiv: 2606.13496
- Budget-Feasible Mechanisms for Submodular Welfare Maximization in Procurement Auctions | arXiv: 2605.00411
- BuildArena: A Physics-Aligned Interactive Benchmark of LLMs for Engineering Construction | arXiv: 2510.16559
- Building Reliable Long-Form Generation via Hallucination Rejection Sampling | arXiv: 2606.03628
- Building Social World Models with Large Language Models | arXiv: 2606.11482
- Bulk-Calibrated Credal Ambiguity Sets: Fast, Tractable Decision Making under Out-of-Sample Contamination | arXiv: 2601.21324
- Bullet Trains: Parallelizing Training of Temporally Precise Spiking Neural Networks | arXiv: 2603.13283
- BYORn: Bootstrap Your Own Responses to Defend Large Vision-Language Models Against Backdoor Attacks | arXiv: 2606.02947
- Calibrated Multimodal Representation Learning with Missing Modalities | arXiv: 2511.12034
- Calibrating Uncertainty for Zero-Shot Adversarial CLIP | arXiv: 2512.12997
- Calibration of Structured Ignorance Certificates for Diagnosing Unknown Unknowns in Reasoning Models | arXiv: 2606.08571
- CAME-Grad: The Double Dilemma in Multi-Task Radiology Report Generation — A Gradient Dynamics Analysis and Solution | arXiv: 2605.22635
- CAMEL: Confidence-Gated Reflection for Reward Modeling | arXiv: 2602.20670
- CamGeo: Sparse Camera-Conditioned Image-to-Video Generation with 3D Geometry Prior | arXiv: 2605.30895
- Can Adaptive Gradient Methods Converge under Heavy-Tailed Noise? A Case Study of AdaGrad | arXiv: 2605.18694
- Can Large Language Models Generalize Procedures Across Representations? | arXiv: 2602.03542
- Can Local Learning Match Self-Supervised Backpropagation? | arXiv: 2601.21683
- Can Recommender Systems Teach Themselves? A Recursive Self-Improving Framework with Fidelity Control | arXiv: 2602.15659
- CapBencher: Give Your LLM Benchmark a Built-in Alarm for Test-Set Overfitting | arXiv: 2505.18102
- Capturing Gaze Shifts for Guidance: Cross-Modal Fusion Enhancement for VLM Hallucination Mitigation | arXiv: 2510.22067
- Caracal: Causal Architecture via Spectral Mixing | arXiv: 2605.00292
- CARD: Coarse-to-fine Autoregressive Modeling with Radix-based Decomposition for Transferable Free Energy Estimation | arXiv: 2605.02657
- CARE: Class-Adaptive Expert Consensus for Reliable Learning with Long-Tailed Noisy Labels | arXiv: 2605.23254
- CASCADE Conformal Prediction: Uncertainty-Adaptive Prediction Intervals for Two-Stage Clinical Decision Support | arXiv: 2605.20468
- Cascaded Flow Matching for Heterogeneous Tabular Data with Mixed-Type Features | arXiv: 2601.22816
- Catastrophic Forgetting is Low-Rank: A Function-Space Theory for Continual Adaptation | arXiv: 2606.18024
- Causal Fine-Tuning under Latent Confounded Shift | arXiv: 2410.14375
- Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video | arXiv: 2602.02214
- Causal Modeling of Selection in Evolution | arXiv: 2606.05689
- Causal-JEPA: Learning World Models through Object-Level Latent Masking | arXiv: 2602.11389
- CB-SLICE: Concept-Based Interpretable Error Slice Discovery | arXiv: 2605.29836
- CentaurEval: Benchmarking Human-in-the-Loop Value in Agentic Coding | arXiv: 2512.04111
- Certified Circuits: Stability Guarantees for Mechanistic Circuits | arXiv: 2602.22968
- Certified Robustness under Heterogeneous Perturbations via Hybrid Randomized Smoothing | arXiv: 2605.12876
- CG-MLLM: Captioning and Generating 3D Content via Multi-modal Large Language Models | arXiv: 2601.21798
- Chain-of-Thought Reasoning in the Wild Is Not Always Faithful | arXiv: 2503.08679
- Characterizing the Effect of Noise in Language Generation in the Limit | arXiv: 2601.21237
- CHARM: Using Multimodal JEPA + Channel Descriptions for Time Series Foundation Embedding | arXiv: 2605.31580
- Chebyshev Policies and the Mountain Car Problem: Reinforcement Learning for Low-Dimensional Control Tasks | arXiv: 2605.22305
- Circle-RoPE: Cone-like Decoupled Rotary Positional Embedding for Vision-Language Models | arXiv: 2505.16416
- Circuit Fingerprints: How Answer Tokens Encode Their Geometrical Path | arXiv: 2602.09784
- Circuit Tracing in Autoregressive Protein Language Models | arXiv: 2606.16044
- CLARITree: Cholesky and Lookahead Accelerations for Regression with Interpretable Piecewise Linear Trees | arXiv: 2606.12840
- CLEAR: Context-Aware Learning with End-to-End Mask-Free Inference for Adaptive Video Subtitle Removal | arXiv: 2603.21901
- ClinTutor-R1: Advancing Scalable and Robust One-to-Many Alignment in Clinical Socratic Education | arXiv: 2512.05671
- CLIP Tricks You: Training-free Token Pruning for Efficient Pixel Grounding in Large Vision-Language Models | arXiv: 2605.13178
- Closing the Feedback Loop: From Experience Extraction to Insight Governance in Verbal Reinforcement Learning | arXiv: 2606.17591
- Closing the Loop: PID Feedback Control for Interpretable Activation Steering in Symbolic Music Generation | arXiv: 2606.18790
- CLoVE: Personalized Federated Learning through Clustering of Loss Vector Embeddings | arXiv: 2506.22427
- Clustering as Reasoning: A \(k\)-Means Interpretation of Chain-of-Thought Graph Learning | arXiv: 2605.24867
- CMI-RewardBench: Evaluating Music Reward Models with Compositional Multimodal Instruction | arXiv: 2603.00610
- Coarse-Grained Boltzmann Generators | arXiv: 2602.10637
- CoCoEdit: Content-Consistent Image Editing via Region Regularized Reinforcement Learning | arXiv: 2602.14068
- CoCoReviewBench: A Completeness- and Correctness-Oriented Benchmark for AI Reviewers | arXiv: 2605.07905
- CoDA-Bench: Can Code Agents Handle Data-Intensive Tasks? | arXiv: 2606.15300
- Coevolutionary Continuous Discrete Diffusion: Make Your Diffusion Language Model a Latent Reasoner | arXiv: 2510.03206
- CoFrGeNet: Continued Fraction Architectures for Language Generation | arXiv: 2601.21766
- COFT: Counterfactual-Conformal Decoding for Fair Chain-of-Thought Reasoning in Large Language Models | arXiv: 2605.30641
- Cognitive Fatigue in Autoregressive Transformers: Formalization and Measurement | arXiv: 2605.30981
- CoIRL-AD: Collaborative-Competitive Imitation-Reinforcement Learning in Latent World Models for Autonomous Driving | arXiv: 2510.12560
- CollabBench: Benchmarking and Unleashing Collaborative Ability of LLMs with Diverse Players via Proactive Engagement | arXiv: 2606.05793
- COLLIE: Guiding Skill Discovery in Semantically Coherent Latent Space | arXiv: 2606.00950
- Colorful Pinball: Density-Weighted Quantile Regression for Conditional Guarantee of Conformal Prediction | arXiv: 2512.24139
- Coloring the Noise: Adversarial Sobolev Alignment for Faithful Image Super Resolution | arXiv: 2605.23264
- CombinationTS: A Modular Framework for Understanding Time-Series Forecasting Models | arXiv: 2605.01231
- Complexity as Advantage: A Regret-Based Perspective on Emergent Structure | arXiv: 2511.04590
- Compositional Consistency-Guided Decoding for Three-Way Logical Question Answering | arXiv: 2604.06196
- Compositional Generative Modeling from Decentralized Data | arXiv: 2606.10153
- Compositional Transduction with Latent Analogies for Offline Goal-Conditioned Reinforcement Learning | arXiv: 2605.20609
- Comprehensive AI Governance Requires Addressing Non-Model Gains | arXiv: 2606.00047
- Compress then Merge: From Multiple LoRAs into One Low-Rank Adapter | arXiv: 2606.03723
- Compression as Adaptation: Implicit Visual Representation with Diffusion Foundation Models | arXiv: 2603.07615
- Compute as Teacher: Turning Inference Compute Into Reference-Free Supervision | arXiv: 2509.14234
- Conditional Diffusion Sampling | arXiv: 2605.04013
- Conditional KRR: Injecting Unpenalized Features into Kernel Methods with Applications to Kernel Thresholding | arXiv: 2605.26067
- Conf-Gen: Conformal Uncertainty Quantification for Generative Models | arXiv: 2605.28920
- Conflict-Aware Additive Guidance for Flow Models under Compositional Rewards | arXiv: 2605.20758
- Conflicting Biases at the Edge of Stability: Norm versus Sharpness Regularization | arXiv: 2505.21423
- Conformal Reliability: A New Evaluation Metric for Conditional Generation | arXiv: 2605.30807
- Conformal Thinking: Risk Control for Reasoning on a Compute Budget | arXiv: 2602.03814
- Connecting Independently Trained Modes via Layer-Wise Connectivity | arXiv: 2505.02604
- Conservation Laws for Modern Neural Architectures | arXiv: 2606.17816
- Consistency Training Can Entrench Misalignment | arXiv: 2606.03810
- Consistent Diffusion Language Models | arXiv: 2605.00161
- Constitutional Black-Box Monitoring for Scheming in LLM Agents | arXiv: 2603.00829
- Constrained Bayesian Experimental Design via Online Planning | arXiv: 2605.26990
- Constrained Flow Optimization via Sequential Fine-Tuning for Molecular Design | arXiv: 2605.30610
- Constrained Multi-Objective Reinforcement Learning with Max-Min Criterion | arXiv: 2605.31388
- Content-Style Identification via Differential Independence | arXiv: 2605.17827
- Context-Driven Incremental Compression for Multi-Turn Dialogue Generation | arXiv: 2606.12411
- Contextualized Visual Personalization in Vision-Language Models | arXiv: 2602.03454
- Continual Learning of Domain-Invariant Representations | arXiv: 2605.15775
- Continual Model Routing in Evolving Model Hubs | arXiv: 2605.28577
- Contrastive Representation Regularization for Vision-Language-Action Models | arXiv: 2510.01711
- Contrastive Spectral Rectification: Test-Time Defense towards Zero-shot Adversarial Robustness of CLIP | arXiv: 2601.19210
- Controllable Generative Sandbox for Causal Inference | arXiv: 2603.03587
- Controlling the Risk of Corrupted Contexts for Language Models via Early-Exiting | arXiv: 2510.02480
- Convergence of Steepest Descent and Adam under Non-Uniform Smoothness | arXiv: 2605.30648
- Convergence of Two-Timescale Markovian Stochastic Approximations with Applications in Reinforcement Learning | arXiv: 2605.31172
- Convex Basins in Single-Index Model Loss Landscapes: Applications to Robust Recovery under Strong Adversarial Corruption | arXiv: 2605.29497
- Convex Distance Operator Transport: A Convex and Geometry-Preserving Formulation | arXiv: 2606.02047
- CoOT: Learning to Coordinate In-Context with Coordination Transformers | arXiv: 2506.23549
- COPF: An Online Framework for Deployment-Stable Counterfactual Fairness in Evolving Graphs | arXiv: 2606.00700
- CORE-MTL: Rethinking Gradient Balancing via Causal Orthogonal Representations | arXiv: 2606.02221
- CORE: Conflict-Oriented Reasoning for General Multimodal Manipulation Detection | arXiv: 2606.03066
- Correcting Prompt Dependence in LLM Benchmarks: A Bayesian Hierarchical Model with Embedding-Space Clustering | arXiv: 2510.05709
- Correcting Split Selection in Online Decision Trees via Anytime-Valid Inference | arXiv: 2605.31239
- CorrSteer: Generation-Time LLM Steering via Correlated Sparse Autoencoder Features | arXiv: 2508.12535
- CoSiNE: Conditional Site-Independent Neural Evolution Model for Antibody Sequences | arXiv: 2602.18982
- Cost-Aware Stopping for Bayesian Optimization | arXiv: 2507.12453
- Counterfactual Transport Flows for Offline Conservative Trajectory Refinement | arXiv: 2606.09115
- CountsDiff: A Diffusion Model on the Natural Numbers for Generation and Imputation of Count-Based Data | arXiv: 2604.03779
- Coupled Training with Privileged Information and Unlabeled Data | arXiv: 2605.23268
- Coupled Variational Reinforcement Learning for Language Model General Reasoning | arXiv: 2512.12576
- Courtroom Analogy: New Perspective on Uncertainty-Aware Classification | arXiv: 2605.25616
- CPMöbius: Iterative Coach–Player Reasoning for Data-Free Reinforcement Learning | arXiv: 2602.02979
- Creative Collision: Directorial Persona Steering and Competition in Large Language Models | arXiv: 2606.16240
- CrispEdit: Low-Curvature Projections for Scalable Non-Destructive LLM Editing | arXiv: 2602.15823
- CriticalKV: Optimizing KV Cache Eviction from an Output Perturbation Perspective | arXiv: 2502.03805
- Critique-GRPO: Advancing LLM Reasoning with Natural Language and Numerical Feedback | arXiv: 2506.03106
- Critique-Guided Distillation for Robust Reasoning via Refinement | arXiv: 2505.11628
- Cross-Chirality Generalization by Axial Vectors for Hetero-Chiral Protein-Peptide Interaction Design | arXiv: 2602.20176
- CSMR (Look on Demand): A Cognitive Scheduling Framework for Visual Evidence Acquisition in Multimodal Reasoning | arXiv: 2605.28160
- CSPO: Constraint-Sensitive Policy Optimization for Safe Reinforcement Learning | arXiv: 2606.14415
- Culturally-Adapted Red-Teaming Across East and Southeast Asian Contexts: A Methodological and Comparative Analysis | arXiv: 2606.09178
- Curriculum Learning for Safety Alignment | arXiv: 2605.26315
- Cutting LLM Evaluation Costs with SySRs: A Bandit Algorithm that Provably Exploits Model Similarity | arXiv: 2606.07726
- CVSearch: Empowering Multimodal LLMs with Cognitive Visual Search for High-Resolution Image Perception | arXiv: 2605.23655
- CyberGym-E2E: Scalable Real-World Benchmark for AI Agents' End-to-End Cybersecurity Capabilities | arXiv: 2606.04460
- CyberJurors: A Multi-Agent Simulation Task for E-Commerce Disputes Verdict | arXiv: 2605.28369
- D\(^2\)Evo: Dual Difficulty-Aware Self-Evolution for Data-Efficient Reinforcement Learning | arXiv: 2605.17037
- d2: Improving Reasoning in Diffusion Language Models via Trajectory Likelihood Estimation | arXiv: 2509.21474
- DAG-MoE: From Simple Mixture to Structural Aggregation in Mixture-of-Experts | arXiv: 2606.01062
- DAG: A Dual Correlation Network for Time Series Forecasting with Exogenous Variables | arXiv: 2509.14933
- DAPD: Dependency-Aware Parallel Decoding via Attention for Diffusion LLMs | arXiv: 2603.12996
- DARTS: Distribution-Aware Active Rollout Trajectory Shaping for Accelerating LLM Reinforcement Learning | arXiv: 2605.30859
- Data Augmentation of Contrastive Learning is Estimating Positive-incentive Noise | arXiv: 2408.09929
- Data Difficulty and the Generalization--Extrapolation Tradeoff in LLM Fine-Tuning | arXiv: 2605.12906
- Data- and Variance-dependent Regret Bounds for Online Tabular MDPs | arXiv: 2602.01903
- DCER: Robust Multimodal Fusion via Dual-Stage Compression and Energy-Based Reconstruction | arXiv: 2602.04904
- Debate with Images: Detecting Deceptive Behaviors in Multimodal Large Language Models | arXiv: 2512.00349
- Decentralized Instruction Tuning: Conflict-Aware Splitting and Weight Merging | arXiv: 2606.01717
- DecepChain: Inducing Deceptive Reasoning in Large Language Models | arXiv: 2510.00319
- Decision Tree Learning on Product Spaces | arXiv: 2605.12983
- Decompose and Recompose: Reasoning New Skills from Existing Abilities for Cross-Task Robotic Manipulation | arXiv: 2605.01448
- Decompose, Structure, and Repair: A Neuro-Symbolic Framework for Autoformalization via Operator Trees | arXiv: 2604.19000
- Decomposed On-Policy Distillation for Vision-Language Reasoning: Steering Gradients for Visual Grounding | arXiv: 2606.00564
- Decomposing the Basic Abilities of Large Language Models: Mitigating Cross-Task Interference in Multi-Task Instruct-Tuning | arXiv: 2605.05676
- Decouple Searching from Training: Scaling Data Mixing via Model Merging for Large Language Model Pre-training | arXiv: 2602.00747
- Decoupled Conformal Optimisation: Efficient Prediction Sets via Independent Tuning and Calibration | arXiv: 2605.18354
- Decoupled Training with Local Reinforcement Fine-Tuning in Federated Learning | arXiv: 2605.27900
- Decoupling Reasoning and Confidence: Resurrecting Calibration in Reinforcement Learning from Verifiable Rewards | arXiv: 2603.09117
- Decoupling Skeleton and Flesh: Efficient Multimodal Table Reasoning with Disentangled Alignment and Structure-aware Guidance | arXiv: 2602.03491
- Decoupling the "What" and "Where" With Polar Coordinate Positional Embeddings | arXiv: 2509.10534
- Deep Networks Learn to Parse Uniform-Depth Context-Free Languages from Local Statistics | arXiv: 2602.06065
- Deep Neural Sheaf Diffusion | arXiv: 2605.19021
- Deep Pre-Alignment for VLMs | arXiv: 2605.15300
- Deep Residual Injection for Full-Spectrum Forensic Signal Perception in Multimodal Large Language Models | arXiv: 2606.15880
- Deep Sequence Models Tend to Memorize Geometrically; It Is Unclear Why | arXiv: 2510.26745
- DeepSight: Long-Horizon World Modeling via Latent States Prediction for End-to-End Autonomous Driving | arXiv: 2605.10564
- Degradation-Aware Metric Prompting for Hyperspectral Image Restoration | arXiv: 2512.20251
- DEI: Diversity in Evolutionary Inference for Quality-Diversity Search | arXiv: 2605.27130
- Delayed Momentum Aggregation: Communication-efficient Byzantine-robust Federated Learning with Partial Participation | arXiv: 2509.02970
- Deliberate Evolution: Agentic Reasoning for Sample-Efficient Symbolic Regression with LLMs | arXiv: 2606.04360
- Demystifying Multimodal Biomolecular Co-design with Intrinsic Geodesic Coupling | arXiv: 2606.01628
- Demystifying the Optimal Fair Classifier in Multi-Class Classification | arXiv: 2606.00656
- Demystifying When Pruning Works via Representation Hierarchies | arXiv: 2603.24652
- DenseMLLM: Standard Multimodal LLMs for Dense Prediction | arXiv: 2602.14134
- DenseSteer: Steering Small Language Models towards Dense Math Reasoning | arXiv: 2605.29247
- Density-Aware Translation of Spurious Correlations in Zero-Shot VLMs | arXiv: 2606.01710
- Density-Guided Robust Counterfactual Explanations on Tabular Data under Model Multiplicity | arXiv: 2605.30901
- Depth over Fidelity in Fixed-Budget Noisy Evolution Strategies | arXiv: 2606.06555
- Detached Skip-Links and \(R\)-Probe: Decoupling Feature Aggregation from Gradient Propagation for MLLM OCR | arXiv: 2603.20020
- Detecting Fluent Optimization-Based Adversarial Prompts via Sequential Entropy Changes | arXiv: 2605.19966
- DFlash: Block Diffusion for Flash Speculative Decoding | arXiv: 2602.06036
- DFSAttn: Dynamic Fine-Grained Sparse Attention for Efficient Video Generation | arXiv: 2605.23445
- dgMARK: Decoding-Guided Watermarking for Diffusion Language Models | arXiv: 2601.22985
- DGNO: Discontinuous Galerkin Neural Operator for Pathology Defocus Deblurring | arXiv: 2605.23282
- DGS-Net: Distillation-Guided Gradient Surgery for CLIP Fine-Tuning in AI-Generated Image Detection | arXiv: 2511.13108
- Diagnosing and Correcting Concept Omission in Multimodal Diffusion Transformers | arXiv: 2605.14270
- Diagnosing Multi-step Reasoning Failures in Black-box LLMs via Stepwise Confidence Attribution | arXiv: 2605.19228
- Diagnosing the Reliability of LLM-as-a-Judge via Item Response Theory | arXiv: 2602.00521
- DiBO: Offline Black-box Optimization with Diffusion Language Models (DNA + Robot Morphology) | arXiv: 2603.17919
- Different Layers, Different Manifolds: Module-Wise Weight-Space Geometry in Transformer Optimization | arXiv: 2606.13276
- Differential Syntactic and Semantic Encoding in LLMs | arXiv: 2601.04765
- Differentially Private Preference Data Synthesis for Large Language Model Alignment | arXiv: 2605.30808
- Differentially Private Submodular Maximization with a Knapsack Constraint | arXiv: 2606.14951
- Diffusion Differentiable Resampling | arXiv: 2512.10401
- Diffusion Language Model Parallel Decoding via Product-of-Experts Bridge | arXiv: 2606.08048
- Diffusion Models Are Statistically Optimal for Learning Low-Dimensional Multi-Modal Distributions | arXiv: 2605.30153
- Dimension-Free Multimodal Sampling via Preconditioned Annealed Langevin Dynamics | arXiv: 2605.30396
- Dimensionality Controls When Modularity Helps in Continual Learning | arXiv: 2606.17889
- Direct 3D-Aware Object Insertion via Decomposed Visual Proxies | arXiv: 2606.06601
- DirectEdit: Step-Level Accurate Inversion for Flow-Based Image Editing | arXiv: 2605.02417
- Direction-Conditioned Policies via Compositional Subgoal Scoring for Online Goal-Conditioned Reinforcement Learning | arXiv: 2606.16515
- DISCO: Mitigating Bias in Deep Learning with Conditional Distance Correlation | arXiv: 2506.11653
- DiscoForcing: A Unified Framework for Real-Time Audio-Driven Character Control with Diffusion Forcing | arXiv: 2605.28491
- DiScoFormer: Plug-In Density and Score Estimation with Transformers | arXiv: 2511.05924
- Discovering Differences in Strategic Behavior Between Humans and LLMs | arXiv: 2602.10324
- Discovering Implicit Large Language Model Alignment Objectives | arXiv: 2602.15338
- Discovering Interpretable Algorithms by Decompiling Transformers to RASP | arXiv: 2602.08857
- Discovering Ordinary Differential Equations with LLM-Based Qualitative and Quantitative Evaluation | arXiv: 2605.07323
- DiscoverLLM: From Executing Intents to Discovering Them | arXiv: 2602.03429
- Discrete Diffusion Samplers and Bridges: Off-Policy Algorithms and Applications in Latent Spaces | arXiv: 2602.05961
- Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies | arXiv: 2508.20072
- Disentangling Direction and Magnitude in Transformer Representations: A Double Dissociation Through L2-Matched Perturbation Analysis | arXiv: 2602.11169
- Disentangling Latent Risk Pathways via Bayesian Hypergraph Inference | arXiv: 2606.07677
- DisjunctiveNet: Neural Symbolic Learning via Differentiable Convexified Optimization Layers | arXiv: 2605.30456
- Dispersion Loss Counteracts Embedding Condensation and Improves Generalization in Small Language Models | arXiv: 2602.00217
- Dissect and Prune: Enhancing Robustness in AI-Generated Image Detection | arXiv: 2606.10309
- Dissecting Multimodal In-Context Learning: Modality Asymmetries and Circuit Dynamics in modern Transformers | arXiv: 2601.20796
- Distilling Linearized Behavior into Non-Linear Fine-Tuning for Effective Task Arithmetic | arXiv: 2605.18993
- DistMatch: Adaptive Binning via Distribution Matching for Robust Sequential Conformal | arXiv: 2606.00690
- Distribution Alignment for One-Shot Federated Learning via Optimal Transport | arXiv: 2606.16655
- Distribution Transformers: Fast Approximate Bayesian Inference With On-The-Fly Prior Adaptation | arXiv: 2502.02463
- Distribution-Free Uncertainty Quantification for Continuous AI Agent Evaluation | arXiv: 2605.19779
- Distributional Inverse Reinforcement Learning | arXiv: 2510.03013
- Distributional Open-Ended Evaluation of LLM Cultural Value Alignment Based on Value Codebook | arXiv: 2604.06210
- DIVA: Harnessing the Representation Divergence in Unified Multimodal Models for Mutual Reinforcement | arXiv: 2605.25328
- Dive into the Scene: Breaking the Perceptual Bottleneck in Vision-Language Decision Making via Focus Plan Generation | arXiv: 2606.04046
- DIVER: Diving Deeper into Distilled Data via Expressive Semantic Recovery | arXiv: 2605.12649
- Diversity Matters: Revisiting Test-Time Compute in Vision-Language Models | arXiv: 2605.30713
- Diversity Over Frequency: Rethinking Tool Use in Visual Chain-of-Thought Agents | arXiv: 2606.00096
- Diversity-Driven Offline Multi-Objective Optimization via Nested Pareto Set Learning | arXiv: 2606.15115
- Divide and Conquer: Reliable Multi-View Evidential Learning for Deepfake Detection | arXiv: 2606.01885
- Divide and Contrast: Learning Robust Temporal Features Without Augmentation | arXiv: 2605.21241
- Divide-and-Denoise: A Game-Theoretic Method for Fairly Composing Diffusion Models | arXiv: 2606.14756
- DIYHealth Suite: Dataset, Model, and Benchmark for Health Management at Home | arXiv: 2606.07542
- dLLM-Cache: Accelerating Diffusion Large Language Models with Adaptive Caching | arXiv: 2506.06295
- DLLM-JEPA: Joint Embedding Predictive Architectures for Masked Diffusion Language Models | arXiv: 2606.00091
- DLO-Lab: Benchmarking Deformable Linear Object Manipulations with Differentiable Physics | arXiv: 2606.04206
- DNAChunker: Learnable Tokenization for DNA Language Models | arXiv: 2601.03019
- Do Activation Verbalization Methods Convey Privileged Information? | arXiv: 2509.13316
- Do Audio LLMs Listen or Read? Analyzing and Mitigating Paralinguistic Failures with VoxParadox | arXiv: 2605.27772
- Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs | arXiv: 2606.00477
- Do Time Series Foundation Model Benchmarks Hide Regime-Dependent Failures? Evidence from Traffic Speed Forecasting | arXiv: 2606.18367
- Do Transformers Need Three Projections? A Systematic Study of QKV Sharing Systems | arXiv: 2606.04032
- Does AI Reviewer See the Full Picture? Attacking and Defending Multimodal Peer Review | arXiv: 2606.12716
- Does Persona Make LLMs K-pop Fans? A Pilot Study of LLM-Based Online Concert Audience Agents | arXiv: 2606.07837
- Don't Ignore the Tail: Decoupling top-K Probabilities for Efficient Language Model Distillation | arXiv: 2602.20816
- DOT-MoE: Transforming Dense LLMs into MoE with Differentiable Optimal Transport | arXiv: 2606.01666
- Doubly Outlier-Robust Online Infinite Hidden Markov Model | arXiv: 2604.14322
- DP-KFC: Data-Free Preconditioning for Privacy-Preserving Deep Learning | arXiv: 2605.13418
- Dr. Tulu: Reinforcement Learning with Evolving Rubrics for Deep Research | arXiv: 2511.19399
- DR.Q: Debiased Model-based Representations for Sample-efficient Continuous Control | arXiv: 2605.11711
- Drift is a Sampling Error: SNR-Aware Power Distributions for Long-Horizon Robotic Planning | arXiv: 2605.09537
- DRIVE: Distributional and Retrieval-Augmented Bidding with Value Evaluation | arXiv: 2606.14192
- Dropout Universality: Scaling Laws and Optimal Scheduling at the Edge-of-Chaos | arXiv: 2605.21648
- DSL-Topic: Improving Topic Modeling by Distilling Soft Labels from Language Models | arXiv: 2602.17907
- DTKG: Dual-Track Knowledge Graph-Verified Reasoning Framework for Multi-Hop QA | arXiv: 2510.16302
- Dual Advantage Fields | arXiv: 2606.04188
- Dual Mechanisms of Value Expression: Intrinsic vs. Prompted Values in Large Language Models | arXiv: 2509.24319
- Dual Quaternion SE(3) Synchronization with Recovery Guarantees | arXiv: 2602.00324
- Dual-branch Robust Unlearnable Examples | arXiv: 2605.01718
- Dual-Stream Diffusion for World-Model Augmented Vision-Language-Action Model | arXiv: 2510.27607
- DualOptim+: Bridging Shared and Decoupled Optimizer States for Better Machine Unlearning in Large Language Models | arXiv: 2605.21539
- DyCon: Dynamic Reasoning Control via Evolving Difficulty Modeling | arXiv: 2606.07108
- DyLLM: Efficient Diffusion LLM Inference via Saliency-based Token Selection and Partial Attention | arXiv: 2603.08026
- DynaDiff: Generative Adaptation of Dynamics to Environmental Shifts via Weight-space Diffusion | arXiv: 2505.13919
- Dynamic Linear Attention | arXiv: 2606.10650
- Dynamic-TMoE: A Drift-Aware Dynamic Mixture of Experts Framework for Non-Stationary Time Series | arXiv: 2605.20678
- Dynamics and Representation Structure of Local Approximations to Gradient-Based Learning in Linear Recurrent Neural Networks | arXiv: 2606.00243
- Dynamics Within Latent Chain-of-Thought: An Empirical Study of Causal Structure | arXiv: 2602.08783
- DynaTok: Token-Based 4D Reconstruction from Partial Point Clouds | arXiv: 2606.12189
- E-mem: Multi-Agent Based Episodic Context Reconstruction for LLM Agent Memory | arXiv: 2601.21714
- EAPO: Enhancing Policy Optimization with On-Demand Expert Assistance | arXiv: 2509.23730
- EARL: Towards a Unified Analysis-Guided Reinforcement Learning Framework for Egocentric Interaction Reasoning and Pixel Grounding | arXiv: 2605.14742
- Early Decisions Matter: Proximity Bias and Initial Trajectory Shaping in Non-Autoregressive Diffusion Language Models | arXiv: 2604.10567
- Easier to Judge Than to Find: Predicting In-Context Learning Success for Demonstration Selection | arXiv: 2605.18512
- ECA: Efficient Continual Alignment for Open-Ended Image-to-Text Generation | arXiv: 2606.12633
- ECG-R1: Protocol-Guided and Modality-Agnostic MLLM for Reliable ECG Interpretation | arXiv: 2602.04279
- EchoRL: Reinforcement Learning via Rollout Echoing | arXiv: 2605.31228
- ECSEL: Explainable Classification via Signomial Equation Learning | arXiv: 2601.21789
- Edit-Based Refinement for Parallel Masked Diffusion Language Models | arXiv: 2605.09603
- EduMirror: Modeling Educational Social Dynamics with Value-driven Multi-agent Simulation | arXiv: 2606.07948
- EEG-Based Multimodal Learning via Hyperbolic Mixture-of-Curvature Experts | arXiv: 2604.12579
- Effective Model Pruning: Measure the Redundancy of Model Components | arXiv: 2509.25606
- Efficient DP-SGD for LLMs with Randomized Clipping | arXiv: 2605.24879
- Efficient Learned Image Compression without Entropy Coding | arXiv: 2605.23323
- Efficient Learning of Deep State Space Models via Importance Smoothing | arXiv: 2605.21108
- Efficient Preference Poisoning Attack on Offline RLHF | arXiv: 2605.02495
- Efficient Reasoning with Hidden Thinking | arXiv: 2501.19201
- Efficient Skill Grounding via Code Refactoring with Small Language Models | arXiv: 2606.07999
- Efficient Stochastic Optimisation via Sequential Monte Carlo | arXiv: 2601.22003
- Efficient Training-Free Multi-Token Prediction via Embedding-Space Probing | arXiv: 2603.17942
- Efficient, Validation-Free Intrinsic Quality Estimation for Large-Scale Face Recognition Datasets | arXiv: 2605.29720
- Efficiently Learning Drifting Halfspaces with Massart Noise | arXiv: 2606.11149
- Ekka: Automated Diagnosis of Silent Errors in LLM Inference | arXiv: 2606.04594
- Ellipsoidal Time Series Forecasting | arXiv: 2505.17370
- Embedding Hybrid Systems into Continuous Latent Vector Fields | arXiv: 2606.10596
- EMBGuard: Constructing Hazard-Aware Guardrails for Safe Planning in Embodied Agents | arXiv: 2605.30924
- Embodied Interpretability: Linking Causal Understanding to Generalization in Vision-Language-Action Models | arXiv: 2605.00321
- Embodied Task Planning via Graph-Informed Action Generation with Large Language Models | arXiv: 2601.21841
- Emergence of Hierarchical Emotion Organization in Large Language Models | arXiv: 2507.10599
- End-to-End Autoregressive Image Generation with 1D Semantic Tokenizer | arXiv: 2605.00503
- End-to-End Compression for Tabular Foundation Models | arXiv: 2602.05649
- Energy-Structured Low-Rank Adaptation for Continual Learning | arXiv: 2605.27482
- EngiAgent: Fully Connected Coordination of LLM Agents for Solving Open-ended Engineering Problems with Feasible Solutions | arXiv: 2605.02289
- Enhancing Conformal Prediction via Class Similarity | arXiv: 2511.19359
- Enhancing LLM Training via Spectral Clipping | arXiv: 2603.14315
- Enhancing Membership Inference Attacks on Diffusion Models from a Frequency-Domain Perspective | arXiv: 2505.20955
- Enhancing Train-Free Infinite-Frame Generation for Consistent Long Videos | arXiv: 2605.18233
- Ensembling Sparse Autoencoders | arXiv: 2505.16077
- Entropy-Aware On-Policy Distillation of Language Models | arXiv: 2603.07079
- Entropy-informed Decoding: Adaptive Information-Driven Branching | arXiv: 2605.09745
- Envisioning Beyond the Few: Disentangled Semantics and Primitives for Few-Shot Atypical Layout-to-Image Generation | arXiv: 2605.31266
- Envy-Free Allocation of Indivisible Goods via Noisy Queries | arXiv: 2602.06361
- ePC: Fast and Deep Predictive Coding in Digital Simulation | arXiv: 2505.20137
- EPiC: Efficient Video Camera Control Learning with Precise Anchor-Video Guidance | arXiv: 2505.21876
- EpiCache: Episodic KV Cache Management for Long-Term Conversation on Resource-Constrained Environments | arXiv: 2509.17396
- EPS3D: End-to-End Feed-Forward 3D Panoptic Segmentation | arXiv: 2606.08980
- EqGINO: Equivariant Geometry-Informed Fourier Neural Operators for 3D PDEs | arXiv: 2606.03260
- Equilibrium Reasoners: Learning Attractors Enables Scalable Reasoning | arXiv: 2605.21488
- ERAlign: Energy-based Representation Alignment of GNNs and LLMs on Text-attributed Graphs | arXiv: 2606.10461
- Escaping Mode Collapse in LLM Generation via Geometric Regulation | arXiv: 2605.00435
- Esoteric Language Models: A Family of Any-Order Diffusion LLMs | arXiv: 2506.01928
- Estimating Correlation Clustering Cost in Node-Arrival Stream | arXiv: 2605.07091
- Estimating Tail Risks in Language Model Output Distributions | arXiv: 2604.22167
- ETS: Energy-Guided Test-Time Scaling for Training-Free RL Alignment | arXiv: 2601.21484
- Evaluating and Rewarding LALMs for Expressive Role-Play TTS via Mean Continuation Log-Probability | arXiv: 2601.22661
- Evaluating Bivariate Causal Statements Based on Mutual Compatibility | arXiv: 2606.00278
- Evaluating Relational Reasoning in LLMs with REL | arXiv: 2604.12176
- Evaluating the Representation Space of Diffusion Models via Self-Supervised Principles | arXiv: 2606.09718
- Event2Vec: Processing Neuromorphic Events Directly by Representations in Vector Space | arXiv: 2504.15371
- Evidential Reasoning Advances Interpretable Real-World Disease Screening | arXiv: 2605.15171
- EVL-ECG: Efficient ECG Interpretation With Multi-Aspect Heterogeneous Knowledge Distillation | arXiv: 2605.29977
- EvoClaw: Evaluating AI Agents on Continuous Software Evolution | arXiv: 2603.13428
- EvoEGF-Mol: Evolving Exponential Geodesic Flow for Structure-based Drug Design | arXiv: 2601.22466
- EvoGM: Learning to Merge LLMs via Evolutionary Generative Optimization | arXiv: 2605.29295
- EvolveR: Self-Evolving LLM Agents through an Experience-Driven Lifecycle | arXiv: 2510.16079
- ExCyTIn-Bench: Evaluating LLM Agents on Cyber Threat Investigation | arXiv: 2507.14201
- Expand Neurons, Not Parameters | arXiv: 2510.04500
- Expectation Consistency Loss: Rethink Confidence Calibration under Covariate Shift | arXiv: 2605.21552
- Explainable Forensics of Manipulated Segments in Untrimmed Long Videos | arXiv: 2606.02402
- ExPLAIND: Unifying Model, Data, and Training Attribution to Study Model Behavior | arXiv: 2505.20076
- Explaining Data Mixing Scaling Laws | arXiv: 2606.08167
- Explaining Is Harder than Predicting Alone: Evaluating Concept-Based Explanations of MLLMs as ICL Visual Classifiers | arXiv: 2605.28215
- Exploiting Weight-Space Symmetries for Approximating Curvature | arXiv: 2606.00442
- Exploring Accurate and Transparent Domain Adaptation in Predictive Healthcare via Concept-Grounded Orthogonal Inference | arXiv: 2602.12542
- Exploring and Exploiting Stability in Latent Flow Matching | arXiv: 2605.08398
- Exploring Data-Free LoRA Transferability for Video Diffusion Models | arXiv: 2605.01929
- Exploring Systems-Thinking Approaches to Loss of Control Risk | arXiv: 2606.13474
- Exposing Hidden Biases in Text-to-Image Models via Automated Prompt Search | arXiv: 2512.08724
- Exposing Vulnerabilities in Explanation for Time Series Classifiers via Dual-Target Adversarial Attack | arXiv: 2602.02763
- Exposure Bias as Epistemic Underidentification in Recursive Forecasting | arXiv: 2606.12990
- Express Your Doubts: Probabilistic World Modeling Should Not Be Based on Token logprobs | arXiv: 2505.02072
- Extending Fair Null-Space Projections for Continuous Attributes to Kernel Methods | arXiv: 2511.03304
- Extra-CoT: A Chain-of-Thought Compression Framework under Extreme Compression Ratios | arXiv: 2602.08324
- E²PO: Embedding-perturbed Exploration Preference Optimization for Flow Models | arXiv: 2605.15803
- F-TIS: Harnessing Diverse Models in Collaborative GRPO | arXiv: 2605.22537
- FAB: A First-Order AB-based Gradient Algorithm for Distributed Bilevel Optimization over Time-Varying Directed Graphs | arXiv: 2605.06328
- Factored Classifier-Free Guidance | arXiv: 2506.14399
- FactoryNet: A Large-Scale Dataset toward Industrial Time-Series Foundation Models | arXiv: 2605.09081
- Fair Dataset Distillation via Cross-Group Barycenter Alignment | arXiv: 2605.00185
- Fair Decisions from Calibrated Scores: Achieving Optimal Classification While Satisfying Sufficiency | arXiv: 2602.07285
- FAIR-Calib: Frontier-Aware Instability-Reweighted Calibration for Post-Training Quantization of Diffusion Large Language Models | arXiv: 2606.06547
- Fairness in Aggregation: Optimal Top-\(k\) and Improved Full Ranking | arXiv: 2605.23265
- Fast and Highly Expressive Policy Learning for Offline Reinforcement Learning via Bootstrapped Flow Q-Learning | arXiv: 2606.10613
- Fast-dLLM++: Fréchet Profile Decoding for Faster Diffusion LLM Inference | arXiv: 2606.02955
- Fast-SAM3D: 3Dfy Anything in Images but Faster | arXiv: 2602.05293
- Feature-Augmented Transformers for Robust AI-Text Detection Across Domains and Generators | arXiv: 2605.03969
- Federated Distillation for Whole Slide Image via Gaussian-Mixture Feature Alignment and Curriculum Integration | arXiv: 2605.00578
- Federated Variational Preference Alignment with Gumbel-Softmax Prior for Personalized User Preferences | arXiv: 2605.30873
- FedHPro: Federated Hyper-Prototype Learning via Gradient Matching | arXiv: 2605.13475
- FedRot-LoRA: Mitigating Rotational Misalignment in Federated LoRA | arXiv: 2602.23638
- FedSDR: Federated Self-Distillation with Rectification | arXiv: 2605.18028
- FedTreeLoRA: Reconciling Statistical and Functional Heterogeneity in Federated LoRA Fine-Tuning | arXiv: 2603.13282
- Few-Shot Synthetic Accented Speech for ASR Fine-Tuning: What Helps and When? | arXiv: 2604.27273
- Find, Fix, Reason: Context Repair for Video Reasoning | arXiv: 2604.16243
- Finding DoRI: Discovery of Retained Images in Diffusion Models | arXiv: 2507.16880
- Finding Most Influential Sets | arXiv: 2606.05919
- Finding the Correct Visual Evidence Without Forgetting: Mitigating Hallucination in LVLMs via Inter-Layer Visual Attention Discrepancy | arXiv: 2605.20965
- Finding the Minimal Parameter Budget for Implicit Reasoning: A Data Complexity Driven Scaling Law for Language Models | arXiv: 2504.03635
- Finer Parameter Steps for Low-Rank PEFT: A Controlled Study with CP Tensor Adapters | arXiv: 2606.00428
- Finite-Width Neural Tangent Kernels from Feynman Diagrams | arXiv: 2508.11522
- Fixed Aggregation Features Can Rival GNNs | arXiv: 2601.19449
- FLAG: Foundation Model Representation with Latent Diffusion Alignment via Graph for Spatial Gene Expression Prediction | arXiv: 2605.18055
- Flatland: The Adventures of Gradient Descent with Large Step Sizes | arXiv: 2606.06722
- Flatness-Aware Stochastic Gradient Langevin Dynamics | arXiv: 2510.02174
- FlattenGPT: Depth Compression for Transformer with Layer Flattening | arXiv: 2602.08858
- Flexible Kernels for Protein Property Prediction | arXiv: 2606.11057
- FlexRank: Nested Low-Rank Knowledge Decomposition for Adaptive Model Deployment | arXiv: 2602.02680
- FLIPS: Instance-Fingerprinting for LLMs via Pseudo-Random Sequences | arXiv: 2605.29110
- Float8@2bits: Entropy Coding Enables Data-Free Model Compression | arXiv: 2601.22787
- FloorplanQA: A Benchmark for Spatial Reasoning in LLMs Using Structured Representations | arXiv: 2507.07644
- Flow Sampling: Learning to Sample from Unnormalized Densities via Denoising Conditional Processes | arXiv: 2605.03984
- Flow-Equivariant World Models: Memory for Partially Observed Dynamic Environments | arXiv: 2601.01075
- FlowNar: Scalable Streaming Narration for Long-Form Videos | arXiv: 2606.00620
- FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation | arXiv: 2605.29461
- FOAM: Frequency and Operator Error-Based Adaptive Damping Method for Reducing Staleness-Oriented Error for Shampoo | arXiv: 2606.02365
- Focus and Dilution: The Multi-stage Learning Process of Attention | arXiv: 2605.01199
- Focus Then Listen: An Empirical Study of Plug-and-Play Audio Enhancer for Noise-Robust Large Audio Language Models | arXiv: 2603.04862
- FOCUS: DLLMs Know How to Tame Their Compute Bound | arXiv: 2601.23278
- FOCUS: Forcing In-Context Object Localization through Visual Support Constraints and Policy Optimization | arXiv: 2605.31145
- Focusing Where Vision Matters: Selective Training for Large Vision Language Models via Visual Information Gain | arXiv: 2602.17186
- FoeGlass: Simple In-Context Learning Is Enough for Red Teaming Audio Deepfake Detectors | arXiv: 2606.05101
- Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality | arXiv: 2510.12152
- ForceForget: Reinforcement Concept Removal for Enhancing Safety in Text-to-Image Models | arXiv: 2606.14351
- ForensicConcept: Transferable Forensic Concepts for AIGI Detection | arXiv: 2606.07034
- Foresee-to-Ground: From Predictive Temporal Perception to Evidence-Driven Reasoning | arXiv: 2605.21973
- ForesightKV: Optimizing KV Cache Eviction for Reasoning Models by Learning Long-Term Contribution | arXiv: 2602.03203
- Forget to Know, Remember to Use: Context-Aware Unlearning for Large Language Models | arXiv: 2510.17620
- Forget-It-All: Multi-Concept Machine Unlearning via Concept-Aware Neuron Masking | arXiv: 2601.06163
- Forgetting in Diffusion Models: A Unified Framework via KL Divergence and Likelihood Constraints | arXiv: 2605.30825
- Forgetting is Not Deletion: An Investigation of Reversibility in LLM Machine Unlearning | arXiv: 2505.16831
- Formal Concept Lattices are Good Semantic Scaffolds for Concept-Based Learning | arXiv: 2606.05471
- Formalizing and Falsifying Causal Pathways of Rare Events | arXiv: 2605.31254
- Formalizing Learning from Language Feedback with Provable Guarantees | arXiv: 2506.10341
- Formalizing the Binding Problem | arXiv: 2606.03976
- Foundation Inference Models for Ordinary Differential Equations | arXiv: 2602.08733
- Foundation VAEs for 3D CT Reconstruction, Augmentation, and Generation | arXiv: 2605.30893
- FoundObj: Self-supervised Foundation Models as Rewards for Label-free 3D Object Segmentation | arXiv: 2605.27178
- Fourier Features Let Agents Learn High Precision Policies with Imitation Learning | arXiv: 2606.12334
- FOVI: Bio-inspired Foveated Interface for Deep Vision Models | arXiv: 2602.03766
- FRACTAL: State Space Model with Fractional Recurrent Architecture for Computational Temporal Analysis of Long Sequences | arXiv: 2605.08833
- FreeRet: MLLMs as Training-Free Retrievers | arXiv: 2509.24621
- Frequency Matching in Spiking Neural Networks for mmWave Sensing | arXiv: 2605.09983
- FRISM: Fine-Grained Reasoning Injection via Subspace-Level Model Merging for Vision–Language Models | arXiv: 2601.21187
- From 2D Grids to 1D Tokens: Reforming Shared Representations for Multimodal Image Fusion | arXiv: 2606.12303
- From Abstraction to Instantiation: Learning Behavioral Representation for Vision-Language-Action Model | arXiv: 2605.22671
- From Backward Spreading to Forward Replay: Revisiting Target Construction in LLM Parameter Editing | arXiv: 2605.00358
- From Correspondence to Actions: Human-Like Multi-Image Spatial Reasoning in Multi-modal Large Language Models | arXiv: 2602.08735
- From Feasible to Practical: Pareto-Optimal Synthesis Planning | arXiv: 2605.29113
- From Flat Facts to Sharp Hallucinations: Detecting Stubborn Errors via Gradient Sensitivity | arXiv: 2605.00939
- From Generalist to Specialist Representation | arXiv: 2605.12733
- From Geometry to Dynamics: Learning Overdamped Langevin Dynamics from Sparse Observations with Geometric Constraints | arXiv: 2512.23566
- From Holo Pockets to Electron Density: GPT-style Drug Design with Density | arXiv: 2605.08767
- From Human-Level AI Tales to AI Leveling Human Scales | arXiv: 2602.18911
- From Imagined Futures to Executable Actions: Mixture of Latent Actions for Robot Manipulation | arXiv: 2605.12167
- From LLM-Generated Conjectures to Lean Formalizations: Automated Polynomial Inequality Proving via Sum-of-Squares Certificates | arXiv: 2605.15445
- From Observation to Intervention: A Causal Audit of Expert Importance in Mixture-of-Experts Models | arXiv: 2606.10703
- From Observations to States: Latent Time Series Forecasting | arXiv: 2602.00297
- From Out-of-Distribution Detection to Hallucination Detection: A Geometric View | arXiv: 2602.07253
- From Parameter Dynamics to Risk Scoring: Quantifying Sample-Level Safety Degradation in LLM Fine-tuning | arXiv: 2605.04572
- From Per-Image Low-Rank to Encoding Mismatch: Rethinking Feature Distillation in Vision Transformers | arXiv: 2511.15572
- From Player to Master: Enhancing Test-Time Learning of LLM Agents via Reinforcement Learning over Memory | arXiv: 2606.08656
- From Prompts to Responses: Dual-Sided Data Leakage and Defense in Split Large Language Models | arXiv: 2606.14210
- From Rashomon Theory to PRAXIS: Efficient Decision Tree Rashomon Sets | arXiv: 2606.00202
- From Reward-Free Representations to Preferences: Rethinking Offline Preference-Based Reinforcement Learning | arXiv: 2606.01123
- From Seeing to Thinking: Decoupling Perception and Reasoning Improves Post-Training of Vision-Language Models | arXiv: 2605.20177
- From Self-Evolving Synthetic Data to Verifiable-Reward RL: Post-Training Multi-turn Interactive Tool-Using Agents | arXiv: 2601.22607
- From Shortcuts to Reasoning: Robust Post-Training of Theory of Mind with Reinforcement Learning | arXiv: 2606.09092
- From Talking to Singing: A New Challenge for Audio-Visual Deepfake Detection | arXiv: 2605.27944
- From Volume to Value: Preference-Aligned Memory Construction for On-Device RAG | arXiv: 2605.18271
- From Weak Cues to Real Identities: Evaluating Inference-Driven De-Anonymization in LLM Agents | arXiv: 2603.18382
- From Zero to Hero: Advancing Zero-Shot Foundation Models for Tabular Outlier Detection | arXiv: 2602.03018
- FSI2P: A Hierarchical Focus–Sweep Registration Network with Dynamically Allocated Depth | arXiv: 2605.07607
- Full-Batch Gradient Descent Outperforms One-Pass SGD: Sample Complexity Separation in Single-Index Learning | arXiv: 2602.02431
- Full-Spectrum Graph Neural Network: Expressive and Scalable | arXiv: 2605.05759
- Functional Attention: From Pairwise Affinities to Functional Correspondences | arXiv: 2605.31559
- Functional Cache Grafting: Robust and Rapid Code-Policy Synthesis for Embodied Agents | arXiv: 2606.13097
- Functional Equivalence in Attention: A Comprehensive Study with Applications to Linear Mode Connectivity | arXiv: 2606.17830
- Furina: Fragmented Uncertainty-Driven Refusal Instability Attack | arXiv: 2605.26158
- FuseFSS: Efficient Secure LLM Inference with Function Secret Sharing | arXiv: 2606.09551
- Future Dynamic 3D Reconstruction: A 3D World Model with Disentangled Ego-Motion | arXiv: 2606.18250
- FutureOmni: Evaluating Future Forecasting from Omni-Modal Context for Multimodal LLMs | arXiv: 2601.13836
- Game of Thought: Robust Information Seeking with Large Language Models Using Game Theory | arXiv: 2602.01708
- GASS: Geometry-Aware Spherical Sampling for Disentangled Diversity Enhancement in Text-to-Image Generation | arXiv: 2602.17200
- Gated Relational Alignment via Confidence-based Distillation for Efficient VLMs | arXiv: 2601.22709
- GCIB: Graph Contrastive Information Bottleneck for Multi-Behavior Recommendation | arXiv: 2605.25690
- GEM-FI: Gated Evidential Mixtures with Fisher Modulation | arXiv: 2605.03750
- GEM: Geometric Entropy Mixing for Optimal LLM Data Curation | arXiv: 2605.26121
- GEMQ: Global Expert-Level Mixed-Precision Quantization for MoE LLMs | arXiv: 2605.23078
- Generalizing Multi-scale Time-Series Modeling with a Single Operator | arXiv: 2605.31129
- Generating Robust Portfolios of Optimization Models using Large Language Models | arXiv: 2605.27013
- Generative Modeling of Discrete Latent Structures via Dynamic Policy Gradients | arXiv: 2606.07400
- Generative Models Erode Human Temporal Learning Through Market Selection | arXiv: 2606.06572
- Generative Neural Operators Through Diffusion Last Layer | arXiv: 2602.04139
- Generative Representation Learning on Hyper-relational Knowledge Graphs via Masked Discrete Diffusion | arXiv: 2605.24064
- Generative Visual Code Mobile World Models | arXiv: 2602.01576
- GenExam: A Multidisciplinary Text-to-Image Exam | arXiv: 2509.14232
- Geo-Expert: Fine-Tuning an 8B Model into an Expert-Level Geological Reasoning LLM via LoRA | arXiv: 2605.24844
- Geodesic Flow Matching for Denoising High-Dimensional Structured Representations | arXiv: 2606.00248
- Geometric and Stochastic Analysis of Discontinuities in Sparse Mixture-of-Experts | arXiv: 2606.19036
- Geometrically Constrained Outlier Synthesis | arXiv: 2603.08413
- Geometry of Reason: Spectral Signatures of Valid Mathematical Reasoning | arXiv: 2601.00791
- Geometry-Aware Dataset Condensation for Diffusion Model Training | arXiv: 2606.05883
- Geometry-Aware Tabular Diffusion | arXiv: 2606.02607
- Geometry-based Schrödinger Bridges for Trustworthy Multimodal Fusion | arXiv: 2605.31193
- Geometry-Guided Modeling of Foundation Features Enables Generalizable Object Shape Deformation Learning | arXiv: 2605.29661
- Geometry-Preserving Unsupervised Alignment for Heterogeneous Foundation Models | arXiv: 2606.04385
- GILT: An LLM-Free, Tuning-Free Graph Foundational Model for In-Context Learning | arXiv: 2510.04567
- GIST: Targeted Data Selection for Instruction Tuning with Gradient Subspace Projection | arXiv: 2602.18584
- Global Convergence of Adaptive Sensing for Principal Eigenvector Estimation | arXiv: 2505.10882
- Global Plane Waves from Local Gaussians: Periodic Charge Densities in a Blink | arXiv: 2601.19966
- Global Policy-Space Response Oracles for Two-Player Zero-Sum Games | arXiv: 2605.28273
- GOTabPFN: From Feature Ordering to Compact Tokenization for Tabular Foundation Models on High-Dimensional Data | arXiv: 2606.05441
- Gradient Descent with Large Step Size Restores Symmetry in Deep Linear Networks with Multi-Pathway | arXiv: 2606.05219
- Gradient Preconditioning for Efficient and Reliable Reward-Guided Generation | arXiv: 2602.08646
- Gradient Transformer: Learning to Generate Updates for LLMs | arXiv: 2605.27591
- GradPower: Powering Gradients for Faster Language Model Pre-Training | arXiv: 2505.24275
- Graph-GRPO: Training Graph Flow Models with Reinforcement Learning | arXiv: 2603.10395
- Graph-R1: Towards Agentic GraphRAG Framework via End-to-end Reinforcement Learning | arXiv: 2507.21892
- GraphFlow: A Graph-Based Workflow Management for Efficient LLM-Agent Serving | arXiv: 2605.22566
- Grokking: From Abstraction to Intelligence | arXiv: 2603.29262
- Group Cognition Learning: Making Everything Better Through Governed Two-Stage Agents Collaboration | arXiv: 2605.00370
- GRPO is Secretly a Process Reward Model | arXiv: 2509.21154
- Guaranteed Optimal Compositional Explanations for Neurons | arXiv: 2511.20934
- GUDA: Counterfactual Group-wise Training Data Attribution for Diffusion Models via Unlearning | arXiv: 2601.22651
- GuidedBridge: Training-freely Improving Bridge Models with Prior Guidance | arXiv: 2606.03119
- Hacking Generative Perplexity: Why Unconditional Text Evaluation Needs Distributional Metrics | arXiv: 2606.08417
- Hallucination is a Consequence of Space-Optimality: A Rate-Distortion Theorem for Membership Testing | arXiv: 2602.00906
- Hallucinations Undermine Trust; Metacognition is a Way Forward | arXiv: 2605.01428
- Hard Labels In! Rethinking the Role of Hard Labels in Mitigating Local Semantic Drift | arXiv: 2512.15647
- Harnessing Reasoning Trajectories for Hallucination Detection via Answer-agreement Representation Shaping | arXiv: 2601.17467
- HASTE: Hardware-Aware Dynamic Sparse Training for Large Output Spaces | arXiv: 2606.01117
- HawkesLLM: Semantic Uncertainty Propagation in Agentic Text Simulation | arXiv: 2605.23043
- HDFlow: Hierarchical Diffusion-Flow Planning for Long-horizon Tasks | arXiv: 2605.04525
- HE-SNR: Uncovering Latent Logic via Entropy for Guiding Mid-Training on SWE-bench | arXiv: 2601.20255
- HEDP: A Hybrid Energy-Distance Prompt-based Framework for Domain Incremental Learning | arXiv: 2605.05776
- HELIX: Hybrid Encoding with Learnable Identity and Cross-dimensional Synthesis for Time Series Imputation | arXiv: 2605.02278
- Helpful to a Fault: Measuring Illicit Assistance in Multi-Turn, Multilingual LLM Agents | arXiv: 2602.16346
- HEPA: A Self-Supervised Horizon-Conditioned Event Predictive Architecture for Time Series | arXiv: 2605.11130
- Hermite-NGP: Gradient-Augmented Hash Encoding for Learning PDEs | arXiv: 2605.24774
- HGMem: Hypergraph-based Working Memory to Improve Multi-step RAG for Long-Context Complex Relational Modeling | arXiv: 2512.23959
- Hidden Error Awareness in Chain-of-Thought Reasoning: The Signal Is Diagnostic, Not Causal | arXiv: 2605.09502
- Hidden in Plain Tokens: Simply Robust, Gradient-Free Watermark for Synthetic Audio | arXiv: 2605.25967
- Hiding in Plain Floats: Steganographic Carriers for Indirect Prompt and Content Injection | arXiv: 2606.08403
- Hierarchical Abstract Tree for Cross-Document Retrieval-Augmented Generation | arXiv: 2605.00529
- Hierarchical Image Tokenization for Multi-Scale Image Super Resolution | arXiv: 2605.14891
- Hierarchical Synthetic Tabular Data Generation: A Hybrid Top-Down and Bottom-Up Framework | arXiv: 2605.28198
- HiPER: Hierarchical Reinforcement Learning with Explicit Credit Assignment for Large Language Model Agents | arXiv: 2602.16165
- HiPPO Zoo: Explicit Memory Mechanisms for Interpretable State Space Models | arXiv: 2602.21340
- Hista and Numca: Estimate State Value Effectively for LLM Reinforcement Learning | arXiv: 2605.29782
- HO-SFL: Hybrid-Order Split Federated Learning with Backprop-Free Clients and Dimension-Free Aggregation | arXiv: 2603.14773
- HOI-PAGE: Zero-Shot Human-Object Interaction Generation with Part Affordance Guidance | arXiv: 2506.07209
- HoloFair: Unified T2I Fairness Evaluation and Fair-GRPO Debiasing | arXiv: 2605.24687
- Honest Lying: Understanding Memory Confabulation in Reflexive Agents | arXiv: 2605.29463
- How 'Neural' is a Neural Foundation Model? | arXiv: 2601.21508
- How can embedding models bind concepts? | arXiv: 2605.31503
- How can we assess human-agent interactions? Case studies in software agent design | arXiv: 2510.09801
- How Does Bayesian Sampling Help Membership Inference Attacks? | arXiv: 2503.07482
- How Does Reasoning Flow? Tracing Attention-Induced Information Flow for Targeted RL in LLMs | arXiv: 2606.10646
- How Far Ahead Do LLMs Plan? Uncovering the Latent Horizon in Chain-of-Thought Reasoning | arXiv: 2602.02103
- How Few-Shot Examples Add Up: A Causal Decomposition of Function Vectors in In-Context Learning | arXiv: 2605.16591
- How Hard Can It Be? Hardness-Aware Multi-Objective Unlearning | arXiv: 2606.02119
- How Language Models Process Negation | arXiv: 2605.03052
- How Many Different Outputs Can a Transformer Generate? | arXiv: 2605.22223
- How Reasoning Evolves from Post-Training Data: An Empirical Study Using Chess | arXiv: 2604.05134
- How the Optimizer Shapes Learned Solutions in Equivariant Neural Networks | arXiv: 2605.27662
- HRC + DSPPO: Separating Transitive and Cyclic Preferences via Game-Theoretic Decomposition | arXiv: 2605.17342
- HSGG: Training-Free Hierarchical Scene Graph Generation with Geometry-Guided Relation Reasoning
- Hunt Instead of Wait: Evaluating Deep Data Research on Large Language Models | arXiv: 2602.02039
- Hyper-ICL: Attention Calibration with Hyperbolic Anchor Distillation for Multimodal ICL | arXiv: 2605.29103
- Hyperbolic Neural Population Geometry Benefits Computation | arXiv: 2606.10238
- Hyperparameter Transfer with Mixture-of-Experts Layers | arXiv: 2601.20205
- Hölder++: Improving the Quality-Coherence Trade-off in Multimodal VAEs | arXiv: 2606.13381
- Identifiable Equivariant Networks are Layerwise Equivariant | arXiv: 2601.21645
- Identifying and Correcting Label Noise for Robust GNNs via Influence Contradiction | arXiv: 2601.17469
- IdEst: Assessing Self-Supervised Learning Representations via Intrinsic Dimension | arXiv: 2606.03338
- IDLM: Inverse-distilled Diffusion Language Models | arXiv: 2602.19066
- IDO: Incongruity-Aware Distribution Optimization for Multimodal Fake News Detection | arXiv: 2605.29116
- If open source is to win, it must go public | arXiv: 2507.09296
- iLoRA: Bayesian Low-Rank Adaptation with Latent Interaction Graphs for Microbiome Diagnosis | arXiv: 2605.30179
- Image Restoration via Diffusion Models with Dynamic Resolution | arXiv: 2605.14267
- Images as Tables: In-Context Learning with TabPFN for Low-Data Detection of AI-Generated Images | arXiv: 2606.00872
- Imagination Helps Visual Reasoning, But Not Yet in Latent Space | arXiv: 2602.22766
- Immuno-VLM: Immunizing Large Vision-Language Models via Generative Semantic Antibodies for Open-World Trustworthiness | arXiv: 2605.30745
- IMPACT: Influence Modeling for Open-Set Time Series Anomaly Detection | arXiv: 2603.29183
- Implicit Preference Alignment for Human Image Animation | arXiv: 2605.07545
- Implicit Safety Alignment from Crowd Preferences | arXiv: 2605.21822
- Improved Convergence Analysis of Topology Dependence in Decentralized SGD | arXiv: 2606.09154
- In Defense of Information Leakage in Concept-based Models | arXiv: 2606.10669
- In-Context Routing (ICR): Train-Once, Use-Everywhere Attention-Level Implicit ICL | arXiv: 2509.22854
- In-Training Defenses Against Emergent Misalignment in Language Models | arXiv: 2508.06249
- Incentivized Exploration with Stochastic Covariates: A Two-Stage Mechanism Design for Recommender System | arXiv: 2406.04374
- Inconsistency-Aware Minimization: Improving Generalization with Unlabeled Data | arXiv: 2605.31324
- Incremental BPE Tokenization | arXiv: 2605.30813
- Incremental Transformer Neural Processes | arXiv: 2602.18955
- Inducing Overthink: Hierarchical Genetic Algorithm-based DoS Attack on Black-Box Large Language Reasoning Models | arXiv: 2605.13338
- Industrializing Prediction-Powered Inference: The GLIDE Library for Reliable GenAI and Agentic Systems Evaluation | arXiv: 2605.31278
- Inference of Online Newton Methods with Nesterov's Accelerated Sketching | arXiv: 2604.23436
- Inference Time Optimization with Confidence Dynamics | arXiv: 2605.25244
- Inference-Time Conformal Reasoning with Valid Factuality Control for Large Language Models | arXiv: 2606.08831
- Influence-Guided Symbolic Regression: Scientific Discovery via LLM-Driven Equation Search with Granular Feedback | arXiv: 2605.29184
- InfoAtlas: A Foundation Model for Zero-Shot Statistical Dependence Estimation | arXiv: 2606.00241
- InfoLaw: Information Scaling Laws for Large Language Models with Quality-Weighted Mixture Data and Repetition | arXiv: 2605.02364
- Information-Geometric Adaptive Sampling for Graph Diffusion | arXiv: 2605.00250
- Informed Asymmetric Actor-Critic: Leveraging Privileged Signals Beyond Full-State Access | arXiv: 2509.26000
- InftyThink+: Effective and Efficient Infinite-Horizon Reasoning via Reinforcement Learning | arXiv: 2602.06960
- Initialization is Half the Battle: Generating Diverse Images from a Guidance Potential Posterior | arXiv: 2606.02453
- Injecting Distributional Awareness into MLLMs via Reinforcement Learning for Deep Imbalanced Regression | arXiv: 2605.01402
- InnoEval: On Research Idea Evaluation as a Knowledge-Grounded, Multi-Perspective Reasoning Problem | arXiv: 2602.14367
- Insertion Based Sequence Generation with Learnable Order Dynamics | arXiv: 2602.18695
- Instruction Lens Score: Your Instruction Contributes a Powerful Object Hallucination Detector for Multimodal Large Language Models | arXiv: 2605.12258
- Interaction-Breaking Adversarial Learning Framework for Robust Multi-Agent Reinforcement Learning | arXiv: 2605.18024
- Internalizing Agency from Reflective Experience | arXiv: 2603.16843
- Internalizing Safety Understanding in Large Reasoning Models via Verification | arXiv: 2605.08930
- Interpretability and Generalization Bounds for Learning Spatial Physics | arXiv: 2506.15199
- Interpretability Can Be Actionable | arXiv: 2605.11161
- Interpretability in Deep Time Series Models Demands Semantic Alignment | arXiv: 2602.02239
- Interpretable Equivariant Marks for Contrastive Cosmological Inference | arXiv: 2606.11295
- Interpretable Self-Supervised Learning via Representer Landmarks and Nyström Approximation | arXiv: 2509.24467
- Inverse Depth Scaling From Most Layers Being Similar | arXiv: 2602.05970
- Investigating Advanced Reasoning of Large Language Models via Black-Box Environment Interaction | arXiv: 2508.19035
- Investigating Memory in Model-Free RL with POPGym Arcade | arXiv: 2503.01450
- IQA-Spider: Unifying Multi-Granularity Image Quality Assessment with Reasoning, Grounding and Referring | arXiv: 2605.24553
- IR3DE: A Linear Router for Large Language Models | arXiv: 2606.06098
- Is Code Better Than Language for Algorithmic Reasoning? | arXiv: 2606.15589
- Is One Layer Enough? Understanding Inference Dynamics in Tabular Foundation Models | arXiv: 2605.06510
- Is Spurious Correlation Removal Always Learnable? | arXiv: 2606.12930
- Is Your LLM Overcharging You? Tokenization, Transparency, and Incentives | arXiv: 2505.21627
- It's a TRAP! Task-Redirecting Agent Persuasion Benchmark for Web Agents | arXiv: 2512.23128
- It's TIME: Towards the Next Generation of Time Series Forecasting Benchmarks | arXiv: 2602.12147
- Iterative Refinement Neural Operators are Learned Fixed-Point Solvers: A Principled Approach to Spectral Bias Mitigation | arXiv: 2605.24041
- iTryOn: Mastering Interactive Video Virtual Try-On with Spatial-Semantic Guidance | arXiv: 2605.21431
- iVGR: Internalizing Visually Grounded Reasoning for MLLMs with Reinforcement Learning | arXiv: 2605.31096
- iWorld-Bench: A Benchmark for Interactive World Models with a Unified Action Generation Framework | arXiv: 2605.03941
- JAEGER: Joint 3D Audio-Visual Grounding and Reasoning in Simulated Physical Environments | arXiv: 2602.18527
- Jailbreak to Protect: Buffering and Reinforcing via Temporary Jailbreaking for Safe Fine-Tuning in Large Language Models | arXiv: 2605.24550
- Jailbreaking Vision-Language Models Through the Visual Modality | arXiv: 2605.00583
- Joint Model and Data Sparsification via the Marginal Likelihood | arXiv: 2605.29107
- Kalman Linear Attention: Parallel Bayesian Filtering For Efficient Language Modelling and State Tracking | arXiv: 2602.10743
- KBQA-R1: Reinforcing Large Language Models for Knowledge Base Question Answering | arXiv: 2512.10999
- KnapSpec: Self-Speculative Decoding via Adaptive Layer Selection as a Knapsack Problem | arXiv: 2602.20217
- Knowing Isn't Understanding: Re-Grounding Generative Proactivity with Epistemic and Behavioral Insight | arXiv: 2602.15259
- KORE: Enhancing Knowledge Injection for Large Multimodal Models via Knowledge-Oriented Controls | arXiv: 2510.19316
- Korean Culture into LLM Alignment: Toward Cultural Coherence | arXiv: 2606.06797
- Krause Synchronization Transformers | arXiv: 2602.11534
- L\(^3\): Large Lookup Layers | arXiv: 2601.21461
- L2G-Net: Local to Global Spectral Graph Neural Networks via Cauchy Factorizations | arXiv: 2602.18837
- LabBuilder: Protocol-Grounded 3D Layout Generation for Interactable and Safe Laboratory | arXiv: 2605.02288
- LABO: LLM-Accelerated Bayesian Optimization through Broad Exploration and Selective Experimentation | arXiv: 2605.22054
- Lagrangian Perturbation Diffusion Steering: Latent Reinforcement Learning for Generative Policies | arXiv: 2606.01151
- LangForce: Bayesian Decomposition of Vision-Language-Action Models via Latent Action Queries | arXiv: 2601.15197
- Laplacian Representations for Decision-Time Planning | arXiv: 2602.05031
- LAPRAS: Learning-Augmented PRivate Answering for Linear Query Streams | arXiv: 2605.01960
- LARE: Low-Attention Region Encoding for Text–Image Retrieval | arXiv: 2606.18885
- Large Language Models Should Learn Personalized Rather Than Aggregated Human Preferences | arXiv: 2606.07629
- Large Vision-Language Models Get Lost in Attention | arXiv: 2605.05668
- LASER: Learning Active Sensing for Continuum Field Reconstruction | arXiv: 2604.19355
- Latent Diffusion Pretraining for Crystal Property Prediction | arXiv: 2606.00776
- Latent Laplace Diffusion for Irregular Multivariate Time Series | arXiv: 2605.19805
- Latent Reasoning VLA: Latent Thinking and Prediction for Vision-Language-Action Models | arXiv: 2602.01166
- Latent Representation Alignment for Offline Goal-Conditioned Reinforcement Learning | arXiv: 2605.25740
- LatentChem: From Textual CoT to Latent Thinking in Chemical Reasoning | arXiv: 2602.07075
- LatentLens: Revealing Highly Interpretable Visual Tokens in LLMs | arXiv: 2602.00462
- Layer-Specific Fine-Tuning for Improved Negation Handling in Medical Vision-Language Models | arXiv: 2602.12498
- LazyAttention: Efficient Retrieval-Augmented Generation with Deferred Positional Encoding | arXiv: 2606.04302
- LBR/LBP: Language Bias in LVLMs — From In-Depth Analysis to Simple and Effective Mitigation | arXiv: 2605.25036
- LC-QAT: Data-Efficient 2-Bit QAT for LLMs via Linear-Constrained Vector Quantization | arXiv: 2606.10531
- LEAP: Learnable End-to-End Adaptive Pruning of Large Language Models | arXiv: 2605.17289
- Learn from A Rationalist: Distilling Intermediate Interpretable Rationales | arXiv: 2601.22531
- Learn to Think: Improving Multimodal Reasoning through Vision-Aware Self-Improvement Training | arXiv: 2605.11931
- Learnable Kernel Density Estimation for Graphs and Its Application to Graph-Level Anomaly Detection | arXiv: 2505.21285
- Learned Subspace Compression for Communication-Efficient Pipeline Parallelism | arXiv: 2606.05484
- Learning a Zeroth-Order Optimizer for Fine-Tuning LLMs | arXiv: 2510.00419
- Learning Coherent Representations: A Topological Approach to Interpretability | arXiv: 2606.02841
- Learning Context-Conditioned Predicate Semantics via Prototype Feedback | arXiv: 2605.29610
- Learning Credal Ensembles via Distributionally Robust Optimization | arXiv: 2602.08470
- Learning Design Skills as Memory Policies for Agentic Photonic Inverse Design | arXiv: 2605.29421
- Learning Dynamics of Zeroth-Order Optimization: A Kernel Perspective | arXiv: 2605.03373
- Learning Efficient Guardrails for Compliance | arXiv: 2510.03485
- Learning from Fine-Grained Visual Discrepancies: Mitigating Multimodal Hallucinations via In-Context Visual Contrastive Optimization | arXiv: 2605.31312
- Learning General Causal Structures with Hidden Dynamic Process for Climate Analysis | arXiv: 2501.12500
- Learning Graph Foundation Models on Riemannian Graph-of-Graphs | arXiv: 2605.09993
- Learning GUI Grounding with Spatial Reasoning from Visual Feedback | arXiv: 2509.21552
- Learning in Structured Stackelberg Games | arXiv: 2504.09006
- Learning Instance-Adaptive Low-Rank Orthogonal Subspaces for Clothes-Changing Person Re-Identification | arXiv: 2606.11661
- Learning Locally, Revising Globally: Global Reviser for Federated Learning with Noisy Labels | arXiv: 2412.00452
- Learning Long Range Spatio-Temporal Representations over Continuous Time Dynamic Graphs with State Space Models | arXiv: 2606.04672
- Learning Manifold and Itô Dynamics with Branched Neural Rough Differential Equations | arXiv: 2606.05272
- Learning Multi-Scale Hypergraph for High-Order Brain Connectivity Analysis | arXiv: 2606.03310
- Learning Normalized Energy Models for Linear Inverse Problems | arXiv: 2605.15487
- Learning Permutation-Invariant Macroscopic Dynamics | arXiv: 2605.30812
- Learning Protein Structure-Function Relationships through Knowledge-guided Representation Decomposition | arXiv: 2605.23960
- Learning Query-Aware Budget-Tier Routing for Runtime Agent Memory | arXiv: 2602.06025
- Learning Randomized Reductions | arXiv: 2412.18134
- Learning the Interaction Prior for Protein-Protein Interaction Prediction: A Model-Agnostic Approach | arXiv: 2605.09964
- Learning the Neighborhood: Contrast-Free Multimodal Self-Supervised Molecular Graph Pretraining | arXiv: 2509.22468
- Learning to Approximate Uniform Facility Location via Graph Neural Networks | arXiv: 2602.13155
- Learning to Bet for Horizon-Aware Anytime-Valid Testing | arXiv: 2603.19551
- Learning to Extrapolate to New Tasks: A Relational Approach to Task Extrapolation | arXiv: 2605.30132
- Learning to Refine: Spectral-Decoupled Iterative Refinement Framework for Precipitation Nowcasting | arXiv: 2606.02661
- Learning to Route Languages for Multilingual Policy Optimization | arXiv: 2605.25360
- Learning to Search and Searching to Learn for Generalization in Planning | arXiv: 2605.25720
- Learning Unmasking Policies for Diffusion Language Models | arXiv: 2512.09106
- Learning-Augmented Scalable Linear Assignment Problem Optimization via Neural Dual Warm-Starts | arXiv: 2605.09382
- LEC: Linear Expectation Constraints for Selection-Conditioned Risk Control in Selective Prediction and Routing Systems | arXiv: 2512.01556
- Left-Right Symmetry Breaking in CLIP-style Vision-Language Models Trained on Synthetic Spatial-Relation Data | arXiv: 2601.12809
- LEMUR: Learned Multi-Vector Retrieval | arXiv: 2601.21853
- Less Data, Faster Training: Repeating Smaller Datasets Speeds Up Learning via Sampling Biases | arXiv: 2605.20314
- Less Diverse, Less Safe: The Indirect But Pervasive Risk of Test-Time Scaling in Large Language Models | arXiv: 2510.08592
- Less Is More: Elevating RAG via Performance-Driven Context Compression | arXiv: 2508.19282
- Less Precise Can Be More Reliable: A Systematic Evaluation of Quantization's Impact on VLMs Beyond Accuracy | arXiv: 2509.21173
- Let EEG Models Learn EEG | arXiv: 2605.21280
- LFQ: Logit-aware Final-block Quantization for Boosting the Generation Quality of Low-Bit Quantized LLMs | arXiv: 2605.29756
- Lifting Traces to Logic: Programmatic Skill Induction with Neuro-Symbolic Learning for Long-Horizon Agentic Tasks | arXiv: 2605.01293
- LiftQuant: Continuous Bit-Width LLM via Dimensional Lifting and Projection | arXiv: 2606.04050
- Light Forcing: Accelerating Autoregressive Video Diffusion via Sparse Attention | arXiv: 2602.04789
- LightAVSeg: Lightweight Audio-Visual Segmentation | arXiv: 2605.08805
- Lightning Unified Video Editing via In-Context Sparse Attention | arXiv: 2605.04569
- Limits of Convergence-Rate Control for Open-Weight Safety | arXiv: 2602.18868
- LimiX-2M: Mitigating Low-Rank Collapse and Attention Bottlenecks in Tabular Foundation Models | arXiv: 2606.04485
- LIMMT: Less is More for Motion Tracking | arXiv: 2606.06953
- LIMSSR: LLM-Driven Sequence-to-Score Reasoning under Training-Time Incomplete Multimodal Observations | arXiv: 2605.00434
- LiMuon: Light and Fast Muon Optimizer for Large Models | arXiv: 2509.14562
- LineageFlow: Flow Matching for High-Fidelity Family-Aware Protein Sequence Generation | arXiv: 2205.22252
- Linearizing Vision Transformer with Test-Time Training | arXiv: 2605.02772
- Linguistic Nepotism: Trading-off Quality for Language Preference in Multilingual RAG | arXiv: 2509.13930
- LithoGRPO: Fast Inverse Lithography via GRPO Reinforced Flow Matching | arXiv: 2606.00228
- LK Losses: Direct Acceptance Rate Optimization for Speculative Decoding | arXiv: 2602.23881
- LLM Agents Are the Antidote to Walled Gardens | arXiv: 2506.23978
- LLM Benchmark Datasets Should Be Contamination-Resistant (Position Paper) | arXiv: 2605.19999
- LLM Self-Recognition: Steering and Retrieving Activation Signatures | arXiv: 2606.06315
- LLM-Guided Communication for Cooperative Multi-Agent Reinforcement Learning | arXiv: 2605.18077
- LLMs as Noisy Channels: A Shannon Perspective on Model Capacity and Scaling Laws | arXiv: 2605.23901
- LLMs Lean on Priors, Not Programming Language Semantics | arXiv: 2510.03415
- Local and Mixing-Based Algorithms for Gaussian Graphical Model Selection from Glauber Dynamics | arXiv: 2412.18594
- Local Hessian Spectral Filtering for Robust Intrinsic Dimension Estimation | arXiv: 2605.01221
- Localized, High-resolution Geographic Representations with Slepian Functions | arXiv: 2602.00392
- Localizing Memorized Regions in Diffusion Models via Coordinate-Wise Curvature Differences | arXiv: 2605.26756
- Locally Coherent Parallel Decoding in Diffusion Language Models | arXiv: 2603.20216
- LocoT2V-Bench: Benchmarking Long-form and Complex Text-to-Video Generation | arXiv: 2510.26412
- Long Live The Balance: Information Bottleneck Driven Tree-based Policy Optimization | arXiv: 2605.28109
- Long-Horizon Model-Based Offline Reinforcement Learning Without Explicit Conservatism | arXiv: 2512.04341
- Lookahead Sample Reward Guidance for Test-Time Scaling of Diffusion Models | arXiv: 2602.03211
- LoRA-DA: Data-Aware Initialization for Low-Rank Adaptation via Asymptotic Analysis | arXiv: 2510.24561
- LoRe: Adaptive Interaction-Evaluation Routing with Per-Step Interaction Budgets for Iterative Graph Solvers | arXiv: 2605.29005
- Loss Landscape Diagnosis for Gradient-Based Gray-Scott System Inversion: Disentangling the Roles of PINN Components | arXiv: 2606.11258
- Lower Complexity Bounds for Nonconvex-Strongly-Convex Bilevel Optimization with First-Order Oracles | arXiv: 2511.19656
- LuVe: Latent-Cascaded Ultra-High-Resolution Video Generation with Dual Frequency Experts | arXiv: 2602.11564
- MAAT: Heterogeneous Partial Observation State Reconstruction Based on Knowledge-Guided Kernel Regression | arXiv: 2601.22328
- MacArena: Benchmarking Computer Use Agents on an Online macOS Environment | arXiv: 2606.06560
- Making Expert Reasoning Learnable with Self-Distillation | arXiv: 2602.02405
- Making Models Unmergeable via Scaling-Sensitive Loss Landscape | arXiv: 2601.21898
- MalTree: Tracing Malware Evolution from Embeddings at Scale | arXiv: 2606.06570
- Manga109-v2026: Revisiting Manga109 Annotations for Modern Manga Understanding | arXiv: 2605.21182
- Manifold-Aligned Guided Integrated Gradients for Reliable Feature Attribution | arXiv: 2605.02167
- ManiSoft: Towards Vision-Language Manipulation for Soft Continuum Robotics | arXiv: 2605.18617
- Many-Shot CoT-ICL: Making In-Context Learning Truly Learn | arXiv: 2605.13511
- Mapping Human Anti-collusion Mechanisms to Multi-agent AI Systems | arXiv: 2601.00360
- Margin-Adaptive Confidence Ranking for Reliable LLM Judgement | arXiv: 2605.15416
- Markov Chain Monte Carlo without Evaluating the Target: An Auxiliary Variable Approach | arXiv: 2406.05242
- Marrying Generative Model of Healthcare Events with Digital Twin of Social Determinants of Health for Disease Reasoning | arXiv: 2605.09771
- MARS: Modular Agent with Reflective Search for Automated AI Research | arXiv: 2602.02660
- MAS-Orchestra: Understanding and Improving Multi-Agent Reasoning Through Holistic Orchestration and Controlled Benchmarks | arXiv: 2601.14652
- Masks Can Be Distracting: On Context Comprehension in Diffusion Language Models | arXiv: 2511.21338
- MASPO: Joint Prompt Optimization for LLM-based Multi-Agent Systems | arXiv: 2605.06623
- MASPOB: Multi-Agent Prompt Optimization via GNN Surrogate + LinUCB + Coordinate Ascent | arXiv: 2603.02630
- MatchFixAgent: Language-Agnostic Autonomous Repository-Level Code Translation Validation and Repair | arXiv: 2509.16187
- Matroid Algorithms Under Size-Sensitive Independence Oracles | arXiv: 2605.00201
- MCP-Persona: Evaluating LLM Agent Capabilities in Real-World Personal Applications via Environment Simulation | arXiv: 2606.02470
- Mean-Shift PCA by Knockoff Mean | arXiv: 2605.25460
- Measurement Plasticity: Sensor-Level Adaptation for Vision–Language Models | arXiv: 2512.12571
- Measurement-Consistent Langevin Corrector for Stabilizing Latent Diffusion Inverse Problem Solvers | arXiv: 2601.04791
- Measuring Agents in Production | arXiv: 2512.04123
- Measuring Weak-to-Strong Legibility of Reasoning Models | arXiv: 2603.20508
- MECAT: A Multi-Experts Constructed Benchmark for Fine-Grained Audio Understanding Tasks | arXiv: 2507.23511
- Med-Scout: Curing MLLMs' Geometric Blindness in Medical Perception via Geometry-Aware RL Post-Training | arXiv: 2601.23220
- MedCase-Structured: A Text-to-FHIR Dataset for Benchmarking Diagnostic Reasoning in Clinically Realistic EHR Settings | arXiv: 2605.30295
- MedCoG: Maximizing LLM Inference Density in Medical Reasoning via Meta-Cognitive Regulation | arXiv: 2602.07905
- MedCRP-CL: Continual Medical Image Segmentation via Bayesian Nonparametric Semantic Modality Discovery | arXiv: 2605.20297
- MedMosaic: A Challenging Large Scale Benchmark of Diverse Medical Audio | arXiv: 2605.00969
- MedSIGHT: Towards Grounded Visual Comprehension in Medical Large Vision-Language Models | arXiv: 2606.06760
- MEG-XL: Data-Efficient Brain-to-Text via Long-Context Pre-Training | arXiv: 2602.02494
- Memetic Capture: A Pluralistic Policy Framework for Governing AI-Driven Cultural Disempowerment | arXiv: 2606.07802
- Memorization Dynamics of Fill-in-the-Middle Pretraining | arXiv: 2605.22981
- Memory as a Markov Matrix: Sample Efficient Knowledge Expansion via Token-to-Dictionary Mapping | arXiv: 2605.04308
- Memory is Reconstructed, Not Retrieved: Graph Memory for LLM Agents | arXiv: 2606.06036
- Memory-Efficient LLM Pretraining via Minimalist Optimizer Design | arXiv: 2506.16659
- Memory-Efficient Partitioned DNN Inference on Resource-Constrained Android Crowds | arXiv: 2605.20723
- MentisOculi: Revealing the Limits of Reasoning with Mental Imagery | arXiv: 2602.02465
- MEnvAgent: Scalable Polyglot Environment Construction for Verifiable Software Engineering | arXiv: 2601.22859
- MESA: Improving MoE Safety Alignment via Decentralized Expertise | arXiv: 2606.00651
- Mesh Field Theory: Port–Hamiltonian Formulation of Mesh-Based Physics | arXiv: 2605.00394
- Message Tuning Outshines Graph Prompt Tuning: A Prismatic Space Perspective | arXiv: 2606.03290
- MET-Bench: Multimodal Entity Tracking for Evaluating the Limitations of Vision-Language and Reasoning Models | arXiv: 2502.10886
- Meta-learning Structure-Preserving Dynamics | arXiv: 2508.11205
- Metadata Predictability Is Not Evidence Dependence: An Intervention-Based Audit for Weak-Label Benchmarks | arXiv: 2605.23701
- MetaDNS: Enhancing Exploration in Discrete Neural Samplers via Well-Tempered Metadynamics | arXiv: 2605.21722
- MetaMoE: Diversity-Aware Proxy Selection for Privacy-Preserving Mixture-of-Experts Unification | arXiv: 2605.14289
- MetaphorVU: Towards Metaphorical Video Understanding | arXiv: 2605.25461
- Metis: Learning to Jailbreak LLMs via Self-Evolving Metacognitive Policy Optimization | arXiv: 2605.10067
- MFPO: Accelerating MaxEnt RL to Gaussian Policy Speeds with Few-step MeanFlow Policy | arXiv: 2604.14698
- MIC: Maximizing Informational Capacity in Adaptive Representations via Isotropic Subspace Alignment | arXiv: 2605.29987
- Mind Dreamer: Untethering Imagination via Active Causal Intervention on Latent Manifolds | arXiv: 2605.16030
- Mind the Gap: Mixtures of Gaussians in Approximate Differential Privacy | arXiv: 2605.28078
- Mind Your Margin and Boundary: Are Your Distilled Datasets Truly Robust? | arXiv: 2605.20606
- MIND: Multi-Rationale Integrated Discriminative Reasoning Framework for Multi-Modal Fake News | arXiv: 2605.29117
- MindZero: Learning Online Mental Reasoning with Zero Annotations | arXiv: 2606.00240
- MineDraft: A Framework for Batch Parallel Speculative Decoding | arXiv: 2603.18016
- Minibatch Selection via Partition Matroid Constrained Gradient Matching | arXiv: 2606.07954
- Minim: Privacy-Aware Minimal View for Agents via Trusted Local Sanitization | arXiv: 2606.13949
- MiniMax Learning of Interpretable Factored Stochastic Policies from Conjoint Data, with Uncertainty Quantification | arXiv: 2504.19043
- MIRO: Multi-Reward Conditioned Pretraining for Simultaneously Improving T2I Quality and Efficiency | arXiv: 2510.25897
- Mirror Descent Under Generalized Smoothness | arXiv: 2502.00753
- Mirror Mean-Field Langevin Dynamics | arXiv: 2505.02621
- Mitigating Error Accumulation in Continuous Navigation via Memory-Augmented Kalman Filtering | arXiv: 2602.11183
- Mitigating Hallucinations in Large Vision-Language Models via Causal Route Gating | arXiv: 2605.24024
- Mitigating Label Shift in Tabular In-Context Learning via Test-Time Posterior Adjustment | arXiv: 2605.04363
- Mitigating Manifold Departure: Uncertainty-Aware Subspace Rectification for Trustworthy MLLM Decoding | arXiv: 2606.09859
- Mitigating Perceptual Judgment Bias in Multimodal LLM-as-a-Judge via Perceptual Perturbation and Reward Modeling | arXiv: 2606.02578
- Mitigating Reward Hacking in RLHF via Bayesian Non-negative Reward Modeling | arXiv: 2602.10623
- Mitigating Staleness in Asynchronous Pipeline Parallelism via Basis Rotation | arXiv: 2602.03515
- Mitigating the Contractivity Trap in Diffusion ODEs via Stein Stabilization | arXiv: 2606.07835
- MiVE: Multiscale Vision-language features for reference-guided video Editing | arXiv: 2605.14664
- Mix, Don't Pick: Why Synthetic Corpus Composition Matters for Time Series Foundation Model Pretraining | arXiv: 2606.09912
- Mixture of Horizons in Action Chunking | arXiv: 2511.19433
- Mixture Prototype Flow Matching for Open-Set Supervised Anomaly Detection | arXiv: 2605.02438
- ML-Embed: Inclusive and Efficient Embeddings for a Multilingual World | arXiv: 2605.15081
- MLUBench: A Benchmark for Lifelong Unlearning Evaluation in MLLMs | arXiv: 2606.12809
- MM-Snowball: Evaluating and Mitigating Hallucination Snowballing in Multimodal Multi-Turn Dialogue | arXiv: 2606.00622
- MMD-Balls as Credal Sets: A PAC-Bayesian Framework for Epistemic Uncertainty in Test-Time Adaptation | arXiv: 2605.21783
- MoDA: Modulation Adapter for Fine-Grained Visual Grounding in Instructional MLLMs | arXiv: 2506.01850
- Model Merging Scaling Laws in Large Language Models | arXiv: 2509.24244
- Model-Dowser: Data-Free Importance Probing to Mitigate Catastrophic Forgetting in Multimodal Large Language Models | arXiv: 2602.04509
- Modeling Hierarchical Thinking in Large Reasoning Models | arXiv: 2510.22437
- MoMa QL: Accelerating Diffusion/Flow Matching Policies for Offline and Offline-to-Online RL via Moment Matching | arXiv: 2605.29033
- MOOSE-Star: Unlocking Tractable Training for Scientific Discovery by Breaking the Complexity Barrier | arXiv: 2603.03756
- More Capable, Less Cooperative? When LLMs Fail At Zero-Cost Collaboration | arXiv: 2604.07821
- MOSAIC: Learning When to Act or Refuse — Guarding Agentic Reasoning Models for Safe Multi-step Tool Use | arXiv: 2603.03205
- MoshiRAG: Asynchronous Knowledge Retrieval for Full-Duplex Speech Language Models | arXiv: 2604.12928
- MotiMotion: Motion-Controlled Video Generation with Visual Reasoning | arXiv: 2605.22818
- MotionGRPO: Overcoming Low Intra-Group Diversity in GRPO-Based Egocentric Motion Recovery | arXiv: 2605.05680
- Moving Out: Physically-grounded Human-AI Collaboration | arXiv: 2507.18623
- Multi\(^2\): Hierarchical Multi-Agent Decision-Making with LLM-Based Agents in Interactive Environments | arXiv: 2606.03698
- Multi-Adapter Representation Interventions via Energy Calibration | arXiv: 2605.28722
- Multi-Agent Decision-Focused Learning via Value-Aware Sequential Communication | arXiv: 2604.08944
- Multi-Agent Reinforcement Learning from Delayed Marketplace Feedback for Objective-Weight Adaptation in Three-Sided Dispatch | arXiv: 2606.13604
- Multi-Agent Systems are Mixtures of Experts: Who Becomes an Influencer? | arXiv: 2605.25929
- Multi-Agent Teams Hold Experts Back: Why Self-Organized LLM Teams Fail to Retain "Experts" | arXiv: 2602.01011
- Multi-Level Strategic Classification: Incentivizing Improvement Through Promotion and Relegation Dynamics | arXiv: 2602.11439
- Multi-Objective Bayesian Optimization via Adaptive ε-Constraints Decomposition | arXiv: 2604.15959
- Multi-task Linear Regression without Eigenvalue Lower Bounds: Adaptivity, Robustness and Safety | arXiv: 2605.17126
- MultiBreak: A Scalable and Diverse Multi-turn Jailbreak Benchmark for Evaluating LLM Safety | arXiv: 2605.01687
- Multilingual Unlearning in LLMs: Transfer, Dynamics, and Reversibility | arXiv: 2606.03291
- Multimodal Continual Learning with MLLMs from Multi-scenario Perspectives | arXiv: 2511.18507
- Multimodal Fact-Level Attribution for Verifiable Reasoning | arXiv: 2602.11509
- Multimodal Fusion via Self-Consistent Task-Gradient Fields | arXiv: 2410.15475
- Multiple Choice Learning of Low-Rank Adapters for Language Modeling | arXiv: 2507.10419
- Muon in Associative Memory Learning: Training Dynamics and Scaling Laws | arXiv: 2602.05725
- MUSE: Resolving Manifold Misalignment in Visual Tokenization via Topological Orthogonality | arXiv: 2605.05646
- MusicDET: Zero-Shot AI-Generated Music Detection | arXiv: 2605.18072
- MVR-cache: Optimizing Semantic Caching via Multi-Vector Retrieval and Learned Prompt Segmentation | arXiv: 2605.24914
- MōLe-Λ: Learning the Coupled-Cluster Response State for Energies, Gradients, and Properties | arXiv: 2605.29622
- NAACA: Training-Free NeuroAuditory Attentive Cognitive Architecture with Oscillatory Working Memory for Salience-Driven Attention Gating | arXiv: 2605.13651
- Names Don't Matter: Symbol-Invariant Transformer for Open-Vocabulary Learning | arXiv: 2601.23169
- NanoQuant: Efficient Sub-1-Bit Quantization of Large Language Models | arXiv: 2602.06694
- NarrativeWorldBench: A Frontier-Saturated Benchmark and a Latent World Model for Long-Horizon Co-Creative Audio Drama | arXiv: 2606.17391
- Native Active Perception as Reasoning for Omni-Modal Understanding | arXiv: 2606.19341
- NaviAgent: Graph-Driven Bilevel Planning for Scalable Tool Orchestration | arXiv: 2506.19500
- nD-RoPE: A Generalized RoPE for n-Dimensional Position Embedding | arXiv: 2606.12146
- NEMO: Execution-Aware Optimization Modeling via Autonomous Coding Agents | arXiv: 2601.21372
- Nested Spatio-Temporal Time Series Forecasting | arXiv: 2605.16447
- Networked Information Aggregation for Binary Classification | arXiv: 2605.01082
- NeUQI: Near-Optimal Uniform Quantization Parameter Initialization for Low-Bit LLMs | arXiv: 2505.17595
- Neural Collapse by Design: Learning Class Prototypes on the Hypersphere | arXiv: 2605.20302
- Neural Estimation of Pairwise Mutual Information in Masked Discrete Sequence Models | arXiv: 2605.20187
- Neural Implicit Action Fields: From Discrete Waypoints to Continuous Functions for Vision-Language-Action Models | arXiv: 2603.01766
- Neural Low-Discrepancy Sequences | arXiv: 2510.03745
- Neural QAOA\(^2\): Differentiable Joint Graph Partitioning and Parameter Initialization for Quantum Combinatorial Optimization | arXiv: 2605.13072
- Neutral-Reference Prompting for Vision-Language Models | arXiv: 2605.15615
- New Bounds for Kernel Sums via Fast Spherical Embeddings | arXiv: 2605.01263
- New Wide-Net-Casting Jailbreak Attacks Risk Large Models | arXiv: 2605.17128
- NITP: Next Implicit Token Prediction for LLM Pre-training | arXiv: 2605.24956
- Noise-Guided Transport: Imitation Learning from Random Priors | arXiv: 2509.26294
- Nonparametric LLM Evaluation from Preference Data | arXiv: 2601.21816
- NonZero: Interaction-Guided Exploration for Multi-Agent Monte Carlo Tree Search | arXiv: 2605.00751
- Not All Prefills Are Equal: PPD Disaggregation for Multi-turn LLM Serving | arXiv: 2603.13358
- NumLeak: Public Numeric Benchmarks as Latent Labels in Foundation Models | arXiv: 2605.30393
- OBCache: Optimal Brain KV Cache Pruning for Efficient Long-Context LLM Inference | arXiv: 2510.07651
- ObjEmbed: Towards Universal Multimodal Object Embeddings | arXiv: 2605.29118
- OcclusionFormer: Arranging Z-Order for Layout-Grounded Image Generation | arXiv: 2605.21343
- Offline Multi-agent Reinforcement Learning via Sequential Score Decomposition | arXiv: 2505.05968
- Offline Preference Optimization for Rectified Flow with Noise-Tracked Pairs | arXiv: 2605.09433
- Offline Reinforcement Learning with Generative Trajectory Policies | arXiv: 2510.11499
- Offline Reinforcement Learning with Universal Horizon Models | arXiv: 2605.15603
- OLAF-World: Orienting Latent Actions for Video World Modeling | arXiv: 2602.10104
- Old Habits Die Hard: How Conversational History Geometrically Traps LLMs | arXiv: 2603.03308
- OLIVIA: Harmonizing Time Series Foundation Models with Power Spectral Density | arXiv: 2605.17340
- OMAC: A Holistic Optimization Framework for LLM-Based Multi-Agent Collaboration | arXiv: 2505.11765
- OmniAID: Decoupling Semantic and Artifacts for Universal AI-Generated Image Detection in the Wild | arXiv: 2511.08423
- OmniSapiens: A Foundation Model for Social Behavior Processing via Heterogeneity-Aware Relative Policy Optimization | arXiv: 2602.10635
- OmniSIFT: Modality-Asymmetric Token Compression for Efficient Omni-modal Large Language Models | arXiv: 2602.04804
- OmniVerifier-M1: Multimodal Meta-Verifier with Explicit Structured Recalibration | arXiv: 2605.28805
- OmniVL-Guard: Towards Unified Vision-Language Forgery Detection and Grounding via Balanced RL | arXiv: 2602.10687
- OMP: One-step Meanflow Policy with Directional Alignment | arXiv: 2512.19347
- On Cost-Effective LLM-as-a-Judge Improvement Techniques | arXiv: 2604.13717
- On Effectiveness and Efficiency of Agentic Tool-calling and RL Training | arXiv: 2606.00135
- On Information Self-Locking in Reinforcement Learning for Active Reasoning of LLM Agents | arXiv: 2603.12109
- On Regret Bounds of Thompson Sampling for Bayesian Optimization | arXiv: 2603.09276
- On Revisiting Entropy for Identifying Mislabeled Images | arXiv: 2605.31090
- On Robustness and Chain-of-Thought Consistency of RL-Finetuned VLMs | arXiv: 2602.12506
- On the Adversarial Robustness of Large Vision-Language Models under Visual Token Compression | arXiv: 2601.21531
- On the Collapse of Generative Paths: A Criterion and Correction for Diffusion Steering | arXiv: 2512.10339
- On the Convergence Rate of LoRA Gradient Descent | arXiv: 2512.18248
- On the Coordination of Value-Maximizing Bidders | arXiv: 2511.04993
- On the Epistemic Uncertainty of Overparametrized Neural Networks | arXiv: 2605.25234
- On the Expressive Power of GNNs to Solve Linear SDPs | arXiv: 2604.27786
- On the Expressive Power of Permutation-Equivariant Weight-Space Networks | arXiv: 2602.01083
- On the Generalization Gap in Self-Evolving Language Model Reasoning | arXiv: 2606.01075
- On the Interaction of Batch Noise, Adaptivity, and Compression, under \((L_0,L_1)\)-Smoothness: An SDE Approach | arXiv: 2506.00181
- On the Learnability of Test-Time Adaptation: A Recovery Complexity Perspective | arXiv: 2605.28057
- On the Limits of LLM Adaptability: Impact of Model-Internalized Priors on Annotation | arXiv: 2606.00467
- On the Provable Suboptimality of Momentum SGD in Nonstationary Stochastic Optimization | arXiv: 2601.12238
- On the Relationship Between Activation Outliers and Feature Death in Sparse Autoencoders | arXiv: 2605.31518
- On the Robustness of Langevin Dynamics to Score Function Error | arXiv: 2603.11319
- On the Salience of Low-Probability Tokens for AI-Generated Text Detection: A Multiscale Uncertainty Perspective | arXiv: 2606.02158
- On Training Large Language Models for Long-Horizon Tasks: An Empirical Study of Horizon Length | arXiv: 2605.02572
- Once-for-All: Scalable Simultaneous Forecasting via Equilibrium State Estimation | arXiv: 2606.13285
- One Bias After Another: Mechanistic Reward Shaping and Persistent Biases in Language Reward Models | arXiv: 2603.03291
- One Model to Translate Them All: Universal Any-to-Any Translation for Heterogeneous Collaborative Perception | arXiv: 2605.17907
- One-shot Conditional Sampling: MMD meets Nearest Neighbors | arXiv: 2509.25507
- One-Step Residual Shifting Diffusion for Image Super-Resolution via Distillation | arXiv: 2503.13358
- Online Learning with Recency: Algorithms for Sliding-window Streaming Multi-armed Bandits | arXiv: 2606.08977
- Online Self-Training for Co-Adaptation in Hierarchical Diffusion Policies | arXiv: 2603.05291
- Operationalising the Superficial Alignment Hypothesis via Task Complexity | arXiv: 2602.15829
- Optimal and Scalable MAPF via Multi-Marginal Optimal Transport and Schrödinger Bridges | arXiv: 2605.10917
- Optimal Attention Temperature Improves the Robustness of In-Context Learning under Distribution Shift in High Dimensions | arXiv: 2511.01292
- Optimal Bayesian Stopping for Efficient Inference of Consistent LLM Answers | arXiv: 2602.05395
- Optimal Design for Multinomial Logit Model with Applications to Best Assortment Identification | arXiv: 2605.25592
- Optimal Regularization for Performative Learning | arXiv: 2510.12249
- Optimal Transport under Group Fairness Constraints | arXiv: 2601.07144
- Optimizing Diversity and Quality through Base-Aligned Model Collaboration | arXiv: 2511.05650
- Optimizing Language Models for Crosslingual Knowledge Consistency | arXiv: 2603.04678
- Optimizing Token Choice for Code Watermarking: An RL Approach | arXiv: 2508.11925
- Order within Chaos: Capturing Intrinsic Energy Anomalies for AI-Manipulated Image Forgery Localization | arXiv: 2606.02178
- ORLoopBench: Solver-in-the-Loop Benchmarks for Self-Correction and Behavioral Rationality in Operations Research | arXiv: 2601.21008
- Orthogonal Concept Erasure for Diffusion Models | arXiv: 2605.28902
- OSAQ: Outlier Self-Absorption for Accurate Low-bit LLM Quantization | arXiv: 2605.04738
- OServe: Accelerating LLM Serving via Spatial-Temporal Workload Orchestration | arXiv: 2602.12151
- OT-Bridge Editor: Geometrically Constrained Stenosis Editing in Coronary Angiography via Entropic Optimal Transport | arXiv: 2605.08851
- OTora: A Unified Red Teaming Framework for Reasoning-Level Denial-of-Service in LLM Agents | arXiv: 2605.08876
- Outcome-Aware Spectral Feature Learning for Instrumental Variable Regression | arXiv: 2512.00919
- Over-Alignment vs Over-Fitting: The Role of Feature Learning Strength in Generalization | arXiv: 2602.00827
- PAC-Bayesian Reinforcement Learning Trains Generalizable Policies | arXiv: 2510.10544
- PaCX-MAE: Physiology-Augmented Chest X-Ray Masked Autoencoder | arXiv: 2606.01537
- PADD: Path-Aligned Decompression Distillation for Non-Router Teacher to Guide MoE Student Learning | arXiv: 2606.10369
- Pair2Scene: Learning Local Object Relations for Procedural Scene Generation | arXiv: 2604.11808
- ParalESN: Enabling Parallel Information Processing in Reservoir Computing | arXiv: 2601.22296
- Parameter-free Dynamic Regret: Time-varying Movement Costs, Delayed Feedback, and Memory | arXiv: 2602.06902
- Parameters as Experts: Adapting Vision Models with Dynamic Parameter Routing | arXiv: 2602.06862
- Parametric Prior Mapping Framework for Non-stationary Probabilistic Time Series Forecasting | arXiv: 2605.23402
- Pareto-Guided Optimal Transport for Multi-Reward Alignment | arXiv: 2605.13155
- ParisKV: Fast and Drift-Robust KV-Cache Retrieval for Long-Context LLMs | arXiv: 2602.07721
- Parsimonious Learning-Augmented Online Metric Matching | arXiv: 2605.26886
- PartCo: Part-Level Correspondence Priors Enhance Category Discovery | arXiv: 2509.22769
- Partial Fusion of Neural Networks: Efficient Tradeoffs Between Ensembles and Weight Aggregation | arXiv: 2605.22350
- Partitioning for Intrinsic Model Inversion Resistance in Collaborative Inference | arXiv: 2506.15412
- Path-Coupled Bellman Flows for Distributional Reinforcement Learning | arXiv: 2605.08253
- PathCTM: Thinking in Scales — Accelerating Gigapixel Pathology Image Analysis via Adaptive Continuous Reasoning | arXiv: 2605.19491
- PathWise: Planning through World Model for Automated Heuristic Design via Self-Evolving LLMs | arXiv: 2601.20539
- PATRA: Pattern-Aware Alignment and Balanced Reasoning for Time Series Question Answering | arXiv: 2602.23161
- PAWS: Preference Learning with Advantage-Weighted Segments | arXiv: 2606.11982
- Perceptual Flow Network for Visually Grounded Reasoning | arXiv: 2605.02730
- Performative Learning Theory | arXiv: 2602.04402
- Persona-Pruner: Sculpting Lightweight Models for Role-Playing | arXiv: 2606.14695
- Persona2Web: Benchmarking Personalized Web Agents for Contextual Reasoning with User History | arXiv: 2602.17003
- Persuasive Privacy | arXiv: 2601.22945
- PFT: Phonon Fine-tuning for Machine Learned Interatomic Potentials | arXiv: 2601.07742
- PhaLar: Phasors for Learned Musical Audio Representations | arXiv: 2605.03929
- Phy-CoSF: Physics-Guided Continuous Spectral Fields Reconstruction and Super-Resolution for Snapshot Compressive Imaging | arXiv: 2605.13583
- PhyScene3D: Physically Consistent Interactive 3D Tabletop Scene Generation | arXiv: 2606.01649
- PhysForge: Generating Physics-Grounded 3D Assets for Interactive Virtual World | arXiv: 2605.05163
- PhysHanDI: Physics-Based Reconstruction of Hand-Deformable Object Interactions | arXiv: 2605.09538
- Physics from Video: Identifiability of Time-Invariant Second-Order ODEs under Minimal Trajectory Conditions | arXiv: 2606.00115
- Physics in 2-Steps: Locking Motion Priors Before Visual Refinement Erases Them | arXiv: 2606.06361
- Physics Is All You Need? A Case Study in Physicist-Supervised AI Development of Scientific Software | arXiv: 2605.30353
- Physics-Informed Coarsening for Multigrid Graph Neural Surrogates | arXiv: 2605.31013
- PICACO: Pluralistic In-Context Value Alignment of LLMs via Total Correlation Optimization | arXiv: 2507.16679
- PINE: Pruning Boosted Tree Ensembles with Conformal In-Distribution Prediction Equivalence | arXiv: 2605.28068
- PINNfluence: Interpreting PINNs Through Influence Functions | arXiv: 2409.08958
- PipeSD: An Efficient Cloud-Edge Collaborative Pipeline Inference Framework with Speculative Decoding | arXiv: 2605.13319
- PLAID: A Unified Data Model for Machine Learning on Heterogeneous Physics Simulations | arXiv: 2505.02974
- Plan for Speed: Dilated Scheduling for Masked Diffusion Language Models | arXiv: 2506.19037
- Plan in Sandbox, Navigate in Open Worlds: Learning Physics-Grounded Abstracted Experience for Embodied Navigation | arXiv: 2605.10118
- Plug-and-Play Benchmarking of Reinforcement Learning Algorithms for Large-Scale Flow Control | arXiv: 2601.15015
- Plug-and-Play Diffusion Meets ADMM: Dual-Variable Coupling for Robust Medical Image Reconstruction | arXiv: 2602.23214
- Plug-and-Play Guidance for Discrete Diffusion Models via Gradient-Informed Logit Correction | arXiv: 2606.06303
- Plug-and-Play Label Map Diffusion for Universal Goal-Oriented Navigation | arXiv: 2605.05960
- Plug-and-Play Spiking Operators: Breaking the Nonlinearity Bottleneck in Spiking Transformers | arXiv: 2605.20289
- PODiff: Latent Diffusion in Proper Orthogonal Decomposition Space for Scientific Super-Resolution | arXiv: 2605.03399
- POET-X: Memory-efficient LLM Training by Scaling Orthogonal Transformation | arXiv: 2603.05500
- Poison with Style: A Practical Poisoning Attack on Code Large Language Models | arXiv: 2605.27631
- Polaris: Coupled Orbital Polar Embeddings for Hierarchical Concept Learning | arXiv: 2605.00265
- PoliticsBench: Benchmarking Political Values in Large Language Models with Multi-Stage Roleplay | arXiv: 2603.23841
- PolyFlow: Safe and Efficient Polytope-Constrained Flow Matching with Constraint Embedding and Projection-free Update | arXiv: 2606.13400
- Polynomial Neural Sheaf Diffusion: A Spectral Filtering Approach on Cellular Sheaves | arXiv: 2512.00242
- Polyphonia: Zero-Shot Timbre Transfer in Polyphonic Music with Acoustic-Informed Attention Calibration | arXiv: 2605.10203
- PolySAE: Modeling Feature Interactions in Sparse Autoencoders via Polynomial Decoding | arXiv: 2602.01322
- Position: 'AI Alignment' Encompasses Competing Technical Priorities | arXiv: 2606.14315
- Position: Adopting AI in Practice Does Not Guarantee the Productivity Boost | arXiv: 2605.24688
- Position: Adversarial ML for LLMs Is Not Making Any Progress | arXiv: 2502.02260
- Position: Age Estimation Models Do Not Process Biometric Data | arXiv: 2605.17347
- Position: Agentic AI Orchestration Should Be Bayes-Consistent | arXiv: 2605.00742
- Position: AI Evaluations Should be Grounded on a Theory of Capability | arXiv: 2509.19590
- Position: AI Researchers Must Help Lead Arms Control to Mitigate Military AI Risks | arXiv: 2606.11533
- Position: Assistive Agents Need Accessibility Alignment | arXiv: 2605.13579
- Position: Beyond Sensitive Attributes, ML Fairness Should Quantify Structural Injustice via Social Determinants | arXiv: 2508.08337
- Position: Current Benchmarking Hinders Real Progress in Deep Learning for Time Series | arXiv: 2512.22702
- Position: Deployed Reinforcement Learning should be Continual | arXiv: 2606.04029
- Position: Embodied AI Requires a Privacy-Utility Trade-off | arXiv: 2605.05017
- Position: Evaluation of ML Resource Utilization Requires Model Life Cycle Assessment | arXiv: 2606.07632
- Position: Generative Engine Optimization Creates Underexamined Risks, Governance Must Target Concentration, Disclosure, and Academic Blind Spots | arXiv: 2606.12439
- Position: Good Embodied Reward Models Need Bad Behavior Data | arXiv: 2606.01036
- Position: Hippocampal Explicit Memory Is the Cornerstone for AGI | arXiv: 2606.11245
- Position: Ideas Should be the Center of Machine Learning Research | arXiv: 2605.15253
- Position: Let's Develop Data Probes to Fundamentally Understand How Data Affects LLM Performance | arXiv: 2605.18801
- Position: Machine Learning for Heart Transplant Allocation Policy Optimization Should Account for Incentives | arXiv: 2602.04990
- Position: Modular Memory is the Key to Continual Learning Agents | arXiv: 2603.01761
- Position: Neglecting the Sustainability of AI is Fuelling a Global AI Arms Race | arXiv: 2502.20016
- Position: Reliable AI Needs to Externalize Implicit Knowledge: A Human-AI Collaboration Perspective | arXiv: 2605.02010
- Position: Retire the "Positive Backdoor" Label -- Secret Alignment Requires Strict and Systematic Evaluation | arXiv: 2605.28597
- Position: Stop Anthropomorphizing Intermediate Tokens as Reasoning/Thinking Traces! | arXiv: 2504.09762
- Position: Stop Chasing the C-index when Evaluating Survival Analysis Models | arXiv: 2506.02075
- Position: Stop Preaching and Start Practising Data Frugality for Responsible Development of AI | arXiv: 2602.19789
- Position: Text Embeddings Should Capture Implicit Semantics, Not Just Surface Meaning | arXiv: 2506.08354
- Position: The ML Community Must Build an AI-Augmented Peer-Review Ecosystem | arXiv: 2506.08134
- Position: The Systemic Lack of Agency in Visual Reasoning | arXiv: 2606.14795
- Position: The Turing-Completeness of Autoregressive Transformers Relies Heavily on Context Management | arXiv: 2605.19514
- Position: Towards Responsible Evaluation for Text-to-Speech | arXiv: 2510.06927
- Position: Uncertainty Quantification in LLMs is Just Unsupervised Clustering | arXiv: 2605.19220
- Position: Zeroth-Order Optimization in Deep Learning Is Underexplored, Not Underpowered | arXiv: 2605.15622
- Possibilistic Predictive Uncertainty for Deep Learning | arXiv: 2605.00600
- Post-Hoc Merging Is Not Enough: Many-Shot Model Merging with Loss-Gap Balancing | arXiv: 2606.16501
- Post-Training LLMs as Better Decision-Making Agents: A Regret-Minimization Approach | arXiv: 2511.04393
- PowerFlow: Unlocking the Dual Nature of LLMs via Principled Distribution Matching | arXiv: 2603.18363
- Practical and Optimal Algorithm for Linear Contextual Bandits with Rare Parameter Updates | arXiv: 2606.00984
- PragLocker: Protecting Agent Intellectual Property in Untrusted Deployments via Non-Portable Prompts | arXiv: 2605.05974
- Predicting Large Model Test Losses with a Noisy Quadratic System | arXiv: 2605.09154
- Predictive Prefetching for Retrieval-Augmented Generation | arXiv: 2605.17989
- Preregistration for Experiments with AI Agents | arXiv: 2606.11217
- Prescriptive Scaling Reveals the Evolution of Language Model Capabilities | arXiv: 2602.15327
- Preserve-Then-Quantize: Balancing Rank Budgets for Quantization Error Reconstruction in LLMs | arXiv: 2602.02001
- Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization | arXiv: 2510.21583
- Prioritize the Process, Not Just the Outcome: Rewarding Latent Thought Trajectories Improves Reasoning in Looped Language Models | arXiv: 2602.10520
- PRISM: A 3D Probabilistic Neural Representation for Interpretable Shape Modeling | arXiv: 2602.11467
- Prism: Efficient Test-Time Scaling via Hierarchical Search and Self-Verification for Discrete Diffusion Language Models | arXiv: 2602.01842
- PRISM: Gauge-Invariant Tangent-Space Differentially Private LoRA | arXiv: 2606.00944
- Prism: Spectral-Aware Block-Sparse Attention | arXiv: 2602.08426
- PRISM: Synergizing Vision Foundation Models via Self-Organized Expert Specialization | arXiv: 2606.03444
- Privacy Amplification in Differentially Private Zeroth-Order Optimization with Hidden States | arXiv: 2506.00158
- Privacy-Aware Video Anomaly Detection through Orthogonal Subspace Projection | arXiv: 2605.08651
- Private and Stable Test-Time Adaptation with Differential Privacy | arXiv: 2606.01908
- Private Learning with Public Feature Conditioning | arXiv: 2606.18773
- PrivCode++: Latent-Conditioned Differentially Private Code Generation for Comprehensive Guarantees | arXiv: 2606.09145
- ProAct-VL: A Proactive VideoLLM for Real-Time AI Companions | arXiv: 2603.03447
- ProactiveLLM: Learning Active Interaction for Streaming Large Language Models | arXiv: 2606.00523
- Probabilistic Modeling of Latent Agentic Substructures in Deep Neural Networks | arXiv: 2509.06701
- Probability-Entropy Calibration: An Elastic Indicator for Adaptive Fine-tuning | arXiv: 2602.01745
- Probing Cross-modal Information Hubs in Audio-Visual LLMs | arXiv: 2605.10815
- Probing Neural TSP Representations for Prescriptive Decision Support | arXiv: 2602.07216
- Probing RLVR Training Instability through the Lens of Objective-Level Hacking | arXiv: 2602.01103
- Probing Token Spaces under Generator Shift in AI-Generated Music Detection | arXiv: 2606.08663
- ProbMoE: Differentiable Probabilistic Routing for Mixture-of-Experts | arXiv: 2606.01509
- Procedural Pretraining: Warming Up Language Models with Abstract Data | arXiv: 2601.21725
- Process Reward Agents for Steering Knowledge-Intensive Reasoning | arXiv: 2604.09482
- ProjQ: Project-and-Quantize for Adapter-Aware LLM Compression | arXiv: 2606.00494
- ProMoS: Generalist Graph Anomaly Detection via Prototype-Based Distillation | arXiv: 2605.26857
- Prompt Injection as Role Confusion | arXiv: 2603.12277
- Prompt Optimization Is a Coin Flip: Diagnosing When It Helps in Compound AI Systems | arXiv: 2604.14585
- Prompts for Public-Sector LLMs Should Be Governed as Commons | arXiv: 2606.00873
- ProRL: Effective Reinforcement Learning for Proactive Recommendation via Rectified Policy Gradient Estimation | arXiv: 2605.28293
- Protein Autoregressive Modeling via Multiscale Structure Generation | arXiv: 2602.04883
- Protein Circuit Tracing via Cross-layer Transcoders | arXiv: 2602.12026
- Protein Fold Classification at Scale: Benchmarking and Pretraining | arXiv: 2605.18552
- Protein Language Model Embeddings Improve Generalization of Implicit Transfer Operators | arXiv: 2602.11216
- ProtocolBench: Which LLM MultiAgent Protocol to Choose? | arXiv: 2510.17149
- Prototype Transformer: Towards Language Model Architectures Interpretable by Design | arXiv: 2602.11852
- Provable Accuracy Collapse in Embedding-Based Representations under Dimensionality Mismatch | arXiv: 2605.03346
- Provable Benefit of Curriculum in Transformer Tree-Reasoning Post-Training | arXiv: 2511.07372
- Provably Data-Driven Lagrangian Relaxation for Mixed Integer Linear Programming | arXiv: 2605.19052
- Provably Data-driven Multiple Hyper-parameter Tuning with Structured Loss Function | arXiv: 2602.02406
- Provably Learning Attention with Queries | arXiv: 2601.16873
- Proxy Compression for Language Modeling | arXiv: 2602.04289
- PRPO: Paragraph-level Policy Optimization for Vision-Language Deepfake Detection | arXiv: 2509.26272
- Pseudospectral Bounds for Transient Amplification in Coupled Gradient Descent | arXiv: 2606.04031
- PSG-Nav: Probabilistic Scene Graph Navigation via Multiverse Decision Making | arXiv: 2606.01313
- Pull Requests as a Training Signal for Repo-Level Code Editing | arXiv: 2602.07457
- Q-Delta: Beyond Key–Value Associative State Evolution | arXiv: 2606.08804
- Q-DiT4SR: Exploration of Detail-Preserving Diffusion Transformer Quantization for Real-World Image Super-Resolution | arXiv: 2602.01273
- QHyer: Q-conditioned Hybrid Attention-mamba Transformer for Offline Goal-conditioned RL | arXiv: 2605.01862
- Quant VideoGen: Auto-Regressive Long Video Generation via 2-Bit KV-Cache Quantization | arXiv: 2602.02958
- Quantifying and Optimizing Simplicity via Polynomial Representations | arXiv: 2605.29823
- Quantifying Error Propagation and Model Collapse in Diffusion Models | arXiv: 2602.16601
- Quantifying the Salience of Geo-Cultural Values for Pluralistic Safety Alignment | arXiv: 2606.00369
- Quantifying the Uncertainty of Foundation Models with Singular Value Ensembles | arXiv: 2601.22068
- Quantile-Free Uncertainty Quantification in Graph Neural Networks | arXiv: 2605.04847
- Quantized Keys Steal Attention: Bias Correction for KV-Cache Compression in Video Generation | arXiv: 2605.26266
- Quantum Algorithms for Triangle Cut Sparsification | arXiv: 2606.06287
- Quantum latent distributions in deep generative models | arXiv: 2508.19857
- Query Circuits: Explaining How Language Models Answer User Prompts | arXiv: 2509.24808
- Query Lens: Interpreting Sparse Key-Value Features with Indirect Effects | arXiv: 2606.07617
- QuITE: Query-based Irregular Time Series Embedding | arXiv: 2605.28166
- Quiver: Quantum-Informed Views for Enhanced Representations in Large ML Models | arXiv: 2606.02785
- R\(^3\)L: Reasoning 3D Layouts from Relative Spatial Relations | arXiv: 2605.06758
- R2-Router: A New Paradigm for LLM Routing with Reasoning | arXiv: 2602.02823
- R2R2: Robust Representation for Intensive Experience Reuse via Redundancy Reduction in Self-Predictive Learning | arXiv: 2605.14026
- RaBiT: Residual-Aware Binarization Training for Accurate and Efficient LLMs | arXiv: 2602.05367
- RACO: Reward-free Alignment for Conflicting Objectives | arXiv: 2602.02495
- RADAR: Redundancy-Aware Diffusion for Multi-Agent Communication Structure Generation | arXiv: 2605.09907
- RADE: Random Add-Drop Edge as a Regularizer | arXiv: 2606.00757
- RAIGen: Rare Attribute Identification in Text-to-Image Generative Models | arXiv: 2602.06806
- Randomized Advantage Transformation (RAT): Computing Natural Policy Gradients via Direct Backpropagation | arXiv: 2605.18591
- Rank-Learner: Orthogonal Ranking of Treatment Effects | arXiv: 2602.03517
- Ranking-Free RAG: Replacing Re-Ranking with Selection in RAG for Sensitive Domains | arXiv: 2505.16014
- Rao-Blackwellized Score Matching on Manifolds | arXiv: 2605.25567
- Rapid Poison: Practical Poisoning Attacks Against the Rapid Response Framework | arXiv: 2606.16242
- Rare Event Analysis of Large Language Models | arXiv: 2602.06791
- Rational Sparse Autoencoder | arXiv: 2606.14990
- Rays as Pixels: Learning A Joint Distribution of Videos and Camera Trajectories | arXiv: 2604.09429
- REAL: Integrating Regression-Aware Rewards into RL, Teaching LLM-as-a-Judge that "Even a One-Point Difference Matters" | arXiv: 2603.17145
- REAL: Resolving Knowledge Conflicts in Knowledge-Intensive Visual Question Answering via Reasoning-Pivot Alignment | arXiv: 2602.14065
- REALISTA: Realistic Latent Adversarial Attacks that Elicit LLM Hallucinations | arXiv: 2605.12813
- Realizable Bayes-Consistency for General Metric Losses | arXiv: 2605.03823
- Reason, Then Re-reason: Cross-view Revisiting Improves Spatial Reasoning | arXiv: 2606.11683
- Reasoning Can Be Restored by Correcting a Few Decision Tokens | arXiv: 2605.16874
- Reasoning Is Not Free: Robust Adaptive Cost-Efficient Routing for LLM-as-a-Judge | arXiv: 2605.10805
- Reasoning on the Manifold: Bidirectional Consistency for Self-Verification in Diffusion Language Models | arXiv: 2604.16565
- Reasoning Structure of Large Language Models | arXiv: 2606.03883
- Recovering Hidden Reward in Diffusion-Based Policies | arXiv: 2605.00623
- Recovering Policy-Induced Errors: Benchmarking and Trajectory Synthesis for Robust GUI Agents | arXiv: 2605.29447
- Rectified LpJEPA: Joint-Embedding Predictive Architectures with Sparse and Maximum-Entropy Representations | arXiv: 2602.01456
- Red-Teaming Agent Execution Contexts: Open-World Security Evaluation on OpenClaw | arXiv: 2605.11047
- Referring Multiple Regions with Large Multimodal Models via Contextual Latent Steering | arXiv: 2605.01827
- Refining Context-Entangled Content Segmentation via Curriculum Selection and Anti-Curriculum Promotion | arXiv: 2602.01183
- REFLECTOR: Internalizing "Self-Reflection during Generation" into Trajectories to Resist Indirect Jailbreaking | arXiv: 2605.20654
- ReflexGrad: Within-Episode Failure Recovery in LLM Agents via Progress-Gated Dual-Process Routing | arXiv: 2511.14584
- Regret-Based Federated Causal Discovery with Unknown Interventions | arXiv: 2512.23626
- Reinforced Sequential Monte Carlo for Amortised Sampling | arXiv: 2510.11711
- Reinforcement Learning for Reachability: Guaranteeing Asymptotic Optimality | arXiv: 2605.24740
- RelaxFlow: Text-Driven Amodal 3D Generation | arXiv: 2603.05425
- Reliable to Expressive: A Curriculum for Rubric-Following Safety Judges | arXiv: 2606.09165
- RELO: Reinforcement Learning to Localize for Visual Object Tracking | arXiv: 2605.07379
- ReMoE: Boosting Expert Reuse through Router Fine-Tuning in Memory-Constrained MoE LLM Inference | arXiv: 2605.27081
- RepetitionCurse: Measuring and Understanding Router Imbalance in Mixture-of-Experts LLMs under DoS Stress | arXiv: 2512.23995
- RePo: Language Models with Context Re-Positioning | arXiv: 2512.14391
- Representational Similarity and Model Behavior in Multi-Agent Interaction | arXiv: 2606.07818
- ReQAT: Achieving Full-Precision Reasoning Accuracy with 4-bit Floating-Point Quantization-Aware Training | arXiv: 2606.15682
- ReSeek: A Self-Correcting Framework for Search Agents with Instructive Rewards | arXiv: 2510.00568
- Resolution Diagnostics for Paired LLM Evaluation | arXiv: 2605.30315
- ReSpinQuant: Efficient Layer-Wise LLM Quantization via Subspace Residual Rotation Approximation | arXiv: 2604.11080
- ResRL: Boosting LLM Reasoning via Negative Sample Projection Residual Reinforcement Learning | arXiv: 2605.00380
- Resting Neurons, Active Insights: Robustify Activation Sparsity for Large Language Models | arXiv: 2512.12744
- RESTORE: Improving Visual Token Reduction via Distortion Correction for Enhanced MLLM Inference Efficiency | arXiv: 2606.01711
- Restoring Initial Noise Sensitivity in Text-to-Image Distillation via Geometric Alignment | arXiv: 2606.01651
- Rethink the Role of Neural Decoders in Quantum Error Correction | arXiv: 2605.12046
- Rethinking Contrastive Learning for Graph Collaborative Filtering: Limitations and a Simple Remedy | arXiv: 2605.24015
- Rethinking Evaluation Paradigms in IBP-based Certified Training | arXiv: 2606.02134
- Rethinking Feature Alignment in Generalist Graph Anomaly Detection: A Relational Fingerprint-based Approach | arXiv: 2605.25429
- Rethinking FID Through the Geometry of the Reference Dataset | arXiv: 2605.29335
- Rethinking Genomic Modeling Through Optical Character Recognition | arXiv: 2602.02014
- Rethinking LLM Ensembling from the Perspective of Mixture Models | arXiv: 2605.00419
- Rethinking Psychometric Evaluation of LLMs: When and Why Self-Reports Predict Behavior | arXiv: 2606.12730
- Rethinking the Flow-Based Gradual Domain Adaptation: A Semi-Dual Optimal Transport Perspective | arXiv: 2602.01179
- Retriever Portfolios: A Principled Approach to Adaptive RAG | arXiv: 2605.31176
- RETROSPECT: RETROsynthesis via Sequential Prediction, and Chemically Transformed-ranking | arXiv: 2606.07181
- Return of Frustratingly Easy Unsupervised Video Domain Adaptation | arXiv: 2605.19510
- Return-to-Go is More Than a Number: Q-Guided Alignment for Return-Conditioned Supervised Learning | arXiv: 2605.29028
- Revenue Guarantees of No-Swap-Regret Dynamics in First Price Auctions | arXiv: 2606.06085
- Reverse Flow Matching: A Unified Framework for Online Reinforcement Learning with Diffusion and Flow Policies | arXiv: 2601.08136
- Reverse-Engineering Model Editing on Language Models | arXiv: 2602.10134
- Revis: Sparse Latent Steering to Mitigate Object Hallucination in Large Vision-Language Models | arXiv: 2602.11824
- Revisiting Parameter-Based Knowledge Editing in Large Language Models: Theoretical Limits and Empirical Evidence | arXiv: 2606.00570
- Revisiting Photometric Ambiguity for Accurate Gaussian-Splatting Surface Reconstruction | arXiv: 2605.12494
- Revisiting Regularized Policy Optimization for Stable and Efficient Reinforcement Learning in Two-Player Games | arXiv: 2602.10894
- Revisiting Uncertainty: On Evidential Learning for Partially Relevant Video Retrieval | arXiv: 2605.06083
- ReVSI: Rebuilding Visual Spatial Intelligence Evaluation for Accurate Assessment of VLM 3D Reasoning | arXiv: 2604.24300
- Reward Hacking Benchmark: Measuring Exploits in LLM Agents with Tool Use | arXiv: 2605.02964
- Reward Modeling from Natural Language Human Feedback | arXiv: 2601.07349
- Reward Shaping for (Inference-Time) Alignment: A Stackelberg Game Perspective | arXiv: 2602.02572
- REX: A Family of Reversible Exponential Stochastic Runge-Kutta Solvers | arXiv: 2502.08834
- RGMem: Renormalization Group-Inspired Memory Evolution for Language Agents | arXiv: 2510.16392
- Riemannian Generative Decoder | arXiv: 2506.19133
- Riemannian MeanFlow for One-Step Generation on Manifolds | arXiv: 2603.10718
- Riemannian Metric Matching for Scalable Geometric Modeling of Distributions | arXiv: 2606.14334
- Riemannian Networks over Full-Rank Correlation Matrices | arXiv: 2605.19073
- Right Predictions, Misleading Explanations: On the Vulnerability of Vision-Language Model Explanations | arXiv: 2605.16651
- RKSC: Reasoning-Aware KV Cache Sharing and Confident Early Exit for Multi-Step LLM Inference | arXiv: 2606.09937
- RL-SPH: Learning to Achieve Feasible Solutions for Integer Linear Programs | arXiv: 2411.19517
- RL4RLA: Teaching ML to Discover Randomized Linear Algebra Algorithms Through Curriculum Design and Graph-Based Search | arXiv: 2605.18004
- RLVE: Scaling Up Reinforcement Learning for Language Models with Adaptive Verifiable Environments | arXiv: 2511.07317
- RMNP: Row-Momentum Normalized Preconditioning for Scalable Matrix-Based Optimization | arXiv: 2603.20527
- RoboMME: Benchmarking and Understanding Memory for Robotic Generalist Policies | arXiv: 2603.04639
- Robust In-Context Reinforcement Learning Under Reward Poisoning Attacks | arXiv: 2506.06891
- Robust-U1: Can MLLMs Self-Recover Corrupted Visual Content for Robust Understanding? | arXiv: 2606.08063
- Robustness of Mixtures of Experts to Feature Noise | arXiv: 2601.14792
- RoCA: Robust Cross-Domain End-to-End Autonomous Driving | arXiv: 2506.10145
- Rotation-Invariant Spherical Watermarking via Third-Order SO(3) Representation Coupling | arXiv: 2605.26702
- RouteJudge: An Open Platform for Reproducible and Preference-Aware LLM Routing | arXiv: 2606.18774
- Routing by Reaching: Composition of Pre-trained GFlowNets for Multi-Objective Generation | arXiv: 2602.21565
- RQ-MoE: Residual Quantization via Mixture of Experts for Efficient Input-Dependent Vector Compression | arXiv: 2605.14359
- RT-Lynx: Putting the GEMM Sparsity In a Right Way for Diffusion Models | arXiv: 2605.26632
- Rule2DRC: Benchmarking LLM Agents for DRC Script Synthesis with Execution-Guided Test Generation | arXiv: 2605.15669
- RulePlanner: All-in-One Reinforcement Learner for Unifying Design Rules in 3D Floorplanning | arXiv: 2601.22476
- SAC-Opt: Semantic Anchors for Iterative Correction in Optimization Modeling | arXiv: 2510.05115
- SAEmnesia: Erasing Concepts in Diffusion Models with Supervised Sparse Autoencoders | arXiv: 2509.21379
- SAFAG: Generalizable Actionable Part Pose Estimation without Symmetry Annotation | arXiv: 2605.17033
- Safe In-Context Reinforcement Learning | arXiv: 2509.25582
- Safe Reinforcement Learning with Preference-Based Constraint Inference | arXiv: 2603.23565
- SafeHarbor: Defining Precise Decision Boundaries via Hierarchical Memory-Augmented Guardrail for LLM Agent Safety | arXiv: 2605.05704
- SafeSearch: Automated Red-Teaming of LLM-Based Search Agents | arXiv: 2509.23694
- Safety Anchor: Defending Harmful Fine-tuning via Geometric Bottlenecks | arXiv: 2605.05995
- Safety Generalization Under Distribution Shift in Safe Reinforcement Learning: A Diabetes Testbed | arXiv: 2601.21094
- Saliency-Aware Model Merging | arXiv: 2606.00511
- Same Target, Different Basins: Hard vs. Soft Labels for Annotator Distributions | arXiv: 2605.20642
- SAME: Stabilized Mixture-of-Experts for Multimodal Continual Instruction Tuning | arXiv: 2602.01990
- Sample from What You See: Visuomotor Policy Learning via Diffusion Bridge with Observation-Embedded Stochastic Differential Equation | arXiv: 2512.07212
- Saving Foundation Flow-Matching Priors for Inverse Problems | arXiv: 2511.16520
- Scalable Circuit Learning for Interpreting Large Language Models | arXiv: 2606.16939
- Scalable GANs with Transformers | arXiv: 2509.24935
- Scalable Single-Cell Gene Expression Generation with Latent Diffusion Models | arXiv: 2511.02986
- SCALE: Self-uncertainty Conditioned Adaptive Looking and Execution for Vision-Language-Action Models | arXiv: 2602.04208
- Scaling by Diversified Experience for Vision-Language-Action Models | arXiv: 2606.09009
- Scaling Continual Learning to 300+ Tasks with Bi-Level Routing Mixture-of-Experts | arXiv: 2602.03473
- Scaling Depth Capacity via Zero/One-Layer Model Expansion | arXiv: 2511.04981
- Scaling Laws of Global Weather Models | arXiv: 2602.22962
- Scaling Small Agents Through Strategy Auctions | arXiv: 2602.02751
- Scaling Unsupervised Multi-Source Federated Domain Adaptation through Group-Wise Discrepancy Minimization | arXiv: 2510.08150
- Scaling Vision Transformers for Functional MRI with Flat Maps | arXiv: 2510.13768
- Scaling, Benchmarking, and Reasoning of Vision-Language Agents for Mobile GUI Navigation | arXiv: 2705.27134
- Scaling-Aware Adapter for Structure-Grounded LLM Reasoning | arXiv: 2602.02780
- ScaLoRA: Optimally Scaled Low-Rank Adaptation for Efficient High-Rank Fine-Tuning | arXiv: 2510.23818
- scCBGM: Interpretable Single-Cell Counterfactual Editing | arXiv: 2606.07760
- SceneSmith: Agentic Generation of Simulation-Ready Indoor Scenes | arXiv: 2602.09153
- Scheduling LLM Inference with Uncertainty-Aware Output Length Predictions | arXiv: 2604.00499
- Scientific Logicality Enriched Methodology for LLM Reasoning: A Practice in Physics | arXiv: 2605.17104
- SCOPE: Selective Conformal Optimized Pairwise LLM Judging | arXiv: 2602.13110
- Score-Based Error Correcting Code Decoder | arXiv: 2605.28358
- Score-Repellent Monte Carlo: Toward Efficient Non-Markovian Sampler with Constant Memory in General State Spaces | arXiv: 2604.22948
- Scout: Active Information Foraging for Long-Text Understanding with Decoupled Epistemic States | arXiv: 2605.04496
- ScreenParse: Moving Beyond Sparse Grounding with Complete Screen Parsing Supervision | arXiv: 2602.14276
- SE-GA: Memory-Augmented Self-Evolution for GUI Agents | arXiv: 2605.16883
- Searching for Synergy in Shared Workspace Human-AI Collaboration | arXiv: 2606.18413
- Securing Multi-Agent Systems Against Corruptions via Node Contribution Backpropagation | arXiv: 2510.19420
- Seeing is Understanding: Unlocking Causal Attention into Modality-Mutual Attention for Multimodal LLMs | arXiv: 2503.02597
- Seeing Realism from Simulation: Efficient Video Transfer for Vision-Language-Action Data Augmentation | arXiv: 2605.02757
- Seeing to Generalize: How Visual Data Corrects Binding Shortcuts | arXiv: 2602.15183
- Segment Anything with Robust Uncertainty-Accuracy Correlation | arXiv: 2605.10603
- Seizure-Semiology-Suite (S³): A Clinically Multimodal Dataset, Benchmark, and Models for Seizure Semiology Understanding | arXiv: 2605.21852
- Select to Think: Unlocking SLM Potential with Local Sufficiency | arXiv: 2604.26940
- Selecting Samples on Graphs: A Unified Dataset Pruning Framework for Lossless Training Acceleration | arXiv: 2606.12913
- Selective Coupling of Decoupled Informative Regions: Masked Attention Alignment for Data-Free Quantization of Vision Transformers | arXiv: 2606.04373
- Self-Augmenting Retrieval for Diffusion Language Models | arXiv: 2606.06474
- Self-Captioning Multimodal Interaction Tuning: Amplifying Exploitable Redundancies for Robust Vision Language Models | arXiv: 2605.08145
- Self-Debias: Self-correcting for Debiasing Large Language Models | arXiv: 2604.08243
- Self-evolving LLM agents with in-distribution Optimization | arXiv: 2606.07367
- Self-Guidance: Enhancing Neural Codecs via Decoder Manifold Alignment | arXiv: 2606.12940
- Self-Play Only Evolves When Self-Synthetic Pipeline Ensures Learnable Information Gain | arXiv: 2603.02218
- Self-Prompting Diffusion Transformer for Open-Vocabulary Scene Text Editing via In-Context Learning | arXiv: 2605.15523
- Self-Prophetic Decoding to Unlock Visual Search in LVLMs | arXiv: 2605.28741
- Self-Refining Video Sampling | arXiv: 2601.18577
- Self-Supervised Dynamical System Representations for Physiological Time-Series | arXiv: 2512.00239
- Semantic Cache Distillation: Efficient State Transfer via Reuse and Selective Patching | arXiv: 2606.07684
- Semantic Granularity Navigation in Image Editing | arXiv: 2605.21190
- Semantic Integrity Matters: Benchmarking and Preserving High-Density Reasoning in KV Cache Compression | arXiv: 2502.01941
- Semantic Router: On the Feasibility of Hijacking MLLMs via a Single Adversarial Perturbation | arXiv: 2511.20002
- Semantic-Aware Motion Encoding for Topology-Agnostic Character Animation | arXiv: 2605.27055
- Semantics-Enhanced Retrieval-Augmented Time Series Forecasting | arXiv: 2606.14941
- SemGrad: Gradients w.r.t. Semantics-Preserving Embeddings Tell LLM Uncertainty | arXiv: 2605.04638
- Semi-Supervised Neural Super-Resolution for Mesh-Based Simulations | arXiv: 2605.09284
- Semi-Supervised Noise Adaptation: Transferring Knowledge from Noise Domain | arXiv: 2606.00558
- SEMIR: Semantic Minor-Induced Representation Learning on Graphs for Visual Segmentation | arXiv: 2605.12389
- Sequential Group Composition: A Window into the Mechanics of Deep Learning | arXiv: 2602.03655
- Sequential Kernel-based Conditional Independence Testing via Adaptive Betting | arXiv: 2606.18993
- SFT Overtraining Predicts Rank Inversion via Entropy Collapse Under RLVR | arXiv: 2606.18487
- SGMD: Score Gradient Matching Distillation for Few-Step Video Diffusion | arXiv: 2605.30116
- ShaplEIG: Bayesian Experimental Design for Shapley Value Estimation | arXiv: 2606.02247
- Shapley Neuron Values for Continual Learning: Which Neurons Matter Most? | arXiv: 2605.15877
- Sharp Description of Local Minima in the Loss Landscape of High-Dimensional Two-Layer ReLU Networks | arXiv: 2604.09412
- Sheaf-ADMM: Learning Multi-Agent Coordination via Sheaf-ADMM | arXiv: 2605.31005
- Shift-Dependent Asymmetry: Orthogonal Inverse Low-Rank Adaptation for Federated Medical Segmentation | arXiv: 2606.08687
- Shifting the Breaking Point of Flow Matching for Multi-Instance Editing | arXiv: 2602.08749
- SiameseNorm: Breaking the Barrier to Reconciling Pre/Post-Norm | arXiv: 2602.08064
- SIGMA: Structure-Invariant Generative Molecular Alignment for Chemical Language Models via Autoregressive Contrastive Learning | arXiv: 2603.25062
- Sign Lock-In: Randomly Initialized Weight Signs Persist and Bottleneck Sub-Bit Model Compression | arXiv: 2602.17063
- SIMPC: Learning Self-Induced Mirror-Point Consistency for Unsupervised Point Cloud Denoising | arXiv: 2605.26894
- Simple Algorithms for Bad Triangle Transversals with Applications to Correlation Clustering | arXiv: 2602.04463
- Simple Approximation and Derivative Free Inference-Time Scaling for Diffusion Models via Sequential Monte Carlo on Path Measures | arXiv: 2605.17850
- Simulation-Augmented Multi-Step Split Conformal Prediction for Aggregated Forecasts | arXiv: 2606.16356
- Simultaneous Multi-objective Alignment Across Verifiable and Non-verifiable Rewards | arXiv: 2510.01167
- Single-Rollout Hidden-State Dynamics for Training-Free RLVR Data Selection | arXiv: 2605.28631
- Singular Bayesian Neural Networks | arXiv: 2602.00387
- Singular Vectors of Attention Heads Align with Features | arXiv: 2602.13524
- Site4Drug: Predicting Drug-Binding Target Sites with an AI Agent | arXiv: 2606.01816
- SkelHCC: A Hyperbolic CLIP-Driven Cache Adaptation Framework for Skeleton-based One-Shot Action Recognition | arXiv: 2606.03610
- Skill-Based Mixture-of-Experts: Adaptive Routing for Heterogeneous Reasoning via Inferred Skills | arXiv: 2503.05641
- Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents | arXiv: 2602.01869
- Skip a Layer or Loop It? Learning Program-of-Layers in LLMs | arXiv: 2606.06574
- Skipping the Zeros in Diffusion Models for Sparse Data Generation | arXiv: 2605.01817
- SLAP: The Semantic Least Action Principle for Variational Video-Language Modeling | arXiv: 2605.30750
- SLAY: Geometry-Aware Spherical Linearized Attention with Yat-Kernel | arXiv: 2602.04915
- SLQ: Bridging Modalities via Shared Latent Queries for Retrieval with Frozen MLLMs | arXiv: 2604.13710
- Smarter Saboteurs, Better Fixers: Scaling & Security in Linear Multi-Agent Workflows | arXiv: 2606.12709
- SmartThinker: Progressive Chain-of-Thought Length Calibration for Efficient Large Language Model Reasoning | arXiv: 2603.08000
- Smoothing Slot Attention Iterations and Recurrences | arXiv: 2508.05417
- Smoothness Errors in Dynamics Models and How to Avoid Them | arXiv: 2602.05352
- SoftMoE: Soft Differentiable Routing for Mixture-of-Experts in LLMs | arXiv: 2606.17952
- Softplus Attention with Re-weighting Boosts Length Extrapolation in Large Language Models | arXiv: 2501.13428
- SOLAR: Self-supervised Joint Learning for Symmetric Multimodal Retrieval | arXiv: 2605.15868
- Solving Inverse Problems with Flow-based Models via Model Predictive Control | arXiv: 2601.23231
- Sonar-TS: Search-Then-Verify Natural Language Querying for Time Series Databases | arXiv: 2602.17001
- SORA: Free Second-Order Attacks in Fast Adversarial Training | arXiv: 2606.00738
- SPA-Cache: Singular Proxies for Adaptive Caching in Diffusion Language Models | arXiv: 2602.02544
- Space-sampled Value Decay: Forgetting Mechanisms for Non-stationary Deep Reinforcement Learning | arXiv: 2606.11797
- SPARD: Defending Harmful Fine-Tuning Attack via Safety Projection with Relevance-Diversity Data Selection | arXiv: 2605.28030
- SPARe: Stacked Parallelism with Adaptive Reordering for Fault-Tolerant LLM Pretraining Systems with 100k+ GPUs | arXiv: 2603.00357
- Sparse Autoencoders are Topic Models | arXiv: 2511.16309
- Sparse Autoencoders for Interpretable Emotion Control in Text-to-Speech | arXiv: 2606.01479
- Sparse Tokens Suffice: Jailbreaking Audio Language Models via Token-Aware Gradient Optimization | arXiv: 2605.04700
- Sparser Block-Sparse Attention via Token Permutation | arXiv: 2510.21270
- SPATIA: Multimodal Generation and Prediction of Spatial Cell Phenotypes | arXiv: 2507.04704
- Spatial Memory for Out-of-Vision Manipulation in Vision-Language-Action | arXiv: 2605.22283
- Spatial Priors via Space Filling Curves for Small and Limited Data Vision Transformers | arXiv: 2606.14757
- SpatialReward: Bridging the Perception Gap in Online RL for Image Editing via Explicit Spatial Reasoning | arXiv: 2602.07458
- Spatiotemporal Imputation with Graph-Informed Flow Matching | arXiv: 2606.06682
- SpecPrune-VLA: Accelerating Vision-Language-Action Models via Action-Aware Self-Speculative Pruning | arXiv: 2509.05614
- Spectral Guidance for Flexible and Efficient Control of Diffusion Models | arXiv: 2605.28900
- Spectral-Progressive Thought Flow for Lightweight Multimodal Reasoning | arXiv: 2606.02842
- Spectrally Regularized Latent Flow Matching for Turbulence Generation | arXiv: 2606.11691
- Speculative Coupled Decoding for Training-Free Lossless Acceleration of Autoregressive Visual Generation | arXiv: 2510.24211
- Speculative Sampling for Faster Molecular Dynamics | arXiv: 2606.02455
- SPEED-Bench: A Unified and Diverse Benchmark for Speculative Decoding | arXiv: 2604.09557
- SPHERE: Mitigating the Loss of Spectral Plasticity in Mixture-of-Experts for Deep Reinforcement Learning | arXiv: 2605.04712
- Spherical Steering: Geometry-Aware Activation Rotation for Language Models | arXiv: 2602.08169
- SphericalDreamer: Generating Navigable Immersive 3D Worlds with Panorama Fusion | arXiv: 2605.19974
- SplAttN: Bridging 2D and 3D with Gaussian Soft Splatting and Attention for Point Cloud Completion | arXiv: 2605.01466
- SPROUT: Supervise Less, See More — Training-free Nuclear Instance Segmentation with Prototype-Guided Prompting | arXiv: 2511.19953
- SPSsafe: Safeguarded Stochastic Polyak Step Sizes for Non-smooth Optimization | arXiv: 2512.02342
- SSR-Merge: Subspace Signal Routing for Training-Free LoRA Merging in Diffusion Models | arXiv: 2606.10617
- Stability Analysis of Sharpness-Aware Minimization | arXiv: 2301.06308
- Stabilizing Recurrent Dynamics for Test-Time Scalable Latent Reasoning in Looped Language Models | arXiv: 2605.26733
- Stable Velocity: A Variance Perspective on Flow Matching | arXiv: 2602.05435
- Stable-GFlowNet: Toward Diverse and Robust LLM Red-Teaming via Contrastive Trajectory Balance | arXiv: 2605.00553
- STABLE: Simulation-Ready Tabletop Layout Generation via a Semantics–Physics Dual System | arXiv: 2605.16137
- StableVLA: Towards Robust Vision-Language-Action Models without Extra Data | arXiv: 2605.18287
- Stage-wise Distortion-Perception Traversal in Zero-shot Inverse Problems with Diffusion Models | arXiv: 2605.28711
- STAR: Rethinking MoE Routing as Structure-Aware Subspace Learning | arXiv: 2606.08814
- STARE: Step-wise Temporal Alignment and Red-teaming Engine for Multi-modal Toxicity Attack | arXiv: 2605.00699
- Statistical Consistency and Generalization of Contrastive Representation Learning | arXiv: 2605.02116
- Steer Like the LLM: Activation Steering that Mimics Prompting | arXiv: 2605.03907
- Steerable Cultural Preference Optimization of Reward Models | arXiv: 2606.18606
- Steering Beyond the Support: Adversarial Training on Unsupervised Jailbroken Activation Simulation | arXiv: 2605.24535
- Stein Diffusion Guidance: Training-Free Posterior Correction for Sampling Beyond High-Density Regions | arXiv: 2507.05482
- STEP: Warm-Started Visuomotor Policies with Spatiotemporal Consistency Prediction | arXiv: 2602.08245
- Stochastic Minimum-Cost Reach-Avoid Reinforcement Learning | arXiv: 2605.11975
- Stochastic Sparse Attention for Memory-Bound Inference | arXiv: 2605.01910
- Stop Automating Peer Review Without Rigorous Evaluation | arXiv: 2605.03202
- Stop When Further Reasoning Won't Help: Attention-State Adaptive Generation in Reasoning Models | arXiv: 2606.15070
- STORM: Segment, Track, and Object Re-Localization from a Single Image | arXiv: 2511.09771
- Streaming Sliced Optimal Transport | arXiv: 2505.06835
- STRIDE: Post-Training LLMs to Reason and Refine Bio-Sequences via Edit Trajectories | arXiv: 2603.03573
- Structure-Centric Graph Foundation Model via Geometric Bases | arXiv: 2605.08689
- Structure-Induced Information for Rerooting Levin Tree Search | arXiv: 2605.30664
- Structured Diffusion Bridges: Inductive Bias for Denoising Diffusion Bridges | arXiv: 2605.02973
- Structured Generalized Linear Token Mixing: Shifting Gears Between Complexity and Expressivity with SND + Kronecker | arXiv: 2605.31367
- Structuring The Future: Diffusion LLM Speculative Decoding via Calibrated Draft Graphs | arXiv: 2509.18085
- SuCo: Sufficiency-guided Continuous Adaptive Reasoning | arXiv: 2606.17687
- Supervised Graph Contrastive Learning for Gene Regulatory Networks | arXiv: 2505.17786
- Support-Proximity Augmented Diffusion Estimation for Offline Black-Box Optimization | arXiv: 2605.11246
- SURF: Separation via Unsupervised Remixing Flow | arXiv: 2606.04921
- SURGE: Approximation and Training Free Particle Filter for Diffusion Surrogate | arXiv: 2605.18745
- SURGE: Surrogate Gradient Adaptation in Binary Neural Networks | arXiv: 2605.10989
- SVL: Spike-based Vision-Language Pretraining for Efficient 3D Open-World Understanding | arXiv: 2505.17674
- SVRG and Beyond via Posterior Correction | arXiv: 2512.01930
- SWE-IF: Aligning Code Evaluation with Human Preference | arXiv: 2510.07315
- SWE-rebench V2: Language-Agnostic SWE Task Collection at Scale | arXiv: 2602.23866
- Swift-SVD: Theoretical Optimality Meets Practical Efficiency in Low-Rank LLM Compression | arXiv: 2604.01609
- SwitchCraft: A Programmatic Framework for Designing State-Switching Proteins | arXiv: 2605.31236
- SyMerge: From Non-Interference to Synergistic Merging via Single-Layer Adaptation | arXiv: 2412.19098
- SynerMedGen: Synergizing Medical Multimodal Understanding with Generation via Task Alignment | arXiv: 2605.08724
- Systematic Failures in Collective Reasoning under Distributed Information in Multi-Agent LLMs | arXiv: 2505.11556
- T\(^2\)PO: Uncertainty-Guided Exploration Control for Stable Multi-Turn Agentic Reinforcement Learning | arXiv: 2605.02178
- T-GINEE: A Tensor-Based Multilayer Graph Representation Learning | arXiv: 2605.28300
- T-POP: Test-Time Personalization with Online Preference Feedback | arXiv: 2509.24696
- T2AV-Compass: Towards Unified Evaluation for Text-to-Audio-Video Generation | arXiv: 2512.21094
- T3S: Training Trajectory-Aware Token Selection, Breaking the "Imitation Shock" in Reasoning Distillation | arXiv: 2601.10348
- TabMGP: Martingale Posterior with TabPFN | arXiv: 2510.25154
- TabSwift: An Efficient Tabular Foundation Model with Row-Wise Attention | arXiv: 2606.07345
- TadA-Bench: A Million-Variant Benchmark for Future-Round Discovery Toward Agentic Protein Engineering | arXiv: 2606.02624
- TAG: Tangential Amplifying Guidance for Hallucination-Resistant Sampling | arXiv: 2510.04533
- Tailoring Strictly Proper Scoring Rules for Downstream Tasks: An Application to Causal Inference | arXiv: 2606.03332
- Talk, Judge, Cooperate: Gossip-Driven Indirect Reciprocity in Self-Interested LLM Agents | arXiv: 2602.07777
- Taming the Loss Landscape of PINNs with Noisy Feynman-Kac Supervision: Operator Preconditioning and Non-Asymptotic Error Bounds | arXiv: 2606.00643
- TapSampling: Inference-Time Sampling with a Task-Progress-Understanding Verifier for Robotic Manipulation | arXiv: 2605.25547
- Target-Agnostic Calibration under Distribution Shift with Frequency-Aware Gradient Rectification | arXiv: 2508.19830
- Task-Aware Structured Memory for Dynamic Multi-modal In-Context Learning | arXiv: 2606.11853
- Task-Driven Subspace Decomposition for Knowledge Sharing and Isolation in LoRA-based Continual Learning | arXiv: 2603.00191
- Task-Restricted Symmetries in Recurrent Weight Space | arXiv: 2606.18457
- TCAP: Tri-Component Attention Profiling for Unsupervised Backdoor Detection in MLLM Fine-Tuning | arXiv: 2601.21692
- TD3B: Transition-Directed Discrete Diffusion for Allosteric Binder Generation | arXiv: 2605.09810
- Teaching Molecular Dynamics to a Non-Autoregressive Ionic Transport Predictor | arXiv: 2605.09311
- TEAM: Temporal-Spatial Consistency Guided Expert Activation for MoE Diffusion Language Model Acceleration | arXiv: 2602.08404
- TEMPORA: Characterising the Time-Contingent Utility of Online Test-Time Adaptation | arXiv: 2602.06136
- Temporal Difference Learning for Diffusion Models | arXiv: 2606.15048
- Temporal Preference Optimization for Unsupervised Retrieval | arXiv: 2606.17664
- Temporal Score Rescaling for Temperature Sampling in Diffusion and Flow Models | arXiv: 2510.01184
- Temporal-Aware Reasoning Optimization for Video Temporal Grounding | arXiv: 2606.09248
- Test time training enhances in-context learning of nonlinear functions | arXiv: 2509.25741
- Test-Time Training for Visual Foresight Vision-Language-Action Models | arXiv: 2605.08215
- Test-Time Training with KV Binding Is Secretly Linear Attention | arXiv: 2602.21204
- Testing the Test: Score-Direction Instability in Class-Split Anomaly Detection | arXiv: 2606.02601
- Text-Conditional JEPA for Learning Semantically Rich Visual Representations | arXiv: 2605.03245
- Textual Supervision Enhances Geospatial Representations in Vision-Language Models | arXiv: 2606.07172
- TGV-KV: Text-Grounded KV Eviction for Vision-Language Models | arXiv: 2606.03075
- The (Marginal) Value of a Search Ad: An Online Causal Framework for Repeated Second-price Auctions | arXiv: 2605.01756
- The ACUTE Protocol: Operationalizing Language Model Activations for Better Calibration, Utility, and Trust | arXiv: 2606.07822
- The Bridge-Garden Dilemma in LLM Distillation: Why Mixing Hard and Soft Labels Works | arXiv: 2605.26246
- The Cost of Learning Under Multiple Change Points | arXiv: 2602.11406
- The Coupling Within: Flow Matching via Distilled Normalizing Flows | arXiv: 2603.09014
- The Cylindrical Representation Hypothesis for Language Model Steering | arXiv: 2605.01844
- The Data Manifold under the Microscope | arXiv: 2606.15760
- The Deterministic Horizon: When Extended Reasoning Fails and Tool Delegation Becomes Necessary | arXiv: 2606.00376
- The Devil is in the Condition Numbers: Why is GLU Better than non-GLU Structure? | arXiv: 2605.20749
- The Discrete-Log Clock: How a Transformer Learns Modular Multiplication | arXiv: 2606.17399
- The Easy, the Hard, and the Learnable: Confidence and Difficulty-Adaptive Policy Optimization for LLM Reasoning | arXiv: 2606.07950
- The Expert Strikes Back: Interpreting Mixture-of-Experts Language Models at Expert Level | arXiv: 2604.02178
- The Expressive Power of Low Precision Softmax Transformers with (Summarized) Chain-of-Thought | arXiv: 2605.18079
- The Geometric Mechanics of Contrastive Representation Learning: Alignment Potentials, Entropic Dispersion, and Cross-modal Divergence | arXiv: 2601.19597
- The Geometry of Projection Heads: Conditioning, Invariance and Collapse | arXiv: 2605.17180
- The Implicit Bias of Adam and Muon on Smooth Homogeneous Neural Networks | arXiv: 2602.16340
- The Injection Paradox: Brand-Level Suppression in Safety-Trained LLM Recommendations via RAG Context Injection | arXiv: 2606.09204
- The Labyrinth and the Thread: Rethinking Regularizations in Sequential Knowledge Editing for Large Language Models | arXiv: 2605.26670
- The Latent Color Subspace: Emergent Order in High-Dimensional Chaos | arXiv: 2603.12261
- The Lie We Tell: Correcting the Euclidean Fallacy in Vision-Language-Action Policies via Score Matching on Tangent Space | arXiv: 2606.01847
- The Obfuscation Atlas: Mapping Where Honesty Emerges in RLVR with Deception Probes | arXiv: 2602.15515
- The Perceived Fragility of Explanations in Audio Models: Manipulation of Attribution with Unchanged Predictions | arXiv: 2606.14466
- The Perception-Physics Paradox: Probing Scientific Alignment with TC-Bench | arXiv: 2605.24782
- The Perceptual Bandwidth Bottleneck in Vision-Language Models: Active Visual Reasoning via Sequential Experimental Design | arXiv: 2605.01345
- The Quality-Utility Paradox: Why High-Reward Data Impairs Small Model Mathematical Reasoning | arXiv: 2606.16152
- The Realignment Problem: When Right becomes Wrong in LLMs | arXiv: 2511.02623
- The Role of Feedback Alignment in Self-Distillation | arXiv: 2606.11173
- The Shape of Addition: Geometric Structures of Arithmetic in Large Language Models | arXiv: 2606.03645
- The Shape of Reasoning: Topological Analysis of Reasoning Traces in Large Language Models | arXiv: 2510.20665
- The Silent Thought: Modeling Internal Cognition in Full-Duplex Spoken Dialogue Models via Latent Reasoning | arXiv: 2603.17837
- The Structural Origin of Attention Sink: Variance Discrepancy, Super Neurons, and Dimension Disparity | arXiv: 2605.06611
- The Surprising Difficulty of Search in Model-Based Reinforcement Learning | arXiv: 2601.21306
- The Synthetic Web: Adversarially-Curated Mini-Internets for Diagnosing Epistemic Weaknesses of Language Agents | arXiv: 2603.00801
- The Truth Stays in the Family: Enhancing Contextual Truthfulness via Inherited Heads in Model Lineages | arXiv: 2606.15821
- The Unlearnability Phenomenon in RLVR for Language Models | arXiv: 2605.16787
- Theoretical Analysis of Sparse Optimization with Reparameterization, Weight Decay, and Adaptive Learning Rate | arXiv: 2505.25134
- Theoretically Optimal Attention/FFN Ratios in Disaggregated LLM Serving | arXiv: 2601.21351
- Think Less, Act Early: Reinforced Latent Reasoning with Early Exit in Vision-Language-Action Models | arXiv: 2606.15099
- Think Twice Before You Act: Enhancing Agent Behavioral Safety with Thought Correction | arXiv: 2505.11063
- Thinking in Structures: Evaluating Spatial Intelligence in Constraint-Governed Spaces | arXiv: 2602.07864
- Three Years of r/ChatGPT: Societal Impact Evaluations from Social Media Data | arXiv: 2606.05750
- Threshold-Based Exclusive Batching for LLM Inference | arXiv: 2606.00516
- Threshold-Guided Optimization for Visual Generative Models | arXiv: 2605.04653
- Through the Stealth Lens: Attention-Aware Defenses Against Poisoning in RAG | arXiv: 2506.04390
- TideGS: Scalable Training of Over One Billion 3D Gaussian Splatting Primitives via Out-of-Core Optimization | arXiv: 2605.20150
- Time-series Forecasting Through the Lens of Dynamics | arXiv: 2507.15774
- TimeGuard: Channel-wise Pool Training for Backdoor Defense in Time Series Forecasting | arXiv: 2605.22365
- TimeOmni-VL: Unified Models for Time Series Understanding and Generation | arXiv: 2602.17149
- TimeRewarder: Learning Dense Reward from Passive Videos via Frame-wise Temporal Distance | arXiv: 2509.26627
- TimeSpot: Benchmarking Geo-Temporal Understanding in Vision-Language Models in Real-World Settings | arXiv: 2603.06687
- Timestep Rescheduling in Diffusion Inversion | arXiv: 2606.15389
- TINNs: Time-Induced Neural Networks for Solving Time-Dependent PDEs | arXiv: 2601.20361
- ToaSt: Token Channel Selection and Structured Pruning for Efficient ViT | arXiv: 2602.15720
- Token Sparse Attention: Efficient Long-Context Inference with Interleaved Token Selection | arXiv: 2602.03216
- Token-Efficient Change Detection in LLM APIs | arXiv: 2602.11083
- ToolMATH: A Math Tool Benchmark for Realistic Long-Horizon Multi-Tool Reasoning | arXiv: 2602.21265
- Top-W: Geometry-Aware Decoding with Wasserstein-Regularized Truncation and Mass Penalties for LLMs | arXiv: 2602.10346
- Topology-Preserving Neural Operator Learning via Hodge Decomposition | arXiv: 2605.13834
- Torus Graphs for Large-Scale Neural Phase Analysis | arXiv: 2606.00496
- Toward Culturally Aligned LLMs through Ontology-Guided Multi-Agent Reasoning | arXiv: 2601.21700
- Toward Robust Multilingual Adaptation of LLMs for Low-Resource Languages | arXiv: 2510.14466
- Toward Scalable and Valid Conditional Independence Testing with Spectral Representations | arXiv: 2512.19510
- Toward Stable Value Alignment: Introducing Independent Modules for Consistent Value Guidance | arXiv: 2605.11712
- Toward Structural Multimodal Representations: Specialization, Selection, and Sparsification via Mixture-of-Experts | arXiv: 2605.03348
- Toward Training Superintelligent Software Agents through Self-Play SWE-RL | arXiv: 2512.18552
- Toward Understanding Adversarial Distillation: Why Robust Teachers Fail | arXiv: 2605.21999
- Towards A Generative Protein Evolution Machine with DPLM-Evo | arXiv: 2605.00182
- Towards a Holistic Understanding of Selection Bias for Causal Effect Identification | arXiv: 2605.13430
- Towards a Science of AI Agent Reliability | arXiv: 2602.16666
- Towards Atoms of Large Language Models | arXiv: 2509.20784
- Towards Context-Invariant Safety Alignment for Large Language Models | arXiv: 2605.20994
- Towards Diverse Scientific Hypothesis Search with Large Language Models | arXiv: 2606.10587
- Towards Effective Waste Segmentation for Automated Waste Recycling in Cluttered Background | arXiv: 2606.13587
- Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning | arXiv: 2605.01663
- Towards Feedback-to-Plan Decisions for Self-Evolving LLM Agents in CUDA Kernel Generation | arXiv: 2605.26720
- Towards Fine-Grained Robustness: Attention-Guided Test-Time Prompt Tuning for Vision-Language Models | arXiv: 2605.19956
- Towards Functional Correctness of Code Models with Selective Generation | arXiv: 2505.13553
- Towards Long-Horizon Interpretability: Efficient and Faithful Multi-Token Attribution for Reasoning LLMs | arXiv: 2602.01914
- Towards One-for-All Anomaly Detection for Tabular Data | arXiv: 2603.14407
- Towards Optimal Robustness in Learning-Augmented Paging | arXiv: 2606.01342
- Towards Pareto-Optimal Tool-Integrated Agents with Pareto Ranking Policy Optimization | arXiv: 2606.16111
- Towards Resource-Efficient LLMs: End-to-End Energy Accounting of Distillation Pipelines | arXiv: 2605.13981
- Towards Steering without Sacrifice: Principled Training of Steering Vectors for Prompt-only Interventions | arXiv: 2605.05983
- Towards Streaming Synchronized Spatial Audio Generation via Autoregressive Diffusion Transformer | arXiv: 2605.30940
- Towards Understanding Adam Convergence on Highly Degenerate Polynomials | arXiv: 2603.09581
- Towards Understanding Continual Factual Knowledge Acquisition of Language Models: From Theory to Algorithm | arXiv: 2605.10640
- Towards Understanding Modality Interaction in Multimodal Language Models via Partial Information Decomposition | arXiv: 2606.00959
- Towards Universal Gene Regulatory Network Inference: Unlocking Generalizable Regulatory Knowledge in Single-cell Foundation Models | arXiv: 2605.08128
- TPV: Parameter Perturbations Through the Lens of Test Prediction Variance | arXiv: 2512.11089
- TRACE: Evaluating LLM CoT Reasoning Process Quality with the Toulmin Argumentation Model | arXiv: 2605.29656
- TRACER: Robust Multimodal Fine-tuning Proven with WMA Teacher + Geometric Decomposition | arXiv: 2605.29380
- Tracing the Dynamics of Refusal: Exploiting Latent Refusal Trajectories for Robust Jailbreak Detection | arXiv: 2605.02958
- Tracking Drift: Variation-Aware Entropy Scheduling for Non-Stationary Reinforcement Learning | arXiv: 2601.19624
- Training-Free Coverless Multi-Image Steganography with Access Control | arXiv: 2603.09390
- Training-Inference Consistent Segmented Execution for Long-Context LLMs | arXiv: 2605.11744
- Trajectory-Level Data Augmentation for Offline Reinforcement Learning | arXiv: 2605.13401
- Transferable Multi-Bit Watermarking Across Frozen Diffusion Models via Latent Consistency Bridges | arXiv: 2603.20304
- Transformed Latent Variable Multi-Output Gaussian Processes | arXiv: 2605.05133
- TRAP: Hijacking CoT Reasoning of VLA for Targeted Behavior Attacks via Adversarial Patches | arXiv: 2603.23117
- Tree-Structured Orthonormal Decomposition of the Aitchison Simplex | arXiv: 2606.11646
- Triadic Dynamics Aware Diffusion Posterior Sampling for Inverse Problems: Optimizing Guidance and Stochasticity Schedules | arXiv: 2605.26470
- TriForces: Augmenting Atomistic GNNs for Transferable Representations | arXiv: 2605.20581
- Trust Functions: Near-Lossless Weak-to-Strong Generalization by Learning When to Trust the Weak Teacher | arXiv: 2606.01000
- Trust3R: Evidential Uncertainty for Feed-Forward 3D Reconstruction | arXiv: 2605.19539
- TruthRL: Incentivizing Truthful LLMs via Reinforcement Learning | arXiv: 2509.25760
- TSRBench: A Comprehensive Multi-task Multi-modal Time Series Reasoning Benchmark for Generalist Models | arXiv: 2601.18744
- TuneAhead: Predicting Fine-tuning Performance Before Full Training Begins | arXiv: 2606.17660
- Tuning the Implicit Regularizer of Masked Diffusion Language Models: Enhancing Generalization via Insights from k-Parity | arXiv: 2601.22450
- TUR-DPO: Topology- and Uncertainty-Aware Direct Preference Optimization | arXiv: 2605.00224
- Turning Adaptation into Assets: Cross-Domain Bridging for Online Vision-Language Navigation | arXiv: 2605.23257
- Turning Back Without Forgetting: Selective Backward Refinement for Parameter-Efficient Continual Learning | arXiv: 2606.01379
- Turning Bias into Bugs: Bandit-Guided Style Manipulation Attacks on LLM Judges | arXiv: 2605.26156
- Turning Drift into Constraint: Robust Reasoning Alignment in Non-Stationary Multi-Stream Environments | arXiv: 2510.04142
- Turning Stale Gradients into Stable Gradients: Coherent Coordinate Descent with Implicit Landscape Smoothing for Lightweight Zeroth-Order Optimization | arXiv: 2605.14373
- TWLA: Achieving Ternary Weights and Low-Bit Activations for LLMs via Post-Training Quantization | arXiv: 2606.13054
- Two Blind Spots in Machine Unlearning: Over-Unlearning and Prototype Re-learning Attacks | arXiv: 2506.01318
- Two-Dimensional Quantization for Geometry-Aware Audio Coding | arXiv: 2512.01537
- Two-Layer Linear Auto-Regressive Models Estimate Latent States | arXiv: 2606.12691
- U-Cast: A Surprisingly Simple and Efficient Frontier Probabilistic AI Weather Forecasting | arXiv: 2604.09041
- UB-SMoE: Universally Balanced Sparse Mixture-of-Experts for Resource-Adaptive Federated Fine-tuning of Foundation Models | arXiv: 2605.16690
- Ubiquity of Emergent Hebbian Dynamics in Regularized Learning | arXiv: 2505.18069
- UCPO: Uncertainty-Aware Policy Optimization | arXiv: 2601.22648
- UDM-GRPO: Stable and Efficient GRPO for Unified Discrete Diffusion Models | arXiv: 2604.18518
- UGround: Towards Unified Visual Grounding with Unrolled Transformers | arXiv: 2510.03853
- Unbiased and Second-Order-Free Training for High-Dimensional PDEs | arXiv: 2605.14643
- Understand and Accelerate Memory Processing Pipeline for Large Language Model Inference | arXiv: 2603.29002
- Understanding Catastrophic Forgetting In LoRA via Mean-Field Attention Dynamics | arXiv: 2402.15415
- Understanding Generalization and Forgetting in In-Context Continual Learning | arXiv: 2605.28705
- Understanding LoRA as Knowledge Memory: An Empirical Analysis | arXiv: 2603.01097
- Understanding Self-Supervised Learning via Latent Distribution Matching | arXiv: 2605.03517
- Understanding the Parameter Space Geometry of Transformers Encoding Boolean Functions | arXiv: 2606.08768
- Understanding Truncated Positional Encodings for Graph Neural Networks | arXiv: 2606.13671
- UnHype: CLIP-Guided Hypernetworks for Dynamic LoRA Unlearning | arXiv: 2602.03410
- Unified Masked Diffusion Models with Diverse Generation Orders | arXiv: 2602.02112
- Unified Multimodal Visual Tracking with Dual Mixture-of-Experts | arXiv: 2605.03716
- Unified Value Alignment and Assignment in Cross-Domain Offline Reinforcement Learning | arXiv: 2605.24862
- Unifying Dataset Pruning and Distillation for Efficient Large-scale Compression | arXiv: 2502.06434
- UniRTL: Unified Code and Graph for Robust RTL Representation Learning | arXiv: 2605.31040
- UniScale: Adaptive Unified Inference Scaling through Online Joint Optimization of Model Routing and Test-Time Scaling | arXiv: 2605.30898
- UniSVQ: 2-bit Unified Scalar-Vector Quantization | arXiv: 2606.10520
- Universal 1/3 Time Scaling in Learning Spiked Distributions | arXiv: 2602.03685
- Universal Reasoner: Composable Plug-and-Play Reasoners for Frozen LLMs | arXiv: 2505.19075
- Universal Skeleton Understanding: Differentiable Rendering and MLLMs | arXiv: 2603.18003
- Unlocking Zero-Shot Geospatial Reasoning via Indirect Rewards | arXiv: 2510.00072
- Unraveling Syntax: Language Modeling and the Substructure of Grammars | arXiv: 2510.02524
- Unsat Core Prediction through Polarity-Aware Representation Learning over Clause-Literal Hypergraphs | arXiv: 2605.04819
- Unsupervised Hierarchical Skill Discovery | arXiv: 2601.23156
- Unveiling Multi-Regime Patterns in SciML: Diverse Failure Modes and Domain-Specific Optimization | arXiv: 2605.29153
- Unveiling the Structure of Do-Calculus Reasoning via Derivation Graphs | arXiv: 2606.03719
- Unveiling Visual Counting Bottlenecks in Vision-Language Models | arXiv: 2605.30170
- UOTIP: Unbalanced Optimal Transport Mapping for Unpaired Inversion Problems | arXiv: 2605.21094
- URS: Unified Neural Routing Solver | arXiv: 2509.23413
- Utility-Diversity Aware Online Batch Selection for LLM Supervised Fine-tuning | arXiv: 2510.16882
- V-LynX: Token Interface Alignment for VideoX LLMs | arXiv: 2606.00508
- V2V-Bench: A Comprehensive Benchmark for Video-to-Video Generation Evaluation | arXiv: 2606.05665
- VALUEFLOW: Toward Pluralistic and Steerable Value-based Alignment in Large Language Models | arXiv: 2602.03160
- VAnim: Rendering-Aware Sparse State Modeling for Structure-Preserving Vector Animation | arXiv: 2605.01517
- Variable Clustering via Distributionally Robust Nodewise Regression | arXiv: 2212.07944
- Variational Adapter for Cross-modal Similarity Representation | arXiv: 2605.30968
- Variational Routing: A Scalable Bayesian Framework for Calibrated MoE Transformers | arXiv: 2603.09453
- Vector Linking based on Cross-Model Local Isometric Consistency | arXiv: 2605.31100
- VEDA: Scalable Video Diffusion via Distilled Sparse Attention | arXiv: 2605.30325
- VEENA: Interpreting and Enhancing Emotional Circuits in Large Vision-Language Models via Cross-Modal Information Flow | arXiv: 2605.21980
- Verified SHAP: Provable Bounds for Precise Shapley Values in Neural Networks | arXiv: 2605.24084
- Verifying Meta-Awareness via Predictive Rewards in Reasoning Models | arXiv: 2510.03259
- Very Efficient Listwise Multimodal Reranking for Long Documents | arXiv: 2605.11864
- VIA-SD: Verification via Intra-Model Routing for Speculative Decoding | arXiv: 2606.12243
- Video-Based Optimal Transport for Feedback-Efficient Offline Preference-Based Reinforcement Learning | arXiv: 2606.16856
- Video-MTR: Reinforced Multi-Turn Reasoning for Long Video Understanding | arXiv: 2508.20478
- Video2GUI: Synthesizing Large-Scale Interaction Trajectories for Generalized GUI Agent Pretraining | arXiv: 2605.14747
- VideoGPA: Distilling Geometry Priors for 3D-Consistent Video Generation | arXiv: 2601.23286
- VideoKR: Towards Knowledge- and Reasoning-Intensive Video Understanding | arXiv: 2606.05259
- VideoSEAL: Mitigating Evidence Misalignment in Agentic Long Video Understanding by Decoupling Answer Authority | arXiv: 2605.12571
- VideoTemp-o3: Harmonizing Temporal Grounding and Video Understanding in Agentic Thinking | arXiv: 2602.07801
- View Space: Representation Learning Across Arbitrary Graphs | arXiv: 2512.11561
- ViewMask-1-to-3: Multi-View Consistent Image Generation via Multimodal Discrete Diffusion Models | arXiv: 2512.14099
- Viral Proteins Reveal Geometry of Protein Language Models | arXiv: 2606.12609
- Vision Language Models Cannot Reason About Physical Transformations | arXiv: 2603.07109
- Vision-aligned Latent Reasoning for Multi-modal Large Language Model | arXiv: 2602.04476
- Vision-Language Asymmetry in Bistable Image Captioning | arXiv: 2606.08031
- VisionPulse: Dynamic Visual Sparsification in Multimodal Reasoning | arXiv: 2605.31457
- Visual Implicit Autoregressive Modeling | arXiv: 2605.01220
- Visual Persuasion: What Influences the Decisions of Vision-Language Models? | arXiv: 2602.15278
- VLA-Arena: An Open-Source Framework for Evaluating Vision-Language-Action Models | arXiv: 2512.22539
- VLANeXt: A Recipe for Building Robust VLA Models | arXiv: 2602.18532
- VocSim: A Training-Free Benchmark for Zero-Shot Content Identity Recognition for Single-Source Audio | arXiv: 2512.10120
- Voting Protocols as Coordination Mechanisms for Role-Constrained Multi-Agent Tutoring Systems | arXiv: 2606.08030
- VPD-100K: Towards Generalizable and Fine-grained Visual Privacy Protection | arXiv: 2605.10229
- VSCD: Video Scene Change Detection in Unaligned Scenarios | arXiv: 2605.20821
- Vulnerable Agent Identification in Large-Scale Multi-Agent Reinforcement Learning | arXiv: 2509.15103
- WarmServe: Multi-model GPU Warm-up Mechanism via Load-Once-Many | arXiv: 2512.09472
- Watch Your Step: Information Injection in Diffusion Models via Shadow Timestep Embedding | arXiv: 2605.00935
- Watermarking LLM Agent Trajectories (ACTHOOK) | arXiv: 2602.18700
- WaveVerse: Scalable RF Simulation in Generative 4D Worlds | arXiv: 2508.12176
- Weak Diffusion Priors Can Still Achieve Strong Inverse-Problem Performance | arXiv: 2601.22443
- Weasel: Achieving Out-of-Distribution Generalization for Web Agents via Importance-Diversity Data Selection | arXiv: 2605.20291
- WeatherSyn: An Instruction Tuning MLLM For Weather Forecasting Report Generation | arXiv: 2605.07522
- Web Agents Should Use Typed Actions Instead of Click-Based Browsing | arXiv: 2602.17245
- WestWorld: Scalable Trajectory World Models with Knowledge Encoding | arXiv: 2603.14392
- What Does Reinforcement Learning for Visual Tool Use Really Learn? | arXiv: 2602.01334
- What Linear Probes Miss: Multi-View Probing for Weight-Space Learning | arXiv: 2605.23410
- What Makes a Desired Graph for Relational Deep Learning? | arXiv: 2606.08491
- What Makes a Representation Good for Single-Cell Perturbation Prediction? | arXiv: 2605.19343
- What Makes Synthetic Data Effective in Image Segmentation | arXiv: 2605.19289
- What Really Improves Mathematical Reasoning: Structured Reasoning Signals Beyond Pure Code | arXiv: 2605.19762
- What Structural Inductive Bias Helps Transformers Reason Over Knowledge Graphs? A Study with Tabula RASA | arXiv: 2602.02834
- What You Think is What You See: Driving Exploration in VLM Agents via Visual-Linguistic Curiosity (GLANCE) | arXiv: 2605.03782
- When AI Benchmarks Plateau: A Systematic Study of Benchmark Saturation | arXiv: 2602.16763
- When Benign Inputs Lead to Severe Harms: Eliciting Unsafe Unintended Behaviors of Computer-Use Agents | arXiv: 2602.08235
- When Cloud Agents Meet Device Agents: Lessons from Hybrid Multi-Agent Systems | arXiv: 2605.30102
- When Distance Distracts: Representation Distance Bias in BT-Loss for Reward Models | arXiv: 2512.06343
- When Do Graph Foundation Models Transfer? A Data-Centric Theory | arXiv: 2605.29828
- When Hallucination Costs Millions: Benchmarking AI Agents in High-Stakes Adversarial Financial Markets (CAIA) | arXiv: 2510.00332
- When Preference Labels Fall Short: Aligning Diffusion Models from Real Data | arXiv: 2605.19839
- When Sample Selection Bias Precipitates Model Collapse | arXiv: 2606.13732
- When Shared Knowledge Hurts: Spectral Over-Accumulation in Model Merging | arXiv: 2602.05536
- When Should an AI Scientist Stop? Verifiable Experiment Steering and Refusal for Autonomous Discovery | arXiv: 2606.07576
- When Softmax Fails at the Top: Extreme Value Corrections for InfoNCE | arXiv: 2606.00262
- When the Chain of Thought Knows Better: Failure Modes in Multi-Turn Reasoning Models | arXiv: 2606.10740
- When to Re-Plan: Subgoal Persistence in Hierarchical Latent Reasoning | arXiv: 2606.03741
- Where Computation Lives Inside TabPFN: Causal Localisation of Attention Head Function | arXiv: 2606.12917
- Where Concept Erasure Should Occur: Concept-Layer Alignment in Text-to-Video Diffusion Models | arXiv: 2605.25941
- Where Rectified Flows Leak: Characterising Membership Signals Along the Interpolation Path | arXiv: 2606.07271
- Where's the Plan? Locating Latent Planning in Language Models with Lightweight Mechanistic Interventions | arXiv: 2605.07984
- Which Anatomy Matters Under Limited Labels? A Data-Efficient Anatomy-Aware Benchmark for Cardiac Pathology Prediction | arXiv: 2606.06509
- Who can we trust? LLM-as-a-jury for Comparative Assessment | arXiv: 2602.16610
- Who Flips? Self- and Cross-Model Counterarguments Reveal Answer Instability in LLMs | arXiv: 2606.16011
- Whom to Query for What: Adaptive Group Elicitation via Multi-Turn LLM Interactions | arXiv: 2602.14279
- Whose Alignment? Comparing LLM Process Alignment Across Diverse Organizational Decision Contexts | arXiv: 2605.25256
- Why Are Linear RNNs More Parallelizable? | arXiv: 2603.03612
- Why Linear Interpretability Works: Invariant Subspaces as a Result of Architectural Constraints | arXiv: 2602.09783
- Why Specialist Models Still Matter: A Heterogeneous Multi-Agent Paradigm for Medical Artificial Intelligence | arXiv: 2605.29744
- WIND: Weather Inverse Diffusion for Zero-Shot Atmospheric Modeling | arXiv: 2602.03924
- WinQ: Accelerating Quantization-Aware Training of Language Models Around Saddle Points | arXiv: 2605.17471
- WISE: A World Knowledge-Informed Semantic Evaluation for Text-to-Image Generation | arXiv: 2503.07265
- World-R1: Reinforcing 3D Constraints for Text-to-Video Generation | arXiv: 2404.24764
- WorldCache: Accelerating World Models for Free via Heterogeneous Token Caching | arXiv: 2603.06331
- WUSH: Near-Optimal Adaptive Transforms for LLM Quantization | arXiv: 2512.00956
- xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector Extraction | arXiv: 2503.18893
- XTransfer: Modality-Agnostic Few-Shot Model Transfer for Human Sensing at the Edge | arXiv: 2506.22726
- YAQA: End-to-End KL Minimizing Adaptive Weight Quantization for LLMs | arXiv: 2505.22988
- You Can Learn Tokenization End-to-End with Reinforcement Learning | arXiv: 2602.13940
- You Don't Need All That Attention: Surgical Memorization Mitigation in Text-to-Image Diffusion Models | arXiv: 2603.00133
- Zero-Flow Encoders | arXiv: 2602.00797
- Zero-Shot 3D Question Answering via Hierarchical View-to-Token Transportation | arXiv: 2606.03100
- Zero-source LLM Hallucination Detection with Human-like Criteria Probing | arXiv: 2606.12900
- Zeroth-Order Non-Log-Concave Sampling with Variance Reduction and Applications to Inverse Problems | arXiv: 2605.30573
- ZipMoE: Efficient On-Device MoE Serving via Lossless Compression and Cache-Affinity Scheduling | arXiv: 2601.21198