ICML 2021 Accepted Papers
The full list of 1,181 papers accepted at ICML 2021 (International Conference on Machine Learning). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Spotlight: 1,014Oral: 166
- Learning Transferable Visual Models From Natural Language SupervisionOral35,305 citations
- Training data-efficient image transformers & distillation through attentionSpotlight8,716 citations
- Zero-Shot Text-to-Image GenerationSpotlight6,333 citations
- Scaling Up Visual and Vision-Language Representation Learning With Noisy Text SupervisionOral4,467 citations
- Improved Denoising Diffusion Probabilistic ModelsSpotlight4,295 citations
- EfficientNetV2: Smaller Models and Faster TrainingSpotlight4,128 citations
- Barlow Twins: Self-Supervised Learning via Redundancy ReductionSpotlight2,939 citations
- Is Space-Time Attention All You Need for Video Understanding?Spotlight2,678 citations
- ViLT: Vision-and-Language Transformer Without Convolution or Region SupervisionOral2,071 citations
- WILDS: A Benchmark of in-the-Wild Distribution ShiftsOral1,715 citations
- SimAM: A Simple, Parameter-Free Attention Module for Convolutional Neural NetworksSpotlight1,685 citations
- Calibrate Before Use: Improving Few-shot Performance of Language ModelsOral1,480 citations
- E(n) Equivariant Graph Neural NetworksSpotlight1,237 citations
- Perceiver: General Perception with Iterative AttentionSpotlight1,234 citations
- Ditto: Fair and Robust Federated Learning Through PersonalizationSpotlight1,178 citations
- Conditional Variational Autoencoder with Adversarial Learning for End-to-End Text-to-SpeechSpotlight1,105 citations
- Out-of-Distribution Generalization via Risk Extrapolation (REx)Oral1,103 citations
- ConViT: Improving Vision Transformers with Soft Convolutional Inductive BiasesSpotlight1,025 citations
- Exploiting Shared Representations for Personalized Federated LearningSpotlight966 citations
- Data-Free Knowledge Distillation for Heterogeneous Federated LearningSpotlight888 citations
- MSA TransformerSpotlight754 citations
- Equivariant message passing for the prediction of tensorial properties and molecular spectraSpotlight724 citations
- High-Performance Large-Scale Image Recognition Without NormalizationSpotlight668 citations
- Grad-TTS: A Diffusion Probabilistic Model for Text-to-SpeechSpotlight635 citations
- Just Train Twice: Improving Group Robustness without Training Group InformationOral630 citations
- Label-Only Membership Inference AttacksSpotlight620 citations
- Graph Contrastive Learning AutomatedOral612 citations
- Unifying Vision-and-Language Tasks via Text GenerationSpotlight601 citations
- Rethinking Rotated Object Detection with Gaussian Wasserstein Distance LossSpotlight560 citations
- Neural Architecture Search without TrainingOral538 citations
- On Explainability of Graph Neural Networks via Subgraph ExplorationsSpotlight523 citations
- What Are Bayesian Neural Network Posteriors Really Like?Oral515 citations
- Is Pessimism Provably Efficient for Offline RL?Spotlight499 citations
- Towards Understanding and Mitigating Social Biases in Language ModelsSpotlight490 citations
- Attention is not all you need: pure attention loses rank doubly exponentially with depthOral475 citations
- Environment Inference for Invariant LearningSpotlight460 citations
- Autoregressive Denoising Diffusion Models for Multivariate Probabilistic Time Series ForecastingSpotlight439 citations
- I-BERT: Integer-only BERT QuantizationOral429 citations
- Synthesizer: Rethinking Self-Attention for Transformer ModelsSpotlight426 citations
- Personalized Federated Learning using HypernetworksSpotlight421 citations
- Delving into Deep Imbalanced RegressionOral415 citations
- Decoupling Representation Learning from Reinforcement LearningSpotlight403 citations
- ASAM: Adaptive Sharpness-Aware Minimization for Scale-Invariant Learning of Deep Neural NetworksSpotlight385 citations
- Whitening for Self-Supervised Representation LearningSpotlight378 citations
- Domain Generalization using Causal MatchingOral377 citations
- Dataset Condensation with Differentiable Siamese AugmentationSpotlight375 citations
- Offline Reinforcement Learning with Fisher Divergence Critic RegularizationSpotlight364 citations
- GRAND: Graph Neural DiffusionSpotlight352 citations
- Understanding self-supervised learning dynamics without contrastive pairsOral349 citations
- PEBBLE: Feedback-Efficient Interactive Reinforcement Learning via Relabeling Experience and Unsupervised Pre-trainingOral343 citations
- Weisfeiler and Lehman Go Topological: Message Passing Simplicial NetworksSpotlight342 citations
- Accuracy on the Line: on the Strong Correlation Between Out-of-Distribution and In-Distribution GeneralizationSpotlight333 citations
- Dash: Semi-Supervised Learning with Dynamic ThresholdingOral314 citations
- HAWQ-V3: Dyadic Neural Network QuantizationSpotlight309 citations
- Training Graph Neural Networks with 1000 LayersSpotlight308 citations
- Bilevel Optimization: Convergence Analysis and Enhanced DesignSpotlight299 citations
- Revisiting Point Cloud Shape Classification with a Simple and Effective BaselineSpotlight295 citations
- BASE Layers: Simplifying Training of Large, Sparse ModelsSpotlight293 citations
- The Distributed Discrete Gaussian Mechanism for Federated Learning with Secure AggregationSpotlight288 citations
- SUNRISE: A Simple Unified Framework for Ensemble Learning in Deep Reinforcement LearningSpotlight284 citations
- Reinforcement Learning with Prototypical RepresentationsSpotlight279 citations
- Memory-Efficient Pipeline-Parallel DNN TrainingSpotlight274 citations
- Contrastive Learning Inverts the Data Generating ProcessSpotlight269 citations
- Self-supervised Graph-level Representation Learning with Local and Global StructureSpotlight268 citations
- GRAD-MATCH: Gradient Matching based Data Subset Selection for Efficient Deep Model TrainingSpotlight267 citations
- Linear Transformers Are Secretly Fast Weight ProgrammersSpotlight265 citations
- Federated Continual Learning with Weighted Inter-client TransferSpotlight262 citations
- Tensor Programs IV: Feature Learning in Infinite-Width Neural NetworksSpotlight261 citations
- Learning Gradient Fields for Molecular Conformation GenerationOral258 citations
- Bilinear Classes: A Structural Framework for Provable Generalization in RLOral256 citations
- Clustered Sampling: Low-Variance and Improved Representativity for Clients Selection in Federated LearningSpotlight255 citations
- CRFL: Certifiably Robust Federated Learning against Backdoor AttacksSpotlight243 citations
- Multi-Task Reinforcement Learning with Context-based RepresentationsSpotlight242 citations
- Generative Adversarial TransformersSpotlight240 citations
- Learning from History for Byzantine Robust OptimizationSpotlight240 citations
- A Free Lunch From ANN: Towards Efficient, Accurate Spiking Neural Networks CalibrationSpotlight235 citations
- Descending through a Crowded Valley - Benchmarking Deep Learning OptimizersSpotlight232 citations
- Neural Symbolic Regression that scalesSpotlight232 citations
- LogME: Practical Assessment of Pre-trained Models for Transfer LearningSpotlight231 citations
- Provable Meta-Learning of Linear RepresentationsSpotlight231 citations
- GraphNorm: A Principled Approach to Accelerating Graph Neural Network TrainingSpotlight230 citations
- GraphDF: A Discrete Flow Model for Molecular Graph GenerationSpotlight229 citations
- A Unified Lottery Ticket Hypothesis for Graph Neural NetworksSpotlight227 citations
- Practical and Private (Deep) Learning Without Sampling or ShufflingSpotlight226 citations
- Directional Graph NetworksOral225 citations
- To be Robust or to be Fair: Towards Fairness in Adversarial TrainingSpotlight225 citations
- Uncertainty Weighted Actor-Critic for Offline Reinforcement LearningSpotlight224 citations
- CLOCS: Contrastive Learning of Cardiac Signals Across Space, Time, and PatientsSpotlight222 citations
- Generative Causal Explanations for Graph Neural NetworksSpotlight221 citations
- Generating images with sparse representationsOral219 citations
- A Practical Method for Constructing Equivariant Multilayer Perceptrons for Arbitrary Matrix GroupsOral217 citations
- Just How Toxic is Data Poisoning? A Unified Benchmark for Backdoor and Data Poisoning AttacksSpotlight214 citations
- Phasic Policy GradientOral214 citations
- Accurate Post Training Quantization With Small Calibration SetsSpotlight212 citations
- Machine Unlearning for Random ForestsSpotlight207 citations
- Adversarial Purification with Score-based Generative ModelsSpotlight202 citations
- Meta-StyleSpeech : Multi-Speaker Adaptive Text-to-Speech GenerationSpotlight202 citations
- GNNAutoScale: Scalable and Expressive Graph Neural Networks via Historical EmbeddingsSpotlight201 citations
- Neural SDEs as Infinite-Dimensional GANsSpotlight201 citations
- Group Fisher Pruning for Practical Network CompressionSpotlight200 citations
- Heterogeneity for the Win: One-Shot Federated ClusteringSpotlight199 citations
- The Lipschitz Constant of Self-AttentionSpotlight196 citations
- Prioritized Level ReplaySpotlight194 citations
- SPECTRE: defending against backdoor attacks using robust statistics187 citations
- Neural Transformation Learning for Deep Anomaly Detection Beyond ImagesSpotlight186 citations
- Neural-Pull: Learning Signed Distance Function from Point clouds by Learning to Pull Space onto SurfaceSpotlight184 citations
- Z-GCNETs: Time Zigzags at Graph Convolutional Networks for Time Series ForecastingSpotlight183 citations
- Unbalanced minibatch Optimal Transport; applications to Domain AdaptationSpotlight182 citations
- Dissecting Supervised Contrastive LearningOral181 citations
- Neural Rough Differential Equations for Long Time SeriesSpotlight178 citations
- State Entropy Maximization with Random Encoders for Efficient ExplorationSpotlight177 citations
- Actionable Models: Unsupervised Offline Reinforcement Learning of Robotic SkillsSpotlight171 citations
- Goal-Conditioned Reinforcement Learning with Imagined SubgoalsSpotlight170 citations
- Heterogeneous Risk MinimizationSpotlight170 citations
- Toward Understanding the Feature Learning Process of Self-supervised Contrastive LearningSpotlight170 citations
- A Sharp Analysis of Model-based Reinforcement Learning with Self-PlaySpotlight169 citations
- CRPO: A New Approach for Safe Reinforcement Learning with Convergence GuaranteeSpotlight169 citations
- Globally-Robust Neural NetworksSpotlight169 citations
- Improved Contrastive Divergence Training of Energy-Based ModelsSpotlight169 citations
- Voice2Series: Reprogramming Acoustic Models for Time Series ClassificationSpotlight169 citations
- APS: Active Pretraining with Successor FeaturesOral168 citations
- Breaking the Limits of Message Passing Graph Neural NetworksSpotlight168 citations
- Scaling Multi-Agent Reinforcement Learning with Selective Parameter SharingSpotlight168 citations
- Conformal prediction interval for dynamic time-seriesOral167 citations
- DouZero: Mastering DouDizhu with Self-Play Deep Reinforcement LearningSpotlight167 citations
- TFix: Learning to Fix Coding Errors with a Text-to-Text TransformerSpotlight166 citations
- Provably End-to-end Label-noise Learning without Anchor PointsSpotlight165 citations
- The Heavy-Tail Phenomenon in SGDSpotlight164 citations
- From Local Structures to Size Generalization in Graph Neural NetworksSpotlight161 citations
- PAGE: A Simple and Optimal Probabilistic Gradient Estimator for Nonconvex OptimizationOral160 citations
- Thinking Like TransformersSpotlight160 citations
- Elastic Graph Neural NetworksOral156 citations
- Provably Efficient Reinforcement Learning for Discounted MDPs with Feature MappingSpotlight154 citations
- NeRF-VAE: A Geometry Aware 3D Scene Generative ModelOral153 citations
- Do We Actually Need Dense Over-Parameterization? In-Time Over-Parameterization in Sparse TrainingSpotlight152 citations
- Towards Domain-Agnostic Contrastive LearningSpotlight149 citations
- Break-It-Fix-It: Unsupervised Learning for Program RepairOral145 citations
- MARINA: Faster Non-Convex Distributed Learning with CompressionSpotlight145 citations
- EMaQ: Expected-Max Q-Learning Operator for Simple Yet Effective Offline and Online RLSpotlight144 citations
- Representation Matters: Offline Pretraining for Sequential Decision MakingSpotlight144 citations
- UniSpeech: Unified Speech Representation Learning with Labeled and Unlabeled DataSpotlight144 citations
- On Disentangled Representations Learned from Correlated DataOral142 citations
- ProGraML: A Graph-based Program Representation for Data Flow Analysis and Compiler OptimizationsSpotlight142 citations
- Batch Value-function Approximation with Only RealizabilitySpotlight141 citations
- PACOH: Bayes-Optimal Meta-Learning with PAC-GuaranteesSpotlight141 citations
- Backdoor Scanning for Deep Neural Networks through K-Arm OptimizationSpotlight139 citations
- Few-Shot Neural Architecture SearchOral138 citations
- Accelerated Algorithms for Smooth Convex-Concave Minimax Problems with O(1/k^2) Rate on Squared Gradient NormOral137 citations
- Confidence Scores Make Instance-dependent Label-noise Learning PossibleOral137 citations
- Cooperative Exploration for Multi-Agent Deep Reinforcement LearningOral137 citations
- Scalable Marginal Likelihood Estimation for Model Selection in Deep LearningSpotlight136 citations
- Discovering symbolic policies with deep reinforcement learningSpotlight135 citations
- KD3A: Unsupervised Multi-Source Decentralized Domain Adaptation via Knowledge DistillationSpotlight135 citations
- Offline Meta-Reinforcement Learning with Advantage WeightingSpotlight135 citations
- Revisiting Rainbow: Promoting more insightful and inclusive deep reinforcement learning researchSpotlight134 citations
- Size-Invariant Graph Representations for Graph Classification ExtrapolationsOral132 citations
- Trajectory Diversity for Zero-Shot CoordinationSpotlight131 citations
- Deep Generative Learning via Schrödinger BridgeSpotlight130 citations
- Leveraged Weighted Loss for Partial Label LearningOral130 citations
- OptiDICE: Offline Policy Optimization via Stationary Distribution Correction EstimationSpotlight129 citations
- Path Planning using Neural A* SearchSpotlight129 citations
- RRL: Resnet as representation for Reinforcement LearningSpotlight129 citations
- TeraPipe: Token-Level Pipeline Parallelism for Training Large-Scale Language ModelsSpotlight128 citations
- Understanding Failures in Out-of-Distribution Detection with Deep Generative ModelsSpotlight128 citations
- Bayesian Deep Learning via Subnetwork InferenceSpotlight127 citations
- One Pass Late Fusion Multi-view ClusteringSpotlight127 citations
- Outside the Echo Chamber: Optimizing the Performative RiskSpotlight125 citations
- Sharf: Shape-conditioned Radiance Fields from a Single ViewSpotlight124 citations
- Representation Subspace Distance for Domain Adaptation RegressionSpotlight122 citations
- Decoupling Value and Policy for Generalization in Reinforcement LearningOral120 citations
- Simple and Effective VAE Training with Calibrated DecodersSpotlight120 citations
- Characterizing Structural Regularities of Labeled Data in Overparameterized ModelsOral119 citations
- Oops I Took A Gradient: Scalable Sampling for Discrete DistributionsOral119 citations
- How Do Adam and Training Strategies Help BNNs OptimizationSpotlight118 citations
- Large Scale Private Learning via Low-rank ReparametrizationSpotlight118 citations
- Principled Simplicial Neural Networks for Trajectory PredictionOral117 citations
- Scalable Evaluation of Multi-Agent Reinforcement Learning with Melting PotOral117 citations
- What Makes for End-to-End Object Detection?Spotlight117 citations
- Bridging Multi-Task Learning and Meta-Learning: Towards Efficient Training and Effective AdaptationSpotlight116 citations
- Explaining Time Series Predictions with Dynamic MasksSpotlight116 citations
- Learning Noise Transition Matrix from Only Noisy Labels via Total Variation RegularizationOral115 citations
- Learning a Universal Template for Few-shot Dataset GeneralizationSpotlight115 citations
- DeepReDuce: ReLU Reduction for Fast Private InferenceSpotlight114 citations
- Geometry of the Loss Landscape in Overparameterized Neural Networks: Symmetries and InvariancesSpotlight114 citations
- Private Stochastic Convex Optimization: Optimal Rates in L1 GeometryOral114 citations
- Logarithmic Regret for Reinforcement Learning with Linear Function ApproximationSpotlight112 citations
- Quasi-global Momentum: Accelerating Decentralized Deep Learning on Heterogeneous DataSpotlight112 citations
- The Limits of Min-Max Optimization Algorithms: Convergence to Spurious Non-Critical SetsOral112 citations
- Clusterability as an Alternative to Anchor Points When Learning with Noisy LabelsSpotlight111 citations
- Deep Adaptive Design: Amortizing Sequential Bayesian Experimental DesignOral111 citations
- Measuring Robustness in Deep Learning Based Compressive SensingOral111 citations
- Can Subnetwork Structure Be the Key to Out-of-Distribution Generalization?Oral109 citations
- Conservative Objective Models for Effective Offline Model-Based OptimizationSpotlight108 citations
- Learning and Planning in Complex Action SpacesSpotlight108 citations
- A statistical perspective on distillationSpotlight107 citations
- Classification with Rejection Based on Cost-sensitive ClassificationSpotlight107 citations
- Intermediate Layer Optimization for Inverse Problems using Deep Generative ModelsSpotlight107 citations
- MC-LSTM: Mass-Conserving LSTMSpotlight107 citations
- Optimization of Graph Neural Networks: Implicit Acceleration by Skip Connections and More DepthSpotlight107 citations
- An End-to-End Framework for Molecular Conformation Generation via Bilevel ProgrammingSpotlight106 citations
- Classifying high-dimensional Gaussian mixtures: Where kernel methods fail and neural networks succeedSpotlight105 citations
- From Poincaré Recurrence to Convergence in Imperfect Information Games: Finding Equilibrium via RegularizationSpotlight105 citations
- Graph Neural Networks Inspired by Classical Iterative AlgorithmsOral104 citations
- Improving Generalization in Meta-learning via Task AugmentationSpotlight104 citations
- Characterizing Fairness Over the Set of Good Models Under Selective LabelsSpotlight103 citations
- Differentiable Particle Filtering via Entropy-Regularized Optimal TransportOral103 citations
- LEGO: Latent Execution-Guided Reasoning for Multi-Hop Question Answering on Knowledge GraphsSpotlight103 citations
- Learning Neural Network SubspacesSpotlight103 citations
- On Linear Identifiability of Learned RepresentationsSpotlight103 citations
- Provably Strict Generalisation Benefit for Equivariant ModelsSpotlight103 citations
- Data Augmentation for Meta-LearningSpotlight102 citations
- FOP: Factorizing Optimal Joint Policy of Maximum-Entropy Multi-Agent Reinforcement LearningSpotlight102 citations
- 1-bit Adam: Communication Efficient Large-Scale Training with Adam’s Convergence SpeedSpotlight100 citations
- Consensus Control for Decentralized Deep LearningSpotlight100 citations
- Disentangling syntax and semantics in the brain with deep networksSpotlight100 citations
- Mandoline: Model Evaluation under Distribution ShiftSpotlight100 citations
- Poolingformer: Long Document Modeling with Pooling AttentionSpotlight99 citations
- Fast active learning for pure exploration in reinforcement learningSpotlight97 citations
- On the Implicit Bias of Initialization Shape: Beyond Infinitesimal Mirror DescentOral97 citations
- AGENT: A Benchmark for Core Psychological ReasoningSpotlight96 citations
- Leveraging Sparse Linear Layers for Debuggable Deep NetworksOral96 citations
- Multiplicative Noise and Heavy Tails in Stochastic OptimizationSpotlight96 citations
- Tight Bounds on the Smallest Eigenvalue of the Neural Tangent Kernel for Deep ReLU NetworksSpotlight96 citations
- Differentially Private Query Release Through Adaptive ProjectionOral95 citations
- Continual Learning in the Teacher-Student Setup: Impact of Task SimilaritySpotlight94 citations
- How to Learn when Data Reacts to Your Model: Performative Gradient DescentSpotlight94 citations
- LTL2Action: Generalizing LTL Instructions for Multi-Task RLSpotlight94 citations
- Graph Convolution for Semi-Supervised Classification: Improved Linear Separability and Out-of-Distribution GeneralizationSpotlight93 citations
- Learning and Planning in Average-Reward Markov Decision ProcessesSpotlight93 citations
- How Important is the Train-Validation Split in Meta-Learning?Spotlight92 citations
- Muesli: Combining Improvements in Policy OptimizationSpotlight92 citations
- Optimal Complexity in Decentralized TrainingOral92 citations
- Soft then Hard: Rethinking the Quantization in Neural Image CompressionSpotlight92 citations
- End-to-End Learning of Coherent Probabilistic Forecasts for Hierarchical Time SeriesSpotlight91 citations
- Decoupling Exploration and Exploitation for Meta-Reinforcement Learning without SacrificesSpotlight90 citations
- Implicit-PDF: Non-Parametric Representation of Probability Distributions on the Rotation ManifoldSpotlight90 citations
- A Value-Function-based Interior-point Method for Non-convex Bi-level OptimizationSpotlight89 citations
- HEMET: A Homomorphic-Encryption-Friendly Privacy-Preserving Mobile Neural Network ArchitectureSpotlight89 citations
- Order-Agnostic Cross Entropy for Non-Autoregressive Machine TranslationOral89 citations
- World Model as a Graph: Learning Latent Landmarks for PlanningOral89 citations
- Exponential Lower Bounds for Batch Reinforcement Learning: Batch RL can be Exponentially Harder than Online RLOral88 citations
- f-Domain Adversarial Learning: Theory and AlgorithmsSpotlight88 citations
- iDARTS: Differentiable Architecture Search with Stochastic Implicit GradientsSpotlight88 citations
- ActNN: Reducing Training Memory Footprint via 2-Bit Activation Compressed TrainingOral87 citations
- Annealed Flow Transport Monte CarloOral87 citations
- CombOptNet: Fit the Right NP-Hard Problem by Learning Integer Programming ConstraintsSpotlight87 citations
- Hierarchical VAEs Know What They Don’t KnowSpotlight87 citations
- Of Moments and Matching: A Game-Theoretic Framework for Closing the Imitation GapSpotlight87 citations
- Robust Reinforcement Learning using Least Squares Policy Iteration with Provable Performance GuaranteesSpotlight87 citations
- UnICORNN: A recurrent model for learning very long time dependenciesSpotlight87 citations
- When Does Data Augmentation Help With Membership Inference Attacks?Spotlight87 citations
- Debiasing Model Updates for Improving Personalized Federated TrainingSpotlight86 citations
- Improved OOD Generalization via Adversarial Training and PretraingSpotlight86 citations
- A Policy Gradient Algorithm for Learning to Learn in Multiagent Reinforcement LearningSpotlight85 citations
- Directional Bias AmplificationSpotlight85 citations
- KNAS: Green Neural Architecture SearchSpotlight85 citations
- Optimizing persistent homology based functionsOral85 citations
- Asymmetric Loss Functions for Learning with Noisy LabelsSpotlight84 citations
- Federated Learning under Arbitrary Communication PatternsSpotlight84 citations
- Gradient Disaggregation: Breaking Privacy in Federated Learning by Reconstructing the User Participant MatrixOral84 citations
- How Framelets Enhance Graph Neural NetworksSpotlight84 citations
- Loss Surface Simplexes for Mode Connecting Volumes and Fast EnsemblingSpotlight84 citations
- Meta-Thompson SamplingSpotlight84 citations
- What Does Rotation Prediction Tell Us about Classifier Accuracy under Varying Testing Environments?Spotlight84 citations
- AlphaNet: Improved Training of Supernets with Alpha-DivergenceOral83 citations
- DAGs with No Curl: An Efficient DAG Structure Learning ApproachSpotlight83 citations
- Randomized Entity-wise Factorization for Multi-Agent Reinforcement LearningOral83 citations
- Class2Simi: A Noise Reduction Perspective on Learning with Noisy LabelsSpotlight82 citations
- Emergent Social Learning via Multi-agent Reinforcement LearningSpotlight82 citations
- Skew Orthogonal ConvolutionsSpotlight82 citations
- Towards the Unification and Robustness of Perturbation and Gradient Based ExplanationsSpotlight82 citations
- Causal Curiosity: RL Agents Discovering Self-supervised Experiments for Causal Representation LearningSpotlight81 citations
- Self-Damaging Contrastive LearningSpotlight81 citations
- Catastrophic Fisher Explosion: Early Phase Fisher Matrix Impacts GeneralizationSpotlight80 citations
- Fused Acoustic and Text Encoding for Multimodal Bilingual Pretraining and Speech TranslationSpotlight80 citations
- Optimal Counterfactual Explanations in Tree EnsemblesSpotlight80 citations
- Examining and Combating Spurious Features under Distribution ShiftSpotlight79 citations
- Learning Task Informed AbstractionsSpotlight79 citations
- Modelling Behavioural Diversity for Learning in Open-Ended GamesOral79 citations
- Off-Belief LearningSpotlight79 citations
- Counterfactual Credit Assignment in Model-Free Reinforcement LearningSpotlight78 citations
- Outlier-Robust Optimal TransportSpotlight78 citations
- Proximal Causal Learning with Kernels: Two-Stage Estimation and Moment RestrictionSpotlight78 citations
- Revealing the Structure of Deep Neural Networks via Convex DualitySpotlight78 citations
- Selecting Data Augmentation for Simulating InterventionsSpotlight78 citations
- Think Global and Act Local: Bayesian Optimisation over High-Dimensional Categorical and Mixed Search SpacesSpotlight78 citations
- Accelerate CNNs from Three Dimensions: A Comprehensive Pruning FrameworkSpotlight77 citations
- Continuous-time Model-based Reinforcement LearningSpotlight77 citations
- Data augmentation for deep learning based accelerated MRI reconstruction with limited dataSpotlight77 citations
- FL-NTK: A Neural Tangent Kernel-based Framework for Federated Learning AnalysisSpotlight77 citations
- Learning Intra-Batch Connections for Deep Metric LearningSpotlight77 citations
- Leveraging Non-uniformity in First-order Non-convex OptimizationSpotlight77 citations
- Low-Rank Sinkhorn FactorizationSpotlight77 citations
- Maximum Mean Discrepancy Test is Aware of Adversarial AttacksSpotlight77 citations
- Mind the Box: $l_1$-APGD for Sparse Adversarial Attacks on Image ClassifiersSpotlight77 citations
- Unbiased Gradient Estimation in Unrolled Computation Graphs with Persistent Evolution StrategiesOral77 citations
- DORO: Distributional and Outlier Robust OptimizationSpotlight76 citations
- Learning Fair Policies in Decentralized Cooperative Multi-Agent Reinforcement LearningSpotlight76 citations
- Leveraging Public Data for Practical Private Query ReleaseSpotlight76 citations
- SECANT: Self-Expert Cloning for Zero-Shot Generalization of Visual PoliciesSpotlight76 citations
- Self-Tuning for Data-Efficient Deep LearningSpotlight76 citations
- Tensor Programs IIb: Architectural Universality Of Neural Tangent Kernel Training DynamicsSpotlight76 citations
- Distribution-Free Calibration Guarantees for Histogram Binning without Sample SplittingSpotlight75 citations
- Exponentially Many Local Minima in Quantum Neural NetworksSpotlight75 citations
- Federated Composite OptimizationSpotlight75 citations
- Learning Bounds for Open-Set LearningSpotlight75 citations
- Momentum Residual Neural NetworksSpotlight75 citations
- Stabilizing Equilibrium Models by Jacobian RegularizationSpotlight74 citations
- Strategic Classification in the DarkSpotlight74 citations
- Explanations for Monotonic Classifiers.Spotlight73 citations
- Neural Tangent Generalization AttacksSpotlight73 citations
- Stability and Convergence of Stochastic Gradient Clipping: Beyond Lipschitz Continuity and SmoothnessOral73 citations
- Fair Classification with Noisy Protected Attributes: A Framework with Provable GuaranteesSpotlight72 citations
- Active Testing: Sample-Efficient Model EvaluationSpotlight71 citations
- How could Neural Networks understand Programs?Spotlight71 citations
- LieTransformer: Equivariant Self-Attention for Lie GroupsSpotlight71 citations
- Link Prediction with Persistent Homology: An Interactive ViewSpotlight71 citations
- Quantifying Ignorance in Individual-Level Causal-Effect Estimates under Hidden ConfoundingSpotlight71 citations
- Understanding the Dynamics of Gradient Flow in Overparameterized Linear modelsSpotlight71 citations
- Inverse Constrained Reinforcement LearningSpotlight70 citations
- Multiplying Matrices Without MultiplyingSpotlight70 citations
- Towards Certifying L-infinity Robustness using Neural Networks with L-inf-dist NeuronsSpotlight70 citations
- Leveraging Language to Learn Program Abstractions and Search HeuristicsSpotlight69 citations
- Private Adaptive Gradient Methods for Convex OptimizationSpotlight69 citations
- Safe Reinforcement Learning Using Advantage-Based InterventionSpotlight69 citations
- Solving high-dimensional parabolic PDEs using the tensor train formatOral68 citations
- Controlling Graph Dynamics with Reinforcement Learning and Graph Neural NetworksSpotlight67 citations
- Distributed Second Order Methods with Fast Rates and Compressed CommunicationSpotlight67 citations
- Efficient Lottery Ticket Finding: Less Data is MoreSpotlight67 citations
- Online Graph Dictionary LearningSpotlight67 citations
- Efficient Differentiable Simulation of Articulated BodiesSpotlight66 citations
- Evaluating Robustness of Predictive Uncertainty Estimation: Are Dirichlet-based Models Reliable?Spotlight66 citations
- Sparsity-Agnostic Lasso BanditSpotlight66 citations
- Strategic Classification Made PracticalSpotlight66 citations
- Towards Open Ad Hoc Teamwork Using Graph-based Policy LearningSpotlight66 citations
- Watermarking Deep Neural Networks with Greedy ResidualsSpotlight66 citations
- Fairness of Exposure in Stochastic BanditsSpotlight65 citations
- LIME: Learning Inductive Bias for Primitives of Mathematical ReasoningSpotlight65 citations
- Data-driven Prediction of General Hamiltonian Dynamics via Learning Exactly-Symplectic MapsSpotlight64 citations
- Don’t Just Blame Over-parametrization for Over-confidence: Theoretical Analysis of Calibration in Binary ClassificationSpotlight64 citations
- Global inducing point variational posteriors for Bayesian neural networks and deep Gaussian processesSpotlight64 citations
- LAMDA: Label Matching Deep Domain AdaptationSpotlight64 citations
- One for One, or All for All: Equilibria and Optimality of Collaboration in Federated LearningSpotlight64 citations
- Regularized Online Allocation Problems: Fairness and BeyondSpotlight64 citations
- Skill Discovery for Exploration and Planning using Deep Skill GraphsOral64 citations
- Composing Normalizing Flows for Inverse ProblemsSpotlight63 citations
- Exploration in Approximate Hyper-State Space for Meta Reinforcement LearningSpotlight63 citations
- Massively Parallel and Asynchronous Tsetlin Machine Architecture Supporting Almost Constant-Time ScalingSpotlight63 citations
- Object Segmentation Without Labels with Large-Scale Generative ModelsSpotlight63 citations
- On the Proof of Global Convergence of Gradient Descent for Deep ReLU Networks with Linear WidthsSpotlight63 citations
- Risk Bounds and Rademacher Complexity in Batch Reinforcement LearningSpotlight63 citations
- Towards Defending against Adversarial Examples via Attack-Invariant FeaturesSpotlight63 citations
- A Theory of Label Propagation for Subpopulation ShiftSpotlight62 citations
- Breaking the Deadly Triad with a Target NetworkSpotlight62 citations
- Coach-Player Multi-agent Reinforcement Learning for Dynamic Team CompositionOral62 citations
- Near-Optimal Representation Learning for Linear Bandits and Linear RLSpotlight62 citations
- Training Recurrent Neural Networks via Forward Propagation Through TimeSpotlight62 citations
- Vector Quantized Models for PlanningSpotlight62 citations
- Align, then memorise: the dynamics of learning with feedback alignmentSpotlight61 citations
- Bias-Variance Reduced Local SGD for Less Heterogeneous Federated LearningSpotlight61 citations
- DFAC Framework: Factorizing the Value Function via Quantile Mixture for Multi-Agent Distributional Q-LearningSpotlight61 citations
- On the Explicit Role of Initialization on the Convergence and Implicit Bias of Overparametrized Linear NetworksSpotlight61 citations
- Privacy-Preserving Feature Selection with Secure Multiparty ComputationSpotlight61 citations
- Stochastic Multi-Armed Bandits with Unrestricted Delay DistributionsSpotlight61 citations
- Temporal Predictive Coding For Model-Based Planning In Latent SpaceSpotlight61 citations
- "Hey, that’s not an ODE": Faster ODE Adjoints via SeminormsSpotlight60 citations
- Grounding Language to Entities and Dynamics for Generalization in Reinforcement LearningSpotlight60 citations
- Inferring Latent Dynamics Underlying Neural Population Activity via Neural Differential EquationsOral60 citations
- Online Learning in Unknown Markov GamesSpotlight60 citations
- Scalable Computations of Wasserstein Barycenter via Input Convex Neural NetworksOral60 citations
- Few-Shot Conformal Prediction with Auxiliary TasksSpotlight59 citations
- Learning in Nonzero-Sum Stochastic Games with PotentialsSpotlight59 citations
- On-Policy Deep Reinforcement Learning for the Average-Reward CriterionSpotlight59 citations
- PODS: Policy Optimization via Differentiable SimulationSpotlight59 citations
- Spectral Normalisation for Deep Reinforcement Learning: An Optimisation PerspectiveSpotlight59 citations
- UneVEn: Universal Value Exploration for Multi-Agent Reinforcement LearningSpotlight59 citations
- Alternative Microfoundations for Strategic ClassificationSpotlight58 citations
- Byzantine-Resilient High-Dimensional SGD with Local Iterations on Heterogeneous DataSpotlight58 citations
- Cross-Gradient Aggregation for Decentralized Learning from Non-IID DataSpotlight58 citations
- Differentially Private QuantilesSpotlight58 citations
- Kernel Stein Discrepancy DescentOral58 citations
- On a Combination of Alternating Minimization and Nesterov’s MomentumSpotlight58 citations
- Relative Positional Encoding for Transformers with Linear ComplexityOral58 citations
- Efficient Training of Robust Decision Trees Against Adversarial ExamplesSpotlight57 citations
- High-dimensional Experimental Design and Kernel BanditsOral57 citations
- Learning to Weight Imperfect DemonstrationsSpotlight57 citations
- Risk-Sensitive Reinforcement Learning with Function Approximation: A Debiasing ApproachOral57 citations
- SparseBERT: Rethinking the Importance Analysis in Self-attentionSpotlight57 citations
- Towards Open-World Recommendation: An Inductive Model-based Collaborative Filtering ApproachSpotlight57 citations
- What does LIME really see in images?Spotlight57 citations
- Augmented World Models Facilitate Zero-Shot Dynamics Generalization From a Single Offline EnvironmentSpotlight56 citations
- CIFS: Improving Adversarial Robustness of CNNs via Channel-wise Importance-based Feature SelectionSpotlight56 citations
- Implicit Regularization in Tensor FactorizationSpotlight56 citations
- Instabilities of Offline RL with Pre-Trained Neural RepresentationSpotlight56 citations
- Model-Based Reinforcement Learning via Latent-Space CollocationSpotlight56 citations
- SCC: an efficient deep reinforcement learning agent mastering the game of StarCraft IISpotlight56 citations
- Autoencoding Under Normalization ConstraintsSpotlight55 citations
- Deep kernel processesSpotlight55 citations
- Necessary and sufficient conditions for causal feature selection in time series with latent common causesSpotlight55 citations
- Zero-Shot Knowledge Distillation from a Decision-Based Black-Box ModelSpotlight55 citations
- A Zeroth-Order Block Coordinate Descent Algorithm for Huge-Scale Black-Box OptimizationSpotlight54 citations
- Accuracy, Interpretability, and Differential Privacy via Explainable BoostingSpotlight54 citations
- Fairness for Image Generation with Uncertain Sensitive AttributesSpotlight54 citations
- Near-Optimal Linear Regression under Distribution ShiftSpotlight54 citations
- Simultaneous Similarity-based Self-Distillation for Deep Metric LearningSpotlight54 citations
- Achieving Near Instance-Optimality and Minimax-Optimality in Stochastic and Adversarial Linear Bandits SimultaneouslySpotlight53 citations
- Active Feature Acquisition with Generative Surrogate ModelsSpotlight53 citations
- Bayesian Optimization over Hybrid SpacesSpotlight53 citations
- Ensemble Bootstrapping for Q-LearningSpotlight53 citations
- Learning While Playing in Mean-Field Games: Convergence and OptimalitySpotlight53 citations
- Model Distillation for Revenue Optimization: Interpretable Personalized PricingSpotlight53 citations
- Model-Targeted Poisoning Attacks with Provable ConvergenceSpotlight53 citations
- Monte Carlo Variational Auto-EncodersSpotlight53 citations
- Quantifying the Benefit of Using Differentiable Learning over Tangent KernelsSpotlight53 citations
- Train simultaneously, generalize better: Stability of gradient-based minimax learnersSpotlight53 citations
- A Riemannian Block Coordinate Descent Method for Computing the Projection Robust Wasserstein DistanceSpotlight52 citations
- Beyond $log^2(T)$ regret for decentralized bandits in matching marketsSpotlight52 citations
- Bootstrapping Fitted Q-Evaluation for Off-Policy InferenceSpotlight52 citations
- Data-efficient Hindsight Off-policy Option LearningSpotlight52 citations
- Efficient Iterative Amortized Inference for Learning Symmetric and Disentangled Multi-Object RepresentationsSpotlight52 citations
- EfficientTTS: An Efficient and High-Quality Text-to-Speech ArchitectureSpotlight52 citations
- GLSearch: Maximum Common Subgraph Detection via Learning to SearchSpotlight52 citations
- Improved, Deterministic Smoothing for L_1 Certified RobustnessOral52 citations
- Instance-Optimal Compressed Sensing via Posterior SamplingSpotlight52 citations
- Lipschitz normalization for self-attention layers with application to graph neural networksSpotlight52 citations
- PAC-Learning for Strategic ClassificationOral52 citations
- Principled Exploration via Optimistic Bootstrapping and Backward InductionSpotlight52 citations
- Regret and Cumulative Constraint Violation Analysis for Online Convex Optimization with Long Term ConstraintsOral52 citations
- Safe Reinforcement Learning with Linear Function ApproximationSpotlight52 citations
- Scalable Certified Segmentation via Randomized SmoothingSpotlight52 citations
- Sinkhorn Label Allocation: Semi-Supervised Classification via Annealed Self-TrainingSpotlight52 citations
- Stochastic Sign Descent Methods: New Algorithms and Better TheorySpotlight52 citations
- Decentralized Riemannian Gradient Descent on the Stiefel ManifoldSpotlight51 citations
- Fast Sketching of Polynomial Kernels of Polynomial DegreeSpotlight51 citations
- HoroPCA: Hyperbolic Dimensionality Reduction via Horospherical ProjectionsSpotlight51 citations
- How Does Loss Function Affect Generalization Performance of Deep Learning? Application to Human Age EstimationSpotlight51 citations
- Information Obfuscation of Graph Neural NetworksSpotlight51 citations
- Knowledge Enhanced Machine Learning Pipeline against Diverse Adversarial AttacksSpotlight51 citations
- Let’s Agree to Degree: Comparing Graph Convolutional Networks in the Message-Passing FrameworkOral51 citations
- Multi-Receiver Online Bayesian PersuasionSpotlight51 citations
- Regularized Submodular Maximization at ScaleSpotlight51 citations
- Reward Identification in Inverse Reinforcement LearningSpotlight51 citations
- SiameseXML: Siamese Networks meet Extreme Classifiers with 100M LabelsSpotlight51 citations
- Stability and Generalization of Stochastic Gradient Methods for Minimax ProblemsOral51 citations
- Value Alignment VerificationSpotlight51 citations
- An Identifiable Double VAE For Disentangled RepresentationsSpotlight50 citations
- Blind Pareto Fairness and Subgroup RobustnessSpotlight50 citations
- Discriminative Complementary-Label Learning with Weighted LossOral50 citations
- Gaussian Process-Based Real-Time Learning for Safety Critical ApplicationsSpotlight50 citations
- Neighborhood Contrastive Learning Applied to Online Patient MonitoringSpotlight50 citations
- Randomized Exploration in Reinforcement Learning with General Value Function ApproximationSpotlight50 citations
- Reinforcement Learning Under Moral UncertaintySpotlight50 citations
- Sliced Iterative Normalizing FlowsSpotlight50 citations
- The Emergence of IndividualityOral50 citations
- UCB Momentum Q-learning: Correcting the bias without forgettingOral50 citations
- Value Iteration in Continuous Actions, States and TimeSpotlight50 citations
- Zoo-Tuning: Adaptive Transfer from A Zoo of ModelsSpotlight50 citations
- Compositional Video Synthesis with Action GraphsSpotlight49 citations
- Differentiable Spatial Planning using TransformersSpotlight49 citations
- Image-Level or Object-Level? A Tale of Two Resampling Strategies for Long-Tailed DetectionSpotlight49 citations
- Interpretable Stability Bounds for Spectral Graph FiltersSpotlight49 citations
- Near-Optimal Model-Free Reinforcement Learning in Non-Stationary Episodic MDPsSpotlight49 citations
- Robust Learning for Data Poisoning AttacksSpotlight49 citations
- SpreadsheetCoder: Formula Prediction from Semi-structured ContextSpotlight49 citations
- Unsupervised Part Representation by Flow CapsulesSpotlight49 citations
- Accelerating Gossip SGD with Periodic Global AveragingSpotlight48 citations
- Adversarial Policy Learning in Two-player Competitive GamesSpotlight48 citations
- Average-Reward Off-Policy Policy Evaluation with Function ApproximationSpotlight48 citations
- BANG: Bridging Autoregressive and Non-autoregressive Generation with Large Scale PretrainingSpotlight48 citations
- Correlation Clustering in Constant Many Parallel RoundsOral48 citations
- Deep Learning for Functional Data Analysis with Adaptive Basis LayersSpotlight48 citations
- Few-shot Language Coordination by Modeling Theory of MindSpotlight48 citations
- K-shot NAS: Learnable Weight-Sharing for NAS with K-shot SupernetsSpotlight48 citations
- Lossless Compression of Efficient Private Local RandomizersSpotlight48 citations
- Sawtooth Factorial Topic Embeddings Guided Gamma Belief NetworkSpotlight48 citations
- Selfish Sparse RNN TrainingSpotlight48 citations
- Transfer-Based Semantic Anomaly DetectionSpotlight48 citations
- Unsupervised Learning of Visual 3D Keypoints for ControlSpotlight48 citations
- A Bit More Bayesian: Domain-Invariant Learning with UncertaintySpotlight47 citations
- Continuous Coordination As a Realistic Scenario for Lifelong LearningSpotlight47 citations
- Deep Reinforcement Learning amidst Continual Structured Non-StationaritySpotlight47 citations
- Finite mixture models do not reliably learn the number of componentsSpotlight47 citations
- Generalizable Episodic Memory for Deep Reinforcement LearningSpotlight47 citations
- KO codes: inventing nonlinear encoding and decoding for reliable wireless communication via deep-learningSpotlight47 citations
- Kernel Continual LearningSpotlight47 citations
- Learning from Noisy Labels with No Change to the Training ProcessSpotlight47 citations
- Multi-Agent Training beyond Zero-Sum with Correlated Equilibrium Meta-SolversSpotlight47 citations
- Optimal Thompson Sampling strategies for support-aware CVaR banditsSpotlight47 citations
- Robust Policy Gradient against Strong Data CorruptionSpotlight47 citations
- Testing DNN-based Autonomous Driving Systems under Critical Environmental ConditionsSpotlight47 citations
- A Hybrid Variance-Reduced Method for Decentralized Stochastic Non-Convex OptimizationSpotlight46 citations
- AutoAttend: Automated Attention Representation SearchSpotlight46 citations
- GP-Tree: A Gaussian Process Classifier for Few-Shot Incremental LearningSpotlight46 citations
- MOTS: Minimax Optimal Thompson SamplingSpotlight46 citations
- MURAL: Meta-Learning Uncertainty-Aware Rewards for Outcome-Driven Reinforcement LearningSpotlight46 citations
- Offline Reinforcement Learning with Pseudometric LearningSpotlight46 citations
- Opening the Blackbox: Accelerating Neural Differential Equations by Regularizing Internal Solver HeuristicsSpotlight46 citations
- Parallelizing Legendre Memory Unit TrainingSpotlight46 citations
- A New Formalism, Method and Open Issues for Zero-Shot CoordinationSpotlight45 citations
- BORE: Bayesian Optimization by Density-Ratio EstimationOral45 citations
- Bayesian Algorithm Execution: Estimating Computable Properties of Black-box Functions Using Mutual InformationSpotlight45 citations
- Cross-domain Imitation from ObservationsOral45 citations
- Fast Stochastic Bregman Gradient Methods: Sharp Analysis and Variance ReductionSpotlight45 citations
- Global Optimality Beyond Two Layers: Training Deep ReLU Networks via Convex ProgramsSpotlight45 citations
- Interactive Learning from Activity DescriptionSpotlight45 citations
- Meta-Cal: Well-controlled Post-hoc Calibration by RankingSpotlight45 citations
- Online Learning with Optimism and DelaySpotlight45 citations
- Phase Transitions, Distance Functions, and Implicit Neural RepresentationsSpotlight45 citations
- Tesseract: Tensorised Actors for Multi-Agent Reinforcement LearningSpotlight45 citations
- The Implicit Bias for Adaptive Optimization Algorithms on Homogeneous Neural NetworksOral45 citations
- Towards Distraction-Robust Active Visual TrackingSpotlight45 citations
- Correcting Exposure Bias for Link RecommendationSpotlight44 citations
- Differentially Private Aggregation in the Shuffle Model: Almost Central Accuracy in Almost a Single MessageSpotlight44 citations
- Differentially Private Bayesian Inference for Generalized Linear ModelsSpotlight44 citations
- Not All Memories are Created Equal: Learning to Forget by ExpiringOral44 citations
- TempoRL: Learning When to ActSpotlight44 citations
- Understanding Instance-Level Label Noise: Disparate Impacts and TreatmentsOral44 citations
- Aggregating From Multiple Target-Shifted SourcesSpotlight43 citations
- Besov Function Approximation and Binary Classification on Low-Dimensional Manifolds Using Convolutional Residual NetworksSpotlight43 citations
- Decomposed Mutual Information Estimation for Contrastive Representation LearningSpotlight43 citations
- Deeply-Debiased Off-Policy Interval EstimationOral43 citations
- Differentiable Sorting Networks for Scalable Sorting and Ranking SupervisionSpotlight43 citations
- Efficient Deviation Types and Learning for Hindsight Rationality in Extensive-Form GamesSpotlight43 citations
- Equivariant Learning of Stochastic Fields: Gaussian Processes and Steerable Conditional Neural ProcessesSpotlight43 citations
- Evolving Attention with Residual ConvolutionsSpotlight43 citations
- Model-Free Reinforcement Learning: from Clipped Pseudo-Regret to Sample ComplexitySpotlight43 citations
- On the Inherent Regularization Effects of Noise Injection During TrainingSpotlight43 citations
- Oneshot Differentially Private Top-k SelectionSpotlight43 citations
- Recomposing the Reinforcement Learning Building Blocks with HypernetworksSpotlight43 citations
- Toward Better Generalization Bounds with Locally Elastic StabilitySpotlight43 citations
- Unsupervised Skill Discovery with Bottleneck Option LearningSpotlight43 citations
- A General Framework For Detecting Anomalous Inputs to DNN ClassifiersOral42 citations
- Global Prosody Style Transfer Without Text TranscriptionsOral42 citations
- Non-Negative Bregman Divergence Minimization for Deep Direct Density Ratio EstimationSpotlight42 citations
- Oblivious Sketching-based Central Path Method for Linear ProgrammingSpotlight42 citations
- On the Predictability of Pruning Across ScalesSpotlight42 citations
- Positive-Negative Momentum: Manipulating Stochastic Gradient Noise to Improve GeneralizationSpotlight42 citations
- Representation Matters: Assessing the Importance of Subgroup Allocations in Training DataSpotlight42 citations
- Bayesian Structural Adaptation for Continual LearningSpotlight41 citations
- Conditional Distributional Treatment Effect with Kernel Conditional Mean Embeddings and U-Statistic RegressionSpotlight41 citations
- Density Constrained Reinforcement LearningSpotlight41 citations
- Elementary superexpressive activationsSpotlight41 citations
- Fast margin maximization via dual accelerationSpotlight41 citations
- MetaCURE: Meta Reinforcement Learning with Empowerment-Driven ExplorationSpotlight41 citations
- On Perceptual Lossy Compression: The Cost of Perceptual Reconstruction and An Optimal Training FrameworkSpotlight41 citations
- On the price of explainability for some clustering problemsOral41 citations
- Provably Efficient Learning of Transferable RewardsSpotlight41 citations
- Robust Asymmetric Learning in POMDPsOral41 citations
- Smooth $p$-Wasserstein Distance: Structure, Empirical Approximation, and Statistical ApplicationsSpotlight41 citations
- Adversarial Multi Class Learning under Weak Supervision with Performance GuaranteesSpotlight40 citations
- Dynamic Balancing for Model Selection in Bandits and RLSpotlight40 citations
- Global Convergence of Policy Gradient for Linear-Quadratic Mean-Field Control/Game in Continuous TimeSpotlight40 citations
- Improving Molecular Graph Neural Network Explainability with Orthonormalization and Induced SparsitySpotlight40 citations
- OmniNet: Omnidirectional Representations from TransformersOral40 citations
- On Lower Bounds for Standard and Robust Gaussian Process Bandit OptimizationSpotlight40 citations
- Optimal Off-Policy Evaluation from Multiple Logging PoliciesSpotlight40 citations
- Optimal Transport Kernels for Sequential and Parallel Neural Architecture SearchSpotlight40 citations
- PsiPhi-Learning: Reinforcement Learning with Demonstrations using Successor Features and Inverse Temporal Difference LearningOral40 citations
- Representational aspects of depth and conditioning in normalizing flowsSpotlight40 citations
- Robust Representation Learning via Perceptual Similarity MetricsSpotlight40 citations
- Signatured Deep Fictitious Play for Mean Field Games with Common NoiseSpotlight40 citations
- Variational Empowerment as Representation Learning for Goal-Conditioned Reinforcement LearningSpotlight40 citations
- A Sampling-Based Method for Tensor Ring DecompositionSpotlight39 citations
- Demystifying Inductive Biases for (Beta-)VAE Based ArchitecturesSpotlight39 citations
- Federated Deep AUC Maximization for Hetergeneous Data with a Constant Communication ComplexitySpotlight39 citations
- HardCoRe-NAS: Hard Constrained diffeRentiable Neural Architecture SearchSpotlight39 citations
- Learning Representations by Humans, for HumansSpotlight39 citations
- Multi-group Agnostic PAC LearnabilitySpotlight39 citations
- Sparse Feature Selection Makes Batch Reinforcement Learning More Sample EfficientSpotlight39 citations
- The Logical Options FrameworkOral39 citations
- Understanding Noise Injection in GANsSpotlight39 citations
- Value-at-Risk Optimization with Gaussian ProcessesSpotlight39 citations
- Doubly Robust Off-Policy Actor-Critic: Convergence and OptimalitySpotlight38 citations
- Dropout: Explicit Forms and Capacity ControlSpotlight38 citations
- Finite-Sample Analysis of Off-Policy Natural Actor-Critic AlgorithmSpotlight38 citations
- Grey-box Extraction of Natural Language ModelsSpotlight38 citations
- Lottery Ticket Preserves Weight Correlation: Is It Desirable or Not?Spotlight38 citations
- Mixed Nash Equilibria in the Adversarial Examples GameSpotlight38 citations
- Near-Optimal Algorithms for Explainable k-Medians and k-MeansSpotlight38 citations
- Quantum algorithms for reinforcement learning with a generative modelSpotlight38 citations
- Solving Inverse Problems with a Flow-based Noise ModelSpotlight38 citations
- Tractable structured natural-gradient descent using local parameterizationsSpotlight38 citations
- Variational Data Assimilation with a Learned Inverse Observation OperatorSpotlight38 citations
- DriftSurf: Stable-State / Reactive-State Learning under Concept DriftSpotlight37 citations
- Learning Online Algorithms with Distributional AdviceSpotlight37 citations
- Nondeterminism and Instability in Neural Network OptimizationSpotlight37 citations
- On the Optimality of Batch Policy Optimization AlgorithmsSpotlight37 citations
- Pareto GAN: Extending the Representational Power of GANs to Heavy-Tailed DistributionsSpotlight37 citations
- Structured World Belief for Reinforcement Learning in POMDPSpotlight37 citations
- TeachMyAgent: a Benchmark for Automatic Curriculum Learning in Deep RLSpotlight37 citations
- ADOM: Accelerated Decentralized Optimization Method for Time-Varying NetworksSpotlight36 citations
- Differentiable Dynamic Quantization with Mixed Precision and Adaptive ResolutionSpotlight36 citations
- Double-Win Quant: Aggressively Winning Robustness of Quantized Deep Neural Networks via Random Precision Training and InferenceSpotlight36 citations
- Graph Mixture Density NetworksSpotlight36 citations
- Inverse Decision Modeling: Learning Interpretable Representations of BehaviorOral36 citations
- Locally Private k-Means in One RoundOral36 citations
- Noise and Fluctuation of Finite Learning Rate Stochastic Gradient DescentSpotlight36 citations
- PipeTransformer: Automated Elastic Pipelining for Distributed Training of Large-scale ModelsSpotlight36 citations
- Probabilistic Generating CircuitsOral36 citations
- Sharper Generalization Bounds for ClusteringSpotlight36 citations
- SoundDet: Polyphonic Moving Sound Event Detection and Localization from Raw WaveformSpotlight36 citations
- Variational Auto-Regressive Gaussian Processes for Continual LearningSpotlight36 citations
- BASGD: Buffered Asynchronous SGD for Byzantine LearningSpotlight35 citations
- Beyond Variance Reduction: Understanding the True Impact of Baselines on Policy OptimizationSpotlight35 citations
- CATE: Computation-aware Neural Architecture Encoding with TransformersOral35 citations
- Generative Video Transformer: Can Objects be the Words?Spotlight35 citations
- Leveraging Good Representations in Linear Contextual BanditsSpotlight35 citations
- Order Matters: Probabilistic Modeling of Node Sequence for Graph GenerationSpotlight35 citations
- Sparse and Imperceptible Adversarial Attack via a Homotopy AlgorithmOral35 citations
- Testing Group Fairness via Optimal Transport ProjectionsSpotlight35 citations
- A Second look at Exponential and Cosine Step Sizes: Simplicity, Adaptivity, and PerformanceSpotlight34 citations
- Accelerating Feedforward Computation via Parallel Nonlinear Equation SolvingSpotlight34 citations
- Adaptive Sampling for Best Policy Identification in Markov Decision ProcessesSpotlight34 citations
- Bayesian Attention Belief NetworksSpotlight34 citations
- How rotational invariance of common kernels prevents generalization in high dimensionsSpotlight34 citations
- RATT: Leveraging Unlabeled Data to Guarantee GeneralizationOral34 citations
- Self-Paced Context Evaluation for Contextual Reinforcement LearningSpotlight34 citations
- SketchEmbedNet: Learning Novel Concepts by Imitating DrawingsSpotlight34 citations
- Towards Tight Bounds on the Sample Complexity of Average-reward MDPsSpotlight34 citations
- When All We Need is a Piece of the Pie: A Generic Framework for Optimizing Two-way Partial AUCOral34 citations
- Connecting Optimal Ex-Ante Collusion in Teams to Extensive-Form Correlation: Faster Algorithms and Positive Complexity ResultsSpotlight33 citations
- Diversity Actor-Critic: Sample-Aware Entropy Regularization for Sample-Efficient ExplorationSpotlight33 citations
- Fair Selective Classification Via SufficiencyOral33 citations
- Finding the Stochastic Shortest Path with Low Regret: the Adversarial Cost and Unknown Transition CaseSpotlight33 citations
- Improved Corruption Robust Algorithms for Episodic Reinforcement LearningSpotlight33 citations
- Improving Lossless Compression Rates via Monte Carlo Bits-Back CodingOral33 citations
- LARNet: Lie Algebra Residual Network for Face RecognitionSpotlight33 citations
- Learning Generalized Intersection Over Union for Dense Pixelwise PredictionSpotlight33 citations
- Model Performance Scaling with Multiple Data SourcesSpotlight33 citations
- Pointwise Binary Classification with Pairwise Confidence ComparisonsSpotlight33 citations
- Prior Image-Constrained Reconstruction using Style-Based Generative ModelsSpotlight33 citations
- Adapting to Delays and Data in Adversarial Multi-Armed BanditsSpotlight32 citations
- Adversarial Dueling BanditsSpotlight32 citations
- Beyond the Pareto Efficient Frontier: Constraint Active Search for Multiobjective Experimental DesignSpotlight32 citations
- Boosting the Throughput and Accelerator Utilization of Specialized CNN Inference Beyond Increasing Batch SizeSpotlight32 citations
- Commutative Lie Group VAE for Disentanglement LearningOral32 citations
- First-Order Methods for Wasserstein Distributionally Robust MDPSpotlight32 citations
- Follow-the-Regularized-Leader Routes to Chaos in Routing GamesSpotlight32 citations
- Hierarchical Agglomerative Graph Clustering in Nearly-Linear TimeSpotlight32 citations
- Marginal Contribution Feature Importance - an Axiomatic Approach for Explaining DataSpotlight32 citations
- Multi-Dimensional Classification via Sparse Label EncodingOral32 citations
- Near Optimal Reward-Free Reinforcement LearningOral32 citations
- Non-Autoregressive Electron Redistribution Modeling for Reaction PredictionSpotlight32 citations
- Online Unrelated Machine Load Balancing with Predictions RevisitedOral32 citations
- REPAINT: Knowledge Transfer in Deep Reinforcement LearningSpotlight32 citations
- RNN with Particle Flow for Probabilistic Spatio-temporal ForecastingOral32 citations
- Expressive 1-Lipschitz Neural Networks for Robust Multiple Graph Learning against Adversarial AttacksSpotlight31 citations
- Federated Learning of User Verification Models Without Sharing EmbeddingsSpotlight31 citations
- Kernel-Based Reinforcement Learning: A Finite-Time AnalysisSpotlight31 citations
- Learning Curves for Analysis of Deep NetworksSpotlight31 citations
- Learning disentangled representations via product manifold projectionSpotlight31 citations
- Locally Persistent Exploration in Continuous Control Tasks with Sparse RewardsSpotlight31 citations
- Making Paper Reviewing Robust to Bid Manipulation AttacksSpotlight31 citations
- Model-based Reinforcement Learning for Continuous Control with Posterior SamplingOral31 citations
- On Reward-Free RL with Kernel and Neural Function Approximations: Single-Agent MDP and Markov GameOral31 citations
- SMG: A Shuffling Gradient-Based Method with MomentumSpotlight31 citations
- Self-Improved Retrosynthetic PlanningSpotlight31 citations
- Top-k eXtreme Contextual Bandits with Arm HierarchySpotlight31 citations
- Training Adversarially Robust Sparse Networks via Bayesian Connectivity SamplingSpotlight31 citations
- A Modular Analysis of Provable Acceleration via Polyak’s Momentum: Training a Wide ReLU Network and a Deep Linear NetworkSpotlight30 citations
- Acceleration via Fractal Learning Rate SchedulesSpotlight30 citations
- Connecting Interpretability and Robustness in Decision Trees through SeparationSpotlight30 citations
- Differentially-Private Clustering of Easy InstancesSpotlight30 citations
- Fold2Seq: A Joint Sequence(1D)-Fold(3D) Embedding-based Generative Model for Protein DesignSpotlight30 citations
- Low-Precision Reinforcement Learning: Running Soft Actor-Critic in Half PrecisionSpotlight30 citations
- Navigation Turing Test (NTT): Learning to Evaluate Human-Like NavigationSpotlight30 citations
- Overcoming Catastrophic Forgetting by Bayesian Generative RegularizationSpotlight30 citations
- Parallel tempering on optimized pathsSpotlight30 citations
- Regret Minimization in Stochastic Non-Convex Learning via a Proximal-Gradient ApproachSpotlight30 citations
- The Symmetry between Arms and Knapsacks: A Primal-Dual Approach for Bandits with KnapsacksOral30 citations
- Towards Rigorous Interpretations: a Formalisation of Feature AttributionSpotlight30 citations
- Training Data Subset Selection for Regression with Controlled Generalization ErrorSpotlight30 citations
- Understanding and Mitigating Accuracy Disparity in RegressionSpotlight30 citations
- Valid Causal Inference with (Some) Invalid InstrumentsSpotlight30 citations
- An Algorithm for Stochastic and Adversarial Bandits with Switching CostsSpotlight29 citations
- CURI: A Benchmark for Productive Concept Learning Under UncertaintySpotlight29 citations
- Collaborative Bayesian Optimization with Fair RegretSpotlight29 citations
- Communication-Efficient Distributed SVD via Local Power IterationsSpotlight29 citations
- Fundamental Tradeoffs in Distributionally Adversarial TrainingSpotlight29 citations
- Generalised Lipschitz Regularisation Equals Distributional RobustnessSpotlight29 citations
- Improved Confidence Bounds for the Linear Logistic Model and Applications to BanditsSpotlight29 citations
- Latent Space Energy-Based Model of Symbol-Vector Coupling for Text Generation and ClassificationSpotlight29 citations
- Learning de-identified representations of prosody from raw audioSpotlight29 citations
- Monotonic Robust Policy Optimization with Model DiscrepancySpotlight29 citations
- Parallel and Flexible Sampling from Autoregressive Models via Langevin DynamicsSpotlight29 citations
- Permutation WeightingSpotlight29 citations
- Re-understanding Finite-State Representations of Recurrent Policy NetworksSpotlight29 citations
- Reasoning Over Virtual Knowledge Bases With Open Predicate RelationsSpotlight29 citations
- Regularizing towards Causal Invariance: Linear Models with ProxiesSpotlight29 citations
- Scalable Normalizing Flows for Permutation Invariant DensitiesSpotlight29 citations
- Solving Challenging Dexterous Manipulation Tasks With Trajectory Optimisation and Reinforcement LearningSpotlight29 citations
- Symmetric Spaces for Graph Embeddings: A Finsler-Riemannian ApproachSpotlight29 citations
- Systematic Analysis of Cluster Similarity Indices: How to Validate Validation MeasuresSpotlight29 citations
- Tighter Bounds on the Log Marginal Likelihood of Gaussian Process Regression Using Conjugate GradientsOral29 citations
- Towards Understanding Learning in Neural Networks with Linear TeachersSpotlight29 citations
- Unsupervised Embedding Adaptation via Early-Stage Feature Reconstruction for Few-Shot ClassificationSpotlight29 citations
- A theory of high dimensional regression with arbitrary correlations between input features and target functions: sample complexity, multiple descent curves and a hierarchy of phase transitionsSpotlight28 citations
- Adapting to misspecification in contextual bandits with offline regression oraclesSpotlight28 citations
- Adversarial Option-Aware Hierarchical Imitation LearningSpotlight28 citations
- Dataset Dynamics via Gradient Flows in Probability SpaceSpotlight28 citations
- Differentially Private Correlation ClusteringSpotlight28 citations
- Explainable Automated Graph Representation Learning with Hyperparameter ImportanceSpotlight28 citations
- Guarantees for Tuning the Step Size using a Learning-to-Learn ApproachSpotlight28 citations
- Improved Algorithms for Agnostic Pool-based Active ClassificationSpotlight28 citations
- Memory Efficient Online Meta LearningSpotlight28 citations
- More Powerful and General Selective Inference for Stepwise Feature Selection using Homotopy MethodSpotlight28 citations
- On the Problem of Underranking in Group-Fair RankingSpotlight28 citations
- Parameterless Transductive Feature Re-representation for Few-Shot LearningSpotlight28 citations
- Provably Efficient Algorithms for Multi-Objective Competitive RLOral28 citations
- SGLB: Stochastic Gradient Langevin BoostingSpotlight28 citations
- SigGPDE: Scaling Sparse Gaussian Processes on Sequential DataSpotlight28 citations
- Variance Reduction via Primal-Dual Accelerated Dual Averaging for Nonsmooth Convex Finite-SumsOral28 citations
- A Representation Learning Perspective on the Importance of Train-Validation Splitting in Meta-LearningSpotlight27 citations
- Active Deep Probabilistic SubsamplingSpotlight27 citations
- Addressing Catastrophic Forgetting in Few-Shot ProblemsSpotlight27 citations
- Auto-NBA: Efficient and Effective Search Over the Joint Space of Networks, Bitwidths, and AcceleratorsSpotlight27 citations
- Exact Gap between Generalization Error and Uniform Convergence in Random Feature ModelsSpotlight27 citations
- Improving Gradient Regularization using Complex-Valued Neural NetworksSpotlight27 citations
- Learning by Turning: Neural Architecture Aware OptimisationSpotlight27 citations
- Oblivious Sketching for Logistic RegressionSpotlight27 citations
- Predict then Interpolate: A Simple Algorithm to Learn Stable ClassifiersSpotlight27 citations
- Rissanen Data Analysis: Examining Dataset Characteristics via Description LengthSpotlight27 citations
- Sample Complexity of Robust Linear Classification on Separated DataSpotlight27 citations
- Sequential Domain Adaptation by Synthesizing Distributionally Robust ExpertsOral27 citations
- Weight-covariance alignment for adversarially robust neural networksSpotlight27 citations
- You Only Sample (Almost) Once: Linear Cost Self-Attention Via Bernoulli SamplingSpotlight27 citations
- A Language for Counterfactual Generative ModelsSpotlight26 citations
- A Probabilistic Approach to Neural Network PruningSpotlight26 citations
- Accelerating Safe Reinforcement Learning with Constraint-mismatched Baseline PoliciesSpotlight26 citations
- An Information-Geometric Distance on the Space of TasksSpotlight26 citations
- Approximate Group Fairness for ClusteringSpotlight26 citations
- Budgeted Heterogeneous Treatment Effect EstimationSpotlight26 citations
- Cyclically Equivariant Neural Decoders for Cyclic CodesOral26 citations
- Deciding What to Learn: A Rate-Distortion ApproachSpotlight26 citations
- Diffusion Earth Mover’s Distance and Distribution EmbeddingsSpotlight26 citations
- Label Distribution Learning MachineOral26 citations
- Latent Programmer: Discrete Latent Codes for Program SynthesisOral26 citations
- Learning from Similarity-Confidence DataSpotlight26 citations
- Learning to Generate Noise for Multi-Attack RobustnessSpotlight26 citations
- PC-MLP: Model-based Reinforcement Learning with Policy Cover Guided ExplorationSpotlight26 citations
- Policy Gradient Bayesian Robust Optimization for Imitation LearningSpotlight26 citations
- Privacy-Preserving Video Classification with Convolutional Neural NetworksSpotlight26 citations
- Revisiting Peng’s Q($λ$) for Modern Reinforcement LearningSpotlight26 citations
- Robust Pure Exploration in Linear Bandits with Limited BudgetSpotlight26 citations
- Straight to the Gradient: Learning to Use Novel Tokens for Neural Text GenerationOral26 citations
- Which transformer architecture fits my data? A vocabulary bottleneck in self-attentionSpotlight26 citations
- A Collective Learning Framework to Boost GNN Expressiveness for Node ClassificationSpotlight25 citations
- Backpropagated Neighborhood Aggregation for Accurate Training of Spiking Neural NetworksSpotlight25 citations
- Communication-Efficient Distributed Optimization with Quantized PreconditionersSpotlight25 citations
- Generalization Guarantees for Neural Architecture Search with Train-Validation SplitSpotlight25 citations
- Guided Exploration with Proximal Policy Optimization using a Single DemonstrationSpotlight25 citations
- High-Dimensional Gaussian Process Inference with DerivativesSpotlight25 citations
- Improving Breadth-Wise Backpropagation in Graph Neural Networks Helps Learning Long-Range Dependencies.Spotlight25 citations
- Megaverse: Simulating Embodied Agents at One Million Experiences per SecondSpotlight25 citations
- Network Inference and Influence Maximization from SamplesOral25 citations
- On-Off Center-Surround Receptive Fields for Accurate and Robust Image ClassificationSpotlight25 citations
- Online A-Optimal Design and Active Linear RegressionSpotlight25 citations
- Provable Generalization of SGD-trained Neural Networks of Any Width in the Presence of Adversarial Label NoiseSpotlight25 citations
- RNNRepair: Automatic RNN Repair via Model-based AnalysisSpotlight25 citations
- SAINT-ACC: Safety-Aware Intelligent Adaptive Cruise Control for Autonomous Vehicles Using Deep Reinforcement LearningSpotlight25 citations
- Scaling Properties of Deep Residual NetworksSpotlight25 citations
- Sharing Less is More: Lifelong Learning in Deep Networks with Selective Layer TransferSpotlight25 citations
- Towards Better Laplacian Representation in Reinforcement Learning with Generalized Graph DrawingSpotlight25 citations
- Towards Practical Mean Bounds for Small SamplesSpotlight25 citations
- A Deep Reinforcement Learning Approach to Marginalized Importance Sampling with the Successor RepresentationSpotlight24 citations
- A Functional Perspective on Learning Symmetric Functions with Neural NetworksSpotlight24 citations
- A Novel Sequential Coreset Method for Gradient Descent AlgorithmsSpotlight24 citations
- A large-scale benchmark for few-shot program induction and synthesisSpotlight24 citations
- Adaptive Newton Sketch: Linear-time Optimization with Quadratic Convergence and Effective Hessian DimensionalitySpotlight24 citations
- Almost Optimal Anytime Algorithm for Batched Multi-Armed BanditsSpotlight24 citations
- Deep Latent Graph MatchingSpotlight24 citations
- Differentially Private Sliced Wasserstein DistanceOral24 citations
- Exact Optimization of Conformal Predictors via Incremental and Decremental LearningSpotlight24 citations
- Fast Algorithms for Stackelberg Prediction Game with Least Squares LossSpotlight24 citations
- Function Contrastive Learning of Transferable Meta-RepresentationsSpotlight24 citations
- GMAC: A Distributional Perspective on Actor-Critic FrameworkSpotlight24 citations
- Hyperparameter Selection for Imitation LearningOral24 citations
- Making transport more robust and interpretable by moving data through a small number of anchor pointsSpotlight24 citations
- Matrix Sketching for Secure Collaborative Machine LearningSpotlight24 citations
- Non-Exponentially Weighted Aggregation: Regret Bounds for Unbounded Loss FunctionsSpotlight24 citations
- PHEW : Constructing Sparse Networks that Learn Fast and Generalize Well without Training DataSpotlight24 citations
- Riemannian Convex Potential MapsSpotlight24 citations
- Towards Better Robust Generalization with Shift Consistency RegularizationSpotlight24 citations
- Variance Reduced Training with Stratified Sampling for Forecasting ModelsSpotlight24 citations
- A Gradient Based Strategy for Hamiltonian Monte Carlo Hyperparameter OptimizationSpotlight23 citations
- A New Representation of Successor Features for Transfer across Dissimilar EnvironmentsSpotlight23 citations
- A Regret Minimization Approach to Iterative Learning ControlSpotlight23 citations
- A Scalable Second Order Method for Ill-Conditioned Matrix Completion from Few SamplesSpotlight23 citations
- Asynchronous Distributed Learning : Adapting to Gradient Delays without Prior KnowledgeSpotlight23 citations
- Bias-Free Scalable Gaussian Processes via Randomized TruncationsSpotlight23 citations
- How and Why to Use Experimental Data to Evaluate Methods for Observational Causal InferenceSpotlight23 citations
- Learning Diverse-Structured Networks for Adversarial RobustnessSpotlight23 citations
- Model Fusion for Personalized LearningSpotlight23 citations
- Newton Method over Networks is Fast up to the Statistical PrecisionSpotlight23 citations
- On the difficulty of unbiased alpha divergence minimizationSpotlight23 citations
- Optimal Streaming Algorithms for Multi-Armed BanditsSpotlight23 citations
- Private Alternating Least Squares: Practical Private Matrix Completion with Tighter RatesOral23 citations
- Tightening the Dependence on Horizon in the Sample Complexity of Q-LearningSpotlight23 citations
- Amortized Conditional Normalized Maximum Likelihood: Reliable Out of Distribution Uncertainty EstimationSpotlight22 citations
- Analysis of stochastic Lanczos quadrature for spectrum approximationOral22 citations
- Catformer: Designing Stable Transformers via Sensitivity AnalysisSpotlight22 citations
- Disambiguation of Weak Supervision leading to Exponential Convergence ratesSpotlight22 citations
- Emphatic Algorithms for Deep Reinforcement LearningSpotlight22 citations
- Equivariant Networks for Pixelized SpheresSpotlight22 citations
- Interpreting and Disentangling Feature Components of Various Complexity from DNNsSpotlight22 citations
- Keyframe-Focused Visual Imitation LearningSpotlight22 citations
- Meta-learning Hyperparameter Performance Prediction with Neural ProcessesSpotlight22 citations
- Policy Information Capacity: Information-Theoretic Measure for Task Complexity in Deep Reinforcement LearningSpotlight22 citations
- Progressive-Scale Boundary Blackbox Attack via Projective Gradient EstimationSpotlight22 citations
- Rethinking Neural vs. Matrix-Factorization Collaborative Filtering: the Theoretical PerspectivesSpotlight22 citations
- SinIR: Efficient General Image Manipulation with Single Image ReconstructionSpotlight22 citations
- Task-Optimal Exploration in Linear Dynamical SystemsOral22 citations
- Versatile Verification of Tree EnsemblesSpotlight22 citations
- Asymmetric Heavy Tails and Implicit Bias in Gaussian Noise InjectionsSpotlight21 citations
- Characterizing the Gap Between Actor-Critic and Policy GradientSpotlight21 citations
- DG-LMC: A Turn-key and Scalable Synchronous Distributed MCMC Algorithm via Langevin Monte Carlo within GibbsOral21 citations
- Dense for the Price of Sparse: Improved Performance of Sparsely Initialized Networks via a Subspace OffsetSpotlight21 citations
- Differentially Private Densest Subgraph DetectionSpotlight21 citations
- Efficient Message Passing for 0–1 ILPs with Binary Decision DiagramsSpotlight21 citations
- Estimating Identifiable Causal Effects on Markov Equivalence Class through Double Machine LearningSpotlight21 citations
- Integer Programming for Causal Structure Learning in the Presence of Latent VariablesOral21 citations
- Learning Queueing Policies for Organ Transplantation Allocation using Interpretable Counterfactual Survival AnalysisSpotlight21 citations
- On the Random Conjugate Kernel and Neural Tangent KernelSpotlight21 citations
- Optimal Non-Convex Exact Recovery in Stochastic Block Model via Projected Power MethodSpotlight21 citations
- Policy Caches with Successor FeaturesSpotlight21 citations
- Provable Lipschitz Certification for Generative ModelsSpotlight21 citations
- Provably Correct Optimization and Exploration with Non-linear PoliciesSpotlight21 citations
- SPADE: A Spectral Method for Black-Box Adversarial Robustness EvaluationSpotlight21 citations
- Sparse within Sparse Gaussian Processes using Neighbor InformationSpotlight21 citations
- Stochastic Iterative Graph MatchingSpotlight21 citations
- Uncovering the Connections Between Adversarial Transferability and Knowledge TransferabilitySpotlight21 citations
- A Proxy Variable View of Shared ConfoundingSpotlight20 citations
- Adversarial Combinatorial Bandits with General Non-linear Reward FunctionsSpotlight20 citations
- Asynchronous Decentralized Optimization With Implicit Stochastic Variance ReductionSpotlight20 citations
- DeepWalking Backwards: From Embeddings Back to GraphsSpotlight20 citations
- Dueling Convex OptimizationSpotlight20 citations
- Fairness and Bias in Online SelectionSpotlight20 citations
- Fast Projection Onto Convex Smooth ConstraintsSpotlight20 citations
- Improved Regret Bound and Experience Replay in Regularized Policy IterationOral20 citations
- Learn-to-Share: A Hardware-friendly Transfer Learning Framework Exploiting Computation and Parameter SharingOral20 citations
- Learning Binary Decision Trees by Argmin DifferentiationSpotlight20 citations
- Mixed Cross Entropy Loss for Neural Machine TranslationOral20 citations
- On Reinforcement Learning with Adversarial Corruption and Its Application to Block MDPSpotlight20 citations
- On the Convergence of Hamiltonian Monte Carlo with Stochastic GradientsSpotlight20 citations
- Policy Analysis using Synthetic Controls in Continuous-TimeSpotlight20 citations
- Quantile Bandits for Best Arms IdentificationSpotlight20 citations
- Robust Learning-Augmented Caching: An Experimental StudySpotlight20 citations
- Self Normalizing FlowsSpotlight20 citations
- Temporal Difference Learning as Gradient SplittingOral20 citations
- Conditional Temporal Neural Processes with Covariance LossSpotlight19 citations
- Consistent regression when oblivious outliers overwhelmSpotlight19 citations
- Directed Graph Embeddings in Pseudo-Riemannian ManifoldsSpotlight19 citations
- Discretization Drift in Two-Player GamesSpotlight19 citations
- Integrated Defense for Resilient Graph MatchingSpotlight19 citations
- Large-Scale Meta-Learning with Continual Trajectory ShiftingSpotlight19 citations
- Neuro-algorithmic Policies Enable Fast Combinatorial GeneralizationSpotlight19 citations
- Online Selection Problems against Constrained AdversarySpotlight19 citations
- Sparsifying Networks via Subdifferential InclusionSpotlight19 citations
- Unsupervised Co-part Segmentation through AssemblySpotlight19 citations
- Whitening and Second Order Optimization Both Make Information in the Dataset Unusable During Training, and Can Reduce or Prevent GeneralizationSpotlight19 citations
- Agnostic Learning of Halfspaces with Gradient Descent via Soft MarginsOral18 citations
- Composed Fine-Tuning: Freezing Pre-Trained Denoising Autoencoders for Improved GeneralizationOral18 citations
- Decision-Making Under Selective Labels: Optimal Finite-Domain Policies and BeyondSpotlight18 citations
- Flow-based Attribution in Graphical Models: A Recursive Shapley ApproachSpotlight18 citations
- Model-Free and Model-Based Policy Evaluation when Causality is UncertainSpotlight18 citations
- Multi-layered Network Exploration via Random Walks: From Offline Optimization to Online LearningOral18 citations
- Online Limited Memory Neural-Linear Bandits with Likelihood MatchingSpotlight18 citations
- Online Policy Gradient for Model Free Learning of Linear Quadratic Regulators with $\sqrt$T RegretSpotlight18 citations
- Probabilistic Sequential Shrinking: A Best Arm Identification Algorithm for Stochastic Bandits with CorruptionsSpotlight18 citations
- Provable Robustness of Adversarial Training for Learning Halfspaces with NoiseSpotlight18 citations
- Self-supervised and Supervised Joint Training for Resource-rich Machine TranslationSpotlight18 citations
- Submodular Maximization subject to a Knapsack Constraint: Combinatorial Algorithms with Near-optimal Adaptive ComplexitySpotlight18 citations
- Tilting the playing field: Dynamical loss functions for machine learningOral18 citations
- Two Heads are Better Than One: Hypergraph-Enhanced Graph Reasoning for Visual Event RatiocinationSpotlight18 citations
- ARMS: Antithetic-REINFORCE-Multi-Sample Gradient for Binary VariablesSpotlight17 citations
- Benchmarks, Algorithms, and Metrics for Hierarchical DisentanglementOral17 citations
- Concentric mixtures of Mallows models for top-$k$ rankings: sampling and identifiabilitySpotlight17 citations
- Cross-model Back-translated Distillation for Unsupervised Machine TranslationSpotlight17 citations
- Generalization Bounds in the Presence of Outliers: a Median-of-Means StudySpotlight17 citations
- Generalized Doubly Reparameterized Gradient EstimatorsSpotlight17 citations
- Learn2Hop: Learned Optimization on Rough LandscapesSpotlight17 citations
- Learning Stochastic Behaviour from Aggregate DataSpotlight17 citations
- Locally Adaptive Label Smoothing Improves Predictive ChurnSpotlight17 citations
- Message Passing Adaptive Resonance Theory for Online Active Semi-supervised LearningSpotlight17 citations
- Multidimensional Scaling: Approximation and ComplexitySpotlight17 citations
- PixelTransformer: Sample Conditioned Signal GenerationSpotlight17 citations
- Post-selection inference with HSIC-LassoSpotlight17 citations
- Two-way kernel matrix puncturing: towards resource-efficient PCA and spectral clusteringSpotlight17 citations
- 12-Lead ECG Reconstruction via Koopman OperatorsSpotlight16 citations
- A Structured Observation Distribution for Generative Biological Sequence Prediction and ForecastingSpotlight16 citations
- AdaXpert: Adapting Neural Architecture for Growing DataSpotlight16 citations
- Binary Classification from Multiple Unlabeled Datasets via Surrogate Set ClassificationSpotlight16 citations
- Combinatorial Blocking Bandits with Stochastic DelaysSpotlight16 citations
- Combining Pessimism with Optimism for Robust and Efficient Model-Based Deep Reinforcement LearningSpotlight16 citations
- DANCE: Enhancing saliency maps using decoysSpotlight16 citations
- Deep Continuous NetworksSpotlight16 citations
- Dimensionality Reduction for the Sum-of-Distances MetricOral16 citations
- GBHT: Gradient Boosting Histogram Transform for Density EstimationSpotlight16 citations
- Geometric convergence of elliptical slice samplingSpotlight16 citations
- Local Correlation Clustering with Asymmetric Classification ErrorsSpotlight16 citations
- Meta-Learning Bidirectional Update RulesSpotlight16 citations
- Neural Pharmacodynamic State Space ModelingSpotlight16 citations
- No-regret Algorithms for Capturing Events in Poisson Point ProcessesSpotlight16 citations
- Off-Policy Confidence SequencesSpotlight16 citations
- On Learnability via Gradient Method for Two-Layer ReLU Neural Networks in Teacher-Student SettingSpotlight16 citations
- Parallel Droplet Control in MEDA Biochips using Multi-Agent Reinforcement LearningSpotlight16 citations
- Randomized Algorithms for Submodular Function Maximization with a $k$-System ConstraintSpotlight16 citations
- Reinforcement Learning of Implicit and Explicit Control Flow InstructionsSpotlight16 citations
- Streaming Bayesian Deep Tensor FactorizationSpotlight16 citations
- Structured Convolutional Kernel Networks for Airline Crew SchedulingSpotlight16 citations
- T-SCI: A Two-Stage Conformal Inference Algorithm with Guaranteed Coverage for Cox-MLPSpotlight16 citations
- Training Quantized Neural Networks to Global Optimality via Semidefinite ProgrammingSpotlight16 citations
- Zeroth-Order Non-Convex Learning via Hierarchical Dual AveragingSpotlight16 citations
- Adversarial Robustness Guarantees for Random Deep Neural NetworksSpotlight15 citations
- Affine Invariant Analysis of Frank-Wolfe on Strongly Convex SetsSpotlight15 citations
- Analyzing the tree-layer structure of Deep ForestsSpotlight15 citations
- Best Model Identification: A Rested Bandit FormulationSpotlight15 citations
- Bias-Robust Bayesian Optimization via Dueling BanditsSpotlight15 citations
- CARTL: Cooperative Adversarially-Robust Transfer LearningOral15 citations
- Crowdsourcing via Annotator Co-occurrence Imputation and Provable Symmetric Nonnegative Matrix FactorizationOral15 citations
- Event Outlier Detection in Continuous TimeSpotlight15 citations
- Faster Kernel Matrix Algebra via Density EstimationSpotlight15 citations
- Modeling Hierarchical Structures with Continuous Recursive Neural NetworksOral15 citations
- Nonparametric Hamiltonian Monte CarloSpotlight15 citations
- On Monotonic Linear Interpolation of Neural Network ParametersSpotlight15 citations
- On Proximal Policy Optimization’s Heavy-tailed GradientsSpotlight15 citations
- On the Generalization Power of Overfitted Two-Layer Neural Tangent Kernel ModelsSpotlight15 citations
- PID Accelerated Value Iteration AlgorithmSpotlight15 citations
- Prediction-Centric Learning of Independent Cascade Dynamics from Partial ObservationsSpotlight15 citations
- Projection Robust Wasserstein BarycentersSpotlight15 citations
- Provably Efficient Fictitious Play Policy Optimization for Zero-Sum Markov Games with Structured TransitionsOral15 citations
- Relative Deviation Margin BoundsSpotlight15 citations
- SKIing on Simplices: Kernel Interpolation on the Permutohedral Lattice for Scalable Gaussian ProcessesOral15 citations
- Scalable Optimal Transport in High Dimensions for Graph Distances, Embedding Alignment, and MoreSpotlight15 citations
- Slot Machines: Discovering Winning Combinations of Random Weights in Neural NetworksSpotlight15 citations
- Winograd Algorithm for AdderNetSpotlight15 citations
- A Discriminative Technique for Multiple-Source AdaptationSpotlight14 citations
- Automatic variational inference with cascading flowsSpotlight14 citations
- Boosting for Online Convex OptimizationSpotlight14 citations
- Deep Coherent Exploration for Continuous ControlSpotlight14 citations
- Detection of Signal in the Spiked Rectangular ModelsSpotlight14 citations
- Distributed Nyström Kernel Learning with CommunicationsSpotlight14 citations
- Estimating $α$-Rank from A Few Entries with Low Rank Matrix CompletionSpotlight14 citations
- Generalization Error Bound for Hyperbolic Ordinal EmbeddingSpotlight14 citations
- Hierarchical Clustering of Data Streams: Scalable Algorithms and Approximation GuaranteesSpotlight14 citations
- Instance Specific Approximations for Submodular MaximizationSpotlight14 citations
- Learning Interaction Kernels for Agent Systems on Riemannian ManifoldsSpotlight14 citations
- Learning Self-Modulating Attention in Continuous Time Space with Applications to Sequential RecommendationSpotlight14 citations
- On Characterizing GAN Convergence Through Proximal Duality GapSpotlight14 citations
- On Limited-Memory Subsampling Strategies for BanditsSpotlight14 citations
- Projection techniques to update the truncated SVD of evolving matrices with applicationsSpotlight14 citations
- Robust Testing and Estimation under Manipulation AttacksSpotlight14 citations
- Robust Unsupervised Learning via L-statistic MinimizationSpotlight14 citations
- Supervised Tree-Wasserstein DistanceSpotlight14 citations
- The Impact of Record Linkage on Learning from Feature Partitioned DataSpotlight14 citations
- The Power of Adaptivity for Stochastic Submodular CoverOral14 citations
- Whittle Networks: A Deep Likelihood Model for Time SeriesSpotlight14 citations
- A Framework for Private Matrix Analysis in Sliding Window ModelSpotlight13 citations
- Active Learning for Distributionally Robust Level-Set EstimationSpotlight13 citations
- Approximation Theory of Convolutional Architectures for Time Series ModellingSpotlight13 citations
- Chebyshev Polynomial Codes: Task Entanglement-based Coding for Distributed Matrix MultiplicationSpotlight13 citations
- Decomposable Submodular Function Minimization via Maximum FlowSpotlight13 citations
- Detecting Rewards Deterioration in Episodic Reinforcement LearningSpotlight13 citations
- Distributionally Robust Optimization with Markovian DataSpotlight13 citations
- Implicit Bias of Linear RNNsSpotlight13 citations
- Label Inference Attacks from Log-loss ScoresOral13 citations
- MorphVAE: Generating Neural Morphologies from 3D-Walks using a Variational Autoencoder with Spherical Latent SpaceSpotlight13 citations
- On the Power of Localized Perceptron for Label-Optimal Learning of Halfspaces with Adversarial NoiseSpotlight13 citations
- Parameter-free Locally Accelerated Conditional GradientsSpotlight13 citations
- Quantization Algorithms for Random Fourier FeaturesSpotlight13 citations
- Robust Density Estimation from Batches: The Best Things in Life are (Nearly) FreeOral13 citations
- Three Operator Splitting with a Nonconvex Loss FunctionSpotlight13 citations
- An Integer Linear Programming Framework for Mining Constraints from DataSpotlight12 citations
- Confidence-Budget Matching for Sequential Budgeted LearningSpotlight12 citations
- Diffusion Source Identification on Networks with Statistical ConfidenceSpotlight12 citations
- Dynamic Planning and Learning under Recovering RewardsSpotlight12 citations
- Efficient Performance Bounds for Primal-Dual Reinforcement Learning from DemonstrationsSpotlight12 citations
- From Local to Global Norm Emergence: Dissolving Self-reinforcing Substructures with Incremental Social InstrumentsSpotlight12 citations
- GANMEX: One-vs-One Attributions using GAN-based Model ExplainabilitySpotlight12 citations
- GeomCA: Geometric Evaluation of Data RepresentationsSpotlight12 citations
- Group-Sparse Matrix Factorization for Transfer Learning of Word EmbeddingsSpotlight12 citations
- Improving Ultrametrics Embeddings Through CoresetsSpotlight12 citations
- Interpretable Stein Goodness-of-fit Tests on Riemannian ManifoldSpotlight12 citations
- Joint Online Learning and Decision-making via Dual Mirror DescentSpotlight12 citations
- Learning to Rehearse in Long Sequence MemorizationSpotlight12 citations
- Markpainting: Adversarial Machine Learning meets InpaintingSpotlight12 citations
- Modularity in Reinforcement Learning via Algorithmic Independence in Credit AssignmentOral12 citations
- Offline Contextual Bandits with Overparameterized ModelsSpotlight12 citations
- Posterior Value Functions: Hindsight Baselines for Policy Gradient MethodsSpotlight12 citations
- Quantitative Understanding of VAE as a Non-linearly Scaled Isometric EmbeddingSpotlight12 citations
- Rate-Distortion Analysis of Minimum Excess Risk in Bayesian LearningOral12 citations
- Sparse Bayesian Learning via Stepwise RegressionSpotlight12 citations
- Better Training using Weight-Constrained Stochastic DynamicsSpotlight11 citations
- Convex Regularization in Monte-Carlo Tree SearchSpotlight11 citations
- CountSketches, Feature Hashing and the Median of ThreeSpotlight11 citations
- Decentralized Single-Timescale Actor-Critic on Zero-Sum Two-Player Stochastic GamesSpotlight11 citations
- Disentangling Sampling and Labeling Bias for Learning in Large-output SpacesSpotlight11 citations
- Enhancing Robustness of Neural Networks through Fourier StabilizationSpotlight11 citations
- Estimation and Quantization of Expected Persistence DiagramsSpotlight11 citations
- Implicit rate-constrained optimization of non-decomposable objectivesSpotlight11 citations
ICML accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.