ICLR 2021 Accepted Papers
The full list of 860 papers accepted at ICLR 2021 (International Conference on Learning Representations). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Poster: 693Spotlight: 114Oral: 53
- An Image is Worth 16x16 Words: Transformers for Image Recognition at ScaleOral62,867 citations
- Denoising Diffusion Implicit ModelsPoster8,188 citations
- Score-Based Generative Modeling through Stochastic Differential EquationsOral7,224 citations
- Deformable DETR: Deformable Transformers for End-to-End Object DetectionOral6,958 citations
- Measuring Massive Multitask Language UnderstandingPoster4,192 citations
- DEBERTA: DECODING-ENHANCED BERT WITH DISENTANGLED ATTENTIONPoster3,296 citations
- Fourier Neural Operator for Parametric Partial Differential EquationsPoster3,172 citations
- Rethinking Attention with PerformersOral2,032 citations
- Adaptive Federated OptimizationPoster1,819 citations
- FastSpeech 2: Fast and High-Quality End-to-End Text to SpeechPoster1,735 citations
- Sharpness-aware Minimization for Efficiently Improving GeneralizationSpotlight1,709 citations
- DiffWave: A Versatile Diffusion Model for Audio SynthesisOral1,632 citations
- In Search of Lost Domain GeneralizationPoster1,378 citations
- Tent: Fully Test-Time Adaptation by Entropy MinimizationSpotlight1,373 citations
- GShard: Scaling Giant Models with Conditional Computation and Automatic ShardingPoster1,282 citations
- Approximate Nearest Neighbor Negative Contrastive Learning for Dense Text RetrievalPoster1,280 citations
- Prototypical Contrastive Learning of Unsupervised RepresentationsPoster1,264 citations
- GraphCodeBERT: Pre-training Code Representations with Data FlowPoster1,214 citations
- Learning Mesh-Based Simulation with Graph NetworksSpotlight1,101 citations
- FedBN: Federated Learning on Non-IID Features via Local Batch NormalizationPoster1,089 citations
- Mastering Atari with Discrete World ModelsPoster1,065 citations
- Federated Learning Based on Dynamic RegularizationOral1,035 citations
- Domain Generalization with MixStylePoster1,006 citations
- On the Bottleneck of Graph Neural Networks and its Practical ImplicationsPoster974 citations
- Contrastive Learning with Hard Negative SamplesPoster963 citations
- Adaptive Universal Generalized PageRank Graph Neural NetworkPoster959 citations
- Long-tail learning via logit adjustmentSpotlight907 citations
- WaveGrad: Estimating Gradients for Waveform GenerationPoster894 citations
- Long Range Arena : A Benchmark for Efficient TransformersPoster797 citations
- In Defense of Pseudo-Labeling: An Uncertainty-Aware Pseudo-label Selection Framework for Semi-Supervised LearningPoster743 citations
- WaNet - Imperceptible Warping-based Backdoor AttackPoster694 citations
- HeteroFL: Computation and Communication Efficient Federated Learning for Heterogeneous ClientsPoster677 citations
- Hopfield Networks is All You NeedPoster673 citations
- QPLEX: Duplex Dueling Multi-Agent Q-LearningPoster610 citations
- Aligning AI With Shared Human ValuesPoster607 citations
- Dataset Condensation with Gradient MatchingOral599 citations
- Unbiased Teacher for Semi-Supervised Object DetectionPoster598 citations
- Autoregressive Entity RetrievalSpotlight596 citations
- Learning Invariant Representations for Reinforcement Learning without ReconstructionOral569 citations
- Learning from Protein Structure with Geometric Vector PerceptronsSpotlight569 citations
- Supervised Contrastive Learning for Pre-trained Language Model Fine-tuningPoster561 citations
- Neural Attention Distillation: Erasing Backdoor Triggers from Deep Neural NetworksPoster554 citations
- Image Augmentation Is All You Need: Regularizing Deep Reinforcement Learning from PixelsSpotlight533 citations
- BRECQ: Pushing the Limit of Post-Training Quantization by Block ReconstructionPoster511 citations
- Revisiting Few-sample BERT Fine-tuningPoster498 citations
- Long-tailed Recognition by Routing Diverse Distribution-Aware ExpertsSpotlight489 citations
- ALFWorld: Aligning Text and Embodied Environments for Interactive LearningPoster466 citations
- Deep symbolic regression: Recovering mathematical expressions from data via risk-seeking policy gradientsOral454 citations
- Noise or Signal: The Role of Image Backgrounds in Object RecognitionPoster454 citations
- On the Stability of Fine-tuning BERT: Misconceptions, Explanations, and Strong BaselinesPoster453 citations
- Free Lunch for Few-shot Learning: Distribution CalibrationOral448 citations
- SSD: A Unified Framework for Self-Supervised Outlier DetectionPoster420 citations
- Uncertainty Sets for Image Classifiers using Conformal PredictionSpotlight414 citations
- How Neural Networks Extrapolate: From Feedforward to Graph Neural NetworksOral413 citations
- Personalized Federated Learning with First Order Model OptimizationPoster413 citations
- PseudoSeg: Designing Pseudo Labels for Semantic SegmentationPoster413 citations
- Simple Spectral Graph ConvolutionPoster411 citations
- Data-Efficient Reinforcement Learning with Self-Predictive RepresentationsSpotlight410 citations
- Unsupervised Representation Learning for Time Series with Temporal Neighborhood CodingPoster403 citations
- Random Feature AttentionSpotlight401 citations
- Recurrent Independent MechanismsSpotlight389 citations
- Very Deep VAEs Generalize Autoregressive Models and Can Outperform Them on ImagesSpotlight385 citations
- FedBE: Making Bayesian Model Ensemble Applicable to Federated LearningPoster383 citations
- Discrete Graph Structure Learning for Forecasting Multiple Time SeriesPoster381 citations
- Transformer protein language models are unsupervised structure learnersPoster380 citations
- Combining Label Propagation and Simple Models out-performs Graph Neural NetworksPoster373 citations
- Zero-Cost Proxies for Lightweight NASPoster372 citations
- Gradient Projection Memory for Continual LearningOral368 citations
- BERTology Meets Biology: Interpreting Attention in Protein Language ModelsPoster367 citations
- The Risks of Invariant Risk MinimizationPoster367 citations
- What Should Not Be Contrastive in Contrastive LearningPoster361 citations
- Large Scale Image Completion via Co-Modulated Generative Adversarial NetworksSpotlight354 citations
- Robust early-learning: Hindering the memorization of noisy labelsPoster354 citations
- Structured Prediction as Translation between Augmented Natural LanguagesSpotlight352 citations
- Rethinking Positional Encoding in Language Pre-trainingPoster348 citations
- Do Wide and Deep Networks Learn the Same Things? Uncovering How Neural Network Representations Vary with Width and DepthPoster342 citations
- Geometry-aware Instance-reweighted Adversarial TrainingOral339 citations
- How to Find Your Friendly Neighborhood: Graph Attention Design with Self-SupervisionPoster334 citations
- Exploring Balanced Feature Spaces for Representation LearningPoster331 citations
- Neural Architecture Search on ImageNet in Four GPU Hours: A Theoretically Inspired PerspectivePoster331 citations
- Achieving Linear Speedup with Partial Worker Participation in Non-IID Federated LearningPoster329 citations
- Nearest Neighbor Machine TranslationPoster329 citations
- Towards Faster and Stabilized GAN Training for High-fidelity Few-shot Image SynthesisPoster328 citations
- Inductive Representation Learning in Temporal Networks via Causal Anonymous WalksPoster327 citations
- Bag of Tricks for Adversarial TrainingPoster326 citations
- Randomized Ensembled Double Q-Learning: Learning Fast Without a ModelPoster323 citations
- Interpreting Graph Neural Networks for NLP With Differentiable Edge MaskingSpotlight319 citations
- How Does Mixup Help With Robustness and Generalization?Spotlight313 citations
- Gradient Descent on Neural Networks Typically Occurs at the Edge of StabilityPoster311 citations
- Differentially Private Learning Needs Better Features (or Much More Data)Spotlight310 citations
- The Intrinsic Dimension of Images and Its Impact on LearningSpotlight310 citations
- Few-Shot Learning via Learning the Representation, ProvablyPoster305 citations
- Support-set bottlenecks for video-text representation learningSpotlight302 citations
- Representation Learning via Invariant Causal MechanismsPoster301 citations
- Explainable Deep One-Class ClassificationPoster297 citations
- Learning N:M Fine-grained Structured Sparse Neural Networks From ScratchPoster296 citations
- Dataset Meta-Learning from Kernel Ridge-RegressionPoster294 citations
- Training with Quantization Noise for Extreme Model CompressionPoster292 citations
- Federated Semi-Supervised Learning with Inter-Client Consistency & Disjoint LearningPoster286 citations
- Layer-adaptive Sparsity for the Magnitude-based PruningPoster280 citations
- Theoretical Analysis of Self-Training with Deep Networks on Unlabeled DataOral278 citations
- Pruning Neural Networks at Initialization: Why Are We Missing the Mark?Poster275 citations
- Learning and Evaluating Representations for Deep One-Class ClassificationPoster271 citations
- Optimal Conversion of Conventional Artificial Neural Networks to Spiking Neural NetworksPoster271 citations
- Distilling Knowledge from Reader to Retriever for Question AnsweringPoster269 citations
- Witches' Brew: Industrial Scale Data Poisoning via Gradient MatchingPoster269 citations
- Robust and Generalizable Visual Representation Learning via Random ConvolutionsPoster267 citations
- Improve Object Detection with Feature-based Knowledge Distillation: Towards Accurate and Efficient DetectorsPoster262 citations
- Better Fine-Tuning by Reducing Representational CollapsePoster261 citations
- RODE: Learning Roles to Decompose Multi-Agent TasksPoster260 citations
- Learning with Instance-Dependent Label Noise: A Sample Sieve ApproachPoster255 citations
- Influence Functions in Deep Learning Are FragilePoster254 citations
- Training independent subnetworks for robust predictionPoster252 citations
- Accurate Learning of Graph Representations with Graph Multiset PoolingPoster251 citations
- DC3: A learning method for optimization with hard constraintsPoster251 citations
- Multi-Time Attention Networks for Irregularly Sampled Time SeriesPoster249 citations
- Perceptual Adversarial Robustness: Defense Against Unseen Threat ModelsPoster249 citations
- On the Origin of Implicit Regularization in Stochastic Gradient DescentPoster248 citations
- Fast and Complete: Enabling Complete Neural Network Verification with Rapid and Massively Parallel Incomplete VerifiersPoster247 citations
- SaliencyMix: A Saliency Guided Data Augmentation Strategy for Better RegularizationPoster246 citations
- AdaSpeech: Adaptive Text to Speech for Custom VoicePoster242 citations
- RNNLogic: Learning Logic Rules for Reasoning on Knowledge GraphsPoster241 citations
- End-to-end Adversarial Text-to-SpeechOral239 citations
- Analyzing the Expressive Power of Graph Neural Networks in a Spectral PerspectivePoster235 citations
- Self-supervised Learning from a Multi-view PerspectivePoster235 citations
- Uncertainty Estimation in Autoregressive Structured PredictionPoster235 citations
- Rethinking Architecture Selection in Differentiable NASOral233 citations
- SEED: Self-supervised Distillation For Visual RepresentationPoster233 citations
- Robust Overfitting may be mitigated by properly learned smootheningPoster232 citations
- Colorization TransformerPoster231 citations
- Multivariate Probabilistic Time Series Forecasting via Conditioned Normalizing FlowsSpotlight231 citations
- What Matters for On-Policy Deep Actor-Critic Methods? A Large-Scale StudyOral230 citations
- Explainable Subgraph Reasoning for Forecasting on Temporal Knowledge GraphsPoster229 citations
- FedMix: Approximation of Mixup under Mean Augmented Federated LearningPoster229 citations
- EVALUATION OF NEURAL ARCHITECTURES TRAINED WITH SQUARE LOSS VS CROSS-ENTROPY IN CLASSIFICATION TASKSPoster227 citations
- LambdaNetworks: Modeling long-range Interactions without AttentionSpotlight224 citations
- Contrastive Behavioral Similarity Embeddings for Generalization in Reinforcement LearningSpotlight222 citations
- Understanding the failure modes of out-of-distribution generalizationPoster220 citations
- Unlearnable Examples: Making Personal Data UnexploitableSpotlight220 citations
- BOIL: Towards Representation Change for Few-shot LearningPoster219 citations
- DARTS-: Robustly Stepping out of Performance Collapse Without IndicatorsPoster219 citations
- Degree-Quant: Quantization-Aware Training for Graph Neural NetworksPoster219 citations
- NBDT: Neural-Backed Decision TreePoster219 citations
- You Only Need Adversarial Supervision for Semantic Image SynthesisPoster219 citations
- Robust Reinforcement Learning on State Observations with Learned Optimal AdversaryPoster218 citations
- Co-Mixup: Saliency Guided Joint Mixup with Supermodular DiversityOral216 citations
- Gradient Vaccine: Investigating and Improving Multi-task Optimization in Massively Multilingual ModelsSpotlight215 citations
- Learning explanations that are hard to varyPoster214 citations
- Incorporating Symmetry into Deep Dynamics Models for Improved GeneralizationPoster212 citations
- Learning to Reach Goals via Iterated Supervised LearningOral212 citations
- A Good Image Generator Is What You Need for High-Resolution Video SynthesisSpotlight211 citations
- Anatomy of Catastrophic Forgetting: Hidden Representations and Task SemanticsPoster211 citations
- OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement LearningPoster209 citations
- Graph Information Bottleneck for Subgraph RecognitionPoster206 citations
- Open Question Answering over Tables and TextPoster206 citations
- BREEDS: Benchmarks for Subpopulation ShiftPoster205 citations
- Large Associative Memory Problem in Neurobiology and Machine LearningPoster205 citations
- AdamP: Slowing Down the Slowdown for Momentum Optimizers on Scale-invariant WeightsPoster204 citations
- Retrieval-Augmented Generation for Code Summarization via Hybrid GNNSpotlight204 citations
- Neural Pruning via Growing RegularizationPoster202 citations
- Rethinking Soft Labels for Knowledge Distillation: A Bias–Variance Tradeoff PerspectivePoster202 citations
- What Makes Instance Discrimination Good for Transfer Learning?Poster201 citations
- LEAF: A Learnable Frontend for Audio ClassificationPoster200 citations
- Augmenting Physical Models with Deep Networks for Complex Dynamics ForecastingOral199 citations
- Is Attention Better Than Matrix Decomposition?Poster199 citations
- Towards Impartial Multi-task LearningPoster198 citations
- What are the Statistical Limits of Offline RL with Linear Function Approximation?Spotlight198 citations
- Learning with Feature-Dependent Label Noise: A Progressive ApproachSpotlight195 citations
- Knowledge distillation via softmax regression representation learningPoster194 citations
- Self-Supervised Policy Adaptation during DeploymentSpotlight192 citations
- Implicit Gradient RegularizationPoster189 citations
- Flowtron: an Autoregressive Flow-based Generative Network for Text-to-Speech SynthesisPoster188 citations
- Deep Encoder, Shallow Decoder: Reevaluating Non-autoregressive Machine TranslationPoster187 citations
- Deep Neural Network Fingerprinting by Conferrable Adversarial ExamplesSpotlight186 citations
- Optimism in Reinforcement Learning with Generalized Linear Function ApproximationPoster186 citations
- Expressive Power of Invariant and Equivariant Graph Neural NetworksSpotlight185 citations
- Deployment-Efficient Reinforcement Learning via Model-Based Offline OptimizationPoster179 citations
- Fair Mixup: Fairness via InterpolationPoster179 citations
- FairBatch: Batch Selection for Model FairnessPoster179 citations
- Hyperbolic Neural Networks++Poster179 citations
- MARS: Markov Molecular Sampling for Multi-objective Drug DiscoverySpotlight179 citations
- Multiplicative Filter NetworksPoster179 citations
- Shapley explainability on the data manifoldPoster177 citations
- Learning Safe Multi-agent Control with Decentralized Neural Barrier CertificatesPoster175 citations
- Minimum Width for Universal ApproximationSpotlight171 citations
- Model-Based Offline PlanningPoster170 citations
- A Universal Representation Transformer Layer for Few-Shot Image ClassificationPoster169 citations
- Conservative Safety Critics for ExplorationPoster168 citations
- Learning with AMIGo: Adversarially Motivated Intrinsic GoalsPoster168 citations
- Parrot: Data-Driven Behavioral Priors for Reinforcement LearningOral168 citations
- R-GAP: Recursive Gradient Attack on PrivacyPoster168 citations
- Deep Partition Aggregation: Provable Defenses against General Poisoning AttacksPoster167 citations
- The Importance of Pessimism in Fixed-Dataset Policy OptimizationPoster167 citations
- Tilted Empirical Risk MinimizationPoster167 citations
- DrNAS: Dirichlet Neural Architecture SearchPoster166 citations
- SALD: Sign Agnostic Learning with DerivativesPoster165 citations
- LowKey: Leveraging Adversarial Attacks to Protect Social Media Users from Facial RecognitionPoster163 citations
- Complex Query Answering with Neural Link PredictorsOral162 citations
- Learning the Pareto Front with HypernetworksPoster162 citations
- MultiModalQA: complex question answering over text, tables and imagesPoster162 citations
- CausalWorld: A Robotic Manipulation Benchmark for Causal Structure and Transfer LearningPoster161 citations
- On Position Embeddings in BERTPoster161 citations
- A Diffusion Theory For Deep Learning Dynamics: Stochastic Gradient Descent Exponentially Favors Flat MinimaPoster159 citations
- Dance Revolution: Long-Term Dance Generation with Music via Curriculum LearningPoster159 citations
- Neural Thompson SamplingPoster159 citations
- DOP: Off-Policy Multi-Agent Decomposed Policy GradientsPoster158 citations
- Primal Wasserstein Imitation LearningPoster158 citations
- Self-training For Few-shot Transfer Across Extreme Task DifferencesOral157 citations
- Counterfactual Generative NetworksPoster156 citations
- HW-NAS-Bench: Hardware-Aware Neural Architecture Search BenchmarkSpotlight155 citations
- Linear Mode Connectivity in Multitask and Continual LearningPoster155 citations
- PSTNet: Point Spatio-Temporal Convolution on Point Cloud SequencesPoster155 citations
- Rethinking Embedding Coupling in Pre-trained Language ModelsPoster155 citations
- Towards Resolving the Implicit Bias of Gradient Descent for Matrix Factorization: Greedy Low-Rank LearningPoster155 citations
- Towards Nonlinear Disentanglement in Natural Data with Temporal Sparse CodingOral154 citations
- Watch-And-Help: A Challenge for Social Perception and Human-AI CollaborationSpotlight154 citations
- $i$-Mix: A Domain-Agnostic Strategy for Contrastive Representation LearningPoster153 citations
- Calibration of Neural Networks using SplinesPoster153 citations
- Learning Neural Generative Dynamics for Molecular Conformation GenerationPoster153 citations
- Training BatchNorm and Only BatchNorm: On the Expressive Power of Random Features in CNNsPoster153 citations
- How Much Over-parameterization Is Sufficient to Learn Deep ReLU Networks?Poster152 citations
- Language-Agnostic Representation Learning of Source Code from Structure and ContextPoster152 citations
- Optimal Regularization can Mitigate Double DescentPoster152 citations
- Characterizing signal propagation to close the performance gap in unnormalized ResNetsPoster151 citations
- Getting a CLUE: A Method for Explaining Uncertainty EstimatesOral151 citations
- Dataset Inference: Ownership Resolution in Machine LearningSpotlight150 citations
- Improving Adversarial Robustness via Channel-wise Activation SuppressingSpotlight149 citations
- Learning Neural Event Functions for Ordinary Differential EquationsPoster148 citations
- Model Patching: Closing the Subgroup Performance Gap with Data AugmentationPoster148 citations
- On Dyadic Fairness: Exploring and Mitigating Bias in Graph ConnectionsPoster148 citations
- When Do Curricula Work?Oral148 citations
- DeLighT: Deep and Light-weight TransformerPoster147 citations
- Federated Learning via Posterior Averaging: A New Perspective and Practical AlgorithmsPoster146 citations
- Generalized Energy Based ModelsPoster145 citations
- Image GANs meet Differentiable Rendering for Inverse Graphics and Interpretable 3D Neural RenderingOral145 citations
- Learning Energy-Based Models by Diffusion Recovery LikelihoodPoster145 citations
- Adversarial score matching and improved sampling for image generationPoster144 citations
- InfoBERT: Improving Robustness of Language Models from An Information Theoretic PerspectivePoster143 citations
- Linear Last-iterate Convergence in Constrained Saddle-point OptimizationPoster143 citations
- A Distributional Approach to Controlled Text GenerationOral142 citations
- Lipschitz Recurrent Neural NetworksPoster142 citations
- Shape-Texture Debiased Neural Network TrainingPoster142 citations
- Gauge Equivariant Mesh CNNs: Anisotropic convolutions on geometric graphsSpotlight141 citations
- Interpretable Neural Architecture Search via Bayesian Optimisation with Weisfeiler-Lehman KernelsPoster140 citations
- Clustering-friendly Representation Learning via Instance Discrimination and Feature DecorrelationPoster139 citations
- Contrastive Learning with Adversarial Perturbations for Conditional Text GenerationPoster138 citations
- Robust Curriculum Learning: from clean label detection to noisy label self-correctionPoster138 citations
- Orthogonalizing Convolutional Layers with the Cayley TransformSpotlight137 citations
- VAEBM: A Symbiosis between Variational Autoencoders and Energy-based ModelsSpotlight137 citations
- Directed Acyclic Graph Neural NetworksPoster136 citations
- PlasticineLab: A Soft-Body Manipulation Benchmark with Differentiable PhysicsSpotlight135 citations
- Do 2D GANs Know 3D Shape? Unsupervised 3D Shape Reconstruction from 2D Image GANsOral133 citations
- MELR: Meta-Learning via Modeling Episode-Level Relationships for Few-Shot LearningPoster133 citations
- Do not Let Privacy Overbill Utility: Gradient Embedding Perturbation for Private LearningPoster132 citations
- Implicit Under-Parameterization Inhibits Data-Efficient Deep Reinforcement LearningPoster132 citations
- Are Neural Rankers still Outperformed by Gradient Boosted Decision Trees?Spotlight131 citations
- Attentional Constellation Nets for Few-Shot LearningPoster131 citations
- Systematic generalisation with group invariant predictionsSpotlight131 citations
- FairFil: Contrastive Neural Debiasing Method for Pretrained Text EncodersPoster130 citations
- Wasserstein-2 Generative NetworksPoster130 citations
- Isotropy in the Contextual Embedding Space: Clusters and ManifoldsPoster129 citations
- Neural Spatio-Temporal Point ProcessesPoster129 citations
- Online Adversarial Purification based on Self-supervised LearningPoster129 citations
- Bypassing the Ambient Dimension: Private SGD with Gradient Subspace IdentificationPoster128 citations
- MoPro: Webly Supervised Learning with Momentum PrototypesPoster127 citations
- Towards Robustness Against Natural Language Word SubstitutionsSpotlight127 citations
- Signatory: differentiable computations of the signature and logsignature transforms, on both CPU and GPUPoster126 citations
- Communication in Multi-Agent Reinforcement Learning: Intention SharingPoster125 citations
- Uncertainty in Gradient Boosting via EnsemblesPoster124 citations
- Active Contrastive Learning of Audio-Visual Video RepresentationsPoster122 citations
- A PAC-Bayesian Approach to Generalization Bounds for Graph Neural NetworksPoster121 citations
- Learning to Set Waypoints for Audio-Visual NavigationPoster120 citations
- Net-DNF: Effective Deep Modeling of Tabular DataPoster119 citations
- Coupled Oscillatory Recurrent Neural Network (coRNN): An accurate and (gradient) stable architecture for learning long time dependenciesOral118 citations
- Deep Neural Tangent Kernel and Laplace Kernel Have the Same RKHSPoster118 citations
- Incremental few-shot learning via vector quantization in deep embedded spacePoster118 citations
- Learning from others' mistakes: Avoiding dataset biases without modeling themPoster118 citations
- Progressive Skeletonization: Trimming more fat from a network at initializationPoster118 citations
- The role of Disentanglement in GeneralisationPoster118 citations
- AdaGCN: Adaboosting Graph Convolutional Networks into Deep ModelsPoster117 citations
- Generalized Multimodal ELBOPoster115 citations
- Multi-Prize Lottery Ticket Hypothesis: Finding Accurate Binary Neural Networks by Pruning A Randomly Weighted NetworkPoster114 citations
- VTNet: Visual Transformer Network for Object Goal NavigationPoster114 citations
- Distributional Sliced-Wasserstein and Applications to Generative ModelingSpotlight113 citations
- Topology-Aware Segmentation Using Discrete Morse TheorySpotlight112 citations
- On Statistical Bias In Active Learning: How and When to Fix ItSpotlight111 citations
- Are Neural Nets Modular? Inspecting Functional Modularity Through Differentiable Weight MasksPoster110 citations
- Benchmarks for Deep Off-Policy EvaluationPoster109 citations
- IEPT: Instance-Level and Episode-Level Pretext Tasks for Few-Shot LearningPoster109 citations
- Meta-learning Symmetries by ReparameterizationPoster109 citations
- Beyond Fully-Connected Layers with Quaternions: Parameterization of Hypercomplex Multiplications with $1/n$ ParametersSpotlight108 citations
- Intrinsic-Extrinsic Convolution and Pooling for Learning on 3D Protein StructuresPoster108 citations
- Wasserstein Embedding for Graph LearningPoster108 citations
- Deep Equals Shallow for ReLU Networks in Kernel RegimesPoster107 citations
- Mind the Pad -- CNNs Can Develop Blind SpotsSpotlight107 citations
- A Unified Approach to Interpreting and Boosting Adversarial TransferabilityPoster106 citations
- Dynamic Tensor RematerializationSpotlight106 citations
- GraPPa: Grammar-Augmented Pre-Training for Table Semantic ParsingPoster106 citations
- Learning to Recombine and Resample Data For Compositional GeneralizationPoster106 citations
- MiCE: Mixture of Contrastive Experts for Unsupervised Image ClusteringPoster106 citations
- Convex Potential Flows: Universal Probability Distributions with Optimal Transport and Convex OptimizationPoster105 citations
- Off-Dynamics Reinforcement Learning: Training for Transfer with Domain ClassifiersPoster105 citations
- Efficient Continual Learning with Modular Networks and Task-Driven PriorsPoster104 citations
- Empirical or Invariant Risk Minimization? A Sample Complexity PerspectivePoster104 citations
- Grounding Physical Concepts of Objects and Events Through Dynamic Visual ReasoningPoster104 citations
- On the Universality of Rotation Equivariant Point Cloud NetworksPoster104 citations
- Transient Non-stationarity and Generalisation in Deep Reinforcement LearningPoster104 citations
- Adversarially Guided Actor-CriticPoster103 citations
- Concept Learners for Few-Shot LearningPoster103 citations
- Graph Coarsening with Neural NetworksPoster103 citations
- Behavioral Cloning from Noisy DemonstrationsSpotlight102 citations
- CcGAN: Continuous Conditional Generative Adversarial Networks for Image GenerationPoster102 citations
- Negative Data AugmentationPoster102 citations
- Is Label Smoothing Truly Incompatible with Knowledge Distillation: An Empirical StudyPoster101 citations
- Revisiting Locally Supervised Learning: an Alternative to End-to-end TrainingPoster101 citations
- CoCon: A Self-Supervised Approach for Controlled Text GenerationPoster100 citations
- Understanding and Improving Lexical Choice in Non-Autoregressive TranslationPoster100 citations
- Conditional Negative Sampling for Contrastive Learning of Visual RepresentationsPoster99 citations
- Evolving Reinforcement Learning AlgorithmsOral99 citations
- Learning Incompressible Fluid Dynamics from Scratch - Towards Fast, Differentiable Fluid Models that GeneralizeSpotlight99 citations
- Text Generation by Learning from DemonstrationsPoster99 citations
- Adversarially-Trained Deep Nets Transfer Better: Illustration on Image ClassificationPoster98 citations
- CoDA: Contrast-enhanced and Diversity-promoting Data Augmentation for Natural Language UnderstandingPoster98 citations
- RMSprop converges with proper hyper-parameterSpotlight98 citations
- Semantic Re-tuning with Contrastive TensionPoster98 citations
- A unifying view on implicit bias in training linear neural networksPoster97 citations
- Conditionally Adaptive Multi-Task Learning: Improving Transfer Learning in NLP Using Fewer Parameters & Less DataPoster97 citations
- Interactive Weak Supervision: Learning Useful Heuristics for Data LabelingPoster97 citations
- Risk-Averse Offline Reinforcement LearningPoster97 citations
- The Recurrent Neural Tangent KernelPoster97 citations
- A Mathematical Exploration of Why Language Models Help Solve Downstream TasksPoster95 citations
- CPR: Classifier-Projection Regularization for Continual LearningPoster95 citations
- Learnable Embedding sizes for Recommender SystemsPoster95 citations
- My Body is a Cage: the Role of Morphology in Graph-Based Incompatible ControlPoster95 citations
- On the Transfer of Disentangled Representations in Realistic SettingsPoster95 citations
- On the role of planning in model-based deep reinforcement learningPoster95 citations
- Universal Weakly Supervised Segmentation by Pixel-to-Segment Contrastive LearningPoster95 citations
- Parameter Efficient Multimodal Transformers for Video Representation LearningPoster94 citations
- C-Learning: Learning to Achieve Goals via Recursive ClassificationPoster93 citations
- Creative Sketch GenerationPoster93 citations
- Hierarchical Reinforcement Learning by Discovering Intrinsic OptionsPoster93 citations
- Stochastic Security: Adversarial Defense Using Long-Run Dynamics of Energy-Based ModelsPoster93 citations
- Enjoy Your Editing: Controllable GANs for Image Editing via Latent Space NavigationPoster92 citations
- Heteroskedastic and Imbalanced Deep Learning with Adaptive RegularizationPoster92 citations
- Coping with Label Shift via Distributionally Robust OptimisationPoster91 citations
- Dual-mode ASR: Unify and Improve Streaming ASR with Full-context ModelingPoster91 citations
- Share or Not? Learning to Schedule Language-Specific Capacity for Multilingual TranslationOral91 citations
- Learning a Latent Search Space for Routing Problems using Variational AutoencodersPoster90 citations
- MixKD: Towards Efficient Distillation of Large-scale Language ModelsPoster90 citations
- Revisiting Dynamic Convolution via Matrix DecompositionPoster90 citations
- Byzantine-Resilient Non-Convex Stochastic Gradient DescentPoster89 citations
- Geometry-Aware Gradient Algorithms for Neural Architecture SearchSpotlight89 citations
- Learning perturbation sets for robust machine learningPoster89 citations
- Shape or Texture: Understanding Discriminative Features in CNNsPoster89 citations
- Few-Shot Bayesian Optimization with Deep Kernel SurrogatesPoster88 citations
- MONGOOSE: A Learnable LSH Framework for Efficient Neural Network TrainingOral88 citations
- not-MIWAE: Deep Generative Modelling with Missing not at Random DataPoster88 citations
- BSQ: Exploring Bit-Level Sparsity for Mixed-Precision Neural Network QuantizationPoster87 citations
- FOCAL: Efficient Fully-Offline Meta-Reinforcement Learning via Distance Metric Learning and Behavior RegularizationPoster87 citations
- Interpretable Models for Granger Causality Using Self-explaining Neural NetworksPoster87 citations
- On Learning Universal Representations Across LanguagesPoster87 citations
- On the geometry of generalization and memorization in deep neural networksPoster87 citations
- Boost then Convolve: Gradient Boosting Meets Graph Neural NetworksPoster86 citations
- Into the Wild with AudioScope: Unsupervised Audio-Visual Separation of On-Screen SoundsPoster86 citations
- Learning Accurate Entropy Model with Global Reference for Image CompressionPoster86 citations
- MODALS: Modality-agnostic Automated Data Augmentation in the Latent SpacePoster86 citations
- NAS-Bench-ASR: Reproducible Neural Architecture Search for Speech RecognitionPoster86 citations
- Neural Mechanics: Symmetry and Broken Conservation Laws in Deep Learning DynamicsPoster86 citations
- Scalable Bayesian Inverse Reinforcement LearningPoster86 citations
- Adaptive and Generative Zero-Shot LearningPoster85 citations
- Grounded Language Learning Fast and SlowSpotlight85 citations
- Learning continuous-time PDEs from sparse data with graph neural networksPoster85 citations
- Quantifying Differences in Reward FunctionsSpotlight85 citations
- Targeted Attack against Deep Neural Networks via Flipping Limited Weight BitsPoster85 citations
- The Deep Bootstrap Framework: Good Online Learners are Good Offline GeneralizersPoster85 citations
- Using latent space regression to analyze and leverage compositionality in GANsPoster85 citations
- Viewmaker Networks: Learning Views for Unsupervised Representation LearningPoster85 citations
- Enforcing robust control guarantees within neural network policiesPoster84 citations
- Explaining the Efficacy of Counterfactually Augmented DataPoster84 citations
- Neural ODE ProcessesPoster84 citations
- Learning Deep Features in Instrumental Variable RegressionPoster83 citations
- Long Live the Lottery: The Existence of Winning Tickets in Lifelong LearningPoster83 citations
- MetaNorm: Learning to Normalize Few-Shot Batches Across DomainsPoster83 citations
- Training GANs with Stronger Augmentations via Contrastive DiscriminatorPoster83 citations
- A Panda? No, It's a Sloth: Slowdown Attacks on Adaptive Multi-Exit Neural Network InferenceSpotlight82 citations
- Empirical Analysis of Unlabeled Entity Problem in Named Entity RecognitionPoster82 citations
- IsarStep: a Benchmark for High-level Mathematical ReasoningPoster82 citations
- Symmetry-Aware Actor-Critic for 3D Molecular DesignPoster82 citations
- Emergent Symbols through Binding in External MemorySpotlight81 citations
- Grounding Language to Autonomously-Acquired Skills via Goal GenerationPoster81 citations
- Neural Topic Model via Optimal TransportSpotlight81 citations
- PMI-Masking: Principled masking of correlated spansSpotlight81 citations
- Predicting Inductive Biases of Pre-Trained ModelsPoster81 citations
- CO2: Consistent Contrast for Unsupervised Visual Representation LearningPoster80 citations
- CaPC Learning: Confidential and Private Collaborative LearningPoster80 citations
- Generalized Variational Continual LearningPoster80 citations
- SCoRe: Pre-Training for Context Representation in Conversational Semantic ParsingPoster79 citations
- Combining Ensembles and Data Augmentation Can Harm Your CalibrationPoster78 citations
- Neural Approximate Sufficient Statistics for Implicit ModelsSpotlight78 citations
- AdaFuse: Adaptive Temporal Fusion Network for Efficient Action RecognitionPoster77 citations
- Bayesian Few-Shot Classification with One-vs-Each Pólya-Gamma Augmented Gaussian ProcessesPoster77 citations
- Cross-Attentional Audio-Visual Fusion for Weakly-Supervised Action LocalizationPoster77 citations
- VCNet and Functional Targeted Regularization For Learning Causal Effects of Continuous TreatmentsOral77 citations
- A statistical theory of cold posteriors in deep neural networksPoster76 citations
- CT-Net: Channel Tensorization Network for Video ClassificationPoster76 citations
- Neural Synthesis of Binaural Speech From Mono AudioOral76 citations
- Reinforcement Learning with Random DelaysPoster76 citations
- Improving Zero-Shot Voice Style Transfer via Disentangled Representation LearningPoster75 citations
- Pre-training Text-to-Text Transformers for Concept-centric Common SensePoster75 citations
- A Better Alternative to Error Feedback for Communication-Efficient Distributed LearningPoster74 citations
- EEC: Learning to Encode and Regenerate Images for Continual LearningPoster74 citations
- How Benign is Benign Overfitting ?Spotlight74 citations
- Prototypical Representation Learning for Relation ExtractionPoster74 citations
- Teaching Temporal Logics to Neural NetworksPoster74 citations
- Answering Complex Open-Domain Questions with Multi-Hop Dense RetrievalPoster73 citations
- High-Capacity Expert Binary NetworksPoster73 citations
- Learning Cross-Domain Correspondence for Control with Dynamics Cycle-ConsistencyOral73 citations
- SAFENet: A Secure, Accurate and Fast Neural Network InferencePoster73 citations
- CoCo: Controllable Counterfactuals for Evaluating Dialogue State TrackersPoster72 citations
- Contextual Transformation Networks for Online Continual LearningPoster71 citations
- DICE: Diversity in Deep Ensembles via Conditional Redundancy Adversarial EstimationPoster71 citations
- In-N-Out: Pre-Training and Self-Training using Auxiliary Information for Out-of-Distribution RobustnessPoster71 citations
- Scaling the Convex Barrier with Active SetsPoster71 citations
- SenSeI: Sensitive Set Invariance for Enforcing Individual FairnessOral70 citations
- Winning the L2RPN Challenge: Power Grid Management via Semi-Markov Afterstate Actor-CriticSpotlight70 citations
- Class Normalization for (Continual)? Generalized Zero-Shot LearningPoster69 citations
- Evaluations and Methods for Explanation through Robustness AnalysisPoster69 citations
- Growing Efficient Deep Networks by Structured Continuous SparsificationOral69 citations
- Model-Based Visual Planning with Self-Supervised Functional DistancesSpotlight69 citations
- A Gradient Flow Framework For Analyzing Network PruningSpotlight68 citations
- Auxiliary Learning by Implicit DifferentiationPoster68 citations
- BUSTLE: Bottom-Up Program Synthesis Through Learning-Guided ExplorationSpotlight68 citations
- Partitioned Learned Bloom FiltersPoster68 citations
- Distributed Momentum for Byzantine-resilient Stochastic Gradient DescentPoster67 citations
- Evaluation of Similarity-based ExplanationsPoster67 citations
- Group Equivariant Stand-Alone Self-Attention For VisionPoster67 citations
- Learning Long-term Visual Dynamics with Region Proposal Interaction NetworksPoster67 citations
- MALI: A memory efficient and reverse accurate integrator for Neural ODEsPoster67 citations
- Scalable Transfer Learning with Expert ModelsPoster67 citations
- GANs Can Play Lottery Tickets TooPoster66 citations
- On Graph Neural Networks versus Graph-Augmented MLPsPoster66 citations
- Variational Information Bottleneck for Effective Low-Resource Fine-TuningPoster66 citations
- A Trainable Optimal Transport Embedding for Feature Aggregation and its Relationship to AttentionPoster65 citations
- A Wigner-Eckart Theorem for Group Equivariant Convolution KernelsPoster65 citations
- Initialization and Regularization of Factorized Neural LayersPoster65 citations
- Remembering for the Right Reasons: Explanations Reduce Catastrophic ForgettingPoster65 citations
- Distance-Based Regularisation of Deep Networks for Fine-TuningPoster64 citations
- Generative Scene Graph NetworksPoster64 citations
- When Optimizing $f$-Divergence is Robust with Label NoisePoster64 citations
- Discovering Diverse Multi-Agent Strategic Behavior via Reward RandomizationPoster63 citations
- Fully Unsupervised Diversity Denoising with Convolutional Variational AutoencodersPoster63 citations
- MIROSTAT: A NEURAL TEXT DECODING ALGORITHM THAT DIRECTLY CONTROLS PERPLEXITYPoster63 citations
- Meta-GMVAE: Mixture of Gaussian VAE for Unsupervised Meta-LearningSpotlight63 citations
- Refining Deep Generative Models via Discriminator Gradient FlowPoster63 citations
- Generating Adversarial Computer Programs using Optimized ObfuscationsPoster62 citations
- Impact of Representation Learning in Linear BanditsPoster62 citations
- Offline Model-Based Optimization via Normalized Maximum Likelihood EstimationPoster62 citations
- On Fast Adversarial Robustness Adaptation in Model-Agnostic Meta-LearningPoster62 citations
- Selective Classification Can Magnify Disparities Across GroupsPoster62 citations
- Tradeoffs in Data Augmentation: An Empirical StudyPoster62 citations
- Why Are Convolutional Nets More Sample-Efficient than Fully-Connected Nets?Oral62 citations
- Linear Convergent Decentralized Optimization with CompressionPoster61 citations
- Probing BERT in Hyperbolic SpacesPoster61 citations
- Rank the Episodes: A Simple Approach for Exploration in Procedurally-Generated EnvironmentsPoster61 citations
- Representation Balancing Offline Model-based Reinforcement LearningPoster61 citations
- Robust Pruning at InitializationPoster61 citations
- Shapley Explanation NetworksPoster61 citations
- Auction Learning as a Two-Player GamePoster60 citations
- BiPointNet: Binary Neural Network for Point CloudsPoster60 citations
- Early Stopping in Deep Networks: Double Descent and How to Eliminate itPoster60 citations
- Efficient Conformal Prediction via Cascaded Inference with Expanded AdmissionPoster60 citations
- EigenGame: PCA as a Nash EquilibriumOral60 citations
- Human-Level Performance in No-Press Diplomacy via Equilibrium SearchOral60 citations
- Contrastive Syn-to-Real GeneralizationPoster59 citations
- INT: An Inequality Benchmark for Evaluating Generalization in Theorem ProvingPoster59 citations
- Mathematical Reasoning via Self-supervised Skip-tree TrainingSpotlight59 citations
- Optimal Rates for Averaged Stochastic Gradient Descent under Neural Tangent Kernel RegimeOral59 citations
- Trajectory Prediction using Equivariant Continuous ConvolutionPoster59 citations
- Adaptive Extra-Gradient Methods for Min-Max Optimization and GamesPoster58 citations
- Network Pruning That Matters: A Case Study on Retraining VariantsPoster58 citations
- Neural gradients are near-lognormal: improved quantized and sparse trainingPoster58 citations
- Return-Based Contrastive Representation Learning for Reinforcement LearningPoster58 citations
- Sample-Efficient Automated Deep Reinforcement LearningPoster58 citations
- Selectivity considered harmful: evaluating the causal impact of class selectivity in DNNsPoster58 citations
- Continuous Wasserstein-2 Barycenter Estimation without Minimax OptimizationPoster57 citations
- Learning Robust State Abstractions for Hidden-Parameter Block MDPsPoster57 citations
- Learning Subgoal Representations with Slow DynamicsPoster57 citations
- Rapid Neural Architecture Search by Learning to Generate Graphs from DatasetsPoster57 citations
- Understanding the role of importance weighting for deep learningSpotlight57 citations
- Vulnerability-Aware Poisoning Mechanism for Online RL with Unknown DynamicsPoster57 citations
- Estimating and Evaluating Regression Predictive Uncertainty in Deep Object DetectorsPoster56 citations
- Generalization in data-driven models of primary visual cortexSpotlight56 citations
- Rethinking the Role of Gradient-based Attribution Methods for Model InterpretabilityOral56 citations
- Zero-shot Synthesis with Group-Supervised LearningPoster56 citations
- Capturing Label Characteristics in VAEsPoster55 citations
- Fast And Slow Learning Of Recurrent Independent MechanismsPoster55 citations
- Interpreting and Boosting Dropout from a Game-Theoretic ViewPoster55 citations
- Undistillable: Making A Nasty Teacher That CANNOT teach studentsSpotlight55 citations
- A Block Minifloat Representation for Training Deep Neural NetworksPoster54 citations
- Bidirectional Variational Inference for Non-Autoregressive Text-to-SpeechPoster54 citations
- Clairvoyance: A Pipeline Toolkit for Medical Time SeriesPoster54 citations
- Generative Time-series Modeling with Fourier FlowsPoster54 citations
- IDF++: Analyzing and Improving Integer Discrete Flows for Lossless CompressionPoster54 citations
- Implicit Convex Regularizers of CNN Architectures: Convex Optimization of Two- and Three-Layer Networks in Polynomial TimeSpotlight54 citations
- Self-supervised Visual Reinforcement Learning with Object-centric RepresentationsSpotlight54 citations
- The inductive bias of ReLU networks on orthogonally separable dataPoster54 citations
- Are wider nets better given the same number of parameters?Poster53 citations
- Autoregressive Dynamics Models for Offline Policy Evaluation and OptimizationPoster53 citations
- Deep Networks and the Multiple Manifold ProblemPoster53 citations
- Multi-Level Local SGD: Distributed SGD for Heterogeneous Hierarchical NetworksPoster53 citations
- NeMo: Neural Mesh Models of Contrastive Features for Robust 3D Pose EstimationPoster53 citations
- Reset-Free Lifelong Learning with Skill-Space PlanningPoster53 citations
- Debiasing Concept-based Explanations with Causal AnalysisPoster52 citations
- Efficient Transformers in Reinforcement Learning using Actor-Learner DistillationPoster52 citations
- Hierarchical Autoregressive Modeling for Neural Video CompressionPoster52 citations
- Learning Associative Inference Using Fast Weight MemoryPoster52 citations
- On the Theory of Implicit Deep Learning: Global Convergence with Implicit LayersSpotlight52 citations
- Sharper Generalization Bounds for Learning with Gradient-dominated Objective FunctionsPoster52 citations
- Single-Timescale Actor-Critic Provably Finds Globally Optimal PolicyPoster52 citations
- Ask Your Humans: Using Human Instructions to Improve Generalization in Reinforcement LearningPoster51 citations
- Modelling Hierarchical Structure between Dialogue Policy and Natural Language Generator with Option Framework for Task-oriented Dialogue SystemPoster51 citations
- Uncertainty-aware Active Learning for Optimal Bayesian ClassifierPoster51 citations
- Learning Energy-Based Generative Models via Coarse-to-Fine Expanding and SamplingPoster50 citations
- When does preconditioning help or hurt generalization?Poster50 citations
- Why resampling outperforms reweighting for correcting sampling bias with stochastic gradientsPoster50 citations
- Graph-Based Continual LearningSpotlight49 citations
- HyperGrid Transformers: Towards A Single Model for Multiple TasksPoster49 citations
- Isometric Propagation Network for Generalized Zero-shot LearningPoster49 citations
- PC2WF: 3D Wireframe Reconstruction from Raw Point CloudsPoster49 citations
- SMiRL: Surprise Minimizing Reinforcement Learning in Unstable EnvironmentsOral49 citations
- Self-supervised Adversarial Robustness for the Low-label, High-data RegimePoster49 citations
- Continual learning in recurrent neural networksPoster48 citations
- Identifying nonlinear dynamical systems with multiple time scales and long-range dependenciesSpotlight48 citations
- Neural Jump Ordinary Differential Equations: Consistent Continuous-Time Prediction and FilteringPoster48 citations
- Noise against noise: stochastic label noise helps combat inherent label noiseSpotlight48 citations
- On Self-Supervised Image Representations for GAN EvaluationSpotlight48 citations
- CPT: Efficient Deep Neural Network Training via Cyclic PrecisionSpotlight47 citations
- Direction Matters: On the Implicit Bias of Stochastic Gradient Descent with Moderate Learning RatePoster47 citations
- Efficient Certified Defenses Against Patch Attacks on Image ClassifiersPoster47 citations
- Exemplary Natural Images Explain CNN Activations Better than State-of-the-Art Feature VisualizationPoster47 citations
- Learning to live with Dale's principle: ANNs with separate excitatory and inhibitory unitsPoster47 citations
- Multi-Class Uncertainty Calibration via Mutual Information Maximization-based BinningPoster47 citations
- On the Critical Role of Conventions in Adaptive Human-AI CollaborationPoster47 citations
- Overfitting for Fun and Profit: Instance-Adaptive Data CompressionPoster47 citations
- Planning from Pixels using Inverse Dynamics ModelsPoster47 citations
- Sliced Kernelized Stein DiscrepancyPoster47 citations
- Vector-output ReLU Neural Network Problems are Copositive Programs: Convex Analysis of Two Layer Networks and Polynomial-time AlgorithmsPoster47 citations
- Categorical Normalizing Flows via Continuous TransformationsPoster46 citations
- Generalization bounds via distillationSpotlight46 citations
- Neural Delay Differential EquationsPoster46 citations
- Efficient Generalized Spherical CNNsPoster45 citations
- Lifelong Learning of Compositional StructuresPoster45 citations
- Locally Free Weight Sharing for Network Width SearchSpotlight45 citations
- Relating by Contrasting: A Data-efficient Framework for Multimodal Generative ModelsPoster45 citations
- ResNet After All: Neural ODEs and Their Numerical SolutionPoster45 citations
- Contrastive Explanations for Reinforcement Learning via Embedded Self PredictionsOral44 citations
- Does enhanced shape bias improve neural network robustness to common corruptions?Poster44 citations
- Self-supervised Representation Learning with Relative Predictive CodingPoster44 citations
- Stabilized Medical Image AttacksSpotlight44 citations
- Unsupervised Meta-Learning through Latent-Space Interpolation in Generative ModelsPoster44 citations
- Acting in Delayed Environments with Non-Stationary Markov PoliciesPoster43 citations
- Blending MPC & Value Function Approximation for Efficient Reinforcement LearningPoster43 citations
- On the Curse of Memory in Recurrent Neural Networks: Approximation and Optimization AnalysisPoster43 citations
- PDE-Driven Spatiotemporal DisentanglementPoster43 citations
- Rao-Blackwellizing the Straight-Through Gumbel-Softmax Gradient EstimatorOral43 citations
- ChipNet: Budget-Aware Pruning with Heaviside Continuous ApproximationsPoster42 citations
- Effective Abstract Reasoning with Dual-Contrast NetworkPoster42 citations
- Entropic gradient descent algorithms and wide flat minimaPoster42 citations
- Fast Geometric Projections for Local Robustness CertificationSpotlight42 citations
- Nonseparable Symplectic Neural NetworksPoster42 citations
- Overparameterisation and worst-case generalisation: friend or foe?Poster42 citations
- Saliency is a Possible Red Herring When Diagnosing Poor GeneralizationPoster42 citations
- Understanding and Improving Encoder Layer Fusion in Sequence-to-Sequence LearningPoster42 citations
- DialoGraph: Incorporating Interpretable Strategy-Graph Networks into Negotiation DialoguesPoster41 citations
- Fantastic Four: Differentiable and Efficient Bounds on Singular Values of Convolution LayersPoster41 citations
- Isometric Transformation Invariant and Equivariant Graph Convolutional NetworksPoster41 citations
- Knowledge Distillation as Semiparametric InferencePoster41 citations
- Separation and Concentration in Deep NetworksPoster41 citations
- Wandering within a world: Online contextualized few-shot learningPoster41 citations
- A Critique of Self-Expressive Deep Subspace ClusteringPoster40 citations
- Can a Fruit Fly Learn Word Embeddings?Poster40 citations
- Learning Manifold Patch-Based Representations of Man-Made ShapesPoster40 citations
- Learning advanced mathematical computations from examplesPoster40 citations
- Loss Function Discovery for Object Detection via Convergence-Simulation Driven SearchPoster40 citations
- Multiscale Score Matching for Out-of-Distribution DetectionPoster40 citations
- Neural networks with late-phase weightsPoster40 citations
- Universal approximation power of deep residual neural networks via nonlinear control theoryPoster40 citations
- gradSim: Differentiable simulation for system identification and visuomotor controlPoster40 citations
- Disentangled Recurrent Wasserstein AutoencoderSpotlight39 citations
- Implicit Normalizing FlowsSpotlight39 citations
- Information Laundering for Model PrivacySpotlight39 citations
- Local Convergence Analysis of Gradient Descent Ascent with Finite Timescale SeparationPoster39 citations
- Private Post-GAN BoostingPoster39 citations
- Bayesian Context Aggregation for Neural ProcessesPoster38 citations
- For self-supervised learning, Rationality implies generalization, provablyPoster38 citations
- Learning "What-if" Explanations for Sequential Decision-MakingPoster38 citations
- Modeling the Second Player in Distributionally Robust OptimizationPoster38 citations
- Contextual Dropout: An Efficient Sample-Dependent Dropout ModulePoster37 citations
- Effective and Efficient Vote Attack on Capsule NetworksPoster37 citations
- Group Equivariant Generative Adversarial NetworksPoster37 citations
- Iterated learning for emergent systematicity in VQAOral37 citations
- Latent Convergent Cross MappingPoster37 citations
- Protecting DNNs from Theft using an Ensemble of Diverse ModelsPoster37 citations
- Proximal Gradient Descent-Ascent: Variable Convergence under KŁ GeometryPoster37 citations
- Understanding Over-parameterization in Generative Adversarial NetworksPoster37 citations
- CompOFA – Compound Once-For-All Networks for Faster Multi-Platform DeploymentPoster36 citations
- Differentiable Trust Region Layers for Deep Reinforcement LearningPoster36 citations
- Improving VAEs' Robustness to Adversarial AttackPoster36 citations
- MoVie: Revisiting Modulated Convolutions for Visual Counting and BeyondPoster36 citations
- On the Impossibility of Global Convergence in Multi-Loss OptimizationPoster36 citations
- PAC Confidence Predictions for Deep Neural Network ClassifiersPoster36 citations
- Taming GANs with Lookahead-MinmaxPoster36 citations
- What they do when in doubt: a study of inductive biases in seq2seq learnersPoster36 citations
- Adaptive Procedural Task Generation for Hard-Exploration ProblemsPoster35 citations
- Estimating Lipschitz constants of monotone deep equilibrium modelsPoster35 citations
- GAN2GAN: Generative Noise Learning for Blind Denoising with Single Noisy ImagesPoster35 citations
- Individually Fair RankingsPoster35 citations
- Learning A Minimax Optimizer: A Pilot StudyPoster35 citations
- Learning Structural Edits via Incremental Tree TransformationsPoster35 citations
- Multi-timescale Representation Learning in LSTM Language ModelsPoster35 citations
- Randomized Automatic DifferentiationOral35 citations
- Genetic Soft Updates for Policy Evolution in Deep Reinforcement LearningPoster34 citations
- Learning-based Support Estimation in Sublinear TimeSpotlight34 citations
- Rapid Task-Solving in Novel EnvironmentsPoster34 citations
- Towards Robust Neural Networks via Close-loop ControlPoster34 citations
- Unsupervised Discovery of 3D Physical Objects from VideoPoster34 citations
- Collective Robustness Certificates: Exploiting Interdependence in Graph Neural NetworksPoster33 citations
- Deep Repulsive Clustering of Ordered Data Based on Order-Identity DecompositionPoster33 citations
- ECONOMIC HYPERPARAMETER OPTIMIZATION WITH BLENDED SEARCH STRATEGYPoster33 citations
- Meta Back-TranslationPoster33 citations
- Property Controllable Variational Autoencoder via Invertible Mutual DependencePoster33 citations
- Semi-supervised Keypoint LocalizationPoster33 citations
- Auto Seg-Loss: Searching Metric Surrogates for Semantic SegmentationPoster32 citations
- Learning Parametrised Graph Shift OperatorsPoster32 citations
- Molecule Optimization by Explainable EvolutionPoster32 citations
- Mutual Information State Intrinsic ControlSpotlight32 citations
- Provably robust classification of adversarial examples with detectionPoster32 citations
- Revisiting Hierarchical Approach for Persistent Long-Term Video PredictionPoster32 citations
- Unsupervised Object Keypoint Learning using Local Spatial PredictabilitySpotlight32 citations
- AutoLRS: Automatic Learning-Rate Schedule by Bayesian Optimization on the FlyPoster31 citations
- Convex Regularization behind Neural ReconstructionPoster31 citations
- Decentralized Attribution of Generative ModelsPoster31 citations
- Evaluating the Disentanglement of Deep Generative Models through Manifold TopologyPoster31 citations
- Global Convergence of Three-layer Neural Networks in the Mean Field RegimeOral31 citations
- Group Equivariant Conditional Neural ProcessesPoster31 citations
- Improving Relational Regularized Autoencoders with Spherical Sliced Fused Gromov WassersteinPoster31 citations
- Learning to Represent Action Values as a Hypergraph on the Action VerticesPoster31 citations
- On Data-Augmentation and Consistency-Based Semi-Supervised LearningPoster31 citations
- Sparse Quantized Spectral ClusteringSpotlight31 citations
- Teaching with CommentariesPoster31 citations
- AUXILIARY TASK UPDATE DECOMPOSITION: THE GOOD, THE BAD AND THE NEUTRALPoster30 citations
- Explaining by Imitating: Understanding Decisions by Interpretable Policy LearningPoster30 citations
- Large Batch Simulation for Deep Reinforcement LearningPoster30 citations
- Learning Generalizable Visual Representations via Interactive GameplayOral30 citations
- Learning to Generate 3D Shapes with Generative Cellular AutomataPoster30 citations
- Memory Optimization for Deep NetworksSpotlight30 citations
- Practical Massively Parallel Monte-Carlo Tree Search Applied to Molecular DesignPoster30 citations
- Spatio-Temporal Graph Scattering TransformPoster30 citations
- Calibration tests beyond classificationPoster29 citations
- DeepAveragers: Offline Reinforcement Learning By Solving Derived Non-Parametric MDPsSpotlight29 citations
- Discovering a set of policies for the worst case rewardSpotlight29 citations
- Learning Task-General Representations with Generative Neuro-Symbolic ModelingPoster29 citations
- Estimating informativeness of samples with Smooth Unique InformationPoster28 citations
- Removing Undesirable Feature Contributions Using Out-of-Distribution DataPoster28 citations
- Representing Partial Programs with Blended Abstract SemanticsPoster28 citations
- Task-Agnostic Morphology EvolutionPoster28 citations
- Efficient Wasserstein Natural Gradients for Reinforcement LearningPoster27 citations
- Generative Language-Grounded Policy in Vision-and-Language Navigation with Bayes' RulePoster27 citations
- HyperDynamics: Meta-Learning Object and Agent Dynamics with HypernetworksPoster27 citations
- Improving Transformation Invariance in Contrastive Representation LearningPoster27 citations
- LiftPool: Bidirectional ConvNet PoolingPoster27 citations
- Meta-Learning with Neural Tangent KernelsPoster27 citations
- More or Less: When and How to Build Convolutional Neural Network EnsemblesPoster27 citations
- No Cost Likelihood Manipulation at Test Time for Making Better Mistakes in Deep NetworksPoster27 citations
- Solving Compositional Reinforcement Learning Problems via Task ReductionPoster27 citations
- An Unsupervised Deep Learning Approach for Real-World Image DenoisingPoster26 citations
- Balancing Constraints and Rewards with Meta-Gradient D4PGPoster26 citations
- Conformation-Guided Molecular Representation with Hamiltonian Neural NetworksPoster26 citations
- CopulaGNN: Towards Integrating Representational and Correlational Roles of Graphs in Graph Neural NetworksPoster26 citations
- Exploring the Uncertainty Properties of Neural Networks’ Implicit Priors in the Infinite-Width LimitPoster26 citations
- Graph Traversal with Tensor Functionals: A Meta-Algorithm for Scalable LearningPoster26 citations
- Learning to Sample with Local and Global Contexts in Experience Replay BufferPoster26 citations
- Parameter-Based Value FunctionsPoster26 citations
- Statistical inference for individual fairnessPoster26 citations
- Drop-Bottleneck: Learning Discrete Compressed Representation for Noise-Robust ExplorationPoster25 citations
- Effective Distributed Learning with Random Features: Improved Bounds and AlgorithmsPoster25 citations
- Predicting Infectiousness for Proactive Contact TracingSpotlight25 citations
- Decoupling Global and Local Representations via Invertible Generative FlowsPoster24 citations
- Efficient Reinforcement Learning in Factored MDPs with Application to Constrained RLPoster24 citations
- Emergent Road Rules In Multi-Agent Driving EnvironmentsPoster24 citations
- Fuzzy Tiling Activations: A Simple Approach to Learning Sparse Representations OnlinePoster24 citations
- Iterative Empirical Game Solving via Single Policy Best ResponseSpotlight24 citations
- Learning Value Functions in Deep Policy Gradients using Residual VariancePoster24 citations
- New Bounds For Distributed Mean Estimation and Variance ReductionPoster24 citations
- Policy-Driven Attack: Learning to Query for Hard-label Black-box Adversarial ExamplesPoster24 citations
- Reweighting Augmented Samples by Minimizing the Maximal Expected LossPoster24 citations
- Anytime Sampling for Autoregressive Models via Ordered AutoencodingPoster23 citations
- Cut out the annotator, keep the cutout: better segmentation with weak supervisionPoster23 citations
- Improved Autoregressive Modeling with Distribution SmoothingOral23 citations
- Meta-Learning of Structured Task Distributions in Humans and MachinesPoster23 citations
- Probabilistic Numeric Convolutional Neural NetworksPoster23 citations
- Benefit of deep learning with non-convex noisy gradient descent: Provable excess risk bound and superiority to kernel methodsSpotlight22 citations
- Disentangling 3D Prototypical Networks for Few-Shot Concept LearningPoster22 citations
- Extreme Memorization via Scale of InitializationPoster22 citations
- Fooling a Complete Neural Network VerifierPoster22 citations
- Identifying Physical Law of Hamiltonian Systems via Meta-LearningPoster22 citations
- Interpreting Knowledge Graph Relation Representation from Word EmbeddingsPoster22 citations
- Lossless Compression of Structured Convolutional Models via LiftingPoster22 citations
- Meta-learning with negative learning ratesPoster22 citations
- Practical Real Time Recurrent Learning with a Sparse ApproximationSpotlight22 citations
- Diverse Video Generation using a Gaussian Process TriggerPoster21 citations
- GAN "Steerability" without optimizationSpotlight21 citations
- Hopper: Multi-hop Transformer for Spatiotemporal ReasoningPoster21 citations
- Learning Better Structured Representations Using Low-rank Adaptive Label SmoothingPoster21 citations
- Learning Task Decomposition with Ordered Memory Policy NetworkPoster21 citations
- A Learning Theoretic Perspective on Local ExplainabilityPoster20 citations
- Batch Reinforcement Learning Through Continuation MethodPoster20 citations
- Combining Physics and Machine Learning for Network Flow EstimationPoster20 citations
- Global optimality of softmax policy gradient with single hidden layer neural networks in the mean-field regimePoster20 citations
- Graph Convolution with Low-rank Learnable Local FiltersSpotlight20 citations
- Graph Edit NetworksPoster20 citations
- Large-width functional asymptotics for deep Gaussian neural networksPoster20 citations
- Mind the Gap when Conditioning Amortised Inference in Sequential Latent-Variable ModelsPoster20 citations
- Representation Learning for Sequence Data with Deep Autoencoding Predictive ComponentsPoster20 citations
- SEDONA: Search for Decoupled Neural Networks toward Greedy Block-wise LearningPoster20 citations
- Self-Supervised Learning of Compressed Video RepresentationsPoster20 citations
- Seq2Tens: An Efficient Representation of Sequences by Low-Rank Tensor ProjectionsPoster20 citations
- VA-RED$^2$: Video Adaptive Redundancy ReductionPoster20 citations
- Activation-level uncertainty in deep neural networksPoster19 citations
- Domain-Robust Visual Imitation Learning with Mutual Information ConstraintsPoster19 citations
- Greedy-GQ with Variance Reduction: Finite-time Analysis and Improved ComplexityPoster19 citations
- Individually Fair Gradient BoostingSpotlight19 citations
- Latent Skill Planning for Exploration and TransferPoster19 citations
- Learning to Deceive Knowledge Graph Augmented Models via Targeted PerturbationPoster19 citations
- Physics-aware, probabilistic model order reduction with guaranteed stabilityPoster19 citations
- Scalable Learning and MAP Inference for Nonsymmetric Determinantal Point ProcessesOral19 citations
- WrapNet: Neural Net Inference with Ultra-Low-Precision ArithmeticPoster19 citations
- A Hypergradient Approach to Robust Regression without CorrespondencePoster18 citations
- Async-RED: A Provably Convergent Asynchronous Block Parallel Stochastic Method using Deep Denoising PriorsSpotlight18 citations
- Control-Aware Representations for Model-based Reinforcement LearningPoster18 citations
- On the Universality of the Double Descent Peak in Ridgeless RegressionPoster18 citations
- On the mapping between Hopfield networks and Restricted Boltzmann MachinesOral18 citations
- One Network Fits All? Modular versus Monolithic Task Formulations in Neural NetworksPoster18 citations
- Taking Notes on the Fly Helps Language Pre-TrainingPoster18 citations
- The Unreasonable Effectiveness of Patches in Deep Convolutional Kernels MethodsPoster18 citations
- Certify or Predict: Boosting Certified Robustness with Compositional ArchitecturesPoster17 citations
- Chaos of Learning Beyond Zero-sum and Coordination via Game DecompositionsPoster17 citations
- Computational Separation Between Convolutional and Fully-Connected NetworksPoster17 citations
- Deconstructing the Regularization of BatchNormPoster17 citations
- Gradient Origin NetworksPoster17 citations
- Learning Reasoning Paths over Semantic Graphs for Video-grounded DialoguesPoster17 citations
- Neurally Augmented ALISTAPoster17 citations
- The Role of Momentum Parameters in the Optimal Convergence of Adaptive Polyak's Heavy-ball MethodsPoster17 citations
- DynaTune: Dynamic Tensor Program Optimization in Deep Neural Network CompilationPoster16 citations
- Efficient Inference of Flexible Interaction in Spiking-neuron NetworksPoster16 citations
- Factorizing Declarative and Procedural Knowledge in Structured, Dynamical EnvironmentsPoster16 citations
- Influence Estimation for Generative Adversarial NetworksSpotlight16 citations
- Non-asymptotic Confidence Intervals of Off-policy Evaluation: Primal and Dual BoundsPoster16 citations
- Representation learning for improved interpretability and classification accuracy of clinical factors from EEGPoster16 citations
- Variational Intrinsic Control RevisitedPoster16 citations
- Go with the flow: Adaptive control for Neural ODEsPoster15 citations
- Model-based micro-data reinforcement learning: what are the crucial model properties and which model to choose?Poster15 citations
- Reducing the Computational Cost of Deep Generative Models with Binary Neural NetworksPoster15 citations
- Regularized Inverse Reinforcement LearningSpotlight15 citations
- SOLAR: Sparse Orthogonal Learned and Random EmbeddingsPoster15 citations
- Set Prediction without Imposing Structure as Conditional Density EstimationPoster15 citations
- The Traveling Observer Model: Multi-task Learning Through Spatial Variable EmbeddingsSpotlight15 citations
- Theoretical bounds on estimation error for meta-learningPoster15 citations
- Correcting experience replay for multi-agent communicationSpotlight14 citations
- Learning to Make Decisions via Submodular RegularizationPoster14 citations
- Monte-Carlo Planning and Learning with Language Action Value EstimatesPoster14 citations
- No MCMC for me: Amortized sampling for fast and stable training of energy-based modelsPoster14 citations
- On InstaHide, Phase Retrieval, and Sparse Matrix FactorizationPoster14 citations
- Optimizing Memory Placement using Evolutionary Graph Reinforcement LearningPoster14 citations
- The geometry of integration in text classification RNNsPoster14 citations
- TropEx: An Algorithm for Extracting Linear Terms in Deep Neural NetworksPoster14 citations
- Unsupervised Audiovisual Synthesis via Exemplar AutoencodersPoster14 citations
- ANOCE: Analysis of Causal Effects with Multiple Mediators via Constrained Structural LearningPoster13 citations
- Anchor & Transform: Learning Sparse Embeddings for Large VocabulariesPoster13 citations
- Extracting Strong Policies for Robotics Tasks from Zero-Order Trajectory OptimizersPoster13 citations
- Generating Furry Cars: Disentangling Object Shape and Appearance across Multiple DomainsPoster13 citations
- Learning Hyperbolic Representations of Topological FeaturesPoster13 citations
- Usable Information and Evolution of Optimal Representations During TrainingPoster13 citations
- Discovering Non-monotonic Autoregressive Orderings with Variational InferencePoster12 citations
- Learning from Demonstration with Weakly Supervised DisentanglementPoster12 citations
- Neural Networks for Learning Counterfactual G-Invariances from Single EnvironmentsPoster12 citations
- Repurposing Pretrained Models for Robust Out-of-domain Few-Shot LearningPoster12 citations
- Ringing ReLUs: Harmonic Distortion Analysis of Nonlinear Feedforward NetworksPoster12 citations
- Bowtie Networks: Generative Modeling for Joint Few-Shot Recognition and Novel-View SynthesisPoster11 citations
- Contrastive Divergence Learning is a Time Reversal Adversarial GameSpotlight11 citations
- Deciphering and Optimizing Multi-Task Learning: a Random Matrix ApproachSpotlight11 citations
- Deep Learning meets Projective ClusteringPoster11 citations
- Efficient Empowerment Estimation for Unsupervised StabilizationPoster11 citations
- Filtered Inner Product Projection for Crosslingual Embedding AlignmentPoster11 citations
- Learning a Latent Simplex in Input Sparsity TimeSpotlight11 citations
- Variational State-Space Models for Localisation and Dense 3D Mapping in 6 DoFPoster11 citations
- A Discriminative Gaussian Mixture Model with SparsityPoster10 citations
- Accelerating Convergence of Replica Exchange Stochastic Gradient MCMC via Variance ReductionPoster10 citations
- Average-case Acceleration for Bilinear Games and Normal MatricesPoster10 citations
- Conditional Generative Modeling via Learning the Latent SpacePoster10 citations
- DINO: A Conditional Energy-Based GAN for Domain TranslationPoster10 citations
- PolarNet: Learning to Optimize Polar Keypoints for Keypoint Based Object DetectionPoster10 citations
- Sequential Density Ratio Estimation for Simultaneous Optimization of Speed and AccuracySpotlight10 citations
- Spatial Dependency Networks: Neural Layers for Improved Generative Image ModelingPoster10 citations
- Uncertainty Estimation and Calibration with Finite-State Probabilistic RNNsPoster10 citations
- X2T: Training an X-to-Text Typing Interface with Online Learning from User FeedbackPoster10 citations
- DDPNOpt: Differential Dynamic Programming Neural OptimizerSpotlight9 citations
- Intraclass clustering: an implicit learning ability that regularizes DNNsPoster9 citations
- Plan-Based Relaxed Reward Shaping for Goal-Directed TasksPoster9 citations
- Provable Rich Observation Reinforcement Learning with Combinatorial Latent StatesPoster9 citations
- Understanding the effects of data parallelism and sparsity on neural network trainingPoster9 citations
- Contemplating Real-World Object ClassificationPoster8 citations
- End-to-End Egospheric Spatial MemoryPoster8 citations
- Local Search Algorithms for Rank-Constrained Convex OptimizationPoster8 citations
- Simple Augmentation Goes a Long Way: ADRL for DNN QuantizationPoster8 citations
- HalentNet: Multimodal Trajectory Forecasting with Hallucinative IntentsPoster7 citations
- Improved Estimation of Concentration Under $\ell_p$-Norm Distance Metrics Using Half SpacesPoster7 citations
- Learning What To Do by Simulating the PastPoster7 citations
- Neural Learning of One-of-Many Solutions for Combinatorial Problems in Structured Output SpacesPoster7 citations
- On the Dynamics of Training Attention ModelsPoster7 citations
- UMEC: Unified model and embedding compression for efficient recommendation systemsPoster7 citations
- A Temporal Kernel Approach for Deep Learning with Continuous-time InformationPoster6 citations
- Fast convergence of stochastic subgradient method under interpolationPoster6 citations
- IOT: Instance-wise Layer Reordering for Transformer StructuresPoster6 citations
- NOVAS: Non-convex Optimization via Adaptive Stochastic Search for End-to-end Learning and ControlPoster6 citations
- Prediction and generalisation over directed actions by grid cellsPoster6 citations
- A teacher-student framework to distill future trajectoriesPoster5 citations
- Faster Binary Embeddings for Preserving Euclidean DistancesPoster5 citations
- Integrating Categorical Semantics into Unsupervised Domain TranslationPoster5 citations
- Monotonic Kronecker-Factored LatticePoster5 citations
- Predicting Classification Accuracy When Adding New Unobserved ClassesPoster5 citations
- Private Image Reconstruction from System Side Channels Using Generative ModelsPoster5 citations
- Projected Latent Markov Chain Monte Carlo: Conditional Sampling of Normalizing FlowsPoster5 citations
- Kanerva++: Extending the Kanerva Machine With Differentiable, Locally Block Allocated Latent MemoryPoster4 citations
- Mapping the Timescale Organization of Neural Language ModelsPoster4 citations
- Neural representation and generation for RNA secondary structuresPoster4 citations
- Scaling Symbolic Methods using Gradients for Neural Model ExplanationPoster4 citations
- Single-Photon Image ClassificationPoster4 citations
- Sparse encoding for more-interpretable feature-selecting representations in probabilistic matrix factorizationPoster4 citations
- Spatially Structured Recurrent ModulesPoster4 citations
- A Design Space Study for LISTA and BeyondPoster3 citations
- ARMOURED: Adversarially Robust MOdels using Unlabeled data by REgularizing DiversityPoster3 citations
- Beyond Categorical Label Representations for Image ClassificationPoster3 citations
- Multi-resolution modeling of a discrete stochastic process identifies causes of cancerPoster3 citations
- SkipW: Resource Adaptable RNN with Strict Upper Computational LimitPoster3 citations
- C-Learning: Horizon-Aware Cumulative Accessibility EstimationPoster2 citations
- Differentiable Segmentation of SequencesPoster2 citations
- Disambiguating Symbolic Expressions in Informal DocumentsPoster2 citations
- Heating up decision boundaries: isocapacitory saturation, adversarial scenarios and generalization boundsPoster2 citations
- Robust Learning of Fixed-Structure Bayesian Networks in Nearly-Linear TimePoster2 citations
- Tomographic Auto-Encoder: Unsupervised Bayesian Recovery of Corrupted DataPoster2 citations
- What Can You Learn From Your Muscles? Learning Visual Representation from Human InteractionsPoster2 citations
- Adapting to Reward Progressivity via Spectral Reinforcement LearningPoster1 citations
- A Geometric Analysis of Deep Generative Image Models and Its ApplicationsPoster
- Fidelity-based Deep Adiabatic SchedulingSpotlight
- Mixed-Features Vectors and Subspace SplittingPoster
- Regularization Matters in Policy Optimization - An Empirical Study on Continuous ControlSpotlight
- Temporally-Extended ε-Greedy ExplorationPoster
- Trusted Multi-View ClassificationPoster
- UPDeT: Universal Multi-agent RL via Policy Decoupling with TransformersSpotlight
ICLR accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.