ICLR 2020 Accepted Papers
The full list of 687 papers accepted at ICLR 2020 (International Conference on Learning Representations). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Poster: 531Spotlight: 108Talk: 48
- ALBERT: A Lite BERT for Self-supervised Learning of Language RepresentationsSpotlight8,832 citations
- BERTScore: Evaluating Text Generation with BERTPoster6,747 citations
- ELECTRA: Pre-training Text Encoders as Discriminators Rather Than GeneratorsPoster4,882 citations
- The Curious Case of Neural Text DegenerationPoster3,518 citations
- Reformer: The Efficient TransformerTalk3,397 citations
- On the Convergence of FedAvg on Non-IID DataTalk3,022 citations
- On the Variance of the Adaptive Learning Rate and BeyondPoster2,552 citations
- VL-BERT: Pre-training of Generic Visual-Linguistic RepresentationsPoster2,015 citations
- Strategies for Pre-training Graph Neural NetworksSpotlight1,823 citations
- DropEdge: Towards Deep Graph Convolutional Networks on Node ClassificationPoster1,783 citations
- N-BEATS: Neural basis expansion analysis for interpretable time series forecastingPoster1,691 citations
- Dream to Control: Learning Behaviors by Latent ImaginationSpotlight1,635 citations
- Once-for-All: Train One Network and Specialize it for Efficient DeploymentPoster1,607 citations
- AugMix: A Simple Data Processing Method to Improve Robustness and UncertaintyPoster1,605 citations
- Decoupling Representation and Classifier for Long-Tailed RecognitionPoster1,599 citations
- Fast is better than free: Revisiting adversarial trainingPoster1,505 citations
- Federated Learning with Matched AveragingTalk1,489 citations
- Geom-GCN: Geometric Graph Convolutional NetworksSpotlight1,460 citations
- Contrastive Representation DistillationPoster1,458 citations
- GraphSAINT: Graph Sampling Based Inductive Learning MethodPoster1,395 citations
- DivideMix: Learning with Noisy Labels as Semi-supervised LearningPoster1,342 citations
- Composition-based Multi-Relational Graph Convolutional NetworksPoster1,247 citations
- Deep Double Descent: Where Bigger Models and More Data HurtPoster1,228 citations
- InfoGraph: Unsupervised and Semi-supervised Graph-Level Representation Learning via Mutual Information MaximizationSpotlight1,221 citations
- Large Batch Optimization for Deep Learning: Training BERT in 76 minutesPoster1,205 citations
- Model Based Reinforcement Learning for AtariSpotlight1,127 citations
- Fair Resource Allocation in Federated LearningPoster1,079 citations
- Plug and Play Language Models: A Simple Approach to Controlled Text GenerationPoster1,069 citations
- LEARNED STEP SIZE QUANTIZATIONPoster1,015 citations
- Emergent Tool Use From Multi-Agent AutocurriculaSpotlight961 citations
- Deep Batch Active Learning by Diverse, Uncertain Gradient Lower BoundsTalk957 citations
- Self-labelling via simultaneous clustering and representation learningSpotlight953 citations
- Generalization through Memorization: Nearest Neighbor Language ModelsPoster952 citations
- NAS-Bench-201: Extending the Scope of Reproducible Neural Architecture SearchSpotlight944 citations
- Improving Adversarial Robustness Requires Revisiting Misclassified ExamplesPoster925 citations
- PC-DARTS: Partial Channel Connections for Memory-Efficient Architecture SearchSpotlight920 citations
- DBA: Distributed Backdoor Attacks against Federated LearningPoster907 citations
- Deep Semi-Supervised Anomaly DetectionPoster824 citations
- vq-wav2vec: Self-Supervised Learning of Discrete Speech RepresentationsPoster811 citations
- Rapid Learning or Feature Reuse? Towards Understanding the Effectiveness of MAMLPoster809 citations
- Mutual Mean-Teaching: Pseudo Label Refinery for Unsupervised Domain Adaptation on Person Re-identificationPoster802 citations
- Inductive representation learning on temporal graphsPoster800 citations
- Meta-Dataset: A Dataset of Datasets for Learning to Learn from Few ExamplesPoster788 citations
- Picking Winning Tickets Before Training by Preserving Gradient FlowPoster775 citations
- On the Relationship between Self-Attention and Convolutional LayersPoster767 citations
- U-GAT-IT: Unsupervised Generative Attentional Networks with Adaptive Layer-Instance Normalization for Image-to-Image TranslationPoster764 citations
- A Baseline for Few-Shot Image ClassificationPoster757 citations
- Fantastic Generalization Measures and Where to Find ThemPoster757 citations
- Nesterov Accelerated Gradient and Scale Invariance for Adversarial AttacksPoster734 citations
- Reducing Transformer Depth on Demand with Structured DropoutPoster708 citations
- PairNorm: Tackling Oversmoothing in GNNsPoster685 citations
- Your classifier is secretly an energy based model and you should treat it like oneTalk674 citations
- Learning The Difference That Makes A Difference With Counterfactually-Augmented DataSpotlight661 citations
- Compressive Transformers for Long-Range Sequence ModellingPoster654 citations
- Learning To Explore Using Active Neural SLAMPoster649 citations
- On Mutual Information Maximization for Representation LearningPoster634 citations
- Neural Text Generation With Unlikelihood TrainingPoster622 citations
- Why Gradient Clipping Accelerates Training: A Theoretical Justification for AdaptivityTalk609 citations
- Poly-encoders: Architectures and Pre-training Strategies for Fast and Accurate Multi-sentence ScoringPoster600 citations
- A Fair Comparison of Graph Neural Networks for Graph ClassificationPoster588 citations
- Deep Learning For Symbolic MathematicsSpotlight585 citations
- Directional Message Passing for Molecular GraphsSpotlight584 citations
- Graph Neural Networks Exponentially Lose Expressive Power for Node ClassificationSpotlight575 citations
- FreeLB: Enhanced Adversarial Training for Natural Language UnderstandingSpotlight567 citations
- DDSP: Differentiable Digital Signal ProcessingSpotlight562 citations
- CLEVRER: Collision Events for Video Representation and ReasoningSpotlight559 citations
- BatchEnsemble: an Alternative Approach to Efficient Ensemble and Lifelong LearningPoster550 citations
- GraphAF: a Flow-based Autoregressive Model for Molecular Graph GenerationPoster544 citations
- DD-PPO: Learning Near-Perfect PointGoal Navigators from 2.5 Billion FramesPoster542 citations
- Graph Convolutional Reinforcement LearningPoster528 citations
- Cross-Domain Few-Shot Classification via Learned Feature-Wise TransformationSpotlight524 citations
- Incorporating BERT into Neural Machine TranslationPoster522 citations
- Dynamics-Aware Unsupervised Discovery of SkillsTalk518 citations
- TabFact: A Large-scale Dataset for Table-based Fact VerificationPoster517 citations
- Don't Use Large Mini-batches, Use Local SGDPoster516 citations
- Pseudo-LiDAR++: Accurate Depth for 3D Object Detection in Autonomous DrivingPoster515 citations
- Classification-Based Anomaly Detection for General DataPoster493 citations
- DiffTaichi: Differentiable Programming for Physical SimulationPoster486 citations
- Continual learning with hypernetworksSpotlight481 citations
- Comparing Rewinding and Fine-tuning in Neural Network PruningTalk479 citations
- On the "steerability" of generative adversarial networksPoster474 citations
- Adversarial Policies: Attacking Deep Reinforcement LearningPoster472 citations
- Abductive Commonsense ReasoningPoster468 citations
- Understanding and Robustifying Differentiable Architecture SearchTalk464 citations
- How much Position Information Do Convolutional Neural Networks Encode?Spotlight462 citations
- A Meta-Transfer Objective for Learning to Disentangle Causal MechanismsPoster438 citations
- Evaluating The Search Phase of Neural Architecture SearchPoster437 citations
- Lite Transformer with Long-Short Range AttentionPoster437 citations
- Are Transformers universal approximators of sequence-to-sequence functions?Poster432 citations
- Skip Connections Matter: On the Transferability of Adversarial Examples Generated with ResNetsSpotlight423 citations
- Pitfalls of In-Domain Uncertainty Estimation and Ensembling in Deep LearningPoster412 citations
- Never Give Up: Learning Directed Exploration StrategiesPoster410 citations
- Measuring Compositional Generalization: A Comprehensive Method on Realistic DataPoster406 citations
- Neural Oblivious Decision Ensembles for Deep Learning on Tabular DataPoster402 citations
- SELF: Learning to Filter Noisy Labels with Self-EnsemblingPoster400 citations
- Cross-Lingual Ability of Multilingual BERT: An Empirical StudyPoster396 citations
- Towards Stable and Efficient Training of Verifiably Robust Neural NetworksPoster396 citations
- Enabling Deep Spiking Neural Networks with Hybrid Conversion and Spike Timing Dependent BackpropagationPoster393 citations
- Selection via Proxy: Efficient Data Selection for Deep LearningPoster391 citations
- Query2box: Reasoning over Knowledge Graphs in Vector Space Using Box EmbeddingsPoster388 citations
- Gradient Descent Maximizes the Margin of Homogeneous Neural NetworksTalk385 citations
- Additive Powers-of-Two Quantization: An Efficient Non-uniform Discretization for Neural NetworksPoster377 citations
- Federated Adversarial Domain AdaptationPoster373 citations
- From Variational to Deterministic AutoencodersPoster364 citations
- A Learning-based Iterative Method for Solving Vehicle Routing ProblemsPoster363 citations
- MMA Training: Direct Input Space Margin Maximization through Adversarial TrainingPoster358 citations
- Cyclical Stochastic Gradient MCMC for Bayesian Deep LearningTalk357 citations
- Pre-training Tasks for Embedding-based Large-scale RetrievalPoster355 citations
- Tensor Decompositions for Temporal Knowledge Base CompletionPoster355 citations
- What graph neural networks cannot learn: depth vs widthPoster351 citations
- Contrastive Learning of Structured World ModelsTalk348 citations
- Inductive Matrix Completion Based on Graph Neural NetworksSpotlight346 citations
- Consistency Regularization for Generative Adversarial NetworksPoster337 citations
- Symplectic ODE-Net: Learning Hamiltonian Dynamics with ControlPoster337 citations
- Keep Doing What Worked: Behavior Modelling Priors for Offline Reinforcement LearningPoster330 citations
- Learning to Retrieve Reasoning Paths over Wikipedia Graph for Question AnsweringPoster329 citations
- VariBAD: A Very Good Method for Bayes-Adaptive Deep RL via Meta-LearningPoster329 citations
- What Can Neural Networks Reason About?Spotlight325 citations
- Learning Robust Representations via Multi-View Information BottleneckPoster323 citations
- High Fidelity Speech Synthesis with Adversarial NetworksTalk321 citations
- GENESIS: Generative Scene Inference and Sampling with Object-Centric Latent RepresentationsPoster316 citations
- Causal Discovery with Reinforcement LearningTalk315 citations
- Input Complexity and Out-of-distribution Detection with Likelihood-based Generative ModelsPoster315 citations
- The Logical Expressiveness of Graph Neural NetworksSpotlight313 citations
- SQIL: Imitation Learning via Reinforcement Learning with Sparse RewardsPoster312 citations
- Drawing Early-Bird Tickets: Toward More Efficient Training of Deep NetworksSpotlight310 citations
- Projection-Based Constrained Policy OptimizationPoster307 citations
- Gradient-Based Neural DAG LearningPoster306 citations
- DeepV2D: Video to Depth with Differentiable Structure from MotionPoster305 citations
- Sign-OPT: A Query-Efficient Hard-label Adversarial AttackPoster305 citations
- Training binary neural networks with real-to-binary convolutionsPoster298 citations
- Neural Tangents: Fast and Easy Infinite Neural Networks in PythonSpotlight293 citations
- Ensemble Distribution DistillationPoster289 citations
- Symplectic Recurrent Neural NetworksSpotlight286 citations
- Global Relational Models of Source CodePoster285 citations
- Semantically-Guided Representation Learning for Self-Supervised Monocular DepthPoster285 citations
- Revisiting Self-Training for Neural Sequence GenerationPoster282 citations
- Neural Policy Gradient Methods: Global Optimality and Rates of ConvergencePoster281 citations
- A Neural Dirichlet Process Mixture Model for Task-Free Continual LearningPoster280 citations
- Decentralized Deep Learning with Arbitrary Communication CompressionPoster280 citations
- You CAN Teach an Old Dog New Tricks! On Training Knowledge Graph EmbeddingsPoster273 citations
- HOPPITY: LEARNING GRAPH TRANSFORMATIONS TO DETECT AND FIX BUGS IN PROGRAMSSpotlight272 citations
- SPACE: Unsupervised Object-Oriented Scene Representation via Spatial Attention and DecompositionPoster269 citations
- Meta-Learning with Warped Gradient DescentTalk266 citations
- Uncertainty-guided Continual Learning with Bayesian Neural NetworksPoster266 citations
- Language GANs Falling ShortPoster265 citations
- Hamiltonian Generative NetworksSpotlight264 citations
- ReClor: A Reading Comprehension Dataset Requiring Logical ReasoningPoster264 citations
- An Exponential Learning Rate Schedule for Deep LearningSpotlight263 citations
- Deep Graph Matching ConsensusPoster262 citations
- LAMOL: LAnguage MOdeling for Lifelong Language LearningPoster261 citations
- Scaling Autoregressive Video ModelsSpotlight261 citations
- Dynamic Model Pruning with FeedbackPoster260 citations
- Adversarial AutoAugmentPoster257 citations
- Is a Good Representation Sufficient for Sample Efficient Reinforcement Learning?Spotlight256 citations
- FasterSeg: Searching for Faster Real-time Semantic SegmentationPoster255 citations
- Hyper-SAGNN: a self-attention based graph neural network for hypergraphsPoster254 citations
- Automatically Discovering and Learning New Visual Categories with Ranking StatisticsPoster250 citations
- Bridging Mode Connectivity in Loss Landscapes and Adversarial RobustnessPoster249 citations
- Meta-Learning without MemorizationSpotlight249 citations
- Network Randomization: A Simple Technique for Generalization in Deep Reinforcement LearningPoster246 citations
- Understanding the Limitations of Variational Mutual Information EstimatorsPoster246 citations
- Understanding Knowledge Distillation in Non-autoregressive Machine TranslationPoster245 citations
- Intriguing Properties of Adversarial Training at ScalePoster244 citations
- Mixout: Effective Regularization to Finetune Large-scale Pretrained Language ModelsPoster242 citations
- RIDE: Rewarding Impact-Driven Exploration for Procedurally-Generated EnvironmentsPoster241 citations
- On Identifiability in TransformersPoster237 citations
- Restricting the Flow: Information Bottlenecks for AttributionTalk237 citations
- Learning to Control PDEs with Differentiable PhysicsSpotlight235 citations
- Thieves on Sesame Street! Model Extraction of BERT-based APIsPoster235 citations
- Few-shot Text Classification with Distributional SignaturesPoster233 citations
- Generative Models for Effective ML on Private, Decentralized DatasetsPoster232 citations
- Imitation Learning via Off-Policy Distribution MatchingPoster231 citations
- StructPool: Structured Graph Pooling via Conditional Random FieldsPoster230 citations
- Lagrangian Fluid Simulation with Continuous ConvolutionsPoster229 citations
- Prediction Poisoning: Towards Defenses Against DNN Model Stealing AttacksPoster228 citations
- Maxmin Q-learning: Controlling the Estimation Bias of Q-learningPoster227 citations
- A Constructive Prediction of the Generalization Error Across ScalesPoster223 citations
- Polylogarithmic width suffices for gradient descent to achieve arbitrarily small test error with shallow ReLU networksPoster223 citations
- Reinforcement Learning Based Graph-to-Sequence Model for Natural Question GenerationPoster221 citations
- The Ingredients of Real World Robotic Reinforcement LearningSpotlight220 citations
- Estimating counterfactual treatment outcomes over time through adversarially balanced representationsSpotlight218 citations
- NAS evaluation is frustratingly hardPoster218 citations
- Curriculum Loss: Robust Learning and Generalization against Label CorruptionPoster217 citations
- SlowMo: Improving Communication-Efficient Distributed SGD with Slow MomentumPoster217 citations
- Robust anomaly detection and backdoor attack detection via differential privacyPoster216 citations
- Behaviour Suite for Reinforcement LearningSpotlight215 citations
- Depth-Adaptive TransformerPoster215 citations
- Functional Regularisation for Continual Learning with Gaussian ProcessesPoster215 citations
- Rethinking Softmax Cross-Entropy Loss for Adversarial RobustnessPoster214 citations
- Iterative energy-based projection on a normal data manifold for anomaly localizationPoster213 citations
- GenDICE: Generalized Offline Estimation of Stationary ValuesTalk211 citations
- Implementation Matters in Deep RL: A Case Study on PPO and TRPOTalk211 citations
- Disentangling Factors of Variations Using Few LabelsPoster210 citations
- Adversarial Training and Provable Defenses: Bridging the GapTalk207 citations
- Intensity-Free Learning of Temporal Point ProcessesSpotlight206 citations
- CATER: A diagnostic dataset for Compositional Actions & TEmporal ReasoningTalk205 citations
- MACER: Attack-free and Scalable Robust Training via Maximizing Certified RadiusPoster205 citations
- Neural Execution of Graph AlgorithmsPoster205 citations
- Understanding and Improving Information Transfer in Multi-Task LearningPoster205 citations
- Fast Task Inference with Variational Intrinsic Successor FeaturesTalk203 citations
- Harnessing the Power of Infinitely Wide Deep Nets on Small-data TasksSpotlight202 citations
- NAS-Bench-1Shot1: Benchmarking and Dissecting One-shot Neural Architecture SearchPoster202 citations
- Scalable and Order-robust Continual Learning with Additive Parameter DecompositionPoster200 citations
- StructBERT: Incorporating Language Structures into Pre-training for Deep Language UnderstandingPoster200 citations
- Provable Filter Pruning for Efficient Neural NetworksPoster199 citations
- The Early Phase of Neural Network TrainingPoster199 citations
- A Signal Propagation Perspective for Pruning Neural Networks at InitializationSpotlight198 citations
- Certified Defenses for Adversarial PatchesPoster198 citations
- Learning Disentangled Representations for CounterFactual RegressionPoster197 citations
- Can gradient clipping mitigate label noise?Poster196 citations
- Convolutional Conditional Neural ProcessesTalk196 citations
- Multilingual Alignment of Contextual Word RepresentationsPoster196 citations
- Finite Depth and Width Corrections to the Neural Tangent KernelSpotlight194 citations
- Meta-Q-LearningTalk193 citations
- Quantum Algorithms for Deep Convolutional Neural NetworksPoster192 citations
- Exploring Model-based Planning with Policy NetworksPoster191 citations
- The Break-Even Point on Optimization Trajectories of Deep Neural NetworksSpotlight191 citations
- And the Bit Goes Down: Revisiting the Quantization of Neural NetworksSpotlight190 citations
- Overlearning Reveals Sensitive AttributesPoster189 citations
- Editable Neural NetworksPoster188 citations
- On Robustness of Neural Ordinary Differential EquationsSpotlight188 citations
- A Theory of Usable Information under Computational ConstraintsTalk186 citations
- Empirical Bayes Transductive Meta-Learning with Synthetic GradientsPoster186 citations
- Sequential Latent Knowledge Selection for Knowledge-Grounded DialogueSpotlight186 citations
- Mogrifier LSTMTalk185 citations
- Rethinking the Hyperparameters for Fine-tuningPoster184 citations
- Influence-Based Multi-Agent ExplorationSpotlight183 citations
- Scale-Equivariant Steerable NetworksPoster183 citations
- Towards neural networks that provably know when they don't knowPoster181 citations
- Learning Nearly Decomposable Value Functions Via Communication MinimizationPoster178 citations
- Unrestricted Adversarial Examples via Semantic ManipulationPoster178 citations
- A Function Space View of Bounded Norm Infinite Width ReLU Nets: The Multivariate CasePoster173 citations
- A critical analysis of self-supervision, or what we can learn from a single imagePoster171 citations
- Differentiation of Blackbox Combinatorial SolversSpotlight171 citations
- Observational Overfitting in Reinforcement LearningPoster171 citations
- Deep Imitative Models for Flexible Inference, Planning, and ControlPoster170 citations
- Multi-agent Reinforcement Learning for Networked System ControlPoster170 citations
- Augmenting Genetic Algorithms with Deep Neural Networks for Exploring the Chemical SpacePoster169 citations
- Neural Module Networks for Reasoning over TextPoster169 citations
- Weakly Supervised Disentanglement with GuaranteesPoster169 citations
- B-Spline CNNs on Lie groupsPoster167 citations
- Efficient Probabilistic Logic Reasoning with Graph Neural NetworksPoster167 citations
- Model-based reinforcement learning for biological sequence designPoster167 citations
- Hierarchical Foresight: Self-Supervised Learning of Long-Horizon Tasks via Visual Subgoal GenerationPoster166 citations
- SEED RL: Scalable and Efficient Deep-RL with Accelerated Central InferenceTalk166 citations
- Residual Energy-Based Models for Text GenerationPoster164 citations
- Differentially Private Meta-LearningPoster163 citations
- On the Equivalence between Positional Node Embeddings and Structural Graph RepresentationsPoster162 citations
- Diverse Trajectory Forecasting with Determinantal Point ProcessesPoster161 citations
- Improving Generalization in Meta Reinforcement Learning using Learned ObjectivesSpotlight159 citations
- Robust And Interpretable Blind Image Denoising Via Bias-Free Convolutional Neural NetworksPoster159 citations
- Sharing Knowledge in Multi-Task Deep Reinforcement LearningPoster159 citations
- Adversarially robust transfer learningPoster157 citations
- Monotonic Multihead AttentionPoster157 citations
- Playing the lottery with rewards and multiple languages: lottery tickets in RL and NLPPoster157 citations
- Provable Benefit of Orthogonal Initialization in Optimizing Deep Linear NetworksPoster157 citations
- Unpaired Point Cloud Completion on Real Scans using Adversarial TrainingPoster157 citations
- Lipschitz constant estimation of Neural Networks via sparse polynomial optimizationPoster156 citations
- GraphZoom: A Multi-level Spectral Approach for Accurate and Scalable Graph EmbeddingTalk155 citations
- A Probabilistic Formulation of Unsupervised Text Style TransferSpotlight154 citations
- Multiplicative Interactions and Where to Find ThemPoster154 citations
- Training individually fair ML models with sensitive subspace robustnessSpotlight154 citations
- Learning Compositional Koopman Operators for Model-Based ControlSpotlight152 citations
- Disentanglement by Nonlinear ICA with General Incompressible-flow Networks (GIN)Spotlight151 citations
- AtomNAS: Fine-Grained End-to-End Neural Architecture SearchPoster150 citations
- Black-Box Adversarial Attack with Transferable Model-based EmbeddingPoster150 citations
- Option Discovery using Deep Skill ChainingPoster150 citations
- Defending Against Physically Realizable Attacks on Image ClassificationSpotlight149 citations
- RNA Secondary Structure Prediction By Learning Unrolled AlgorithmsTalk149 citations
- ES-MAML: Simple Hessian-Free Meta LearningPoster148 citations
- Encoding word order in complex embeddingsSpotlight148 citations
- Beyond Linearization: On Quadratic and Higher-Order Approximation of Wide Neural NetworksPoster146 citations
- Dynamic Sparse Training: Find Efficient Sparse Network From Scratch With Trainable Masked LayersPoster146 citations
- Multi-Scale Representation Learning for Spatial Feature Distributions using Grid CellsSpotlight146 citations
- Learning to Balance: Bayesian Meta-Learning for Imbalanced and Out-of-distribution TasksTalk144 citations
- Reinforced active learning for image segmentationPoster143 citations
- Efficient and Information-Preserving Future Frame Prediction and BeyondPoster142 citations
- LambdaNet: Probabilistic Type Inference using Graph Neural NetworksPoster141 citations
- Neural Machine Translation with Universal Visual RepresentationSpotlight141 citations
- Robustness Verification for TransformersPoster141 citations
- DeepHoyer: Learning Sparser Neural Network with Differentiable Scale-Invariant Sparsity MeasuresPoster140 citations
- SCALOR: Generative World Models with Scalable Object RepresentationsPoster140 citations
- Enhancing Adversarial Defense by k-Winners-Take-AllSpotlight139 citations
- Evolutionary Population Curriculum for Scaling Multi-Agent Reinforcement LearningPoster139 citations
- Asymptotics of Wide Networks from Feynman DiagramsSpotlight137 citations
- Mixup Inference: Better Exploiting Mixup to Defend Adversarial AttacksPoster136 citations
- V-MPO: On-Policy Maximum a Posteriori Policy Optimization for Discrete and Continuous ControlPoster136 citations
- Robust Reinforcement Learning for Continuous Control with Model MisspecificationPoster135 citations
- Graph Constrained Reinforcement Learning for Natural Language Action SpacesPoster132 citations
- Pay Attention to Features, Transfer Learn Faster CNNsPoster132 citations
- Transformer-XH: Multi-Evidence Reasoning with eXtra Hop AttentionPoster132 citations
- Controlling generative models with continuous factors of variationsPoster131 citations
- Conditional Learning of Fair RepresentationsSpotlight129 citations
- Neural Symbolic Reader: Scalable Integration of Distributed and Symbolic Representations for Reading ComprehensionSpotlight129 citations
- Permutation Equivariant Models for Compositional Generalization in LanguagePoster129 citations
- Disagreement-Regularized Imitation LearningSpotlight128 citations
- Explanation by Progressive ExaggerationSpotlight128 citations
- Fooling Detection Alone is Not Enough: Adversarial Attack against Multiple Object TrackingPoster128 citations
- Towards Hierarchical Importance Attribution: Explaining Compositional Semantics for Neural Sequence ModelsSpotlight128 citations
- A Generalized Training Approach for Multiagent LearningTalk127 citations
- Lookahead: A Far-sighted Alternative of Magnitude-based PruningPoster127 citations
- Pretrained Encyclopedia: Weakly Supervised Knowledge-Pretrained Language ModelPoster127 citations
- Reconstructing continuous distributions of 3D protein structure from cryo-EM imagesSpotlight127 citations
- Generalization bounds for deep convolutional neural networksPoster125 citations
- Q-learning with UCB Exploration is Sample Efficient for Infinite-Horizon MDPPoster125 citations
- BackPACK: Packing more into BackpropTalk124 citations
- Exploratory Not Explanatory: Counterfactual Analysis of Saliency Maps for Deep Reinforcement LearningPoster124 citations
- Understanding Architectures Learnt by Cell-based Neural Architecture SearchPoster124 citations
- V4D: 4D Convolutional Neural Networks for Video-level Representation LearningPoster123 citations
- VideoFlow: A Conditional Flow-Based Model for Stochastic Video GenerationPoster123 citations
- On Solving Minimax Optimization Locally: A Follow-the-Ridge ApproachPoster122 citations
- AssembleNet: Searching for Multi-Stream Neural Connectivity in Video ArchitecturesPoster121 citations
- CM3: Cooperative Multi-goal Multi-stage Multi-agent Reinforcement LearningPoster120 citations
- Counterfactuals uncover the modular structure of deep generative modelsPoster120 citations
- You Only Train Once: Loss-Conditional Training of Deep NetworksPoster120 citations
- AutoQ: Automated Kernel-Wise Neural Network QuantizationPoster119 citations
- Automated Relational Meta-learningPoster119 citations
- Learning deep graph matching with channel-independent embedding and Hungarian attentionPoster118 citations
- Memory-Based Graph NetworksPoster118 citations
- Efficient Riemannian Optimization on the Stiefel Manifold via the Cayley TransformPoster117 citations
- Low-Resource Knowledge-Grounded Dialogue GenerationPoster117 citations
- DeepSphere: a graph-based spherical CNNSpotlight116 citations
- Are Pre-trained Language Models Aware of Phrases? Simple but Strong Baselines for Grammar InductionPoster115 citations
- Capsules with Inverted Dot-Product Attention RoutingPoster115 citations
- Compositional languages emerge in a neural iterated learning modelPoster115 citations
- Rényi Fair InferencePoster115 citations
- RaPP: Novelty Detection with Reconstruction along Projection PathwayPoster114 citations
- Stochastic AUC Maximization with Deep Neural NetworksPoster114 citations
- CoPhy: Counterfactual Learning of Physical DynamicsSpotlight113 citations
- Measuring the Reliability of Reinforcement Learning AlgorithmsSpotlight113 citations
- Sample Efficient Policy Gradient Methods with Recursive Variance ReductionPoster113 citations
- Environmental drivers of systematicity and generalization in a situated agentPoster112 citations
- Identity Crisis: Memorization and Generalization Under Extreme OverparameterizationPoster112 citations
- Learning Space Partitions for Nearest Neighbor SearchPoster112 citations
- Adaptive Structural Fingerprints for Graph Attention NetworksPoster111 citations
- Model-Augmented Actor-Critic: Backpropagating through PathsPoster110 citations
- Accelerating SGD with momentum for over-parameterized learningPoster109 citations
- Certified Robustness for Top-k Predictions against Adversarial Perturbations via Randomized SmoothingPoster108 citations
- Learning Hierarchical Discrete Linguistic Units from Visually-Grounded SpeechTalk108 citations
- Theory and Evaluation Metrics for Learning Disentangled RepresentationsPoster108 citations
- Detecting and Diagnosing Adversarial Images with Class-Conditional Capsule ReconstructionsPoster107 citations
- Making Efficient Use of Demonstrations to Solve Hard Exploration ProblemsPoster107 citations
- Robust Local Features for Improving the Generalization of Adversarial TrainingPoster106 citations
- Simplified Action Decoder for Deep Multi-Agent Reinforcement LearningSpotlight106 citations
- Sub-policy Adaptation for Hierarchical Reinforcement LearningPoster106 citations
- Distributed Bandit Learning: Near-Optimal Regret with Efficient CommunicationPoster105 citations
- Learn to Explain Efficiently via Neural Logic Inductive LearningPoster105 citations
- Towards Fast Adaptation of Neural Architectures with Meta LearningPoster104 citations
- Triple Wins: Boosting Accuracy, Robustness and Efficiency Together by Enabling Input-Adaptive InferencePoster104 citations
- Differentiable Reasoning over a Virtual Knowledge BaseTalk103 citations
- State Alignment-based Imitation LearningPoster102 citations
- Chameleon: Adaptive Code Optimization for Expedited Deep Neural Network CompilationPoster101 citations
- Continual Learning with Bayesian Neural Networks for Non-Stationary DataPoster101 citations
- Dynamical Distance Learning for Semi-Supervised and Unsupervised Skill DiscoveryPoster100 citations
- Meta-Learning Acquisition Functions for Transfer Learning in Bayesian OptimizationSpotlight100 citations
- Padé Activation Units: End-to-end Learning of Flexible Activation Functions in Deep NetworksPoster100 citations
- Transferable Perturbations of Deep Feature DistributionsPoster100 citations
- Explain Your Move: Understanding Agent Actions Using Specific and Relevant Feature AttributionPoster99 citations
- Query-efficient Meta Attack to Deep Neural NetworksPoster99 citations
- A Closer Look at Deep Policy GradientsTalk98 citations
- BayesOpt Adversarial AttackPoster98 citations
- Continual Learning with Adaptive Weights (CLAW)Poster98 citations
- Learning from Rules Generalizing Labeled ExemplarsSpotlight98 citations
- On Generalization Error Bounds of Noisy Gradient Methods for Non-Convex LearningPoster98 citations
- On the Weaknesses of Reinforcement Learning for Neural Machine TranslationPoster98 citations
- Denoising and Regularization via Exploiting the Structural Bias of Convolutional GeneratorsPoster97 citations
- Generalization of Two-layer Neural Networks: An Asymptotic ViewpointSpotlight97 citations
- Improving Neural Language Generation with Spectrum ControlPoster96 citations
- Learning to Coordinate Manipulation Skills via Skill Behavior DiversificationPoster96 citations
- A Theoretical Analysis of the Number of Shots in Few-Shot LearningPoster95 citations
- Variational Recurrent Models for Solving Partially Observable Control TasksPoster95 citations
- FSPool: Learning Set Representations with Featurewise Sort PoolingPoster94 citations
- Batch-shaping for learning conditional channel gated networksPoster93 citations
- Deep neuroethology of a virtual rodentSpotlight93 citations
- Sign Bits Are All You Need for Black-Box AttacksPoster93 citations
- Tree-Structured Attention with Hierarchical AccumulationPoster93 citations
- Jacobian Adversarially Regularized Networks for RobustnessPoster92 citations
- Principled Weight Initialization for HypernetworksTalk92 citations
- Unsupervised Model Selection for Variational Disentangled Representation LearningPoster92 citations
- FEW-SHOT LEARNING ON GRAPHS VIA SUPER-CLASSES BASED ON GRAPH SPECTRAL MEASURESPoster91 citations
- Simple and Effective Regularization Methods for Training on Noisily Labeled Data with Generalization GuaranteePoster91 citations
- On Bonus Based Exploration Methods In The Arcade Learning EnvironmentPoster88 citations
- EMPIR: Ensembles of Mixed Precision Deep Networks for Increased Robustness Against Adversarial AttacksPoster87 citations
- Linear Symmetric Quantization of Neural Networks for Low-precision Integer HardwarePoster87 citations
- Dynamically Pruned Message Passing Networks for Large-scale Knowledge Graph ReasoningPoster86 citations
- Maximum Likelihood Constraint Inference for Inverse Reinforcement LearningSpotlight86 citations
- Economy Statistical Recurrent Units For Inferring Nonlinear Granger CausalityPoster85 citations
- Robust Subspace Recovery Layer for Unsupervised Anomaly DetectionPoster85 citations
- The Implicit Bias of Depth: How Incremental Learning Drives GeneralizationPoster85 citations
- BREAKING CERTIFIED DEFENSES: SEMANTIC ADVERSARIAL EXAMPLES WITH SPOOFED ROBUSTNESS CERTIFICATESPoster84 citations
- Curvature Graph NetworkPoster84 citations
- A Closer Look at the Optimization Landscapes of Generative Adversarial NetworksPoster83 citations
- Meta-learning curiosity algorithmsPoster83 citations
- Towards Better Understanding of Adaptive Gradient Algorithms in Generative Adversarial NetsPoster83 citations
- Gradientless Descent: High-Dimensional Zeroth-Order OptimizationSpotlight81 citations
- HiLLoC: lossless image compression with hierarchical latent variable modelsPoster81 citations
- Program Guided AgentSpotlight81 citations
- Scalable Neural Methods for Reasoning With a Symbolic Knowledge BasePoster81 citations
- Cross-lingual Alignment vs Joint Training: A Comparative Study and A Simple Unified FrameworkPoster80 citations
- Deformable Kernels: Adapting Effective Receptive Fields for Object DeformationPoster80 citations
- BlockSwap: Fisher-guided Block Substitution for Network Compression on a BudgetPoster79 citations
- Conservative Uncertainty Estimation By Fitting Prior NetworksPoster79 citations
- Smoothness and Stability in GANsPoster79 citations
- Doubly Robust Bias Reduction in Infinite Horizon Off-Policy EstimationSpotlight78 citations
- Neural Network Branching for Neural Network VerificationTalk78 citations
- Physics-aware Difference Graph Networks for Sparsely-Observed DynamicsPoster78 citations
- A Mutual Information Maximization Perspective of Language Representation LearningSpotlight77 citations
- Deep Orientation Uncertainty Learning based on a Bingham LossPoster77 citations
- Minimizing FLOPs to Learn Efficient Sparse RepresentationsPoster77 citations
- On Universal Equivariant Set NetworksPoster77 citations
- On the interaction between supervision and self-play in emergent communicationPoster77 citations
- Reinforced Genetic Algorithm Learning for Optimizing Computation GraphsPoster77 citations
- PAC Confidence Sets for Deep Neural Networks via Calibrated PredictionPoster76 citations
- Feature Interaction Interpretability: A Case for Explaining Ad-Recommendation Systems via Neural Interaction DetectionPoster75 citations
- Quantifying Point-Prediction Uncertainty in Neural Networks via Residual Estimation with an I/O KernelPoster75 citations
- Actor-Critic Provably Finds Nash Equilibria of Linear-Quadratic Mean-Field GamesPoster74 citations
- Ridge Regression: Structure, Cross-Validation, and SketchingSpotlight74 citations
- Structured Object-Aware Physics Prediction for Video Modeling and PlanningPoster73 citations
- Data-Independent Neural Pruning via CoresetsPoster72 citations
- The intriguing role of module criticality in the generalization of deep networksSpotlight72 citations
- Image-guided Neural Object RenderingPoster71 citations
- Kaleidoscope: An Efficient, Learnable Representation For All Structured Linear MapsSpotlight71 citations
- Abstract Diagrammatic Reasoning with Multiplex Graph NetworksPoster70 citations
- Data-dependent Gaussian Prior Objective for Language GenerationTalk69 citations
- Double Neural Counterfactual Regret MinimizationPoster69 citations
- Learning to solve the credit assignment problemPoster69 citations
- Watch, Try, Learn: Meta-Learning from Demonstrations and RewardsPoster69 citations
- A Target-Agnostic Attack on Deep Models: Exploiting Security Vulnerabilities of Transfer LearningPoster68 citations
- Demystifying Inter-Class DisentanglementPoster68 citations
- RNNs Incrementally Evolving on an Equilibrium Manifold: A Panacea for Vanishing and Exploding Gradients?Poster68 citations
- RTFM: Generalising to New Environment Dynamics via ReadingPoster68 citations
- Discovering Motor Programs by Recomposing DemonstrationsPoster66 citations
- Exploration in Reinforcement Learning with Deep Covering OptionsPoster66 citations
- Gradient $\ell_1$ Regularization for Quantization RobustnessPoster66 citations
- AE-OT: A NEW GENERATIVE MODEL BASED ON EXTENDED SEMI-DISCRETE OPTIMAL TRANSPORTPoster65 citations
- Coherent Gradients: An Approach to Understanding Generalization in Gradient Descent-based OptimizationPoster65 citations
- Combining Q-Learning and Search with Amortized Value EstimatesPoster65 citations
- Stochastic Weight Averaging in Parallel: Large-Batch Training That Generalizes WellPoster65 citations
- A FRAMEWORK FOR ROBUSTNESS CERTIFICATION OF SMOOTHED CLASSIFIERS USING F-DIVERGENCESPoster64 citations
- CLN2INV: Learning Loop Invariants with Continuous Logic NetworksPoster64 citations
- Dynamics-Aware EmbeddingsPoster64 citations
- Energy-based models for atomic-resolution protein conformationsSpotlight64 citations
- Four Things Everyone Should Know to Improve Batch NormalizationPoster64 citations
- Learning to Plan in High Dimensions via Neural Exploration-Exploitation TreesSpotlight64 citations
- Locality and Compositionality in Zero-Shot LearningPoster64 citations
- SNODE: Spectral Discretization of Neural ODEs for System IdentificationPoster63 citations
- Shifted and Squeezed 8-bit Floating Point format for Low-Precision Training of Deep Neural NetworksPoster63 citations
- The Shape of Data: Intrinsic Distance for Data DistributionsPoster63 citations
- Budgeted Training: Rethinking Deep Neural Network Training Under Resource ConstraintsPoster62 citations
- CAQL: Continuous Action Q-LearningPoster62 citations
- Non-Autoregressive Dialog State TrackingPoster62 citations
- Synthesizing Programmatic Policies that Inductively GeneralizePoster62 citations
- Neural Arithmetic UnitsSpotlight61 citations
- Semi-Supervised Generative Modeling for Controllable Speech SynthesisPoster61 citations
- State-only Imitation with Transition Dynamics MismatchPoster61 citations
- Understanding Why Neural Networks Generalize Well Through GSNR of ParametersSpotlight61 citations
- Estimating Gradients for Discrete Random Variables by Sampling without ReplacementSpotlight60 citations
- GAT: Generative Adversarial Training for Adversarial Example Detection and Robust ClassificationPoster60 citations
- Meta Dropout: Learning to Perturb Latent Features for GeneralizationPoster60 citations
- Disentangling neural mechanisms for perceptual groupingSpotlight59 citations
- Understanding the Limitations of Conditional Generative ModelsPoster59 citations
- Hypermodels for ExplorationPoster58 citations
- Meta Reinforcement Learning with Autonomous Inference of Subtask DependenciesPoster58 citations
- Neural tangent kernels, transportation mappings, and universal approximationPoster58 citations
- PROGRESSIVE LEARNING AND DISENTANGLEMENT OF HIERARCHICAL REPRESENTATIONSSpotlight58 citations
- Episodic Reinforcement Learning with Associative MemoryPoster57 citations
- Probability Calibration for Knowledge Graph Embedding ModelsPoster57 citations
- Deep Network Classification by Scattering and Homotopy Dictionary LearningPoster56 citations
- Recurrent neural circuits for contour detectionPoster56 citations
- Adversarial Lipschitz RegularizationPoster55 citations
- BinaryDuo: Reducing Gradient Mismatch in Binary Activation Network by Coupling Binary ActivationsPoster55 citations
- Convergence of Gradient Methods on Bilinear Zero-Sum GamesPoster55 citations
- Network DeconvolutionSpotlight55 citations
- Reinforcement Learning with Competitive Ensembles of Information-Constrained PrimitivesPoster55 citations
- Stable Rank Normalization for Improved Generalization in Neural Networks and GANsSpotlight55 citations
- Variational Template Machine for Data-to-Text GenerationPoster55 citations
- Learning-Augmented Data Stream AlgorithmsPoster53 citations
- Deep probabilistic subsampling for task-adaptive compressed sensingPoster52 citations
- Making Sense of Reinforcement Learning and Probabilistic InferenceSpotlight52 citations
- Reanalysis of Variance Reduced Temporal Difference LearningPoster52 citations
- SAdam: A Variant of Adam for Strongly Convex FunctionsPoster52 citations
- Towards Stabilizing Batch Statistics in Backward Propagation of Batch NormalizationPoster52 citations
- Differentiable learning of numerical rules in knowledge graphsPoster51 citations
- Scalable Model Compression by Entropy Penalized ReparameterizationPoster51 citations
- Sparse Coding with Gated Learned ISTASpotlight51 citations
- GLAD: Learning Sparse Graph RecoveryPoster50 citations
- Gradients as Features for Deep Representation LearningPoster50 citations
- On Computation and Generalization of Generative Adversarial Imitation LearningPoster50 citations
- Physics-as-Inverse-Graphics: Unsupervised Physical Parameter Estimation from VideoPoster50 citations
- Population-Guided Parallel Policy Search for Reinforcement LearningPoster50 citations
- The Local Elasticity of Neural NetworksPoster50 citations
- Thinking While Moving: Deep Reinforcement Learning with Concurrent ControlPoster50 citations
- Distance-Based Learning from Errors for Confidence CalibrationPoster49 citations
- Empirical Studies on the Properties of Linear Regions in Deep Neural NetworksPoster49 citations
- Action Semantics Network: Considering the Effects of Actions in Multiagent SystemsPoster48 citations
- SpikeGrad: An ANN-equivalent Computation Model for Implementing Backpropagation with SpikesPoster48 citations
- Vid2Game: Controllable Characters Extracted from Real-World VideosPoster48 citations
- Compression based bound for non-compressed network: unified generalization error analysis of large compressible deep neural networkSpotlight47 citations
- End to End Trainable Active Contours via Differentiable RenderingPoster47 citations
- Finding and Visualizing Weaknesses of Deep Reinforcement Learning AgentsPoster47 citations
- Functional vs. parametric equivalence of ReLU networksPoster47 citations
- Latent Normalizing Flows for Many-to-Many Cross-Domain MappingsPoster47 citations
- Why Not to Use Zero Imputation? Correcting Sparsity Bias in Training Neural NetworksPoster47 citations
- On the Global Convergence of Training Deep Linear ResNetsPoster46 citations
- Order Learning and Its Application to Age EstimationPoster46 citations
- Truth or backpropaganda? An empirical investigation of deep learning theorySpotlight46 citations
- Understanding Generalization in Recurrent Neural NetworksPoster46 citations
- Discriminative Particle Filter Reinforcement Learning for Complex Partial observationsPoster45 citations
- How to 0wn the NAS in Your Spare TimePoster45 citations
- Infinite-Horizon Differentiable Model Predictive ControlPoster45 citations
- Interpretable Complex-Valued Neural Networks for Privacy ProtectionPoster45 citations
- Learning to Group: A Bottom-Up Framework for 3D Part Discovery in Unseen CategoriesPoster45 citations
- Mirror-Generative Neural Machine TranslationTalk45 citations
- Sliced Cramer Synaptic Consolidation for Preserving Deeply Learned RepresentationsSpotlight45 citations
- word2ket: Space-efficient Word Embeddings inspired by Quantum EntanglementSpotlight45 citations
- Automated curriculum generation through setter-solver interactionsPoster44 citations
- Fast Neural Network Adaptation via Parameter Remapping and Architecture SearchPoster44 citations
- Improved Sample Complexities for Deep Neural Networks and Robust Classification via an All-Layer MarginPoster44 citations
- In Search for a SAT-friendly Binarized Neural Network ArchitecturePoster43 citations
- Mixed-curvature Variational AutoencodersPoster43 citations
- Implicit Bias of Gradient Descent based Adversarial Training on Separable DataPoster42 citations
- Learning to Move with Affordance MapsPoster42 citations
- One-Shot Pruning of Recurrent Neural Networks by Jacobian Spectrum EvaluationPoster42 citations
- Single Episode Policy Transfer in Reinforcement LearningPoster42 citations
- Knowledge Consistency between Neural Networks and BeyondPoster41 citations
- Learning Heuristics for Quantified Boolean Formulas through Reinforcement LearningPoster41 citations
- Learning from Explanations with Neural Execution TreePoster41 citations
- Mathematical Reasoning in Latent SpaceTalk41 citations
- Novelty Detection Via BlurringPoster41 citations
- Building Deep Equivariant Capsule NetworksTalk40 citations
- Computation Reallocation for Object DetectionPoster40 citations
- Deep Audio Priors Emerge From Harmonic Convolutional NetworksPoster40 citations
- Harnessing Structures for Value-Based Planning and Reinforcement LearningTalk40 citations
- Jelly Bean World: A Testbed for Never-Ending LearningPoster40 citations
- Learning to Represent Programs with Property SignaturesPoster40 citations
- Pure and Spurious Critical Points: a Geometric Study of Linear NetworksPoster40 citations
- Emergence of functional and structural properties of the head direction system by optimization of recurrent neural networksSpotlight39 citations
- Graph inference learning for semi-supervised classificationPoster39 citations
- Neural Outlier Rejection for Self-Supervised Keypoint LearningPoster39 citations
- Watch the Unobserved: A Simple Approach to Parallelizing Monte Carlo Tree SearchTalk39 citations
- Meta-Learning Deep Energy-Based Memory ModelsPoster38 citations
- RaCT: Toward Amortized Ranking-Critical Training For Collaborative FilteringPoster38 citations
- Augmenting Non-Collaborative Dialog Systems with Explicit Semantic and Strategic Dialog HistoryPoster37 citations
- Compositional Language Continual LearningPoster37 citations
- LEARNING EXECUTION THROUGH NEURAL CODE FUSIONPoster37 citations
- Short and Sparse Deconvolution --- A Geometric ApproachPoster37 citations
- Black-box Off-policy Estimation for Infinite-Horizon Reinforcement LearningPoster36 citations
- Effect of Activation Functions on the Training of Overparametrized Neural NetsPoster36 citations
- Neural Stored-program MemoryPoster36 citations
- Piecewise linear activations substantially shape the loss surfaces of neural networksPoster36 citations
- Toward Evaluating Robustness of Deep Reinforcement Learning with Continuous ControlPoster36 citations
- Unbiased Contrastive Divergence Algorithm for Training Energy-Based Latent Variable ModelsSpotlight36 citations
- Adversarially Robust Representations with Smooth EncodersPoster35 citations
- Oblique Decision Trees from Derivatives of ReLU NetworksPoster35 citations
- A Stochastic Derivative Free Optimization Method with MomentumPoster34 citations
- Composing Task-Agnostic Policies with Deep Reinforcement LearningPoster34 citations
- From Inference to Generation: End-to-end Fully Self-supervised Generation of Human Face from SpeechPoster34 citations
- Inductive and Unsupervised Representation Learning on Graph Structured ObjectsPoster34 citations
- NeurQuRI: Neural Question Requirement Inspector for Answerability Prediction in Machine Reading ComprehensionPoster34 citations
- Universal Approximation with Certified NetworksPoster34 citations
- Depth-Width Trade-offs for ReLU Networks via Sharkovsky's TheoremSpotlight33 citations
- Geometric Analysis of Nonconvex Optimization Landscapes for Overcomplete LearningTalk33 citations
- Precision Gating: Improving Neural Network Efficiency with Dynamic Dual-Precision ActivationsPoster33 citations
- Prediction, Consistency, Curvature: Representation Learning for Locally-Linear ControlPoster33 citations
- The asymptotic spectrum of the Hessian of DNN throughout trainingPoster33 citations
- Intrinsic Motivation for Encouraging Synergistic BehaviorPoster32 citations
- Phase Transitions for the Information Bottleneck in Representation LearningPoster32 citations
- Progressive Memory Banks for Incremental Domain AdaptationPoster32 citations
- RGBD-GAN: Unsupervised 3D Representation Learning From Natural Image Datasets via RGBD Image SynthesisPoster32 citations
- SUMO: Unbiased Estimation of Log Marginal Probability for Latent Variable ModelsSpotlight32 citations
- Unsupervised Clustering using Pseudo-semi-supervised LearningPoster32 citations
- A closer look at the approximation capabilities of neural networksPoster31 citations
- MetaPix: Few-Shot Video RetargetingPoster31 citations
- Robust training with ensemble consensusPoster31 citations
- Self-Adversarial Learning with Comparative Discrimination for Text GenerationPoster31 citations
- Learning from Unlabelled Videos Using Contrastive Predictive Neural 3D MappingPoster30 citations
- ProxSGD: Training Structured Neural Networks under Regularization and ConstraintsPoster30 citations
- A Latent Morphology Model for Open-Vocabulary Neural Machine TranslationSpotlight29 citations
- Detecting Extrapolation with Local EnsemblesPoster29 citations
- Extreme Classification via Adversarial Softmax ApproximationPoster29 citations
- Spike-based causal inference for weight alignmentPoster29 citations
- Adjustable Real-time Style TransferPoster28 citations
- An Inductive Bias for Distances: Neural Nets that Respect the Triangle InequalityPoster28 citations
- DeFINE: Deep Factorized Input Token Embeddings for Neural Sequence ModelingPoster28 citations
- Mutual Information Gradient Estimation for Representation LearningPoster28 citations
- Variance Reduction With Sparse GradientsPoster28 citations
- Co-Attentive Equivariant Neural Networks: Focusing Equivariance On Transformations Co-Occurring in DataPoster27 citations
- Intrinsically Motivated Discovery of Diverse Patterns in Self-Organizing SystemsTalk27 citations
- Multi-Agent Interactions Modeling with Correlated PoliciesPoster27 citations
- AMRL: Aggregated Memory For Reinforcement LearningPoster26 citations
- Bayesian Meta Sampling for Fast Uncertainty AdaptationPoster25 citations
- Generalized Convolutional Forest Networks for Domain Generalization and Visual RecognitionPoster25 citations
- Geometric Insights into the Convergence of Nonlinear TD LearningPoster25 citations
- Kernelized Wasserstein Natural GradientSpotlight25 citations
- Understanding l4-based Dictionary Learning: Interpretation, Stability, and RobustnessPoster25 citations
- Biologically inspired sleep algorithm for increased generalization and adversarial robustness in deep neural networksPoster24 citations
- Higher-Order Function Networks for Learning Composable 3D Object RepresentationsPoster24 citations
- Learning transport cost from subset correspondencePoster24 citations
- Online and stochastic optimization beyond Lipschitz continuity: A Riemannian approachSpotlight24 citations
- Posterior sampling for multi-agent reinforcement learning: solving extensive games with imperfect informationTalk24 citations
- The Variational Bandwidth Bottleneck: Stochastic Evaluation on an Information BudgetPoster24 citations
- Escaping Saddle Points Faster with Stochastic MomentumPoster23 citations
- Learning to LinkPoster23 citations
- I Am Going MAD: Maximum Discrepancy Competition for Comparing Classifiers AdaptivelyPoster22 citations
- Information Geometry of Orthogonal Initializations and TrainingPoster22 citations
- Learning to Guide Random SearchPoster22 citations
- Stochastic Conditional Generative Networks with Basis DecompositionPoster22 citations
- At Stability's Edge: How to Adjust Hyperparameters to Preserve Minima Selection in Asynchronous Training of Neural Networks?Spotlight21 citations
- FSNet: Compression of Deep Convolutional Neural Networks by Filter SummaryPoster21 citations
- Gap-Aware Mitigation of Gradient StalenessPoster21 citations
- Learning Self-Correctable Policies and Value Functions from Demonstrations with Negative SamplingPoster21 citations
- Pruned Graph Scattering TransformsPoster21 citations
- Target-Embedding Autoencoders for Supervised Representation LearningTalk21 citations
- Guiding Program Synthesis by Learning to Generate ExamplesPoster20 citations
- Learning to Learn by Zeroth-Order OraclePoster20 citations
- Domain Adaptive Multibranch NetworksPoster19 citations
- On the Need for Topology-Aware Generative Models for Manifold-Based DefensesPoster19 citations
- Smooth markets: A basic mechanism for organizing gradient-based learnersPoster19 citations
- Tranquil Clouds: Neural Networks for Learning Temporally Coherent Features in Point CloudsSpotlight19 citations
- Improved memory in recurrent neural networks with sequential non-normal dynamicsPoster18 citations
- Kernel of CycleGAN as a principal homogeneous spacePoster18 citations
- Frequency-based Search-control in DynaPoster17 citations
- Neural Epitome Search for Architecture-Agnostic Network CompressionPoster16 citations
- SVQN: Sequential Variational Soft Q-Learning NetworksPoster16 citations
- Dynamic Time Lag Regression: Predicting What & WhenPoster15 citations
- Identifying through Flows for Recovering Latent RepresentationsPoster15 citations
- Lazy-CFR: fast and near-optimal regret minimization for extensive games with imperfect informationPoster15 citations
- Rotation-invariant clustering of neuronal responses in primary visual cortexTalk15 citations
- Variational Autoencoders for Highly Multivariate Spatial Point Processes IntensitiesPoster15 citations
- Expected Information Maximization: Using the I-Projection for Mixture Density EstimationPoster14 citations
- IMPACT: Importance Weighted Asynchronous Architectures with Clipped Target NetworksPoster14 citations
- Ranking Policy GradientPoster14 citations
- Self-Supervised Learning of Appliance UsagePoster14 citations
- AdvectiveNet: An Eulerian-Lagrangian Fluidic Reservoir for Point Cloud ProcessingPoster13 citations
- Extreme Tensoring for Low-Memory PreconditioningPoster13 citations
- Generative Ratio Matching NetworksPoster13 citations
- Masked Based Unsupervised Content TransferPoster13 citations
- To Relieve Your Headache of Training an MRF, Take AdVILPoster13 citations
- Regularizing activations in neural networks via distribution matching with the Wasserstein metricPoster12 citations
- White Noise Analysis of Neural NetworksSpotlight12 citations
- Learning Expensive Coordination: An Event-Based Deep RL ApproachPoster11 citations
- Bounds on Over-Parameterization for Guaranteed Existence of Descent Paths in Shallow ReLU NetworksPoster10 citations
- Decoding As Dynamic Programming For Recurrent Autoregressive ModelsPoster10 citations
- Discrepancy Ratio: Evaluating Model Performance When Even Experts Disagree on the TruthPoster10 citations
- Learning Efficient Parameter Server Synchronization Policies for Distributed SGDPoster10 citations
- Relational State-Space Model for Stochastic Multi-Object SystemsPoster10 citations
- Learning representations for binary-classification without backpropagationPoster9 citations
- Sampling-Free Learning of Bayesian Quantized Neural NetworksPoster9 citations
- Analysis of Video Feature Learning in Two-Stream CNNs on the Example of Zebrafish Swim Bout ClassificationPoster8 citations
- Deep Symbolic Superoptimization Without Human KnowledgePoster8 citations
- Learning the Arrow of Time for Problems in Reinforcement LearningPoster8 citations
- Probabilistic Connection Importance Inference and Lossless Compression of Deep Neural NetworksPoster8 citations
- Infinite-horizon Off-Policy Policy Evaluation with Multiple Behavior PoliciesPoster7 citations
- Low-dimensional statistical manifold embedding of directed graphsPoster7 citations
- Weakly Supervised Clustering by Exploiting Unique Class CountPoster7 citations
- Duration-of-Stay Storage Assignment under UncertaintySpotlight6 citations
- Provable robustness against all adversarial $l_p$-perturbations for $p\geq 1$Poster6 citations
- Span Recovery for Deep Neural Networks with Applications to Input ObfuscationPoster6 citations
- Training Recurrent Neural Networks Online by Learning Explicit State VariablesPoster6 citations
- Difference-Seeking Generative Adversarial Network--Unseen Sample GenerationPoster5 citations
- PCMC-Net: Feature-based Pairwise Choice Markov ChainsPoster5 citations
- Spectral Embedding of Regularized Block ModelsSpotlight5 citations
- Adaptive Correlated Monte Carlo for Contextual Categorical Sequence GenerationPoster4 citations
- Logic and the 2-Simplicial TransformerPoster4 citations
- Optimal Strategies Against Generative AttacksTalk4 citations
- Critical initialisation in continuous approximations of binary neural networksPoster3 citations
- Deep Learning of Determinantal Point Processes via Proper Spectral Sub-gradientPoster3 citations
- Towards Verified Robustness under Text Deletion InterventionsPoster3 citations
- Towards a Deep Network Architecture for Structured SmoothnessPoster3 citations
- Deep 3D Pan via local adaptive "t-shaped" convolutions with global and local adaptive dilationsPoster2 citations
- Massively Multilingual Sparse Word RepresentationsPoster2 citations
- Quantifying the Cost of Reliable Photo Authentication via High-Performance Learned Lossy RepresentationsPoster2 citations
- SNOW: Subscribing to Knowledge via Channel Pooling for Transfer & Lifelong Learning of Convolutional Neural NetworksPoster2 citations
- Training Generative Adversarial Networks from Incomplete Observations using Factorised DiscriminatorsPoster2 citations
- Transferring Optimality Across Data Distributions via Homotopy MethodsPoster2 citations
- Variational Hetero-Encoder Randomized GANs for Joint Image-Text ModelingPoster1 citations
- Distributionally Robust Neural NetworksPoster
- Enhancing Transformation-Based Defenses Against Adversarial Attacks with a Distribution ClassifierPoster
- Implementing Inductive bias for different navigation tasks through diverse RNN attrractorsPoster
- MEMO: A Deep Network for Flexible Combination of Episodic MemoriesPoster
- Measuring and Improving the Use of Graph Information in Graph Neural NetworksPoster
- Mixed Precision DNNs: All you need is a good parametrizationPoster
- Optimistic Exploration even with a Pessimistic InitialisationPoster
- ReMixMatch: Semi-Supervised Learning with Distribution Matching and Augmentation AnchoringPoster
- Real or Not Real, that is the QuestionSpotlight
- The Gambler's Problem and BeyondPoster
ICLR accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.