ICLR 2019 Accepted Papers
The full list of 502 papers accepted at ICLR 2019 (International Conference on Learning Representations). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Poster: 478Oral: 24
- Decoupled Weight Decay RegularizationPoster27,890 citations
- How Powerful are Graph Neural Networks?Oral10,619 citations
- GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language UnderstandingPoster8,516 citations
- Large Scale GAN Training for High Fidelity Natural Image SynthesisOral6,860 citations
- DARTS: Differentiable Architecture SearchPoster5,782 citations
- The Lottery Ticket Hypothesis: Finding Sparse, Trainable Neural NetworksOral4,377 citations
- Benchmarking Neural Network Robustness to Common Corruptions and PerturbationsPoster4,260 citations
- ImageNet-trained CNNs are biased towards texture; increasing shape bias improves accuracy and robustnessOral3,448 citations
- Learning deep representations by mutual information estimation and maximizationOral3,384 citations
- RotatE: Knowledge Graph Embedding by Relational Rotation in Complex SpacePoster3,076 citations
- ProxylessNAS: Direct Neural Architecture Search on Target Task and HardwarePoster2,375 citations
- A Closer Look at Few-shot ClassificationPoster2,355 citations
- Predict then Propagate: Graph Neural Networks meet Personalized PageRankPoster2,182 citations
- Robustness May Be at Odds with AccuracyPoster2,099 citations
- Rethinking the Value of Network PruningPoster1,960 citations
- Deep Anomaly Detection with Outlier ExposurePoster1,914 citations
- Attention, Learn to Solve Routing Problems!Poster1,846 citations
- Efficient Lifelong Learning with A-GEMPoster1,788 citations
- Meta-Learning with Latent Embedding OptimizationPoster1,771 citations
- Exploration by random network distillationPoster1,708 citations
- SNIP: SINGLE-SHOT NETWORK PRUNING BASED ON CONNECTION SENSITIVITYPoster1,524 citations
- The relativistic discriminator: a key element missing from standard GANPoster1,409 citations
- Diversity is All You Need: Learning Skills without a Reward FunctionPoster1,341 citations
- Local SGD Converges Fast and Communicates LittlePoster1,278 citations
- Meta-learning with differentiable closed-form solversPoster1,245 citations
- SNAS: stochastic neural architecture searchPoster1,190 citations
- Evaluating Robustness of Neural Networks with Mixed Integer ProgrammingPoster1,123 citations
- Universal TransformersPoster1,087 citations
- Wizard of Wikipedia: Knowledge-Powered Conversational AgentsPoster1,074 citations
- How to train your MAMLPoster1,039 citations
- Deep Graph InfomaxPoster1,037 citations
- What do you learn from context? Probing for sentence structure in contextualized word representationsPoster1,017 citations
- FFJORD: Free-Form Continuous Dynamics for Scalable Reversible Generative ModelsOral1,014 citations
- LEARNING TO PROPAGATE LABELS: TRANSDUCTIVE PROPAGATION NETWORK FOR FEW-SHOT LEARNINGPoster990 citations
- Learning to Learn without Forgetting by Maximizing Transfer and Minimizing InterferencePoster979 citations
- Large-Scale Study of Curiosity-Driven LearningPoster958 citations
- The Neuro-Symbolic Concept Learner: Interpreting Scenes, Words, and Sentences From Natural SupervisionOral929 citations
- code2seq: Generating Sequences from Structured Representations of CodePoster919 citations
- Adversarial Audio SynthesisPoster917 citations
- PATE-GAN: Generating Synthetic Data with Differential Privacy GuaranteesPoster912 citations
- Residual Non-local Attention Networks for Image RestorationPoster904 citations
- Do Deep Generative Models Know What They Don't Know?Poster903 citations
- Gradient Descent Provably Optimizes Over-parameterized Neural NetworksPoster888 citations
- Adaptive Gradient Methods with Dynamic Bound of Learning RatePoster877 citations
- An Empirical Study of Example Forgetting during Deep Neural Network LearningPoster848 citations
- Approximating CNNs with Bag-of-local-Features models works surprisingly well on ImageNetPoster741 citations
- Learning to Adapt in Dynamic, Real-World Environments through Meta-Reinforcement LearningPoster740 citations
- Pay Less Attention with Lightweight and Dynamic ConvolutionsOral734 citations
- Slimmable Neural NetworksPoster731 citations
- DyRep: Learning Representations over Dynamic GraphsPoster729 citations
- Efficient Multi-Objective Neural Architecture Search via Lamarckian EvolutionPoster694 citations
- GAN Dissection: Visualizing and Understanding Generative Adversarial NetworksPoster694 citations
- Analyzing Inverse Problems with Invertible Neural NetworksPoster687 citations
- Reward Constrained Policy OptimizationPoster667 citations
- Enabling Factorized Piano Music Modeling and Generation with the MAESTRO DatasetOral629 citations
- Recurrent Experience Replay in Distributed Reinforcement LearningPoster629 citations
- GANSynth: Adversarial Neural Audio SynthesisPoster604 citations
- Invariant and Equivariant Graph NetworksPoster599 citations
- Learning Factorized Multimodal RepresentationsPoster561 citations
- Learning a SAT Solver from Single-Bit SupervisionPoster541 citations
- Eidetic 3D LSTM: A Model for Video Prediction and BeyondPoster524 citations
- Query-Efficient Hard-label Black-box Attack: An Optimization-based ApproachPoster520 citations
- Attentive Neural ProcessesPoster519 citations
- Deep Lagrangian Networks: Using Physics as Model Prior for Deep LearningPoster511 citations
- Slalom: Fast, Verifiable and Private Execution of Neural Networks in Trusted HardwareOral507 citations
- Diagnosing and Enhancing VAE ModelsPoster505 citations
- Analysing Mathematical Reasoning Abilities of Neural ModelsPoster496 citations
- Context-adaptive Entropy Model for End-to-end Optimized Image CompressionPoster495 citations
- Graph Wavelet Neural NetworkPoster492 citations
- Adaptive Input Representations for Neural Language ModelingPoster489 citations
- A Variational Inequality Perspective on Generative Adversarial NetworksPoster487 citations
- Phase-Aware Speech Enhancement with Deep Complex U-NetPoster476 citations
- Prior Convictions: Black-box Adversarial Attacks with Bandits and PriorsPoster471 citations
- ClariNet: Parallel Wave Generation in End-to-End Text-to-SpeechPoster448 citations
- Towards the first adversarially robust neural network model on MNISTPoster439 citations
- Supervised Community Detection with Line Graph Neural NetworksPoster437 citations
- Learning Particle Dynamics for Manipulating Rigid Bodies, Deformable Objects, and FluidsPoster435 citations
- Ordered Neurons: Integrating Tree Structures into Recurrent Neural NetworksOral418 citations
- Fixup Initialization: Residual Learning Without NormalizationPoster413 citations
- Dynamic Channel Pruning: Feature Boosting and SuppressionPoster410 citations
- On the Convergence of A Class of Adam-Type Algorithms for Non-Convex OptimizationPoster406 citations
- Bayesian Deep Convolutional Networks with Many Channels are Gaussian ProcessesPoster401 citations
- Are adversarial examples inevitable?Poster392 citations
- Learning when to Communicate at Scale in Multiagent Cooperative and Competitive TasksPoster391 citations
- Visual Semantic Navigation using Scene PriorsPoster391 citations
- Learning protein sequence embeddings using information from structurePoster382 citations
- Understanding Straight-Through Estimator in Training Activation Quantized Neural NetsPoster382 citations
- Deep Decoder: Concise Image Representations from Untrained Non-convolutional NetworksPoster374 citations
- A Closer Look at Deep Learning Heuristics: Learning rate restarts, Warmup and DistillationPoster368 citations
- Learning Multi-Level Hierarchies with HindsightPoster368 citations
- Lagging Inference Networks and Posterior Collapse in Variational AutoencodersPoster367 citations
- Optimistic mirror descent in saddle-point problems: Going the extra (gradient) milePoster366 citations
- Episodic Curiosity through ReachabilityPoster359 citations
- Poincare Glove: Hyperbolic Word EmbeddingsPoster357 citations
- Neural Logic MachinesPoster352 citations
- BA-Net: Dense Bundle Adjustment NetworksOral351 citations
- Discriminator-Actor-Critic: Addressing Sample Inefficiency and Reward Bias in Adversarial Imitation LearningPoster348 citations
- Understanding and Improving Interpolation in Autoencoders via an Adversarial RegularizerPoster338 citations
- Graph HyperNetworks for Neural Architecture SearchPoster331 citations
- Meta-Learning Probabilistic Inference for PredictionPoster330 citations
- Learning Multimodal Graph-to-Graph Translation for Molecule OptimizationPoster327 citations
- FUNCTIONAL VARIATIONAL BAYESIAN NEURAL NETWORKSPoster325 citations
- Three Mechanisms of Weight Decay RegularizationPoster323 citations
- A Convergence Analysis of Gradient Descent for Deep Linear Neural NetworksPoster322 citations
- Deep Convolutional Networks as shallow Gaussian ProcessesPoster321 citations
- Self-Monitoring Navigation Agent via Auxiliary Progress EstimationPoster318 citations
- Representation Degeneration Problem in Training Natural Language Generation ModelsPoster311 citations
- Riemannian Adaptive Optimization MethodsPoster311 citations
- Explaining Image Classifiers by Counterfactual GenerationPoster308 citations
- LanczosNet: Multi-Scale Deep Graph Convolutional NetworksPoster307 citations
- Adaptivity of deep ReLU network for learning in Besov and mixed smooth Besov spaces: optimal rate and curse of dimensionalityPoster304 citations
- Hyperbolic Attention NetworksPoster302 citations
- Unsupervised Learning via Meta-LearningPoster299 citations
- Hierarchical Generative Modeling for Controllable Speech SynthesisPoster297 citations
- MisGAN: Learning from Incomplete Data with Generative Adversarial NetworksPoster295 citations
- There Are Many Consistent Explanations of Unlabeled Data: Why You Should AveragePoster294 citations
- DPSNet: End-to-end Deep Plane Sweep StereoPoster288 citations
- Learning Exploration Policies for NavigationPoster288 citations
- AntisymmetricRNN: A Dynamical System View on Recurrent Neural NetworksPoster284 citations
- Gradient descent aligns the layers of deep linear networksPoster284 citations
- Plan Online, Learn Offline: Efficient Learning and Exploration via Model-Based ControlPoster284 citations
- Towards Understanding Regularization in Batch NormalizationPoster283 citations
- Robust Conditional Generative Adversarial NetworksPoster282 citations
- Variational Discriminator Bottleneck: Improving Imitation Learning, Inverse RL, and GANs by Constraining Information FlowPoster282 citations
- Multilingual Neural Machine Translation with Knowledge DistillationPoster280 citations
- Structured Neural SummarizationPoster279 citations
- Multiple-Attribute Text RewritingPoster278 citations
- Learning to Schedule Communication in Multi-agent Reinforcement LearningPoster273 citations
- Algorithmic Framework for Model-based Deep Reinforcement Learning with Theoretical GuaranteesPoster270 citations
- Learning Mixed-Curvature Representations in Product SpacesPoster270 citations
- Learning Robust Representations by Projecting Superficial Statistics OutOral270 citations
- L-Shapley and C-Shapley: Efficient Model Interpretation for Structured DataPoster268 citations
- Deep reinforcement learning with relational inductive biasesPoster265 citations
- RelGAN: Relational Generative Adversarial Networks for Text GenerationPoster265 citations
- Regularized Learning for Domain Adaptation under Label ShiftsPoster263 citations
- Differentiable Learning-to-Normalize via Switchable NormalizationPoster262 citations
- LayoutGAN: Generating Graphic Layouts with Wireframe DiscriminatorsPoster262 citations
- BabyAI: A Platform to Study the Sample Efficiency of Grounded Language LearningPoster259 citations
- Near-Optimal Representation Learning for Hierarchical Reinforcement LearningPoster258 citations
- Optimal Control Via Neural Networks: A Convex ApproachPoster257 citations
- ProMP: Proximal Meta-Policy SearchPoster255 citations
- Capsule Graph Neural NetworkPoster254 citations
- Deep learning generalizes because the parameter-function map is biased towards simple functionsPoster253 citations
- Diversity-Sensitive Conditional Generative Adversarial NetworksPoster253 citations
- Predicting the Generalization Gap in Deep Networks with Margin DistributionsPoster249 citations
- Deterministic Variational Inference for Robust Bayesian Neural NetworksOral248 citations
- Boosting Robustness Certification of Neural NetworksPoster241 citations
- Janossy Pooling: Learning Deep Permutation-Invariant Functions for Variable-Size InputsPoster238 citations
- Deep Online Learning Via Meta-Learning: Continual Adaptation for Model-Based RLPoster236 citations
- The Singular Values of Convolutional LayersPoster234 citations
- Training for Faster Adversarial Robustness Verification via Inducing ReLU StabilityPoster234 citations
- Non-vacuous Generalization Bounds at the ImageNet Scale: a PAC-Bayesian Compression ApproachPoster232 citations
- ALISTA: Analytic Weights Are As Good As Learned Weights in LISTAPoster227 citations
- Adversarial Reprogramming of Neural NetworksPoster227 citations
- Generative Code Modeling with GraphsPoster227 citations
- signSGD with Majority Vote is Communication Efficient and Fault TolerantPoster227 citations
- Adv-BNN: Improved Adversarial Defense through Robust Bayesian Neural NetworkPoster226 citations
- Multi-step Retriever-Reader Interaction for Scalable Open-domain Question AnsweringPoster225 citations
- Relaxed Quantization for Discretized Neural NetworksPoster224 citations
- INVASE: Instance-wise Variable Selection using Neural NetworksPoster218 citations
- Identifying and Controlling Important Neurons in Neural Machine TranslationPoster218 citations
- A Mean Field Theory of Batch NormalizationPoster217 citations
- Characterizing Audio Adversarial Examples Using Temporal DependencyPoster217 citations
- Self-Tuning Networks: Bilevel Optimization of Hyperparameters using Structured Best-Response FunctionsPoster216 citations
- InstaGAN: Instance-aware Image-to-Image TranslationPoster215 citations
- Multi-class classification without multi-class labelsPoster215 citations
- Spherical CNNs on Unstructured GridsPoster215 citations
- Preventing Posterior Collapse with delta-VAEsPoster214 citations
- Learning Localized Generative Models for 3D Point Clouds via Graph ConvolutionPoster213 citations
- Critical Learning Periods in Deep NetworksPoster211 citations
- Overcoming Catastrophic Forgetting for Continual Learning via Model AdaptationPoster211 citations
- DELTA: DEEP LEARNING TRANSFER USING FEATURE MAP WITH ATTENTION FOR CONVOLUTIONAL NETWORKSPoster207 citations
- SOM-VAE: Interpretable Discrete Representation Learning on Time SeriesPoster205 citations
- Systematic Generalization: What Is Required and Can It Be Learned?Poster202 citations
- Excessive Invariance Causes Adversarial VulnerabilityPoster201 citations
- Unsupervised Control Through Non-Parametric Discriminative RewardsPoster201 citations
- CEM-RL: Combining evolutionary and gradient-based methods for policy searchPoster197 citations
- Interpolation-Prediction Networks for Irregularly Sampled Time SeriesPoster197 citations
- Global-to-local Memory Pointer Networks for Task-Oriented DialoguePoster196 citations
- Probabilistic Recursive Reasoning for Multi-Agent Reinforcement LearningPoster196 citations
- Stochastic Optimization of Sorting Networks via Continuous RelaxationsPoster195 citations
- The Limitations of Adversarial Training and the Blind-Spot AttackPoster194 citations
- Structured Adversarial Attack: Towards General Implementation and Better InterpretabilityPoster193 citations
- Execution-Guided Neural Program SynthesisPoster192 citations
- Measuring Compositionality in Representation LearningPoster192 citations
- Variational Autoencoder with Arbitrary ConditioningPoster192 citations
- Learning-Based Frequency Estimation AlgorithmsPoster191 citations
- InfoBot: Transfer and Exploration via the Information BottleneckPoster189 citations
- Quasi-hyperbolic momentum and Adam for deep learningPoster189 citations
- Emergent Coordination Through CompetitionPoster186 citations
- Hierarchical interpretations for neural network predictionsPoster186 citations
- On the Turing Completeness of Modern Neural Network ArchitecturesPoster186 citations
- Generalizable Adversarial Training via Spectral NormalizationPoster183 citations
- Quaternion Recurrent Neural NetworksPoster183 citations
- Trellis Networks for Sequence ModelingPoster181 citations
- How Important is a NeuronPoster179 citations
- Measuring and regularizing networks in function spacePoster179 citations
- Neural Probabilistic Motor Primitives for Humanoid ControlPoster177 citations
- Sample Efficient Adaptive Text-to-SpeechPoster177 citations
- Learning what and where to attendPoster176 citations
- Learning to Understand Goal Specifications by Modelling RewardPoster175 citations
- Learning Protein Structure with a Differentiable SimulatorOral174 citations
- Practical lossless compression with latent variables using bits back codingPoster174 citations
- Improving Generalization and Stability of Generative Adversarial NetworksPoster173 citations
- Amortized Bayesian Meta-LearningPoster170 citations
- Improving the Generalization of Adversarial Training with Domain AdaptationPoster170 citations
- Learning to Infer and Execute 3D Shape ProgramsPoster169 citations
- DialogWAE: Multimodal Response Generation with Conditional Wasserstein Auto-EncoderPoster168 citations
- Discriminator Rejection SamplingPoster168 citations
- Neural Program Repair by Jointly Learning to Localize and RepairPoster167 citations
- Woulda, Coulda, Shoulda: Counterfactually-Guided Policy SearchPoster166 citations
- Exemplar Guided Unsupervised Image-to-Image Translation with Semantic ConsistencyPoster165 citations
- Neural Persistence: A Complexity Measure for Deep Neural Networks Using Algebraic TopologyPoster165 citations
- Stable Recurrent ModelsPoster165 citations
- GENERATING HIGH FIDELITY IMAGES WITH SUBSCALE PIXEL NETWORKS AND MULTIDIMENSIONAL UPSCALINGOral163 citations
- Temporal Difference Variational Auto-EncoderOral161 citations
- A Universal Music Translation NetworkPoster160 citations
- Universal Successor Features ApproximatorsPoster160 citations
- Model-Predictive Policy Learning with Uncertainty Regularization for Driving in Dense TrafficPoster159 citations
- Learning Neural PDE Solvers with Convergence GuaranteesPoster157 citations
- From Language to Goals: Inverse Reinforcement Learning for Vision-Based Instruction FollowingPoster153 citations
- Learning To SimulatePoster153 citations
- Bias-Reduced Uncertainty Estimation for Deep Neural ClassifiersPoster150 citations
- Learning Actionable Representations with Goal Conditioned PoliciesPoster150 citations
- Meta-Learning Update Rules for Unsupervised Representation LearningOral150 citations
- SPIGAN: Privileged Adversarial Learning from SimulationPoster150 citations
- Selfless Sequential LearningPoster150 citations
- TimbreTron: A WaveNet(CycleGAN(CQT(Audio))) Pipeline for Musical Timbre TransferPoster146 citations
- FlowQA: Grasping Flow in History for Conversational Machine ComprehensionPoster145 citations
- Reasoning About Physical Interactions with Object-Oriented Prediction and PlanningPoster145 citations
- Learning from Positive and Unlabeled Data with a Selection BiasPoster143 citations
- CAMOU: Learning Physical Vehicle Camouflages to Adversarially Attack Detectors in the WildPoster141 citations
- Spreading vectors for similarity searchPoster139 citations
- Theoretical Analysis of Auto Rate-Tuning by Batch NormalizationPoster139 citations
- Doubly Reparameterized Gradient Estimators for Monte Carlo ObjectivesPoster137 citations
- On the Relation Between the Sharpest Directions of DNN Loss and the SGD Step LengthPoster137 citations
- An analytic theory of generalization dynamics and transfer learning in deep linear networksPoster136 citations
- Learning to Represent EditsPoster133 citations
- Modeling Uncertainty with Hedged Instance EmbeddingsPoster133 citations
- No Training Required: Exploring Random Encoders for Sentence ClassificationPoster133 citations
- On Self Modulation for Generative Adversarial NetworksPoster133 citations
- ProxQuant: Quantized Neural Networks via Proximal OperatorsPoster133 citations
- Stable Opponent Shaping in Differentiable GamesPoster131 citations
- Generating Multiple Objects at Spatially Distinct LocationsPoster129 citations
- GamePad: A Learning Environment for Theorem ProvingPoster127 citations
- Big-Little Net: An Efficient Multi-Scale Feature Representation for Visual and Speech RecognitionPoster124 citations
- Hierarchical Visuomotor Control of HumanoidsPoster124 citations
- Deterministic PAC-Bayesian generalization bounds for deep networks via generalizing noise-resiliencePoster121 citations
- Beyond Pixel Norm-Balls: Parametric Adversaries using an Analytically Differentiable RendererPoster120 citations
- Learning To Solve Circuit-SAT: An Unsupervised Differentiable ApproachPoster120 citations
- Variance Reduction for Reinforcement Learning in Input-Driven EnvironmentsPoster120 citations
- Diffusion Scattering Transforms on GraphsPoster118 citations
- Stochastic Prediction of Multi-Agent Interactions from Partial ObservationsPoster118 citations
- A comprehensive, application-oriented study of catastrophic forgetting in DNNsPoster115 citations
- ADef: an Iterative Algorithm to Construct Adversarial DeformationsPoster114 citations
- DHER: Hindsight Experience Replay for Dynamic GoalsPoster114 citations
- Composing Complex Skills by Learning Transition PoliciesPoster110 citations
- Improving Sequence-to-Sequence Learning via Optimal TransportPoster110 citations
- Learning Finite State Representations of Recurrent Policy NetworksPoster110 citations
- Adaptive Posterior Learning: few-shot learning with a surprise-based memory modulePoster109 citations
- An Empirical study of Binary Neural Networks' OptimisationPoster109 citations
- Information asymmetry in KL-regularized RLPoster109 citations
- Policy Transfer with Strategy OptimizationPoster108 citations
- The Laplacian in RL: Learning Representations with Efficient ApproximationsPoster108 citations
- Large Scale Graph Learning From Smooth SignalsPoster107 citations
- MARGINALIZED AVERAGE ATTENTIONAL NETWORK FOR WEAKLY-SUPERVISED LEARNINGPoster107 citations
- On the Minimal Supervision for Training Any Binary Classifier from Only Unlabeled DataPoster106 citations
- Smoothing the Geometry of Probabilistic Box EmbeddingsOral106 citations
- A Statistical Approach to Assessing Neural Network RobustnessPoster105 citations
- Backpropamine: training self-modifying neural networks with differentiable neuromodulated plasticityPoster105 citations
- Small nonlinearities in activation functions create bad local minima in neural networksPoster105 citations
- The Unusual Effectiveness of Averaging in GAN TrainingPoster105 citations
- Time-Agnostic Prediction: Predicting Predictable Video FramesPoster105 citations
- A Unified Theory of Early Visual Representations from Retina to Cortex through Anatomically Constrained Deep CNNsOral104 citations
- Information-Directed Exploration for Deep Reinforcement LearningPoster104 citations
- On the loss landscape of a class of deep neural networks with no bad local valleysPoster104 citations
- Learning to Design RNAPoster103 citations
- Learning to Make Analogies by Contrasting Abstract Relational StructurePoster102 citations
- Caveats for information bottleneck in deterministic scenariosPoster101 citations
- Generating Multi-Agent Trajectories using Programmatic Weak SupervisionPoster101 citations
- Kernel Change-point Detection with Auxiliary Deep Generative ModelsPoster100 citations
- Toward Understanding the Impact of Staleness in Distributed Machine LearningPoster100 citations
- Improving MMD-GAN Training with Repulsive Loss FunctionPoster99 citations
- Data-Dependent Coresets for Compressing Neural Networks with Applications to Generalization BoundsPoster98 citations
- Hindsight policy gradientsPoster98 citations
- Neural Graph Evolution: Towards Efficient Automatic Robot DesignPoster97 citations
- Contingency-Aware Exploration in Reinforcement LearningPoster96 citations
- Learning to Learn with Conditional Class DependenciesPoster96 citations
- Building Dynamic Knowledge Graphs from Text using Machine Reading ComprehensionPoster95 citations
- Directed-Info GAIL: Learning Hierarchical Policies from Unsegmented Demonstrations using Directed InformationPoster95 citations
- KnockoffGAN: Generating Knockoffs for Feature Selection using Generative Adversarial NetworksOral95 citations
- Relational Forward Models for Multi-Agent LearningPoster95 citations
- Approximability of Discriminators Implies Diversity in GANsPoster93 citations
- L2-Nonexpansive Neural NetworksPoster93 citations
- StrokeNet: A Neural Painting EnvironmentPoster93 citations
- Disjoint Mapping Network for Cross-modal Matching of Voices and FacesPoster92 citations
- Aggregated Momentum: Stability Through Passive DampingPoster91 citations
- Automatically Composing Representation Transformations as a Means for GeneralizationPoster91 citations
- Rigorous Agent Evaluation: An Adversarial Approach to Uncover Catastrophic FailuresPoster91 citations
- A Generative Model For Electron PathsPoster90 citations
- Adversarial Imitation via Variational Inverse Reinforcement LearningPoster90 citations
- Adversarial Domain Adaptation for Stable Brain-Machine InterfacesPoster89 citations
- Fluctuation-dissipation relations for stochastic gradient descentPoster89 citations
- Generative Question Answering: Learning to Answer the Whole QuestionPoster89 citations
- Visual Explanation by Interpretation: Improving Visual Feedback Capabilities of Deep Neural NetworksPoster89 citations
- Biologically-Plausible Learning Algorithms Can Scale to Large DatasetsPoster88 citations
- Learning Implicitly Recurrent CNNs Through Parameter SharingPoster88 citations
- Minimal Random Code Learning: Getting Bits Back from Compressed Model ParametersPoster88 citations
- Tree-Structured Recurrent Switching Linear Dynamical Systems for Multi-Scale ModelingPoster88 citations
- Function Space Particle Optimization for Bayesian Neural NetworksPoster87 citations
- Multi-Domain Adversarial LearningPoster87 citations
- Recall Traces: Backtracking Models for Efficient Reinforcement LearningPoster87 citations
- SGD Converges to Global Minimum in Deep Learning via Star-convex PathPoster86 citations
- Scalable Unbalanced Optimal Transport using Generative Adversarial NetworksPoster86 citations
- Von Mises-Fisher Loss for Training Sequence to Sequence Models with Continuous OutputsPoster86 citations
- Integer Networks for Data Compression with Latent-Variable ModelsPoster85 citations
- Knowledge Flow: Improve Upon Your TeachersPoster84 citations
- Unsupervised Discovery of Parts, Structure, and DynamicsPoster84 citations
- Unsupervised Hyper-alignment for Multilingual Word EmbeddingsPoster84 citations
- Environment Probing Interaction PoliciesPoster83 citations
- signSGD via Zeroth-Order OraclePoster83 citations
- A Direct Approach to Robust Deep Learning Using Adversarial NetworksPoster82 citations
- Stochastic Gradient/Mirror Descent: Minimax Optimality and Implicit RegularizationPoster82 citations
- DeepOBS: A Deep Learning Optimizer Benchmark SuitePoster81 citations
- STCN: Stochastic Temporal Convolutional NetworksPoster81 citations
- ARM: Augment-REINFORCE-Merge Gradient for Stochastic Binary NetworksPoster80 citations
- AdaShift: Decorrelation and Convergence of Adaptive Learning Rate MethodsPoster80 citations
- Deep, Skinny Neural Networks are not Universal ApproximatorsPoster80 citations
- Transferring Knowledge across Learning ProcessesOral80 citations
- K for the Price of 1: Parameter-efficient Multi-task and Transfer LearningPoster79 citations
- Coarse-grain Fine-grain Coattention Network for Multi-evidence Question AnsweringPoster78 citations
- Complement Objective TrainingPoster76 citations
- Guiding Policies with Language via Meta-LearningPoster75 citations
- Learning Latent Superstructures in Variational Autoencoders for Deep Multidimensional ClusteringPoster75 citations
- Learning concise representations for regression by evolving networks of treesPoster75 citations
- Sample Efficient Imitation Learning for Continuous ControlPoster75 citations
- LEARNING FACTORIZED REPRESENTATIONS FOR OPEN-SET DOMAIN ADAPTATIONPoster74 citations
- Multilingual Neural Machine Translation With Soft Decoupled EncodingPoster74 citations
- Competitive experience replayPoster72 citations
- Preferences Implicit in the State of the WorldPoster72 citations
- Learning Two-layer Neural Networks with Symmetric InputsPoster71 citations
- Towards GAN Benchmarks Which Require GeneralizationPoster71 citations
- Augmented Cyclic Adversarial Learning for Low Resource Domain AdaptationPoster70 citations
- Learning Self-Imitating Diverse PoliciesPoster70 citations
- Learning to Navigate the WebPoster70 citations
- Dynamic Sparse Graph for Efficient Deep LearningPoster69 citations
- Multi-Agent Dual LearningPoster69 citations
- Whitening and Coloring Batch Transform for GANsPoster69 citations
- Differentiable Perturb-and-Parse: Semi-Supervised Parsing with a Structured Variational AutoencoderPoster68 citations
- On the Sensitivity of Adversarial Robustness to Input Data DistributionsPoster68 citations
- RNNs implicitly implement tensor-product representationsPoster68 citations
- Active Learning with Partial FeedbackPoster67 citations
- Unsupervised Domain Adaptation for Distance Metric LearningPoster66 citations
- Variational Bayesian Phylogenetic InferencePoster66 citations
- M^3RL: Mind-aware Multi-agent Management Reinforcement LearningPoster65 citations
- Soft Q-Learning with Mutual-Information RegularizationPoster65 citations
- Learning to Describe Scenes with ProgramsPoster64 citations
- Maximal Divergence Sequential Autoencoder for Binary Software Vulnerability DetectionPoster64 citations
- A rotation-equivariant convolutional neural network model of primary visual cortexPoster63 citations
- Subgradient Descent Learns Orthogonal DictionariesPoster61 citations
- Conditional Network EmbeddingsPoster60 citations
- Don't Settle for Average, Go for the Max: Fuzzy Sets and Max-Pooled Word VectorsPoster60 citations
- Feature-Wise Bias AmplificationPoster60 citations
- Harmonic Unpaired Image-to-image TranslationPoster60 citations
- Max-MIG: an Information Theoretic Approach for Joint Learning from CrowdsPoster60 citations
- Bayesian Policy Optimization for Model UncertaintyPoster59 citations
- Combinatorial Attacks on Binarized Neural NetworksPoster59 citations
- Dynamically Unfolding Recurrent Restorer: A Moving Endpoint Control Method for Image RestorationPoster59 citations
- Probabilistic Planning with Sequential Monte Carlo methodsPoster58 citations
- Universal Stagewise Learning for Non-Convex Problems with Convergence on Averaged SolutionsPoster58 citations
- A new dog learns old tricks: RL finds classic optimization algorithmsPoster57 citations
- Per-Tensor Fixed-Point Quantization of the Back-Propagation AlgorithmPoster57 citations
- Two-Timescale Networks for Nonlinear Value Function ApproximationPoster57 citations
- Bayesian Prediction of Future Street Scenes using Synthetic LikelihoodsPoster56 citations
- h-detach: Modifying the LSTM Gradient Towards Better OptimizationPoster56 citations
- Deep Learning 3D Shapes Using Alt-az Anisotropic 2-Sphere ConvolutionPoster53 citations
- Optimal Completion Distillation for Sequence LearningPoster53 citations
- Towards Robust, Locally Linear Deep NetworksPoster53 citations
- Adaptive Estimators Show Information Compression in Deep Neural NetworksPoster52 citations
- Learnable Embedding Space for Efficient Neural Architecture CompressionPoster52 citations
- Solving the Rubik's Cube with Approximate Policy IterationPoster52 citations
- ANYTIME MINIBATCH: EXPLOITING STRAGGLERS IN ONLINE DISTRIBUTED OPTIMIZATIONPoster51 citations
- AutoLoss: Learning Discrete Schedule for Alternate OptimizationPoster51 citations
- Beyond Greedy Ranking: Slate Optimization via List-CVAEPoster51 citations
- Efficient Training on Very Large Corpora via Gramian EstimationPoster51 citations
- Synthetic Datasets for Neural Program SynthesisPoster51 citations
- Meta-Learning For Stochastic Gradient MCMCPoster50 citations
- ProbGAN: Towards Probabilistic GAN with Theoretical GuaranteesPoster50 citations
- RotDCF: Decomposition of Convolutional Filters for Rotation-Equivariant Deep NetworksPoster50 citations
- Verification of Non-Linear Specifications for Neural NetworksPoster50 citations
- Learning Grid Cells as Vector Representation of Self-Position Coupled with Matrix Representation of Self-MotionPoster49 citations
- Neural Speed Reading with Structural-Jump-LSTMPoster49 citations
- The Deep Weight PriorPoster49 citations
- Unsupervised Speech Recognition via Segmental Empirical Output Distribution MatchingPoster48 citations
- DOM-Q-NET: Grounded RL on Structured LanguagePoster47 citations
- Energy-Constrained Compression for Deep Neural Networks via Weighted Sparse Projection and Layer Input MaskingPoster47 citations
- Deep Frank-Wolfe For Neural Network OptimizationPoster46 citations
- Emerging Disentanglement in Auto-Encoder Based Unsupervised Image Content TransferPoster46 citations
- Neural TTS Stylization with Adversarial and Collaborative GamesPoster45 citations
- Opportunistic Learning: Budgeted Cost-Sensitive Learning from Data StreamsPoster45 citations
- Spectral Inference Networks: Unifying Deep and Spectral LearningPoster45 citations
- ACCELERATING NONCONVEX LEARNING VIA REPLICA EXCHANGE LANGEVIN DIFFUSIONPoster44 citations
- Improving Differentiable Neural Computers Through Memory Masking, De-allocation, and Link Distribution Sharpness ControlPoster44 citations
- Learning Embeddings into Entropic Wasserstein SpacesPoster44 citations
- Learning a Meta-Solver for Syntax-Guided Program SynthesisPoster44 citations
- Learning to Remember More with Less MemorizationOral44 citations
- MAE: Mutual Posterior-Divergence Regularization for Variational AutoEncodersPoster44 citations
- Accumulation Bit-Width Scaling For Ultra-Low Precision Training Of Deep NetworksPoster43 citations
- Posterior Attention Models for Sequence to Sequence LearningPoster43 citations
- Modeling the Long Term Future in Model-Based Reinforcement LearningPoster42 citations
- Revealing interpretable object representations from human behaviorPoster42 citations
- Diversity and Depth in Per-Example Routing ModelsPoster41 citations
- Generative predecessor models for sample-efficient imitation learningPoster41 citations
- Hierarchical Reinforcement Learning via Advantage-Weighted Information MaximizationPoster41 citations
- Mode NormalizationPoster41 citations
- On Random Deep Weight-Tied Autoencoders: Exact Asymptotic Analysis, Phase Transitions, and Implications to TrainingOral41 citations
- AD-VAT: An Asymmetric Dueling mechanism for learning Visual Active TrackingPoster40 citations
- Unsupervised Adversarial Image ReconstructionPoster40 citations
- Towards Metamerism via Foveated Style TransferPoster38 citations
- Value Propagation NetworksPoster38 citations
- Analysis of Quantized ModelsPoster37 citations
- Label super-resolution networksPoster37 citations
- Variance Networks: When Expectation Does Not Meet Your ExpectationsPoster37 citations
- Wasserstein Barycenter Model EnsemblingPoster37 citations
- G-SGD: Optimizing ReLU Neural Networks in its Positively Scale-Invariant SpacePoster35 citations
- Learning Recurrent Binary/Ternary WeightsPoster35 citations
- Optimal Transport Maps For Distribution Preserving Operations on Latent Spaces of Generative ModelsPoster35 citations
- A Data-Driven and Distributed Approach to Sparse Signal Representation and RecoveryPoster33 citations
- Efficient Augmentation via Data SubsamplingPoster33 citations
- Minimal Images in Deep Neural Networks: Fragile Object Recognition in Natural ImagesPoster33 citations
- Overcoming the Disentanglement vs Reconstruction Trade-off via Jacobian SupervisionPoster33 citations
- Representing Formal Languages: A Comparison Between Finite Automata and Recurrent Neural NetworksPoster33 citations
- Harmonizing Maximum Likelihood with GANs for Multimodal Conditional GenerationPoster32 citations
- Learning Representations of Sets through Optimized PermutationsPoster32 citations
- Auxiliary Variational MCMCPoster31 citations
- On the Universal Approximability and Complexity Bounds of Quantized ReLU Neural NetworksPoster31 citations
- Supervised Policy Update for Deep Reinforcement LearningPoster31 citations
- Human-level Protein Localization with Convolutional Neural NetworksPoster29 citations
- Latent Convolutional ModelsPoster29 citations
- Learning sparse relational transition modelsPoster29 citations
- Variational Autoencoders with Jointly Optimized Latent Dependency StructurePoster29 citations
- Discovery of Natural Language Concepts in Individual Units of CNNsPoster28 citations
- Generalized Tensor Models for Recurrent Neural NetworksPoster28 citations
- Post Selection Inference with Incomplete Maximum Mean Discrepancy EstimatorPoster28 citations
- Learning to Screen for Fast Softmax Inference on Large Vocabulary Neural NetworksPoster27 citations
- Learning what you can do before doing anythingPoster27 citations
- Bounce and Learn: Modeling Scene Dynamics with Real-World BouncesPoster26 citations
- Cost-Sensitive Robustness against Adversarial ExamplesPoster26 citations
- Don't let your Discriminator be fooledPoster26 citations
- Kernel RNN Learning (KeRNL)Poster26 citations
- On Computation and Generalization of Generative Adversarial Networks under Spectrum ControlPoster26 citations
- Deep Layers as Stochastic SolversPoster25 citations
- Detecting Egregious Responses in Neural Sequence-to-sequence ModelsPoster25 citations
- Feed-forward Propagation in Probabilistic Neural Networks with Categorical and Max LayersPoster25 citations
- GO Gradient for Expectation-Based ObjectivesPoster25 citations
- Imposing Category Trees Onto Word-Embeddings Using A Geometric ConstructionPoster24 citations
- NOODL: Provable Online Dictionary Learning and Sparse CodingPoster24 citations
- Transfer Learning for Sequences via Learning to CollocatePoster24 citations
- Off-Policy Evaluation and Learning from Logged Bandit Feedback: Error Reduction via Surrogate PolicyPoster23 citations
- Distribution-Interpolation Trade off in Generative ModelsPoster22 citations
- A Max-Affine Spline Perspective of Recurrent Neural NetworksPoster21 citations
- Feature Intertwiner for Object DetectionPoster21 citations
- Large-Scale Answerer in Questioner's Mind for Visual Dialog Question GenerationPoster21 citations
- Learning Procedural Abstractions and Evaluating Discrete Latent Temporal StructurePoster21 citations
- textTOvec: DEEP CONTEXTUALIZED NEURAL AUTOREGRESSIVE TOPIC MODELS OF LANGUAGE WITH DISTRIBUTED COMPOSITIONAL PRIORPoster21 citations
- From Hard to Soft: Understanding Deep Network Nonlinearities via Vector Quantization and Statistical InferencePoster20 citations
- Hierarchical RL Using an Ensemble of Proprioceptive Periodic PoliciesPoster20 citations
- Top-Down Neural Model For FormulaePoster20 citations
- Visceral Machines: Risk-Aversion in Reinforcement Learning with Intrinsic Physiological RewardsPoster19 citations
- A2BCD: Asynchronous Acceleration with Optimal ComplexityPoster18 citations
- CBOW Is Not All You Need: Combining CBOW with the Compositional Matrix Space ModelPoster18 citations
- A Kernel Random Matrix-Based Approach for Sparse PCAPoster17 citations
- Neural network gradient-based learning of black-box function interfacesPoster17 citations
- Visual Reasoning by Progressive Module NetworksPoster17 citations
- Convolutional Neural Networks on Non-uniform Geometrical Signals Using Euclidean Spectral TransformationPoster16 citations
- Preconditioner on Matrix Lie Group for SGDPoster16 citations
- Dimensionality Reduction for Representing the Knowledge of Probabilistic ModelsPoster15 citations
- Generating Liquid Simulations with Deformation-aware Neural NetworksPoster15 citations
- LeMoNADe: Learned Motif and Neuronal Assembly Detection in calcium imaging videosPoster15 citations
- Double Viterbi: Weight Encoding for High Compression Ratio and Fast On-Chip Reconstruction for Deep Neural NetworkPoster14 citations
- Learning Programmatically Structured Representations with Perceptor GradientsPoster13 citations
- Marginal Policy Gradients: A Unified Family of Estimators for Bounded Action Spaces with ApplicationsPoster13 citations
- Minimum Divergence vs. Maximum Margin: an Empirical Comparison on Seq2Seq ModelsPoster12 citations
- Random mesh projectors for inverse problemsPoster12 citations
- Understanding Composition of Word Embeddings via Tensor DecompositionPoster12 citations
- Efficiently testing local optimality and escaping saddles for ReLU networksPoster11 citations
- Sparse Dictionary Learning by Dynamical Neural NetworksPoster11 citations
- DISTRIBUTIONAL CONCAVITY REGULARIZATION FOR GANSPoster9 citations
- Initialized Equilibrium Propagation for Backprop-Free TrainingPoster9 citations
- NADPEx: An on-policy temporally consistent exploration method for deep reinforcement learningPoster9 citations
- The Comparative Power of ReLU Networks and Polynomial Kernels in the Presence of Sparse Latent StructurePoster8 citations
- Unsupervised Learning of the Set of Local MaximaPoster6 citations
- Information Theoretic lower bounds on negative log likelihoodPoster4 citations
- ROBUST ESTIMATION VIA GENERATIVE ADVERSARIAL NETWORKSPoster3 citations
- Variational Smoothing in Recurrent Neural Network Language ModelsPoster3 citations
- Adversarial Attacks on Graph Neural Networks via Meta LearningPoster
- Defensive Quantization: When Efficiency Meets RobustnessPoster
- Equi-normalization of Neural NetworksPoster
- Music Transformer: Generating Music with Long-Term StructurePoster
- PeerNets: Exploiting Peer Wisdom Against Adversarial AttacksPoster
- Sliced Wasserstein Auto-EncodersPoster
- The role of over-parametrization in generalization of neural networksPoster
ICLR accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.